உள்ளடக்கத்துக்குச் செல்
வரம்புகளும் இருப்பும்

வரம்புகளும் இருப்பும்

ஒவ்வொரு கோரிக்கையும் சமமாக வழங்கப்படுகிறது. rate நிலைகள் இல்லை. தனி API ஒதுக்கீடு இல்லை. உங்கள் டோக்கன்களுக்கு ஏற்கனவே பணம் செலுத்திவிட்டீர்கள் — உங்களுக்கு விருப்பமான வேகத்தில் பயன்படுத்துங்கள்.

உங்கள் இருப்பு எதனால் ஆனது, ஒரு கோரிக்கை எதை ஒதுக்கி எவ்வளவு செலவாகிறது, எத்தனை கோரிக்கைகள் அனுப்பலாம், மற்றும் ஒரு கோரிக்கை சந்திக்கக்கூடிய சில வரம்புகள் ஆகியவற்றை இந்தப் பக்கம் விளக்குகிறது.

இருப்பிலுள்ள 1M டோக்கன்களின் மதிப்பு
$5.00
தினசரி ஒதுக்கீடு புதுப்பிக்கப்படும்
00:00 UTC
ஃப்ளட் பாதுகாப்பு, கணக்குக்கு
120 கோரிக்கைகள் / நிமிடம்

கோரிக்கைகள் எவ்வாறு வழங்கப்படுகின்றன

  • rate நிலைகள் இல்லை — கோரிக்கைகள் எவ்வளவு வேகமாக வரலாம் என்பதை ஒரே விதி வரையறுக்கிறது, அது ஒவ்வொரு கணக்கிற்கும் ஒவ்வொரு திட்டத்திற்கும் ஒன்றே: நிமிடத்துக்கு 120 கோரிக்கைகள். நிமிடத்துக்கான டோக்கன்களுக்கு வரம்பு இல்லை.
  • தனி API ஒதுக்கீடு இல்லை — API அரட்டையின் அதே இருப்பைச் செலவிடுகிறது. இன்றைய ஒதுக்கீட்டின் அளவைத் திட்டம் நிர்ணயிக்கிறது. அது கோரிக்கை வேகத்தை நிர்ணயிப்பதில்லை.
  • உங்களுக்கு விருப்பமான வேகத்தில் — இணையாக அனுப்பும் கோரிக்கைகள் ஏற்கப்பட்டு வரிசையில் காத்திருக்கும். இணையாக இருப்பதால் அவை மறுக்கப்படுவதில்லை.

உங்கள் இருப்பு

உங்கள் இருப்பு டோக்கன்களில் கணக்கிடப்படுகிறது. இருப்பிலுள்ள 1,000,000 டோக்கன்களின் மதிப்பு $5.00, மாடல்கள் & விலை பக்கத்திலுள்ள ஒவ்வொரு விலையும் அந்த மதிப்புடனான விகிதமாகும்.

எந்த நேரத்திலும் இருப்பு என்பது இரண்டு பகுதிகளின் கூட்டுத்தொகை.

  • இன்றைய திட்ட ஒதுக்கீடு — உங்கள் திட்டம் நிர்ணயிக்கும் டோக்கன்களின் எண்ணிக்கை. இது தினமும் 00:00 UTC-க்குப் புதிதாக வரும். நாளின் முடிவில் மீதமுள்ளது அடுத்த நாளுக்குச் செல்லாது.
  • வாங்கிய கிரெடிட் — நீங்கள் ஒரு பேக்காக வாங்கிய டோக்கன்கள். கிரெடிட் காலாவதியாகாது, Free உட்பட ஒவ்வொரு திட்டத்திலும் வேலை செய்யும்.
திட்டம் ஒரு நாளுக்கு டோக்கன்கள் மதிப்பு
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • செலவிடும் வரிசை — ஒவ்வொரு கோரிக்கையும் முதலில் இன்றைய திட்ட ஒதுக்கீட்டைச் செலவிடும். அந்த நாளில் ஒதுக்கீட்டைத் தாண்டும் அளவுக்கு மட்டுமே வாங்கிய கிரெடிட் பயன்படுத்தப்படும்.
  • அரட்டையும் API-யும் பகிர்கின்றன — ஒரு கணக்குக்கு ஒரே இருப்பு. API key அதன் உரிமையாளர் கணக்கின் இருப்பிலிருந்து, அரட்டையின் அதே விலைகளில் செலவிடும்.
  • பேக்குகள் — கிரெடிட் 1,000,000 ($5.00), 2,000,000 ($10.00) மற்றும் 5,000,000 ($25.00) டோக்கன் பேக்குகளாக, அல்லது 1,000,000 முதல் 100,000,000 டோக்கன்கள் வரை நீங்கள் விரும்பும் அளவாக, 1,000,000-க்கு $5.00 என்ற விலையில் விற்கப்படுகிறது.

கிரெடிட்டை ரீசார்ஜ் செய்க திட்டத்தை மாற்றவும்

ஒரு கோரிக்கை எதை ஒதுக்குகிறது, எவ்வளவு செலவாகிறது

  • ஒதுக்கீடு — கோரிக்கை வரும்போது அது தன் வெளியீட்டு அளவை உங்கள் இருப்பிலிருந்து ஒதுக்கும்: /v1/chat/completions மற்றும் /v1/messages-ல் max_tokens, /v1/responses-ல் max_output_tokens. /v1/chat/completions max_completion_tokens-ஐயும் படிக்கும். இயல்புநிலை 4,096, வரம்பு 1 முதல் 65,536.
  • ஏற்பு — ஒதுக்கீடு உங்கள் இருப்பில் மீதமுள்ளதற்குள் பொருந்தினால் மட்டுமே கோரிக்கை ஏற்கப்படும். பூஜ்யத்துக்கு மேல் இருந்தாலும் வெளியீட்டு வரம்பை விடக் குறைவான இருப்புக்கு Quota exceeded பதில் வரும். மீதமுள்ளதைப் பயன்படுத்த சிறிய max_tokens அனுப்புங்கள்.
  • தீர்வு — பதில் முழுமையானதும், ஒதுக்கீடு உண்மையான கட்டணத்தால் மாற்றப்படும். கட்டணம் ஒதுக்கீட்டை விடக் குறைவாகவோ அதிகமாகவோ இருக்கலாம்.
  • திருப்புதல் — பிழை நிலையுடன் முடியும் கோரிக்கை தன் ஒதுக்கீட்டை முழுமையாகத் திருப்பித் தரும்.

உண்மையான கட்டணம் மாடல் குடும்பத்தைப் பொறுத்தது.

மாடல்கள் கட்டணம் விதிக்கப்படுவது
Shannon மாடல்கள் மாடலின் 1M-க்கான விலையில் usage.total_tokens. உள்ளீடு மற்றும் வெளியீட்டுக்கு ஒரே விலை.
ஹோஸ்ட் செய்யப்பட்ட open-weight மாடல்கள் cache செய்யாத உள்ளீடு உள்ளீட்டு விலையில், cache செய்த உள்ளீடு cache விலையில், வெளியீடு வெளியீட்டு விலையில்.

USD தொகை உங்கள் இருப்பிலிருந்து 1,000,000-க்கு $5.00 என டோக்கன்களில் எடுக்கப்பட்டு, முழு டோக்கனாக முழுதாக்கப்படும்.

POST /v1/tokenize அல்லது POST /v1/messages/count_tokens மூலம் டோக்கன்களை எண்ணுவது இலவசம், எதையும் ஒதுக்காது. Token எண்ணிக்கை

இருப்பையும் பயன்பாட்டையும் எங்கே பார்ப்பது

Keys & usage பக்கம் நீங்கள் இப்போது செலவிடக்கூடியதையும், இன்றைய திட்ட ஒதுக்கீட்டையும், வாங்கிய கிரெடிட்டையும், கடந்த 30 நாட்களின் API செலவையும் காட்டும். அதன் கீழே உங்கள் key செய்த ஒவ்வொரு கோரிக்கையையும் பட்டியலிடும்: நேரம், endpoint, மாடல், cache செய்த உள்ளீடு, கட்டணம் விதிக்கப்பட்ட டோக்கன்கள் மற்றும் செலவு. Keys & usage

ஒவ்வொரு பதிலும் அந்த அழைப்பின் டோக்கன் எண்ணிக்கைகள் கொண்ட usage object-ஐயும் கொண்டிருக்கும்.

எண்ட்பாயிண்ட் usage-ன் புலங்கள் ஹோஸ்ட் செய்யப்பட்ட open-weight மாடல்கள் சேர்ப்பவை
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage மாடலின் டோக்கன் எண்ணிக்கைகளைக் கொண்டிருக்கும். உங்கள் இருப்பிலிருந்து எடுக்கப்பட்ட தொகை பதிலில் இல்லை: அது Keys & usage-ல் உள்ள கோரிக்கைப் பட்டியலின் Billed tokens நெடுவரிசை.
  • ஹோஸ்ட் செய்யப்பட்ட open-weight மாடலுடன் /v1/messages-ல், input_tokens என்பது உள்ளீட்டின் cache செய்யாத பகுதி, cache_read_input_tokens cache செய்த பகுதி, cache_creation_input_tokens எப்போதும் 0.
  • /v1/chat/completions-ல் stream தன் கடைசி chunk-ல் [DONE]-க்கு முன் usage-ஐக் கொண்டிருக்கும். ஸ்ட்ரீமிங்

இருப்பு தீர்ந்தால்

ஒதுக்கீடு உங்கள் இருப்புக்குள் பொருந்தாத கோரிக்கைக்கு நிலை 429, வகை rate_limit_error மற்றும் கீழே உள்ள செய்தியுடன் பதில் வரும். கட்டணம் எதுவும் இல்லை. இருப்பு பூஜ்யத்துக்கு மேல் இருந்தாலும் கோரிக்கையின் வெளியீட்டு வரம்பை விடக் குறைவாக இருந்தால் அதே பதில் அனுப்பப்படும்.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses-ல் error object code மற்றும் param-ஐயும் கொண்டிருக்கலாம், இரண்டும் null.

நீங்கள் செய்யக்கூடியவை:

  • 00:00 UTC-ல் அடுத்த திட்ட ஒதுக்கீடு வரை காத்திருங்கள்.
  • கிரெடிட்டை ரீசார்ஜ் செய்யுங்கள். கிரெடிட் திட்ட ஒதுக்கீட்டுக்குப் பிறகு செலவிடப்படும், காலாவதியாகாது. கிரெடிட்டை ரீசார்ஜ் செய்க
  • பெரிய தினசரி ஒதுக்கீடு உள்ள திட்டத்துக்கு மாறுங்கள். திட்டத்தை மாற்றவும்
  • சிறிது இருப்பு மீதமிருந்தால், சிறிய max_tokens அனுப்புங்கள்: ஒதுக்கீடு அப்போது சிறியதாகும்.

Shannon Coder அழைப்பு ஒதுக்கீடு

/v1/chat/completions மற்றும் /v1/messages-ல் shannon-coder-1 டோக்கன்களில் அல்ல, அழைப்புகளில் கணக்கிடப்படுகிறது. ஒவ்வொரு திட்டமும் 4 மணி நேர சாளரத்துக்கு குறிப்பிட்ட எண்ணிக்கையிலான அழைப்புகளைக் கொண்டுள்ளது. ஒரு கோரிக்கை ஒரு அழைப்பு.

திட்டம் 4 மணி நேர சாளரத்துக்கு அழைப்புகள்
Free 3
Plus 20
Standard 40
Pro 60
  • சாளரங்கள் 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-ல் தொடங்கும். சாளரத்தின் முடிவில் மீதமுள்ள அழைப்புகள் அடுத்ததற்குச் செல்லாது.
  • கோரிக்கை ஏற்கப்படும்போது, மாடல் பதிலளிக்கும் முன்பே, ஒரு அழைப்பு கணக்கிடப்படுகிறது. அதன் பிறகு தோல்வியடையும் கோரிக்கையும் ஒரு அழைப்பாகவே கணக்கிடப்படும்.
  • இந்த அழைப்புகள் டோக்கன்களை ஒதுக்குவதில்லை, உங்கள் இருப்பிலிருந்து எதையும் எடுப்பதில்லை. Keys & usage-ல் உள்ள கோரிக்கைப் பட்டியல் அவற்றின் டோக்கன் எண்ணிக்கையையும், பட்டியலிடப்பட்ட விலையில் அதன் மதிப்பையும் காட்டும்.
  • இந்த இரண்டு endpoint-களில் shannon-coder-1-ன் இயல்புநிலை max_tokens 65,536.
  • அழைப்புகள் மீதமில்லாதபோது பதில் நிலை 429, வகை rate_limit_error, செய்தி Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan.
  • /v1/responses-ல் shannon-coder-1-க்கு அழைப்பு ஒதுக்கீடு இல்லை: மற்ற மாடல்களைப் போலவே, உங்கள் இருப்பிலிருந்து 1M-க்கு $8.00 என டோக்கன்களில் கட்டணம் விதிக்கப்படும்.

ஃப்ளட் பாதுகாப்பு

ஒரு கணக்கு நிமிடத்துக்கு 120 கோரிக்கைகள் அனுப்பலாம். கோரிக்கை வேகத்துக்கான ஒரே வரம்பு இதுவே, ஒவ்வொரு திட்டத்திலும் ஒன்றே. இது வெள்ளம் போன்ற கோரிக்கைகளை நிறுத்த உள்ளது, சாதாரணப் பயன்பாட்டை மெதுவாக்க அல்ல.

  • நிமிடம் என்பது உங்கள் முதல் கோரிக்கையுடன் திறக்கும் 60 வினாடிகளின் நிலையான சாளரம். அது முடிந்ததும் எண்ணிக்கை மீண்டும் பூஜ்யத்திலிருந்து தொடங்கும்.
  • எண்ணிக்கை கணக்கு வாரியானது, key வாரியோ IP முகவரி வாரியோ அல்ல. key-ஐ மாற்றுவது புதிய சாளரத்தைத் திறக்காது.
  • ஒரு சாளரத்துக்குள் 121-வது கோரிக்கைக்கு நிலை 429, வகை rate_limit_error மற்றும் செய்தி Too many requests. Retry in <N>s. வரும். N என்பது சாளரம் முடிய உள்ள வினாடிகள், 1 முதல் 60 வரை.
  • இருப்புக்கு முன்பே ஃப்ளட் பாதுகாப்பு சரிபார்க்கப்படும். அது மறுக்கும் கோரிக்கை எதையும் ஒதுக்குவதில்லை, கட்டணமும் இல்லை.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
கோரிக்கை ஃப்ளட் பாதுகாப்பு
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses கணக்கிடப்படும், ஒரு கோரிக்கைக்கு ஒன்று.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens கணக்கிடப்படாது.
/v1/chat/completions மற்றும் /v1/messages-ல் shannon-coder-1 அதற்குப் பதிலாக Shannon Coder அழைப்பு ஒதுக்கீட்டால் கணக்கிடப்படும்.
401 உடன், அல்லது தெரியாத model-க்கு 400 உடன் பதிலளிக்கப்பட்ட கோரிக்கை கணக்கிடப்படாது.
ஃப்ளட் பாதுகாப்பால் மறுக்கப்பட்ட கோரிக்கை சாளரத்தில் கணக்கிடப்படும். கட்டணம் எதுவும் இல்லை.

இணைக் கோரிக்கைகள்

ஒரு கணக்கு ஒரே நேரத்தில் எத்தனை கோரிக்கைகளைத் திறந்து வைத்திருக்கலாம் என்பதற்கு வரம்பு இல்லை, இணையாக அனுப்புவதற்குப் பிழையும் இல்லை. உடனே தொடங்க முடியாத கோரிக்கைகள் வரிசையில் காத்திருந்து முறைப்படி பதிலளிக்கப்படும்.

  • முந்தைய கோரிக்கைகள் முடிந்தாலும் முடியாவிட்டாலும், ஒவ்வொரு கோரிக்கையும் வரும்போது நிமிடத்துக்கு 120 என்ற எண்ணிக்கையில் சேரும்.
  • ஒவ்வொரு கோரிக்கையும் முடியும் வரை தன் ஒதுக்கீட்டைத் தக்கவைக்கும். இயல்பு வெளியீட்டு அளவுடன் திறந்திருக்கும் இருபது கோரிக்கைகள் 20 × 4,096 = 81,920 டோக்கன் இருப்பைத் தக்கவைக்கும். ஒதுக்கீடுகள் சேர்ந்து உங்கள் இருப்பை விடப் பெரிதாக இருந்தால், முடிந்த அழைப்புகள் குறைவாகச் செலவாகியிருக்கும் என்றாலும், அடுத்த கோரிக்கை Quota exceeded பதிலைப் பெறும். சிறிய max_tokens குறைவாகத் தக்கவைக்கும்.
  • streaming இல்லாத கோரிக்கை பதில் முழுமையாகும் வரை எதுவும் அனுப்பாது, எனவே அந்தக் காத்திருப்பை உள்ளடக்கும் timeout-ஐ உங்கள் கிளையன்ட்டுக்குக் கொடுங்கள். stream காத்திருக்கும்போதும் இணைப்பைத் திறந்தே வைத்திருக்கும். ஸ்ட்ரீமிங்

ஒரு கோரிக்கையின் வரம்புகள்

வரம்பு மதிப்பு பொருந்தும் இடம் வரம்பை அடையும்போது
கோரிக்கை body 32 MiB (33,554,432 பைட்டுகள்) ஒவ்வொரு endpoint-ம் நிலை 413, வகை invalid_request_error.
வெளியீட்டு அளவு: max_tokens, max_completion_tokens, max_output_tokens 1 முதல் 65,536 வரை. இயல்புநிலை 4,096; /v1/chat/completions மற்றும் /v1/messages-ல் shannon-coder-1-க்கு இயல்புநிலை 65,536. ஒவ்வொரு மாடலிலும், உங்கள் இருப்பிலிருந்து ஒதுக்கப்படும் அளவாக. பதிலின் நீளத்தின் வரம்பாக: ஹோஸ்ட் செய்யப்பட்ட open-weight மாடல்கள், shannon-1.6-lite, shannon-1.6-pro மற்றும் shannon-coder-1. வரம்புக்கு வெளியே உள்ள மதிப்பு வரம்பின் அருகிலுள்ள எல்லைக்குக் கொண்டுவரப்படும். பிழை இல்லை.
நிறுத்த வரிசைகள்: stop, stop_sequences 4 strings ஹோஸ்ட் செய்யப்பட்ட open-weight மாடல்கள் காலியாக இல்லாத முதல் 4 strings பயன்படுத்தப்படும்.
URL ஆகக் கொடுத்த படம் அல்லது கோப்பு 8 MiB, 20 வினாடிகளுக்குள் படிக்கப்படும், அதிகபட்சம் 5 திசைதிருப்பல்கள், பொது http அல்லது https முகவரி படங்களையோ கோப்புகளையோ ஏற்கும் ஒவ்வொரு endpoint-ம் அந்தப் பகுதி இல்லாமலே கோரிக்கைக்குப் பதிலளிக்கப்படும். பிழை இல்லை.
inline ஆக (base64) அனுப்பிய படம் அல்லது கோப்பு தனி வரம்பு இல்லை. இது 32 MiB கோரிக்கை body-யில் சேரும். படங்களையோ கோப்புகளையோ ஏற்கும் ஒவ்வொரு endpoint-ம் முழுக் கோரிக்கைக்கும் நிலை 413.
POST /v1/tokenize-ன் text 4,000,000 பைட்டுகள் /v1/tokenize நிலை 413, வகை invalid_request_error, செய்தி text too long.
POST /v1/tokenize-ன் messages மற்றும் POST /v1/messages/count_tokens-ன் body 32 MiB கோரிக்கை body இரு எண்ணிக்கை endpoint-களும் நிலை 413.
Context window மாடல் வாரியாக: GET /v1/models-ல் context_window ஒவ்வொரு மாடலும் நீளமான உரையாடலுக்கு என்ன நடக்கும் என்பது மாடலைப் பொறுத்தது. மாடல்கள் & விலை
இணையத் தேடல்கள் (web_search: true) திட்டம் மற்றும் நாள் வாரியாக: Free 3, Plus 30, Standard 50, Pro 60. தேடல் முடிவுகள் கிடைத்த கோரிக்கைக்கு ஒரு தேடல் கணக்கிடப்படும். web_search: true அமைக்கும் கோரிக்கைகள் ஒதுக்கீடு மீதமில்லையென்றால் கோரிக்கை தேடல் இல்லாமல் பதிலளிக்கப்படும். பிழை இல்லை. உள்ளமைக்கப்பட்ட இணைய தேடல்

பிழைகள்

இந்தப் பக்கத்தின் பதில்கள். /v1/messages-ல் அதே error object {"type": "error", "error": {…}} என உள்ளே வைக்கப்படும்.

நிலை வகை செய்தி எப்போது, என்ன செய்வது
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan கோரிக்கையின் ஒதுக்கீடு உங்கள் இருப்புக்குள் பொருந்தவில்லை. 00:00 UTC வரை காத்திருங்கள், கிரெடிட்டை ரீசார்ஜ் செய்யுங்கள், திட்டத்தை மாற்றுங்கள், அல்லது சிறிய max_tokens அனுப்புங்கள்.
429 rate_limit_error Too many requests. Retry in <N>s. தற்போதைய நிமிடத்தில் 120-க்கும் மேற்பட்ட கோரிக்கைகள். N வினாடிகள் காத்திருந்து மீண்டும் அனுப்புங்கள்.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan தற்போதைய 4 மணி நேர சாளரத்தின் Shannon Coder அழைப்புகள் தீர்ந்துவிட்டன.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. மாடலால் இந்த நேரத்தில் கோரிக்கையை ஏற்க முடியாது. சிறிது இடைவெளிக்குப் பிறகு மீண்டும் அனுப்புங்கள்.
503 api_error Could not verify your quota right now. Please retry. உங்கள் இருப்பைப் படிக்க முடியவில்லை. கட்டணம் எதுவும் இல்லை; கோரிக்கையை மீண்டும் அனுப்புங்கள். Shannon மாடலுடன் /v1/responses-ல் நிலை 500.
413 invalid_request_error கோரிக்கை body 32 MiB-ஐ விடப் பெரியது. OpenAI வடிவ endpoint-களில் error object code: "request_too_large"-ஐக் கொண்டிருக்கும்.
413 invalid_request_error text too long POST /v1/tokenize-ன் text 4,000,000 பைட்டுகளை விட நீளமானது.