வரம்புகளும் இருப்பும்
ஒவ்வொரு கோரிக்கையும் சமமாக வழங்கப்படுகிறது. rate நிலைகள் இல்லை. தனி API ஒதுக்கீடு இல்லை. உங்கள் டோக்கன்களுக்கு ஏற்கனவே பணம் செலுத்திவிட்டீர்கள் — உங்களுக்கு விருப்பமான வேகத்தில் பயன்படுத்துங்கள்.
உங்கள் இருப்பு எதனால் ஆனது, ஒரு கோரிக்கை எதை ஒதுக்கி எவ்வளவு செலவாகிறது, எத்தனை கோரிக்கைகள் அனுப்பலாம், மற்றும் ஒரு கோரிக்கை சந்திக்கக்கூடிய சில வரம்புகள் ஆகியவற்றை இந்தப் பக்கம் விளக்குகிறது.
- இருப்பிலுள்ள 1M டோக்கன்களின் மதிப்பு
- $5.00
- தினசரி ஒதுக்கீடு புதுப்பிக்கப்படும்
- 00:00 UTC
- ஃப்ளட் பாதுகாப்பு, கணக்குக்கு
- 120 கோரிக்கைகள் / நிமிடம்
கோரிக்கைகள் எவ்வாறு வழங்கப்படுகின்றன
- rate நிலைகள் இல்லை — கோரிக்கைகள் எவ்வளவு வேகமாக வரலாம் என்பதை ஒரே விதி வரையறுக்கிறது, அது ஒவ்வொரு கணக்கிற்கும் ஒவ்வொரு திட்டத்திற்கும் ஒன்றே: நிமிடத்துக்கு 120 கோரிக்கைகள். நிமிடத்துக்கான டோக்கன்களுக்கு வரம்பு இல்லை.
- தனி API ஒதுக்கீடு இல்லை — API அரட்டையின் அதே இருப்பைச் செலவிடுகிறது. இன்றைய ஒதுக்கீட்டின் அளவைத் திட்டம் நிர்ணயிக்கிறது. அது கோரிக்கை வேகத்தை நிர்ணயிப்பதில்லை.
- உங்களுக்கு விருப்பமான வேகத்தில் — இணையாக அனுப்பும் கோரிக்கைகள் ஏற்கப்பட்டு வரிசையில் காத்திருக்கும். இணையாக இருப்பதால் அவை மறுக்கப்படுவதில்லை.
உங்கள் இருப்பு
உங்கள் இருப்பு டோக்கன்களில் கணக்கிடப்படுகிறது. இருப்பிலுள்ள 1,000,000 டோக்கன்களின் மதிப்பு $5.00, மாடல்கள் & விலை பக்கத்திலுள்ள ஒவ்வொரு விலையும் அந்த மதிப்புடனான விகிதமாகும்.
எந்த நேரத்திலும் இருப்பு என்பது இரண்டு பகுதிகளின் கூட்டுத்தொகை.
- இன்றைய திட்ட ஒதுக்கீடு — உங்கள் திட்டம் நிர்ணயிக்கும் டோக்கன்களின் எண்ணிக்கை. இது தினமும் 00:00 UTC-க்குப் புதிதாக வரும். நாளின் முடிவில் மீதமுள்ளது அடுத்த நாளுக்குச் செல்லாது.
- வாங்கிய கிரெடிட் — நீங்கள் ஒரு பேக்காக வாங்கிய டோக்கன்கள். கிரெடிட் காலாவதியாகாது, Free உட்பட ஒவ்வொரு திட்டத்திலும் வேலை செய்யும்.
| திட்டம் | ஒரு நாளுக்கு டோக்கன்கள் | மதிப்பு |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- செலவிடும் வரிசை — ஒவ்வொரு கோரிக்கையும் முதலில் இன்றைய திட்ட ஒதுக்கீட்டைச் செலவிடும். அந்த நாளில் ஒதுக்கீட்டைத் தாண்டும் அளவுக்கு மட்டுமே வாங்கிய கிரெடிட் பயன்படுத்தப்படும்.
- அரட்டையும் API-யும் பகிர்கின்றன — ஒரு கணக்குக்கு ஒரே இருப்பு. API key அதன் உரிமையாளர் கணக்கின் இருப்பிலிருந்து, அரட்டையின் அதே விலைகளில் செலவிடும்.
- பேக்குகள் — கிரெடிட் 1,000,000 ($5.00), 2,000,000 ($10.00) மற்றும் 5,000,000 ($25.00) டோக்கன் பேக்குகளாக, அல்லது 1,000,000 முதல் 100,000,000 டோக்கன்கள் வரை நீங்கள் விரும்பும் அளவாக, 1,000,000-க்கு $5.00 என்ற விலையில் விற்கப்படுகிறது.
கிரெடிட்டை ரீசார்ஜ் செய்க திட்டத்தை மாற்றவும்
ஒரு கோரிக்கை எதை ஒதுக்குகிறது, எவ்வளவு செலவாகிறது
- ஒதுக்கீடு — கோரிக்கை வரும்போது அது தன் வெளியீட்டு அளவை உங்கள் இருப்பிலிருந்து ஒதுக்கும்:
/v1/chat/completionsமற்றும்/v1/messages-ல்max_tokens,/v1/responses-ல்max_output_tokens./v1/chat/completionsmax_completion_tokens-ஐயும் படிக்கும். இயல்புநிலை 4,096, வரம்பு 1 முதல் 65,536. - ஏற்பு — ஒதுக்கீடு உங்கள் இருப்பில் மீதமுள்ளதற்குள் பொருந்தினால் மட்டுமே கோரிக்கை ஏற்கப்படும். பூஜ்யத்துக்கு மேல் இருந்தாலும் வெளியீட்டு வரம்பை விடக் குறைவான இருப்புக்கு
Quota exceededபதில் வரும். மீதமுள்ளதைப் பயன்படுத்த சிறியmax_tokensஅனுப்புங்கள். - தீர்வு — பதில் முழுமையானதும், ஒதுக்கீடு உண்மையான கட்டணத்தால் மாற்றப்படும். கட்டணம் ஒதுக்கீட்டை விடக் குறைவாகவோ அதிகமாகவோ இருக்கலாம்.
- திருப்புதல் — பிழை நிலையுடன் முடியும் கோரிக்கை தன் ஒதுக்கீட்டை முழுமையாகத் திருப்பித் தரும்.
உண்மையான கட்டணம் மாடல் குடும்பத்தைப் பொறுத்தது.
| மாடல்கள் | கட்டணம் விதிக்கப்படுவது |
|---|---|
| Shannon மாடல்கள் | மாடலின் 1M-க்கான விலையில் usage.total_tokens. உள்ளீடு மற்றும் வெளியீட்டுக்கு ஒரே விலை. |
| ஹோஸ்ட் செய்யப்பட்ட open-weight மாடல்கள் | cache செய்யாத உள்ளீடு உள்ளீட்டு விலையில், cache செய்த உள்ளீடு cache விலையில், வெளியீடு வெளியீட்டு விலையில். |
USD தொகை உங்கள் இருப்பிலிருந்து 1,000,000-க்கு $5.00 என டோக்கன்களில் எடுக்கப்பட்டு, முழு டோக்கனாக முழுதாக்கப்படும்.
POST /v1/tokenize அல்லது POST /v1/messages/count_tokens மூலம் டோக்கன்களை எண்ணுவது இலவசம், எதையும் ஒதுக்காது. Token எண்ணிக்கை
இருப்பையும் பயன்பாட்டையும் எங்கே பார்ப்பது
Keys & usage பக்கம் நீங்கள் இப்போது செலவிடக்கூடியதையும், இன்றைய திட்ட ஒதுக்கீட்டையும், வாங்கிய கிரெடிட்டையும், கடந்த 30 நாட்களின் API செலவையும் காட்டும். அதன் கீழே உங்கள் key செய்த ஒவ்வொரு கோரிக்கையையும் பட்டியலிடும்: நேரம், endpoint, மாடல், cache செய்த உள்ளீடு, கட்டணம் விதிக்கப்பட்ட டோக்கன்கள் மற்றும் செலவு. Keys & usage
ஒவ்வொரு பதிலும் அந்த அழைப்பின் டோக்கன் எண்ணிக்கைகள் கொண்ட usage object-ஐயும் கொண்டிருக்கும்.
| எண்ட்பாயிண்ட் | usage-ன் புலங்கள் | ஹோஸ்ட் செய்யப்பட்ட open-weight மாடல்கள் சேர்ப்பவை |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageமாடலின் டோக்கன் எண்ணிக்கைகளைக் கொண்டிருக்கும். உங்கள் இருப்பிலிருந்து எடுக்கப்பட்ட தொகை பதிலில் இல்லை: அது Keys & usage-ல் உள்ள கோரிக்கைப் பட்டியலின் Billed tokens நெடுவரிசை.- ஹோஸ்ட் செய்யப்பட்ட open-weight மாடலுடன்
/v1/messages-ல்,input_tokensஎன்பது உள்ளீட்டின் cache செய்யாத பகுதி,cache_read_input_tokenscache செய்த பகுதி,cache_creation_input_tokensஎப்போதும்0. -
/v1/chat/completions-ல் stream தன் கடைசி chunk-ல்[DONE]-க்கு முன்usage-ஐக் கொண்டிருக்கும். ஸ்ட்ரீமிங்
இருப்பு தீர்ந்தால்
ஒதுக்கீடு உங்கள் இருப்புக்குள் பொருந்தாத கோரிக்கைக்கு நிலை 429, வகை rate_limit_error மற்றும் கீழே உள்ள செய்தியுடன் பதில் வரும். கட்டணம் எதுவும் இல்லை. இருப்பு பூஜ்யத்துக்கு மேல் இருந்தாலும் கோரிக்கையின் வெளியீட்டு வரம்பை விடக் குறைவாக இருந்தால் அதே பதில் அனுப்பப்படும்.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses-ல் error object code மற்றும் param-ஐயும் கொண்டிருக்கலாம், இரண்டும் null.
நீங்கள் செய்யக்கூடியவை:
- 00:00 UTC-ல் அடுத்த திட்ட ஒதுக்கீடு வரை காத்திருங்கள்.
- கிரெடிட்டை ரீசார்ஜ் செய்யுங்கள். கிரெடிட் திட்ட ஒதுக்கீட்டுக்குப் பிறகு செலவிடப்படும், காலாவதியாகாது. கிரெடிட்டை ரீசார்ஜ் செய்க
- பெரிய தினசரி ஒதுக்கீடு உள்ள திட்டத்துக்கு மாறுங்கள். திட்டத்தை மாற்றவும்
- சிறிது இருப்பு மீதமிருந்தால், சிறிய
max_tokensஅனுப்புங்கள்: ஒதுக்கீடு அப்போது சிறியதாகும்.
Shannon Coder அழைப்பு ஒதுக்கீடு
/v1/chat/completions மற்றும் /v1/messages-ல் shannon-coder-1 டோக்கன்களில் அல்ல, அழைப்புகளில் கணக்கிடப்படுகிறது. ஒவ்வொரு திட்டமும் 4 மணி நேர சாளரத்துக்கு குறிப்பிட்ட எண்ணிக்கையிலான அழைப்புகளைக் கொண்டுள்ளது. ஒரு கோரிக்கை ஒரு அழைப்பு.
| திட்டம் | 4 மணி நேர சாளரத்துக்கு அழைப்புகள் |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- சாளரங்கள் 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-ல் தொடங்கும். சாளரத்தின் முடிவில் மீதமுள்ள அழைப்புகள் அடுத்ததற்குச் செல்லாது.
- கோரிக்கை ஏற்கப்படும்போது, மாடல் பதிலளிக்கும் முன்பே, ஒரு அழைப்பு கணக்கிடப்படுகிறது. அதன் பிறகு தோல்வியடையும் கோரிக்கையும் ஒரு அழைப்பாகவே கணக்கிடப்படும்.
- இந்த அழைப்புகள் டோக்கன்களை ஒதுக்குவதில்லை, உங்கள் இருப்பிலிருந்து எதையும் எடுப்பதில்லை. Keys & usage-ல் உள்ள கோரிக்கைப் பட்டியல் அவற்றின் டோக்கன் எண்ணிக்கையையும், பட்டியலிடப்பட்ட விலையில் அதன் மதிப்பையும் காட்டும்.
- இந்த இரண்டு endpoint-களில்
shannon-coder-1-ன் இயல்புநிலைmax_tokens65,536. - அழைப்புகள் மீதமில்லாதபோது பதில் நிலை
429, வகைrate_limit_error, செய்திShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan. /v1/responses-ல்shannon-coder-1-க்கு அழைப்பு ஒதுக்கீடு இல்லை: மற்ற மாடல்களைப் போலவே, உங்கள் இருப்பிலிருந்து 1M-க்கு $8.00 என டோக்கன்களில் கட்டணம் விதிக்கப்படும்.
ஃப்ளட் பாதுகாப்பு
ஒரு கணக்கு நிமிடத்துக்கு 120 கோரிக்கைகள் அனுப்பலாம். கோரிக்கை வேகத்துக்கான ஒரே வரம்பு இதுவே, ஒவ்வொரு திட்டத்திலும் ஒன்றே. இது வெள்ளம் போன்ற கோரிக்கைகளை நிறுத்த உள்ளது, சாதாரணப் பயன்பாட்டை மெதுவாக்க அல்ல.
- நிமிடம் என்பது உங்கள் முதல் கோரிக்கையுடன் திறக்கும் 60 வினாடிகளின் நிலையான சாளரம். அது முடிந்ததும் எண்ணிக்கை மீண்டும் பூஜ்யத்திலிருந்து தொடங்கும்.
- எண்ணிக்கை கணக்கு வாரியானது, key வாரியோ IP முகவரி வாரியோ அல்ல. key-ஐ மாற்றுவது புதிய சாளரத்தைத் திறக்காது.
- ஒரு சாளரத்துக்குள் 121-வது கோரிக்கைக்கு நிலை
429, வகைrate_limit_errorமற்றும் செய்திToo many requests. Retry in <N>s.வரும்.Nஎன்பது சாளரம் முடிய உள்ள வினாடிகள், 1 முதல் 60 வரை. - இருப்புக்கு முன்பே ஃப்ளட் பாதுகாப்பு சரிபார்க்கப்படும். அது மறுக்கும் கோரிக்கை எதையும் ஒதுக்குவதில்லை, கட்டணமும் இல்லை.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | கோரிக்கை | ஃப்ளட் பாதுகாப்பு |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | கணக்கிடப்படும், ஒரு கோரிக்கைக்கு ஒன்று. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | கணக்கிடப்படாது. |
/v1/chat/completions மற்றும் /v1/messages-ல் shannon-coder-1 | அதற்குப் பதிலாக Shannon Coder அழைப்பு ஒதுக்கீட்டால் கணக்கிடப்படும். |
401 உடன், அல்லது தெரியாத model-க்கு 400 உடன் பதிலளிக்கப்பட்ட கோரிக்கை | கணக்கிடப்படாது. |
| ஃப்ளட் பாதுகாப்பால் மறுக்கப்பட்ட கோரிக்கை | சாளரத்தில் கணக்கிடப்படும். கட்டணம் எதுவும் இல்லை. |
இணைக் கோரிக்கைகள்
ஒரு கணக்கு ஒரே நேரத்தில் எத்தனை கோரிக்கைகளைத் திறந்து வைத்திருக்கலாம் என்பதற்கு வரம்பு இல்லை, இணையாக அனுப்புவதற்குப் பிழையும் இல்லை. உடனே தொடங்க முடியாத கோரிக்கைகள் வரிசையில் காத்திருந்து முறைப்படி பதிலளிக்கப்படும்.
- முந்தைய கோரிக்கைகள் முடிந்தாலும் முடியாவிட்டாலும், ஒவ்வொரு கோரிக்கையும் வரும்போது நிமிடத்துக்கு 120 என்ற எண்ணிக்கையில் சேரும்.
- ஒவ்வொரு கோரிக்கையும் முடியும் வரை தன் ஒதுக்கீட்டைத் தக்கவைக்கும். இயல்பு வெளியீட்டு அளவுடன் திறந்திருக்கும் இருபது கோரிக்கைகள் 20 × 4,096 = 81,920 டோக்கன் இருப்பைத் தக்கவைக்கும். ஒதுக்கீடுகள் சேர்ந்து உங்கள் இருப்பை விடப் பெரிதாக இருந்தால், முடிந்த அழைப்புகள் குறைவாகச் செலவாகியிருக்கும் என்றாலும், அடுத்த கோரிக்கை
Quota exceededபதிலைப் பெறும். சிறியmax_tokensகுறைவாகத் தக்கவைக்கும். - streaming இல்லாத கோரிக்கை பதில் முழுமையாகும் வரை எதுவும் அனுப்பாது, எனவே அந்தக் காத்திருப்பை உள்ளடக்கும் timeout-ஐ உங்கள் கிளையன்ட்டுக்குக் கொடுங்கள். stream காத்திருக்கும்போதும் இணைப்பைத் திறந்தே வைத்திருக்கும். ஸ்ட்ரீமிங்
ஒரு கோரிக்கையின் வரம்புகள்
| வரம்பு | மதிப்பு | பொருந்தும் இடம் | வரம்பை அடையும்போது |
|---|---|---|---|
| கோரிக்கை body | 32 MiB (33,554,432 பைட்டுகள்) | ஒவ்வொரு endpoint-ம் | நிலை 413, வகை invalid_request_error. |
வெளியீட்டு அளவு: max_tokens, max_completion_tokens, max_output_tokens | 1 முதல் 65,536 வரை. இயல்புநிலை 4,096; /v1/chat/completions மற்றும் /v1/messages-ல் shannon-coder-1-க்கு இயல்புநிலை 65,536. | ஒவ்வொரு மாடலிலும், உங்கள் இருப்பிலிருந்து ஒதுக்கப்படும் அளவாக. பதிலின் நீளத்தின் வரம்பாக: ஹோஸ்ட் செய்யப்பட்ட open-weight மாடல்கள், shannon-1.6-lite, shannon-1.6-pro மற்றும் shannon-coder-1. | வரம்புக்கு வெளியே உள்ள மதிப்பு வரம்பின் அருகிலுள்ள எல்லைக்குக் கொண்டுவரப்படும். பிழை இல்லை. |
நிறுத்த வரிசைகள்: stop, stop_sequences | 4 strings | ஹோஸ்ட் செய்யப்பட்ட open-weight மாடல்கள் | காலியாக இல்லாத முதல் 4 strings பயன்படுத்தப்படும். |
| URL ஆகக் கொடுத்த படம் அல்லது கோப்பு | 8 MiB, 20 வினாடிகளுக்குள் படிக்கப்படும், அதிகபட்சம் 5 திசைதிருப்பல்கள், பொது http அல்லது https முகவரி | படங்களையோ கோப்புகளையோ ஏற்கும் ஒவ்வொரு endpoint-ம் | அந்தப் பகுதி இல்லாமலே கோரிக்கைக்குப் பதிலளிக்கப்படும். பிழை இல்லை. |
| inline ஆக (base64) அனுப்பிய படம் அல்லது கோப்பு | தனி வரம்பு இல்லை. இது 32 MiB கோரிக்கை body-யில் சேரும். | படங்களையோ கோப்புகளையோ ஏற்கும் ஒவ்வொரு endpoint-ம் | முழுக் கோரிக்கைக்கும் நிலை 413. |
POST /v1/tokenize-ன் text | 4,000,000 பைட்டுகள் | /v1/tokenize | நிலை 413, வகை invalid_request_error, செய்தி text too long. |
POST /v1/tokenize-ன் messages மற்றும் POST /v1/messages/count_tokens-ன் body | 32 MiB கோரிக்கை body | இரு எண்ணிக்கை endpoint-களும் | நிலை 413. |
| Context window | மாடல் வாரியாக: GET /v1/models-ல் context_window | ஒவ்வொரு மாடலும் | நீளமான உரையாடலுக்கு என்ன நடக்கும் என்பது மாடலைப் பொறுத்தது. மாடல்கள் & விலை |
இணையத் தேடல்கள் (web_search: true) | திட்டம் மற்றும் நாள் வாரியாக: Free 3, Plus 30, Standard 50, Pro 60. தேடல் முடிவுகள் கிடைத்த கோரிக்கைக்கு ஒரு தேடல் கணக்கிடப்படும். | web_search: true அமைக்கும் கோரிக்கைகள் | ஒதுக்கீடு மீதமில்லையென்றால் கோரிக்கை தேடல் இல்லாமல் பதிலளிக்கப்படும். பிழை இல்லை. உள்ளமைக்கப்பட்ட இணைய தேடல் |
பிழைகள்
இந்தப் பக்கத்தின் பதில்கள். /v1/messages-ல் அதே error object {"type": "error", "error": {…}} என உள்ளே வைக்கப்படும்.
| நிலை | வகை | செய்தி | எப்போது, என்ன செய்வது |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | கோரிக்கையின் ஒதுக்கீடு உங்கள் இருப்புக்குள் பொருந்தவில்லை. 00:00 UTC வரை காத்திருங்கள், கிரெடிட்டை ரீசார்ஜ் செய்யுங்கள், திட்டத்தை மாற்றுங்கள், அல்லது சிறிய max_tokens அனுப்புங்கள். |
429 | rate_limit_error | Too many requests. Retry in <N>s. | தற்போதைய நிமிடத்தில் 120-க்கும் மேற்பட்ட கோரிக்கைகள். N வினாடிகள் காத்திருந்து மீண்டும் அனுப்புங்கள். |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | தற்போதைய 4 மணி நேர சாளரத்தின் Shannon Coder அழைப்புகள் தீர்ந்துவிட்டன. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | மாடலால் இந்த நேரத்தில் கோரிக்கையை ஏற்க முடியாது. சிறிது இடைவெளிக்குப் பிறகு மீண்டும் அனுப்புங்கள். |
503 | api_error | Could not verify your quota right now. Please retry. | உங்கள் இருப்பைப் படிக்க முடியவில்லை. கட்டணம் எதுவும் இல்லை; கோரிக்கையை மீண்டும் அனுப்புங்கள். Shannon மாடலுடன் /v1/responses-ல் நிலை 500. |
413 | invalid_request_error | கோரிக்கை body 32 MiB-ஐ விடப் பெரியது. OpenAI வடிவ endpoint-களில் error object code: "request_too_large"-ஐக் கொண்டிருக்கும். | |
413 | invalid_request_error | text too long | POST /v1/tokenize-ன் text 4,000,000 பைட்டுகளை விட நீளமானது. |