සීමා සහ ශේෂය
සෑම ඉල්ලීමකටම එක සමානව සේවය කෙරේ. Rate tiers නැත. වෙනම API quota නැත. ඔබ දැනටමත් ඔබේ tokens සඳහා ගෙවා ඇත — ඒවා ඔබට හැකි තරම් වේගයෙන් භාවිතා කරන්න.
ඔබේ ශේෂය සෑදී ඇත්තේ කුමකින්ද, එක ඉල්ලීමක් වෙන් කරන්නේ සහ වැය වන්නේ කොපමණද, ඔබට ඉල්ලීම් කොපමණ ගණනක් යැවිය හැකිද, සහ එක ඉල්ලීමකට මුහුණ දිය හැකි සීමා කිහිපය මෙම පිටුවේ පැහැදිලි කරයි.
- ශේෂයේ tokens 1Mක වටිනාකම
- $5.00
- දෛනික ප්රමාණය අලුත් වේ
- 00:00 UTC
- ගිණුමකට ඉල්ලීම් ගණන සීමා කිරීම (flood protection)
- 120 ඉල්ලීම් / විනාඩියට
ඉල්ලීම්වලට සේවය කරන ආකාරය
- Rate tiers නැත — ඉල්ලීම් පැමිණිය හැකි වේගය එක නීතියකින් සීමා කෙරෙන අතර, එය සෑම ගිණුමකටම සහ සෑම සැලසුමකටම එකමය: විනාඩියකට ඉල්ලීම් 120. විනාඩියකට tokens සඳහා සීමාවක් නැත.
- වෙනම API quota නැත — API එක chat හි ශේෂයම වියදම් කරයි. සැලසුමක් අද දිනයේ ප්රමාණයේ විශාලත්වය නියම කරයි. එය ඉල්ලීම් වේගයක් නියම නොකරයි.
- ඔබට හැකි තරම් වේගයෙන් — සමාන්තරව යවන ඉල්ලීම් පිළිගෙන පෝලිමේ රැඳී සිටී. සමාන්තර වීම නිසා ඒවා ප්රතික්ෂේප නොකෙරේ.
ඔබේ ශේෂය
ඔබේ ශේෂය tokens වලින් ගණන් ගැනේ. ශේෂයේ tokens 1,000,000ක වටිනාකම $5.00 වන අතර, Models & pricing පිටුවේ සෑම මිලක්ම එම වටිනාකමට එරෙහි අනුපාතයකි.
ඕනෑම මොහොතක ශේෂය කොටස් දෙකක එකතුවකි.
- අද දිනයේ සැලසුම් ප්රමාණය — ඔබේ සැලසුම මගින් නියම කළ tokens ගණනක්. එය සෑම දිනකම 00:00 UTC ට අලුත් වේ. දිනක් අවසානයේ ඉතිරි දේ ඉදිරියට ගෙන නොයයි.
- මිලදී ගත් credit — ඔබ pack එකක් ලෙස මිලදී ගත් tokens. Credit කල් ඉකුත් නොවන අතර Free ඇතුළු සෑම සැලසුමකම ක්රියා කරයි.
| සැලසුම | දිනකට Tokens | වටිනාකම |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- වියදම් කරන පිළිවෙල — සෑම ඉල්ලීමක්ම මුලින් අද දිනයේ සැලසුම් ප්රමාණය වියදම් කරයි. මිලදී ගත් credit භාවිතා වන්නේ එදින ප්රමාණයට වඩා වැඩි දේ සඳහා පමණි.
- Chat සහ API එය බෙදා ගනී — ගිණුමකට එක ශේෂයක් ඇත. API key එකක් වියදම් කරන්නේ එය අයත් ගිණුමේ ශේෂයෙන්, chat හි මිල ගණන්වලින්ම.
- Packs — Credit විකුණන්නේ tokens 1,000,000 ($5.00), 2,000,000 ($10.00) සහ 5,000,000 ($25.00) packs වලින්, නැතහොත් 1,000,000කට $5.00 බැගින් 1,000,000 සිට 100,000,000 tokens දක්වා ඔබ කැමති ප්රමාණයකිනි.
ක්රෙඩිට් එකතු කරන්න සැලසුම වෙනස් කරන්න
ඉල්ලීමක් වෙන් කරන්නේ සහ වැය වන්නේ කොපමණද
- වෙන් කිරීම — ඉල්ලීමක් පැමිණෙන විට එය ඔබේ ශේෂයෙන් එහි output අයවැය වෙන් කර ගනී:
/v1/chat/completionsසහ/v1/messagesහිmax_tokens,/v1/responsesහිmax_output_tokens./v1/chat/completionsmax_completion_tokensද කියවයි. පෙරනිමිය 4,096 වන අතර පරාසය 1 සිට 65,536 දක්වාය. - පිළිගැනීම — වෙන්කිරීම (reservation) ඔබේ ශේෂයේ ඉතිරි ප්රමාණයට ගැළපේ නම් පමණක් ඉල්ලීම පිළිගනී. බිංදුවට වඩා වැඩි නමුත් output අයවැයට වඩා කුඩා ශේෂයකට
Quota exceededපිළිතුර ලැබේ. ඉතිරිය භාවිතා කිරීමට කුඩාmax_tokensයවන්න. - පියවීම — පිළිතුර සම්පූර්ණ වූ විට, වෙන්කිරීම සැබෑ අය කිරීමෙන් ප්රතිස්ථාපනය වේ. අය කිරීම වෙන්කිරීමට වඩා අඩු හෝ වැඩි විය හැක.
- ආපසු දීම — දෝෂ status එකකින් අවසන් වන ඉල්ලීමක් තම වෙන්කිරීම සම්පූර්ණයෙන්ම ආපසු දෙයි.
සැබෑ අය කිරීම model පවුල අනුව රඳා පවතී.
| Models | අය කරන්නේ කුමක්ද |
|---|---|
| Shannon models | Model එකේ 1M කට මිලෙන් usage.total_tokens. Input සහ output සඳහා එකම rate එකකි. |
| අපගේ සේවාදායකවල ධාවනය වන open-weight models | Cached නොවූ input සඳහා input rate එකෙන්, cached input සඳහා cached rate එකෙන්, සහ output සඳහා output rate එකෙන් අය කෙරේ. |
USD ප්රමාණය ඔබේ ශේෂයෙන් tokens වලින් 1,000,000කට $5.00 බැගින් ගනු ලබන අතර, සම්පූර්ණ token එකකට වටයනු ලැබේ.
POST /v1/tokenize හෝ POST /v1/messages/count_tokens සමඟ tokens ගණන් කිරීම නොමිලේ වන අතර කිසිවක් වෙන් නොකරයි. Token ගණන් කිරීම
ශේෂය සහ භාවිතය බලන්නේ කොතැනද
Keys & usage පිටුවේ ඔබට දැන් වියදම් කළ හැකි දේ, අද දිනයේ සැලසුම් ප්රමාණය, ඔබ මිලදී ගත් credit සහ පසුගිය දින 30 හි API වියදම පෙන්වයි. ඊට පහළින් ඔබේ key එක කළ සෑම ඉල්ලීමක්ම ලැයිස්තුගත කරයි: වේලාව, endpoint, model, cached input, බිල් කළ tokens සහ පිරිවැය. යතුරු සහ භාවිතය
සෑම පිළිතුරකම එම call එකේ token ගණන් සහිත usage object එකක් ද ඇත.
| Endpoint | Usage හි fields | අපගේ සේවාදායකවල ධාවනය වන open-weight models එකතු කරන දේ |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageහි model එකේ token ගණන් ඇත. ඔබේ ශේෂයෙන් ගත් ප්රමාණය පිළිතුරේ නැත: එය Keys & usage හි ඉල්ලීම් ලැයිස්තුවේ Billed tokens තීරුවයි.- අපගේ සේවාදායකවල ධාවනය වන open-weight model එකක් සමඟ
/v1/messagesහි,input_tokensයනු input හි cached නොවූ කොටස,cache_read_input_tokensයනු cached කොටස, සහcache_creation_input_tokensසෑම විටම0වේ. -
/v1/chat/completionsහි stream එකක[DONE]ට පෙර අවසාන chunk එකේusageඇත. ස්ට්රීමිං
ශේෂය අවසන් වූ විට
වෙන්කිරීම ඔබේ ශේෂයට නොගැළපෙන ඉල්ලීමකට status 429, type rate_limit_error සහ පහත පණිවිඩය සමඟ පිළිතුරු ලැබේ. කිසිවක් අය නොකෙරේ. ශේෂය බිංදුවට වඩා වැඩි නමුත් ඉල්ලීමේ output අයවැයට වඩා කුඩා වන විටත් එම පිළිතුරම යවනු ලැබේ.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses හි error object එකේ code සහ param ද තිබිය හැකි අතර, දෙකම null වේ.
ඔබට කළ හැකි දේ:
- 00:00 UTC ට ඊළඟ සැලසුම් ප්රමාණය එනතුරු රැඳී සිටින්න.
- Credit එකතු කරන්න. Credit වියදම් වන්නේ සැලසුම් ප්රමාණයෙන් පසුවය සහ කල් ඉකුත් නොවේ. ක්රෙඩිට් එකතු කරන්න
- විශාල දෛනික ප්රමාණයක් ඇති සැලසුමකට මාරු වන්න. සැලසුම වෙනස් කරන්න
- ශේෂයෙන් යමක් ඉතිරි නම් කුඩා
max_tokensයවන්න: එවිට වෙන්කිරීම කුඩා වේ.
Shannon Coder call ප්රමාණය
/v1/chat/completions සහ /v1/messages හි shannon-coder-1 ගණන් ගන්නේ tokens වලින් නොව calls වලිනි. සෑම සැලසුමකටම පැය 4 කවුළුවකට calls ගණනක් ඇතුළත් වේ. එක ඉල්ලීමක් එක call එකකි.
| සැලසුම | පැය 4 කවුළුවකට Calls |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- කවුළු ආරම්භ වන්නේ 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC ට. කවුළුවක් අවසානයේ ඉතිරි calls ඉදිරියට ගෙන නොයයි.
- ඉල්ලීම පිළිගන්නා විට, model එක පිළිතුරු දීමට පෙර call එක ගණන් ගැනේ. පසුව අසාර්ථක වන ඉල්ලීමක් ද call එකක් ලෙස ගණන් ගැනේ.
- මෙම calls tokens වෙන් නොකරන අතර ඔබේ ශේෂයෙන් කිසිවක් ගන්නේ නැත. Keys & usage හි ඉල්ලීම් ලැයිස්තුවෙන් ඒවායේ token ගණන සහ ලැයිස්තුගත මිලේ එහි වටිනාකම පෙන්වයි.
- මෙම endpoints දෙකේ
shannon-coder-1හි පෙරනිමිmax_tokens65,536 වේ. - Calls ඉතිරි නැති විට පිළිතුර status
429, typerate_limit_error, පණිවිඩයShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/planවේ. /v1/responsesහිshannon-coder-1ට call ප්රමාණයක් නැත: එය වෙනත් සෑම model එකක් මෙන් 1M කට $8.00 බැගින් ඔබේ ශේෂයෙන් tokens වලින් අය කෙරේ.
Flood protection
ගිණුමකට විනාඩියකට ඉල්ලීම් 120ක් යැවිය හැක. ඉල්ලීම් වේගය පිළිබඳ එකම සීමාව එයයි, සහ එය සෑම සැලසුමකම එකමය. එය පවතින්නේ ගංවතුර (floods) නැවැත්වීමටය, සාමාන්ය භාවිතය මන්දගාමී කිරීමට නොවේ.
- විනාඩිය යනු ඔබේ පළමු ඉල්ලීමෙන් විවෘත වන තත්පර 60ක ස්ථාවර කවුළුවකි. එය අවසන් වූ විට ගණන නැවත බිංදුවෙන් ආරම්භ වේ.
- ගණන් කිරීම ගිණුමක් අනුවය, key එකක් හෝ IP ලිපිනයක් අනුව නොවේ. Key එක මාරු කිරීමෙන් නව කවුළුවක් විවෘත නොවේ.
- කවුළුවක් තුළ 121 වැනි ඉල්ලීමට status
429, typerate_limit_errorසහToo many requests. Retry in <N>s.පණිවිඩය සමඟ පිළිතුරු ලැබේ.Nයනු කවුළුව අවසන් වන තෙක් තත්පර ගණන, 1 සිට 60 දක්වා. - Flood protection ශේෂයට පෙර පරීක්ෂා කෙරේ. එය ප්රතික්ෂේප කරන ඉල්ලීමක් කිසිවක් වෙන් නොකරන අතර කිසිවක් වැය නොවේ.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | ඉල්ලීම | Flood protection |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | ගණන් ගැනේ, ඉල්ලීමකට එකක්. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | ගණන් නොගනී. |
/v1/chat/completions සහ /v1/messages හි shannon-coder-1 | ඒ වෙනුවට Shannon Coder call ප්රමාණයෙන් ගණන් ගැනේ. |
401 සමඟ, හෝ නොදන්නා model එකකට 400 සමඟ පිළිතුරු දුන් ඉල්ලීමක් | ගණන් නොගනී. |
| Flood protection මගින් ප්රතික්ෂේප කළ ඉල්ලීමක් | කවුළුවට ගණන් ගැනේ. කිසිවක් අය නොකෙරේ. |
සමාන්තර ඉල්ලීම්
ගිණුමකට එකම වේලාවේ විවෘතව තිබිය හැකි ඉල්ලීම් ගණනට සීමාවක් නැති අතර, ඉල්ලීම් සමාන්තරව යැවීම සඳහා දෝෂයක් නැත. එකවර ආරම්භ කළ නොහැකි ඉල්ලීම් පෝලිමේ රැඳී සිට පිළිවෙලින් පිළිතුරු ලබයි.
- කලින් ඉල්ලීම් අවසන් වී තිබුණත් නැතත්, සෑම ඉල්ලීමක්ම පැමිණෙන විට විනාඩියකට 120ට ගණන් ගැනේ.
- සෑම ඉල්ලීමක්ම අවසන් වන තෙක් තමන්ගේම වෙන්කිරීම තබා ගනී. පෙරනිමි output අයවැය සහිත විවෘත ඉල්ලීම් විස්සක් ශේෂයේ tokens 20 × 4,096 = 81,920ක් තබා ගනී. වෙන්කිරීම් එකතුව ඔබේ ශේෂයට වඩා විශාල නම්, අවසන් වූ calls වලට අඩුවෙන් වැය වන්නේ වුවත්, ඊළඟ ඉල්ලීමට
Quota exceededපිළිතුර ලැබේ. කුඩාmax_tokensඅඩුවෙන් තබා ගනී. - Streaming නොමැති ඉල්ලීමක් එහි පිළිතුර සම්පූර්ණ වන තෙක් කිසිවක් නොයවයි, එබැවින් රැඳී සිටීම ආවරණය වන timeout එකක් ඔබේ client එකට දෙන්න. Stream එකක් රැඳී සිටින අතරතුර එහි සම්බන්ධතාව විවෘතව තබා ගනී. ස්ට්රීමිං
තනි ඉල්ලීමක සීමා
| සීමාව | අගය | අදාළ වන්නේ | සීමාවේදී |
|---|---|---|---|
| ඉල්ලීමේ body | 32 MiB (බයිට් 33,554,432) | සෑම endpoint එකක්ම | Status 413, type invalid_request_error. |
Output අයවැය: max_tokens, max_completion_tokens, max_output_tokens | 1 සිට 65,536 දක්වා. පෙරනිමිය 4,096; /v1/chat/completions සහ /v1/messages හි shannon-coder-1 සඳහා පෙරනිමිය 65,536. | සෑම model එකක්ම, ඔබේ ශේෂයෙන් වෙන් කරන ප්රමාණය ලෙස. පිළිතුරේ දිග පිළිබඳ සීමාව ලෙස: අපගේ සේවාදායකවල ධාවනය වන open-weight models, shannon-1.6-lite, shannon-1.6-pro සහ shannon-coder-1. | පරාසයෙන් පිටත අගයක් පරාසයේ ළඟම කෙළවරට ගෙන එනු ලැබේ. දෝෂයක් නැත. |
Stop sequences: stop, stop_sequences | Strings 4ක් | අපගේ සේවාදායකවල ධාවනය වන open-weight models | හිස් නොවන පළමු strings 4 භාවිතා වේ. |
| URL එකක් ලෙස දෙන රූපයක් හෝ ගොනුවක් | 8 MiB, තත්පර 20ක් තුළ කියවයි, උපරිම redirects 5ක්, ප්රසිද්ධ http හෝ https ලිපිනයක් | රූප හෝ ගොනු පිළිගන්නා සෑම endpoint එකක්ම | ඉල්ලීමට එම කොටස නොමැතිව පිළිතුරු ලැබේ. දෝෂයක් නැත. |
| Inline (base64) යවන රූපයක් හෝ ගොනුවක් | තමන්ගේම සීමාවක් නැත. එය 32 MiB ඉල්ලීමේ body එකට ගණන් ගැනේ. | රූප හෝ ගොනු පිළිගන්නා සෑම endpoint එකක්ම | මුළු ඉල්ලීමටම status 413. |
POST /v1/tokenize හි text | බයිට් 4,000,000 | /v1/tokenize | Status 413, type invalid_request_error, පණිවිඩය text too long. |
POST /v1/tokenize හි messages සහ POST /v1/messages/count_tokens හි body එක | 32 MiB ඉල්ලීමේ body එක | ගණන් කිරීමේ endpoints දෙකම | Status 413. |
| Context window | Model එකකට: GET /v1/models හි context_window | සෑම model එකක්ම | දිගු සංවාදයකට සිදුවන දේ model එක අනුව රඳා පවතී. Models සහ මිල ගණන් |
Web searches (web_search: true) | සැලසුමකට සහ දිනකට: Free 3, Plus 30, Standard 50, Pro 60. සෙවීම ප්රතිඵල සොයාගත් ඉල්ලීමක් සඳහා එක සෙවීමක් ගණන් ගැනේ. | web_search: true සකසන ඉල්ලීම් | කිසිවක් ඉතිරි නැති විට ඉල්ලීමට සෙවීමක් නොමැතිව පිළිතුරු ලැබේ. දෝෂයක් නැත. වෙබ් සෙවීම |
දෝෂ
මෙම පිටුවේ පිළිතුරු. /v1/messages හි එම error object එකම {"type": "error", "error": {…}} ලෙස ඔතා ඇත.
| තත්ත්වය | වර්ගය | පණිවිඩය | කවදාද, සහ කළ යුතු දේ |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | ඉල්ලීමේ වෙන්කිරීම ඔබේ ශේෂයට නොගැළපේ. 00:00 UTC තෙක් රැඳී සිටින්න, credit එකතු කරන්න, සැලසුම වෙනස් කරන්න, නැතහොත් කුඩා max_tokens යවන්න. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | වත්මන් විනාඩියේ ඉල්ලීම් 120කට වඩා. N තත්පර රැඳී සිට නැවත යවන්න. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | වත්මන් පැය 4 කවුළුවේ Shannon Coder calls අවසන් වී ඇත. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | මෙම මොහොතේ model එකට ඉල්ලීම භාර ගත නොහැක. කෙටි විරාමයකින් පසු එය නැවත යවන්න. |
503 | api_error | Could not verify your quota right now. Please retry. | ඔබේ ශේෂය කියවිය නොහැකි විය. කිසිවක් අය නොකෙරේ; ඉල්ලීම නැවත යවන්න. Shannon model එකක් සමඟ /v1/responses හි status එක 500 වේ. |
413 | invalid_request_error | ඉල්ලීමේ body එක 32 MiB ට වඩා විශාලය. OpenAI-format endpoints හි error object එකේ code: "request_too_large" ඇත. | |
413 | invalid_request_error | text too long | POST /v1/tokenize හි text බයිට් 4,000,000ට වඩා දිගය. |