අන්තර්ගතයට යන්න
සීමා සහ ශේෂය

සීමා සහ ශේෂය

සෑම ඉල්ලීමකටම එක සමානව සේවය කෙරේ. Rate tiers නැත. වෙනම API quota නැත. ඔබ දැනටමත් ඔබේ tokens සඳහා ගෙවා ඇත — ඒවා ඔබට හැකි තරම් වේගයෙන් භාවිතා කරන්න.

ඔබේ ශේෂය සෑදී ඇත්තේ කුමකින්ද, එක ඉල්ලීමක් වෙන් කරන්නේ සහ වැය වන්නේ කොපමණද, ඔබට ඉල්ලීම් කොපමණ ගණනක් යැවිය හැකිද, සහ එක ඉල්ලීමකට මුහුණ දිය හැකි සීමා කිහිපය මෙම පිටුවේ පැහැදිලි කරයි.

ශේෂයේ tokens 1Mක වටිනාකම
$5.00
දෛනික ප්‍රමාණය අලුත් වේ
00:00 UTC
ගිණුමකට ඉල්ලීම් ගණන සීමා කිරීම (flood protection)
120 ඉල්ලීම් / විනාඩියට

ඉල්ලීම්වලට සේවය කරන ආකාරය

  • Rate tiers නැත — ඉල්ලීම් පැමිණිය හැකි වේගය එක නීතියකින් සීමා කෙරෙන අතර, එය සෑම ගිණුමකටම සහ සෑම සැලසුමකටම එකමය: විනාඩියකට ඉල්ලීම් 120. විනාඩියකට tokens සඳහා සීමාවක් නැත.
  • වෙනම API quota නැත — API එක chat හි ශේෂයම වියදම් කරයි. සැලසුමක් අද දිනයේ ප්‍රමාණයේ විශාලත්වය නියම කරයි. එය ඉල්ලීම් වේගයක් නියම නොකරයි.
  • ඔබට හැකි තරම් වේගයෙන් — සමාන්තරව යවන ඉල්ලීම් පිළිගෙන පෝලිමේ රැඳී සිටී. සමාන්තර වීම නිසා ඒවා ප්‍රතික්ෂේප නොකෙරේ.

ඔබේ ශේෂය

ඔබේ ශේෂය tokens වලින් ගණන් ගැනේ. ශේෂයේ tokens 1,000,000ක වටිනාකම $5.00 වන අතර, Models & pricing පිටුවේ සෑම මිලක්ම එම වටිනාකමට එරෙහි අනුපාතයකි.

ඕනෑම මොහොතක ශේෂය කොටස් දෙකක එකතුවකි.

  • අද දිනයේ සැලසුම් ප්‍රමාණය — ඔබේ සැලසුම මගින් නියම කළ tokens ගණනක්. එය සෑම දිනකම 00:00 UTC ට අලුත් වේ. දිනක් අවසානයේ ඉතිරි දේ ඉදිරියට ගෙන නොයයි.
  • මිලදී ගත් credit — ඔබ pack එකක් ලෙස මිලදී ගත් tokens. Credit කල් ඉකුත් නොවන අතර Free ඇතුළු සෑම සැලසුමකම ක්‍රියා කරයි.
සැලසුම දිනකට Tokens වටිනාකම
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • වියදම් කරන පිළිවෙල — සෑම ඉල්ලීමක්ම මුලින් අද දිනයේ සැලසුම් ප්‍රමාණය වියදම් කරයි. මිලදී ගත් credit භාවිතා වන්නේ එදින ප්‍රමාණයට වඩා වැඩි දේ සඳහා පමණි.
  • Chat සහ API එය බෙදා ගනී — ගිණුමකට එක ශේෂයක් ඇත. API key එකක් වියදම් කරන්නේ එය අයත් ගිණුමේ ශේෂයෙන්, chat හි මිල ගණන්වලින්ම.
  • Packs — Credit විකුණන්නේ tokens 1,000,000 ($5.00), 2,000,000 ($10.00) සහ 5,000,000 ($25.00) packs වලින්, නැතහොත් 1,000,000කට $5.00 බැගින් 1,000,000 සිට 100,000,000 tokens දක්වා ඔබ කැමති ප්‍රමාණයකිනි.

ක්‍රෙඩිට් එකතු කරන්න සැලසුම වෙනස් කරන්න

ඉල්ලීමක් වෙන් කරන්නේ සහ වැය වන්නේ කොපමණද

  • වෙන් කිරීම — ඉල්ලීමක් පැමිණෙන විට එය ඔබේ ශේෂයෙන් එහි output අයවැය වෙන් කර ගනී: /v1/chat/completions සහ /v1/messages හි max_tokens, /v1/responses හි max_output_tokens. /v1/chat/completions max_completion_tokens ද කියවයි. පෙරනිමිය 4,096 වන අතර පරාසය 1 සිට 65,536 දක්වාය.
  • පිළිගැනීම — වෙන්කිරීම (reservation) ඔබේ ශේෂයේ ඉතිරි ප්‍රමාණයට ගැළපේ නම් පමණක් ඉල්ලීම පිළිගනී. බිංදුවට වඩා වැඩි නමුත් output අයවැයට වඩා කුඩා ශේෂයකට Quota exceeded පිළිතුර ලැබේ. ඉතිරිය භාවිතා කිරීමට කුඩා max_tokens යවන්න.
  • පියවීම — පිළිතුර සම්පූර්ණ වූ විට, වෙන්කිරීම සැබෑ අය කිරීමෙන් ප්‍රතිස්ථාපනය වේ. අය කිරීම වෙන්කිරීමට වඩා අඩු හෝ වැඩි විය හැක.
  • ආපසු දීම — දෝෂ status එකකින් අවසන් වන ඉල්ලීමක් තම වෙන්කිරීම සම්පූර්ණයෙන්ම ආපසු දෙයි.

සැබෑ අය කිරීම model පවුල අනුව රඳා පවතී.

Models අය කරන්නේ කුමක්ද
Shannon models Model එකේ 1M කට මිලෙන් usage.total_tokens. Input සහ output සඳහා එකම rate එකකි.
අපගේ සේවාදායකවල ධාවනය වන open-weight models Cached නොවූ input සඳහා input rate එකෙන්, cached input සඳහා cached rate එකෙන්, සහ output සඳහා output rate එකෙන් අය කෙරේ.

USD ප්‍රමාණය ඔබේ ශේෂයෙන් tokens වලින් 1,000,000කට $5.00 බැගින් ගනු ලබන අතර, සම්පූර්ණ token එකකට වටයනු ලැබේ.

POST /v1/tokenize හෝ POST /v1/messages/count_tokens සමඟ tokens ගණන් කිරීම නොමිලේ වන අතර කිසිවක් වෙන් නොකරයි. Token ගණන් කිරීම

ශේෂය සහ භාවිතය බලන්නේ කොතැනද

Keys & usage පිටුවේ ඔබට දැන් වියදම් කළ හැකි දේ, අද දිනයේ සැලසුම් ප්‍රමාණය, ඔබ මිලදී ගත් credit සහ පසුගිය දින 30 හි API වියදම පෙන්වයි. ඊට පහළින් ඔබේ key එක කළ සෑම ඉල්ලීමක්ම ලැයිස්තුගත කරයි: වේලාව, endpoint, model, cached input, බිල් කළ tokens සහ පිරිවැය. යතුරු සහ භාවිතය

සෑම පිළිතුරකම එම call එකේ token ගණන් සහිත usage object එකක් ද ඇත.

Endpoint Usage හි fields අපගේ සේවාදායකවල ධාවනය වන open-weight models එකතු කරන දේ
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage හි model එකේ token ගණන් ඇත. ඔබේ ශේෂයෙන් ගත් ප්‍රමාණය පිළිතුරේ නැත: එය Keys & usage හි ඉල්ලීම් ලැයිස්තුවේ Billed tokens තීරුවයි.
  • අපගේ සේවාදායකවල ධාවනය වන open-weight model එකක් සමඟ /v1/messages හි, input_tokens යනු input හි cached නොවූ කොටස, cache_read_input_tokens යනු cached කොටස, සහ cache_creation_input_tokens සෑම විටම 0 වේ.
  • /v1/chat/completions හි stream එකක [DONE] ට පෙර අවසාන chunk එකේ usage ඇත. ස්ට්‍රීමිං

ශේෂය අවසන් වූ විට

වෙන්කිරීම ඔබේ ශේෂයට නොගැළපෙන ඉල්ලීමකට status 429, type rate_limit_error සහ පහත පණිවිඩය සමඟ පිළිතුරු ලැබේ. කිසිවක් අය නොකෙරේ. ශේෂය බිංදුවට වඩා වැඩි නමුත් ඉල්ලීමේ output අයවැයට වඩා කුඩා වන විටත් එම පිළිතුරම යවනු ලැබේ.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses හි error object එකේ code සහ param ද තිබිය හැකි අතර, දෙකම null වේ.

ඔබට කළ හැකි දේ:

  • 00:00 UTC ට ඊළඟ සැලසුම් ප්‍රමාණය එනතුරු රැඳී සිටින්න.
  • Credit එකතු කරන්න. Credit වියදම් වන්නේ සැලසුම් ප්‍රමාණයෙන් පසුවය සහ කල් ඉකුත් නොවේ. ක්‍රෙඩිට් එකතු කරන්න
  • විශාල දෛනික ප්‍රමාණයක් ඇති සැලසුමකට මාරු වන්න. සැලසුම වෙනස් කරන්න
  • ශේෂයෙන් යමක් ඉතිරි නම් කුඩා max_tokens යවන්න: එවිට වෙන්කිරීම කුඩා වේ.

Shannon Coder call ප්‍රමාණය

/v1/chat/completions සහ /v1/messages හි shannon-coder-1 ගණන් ගන්නේ tokens වලින් නොව calls වලිනි. සෑම සැලසුමකටම පැය 4 කවුළුවකට calls ගණනක් ඇතුළත් වේ. එක ඉල්ලීමක් එක call එකකි.

සැලසුම පැය 4 කවුළුවකට Calls
Free 3
Plus 20
Standard 40
Pro 60
  • කවුළු ආරම්භ වන්නේ 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC ට. කවුළුවක් අවසානයේ ඉතිරි calls ඉදිරියට ගෙන නොයයි.
  • ඉල්ලීම පිළිගන්නා විට, model එක පිළිතුරු දීමට පෙර call එක ගණන් ගැනේ. පසුව අසාර්ථක වන ඉල්ලීමක් ද call එකක් ලෙස ගණන් ගැනේ.
  • මෙම calls tokens වෙන් නොකරන අතර ඔබේ ශේෂයෙන් කිසිවක් ගන්නේ නැත. Keys & usage හි ඉල්ලීම් ලැයිස්තුවෙන් ඒවායේ token ගණන සහ ලැයිස්තුගත මිලේ එහි වටිනාකම පෙන්වයි.
  • මෙම endpoints දෙකේ shannon-coder-1 හි පෙරනිමි max_tokens 65,536 වේ.
  • Calls ඉතිරි නැති විට පිළිතුර status 429, type rate_limit_error, පණිවිඩය Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan වේ.
  • /v1/responses හි shannon-coder-1 ට call ප්‍රමාණයක් නැත: එය වෙනත් සෑම model එකක් මෙන් 1M කට $8.00 බැගින් ඔබේ ශේෂයෙන් tokens වලින් අය කෙරේ.

Flood protection

ගිණුමකට විනාඩියකට ඉල්ලීම් 120ක් යැවිය හැක. ඉල්ලීම් වේගය පිළිබඳ එකම සීමාව එයයි, සහ එය සෑම සැලසුමකම එකමය. එය පවතින්නේ ගංවතුර (floods) නැවැත්වීමටය, සාමාන්‍ය භාවිතය මන්දගාමී කිරීමට නොවේ.

  • විනාඩිය යනු ඔබේ පළමු ඉල්ලීමෙන් විවෘත වන තත්පර 60ක ස්ථාවර කවුළුවකි. එය අවසන් වූ විට ගණන නැවත බිංදුවෙන් ආරම්භ වේ.
  • ගණන් කිරීම ගිණුමක් අනුවය, key එකක් හෝ IP ලිපිනයක් අනුව නොවේ. Key එක මාරු කිරීමෙන් නව කවුළුවක් විවෘත නොවේ.
  • කවුළුවක් තුළ 121 වැනි ඉල්ලීමට status 429, type rate_limit_error සහ Too many requests. Retry in <N>s. පණිවිඩය සමඟ පිළිතුරු ලැබේ. N යනු කවුළුව අවසන් වන තෙක් තත්පර ගණන, 1 සිට 60 දක්වා.
  • Flood protection ශේෂයට පෙර පරීක්ෂා කෙරේ. එය ප්‍රතික්ෂේප කරන ඉල්ලීමක් කිසිවක් වෙන් නොකරන අතර කිසිවක් වැය නොවේ.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
ඉල්ලීම Flood protection
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses ගණන් ගැනේ, ඉල්ලීමකට එකක්.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens ගණන් නොගනී.
/v1/chat/completions සහ /v1/messages හි shannon-coder-1 ඒ වෙනුවට Shannon Coder call ප්‍රමාණයෙන් ගණන් ගැනේ.
401 සමඟ, හෝ නොදන්නා model එකකට 400 සමඟ පිළිතුරු දුන් ඉල්ලීමක් ගණන් නොගනී.
Flood protection මගින් ප්‍රතික්ෂේප කළ ඉල්ලීමක් කවුළුවට ගණන් ගැනේ. කිසිවක් අය නොකෙරේ.

සමාන්තර ඉල්ලීම්

ගිණුමකට එකම වේලාවේ විවෘතව තිබිය හැකි ඉල්ලීම් ගණනට සීමාවක් නැති අතර, ඉල්ලීම් සමාන්තරව යැවීම සඳහා දෝෂයක් නැත. එකවර ආරම්භ කළ නොහැකි ඉල්ලීම් පෝලිමේ රැඳී සිට පිළිවෙලින් පිළිතුරු ලබයි.

  • කලින් ඉල්ලීම් අවසන් වී තිබුණත් නැතත්, සෑම ඉල්ලීමක්ම පැමිණෙන විට විනාඩියකට 120ට ගණන් ගැනේ.
  • සෑම ඉල්ලීමක්ම අවසන් වන තෙක් තමන්ගේම වෙන්කිරීම තබා ගනී. පෙරනිමි output අයවැය සහිත විවෘත ඉල්ලීම් විස්සක් ශේෂයේ tokens 20 × 4,096 = 81,920ක් තබා ගනී. වෙන්කිරීම් එකතුව ඔබේ ශේෂයට වඩා විශාල නම්, අවසන් වූ calls වලට අඩුවෙන් වැය වන්නේ වුවත්, ඊළඟ ඉල්ලීමට Quota exceeded පිළිතුර ලැබේ. කුඩා max_tokens අඩුවෙන් තබා ගනී.
  • Streaming නොමැති ඉල්ලීමක් එහි පිළිතුර සම්පූර්ණ වන තෙක් කිසිවක් නොයවයි, එබැවින් රැඳී සිටීම ආවරණය වන timeout එකක් ඔබේ client එකට දෙන්න. Stream එකක් රැඳී සිටින අතරතුර එහි සම්බන්ධතාව විවෘතව තබා ගනී. ස්ට්‍රීමිං

තනි ඉල්ලීමක සීමා

සීමාව අගය අදාළ වන්නේ සීමාවේදී
ඉල්ලීමේ body 32 MiB (බයිට් 33,554,432) සෑම endpoint එකක්ම Status 413, type invalid_request_error.
Output අයවැය: max_tokens, max_completion_tokens, max_output_tokens 1 සිට 65,536 දක්වා. පෙරනිමිය 4,096; /v1/chat/completions සහ /v1/messages හි shannon-coder-1 සඳහා පෙරනිමිය 65,536. සෑම model එකක්ම, ඔබේ ශේෂයෙන් වෙන් කරන ප්‍රමාණය ලෙස. පිළිතුරේ දිග පිළිබඳ සීමාව ලෙස: අපගේ සේවාදායකවල ධාවනය වන open-weight models, shannon-1.6-lite, shannon-1.6-pro සහ shannon-coder-1. පරාසයෙන් පිටත අගයක් පරාසයේ ළඟම කෙළවරට ගෙන එනු ලැබේ. දෝෂයක් නැත.
Stop sequences: stop, stop_sequences Strings 4ක් අපගේ සේවාදායකවල ධාවනය වන open-weight models හිස් නොවන පළමු strings 4 භාවිතා වේ.
URL එකක් ලෙස දෙන රූපයක් හෝ ගොනුවක් 8 MiB, තත්පර 20ක් තුළ කියවයි, උපරිම redirects 5ක්, ප්‍රසිද්ධ http හෝ https ලිපිනයක් රූප හෝ ගොනු පිළිගන්නා සෑම endpoint එකක්ම ඉල්ලීමට එම කොටස නොමැතිව පිළිතුරු ලැබේ. දෝෂයක් නැත.
Inline (base64) යවන රූපයක් හෝ ගොනුවක් තමන්ගේම සීමාවක් නැත. එය 32 MiB ඉල්ලීමේ body එකට ගණන් ගැනේ. රූප හෝ ගොනු පිළිගන්නා සෑම endpoint එකක්ම මුළු ඉල්ලීමටම status 413.
POST /v1/tokenize හි text බයිට් 4,000,000 /v1/tokenize Status 413, type invalid_request_error, පණිවිඩය text too long.
POST /v1/tokenize හි messages සහ POST /v1/messages/count_tokens හි body එක 32 MiB ඉල්ලීමේ body එක ගණන් කිරීමේ endpoints දෙකම Status 413.
Context window Model එකකට: GET /v1/models හි context_window සෑම model එකක්ම දිගු සංවාදයකට සිදුවන දේ model එක අනුව රඳා පවතී. Models සහ මිල ගණන්
Web searches (web_search: true) සැලසුමකට සහ දිනකට: Free 3, Plus 30, Standard 50, Pro 60. සෙවීම ප්‍රතිඵල සොයාගත් ඉල්ලීමක් සඳහා එක සෙවීමක් ගණන් ගැනේ. web_search: true සකසන ඉල්ලීම් කිසිවක් ඉතිරි නැති විට ඉල්ලීමට සෙවීමක් නොමැතිව පිළිතුරු ලැබේ. දෝෂයක් නැත. වෙබ් සෙවීම

දෝෂ

මෙම පිටුවේ පිළිතුරු. /v1/messages හි එම error object එකම {"type": "error", "error": {…}} ලෙස ඔතා ඇත.

තත්ත්වය වර්ගය පණිවිඩය කවදාද, සහ කළ යුතු දේ
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan ඉල්ලීමේ වෙන්කිරීම ඔබේ ශේෂයට නොගැළපේ. 00:00 UTC තෙක් රැඳී සිටින්න, credit එකතු කරන්න, සැලසුම වෙනස් කරන්න, නැතහොත් කුඩා max_tokens යවන්න.
429 rate_limit_error Too many requests. Retry in <N>s. වත්මන් විනාඩියේ ඉල්ලීම් 120කට වඩා. N තත්පර රැඳී සිට නැවත යවන්න.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan වත්මන් පැය 4 කවුළුවේ Shannon Coder calls අවසන් වී ඇත.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. මෙම මොහොතේ model එකට ඉල්ලීම භාර ගත නොහැක. කෙටි විරාමයකින් පසු එය නැවත යවන්න.
503 api_error Could not verify your quota right now. Please retry. ඔබේ ශේෂය කියවිය නොහැකි විය. කිසිවක් අය නොකෙරේ; ඉල්ලීම නැවත යවන්න. Shannon model එකක් සමඟ /v1/responses හි status එක 500 වේ.
413 invalid_request_error ඉල්ලීමේ body එක 32 MiB ට වඩා විශාලය. OpenAI-format endpoints හි error object එකේ code: "request_too_large" ඇත.
413 invalid_request_error text too long POST /v1/tokenize හි text බයිට් 4,000,000ට වඩා දිගය.