منځپانګې ته ټوپ ووهئ
حدونه او بیلانس

حدونه او بیلانس

هره غوښتنه برابره خدمت کیږي. هیڅ rate کچې نشته. هیڅ جلا API کوټه نشته. تاسو لا دمخه د خپلو ټوکنونو پیسې ورکړې — هر څومره چې ګړندي غواړئ وکاروئ یې.

دا پاڼه تشریح کوي چې ستاسو بیلانس له څه جوړ دی، یوه غوښتنه څه ساتي او څومره لګښت لري، تاسو څومره غوښتنې لیږلی شئ، او هغه لږ حدونه چې یوه غوښتنه ورسره مخ کیدی شي.

د بیلانس د 1M ټوکنونو ارزښت
$5.00
ورځنۍ اجازه نوې کیږي
00:00 UTC
flood protection، په هر حساب
120 غوښتنې / دقیقه

غوښتنې څنګه خدمت کیږي

  • هیڅ rate کچې نشته — یو قاعده محدودوي چې غوښتنې څومره ګړندي رارسیدلی شي، او دا د هر حساب او هر پلان لپاره یو شان ده: په دقیقه 120 غوښتنې. په دقیقه کې د ټوکنونو لپاره هیڅ حد نشته.
  • جلا API کوټه نشته — API هماغه بیلانس مصرفوي چې چیټ یې مصرفوي. پلان د نن ورځې اجازې اندازه ټاکي. دا د غوښتنو کچه نه ټاکي.
  • هر څومره ګړندی چې غواړئ — هغه غوښتنې چې موازي لیږل کیږي منل کیږي او په صف کې انتظار کوي. د موازي کیدو له امله رد نه کیږي.

ستاسو بیلانس

ستاسو بیلانس په ټوکنونو شمیرل کیږي. د بیلانس 1,000,000 ټوکنونه $5.00 ارزښت لري، او د Models & pricing په پاڼه کې هر نرخ د هغه ارزښت پر ضد یو rate دی.

په هره شیبه بیلانس د دوو برخو مجموعه ده.

  • د نن ورځې د پلان اجازه — د ټوکنونو شمیر چې ستاسو پلان ټاکي. هره ورځ په 00:00 UTC نوی کیږي. هغه څه چې د ورځې په پای کې پاتې وي نه لیږدول کیږي.
  • اخیستل شوی کریډیټ — هغه ټوکنونه چې تاسو د بسته په توګه اخیستي. کریډیټ نه ختمیږي او په هر پلان کې کار کوي، Free په ګډون.
پلان ټوکنونه په ورځ کې ارزښت
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • د مصرف ترتیب — هره غوښتنه لومړی د نن ورځې د پلان اجازه مصرفوي. اخیستل شوی کریډیټ یوازې د هغه لپاره کارول کیږي چې په هغې ورځ له اجازې څخه ډیر وي.
  • چیټ او API یې شریکوي — د هر حساب لپاره یو بیلانس شته. API کیلي د هغه حساب له بیلانس مصرفوي چې مالک یې دی، د چیټ په څیر په همدغو نرخونو.
  • بستې — کریډیټ د 1,000,000 ($5.00)، 2,000,000 ($10.00) او 5,000,000 ($25.00) ټوکنونو په بسته کې پلورل کیږي، یا ستاسو د غوره کولو مقدار له 1,000,000 څخه تر 100,000,000 ټوکنونو پورې په $5.00 د هر 1,000,000 لپاره.

د کریډیټ اضافه کول د پلان بدلول

غوښتنه څه ساتي او څومره لګښت لري

  • ساتل — کله چې غوښتنه رارسیږي دا د output بودجه ستاسو له بیلانس ساتي: په /v1/chat/completions او /v1/messages کې max_tokens، په /v1/responses کې max_output_tokens. /v1/chat/completions max_completion_tokens هم لولي. ډیفالټ 4,096 دی او لړۍ له 1 تر 65,536 ده.
  • منل — غوښتنه یوازې هغه وخت منل کیږي کله چې ساتل شوی مقدار ستاسو په پاتې بیلانس کې ځای شي. بیلانس چې له صفر څخه لوړ دی خو د output بودجې څخه کوچنی دی Quota exceeded ځواب ترلاسه کوي. پاتې کارولو لپاره کوچنی max_tokens ولیږئ.
  • تسویه — کله چې ځواب بشپړ شي، ساتل شوی مقدار د ریښتینی لګښت سره بدلیږي. لګښت کولی شي له ساتل شوي مقدار ټیټ یا لوړ وي.
  • بیرته ورکول — هغه غوښتنه چې د تېروتنې حالت سره پای ته رسیږي خپل ساتل شوی مقدار په بشپړه توګه بیرته ورکوي.

ریښتینی لګښت د ماډل کورنۍ پورې اړه لري.

ماډلونه څه بیل کیږي
د Shannon ماډلونه usage.total_tokens د ماډل په نرخ د هر 1M لپاره. Input او output یو rate لري.
کوربه شوي open-weight ماډلونه غیر-cached input د input په نرخ، cached input د cached په نرخ، output د output په نرخ.

په USD مقدار ستاسو له بیلانس په ټوکنونو اخیستل کیږي په $5.00 د هر 1,000,000 لپاره، په بشپړ ټوکن ګردول شوی.

د ټوکنونو شمېرنه د POST /v1/tokenize یا POST /v1/messages/count_tokens سره وړیا ده او هیڅ نه ساتي. د ټوکنونو شمېرنه

بیلانس او usage چیرته وګورو

د Keys & usage پاڼه ښیي چې تاسو همدا اوس څه مصرفولی شئ، د نن ورځې د پلان اجازه، ستاسو اخیستل شوی کریډیټ او د وروستیو 30 ورځو د API مصرف. لاندې دا هره غوښتنه لیست کوي چې ستاسو کیلي کړې: وخت، endpoint، ماډل، cached input، بیل شوي ټوکنونه او لګښت. کیلي او کارونه

هر ځواب د دې call د ټوکنونو شمیرو سره usage څیز هم لري.

اینډپوائنټ (Endpoint) د usage ساحې د کوربه شوو open-weight ماډلونو لخوا زیاتې شوې
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage د ماډل د ټوکنونو شمیرې لري. هغه مقدار چې ستاسو له بیلانس اخیستل کیږي په ځواب کې نه دی: دا د Keys & usage په غوښتنو لیست کې د Billed tokens کالم دی.
  • په /v1/messages کې د کوربه شوي open-weight ماډل سره، input_tokens د input غیر-cached برخه ده، cache_read_input_tokens cached برخه ده او cache_creation_input_tokens تل 0 دی.
  • په /v1/chat/completions کې stream خپل usage په وروستي chunk کې مخکې له [DONE] لیږدوي. جریان

کله چې بیلانس ختم شي

هغه غوښتنه چې ساتل شوی مقدار یې ستاسو په بیلانس کې ځای نه شي په حالت 429، ډول rate_limit_error او لاندې پیغام ځواب کیږي. هیڅ نه بیل کیږي. همدا ځواب هغه وخت هم لیږل کیږي کله چې بیلانس له صفر څخه لوړ وي خو د غوښتنې د output بودجې څخه کوچنی وي.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

په /v1/responses کې error څیز کولی شي code او param هم ولري، دواړه null.

تاسو څه کولی شئ:

  • په 00:00 UTC د راتلونکې پلان اجازې ته انتظار وکړئ.
  • کریډیټ اضافه کړئ. کریډیټ وروسته له پلان اجازې مصرفیږي او نه ختمیږي. د کریډیټ اضافه کول
  • هغه پلان ته بدل شئ چې لویه ورځنۍ اجازه لري. د پلان بدلول
  • که ځینې بیلانس پاتې وي، کوچنی max_tokens ولیږئ: بیا ساتل شوی مقدار کوچنی دی.

د Shannon Coder د call اجازه

shannon-coder-1 په /v1/chat/completions او /v1/messages کې په calls شمیرل کیږي، نه په ټوکنونو. هر پلان په هره 4 ساعتي کړکۍ کې د calls شمیر لري. یوه غوښتنه یو call دی.

پلان Calls د 4 ساعتې کړکۍ لپاره
Free 3
Plus 20
Standard 40
Pro 60
  • کړکۍ په 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC پیلیږي. هغه calls چې د کړکۍ په پای کې پاتې وي نه لیږدول کیږي.
  • Call هغه وخت شمیرل کیږي کله چې غوښتنه ومنل شي، مخکې له دې چې ماډل ځواب ورکړي. هغه غوښتنه چې وروسته ناکامه شي بیا هم د call په توګه شمیرل کیږي.
  • دا calls هیڅ ټوکنونه نه ساتي او ستاسو له بیلانس هیڅ نه اخلي. په Keys & usage کې د غوښتنو لیست د دوی د ټوکنونو شمیر او په لیست شوي نرخ یې ارزښت ښیي.
  • پدې دوو endpoints کې د shannon-coder-1 ډیفالټ max_tokens 65,536 دی.
  • کله چې calls پاتې نه وي ځواب حالت 429، ډول rate_limit_error، او پیغام Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan دی.
  • په /v1/responses کې، shannon-coder-1 د call اجازه نه لري: دا ستاسو له بیلانس په ټوکنونو بیل کیږي په $8.00 د هر 1M لپاره، لکه هر بل ماډل.

Flood protection

حساب کولی شي په دقیقه کې 120 غوښتنې ولیږي. دا د غوښتنو په کچه یوازینی حد دی، او په هر پلان کې یو شان دی. دا د سیلاب د مخنیوي لپاره دی، نه د عادي کارونې د ورو کولو لپاره.

  • دقیقه د 60 ثانیو ټاکلې کړکۍ ده چې ستاسو له لومړۍ غوښتنې پرانیستل کیږي. کله چې پای ته ورسیږي، شمیرنه له صفر څخه بیا پیلیږي.
  • شمېرنه د هر حساب لپاره ده، نه د هر کیلي او نه د هر IP پتې لپاره. د کیلي بدلول نوې کړکۍ نه پرانیزي.
  • په یوه کړکۍ کې 121 مه غوښتنه په حالت 429، ډول rate_limit_error او پیغام Too many requests. Retry in <N>s. ځواب کیږي. N د هغه ثانیو شمیر دی چې تر کړکۍ پایه پاتې دي، له 1 څخه تر 60 پورې.
  • Flood protection مخکې له بیلانس چک کیږي. هغه غوښتنه چې رد کوي هیڅ نه ساتي او هیڅ لګښت نه لري.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
غوښتنه Flood protection
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses شمیرل کیږي، یو په هره غوښتنه.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens نه شمیرل کیږي.
shannon-coder-1 په /v1/chat/completions او /v1/messages کې پر ځای یې د Shannon Coder call اجازې په واسطه شمیرل کیږي.
هغه غوښتنه چې په 401 ځواب شوې، یا د نامعلوم model لپاره په 400 نه شمیرل کیږي.
هغه غوښتنه چې flood protection رد کړې د کړکۍ په شمیرنه کې شمیرل کیږي. هیڅ نه بیل کیږي.

موازي غوښتنې

د دې لپاره هیڅ حد نشته چې حساب په یو وخت کې څو غوښتنې پرانیستې لري، او د موازي لیږلو لپاره هیڅ تېروتنه نشته. هغه غوښتنې چې سمدلاسه نشي پیل کیدی په صف کې انتظار کوي او په نوبت ځواب کیږي.

  • هره غوښتنه کله چې رارسیږي د دقیقې په 120 کې شمیرل کیږي، که مخکینۍ غوښتنې پای ته رسیدلې وي یا نه.
  • هره غوښتنه خپل ساتل شوی مقدار تر پایه ساتي. شل پرانیستې غوښتنې د ډیفالټ output بودجې سره د بیلانس 20 × 4,096 = 81,920 ټوکنونه ساتي. که ساتل شوي مقدارونه یوځای د بیلانس څخه لوی وي، راتلونکې غوښتنه Quota exceeded ځواب ترلاسه کوي، حتی که بشپړې شوې غوښتنې لږ لګښت درلود. کوچنی max_tokens لږ ساتي.
  • هغه غوښتنه چې streaming نه لري تر هغه څه نه لیږي چې ځواب بشپړ شي، نو خپل کلاینټ ته timeout ورکړئ چې انتظار پوښي. Stream خپل اړیکه پرانیستې ساتي پداسې حال کې چې انتظار کوي. جریان

د یوې غوښتنې حدونه

حد ارزښت پلي کیږي په په حد کې
د غوښتنې بدنه 32 MiB (33,554,432 بایټونه) هر endpoint حالت 413، ډول invalid_request_error.
د output بودجه: max_tokens، max_completion_tokens، max_output_tokens له 1 تر 65,536. ډیفالټ 4,096؛ د shannon-coder-1 لپاره په /v1/chat/completions او /v1/messages کې ډیفالټ 65,536 دی. هر ماډل، د هغه مقدار په توګه چې ستاسو له بیلانس ساتل کیږي. د ځواب د اوږدوالي د حد په توګه: کوربه شوي open-weight ماډلونه، shannon-1.6-lite، shannon-1.6-pro او shannon-coder-1. د لړۍ څخه بهر ارزښت د لړۍ نږدې پای ته راوړل کیږي. هیڅ تېروتنه نشته.
د ودرولو ترتیبونه: stop، stop_sequences 4 strings کوربه شوي open-weight ماډلونه لومړي 4 غیر خالي strings کارول کیږي.
انځور یا فایل چې د URL په توګه ورکول شوی 8 MiB، په 20 ثانیو کې لوستل شوی، تر 5 redirects پورې، عامه http یا https پته هر endpoint چې انځورونه یا فایلونه مني غوښتنه پرته له هغې برخې ځواب کیږي. هیڅ تېروتنه نشته.
Inline لیږل شوی انځور یا فایل (base64) خپل حد نه لري. دا د 32 MiB غوښتنې بدنې په شمیرنه کې راځي. هر endpoint چې انځورونه یا فایلونه مني د ټولې غوښتنې لپاره حالت 413.
د POST /v1/tokenize text 4,000,000 بایټونه /v1/tokenize حالت 413، ډول invalid_request_error، پیغام text too long.
د POST /v1/tokenize messages او د POST /v1/messages/count_tokens بدنه د 32 MiB غوښتنې بدنه دواړه د شمېرنې endpoints حالت 413.
Context window د هر ماډل لپاره: په GET /v1/models کې context_window هر ماډل اوږده ګفتګې ته څه کیږي د ماډل پورې اړه لري. ماډلونه او بیې
Web لټونونه (web_search: true) د هر پلان او ورځې لپاره: Free 3، Plus 30، Standard 50، Pro 60. یو لټون د هغې غوښتنې لپاره شمیرل کیږي چې لټون یې پایلې موندلې. هغه غوښتنې چې web_search: true ټاکي کله چې هیڅ پاتې نه وي غوښتنه پرته له لټون ځواب کیږي. هیڅ تېروتنه نشته. جوړ شوی ویب لټون

تېروتنې

د دې پاڼې ځوابونه. په /v1/messages کې همدا error څیز د {"type": "error", "error": {…}} په توګه تاو شوی.

حالت ډول پیغام کله، او څه وکړو
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan د غوښتنې ساتل شوی مقدار ستاسو په بیلانس کې ځای نه کیږي. 00:00 UTC ته انتظار وکړئ، کریډیټ اضافه کړئ، پلان بدل کړئ، یا کوچنی max_tokens ولیږئ.
429 rate_limit_error Too many requests. Retry in <N>s. په اوسنۍ دقیقه کې له 120 زیاتې غوښتنې. N ثانیې انتظار وکړئ او بیا ولیږئ.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan د اوسنۍ 4 ساعتې کړکۍ Shannon Coder calls ختم شوي.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. ماډل پدې شیبه غوښتنه نشي منلی. وروسته له لنډې وقفې یې بیا ولیږئ.
503 api_error Could not verify your quota right now. Please retry. ستاسو بیلانس ونه لوستل شو. هیڅ نه بیل کیږي؛ غوښتنه بیا ولیږئ. په /v1/responses کې د Shannon ماډل سره حالت 500 دی.
413 invalid_request_error د غوښتنې بدنه له 32 MiB لویه ده. په OpenAI بڼه endpoints کې error څیز code: "request_too_large" لري.
413 invalid_request_error text too long د POST /v1/tokenize text له 4,000,000 بایټونو اوږد دی.