حدونه او بیلانس
هره غوښتنه برابره خدمت کیږي. هیڅ rate کچې نشته. هیڅ جلا API کوټه نشته. تاسو لا دمخه د خپلو ټوکنونو پیسې ورکړې — هر څومره چې ګړندي غواړئ وکاروئ یې.
دا پاڼه تشریح کوي چې ستاسو بیلانس له څه جوړ دی، یوه غوښتنه څه ساتي او څومره لګښت لري، تاسو څومره غوښتنې لیږلی شئ، او هغه لږ حدونه چې یوه غوښتنه ورسره مخ کیدی شي.
- د بیلانس د 1M ټوکنونو ارزښت
- $5.00
- ورځنۍ اجازه نوې کیږي
- 00:00 UTC
- flood protection، په هر حساب
- 120 غوښتنې / دقیقه
غوښتنې څنګه خدمت کیږي
- هیڅ rate کچې نشته — یو قاعده محدودوي چې غوښتنې څومره ګړندي رارسیدلی شي، او دا د هر حساب او هر پلان لپاره یو شان ده: په دقیقه 120 غوښتنې. په دقیقه کې د ټوکنونو لپاره هیڅ حد نشته.
- جلا API کوټه نشته — API هماغه بیلانس مصرفوي چې چیټ یې مصرفوي. پلان د نن ورځې اجازې اندازه ټاکي. دا د غوښتنو کچه نه ټاکي.
- هر څومره ګړندی چې غواړئ — هغه غوښتنې چې موازي لیږل کیږي منل کیږي او په صف کې انتظار کوي. د موازي کیدو له امله رد نه کیږي.
ستاسو بیلانس
ستاسو بیلانس په ټوکنونو شمیرل کیږي. د بیلانس 1,000,000 ټوکنونه $5.00 ارزښت لري، او د Models & pricing په پاڼه کې هر نرخ د هغه ارزښت پر ضد یو rate دی.
په هره شیبه بیلانس د دوو برخو مجموعه ده.
- د نن ورځې د پلان اجازه — د ټوکنونو شمیر چې ستاسو پلان ټاکي. هره ورځ په 00:00 UTC نوی کیږي. هغه څه چې د ورځې په پای کې پاتې وي نه لیږدول کیږي.
- اخیستل شوی کریډیټ — هغه ټوکنونه چې تاسو د بسته په توګه اخیستي. کریډیټ نه ختمیږي او په هر پلان کې کار کوي، Free په ګډون.
| پلان | ټوکنونه په ورځ کې | ارزښت |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- د مصرف ترتیب — هره غوښتنه لومړی د نن ورځې د پلان اجازه مصرفوي. اخیستل شوی کریډیټ یوازې د هغه لپاره کارول کیږي چې په هغې ورځ له اجازې څخه ډیر وي.
- چیټ او API یې شریکوي — د هر حساب لپاره یو بیلانس شته. API کیلي د هغه حساب له بیلانس مصرفوي چې مالک یې دی، د چیټ په څیر په همدغو نرخونو.
- بستې — کریډیټ د 1,000,000 ($5.00)، 2,000,000 ($10.00) او 5,000,000 ($25.00) ټوکنونو په بسته کې پلورل کیږي، یا ستاسو د غوره کولو مقدار له 1,000,000 څخه تر 100,000,000 ټوکنونو پورې په $5.00 د هر 1,000,000 لپاره.
د کریډیټ اضافه کول د پلان بدلول
غوښتنه څه ساتي او څومره لګښت لري
- ساتل — کله چې غوښتنه رارسیږي دا د output بودجه ستاسو له بیلانس ساتي: په
/v1/chat/completionsاو/v1/messagesکېmax_tokens، په/v1/responsesکېmax_output_tokens./v1/chat/completionsmax_completion_tokensهم لولي. ډیفالټ 4,096 دی او لړۍ له 1 تر 65,536 ده. - منل — غوښتنه یوازې هغه وخت منل کیږي کله چې ساتل شوی مقدار ستاسو په پاتې بیلانس کې ځای شي. بیلانس چې له صفر څخه لوړ دی خو د output بودجې څخه کوچنی دی
Quota exceededځواب ترلاسه کوي. پاتې کارولو لپاره کوچنیmax_tokensولیږئ. - تسویه — کله چې ځواب بشپړ شي، ساتل شوی مقدار د ریښتینی لګښت سره بدلیږي. لګښت کولی شي له ساتل شوي مقدار ټیټ یا لوړ وي.
- بیرته ورکول — هغه غوښتنه چې د تېروتنې حالت سره پای ته رسیږي خپل ساتل شوی مقدار په بشپړه توګه بیرته ورکوي.
ریښتینی لګښت د ماډل کورنۍ پورې اړه لري.
| ماډلونه | څه بیل کیږي |
|---|---|
| د Shannon ماډلونه | usage.total_tokens د ماډل په نرخ د هر 1M لپاره. Input او output یو rate لري. |
| کوربه شوي open-weight ماډلونه | غیر-cached input د input په نرخ، cached input د cached په نرخ، output د output په نرخ. |
په USD مقدار ستاسو له بیلانس په ټوکنونو اخیستل کیږي په $5.00 د هر 1,000,000 لپاره، په بشپړ ټوکن ګردول شوی.
د ټوکنونو شمېرنه د POST /v1/tokenize یا POST /v1/messages/count_tokens سره وړیا ده او هیڅ نه ساتي. د ټوکنونو شمېرنه
بیلانس او usage چیرته وګورو
د Keys & usage پاڼه ښیي چې تاسو همدا اوس څه مصرفولی شئ، د نن ورځې د پلان اجازه، ستاسو اخیستل شوی کریډیټ او د وروستیو 30 ورځو د API مصرف. لاندې دا هره غوښتنه لیست کوي چې ستاسو کیلي کړې: وخت، endpoint، ماډل، cached input، بیل شوي ټوکنونه او لګښت. کیلي او کارونه
هر ځواب د دې call د ټوکنونو شمیرو سره usage څیز هم لري.
| اینډپوائنټ (Endpoint) | د usage ساحې | د کوربه شوو open-weight ماډلونو لخوا زیاتې شوې |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageد ماډل د ټوکنونو شمیرې لري. هغه مقدار چې ستاسو له بیلانس اخیستل کیږي په ځواب کې نه دی: دا د Keys & usage په غوښتنو لیست کې د Billed tokens کالم دی.- په
/v1/messagesکې د کوربه شوي open-weight ماډل سره،input_tokensد input غیر-cached برخه ده،cache_read_input_tokenscached برخه ده اوcache_creation_input_tokensتل0دی. - په
/v1/chat/completionsکې stream خپلusageپه وروستي chunk کې مخکې له[DONE]لیږدوي. جریان
کله چې بیلانس ختم شي
هغه غوښتنه چې ساتل شوی مقدار یې ستاسو په بیلانس کې ځای نه شي په حالت 429، ډول rate_limit_error او لاندې پیغام ځواب کیږي. هیڅ نه بیل کیږي. همدا ځواب هغه وخت هم لیږل کیږي کله چې بیلانس له صفر څخه لوړ وي خو د غوښتنې د output بودجې څخه کوچنی وي.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} په /v1/responses کې error څیز کولی شي code او param هم ولري، دواړه null.
تاسو څه کولی شئ:
- په 00:00 UTC د راتلونکې پلان اجازې ته انتظار وکړئ.
- کریډیټ اضافه کړئ. کریډیټ وروسته له پلان اجازې مصرفیږي او نه ختمیږي. د کریډیټ اضافه کول
- هغه پلان ته بدل شئ چې لویه ورځنۍ اجازه لري. د پلان بدلول
- که ځینې بیلانس پاتې وي، کوچنی
max_tokensولیږئ: بیا ساتل شوی مقدار کوچنی دی.
د Shannon Coder د call اجازه
shannon-coder-1 په /v1/chat/completions او /v1/messages کې په calls شمیرل کیږي، نه په ټوکنونو. هر پلان په هره 4 ساعتي کړکۍ کې د calls شمیر لري. یوه غوښتنه یو call دی.
| پلان | Calls د 4 ساعتې کړکۍ لپاره |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- کړکۍ په 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC پیلیږي. هغه calls چې د کړکۍ په پای کې پاتې وي نه لیږدول کیږي.
- Call هغه وخت شمیرل کیږي کله چې غوښتنه ومنل شي، مخکې له دې چې ماډل ځواب ورکړي. هغه غوښتنه چې وروسته ناکامه شي بیا هم د call په توګه شمیرل کیږي.
- دا calls هیڅ ټوکنونه نه ساتي او ستاسو له بیلانس هیڅ نه اخلي. په Keys & usage کې د غوښتنو لیست د دوی د ټوکنونو شمیر او په لیست شوي نرخ یې ارزښت ښیي.
- پدې دوو endpoints کې د
shannon-coder-1ډیفالټmax_tokens65,536 دی. - کله چې calls پاتې نه وي ځواب حالت
429، ډولrate_limit_error، او پیغامShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/planدی. - په
/v1/responsesکې،shannon-coder-1د call اجازه نه لري: دا ستاسو له بیلانس په ټوکنونو بیل کیږي په $8.00 د هر 1M لپاره، لکه هر بل ماډل.
Flood protection
حساب کولی شي په دقیقه کې 120 غوښتنې ولیږي. دا د غوښتنو په کچه یوازینی حد دی، او په هر پلان کې یو شان دی. دا د سیلاب د مخنیوي لپاره دی، نه د عادي کارونې د ورو کولو لپاره.
- دقیقه د 60 ثانیو ټاکلې کړکۍ ده چې ستاسو له لومړۍ غوښتنې پرانیستل کیږي. کله چې پای ته ورسیږي، شمیرنه له صفر څخه بیا پیلیږي.
- شمېرنه د هر حساب لپاره ده، نه د هر کیلي او نه د هر IP پتې لپاره. د کیلي بدلول نوې کړکۍ نه پرانیزي.
- په یوه کړکۍ کې 121 مه غوښتنه په حالت
429، ډولrate_limit_errorاو پیغامToo many requests. Retry in <N>s.ځواب کیږي.Nد هغه ثانیو شمیر دی چې تر کړکۍ پایه پاتې دي، له 1 څخه تر 60 پورې. - Flood protection مخکې له بیلانس چک کیږي. هغه غوښتنه چې رد کوي هیڅ نه ساتي او هیڅ لګښت نه لري.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | غوښتنه | Flood protection |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | شمیرل کیږي، یو په هره غوښتنه. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | نه شمیرل کیږي. |
shannon-coder-1 په /v1/chat/completions او /v1/messages کې | پر ځای یې د Shannon Coder call اجازې په واسطه شمیرل کیږي. |
هغه غوښتنه چې په 401 ځواب شوې، یا د نامعلوم model لپاره په 400 | نه شمیرل کیږي. |
| هغه غوښتنه چې flood protection رد کړې | د کړکۍ په شمیرنه کې شمیرل کیږي. هیڅ نه بیل کیږي. |
موازي غوښتنې
د دې لپاره هیڅ حد نشته چې حساب په یو وخت کې څو غوښتنې پرانیستې لري، او د موازي لیږلو لپاره هیڅ تېروتنه نشته. هغه غوښتنې چې سمدلاسه نشي پیل کیدی په صف کې انتظار کوي او په نوبت ځواب کیږي.
- هره غوښتنه کله چې رارسیږي د دقیقې په 120 کې شمیرل کیږي، که مخکینۍ غوښتنې پای ته رسیدلې وي یا نه.
- هره غوښتنه خپل ساتل شوی مقدار تر پایه ساتي. شل پرانیستې غوښتنې د ډیفالټ output بودجې سره د بیلانس 20 × 4,096 = 81,920 ټوکنونه ساتي. که ساتل شوي مقدارونه یوځای د بیلانس څخه لوی وي، راتلونکې غوښتنه
Quota exceededځواب ترلاسه کوي، حتی که بشپړې شوې غوښتنې لږ لګښت درلود. کوچنیmax_tokensلږ ساتي. - هغه غوښتنه چې streaming نه لري تر هغه څه نه لیږي چې ځواب بشپړ شي، نو خپل کلاینټ ته timeout ورکړئ چې انتظار پوښي. Stream خپل اړیکه پرانیستې ساتي پداسې حال کې چې انتظار کوي. جریان
د یوې غوښتنې حدونه
| حد | ارزښت | پلي کیږي په | په حد کې |
|---|---|---|---|
| د غوښتنې بدنه | 32 MiB (33,554,432 بایټونه) | هر endpoint | حالت 413، ډول invalid_request_error. |
د output بودجه: max_tokens، max_completion_tokens، max_output_tokens | له 1 تر 65,536. ډیفالټ 4,096؛ د shannon-coder-1 لپاره په /v1/chat/completions او /v1/messages کې ډیفالټ 65,536 دی. | هر ماډل، د هغه مقدار په توګه چې ستاسو له بیلانس ساتل کیږي. د ځواب د اوږدوالي د حد په توګه: کوربه شوي open-weight ماډلونه، shannon-1.6-lite، shannon-1.6-pro او shannon-coder-1. | د لړۍ څخه بهر ارزښت د لړۍ نږدې پای ته راوړل کیږي. هیڅ تېروتنه نشته. |
د ودرولو ترتیبونه: stop، stop_sequences | 4 strings | کوربه شوي open-weight ماډلونه | لومړي 4 غیر خالي strings کارول کیږي. |
| انځور یا فایل چې د URL په توګه ورکول شوی | 8 MiB، په 20 ثانیو کې لوستل شوی، تر 5 redirects پورې، عامه http یا https پته | هر endpoint چې انځورونه یا فایلونه مني | غوښتنه پرته له هغې برخې ځواب کیږي. هیڅ تېروتنه نشته. |
| Inline لیږل شوی انځور یا فایل (base64) | خپل حد نه لري. دا د 32 MiB غوښتنې بدنې په شمیرنه کې راځي. | هر endpoint چې انځورونه یا فایلونه مني | د ټولې غوښتنې لپاره حالت 413. |
د POST /v1/tokenize text | 4,000,000 بایټونه | /v1/tokenize | حالت 413، ډول invalid_request_error، پیغام text too long. |
د POST /v1/tokenize messages او د POST /v1/messages/count_tokens بدنه | د 32 MiB غوښتنې بدنه | دواړه د شمېرنې endpoints | حالت 413. |
| Context window | د هر ماډل لپاره: په GET /v1/models کې context_window | هر ماډل | اوږده ګفتګې ته څه کیږي د ماډل پورې اړه لري. ماډلونه او بیې |
Web لټونونه (web_search: true) | د هر پلان او ورځې لپاره: Free 3، Plus 30، Standard 50، Pro 60. یو لټون د هغې غوښتنې لپاره شمیرل کیږي چې لټون یې پایلې موندلې. | هغه غوښتنې چې web_search: true ټاکي | کله چې هیڅ پاتې نه وي غوښتنه پرته له لټون ځواب کیږي. هیڅ تېروتنه نشته. جوړ شوی ویب لټون |
تېروتنې
د دې پاڼې ځوابونه. په /v1/messages کې همدا error څیز د {"type": "error", "error": {…}} په توګه تاو شوی.
| حالت | ډول | پیغام | کله، او څه وکړو |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | د غوښتنې ساتل شوی مقدار ستاسو په بیلانس کې ځای نه کیږي. 00:00 UTC ته انتظار وکړئ، کریډیټ اضافه کړئ، پلان بدل کړئ، یا کوچنی max_tokens ولیږئ. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | په اوسنۍ دقیقه کې له 120 زیاتې غوښتنې. N ثانیې انتظار وکړئ او بیا ولیږئ. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | د اوسنۍ 4 ساعتې کړکۍ Shannon Coder calls ختم شوي. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | ماډل پدې شیبه غوښتنه نشي منلی. وروسته له لنډې وقفې یې بیا ولیږئ. |
503 | api_error | Could not verify your quota right now. Please retry. | ستاسو بیلانس ونه لوستل شو. هیڅ نه بیل کیږي؛ غوښتنه بیا ولیږئ. په /v1/responses کې د Shannon ماډل سره حالت 500 دی. |
413 | invalid_request_error | د غوښتنې بدنه له 32 MiB لویه ده. په OpenAI بڼه endpoints کې error څیز code: "request_too_large" لري. | |
413 | invalid_request_error | text too long | د POST /v1/tokenize text له 4,000,000 بایټونو اوږد دی. |