Mipaka na salio
Kila ombi linahudumiwa kwa usawa. Hakuna viwango vya rate. Hakuna quota tofauti ya API. Tayari ulilipia tokens zako — zitumie kwa kasi unayotaka.
Ukurasa huu unaeleza salio lako linaundwa na nini, ombi moja hutenga na kugharimu nini, maombi mangapi unaweza kutuma, na mipaka michache ambayo ombi moja linaweza kukutana nayo.
- thamani ya tokens 1M za salio
- $5.00
- kiasi cha kila siku kinapatikana upya
- 00:00 UTC
- flood protection, kwa kila akaunti
- 120 maombi / dak
Jinsi maombi yanavyohudumiwa
- Hakuna viwango vya rate — Kanuni moja inapunguza kasi ambayo maombi yanaweza kufika, na ni sawa kwa kila akaunti na kila mpango: maombi 120 kwa dakika. Hakuna kikomo cha tokens kwa dakika.
- Hakuna quota tofauti ya API — API hutumia salio lile lile kama chat. Mpango huweka ukubwa wa kiasi cha leo. Hauweki kasi ya maombi.
- Haraka unavyotaka — Maombi yanayotumwa kwa sambamba yanakubaliwa na husubiri kwenye foleni. Hayakataliwi kwa sababu ni ya sambamba.
Salio lako
Salio lako linahesabiwa kwa tokens. Tokens 1,000,000 za salio zina thamani ya $5.00, na kila bei kwenye ukurasa wa Model na bei ni kiwango dhidi ya thamani hiyo.
Wakati wowote salio ni jumla ya sehemu mbili.
- Kiasi cha mpango wa leo — Idadi ya tokens iliyowekwa na mpango wako. Inapatikana upya kila siku saa 00:00 UTC. Kinachobaki mwishoni mwa siku hakihamishwi.
- Mikopo uliyonunua — Tokens ulizonunua kama pakiti. Mikopo haiishi muda wake na hufanya kazi kwenye kila mpango, pamoja na Free.
| Mpango | Tokens kwa siku | Thamani |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- Mpangilio wa matumizi — Kila ombi hutumia kwanza kiasi cha mpango wa leo. Mikopo uliyonunua hutumika tu kwa kinachozidi kiasi hicho siku hiyo.
- Chat na API hulitumia pamoja — Kuna salio moja kwa kila akaunti. API key hutumia salio la akaunti inayoimiliki, kwa bei zile zile kama chat.
- Pakiti — Mikopo huuzwa kwa pakiti za tokens 1,000,000 ($5.00), 2,000,000 ($10.00) na 5,000,000 ($25.00), au kwa kiasi cha chaguo lako kuanzia tokens 1,000,000 hadi 100,000,000 kwa $5.00 kwa 1,000,000.
Ongeza mikopo Badilisha mpango
Ombi hutenga nini na hugharimu nini
- Kutenga — Ombi linapofika hutenga bajeti yake ya output kutoka kwenye salio lako:
max_tokenskwenye/v1/chat/completionsna/v1/messages,max_output_tokenskwenye/v1/responses./v1/chat/completionshusoma piamax_completion_tokens. Chaguo-msingi ni 4,096 na masafa ni 1 hadi 65,536. - Kukubali — Ombi linakubaliwa tu ikiwa hifadhi inatoshea kwenye kilichobaki cha salio lako. Salio lililo juu ya sifuri lakini dogo kuliko bajeti ya output hupata jibu la
Quota exceeded. Tumamax_tokensndogo zaidi ili kutumia kilichobaki. - Kukamilisha — Jibu likikamilika, hifadhi hubadilishwa na gharama halisi. Gharama inaweza kuwa chini au juu kuliko hifadhi.
- Kurudisha — Ombi linaloisha na hali ya kosa hurudisha hifadhi yake kwa ukamilifu.
Gharama halisi inategemea familia ya model.
| Model | Kinachotozwa |
|---|---|
| Model za Shannon | usage.total_tokens kwa bei ya model kwa 1M. Input na output zina bei moja. |
| Model za open-weight zinazopangishwa | Input isiyokeshwa kwa bei ya input, input iliyokeshwa kwa bei ya cached, output kwa bei ya output. |
Kiasi cha USD huchukuliwa kutoka kwenye salio lako la tokens kwa $5.00 kwa 1,000,000, kikizungushwa hadi token nzima.
Kuhesabu tokens kwa POST /v1/tokenize au POST /v1/messages/count_tokens ni bure na hakutengi chochote. Kuhesabu tokens
Mahali pa kuona salio na matumizi
Ukurasa wa Keys na matumizi unaonyesha unachoweza kutumia sasa hivi, kiasi cha mpango wa leo, mikopo uliyonunua na matumizi ya API ya siku 30 zilizopita. Chini yake unaorodhesha kila ombi ambalo key yako ilifanya: wakati, endpoint, model, input iliyokeshwa, tokens zilizotozwa na gharama. Keys na matumizi
Kila jibu pia hubeba kitu cha usage chenye hesabu za tokens za wito huo.
| Endpoint | Fields za usage | Zinazoongezwa na model za open-weight zinazopangishwa |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageina hesabu za tokens za model. Kiasi kinachochukuliwa kutoka kwenye salio lako hakipo kwenye jibu: ni safu ya Tokens zilizotozwa ya orodha ya maombi kwenye Keys na matumizi.- Kwenye
/v1/messagesna model ya open-weight inayopangishwa,input_tokensni sehemu isiyokeshwa ya input,cache_read_input_tokensni sehemu iliyokeshwa nacache_creation_input_tokensdaima ni0. - Stream kwenye
/v1/chat/completionshubebausagekwenye chunk yake ya mwisho kabla ya[DONE]. Kutiririsha
Salio linapoisha
Ombi ambalo hifadhi yake haitoshei kwenye salio lako hujibiwa kwa hali 429, aina rate_limit_error na ujumbe ulio hapa chini. Hakuna kinachotozwa. Jibu lile lile hutumwa wakati salio liko juu ya sifuri lakini ni dogo kuliko bajeti ya output ya ombi.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} Kwenye /v1/responses kitu cha error kinaweza pia kuwa na code na param, zote null.
Unachoweza kufanya:
- Subiri kiasi kinachofuata cha mpango saa 00:00 UTC.
- Ongeza mikopo. Mikopo hutumika baada ya kiasi cha mpango na haiishi muda wake. Ongeza mikopo
- Badilisha kwenda mpango wenye kiasi kikubwa zaidi cha kila siku. Badilisha mpango
- Tuma
max_tokensndogo zaidi, ikiwa salio fulani limebaki: hifadhi huwa ndogo zaidi.
Kiasi cha wito wa Shannon Coder
shannon-coder-1 kwenye /v1/chat/completions na /v1/messages huhesabiwa kwa wito, si kwa tokens. Kila mpango unajumuisha idadi ya wito kwa kila dirisha la saa 4. Ombi moja ni wito mmoja.
| Mpango | Wito kwa dirisha la saa 4 |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- Madirisha huanza saa 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC. Wito unaobaki mwishoni mwa dirisha haujahamishwi.
- Wito huhesabiwa ombi linapokubaliwa, kabla model haijajibu. Ombi linalofeli baadaye bado huhesabiwa kama wito.
- Wito huu hautengi tokens na hauchukui chochote kutoka kwenye salio lako. Orodha ya maombi kwenye Keys na matumizi inaonyesha hesabu yao ya tokens na thamani yake kwa bei iliyoorodheshwa.
max_tokenschaguo-msingi yashannon-coder-1kwenye endpoint hizi mbili ni 65,536.- Wito ukiisha jibu ni hali
429, ainarate_limit_error, ujumbeShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan. - Kwenye
/v1/responses,shannon-coder-1haina kiasi cha wito: inatozwa kwa tokens kutoka kwenye salio lako kwa $8.00 kwa 1M, kama kila model nyingine.
Flood protection
Akaunti inaweza kutuma maombi 120 kwa dakika. Hicho ndicho kikomo pekee cha kasi ya maombi, na ni sawa kwenye kila mpango. Kipo kuzuia mafuriko, si kupunguza kasi ya matumizi ya kawaida.
- Dakika ni dirisha lisilobadilika la sekunde 60 linalofunguka na ombi lako la kwanza. Linapoisha, hesabu huanza upya kutoka sifuri.
- Hesabu ni kwa kila akaunti, si kwa key na si kwa anwani ya IP. Kubadilisha key hakufungui dirisha jipya.
- Ombi la 121 ndani ya dirisha hujibiwa kwa hali
429, ainarate_limit_errorna ujumbeToo many requests. Retry in <N>s.Nni idadi ya sekunde hadi dirisha liishe, kuanzia 1 hadi 60. - Flood protection hukaguliwa kabla ya salio. Ombi linalolikataa halitengi chochote na halina gharama.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | Ombi | Flood protection |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | Huhesabiwa, moja kwa kila ombi. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | Haihesabiwi. |
shannon-coder-1 kwenye /v1/chat/completions na /v1/messages | Huhesabiwa na kiasi cha wito wa Shannon Coder badala yake. |
Ombi lililojibiwa kwa 401, au kwa 400 kwa model isiyojulikana | Haihesabiwi. |
| Ombi lililokataliwa na flood protection | Huhesabiwa kwenye dirisha. Hakuna kinachotozwa. |
Maombi ya sambamba
Hakuna kikomo cha maombi mangapi akaunti inaweza kuwa nayo wazi kwa wakati mmoja, wala kosa kwa kutuma maombi kwa sambamba. Maombi yasiyoweza kuanza mara moja husubiri kwenye foleni na hujibiwa kwa zamu.
- Kila ombi huhesabiwa kwenye 120 kwa dakika linapofika, iwe maombi ya awali yamekwisha au la.
- Kila ombi hushikilia hifadhi yake hadi liishe. Maombi ishirini yaliyo wazi yenye bajeti chaguo-msingi ya output hushikilia 20 × 4,096 = 81,920 tokens za salio. Hifadhi zikiwa kubwa kwa pamoja kuliko salio lako, ombi linalofuata hupata jibu la
Quota exceeded, ingawa wito uliokamilika ungegharimu kidogo zaidi.max_tokensndogo zaidi hushikilia kidogo. - Ombi lisilo la streaming halitumi chochote hadi jibu lake likamilike, kwa hiyo ipe client yako timeout inayofunika kusubiri. Stream huweka muunganisho wake wazi inaposubiri. Kutiririsha
Mipaka ya ombi moja
| Kikomo | Thamani | Inatumika kwa | Kwenye kikomo |
|---|---|---|---|
| Mwili wa ombi | 32 MiB (bytes 33,554,432) | Kila endpoint | Hali 413, aina invalid_request_error. |
Bajeti ya output: max_tokens, max_completion_tokens, max_output_tokens | 1 hadi 65,536. Chaguo-msingi 4,096; kwa shannon-coder-1 kwenye /v1/chat/completions na /v1/messages chaguo-msingi ni 65,536. | Kila model, kama kiasi kinachotengwa kutoka kwenye salio lako. Kama kikomo cha urefu wa jibu: model za open-weight zinazopangishwa, shannon-1.6-lite, shannon-1.6-pro na shannon-coder-1. | Thamani iliyo nje ya masafa huhamishiwa mwisho wa karibu zaidi wa masafa. Hakuna kosa. |
Stop sequences: stop, stop_sequences | Strings 4 | Model za open-weight zinazopangishwa | Strings 4 za kwanza zisizo tupu hutumika. |
| Picha au faili lililotolewa kama URL | 8 MiB, kusomwa ndani ya sekunde 20, redirects zisizozidi 5, anwani ya umma ya http au https | Kila endpoint inayokubali picha au mafaili | Ombi hujibiwa bila sehemu hiyo. Hakuna kosa. |
| Picha au faili lililotumwa ndani ya ombi (base64) | Hakuna kikomo chake chenyewe. Huhesabiwa kwenye mwili wa ombi wa 32 MiB. | Kila endpoint inayokubali picha au mafaili | Hali 413 kwa ombi zima. |
text ya POST /v1/tokenize | Bytes 4,000,000 | /v1/tokenize | Hali 413, aina invalid_request_error, ujumbe text too long. |
messages za POST /v1/tokenize na mwili wa POST /v1/messages/count_tokens | Mwili wa ombi wa 32 MiB | Endpoint zote mbili za kuhesabu | Hali 413. |
| Dirisha la muktadha | Kwa kila model: context_window kwenye GET /v1/models | Kila model | Kinachotokea kwa mazungumzo marefu zaidi kinategemea model. Model na bei |
Utafutaji wa wavuti (web_search: true) | Kwa mpango na siku: Free 3, Plus 30, Standard 50, Pro 60. Utafutaji mmoja huhesabiwa kwa ombi ambalo utafutaji wake ulipata matokeo. | Maombi yanayoweka web_search: true | Visipobaki ombi hujibiwa bila utafutaji. Hakuna kosa. Utafutaji wa wavuti |
Makosa
Majibu ya ukurasa huu. Kwenye /v1/messages kitu kile kile cha error hufungwa kama {"type": "error", "error": {…}}.
| Hali | Aina | Ujumbe | Lini, na nini cha kufanya |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | Hifadhi ya ombi haitoshei kwenye salio lako. Subiri hadi 00:00 UTC, ongeza mikopo, badilisha mpango, au tuma max_tokens ndogo zaidi. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | Zaidi ya maombi 120 katika dakika ya sasa. Subiri sekunde N na utume tena. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | Wito wa Shannon Coder wa dirisha la sasa la saa 4 umeisha. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | Model haiwezi kupokea ombi kwa sasa. Litume tena baada ya kusimama kwa muda mfupi. |
503 | api_error | Could not verify your quota right now. Please retry. | Salio lako halikuweza kusomwa. Hakuna kinachotozwa; tuma ombi tena. Kwenye /v1/responses na model ya Shannon hali ni 500. |
413 | invalid_request_error | Mwili wa ombi ni mkubwa kuliko 32 MiB. Kwenye endpoint za umbizo la OpenAI kitu cha error hubeba code: "request_too_large". | |
413 | invalid_request_error | text too long | text ya POST /v1/tokenize ni ndefu kuliko bytes 4,000,000. |