Ruka hadi kwenye maudhui
Mipaka na salio

Mipaka na salio

Kila ombi linahudumiwa kwa usawa. Hakuna viwango vya rate. Hakuna quota tofauti ya API. Tayari ulilipia tokens zako — zitumie kwa kasi unayotaka.

Ukurasa huu unaeleza salio lako linaundwa na nini, ombi moja hutenga na kugharimu nini, maombi mangapi unaweza kutuma, na mipaka michache ambayo ombi moja linaweza kukutana nayo.

thamani ya tokens 1M za salio
$5.00
kiasi cha kila siku kinapatikana upya
00:00 UTC
flood protection, kwa kila akaunti
120 maombi / dak

Jinsi maombi yanavyohudumiwa

  • Hakuna viwango vya rate — Kanuni moja inapunguza kasi ambayo maombi yanaweza kufika, na ni sawa kwa kila akaunti na kila mpango: maombi 120 kwa dakika. Hakuna kikomo cha tokens kwa dakika.
  • Hakuna quota tofauti ya API — API hutumia salio lile lile kama chat. Mpango huweka ukubwa wa kiasi cha leo. Hauweki kasi ya maombi.
  • Haraka unavyotaka — Maombi yanayotumwa kwa sambamba yanakubaliwa na husubiri kwenye foleni. Hayakataliwi kwa sababu ni ya sambamba.

Salio lako

Salio lako linahesabiwa kwa tokens. Tokens 1,000,000 za salio zina thamani ya $5.00, na kila bei kwenye ukurasa wa Model na bei ni kiwango dhidi ya thamani hiyo.

Wakati wowote salio ni jumla ya sehemu mbili.

  • Kiasi cha mpango wa leo — Idadi ya tokens iliyowekwa na mpango wako. Inapatikana upya kila siku saa 00:00 UTC. Kinachobaki mwishoni mwa siku hakihamishwi.
  • Mikopo uliyonunua — Tokens ulizonunua kama pakiti. Mikopo haiishi muda wake na hufanya kazi kwenye kila mpango, pamoja na Free.
Mpango Tokens kwa siku Thamani
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • Mpangilio wa matumizi — Kila ombi hutumia kwanza kiasi cha mpango wa leo. Mikopo uliyonunua hutumika tu kwa kinachozidi kiasi hicho siku hiyo.
  • Chat na API hulitumia pamoja — Kuna salio moja kwa kila akaunti. API key hutumia salio la akaunti inayoimiliki, kwa bei zile zile kama chat.
  • Pakiti — Mikopo huuzwa kwa pakiti za tokens 1,000,000 ($5.00), 2,000,000 ($10.00) na 5,000,000 ($25.00), au kwa kiasi cha chaguo lako kuanzia tokens 1,000,000 hadi 100,000,000 kwa $5.00 kwa 1,000,000.

Ongeza mikopo Badilisha mpango

Ombi hutenga nini na hugharimu nini

  • Kutenga — Ombi linapofika hutenga bajeti yake ya output kutoka kwenye salio lako: max_tokens kwenye /v1/chat/completions na /v1/messages, max_output_tokens kwenye /v1/responses. /v1/chat/completions husoma pia max_completion_tokens. Chaguo-msingi ni 4,096 na masafa ni 1 hadi 65,536.
  • Kukubali — Ombi linakubaliwa tu ikiwa hifadhi inatoshea kwenye kilichobaki cha salio lako. Salio lililo juu ya sifuri lakini dogo kuliko bajeti ya output hupata jibu la Quota exceeded. Tuma max_tokens ndogo zaidi ili kutumia kilichobaki.
  • Kukamilisha — Jibu likikamilika, hifadhi hubadilishwa na gharama halisi. Gharama inaweza kuwa chini au juu kuliko hifadhi.
  • Kurudisha — Ombi linaloisha na hali ya kosa hurudisha hifadhi yake kwa ukamilifu.

Gharama halisi inategemea familia ya model.

Model Kinachotozwa
Model za Shannon usage.total_tokens kwa bei ya model kwa 1M. Input na output zina bei moja.
Model za open-weight zinazopangishwa Input isiyokeshwa kwa bei ya input, input iliyokeshwa kwa bei ya cached, output kwa bei ya output.

Kiasi cha USD huchukuliwa kutoka kwenye salio lako la tokens kwa $5.00 kwa 1,000,000, kikizungushwa hadi token nzima.

Kuhesabu tokens kwa POST /v1/tokenize au POST /v1/messages/count_tokens ni bure na hakutengi chochote. Kuhesabu tokens

Mahali pa kuona salio na matumizi

Ukurasa wa Keys na matumizi unaonyesha unachoweza kutumia sasa hivi, kiasi cha mpango wa leo, mikopo uliyonunua na matumizi ya API ya siku 30 zilizopita. Chini yake unaorodhesha kila ombi ambalo key yako ilifanya: wakati, endpoint, model, input iliyokeshwa, tokens zilizotozwa na gharama. Keys na matumizi

Kila jibu pia hubeba kitu cha usage chenye hesabu za tokens za wito huo.

Endpoint Fields za usage Zinazoongezwa na model za open-weight zinazopangishwa
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage ina hesabu za tokens za model. Kiasi kinachochukuliwa kutoka kwenye salio lako hakipo kwenye jibu: ni safu ya Tokens zilizotozwa ya orodha ya maombi kwenye Keys na matumizi.
  • Kwenye /v1/messages na model ya open-weight inayopangishwa, input_tokens ni sehemu isiyokeshwa ya input, cache_read_input_tokens ni sehemu iliyokeshwa na cache_creation_input_tokens daima ni 0.
  • Stream kwenye /v1/chat/completions hubeba usage kwenye chunk yake ya mwisho kabla ya [DONE]. Kutiririsha

Salio linapoisha

Ombi ambalo hifadhi yake haitoshei kwenye salio lako hujibiwa kwa hali 429, aina rate_limit_error na ujumbe ulio hapa chini. Hakuna kinachotozwa. Jibu lile lile hutumwa wakati salio liko juu ya sifuri lakini ni dogo kuliko bajeti ya output ya ombi.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

Kwenye /v1/responses kitu cha error kinaweza pia kuwa na code na param, zote null.

Unachoweza kufanya:

  • Subiri kiasi kinachofuata cha mpango saa 00:00 UTC.
  • Ongeza mikopo. Mikopo hutumika baada ya kiasi cha mpango na haiishi muda wake. Ongeza mikopo
  • Badilisha kwenda mpango wenye kiasi kikubwa zaidi cha kila siku. Badilisha mpango
  • Tuma max_tokens ndogo zaidi, ikiwa salio fulani limebaki: hifadhi huwa ndogo zaidi.

Kiasi cha wito wa Shannon Coder

shannon-coder-1 kwenye /v1/chat/completions na /v1/messages huhesabiwa kwa wito, si kwa tokens. Kila mpango unajumuisha idadi ya wito kwa kila dirisha la saa 4. Ombi moja ni wito mmoja.

Mpango Wito kwa dirisha la saa 4
Free 3
Plus 20
Standard 40
Pro 60
  • Madirisha huanza saa 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC. Wito unaobaki mwishoni mwa dirisha haujahamishwi.
  • Wito huhesabiwa ombi linapokubaliwa, kabla model haijajibu. Ombi linalofeli baadaye bado huhesabiwa kama wito.
  • Wito huu hautengi tokens na hauchukui chochote kutoka kwenye salio lako. Orodha ya maombi kwenye Keys na matumizi inaonyesha hesabu yao ya tokens na thamani yake kwa bei iliyoorodheshwa.
  • max_tokens chaguo-msingi ya shannon-coder-1 kwenye endpoint hizi mbili ni 65,536.
  • Wito ukiisha jibu ni hali 429, aina rate_limit_error, ujumbe Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan.
  • Kwenye /v1/responses, shannon-coder-1 haina kiasi cha wito: inatozwa kwa tokens kutoka kwenye salio lako kwa $8.00 kwa 1M, kama kila model nyingine.

Flood protection

Akaunti inaweza kutuma maombi 120 kwa dakika. Hicho ndicho kikomo pekee cha kasi ya maombi, na ni sawa kwenye kila mpango. Kipo kuzuia mafuriko, si kupunguza kasi ya matumizi ya kawaida.

  • Dakika ni dirisha lisilobadilika la sekunde 60 linalofunguka na ombi lako la kwanza. Linapoisha, hesabu huanza upya kutoka sifuri.
  • Hesabu ni kwa kila akaunti, si kwa key na si kwa anwani ya IP. Kubadilisha key hakufungui dirisha jipya.
  • Ombi la 121 ndani ya dirisha hujibiwa kwa hali 429, aina rate_limit_error na ujumbe Too many requests. Retry in <N>s. N ni idadi ya sekunde hadi dirisha liishe, kuanzia 1 hadi 60.
  • Flood protection hukaguliwa kabla ya salio. Ombi linalolikataa halitengi chochote na halina gharama.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
Ombi Flood protection
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses Huhesabiwa, moja kwa kila ombi.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens Haihesabiwi.
shannon-coder-1 kwenye /v1/chat/completions na /v1/messages Huhesabiwa na kiasi cha wito wa Shannon Coder badala yake.
Ombi lililojibiwa kwa 401, au kwa 400 kwa model isiyojulikana Haihesabiwi.
Ombi lililokataliwa na flood protection Huhesabiwa kwenye dirisha. Hakuna kinachotozwa.

Maombi ya sambamba

Hakuna kikomo cha maombi mangapi akaunti inaweza kuwa nayo wazi kwa wakati mmoja, wala kosa kwa kutuma maombi kwa sambamba. Maombi yasiyoweza kuanza mara moja husubiri kwenye foleni na hujibiwa kwa zamu.

  • Kila ombi huhesabiwa kwenye 120 kwa dakika linapofika, iwe maombi ya awali yamekwisha au la.
  • Kila ombi hushikilia hifadhi yake hadi liishe. Maombi ishirini yaliyo wazi yenye bajeti chaguo-msingi ya output hushikilia 20 × 4,096 = 81,920 tokens za salio. Hifadhi zikiwa kubwa kwa pamoja kuliko salio lako, ombi linalofuata hupata jibu la Quota exceeded, ingawa wito uliokamilika ungegharimu kidogo zaidi. max_tokens ndogo zaidi hushikilia kidogo.
  • Ombi lisilo la streaming halitumi chochote hadi jibu lake likamilike, kwa hiyo ipe client yako timeout inayofunika kusubiri. Stream huweka muunganisho wake wazi inaposubiri. Kutiririsha

Mipaka ya ombi moja

Kikomo Thamani Inatumika kwa Kwenye kikomo
Mwili wa ombi 32 MiB (bytes 33,554,432) Kila endpoint Hali 413, aina invalid_request_error.
Bajeti ya output: max_tokens, max_completion_tokens, max_output_tokens 1 hadi 65,536. Chaguo-msingi 4,096; kwa shannon-coder-1 kwenye /v1/chat/completions na /v1/messages chaguo-msingi ni 65,536. Kila model, kama kiasi kinachotengwa kutoka kwenye salio lako. Kama kikomo cha urefu wa jibu: model za open-weight zinazopangishwa, shannon-1.6-lite, shannon-1.6-pro na shannon-coder-1. Thamani iliyo nje ya masafa huhamishiwa mwisho wa karibu zaidi wa masafa. Hakuna kosa.
Stop sequences: stop, stop_sequences Strings 4 Model za open-weight zinazopangishwa Strings 4 za kwanza zisizo tupu hutumika.
Picha au faili lililotolewa kama URL 8 MiB, kusomwa ndani ya sekunde 20, redirects zisizozidi 5, anwani ya umma ya http au https Kila endpoint inayokubali picha au mafaili Ombi hujibiwa bila sehemu hiyo. Hakuna kosa.
Picha au faili lililotumwa ndani ya ombi (base64) Hakuna kikomo chake chenyewe. Huhesabiwa kwenye mwili wa ombi wa 32 MiB. Kila endpoint inayokubali picha au mafaili Hali 413 kwa ombi zima.
text ya POST /v1/tokenize Bytes 4,000,000 /v1/tokenize Hali 413, aina invalid_request_error, ujumbe text too long.
messages za POST /v1/tokenize na mwili wa POST /v1/messages/count_tokens Mwili wa ombi wa 32 MiB Endpoint zote mbili za kuhesabu Hali 413.
Dirisha la muktadha Kwa kila model: context_window kwenye GET /v1/models Kila model Kinachotokea kwa mazungumzo marefu zaidi kinategemea model. Model na bei
Utafutaji wa wavuti (web_search: true) Kwa mpango na siku: Free 3, Plus 30, Standard 50, Pro 60. Utafutaji mmoja huhesabiwa kwa ombi ambalo utafutaji wake ulipata matokeo. Maombi yanayoweka web_search: true Visipobaki ombi hujibiwa bila utafutaji. Hakuna kosa. Utafutaji wa wavuti

Makosa

Majibu ya ukurasa huu. Kwenye /v1/messages kitu kile kile cha error hufungwa kama {"type": "error", "error": {…}}.

Hali Aina Ujumbe Lini, na nini cha kufanya
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan Hifadhi ya ombi haitoshei kwenye salio lako. Subiri hadi 00:00 UTC, ongeza mikopo, badilisha mpango, au tuma max_tokens ndogo zaidi.
429 rate_limit_error Too many requests. Retry in <N>s. Zaidi ya maombi 120 katika dakika ya sasa. Subiri sekunde N na utume tena.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan Wito wa Shannon Coder wa dirisha la sasa la saa 4 umeisha.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. Model haiwezi kupokea ombi kwa sasa. Litume tena baada ya kusimama kwa muda mfupi.
503 api_error Could not verify your quota right now. Please retry. Salio lako halikuweza kusomwa. Hakuna kinachotozwa; tuma ombi tena. Kwenye /v1/responses na model ya Shannon hali ni 500.
413 invalid_request_error Mwili wa ombi ni mkubwa kuliko 32 MiB. Kwenye endpoint za umbizo la OpenAI kitu cha error hubeba code: "request_too_large".
413 invalid_request_error text too long text ya POST /v1/tokenize ni ndefu kuliko bytes 4,000,000.