Lumaktaw sa nilalaman
Mga limitasyon at balance

Mga limitasyon at balance

Pantay na pinagsisilbihan ang bawat request. Walang rate tier. Walang hiwalay na API quota. Nabayaran mo na ang iyong tokens — gamitin ang mga ito nang kasing-bilis ng gusto mo.

Ipinapaliwanag ng pahinang ito kung saan binubuo ang iyong balance, kung ano ang itinatabi at nagagastos ng isang request, ilang request ang maaari mong ipadala, at ang ilang limitasyong maaaring salubungin ng isang request.

halaga ng 1M token ng balance
$5.00
nagre-renew ang daily allowance
00:00 UTC
flood protection, kada account
120 request / min

Paano pinagsisilbihan ang mga request

  • Walang rate tier — Isang patakaran ang naglilimita kung gaano kabilis dumating ang mga request, at pareho ito sa bawat account at bawat plan: 120 request kada minuto. Walang limitasyon sa tokens kada minuto.
  • Walang hiwalay na API quota — Ang API ay gumagastos ng parehong balance ng chat. Itinatakda ng plan ang laki ng allowance ngayong araw. Hindi nito itinatakda ang bilis ng request.
  • Kasing-bilis ng gusto mo — Tinatanggap ang mga request na sabay-sabay na ipinadala at naghihintay sa pila. Hindi sila tinatanggihan dahil lang sa pagiging parallel.

Ang iyong balance

Binibilang sa tokens ang iyong balance. Ang 1,000,000 token ng balance ay nagkakahalaga ng $5.00, at bawat presyo sa pahinang Mga model at presyo ay rate laban sa halagang iyon.

Sa anumang sandali, ang balance ay ang kabuuan ng dalawang bahagi.

  • Plan allowance ngayong araw — Isang bilang ng tokens na itinakda ng iyong plan. Bago ito araw-araw sa 00:00 UTC. Ang natira sa pagtatapos ng araw ay hindi dinadala.
  • Biniling credit — Mga token na binili mo bilang pack. Hindi nag-e-expire ang credit at gumagana sa bawat plan, kasama ang Free.
Plan Tokens kada araw Halaga
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • Pagkakasunod ng paggastos — Bawat request ay unang gumagastos ng plan allowance ngayong araw. Ginagamit lamang ang biniling credit para sa lampas sa allowance sa araw na iyon.
  • Pinaghahatian ng chat at API — Isang balance kada account. Ang API key ay gumagastos mula sa balance ng account na nagmamay-ari nito, sa parehong presyo ng chat.
  • Mga pack — Ibinebenta ang credit sa mga pack na 1,000,000 ($5.00), 2,000,000 ($10.00) at 5,000,000 ($25.00) token, o bilang halagang pipiliin mo mula 1,000,000 hanggang 100,000,000 token sa $5.00 kada 1,000,000.

Mag-top up ng credit Palitan ang plan

Ano ang itinatabi ng request at ano ang halaga nito

  • Pagtatabi — Kapag dumating ang request, itinatabi nito ang output budget nito mula sa iyong balance: max_tokens sa /v1/chat/completions at /v1/messages, max_output_tokens sa /v1/responses. Binabasa rin ng /v1/chat/completions ang max_completion_tokens. 4,096 ang default at 1 hanggang 65,536 ang saklaw.
  • Pagtanggap — Tinatanggap lamang ang request kung kasya ang reservation sa natitira sa iyong balance. Ang balanceng higit sa zero pero mas maliit sa output budget ay nakakakuha ng reply na Quota exceeded. Magpadala ng mas maliit na max_tokens para magamit ang natitira.
  • Pagsasara ng singil — Kapag kumpleto na ang sagot, pinapalitan ng tunay na singil ang reservation. Maaaring mas mababa o mas mataas ang singil kaysa sa reservation.
  • Pagbabalik — Ang request na nagtatapos sa error status ay ibinabalik nang buo ang reservation nito.

Nakadepende sa pamilya ng model ang tunay na singil.

Mga model Ano ang sinisingil
Mga Shannon model Ang usage.total_tokens sa presyo ng model kada 1M. Iisa ang rate ng input at output.
Mga hosted open-weight model Uncached input sa input rate, cached input sa cached rate, output sa output rate.

Ang halagang USD ay kinukuha mula sa iyong balance sa tokens sa $5.00 kada 1,000,000, na ibinibilog sa buong token.

Libre ang pagbibilang ng tokens gamit ang POST /v1/tokenize o POST /v1/messages/count_tokens at wala itong itinatabi. Pagbibilang ng token

Kung saan makikita ang balance at usage

Ipinapakita ng pahinang Keys & usage kung ano ang maaari mong gastusin ngayon, ang plan allowance ngayong araw, ang biniling credit at ang API spend sa nakalipas na 30 araw. Sa ibaba nito, inililista ang bawat request na ginawa ng iyong key: oras, endpoint, model, cached input, sinisingil na tokens at gastos. Keys & usage

Bawat reply ay may dala ring usage object na may bilang ng token ng call na iyon.

Endpoint Mga field ng usage Idinaragdag ng mga hosted open-weight model
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • Hawak ng usage ang bilang ng token ng model. Wala sa reply ang halagang kinukuha sa iyong balance: ito ang column na Sinisingil na tokens sa listahan ng request sa Keys & usage.
  • Sa /v1/messages na may hosted open-weight model, ang input_tokens ay ang uncached na bahagi ng input, ang cache_read_input_tokens ay ang cached na bahagi at ang cache_creation_input_tokens ay palaging 0.
  • Ang stream sa /v1/chat/completions ay may dalang usage sa huling chunk nito bago ang [DONE]. Pag‑stream

Kapag naubos ang balance

Ang request na hindi kasya ang reservation sa iyong balance ay sinasagot ng status na 429, type na rate_limit_error at ng mensahe sa ibaba. Walang sinisingil. Ipinapadala ang parehong reply kapag ang balance ay higit sa zero pero mas maliit sa output budget ng request.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

Sa /v1/responses, maaari ring maglaman ang error object ng code at param, parehong null.

Ang maaari mong gawin:

  • Hintayin ang susunod na plan allowance sa 00:00 UTC.
  • Mag-top up ng credit. Ginagastos ang credit pagkatapos ng plan allowance at hindi ito nag-e-expire. Mag-top up ng credit
  • Lumipat sa plan na may mas malaking daily allowance. Palitan ang plan
  • Magpadala ng mas maliit na max_tokens, kung may natitirang balance: mas maliit na ang reservation.

Shannon Coder call allowance

Ang shannon-coder-1 sa /v1/chat/completions at /v1/messages ay binibilang sa call, hindi sa tokens. Bawat plan ay may kasamang bilang ng call kada 4-hour window. Ang isang request ay isang call.

Plan Mga call kada 4-hour window
Free 3
Plus 20
Standard 40
Pro 60
  • Nagsisimula ang mga window sa 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC. Ang mga call na natira sa pagtatapos ng window ay hindi dinadala.
  • Binibilang ang call kapag tinanggap ang request, bago sumagot ang model. Ang request na nabigo pagkatapos ay binibilang pa rin bilang call.
  • Hindi nagtatabi ng token ang mga call na ito at walang kinukuha sa iyong balance. Ipinapakita ng listahan ng request sa Keys & usage ang bilang ng token ng mga ito at ang halaga nito sa nakalistang presyo.
  • Ang default na max_tokens ng shannon-coder-1 sa dalawang endpoint na ito ay 65,536.
  • Kapag wala nang natitirang call, ang reply ay status na 429, type na rate_limit_error, mensaheng Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan.
  • Sa /v1/responses, walang call allowance ang shannon-coder-1: sinisingil ito sa tokens mula sa iyong balance sa $8.00 kada 1M, tulad ng bawat ibang model.

Flood protection

Maaaring magpadala ang isang account ng 120 request kada minuto. Iyon lang ang limitasyon sa bilis ng request, at pareho ito sa bawat plan. Umiiral ito para pigilan ang pagbaha ng request, hindi para pabagalin ang normal na paggamit.

  • Ang minuto ay nakapirming window na 60 segundo na nagbubukas sa una mong request. Kapag natapos ito, nagsisimula ulit sa zero ang bilang.
  • Kada account ang bilang, hindi kada key at hindi kada IP address. Hindi nagbubukas ng bagong window ang pag-rotate ng key.
  • Ang ika-121 na request sa loob ng window ay sinasagot ng status na 429, type na rate_limit_error at mensaheng Too many requests. Retry in <N>s. Ang N ay ang bilang ng segundo hanggang matapos ang window, mula 1 hanggang 60.
  • Sinusuri ang flood protection bago ang balance. Ang request na tinanggihan nito ay walang itinatabi at walang gastos.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
Request Flood protection
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses Binibilang, isa kada request.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens Hindi binibilang.
shannon-coder-1 sa /v1/chat/completions at /v1/messages Binibilang na lang ng Shannon Coder call allowance.
Request na sinagot ng 401, o ng 400 para sa hindi kilalang model Hindi binibilang.
Request na tinanggihan ng flood protection Binibilang sa window. Walang sinisingil.

Mga parallel na request

Walang limitasyon sa dami ng request na sabay-sabay na bukas ng isang account, at walang error sa pagpapadala ng mga request nang parallel. Ang mga request na hindi agad makapagsimula ay naghihintay sa pila at sinasagot nang sunud-sunod.

  • Binibilang ang bawat request sa 120 kada minuto pagdating nito, tapos man o hindi ang mga naunang request.
  • Hawak ng bawat request ang sarili nitong reservation hanggang matapos ito. Dalawampung bukas na request na may default na output budget ay may hawak na 20 × 4,096 = 81,920 token ng balance. Kung mas malaki ang kabuuan ng mga reservation kaysa sa iyong balance, ang susunod na request ay makakakuha ng reply na Quota exceeded, kahit mas mura sana ang halaga ng mga natapos na call. Mas kaunti ang hawak ng mas maliit na max_tokens.
  • Ang request na walang streaming ay walang ipinapadala hanggang kumpleto ang sagot nito, kaya bigyan ang iyong client ng timeout na sasakop sa paghihintay. Pinananatiling bukas ng stream ang koneksyon nito habang naghihintay. Pag‑stream

Mga limitasyon ng isang request

Limitasyon Value Ina-apply sa Sa limitasyon
Request body 32 MiB (33,554,432 byte) Bawat endpoint Status na 413, type na invalid_request_error.
Output budget: max_tokens, max_completion_tokens, max_output_tokens 1 hanggang 65,536. Default na 4,096; para sa shannon-coder-1 sa /v1/chat/completions at /v1/messages, ang default ay 65,536. Bawat model, bilang halagang itinatabi mula sa iyong balance. Bilang limitasyon sa haba ng sagot: ang mga hosted open-weight model, shannon-1.6-lite, shannon-1.6-pro at shannon-coder-1. Ang value na wala sa saklaw ay inililipat sa pinakamalapit na dulo ng saklaw. Walang error.
Mga stop sequence: stop, stop_sequences 4 na string Mga hosted open-weight model Ginagamit ang unang 4 na hindi walang lamang string.
Image o file na ibinigay bilang URL 8 MiB, binabasa sa loob ng 20 segundo, hanggang 5 redirect, pampublikong http o https na address Bawat endpoint na tumatanggap ng mga image o file Sinasagot ang request nang wala ang bahaging iyon. Walang error.
Image o file na ipinadala inline (base64) Walang sariling limitasyon. Binibilang ito sa 32 MiB na request body. Bawat endpoint na tumatanggap ng mga image o file Status na 413 para sa buong request.
text ng POST /v1/tokenize 4,000,000 byte /v1/tokenize Status na 413, type na invalid_request_error, mensaheng text too long.
messages ng POST /v1/tokenize at ang body ng POST /v1/messages/count_tokens Ang 32 MiB na request body Parehong counting endpoint Status na 413.
Context window Kada model: context_window sa GET /v1/models Bawat model Nakadepende sa model kung ano ang mangyayari sa mas mahabang conversation. Mga model at presyo
Mga web search (web_search: true) Kada plan at araw: Free 3, Plus 30, Standard 50, Pro 60. Isang search ang binibilang para sa request na may nakitang resulta ang search. Mga request na nagse-set ng web_search: true Kapag wala nang natitira, sinasagot ang request nang walang search. Walang error. Web search

Mga error

Ang mga reply ng pahinang ito. Sa /v1/messages, ang parehong error object ay binabalot bilang {"type": "error", "error": {…}}.

Status Type Mensahe Kailan, at ano ang gagawin
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan Hindi kasya ang reservation ng request sa iyong balance. Hintayin ang 00:00 UTC, mag-top up ng credit, magpalit ng plan, o magpadala ng mas maliit na max_tokens.
429 rate_limit_error Too many requests. Retry in <N>s. Higit sa 120 request sa kasalukuyang minuto. Maghintay ng N segundo at ipadala muli.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan Naubos na ang Shannon Coder calls ng kasalukuyang 4-hour window.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. Hindi matanggap ng model ang request sa ngayon. Ipadala muli pagkatapos ng maikling pahinga.
503 api_error Could not verify your quota right now. Please retry. Hindi mabasa ang iyong balance. Walang sinisingil; ipadala muli ang request. Sa /v1/responses na may Shannon model, ang status ay 500.
413 invalid_request_error Mas malaki sa 32 MiB ang request body. Sa mga endpoint na OpenAI-format, dala ng error object ang code: "request_too_large".
413 invalid_request_error text too long Mas mahaba sa 4,000,000 byte ang text ng POST /v1/tokenize.