Pereiti prie turinio
Ribos ir balansas

Ribos ir balansas

Kiekviena užklausa aptarnaujama vienodai. Jokių dažnio pakopų. Jokios atskiros API kvotos. Už savo tokenus jau sumokėjote – naudokite juos taip greitai, kaip norite.

Šiame puslapyje paaiškinama, iš ko sudarytas jūsų balansas, ką viena užklausa rezervuoja ir kiek kainuoja, kiek užklausų galite siųsti ir kelios ribos, su kuriomis gali susidurti pavienė užklausa.

1M balanso tokenų vertė
$5.00
dienos limitas atsinaujina
00:00 UTC
apsauga nuo užplūdimo, vienai paskyrai
120 užklausų / min.

Kaip aptarnaujamos užklausos

  • Jokių dažnio pakopų — Viena taisyklė riboja, kaip greitai gali atvykti užklausos, ir ji vienoda kiekvienai paskyrai bei planui: 120 užklausų per minutę. Tokenų per minutę ribos nėra.
  • Jokios atskiros API kvotos — API leidžia tą patį balansą kaip pokalbis. Planas nustato šiandienos limito dydį. Užklausų dažnio jis nenustato.
  • Tokiu greičiu, kokiu norite — Lygiagrečiai siunčiamos užklausos priimamos ir laukia eilėje. Jos neatmetamos dėl to, kad yra lygiagrečios.

Jūsų balansas

Jūsų balansas skaičiuojamas tokenais. 1,000,000 balanso tokenų vertas $5.00, o kiekviena puslapio Modeliai ir kainos kaina yra tarifas pagal šią vertę.

Bet kuriuo metu balansas yra dviejų dalių suma.

  • Šiandienos plano limitas — Jūsų plano nustatytas tokenų skaičius. Jis atsinaujina kasdien 00:00 UTC. Kas lieka dienos pabaigoje, nepersikelia.
  • Nupirktas kreditas — Tokenai, kuriuos nusipirkote paketu. Kreditas nesuyra ir veikia kiekviename plane, įskaitant Free.
Planas Tokenai per dieną Vertė
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • Išleidimo tvarka — Kiekviena užklausa pirmiausia leidžia šiandienos plano limitą. Nupirktas kreditas naudojamas tik tam, kas tą dieną viršija limitą.
  • Pokalbis ir API dalijasi juo — Kiekviena paskyra turi vieną balansą. API raktas leidžia jį turinčios paskyros balansą tomis pačiomis kainomis kaip pokalbis.
  • Paketai — Kreditas parduodamas paketais po 1,000,000 ($5.00), 2,000,000 ($10.00) ir 5,000,000 ($25.00) tokenų arba jūsų pasirinkta suma nuo 1,000,000 iki 100,000,000 tokenų po $5.00 už 1,000,000.

Papildyti kreditus Keisti planą

Ką užklausa rezervuoja ir kiek kainuoja

  • Rezervavimas — Kai užklausa atvyksta, ji iš jūsų balanso rezervuoja savo išvesties biudžetą: max_tokens kelyje /v1/chat/completions ir /v1/messages, max_output_tokens kelyje /v1/responses. /v1/chat/completions taip pat skaito max_completion_tokens. Numatytoji reikšmė yra 4,096, o intervalas nuo 1 iki 65,536.
  • Priėmimas — Užklausa priimama tik tada, kai rezervacija telpa į jūsų balanso likutį. Jei balansas didesnis už nulį, bet mažesnis už išvesties biudžetą, gaunamas atsakymas Quota exceeded. Siųskite mažesnį max_tokens, kad išnaudotumėte likutį.
  • Sureguliavimas — Kai atsakymas baigtas, rezervacija pakeičiama tikruoju mokesčiu. Mokestis gali būti mažesnis arba didesnis už rezervaciją.
  • Grąžinimas — Užklausa, pasibaigusi klaidos būsena, savo rezervaciją grąžina visą.

Tikrasis apmokestinimas priklauso nuo modelio šeimos.

Modeliai Kas apmokestinama
Shannon modeliai usage.total_tokens pagal modelio kainą už 1M. Įvestis ir išvestis turi vieną tarifą.
Talpinami atvirų svorių modeliai Nekešuota įvestis pagal įvesties tarifą, kešuota įvestis pagal kešo tarifą, išvestis pagal išvesties tarifą.

Suma USD iš jūsų balanso tokenais imama po $5.00 už 1,000,000, apvalinant iki sveiko tokeno.

Tokenų skaičiavimas su POST /v1/tokenize arba POST /v1/messages/count_tokens nemokamas ir nieko nerezervuoja. Tokenų skaičiavimas

Kur matyti balansą ir naudojimą

Puslapyje Raktai ir naudojimas matyti, kiek galite išleisti dabar, šiandienos plano limitas, nupirktas kreditas ir API išlaidos per pastarąsias 30 dienų. Žemiau pateikiama kiekviena jūsų rakto atlikta užklausa: laikas, galinis taškas, modelis, kešuota įvestis, apmokestinti tokenai ir kaina. Raktai ir naudojimas

Kiekviename atsakyme taip pat yra objektas usage su to kreipinio tokenų skaičiumi.

Galutinis taškas Naudojimo laukai Prideda talpinami atvirų svorių modeliai
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage rodo modelio tokenų skaičių. Iš jūsų balanso nuskaičiuota suma atsakyme nepateikiama: ji yra puslapio Raktai ir naudojimas užklausų sąrašo stulpelyje Apmokestinti tokenai.
  • Kelyje /v1/messages su talpinamu atvirų svorių modeliu input_tokens yra nekešuota įvesties dalis, cache_read_input_tokens yra kešuota dalis, o cache_creation_input_tokens visada yra 0.
  • Kelyje /v1/chat/completions srautas usage pateikia paskutiniame gabale prieš [DONE]. Srautinė transliacija

Kai balansas baigiasi

Užklausa, kurios rezervacija netelpa į jūsų balansą, atsakoma būsena 429, tipu rate_limit_error ir toliau pateiktu pranešimu. Nieko neapmokestinama. Tas pats atsakymas siunčiamas, kai balansas didesnis už nulį, bet mažesnis už užklausos išvesties biudžetą.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

Kelyje /v1/responses objekte error gali būti ir code bei param, abu null.

Ką galite daryti:

  • Palaukite kito plano limito 00:00 UTC.
  • Papildykite kreditą. Kreditas leidžiamas po plano limito ir nesuyra. Papildyti kreditus
  • Pereikite į planą su didesniu dienos limitu. Keisti planą
  • Jei dar liko šiek tiek balanso, siųskite mažesnį max_tokens: tada rezervacija bus mažesnė.

Shannon Coder kreipinių limitas

shannon-coder-1 kelyje /v1/chat/completions ir /v1/messages skaičiuojamas kreipiniais, o ne tokenais. Kiekvienas planas apima tam tikrą kreipinių skaičių per 4 valandų langą. Viena užklausa yra vienas kreipinys.

Planas Kreipiniai per 4 valandų langą
Free 3
Plus 20
Standard 40
Pro 60
  • Langai prasideda 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC. Kreipiniai, likę lango pabaigoje, nepersikelia.
  • Kreipinys įskaičiuojamas, kai užklausa priimama, prieš modeliui atsakant. Užklausa, kuri vėliau nepavyksta, vis tiek skaičiuojama kaip kreipinys.
  • Šie kreipiniai tokenų nerezervuoja ir iš jūsų balanso nieko neima. Puslapio Raktai ir naudojimas užklausų sąraše rodomas jų tokenų skaičius ir vertė nurodyta kaina.
  • Numatytasis shannon-coder-1 max_tokens šiuose dvejuose galiniuose taškuose yra 65,536.
  • Kai kreipinių neliko, atsakymas yra būsena 429, tipas rate_limit_error, pranešimas Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan.
  • Kelyje /v1/responses shannon-coder-1 kreipinių limito neturi: jis apmokestinamas tokenais iš jūsų balanso po $8.00 už 1M, kaip ir kiekvienas kitas modelis.

Apsauga nuo užplūdimo

Paskyra gali siųsti 120 užklausų per minutę. Tai vienintelė užklausų dažnio riba, ir ji vienoda kiekviename plane. Ji skirta užplūdimui sustabdyti, o ne įprastam naudojimui lėtinti.

  • Minutė yra fiksuotas 60 sekundžių langas, kuris atsidaro su jūsų pirmąja užklausa. Jam pasibaigus, skaičiavimas vėl prasideda nuo nulio.
  • Skaičiuojama pagal paskyrą, o ne pagal raktą ar IP adresą. Rakto keitimas naujo lango neatidaro.
  • 121-oji užklausa lango viduje atsakoma būsena 429, tipu rate_limit_error ir pranešimu Too many requests. Retry in <N>s. N yra sekundžių iki lango pabaigos skaičius, nuo 1 iki 60.
  • Apsauga nuo užplūdimo tikrinama prieš balansą. Ji atmesta užklausa nieko nerezervuoja ir nieko nekainuoja.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
Užklausa Apsauga nuo užplūdimo
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses Skaičiuojama, po vieną už užklausą.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens Neskaičiuojama.
shannon-coder-1 kelyje /v1/chat/completions ir /v1/messages Vietoj to skaičiuojama pagal Shannon Coder kreipinių limitą.
Užklausa, atsakyta 401, arba 400 dėl nežinomo model Neskaičiuojama.
Užklausa, kurią atmetė apsauga nuo užplūdimo Įskaičiuojama į langą. Nieko neapmokestinama.

Lygiagrečios užklausos

Nėra jokios ribos, kiek užklausų paskyra gali turėti atvirų vienu metu, ir nėra klaidos už lygiagrečių užklausų siuntimą. Užklausos, kurios negali prasidėti iš karto, laukia eilėje ir atsakomos paeiliui.

  • Kiekviena užklausa įskaičiuojama į 120 per minutę, kai tik atvyksta, nesvarbu, ar ankstesnės jau baigėsi.
  • Kiekviena užklausa laiko savo rezervaciją, kol baigiasi. Dvidešimt atvirų užklausų su numatytuoju išvesties biudžetu laiko 20 × 4,096 = 81,920 balanso tokenų. Jei rezervacijos kartu didesnės už jūsų balansą, kita užklausa gauna atsakymą Quota exceeded, nors baigti kreipiniai būtų kainavę mažiau. Mažesnis max_tokens laiko mažiau.
  • Užklausa be srautinio perdavimo nieko nesiunčia, kol atsakymas nebaigtas, todėl klientui nustatykite laiko ribą, apimančią laukimą. Srautas laukdamas palaiko ryšį atvirą. Srautinė transliacija

Pavienės užklausos ribos

Riba Reikšmė Taikoma Pasiekus ribą
Užklausos turinys 32 MiB (33,554,432 baitų) Kiekvienas galinis taškas Būsena 413, tipas invalid_request_error.
Išvesties biudžetas: max_tokens, max_completion_tokens, max_output_tokens Nuo 1 iki 65,536. Numatytoji 4,096; shannon-coder-1 kelyje /v1/chat/completions ir /v1/messages numatytoji yra 65,536. Kiekvienas modelis, kaip iš jūsų balanso rezervuojama suma. Kaip atsakymo ilgio riba: talpinami atvirų svorių modeliai, shannon-1.6-lite, shannon-1.6-pro ir shannon-coder-1. Reikšmė už intervalo ribų perkeliama į artimiausią intervalo galą. Klaidos nėra.
Sustojimo sekos: stop, stop_sequences 4 eilutės Talpinami atvirų svorių modeliai Naudojamos pirmosios 4 netuščios eilutės.
Vaizdas ar failas, nurodytas kaip URL 8 MiB, nuskaitoma per 20 sekundžių, ne daugiau kaip 5 peradresavimai, viešas http arba https adresas Kiekvienas galinis taškas, priimantis vaizdus ar failus Į užklausą atsakoma be tos dalies. Klaidos nėra.
Įterptiniu būdu (base64) siunčiamas vaizdas ar failas Savo ribos nėra. Įskaičiuojamas į 32 MiB užklausos turinį. Kiekvienas galinis taškas, priimantis vaizdus ar failus Būsena 413 visai užklausai.
POST /v1/tokenize laukas text 4,000,000 baitų /v1/tokenize Būsena 413, tipas invalid_request_error, pranešimas text too long.
POST /v1/tokenize laukas messages ir POST /v1/messages/count_tokens turinys 32 MiB užklausos turinys Abu skaičiavimo galiniai taškai Būsena 413.
Konteksto langas Pagal modelį: context_window kelyje GET /v1/models Kiekvienas modelis Kas nutinka ilgesniam pokalbiui, priklauso nuo modelio. Modeliai ir kainos
Paieškos internete (web_search: true) Pagal planą ir dieną: Free 3, Plus 30, Standard 50, Pro 60. Viena paieška skaičiuojama užklausai, kurios paieška rado rezultatų. Užklausos, kuriose nustatyta web_search: true Kai paieškų neliko, į užklausą atsakoma be paieškos. Klaidos nėra. Žiniatinklio paieška

Klaidos

Šio puslapio atsakymai. Kelyje /v1/messages tas pats objektas error apgaubiamas kaip {"type": "error", "error": {…}}.

Būsena Tipas Pranešimas Kada ir ką daryti
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan Užklausos rezervacija netelpa į jūsų balansą. Palaukite iki 00:00 UTC, papildykite kreditą, pakeiskite planą arba siųskite mažesnį max_tokens.
429 rate_limit_error Too many requests. Retry in <N>s. Daugiau nei 120 užklausų per dabartinę minutę. Palaukite N sekundžių ir siųskite dar kartą.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan Dabartinio 4 valandų lango Shannon Coder kreipiniai išnaudoti.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. Modelis šiuo metu užklausos priimti negali. Po trumpos pauzės siųskite ją dar kartą.
503 api_error Could not verify your quota right now. Please retry. Jūsų balanso nepavyko nuskaityti. Nieko neapmokestinama; siųskite užklausą dar kartą. Kelyje /v1/responses su Shannon modeliu būsena yra 500.
413 invalid_request_error Užklausos turinys didesnis nei 32 MiB. OpenAI formato galiniuose taškuose objekte error yra code: "request_too_large".
413 invalid_request_error text too long POST /v1/tokenize laukas text ilgesnis nei 4,000,000 baitų.