Joan edukira
Mugak eta saldoa

Mugak eta saldoa

Eskaera guztiak berdin zerbitzatzen dira. Tasa-mailarik ez. API kupo bereizirik ez. Zure tokenak ordaindu dituzu jada — erabili nahi duzun bezain azkar.

Orrialde honek azaltzen du zerez osatuta dagoen zure saldoa, eskaera batek zer erreserbatzen duen eta zenbat kostatzen duen, zenbat eskaera bidal ditzakezun, eta eskaera bakar batek aurki ditzakeen muga gutxiak.

1M token saldoren balioa
$5.00
eguneko kupoa berritzen da
00:00 UTC
flood protection, kontu bakoitzeko
120 eskaera / min

Eskaerak nola zerbitzatzen diren

  • Tasa-mailarik ez — Arau batek mugatzen du eskaerak zein azkar irits daitezkeen, eta kontu eta plan guztientzat berbera da: minutuko 120 eskaera. Ez dago minutuko token-mugarik.
  • API kupo bereizirik ez — API-ak txatak bezalako saldo bera gastatzen du. Planak gaurko kupoaren tamaina ezartzen du. Ez du eskaera-tasarik ezartzen.
  • Nahi bezain azkar — Paraleloan bidalitako eskaerak onartzen dira eta ilaran itxaroten dute. Ez dira paraleloak izateagatik ukatzen.

Zure saldoa

Zure saldoa tokenetan kontatzen da. 1,000,000 token saldok $5.00 balio dute, eta Modeloak eta prezioak orrialdeko prezio guztiak balio horren aurkako tasak dira.

Edozein unetan saldoa bi zatien batura da.

  • Gaurko planaren kupoa — Zure planak ezarritako token-kopuru bat. Egunero berritzen da 00:00 UTC-n. Egun baten amaieran geratzen dena ez da hurrengora pasatzen.
  • Erositako kreditua — Pakete gisa erosi dituzun tokenak. Kredituak ez du iraungitzen eta plan guztietan balio du, Free barne.
Plana Token egunean Balioa
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • Gastatzeko ordena — Eskaera bakoitzak lehenik gaurko planaren kupoa gastatzen du. Erositako kreditua egun horretan kupotik gorakoa dena ordaintzeko bakarrik erabiltzen da.
  • Txatak eta API-ak partekatzen dute — Kontu bakoitzeko saldo bakarra dago. API gako batek berea den kontuaren saldotik gastatzen du, txatean bezalako prezioetan.
  • Paketeak — Kreditua 1,000,000 ($5.00), 2,000,000 ($10.00) eta 5,000,000 ($25.00) tokeneko paketetan saltzen da, edo zuk aukeratutako kopuru batean 1,000,000 eta 100,000,000 token artean, 1,000,000 bakoitzeko $5.00-ko prezioan.

Kreditua osatu Plana aldarraitu

Eskaera batek zer erreserbatzen duen eta zenbat kostatzen duen

  • Erreserbatu — Eskaera bat iristen denean bere irteera-aurrekontua erreserbatzen du zure saldotik: max_tokens /v1/chat/completions eta /v1/messages endpoint-etan, max_output_tokens /v1/responses endpoint-ean. /v1/chat/completions-ek max_completion_tokens ere irakurtzen du. Lehenetsia 4,096 da eta tartea 1etik 65,536ra.
  • Onartu — Eskaera onartzen da erreserbak geratzen den saldoan sartzen bada bakarrik. Zero baino handiagoa baina irteera-aurrekontua baino txikiagoa den saldoak Quota exceeded erantzuna jasotzen du. Bidali max_tokens txikiago bat gainerakoa erabiltzeko.
  • Likidatu — Erantzuna osatzen denean, erreserba benetako kobrantzak ordezkatzen du. Kobrantza erreserba baino txikiagoa edo handiagoa izan daiteke.
  • Itzuli — Errore-egoerarekin amaitzen den eskaerak bere erreserba osorik itzultzen du.

Benetako kobrantza modelo-familiaren araberakoa da.

Modeloak Zer kobratzen den
Shannon modeloak usage.total_tokens modeloaren 1M bakoitzeko prezioan. Sarrerak eta irteerak tasa bakarra dute.
Pisu irekiko modelo ostatatuak Cachean ez dagoen sarrera sarrera-tasan, cacheko sarrera cacheko tasan, irteera irteera-tasan.

USD-tako zenbatekoa zure saldotik kentzen da tokenetan, 1,000,000 bakoitzeko $5.00-ko tasan, token osora biribilduta.

POST /v1/tokenize edo POST /v1/messages/count_tokens bidez tokenak kontatzea doakoa da eta ez du ezer erreserbatzen. Tokenen kontaketa

Saldoa eta erabilera non ikusi

Gakoak eta erabilera orrialdeak une honetan gastatu dezakezuna, gaurko planaren kupoa, erositako kreditua eta azken 30 egunetako API gastua erakusten ditu. Haren azpian zure gakoak egindako eskaera guztiak zerrendatzen ditu: ordua, endpoint-a, modeloa, cacheko sarrera, fakturatutako tokenak eta kostua. Gakoak eta erabilera

Erantzun guztiek usage objektu bat ere badute, dei horren token-kontaketekin.

Endpoint-a Usage-ren eremuak Pisu irekiko modelo ostatatuek gehitua
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage-k modeloaren token-kontaketak ditu. Zure saldotik kendutako kopurua ez dago erantzunean: Gakoak eta erabilera orrialdeko eskaera-zerrendako Fakturatutako tokenak zutabea da.
  • Pisu irekiko modelo ostatatu batekin /v1/messages endpoint-ean, input_tokens sarreraren cachean ez dagoen zatia da, cache_read_input_tokens cacheko zatia da eta cache_creation_input_tokens beti 0 da.
  • /v1/chat/completions endpoint-eko stream batek usage darama [DONE] baino lehenagoko azken chunk-ean. Streaminga

Saldoa agortzen denean

Erreserba zure saldoan sartzen ez den eskaerari 429 egoerarekin, rate_limit_error motarekin eta beheko mezuarekin erantzuten zaio. Ez da ezer kobratzen. Erantzun bera bidaltzen da saldoa zero baino handiagoa baina eskaeraren irteera-aurrekontua baino txikiagoa denean.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses endpoint-ean error objektuak code eta param ere izan ditzake, biak null.

Zer egin dezakezun:

  • Itxaron hurrengo planaren kupoa 00:00 UTC-n.
  • Gehitu kreditua. Kreditua planaren kupoaren ondoren gastatzen da eta ez du iraungitzen. Kreditua osatu
  • Aldatu eguneko kupo handiagoa duen plan batera. Plana aldarraitu
  • Bidali max_tokens txikiago bat, saldoren bat geratzen bada: erreserba orduan txikiagoa da.

Shannon Coder dei-kupoa

/v1/chat/completions eta /v1/messages endpoint-etako shannon-coder-1 deitan kontatzen da, ez tokenetan. Plan bakoitzak dei-kopuru bat dakar 4 orduko leiho bakoitzeko. Eskaera bat dei bat da.

Plana Dei 4 orduko leiho bakoitzeko
Free 3
Plus 20
Standard 40
Pro 60
  • Leihoak 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-n hasten dira. Leiho baten amaieran geratzen diren deiak ez dira hurrengora pasatzen.
  • Dei bat eskaera onartzen denean kontatzen da, modeloak erantzun aurretik. Gero huts egiten duen eskaera batek dei gisa kontatzen jarraitzen du.
  • Dei hauek ez dute tokenik erreserbatzen eta ez dute ezer kentzen zure saldotik. Gakoak eta erabilera orrialdeko eskaera-zerrendak haien token-kopurua eta zerrendatutako prezioan duen balioa erakusten ditu.
  • shannon-coder-1-en max_tokens lehenetsia bi endpoint hauetan 65,536 da.
  • Deirik geratzen ez denean erantzuna 429 egoera da, rate_limit_error mota, Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan mezuarekin.
  • /v1/responses endpoint-ean, shannon-coder-1-ek ez du dei-kupoik: tokenetan kobratzen da zure saldotik $8.00-ko tasan 1M bakoitzeko, beste modelo guztiak bezala.

Flood protection

Kontu batek minutuko 120 eskaera bidal ditzake. Eskaera-tasaren gaineko muga bakarra da, eta plan guztietan berbera da. Uholdeak geldiarazteko dago, ohiko erabilera moteltzeko ez.

  • Minutua 60 segundoko leiho finko bat da, zure lehen eskaerarekin irekitzen dena. Amaitzen denean, kontaketa zerotik hasten da berriro.
  • Kontaketa kontu bakoitzeko da, ez gako bakoitzeko eta ez IP helbide bakoitzeko. Gakoa birsortzeak ez du leiho berririk irekitzen.
  • Leiho baten barruko 121. eskaerari 429 egoerarekin, rate_limit_error motarekin eta Too many requests. Retry in <N>s. mezuarekin erantzuten zaio. N leihoa amaitu arteko segundo-kopurua da, 1etik 60ra.
  • Flood protection saldoa baino lehen egiaztatzen da. Ukatzen duen eskaerak ez du ezer erreserbatzen eta ez du ezer kostatzen.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
Eskaera Flood protection
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses Kontatzen da, bat eskaera bakoitzeko.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens Ez da kontatzen.
shannon-coder-1 /v1/chat/completions eta /v1/messages endpoint-etan Shannon Coder dei-kupoak kontatzen du horren ordez.
401 jaso duen eskaera, edo model ezezagun baten kasuan 400 jaso duena Ez da kontatzen.
Flood protection-ek ukatutako eskaera Leihoan kontatzen da. Ez da ezer kobratzen.

Eskaera paraleloak

Ez dago kontu batek aldi berean ireki ditzakeen eskaera-kopuruaren mugarik, ez paraleloan eskaerak bidaltzeagatiko errorerik. Berehala hasi ezin diren eskaerak ilaran itxaroten dute eta txandaka erantzuten zaie.

  • Eskaera bakoitza minutuko 120ren barruan kontatzen da iristen denean, aurreko eskaerak amaitu diren ala ez.
  • Eskaera bakoitzak bere erreserba mantentzen du amaitu arte. Irteera-aurrekontu lehenetsiarekin irekitako hogei eskaerak 20 × 4,096 = 81,920 token saldo mantentzen dituzte. Erreserbak batera zure saldoa baino handiagoak badira, hurrengo eskaerak Quota exceeded erantzuna jasotzen du, amaitutako deiek gutxiago kostatuko luketen arren. max_tokens txikiago batek gutxiago mantentzen du.
  • Streaming gabeko eskaera batek ez du ezer bidaltzen erantzuna osatu arte, beraz eman zure bezeroari itxaronaldia estaltzen duen denbora-muga bat. Stream batek bere konexioa irekita mantentzen du itxaroten duen bitartean. Streaminga

Eskaera bakar baten mugak

Muga Balioa Honi aplikatzen zaio Mugan
Eskaera-gorputza 32 MiB (33,554,432 byte) Endpoint guztiak 413 egoera, invalid_request_error mota.
Irteera-aurrekontua: max_tokens, max_completion_tokens, max_output_tokens 1etik 65,536ra. Lehenetsia 4,096; /v1/chat/completions eta /v1/messages endpoint-etako shannon-coder-1-en lehenetsia 65,536 da. Modelo guztiak, zure saldotik erreserbatutako kopuru gisa. Erantzunaren luzeraren muga gisa: pisu irekiko modelo ostatatuak, shannon-1.6-lite, shannon-1.6-pro eta shannon-coder-1. Tartetik kanpoko balioa tarteko hurbilen dagoen muturrera mugitzen da. Errorerik ez.
Gelditze-sekuentziak: stop, stop_sequences 4 kate Pisu irekiko modelo ostatatuak Hutsak ez diren lehen 4 kateak erabiltzen dira.
URL gisa emandako irudia edo fitxategia 8 MiB, 20 segundoren barruan irakurria, 5 birbideratze gehienez, http edo https helbide publikoa Irudiak edo fitxategiak hartzen dituen endpoint guztiak Eskaerari zati hori gabe erantzuten zaio. Errorerik ez.
Lerroan bidalitako irudia edo fitxategia (base64) Ez du muga propiorik. 32 MiB-eko eskaera-gorputzean kontatzen da. Irudiak edo fitxategiak hartzen dituen endpoint guztiak 413 egoera eskaera osoarentzat.
POST /v1/tokenize-ren text 4,000,000 byte /v1/tokenize 413 egoera, invalid_request_error mota, text too long mezua.
POST /v1/tokenize-ren messages eta POST /v1/messages/count_tokens-en gorputza 32 MiB-eko eskaera-gorputza Kontaketa-endpoint biak 413 egoera.
Testuinguru-leihoa Modelo bakoitzeko: context_window GET /v1/models-en Modelo guztiak Elkarrizketa luzeago bati gertatzen zaiona modeloaren araberakoa da. Modeloak eta prezioak
Web bilaketak (web_search: true) Plan eta egun bakoitzeko: Free 3, Plus 30, Standard 50, Pro 60. Bilaketa bat kontatzen da bilaketak emaitzak aurkitu dituen eskaera bakoitzeko. web_search: true ezartzen duten eskaerak Batere geratzen ez bada, eskaerari bilaketarik gabe erantzuten zaio. Errorerik ez. Web bilaketa

Erroreak

Orrialde honetako erantzunak. /v1/messages endpoint-ean error objektu bera {"type": "error", "error": {…}} gisa biltzen da.

Egoera Mota Mezua Noiz, eta zer egin
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan Eskaeraren erreserba ez da zure saldoan sartzen. Itxaron 00:00 UTC arte, gehitu kreditua, aldatu plana, edo bidali max_tokens txikiago bat.
429 rate_limit_error Too many requests. Retry in <N>s. 120 eskaera baino gehiago uneko minutuan. Itxaron N segundo eta bidali berriro.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan Uneko 4 orduko leihoko Shannon Coder deiak agortu dira.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. Modeloak ezin du eskaera hartu une honetan. Bidali berriro pausa labur baten ondoren.
503 api_error Could not verify your quota right now. Please retry. Zure saldoa ezin izan da irakurri. Ez da ezer kobratzen; bidali eskaera berriro. /v1/responses endpoint-ean Shannon modelo batekin egoera 500 da.
413 invalid_request_error Eskaera-gorputza 32 MiB baino handiagoa da. OpenAI formatuko endpoint-etan error objektuak code: "request_too_large" darama.
413 invalid_request_error text too long POST /v1/tokenize-ren text 4,000,000 byte baino luzeagoa da.