Mugak eta saldoa
Eskaera guztiak berdin zerbitzatzen dira. Tasa-mailarik ez. API kupo bereizirik ez. Zure tokenak ordaindu dituzu jada — erabili nahi duzun bezain azkar.
Orrialde honek azaltzen du zerez osatuta dagoen zure saldoa, eskaera batek zer erreserbatzen duen eta zenbat kostatzen duen, zenbat eskaera bidal ditzakezun, eta eskaera bakar batek aurki ditzakeen muga gutxiak.
- 1M token saldoren balioa
- $5.00
- eguneko kupoa berritzen da
- 00:00 UTC
- flood protection, kontu bakoitzeko
- 120 eskaera / min
Eskaerak nola zerbitzatzen diren
- Tasa-mailarik ez — Arau batek mugatzen du eskaerak zein azkar irits daitezkeen, eta kontu eta plan guztientzat berbera da: minutuko 120 eskaera. Ez dago minutuko token-mugarik.
- API kupo bereizirik ez — API-ak txatak bezalako saldo bera gastatzen du. Planak gaurko kupoaren tamaina ezartzen du. Ez du eskaera-tasarik ezartzen.
- Nahi bezain azkar — Paraleloan bidalitako eskaerak onartzen dira eta ilaran itxaroten dute. Ez dira paraleloak izateagatik ukatzen.
Zure saldoa
Zure saldoa tokenetan kontatzen da. 1,000,000 token saldok $5.00 balio dute, eta Modeloak eta prezioak orrialdeko prezio guztiak balio horren aurkako tasak dira.
Edozein unetan saldoa bi zatien batura da.
- Gaurko planaren kupoa — Zure planak ezarritako token-kopuru bat. Egunero berritzen da 00:00 UTC-n. Egun baten amaieran geratzen dena ez da hurrengora pasatzen.
- Erositako kreditua — Pakete gisa erosi dituzun tokenak. Kredituak ez du iraungitzen eta plan guztietan balio du, Free barne.
| Plana | Token egunean | Balioa |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- Gastatzeko ordena — Eskaera bakoitzak lehenik gaurko planaren kupoa gastatzen du. Erositako kreditua egun horretan kupotik gorakoa dena ordaintzeko bakarrik erabiltzen da.
- Txatak eta API-ak partekatzen dute — Kontu bakoitzeko saldo bakarra dago. API gako batek berea den kontuaren saldotik gastatzen du, txatean bezalako prezioetan.
- Paketeak — Kreditua 1,000,000 ($5.00), 2,000,000 ($10.00) eta 5,000,000 ($25.00) tokeneko paketetan saltzen da, edo zuk aukeratutako kopuru batean 1,000,000 eta 100,000,000 token artean, 1,000,000 bakoitzeko $5.00-ko prezioan.
Kreditua osatu Plana aldarraitu
Eskaera batek zer erreserbatzen duen eta zenbat kostatzen duen
- Erreserbatu — Eskaera bat iristen denean bere irteera-aurrekontua erreserbatzen du zure saldotik:
max_tokens/v1/chat/completionseta/v1/messagesendpoint-etan,max_output_tokens/v1/responsesendpoint-ean./v1/chat/completions-ekmax_completion_tokensere irakurtzen du. Lehenetsia 4,096 da eta tartea 1etik 65,536ra. - Onartu — Eskaera onartzen da erreserbak geratzen den saldoan sartzen bada bakarrik. Zero baino handiagoa baina irteera-aurrekontua baino txikiagoa den saldoak
Quota exceedederantzuna jasotzen du. Bidalimax_tokenstxikiago bat gainerakoa erabiltzeko. - Likidatu — Erantzuna osatzen denean, erreserba benetako kobrantzak ordezkatzen du. Kobrantza erreserba baino txikiagoa edo handiagoa izan daiteke.
- Itzuli — Errore-egoerarekin amaitzen den eskaerak bere erreserba osorik itzultzen du.
Benetako kobrantza modelo-familiaren araberakoa da.
| Modeloak | Zer kobratzen den |
|---|---|
| Shannon modeloak | usage.total_tokens modeloaren 1M bakoitzeko prezioan. Sarrerak eta irteerak tasa bakarra dute. |
| Pisu irekiko modelo ostatatuak | Cachean ez dagoen sarrera sarrera-tasan, cacheko sarrera cacheko tasan, irteera irteera-tasan. |
USD-tako zenbatekoa zure saldotik kentzen da tokenetan, 1,000,000 bakoitzeko $5.00-ko tasan, token osora biribilduta.
POST /v1/tokenize edo POST /v1/messages/count_tokens bidez tokenak kontatzea doakoa da eta ez du ezer erreserbatzen. Tokenen kontaketa
Saldoa eta erabilera non ikusi
Gakoak eta erabilera orrialdeak une honetan gastatu dezakezuna, gaurko planaren kupoa, erositako kreditua eta azken 30 egunetako API gastua erakusten ditu. Haren azpian zure gakoak egindako eskaera guztiak zerrendatzen ditu: ordua, endpoint-a, modeloa, cacheko sarrera, fakturatutako tokenak eta kostua. Gakoak eta erabilera
Erantzun guztiek usage objektu bat ere badute, dei horren token-kontaketekin.
| Endpoint-a | Usage-ren eremuak | Pisu irekiko modelo ostatatuek gehitua |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usage-k modeloaren token-kontaketak ditu. Zure saldotik kendutako kopurua ez dago erantzunean: Gakoak eta erabilera orrialdeko eskaera-zerrendako Fakturatutako tokenak zutabea da.- Pisu irekiko modelo ostatatu batekin
/v1/messagesendpoint-ean,input_tokenssarreraren cachean ez dagoen zatia da,cache_read_input_tokenscacheko zatia da etacache_creation_input_tokensbeti0da. -
/v1/chat/completionsendpoint-eko stream batekusagedarama[DONE]baino lehenagoko azken chunk-ean. Streaminga
Saldoa agortzen denean
Erreserba zure saldoan sartzen ez den eskaerari 429 egoerarekin, rate_limit_error motarekin eta beheko mezuarekin erantzuten zaio. Ez da ezer kobratzen. Erantzun bera bidaltzen da saldoa zero baino handiagoa baina eskaeraren irteera-aurrekontua baino txikiagoa denean.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses endpoint-ean error objektuak code eta param ere izan ditzake, biak null.
Zer egin dezakezun:
- Itxaron hurrengo planaren kupoa 00:00 UTC-n.
- Gehitu kreditua. Kreditua planaren kupoaren ondoren gastatzen da eta ez du iraungitzen. Kreditua osatu
- Aldatu eguneko kupo handiagoa duen plan batera. Plana aldarraitu
- Bidali
max_tokenstxikiago bat, saldoren bat geratzen bada: erreserba orduan txikiagoa da.
Shannon Coder dei-kupoa
/v1/chat/completions eta /v1/messages endpoint-etako shannon-coder-1 deitan kontatzen da, ez tokenetan. Plan bakoitzak dei-kopuru bat dakar 4 orduko leiho bakoitzeko. Eskaera bat dei bat da.
| Plana | Dei 4 orduko leiho bakoitzeko |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- Leihoak 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-n hasten dira. Leiho baten amaieran geratzen diren deiak ez dira hurrengora pasatzen.
- Dei bat eskaera onartzen denean kontatzen da, modeloak erantzun aurretik. Gero huts egiten duen eskaera batek dei gisa kontatzen jarraitzen du.
- Dei hauek ez dute tokenik erreserbatzen eta ez dute ezer kentzen zure saldotik. Gakoak eta erabilera orrialdeko eskaera-zerrendak haien token-kopurua eta zerrendatutako prezioan duen balioa erakusten ditu.
shannon-coder-1-enmax_tokenslehenetsia bi endpoint hauetan 65,536 da.- Deirik geratzen ez denean erantzuna
429egoera da,rate_limit_errormota,Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/planmezuarekin. /v1/responsesendpoint-ean,shannon-coder-1-ek ez du dei-kupoik: tokenetan kobratzen da zure saldotik $8.00-ko tasan 1M bakoitzeko, beste modelo guztiak bezala.
Flood protection
Kontu batek minutuko 120 eskaera bidal ditzake. Eskaera-tasaren gaineko muga bakarra da, eta plan guztietan berbera da. Uholdeak geldiarazteko dago, ohiko erabilera moteltzeko ez.
- Minutua 60 segundoko leiho finko bat da, zure lehen eskaerarekin irekitzen dena. Amaitzen denean, kontaketa zerotik hasten da berriro.
- Kontaketa kontu bakoitzeko da, ez gako bakoitzeko eta ez IP helbide bakoitzeko. Gakoa birsortzeak ez du leiho berririk irekitzen.
- Leiho baten barruko 121. eskaerari
429egoerarekin,rate_limit_errormotarekin etaToo many requests. Retry in <N>s.mezuarekin erantzuten zaio.Nleihoa amaitu arteko segundo-kopurua da, 1etik 60ra. - Flood protection saldoa baino lehen egiaztatzen da. Ukatzen duen eskaerak ez du ezer erreserbatzen eta ez du ezer kostatzen.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | Eskaera | Flood protection |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | Kontatzen da, bat eskaera bakoitzeko. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | Ez da kontatzen. |
shannon-coder-1 /v1/chat/completions eta /v1/messages endpoint-etan | Shannon Coder dei-kupoak kontatzen du horren ordez. |
401 jaso duen eskaera, edo model ezezagun baten kasuan 400 jaso duena | Ez da kontatzen. |
| Flood protection-ek ukatutako eskaera | Leihoan kontatzen da. Ez da ezer kobratzen. |
Eskaera paraleloak
Ez dago kontu batek aldi berean ireki ditzakeen eskaera-kopuruaren mugarik, ez paraleloan eskaerak bidaltzeagatiko errorerik. Berehala hasi ezin diren eskaerak ilaran itxaroten dute eta txandaka erantzuten zaie.
- Eskaera bakoitza minutuko 120ren barruan kontatzen da iristen denean, aurreko eskaerak amaitu diren ala ez.
- Eskaera bakoitzak bere erreserba mantentzen du amaitu arte. Irteera-aurrekontu lehenetsiarekin irekitako hogei eskaerak 20 × 4,096 = 81,920 token saldo mantentzen dituzte. Erreserbak batera zure saldoa baino handiagoak badira, hurrengo eskaerak
Quota exceedederantzuna jasotzen du, amaitutako deiek gutxiago kostatuko luketen arren.max_tokenstxikiago batek gutxiago mantentzen du. - Streaming gabeko eskaera batek ez du ezer bidaltzen erantzuna osatu arte, beraz eman zure bezeroari itxaronaldia estaltzen duen denbora-muga bat. Stream batek bere konexioa irekita mantentzen du itxaroten duen bitartean. Streaminga
Eskaera bakar baten mugak
| Muga | Balioa | Honi aplikatzen zaio | Mugan |
|---|---|---|---|
| Eskaera-gorputza | 32 MiB (33,554,432 byte) | Endpoint guztiak | 413 egoera, invalid_request_error mota. |
Irteera-aurrekontua: max_tokens, max_completion_tokens, max_output_tokens | 1etik 65,536ra. Lehenetsia 4,096; /v1/chat/completions eta /v1/messages endpoint-etako shannon-coder-1-en lehenetsia 65,536 da. | Modelo guztiak, zure saldotik erreserbatutako kopuru gisa. Erantzunaren luzeraren muga gisa: pisu irekiko modelo ostatatuak, shannon-1.6-lite, shannon-1.6-pro eta shannon-coder-1. | Tartetik kanpoko balioa tarteko hurbilen dagoen muturrera mugitzen da. Errorerik ez. |
Gelditze-sekuentziak: stop, stop_sequences | 4 kate | Pisu irekiko modelo ostatatuak | Hutsak ez diren lehen 4 kateak erabiltzen dira. |
| URL gisa emandako irudia edo fitxategia | 8 MiB, 20 segundoren barruan irakurria, 5 birbideratze gehienez, http edo https helbide publikoa | Irudiak edo fitxategiak hartzen dituen endpoint guztiak | Eskaerari zati hori gabe erantzuten zaio. Errorerik ez. |
| Lerroan bidalitako irudia edo fitxategia (base64) | Ez du muga propiorik. 32 MiB-eko eskaera-gorputzean kontatzen da. | Irudiak edo fitxategiak hartzen dituen endpoint guztiak | 413 egoera eskaera osoarentzat. |
POST /v1/tokenize-ren text | 4,000,000 byte | /v1/tokenize | 413 egoera, invalid_request_error mota, text too long mezua. |
POST /v1/tokenize-ren messages eta POST /v1/messages/count_tokens-en gorputza | 32 MiB-eko eskaera-gorputza | Kontaketa-endpoint biak | 413 egoera. |
| Testuinguru-leihoa | Modelo bakoitzeko: context_window GET /v1/models-en | Modelo guztiak | Elkarrizketa luzeago bati gertatzen zaiona modeloaren araberakoa da. Modeloak eta prezioak |
Web bilaketak (web_search: true) | Plan eta egun bakoitzeko: Free 3, Plus 30, Standard 50, Pro 60. Bilaketa bat kontatzen da bilaketak emaitzak aurkitu dituen eskaera bakoitzeko. | web_search: true ezartzen duten eskaerak | Batere geratzen ez bada, eskaerari bilaketarik gabe erantzuten zaio. Errorerik ez. Web bilaketa |
Erroreak
Orrialde honetako erantzunak. /v1/messages endpoint-ean error objektu bera {"type": "error", "error": {…}} gisa biltzen da.
| Egoera | Mota | Mezua | Noiz, eta zer egin |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | Eskaeraren erreserba ez da zure saldoan sartzen. Itxaron 00:00 UTC arte, gehitu kreditua, aldatu plana, edo bidali max_tokens txikiago bat. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | 120 eskaera baino gehiago uneko minutuan. Itxaron N segundo eta bidali berriro. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | Uneko 4 orduko leihoko Shannon Coder deiak agortu dira. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | Modeloak ezin du eskaera hartu une honetan. Bidali berriro pausa labur baten ondoren. |
503 | api_error | Could not verify your quota right now. Please retry. | Zure saldoa ezin izan da irakurri. Ez da ezer kobratzen; bidali eskaera berriro. /v1/responses endpoint-ean Shannon modelo batekin egoera 500 da. |
413 | invalid_request_error | Eskaera-gorputza 32 MiB baino handiagoa da. OpenAI formatuko endpoint-etan error objektuak code: "request_too_large" darama. | |
413 | invalid_request_error | text too long | POST /v1/tokenize-ren text 4,000,000 byte baino luzeagoa da. |