Korlátok és egyenleg
Minden kérést egyformán szolgálunk ki. Nincsenek sebességszintek. Nincs külön API-kvóta. A tokenjeidet már kifizetted — használd őket olyan gyorsan, ahogy csak szeretnéd.
Ez az oldal elmagyarázza, miből áll az egyenleged, mit foglal le és mibe kerül egy kérés, hány kérést küldhetsz, és milyen kevés korláttal találkozhat egyetlen kérés.
- 1M token egyenleg értéke
- $5.00
- a napi keret megújul
- 00:00 UTC
- flood protection, fiókonként
- 120 kérés / perc
Hogyan szolgálja ki a rendszer a kéréseket
- Nincsenek sebességszintek — Egyetlen szabály korlátozza, milyen gyorsan érkezhetnek kérések, és ez minden fiókra és csomagra ugyanaz: percenként 120 kérés. A percenkénti tokenekre nincs korlát.
- Nincs külön API-kvóta — Az API ugyanabból az egyenlegből költ, mint a chat. A csomag a mai keret nagyságát szabja meg. A kérések gyakoriságát nem.
- Olyan gyorsan, ahogy szeretnéd — A párhuzamosan küldött kéréseket elfogadja, és sorban várnak. Nem utasítja el őket azért, mert párhuzamosak.
Az egyenleged
Az egyenleged tokenben számolódik. 1,000,000 token egyenleg értéke $5.00, és a Models & pricing oldal minden ára ehhez az értékhez viszonyított árfolyam.
Az egyenleg bármely pillanatban két rész összege.
- Mai csomagkeret — A csomagod által meghatározott tokenmennyiség. Minden nap 00:00 UTC-kor megújul. Ami a nap végén megmarad, nem viszed át.
- Vásárolt kredit — Csomagként vásárolt tokenek. A kredit nem jár le, és minden csomagon működik, a Free csomagon is.
| Csomag | Token naponta | Érték |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- A felhasználás sorrendje — Minden kérés először a mai csomagkeretet használja el. A vásárolt kreditet csak az használja, ami aznap meghaladja a csomagkeretet.
- A chat és az API közösen használja — Fiókonként egy egyenleg van. Az API-kulcs annak a fióknak az egyenlegéből költ, amelyhez tartozik, ugyanazokkal az árakkal, mint a chat.
- Csomagok — A kreditet 1,000,000 ($5.00), 2,000,000 ($10.00) és 5,000,000 ($25.00) tokenes csomagokban árulják, vagy tetszőleges, 1,000,000 és 100,000,000 token közötti mennyiségben, 1,000,000 tokenenként $5.00 áron.
Kredit feltöltés Csomag módosítása
Mit foglal le egy kérés, és mibe kerül
- Foglalás — Amikor a kérés megérkezik, lefoglalja a kimeneti keretét az egyenlegedből:
max_tokensa/v1/chat/completionsés a/v1/messagesvégponton,max_output_tokensa/v1/responsesvégponton. A/v1/chat/completionsamax_completion_tokensmezőt is olvassa. Az alapérték 4,096, a tartomány 1-től 65,536-ig terjed. - Elfogadás — A kérést csak akkor fogadja el, ha a foglalás belefér az egyenleged megmaradt részébe. Az a nullánál nagyobb, de a kimeneti keretnél kisebb egyenleg is a
Quota exceededválaszt kapja. A maradék felhasználásához küldj kisebbmax_tokensértéket. - Elszámolás — Amikor a válasz teljes, a foglalást a tényleges díj váltja fel. A díj lehet alacsonyabb vagy magasabb a foglalásnál.
- Visszaadás — A hibás státusszal végződő kérés teljes egészében visszaadja a foglalását.
A tényleges díj a modellcsaládtól függ.
| Modellek | Mi kerül felszámításra |
|---|---|
| Shannon modellek | A usage.total_tokens a modell 1M-enkénti áráján. A bemenetnek és a kimenetnek egy ára van. |
| Hosztolt nyílt súlyú modellek | A nem gyorsítványos bemenet a bemeneti áron, a gyorsítványos bemenet a gyorsítványos áron, a kimenet a kimeneti áron. |
Az USD-összeget az egyenlegedből tokenben vonja le, 1,000,000 tokenenként $5.00 áron, egész tokenre kerekítve.
A tokenek számolása a POST /v1/tokenize vagy a POST /v1/messages/count_tokens végponttal ingyenes, és nem foglal le semmit. Tokenszámlálás
Hol látod az egyenleget és a használatot
A Keys & usage oldal megmutatja, mennyit költhetsz éppen most, a mai csomagkeretet, a vásárolt kreditedet és az elmúlt 30 nap API-költését. Alatta felsorolja a kulcsod minden kérését: idő, végpont, modell, gyorsítványos bemenet, számlázott token és költség. Keys & usage
Minden válasz tartalmaz egy usage objektumot is az adott hívás tokenszámaival.
| Végpont | A usage mezői | A hosztolt nyílt súlyú modellek teszik hozzá |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
- A
usagea modell tokenszámait tartalmazza. Az egyenlegedből levont összeg nincs a válaszban: ez a Keys & usage kéréslistájának Billed tokens oszlopa. - A
/v1/messagesvégponton hosztolt nyílt súlyú modellnél azinput_tokensa bemenet nem gyorsítványos része, acache_read_input_tokensa gyorsítványos rész, acache_creation_input_tokenspedig mindig0. - A
/v1/chat/completionsvégponton a stream ausagemezőt az utolsó chunkban hordozza, a[DONE]előtt. Streaming
Ha elfogy az egyenleg
Az a kérés, amelynek a foglalása nem fér bele az egyenlegedbe, 429 státuszú, rate_limit_error típusú, az alábbi üzenetet hordozó választ kap. Semmi nem kerül felszámításra. Ugyanezt a választ kapod akkor is, ha az egyenleg nullánál nagyobb, de kisebb a kérés kimeneti kereténél.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} A /v1/responses végponton az error objektum code és param mezőt is tartalmazhat, mindkettő null.
Mit tehetsz:
- Várd meg a következő csomagkeretet 00:00 UTC-kor.
- Tölts fel kreditet. A kreditet a csomagkeret után használja el, és nem jár le. Kredit feltöltés
- Válts nagyobb napi kerettel rendelkező csomagra. Csomag módosítása
- Küldj kisebb
max_tokensértéket, ha maradt még egyenleg: ekkor a foglalás is kisebb.
Shannon Coder híváskerete
A shannon-coder-1 a /v1/chat/completions és a /v1/messages végponton hívásban számolódik, nem tokenben. Minden csomag meghatározott számú hívást tartalmaz 4 órás ablakonként. Egy kérés egy hívás.
| Csomag | Hívás 4 órás ablakonként |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- Az ablakok 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-kor indulnak. Az ablak végén megmaradt hívásokat nem viszed át.
- A hívás akkor számít, amikor a kérést elfogadja, még mielőtt a modell válaszol. Az a kérés, amely ezután hibázik, továbbra is hívásnak számít.
- Ezek a hívások nem foglalnak le tokent, és nem vonnak le semmit az egyenlegedből. A Keys & usage kéréslistája megmutatja a tokenszámukat és annak értékét a listaáron.
- A
shannon-coder-1alapértelmezettmax_tokensértéke ezen a két végponton 65,536. - Ha nincs több hívás, a válasz
429státusz,rate_limit_errortípus és ez az üzenet:Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan. - A
/v1/responsesvégponton ashannon-coder-1-nek nincs híváskerete: tokenben számolódik az egyenlegedből, 1M-enként $8.00 áron, mint minden más modell.
Flood protection
Egy fiók percenként 120 kérést küldhet. Ez az egyetlen korlát a kérések gyakoriságára, és minden csomagon ugyanaz. Az elárasztás megállítására való, nem a normál használat lassítására.
- A perc egy 60 másodperces fix ablak, amely az első kérésedkor nyílik. Amikor véget ér, a számolás újra nullától indul.
- A számolás fiókonként történik, nem kulcsonként és nem IP-címenként. A kulcs cseréje nem nyit új ablakot.
- Az ablakon belüli 121. kérésre
429státusz,rate_limit_errortípus és aToo many requests. Retry in <N>s.üzenet a válasz. AzNaz ablak végéig hátralévő másodpercek száma, 1-től 60-ig. - A flood protection az egyenleg előtt ellenőrzi a kérést. Az általa elutasított kérés semmit nem foglal le, és nem kerül semmibe.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | Kérés | Flood protection |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | Számít, kérésenként egy. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | Nem számít. |
shannon-coder-1 a /v1/chat/completions és a /v1/messages végponton | Helyette a Shannon Coder híváskerete számolja. |
A 401 válaszú kérés, vagy az ismeretlen model miatt 400 válaszú kérés | Nem számít. |
| A flood protection által elutasított kérés | Beleszámít az ablakba. Semmi nem kerül felszámításra. |
Párhuzamos kérések
Nincs korlát arra, hány kérése lehet egy fióknak egyszerre nyitva, és a párhuzamos kérések küldése nem okoz hibát. Azok a kérések, amelyek nem indulhatnak azonnal, sorban várnak, és sorrendben kapnak választ.
- Minden kérés beleszámít a percenkénti 120-ba, amikor megérkezik, akár befejeződtek a korábbi kérések, akár nem.
- Minden kérés a saját foglalását tartja, amíg véget nem ér. Húsz nyitott kérés az alapértelmezett kimeneti kerettel 20 × 4,096 = 81,920 token egyenleget tart foglalva. Ha a foglalások együtt nagyobbak az egyenlegednél, a következő kérés a
Quota exceededválaszt kapja, noha a befejezett hívások kevesebbe kerültek volna. A kisebbmax_tokenskevesebbet tart foglalva. - A streaming nélküli kérés semmit nem küld, amíg a válasza teljes nem lesz, ezért adj a kliensednek a várakozást lefedő timeoutot. A stream nyitva tartja a kapcsolatát, amíg vár. Streaming
Egyetlen kérés korlátai
| Korlát | Érték | Hol érvényes | A korlátnál |
|---|---|---|---|
| Kérés törzse | 32 MiB (33,554,432 bájt) | Minden végpont | 413 státusz, invalid_request_error típus. |
Kimeneti keret: max_tokens, max_completion_tokens, max_output_tokens | 1-től 65,536-ig. Alapérték 4,096; a shannon-coder-1 esetén a /v1/chat/completions és a /v1/messages végponton az alapérték 65,536. | Minden modell, az egyenlegedből lefoglalt mennyiségként. A válasz hosszának korlátjaként: a hosztolt nyílt súlyú modellek, a shannon-1.6-lite, a shannon-1.6-pro és a shannon-coder-1. | A tartományon kívüli értéket a tartomány legközelebbi végére igazítja. Hiba nincs. |
Leállító sorozatok: stop, stop_sequences | 4 string | Hosztolt nyílt súlyú modellek | Az első 4 nem üres stringet használja. |
| URL-ként megadott kép vagy fájl | 8 MiB, 20 másodpercen belül beolvasva, legfeljebb 5 átirányítás, nyilvános http vagy https cím | Minden végpont, amely képet vagy fájlt fogad | A kérésre az adott rész nélkül válaszol. Hiba nincs. |
| Beágyazva (base64) küldött kép vagy fájl | Nincs saját korlátja. Beleszámít a 32 MiB-os kéréstörzsbe. | Minden végpont, amely képet vagy fájlt fogad | 413 státusz az egész kérésre. |
A POST /v1/tokenize text mezője | 4,000,000 bájt | /v1/tokenize | 413 státusz, invalid_request_error típus, text too long üzenet. |
A POST /v1/tokenize messages mezője és a POST /v1/messages/count_tokens törzse | A 32 MiB-os kéréstörzs | Mindkét számláló végpont | 413 státusz. |
| Kontextusablak | Modellenként: context_window a GET /v1/models válaszában | Minden modell | A hosszabb beszélgetés sorsa a modelltől függ. Modellek és árak |
Webes keresések (web_search: true) | Csomagonként és naponta: Free 3, Plus 30, Standard 50, Pro 60. Egy keresés számít annál a kérésnél, amelynek a keresése eredményt talált. | A web_search: true értéket beállító kérések | Ha nem maradt keresés, a kérésre keresés nélkül válaszol. Hiba nincs. Beépített webes keresés |
Hibák
Az oldal válaszai. A /v1/messages végponton ugyanez az error objektum {"type": "error", "error": {…}} formában van becsomagolva.
| Státusz | Típus | Üzenet | Mikor, és mit tegyél |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | A kérés foglalása nem fér bele az egyenlegedbe. Várd meg a 00:00 UTC időpontot, tölts fel kreditet, válts csomagot, vagy küldj kisebb max_tokens értéket. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | Több mint 120 kérés az aktuális percben. Várj N másodpercet, majd küldd újra. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | Az aktuális 4 órás ablak Shannon Coder hívásai elfogytak. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | A modell ebben a pillanatban nem tudja fogadni a kérést. Egy rövid szünet után küldd el újra. |
503 | api_error | Could not verify your quota right now. Please retry. | Az egyenleged nem volt olvasható. Semmi nem kerül felszámításra; küldd el újra a kérést. A /v1/responses végponton Shannon modellel a státusz 500. |
413 | invalid_request_error | A kérés törzse nagyobb 32 MiB-nál. Az OpenAI-formátumú végpontokon az error objektum code: "request_too_large" értéket hordoz. | |
413 | invalid_request_error | text too long | A POST /v1/tokenize text mezője hosszabb 4,000,000 bájtnál. |