Ugrás a tartalomra
Korlátok és egyenleg

Korlátok és egyenleg

Minden kérést egyformán szolgálunk ki. Nincsenek sebességszintek. Nincs külön API-kvóta. A tokenjeidet már kifizetted — használd őket olyan gyorsan, ahogy csak szeretnéd.

Ez az oldal elmagyarázza, miből áll az egyenleged, mit foglal le és mibe kerül egy kérés, hány kérést küldhetsz, és milyen kevés korláttal találkozhat egyetlen kérés.

1M token egyenleg értéke
$5.00
a napi keret megújul
00:00 UTC
flood protection, fiókonként
120 kérés / perc

Hogyan szolgálja ki a rendszer a kéréseket

  • Nincsenek sebességszintek — Egyetlen szabály korlátozza, milyen gyorsan érkezhetnek kérések, és ez minden fiókra és csomagra ugyanaz: percenként 120 kérés. A percenkénti tokenekre nincs korlát.
  • Nincs külön API-kvóta — Az API ugyanabból az egyenlegből költ, mint a chat. A csomag a mai keret nagyságát szabja meg. A kérések gyakoriságát nem.
  • Olyan gyorsan, ahogy szeretnéd — A párhuzamosan küldött kéréseket elfogadja, és sorban várnak. Nem utasítja el őket azért, mert párhuzamosak.

Az egyenleged

Az egyenleged tokenben számolódik. 1,000,000 token egyenleg értéke $5.00, és a Models & pricing oldal minden ára ehhez az értékhez viszonyított árfolyam.

Az egyenleg bármely pillanatban két rész összege.

  • Mai csomagkeret — A csomagod által meghatározott tokenmennyiség. Minden nap 00:00 UTC-kor megújul. Ami a nap végén megmarad, nem viszed át.
  • Vásárolt kredit — Csomagként vásárolt tokenek. A kredit nem jár le, és minden csomagon működik, a Free csomagon is.
Csomag Token naponta Érték
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • A felhasználás sorrendje — Minden kérés először a mai csomagkeretet használja el. A vásárolt kreditet csak az használja, ami aznap meghaladja a csomagkeretet.
  • A chat és az API közösen használja — Fiókonként egy egyenleg van. Az API-kulcs annak a fióknak az egyenlegéből költ, amelyhez tartozik, ugyanazokkal az árakkal, mint a chat.
  • Csomagok — A kreditet 1,000,000 ($5.00), 2,000,000 ($10.00) és 5,000,000 ($25.00) tokenes csomagokban árulják, vagy tetszőleges, 1,000,000 és 100,000,000 token közötti mennyiségben, 1,000,000 tokenenként $5.00 áron.

Kredit feltöltés Csomag módosítása

Mit foglal le egy kérés, és mibe kerül

  • Foglalás — Amikor a kérés megérkezik, lefoglalja a kimeneti keretét az egyenlegedből: max_tokens a /v1/chat/completions és a /v1/messages végponton, max_output_tokens a /v1/responses végponton. A /v1/chat/completions a max_completion_tokens mezőt is olvassa. Az alapérték 4,096, a tartomány 1-től 65,536-ig terjed.
  • Elfogadás — A kérést csak akkor fogadja el, ha a foglalás belefér az egyenleged megmaradt részébe. Az a nullánál nagyobb, de a kimeneti keretnél kisebb egyenleg is a Quota exceeded választ kapja. A maradék felhasználásához küldj kisebb max_tokens értéket.
  • Elszámolás — Amikor a válasz teljes, a foglalást a tényleges díj váltja fel. A díj lehet alacsonyabb vagy magasabb a foglalásnál.
  • Visszaadás — A hibás státusszal végződő kérés teljes egészében visszaadja a foglalását.

A tényleges díj a modellcsaládtól függ.

Modellek Mi kerül felszámításra
Shannon modellek A usage.total_tokens a modell 1M-enkénti áráján. A bemenetnek és a kimenetnek egy ára van.
Hosztolt nyílt súlyú modellek A nem gyorsítványos bemenet a bemeneti áron, a gyorsítványos bemenet a gyorsítványos áron, a kimenet a kimeneti áron.

Az USD-összeget az egyenlegedből tokenben vonja le, 1,000,000 tokenenként $5.00 áron, egész tokenre kerekítve.

A tokenek számolása a POST /v1/tokenize vagy a POST /v1/messages/count_tokens végponttal ingyenes, és nem foglal le semmit. Tokenszámlálás

Hol látod az egyenleget és a használatot

A Keys & usage oldal megmutatja, mennyit költhetsz éppen most, a mai csomagkeretet, a vásárolt kreditedet és az elmúlt 30 nap API-költését. Alatta felsorolja a kulcsod minden kérését: idő, végpont, modell, gyorsítványos bemenet, számlázott token és költség. Keys & usage

Minden válasz tartalmaz egy usage objektumot is az adott hívás tokenszámaival.

Végpont A usage mezői A hosztolt nyílt súlyú modellek teszik hozzá
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • A usage a modell tokenszámait tartalmazza. Az egyenlegedből levont összeg nincs a válaszban: ez a Keys & usage kéréslistájának Billed tokens oszlopa.
  • A /v1/messages végponton hosztolt nyílt súlyú modellnél az input_tokens a bemenet nem gyorsítványos része, a cache_read_input_tokens a gyorsítványos rész, a cache_creation_input_tokens pedig mindig 0.
  • A /v1/chat/completions végponton a stream a usage mezőt az utolsó chunkban hordozza, a [DONE] előtt. Streaming

Ha elfogy az egyenleg

Az a kérés, amelynek a foglalása nem fér bele az egyenlegedbe, 429 státuszú, rate_limit_error típusú, az alábbi üzenetet hordozó választ kap. Semmi nem kerül felszámításra. Ugyanezt a választ kapod akkor is, ha az egyenleg nullánál nagyobb, de kisebb a kérés kimeneti kereténél.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

A /v1/responses végponton az error objektum code és param mezőt is tartalmazhat, mindkettő null.

Mit tehetsz:

  • Várd meg a következő csomagkeretet 00:00 UTC-kor.
  • Tölts fel kreditet. A kreditet a csomagkeret után használja el, és nem jár le. Kredit feltöltés
  • Válts nagyobb napi kerettel rendelkező csomagra. Csomag módosítása
  • Küldj kisebb max_tokens értéket, ha maradt még egyenleg: ekkor a foglalás is kisebb.

Shannon Coder híváskerete

A shannon-coder-1 a /v1/chat/completions és a /v1/messages végponton hívásban számolódik, nem tokenben. Minden csomag meghatározott számú hívást tartalmaz 4 órás ablakonként. Egy kérés egy hívás.

Csomag Hívás 4 órás ablakonként
Free 3
Plus 20
Standard 40
Pro 60
  • Az ablakok 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-kor indulnak. Az ablak végén megmaradt hívásokat nem viszed át.
  • A hívás akkor számít, amikor a kérést elfogadja, még mielőtt a modell válaszol. Az a kérés, amely ezután hibázik, továbbra is hívásnak számít.
  • Ezek a hívások nem foglalnak le tokent, és nem vonnak le semmit az egyenlegedből. A Keys & usage kéréslistája megmutatja a tokenszámukat és annak értékét a listaáron.
  • A shannon-coder-1 alapértelmezett max_tokens értéke ezen a két végponton 65,536.
  • Ha nincs több hívás, a válasz 429 státusz, rate_limit_error típus és ez az üzenet: Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan.
  • A /v1/responses végponton a shannon-coder-1-nek nincs híváskerete: tokenben számolódik az egyenlegedből, 1M-enként $8.00 áron, mint minden más modell.

Flood protection

Egy fiók percenként 120 kérést küldhet. Ez az egyetlen korlát a kérések gyakoriságára, és minden csomagon ugyanaz. Az elárasztás megállítására való, nem a normál használat lassítására.

  • A perc egy 60 másodperces fix ablak, amely az első kérésedkor nyílik. Amikor véget ér, a számolás újra nullától indul.
  • A számolás fiókonként történik, nem kulcsonként és nem IP-címenként. A kulcs cseréje nem nyit új ablakot.
  • Az ablakon belüli 121. kérésre 429 státusz, rate_limit_error típus és a Too many requests. Retry in <N>s. üzenet a válasz. Az N az ablak végéig hátralévő másodpercek száma, 1-től 60-ig.
  • A flood protection az egyenleg előtt ellenőrzi a kérést. Az általa elutasított kérés semmit nem foglal le, és nem kerül semmibe.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
Kérés Flood protection
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses Számít, kérésenként egy.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens Nem számít.
shannon-coder-1 a /v1/chat/completions és a /v1/messages végponton Helyette a Shannon Coder híváskerete számolja.
A 401 válaszú kérés, vagy az ismeretlen model miatt 400 válaszú kérés Nem számít.
A flood protection által elutasított kérés Beleszámít az ablakba. Semmi nem kerül felszámításra.

Párhuzamos kérések

Nincs korlát arra, hány kérése lehet egy fióknak egyszerre nyitva, és a párhuzamos kérések küldése nem okoz hibát. Azok a kérések, amelyek nem indulhatnak azonnal, sorban várnak, és sorrendben kapnak választ.

  • Minden kérés beleszámít a percenkénti 120-ba, amikor megérkezik, akár befejeződtek a korábbi kérések, akár nem.
  • Minden kérés a saját foglalását tartja, amíg véget nem ér. Húsz nyitott kérés az alapértelmezett kimeneti kerettel 20 × 4,096 = 81,920 token egyenleget tart foglalva. Ha a foglalások együtt nagyobbak az egyenlegednél, a következő kérés a Quota exceeded választ kapja, noha a befejezett hívások kevesebbe kerültek volna. A kisebb max_tokens kevesebbet tart foglalva.
  • A streaming nélküli kérés semmit nem küld, amíg a válasza teljes nem lesz, ezért adj a kliensednek a várakozást lefedő timeoutot. A stream nyitva tartja a kapcsolatát, amíg vár. Streaming

Egyetlen kérés korlátai

Korlát Érték Hol érvényes A korlátnál
Kérés törzse 32 MiB (33,554,432 bájt) Minden végpont 413 státusz, invalid_request_error típus.
Kimeneti keret: max_tokens, max_completion_tokens, max_output_tokens 1-től 65,536-ig. Alapérték 4,096; a shannon-coder-1 esetén a /v1/chat/completions és a /v1/messages végponton az alapérték 65,536. Minden modell, az egyenlegedből lefoglalt mennyiségként. A válasz hosszának korlátjaként: a hosztolt nyílt súlyú modellek, a shannon-1.6-lite, a shannon-1.6-pro és a shannon-coder-1. A tartományon kívüli értéket a tartomány legközelebbi végére igazítja. Hiba nincs.
Leállító sorozatok: stop, stop_sequences 4 string Hosztolt nyílt súlyú modellek Az első 4 nem üres stringet használja.
URL-ként megadott kép vagy fájl 8 MiB, 20 másodpercen belül beolvasva, legfeljebb 5 átirányítás, nyilvános http vagy https cím Minden végpont, amely képet vagy fájlt fogad A kérésre az adott rész nélkül válaszol. Hiba nincs.
Beágyazva (base64) küldött kép vagy fájl Nincs saját korlátja. Beleszámít a 32 MiB-os kéréstörzsbe. Minden végpont, amely képet vagy fájlt fogad 413 státusz az egész kérésre.
A POST /v1/tokenize text mezője 4,000,000 bájt /v1/tokenize 413 státusz, invalid_request_error típus, text too long üzenet.
A POST /v1/tokenize messages mezője és a POST /v1/messages/count_tokens törzse A 32 MiB-os kéréstörzs Mindkét számláló végpont 413 státusz.
Kontextusablak Modellenként: context_window a GET /v1/models válaszában Minden modell A hosszabb beszélgetés sorsa a modelltől függ. Modellek és árak
Webes keresések (web_search: true) Csomagonként és naponta: Free 3, Plus 30, Standard 50, Pro 60. Egy keresés számít annál a kérésnél, amelynek a keresése eredményt talált. A web_search: true értéket beállító kérések Ha nem maradt keresés, a kérésre keresés nélkül válaszol. Hiba nincs. Beépített webes keresés

Hibák

Az oldal válaszai. A /v1/messages végponton ugyanez az error objektum {"type": "error", "error": {…}} formában van becsomagolva.

Státusz Típus Üzenet Mikor, és mit tegyél
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan A kérés foglalása nem fér bele az egyenlegedbe. Várd meg a 00:00 UTC időpontot, tölts fel kreditet, válts csomagot, vagy küldj kisebb max_tokens értéket.
429 rate_limit_error Too many requests. Retry in <N>s. Több mint 120 kérés az aktuális percben. Várj N másodpercet, majd küldd újra.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan Az aktuális 4 órás ablak Shannon Coder hívásai elfogytak.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. A modell ebben a pillanatban nem tudja fogadni a kérést. Egy rövid szünet után küldd el újra.
503 api_error Could not verify your quota right now. Please retry. Az egyenleged nem volt olvasható. Semmi nem kerül felszámításra; küldd el újra a kérést. A /v1/responses végponton Shannon modellel a státusz 500.
413 invalid_request_error A kérés törzse nagyobb 32 MiB-nál. Az OpenAI-formátumú végpontokon az error objektum code: "request_too_large" értéket hordoz.
413 invalid_request_error text too long A POST /v1/tokenize text mezője hosszabb 4,000,000 bájtnál.