Ierobežojumi un atlikums
Katrs pieprasījums tiek apkalpots vienlīdz. Nav ātruma līmeņu. Nav atsevišķas API kvotas. Jūs jau samaksājāt par saviem tokeniem — izmantojiet tos tik ātri, cik vēlaties.
Šī lapa izskaidro, no kā sastāv jūsu atlikums, ko viens pieprasījums rezervē un cik maksā, cik pieprasījumu drīkstat sūtīt un dažus ierobežojumus, ar kuriem var sastapties atsevišķs pieprasījums.
- 1M atlikuma tokenu vērtība
- $5.00
- dienas kvota atjaunojas
- 00:00 UTC
- flood protection, uz kontu
- 120 pieprasījumi / min
Kā pieprasījumi tiek apkalpoti
- Nav ātruma līmeņu — Viens noteikums ierobežo, cik ātri pieprasījumi drīkst ierasties, un tas ir vienāds katram kontam un katram plānam: 120 pieprasījumi minūtē. Tokenu minūtē ierobežojuma nav.
- Nav atsevišķas API kvotas — API tērē to pašu atlikumu, ko čats. Plāns nosaka šīs dienas kvotas lielumu. Tas nenosaka pieprasījumu biežumu.
- Tik ātri, cik vēlaties — Paralēli sūtīti pieprasījumi tiek pieņemti un gaida rindā. Tie netiek noraidīti tāpēc, ka ir paralēli.
Jūsu atlikums
Jūsu atlikums tiek skaitīts tokenos. 1,000,000 atlikuma tokenu ir vērti $5.00, un katra cena lapā Modeļi un cenas ir likme pret šo vērtību.
Jebkurā brīdī atlikums ir divu daļu summa.
- Šīs dienas plāna kvota — Tokenu skaits, ko nosaka jūsu plāns. Tas atjaunojas katru dienu plkst. 00:00 UTC. Kas atlicis dienas beigās, netiek pārnests.
- Iegādātais kredīts — Tokeni, ko nopirkāt kā paku. Kredīts nebeidzas un darbojas katrā plānā, arī Free.
| Plāns | Tokeni dienā | Vērtība |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- Tērēšanas secība — Katrs pieprasījums vispirms tērē šīs dienas plāna kvotu. Iegādātais kredīts tiek izmantots tikai tam, kas pārsniedz kvotu tajā dienā.
- Čats un API to dala — Katram kontam ir viens atlikums. API atslēga tērē no tā konta atlikuma, kuram tā pieder, par tām pašām cenām kā čats.
- Pakas — Kredīts tiek pārdots paku veidā pa 1,000,000 ($5.00), 2,000,000 ($10.00) un 5,000,000 ($25.00) tokeniem vai kā jūsu izvēlēta summa no 1,000,000 līdz 100,000,000 tokeniem par $5.00 par 1,000,000.
Papildīt kredītus Mainīt plānu
Ko pieprasījums rezervē un cik tas maksā
- Rezervēšana — Kad pieprasījums ierodas, tas no jūsu atlikuma rezervē savu izvades budžetu:
max_tokensgalapunktos/v1/chat/completionsun/v1/messages,max_output_tokensgalapunktā/v1/responses./v1/chat/completionslasa arīmax_completion_tokens. Noklusējums ir 4,096, un diapazons ir no 1 līdz 65,536. - Pieņemšana — Pieprasījums tiek pieņemts tikai tad, ja rezervācija ietilpst jūsu atlikumā. Atlikums, kas ir lielāks par nulli, bet mazāks par izvades budžetu, saņem atbildi
Quota exceeded. Sūtiet mazākumax_tokens, lai izmantotu pārējo. - Norēķins — Kad atbilde ir pilnīga, rezervāciju aizstāj faktiskā maksa. Maksa var būt zemāka vai augstāka par rezervāciju.
- Atgriešana — Pieprasījums, kas beidzas ar kļūdas statusu, rezervāciju atdod pilnībā.
Faktiskā maksa ir atkarīga no modeļu saimes.
| Modeļi | Ko rēķina |
|---|---|
| Shannon modeļi | usage.total_tokens pēc modeļa cenas par 1M. Ievadei un izvadei ir viena likme. |
| Hostētie atvērto svaru modeļi | Nekešēta ievade par ievades likmi, kešēta ievade par kešēto likmi, izvade par izvades likmi. |
Summa USD tiek ņemta no jūsu atlikuma tokenos par $5.00 par 1,000,000, noapaļota līdz veselam tokenam.
Tokenu skaitīšana ar POST /v1/tokenize vai POST /v1/messages/count_tokens ir bezmaksas un neko nerezervē. Tokenu skaitīšana
Kur redzēt atlikumu un izmantošanu
Lapa Atslēgas un izmantošana rāda, ko varat tērēt tieši tagad, šīs dienas plāna kvotu, iegādāto kredītu un API izdevumus pēdējās 30 dienās. Zem tā ir uzskaitīts katrs pieprasījums, ko veica jūsu atslēga: laiks, galapunkts, modelis, kešēta ievade, rēķinātie tokeni un izmaksas. Atslēgas un izmantošana
Katra atbilde satur arī objektu usage ar šī izsaukuma tokenu skaitu.
| Endpoints | Izmantošanas lauki | Pievieno hostētie atvērto svaru modeļi |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usagesatur modeļa tokenu skaitu. No atlikuma ņemtā summa atbildē nav norādīta: tā ir pieprasījumu saraksta slejā Rēķinātie tokeni lapā Atslēgas un izmantošana.- Galapunktā
/v1/messagesar hostētu atvērto svaru modeliinput_tokensir ievades nekešētā daļa,cache_read_input_tokensir kešētā daļa uncache_creation_input_tokensvienmēr ir0. - Straume galapunktā
/v1/chat/completionsnesusagesavā pēdējā daļā pirms[DONE]. Straumēšana
Kad atlikums beidzas
Pieprasījums, kura rezervācija neietilpst jūsu atlikumā, saņem atbildi ar statusu 429, tipu rate_limit_error un tālāk norādīto ziņojumu. Nekas netiek rēķināts. Tā pati atbilde tiek sūtīta, ja atlikums ir lielāks par nulli, bet mazāks par pieprasījuma izvades budžetu.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} Galapunktā /v1/responses objektā error var būt arī code un param, abi null.
Ko varat darīt:
- Gaidiet nākamo plāna kvotu plkst. 00:00 UTC.
- Papildiniet kredītu. Kredīts tiek tērēts pēc plāna kvotas un nebeidzas. Papildīt kredītus
- Pārejiet uz plānu ar lielāku dienas kvotu. Mainīt plānu
- Ja kāds atlikums vēl ir, sūtiet mazāku
max_tokens: tad rezervācija ir mazāka.
Shannon Coder izsaukumu kvota
shannon-coder-1 galapunktos /v1/chat/completions un /v1/messages tiek skaitīts izsaukumos, nevis tokenos. Katrs plāns ietver noteiktu izsaukumu skaitu 4 stundu logā. Viens pieprasījums ir viens izsaukums.
| Plāns | Izsaukumi 4 stundu logā |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- Logi sākas plkst. 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC. Izsaukumi, kas logā atlikuši, netiek pārnesti.
- Izsaukums tiek ieskaitīts, kad pieprasījums ir pieņemts, pirms modelis atbild. Pieprasījums, kas pēc tam neizdodas, tāpat tiek skaitīts kā izsaukums.
- Šie izsaukumi nerezervē tokenus un neņem neko no jūsu atlikuma. Pieprasījumu saraksts lapā Atslēgas un izmantošana rāda to tokenu skaitu un tā vērtību pēc norādītās cenas.
shannon-coder-1noklusējumamax_tokensšajos divos galapunktos ir 65,536.- Ja izsaukumu vairs nav, atbilde ir statuss
429, tipsrate_limit_error, ziņojumsShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan. - Galapunktā
/v1/responsesshannon-coder-1nav izsaukumu kvotas: tas tiek rēķināts tokenos no jūsu atlikuma par $8.00 par 1M, tāpat kā katrs cits modelis.
Flood protection
Konts drīkst sūtīt 120 pieprasījumus minūtē. Tas ir vienīgais pieprasījumu biežuma ierobežojums, un tas ir vienāds katrā plānā. Tas ir paredzēts, lai apturētu pārplūdi, nevis lai bremzētu parastu lietošanu.
- Minūte ir fiksēts 60 sekunžu logs, kas atveras ar jūsu pirmo pieprasījumu. Kad tas beidzas, skaits sākas no nulles.
- Skaits ir uz kontu, nevis uz atslēgu un nevis uz IP adresi. Atslēgas nomaiņa jaunu logu neatver.
- 121. pieprasījums logā saņem atbildi ar statusu
429, tipurate_limit_errorun ziņojumuToo many requests. Retry in <N>s.Nir sekunžu skaits līdz loga beigām, no 1 līdz 60. - Flood protection tiek pārbaudīts pirms atlikuma. Pieprasījums, ko tas noraida, neko nerezervē un nemaksā.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | Pieprasījums | Flood protection |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | Tiek skaitīts, viens uz pieprasījumu. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | Netiek skaitīts. |
shannon-coder-1 galapunktos /v1/chat/completions un /v1/messages | Tā vietā tiek skaitīts pēc Shannon Coder izsaukumu kvotas. |
Pieprasījums, uz kuru atbildēts ar 401, vai ar 400 nezināmam model | Netiek skaitīts. |
| Pieprasījums, ko noraidījis flood protection | Tiek ieskaitīts logā. Nekas netiek rēķināts. |
Paralēli pieprasījumi
Nav ierobežojuma, cik pieprasījumu kontam vienlaikus var būt atvērti, un nav kļūdas par pieprasījumu sūtīšanu paralēli. Pieprasījumi, kurus nevar sākt uzreiz, gaida rindā un tiek atbildēti pēc kārtas.
- Katrs pieprasījums tiek ieskaitīts 120 minūtē, kad tas ierodas, neatkarīgi no tā, vai iepriekšējie pieprasījumi ir pabeigti.
- Katrs pieprasījums tur savu rezervāciju, līdz beidzas. Divdesmit atvērti pieprasījumi ar noklusējuma izvades budžetu tur 20 × 4,096 = 81,920 atlikuma tokenu. Ja rezervācijas kopā ir lielākas par jūsu atlikumu, nākamais pieprasījums saņem atbildi
Quota exceeded, kaut arī pabeigtie izsaukumi būtu maksājuši mazāk. Mazāksmax_tokenstur mazāk. - Pieprasījums bez straumēšanas neko nesūta, līdz atbilde ir pilnīga, tāpēc iestatiet klientam taimautu, kas aptver gaidīšanu. Straume gaidīšanas laikā patur savienojumu atvērtu. Straumēšana
Viena pieprasījuma ierobežojumi
| Ierobežojums | Vērtība | Attiecas uz | Pie ierobežojuma |
|---|---|---|---|
| Pieprasījuma pamatteksts | 32 MiB (33,554,432 baiti) | Katrs galapunkts | Statuss 413, tips invalid_request_error. |
Izvades budžets: max_tokens, max_completion_tokens, max_output_tokens | No 1 līdz 65,536. Noklusējums 4,096; modelim shannon-coder-1 galapunktos /v1/chat/completions un /v1/messages noklusējums ir 65,536. | Katrs modelis kā summa, kas rezervēta no jūsu atlikuma. Kā atbildes garuma ierobežojums: hostētie atvērto svaru modeļi, shannon-1.6-lite, shannon-1.6-pro un shannon-coder-1. | Vērtība ārpus diapazona tiek pārvietota uz tuvāko diapazona galu. Kļūdas nav. |
Apturēšanas secības: stop, stop_sequences | 4 virknes | Hostētie atvērto svaru modeļi | Tiek izmantotas pirmās 4 netukšās virknes. |
| Attēls vai fails, norādīts kā URL | 8 MiB, nolasīts 20 sekunžu laikā, ne vairāk kā 5 novirzīšanas, publiska http vai https adrese | Katrs galapunkts, kas pieņem attēlus vai failus | Uz pieprasījumu atbild bez šīs daļas. Kļūdas nav. |
| Attēls vai fails, sūtīts iekļauts (base64) | Nav savas robežas. Tas tiek ieskaitīts 32 MiB pieprasījuma pamattekstā. | Katrs galapunkts, kas pieņem attēlus vai failus | Statuss 413 visam pieprasījumam. |
text laukā POST /v1/tokenize | 4,000,000 baiti | /v1/tokenize | Statuss 413, tips invalid_request_error, ziņojums text too long. |
messages laukā POST /v1/tokenize un POST /v1/messages/count_tokens pamatteksts | 32 MiB pieprasījuma pamatteksts | Abi skaitīšanas galapunkti | Statuss 413. |
| Konteksta logs | Katram modelim: context_window rezultātā GET /v1/models | Katrs modelis | Kas notiek ar garāku sarunu, ir atkarīgs no modeļa. Modeļi un cenas |
Meklēšana tīmeklī (web_search: true) | Katram plānam dienā: Free 3, Plus 30, Standard 50, Pro 60. Pieprasījumam, kura meklēšana atrada rezultātus, tiek skaitīta viena meklēšana. | Pieprasījumi, kas iestata web_search: true | Ja vairs nav neviena, uz pieprasījumu atbild bez meklēšanas. Kļūdas nav. Tīmekļa meklēšana |
Kļūdas
Šīs lapas atbildes. Galapunktā /v1/messages tas pats objekts error ir ietverts kā {"type": "error", "error": {…}}.
| Statuss | Veids | Ziņojums | Kad un ko darīt |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | Pieprasījuma rezervācija neietilpst jūsu atlikumā. Gaidiet līdz 00:00 UTC, papildiniet kredītu, mainiet plānu vai sūtiet mazāku max_tokens. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | Vairāk nekā 120 pieprasījumu pašreizējā minūtē. Gaidiet N sekundes un sūtiet vēlreiz. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | Pašreizējā 4 stundu loga Shannon Coder izsaukumi ir izmantoti. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | Modelis šobrīd nevar pieņemt pieprasījumu. Nosūtiet to vēlreiz pēc neilgas pauzes. |
503 | api_error | Could not verify your quota right now. Please retry. | Jūsu atlikumu nevarēja nolasīt. Nekas netiek rēķināts; nosūtiet pieprasījumu vēlreiz. Galapunktā /v1/responses ar Shannon modeli statuss ir 500. |
413 | invalid_request_error | Pieprasījuma pamatteksts ir lielāks par 32 MiB. OpenAI formāta galapunktos objekts error satur code: "request_too_large". | |
413 | invalid_request_error | text too long | text laukā POST /v1/tokenize ir garāks par 4,000,000 baitiem. |