Slaan oor na inhoud
Perke en balans

Perke en balans

Elke versoek word gelyk bedien. Geen tempovlakke nie. Geen aparte API-kwota nie. Jy het reeds vir jou tokens betaal — gebruik hulle so vinnig as wat jy wil.

Hierdie bladsy verduidelik waaruit jou balans bestaan, wat een versoek reserveer en kos, hoeveel versoeke jy mag stuur, en die paar perke wat 'n enkele versoek kan teëkom.

waarde van 1M tokens balans
$5.00
daaglikse toelaat hernu
00:00 UTC
vloedbeskerming, per rekening
120 versoeke / min

Hoe versoeke bedien word

  • Geen tempovlakke nie — Een reël beperk hoe vinnig versoeke mag aankom, en dit is dieselfde vir elke rekening en elke plan: 120 versoeke per minuut. Daar is geen perk op tokens per minuut nie.
  • Geen aparte API-kwota nie — Die API spandeer dieselfde balans as klets. 'n Plan bepaal die grootte van vandag se toelaat. Dit bepaal nie 'n versoektempo nie.
  • So vinnig as wat jy wil — Versoeke wat parallel gestuur word, word aanvaar en wag in 'n tou. Hulle word nie geweier omdat hulle parallel is nie.

Jou balans

Jou balans word in tokens getel. 1,000,000 tokens balans is $5.00 werd, en elke prys op die bladsy Modelle en pryse is 'n tarief teen daardie waarde.

Op enige oomblik is die balans die som van twee dele.

  • Vandag se plan-toelaat — 'n Getal tokens wat deur jou plan bepaal word. Dit is elke dag om 00:00 UTC nuut. Wat aan die einde van 'n dag oor is, word nie oorgedra nie.
  • Aankoopkrediete — Tokens wat jy as 'n pakket gekoop het. Krediet verval nie en werk op elke plan, ook Free.
Plan Tokens per dag Waarde
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • Volgorde van besteding — Elke versoek spandeer eers vandag se plan-toelaat. Aangekoopte krediet word net gebruik vir wat op daardie dag bo die toelaat uitgaan.
  • Klets en API deel dit — Daar is een balans per rekening. 'n API-sleutel spandeer van die balans van die rekening wat dit besit, teen dieselfde pryse as klets.
  • Pakkette — Krediet word verkoop in pakkette van 1,000,000 ($5.00), 2,000,000 ($10.00) en 5,000,000 ($25.00) tokens, of as 'n bedrag van jou keuse van 1,000,000 tot 100,000,000 tokens teen $5.00 per 1,000,000.

Laai krediete op Verander plan

Wat 'n versoek reserveer en wat dit kos

  • Reserveer — Wanneer 'n versoek aankom, reserveer dit sy uitvoerbegroting van jou balans: max_tokens op /v1/chat/completions en /v1/messages, max_output_tokens op /v1/responses. /v1/chat/completions lees ook max_completion_tokens. Die verstek is 4,096 en die reeks is 1 tot 65,536.
  • Toelaat — Die versoek word net aanvaar as die reservering inpas in wat van jou balans oor is. 'n Balans wat bo nul is maar kleiner as die uitvoerbegroting, kry die Quota exceeded-antwoord. Stuur 'n kleiner max_tokens om die res te gebruik.
  • Vereffen — Wanneer die antwoord volledig is, word die reservering deur die werklike heffing vervang. Die heffing kan laer of hoër as die reservering wees.
  • Gee terug — 'n Versoek wat met 'n foutstatus eindig, gee sy reservering ten volle terug.

Die werklike heffing hang van die modelfamilie af.

Modelle Wat gehef word
Shannon-modelle usage.total_tokens teen die model se prys per 1M. Inset en uitset het een tarief.
Gehuisveste oopgewig-modelle Ongekasde inset teen die insettarief, gekasde inset teen die gekasde tarief, uitset teen die uitsettarief.

Die bedrag in USD word in tokens van jou balans afgetrek teen $5.00 per 1,000,000, afgerond tot 'n heel token.

Tokens tel met POST /v1/tokenize of POST /v1/messages/count_tokens is gratis en reserveer niks nie. Tokens tel

Waar om balans en gebruik te sien

Die bladsy Sleutels en gebruik wys wat jy nou kan spandeer, vandag se plan-toelaat, jou aangekoopte krediet en die API-besteding van die laaste 30 dae. Daaronder lys dit elke versoek wat jou sleutel gemaak het: tyd, eindpunt, model, gekasde inset, gefaktureerde tokens en koste. Sleutels en gebruik

Elke antwoord dra ook 'n usage-objek met die tokengetalle van daardie oproep.

Eindpunt Velde van usage Bygevoeg deur gehuisveste oopgewig-modelle
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage hou die tokengetalle van die model. Die bedrag wat van jou balans afgetrek word, is nie in die antwoord nie: dit is die kolom Gefaktureerde tokens van die versoeklys op Sleutels en gebruik.
  • Op /v1/messages met 'n gehuisveste oopgewig-model is input_tokens die ongekasde deel van die inset, cache_read_input_tokens die gekasde deel en cache_creation_input_tokens altyd 0.
  • 'n Stroom op /v1/chat/completions dra usage in sy laaste chunk voor [DONE]. Stroming

Wanneer die balans opraak

'n Versoek waarvan die reservering nie in jou balans inpas nie, word met status 429, tipe rate_limit_error en die boodskap hieronder beantwoord. Niks word gehef nie. Dieselfde antwoord word gestuur wanneer die balans bo nul is maar kleiner as die uitvoerbegroting van die versoek.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

Op /v1/responses kan die error-objek ook code en param hou, albei null.

Wat jy kan doen:

  • Wag vir die volgende plan-toelaat om 00:00 UTC.
  • Laai krediet op. Krediet word na die plan-toelaat gebruik en verval nie. Laai krediete op
  • Verander na 'n plan met 'n groter daaglikse toelaat. Verander plan
  • Stuur 'n kleiner max_tokens, as daar nog balans oor is: die reservering is dan kleiner.

Shannon Coder-oproep-toelaat

shannon-coder-1 op /v1/chat/completions en /v1/messages word in oproepe getel, nie in tokens nie. Elke plan sluit 'n aantal oproepe per venster van 4 uur in. Een versoek is een oproep.

Plan Oproepe per venster van 4 uur
Free 3
Plus 20
Standard 40
Pro 60
  • Vensters begin om 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC. Oproepe wat aan die einde van 'n venster oor is, word nie oorgedra nie.
  • 'n Oproep word getel wanneer die versoek aanvaar word, voordat die model antwoord. 'n Versoek wat daarna misluk, tel steeds as 'n oproep.
  • Hierdie oproepe reserveer geen tokens nie en neem niks van jou balans af nie. Die versoeklys op Sleutels en gebruik wys hul tokengetal en die waarde daarvan teen die gelyste prys.
  • Die verstek-max_tokens van shannon-coder-1 op hierdie twee eindpunte is 65,536.
  • Wanneer geen oproepe oor is nie, is die antwoord status 429, tipe rate_limit_error, boodskap Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan.
  • Op /v1/responses het shannon-coder-1 geen oproep-toelaat nie: dit word in tokens van jou balans gehef teen $8.00 per 1M, soos elke ander model.

Vloedbeskerming

'n Rekening mag 120 versoeke per minuut stuur. Dit is die enigste perk op versoektempo, en dit is dieselfde op elke plan. Dit bestaan om vloede te stop, nie om normale gebruik te vertraag nie.

  • Die minuut is 'n vaste venster van 60 sekondes wat met jou eerste versoek oopgaan. Wanneer dit eindig, begin die telling weer by nul.
  • Die telling is per rekening, nie per sleutel en nie per IP-adres nie. Om die sleutel te wissel open nie 'n nuwe venster nie.
  • Die 121ste versoek binne 'n venster word met status 429, tipe rate_limit_error en die boodskap Too many requests. Retry in <N>s. beantwoord. N is die aantal sekondes tot die venster eindig, van 1 tot 60.
  • Vloedbeskerming word voor die balans nagegaan. 'n Versoek wat dit weier, reserveer niks en kos niks.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
Versoek Vloedbeskerming
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses Getel, een per versoek.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens Nie getel nie.
shannon-coder-1 op /v1/chat/completions en /v1/messages In plaas daarvan getel deur die Shannon Coder-oproep-toelaat.
'n Versoek wat met 401 beantwoord is, of met 400 vir 'n onbekende model Nie getel nie.
'n Versoek wat deur vloedbeskerming geweier is Tel na die venster. Niks word gehef nie.

Parallelle versoeke

Daar is geen perk op hoeveel versoeke 'n rekening gelyktydig oop het nie, en geen fout omdat versoeke parallel gestuur word nie. Versoeke wat nie dadelik kan begin nie, wag in 'n tou en word om die beurt beantwoord.

  • Elke versoek tel by die 120 per minuut wanneer dit aankom, of vroeëre versoeke klaar is of nie.
  • Elke versoek hou sy eie reservering tot dit eindig. Twintig oop versoeke met die verstek-uitvoerbegroting hou 20 × 4,096 = 81,920 tokens balans. As die reserverings saam groter is as jou balans, kry die volgende versoek die Quota exceeded-antwoord, al sou die voltooide oproepe minder gekos het. 'n Kleiner max_tokens hou minder.
  • 'n Versoek sonder stroming stuur niks voordat sy antwoord volledig is nie, so gee jou kliënt 'n time-out wat die wag dek. 'n Stroom hou sy verbinding oop terwyl dit wag. Stroming

Perke van 'n enkele versoek

Perk Waarde Geld vir By die perk
Versoekliggaam 32 MiB (33,554,432 grepe) Elke eindpunt Status 413, tipe invalid_request_error.
Uitvoerbegroting: max_tokens, max_completion_tokens, max_output_tokens 1 tot 65,536. Verstek 4,096; vir shannon-coder-1 op /v1/chat/completions en /v1/messages is die verstek 65,536. Elke model, as die bedrag wat van jou balans gereserveer word. As die perk op die lengte van die antwoord: die gehuisveste oopgewig-modelle, shannon-1.6-lite, shannon-1.6-pro en shannon-coder-1. 'n Waarde buite die reeks word na die naaste punt van die reeks geskuif. Geen fout.
Stopreekse: stop, stop_sequences 4 stringe Gehuisveste oopgewig-modelle Die eerste 4 nie-leë stringe word gebruik.
Beeld of lêer as 'n URL gegee 8 MiB, binne 20 sekondes gelees, hoogstens 5 aanstuurings, 'n openbare http- of https-adres Elke eindpunt wat beelde of lêers aanvaar Die versoek word sonder daardie deel beantwoord. Geen fout.
Beeld of lêer inlyn gestuur (base64) Geen perk van sy eie nie. Dit tel by die versoekliggaam van 32 MiB. Elke eindpunt wat beelde of lêers aanvaar Status 413 vir die hele versoek.
text van POST /v1/tokenize 4,000,000 grepe /v1/tokenize Status 413, tipe invalid_request_error, boodskap text too long.
messages van POST /v1/tokenize en die liggaam van POST /v1/messages/count_tokens Die versoekliggaam van 32 MiB Albei telling-eindpunte Status 413.
Konteksvenster Per model: context_window in GET /v1/models Elke model Wat met 'n langer gesprek gebeur, hang van die model af. Modelle en pryse
Websoektogte (web_search: true) Per plan en dag: Free 3, Plus 30, Standard 50, Pro 60. Een soektog word getel vir 'n versoek waarvan die soektog resultate gevind het. Versoeke wat web_search: true stel Wanneer niks oor is nie, word die versoek sonder soektog beantwoord. Geen fout. Websoektog

Foute

Die antwoorde van hierdie bladsy. Op /v1/messages word dieselfde error-objek as {"type": "error", "error": {…}} toegedraai.

Status Tipe Boodskap Wanneer, en wat om te doen
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan Die reservering van die versoek pas nie in jou balans in nie. Wag vir 00:00 UTC, laai krediet op, verander plan, of stuur 'n kleiner max_tokens.
429 rate_limit_error Too many requests. Retry in <N>s. Meer as 120 versoeke in die huidige minuut. Wag N sekondes en stuur weer.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan Die Shannon Coder-oproepe van die huidige venster van 4 uur is opgebruik.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. Die model kan die versoek op hierdie oomblik nie neem nie. Stuur dit weer ná 'n kort pouse.
503 api_error Could not verify your quota right now. Please retry. Jou balans kon nie gelees word nie. Niks word gehef nie; stuur die versoek weer. Op /v1/responses met 'n Shannon-model is die status 500.
413 invalid_request_error Die versoekliggaam is groter as 32 MiB. Op die eindpunte in OpenAI-formaat dra die error-objek code: "request_too_large".
413 invalid_request_error text too long text van POST /v1/tokenize is langer as 4,000,000 grepe.