Iyakoki da balance
Ana yi wa kowace request hidima daidai. Babu matakan rate. Babu quota na API daban. Kun riga kun biya kuɗin tokens ɗinku — ku yi amfani da su da sauri yadda kuke so.
Wannan shafin yana bayanin abin da balance ɗinku ya ƙunsa, abin da request ɗaya ke ware da kashewa, requests nawa za ku iya aikawa, da ƴan iyakokin da request ɗaya zai iya haɗuwa da su.
- ƙimar tokens 1M na balance
- $5.00
- allowance na yau da kullun yana sabuntawa
- 00:00 UTC
- flood protection, ga kowane asusu
- 120 requests / minti
Yadda ake yi wa requests hidima
- Babu matakan rate — Ƙa'ida ɗaya tana iyakance saurin zuwan requests, kuma iri ɗaya ce ga kowane asusu da kowane plan: requests 120 a minti ɗaya. Babu iyaka kan tokens a minti ɗaya.
- Babu quota na API daban — API yana kashe balance iri ɗaya da na taɗi. Plan yana saita girman allowance na yau. Ba ya saita yawan requests.
- Da sauri yadda kuke so — Ana karɓar requests da aka aika a lokaci guda kuma suna jira a layi. Ba a ƙi su don suna lokaci guda ba.
Balance ɗinku
Ana ƙirga balance ɗinku a tokens. Tokens 1,000,000 na balance sun kai $5.00, kuma kowane farashi a shafin Models & farashi rate ne a kan wannan ƙima.
A kowane lokaci balance shi ne jimillar sassa biyu.
- Plan allowance na yau — Adadin tokens da plan ɗinku ya saita. Yana sabunta kowace rana da ƙarfe 00:00 UTC. Abin da ya rage a ƙarshen rana ba ya ci gaba.
- Credit da aka saya — Tokens da kuka saya a matsayin pack. Credit ba ya ƙarewa kuma yana aiki a kowane plan, har da Free.
| Plan | Tokens a rana | Ƙima |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- Tsarin kashewa — Kowace request tana kashe plan allowance na yau da farko. Ana amfani da credit da aka saya ne kawai ga abin da ya wuce allowance a wannan rana.
- Taɗi da API suna raba shi — Akwai balance ɗaya ga kowane asusu. Maɓallin API yana kashe daga balance na asusun da ya mallake shi, a farashi iri ɗaya da na taɗi.
- Packs — Ana sayar da credit a packs na tokens 1,000,000 ($5.00), 2,000,000 ($10.00) da 5,000,000 ($25.00), ko a adadin da kuka zaɓa daga tokens 1,000,000 zuwa 100,000,000 a $5.00 kowace 1,000,000.
Abin da request ke ware da abin da yake kashewa
- Ware — Idan request ya iso yana ware output budget ɗinsa daga balance ɗinku:
max_tokensa/v1/chat/completionsda/v1/messages,max_output_tokensa/v1/responses./v1/chat/completionsyana kuma karantamax_completion_tokens. Na asali shi ne 4,096 kuma kewayon shi ne 1 zuwa 65,536. - Karɓa — Ana karɓar request ne kawai idan abin da aka ware ya shiga cikin abin da ya rage a balance ɗinku. Balance da ya fi sifili amma ya ƙasa da output budget yana samun amsar
Quota exceeded. Ku aikamax_tokensmafi ƙanƙanta don amfani da sauran. - Daidaitawa — Idan amsar ta cika, ana maye gurbin abin da aka ware da ainihin caji. Cajin na iya zama ƙasa ko sama da abin da aka ware.
- Mayarwa — Request da ya ƙare da matsayin kuskure yana mayar da abin da aka ware gaba ɗaya.
Ainihin cajin ya dogara da iyalin model.
| Models | Abin da ake caji |
|---|---|
| Models na Shannon | usage.total_tokens a farashin model kowace 1M. Input da output suna da rate ɗaya. |
| Hosted open-weight models | Input da ba a yi cache ba a input rate, cached input a cached rate, output a output rate. |
Ana ɗaukar adadin a USD daga balance ɗinku a tokens a $5.00 kowace 1,000,000, an zagaye zuwa cikakken token.
Ƙirgan tokens da POST /v1/tokenize ko POST /v1/messages/count_tokens kyauta ne kuma ba ya ware komai. Ƙidayar tokens
Inda za a ga balance da amfani
Shafin Maɓallai & amfani yana nuna abin da za ku iya kashewa yanzu, plan allowance na yau, credit ɗinku da aka saya da kashewar API na kwanaki 30 da suka wuce. A ƙasa yana lissafa kowace request da maɓallinku ya yi: lokaci, endpoint, model, cached input, tokens da aka caje da kuɗi. Maɓallai & amfani
Kowace amsa tana kuma ɗauke da object ɗin usage mai ƙirgan tokens na wannan kira.
| Endpoint | Fields na usage | Hosted open-weight models ne ke ƙarawa |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageyana ɗauke da ƙirgan tokens na model. Adadin da aka ɗauka daga balance ɗinku ba ya cikin amsar: shi ne ginshiƙin Tokens da aka caje na jerin requests a Maɓallai & amfani.- A
/v1/messagesda hosted open-weight model,input_tokensshi ne ɓangaren input da ba a yi cache ba,cache_read_input_tokensshi ne ɓangaren da aka yi cache kumacache_creation_input_tokenskoyaushe0ne. - Stream a
/v1/chat/completionsyana ɗauke dausagea chunk ɗinsa na ƙarshe kafin[DONE]. Yawo
Idan balance ya ƙare
Request wanda abin da aka ware masa bai shiga cikin balance ɗinku ba ana amsa shi da matsayi 429, nau'in rate_limit_error da saƙon da ke ƙasa. Ba a caje komai ba. Ana aika amsa iri ɗaya idan balance ya fi sifili amma ya ƙasa da output budget na request.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} A /v1/responses object ɗin error na iya ɗaukar code da param ma, duka biyu null.
Abin da za ku iya yi:
- Ku jira plan allowance na gaba da ƙarfe 00:00 UTC.
- Ku ƙara credit. Ana kashe credit bayan plan allowance kuma ba ya ƙarewa. Karin credit
- Ku koma plan mai allowance na yau da kullun mafi girma. Canza plan
- Ku aika
max_tokensmafi ƙanƙanta, idan wani balance ya rage: abin da aka ware sai ya ragu.
Allowance na kiran Shannon Coder
Ana ƙirga shannon-coder-1 a /v1/chat/completions da /v1/messages a kira, ba a tokens ba. Kowane plan yana ɗauke da adadin kira ga kowace taga ta awa 4. Request ɗaya kira ɗaya ne.
| Plan | Kira ga kowace taga ta awa 4 |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- Tagogi suna farawa a 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC. Kiran da suka rage a ƙarshen taga ba sa ci gaba.
- Ana ƙirga kira lokacin da aka karɓi request, kafin model ya amsa. Request da ya gaza bayan haka har yanzu ana ƙirga shi a matsayin kira.
- Waɗannan kira ba sa ware tokens kuma ba sa ɗaukar komai daga balance ɗinku. Jerin requests a Maɓallai & amfani yana nuna adadin tokens ɗinsu da ƙimarsu a farashin da aka lissafa.
max_tokensna asali nashannon-coder-1a waɗannan endpoints biyu shi ne 65,536.- Idan babu sauran kira, amsar ita ce matsayi
429, nau'inrate_limit_error, saƙoShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan. - A
/v1/responses,shannon-coder-1ba shi da allowance na kira: ana cajin sa a tokens daga balance ɗinku a $8.00 kowace 1M, kamar kowane sauran model.
Flood protection
Asusu na iya aika requests 120 a minti ɗaya. Wannan ita ce iyaka ɗaya tilo ga yawan requests, kuma iri ɗaya ce a kowane plan. Tana nan don dakatar da ambaliya, ba don rage amfani na al'ada ba.
- Minti taga ce tsayayye ta daƙiƙa 60 da ke buɗewa da request ɗinku na farko. Idan ta ƙare, ƙirgan yana farawa daga sifili.
- Ana ƙirga ta asusu, ba ta maɓalli ba kuma ba ta adireshin IP ba. Canza maɓalli ba ya buɗe sabuwar taga.
- Request na 121 a cikin taga ana amsa shi da matsayi
429, nau'inrate_limit_errorda saƙonToo many requests. Retry in <N>s.Nshi ne adadin daƙiƙu har taga ta ƙare, daga 1 zuwa 60. - Ana duba flood protection kafin balance. Request da ya ƙi ba ya ware komai kuma ba ya kashe komai.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | Request | Flood protection |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | Ana ƙirgawa, ɗaya ga kowace request. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | Ba a ƙirgawa. |
shannon-coder-1 a /v1/chat/completions da /v1/messages | Ana ƙirga shi ta allowance na kiran Shannon Coder maimakon haka. |
Request da aka amsa da 401, ko da 400 ga model da ba a sani ba | Ba a ƙirgawa. |
| Request da flood protection ya ƙi | Ana ƙirgawa a taga. Ba a caje komai ba. |
Requests a lokaci guda
Babu iyaka kan requests nawa asusu zai iya buɗewa a lokaci guda, kuma babu kuskure don aika requests a lokaci guda. Requests da ba za su iya farawa nan take ba suna jira a layi kuma ana amsa su bi da bi.
- Kowace request tana ƙirgawa cikin 120 a minti ɗaya idan ta iso, ko da requests na baya sun ƙare ko ba su ƙare ba.
- Kowace request tana riƙe abin da ta ware har ta ƙare. Buɗaɗɗun requests ashirin da output budget na asali suna riƙe 20 × 4,096 = tokens 81,920 na balance. Idan abubuwan da aka ware a haɗe sun fi balance ɗinku girma, request na gaba yana samun amsar
Quota exceeded, ko da kiran da suka ƙare za su kashe ƙasa.max_tokensmafi ƙanƙanta yana riƙe ƙasa. - Request ba tare da streaming ba ba ya aika komai har sai amsarsa ta cika, don haka ku ba client ɗinku timeout da ya rufe jira. Stream yana riƙe haɗinsa a buɗe yayin da yake jira. Yawo
Iyakokin request ɗaya
| Iyaka | Ƙima | Ya shafi | A iyaka |
|---|---|---|---|
| Jikin request | 32 MiB (bytes 33,554,432) | Kowane endpoint | Matsayi 413, nau'in invalid_request_error. |
Output budget: max_tokens, max_completion_tokens, max_output_tokens | 1 zuwa 65,536. Na asali 4,096; ga shannon-coder-1 a /v1/chat/completions da /v1/messages na asali shi ne 65,536. | Kowane model, a matsayin adadin da ake ware daga balance ɗinku. A matsayin iyaka kan tsawon amsa: hosted open-weight models, shannon-1.6-lite, shannon-1.6-pro da shannon-coder-1. | Ƙimar da ta wuce kewayon ana kawo ta zuwa ƙarshen kewayon mafi kusa. Babu kuskure. |
Stop sequences: stop, stop_sequences | strings 4 | Hosted open-weight models | Ana amfani da strings 4 na farko marasa komai-ba. |
| Hoto ko fayil da aka bayar a matsayin URL | 8 MiB, ana karantawa cikin daƙiƙa 20, redirects 5 a mafi yawa, adireshin http ko https na jama'a | Kowane endpoint da ke karɓar hotuna ko fayiloli | Ana amsa request ba tare da wannan sashe ba. Babu kuskure. |
| Hoto ko fayil da aka aika a cikin layi (base64) | Babu iyaka na kansa. Yana cikin jikin request na 32 MiB. | Kowane endpoint da ke karɓar hotuna ko fayiloli | Matsayi 413 ga dukan request. |
text na POST /v1/tokenize | bytes 4,000,000 | /v1/tokenize | Matsayi 413, nau'in invalid_request_error, saƙo text too long. |
messages na POST /v1/tokenize da jikin POST /v1/messages/count_tokens | Jikin request na 32 MiB | Duka endpoints biyu na ƙirga | Matsayi 413. |
| Context window | Ga kowane model: context_window a GET /v1/models | Kowane model | Abin da ke faruwa da tattaunawa mafi tsawo ya dogara da model. Models & farashi |
Binciken yanar gizo (web_search: true) | Ga kowane plan da rana: Free 3, Plus 30, Standard 50, Pro 60. Ana ƙirga bincike ɗaya ga request wanda binciken ya sami sakamako. | Requests da suka saita web_search: true | Idan babu sauran, ana amsa request ba tare da bincike ba. Babu kuskure. Binciken Yanar Gizon da aka Gina |
Kurakurai
Amsoshin wannan shafin. A /v1/messages ana nannaɗe object ɗin error iri ɗaya a matsayin {"type": "error", "error": {…}}.
| Matsayi | Nau'i | Saƙo | Lokaci, da abin da za a yi |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | Abin da request ya ware bai shiga cikin balance ɗinku ba. Ku jira 00:00 UTC, ku ƙara credit, ku canza plan, ko ku aika max_tokens mafi ƙanƙanta. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | Fiye da requests 120 a cikin minti na yanzu. Ku jira daƙiƙu N ku sake aikawa. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | An yi amfani da kiran Shannon Coder na taga ta awa 4 ta yanzu. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | Model ba zai iya karɓar request a wannan lokacin ba. Ku sake aika shi bayan ɗan hutu. |
503 | api_error | Could not verify your quota right now. Please retry. | Ba a iya karanta balance ɗinku ba. Ba a caje komai ba; ku sake aika request. A /v1/responses da model na Shannon matsayin shi ne 500. |
413 | invalid_request_error | Jikin request ya fi 32 MiB girma. A endpoints na tsarin OpenAI object ɗin error yana ɗauke da code: "request_too_large". | |
413 | invalid_request_error | text too long | text na POST /v1/tokenize ya fi bytes 4,000,000 tsawo. |