Limitlər və balans
Hər sorğuya bərabər xidmət göstərilir. Tarif pillələri yoxdur. Ayrıca API kvotası yoxdur. Tokenlərinizin pulunu artıq ödəmisiniz — onları istədiyiniz qədər sürətlə istifadə edin.
Bu səhifə balansınızın nədən ibarət olduğunu, bir sorğunun nəyi rezerv etdiyini və nəyə başa gəldiyini, neçə sorğu göndərə biləcəyinizi və tək sorğunun rastlaşa biləcəyi az sayda limiti izah edir.
- 1M token balansın dəyəri
- $5.00
- gündəlik limit yenilənir
- 00:00 UTC
- flood protection, hesab üzrə
- 120 sorğu / dəq
Sorğular necə xidmət edilir
- Tarif pillələri yoxdur — Sorğuların nə qədər sürətlə gələ biləcəyini bir qayda məhdudlaşdırır və bu hər hesab və hər plan üçün eynidir: dəqiqədə 120 sorğu. Dəqiqədə token limiti yoxdur.
- Ayrıca API kvotası yoxdur — API çatla eyni balansı xərcləyir. Plan bugünkü limitin ölçüsünü təyin edir. Sorğu sürətini təyin etmir.
- İstədiyiniz qədər sürətlə — Paralel göndərilən sorğular qəbul edilir və növbədə gözləyir. Paralel olduqları üçün rədd edilmirlər.
Balansınız
Balansınız tokenlərlə hesablanır. 1,000,000 token balans $5.00 dəyərindədir və Models & pricing səhifəsindəki hər qiymət bu dəyərə nisbətdə bir tarifdir.
İstənilən anda balans iki hissənin cəmidir.
- Bugünkü plan limiti — Planınızın təyin etdiyi token sayı. Hər gün 00:00 UTC-də yenilənir. Günün sonunda qalan növbəti günə keçmir.
- Alınmış kredit — Paket kimi aldığınız tokenlər. Kreditin müddəti bitmir və Free daxil olmaqla hər planda işləyir.
| Plan | Gündə token | Dəyəri |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- Xərcləmə sırası — Hər sorğu əvvəlcə bugünkü plan limitini xərcləyir. Alınmış kredit yalnız həmin gün limitdən artıq olan hissə üçün istifadə olunur.
- Çat və API onu bölüşür — Hər hesab üçün bir balans var. API açarı onun sahibi olan hesabın balansından, çatla eyni qiymətlərlə xərcləyir.
- Paketlər — Kredit 1,000,000 ($5.00), 2,000,000 ($10.00) və 5,000,000 ($25.00) tokenlik paketlərlə və ya 1,000,000 ilə 100,000,000 token arasında seçdiyiniz miqdarla, 1,000,000 üçün $5.00 qiymətlə satılır.
Sorğu nəyi rezerv edir və nəyə başa gəlir
- Rezerv — Sorğu gəldikdə output büdcəsini balansınızdan rezerv edir:
/v1/chat/completionsvə/v1/messages-dəmax_tokens,/v1/responses-damax_output_tokens./v1/chat/completionshəmçininmax_completion_tokens-i oxuyur. Standart dəyər 4,096, aralıq 1-dən 65,536-ya qədərdir. - Qəbul — Sorğu yalnız rezerv balansınızın qalan hissəsinə sığarsa qəbul edilir. Sıfırdan yuxarı, lakin output büdcəsindən kiçik balans
Quota exceededcavabını alır. Qalanından istifadə etmək üçün daha kiçikmax_tokensgöndərin. - Hesablaşma — Cavab tamamlandıqda rezerv real ödənişlə əvəz olunur. Ödəniş rezervdən az və ya çox ola bilər.
- Geri qaytarma — Xəta statusu ilə bitən sorğu rezervini tam geri qaytarır.
Real ödəniş model ailəsindən asılıdır.
| Modellər | Nə hesablanır |
|---|---|
| Shannon modelləri | usage.total_tokens modelin 1M üçün qiyməti ilə. Giriş və çıxış üçün bir tarif var. |
| Host edilən açıq çəkili modellər | Keşlənməmiş giriş giriş tarifi ilə, keşlənmiş giriş keş tarifi ilə, çıxış çıxış tarifi ilə. |
USD məbləği balansınızdan tokenlərlə, 1,000,000 üçün $5.00 qiymətlə götürülür və tam tokenə yuvarlaqlaşdırılır.
POST /v1/tokenize və ya POST /v1/messages/count_tokens ilə tokenlərin sayılması pulsuzdur və heç nə rezerv etmir. Tokenlərin sayılması
Balans və istifadəni harada görmək olar
Keys & usage səhifəsi hazırda xərcləyə biləcəyinizi, bugünkü plan limitini, alınmış kreditinizi və son 30 günün API xərcini göstərir. Aşağıda açarınızın etdiyi hər sorğu siyahıya alınır: vaxt, endpoint, model, keşlənmiş giriş, hesablanmış tokenlər və xərc. Keys & usage
Hər cavab həmçinin həmin çağırışın token saylarını saxlayan usage obyekti daşıyır.
| Endpoint | usage sahələri | Host edilən açıq çəkili modellərin əlavə etdikləri |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usagemodelin token saylarını saxlayır. Balansınızdan götürülən məbləğ cavabda yoxdur: o, Keys & usage səhifəsindəki sorğu siyahısının Billed tokens sütunudur.- Host edilən açıq çəkili modellə
/v1/messages-dəinput_tokensgirişin keşlənməmiş hissəsi,cache_read_input_tokenskeşlənmiş hissə,cache_creation_input_tokensisə həmişə0-dır. -
/v1/chat/completions-da axınusage-i[DONE]-dan əvvəlki son chunk-da daşıyır. Axın
Balans bitdikdə
Rezervi balansınıza sığmayan sorğu 429 statusu, rate_limit_error tipi və aşağıdakı mesajla cavablandırılır. Heç nə hesablanmır. Balans sıfırdan yuxarı, lakin sorğunun output büdcəsindən kiçik olduqda da eyni cavab göndərilir.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses-da error obyektində həmçinin hər ikisi null olan code və param ola bilər.
Nə edə bilərsiniz:
- 00:00 UTC-də növbəti plan limitini gözləyin.
- Krediti artırın. Kredit plan limitindən sonra xərclənir və müddəti bitmir. Krediti artır
- Daha böyük gündəlik limiti olan plana keçin. Planı dəyiş
- Balansdan nəsə qalıbsa, daha kiçik
max_tokensgöndərin: onda rezerv də kiçik olur.
Shannon Coder çağırış limiti
/v1/chat/completions və /v1/messages-də shannon-coder-1 tokenlərlə deyil, çağırışlarla sayılır. Hər plana 4 saatlıq pəncərə üçün müəyyən sayda çağırış daxildir. Bir sorğu bir çağırışdır.
| Plan | 4 saatlıq pəncərədə çağırışlar |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- Pəncərələr 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-də başlayır. Pəncərənin sonunda qalan çağırışlar növbəti pəncərəyə keçmir.
- Çağırış sorğu qəbul edildikdə, model cavab verməzdən əvvəl sayılır. Sonradan uğursuz olan sorğu da çağırış sayılır.
- Bu çağırışlar token rezerv etmir və balansınızdan heç nə çıxmır. Keys & usage səhifəsindəki sorğu siyahısı onların token sayını və elan olunmuş qiymətlə dəyərini göstərir.
shannon-coder-1-in bu iki endpoint-də standartmax_tokensdəyəri 65,536-dir.- Çağırış qalmadıqda cavab
429statusu,rate_limit_errortipi vəShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/planmesajı ilə olur. /v1/responses-dashannon-coder-1üçün çağırış limiti yoxdur: o, hər digər model kimi balansınızdan 1M üçün $8.00 qiymətlə tokenlərlə hesablanır.
Flood protection
Hesab dəqiqədə 120 sorğu göndərə bilər. Bu, sorğu sürətinə yeganə limitdir və hər planda eynidir. O, daşqınların qarşısını almaq üçündür, normal istifadəni yavaşlatmaq üçün deyil.
- Dəqiqə ilk sorğunuzla açılan 60 saniyəlik sabit pəncərədir. Pəncərə bitdikdə say yenidən sıfırdan başlayır.
- Say hesab üzrədir, açar və ya IP ünvanı üzrə deyil. Açarı dəyişmək yeni pəncərə açmır.
- Pəncərə daxilində 121-ci sorğu
429statusu,rate_limit_errortipi vəToo many requests. Retry in <N>s.mesajı ilə cavablandırılır.Npəncərənin bitməsinə qədər 1-dən 60-a qədər saniyə sayıdır. - Flood protection balansdan əvvəl yoxlanılır. Onun rədd etdiyi sorğu heç nə rezerv etmir və heç nəyə başa gəlmir.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | Sorğu | Flood protection |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | Sayılır, hər sorğu bir. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | Sayılmır. |
/v1/chat/completions və /v1/messages-də shannon-coder-1 | Əvəzində Shannon Coder çağırış limiti ilə sayılır. |
401 ilə və ya naməlum model üçün 400 ilə cavablandırılan sorğu | Sayılmır. |
| Flood protection tərəfindən rədd edilən sorğu | Pəncərəyə sayılır. Heç nə hesablanmır. |
Paralel sorğular
Hesabın eyni vaxtda neçə açıq sorğusu ola biləcəyinə limit yoxdur və sorğuları paralel göndərməyə görə xəta yoxdur. Dərhal başlaya bilməyən sorğular növbədə gözləyir və növbə ilə cavablandırılır.
- Hər sorğu, əvvəlki sorğular bitsin-bitməsin, gəldiyi anda dəqiqədə 120 limitinə sayılır.
- Hər sorğu bitənə qədər öz rezervini saxlayır. Standart output büdcəsi ilə iyirmi açıq sorğu 20 × 4,096 = 81,920 token balans saxlayır. Rezervlərin cəmi balansınızdan böyükdürsə, bitmiş çağırışlar daha az tutsa belə, növbəti sorğu
Quota exceededcavabını alır. Daha kiçikmax_tokensdaha az saxlayır. - Axınsız sorğu cavabı tamamlanana qədər heç nə göndərmir, ona görə klientinizə gözləməni əhatə edən timeout verin. Axın gözləyərkən bağlantını açıq saxlayır. Axın
Tək sorğunun limitləri
| Limit | Dəyər | Harada tətbiq olunur | Limitə çatdıqda |
|---|---|---|---|
| Sorğu gövdəsi | 32 MiB (33,554,432 bayt) | Hər endpoint | Status 413, tip invalid_request_error. |
Output büdcəsi: max_tokens, max_completion_tokens, max_output_tokens | 1-dən 65,536-ya qədər. Standart 4,096; /v1/chat/completions və /v1/messages-də shannon-coder-1 üçün standart 65,536-dır. | Hər model üçün balansınızdan rezerv edilən miqdar kimi. Cavabın uzunluğuna limit kimi: host edilən açıq çəkili modellər, shannon-1.6-lite, shannon-1.6-pro və shannon-coder-1. | Aralıqdan kənar dəyər aralığın ən yaxın ucuna çəkilir. Xəta olmur. |
Dayanma ardıcıllıqları: stop, stop_sequences | 4 sətir | Host edilən açıq çəkili modellər | İlk 4 boş olmayan sətir istifadə olunur. |
| URL kimi verilən təsvir və ya fayl | 8 MiB, 20 saniyə ərzində oxunur, ən çoxu 5 yönləndirmə, ictimai http və ya https ünvanı | Təsvir və ya fayl qəbul edən hər endpoint | Sorğu həmin hissə olmadan cavablandırılır. Xəta olmur. |
| Inline göndərilən təsvir və ya fayl (base64) | Öz limiti yoxdur. 32 MiB sorğu gövdəsinə daxil edilir. | Təsvir və ya fayl qəbul edən hər endpoint | Bütün sorğu üçün status 413. |
POST /v1/tokenize-in text-i | 4,000,000 bayt | /v1/tokenize | Status 413, tip invalid_request_error, mesaj text too long. |
POST /v1/tokenize-in messages-i və POST /v1/messages/count_tokens-in gövdəsi | 32 MiB sorğu gövdəsi | Hər iki say endpoint-i | Status 413. |
| Kontekst pəncərəsi | Modelə görə: GET /v1/models-də context_window | Hər model | Daha uzun söhbətə nə olacağı modeldən asılıdır. Modellər və qiymətlər |
Veb axtarışları (web_search: true) | Plan və gün üzrə: Free 3, Plus 30, Standard 50, Pro 60. Axtarışı nəticə tapan sorğu üçün bir axtarış sayılır. | web_search: true təyin edən sorğular | Qalmadıqda sorğu axtarışsız cavablandırılır. Xəta olmur. Veb axtarışı |
Xətalar
Bu səhifənin cavabları. /v1/messages-də eyni error obyekti {"type": "error", "error": {…}} kimi bükülür.
| Status | Tip | Mesaj | Nə vaxt və nə etməli |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | Sorğunun rezervi balansınıza sığmır. 00:00 UTC-ni gözləyin, krediti artırın, planı dəyişin və ya daha kiçik max_tokens göndərin. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | Cari dəqiqədə 120-dən çox sorğu. N saniyə gözləyin və yenidən göndərin. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | Cari 4 saatlıq pəncərənin Shannon Coder çağırışları bitib. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | Model bu anda sorğunu qəbul edə bilmir. Qısa fasilədən sonra yenidən göndərin. |
503 | api_error | Could not verify your quota right now. Please retry. | Balansınız oxuna bilmədi. Heç nə hesablanmır; sorğunu yenidən göndərin. /v1/responses-da Shannon modeli ilə status 500-dür. |
413 | invalid_request_error | Sorğu gövdəsi 32 MiB-dan böyükdür. OpenAI formatlı endpoint-lərdə error obyektində code: "request_too_large" olur. | |
413 | invalid_request_error | text too long | POST /v1/tokenize-in text-i 4,000,000 baytdan uzundur. |