Məzmuna keç
Limitlər və balans

Limitlər və balans

Hər sorğuya bərabər xidmət göstərilir. Tarif pillələri yoxdur. Ayrıca API kvotası yoxdur. Tokenlərinizin pulunu artıq ödəmisiniz — onları istədiyiniz qədər sürətlə istifadə edin.

Bu səhifə balansınızın nədən ibarət olduğunu, bir sorğunun nəyi rezerv etdiyini və nəyə başa gəldiyini, neçə sorğu göndərə biləcəyinizi və tək sorğunun rastlaşa biləcəyi az sayda limiti izah edir.

1M token balansın dəyəri
$5.00
gündəlik limit yenilənir
00:00 UTC
flood protection, hesab üzrə
120 sorğu / dəq

Sorğular necə xidmət edilir

  • Tarif pillələri yoxdur — Sorğuların nə qədər sürətlə gələ biləcəyini bir qayda məhdudlaşdırır və bu hər hesab və hər plan üçün eynidir: dəqiqədə 120 sorğu. Dəqiqədə token limiti yoxdur.
  • Ayrıca API kvotası yoxdur — API çatla eyni balansı xərcləyir. Plan bugünkü limitin ölçüsünü təyin edir. Sorğu sürətini təyin etmir.
  • İstədiyiniz qədər sürətlə — Paralel göndərilən sorğular qəbul edilir və növbədə gözləyir. Paralel olduqları üçün rədd edilmirlər.

Balansınız

Balansınız tokenlərlə hesablanır. 1,000,000 token balans $5.00 dəyərindədir və Models & pricing səhifəsindəki hər qiymət bu dəyərə nisbətdə bir tarifdir.

İstənilən anda balans iki hissənin cəmidir.

  • Bugünkü plan limiti — Planınızın təyin etdiyi token sayı. Hər gün 00:00 UTC-də yenilənir. Günün sonunda qalan növbəti günə keçmir.
  • Alınmış kredit — Paket kimi aldığınız tokenlər. Kreditin müddəti bitmir və Free daxil olmaqla hər planda işləyir.
Plan Gündə token Dəyəri
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • Xərcləmə sırası — Hər sorğu əvvəlcə bugünkü plan limitini xərcləyir. Alınmış kredit yalnız həmin gün limitdən artıq olan hissə üçün istifadə olunur.
  • Çat və API onu bölüşür — Hər hesab üçün bir balans var. API açarı onun sahibi olan hesabın balansından, çatla eyni qiymətlərlə xərcləyir.
  • Paketlər — Kredit 1,000,000 ($5.00), 2,000,000 ($10.00) və 5,000,000 ($25.00) tokenlik paketlərlə və ya 1,000,000 ilə 100,000,000 token arasında seçdiyiniz miqdarla, 1,000,000 üçün $5.00 qiymətlə satılır.

Krediti artır Planı dəyiş

Sorğu nəyi rezerv edir və nəyə başa gəlir

  • Rezerv — Sorğu gəldikdə output büdcəsini balansınızdan rezerv edir: /v1/chat/completions və /v1/messages-də max_tokens, /v1/responses-da max_output_tokens. /v1/chat/completions həmçinin max_completion_tokens-i oxuyur. Standart dəyər 4,096, aralıq 1-dən 65,536-ya qədərdir.
  • Qəbul — Sorğu yalnız rezerv balansınızın qalan hissəsinə sığarsa qəbul edilir. Sıfırdan yuxarı, lakin output büdcəsindən kiçik balans Quota exceeded cavabını alır. Qalanından istifadə etmək üçün daha kiçik max_tokens göndərin.
  • Hesablaşma — Cavab tamamlandıqda rezerv real ödənişlə əvəz olunur. Ödəniş rezervdən az və ya çox ola bilər.
  • Geri qaytarma — Xəta statusu ilə bitən sorğu rezervini tam geri qaytarır.

Real ödəniş model ailəsindən asılıdır.

Modellər Nə hesablanır
Shannon modelləri usage.total_tokens modelin 1M üçün qiyməti ilə. Giriş və çıxış üçün bir tarif var.
Host edilən açıq çəkili modellər Keşlənməmiş giriş giriş tarifi ilə, keşlənmiş giriş keş tarifi ilə, çıxış çıxış tarifi ilə.

USD məbləği balansınızdan tokenlərlə, 1,000,000 üçün $5.00 qiymətlə götürülür və tam tokenə yuvarlaqlaşdırılır.

POST /v1/tokenize və ya POST /v1/messages/count_tokens ilə tokenlərin sayılması pulsuzdur və heç nə rezerv etmir. Tokenlərin sayılması

Balans və istifadəni harada görmək olar

Keys & usage səhifəsi hazırda xərcləyə biləcəyinizi, bugünkü plan limitini, alınmış kreditinizi və son 30 günün API xərcini göstərir. Aşağıda açarınızın etdiyi hər sorğu siyahıya alınır: vaxt, endpoint, model, keşlənmiş giriş, hesablanmış tokenlər və xərc. Keys & usage

Hər cavab həmçinin həmin çağırışın token saylarını saxlayan usage obyekti daşıyır.

Endpoint usage sahələri Host edilən açıq çəkili modellərin əlavə etdikləri
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage modelin token saylarını saxlayır. Balansınızdan götürülən məbləğ cavabda yoxdur: o, Keys & usage səhifəsindəki sorğu siyahısının Billed tokens sütunudur.
  • Host edilən açıq çəkili modellə /v1/messages-də input_tokens girişin keşlənməmiş hissəsi, cache_read_input_tokens keşlənmiş hissə, cache_creation_input_tokens isə həmişə 0-dır.
  • /v1/chat/completions-da axın usage-i [DONE]-dan əvvəlki son chunk-da daşıyır. Axın

Balans bitdikdə

Rezervi balansınıza sığmayan sorğu 429 statusu, rate_limit_error tipi və aşağıdakı mesajla cavablandırılır. Heç nə hesablanmır. Balans sıfırdan yuxarı, lakin sorğunun output büdcəsindən kiçik olduqda da eyni cavab göndərilir.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses-da error obyektində həmçinin hər ikisi null olan code və param ola bilər.

Nə edə bilərsiniz:

  • 00:00 UTC-də növbəti plan limitini gözləyin.
  • Krediti artırın. Kredit plan limitindən sonra xərclənir və müddəti bitmir. Krediti artır
  • Daha böyük gündəlik limiti olan plana keçin. Planı dəyiş
  • Balansdan nəsə qalıbsa, daha kiçik max_tokens göndərin: onda rezerv də kiçik olur.

Shannon Coder çağırış limiti

/v1/chat/completions və /v1/messages-də shannon-coder-1 tokenlərlə deyil, çağırışlarla sayılır. Hər plana 4 saatlıq pəncərə üçün müəyyən sayda çağırış daxildir. Bir sorğu bir çağırışdır.

Plan 4 saatlıq pəncərədə çağırışlar
Free 3
Plus 20
Standard 40
Pro 60
  • Pəncərələr 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-də başlayır. Pəncərənin sonunda qalan çağırışlar növbəti pəncərəyə keçmir.
  • Çağırış sorğu qəbul edildikdə, model cavab verməzdən əvvəl sayılır. Sonradan uğursuz olan sorğu da çağırış sayılır.
  • Bu çağırışlar token rezerv etmir və balansınızdan heç nə çıxmır. Keys & usage səhifəsindəki sorğu siyahısı onların token sayını və elan olunmuş qiymətlə dəyərini göstərir.
  • shannon-coder-1-in bu iki endpoint-də standart max_tokens dəyəri 65,536-dir.
  • Çağırış qalmadıqda cavab 429 statusu, rate_limit_error tipi və Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan mesajı ilə olur.
  • /v1/responses-da shannon-coder-1 üçün çağırış limiti yoxdur: o, hər digər model kimi balansınızdan 1M üçün $8.00 qiymətlə tokenlərlə hesablanır.

Flood protection

Hesab dəqiqədə 120 sorğu göndərə bilər. Bu, sorğu sürətinə yeganə limitdir və hər planda eynidir. O, daşqınların qarşısını almaq üçündür, normal istifadəni yavaşlatmaq üçün deyil.

  • Dəqiqə ilk sorğunuzla açılan 60 saniyəlik sabit pəncərədir. Pəncərə bitdikdə say yenidən sıfırdan başlayır.
  • Say hesab üzrədir, açar və ya IP ünvanı üzrə deyil. Açarı dəyişmək yeni pəncərə açmır.
  • Pəncərə daxilində 121-ci sorğu 429 statusu, rate_limit_error tipi və Too many requests. Retry in <N>s. mesajı ilə cavablandırılır. N pəncərənin bitməsinə qədər 1-dən 60-a qədər saniyə sayıdır.
  • Flood protection balansdan əvvəl yoxlanılır. Onun rədd etdiyi sorğu heç nə rezerv etmir və heç nəyə başa gəlmir.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
Sorğu Flood protection
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses Sayılır, hər sorğu bir.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens Sayılmır.
/v1/chat/completions və /v1/messages-də shannon-coder-1 Əvəzində Shannon Coder çağırış limiti ilə sayılır.
401 ilə və ya naməlum model üçün 400 ilə cavablandırılan sorğu Sayılmır.
Flood protection tərəfindən rədd edilən sorğu Pəncərəyə sayılır. Heç nə hesablanmır.

Paralel sorğular

Hesabın eyni vaxtda neçə açıq sorğusu ola biləcəyinə limit yoxdur və sorğuları paralel göndərməyə görə xəta yoxdur. Dərhal başlaya bilməyən sorğular növbədə gözləyir və növbə ilə cavablandırılır.

  • Hər sorğu, əvvəlki sorğular bitsin-bitməsin, gəldiyi anda dəqiqədə 120 limitinə sayılır.
  • Hər sorğu bitənə qədər öz rezervini saxlayır. Standart output büdcəsi ilə iyirmi açıq sorğu 20 × 4,096 = 81,920 token balans saxlayır. Rezervlərin cəmi balansınızdan böyükdürsə, bitmiş çağırışlar daha az tutsa belə, növbəti sorğu Quota exceeded cavabını alır. Daha kiçik max_tokens daha az saxlayır.
  • Axınsız sorğu cavabı tamamlanana qədər heç nə göndərmir, ona görə klientinizə gözləməni əhatə edən timeout verin. Axın gözləyərkən bağlantını açıq saxlayır. Axın

Tək sorğunun limitləri

Limit Dəyər Harada tətbiq olunur Limitə çatdıqda
Sorğu gövdəsi 32 MiB (33,554,432 bayt) Hər endpoint Status 413, tip invalid_request_error.
Output büdcəsi: max_tokens, max_completion_tokens, max_output_tokens 1-dən 65,536-ya qədər. Standart 4,096; /v1/chat/completions və /v1/messages-də shannon-coder-1 üçün standart 65,536-dır. Hər model üçün balansınızdan rezerv edilən miqdar kimi. Cavabın uzunluğuna limit kimi: host edilən açıq çəkili modellər, shannon-1.6-lite, shannon-1.6-pro və shannon-coder-1. Aralıqdan kənar dəyər aralığın ən yaxın ucuna çəkilir. Xəta olmur.
Dayanma ardıcıllıqları: stop, stop_sequences 4 sətir Host edilən açıq çəkili modellər İlk 4 boş olmayan sətir istifadə olunur.
URL kimi verilən təsvir və ya fayl 8 MiB, 20 saniyə ərzində oxunur, ən çoxu 5 yönləndirmə, ictimai http və ya https ünvanı Təsvir və ya fayl qəbul edən hər endpoint Sorğu həmin hissə olmadan cavablandırılır. Xəta olmur.
Inline göndərilən təsvir və ya fayl (base64) Öz limiti yoxdur. 32 MiB sorğu gövdəsinə daxil edilir. Təsvir və ya fayl qəbul edən hər endpoint Bütün sorğu üçün status 413.
POST /v1/tokenize-in text-i 4,000,000 bayt /v1/tokenize Status 413, tip invalid_request_error, mesaj text too long.
POST /v1/tokenize-in messages-i və POST /v1/messages/count_tokens-in gövdəsi 32 MiB sorğu gövdəsi Hər iki say endpoint-i Status 413.
Kontekst pəncərəsi Modelə görə: GET /v1/models-də context_window Hər model Daha uzun söhbətə nə olacağı modeldən asılıdır. Modellər və qiymətlər
Veb axtarışları (web_search: true) Plan və gün üzrə: Free 3, Plus 30, Standard 50, Pro 60. Axtarışı nəticə tapan sorğu üçün bir axtarış sayılır. web_search: true təyin edən sorğular Qalmadıqda sorğu axtarışsız cavablandırılır. Xəta olmur. Veb axtarışı

Xətalar

Bu səhifənin cavabları. /v1/messages-də eyni error obyekti {"type": "error", "error": {…}} kimi bükülür.

Status Tip Mesaj Nə vaxt və nə etməli
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan Sorğunun rezervi balansınıza sığmır. 00:00 UTC-ni gözləyin, krediti artırın, planı dəyişin və ya daha kiçik max_tokens göndərin.
429 rate_limit_error Too many requests. Retry in <N>s. Cari dəqiqədə 120-dən çox sorğu. N saniyə gözləyin və yenidən göndərin.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan Cari 4 saatlıq pəncərənin Shannon Coder çağırışları bitib.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. Model bu anda sorğunu qəbul edə bilmir. Qısa fasilədən sonra yenidən göndərin.
503 api_error Could not verify your quota right now. Please retry. Balansınız oxuna bilmədi. Heç nə hesablanmır; sorğunu yenidən göndərin. /v1/responses-da Shannon modeli ilə status 500-dür.
413 invalid_request_error Sorğu gövdəsi 32 MiB-dan böyükdür. OpenAI formatlı endpoint-lərdə error obyektində code: "request_too_large" olur.
413 invalid_request_error text too long POST /v1/tokenize-in text-i 4,000,000 baytdan uzundur.