İçeriğe geç
Limitler ve bakiye

Limitler ve bakiye

Her istek eşit karşılanır. Hız kademesi yok. Ayrı bir API kotası yok. Token'larınızın parasını zaten ödediniz — istediğiniz kadar hızlı kullanın.

Bu sayfa, bakiyenizin nelerden oluştuğunu, bir isteğin neyi ayırıp neye mal olduğunu, kaç istek gönderebileceğinizi ve tek bir isteğin karşılaşabileceği az sayıdaki sınırı açıklar.

1M token bakiyenin değeri
$5.00
günlük limit yenilenir
00:00 UTC
flood koruması, hesap başına
120 istek / dk

İstekler nasıl karşılanır

  • Hız kademesi yok — İsteklerin ne kadar hızlı gelebileceğini tek bir kural sınırlar ve bu kural her hesap ve her plan için aynıdır: dakikada 120 istek. Dakika başına token için sınır yoktur.
  • Ayrı API kotası yok — API, sohbetle aynı bakiyeyi harcar. Plan, bugünün limitinin büyüklüğünü belirler. İstek hızını belirlemez.
  • İstediğiniz kadar hızlı — Paralel gönderilen istekler kabul edilir ve sırada bekler. Paralel oldukları için reddedilmezler.

Bakiyeniz

Bakiyeniz token cinsinden sayılır. 1,000,000 token bakiye $5.00 değerindedir ve Models & pricing sayfasındaki her fiyat bu değere göre bir orandır.

Bakiye her an iki parçanın toplamıdır.

  • Bugünün plan limiti — Planınızın belirlediği token sayısı. Her gün 00:00 UTC'de yenilenir. Günün sonunda kalan bir sonraki güne devretmez.
  • Satın alınan kredi — Paket olarak satın aldığınız token'lar. Kredinin süresi dolmaz ve Free dahil her planda geçerlidir.
Plan Günlük token Değeri
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • Harcama sırası — Her istek önce bugünün plan limitinden harcar. Satın alınan kredi yalnızca o gün limiti aşan kısım için kullanılır.
  • Sohbet ve API aynı bakiyeyi paylaşır — Hesap başına tek bir bakiye vardır. Bir API anahtarı, sahibi olan hesabın bakiyesinden, sohbetle aynı fiyatlardan harcar.
  • Paketler — Kredi 1,000,000 ($5.00), 2,000,000 ($10.00) ve 5,000,000 ($25.00) token'lık paketler halinde ya da 1,000,000 ile 100,000,000 token arasında seçtiğiniz bir miktar olarak, 1,000,000 başına $5.00 fiyatla satılır.

Kredi yükle Planı değiştir

Bir isteğin ayırdığı ve mal olduğu miktar

  • Ayırma — Bir istek geldiğinde çıktı bütçesini bakiyenizden ayırır: /v1/chat/completions ve /v1/messages üzerinde max_tokens, /v1/responses üzerinde max_output_tokens. /v1/chat/completions ayrıca max_completion_tokens değerini de okur. Varsayılan 4,096'dır ve aralık 1 ile 65,536 arasındadır.
  • Kabul — İstek yalnızca ayrılan miktar bakiyenizde kalana sığarsa kabul edilir. Sıfırdan büyük ama çıktı bütçesinden küçük bir bakiye Quota exceeded yanıtını alır. Kalanı kullanmak için daha küçük bir max_tokens gönderin.
  • Kesinleştirme — Yanıt tamamlandığında ayrılan miktarın yerini gerçek ücret alır. Ücret ayrılan miktardan düşük ya da yüksek olabilir.
  • İade — Hata durumuyla biten bir istek ayırdığı miktarı tamamen geri verir.

Gerçek ücret model ailesine göre değişir.

Modeller Ne ücretlendirilir
Shannon modelleri Modelin 1M başına fiyatından usage.total_tokens. Giriş ve çıktı için tek bir oran vardır.
Host edilen açık ağırlıklı modeller Önbelleğe alınmamış giriş giriş fiyatından, önbelleğe alınmış giriş önbellek fiyatından, çıktı çıktı fiyatından.

USD tutarı, bakiyenizden 1,000,000 başına $5.00 oranıyla token olarak düşülür ve tam token'a yuvarlanır.

POST /v1/tokenize veya POST /v1/messages/count_tokens ile token saymak ücretsizdir ve hiçbir şey ayırmaz. Token sayma

Bakiye ve kullanım nerede görülür

Keys & usage sayfası şu anda harcayabileceğiniz miktarı, bugünün plan limitini, satın alınan kredinizi ve son 30 günün API harcamasını gösterir. Altında anahtarınızın yaptığı her isteği listeler: zaman, uç nokta, model, önbelleğe alınmış giriş, faturalanan token ve maliyet. Keys & usage

Her yanıt ayrıca o çağrının token sayılarını içeren bir usage nesnesi taşır.

Uç nokta usage alanları Host edilen açık ağırlıklı modellerin eklediği
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage modelin token sayılarını içerir. Bakiyenizden düşülen miktar yanıtta yoktur: o, Keys & usage sayfasındaki istek listesinin Faturalanan token sütunudur.
  • Host edilen açık ağırlıklı bir modelle /v1/messages üzerinde input_tokens girişin önbelleğe alınmamış kısmıdır, cache_read_input_tokens önbelleğe alınmış kısımdır ve cache_creation_input_tokens her zaman 0'dır.
  • /v1/chat/completions üzerindeki bir stream, usage bilgisini [DONE] öncesindeki son chunk içinde taşır. Akış

Bakiye bittiğinde

Ayrılan miktarı bakiyenize sığmayan bir istek, 429 durumu, rate_limit_error türü ve aşağıdaki mesajla yanıtlanır. Hiçbir ücret alınmaz. Bakiye sıfırdan büyük ama isteğin çıktı bütçesinden küçük olduğunda da aynı yanıt gönderilir.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses üzerinde error nesnesi ayrıca code ve param alanlarını da içerebilir; ikisi de null olur.

Yapabilecekleriniz:

  • 00:00 UTC'de yenilenecek plan limitini bekleyin.
  • Kredi yükleyin. Kredi plan limitinden sonra harcanır ve süresi dolmaz. Kredi yükle
  • Daha yüksek günlük limiti olan bir plana geçin. Planı değiştir
  • Bir miktar bakiye kaldıysa daha küçük bir max_tokens gönderin: o zaman ayrılan miktar daha küçük olur.

Shannon Coder çağrı limiti

/v1/chat/completions ve /v1/messages üzerindeki shannon-coder-1 token olarak değil, çağrı olarak sayılır. Her plan, 4 saatlik pencere başına belirli sayıda çağrı içerir. Bir istek bir çağrıdır.

Plan 4 saatlik pencere başına çağrı
Free 3
Plus 20
Standard 40
Pro 60
  • Pencereler 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC'de başlar. Bir pencerenin sonunda kalan çağrılar devretmez.
  • Bir çağrı, model yanıt vermeden önce, istek kabul edildiğinde sayılır. Sonradan başarısız olan bir istek de çağrı olarak sayılır.
  • Bu çağrılar token ayırmaz ve bakiyenizden hiçbir şey almaz. Keys & usage sayfasındaki istek listesi, token sayısını ve listelenen fiyattan değerini gösterir.
  • shannon-coder-1 modelinin bu iki uç noktadaki varsayılan max_tokens değeri 65,536'dir.
  • Çağrı kalmadığında yanıt, 429 durumu, rate_limit_error türü ve Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan mesajıyla gelir.
  • /v1/responses üzerinde shannon-coder-1 için çağrı limiti yoktur: diğer tüm modeller gibi bakiyenizden 1M başına $8.00 üzerinden token olarak ücretlendirilir.

Flood koruması

Bir hesap dakikada 120 istek gönderebilir. İstek hızındaki tek sınır budur ve her planda aynıdır. Normal kullanımı yavaşlatmak için değil, flood'u durdurmak için vardır.

  • Dakika, ilk isteğinizle açılan 60 saniyelik sabit bir penceredir. Bittiğinde sayım sıfırdan başlar.
  • Sayım hesap başınadır; anahtar ya da IP adresi başına değildir. Anahtarı değiştirmek yeni bir pencere açmaz.
  • Bir pencere içindeki 121. istek, 429 durumu, rate_limit_error türü ve Too many requests. Retry in <N>s. mesajıyla yanıtlanır. N, pencerenin bitmesine kalan saniye sayısıdır, 1 ile 60 arasında.
  • Flood koruması bakiyeden önce denetlenir. Reddettiği bir istek hiçbir şey ayırmaz ve hiçbir maliyeti yoktur.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
İstek Flood koruması
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses Sayılır, istek başına bir.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens Sayılmaz.
/v1/chat/completions ve /v1/messages üzerindeki shannon-coder-1 Bunun yerine Shannon Coder çağrı limitine göre sayılır.
401 ile ya da bilinmeyen bir model nedeniyle 400 ile yanıtlanan bir istek Sayılmaz.
Flood koruması tarafından reddedilen bir istek Pencereye sayılır. Hiçbir ücret alınmaz.

Paralel istekler

Bir hesabın aynı anda açık tutabileceği istek sayısında sınır yoktur ve istekleri paralel göndermek için hata yoktur. Hemen başlayamayan istekler sırada bekler ve sırayla yanıtlanır.

  • Her istek, önceki istekler bitmiş olsun ya da olmasın, geldiğinde dakikadaki 120 sınırına sayılır.
  • Her istek, bitene kadar kendi ayırdığı miktarı tutar. Varsayılan çıktı bütçesiyle yirmi açık istek 20 × 4,096 = 81,920 token bakiye tutar. Ayrılan miktarların toplamı bakiyenizden büyükse, biten çağrılar daha ucuza mal olacak olsa bile sonraki istek Quota exceeded yanıtını alır. Daha küçük bir max_tokens daha azını tutar.
  • Streaming olmayan bir istek, yanıtı tamamlanana kadar hiçbir şey göndermez; bu yüzden istemcinize beklemeyi kapsayan bir zaman aşımı verin. Bir stream beklerken bağlantısını açık tutar. Akış

Tek bir isteğin sınırları

Sınır Değer Geçerli olduğu yer Sınıra ulaşıldığında
İstek gövdesi 32 MiB (33,554,432 bayt) Her uç nokta 413 durumu, invalid_request_error türü.
Çıktı bütçesi: max_tokens, max_completion_tokens, max_output_tokens 1 ile 65,536 arası. Varsayılan 4,096; /v1/chat/completions ve /v1/messages üzerindeki shannon-coder-1 için varsayılan 65,536'dır. Her model, bakiyenizden ayrılan miktar olarak. Yanıt uzunluğunun sınırı olarak: host edilen açık ağırlıklı modeller, shannon-1.6-lite, shannon-1.6-pro ve shannon-coder-1. Aralığın dışındaki bir değer aralığın en yakın ucuna çekilir. Hata verilmez.
Durdurma dizileri: stop, stop_sequences 4 dize Host edilen açık ağırlıklı modeller İlk 4 boş olmayan dize kullanılır.
URL olarak verilen görsel veya dosya 8 MiB, 20 saniye içinde okunur, en fazla 5 yönlendirme, herkese açık bir http veya https adresi Görsel veya dosya kabul eden her uç nokta İstek o kısım olmadan yanıtlanır. Hata verilmez.
Satır içi (base64) gönderilen görsel veya dosya Kendine ait sınır yok. 32 MiB'lık istek gövdesine sayılır. Görsel veya dosya kabul eden her uç nokta Tüm istek için 413 durumu.
POST /v1/tokenize isteğindeki text 4,000,000 bayt /v1/tokenize 413 durumu, invalid_request_error türü, text too long mesajı.
POST /v1/tokenize isteğindeki messages ve POST /v1/messages/count_tokens isteğinin gövdesi 32 MiB'lık istek gövdesi Her iki sayım uç noktası 413 durumu.
Bağlam penceresi Modele göre: GET /v1/models içindeki context_window Her model Daha uzun bir konuşmaya ne olacağı modele bağlıdır. Modeller ve fiyatlandırma
Web aramaları (web_search: true) Plan ve gün başına: Free 3, Plus 30, Standard 50, Pro 60. Araması sonuç bulan bir istek için bir arama sayılır. web_search: true ayarlayan istekler Hak kalmadığında istek aramasız yanıtlanır. Hata verilmez. Yerleşik Web Arama

Hatalar

Bu sayfadaki yanıtlar. /v1/messages üzerinde aynı error nesnesi {"type": "error", "error": {…}} olarak sarılır.

Durum Tür Mesaj Ne zaman ve ne yapmalı
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan İsteğin ayırdığı miktar bakiyenize sığmıyor. 00:00 UTC'yi bekleyin, kredi yükleyin, plan değiştirin veya daha küçük bir max_tokens gönderin.
429 rate_limit_error Too many requests. Retry in <N>s. Geçerli dakikada 120'den fazla istek. N saniye bekleyip yeniden gönderin.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan Geçerli 4 saatlik penceredeki Shannon Coder çağrıları tükendi.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. Model isteği şu anda alamıyor. Kısa bir aradan sonra yeniden gönderin.
503 api_error Could not verify your quota right now. Please retry. Bakiyeniz okunamadı. Hiçbir ücret alınmaz; isteği yeniden gönderin. Bir Shannon modeliyle /v1/responses üzerinde durum 500 olur.
413 invalid_request_error İstek gövdesi 32 MiB'tan büyük. OpenAI biçimli uç noktalarda error nesnesi code: "request_too_large" taşır.
413 invalid_request_error text too long POST /v1/tokenize isteğindeki text 4,000,000 bayttan uzun.