გადასვლა შინაარსზე
ლიმიტები და ბალანსი

ლიმიტები და ბალანსი

ყოველი მოთხოვნა თანაბრად მუშავდება. არანაირი rate-დონეები. არანაირი ცალკე API კვოტა. თქვენი ტოკენები უკვე გადაიხადეთ — გამოიყენეთ ისინი რაც გინდათ სწრაფად.

ეს გვერდი განმარტავს, რისგან შედგება თქვენი ბალანსი, რას ირეზერვებს და რა ჯდება ერთი მოთხოვნა, რამდენი მოთხოვნის გაგზავნა შეგიძლიათ და იმ რამდენიმე ლიმიტს, რომელსაც ერთი მოთხოვნა შეიძლება შეხვდეს.

ბალანსის 1M ტოკენის ღირებულება
$5.00
დღიური ლიმიტი ახლდება
00:00 UTC
flood protection, ანგარიშის მიხედვით
120 მოთხოვნა / წთ

როგორ მუშავდება მოთხოვნები

  • rate-დონეების გარეშე — ერთი წესი ზღუდავს, რა სიჩქარით შეიძლება მოთხოვნები მოვიდეს, და ის ერთნაირია ყველა ანგარიშისა და ყველა გეგმისთვის: 120 მოთხოვნა წუთში. ტოკენებზე წუთში ლიმიტი არ არსებობს.
  • ცალკე API კვოტა არ არის — API იმავე ბალანსს ხარჯავს, რასაც ჩატი. გეგმა დღევანდელი ლიმიტის ზომას ადგენს. მოთხოვნების სიხშირეს ის არ ადგენს.
  • რაც გინდათ სწრაფად — პარალელურად გაგზავნილი მოთხოვნები მიიღება და რიგში დგას. პარალელურობის გამო ისინი არ უარყოფა.

თქვენი ბალანსი

თქვენი ბალანსი ტოკენებში ითვლება. ბალანსის 1,000,000 ტოკენი $5.00 ღირს და გვერდზე მოდელები და ფასები ყოველი ფასი ამ ღირებულების მიმართ ტარიფია.

ნებისმიერ მომენტში ბალანსი ორი ნაწილის ჯამია.

  • დღევანდელი გეგმის ლიმიტი — ტოკენების რაოდენობა, რომელსაც თქვენი გეგმა ადგენს. ის ყოველდღე ახლდება 00:00 UTC-ზე. რაც დღის ბოლოს დარჩება, არ გადადის.
  • შეძენილი კრედიტი — ტოკენები, რომლებიც პაკეტით შეიძინეთ. კრედიტს ვადა არ გასდის და მუშაობს ყველა გეგმაზე, Free-ის ჩათვლით.
გეგმა ტოკენი დღეში ღირს
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • დახარჯვის თანმიმდევრობა — ყოველი მოთხოვნა ჯერ დღევანდელ გეგმის ლიმიტს ხარჯავს. შეძენილი კრედიტი გამოიყენება მხოლოდ იმისთვის, რაც ამ დღეს ლიმიტს აღემატება.
  • ჩატი და API ერთად იყენებენ — ანგარიშზე ერთი ბალანსია. API გასაღები ხარჯავს იმ ანგარიშის ბალანსს, რომელსაც ეკუთვნის, ჩატის იგივე ფასებით.
  • პაკეტები — კრედიტი იყიდება 1,000,000 ($5.00), 2,000,000 ($10.00) და 5,000,000 ($25.00) ტოკენიან პაკეტებად, ან თქვენ მიერ არჩეული რაოდენობით 1,000,000-დან 100,000,000 ტოკენამდე ფასად $5.00 1,000,000-ზე.

კრედიტის შევსება გეგმის შეცვლა

რას ირეზერვებს მოთხოვნა და რა ჯდება

  • რეზერვი — როცა მოთხოვნა მოდის, ის თქვენი ბალანსიდან თავის გამოტანის ბიუჯეტს ირეზერვებს: max_tokens /v1/chat/completions-სა და /v1/messages-ზე, max_output_tokens /v1/responses-ზე. /v1/chat/completions ასევე კითხულობს max_completion_tokens-ს. ნაგულისხმევია 4,096 და დიაპაზონია 1-დან 65,536-მდე.
  • მიღება — მოთხოვნა მიიღება მხოლოდ იმ შემთხვევაში, თუ რეზერვი თქვენი ბალანსის ნაშთში ეტევა. ბალანსს, რომელიც ნულზე მეტია, მაგრამ გამოტანის ბიუჯეტზე მცირე, პასუხად Quota exceeded ეძლევა. დანარჩენის გამოსაყენებლად გააგზავნეთ უფრო მცირე max_tokens.
  • ანგარიშსწორება — როცა პასუხი სრულდება, რეზერვი რეალური ჩამოჭრით იცვლება. ჩამოჭრა შეიძლება რეზერვზე ნაკლები ან მეტი იყოს.
  • დაბრუნება — მოთხოვნა, რომელიც შეცდომის სტატუსით მთავრდება, რეზერვს სრულად აბრუნებს.

რეალური ჩამოჭრა მოდელის ოჯახზეა დამოკიდებული.

მოდელები რა ირიცხება
Shannon მოდელები usage.total_tokens მოდელის ფასით 1M-ზე. შემავალსა და გამომავალს ერთი ტარიფი აქვს.
Hosted open-weight მოდელები არაქეშირებული შემავალი შემავალის ტარიფით, ქეშირებული შემავალი ქეშირებულის ტარიფით, გამომავალი გამომავალის ტარიფით.

თანხა USD-ში თქვენი ბალანსიდან ტოკენებში იკლება $5.00 1,000,000-ზე, დამრგვალებული მთელ ტოკენამდე.

ტოკენების დათვლა POST /v1/tokenize-ით ან POST /v1/messages/count_tokens-ით უფასოა და არაფერს ირეზერვებს. ტოკენების დათვლა

სად ნახოთ ბალანსი და გამოყენება

გვერდი Keys & usage აჩვენებს, რისი დახარჯვა შეგიძლიათ ახლა, დღევანდელ გეგმის ლიმიტს, თქვენს შეძენილ კრედიტს და ბოლო 30 დღის API ხარჯს. ქვემოთ ჩამოთვლილია თქვენი გასაღებით შესრულებული ყველა მოთხოვნა: დრო, endpoint, მოდელი, ქეშირებული შემავალი, ჩამოჭრილი ტოკენები და ღირებულება. გასაღებები და გამოყენება

ყოველი პასუხი ასევე ატარებს usage ობიექტს ამ გამოძახების ტოკენების რაოდენობით.

Endpoint usage-ის ველები ამატებენ hosted open-weight მოდელები
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage შეიცავს მოდელის ტოკენების რაოდენობას. თანხა, რომელიც თქვენი ბალანსიდან ჩამოიჭრა, პასუხში არ არის: ის არის სვეტი ჩამოჭრილი ტოკენები მოთხოვნების სიაში გვერდზე Keys & usage.
  • /v1/messages-ზე hosted open-weight მოდელით input_tokens შემავალის არაქეშირებული ნაწილია, cache_read_input_tokens — ქეშირებული ნაწილი და cache_creation_input_tokens ყოველთვის 0-ია.
  • /v1/chat/completions-ის სტრიმი usage-ს ატარებს თავის ბოლო chunk-ში [DONE]-მდე. სტრიმინგი

როცა ბალანსი ამოიწურება

მოთხოვნას, რომლის რეზერვიც თქვენს ბალანსში არ ეტევა, პასუხობს სტატუსი 429, ტიპი rate_limit_error და ქვემოთ მოცემული შეტყობინება. არაფერი ირიცხება. იგივე პასუხი იგზავნება, როცა ბალანსი ნულზე მეტია, მაგრამ მოთხოვნის გამოტანის ბიუჯეტზე მცირე.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses-ზე error ობიექტს ასევე შეუძლია შეიცავდეს code-სა და param-ს, ორივე null.

რა შეგიძლიათ გააკეთოთ:

  • დაელოდეთ გეგმის შემდეგ ლიმიტს 00:00 UTC-ზე.
  • შეავსეთ კრედიტი. კრედიტი გეგმის ლიმიტის შემდეგ იხარჯება და ვადა არ გასდის. კრედიტის შევსება
  • გადადით გეგმაზე უფრო დიდი დღიური ლიმიტით. გეგმის შეცვლა
  • გააგზავნეთ უფრო მცირე max_tokens, თუ ბალანსის რაღაც ნაწილი დარჩა: მაშინ რეზერვი უფრო მცირეა.

Shannon Coder-ის გამოძახებების ლიმიტი

shannon-coder-1 /v1/chat/completions-სა და /v1/messages-ზე ითვლება გამოძახებებში და არა ტოკენებში. თითოეული გეგმა 4-საათიან ფანჯარაში გამოძახებების გარკვეულ რაოდენობას მოიცავს. ერთი მოთხოვნა ერთი გამოძახებაა.

გეგმა გამოძახებები 4-საათიან ფანჯარაში
Free 3
Plus 20
Standard 40
Pro 60
  • ფანჯრები იწყება 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-ზე. გამოძახებები, რომლებიც ფანჯრის ბოლოს დარჩება, არ გადადის.
  • გამოძახება ითვლება მოთხოვნის მიღებისას, მოდელის პასუხამდე. მოთხოვნა, რომელიც შემდეგ წარუმატებლად სრულდება, მაინც გამოძახებად ითვლება.
  • ეს გამოძახებები ტოკენებს არ ირეზერვებენ და თქვენი ბალანსიდან არაფერს იღებენ. მოთხოვნების სია გვერდზე Keys & usage აჩვენებს მათ ტოკენების რაოდენობას და მის ღირებულებას მითითებული ფასით.
  • shannon-coder-1-ის ნაგულისხმევი max_tokens ამ ორ endpoint-ზე არის 65,536.
  • გამოძახებების ამოწურვისას პასუხია სტატუსი 429, ტიპი rate_limit_error, შეტყობინება Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan.
  • /v1/responses-ზე shannon-coder-1-ს გამოძახებების ლიმიტი არ აქვს: ის ტოკენებით ირიცხება თქვენი ბალანსიდან $8.00 1M-ზე, ისევე როგორც ყველა სხვა მოდელი.

Flood protection

ანგარიშს შეუძლია გააგზავნოს 120 მოთხოვნა წუთში. ეს მოთხოვნების სიხშირის ერთადერთი ლიმიტია და ყველა გეგმაზე ერთნაირია. ის არსებობს წყალდიდობის შესაჩერებლად და არა ჩვეულებრივი გამოყენების შესანელებლად.

  • წუთი 60 წამის ფიქსირებული ფანჯარაა, რომელიც თქვენი პირველი მოთხოვნით იხსნება. როცა ის მთავრდება, დათვლა ნულიდან იწყება.
  • დათვლა ანგარიშის მიხედვით ხდება და არა გასაღების ან IP მისამართის მიხედვით. გასაღების როტაცია ახალ ფანჯარას არ ხსნის.
  • ფანჯარაში 121-ე მოთხოვნას პასუხობს სტატუსი 429, ტიპი rate_limit_error და შეტყობინება Too many requests. Retry in <N>s. N არის წამების რაოდენობა ფანჯრის დასრულებამდე, 1-დან 60-მდე.
  • Flood protection ბალანსამდე მოწმდება. მოთხოვნა, რომელსაც ის უარყოფს, არაფერს ირეზერვებს და არაფერი ღირს.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
მოთხოვნა Flood protection
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses ითვლება, თითო მოთხოვნაზე ერთი.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens არ ითვლება.
shannon-coder-1 /v1/chat/completions-სა და /v1/messages-ზე ამის ნაცვლად ითვლება Shannon Coder-ის გამოძახებების ლიმიტით.
მოთხოვნა, რომელსაც უპასუხეს 401-ით, ან 400-ით უცნობი model-ის გამო არ ითვლება.
მოთხოვნა, რომელიც flood protection-მა უარყო ითვლება ფანჯარაში. არაფერი ირიცხება.

პარალელური მოთხოვნები

არ არსებობს ლიმიტი იმაზე, რამდენი მოთხოვნა შეიძლება ჰქონდეს ანგარიშს ერთდროულად ღია, და არც შეცდომა პარალელური მოთხოვნების გაგზავნისთვის. მოთხოვნები, რომლებიც ერთდროულად ვერ იწყება, რიგში დგანან და რიგრიგობით პასუხდებიან.

  • ყოველი მოთხოვნა 120-ში წუთში მოსვლისას ითვლება, იმის მიუხედავად, დასრულდა თუ არა წინა მოთხოვნები.
  • ყოველი მოთხოვნა თავის რეზერვს დასრულებამდე ინარჩუნებს. ოცი ღია მოთხოვნა ნაგულისხმევი გამოტანის ბიუჯეტით ბალანსის 20 × 4,096 = 81,920 ტოკენს იკავებს. თუ რეზერვები ერთად ბალანსზე დიდია, შემდეგ მოთხოვნას ეძლევა პასუხი Quota exceeded, თუმცა დასრულებული გამოძახებები ნაკლები დაჯდებოდა. უფრო მცირე max_tokens ნაკლებს იკავებს.
  • სტრიმინგის გარეშე მოთხოვნა არაფერს აგზავნის, სანამ პასუხი არ დასრულდება, ამიტომ თქვენს კლიენტს მიეცით timeout, რომელიც ლოდინს დაფარავს. სტრიმი ლოდინისას კავშირს ღიად ინახავს. სტრიმინგი

ერთი მოთხოვნის ლიმიტები

ლიმიტი მნიშვნელობა ვრცელდება ლიმიტზე
მოთხოვნის body 32 MiB (33,554,432 ბაიტი) ყველა endpoint სტატუსი 413, ტიპი invalid_request_error.
გამოტანის ბიუჯეტი: max_tokens, max_completion_tokens, max_output_tokens 1-დან 65,536-მდე. ნაგულისხმევია 4,096; shannon-coder-1-ზე /v1/chat/completions-სა და /v1/messages-ზე ნაგულისხმევია 65,536. ყველა მოდელი, როგორც თქვენი ბალანსიდან დარეზერვებული რაოდენობა. როგორც პასუხის სიგრძის ლიმიტი: hosted open-weight მოდელები, shannon-1.6-lite, shannon-1.6-pro და shannon-coder-1. დიაპაზონს გარეთ მნიშვნელობა დიაპაზონის უახლოეს ბოლოზე გადაინაცვლებს. შეცდომის გარეშე.
Stop sequence-ები: stop, stop_sequences 4 სტრიქონი Hosted open-weight მოდელები გამოიყენება პირველი 4 არაცარიელი სტრიქონი.
URL-ით მიცემული სურათი ან ფაილი 8 MiB, წაკითხვა 20 წამში, მაქსიმუმ 5 გადამისამართება, საჯარო http ან https მისამართი ყველა endpoint, რომელიც სურათებს ან ფაილებს იღებს მოთხოვნას ამ ნაწილის გარეშე პასუხობენ. შეცდომის გარეშე.
ინლაინ გაგზავნილი სურათი ან ფაილი (base64) საკუთარი ლიმიტი არ აქვს. ითვლება 32 MiB მოთხოვნის body-ში. ყველა endpoint, რომელიც სურათებს ან ფაილებს იღებს სტატუსი 413 მთელ მოთხოვნაზე.
POST /v1/tokenize-ის text 4,000,000 ბაიტი /v1/tokenize სტატუსი 413, ტიპი invalid_request_error, შეტყობინება text too long.
POST /v1/tokenize-ის messages და POST /v1/messages/count_tokens-ის body 32 MiB მოთხოვნის body ორივე დათვლის endpoint სტატუსი 413.
კონტექსტის ფანჯარა მოდელის მიხედვით: context_window GET /v1/models-ში ყველა მოდელი რა ემართება უფრო გრძელ საუბარს, მოდელზეა დამოკიდებული. მოდელები და ფასები
ვებძიებები (web_search: true) გეგმისა და დღის მიხედვით: Free 3, Plus 30, Standard 50, Pro 60. ერთი ძიება ითვლება მოთხოვნაზე, რომლის ძიებამაც შედეგები იპოვა. მოთხოვნები, რომლებიც აყენებენ web_search: true-ს ლიმიტის ამოწურვისას მოთხოვნას ძიების გარეშე პასუხობენ. შეცდომის გარეშე. ჩაშენებული ვებძიება

შეცდომები

ამ გვერდის პასუხები. /v1/messages-ზე იგივე error ობიექტი შეფუთულია როგორც {"type": "error", "error": {…}}.

სტატუსი ტიპი შეტყობინება როდის და რა უნდა გააკეთოთ
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan მოთხოვნის რეზერვი თქვენს ბალანსში არ ეტევა. დაელოდეთ 00:00 UTC-ს, შეავსეთ კრედიტი, შეცვალეთ გეგმა ან გააგზავნეთ უფრო მცირე max_tokens.
429 rate_limit_error Too many requests. Retry in <N>s. მიმდინარე წუთში 120-ზე მეტი მოთხოვნა. დაელოდეთ N წამს და გააგზავნეთ ხელახლა.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan მიმდინარე 4-საათიანი ფანჯრის Shannon Coder-ის გამოძახებები ამოიწურა.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. მოდელს ამ მომენტში მოთხოვნის მიღება არ შეუძლია. გააგზავნეთ ხელახლა მოკლე პაუზის შემდეგ.
503 api_error Could not verify your quota right now. Please retry. თქვენი ბალანსი ვერ წაიკითხა. არაფერი ირიცხება; გააგზავნეთ მოთხოვნა ხელახლა. /v1/responses-ზე Shannon-ის მოდელით სტატუსია 500.
413 invalid_request_error მოთხოვნის body 32 MiB-ზე დიდია. OpenAI-ის ფორმატის endpoint-ებზე error ობიექტი ატარებს code: "request_too_large"-ს.
413 invalid_request_error text too long POST /v1/tokenize-ის text 4,000,000 ბაიტზე გრძელია.