ლიმიტები და ბალანსი
ყოველი მოთხოვნა თანაბრად მუშავდება. არანაირი rate-დონეები. არანაირი ცალკე API კვოტა. თქვენი ტოკენები უკვე გადაიხადეთ — გამოიყენეთ ისინი რაც გინდათ სწრაფად.
ეს გვერდი განმარტავს, რისგან შედგება თქვენი ბალანსი, რას ირეზერვებს და რა ჯდება ერთი მოთხოვნა, რამდენი მოთხოვნის გაგზავნა შეგიძლიათ და იმ რამდენიმე ლიმიტს, რომელსაც ერთი მოთხოვნა შეიძლება შეხვდეს.
- ბალანსის 1M ტოკენის ღირებულება
- $5.00
- დღიური ლიმიტი ახლდება
- 00:00 UTC
- flood protection, ანგარიშის მიხედვით
- 120 მოთხოვნა / წთ
როგორ მუშავდება მოთხოვნები
- rate-დონეების გარეშე — ერთი წესი ზღუდავს, რა სიჩქარით შეიძლება მოთხოვნები მოვიდეს, და ის ერთნაირია ყველა ანგარიშისა და ყველა გეგმისთვის: 120 მოთხოვნა წუთში. ტოკენებზე წუთში ლიმიტი არ არსებობს.
- ცალკე API კვოტა არ არის — API იმავე ბალანსს ხარჯავს, რასაც ჩატი. გეგმა დღევანდელი ლიმიტის ზომას ადგენს. მოთხოვნების სიხშირეს ის არ ადგენს.
- რაც გინდათ სწრაფად — პარალელურად გაგზავნილი მოთხოვნები მიიღება და რიგში დგას. პარალელურობის გამო ისინი არ უარყოფა.
თქვენი ბალანსი
თქვენი ბალანსი ტოკენებში ითვლება. ბალანსის 1,000,000 ტოკენი $5.00 ღირს და გვერდზე მოდელები და ფასები ყოველი ფასი ამ ღირებულების მიმართ ტარიფია.
ნებისმიერ მომენტში ბალანსი ორი ნაწილის ჯამია.
- დღევანდელი გეგმის ლიმიტი — ტოკენების რაოდენობა, რომელსაც თქვენი გეგმა ადგენს. ის ყოველდღე ახლდება 00:00 UTC-ზე. რაც დღის ბოლოს დარჩება, არ გადადის.
- შეძენილი კრედიტი — ტოკენები, რომლებიც პაკეტით შეიძინეთ. კრედიტს ვადა არ გასდის და მუშაობს ყველა გეგმაზე, Free-ის ჩათვლით.
| გეგმა | ტოკენი დღეში | ღირს |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- დახარჯვის თანმიმდევრობა — ყოველი მოთხოვნა ჯერ დღევანდელ გეგმის ლიმიტს ხარჯავს. შეძენილი კრედიტი გამოიყენება მხოლოდ იმისთვის, რაც ამ დღეს ლიმიტს აღემატება.
- ჩატი და API ერთად იყენებენ — ანგარიშზე ერთი ბალანსია. API გასაღები ხარჯავს იმ ანგარიშის ბალანსს, რომელსაც ეკუთვნის, ჩატის იგივე ფასებით.
- პაკეტები — კრედიტი იყიდება 1,000,000 ($5.00), 2,000,000 ($10.00) და 5,000,000 ($25.00) ტოკენიან პაკეტებად, ან თქვენ მიერ არჩეული რაოდენობით 1,000,000-დან 100,000,000 ტოკენამდე ფასად $5.00 1,000,000-ზე.
კრედიტის შევსება გეგმის შეცვლა
რას ირეზერვებს მოთხოვნა და რა ჯდება
- რეზერვი — როცა მოთხოვნა მოდის, ის თქვენი ბალანსიდან თავის გამოტანის ბიუჯეტს ირეზერვებს:
max_tokens/v1/chat/completions-სა და/v1/messages-ზე,max_output_tokens/v1/responses-ზე./v1/chat/completionsასევე კითხულობსmax_completion_tokens-ს. ნაგულისხმევია 4,096 და დიაპაზონია 1-დან 65,536-მდე. - მიღება — მოთხოვნა მიიღება მხოლოდ იმ შემთხვევაში, თუ რეზერვი თქვენი ბალანსის ნაშთში ეტევა. ბალანსს, რომელიც ნულზე მეტია, მაგრამ გამოტანის ბიუჯეტზე მცირე, პასუხად
Quota exceededეძლევა. დანარჩენის გამოსაყენებლად გააგზავნეთ უფრო მცირეmax_tokens. - ანგარიშსწორება — როცა პასუხი სრულდება, რეზერვი რეალური ჩამოჭრით იცვლება. ჩამოჭრა შეიძლება რეზერვზე ნაკლები ან მეტი იყოს.
- დაბრუნება — მოთხოვნა, რომელიც შეცდომის სტატუსით მთავრდება, რეზერვს სრულად აბრუნებს.
რეალური ჩამოჭრა მოდელის ოჯახზეა დამოკიდებული.
| მოდელები | რა ირიცხება |
|---|---|
| Shannon მოდელები | usage.total_tokens მოდელის ფასით 1M-ზე. შემავალსა და გამომავალს ერთი ტარიფი აქვს. |
| Hosted open-weight მოდელები | არაქეშირებული შემავალი შემავალის ტარიფით, ქეშირებული შემავალი ქეშირებულის ტარიფით, გამომავალი გამომავალის ტარიფით. |
თანხა USD-ში თქვენი ბალანსიდან ტოკენებში იკლება $5.00 1,000,000-ზე, დამრგვალებული მთელ ტოკენამდე.
ტოკენების დათვლა POST /v1/tokenize-ით ან POST /v1/messages/count_tokens-ით უფასოა და არაფერს ირეზერვებს. ტოკენების დათვლა
სად ნახოთ ბალანსი და გამოყენება
გვერდი Keys & usage აჩვენებს, რისი დახარჯვა შეგიძლიათ ახლა, დღევანდელ გეგმის ლიმიტს, თქვენს შეძენილ კრედიტს და ბოლო 30 დღის API ხარჯს. ქვემოთ ჩამოთვლილია თქვენი გასაღებით შესრულებული ყველა მოთხოვნა: დრო, endpoint, მოდელი, ქეშირებული შემავალი, ჩამოჭრილი ტოკენები და ღირებულება. გასაღებები და გამოყენება
ყოველი პასუხი ასევე ატარებს usage ობიექტს ამ გამოძახების ტოკენების რაოდენობით.
| Endpoint | usage-ის ველები | ამატებენ hosted open-weight მოდელები |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageშეიცავს მოდელის ტოკენების რაოდენობას. თანხა, რომელიც თქვენი ბალანსიდან ჩამოიჭრა, პასუხში არ არის: ის არის სვეტი ჩამოჭრილი ტოკენები მოთხოვნების სიაში გვერდზე Keys & usage./v1/messages-ზე hosted open-weight მოდელითinput_tokensშემავალის არაქეშირებული ნაწილია,cache_read_input_tokens— ქეშირებული ნაწილი დაcache_creation_input_tokensყოველთვის0-ია.-
/v1/chat/completions-ის სტრიმიusage-ს ატარებს თავის ბოლო chunk-ში[DONE]-მდე. სტრიმინგი
როცა ბალანსი ამოიწურება
მოთხოვნას, რომლის რეზერვიც თქვენს ბალანსში არ ეტევა, პასუხობს სტატუსი 429, ტიპი rate_limit_error და ქვემოთ მოცემული შეტყობინება. არაფერი ირიცხება. იგივე პასუხი იგზავნება, როცა ბალანსი ნულზე მეტია, მაგრამ მოთხოვნის გამოტანის ბიუჯეტზე მცირე.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses-ზე error ობიექტს ასევე შეუძლია შეიცავდეს code-სა და param-ს, ორივე null.
რა შეგიძლიათ გააკეთოთ:
- დაელოდეთ გეგმის შემდეგ ლიმიტს 00:00 UTC-ზე.
- შეავსეთ კრედიტი. კრედიტი გეგმის ლიმიტის შემდეგ იხარჯება და ვადა არ გასდის. კრედიტის შევსება
- გადადით გეგმაზე უფრო დიდი დღიური ლიმიტით. გეგმის შეცვლა
- გააგზავნეთ უფრო მცირე
max_tokens, თუ ბალანსის რაღაც ნაწილი დარჩა: მაშინ რეზერვი უფრო მცირეა.
Shannon Coder-ის გამოძახებების ლიმიტი
shannon-coder-1 /v1/chat/completions-სა და /v1/messages-ზე ითვლება გამოძახებებში და არა ტოკენებში. თითოეული გეგმა 4-საათიან ფანჯარაში გამოძახებების გარკვეულ რაოდენობას მოიცავს. ერთი მოთხოვნა ერთი გამოძახებაა.
| გეგმა | გამოძახებები 4-საათიან ფანჯარაში |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- ფანჯრები იწყება 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-ზე. გამოძახებები, რომლებიც ფანჯრის ბოლოს დარჩება, არ გადადის.
- გამოძახება ითვლება მოთხოვნის მიღებისას, მოდელის პასუხამდე. მოთხოვნა, რომელიც შემდეგ წარუმატებლად სრულდება, მაინც გამოძახებად ითვლება.
- ეს გამოძახებები ტოკენებს არ ირეზერვებენ და თქვენი ბალანსიდან არაფერს იღებენ. მოთხოვნების სია გვერდზე Keys & usage აჩვენებს მათ ტოკენების რაოდენობას და მის ღირებულებას მითითებული ფასით.
shannon-coder-1-ის ნაგულისხმევიmax_tokensამ ორ endpoint-ზე არის 65,536.- გამოძახებების ამოწურვისას პასუხია სტატუსი
429, ტიპიrate_limit_error, შეტყობინებაShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan. /v1/responses-ზეshannon-coder-1-ს გამოძახებების ლიმიტი არ აქვს: ის ტოკენებით ირიცხება თქვენი ბალანსიდან $8.00 1M-ზე, ისევე როგორც ყველა სხვა მოდელი.
Flood protection
ანგარიშს შეუძლია გააგზავნოს 120 მოთხოვნა წუთში. ეს მოთხოვნების სიხშირის ერთადერთი ლიმიტია და ყველა გეგმაზე ერთნაირია. ის არსებობს წყალდიდობის შესაჩერებლად და არა ჩვეულებრივი გამოყენების შესანელებლად.
- წუთი 60 წამის ფიქსირებული ფანჯარაა, რომელიც თქვენი პირველი მოთხოვნით იხსნება. როცა ის მთავრდება, დათვლა ნულიდან იწყება.
- დათვლა ანგარიშის მიხედვით ხდება და არა გასაღების ან IP მისამართის მიხედვით. გასაღების როტაცია ახალ ფანჯარას არ ხსნის.
- ფანჯარაში 121-ე მოთხოვნას პასუხობს სტატუსი
429, ტიპიrate_limit_errorდა შეტყობინებაToo many requests. Retry in <N>s.Nარის წამების რაოდენობა ფანჯრის დასრულებამდე, 1-დან 60-მდე. - Flood protection ბალანსამდე მოწმდება. მოთხოვნა, რომელსაც ის უარყოფს, არაფერს ირეზერვებს და არაფერი ღირს.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | მოთხოვნა | Flood protection |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | ითვლება, თითო მოთხოვნაზე ერთი. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | არ ითვლება. |
shannon-coder-1 /v1/chat/completions-სა და /v1/messages-ზე | ამის ნაცვლად ითვლება Shannon Coder-ის გამოძახებების ლიმიტით. |
მოთხოვნა, რომელსაც უპასუხეს 401-ით, ან 400-ით უცნობი model-ის გამო | არ ითვლება. |
| მოთხოვნა, რომელიც flood protection-მა უარყო | ითვლება ფანჯარაში. არაფერი ირიცხება. |
პარალელური მოთხოვნები
არ არსებობს ლიმიტი იმაზე, რამდენი მოთხოვნა შეიძლება ჰქონდეს ანგარიშს ერთდროულად ღია, და არც შეცდომა პარალელური მოთხოვნების გაგზავნისთვის. მოთხოვნები, რომლებიც ერთდროულად ვერ იწყება, რიგში დგანან და რიგრიგობით პასუხდებიან.
- ყოველი მოთხოვნა 120-ში წუთში მოსვლისას ითვლება, იმის მიუხედავად, დასრულდა თუ არა წინა მოთხოვნები.
- ყოველი მოთხოვნა თავის რეზერვს დასრულებამდე ინარჩუნებს. ოცი ღია მოთხოვნა ნაგულისხმევი გამოტანის ბიუჯეტით ბალანსის 20 × 4,096 = 81,920 ტოკენს იკავებს. თუ რეზერვები ერთად ბალანსზე დიდია, შემდეგ მოთხოვნას ეძლევა პასუხი
Quota exceeded, თუმცა დასრულებული გამოძახებები ნაკლები დაჯდებოდა. უფრო მცირეmax_tokensნაკლებს იკავებს. - სტრიმინგის გარეშე მოთხოვნა არაფერს აგზავნის, სანამ პასუხი არ დასრულდება, ამიტომ თქვენს კლიენტს მიეცით timeout, რომელიც ლოდინს დაფარავს. სტრიმი ლოდინისას კავშირს ღიად ინახავს. სტრიმინგი
ერთი მოთხოვნის ლიმიტები
| ლიმიტი | მნიშვნელობა | ვრცელდება | ლიმიტზე |
|---|---|---|---|
| მოთხოვნის body | 32 MiB (33,554,432 ბაიტი) | ყველა endpoint | სტატუსი 413, ტიპი invalid_request_error. |
გამოტანის ბიუჯეტი: max_tokens, max_completion_tokens, max_output_tokens | 1-დან 65,536-მდე. ნაგულისხმევია 4,096; shannon-coder-1-ზე /v1/chat/completions-სა და /v1/messages-ზე ნაგულისხმევია 65,536. | ყველა მოდელი, როგორც თქვენი ბალანსიდან დარეზერვებული რაოდენობა. როგორც პასუხის სიგრძის ლიმიტი: hosted open-weight მოდელები, shannon-1.6-lite, shannon-1.6-pro და shannon-coder-1. | დიაპაზონს გარეთ მნიშვნელობა დიაპაზონის უახლოეს ბოლოზე გადაინაცვლებს. შეცდომის გარეშე. |
Stop sequence-ები: stop, stop_sequences | 4 სტრიქონი | Hosted open-weight მოდელები | გამოიყენება პირველი 4 არაცარიელი სტრიქონი. |
| URL-ით მიცემული სურათი ან ფაილი | 8 MiB, წაკითხვა 20 წამში, მაქსიმუმ 5 გადამისამართება, საჯარო http ან https მისამართი | ყველა endpoint, რომელიც სურათებს ან ფაილებს იღებს | მოთხოვნას ამ ნაწილის გარეშე პასუხობენ. შეცდომის გარეშე. |
| ინლაინ გაგზავნილი სურათი ან ფაილი (base64) | საკუთარი ლიმიტი არ აქვს. ითვლება 32 MiB მოთხოვნის body-ში. | ყველა endpoint, რომელიც სურათებს ან ფაილებს იღებს | სტატუსი 413 მთელ მოთხოვნაზე. |
POST /v1/tokenize-ის text | 4,000,000 ბაიტი | /v1/tokenize | სტატუსი 413, ტიპი invalid_request_error, შეტყობინება text too long. |
POST /v1/tokenize-ის messages და POST /v1/messages/count_tokens-ის body | 32 MiB მოთხოვნის body | ორივე დათვლის endpoint | სტატუსი 413. |
| კონტექსტის ფანჯარა | მოდელის მიხედვით: context_window GET /v1/models-ში | ყველა მოდელი | რა ემართება უფრო გრძელ საუბარს, მოდელზეა დამოკიდებული. მოდელები და ფასები |
ვებძიებები (web_search: true) | გეგმისა და დღის მიხედვით: Free 3, Plus 30, Standard 50, Pro 60. ერთი ძიება ითვლება მოთხოვნაზე, რომლის ძიებამაც შედეგები იპოვა. | მოთხოვნები, რომლებიც აყენებენ web_search: true-ს | ლიმიტის ამოწურვისას მოთხოვნას ძიების გარეშე პასუხობენ. შეცდომის გარეშე. ჩაშენებული ვებძიება |
შეცდომები
ამ გვერდის პასუხები. /v1/messages-ზე იგივე error ობიექტი შეფუთულია როგორც {"type": "error", "error": {…}}.
| სტატუსი | ტიპი | შეტყობინება | როდის და რა უნდა გააკეთოთ |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | მოთხოვნის რეზერვი თქვენს ბალანსში არ ეტევა. დაელოდეთ 00:00 UTC-ს, შეავსეთ კრედიტი, შეცვალეთ გეგმა ან გააგზავნეთ უფრო მცირე max_tokens. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | მიმდინარე წუთში 120-ზე მეტი მოთხოვნა. დაელოდეთ N წამს და გააგზავნეთ ხელახლა. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | მიმდინარე 4-საათიანი ფანჯრის Shannon Coder-ის გამოძახებები ამოიწურა. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | მოდელს ამ მომენტში მოთხოვნის მიღება არ შეუძლია. გააგზავნეთ ხელახლა მოკლე პაუზის შემდეგ. |
503 | api_error | Could not verify your quota right now. Please retry. | თქვენი ბალანსი ვერ წაიკითხა. არაფერი ირიცხება; გააგზავნეთ მოთხოვნა ხელახლა. /v1/responses-ზე Shannon-ის მოდელით სტატუსია 500. |
413 | invalid_request_error | მოთხოვნის body 32 MiB-ზე დიდია. OpenAI-ის ფორმატის endpoint-ებზე error ობიექტი ატარებს code: "request_too_large"-ს. | |
413 | invalid_request_error | text too long | POST /v1/tokenize-ის text 4,000,000 ბაიტზე გრძელია. |