मर्यादा आणि बॅलन्स
प्रत्येक रिक्वेस्टला समान वागणूक मिळते. रेट टियर्स नाहीत. वेगळा API कोटा नाही. तुम्ही तुमच्या टोकन्सचे पैसे आधीच दिले आहेत — हवे तितक्या वेगाने वापरा.
हे पान स्पष्ट करते की तुमचा बॅलन्स कशाचा बनलेला आहे, एक रिक्वेस्ट काय राखून ठेवते आणि किती खर्च करते, तुम्ही किती रिक्वेस्ट्स पाठवू शकता, आणि एका रिक्वेस्टला लागू होणाऱ्या काही मर्यादा.
- बॅलन्सच्या 1M टोकन्सची किंमत
- $5.00
- दैनिक कोटा नूतनीकरण
- 00:00 UTC
- फ्लड प्रोटेक्शन, प्रति अकाउंट
- 120 रिक्वेस्ट्स / मिनिट
रिक्वेस्ट्स कशा हाताळल्या जातात
- रेट टियर्स नाहीत — रिक्वेस्ट्स किती वेगाने येऊ शकतात हे एकच नियम ठरवतो, आणि तो प्रत्येक अकाउंट आणि प्रत्येक प्लॅनसाठी सारखा आहे: प्रति मिनिट 120 रिक्वेस्ट्स. प्रति मिनिट टोकन्सवर मर्यादा नाही.
- वेगळा API कोटा नाही — API चॅटसारखाच बॅलन्स खर्च करते. प्लॅन आजच्या कोट्याचा आकार ठरवतो. तो रिक्वेस्ट दर ठरवत नाही.
- हवे तितक्या वेगाने — समांतर पाठवलेल्या रिक्वेस्ट्स स्वीकारल्या जातात आणि रांगेत थांबतात. समांतर असल्यामुळे त्या नाकारल्या जात नाहीत.
तुमचा बॅलन्स
तुमचा बॅलन्स टोकन्समध्ये मोजला जातो. बॅलन्सच्या 1,000,000 टोकन्सची किंमत $5.00 आहे, आणि Models & pricing पानावरील प्रत्येक किंमत त्या मूल्याच्या तुलनेत एक दर आहे.
कोणत्याही क्षणी बॅलन्स म्हणजे दोन भागांची बेरीज.
- आजचा प्लॅन कोटा — तुमच्या प्लॅनने ठरवलेली टोकन्सची संख्या. ती दररोज 00:00 UTC ला नवी होते. दिवसाच्या शेवटी उरलेली पुढे नेली जात नाही.
- खरेदी केलेले क्रेडिट — तुम्ही पॅक म्हणून खरेदी केलेली टोकन्स. क्रेडिटची मुदत संपत नाही आणि ते Free सह प्रत्येक प्लॅनवर चालते.
| प्लॅन | प्रति दिवस टोकन्स | किंमत |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- खर्चाचा क्रम — प्रत्येक रिक्वेस्ट आधी आजचा प्लॅन कोटा खर्च करते. खरेदी केलेले क्रेडिट त्या दिवशी कोट्याच्या पलीकडे जाणाऱ्या भागासाठीच वापरले जाते.
- चॅट आणि API तो वाटून घेतात — प्रत्येक अकाउंटसाठी एकच बॅलन्स आहे. API की ज्या अकाउंटची आहे त्याच्या बॅलन्समधून, चॅटच्या किमतींनीच खर्च करते.
- पॅक — क्रेडिट 1,000,000 ($5.00), 2,000,000 ($10.00) आणि 5,000,000 ($25.00) टोकन्सच्या पॅकमध्ये विकले जाते, किंवा 1,000,000 ते 100,000,000 टोकन्समधील तुम्ही निवडलेल्या रकमेत, प्रति 1,000,000 साठी $5.00 दराने.
रिक्वेस्ट काय राखून ठेवते आणि किती खर्च करते
- राखीव — रिक्वेस्ट आल्यावर ती तुमच्या बॅलन्समधून तिचे आउटपुट बजेट राखून ठेवते:
/v1/chat/completionsआणि/v1/messagesवरmax_tokens,/v1/responsesवरmax_output_tokens./v1/chat/completionsmax_completion_tokensदेखील वाचते. डिफॉल्ट 4,096 आहे आणि श्रेणी 1 ते 65,536 आहे. - स्वीकार — राखीव रक्कम तुमच्या उरलेल्या बॅलन्समध्ये बसत असेल तरच रिक्वेस्ट स्वीकारली जाते. शून्यापेक्षा जास्त पण आउटपुट बजेटपेक्षा कमी असलेल्या बॅलन्सला
Quota exceededउत्तर मिळते. उरलेला बॅलन्स वापरण्यासाठी लहानmax_tokensपाठवा. - समायोजन — उत्तर पूर्ण झाल्यावर राखीव रक्कम प्रत्यक्ष शुल्काने बदलली जाते. शुल्क राखीव रकमेपेक्षा कमी किंवा जास्त असू शकते.
- परतावा — त्रुटी स्टेटसने संपणारी रिक्वेस्ट तिची राखीव रक्कम पूर्ण परत देते.
प्रत्यक्ष शुल्क मॉडेल कुटुंबावर अवलंबून असते.
| मॉडेल्स | काय आकारले जाते |
|---|---|
| Shannon मॉडेल्स | मॉडेलच्या प्रति 1M किमतीनुसार usage.total_tokens. इनपुट आणि आउटपुटसाठी एकच दर. |
| होस्ट केलेली open-weight मॉडेल्स | कॅश न केलेले इनपुट इनपुट दराने, कॅश केलेले इनपुट कॅश दराने, आउटपुट आउटपुट दराने. |
USD मधील रक्कम तुमच्या बॅलन्समधून प्रति 1,000,000 साठी $5.00 दराने टोकन्समध्ये घेतली जाते, पूर्ण टोकनपर्यंत पूर्णांकित.
POST /v1/tokenize किंवा POST /v1/messages/count_tokens ने टोकन्स मोजणे मोफत आहे आणि काहीही राखून ठेवत नाही. टोकन मोजणी
बॅलन्स आणि वापर कुठे पाहायचा
Keys & usage पान तुम्ही आत्ता किती खर्च करू शकता, आजचा प्लॅन कोटा, तुम्ही खरेदी केलेले क्रेडिट आणि गेल्या 30 दिवसांचा API खर्च दाखवते. त्याखाली तुमच्या कीने केलेली प्रत्येक रिक्वेस्ट सूचीबद्ध असते: वेळ, एंडपॉइंट, मॉडेल, कॅश केलेले इनपुट, बिल केलेली टोकन्स आणि खर्च. की आणि वापर
प्रत्येक उत्तरात त्या कॉलची टोकन संख्या असलेला usage ऑब्जेक्टही असतो.
| एंडपॉइंट | usage ची फील्ड्स | होस्ट केलेल्या open-weight मॉडेल्सनी जोडलेली |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageमध्ये मॉडेलची टोकन संख्या असते. तुमच्या बॅलन्समधून घेतलेली रक्कम उत्तरात नसते: ती Keys & usage वरील रिक्वेस्ट यादीतील Billed tokens स्तंभात असते.- होस्ट केलेल्या open-weight मॉडेलसह
/v1/messagesवर,input_tokensहा इनपुटचा कॅश न केलेला भाग आहे,cache_read_input_tokensकॅश केलेला भाग आहे आणिcache_creation_input_tokensनेहमी0असतो. -
/v1/chat/completionsवरील स्ट्रीम[DONE]च्या आधीच्या शेवटच्या चंकमध्येusageदेतो. स्ट्रीमिंग
बॅलन्स संपल्यावर
ज्या रिक्वेस्टची राखीव रक्कम तुमच्या बॅलन्समध्ये बसत नाही तिला स्टेटस 429, प्रकार rate_limit_error आणि खालील संदेश मिळतो. काहीही आकारले जात नाही. बॅलन्स शून्यापेक्षा जास्त पण रिक्वेस्टच्या आउटपुट बजेटपेक्षा कमी असतानाही हेच उत्तर दिले जाते.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses वर error ऑब्जेक्टमध्ये code आणि param देखील असू शकतात, दोन्ही null.
तुम्ही काय करू शकता:
- 00:00 UTC ला पुढच्या प्लॅन कोट्याची वाट पाहा.
- क्रेडिट टॉप-अप करा. क्रेडिट प्लॅन कोट्यानंतर खर्च होते आणि त्याची मुदत संपत नाही. क्रेडिट टॉप-अप करा
- मोठा दैनिक कोटा असलेल्या प्लॅनवर जा. प्लॅन बदला
- काही बॅलन्स उरला असेल तर लहान
max_tokensपाठवा: तेव्हा राखीव रक्कम कमी असते.
Shannon Coder कॉल कोटा
/v1/chat/completions आणि /v1/messages वर shannon-coder-1 टोकन्समध्ये नव्हे तर कॉल्समध्ये मोजले जाते. प्रत्येक प्लॅनमध्ये प्रति 4 तासांच्या विंडोसाठी ठरावीक कॉल्स असतात. एक रिक्वेस्ट म्हणजे एक कॉल.
| प्लॅन | प्रति 4 तासांच्या विंडो कॉल्स |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- विंडो 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC पासून सुरू होतात. विंडोच्या शेवटी उरलेले कॉल्स पुढे नेले जात नाहीत.
- रिक्वेस्ट स्वीकारली जाते तेव्हा, मॉडेल उत्तर देण्यापूर्वी, कॉल मोजला जातो. नंतर अयशस्वी झालेली रिक्वेस्टही एक कॉल म्हणून मोजली जाते.
- हे कॉल्स टोकन्स राखून ठेवत नाहीत आणि तुमच्या बॅलन्समधून काहीही घेत नाहीत. Keys & usage वरील रिक्वेस्ट यादी त्यांची टोकन संख्या आणि दिलेल्या किमतीतील मूल्य दाखवते.
- या दोन एंडपॉइंट्सवर
shannon-coder-1चे डिफॉल्टmax_tokens65,536 आहे. - कॉल्स शिल्लक नसताना उत्तर स्टेटस
429, प्रकारrate_limit_error, संदेशShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/planअसे असते. /v1/responsesवरshannon-coder-1ला कॉल कोटा नाही: इतर मॉडेल्सप्रमाणे त्याचे शुल्क तुमच्या बॅलन्समधून प्रति 1M $8.00 दराने टोकन्समध्ये लागते.
फ्लड प्रोटेक्शन
अकाउंट प्रति मिनिट 120 रिक्वेस्ट्स पाठवू शकते. रिक्वेस्ट दरावरील ही एकमेव मर्यादा आहे आणि ती प्रत्येक प्लॅनवर सारखीच आहे. ती फ्लड थांबवण्यासाठी आहे, सामान्य वापर मंदावण्यासाठी नाही.
- मिनिट ही 60 सेकंदांची निश्चित विंडो आहे जी तुमच्या पहिल्या रिक्वेस्टने उघडते. ती संपल्यावर मोजणी पुन्हा शून्यापासून सुरू होते.
- मोजणी प्रति अकाउंट आहे, प्रति की किंवा प्रति IP पत्ता नाही. की बदलल्याने नवी विंडो उघडत नाही.
- विंडोमधील 121 व्या रिक्वेस्टला स्टेटस
429, प्रकारrate_limit_errorआणि संदेशToo many requests. Retry in <N>s.मिळतो.Nम्हणजे विंडो संपेपर्यंतचे सेकंद, 1 ते 60. - फ्लड प्रोटेक्शन बॅलन्सच्या आधी तपासले जाते. त्याने नाकारलेली रिक्वेस्ट काहीही राखून ठेवत नाही आणि तिचे शुल्क लागत नाही.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | रिक्वेस्ट | फ्लड प्रोटेक्शन |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | मोजले जाते, प्रत्येक रिक्वेस्टला एक. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | मोजले जात नाही. |
/v1/chat/completions आणि /v1/messages वर shannon-coder-1 | त्याऐवजी Shannon Coder कॉल कोट्याने मोजले जाते. |
401 ने किंवा अज्ञात model साठी 400 ने उत्तर दिलेली रिक्वेस्ट | मोजले जात नाही. |
| फ्लड प्रोटेक्शनने नाकारलेली रिक्वेस्ट | विंडोमध्ये मोजले जाते. काहीही आकारले जात नाही. |
समांतर रिक्वेस्ट्स
अकाउंटवर एकाच वेळी किती रिक्वेस्ट्स उघड्या असू शकतात याला मर्यादा नाही, आणि रिक्वेस्ट्स समांतर पाठवल्याबद्दल त्रुटी नाही. लगेच सुरू होऊ न शकणाऱ्या रिक्वेस्ट्स रांगेत थांबतात आणि क्रमाने उत्तर मिळते.
- प्रत्येक रिक्वेस्ट आल्यावर ती दर मिनिटाच्या 120 मध्ये मोजली जाते, आधीच्या रिक्वेस्ट्स संपल्या असोत वा नसोत.
- प्रत्येक रिक्वेस्ट संपेपर्यंत स्वतःची राखीव रक्कम धरून ठेवते. डिफॉल्ट आउटपुट बजेटसह वीस उघड्या रिक्वेस्ट्स 20 × 4,096 = 81,920 टोकन्सचा बॅलन्स धरून ठेवतात. राखीव रकमा मिळून तुमच्या बॅलन्सपेक्षा मोठ्या असतील, तर पुढच्या रिक्वेस्टला
Quota exceededउत्तर मिळते, पूर्ण झालेल्या कॉल्सचा खर्च कमी असला तरीही. लहानmax_tokensकमी रक्कम धरते. - स्ट्रीमिंग नसलेली रिक्वेस्ट उत्तर पूर्ण होईपर्यंत काहीही पाठवत नाही, म्हणून तुमच्या क्लायंटला या प्रतीक्षेला पुरेसा टाइमआउट द्या. स्ट्रीम प्रतीक्षा करताना कनेक्शन उघडे ठेवतो. स्ट्रीमिंग
एका रिक्वेस्टच्या मर्यादा
| मर्यादा | मूल्य | कुठे लागू | मर्यादेवर |
|---|---|---|---|
| रिक्वेस्ट बॉडी | 32 MiB (33,554,432 बाइट्स) | प्रत्येक एंडपॉइंट | स्टेटस 413, प्रकार invalid_request_error. |
आउटपुट बजेट: max_tokens, max_completion_tokens, max_output_tokens | 1 ते 65,536. डिफॉल्ट 4,096; /v1/chat/completions आणि /v1/messages वर shannon-coder-1 साठी डिफॉल्ट 65,536. | प्रत्येक मॉडेल, तुमच्या बॅलन्समधून राखीव रक्कम म्हणून. उत्तराच्या लांबीची मर्यादा म्हणून: होस्ट केलेली open-weight मॉडेल्स, shannon-1.6-lite, shannon-1.6-pro आणि shannon-coder-1. | श्रेणीबाहेरचे मूल्य श्रेणीच्या सर्वात जवळच्या टोकाला हलवले जाते. त्रुटी नाही. |
स्टॉप सीक्वेन्स: stop, stop_sequences | 4 स्ट्रिंग | होस्ट केलेली open-weight मॉडेल्स | पहिल्या 4 रिकाम्या नसलेल्या स्ट्रिंग वापरल्या जातात. |
| URL म्हणून दिलेली इमेज किंवा फाइल | 8 MiB, 20 सेकंदांत वाचली जाते, जास्तीत जास्त 5 रीडायरेक्ट्स, सार्वजनिक http किंवा https पत्ता | इमेज किंवा फाइल्स घेणारा प्रत्येक एंडपॉइंट | रिक्वेस्टचे उत्तर त्या भागाशिवाय दिले जाते. त्रुटी नाही. |
| इनलाइन पाठवलेली इमेज किंवा फाइल (base64) | स्वतःची मर्यादा नाही. ती 32 MiB रिक्वेस्ट बॉडीमध्ये मोजली जाते. | इमेज किंवा फाइल्स घेणारा प्रत्येक एंडपॉइंट | संपूर्ण रिक्वेस्टसाठी स्टेटस 413. |
POST /v1/tokenize चा text | 4,000,000 बाइट्स | /v1/tokenize | स्टेटस 413, प्रकार invalid_request_error, संदेश text too long. |
POST /v1/tokenize चे messages आणि POST /v1/messages/count_tokens ची बॉडी | 32 MiB रिक्वेस्ट बॉडी | दोन्ही मोजणी एंडपॉइंट्स | स्टेटस 413. |
| कॉन्टेक्स्ट विंडो | प्रत्येक मॉडेलसाठी: GET /v1/models मधील context_window | प्रत्येक मॉडेल | जास्त लांब संभाषणाचे काय होते ते मॉडेलवर अवलंबून असते. मॉडेल्स आणि किंमत |
वेब शोध (web_search: true) | प्लॅन आणि दिवसानुसार: Free 3, Plus 30, Standard 50, Pro 60. ज्या रिक्वेस्टच्या शोधाला निकाल मिळाले तिच्यासाठी एक शोध मोजला जातो. | web_search: true सेट करणाऱ्या रिक्वेस्ट्स | काही शिल्लक नसताना रिक्वेस्टचे उत्तर शोधाशिवाय दिले जाते. त्रुटी नाही. Built‑in Web Search |
त्रुटी
या पानावरील उत्तरे. /v1/messages वर तोच error ऑब्जेक्ट {"type": "error", "error": {…}} असा गुंडाळलेला असतो.
| स्टेटस | प्रकार | संदेश | केव्हा, आणि काय करावे |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | रिक्वेस्टची राखीव रक्कम तुमच्या बॅलन्समध्ये बसत नाही. 00:00 UTC ची वाट पाहा, क्रेडिट टॉप-अप करा, प्लॅन बदला, किंवा लहान max_tokens पाठवा. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | सध्याच्या मिनिटात 120 पेक्षा जास्त रिक्वेस्ट्स. N सेकंद थांबा आणि पुन्हा पाठवा. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | सध्याच्या 4 तासांच्या विंडोमधील Shannon Coder कॉल्स संपले आहेत. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | मॉडेल या क्षणी रिक्वेस्ट घेऊ शकत नाही. थोड्या विरामानंतर ती पुन्हा पाठवा. |
503 | api_error | Could not verify your quota right now. Please retry. | तुमचा बॅलन्स वाचता आला नाही. काहीही आकारले जात नाही; रिक्वेस्ट पुन्हा पाठवा. Shannon मॉडेलसह /v1/responses वर स्टेटस 500 असते. |
413 | invalid_request_error | रिक्वेस्ट बॉडी 32 MiB पेक्षा मोठी आहे. OpenAI फॉरमॅट एंडपॉइंट्सवर error ऑब्जेक्टमध्ये code: "request_too_large" असते. | |
413 | invalid_request_error | text too long | POST /v1/tokenize चा text 4,000,000 बाइट्सपेक्षा मोठा आहे. |