मजकुराकडे जा
मर्यादा आणि बॅलन्स

मर्यादा आणि बॅलन्स

प्रत्येक रिक्वेस्टला समान वागणूक मिळते. रेट टियर्स नाहीत. वेगळा API कोटा नाही. तुम्ही तुमच्या टोकन्सचे पैसे आधीच दिले आहेत — हवे तितक्या वेगाने वापरा.

हे पान स्पष्ट करते की तुमचा बॅलन्स कशाचा बनलेला आहे, एक रिक्वेस्ट काय राखून ठेवते आणि किती खर्च करते, तुम्ही किती रिक्वेस्ट्स पाठवू शकता, आणि एका रिक्वेस्टला लागू होणाऱ्या काही मर्यादा.

बॅलन्सच्या 1M टोकन्सची किंमत
$5.00
दैनिक कोटा नूतनीकरण
00:00 UTC
फ्लड प्रोटेक्शन, प्रति अकाउंट
120 रिक्वेस्ट्स / मिनिट

रिक्वेस्ट्स कशा हाताळल्या जातात

  • रेट टियर्स नाहीत — रिक्वेस्ट्स किती वेगाने येऊ शकतात हे एकच नियम ठरवतो, आणि तो प्रत्येक अकाउंट आणि प्रत्येक प्लॅनसाठी सारखा आहे: प्रति मिनिट 120 रिक्वेस्ट्स. प्रति मिनिट टोकन्सवर मर्यादा नाही.
  • वेगळा API कोटा नाही — API चॅटसारखाच बॅलन्स खर्च करते. प्लॅन आजच्या कोट्याचा आकार ठरवतो. तो रिक्वेस्ट दर ठरवत नाही.
  • हवे तितक्या वेगाने — समांतर पाठवलेल्या रिक्वेस्ट्स स्वीकारल्या जातात आणि रांगेत थांबतात. समांतर असल्यामुळे त्या नाकारल्या जात नाहीत.

तुमचा बॅलन्स

तुमचा बॅलन्स टोकन्समध्ये मोजला जातो. बॅलन्सच्या 1,000,000 टोकन्सची किंमत $5.00 आहे, आणि Models & pricing पानावरील प्रत्येक किंमत त्या मूल्याच्या तुलनेत एक दर आहे.

कोणत्याही क्षणी बॅलन्स म्हणजे दोन भागांची बेरीज.

  • आजचा प्लॅन कोटा — तुमच्या प्लॅनने ठरवलेली टोकन्सची संख्या. ती दररोज 00:00 UTC ला नवी होते. दिवसाच्या शेवटी उरलेली पुढे नेली जात नाही.
  • खरेदी केलेले क्रेडिट — तुम्ही पॅक म्हणून खरेदी केलेली टोकन्स. क्रेडिटची मुदत संपत नाही आणि ते Free सह प्रत्येक प्लॅनवर चालते.
प्लॅन प्रति दिवस टोकन्स किंमत
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • खर्चाचा क्रम — प्रत्येक रिक्वेस्ट आधी आजचा प्लॅन कोटा खर्च करते. खरेदी केलेले क्रेडिट त्या दिवशी कोट्याच्या पलीकडे जाणाऱ्या भागासाठीच वापरले जाते.
  • चॅट आणि API तो वाटून घेतात — प्रत्येक अकाउंटसाठी एकच बॅलन्स आहे. API की ज्या अकाउंटची आहे त्याच्या बॅलन्समधून, चॅटच्या किमतींनीच खर्च करते.
  • पॅक — क्रेडिट 1,000,000 ($5.00), 2,000,000 ($10.00) आणि 5,000,000 ($25.00) टोकन्सच्या पॅकमध्ये विकले जाते, किंवा 1,000,000 ते 100,000,000 टोकन्समधील तुम्ही निवडलेल्या रकमेत, प्रति 1,000,000 साठी $5.00 दराने.

क्रेडिट टॉप-अप करा प्लॅन बदला

रिक्वेस्ट काय राखून ठेवते आणि किती खर्च करते

  • राखीव — रिक्वेस्ट आल्यावर ती तुमच्या बॅलन्समधून तिचे आउटपुट बजेट राखून ठेवते: /v1/chat/completions आणि /v1/messages वर max_tokens, /v1/responses वर max_output_tokens. /v1/chat/completions max_completion_tokens देखील वाचते. डिफॉल्ट 4,096 आहे आणि श्रेणी 1 ते 65,536 आहे.
  • स्वीकार — राखीव रक्कम तुमच्या उरलेल्या बॅलन्समध्ये बसत असेल तरच रिक्वेस्ट स्वीकारली जाते. शून्यापेक्षा जास्त पण आउटपुट बजेटपेक्षा कमी असलेल्या बॅलन्सला Quota exceeded उत्तर मिळते. उरलेला बॅलन्स वापरण्यासाठी लहान max_tokens पाठवा.
  • समायोजन — उत्तर पूर्ण झाल्यावर राखीव रक्कम प्रत्यक्ष शुल्काने बदलली जाते. शुल्क राखीव रकमेपेक्षा कमी किंवा जास्त असू शकते.
  • परतावा — त्रुटी स्टेटसने संपणारी रिक्वेस्ट तिची राखीव रक्कम पूर्ण परत देते.

प्रत्यक्ष शुल्क मॉडेल कुटुंबावर अवलंबून असते.

मॉडेल्स काय आकारले जाते
Shannon मॉडेल्स मॉडेलच्या प्रति 1M किमतीनुसार usage.total_tokens. इनपुट आणि आउटपुटसाठी एकच दर.
होस्ट केलेली open-weight मॉडेल्स कॅश न केलेले इनपुट इनपुट दराने, कॅश केलेले इनपुट कॅश दराने, आउटपुट आउटपुट दराने.

USD मधील रक्कम तुमच्या बॅलन्समधून प्रति 1,000,000 साठी $5.00 दराने टोकन्समध्ये घेतली जाते, पूर्ण टोकनपर्यंत पूर्णांकित.

POST /v1/tokenize किंवा POST /v1/messages/count_tokens ने टोकन्स मोजणे मोफत आहे आणि काहीही राखून ठेवत नाही. टोकन मोजणी

बॅलन्स आणि वापर कुठे पाहायचा

Keys & usage पान तुम्ही आत्ता किती खर्च करू शकता, आजचा प्लॅन कोटा, तुम्ही खरेदी केलेले क्रेडिट आणि गेल्या 30 दिवसांचा API खर्च दाखवते. त्याखाली तुमच्या कीने केलेली प्रत्येक रिक्वेस्ट सूचीबद्ध असते: वेळ, एंडपॉइंट, मॉडेल, कॅश केलेले इनपुट, बिल केलेली टोकन्स आणि खर्च. की आणि वापर

प्रत्येक उत्तरात त्या कॉलची टोकन संख्या असलेला usage ऑब्जेक्टही असतो.

एंडपॉइंट usage ची फील्ड्स होस्ट केलेल्या open-weight मॉडेल्सनी जोडलेली
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage मध्ये मॉडेलची टोकन संख्या असते. तुमच्या बॅलन्समधून घेतलेली रक्कम उत्तरात नसते: ती Keys & usage वरील रिक्वेस्ट यादीतील Billed tokens स्तंभात असते.
  • होस्ट केलेल्या open-weight मॉडेलसह /v1/messages वर, input_tokens हा इनपुटचा कॅश न केलेला भाग आहे, cache_read_input_tokens कॅश केलेला भाग आहे आणि cache_creation_input_tokens नेहमी 0 असतो.
  • /v1/chat/completions वरील स्ट्रीम [DONE] च्या आधीच्या शेवटच्या चंकमध्ये usage देतो. स्ट्रीमिंग

बॅलन्स संपल्यावर

ज्या रिक्वेस्टची राखीव रक्कम तुमच्या बॅलन्समध्ये बसत नाही तिला स्टेटस 429, प्रकार rate_limit_error आणि खालील संदेश मिळतो. काहीही आकारले जात नाही. बॅलन्स शून्यापेक्षा जास्त पण रिक्वेस्टच्या आउटपुट बजेटपेक्षा कमी असतानाही हेच उत्तर दिले जाते.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses वर error ऑब्जेक्टमध्ये code आणि param देखील असू शकतात, दोन्ही null.

तुम्ही काय करू शकता:

  • 00:00 UTC ला पुढच्या प्लॅन कोट्याची वाट पाहा.
  • क्रेडिट टॉप-अप करा. क्रेडिट प्लॅन कोट्यानंतर खर्च होते आणि त्याची मुदत संपत नाही. क्रेडिट टॉप-अप करा
  • मोठा दैनिक कोटा असलेल्या प्लॅनवर जा. प्लॅन बदला
  • काही बॅलन्स उरला असेल तर लहान max_tokens पाठवा: तेव्हा राखीव रक्कम कमी असते.

Shannon Coder कॉल कोटा

/v1/chat/completions आणि /v1/messages वर shannon-coder-1 टोकन्समध्ये नव्हे तर कॉल्समध्ये मोजले जाते. प्रत्येक प्लॅनमध्ये प्रति 4 तासांच्या विंडोसाठी ठरावीक कॉल्स असतात. एक रिक्वेस्ट म्हणजे एक कॉल.

प्लॅन प्रति 4 तासांच्या विंडो कॉल्स
Free 3
Plus 20
Standard 40
Pro 60
  • विंडो 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC पासून सुरू होतात. विंडोच्या शेवटी उरलेले कॉल्स पुढे नेले जात नाहीत.
  • रिक्वेस्ट स्वीकारली जाते तेव्हा, मॉडेल उत्तर देण्यापूर्वी, कॉल मोजला जातो. नंतर अयशस्वी झालेली रिक्वेस्टही एक कॉल म्हणून मोजली जाते.
  • हे कॉल्स टोकन्स राखून ठेवत नाहीत आणि तुमच्या बॅलन्समधून काहीही घेत नाहीत. Keys & usage वरील रिक्वेस्ट यादी त्यांची टोकन संख्या आणि दिलेल्या किमतीतील मूल्य दाखवते.
  • या दोन एंडपॉइंट्सवर shannon-coder-1 चे डिफॉल्ट max_tokens 65,536 आहे.
  • कॉल्स शिल्लक नसताना उत्तर स्टेटस 429, प्रकार rate_limit_error, संदेश Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan असे असते.
  • /v1/responses वर shannon-coder-1 ला कॉल कोटा नाही: इतर मॉडेल्सप्रमाणे त्याचे शुल्क तुमच्या बॅलन्समधून प्रति 1M $8.00 दराने टोकन्समध्ये लागते.

फ्लड प्रोटेक्शन

अकाउंट प्रति मिनिट 120 रिक्वेस्ट्स पाठवू शकते. रिक्वेस्ट दरावरील ही एकमेव मर्यादा आहे आणि ती प्रत्येक प्लॅनवर सारखीच आहे. ती फ्लड थांबवण्यासाठी आहे, सामान्य वापर मंदावण्यासाठी नाही.

  • मिनिट ही 60 सेकंदांची निश्चित विंडो आहे जी तुमच्या पहिल्या रिक्वेस्टने उघडते. ती संपल्यावर मोजणी पुन्हा शून्यापासून सुरू होते.
  • मोजणी प्रति अकाउंट आहे, प्रति की किंवा प्रति IP पत्ता नाही. की बदलल्याने नवी विंडो उघडत नाही.
  • विंडोमधील 121 व्या रिक्वेस्टला स्टेटस 429, प्रकार rate_limit_error आणि संदेश Too many requests. Retry in <N>s. मिळतो. N म्हणजे विंडो संपेपर्यंतचे सेकंद, 1 ते 60.
  • फ्लड प्रोटेक्शन बॅलन्सच्या आधी तपासले जाते. त्याने नाकारलेली रिक्वेस्ट काहीही राखून ठेवत नाही आणि तिचे शुल्क लागत नाही.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
रिक्वेस्ट फ्लड प्रोटेक्शन
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses मोजले जाते, प्रत्येक रिक्वेस्टला एक.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens मोजले जात नाही.
/v1/chat/completions आणि /v1/messages वर shannon-coder-1 त्याऐवजी Shannon Coder कॉल कोट्याने मोजले जाते.
401 ने किंवा अज्ञात model साठी 400 ने उत्तर दिलेली रिक्वेस्ट मोजले जात नाही.
फ्लड प्रोटेक्शनने नाकारलेली रिक्वेस्ट विंडोमध्ये मोजले जाते. काहीही आकारले जात नाही.

समांतर रिक्वेस्ट्स

अकाउंटवर एकाच वेळी किती रिक्वेस्ट्स उघड्या असू शकतात याला मर्यादा नाही, आणि रिक्वेस्ट्स समांतर पाठवल्याबद्दल त्रुटी नाही. लगेच सुरू होऊ न शकणाऱ्या रिक्वेस्ट्स रांगेत थांबतात आणि क्रमाने उत्तर मिळते.

  • प्रत्येक रिक्वेस्ट आल्यावर ती दर मिनिटाच्या 120 मध्ये मोजली जाते, आधीच्या रिक्वेस्ट्स संपल्या असोत वा नसोत.
  • प्रत्येक रिक्वेस्ट संपेपर्यंत स्वतःची राखीव रक्कम धरून ठेवते. डिफॉल्ट आउटपुट बजेटसह वीस उघड्या रिक्वेस्ट्स 20 × 4,096 = 81,920 टोकन्सचा बॅलन्स धरून ठेवतात. राखीव रकमा मिळून तुमच्या बॅलन्सपेक्षा मोठ्या असतील, तर पुढच्या रिक्वेस्टला Quota exceeded उत्तर मिळते, पूर्ण झालेल्या कॉल्सचा खर्च कमी असला तरीही. लहान max_tokens कमी रक्कम धरते.
  • स्ट्रीमिंग नसलेली रिक्वेस्ट उत्तर पूर्ण होईपर्यंत काहीही पाठवत नाही, म्हणून तुमच्या क्लायंटला या प्रतीक्षेला पुरेसा टाइमआउट द्या. स्ट्रीम प्रतीक्षा करताना कनेक्शन उघडे ठेवतो. स्ट्रीमिंग

एका रिक्वेस्टच्या मर्यादा

मर्यादा मूल्य कुठे लागू मर्यादेवर
रिक्वेस्ट बॉडी 32 MiB (33,554,432 बाइट्स) प्रत्येक एंडपॉइंट स्टेटस 413, प्रकार invalid_request_error.
आउटपुट बजेट: max_tokens, max_completion_tokens, max_output_tokens 1 ते 65,536. डिफॉल्ट 4,096; /v1/chat/completions आणि /v1/messages वर shannon-coder-1 साठी डिफॉल्ट 65,536. प्रत्येक मॉडेल, तुमच्या बॅलन्समधून राखीव रक्कम म्हणून. उत्तराच्या लांबीची मर्यादा म्हणून: होस्ट केलेली open-weight मॉडेल्स, shannon-1.6-lite, shannon-1.6-pro आणि shannon-coder-1. श्रेणीबाहेरचे मूल्य श्रेणीच्या सर्वात जवळच्या टोकाला हलवले जाते. त्रुटी नाही.
स्टॉप सीक्वेन्स: stop, stop_sequences 4 स्ट्रिंग होस्ट केलेली open-weight मॉडेल्स पहिल्या 4 रिकाम्या नसलेल्या स्ट्रिंग वापरल्या जातात.
URL म्हणून दिलेली इमेज किंवा फाइल 8 MiB, 20 सेकंदांत वाचली जाते, जास्तीत जास्त 5 रीडायरेक्ट्स, सार्वजनिक http किंवा https पत्ता इमेज किंवा फाइल्स घेणारा प्रत्येक एंडपॉइंट रिक्वेस्टचे उत्तर त्या भागाशिवाय दिले जाते. त्रुटी नाही.
इनलाइन पाठवलेली इमेज किंवा फाइल (base64) स्वतःची मर्यादा नाही. ती 32 MiB रिक्वेस्ट बॉडीमध्ये मोजली जाते. इमेज किंवा फाइल्स घेणारा प्रत्येक एंडपॉइंट संपूर्ण रिक्वेस्टसाठी स्टेटस 413.
POST /v1/tokenize चा text 4,000,000 बाइट्स /v1/tokenize स्टेटस 413, प्रकार invalid_request_error, संदेश text too long.
POST /v1/tokenize चे messages आणि POST /v1/messages/count_tokens ची बॉडी 32 MiB रिक्वेस्ट बॉडी दोन्ही मोजणी एंडपॉइंट्स स्टेटस 413.
कॉन्टेक्स्ट विंडो प्रत्येक मॉडेलसाठी: GET /v1/models मधील context_window प्रत्येक मॉडेल जास्त लांब संभाषणाचे काय होते ते मॉडेलवर अवलंबून असते. मॉडेल्स आणि किंमत
वेब शोध (web_search: true) प्लॅन आणि दिवसानुसार: Free 3, Plus 30, Standard 50, Pro 60. ज्या रिक्वेस्टच्या शोधाला निकाल मिळाले तिच्यासाठी एक शोध मोजला जातो. web_search: true सेट करणाऱ्या रिक्वेस्ट्स काही शिल्लक नसताना रिक्वेस्टचे उत्तर शोधाशिवाय दिले जाते. त्रुटी नाही. Built‑in Web Search

त्रुटी

या पानावरील उत्तरे. /v1/messages वर तोच error ऑब्जेक्ट {"type": "error", "error": {…}} असा गुंडाळलेला असतो.

स्टेटस प्रकार संदेश केव्हा, आणि काय करावे
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan रिक्वेस्टची राखीव रक्कम तुमच्या बॅलन्समध्ये बसत नाही. 00:00 UTC ची वाट पाहा, क्रेडिट टॉप-अप करा, प्लॅन बदला, किंवा लहान max_tokens पाठवा.
429 rate_limit_error Too many requests. Retry in <N>s. सध्याच्या मिनिटात 120 पेक्षा जास्त रिक्वेस्ट्स. N सेकंद थांबा आणि पुन्हा पाठवा.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan सध्याच्या 4 तासांच्या विंडोमधील Shannon Coder कॉल्स संपले आहेत.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. मॉडेल या क्षणी रिक्वेस्ट घेऊ शकत नाही. थोड्या विरामानंतर ती पुन्हा पाठवा.
503 api_error Could not verify your quota right now. Please retry. तुमचा बॅलन्स वाचता आला नाही. काहीही आकारले जात नाही; रिक्वेस्ट पुन्हा पाठवा. Shannon मॉडेलसह /v1/responses वर स्टेटस 500 असते.
413 invalid_request_error रिक्वेस्ट बॉडी 32 MiB पेक्षा मोठी आहे. OpenAI फॉरमॅट एंडपॉइंट्सवर error ऑब्जेक्टमध्ये code: "request_too_large" असते.
413 invalid_request_error text too long POST /v1/tokenize चा text 4,000,000 बाइट्सपेक्षा मोठा आहे.