सीमा र ब्यालेन्स
हरेक अनुरोध बराबर सेवा पाउँछ। कुनै रेट तह छैन। छुट्टै API कोटा छैन। तपाईंले आफ्ना टोकनको भुक्तानी गरिसक्नुभएको छ — जति चाहनुहुन्छ त्यति छिटो प्रयोग गर्नुहोस्।
यो पेजले तपाईंको ब्यालेन्स केले बनेको छ, एउटा अनुरोधले के छुट्याउँछ र कति लाग्छ, कति अनुरोध पठाउन सकिन्छ, र एउटा अनुरोधले भेट्न सक्ने केही सीमाहरू बताउँछ।
- ब्यालेन्सका 1M टोकनको मूल्य
- $5.00
- दैनिक भत्ता नवीकरण
- 00:00 UTC
- फ्लड प्रोटेक्सन, प्रति खाता
- 120 अनुरोध / मिनेट
अनुरोधहरू कसरी सेवामा लाग्छन्
- कुनै रेट तह छैन — एउटा नियमले अनुरोध कति छिटो आउन सक्छ भनेर सीमित गर्छ, र यो हरेक खाता र हरेक प्लानका लागि उस्तै छ: प्रति मिनेट 120 अनुरोध। प्रति मिनेट टोकनमा कुनै सीमा छैन।
- छुट्टै API कोटा छैन — API ले च्याटकै ब्यालेन्स खर्च गर्छ। प्लानले आजको भत्ताको आकार तोक्छ। यसले अनुरोध दर तोक्दैन।
- जति चाहनुहुन्छ त्यति छिटो — समानान्तर पठाइएका अनुरोधहरू स्वीकार हुन्छन् र लाइनमा पर्खन्छन्। तिनीहरू समानान्तर भएकै कारण अस्वीकार गरिँदैनन्।
तपाईंको ब्यालेन्स
तपाईंको ब्यालेन्स टोकनमा गनिन्छ। ब्यालेन्सका 1,000,000 टोकनको मूल्य $5.00 हो, र Models & pricing पेजको हरेक मूल्य त्यही मूल्यसँगको दर हो।
जुनसुकै बेला ब्यालेन्स दुई भागको योग हुन्छ।
- आजको प्लान भत्ता — तपाईंको प्लानले तोकेको टोकन संख्या। यो हरेक दिन 00:00 UTC मा नयाँ हुन्छ। दिनको अन्त्यमा बाँकी रहेको अर्को दिनमा सर्दैन।
- खरिद गरिएको क्रेडिट — प्याकका रूपमा किनेका टोकन। क्रेडिटको म्याद सकिँदैन र Free सहित हरेक प्लानमा काम गर्छ।
| प्लान | प्रति दिन टोकन | मूल्य |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- खर्चको क्रम — हरेक अनुरोधले पहिले आजको प्लान भत्ता खर्च गर्छ। खरिद गरिएको क्रेडिट त्यो दिन भत्ताभन्दा बाहिर जाने मात्राका लागि मात्र प्रयोग हुन्छ।
- च्याट र API ले साझा गर्छन् — प्रति खाता एउटा ब्यालेन्स हुन्छ। API की ले त्यसको मालिक खाताको ब्यालेन्सबाट च्याटकै मूल्यमा खर्च गर्छ।
- प्याकहरू — क्रेडिट 1,000,000 ($5.00), 2,000,000 ($10.00) र 5,000,000 ($25.00) टोकनका प्याकमा बिक्री हुन्छ, वा प्रति 1,000,000 $5.00 मा 1,000,000 देखि 100,000,000 टोकनसम्म तपाईंले रोजेको मात्रामा।
क्रेडिट टप-अप गर्नुहोस् प्लान परिवर्तन गर्नुहोस्
अनुरोधले के छुट्याउँछ र कति लाग्छ
- छुट्याउने — अनुरोध आइपुग्दा यसले आफ्नो आउटपुट बजेट तपाईंको ब्यालेन्सबाट छुट्याउँछ:
/v1/chat/completionsर/v1/messagesमाmax_tokens,/v1/responsesमाmax_output_tokens।/v1/chat/completionsलेmax_completion_tokensपनि पढ्छ। पूर्वनिर्धारित 4,096 हो र दायरा 1 देखि 65,536 सम्म हो। - स्वीकार — छुट्याइएको रकम तपाईंको बाँकी ब्यालेन्समा अट्ने भए मात्र अनुरोध स्वीकार हुन्छ। शून्यभन्दा माथि तर आउटपुट बजेटभन्दा सानो ब्यालेन्सले
Quota exceededजवाफ पाउँछ। बाँकी प्रयोग गर्न सानोmax_tokensपठाउनुहोस्। - मिलान — जवाफ पूरा हुँदा छुट्याइएको रकम वास्तविक शुल्कले बदलिन्छ। शुल्क छुट्याइएको रकमभन्दा कम वा बढी हुन सक्छ।
- फिर्ता — त्रुटि स्टेटसमा सकिने अनुरोधले आफ्नो छुट्याइएको रकम पूरै फिर्ता गर्छ।
वास्तविक शुल्क मोडल परिवारमा निर्भर हुन्छ।
| मोडलहरू | के शुल्क लाग्छ |
|---|---|
| Shannon मोडलहरू | मोडलको प्रति 1M मूल्यमा usage.total_tokens। इनपुट र आउटपुटको एउटै दर हुन्छ। |
| होस्ट गरिएका ओपन-वेट मोडलहरू | क्याश नभएको इनपुट इनपुट दरमा, क्याश्ड इनपुट क्याश्ड दरमा, आउटपुट आउटपुट दरमा। |
USD को रकम तपाईंको ब्यालेन्सबाट प्रति 1,000,000 $5.00 मा टोकनमा लिइन्छ, पूर्ण टोकनमा राउन्ड गरेर।
POST /v1/tokenize वा POST /v1/messages/count_tokens ले टोकन गणना गर्न निःशुल्क छ र केही छुट्याउँदैन। टोकन गणना
ब्यालेन्स र प्रयोग कहाँ हेर्ने
Keys & usage पेजले तपाईंले अहिले खर्च गर्न सक्ने रकम, आजको प्लान भत्ता, खरिद गरिएको क्रेडिट र पछिल्ला 30 दिनको API खर्च देखाउँछ। त्यसमुनि यसले तपाईंको कीले गरेका हरेक अनुरोध सूचीबद्ध गर्छ: समय, इन्डपोइन्ट, मोडल, क्याश्ड इनपुट, बिल गरिएका टोकन र लागत। की र प्रयोग
हरेक जवाफमा त्यो कलका टोकन गणना भएको usage अब्जेक्ट पनि हुन्छ।
| इन्डपोइन्ट | usage का फिल्डहरू | होस्ट गरिएका ओपन-वेट मोडलहरूले थप्ने |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageमा मोडलका टोकन गणना हुन्छन्। तपाईंको ब्यालेन्सबाट लिइएको रकम जवाफमा हुँदैन: त्यो Keys & usage को अनुरोध सूचीको बिल गरिएका टोकन स्तम्भमा हुन्छ।- होस्ट गरिएको ओपन-वेट मोडलसँग
/v1/messagesमा,input_tokensइनपुटको क्याश नभएको भाग हो,cache_read_input_tokensक्याश्ड भाग हो रcache_creation_input_tokensसधैं0हुन्छ। -
/v1/chat/completionsको स्ट्रिमले[DONE]अघिको अन्तिम चङ्कमाusageबोक्छ। स्ट्रिमिङ
ब्यालेन्स सकिँदा
छुट्याउनुपर्ने रकम तपाईंको ब्यालेन्समा नअट्ने अनुरोधलाई स्टेटस 429, प्रकार rate_limit_error र तलको सन्देशसहित जवाफ दिइन्छ। केही शुल्क लाग्दैन। ब्यालेन्स शून्यभन्दा माथि तर अनुरोधको आउटपुट बजेटभन्दा सानो हुँदा पनि यही जवाफ पठाइन्छ।
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses मा error अब्जेक्टमा code र param पनि हुन सक्छन्, दुवै null।
तपाईंले के गर्न सक्नुहुन्छ:
- 00:00 UTC मा अर्को प्लान भत्ता आउनेसम्म पर्खनुहोस्।
- क्रेडिट टप-अप गर्नुहोस्। क्रेडिट प्लान भत्ता पछि खर्च हुन्छ र यसको म्याद सकिँदैन। क्रेडिट टप-अप गर्नुहोस्
- ठूलो दैनिक भत्ता भएको प्लानमा परिवर्तन गर्नुहोस्। प्लान परिवर्तन गर्नुहोस्
- केही ब्यालेन्स बाँकी भए सानो
max_tokensपठाउनुहोस्: तब छुट्याइने रकम सानो हुन्छ।
Shannon Coder कल भत्ता
/v1/chat/completions र /v1/messages मा shannon-coder-1 टोकनमा होइन, कलमा गनिन्छ। हरेक प्लानमा प्रति 4 घण्टे विन्डो निश्चित संख्याका कल समावेश हुन्छन्। एउटा अनुरोध एउटा कल हो।
| प्लान | प्रति 4 घण्टे विन्डो कलहरू |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- विन्डोहरू 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC बाट सुरु हुन्छन्। विन्डोको अन्त्यमा बाँकी कलहरू अर्कोमा सर्दैनन्।
- अनुरोध स्वीकार हुँदा, मोडलले जवाफ दिनु अघि, कल गनिन्छ। पछि असफल भएको अनुरोध पनि एक कलका रूपमा गनिन्छ।
- यी कलहरूले टोकन छुट्याउँदैनन् र तपाईंको ब्यालेन्सबाट केही लिँदैनन्। Keys & usage को अनुरोध सूचीले तिनको टोकन संख्या र सूचीबद्ध मूल्यमा त्यसको मूल्य देखाउँछ।
- यी दुई इन्डपोइन्टमा
shannon-coder-1को पूर्वनिर्धारितmax_tokens65,536 हो। - कल बाँकी नरहेमा जवाफ स्टेटस
429, प्रकारrate_limit_error, सन्देशShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/planहुन्छ। /v1/responsesमाshannon-coder-1को कल भत्ता हुँदैन: अरू हरेक मोडलजस्तै यसमा तपाईंको ब्यालेन्सबाट प्रति 1M $8.00 मा टोकनमा शुल्क लाग्छ।
फ्लड प्रोटेक्सन
एउटा खाताले प्रति मिनेट 120 अनुरोध पठाउन सक्छ। अनुरोध दरमा यही एउटै सीमा हो, र यो हरेक प्लानमा उस्तै छ। यो सामान्य प्रयोग ढिलो गर्न होइन, बाढी रोक्न हो।
- मिनेट 60 सेकेन्डको निश्चित विन्डो हो जुन तपाईंको पहिलो अनुरोधबाट खुल्छ। यो सकिँदा गणना फेरि शून्यबाट सुरु हुन्छ।
- गणना प्रति खाता हुन्छ, प्रति की वा प्रति IP ठेगाना होइन। की बदल्दा नयाँ विन्डो खुल्दैन।
- विन्डोभित्रको 121 औं अनुरोधलाई स्टेटस
429, प्रकारrate_limit_errorर सन्देशToo many requests. Retry in <N>s.सहित जवाफ दिइन्छ।Nविन्डो सकिनेसम्मको सेकेन्ड संख्या हो, 1 देखि 60 सम्म। - फ्लड प्रोटेक्सन ब्यालेन्स भन्दा पहिले जाँचिन्छ। यसले अस्वीकार गरेको अनुरोधले केही छुट्याउँदैन र केही लाग्दैन।
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | अनुरोध | फ्लड प्रोटेक्सन |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | गनिन्छ, प्रति अनुरोध एक। |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | गनिँदैन। |
/v1/chat/completions र /v1/messages मा shannon-coder-1 | यसको सट्टा Shannon Coder कल भत्ताले गन्छ। |
401 सहित, वा अज्ञात model का लागि 400 सहित जवाफ दिइएको अनुरोध | गनिँदैन। |
| फ्लड प्रोटेक्सनले अस्वीकार गरेको अनुरोध | विन्डोमा गनिन्छ। केही शुल्क लाग्दैन। |
समानान्तर अनुरोधहरू
एउटा खाताले एकै समयमा कति अनुरोध खुला राख्न सक्छ भन्ने सीमा छैन, र समानान्तर अनुरोध पठाउँदा त्रुटि आउँदैन। तुरुन्तै सुरु हुन नसक्ने अनुरोधहरू लाइनमा पर्खन्छन् र पालैपालो जवाफ पाउँछन्।
- अघिल्ला अनुरोध सकिएका छन् वा छैनन् भन्ने नहेरी हरेक अनुरोध आइपुग्दा प्रति मिनेट 120 मा गनिन्छ।
- हरेक अनुरोधले सकिएसम्म आफ्नो छुट्याइएको रकम राख्छ। पूर्वनिर्धारित आउटपुट बजेटसहित बीसवटा खुला अनुरोधले 20 × 4,096 = 81,920 टोकन ब्यालेन्स राख्छन्। छुट्याइएका रकम जोडेर तपाईंको ब्यालेन्सभन्दा ठूला भए, सकिएका कलहरूको लागत कम पर्ने भए पनि, अर्को अनुरोधले
Quota exceededजवाफ पाउँछ। सानोmax_tokensले कम राख्छ। - स्ट्रिमिङ नगरिएको अनुरोधले जवाफ पूरा नभएसम्म केही पठाउँदैन, त्यसैले आफ्नो क्लाइन्टलाई पर्खाइ धान्ने टाइमआउट दिनुहोस्। स्ट्रिमले पर्खँदा आफ्नो कनेक्सन खुला राख्छ। स्ट्रिमिङ
एउटा अनुरोधका सीमाहरू
| सीमा | मान | कहाँ लागू हुन्छ | सीमामा पुग्दा |
|---|---|---|---|
| अनुरोध बडी | 32 MiB (33,554,432 बाइट) | हरेक इन्डपोइन्ट | स्टेटस 413, प्रकार invalid_request_error। |
आउटपुट बजेट: max_tokens, max_completion_tokens, max_output_tokens | 1 देखि 65,536 सम्म। पूर्वनिर्धारित 4,096; /v1/chat/completions र /v1/messages मा shannon-coder-1 को पूर्वनिर्धारित 65,536 हो। | हरेक मोडल, तपाईंको ब्यालेन्सबाट छुट्याइने रकमका रूपमा। जवाफको लम्बाइको सीमाका रूपमा: होस्ट गरिएका ओपन-वेट मोडलहरू, shannon-1.6-lite, shannon-1.6-pro र shannon-coder-1। | दायराबाहिरको मान दायराको नजिकको छेउमा सारिन्छ। त्रुटि हुँदैन। |
स्टप सिक्वेन्सहरू: stop, stop_sequences | 4 स्ट्रिङ | होस्ट गरिएका ओपन-वेट मोडलहरू | खाली नभएका पहिलो 4 स्ट्रिङ प्रयोग गरिन्छ। |
| URL का रूपमा दिइएको छवि वा फाइल | 8 MiB, 20 सेकेन्डभित्र पढिने, बढीमा 5 रिडाइरेक्ट, सार्वजनिक http वा https ठेगाना | छवि वा फाइल लिने हरेक इन्डपोइन्ट | अनुरोधको जवाफ त्यो भाग बिना दिइन्छ। त्रुटि हुँदैन। |
| इनलाइन (base64) पठाइएको छवि वा फाइल | आफ्नै सीमा छैन। यो 32 MiB अनुरोध बडीमा गनिन्छ। | छवि वा फाइल लिने हरेक इन्डपोइन्ट | सम्पूर्ण अनुरोधका लागि स्टेटस 413। |
POST /v1/tokenize को text | 4,000,000 बाइट | /v1/tokenize | स्टेटस 413, प्रकार invalid_request_error, सन्देश text too long। |
POST /v1/tokenize को messages र POST /v1/messages/count_tokens को बडी | 32 MiB अनुरोध बडी | दुवै गणना इन्डपोइन्ट | स्टेटस 413। |
| कन्टेक्स्ट विन्डो | प्रति मोडल: GET /v1/models मा context_window | हरेक मोडल | लामो कुराकानीको के हुन्छ भन्ने मोडलमा निर्भर हुन्छ। मोडल र मूल्य |
वेब खोजहरू (web_search: true) | प्रति प्लान र दिन: Free 3, Plus 30, Standard 50, Pro 60। खोजले नतिजा भेटेको अनुरोधका लागि एउटा खोज गनिन्छ। | web_search: true सेट गर्ने अनुरोधहरू | केही बाँकी नरहे अनुरोधको जवाफ खोज बिना दिइन्छ। त्रुटि हुँदैन। निर्मित वेब खोज |
त्रुटिहरू
यो पेजका जवाफहरू। /v1/messages मा उही error अब्जेक्ट {"type": "error", "error": {…}} मा बेरिएको हुन्छ।
| स्थिति | प्रकार | सन्देश | कहिले, र के गर्ने |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | अनुरोधले छुट्याउनुपर्ने रकम तपाईंको ब्यालेन्समा अट्दैन। 00:00 UTC सम्म पर्खनुहोस्, क्रेडिट टप-अप गर्नुहोस्, प्लान बदल्नुहोस्, वा सानो max_tokens पठाउनुहोस्। |
429 | rate_limit_error | Too many requests. Retry in <N>s. | हालको मिनेटमा 120 भन्दा बढी अनुरोध। N सेकेन्ड पर्खनुहोस् र फेरि पठाउनुहोस्। |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | हालको 4 घण्टे विन्डोका Shannon Coder कलहरू सकिए। |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | मोडलले यस क्षण अनुरोध लिन सक्दैन। छोटो विराम पछि फेरि पठाउनुहोस्। |
503 | api_error | Could not verify your quota right now. Please retry. | तपाईंको ब्यालेन्स पढ्न सकिएन। केही शुल्क लाग्दैन; अनुरोध फेरि पठाउनुहोस्। Shannon मोडलसँग /v1/responses मा स्टेटस 500 हुन्छ। |
413 | invalid_request_error | अनुरोध बडी 32 MiB भन्दा ठूलो छ। OpenAI-ढाँचाका इन्डपोइन्टहरूमा error अब्जेक्टमा code: "request_too_large" हुन्छ। | |
413 | invalid_request_error | text too long | POST /v1/tokenize को text 4,000,000 बाइटभन्दा लामो छ। |