सामग्रीमा जानुहोस्
सीमा र ब्यालेन्स

सीमा र ब्यालेन्स

हरेक अनुरोध बराबर सेवा पाउँछ। कुनै रेट तह छैन। छुट्टै API कोटा छैन। तपाईंले आफ्ना टोकनको भुक्तानी गरिसक्नुभएको छ — जति चाहनुहुन्छ त्यति छिटो प्रयोग गर्नुहोस्।

यो पेजले तपाईंको ब्यालेन्स केले बनेको छ, एउटा अनुरोधले के छुट्याउँछ र कति लाग्छ, कति अनुरोध पठाउन सकिन्छ, र एउटा अनुरोधले भेट्न सक्ने केही सीमाहरू बताउँछ।

ब्यालेन्सका 1M टोकनको मूल्य
$5.00
दैनिक भत्ता नवीकरण
00:00 UTC
फ्लड प्रोटेक्सन, प्रति खाता
120 अनुरोध / मिनेट

अनुरोधहरू कसरी सेवामा लाग्छन्

  • कुनै रेट तह छैन — एउटा नियमले अनुरोध कति छिटो आउन सक्छ भनेर सीमित गर्छ, र यो हरेक खाता र हरेक प्लानका लागि उस्तै छ: प्रति मिनेट 120 अनुरोध। प्रति मिनेट टोकनमा कुनै सीमा छैन।
  • छुट्टै API कोटा छैन — API ले च्याटकै ब्यालेन्स खर्च गर्छ। प्लानले आजको भत्ताको आकार तोक्छ। यसले अनुरोध दर तोक्दैन।
  • जति चाहनुहुन्छ त्यति छिटो — समानान्तर पठाइएका अनुरोधहरू स्वीकार हुन्छन् र लाइनमा पर्खन्छन्। तिनीहरू समानान्तर भएकै कारण अस्वीकार गरिँदैनन्।

तपाईंको ब्यालेन्स

तपाईंको ब्यालेन्स टोकनमा गनिन्छ। ब्यालेन्सका 1,000,000 टोकनको मूल्य $5.00 हो, र Models & pricing पेजको हरेक मूल्य त्यही मूल्यसँगको दर हो।

जुनसुकै बेला ब्यालेन्स दुई भागको योग हुन्छ।

  • आजको प्लान भत्ता — तपाईंको प्लानले तोकेको टोकन संख्या। यो हरेक दिन 00:00 UTC मा नयाँ हुन्छ। दिनको अन्त्यमा बाँकी रहेको अर्को दिनमा सर्दैन।
  • खरिद गरिएको क्रेडिट — प्याकका रूपमा किनेका टोकन। क्रेडिटको म्याद सकिँदैन र Free सहित हरेक प्लानमा काम गर्छ।
प्लान प्रति दिन टोकन मूल्य
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • खर्चको क्रम — हरेक अनुरोधले पहिले आजको प्लान भत्ता खर्च गर्छ। खरिद गरिएको क्रेडिट त्यो दिन भत्ताभन्दा बाहिर जाने मात्राका लागि मात्र प्रयोग हुन्छ।
  • च्याट र API ले साझा गर्छन् — प्रति खाता एउटा ब्यालेन्स हुन्छ। API की ले त्यसको मालिक खाताको ब्यालेन्सबाट च्याटकै मूल्यमा खर्च गर्छ।
  • प्याकहरू — क्रेडिट 1,000,000 ($5.00), 2,000,000 ($10.00) र 5,000,000 ($25.00) टोकनका प्याकमा बिक्री हुन्छ, वा प्रति 1,000,000 $5.00 मा 1,000,000 देखि 100,000,000 टोकनसम्म तपाईंले रोजेको मात्रामा।

क्रेडिट टप-अप गर्नुहोस् प्लान परिवर्तन गर्नुहोस्

अनुरोधले के छुट्याउँछ र कति लाग्छ

  • छुट्याउने — अनुरोध आइपुग्दा यसले आफ्नो आउटपुट बजेट तपाईंको ब्यालेन्सबाट छुट्याउँछ: /v1/chat/completions र /v1/messages मा max_tokens, /v1/responses मा max_output_tokens। /v1/chat/completions ले max_completion_tokens पनि पढ्छ। पूर्वनिर्धारित 4,096 हो र दायरा 1 देखि 65,536 सम्म हो।
  • स्वीकार — छुट्याइएको रकम तपाईंको बाँकी ब्यालेन्समा अट्ने भए मात्र अनुरोध स्वीकार हुन्छ। शून्यभन्दा माथि तर आउटपुट बजेटभन्दा सानो ब्यालेन्सले Quota exceeded जवाफ पाउँछ। बाँकी प्रयोग गर्न सानो max_tokens पठाउनुहोस्।
  • मिलान — जवाफ पूरा हुँदा छुट्याइएको रकम वास्तविक शुल्कले बदलिन्छ। शुल्क छुट्याइएको रकमभन्दा कम वा बढी हुन सक्छ।
  • फिर्ता — त्रुटि स्टेटसमा सकिने अनुरोधले आफ्नो छुट्याइएको रकम पूरै फिर्ता गर्छ।

वास्तविक शुल्क मोडल परिवारमा निर्भर हुन्छ।

मोडलहरू के शुल्क लाग्छ
Shannon मोडलहरू मोडलको प्रति 1M मूल्यमा usage.total_tokens। इनपुट र आउटपुटको एउटै दर हुन्छ।
होस्ट गरिएका ओपन-वेट मोडलहरू क्याश नभएको इनपुट इनपुट दरमा, क्याश्ड इनपुट क्याश्ड दरमा, आउटपुट आउटपुट दरमा।

USD को रकम तपाईंको ब्यालेन्सबाट प्रति 1,000,000 $5.00 मा टोकनमा लिइन्छ, पूर्ण टोकनमा राउन्ड गरेर।

POST /v1/tokenize वा POST /v1/messages/count_tokens ले टोकन गणना गर्न निःशुल्क छ र केही छुट्याउँदैन। टोकन गणना

ब्यालेन्स र प्रयोग कहाँ हेर्ने

Keys & usage पेजले तपाईंले अहिले खर्च गर्न सक्ने रकम, आजको प्लान भत्ता, खरिद गरिएको क्रेडिट र पछिल्ला 30 दिनको API खर्च देखाउँछ। त्यसमुनि यसले तपाईंको कीले गरेका हरेक अनुरोध सूचीबद्ध गर्छ: समय, इन्डपोइन्ट, मोडल, क्याश्ड इनपुट, बिल गरिएका टोकन र लागत। की र प्रयोग

हरेक जवाफमा त्यो कलका टोकन गणना भएको usage अब्जेक्ट पनि हुन्छ।

इन्डपोइन्ट usage का फिल्डहरू होस्ट गरिएका ओपन-वेट मोडलहरूले थप्ने
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage मा मोडलका टोकन गणना हुन्छन्। तपाईंको ब्यालेन्सबाट लिइएको रकम जवाफमा हुँदैन: त्यो Keys & usage को अनुरोध सूचीको बिल गरिएका टोकन स्तम्भमा हुन्छ।
  • होस्ट गरिएको ओपन-वेट मोडलसँग /v1/messages मा, input_tokens इनपुटको क्याश नभएको भाग हो, cache_read_input_tokens क्याश्ड भाग हो र cache_creation_input_tokens सधैं 0 हुन्छ।
  • /v1/chat/completions को स्ट्रिमले [DONE] अघिको अन्तिम चङ्कमा usage बोक्छ। स्ट्रिमिङ

ब्यालेन्स सकिँदा

छुट्याउनुपर्ने रकम तपाईंको ब्यालेन्समा नअट्ने अनुरोधलाई स्टेटस 429, प्रकार rate_limit_error र तलको सन्देशसहित जवाफ दिइन्छ। केही शुल्क लाग्दैन। ब्यालेन्स शून्यभन्दा माथि तर अनुरोधको आउटपुट बजेटभन्दा सानो हुँदा पनि यही जवाफ पठाइन्छ।

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses मा error अब्जेक्टमा code र param पनि हुन सक्छन्, दुवै null।

तपाईंले के गर्न सक्नुहुन्छ:

  • 00:00 UTC मा अर्को प्लान भत्ता आउनेसम्म पर्खनुहोस्।
  • क्रेडिट टप-अप गर्नुहोस्। क्रेडिट प्लान भत्ता पछि खर्च हुन्छ र यसको म्याद सकिँदैन। क्रेडिट टप-अप गर्नुहोस्
  • ठूलो दैनिक भत्ता भएको प्लानमा परिवर्तन गर्नुहोस्। प्लान परिवर्तन गर्नुहोस्
  • केही ब्यालेन्स बाँकी भए सानो max_tokens पठाउनुहोस्: तब छुट्याइने रकम सानो हुन्छ।

Shannon Coder कल भत्ता

/v1/chat/completions र /v1/messages मा shannon-coder-1 टोकनमा होइन, कलमा गनिन्छ। हरेक प्लानमा प्रति 4 घण्टे विन्डो निश्चित संख्याका कल समावेश हुन्छन्। एउटा अनुरोध एउटा कल हो।

प्लान प्रति 4 घण्टे विन्डो कलहरू
Free 3
Plus 20
Standard 40
Pro 60
  • विन्डोहरू 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC बाट सुरु हुन्छन्। विन्डोको अन्त्यमा बाँकी कलहरू अर्कोमा सर्दैनन्।
  • अनुरोध स्वीकार हुँदा, मोडलले जवाफ दिनु अघि, कल गनिन्छ। पछि असफल भएको अनुरोध पनि एक कलका रूपमा गनिन्छ।
  • यी कलहरूले टोकन छुट्याउँदैनन् र तपाईंको ब्यालेन्सबाट केही लिँदैनन्। Keys & usage को अनुरोध सूचीले तिनको टोकन संख्या र सूचीबद्ध मूल्यमा त्यसको मूल्य देखाउँछ।
  • यी दुई इन्डपोइन्टमा shannon-coder-1 को पूर्वनिर्धारित max_tokens 65,536 हो।
  • कल बाँकी नरहेमा जवाफ स्टेटस 429, प्रकार rate_limit_error, सन्देश Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan हुन्छ।
  • /v1/responses मा shannon-coder-1 को कल भत्ता हुँदैन: अरू हरेक मोडलजस्तै यसमा तपाईंको ब्यालेन्सबाट प्रति 1M $8.00 मा टोकनमा शुल्क लाग्छ।

फ्लड प्रोटेक्सन

एउटा खाताले प्रति मिनेट 120 अनुरोध पठाउन सक्छ। अनुरोध दरमा यही एउटै सीमा हो, र यो हरेक प्लानमा उस्तै छ। यो सामान्य प्रयोग ढिलो गर्न होइन, बाढी रोक्न हो।

  • मिनेट 60 सेकेन्डको निश्चित विन्डो हो जुन तपाईंको पहिलो अनुरोधबाट खुल्छ। यो सकिँदा गणना फेरि शून्यबाट सुरु हुन्छ।
  • गणना प्रति खाता हुन्छ, प्रति की वा प्रति IP ठेगाना होइन। की बदल्दा नयाँ विन्डो खुल्दैन।
  • विन्डोभित्रको 121 औं अनुरोधलाई स्टेटस 429, प्रकार rate_limit_error र सन्देश Too many requests. Retry in <N>s. सहित जवाफ दिइन्छ। N विन्डो सकिनेसम्मको सेकेन्ड संख्या हो, 1 देखि 60 सम्म।
  • फ्लड प्रोटेक्सन ब्यालेन्स भन्दा पहिले जाँचिन्छ। यसले अस्वीकार गरेको अनुरोधले केही छुट्याउँदैन र केही लाग्दैन।
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
अनुरोध फ्लड प्रोटेक्सन
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses गनिन्छ, प्रति अनुरोध एक।
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens गनिँदैन।
/v1/chat/completions र /v1/messages मा shannon-coder-1 यसको सट्टा Shannon Coder कल भत्ताले गन्छ।
401 सहित, वा अज्ञात model का लागि 400 सहित जवाफ दिइएको अनुरोध गनिँदैन।
फ्लड प्रोटेक्सनले अस्वीकार गरेको अनुरोध विन्डोमा गनिन्छ। केही शुल्क लाग्दैन।

समानान्तर अनुरोधहरू

एउटा खाताले एकै समयमा कति अनुरोध खुला राख्न सक्छ भन्ने सीमा छैन, र समानान्तर अनुरोध पठाउँदा त्रुटि आउँदैन। तुरुन्तै सुरु हुन नसक्ने अनुरोधहरू लाइनमा पर्खन्छन् र पालैपालो जवाफ पाउँछन्।

  • अघिल्ला अनुरोध सकिएका छन् वा छैनन् भन्ने नहेरी हरेक अनुरोध आइपुग्दा प्रति मिनेट 120 मा गनिन्छ।
  • हरेक अनुरोधले सकिएसम्म आफ्नो छुट्याइएको रकम राख्छ। पूर्वनिर्धारित आउटपुट बजेटसहित बीसवटा खुला अनुरोधले 20 × 4,096 = 81,920 टोकन ब्यालेन्स राख्छन्। छुट्याइएका रकम जोडेर तपाईंको ब्यालेन्सभन्दा ठूला भए, सकिएका कलहरूको लागत कम पर्ने भए पनि, अर्को अनुरोधले Quota exceeded जवाफ पाउँछ। सानो max_tokens ले कम राख्छ।
  • स्ट्रिमिङ नगरिएको अनुरोधले जवाफ पूरा नभएसम्म केही पठाउँदैन, त्यसैले आफ्नो क्लाइन्टलाई पर्खाइ धान्ने टाइमआउट दिनुहोस्। स्ट्रिमले पर्खँदा आफ्नो कनेक्सन खुला राख्छ। स्ट्रिमिङ

एउटा अनुरोधका सीमाहरू

सीमा मान कहाँ लागू हुन्छ सीमामा पुग्दा
अनुरोध बडी 32 MiB (33,554,432 बाइट) हरेक इन्डपोइन्ट स्टेटस 413, प्रकार invalid_request_error।
आउटपुट बजेट: max_tokens, max_completion_tokens, max_output_tokens 1 देखि 65,536 सम्म। पूर्वनिर्धारित 4,096; /v1/chat/completions र /v1/messages मा shannon-coder-1 को पूर्वनिर्धारित 65,536 हो। हरेक मोडल, तपाईंको ब्यालेन्सबाट छुट्याइने रकमका रूपमा। जवाफको लम्बाइको सीमाका रूपमा: होस्ट गरिएका ओपन-वेट मोडलहरू, shannon-1.6-lite, shannon-1.6-pro र shannon-coder-1। दायराबाहिरको मान दायराको नजिकको छेउमा सारिन्छ। त्रुटि हुँदैन।
स्टप सिक्वेन्सहरू: stop, stop_sequences 4 स्ट्रिङ होस्ट गरिएका ओपन-वेट मोडलहरू खाली नभएका पहिलो 4 स्ट्रिङ प्रयोग गरिन्छ।
URL का रूपमा दिइएको छवि वा फाइल 8 MiB, 20 सेकेन्डभित्र पढिने, बढीमा 5 रिडाइरेक्ट, सार्वजनिक http वा https ठेगाना छवि वा फाइल लिने हरेक इन्डपोइन्ट अनुरोधको जवाफ त्यो भाग बिना दिइन्छ। त्रुटि हुँदैन।
इनलाइन (base64) पठाइएको छवि वा फाइल आफ्नै सीमा छैन। यो 32 MiB अनुरोध बडीमा गनिन्छ। छवि वा फाइल लिने हरेक इन्डपोइन्ट सम्पूर्ण अनुरोधका लागि स्टेटस 413।
POST /v1/tokenize को text 4,000,000 बाइट /v1/tokenize स्टेटस 413, प्रकार invalid_request_error, सन्देश text too long।
POST /v1/tokenize को messages र POST /v1/messages/count_tokens को बडी 32 MiB अनुरोध बडी दुवै गणना इन्डपोइन्ट स्टेटस 413।
कन्टेक्स्ट विन्डो प्रति मोडल: GET /v1/models मा context_window हरेक मोडल लामो कुराकानीको के हुन्छ भन्ने मोडलमा निर्भर हुन्छ। मोडल र मूल्य
वेब खोजहरू (web_search: true) प्रति प्लान र दिन: Free 3, Plus 30, Standard 50, Pro 60। खोजले नतिजा भेटेको अनुरोधका लागि एउटा खोज गनिन्छ। web_search: true सेट गर्ने अनुरोधहरू केही बाँकी नरहे अनुरोधको जवाफ खोज बिना दिइन्छ। त्रुटि हुँदैन। निर्मित वेब खोज

त्रुटिहरू

यो पेजका जवाफहरू। /v1/messages मा उही error अब्जेक्ट {"type": "error", "error": {…}} मा बेरिएको हुन्छ।

स्थिति प्रकार सन्देश कहिले, र के गर्ने
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan अनुरोधले छुट्याउनुपर्ने रकम तपाईंको ब्यालेन्समा अट्दैन। 00:00 UTC सम्म पर्खनुहोस्, क्रेडिट टप-अप गर्नुहोस्, प्लान बदल्नुहोस्, वा सानो max_tokens पठाउनुहोस्।
429 rate_limit_error Too many requests. Retry in <N>s. हालको मिनेटमा 120 भन्दा बढी अनुरोध। N सेकेन्ड पर्खनुहोस् र फेरि पठाउनुहोस्।
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan हालको 4 घण्टे विन्डोका Shannon Coder कलहरू सकिए।
429 rate_limit_error Shannon routes are temporarily busy. Please retry. मोडलले यस क्षण अनुरोध लिन सक्दैन। छोटो विराम पछि फेरि पठाउनुहोस्।
503 api_error Could not verify your quota right now. Please retry. तपाईंको ब्यालेन्स पढ्न सकिएन। केही शुल्क लाग्दैन; अनुरोध फेरि पठाउनुहोस्। Shannon मोडलसँग /v1/responses मा स्टेटस 500 हुन्छ।
413 invalid_request_error अनुरोध बडी 32 MiB भन्दा ठूलो छ। OpenAI-ढाँचाका इन्डपोइन्टहरूमा error अब्जेक्टमा code: "request_too_large" हुन्छ।
413 invalid_request_error text too long POST /v1/tokenize को text 4,000,000 बाइटभन्दा लामो छ।