ወደ ይዘቱ እለፍ
ገደቦች እና ቀሪ ሂሳብ

ገደቦች እና ቀሪ ሂሳብ

እያንዳንዱ ጥያቄ እኩል ይስተናገዳል። የፍጥነት ደረጃዎች የሉም። የተለየ የAPI quota የለም። ለtokens ክፍያዎን ቀድመው ከፍለዋል — በፈለጉት ፍጥነት ይጠቀሙባቸው።

ይህ ገጽ ቀሪ ሂሳብዎ ከምን እንደተሠራ፣ አንድ ጥያቄ ምን እንደሚይዝና እንደሚያስከፍል፣ ስንት ጥያቄዎች መላክ እንደሚችሉ፣ እና አንድ ጥያቄ ሊያጋጥመው የሚችሉትን ጥቂት ገደቦች ያብራራል።

የ1M tokens ቀሪ ሂሳብ ዋጋ
$5.00
ዕለታዊ መጠን ይታደሳል
00:00 UTC
የጥያቄ ብዛት ጥበቃ፣ በመለያ
120 ጥያቄዎች / ደቂቃ

ጥያቄዎች እንዴት እንደሚስተናገዱ

  • የፍጥነት ደረጃዎች የሉም — ጥያቄዎች ምን ያህል በፍጥነት ሊደርሱ እንደሚችሉ አንድ ሕግ ይገድባል፣ ለእያንዳንዱ መለያና ዕቅድ ተመሳሳይ ነው፦ በደቂቃ 120 ጥያቄዎች። በደቂቃ በሚወጡ tokens ላይ ገደብ የለም።
  • የተለየ የAPI quota የለም — API ከchat ጋር ተመሳሳዩን ቀሪ ሂሳብ ያወጣል። ዕቅድ የዛሬውን ዕለታዊ መጠን መጠን ይወስናል። የጥያቄ ፍጥነትን አይወስንም።
  • በፈለጉት ፍጥነት — በትይዩ የተላኩ ጥያቄዎች ተቀባይነት ያገኛሉ እና ተራ ይጠብቃሉ። በትይዩነታቸው ምክንያት አይከለከሉም።

ቀሪ ሂሳብዎ

ቀሪ ሂሳብዎ በtokens ይቆጠራል። 1,000,000 tokens ቀሪ ሂሳብ $5.00 ዋጋ አለው፣ እና በModels & pricing ገጽ ላይ ያለው እያንዳንዱ ዋጋ ከዚያ ዋጋ አንጻር የተሰላ ነው።

በማንኛውም ጊዜ ቀሪ ሂሳቡ የሁለት ክፍሎች ድምር ነው።

  • የዛሬው የዕቅድ ዕለታዊ መጠን — በዕቅድዎ የሚወሰን የtokens ብዛት። በየቀኑ በ00:00 UTC አዲስ ይሆናል። በቀኑ መጨረሻ የቀረው ወደ ቀጣዩ አይተላለፍም።
  • የተገዛ ክሬዲት — እንደ pack የገዙት tokens። ክሬዲት አያልቅም እና Freeን ጨምሮ በእያንዳንዱ ዕቅድ ላይ ይሰራል።
ዕቅድ Tokens በቀን ዋጋ
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • የወጪ ቅደም ተከተል — እያንዳንዱ ጥያቄ መጀመሪያ የዛሬውን የዕቅድ ዕለታዊ መጠን ያወጣል። የተገዛ ክሬዲት የሚውለው በዚያ ቀን ከዕለታዊ መጠኑ ለሚበልጠው ብቻ ነው።
  • Chat እና API ይጋሩታል — በአንድ መለያ አንድ ቀሪ ሂሳብ አለ። API ቁልፍ ከባለቤቱ መለያ ቀሪ ሂሳብ ያወጣል፣ ከchat ጋር በተመሳሳይ ዋጋ።
  • Packs — ክሬዲት በ1,000,000 ($5.00)፣ 2,000,000 ($10.00) እና 5,000,000 ($25.00) tokens packs ይሸጣል፣ ወይም ከ1,000,000 እስከ 100,000,000 tokens በመረጡት መጠን በ1,000,000 $5.00 ዋጋ።

ክሬዲት መሙላ திት መቀየር

ጥያቄ ምን እንደሚይዝና ምን እንደሚያስከፍል

  • መያዝ — ጥያቄ ሲደርስ የውጤት በጀቱን ከቀሪ ሂሳብዎ ይይዛል፦ በ/v1/chat/completions እና በ/v1/messages ላይ max_tokens፣ በ/v1/responses ላይ max_output_tokens። /v1/chat/completions max_completion_tokensንም ያነባል። default 4,096 ሲሆን ክልሉ ከ1 እስከ 65,536 ነው።
  • መቀበል — ጥያቄው ተቀባይነት የሚያገኘው መያዣው በቀሪ ሂሳብዎ ውስጥ ከገባ ብቻ ነው። ከዜሮ በላይ ሆኖ ከውጤት በጀቱ ያነሰ ቀሪ ሂሳብ Quota exceeded ምላሽ ያገኛል። የቀረውን ለመጠቀም ያነሰ max_tokens ይላኩ።
  • ማወራረድ — መልሱ ሲጠናቀቅ መያዣው በእውነተኛው ክፍያ ይተካል። ክፍያው ከመያዣው ሊያንስ ወይም ሊበልጥ ይችላል።
  • መመለስ — በስህተት status የሚያበቃ ጥያቄ መያዣውን ሙሉ በሙሉ ይመልሳል።

እውነተኛው ክፍያ በሞዴሉ ቤተሰብ ላይ ይመሰረታል።

ሞዴሎች የሚከፈለው
የShannon ሞዴሎች usage.total_tokens በሞዴሉ በ1M ዋጋ። Input እና output አንድ ዋጋ አላቸው።
የተስተናገዱ open-weight ሞዴሎች ያልተቀመጠው የግብዓት ክፍል (uncached input) በግብዓት ዋጋ፣ ከcache የተነበበው ግብዓት በcached ዋጋ፣ ውጤቱ (output) በውጤት ዋጋ ይከፈላል።

በUSD ያለው መጠን ከቀሪ ሂሳብዎ በtokens በ1,000,000 $5.00 ተሰልቶ ወደ ሙሉ token ተጠጋግቶ ይወሰዳል።

በPOST /v1/tokenize ወይም በPOST /v1/messages/count_tokens tokens መቁጠር ነፃ ነው እና ምንም አይመድብም። የToken ቆጠራ

ቀሪ ሂሳብንና አጠቃቀምን የት ማየት

Keys & usage ገጽ አሁን ማውጣት የሚችሉትን፣ የዛሬውን የዕቅድ ዕለታዊ መጠን፣ የገዙትን ክሬዲት እና የባለፉት 30 ቀናት የAPI ወጪ ያሳያል። ከዚያ በታች ቁልፍዎ ያደረገውን እያንዳንዱን ጥያቄ ይዘረዝራል፦ ሰዓት፣ endpoint፣ ሞዴል፣ cached input፣ የተከፈለባቸው tokens እና ወጪ። Keys & usage

እያንዳንዱ ምላሽ የዚያን ጥሪ የtoken ቆጠራ የያዘ usage object ይይዛል።

ኤንድ-ፖይንት (Endpoint) የusage መስኮች በተስተናገዱ open-weight ሞዴሎች የሚጨመር
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage የሞዴሉን የtoken ቆጠራ ይይዛል። ከቀሪ ሂሳብዎ የተወሰደው መጠን በምላሹ ውስጥ የለም፦ በKeys & usage ላይ ባለው የጥያቄ ዝርዝር Billed tokens ዓምድ ውስጥ ነው።
  • በ/v1/messages ላይ ከተስተናገደ open-weight ሞዴል ጋር input_tokens የinput ያልተቀመጠው (uncached) ክፍል ነው፣ cache_read_input_tokens የተቀመጠው ክፍል ነው፣ እና cache_creation_input_tokens ሁልጊዜ 0 ነው።
  • በ/v1/chat/completions ላይ stream usageን ከ[DONE] በፊት በመጨረሻው chunk ይይዛል። ስትሪሚንግ

ቀሪ ሂሳቡ ሲያልቅ

መያዣው በቀሪ ሂሳብዎ ውስጥ የማይገባ ጥያቄ በstatus 429፣ በአይነት rate_limit_error እና ከታች ባለው መልእክት ይመለሳል። ምንም አይከፈልም። ቀሪ ሂሳቡ ከዜሮ በላይ ሆኖ ከጥያቄው የውጤት በጀት ሲያንስም ተመሳሳይ ምላሽ ይላካል።

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

በ/v1/responses ላይ የerror object code እና param ሊይዝ ይችላል፣ ሁለቱም null።

ማድረግ የሚችሉት፦

  • በ00:00 UTC የሚመጣውን ቀጣይ የዕቅድ ዕለታዊ መጠን ይጠብቁ።
  • ክሬዲት ይሙሉ። ክሬዲት ከዕቅዱ ዕለታዊ መጠን በኋላ ይውላል እና አያልቅም። ክሬዲት መሙላ
  • ትልቅ ዕለታዊ መጠን ወዳለው ዕቅድ ይቀይሩ። திት መቀየር
  • ቀሪ ሂሳብ ካለ ያነሰ max_tokens ይላኩ፦ ያኔ መያዣው ያነሰ ይሆናል።

የShannon Coder የጥሪ መጠን

በ/v1/chat/completions እና በ/v1/messages ላይ shannon-coder-1 በጥሪዎች ይቆጠራል እንጂ በtokens አይደለም። እያንዳንዱ ዕቅድ በ4-ሰዓት መስኮት የተወሰነ የጥሪ ብዛት ያካትታል። አንድ ጥያቄ አንድ ጥሪ ነው።

ዕቅድ ጥሪዎች በ4-ሰዓት መስኮት
Free 3
Plus 20
Standard 40
Pro 60
  • መስኮቶች በ00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC ይጀምራሉ። በመስኮት መጨረሻ የቀሩ ጥሪዎች ወደ ቀጣዩ አይተላለፉም።
  • ጥሪ የሚቆጠረው ጥያቄው ተቀባይነት ሲያገኝ ነው፣ ሞዴሉ ከመመለሱ በፊት። ከዚያ በኋላ የሚከሽፍ ጥያቄም እንደ ጥሪ ይቆጠራል።
  • እነዚህ ጥሪዎች ምንም tokens አይመድቡም እና ከቀሪ ሂሳብዎ ምንም አይወስዱም። በKeys & usage ላይ ያለው የጥያቄ ዝርዝር የtoken ቆጠራቸውን እና በተዘረዘረው ዋጋ ያላቸውን ዋጋ ያሳያል።
  • በእነዚህ ሁለት endpoints ላይ የshannon-coder-1 default max_tokens 65,536 ነው።
  • ጥሪዎች ሲያልቁ ምላሹ status 429፣ አይነት rate_limit_error፣ መልእክት Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan ነው።
  • በ/v1/responses ላይ shannon-coder-1 የጥሪ መጠን የለውም፦ እንደ ሌሎች ሞዴሎች ሁሉ ከቀሪ ሂሳብዎ በtokens በ1M $8.00 ይከፈላል።

የጥያቄ ብዛት ጥበቃ

አንድ መለያ በደቂቃ 120 ጥያቄዎች ሊልክ ይችላል። ይህ በጥያቄ ፍጥነት ላይ ያለው ብቸኛ ገደብ ነው፣ እና በእያንዳንዱ ዕቅድ ተመሳሳይ ነው። የተፈጠረው ጎርፍን ለማስቆም እንጂ መደበኛ አጠቃቀምን ለማዘግየት አይደለም።

  • ደቂቃው በመጀመሪያ ጥያቄዎ የሚከፈት የ60 ሰከንድ ቋሚ መስኮት ነው። ሲያልቅ ቆጠራው እንደገና ከዜሮ ይጀምራል።
  • ቆጠራው በመለያ ነው፣ በቁልፍም በIP አድራሻም አይደለም። ቁልፉን መቀየር አዲስ መስኮት አይከፍትም።
  • በመስኮት ውስጥ 121ኛው ጥያቄ በstatus 429፣ በአይነት rate_limit_error እና በመልእክቱ Too many requests. Retry in <N>s. ይመለሳል። N መስኮቱ እስኪያልቅ ያሉት ሰከንዶች ብዛት ነው፣ ከ1 እስከ 60።
  • የጥያቄ ብዛት ጥበቃ ከቀሪ ሂሳቡ በፊት ይፈተሻል። የሚከለክለው ጥያቄ ምንም አይይዝም እና ምንም አያስከፍልም።
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
ጥያቄ የጥያቄ ብዛት ጥበቃ
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses ይቆጠራል፣ በአንድ ጥያቄ አንድ።
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens አይቆጠርም።
በ/v1/chat/completions እና በ/v1/messages ላይ shannon-coder-1 በምትኩ በShannon Coder የጥሪ መጠን ይቆጠራል።
በ401 ወይም ለማይታወቅ model በ400 የተመለሰ ጥያቄ አይቆጠርም።
በጥያቄ ብዛት ጥበቃ የተከለከለ ጥያቄ ወደ መስኮቱ ይቆጠራል። ምንም አይከፈልም።

ትይዩ ጥያቄዎች

አንድ መለያ በአንድ ጊዜ ስንት ጥያቄዎች ክፍት ማድረግ እንደሚችል ገደብ የለም፣ በትይዩ ለመላክም ስህተት የለም። ወዲያውኑ መጀመር የማይችሉ ጥያቄዎች ተራ ይጠብቃሉ እና በየተራ ይመለሳሉ።

  • እያንዳንዱ ጥያቄ ሲደርስ ወደ 120 በደቂቃው ይቆጠራል፣ ቀደምት ጥያቄዎች ቢጠናቀቁም ባይጠናቀቁም።
  • እያንዳንዱ ጥያቄ እስኪያልቅ የራሱን መያዣ ይይዛል። በdefault የውጤት በጀት የተከፈቱ ሃያ ጥያቄዎች 20 × 4,096 = 81,920 tokens ቀሪ ሂሳብ ይይዛሉ። መያዣዎቹ በአንድ ላይ ከቀሪ ሂሳብዎ ከበለጡ፣ የተጠናቀቁ ጥሪዎች ያነሰ ቢያስከፍሉም ቀጣዩ ጥያቄ Quota exceeded ምላሽ ያገኛል። ያነሰ max_tokens ያነሰ ይይዛል።
  • stream የሌለው ጥያቄ መልሱ እስኪጠናቀቅ ምንም አይልክም፣ ስለዚህ ለ client ጥበቃውን የሚሸፍን timeout ይስጡት። stream በሚጠብቅበት ጊዜ ግንኙነቱን ክፍት ያደርጋል። ስትሪሚንግ

የአንድ ጥያቄ ገደቦች

ገደብ እሴት የሚመለከተው ገደቡ ላይ ሲደርስ
የጥያቄ body 32 MiB (33,554,432 ባይቶች) እያንዳንዱ endpoint Status 413፣ አይነት invalid_request_error።
የውጤት በጀት፦ max_tokens፣ max_completion_tokens፣ max_output_tokens ከ1 እስከ 65,536። Default 4,096፤ በ/v1/chat/completions እና በ/v1/messages ላይ ለshannon-coder-1 default 65,536 ነው። እያንዳንዱ ሞዴል፣ ከቀሪ ሂሳብዎ እንደሚያዝ መጠን። የመልሱ ርዝመት ገደብ እንደሆነ፦ የተስተናገዱ open-weight ሞዴሎች፣ shannon-1.6-lite፣ shannon-1.6-pro እና shannon-coder-1። ከክልሉ ውጭ ያለ እሴት ወደ ቅርቡ የክልል ጫፍ ይወሰዳል። ስህተት የለም።
የማቆሚያ ቅደም ተከተሎች፦ stop፣ stop_sequences 4 strings የተስተናገዱ open-weight ሞዴሎች የመጀመሪያዎቹ 4 ባዶ ያልሆኑ strings ይጠቀማሉ።
እንደ URL የተሰጠ ምስል ወይም ፋይል 8 MiB፣ በ20 ሰከንድ ውስጥ የሚነበብ፣ ቢበዛ 5 redirects፣ የህዝብ http ወይም https አድራሻ ምስሎችን ወይም ፋይሎችን የሚቀበል እያንዳንዱ endpoint ጥያቄው ያለዚያ ክፍል ይመለሳል። ስህተት የለም።
በውስጠ-ጥያቄ የተላከ ምስል ወይም ፋይል (base64) የራሱ ገደብ የለውም። ወደ 32 MiB የጥያቄ body ይቆጠራል። ምስሎችን ወይም ፋይሎችን የሚቀበል እያንዳንዱ endpoint ለጠቅላላው ጥያቄ Status 413።
የPOST /v1/tokenize text 4,000,000 ባይቶች /v1/tokenize Status 413፣ አይነት invalid_request_error፣ መልእክት text too long።
የPOST /v1/tokenize messages እና የPOST /v1/messages/count_tokens body 32 MiB የጥያቄ body ሁለቱም የመቁጠሪያ endpoints Status 413።
Context window በሞዴል፦ በGET /v1/models ውስጥ context_window እያንዳንዱ ሞዴል ከዚያ የሚረዝም ውይይት ምን እንደሚሆን በሞዴሉ ላይ ይመሰረታል። ሞዴሎችና ዋጋ
የድር ፍለጋዎች (web_search: true) በዕቅድ እና በቀን፦ Free 3፣ Plus 30፣ Standard 50፣ Pro 60። ፍለጋው ውጤት ላገኘ ጥያቄ አንድ ፍለጋ ይቆጠራል። web_search: true ያዘጋጁ ጥያቄዎች ምንም ሲቀር ጥያቄው ያለ ፍለጋ ይመለሳል። ስህተት የለም። የተገናኘ ድር ፍለጋ

ስህተቶች

የዚህ ገጽ ምላሾች። በ/v1/messages ላይ ተመሳሳዩ error object እንደ {"type": "error", "error": {…}} ይጠቀለላል።

ሁኔታ ዓይነት መልእክት መቼ፣ እና ምን ማድረግ
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan የጥያቄው መያዣ በቀሪ ሂሳብዎ ውስጥ አይገባም። 00:00 UTC ይጠብቁ፣ ክሬዲት ይሙሉ፣ ዕቅድ ይቀይሩ፣ ወይም ያነሰ max_tokens ይላኩ።
429 rate_limit_error Too many requests. Retry in <N>s. በአሁኑ ደቂቃ ከ120 በላይ ጥያቄዎች። N ሰከንዶች ይጠብቁ እና እንደገና ይላኩ።
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan የአሁኑ የ4-ሰዓት መስኮት የShannon Coder ጥሪዎች አልቀዋል።
429 rate_limit_error Shannon routes are temporarily busy. Please retry. ሞዴሉ በዚህ ጊዜ ጥያቄውን መቀበል አይችልም። ከአጭር ቆይታ በኋላ እንደገና ይላኩት።
503 api_error Could not verify your quota right now. Please retry. ቀሪ ሂሳብዎ ሊነበብ አልቻለም። ምንም አይከፈልም፤ ጥያቄውን እንደገና ይላኩ። በ/v1/responses ላይ ከShannon ሞዴል ጋር status 500 ነው።
413 invalid_request_error የጥያቄው body ከ32 MiB ይበልጣል። በOpenAI-ፎርማት endpoints ላይ የerror object code: "request_too_large" ይይዛል።
413 invalid_request_error text too long የPOST /v1/tokenize text ከ4,000,000 ባይቶች ይረዝማል።