ገደቦች እና ቀሪ ሂሳብ
እያንዳንዱ ጥያቄ እኩል ይስተናገዳል። የፍጥነት ደረጃዎች የሉም። የተለየ የAPI quota የለም። ለtokens ክፍያዎን ቀድመው ከፍለዋል — በፈለጉት ፍጥነት ይጠቀሙባቸው።
ይህ ገጽ ቀሪ ሂሳብዎ ከምን እንደተሠራ፣ አንድ ጥያቄ ምን እንደሚይዝና እንደሚያስከፍል፣ ስንት ጥያቄዎች መላክ እንደሚችሉ፣ እና አንድ ጥያቄ ሊያጋጥመው የሚችሉትን ጥቂት ገደቦች ያብራራል።
- የ1M tokens ቀሪ ሂሳብ ዋጋ
- $5.00
- ዕለታዊ መጠን ይታደሳል
- 00:00 UTC
- የጥያቄ ብዛት ጥበቃ፣ በመለያ
- 120 ጥያቄዎች / ደቂቃ
ጥያቄዎች እንዴት እንደሚስተናገዱ
- የፍጥነት ደረጃዎች የሉም — ጥያቄዎች ምን ያህል በፍጥነት ሊደርሱ እንደሚችሉ አንድ ሕግ ይገድባል፣ ለእያንዳንዱ መለያና ዕቅድ ተመሳሳይ ነው፦ በደቂቃ 120 ጥያቄዎች። በደቂቃ በሚወጡ tokens ላይ ገደብ የለም።
- የተለየ የAPI quota የለም — API ከchat ጋር ተመሳሳዩን ቀሪ ሂሳብ ያወጣል። ዕቅድ የዛሬውን ዕለታዊ መጠን መጠን ይወስናል። የጥያቄ ፍጥነትን አይወስንም።
- በፈለጉት ፍጥነት — በትይዩ የተላኩ ጥያቄዎች ተቀባይነት ያገኛሉ እና ተራ ይጠብቃሉ። በትይዩነታቸው ምክንያት አይከለከሉም።
ቀሪ ሂሳብዎ
ቀሪ ሂሳብዎ በtokens ይቆጠራል። 1,000,000 tokens ቀሪ ሂሳብ $5.00 ዋጋ አለው፣ እና በModels & pricing ገጽ ላይ ያለው እያንዳንዱ ዋጋ ከዚያ ዋጋ አንጻር የተሰላ ነው።
በማንኛውም ጊዜ ቀሪ ሂሳቡ የሁለት ክፍሎች ድምር ነው።
- የዛሬው የዕቅድ ዕለታዊ መጠን — በዕቅድዎ የሚወሰን የtokens ብዛት። በየቀኑ በ00:00 UTC አዲስ ይሆናል። በቀኑ መጨረሻ የቀረው ወደ ቀጣዩ አይተላለፍም።
- የተገዛ ክሬዲት — እንደ pack የገዙት tokens። ክሬዲት አያልቅም እና Freeን ጨምሮ በእያንዳንዱ ዕቅድ ላይ ይሰራል።
| ዕቅድ | Tokens በቀን | ዋጋ |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- የወጪ ቅደም ተከተል — እያንዳንዱ ጥያቄ መጀመሪያ የዛሬውን የዕቅድ ዕለታዊ መጠን ያወጣል። የተገዛ ክሬዲት የሚውለው በዚያ ቀን ከዕለታዊ መጠኑ ለሚበልጠው ብቻ ነው።
- Chat እና API ይጋሩታል — በአንድ መለያ አንድ ቀሪ ሂሳብ አለ። API ቁልፍ ከባለቤቱ መለያ ቀሪ ሂሳብ ያወጣል፣ ከchat ጋር በተመሳሳይ ዋጋ።
- Packs — ክሬዲት በ1,000,000 ($5.00)፣ 2,000,000 ($10.00) እና 5,000,000 ($25.00) tokens packs ይሸጣል፣ ወይም ከ1,000,000 እስከ 100,000,000 tokens በመረጡት መጠን በ1,000,000 $5.00 ዋጋ።
ጥያቄ ምን እንደሚይዝና ምን እንደሚያስከፍል
- መያዝ — ጥያቄ ሲደርስ የውጤት በጀቱን ከቀሪ ሂሳብዎ ይይዛል፦ በ
/v1/chat/completionsእና በ/v1/messagesላይmax_tokens፣ በ/v1/responsesላይmax_output_tokens።/v1/chat/completionsmax_completion_tokensንም ያነባል። default 4,096 ሲሆን ክልሉ ከ1 እስከ 65,536 ነው። - መቀበል — ጥያቄው ተቀባይነት የሚያገኘው መያዣው በቀሪ ሂሳብዎ ውስጥ ከገባ ብቻ ነው። ከዜሮ በላይ ሆኖ ከውጤት በጀቱ ያነሰ ቀሪ ሂሳብ
Quota exceededምላሽ ያገኛል። የቀረውን ለመጠቀም ያነሰmax_tokensይላኩ። - ማወራረድ — መልሱ ሲጠናቀቅ መያዣው በእውነተኛው ክፍያ ይተካል። ክፍያው ከመያዣው ሊያንስ ወይም ሊበልጥ ይችላል።
- መመለስ — በስህተት status የሚያበቃ ጥያቄ መያዣውን ሙሉ በሙሉ ይመልሳል።
እውነተኛው ክፍያ በሞዴሉ ቤተሰብ ላይ ይመሰረታል።
| ሞዴሎች | የሚከፈለው |
|---|---|
| የShannon ሞዴሎች | usage.total_tokens በሞዴሉ በ1M ዋጋ። Input እና output አንድ ዋጋ አላቸው። |
| የተስተናገዱ open-weight ሞዴሎች | ያልተቀመጠው የግብዓት ክፍል (uncached input) በግብዓት ዋጋ፣ ከcache የተነበበው ግብዓት በcached ዋጋ፣ ውጤቱ (output) በውጤት ዋጋ ይከፈላል። |
በUSD ያለው መጠን ከቀሪ ሂሳብዎ በtokens በ1,000,000 $5.00 ተሰልቶ ወደ ሙሉ token ተጠጋግቶ ይወሰዳል።
በPOST /v1/tokenize ወይም በPOST /v1/messages/count_tokens tokens መቁጠር ነፃ ነው እና ምንም አይመድብም። የToken ቆጠራ
ቀሪ ሂሳብንና አጠቃቀምን የት ማየት
Keys & usage ገጽ አሁን ማውጣት የሚችሉትን፣ የዛሬውን የዕቅድ ዕለታዊ መጠን፣ የገዙትን ክሬዲት እና የባለፉት 30 ቀናት የAPI ወጪ ያሳያል። ከዚያ በታች ቁልፍዎ ያደረገውን እያንዳንዱን ጥያቄ ይዘረዝራል፦ ሰዓት፣ endpoint፣ ሞዴል፣ cached input፣ የተከፈለባቸው tokens እና ወጪ። Keys & usage
እያንዳንዱ ምላሽ የዚያን ጥሪ የtoken ቆጠራ የያዘ usage object ይይዛል።
| ኤንድ-ፖይንት (Endpoint) | የusage መስኮች | በተስተናገዱ open-weight ሞዴሎች የሚጨመር |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageየሞዴሉን የtoken ቆጠራ ይይዛል። ከቀሪ ሂሳብዎ የተወሰደው መጠን በምላሹ ውስጥ የለም፦ በKeys & usage ላይ ባለው የጥያቄ ዝርዝር Billed tokens ዓምድ ውስጥ ነው።- በ
/v1/messagesላይ ከተስተናገደ open-weight ሞዴል ጋርinput_tokensየinput ያልተቀመጠው (uncached) ክፍል ነው፣cache_read_input_tokensየተቀመጠው ክፍል ነው፣ እናcache_creation_input_tokensሁልጊዜ0ነው። - በ
/v1/chat/completionsላይ streamusageን ከ[DONE]በፊት በመጨረሻው chunk ይይዛል። ስትሪሚንግ
ቀሪ ሂሳቡ ሲያልቅ
መያዣው በቀሪ ሂሳብዎ ውስጥ የማይገባ ጥያቄ በstatus 429፣ በአይነት rate_limit_error እና ከታች ባለው መልእክት ይመለሳል። ምንም አይከፈልም። ቀሪ ሂሳቡ ከዜሮ በላይ ሆኖ ከጥያቄው የውጤት በጀት ሲያንስም ተመሳሳይ ምላሽ ይላካል።
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} በ/v1/responses ላይ የerror object code እና param ሊይዝ ይችላል፣ ሁለቱም null።
ማድረግ የሚችሉት፦
- በ00:00 UTC የሚመጣውን ቀጣይ የዕቅድ ዕለታዊ መጠን ይጠብቁ።
- ክሬዲት ይሙሉ። ክሬዲት ከዕቅዱ ዕለታዊ መጠን በኋላ ይውላል እና አያልቅም። ክሬዲት መሙላ
- ትልቅ ዕለታዊ መጠን ወዳለው ዕቅድ ይቀይሩ። திት መቀየር
- ቀሪ ሂሳብ ካለ ያነሰ
max_tokensይላኩ፦ ያኔ መያዣው ያነሰ ይሆናል።
የShannon Coder የጥሪ መጠን
በ/v1/chat/completions እና በ/v1/messages ላይ shannon-coder-1 በጥሪዎች ይቆጠራል እንጂ በtokens አይደለም። እያንዳንዱ ዕቅድ በ4-ሰዓት መስኮት የተወሰነ የጥሪ ብዛት ያካትታል። አንድ ጥያቄ አንድ ጥሪ ነው።
| ዕቅድ | ጥሪዎች በ4-ሰዓት መስኮት |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- መስኮቶች በ00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC ይጀምራሉ። በመስኮት መጨረሻ የቀሩ ጥሪዎች ወደ ቀጣዩ አይተላለፉም።
- ጥሪ የሚቆጠረው ጥያቄው ተቀባይነት ሲያገኝ ነው፣ ሞዴሉ ከመመለሱ በፊት። ከዚያ በኋላ የሚከሽፍ ጥያቄም እንደ ጥሪ ይቆጠራል።
- እነዚህ ጥሪዎች ምንም tokens አይመድቡም እና ከቀሪ ሂሳብዎ ምንም አይወስዱም። በKeys & usage ላይ ያለው የጥያቄ ዝርዝር የtoken ቆጠራቸውን እና በተዘረዘረው ዋጋ ያላቸውን ዋጋ ያሳያል።
- በእነዚህ ሁለት endpoints ላይ የ
shannon-coder-1defaultmax_tokens65,536 ነው። - ጥሪዎች ሲያልቁ ምላሹ status
429፣ አይነትrate_limit_error፣ መልእክትShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/planነው። - በ
/v1/responsesላይshannon-coder-1የጥሪ መጠን የለውም፦ እንደ ሌሎች ሞዴሎች ሁሉ ከቀሪ ሂሳብዎ በtokens በ1M $8.00 ይከፈላል።
የጥያቄ ብዛት ጥበቃ
አንድ መለያ በደቂቃ 120 ጥያቄዎች ሊልክ ይችላል። ይህ በጥያቄ ፍጥነት ላይ ያለው ብቸኛ ገደብ ነው፣ እና በእያንዳንዱ ዕቅድ ተመሳሳይ ነው። የተፈጠረው ጎርፍን ለማስቆም እንጂ መደበኛ አጠቃቀምን ለማዘግየት አይደለም።
- ደቂቃው በመጀመሪያ ጥያቄዎ የሚከፈት የ60 ሰከንድ ቋሚ መስኮት ነው። ሲያልቅ ቆጠራው እንደገና ከዜሮ ይጀምራል።
- ቆጠራው በመለያ ነው፣ በቁልፍም በIP አድራሻም አይደለም። ቁልፉን መቀየር አዲስ መስኮት አይከፍትም።
- በመስኮት ውስጥ 121ኛው ጥያቄ በstatus
429፣ በአይነትrate_limit_errorእና በመልእክቱToo many requests. Retry in <N>s.ይመለሳል።Nመስኮቱ እስኪያልቅ ያሉት ሰከንዶች ብዛት ነው፣ ከ1 እስከ 60። - የጥያቄ ብዛት ጥበቃ ከቀሪ ሂሳቡ በፊት ይፈተሻል። የሚከለክለው ጥያቄ ምንም አይይዝም እና ምንም አያስከፍልም።
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | ጥያቄ | የጥያቄ ብዛት ጥበቃ |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | ይቆጠራል፣ በአንድ ጥያቄ አንድ። |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | አይቆጠርም። |
በ/v1/chat/completions እና በ/v1/messages ላይ shannon-coder-1 | በምትኩ በShannon Coder የጥሪ መጠን ይቆጠራል። |
በ401 ወይም ለማይታወቅ model በ400 የተመለሰ ጥያቄ | አይቆጠርም። |
| በጥያቄ ብዛት ጥበቃ የተከለከለ ጥያቄ | ወደ መስኮቱ ይቆጠራል። ምንም አይከፈልም። |
ትይዩ ጥያቄዎች
አንድ መለያ በአንድ ጊዜ ስንት ጥያቄዎች ክፍት ማድረግ እንደሚችል ገደብ የለም፣ በትይዩ ለመላክም ስህተት የለም። ወዲያውኑ መጀመር የማይችሉ ጥያቄዎች ተራ ይጠብቃሉ እና በየተራ ይመለሳሉ።
- እያንዳንዱ ጥያቄ ሲደርስ ወደ 120 በደቂቃው ይቆጠራል፣ ቀደምት ጥያቄዎች ቢጠናቀቁም ባይጠናቀቁም።
- እያንዳንዱ ጥያቄ እስኪያልቅ የራሱን መያዣ ይይዛል። በdefault የውጤት በጀት የተከፈቱ ሃያ ጥያቄዎች 20 × 4,096 = 81,920 tokens ቀሪ ሂሳብ ይይዛሉ። መያዣዎቹ በአንድ ላይ ከቀሪ ሂሳብዎ ከበለጡ፣ የተጠናቀቁ ጥሪዎች ያነሰ ቢያስከፍሉም ቀጣዩ ጥያቄ
Quota exceededምላሽ ያገኛል። ያነሰmax_tokensያነሰ ይይዛል። - stream የሌለው ጥያቄ መልሱ እስኪጠናቀቅ ምንም አይልክም፣ ስለዚህ ለ client ጥበቃውን የሚሸፍን timeout ይስጡት። stream በሚጠብቅበት ጊዜ ግንኙነቱን ክፍት ያደርጋል። ስትሪሚንግ
የአንድ ጥያቄ ገደቦች
| ገደብ | እሴት | የሚመለከተው | ገደቡ ላይ ሲደርስ |
|---|---|---|---|
| የጥያቄ body | 32 MiB (33,554,432 ባይቶች) | እያንዳንዱ endpoint | Status 413፣ አይነት invalid_request_error። |
የውጤት በጀት፦ max_tokens፣ max_completion_tokens፣ max_output_tokens | ከ1 እስከ 65,536። Default 4,096፤ በ/v1/chat/completions እና በ/v1/messages ላይ ለshannon-coder-1 default 65,536 ነው። | እያንዳንዱ ሞዴል፣ ከቀሪ ሂሳብዎ እንደሚያዝ መጠን። የመልሱ ርዝመት ገደብ እንደሆነ፦ የተስተናገዱ open-weight ሞዴሎች፣ shannon-1.6-lite፣ shannon-1.6-pro እና shannon-coder-1። | ከክልሉ ውጭ ያለ እሴት ወደ ቅርቡ የክልል ጫፍ ይወሰዳል። ስህተት የለም። |
የማቆሚያ ቅደም ተከተሎች፦ stop፣ stop_sequences | 4 strings | የተስተናገዱ open-weight ሞዴሎች | የመጀመሪያዎቹ 4 ባዶ ያልሆኑ strings ይጠቀማሉ። |
| እንደ URL የተሰጠ ምስል ወይም ፋይል | 8 MiB፣ በ20 ሰከንድ ውስጥ የሚነበብ፣ ቢበዛ 5 redirects፣ የህዝብ http ወይም https አድራሻ | ምስሎችን ወይም ፋይሎችን የሚቀበል እያንዳንዱ endpoint | ጥያቄው ያለዚያ ክፍል ይመለሳል። ስህተት የለም። |
| በውስጠ-ጥያቄ የተላከ ምስል ወይም ፋይል (base64) | የራሱ ገደብ የለውም። ወደ 32 MiB የጥያቄ body ይቆጠራል። | ምስሎችን ወይም ፋይሎችን የሚቀበል እያንዳንዱ endpoint | ለጠቅላላው ጥያቄ Status 413። |
የPOST /v1/tokenize text | 4,000,000 ባይቶች | /v1/tokenize | Status 413፣ አይነት invalid_request_error፣ መልእክት text too long። |
የPOST /v1/tokenize messages እና የPOST /v1/messages/count_tokens body | 32 MiB የጥያቄ body | ሁለቱም የመቁጠሪያ endpoints | Status 413። |
| Context window | በሞዴል፦ በGET /v1/models ውስጥ context_window | እያንዳንዱ ሞዴል | ከዚያ የሚረዝም ውይይት ምን እንደሚሆን በሞዴሉ ላይ ይመሰረታል። ሞዴሎችና ዋጋ |
የድር ፍለጋዎች (web_search: true) | በዕቅድ እና በቀን፦ Free 3፣ Plus 30፣ Standard 50፣ Pro 60። ፍለጋው ውጤት ላገኘ ጥያቄ አንድ ፍለጋ ይቆጠራል። | web_search: true ያዘጋጁ ጥያቄዎች | ምንም ሲቀር ጥያቄው ያለ ፍለጋ ይመለሳል። ስህተት የለም። የተገናኘ ድር ፍለጋ |
ስህተቶች
የዚህ ገጽ ምላሾች። በ/v1/messages ላይ ተመሳሳዩ error object እንደ {"type": "error", "error": {…}} ይጠቀለላል።
| ሁኔታ | ዓይነት | መልእክት | መቼ፣ እና ምን ማድረግ |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | የጥያቄው መያዣ በቀሪ ሂሳብዎ ውስጥ አይገባም። 00:00 UTC ይጠብቁ፣ ክሬዲት ይሙሉ፣ ዕቅድ ይቀይሩ፣ ወይም ያነሰ max_tokens ይላኩ። |
429 | rate_limit_error | Too many requests. Retry in <N>s. | በአሁኑ ደቂቃ ከ120 በላይ ጥያቄዎች። N ሰከንዶች ይጠብቁ እና እንደገና ይላኩ። |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | የአሁኑ የ4-ሰዓት መስኮት የShannon Coder ጥሪዎች አልቀዋል። |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | ሞዴሉ በዚህ ጊዜ ጥያቄውን መቀበል አይችልም። ከአጭር ቆይታ በኋላ እንደገና ይላኩት። |
503 | api_error | Could not verify your quota right now. Please retry. | ቀሪ ሂሳብዎ ሊነበብ አልቻለም። ምንም አይከፈልም፤ ጥያቄውን እንደገና ይላኩ። በ/v1/responses ላይ ከShannon ሞዴል ጋር status 500 ነው። |
413 | invalid_request_error | የጥያቄው body ከ32 MiB ይበልጣል። በOpenAI-ፎርማት endpoints ላይ የerror object code: "request_too_large" ይይዛል። | |
413 | invalid_request_error | text too long | የPOST /v1/tokenize text ከ4,000,000 ባይቶች ይረዝማል። |