Անցնել բովանդակությանը
Սահմանաչափեր և մնացորդ

Սահմանաչափեր և մնացորդ

Յուրաքանչյուր հարցում սպասարկվում է հավասարապես։ Արագության մակարդակներ չկան։ Առանձին API քվոտա չկա։ Դուք արդեն վճարել եք ձեր թոքենների համար. օգտագործեք դրանք այնքան արագ, որքան ուզում եք։

Այս էջը բացատրում է, թե ինչից է բաղկացած ձեր մնացորդը, ինչ է վերապահում և ինչ արժե մեկ հարցումը, քանի հարցում կարող եք ուղարկել և այն քիչ սահմանաչափերը, որոնց կարող է հանդիպել մեկ հարցումը։

1M թոքեն մնացորդի արժեքը
$5.00
օրական քվոտան նորացվում է
00:00 UTC
flood-պաշտպանություն՝ հաշվի համար
120 հարցում / րոպե

Ինչպես են սպասարկվում հարցումները

  • Արագության մակարդակներ չկան — Մեկ կանոն սահմանափակում է, թե որքան արագ կարող են հարցումները հասնել, և այն նույնն է յուրաքանչյուր հաշվի և յուրաքանչյուր պլանի համար՝ 120 հարցում րոպեում։ Թոքեն րոպեում սահմանաչափ չկա։
  • Առանձին API քվոտա չկա — API-ն ծախսում է նույն մնացորդը, ինչ չատը։ Պլանը սահմանում է այսօրվա քվոտայի չափը։ Այն հարցումների արագություն չի սահմանում։
  • Այնքան արագ, որքան ուզում եք — Զուգահեռ ուղարկված հարցումները ընդունվում են և սպասում հերթում։ Դրանք զուգահեռ լինելու համար չեն մերժվում։

Ձեր մնացորդը

Ձեր մնացորդը հաշվվում է թոքեններով։ 1,000,000 թոքեն մնացորդն արժե $5.00, և «Մոդելներ և գներ» էջի յուրաքանչյուր գին այդ արժեքի նկատմամբ գին է։

Ցանկացած պահի մնացորդը երկու մասի գումարն է։

  • Այսօրվա պլանի քվոտա — Թոքենների քանակ, որը սահմանում է ձեր պլանը։ Այն նորանում է ամեն օր 00:00 UTC-ին։ Օրվա վերջում մնացածը չի փոխանցվում։
  • Գնված կրեդիտ — Թոքեններ, որոնք գնել եք փաթեթով։ Կրեդիտը ժամկետանց չի դառնում և աշխատում է յուրաքանչյուր պլանի վրա, ներառյալ Free-ն։
Պլան Թոքեն օրական Արժեք
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • Ծախսման հերթականություն — Յուրաքանչյուր հարցում նախ ծախսում է այսօրվա պլանի քվոտան։ Գնված կրեդիտը օգտագործվում է միայն այն մասի համար, որը տվյալ օրը գերազանցում է քվոտան։
  • Չատը և API-ն կիսում են այն — Յուրաքանչյուր հաշիվ ունի մեկ մնացորդ։ API բանալին ծախսում է իր տեր հաշվի մնացորդից՝ չատի նույն գներով։
  • Փաթեթներ — Կրեդիտը վաճառվում է 1,000,000 ($5.00), 2,000,000 ($10.00) և 5,000,000 ($25.00) թոքենանոց փաթեթներով, կամ ձեր ընտրած քանակով՝ 1,000,000-ից մինչև 100,000,000 թոքեն, 1,000,000-ի համար $5.00 գնով։

Լրացնել կրեդիտը Փոխել պլանը

Ինչ է վերապահում հարցումը և ինչ արժե

  • Վերապահում — Երբ հարցումը հասնում է, այն ձեր մնացորդից վերապահում է իր ելքի բյուջեն՝ max_tokens /v1/chat/completions-ում և /v1/messages-ում, max_output_tokens /v1/responses-ում։ /v1/chat/completions-ը կարդում է նաև max_completion_tokens։ Լռելյայնը 4,096 է, իսկ միջակայքը՝ 1-ից 65,536։
  • Ընդունում — Հարցումն ընդունվում է միայն եթե վերապահումը տեղավորվում է ձեր մնացորդի մնացածի մեջ։ Զրոյից բարձր, բայց ելքի բյուջեից փոքր մնացորդը ստանում է Quota exceeded պատասխան։ Մնացածն օգտագործելու համար ուղարկեք ավելի փոքր max_tokens։
  • Հաշվարկ — Երբ պատասխանն ավարտվում է, վերապահումը փոխարինվում է իրական գանձմամբ։ Գանձումը կարող է լինել վերապահումից ցածր կամ բարձր։
  • Վերադարձ — Սխալի կարգավիճակով ավարտվող հարցումը վերադարձնում է իր վերապահումն ամբողջությամբ։

Իրական գանձումը կախված է մոդելի ընտանիքից։

Մոդելներ Ինչ է գանձվում
Shannon մոդելներ usage.total_tokens մոդելի գնով՝ 1M-ի համար։ Մուտքը և ելքը ունեն մեկ գին։
Hosted open-weight մոդելներ Cache-ում չգտնված մուտքը՝ մուտքի գնով, cache-ված մուտքը՝ cache-ի գնով, ելքը՝ ելքի գնով։

USD գումարը ձեր մնացորդից հանվում է թոքեններով՝ 1,000,000-ի համար $5.00 փոխարժեքով, կլորացված մինչև ամբողջ թոքեն։

Թոքենների հաշվարկը POST /v1/tokenize-ով կամ POST /v1/messages/count_tokens-ով անվճար է և ոչինչ չի վերապահում։ Թոքենների հաշվարկ

Որտեղ տեսնել մնացորդն ու օգտագործումը

«Բանալիներ և օգտագործում» էջը ցույց է տալիս, թե որքան կարող եք ծախսել հիմա, այսօրվա պլանի քվոտան, ձեր գնված կրեդիտը և վերջին 30 օրվա API ծախսը։ Դրա ներքևում թվարկված է ձեր բանալու կատարած յուրաքանչյուր հարցում՝ ժամանակ, endpoint, մոդել, cache-ված մուտք, հաշվարկված թոքեններ և արժեք։ Բանալիներ և օգտագործում

Յուրաքանչյուր պատասխան կրում է նաև usage օբյեկտ՝ տվյալ կանչի թոքենների քանակներով։

Էնդփոյնթ Usage-ի դաշտեր Ավելացնում են hosted open-weight մոդելները
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage-ը պարունակում է մոդելի թոքենների քանակները։ Ձեր մնացորդից հանված գումարը պատասխանում չէ. այն «Բանալիներ և օգտագործում» էջի հարցումների ցանկի Հաշվարկված թոքեններ սյունն է։
  • /v1/messages-ում hosted open-weight մոդելի դեպքում input_tokens-ը մուտքի չ-cache-ված մասն է, cache_read_input_tokens-ը՝ cache-ված մասը, իսկ cache_creation_input_tokens-ը միշտ 0 է։
  • /v1/chat/completions-ի հոսքը usage-ը կրում է [DONE]-ից առաջ վերջին chunk-ում։ Ստրիմինգ

Երբ մնացորդը սպառվում է

Հարցումը, որի վերապահումը չի տեղավորվում ձեր մնացորդի մեջ, ստանում է 429 կարգավիճակ, rate_limit_error տեսակ և ստորև հաղորդագրությունը։ Ոչինչ չի գանձվում։ Նույն պատասխանն ուղարկվում է նաև այն դեպքում, երբ մնացորդը զրոյից բարձր է, բայց փոքր է հարցման ելքի բյուջեից։

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses-ում error օբյեկտը կարող է պարունակել նաև code և param, երկուսն էլ null։

Ինչ կարող եք անել.

  • Սպասեք պլանի հաջորդ քվոտային՝ 00:00 UTC-ին։
  • Լրացրեք կրեդիտ։ Կրեդիտը ծախսվում է պլանի քվոտայից հետո և ժամկետանց չի դառնում։ Լրացնել կրեդիտը
  • Անցեք ավելի մեծ օրական քվոտա ունեցող պլանի։ Փոխել պլանը
  • Եթե մնացորդ դեռ կա, ուղարկեք ավելի փոքր max_tokens. այդ դեպքում վերապահումը փոքր է։

Shannon Coder կանչերի քվոտա

shannon-coder-1-ը /v1/chat/completions-ում և /v1/messages-ում հաշվվում է կանչերով, ոչ թե թոքեններով։ Յուրաքանչյուր պլան ներառում է որոշակի քանակի կանչեր 4-ժամյա պատուհանում։ Մեկ հարցումը մեկ կանչ է։

Պլան Կանչեր 4-ժամյա պատուհանում
Free 3
Plus 20
Standard 40
Pro 60
  • Պատուհանները սկսվում են UTC-ով 00:00, 04:00, 08:00, 12:00, 16:00, 20:00-ին։ Պատուհանի վերջում մնացած կանչերը չեն փոխանցվում։
  • Կանչը հաշվվում է, երբ հարցումն ընդունվում է, մինչև մոդելի պատասխանելը։ Հետո ձախողված հարցումը դարձյալ հաշվվում է որպես կանչ։
  • Այս կանչերը թոքեններ չեն վերապահում և ձեր մնացորդից ոչինչ չեն վերցնում։ «Բանալիներ և օգտագործում» էջի հարցումների ցանկը ցույց է տալիս դրանց թոքենների քանակը և դրա արժեքը նշված գնով։
  • shannon-coder-1-ի լռելյայն max_tokens-ը այս երկու endpoint-ներում 65,536 է։
  • Երբ կանչեր չեն մնում, պատասխանը 429 կարգավիճակ է, rate_limit_error տեսակ, Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan հաղորդագրություն։
  • /v1/responses-ում shannon-coder-1-ը կանչերի քվոտա չունի. այն գանձվում է թոքեններով՝ ձեր մնացորդից, 1M-ի համար $8.00 գնով, ինչպես մյուս բոլոր մոդելները։

Flood-պաշտպանություն

Հաշիվը կարող է ուղարկել 120 հարցում րոպեում։ Սա հարցումների արագության միակ սահմանաչափն է, և այն նույնն է յուրաքանչյուր պլանի համար։ Այն գոյություն ունի flood կանգնեցնելու համար, ոչ թե սովորական օգտագործումը դանդաղեցնելու։

  • Րոպեն 60 վայրկյանի ֆիքսված պատուհան է, որը բացվում է ձեր առաջին հարցմամբ։ Երբ այն ավարտվում է, հաշվարկը նորից սկսվում է զրոյից։
  • Հաշվարկը հաշվի համար է, ոչ թե բանալու և ոչ թե IP հասցեի։ Բանալու փոխարինումը նոր պատուհան չի բացում։
  • Պատուհանի ներսում 121-րդ հարցումը ստանում է 429 կարգավիճակ, rate_limit_error տեսակ և Too many requests. Retry in <N>s. հաղորդագրություն։ N-ը պատուհանի ավարտին մնացած վայրկյանների քանակն է՝ 1-ից 60։
  • Flood-պաշտպանությունը ստուգվում է մնացորդից առաջ։ Նրա մերժած հարցումը ոչինչ չի վերապահում և ոչինչ չի արժենում։
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
Հարցում Flood-պաշտպանություն
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses Հաշվվում է, մեկը յուրաքանչյուր հարցման համար։
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens Չի հաշվվում։
shannon-coder-1 /v1/chat/completions-ում և /v1/messages-ում Փոխարենը հաշվվում է Shannon Coder կանչերի քվոտայով։
Հարցում, որին պատասխանվել է 401-ով, կամ 400-ով՝ անհայտ model-ի համար Չի հաշվվում։
Flood-պաշտպանության մերժած հարցում Հաշվվում է պատուհանի մեջ։ Ոչինչ չի գանձվում։

Զուգահեռ հարցումներ

Սահմանաչափ չկա, թե հաշիվը քանի հարցում կարող է միաժամանակ բաց ունենալ, և զուգահեռ հարցումներ ուղարկելու համար սխալ չկա։ Հարցումները, որոնք չեն կարող անմիջապես սկսվել, սպասում են հերթում և պատասխանվում են հերթով։

  • Յուրաքանչյուր հարցում հաշվվում է րոպեում 120-ի մեջ, երբ հասնում է՝ անկախ նրանից, թե նախորդ հարցումներն ավարտվել են, թե ոչ։
  • Յուրաքանչյուր հարցում պահում է իր վերապահումը մինչև ավարտը։ Լռելյայն ելքի բյուջեով քսան բաց հարցում պահում է 20 × 4,096 = 81,920 թոքեն մնացորդ։ Եթե վերապահումները միասին մեծ են ձեր մնացորդից, հաջորդ հարցումը ստանում է Quota exceeded պատասխան՝ թեև ավարտված կանչերն ավելի քիչ կարժենային։ Ավելի փոքր max_tokens-ը պահում է ավելի քիչ։
  • Streaming-ից զուրկ հարցումը ոչինչ չի ուղարկում, մինչև պատասխանն ավարտվի, ուստի ձեր կլիենտին տվեք timeout, որը ծածկում է սպասումը։ Հոսքը սպասելիս պահում է իր կապը բաց։ Ստրիմինգ

Մեկ հարցման սահմանաչափեր

Սահմանաչափ Արժեք Վերաբերում է Սահմանաչափին հասնելիս
Հարցման մարմին 32 MiB (33,554,432 բայթ) Յուրաքանչյուր endpoint 413 կարգավիճակ, invalid_request_error տեսակ։
Ելքի բյուջե՝ max_tokens, max_completion_tokens, max_output_tokens 1-ից 65,536։ Լռելյայնը 4,096 է. shannon-coder-1-ի համար /v1/chat/completions-ում և /v1/messages-ում լռելյայնը 65,536 է։ Յուրաքանչյուր մոդել՝ որպես ձեր մնացորդից վերապահվող քանակ։ Որպես պատասխանի երկարության սահմանաչափ՝ hosted open-weight մոդելները, shannon-1.6-lite-ը, shannon-1.6-pro-ն և shannon-coder-1-ը։ Միջակայքից դուրս արժեքը տեղափոխվում է միջակայքի մոտակա ծայրը։ Սխալ չկա։
Կանգի հաջորդականություններ՝ stop, stop_sequences 4 տող Hosted open-weight մոդելներ Օգտագործվում են առաջին 4 ոչ դատարկ տողերը։
URL-ով տրված պատկեր կամ ֆայլ 8 MiB, կարդացվում է 20 վայրկյանում, առավելագույնը 5 վերահասցեավորում, հանրային http կամ https հասցե Յուրաքանչյուր endpoint, որն ընդունում է պատկերներ կամ ֆայլեր Հարցմանը պատասխանվում է առանց այդ մասի։ Սխալ չկա։
Ներկառուցված ուղարկված պատկեր կամ ֆայլ (base64) Սեփական սահմանաչափ չկա։ Այն հաշվվում է 32 MiB հարցման մարմնի մեջ։ Յուրաքանչյուր endpoint, որն ընդունում է պատկերներ կամ ֆայլեր 413 կարգավիճակ ամբողջ հարցման համար։
POST /v1/tokenize-ի text-ը 4,000,000 բայթ /v1/tokenize 413 կարգավիճակ, invalid_request_error տեսակ, text too long հաղորդագրություն։
POST /v1/tokenize-ի messages-ը և POST /v1/messages/count_tokens-ի մարմինը 32 MiB հարցման մարմին Հաշվարկի երկու endpoint-ները 413 կարգավիճակ։
Համատեքստի պատուհան Ըստ մոդելի՝ context_window GET /v1/models-ում Յուրաքանչյուր մոդել Ավելի երկար զրույցի հետ կատարվողը կախված է մոդելից։ Մոդելներ և գներ
Վեբ որոնումներ (web_search: true) Ըստ պլանի և օրվա՝ Free 3, Plus 30, Standard 50, Pro 60։ Մեկ որոնում հաշվվում է այն հարցման համար, որի որոնումը արդյունք է գտել։ Հարցումներ, որոնք սահմանում են web_search: true Երբ որոնում չի մնացել, հարցմանը պատասխանվում է առանց որոնման։ Սխալ չկա։ Ներկառուցված վեբ որոնում

Սխալներ

Այս էջի պատասխանները։ /v1/messages-ում նույն error օբյեկտը փաթաթվում է որպես {"type": "error", "error": {…}}։

Կարգավիճակ Տեսակ Հաղորդագրություն Երբ և ինչ անել
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan Հարցման վերապահումը չի տեղավորվում ձեր մնացորդի մեջ։ Սպասեք 00:00 UTC-ին, լրացրեք կրեդիտ, փոխեք պլանը կամ ուղարկեք ավելի փոքր max_tokens։
429 rate_limit_error Too many requests. Retry in <N>s. Ընթացիկ րոպեում ավելի քան 120 հարցում։ Սպասեք N վայրկյան և ուղարկեք կրկին։
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan Ընթացիկ 4-ժամյա պատուհանի Shannon Coder կանչերը սպառվել են։
429 rate_limit_error Shannon routes are temporarily busy. Please retry. Մոդելը տվյալ պահին չի կարող ընդունել հարցումը։ Ուղարկեք այն կրկին կարճ դադարից հետո։
503 api_error Could not verify your quota right now. Please retry. Ձեր մնացորդը հնարավոր չեղավ կարդալ։ Ոչինչ չի գանձվում. ուղարկեք հարցումը կրկին։ /v1/responses-ում Shannon մոդելի դեպքում կարգավիճակը 500 է։
413 invalid_request_error Հարցման մարմինը մեծ է 32 MiB-ից։ OpenAI ձևաչափի endpoint-ներում error օբյեկտը կրում է code: "request_too_large"։
413 invalid_request_error text too long POST /v1/tokenize-ի text-ը 4,000,000 բայթից երկար է։