Սահմանաչափեր և մնացորդ
Յուրաքանչյուր հարցում սպասարկվում է հավասարապես։ Արագության մակարդակներ չկան։ Առանձին API քվոտա չկա։ Դուք արդեն վճարել եք ձեր թոքենների համար. օգտագործեք դրանք այնքան արագ, որքան ուզում եք։
Այս էջը բացատրում է, թե ինչից է բաղկացած ձեր մնացորդը, ինչ է վերապահում և ինչ արժե մեկ հարցումը, քանի հարցում կարող եք ուղարկել և այն քիչ սահմանաչափերը, որոնց կարող է հանդիպել մեկ հարցումը։
- 1M թոքեն մնացորդի արժեքը
- $5.00
- օրական քվոտան նորացվում է
- 00:00 UTC
- flood-պաշտպանություն՝ հաշվի համար
- 120 հարցում / րոպե
Ինչպես են սպասարկվում հարցումները
- Արագության մակարդակներ չկան — Մեկ կանոն սահմանափակում է, թե որքան արագ կարող են հարցումները հասնել, և այն նույնն է յուրաքանչյուր հաշվի և յուրաքանչյուր պլանի համար՝ 120 հարցում րոպեում։ Թոքեն րոպեում սահմանաչափ չկա։
- Առանձին API քվոտա չկա — API-ն ծախսում է նույն մնացորդը, ինչ չատը։ Պլանը սահմանում է այսօրվա քվոտայի չափը։ Այն հարցումների արագություն չի սահմանում։
- Այնքան արագ, որքան ուզում եք — Զուգահեռ ուղարկված հարցումները ընդունվում են և սպասում հերթում։ Դրանք զուգահեռ լինելու համար չեն մերժվում։
Ձեր մնացորդը
Ձեր մնացորդը հաշվվում է թոքեններով։ 1,000,000 թոքեն մնացորդն արժե $5.00, և «Մոդելներ և գներ» էջի յուրաքանչյուր գին այդ արժեքի նկատմամբ գին է։
Ցանկացած պահի մնացորդը երկու մասի գումարն է։
- Այսօրվա պլանի քվոտա — Թոքենների քանակ, որը սահմանում է ձեր պլանը։ Այն նորանում է ամեն օր 00:00 UTC-ին։ Օրվա վերջում մնացածը չի փոխանցվում։
- Գնված կրեդիտ — Թոքեններ, որոնք գնել եք փաթեթով։ Կրեդիտը ժամկետանց չի դառնում և աշխատում է յուրաքանչյուր պլանի վրա, ներառյալ Free-ն։
| Պլան | Թոքեն օրական | Արժեք |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- Ծախսման հերթականություն — Յուրաքանչյուր հարցում նախ ծախսում է այսօրվա պլանի քվոտան։ Գնված կրեդիտը օգտագործվում է միայն այն մասի համար, որը տվյալ օրը գերազանցում է քվոտան։
- Չատը և API-ն կիսում են այն — Յուրաքանչյուր հաշիվ ունի մեկ մնացորդ։ API բանալին ծախսում է իր տեր հաշվի մնացորդից՝ չատի նույն գներով։
- Փաթեթներ — Կրեդիտը վաճառվում է 1,000,000 ($5.00), 2,000,000 ($10.00) և 5,000,000 ($25.00) թոքենանոց փաթեթներով, կամ ձեր ընտրած քանակով՝ 1,000,000-ից մինչև 100,000,000 թոքեն, 1,000,000-ի համար $5.00 գնով։
Ինչ է վերապահում հարցումը և ինչ արժե
- Վերապահում — Երբ հարցումը հասնում է, այն ձեր մնացորդից վերապահում է իր ելքի բյուջեն՝
max_tokens/v1/chat/completions-ում և/v1/messages-ում,max_output_tokens/v1/responses-ում։/v1/chat/completions-ը կարդում է նաևmax_completion_tokens։ Լռելյայնը 4,096 է, իսկ միջակայքը՝ 1-ից 65,536։ - Ընդունում — Հարցումն ընդունվում է միայն եթե վերապահումը տեղավորվում է ձեր մնացորդի մնացածի մեջ։ Զրոյից բարձր, բայց ելքի բյուջեից փոքր մնացորդը ստանում է
Quota exceededպատասխան։ Մնացածն օգտագործելու համար ուղարկեք ավելի փոքրmax_tokens։ - Հաշվարկ — Երբ պատասխանն ավարտվում է, վերապահումը փոխարինվում է իրական գանձմամբ։ Գանձումը կարող է լինել վերապահումից ցածր կամ բարձր։
- Վերադարձ — Սխալի կարգավիճակով ավարտվող հարցումը վերադարձնում է իր վերապահումն ամբողջությամբ։
Իրական գանձումը կախված է մոդելի ընտանիքից։
| Մոդելներ | Ինչ է գանձվում |
|---|---|
| Shannon մոդելներ | usage.total_tokens մոդելի գնով՝ 1M-ի համար։ Մուտքը և ելքը ունեն մեկ գին։ |
| Hosted open-weight մոդելներ | Cache-ում չգտնված մուտքը՝ մուտքի գնով, cache-ված մուտքը՝ cache-ի գնով, ելքը՝ ելքի գնով։ |
USD գումարը ձեր մնացորդից հանվում է թոքեններով՝ 1,000,000-ի համար $5.00 փոխարժեքով, կլորացված մինչև ամբողջ թոքեն։
Թոքենների հաշվարկը POST /v1/tokenize-ով կամ POST /v1/messages/count_tokens-ով անվճար է և ոչինչ չի վերապահում։ Թոքենների հաշվարկ
Որտեղ տեսնել մնացորդն ու օգտագործումը
«Բանալիներ և օգտագործում» էջը ցույց է տալիս, թե որքան կարող եք ծախսել հիմա, այսօրվա պլանի քվոտան, ձեր գնված կրեդիտը և վերջին 30 օրվա API ծախսը։ Դրա ներքևում թվարկված է ձեր բանալու կատարած յուրաքանչյուր հարցում՝ ժամանակ, endpoint, մոդել, cache-ված մուտք, հաշվարկված թոքեններ և արժեք։ Բանալիներ և օգտագործում
Յուրաքանչյուր պատասխան կրում է նաև usage օբյեկտ՝ տվյալ կանչի թոքենների քանակներով։
| Էնդփոյնթ | Usage-ի դաշտեր | Ավելացնում են hosted open-weight մոդելները |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usage-ը պարունակում է մոդելի թոքենների քանակները։ Ձեր մնացորդից հանված գումարը պատասխանում չէ. այն «Բանալիներ և օգտագործում» էջի հարցումների ցանկի Հաշվարկված թոքեններ սյունն է։/v1/messages-ում hosted open-weight մոդելի դեպքումinput_tokens-ը մուտքի չ-cache-ված մասն է,cache_read_input_tokens-ը՝ cache-ված մասը, իսկcache_creation_input_tokens-ը միշտ0է։-
/v1/chat/completions-ի հոսքըusage-ը կրում է[DONE]-ից առաջ վերջին chunk-ում։ Ստրիմինգ
Երբ մնացորդը սպառվում է
Հարցումը, որի վերապահումը չի տեղավորվում ձեր մնացորդի մեջ, ստանում է 429 կարգավիճակ, rate_limit_error տեսակ և ստորև հաղորդագրությունը։ Ոչինչ չի գանձվում։ Նույն պատասխանն ուղարկվում է նաև այն դեպքում, երբ մնացորդը զրոյից բարձր է, բայց փոքր է հարցման ելքի բյուջեից։
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses-ում error օբյեկտը կարող է պարունակել նաև code և param, երկուսն էլ null։
Ինչ կարող եք անել.
- Սպասեք պլանի հաջորդ քվոտային՝ 00:00 UTC-ին։
- Լրացրեք կրեդիտ։ Կրեդիտը ծախսվում է պլանի քվոտայից հետո և ժամկետանց չի դառնում։ Լրացնել կրեդիտը
- Անցեք ավելի մեծ օրական քվոտա ունեցող պլանի։ Փոխել պլանը
- Եթե մնացորդ դեռ կա, ուղարկեք ավելի փոքր
max_tokens. այդ դեպքում վերապահումը փոքր է։
Shannon Coder կանչերի քվոտա
shannon-coder-1-ը /v1/chat/completions-ում և /v1/messages-ում հաշվվում է կանչերով, ոչ թե թոքեններով։ Յուրաքանչյուր պլան ներառում է որոշակի քանակի կանչեր 4-ժամյա պատուհանում։ Մեկ հարցումը մեկ կանչ է։
| Պլան | Կանչեր 4-ժամյա պատուհանում |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- Պատուհանները սկսվում են UTC-ով 00:00, 04:00, 08:00, 12:00, 16:00, 20:00-ին։ Պատուհանի վերջում մնացած կանչերը չեն փոխանցվում։
- Կանչը հաշվվում է, երբ հարցումն ընդունվում է, մինչև մոդելի պատասխանելը։ Հետո ձախողված հարցումը դարձյալ հաշվվում է որպես կանչ։
- Այս կանչերը թոքեններ չեն վերապահում և ձեր մնացորդից ոչինչ չեն վերցնում։ «Բանալիներ և օգտագործում» էջի հարցումների ցանկը ցույց է տալիս դրանց թոքենների քանակը և դրա արժեքը նշված գնով։
shannon-coder-1-ի լռելյայնmax_tokens-ը այս երկու endpoint-ներում 65,536 է։- Երբ կանչեր չեն մնում, պատասխանը
429կարգավիճակ է,rate_limit_errorտեսակ,Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/planհաղորդագրություն։ /v1/responses-ումshannon-coder-1-ը կանչերի քվոտա չունի. այն գանձվում է թոքեններով՝ ձեր մնացորդից, 1M-ի համար $8.00 գնով, ինչպես մյուս բոլոր մոդելները։
Flood-պաշտպանություն
Հաշիվը կարող է ուղարկել 120 հարցում րոպեում։ Սա հարցումների արագության միակ սահմանաչափն է, և այն նույնն է յուրաքանչյուր պլանի համար։ Այն գոյություն ունի flood կանգնեցնելու համար, ոչ թե սովորական օգտագործումը դանդաղեցնելու։
- Րոպեն 60 վայրկյանի ֆիքսված պատուհան է, որը բացվում է ձեր առաջին հարցմամբ։ Երբ այն ավարտվում է, հաշվարկը նորից սկսվում է զրոյից։
- Հաշվարկը հաշվի համար է, ոչ թե բանալու և ոչ թե IP հասցեի։ Բանալու փոխարինումը նոր պատուհան չի բացում։
- Պատուհանի ներսում 121-րդ հարցումը ստանում է
429կարգավիճակ,rate_limit_errorտեսակ ևToo many requests. Retry in <N>s.հաղորդագրություն։N-ը պատուհանի ավարտին մնացած վայրկյանների քանակն է՝ 1-ից 60։ - Flood-պաշտպանությունը ստուգվում է մնացորդից առաջ։ Նրա մերժած հարցումը ոչինչ չի վերապահում և ոչինչ չի արժենում։
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | Հարցում | Flood-պաշտպանություն |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | Հաշվվում է, մեկը յուրաքանչյուր հարցման համար։ |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | Չի հաշվվում։ |
shannon-coder-1 /v1/chat/completions-ում և /v1/messages-ում | Փոխարենը հաշվվում է Shannon Coder կանչերի քվոտայով։ |
Հարցում, որին պատասխանվել է 401-ով, կամ 400-ով՝ անհայտ model-ի համար | Չի հաշվվում։ |
| Flood-պաշտպանության մերժած հարցում | Հաշվվում է պատուհանի մեջ։ Ոչինչ չի գանձվում։ |
Զուգահեռ հարցումներ
Սահմանաչափ չկա, թե հաշիվը քանի հարցում կարող է միաժամանակ բաց ունենալ, և զուգահեռ հարցումներ ուղարկելու համար սխալ չկա։ Հարցումները, որոնք չեն կարող անմիջապես սկսվել, սպասում են հերթում և պատասխանվում են հերթով։
- Յուրաքանչյուր հարցում հաշվվում է րոպեում 120-ի մեջ, երբ հասնում է՝ անկախ նրանից, թե նախորդ հարցումներն ավարտվել են, թե ոչ։
- Յուրաքանչյուր հարցում պահում է իր վերապահումը մինչև ավարտը։ Լռելյայն ելքի բյուջեով քսան բաց հարցում պահում է 20 × 4,096 = 81,920 թոքեն մնացորդ։ Եթե վերապահումները միասին մեծ են ձեր մնացորդից, հաջորդ հարցումը ստանում է
Quota exceededպատասխան՝ թեև ավարտված կանչերն ավելի քիչ կարժենային։ Ավելի փոքրmax_tokens-ը պահում է ավելի քիչ։ - Streaming-ից զուրկ հարցումը ոչինչ չի ուղարկում, մինչև պատասխանն ավարտվի, ուստի ձեր կլիենտին տվեք timeout, որը ծածկում է սպասումը։ Հոսքը սպասելիս պահում է իր կապը բաց։ Ստրիմինգ
Մեկ հարցման սահմանաչափեր
| Սահմանաչափ | Արժեք | Վերաբերում է | Սահմանաչափին հասնելիս |
|---|---|---|---|
| Հարցման մարմին | 32 MiB (33,554,432 բայթ) | Յուրաքանչյուր endpoint | 413 կարգավիճակ, invalid_request_error տեսակ։ |
Ելքի բյուջե՝ max_tokens, max_completion_tokens, max_output_tokens | 1-ից 65,536։ Լռելյայնը 4,096 է. shannon-coder-1-ի համար /v1/chat/completions-ում և /v1/messages-ում լռելյայնը 65,536 է։ | Յուրաքանչյուր մոդել՝ որպես ձեր մնացորդից վերապահվող քանակ։ Որպես պատասխանի երկարության սահմանաչափ՝ hosted open-weight մոդելները, shannon-1.6-lite-ը, shannon-1.6-pro-ն և shannon-coder-1-ը։ | Միջակայքից դուրս արժեքը տեղափոխվում է միջակայքի մոտակա ծայրը։ Սխալ չկա։ |
Կանգի հաջորդականություններ՝ stop, stop_sequences | 4 տող | Hosted open-weight մոդելներ | Օգտագործվում են առաջին 4 ոչ դատարկ տողերը։ |
| URL-ով տրված պատկեր կամ ֆայլ | 8 MiB, կարդացվում է 20 վայրկյանում, առավելագույնը 5 վերահասցեավորում, հանրային http կամ https հասցե | Յուրաքանչյուր endpoint, որն ընդունում է պատկերներ կամ ֆայլեր | Հարցմանը պատասխանվում է առանց այդ մասի։ Սխալ չկա։ |
| Ներկառուցված ուղարկված պատկեր կամ ֆայլ (base64) | Սեփական սահմանաչափ չկա։ Այն հաշվվում է 32 MiB հարցման մարմնի մեջ։ | Յուրաքանչյուր endpoint, որն ընդունում է պատկերներ կամ ֆայլեր | 413 կարգավիճակ ամբողջ հարցման համար։ |
POST /v1/tokenize-ի text-ը | 4,000,000 բայթ | /v1/tokenize | 413 կարգավիճակ, invalid_request_error տեսակ, text too long հաղորդագրություն։ |
POST /v1/tokenize-ի messages-ը և POST /v1/messages/count_tokens-ի մարմինը | 32 MiB հարցման մարմին | Հաշվարկի երկու endpoint-ները | 413 կարգավիճակ։ |
| Համատեքստի պատուհան | Ըստ մոդելի՝ context_window GET /v1/models-ում | Յուրաքանչյուր մոդել | Ավելի երկար զրույցի հետ կատարվողը կախված է մոդելից։ Մոդելներ և գներ |
Վեբ որոնումներ (web_search: true) | Ըստ պլանի և օրվա՝ Free 3, Plus 30, Standard 50, Pro 60։ Մեկ որոնում հաշվվում է այն հարցման համար, որի որոնումը արդյունք է գտել։ | Հարցումներ, որոնք սահմանում են web_search: true | Երբ որոնում չի մնացել, հարցմանը պատասխանվում է առանց որոնման։ Սխալ չկա։ Ներկառուցված վեբ որոնում |
Սխալներ
Այս էջի պատասխանները։ /v1/messages-ում նույն error օբյեկտը փաթաթվում է որպես {"type": "error", "error": {…}}։
| Կարգավիճակ | Տեսակ | Հաղորդագրություն | Երբ և ինչ անել |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | Հարցման վերապահումը չի տեղավորվում ձեր մնացորդի մեջ։ Սպասեք 00:00 UTC-ին, լրացրեք կրեդիտ, փոխեք պլանը կամ ուղարկեք ավելի փոքր max_tokens։ |
429 | rate_limit_error | Too many requests. Retry in <N>s. | Ընթացիկ րոպեում ավելի քան 120 հարցում։ Սպասեք N վայրկյան և ուղարկեք կրկին։ |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | Ընթացիկ 4-ժամյա պատուհանի Shannon Coder կանչերը սպառվել են։ |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | Մոդելը տվյալ պահին չի կարող ընդունել հարցումը։ Ուղարկեք այն կրկին կարճ դադարից հետո։ |
503 | api_error | Could not verify your quota right now. Please retry. | Ձեր մնացորդը հնարավոր չեղավ կարդալ։ Ոչինչ չի գանձվում. ուղարկեք հարցումը կրկին։ /v1/responses-ում Shannon մոդելի դեպքում կարգավիճակը 500 է։ |
413 | invalid_request_error | Հարցման մարմինը մեծ է 32 MiB-ից։ OpenAI ձևաչափի endpoint-ներում error օբյեկտը կրում է code: "request_too_large"։ | |
413 | invalid_request_error | text too long | POST /v1/tokenize-ի text-ը 4,000,000 բայթից երկար է։ |