ਸੀਮਾਵਾਂ ਅਤੇ ਬੈਲੇਂਸ
ਹਰ ਰਿਕੁਐਸਟ ਨੂੰ ਬਰਾਬਰ ਸੇਵਾ ਮਿਲਦੀ ਹੈ। ਕੋਈ ਰੇਟ ਟੀਅਰ ਨਹੀਂ। ਕੋਈ ਵੱਖਰਾ API ਕੋਟਾ ਨਹੀਂ। ਤੁਸੀਂ ਆਪਣੇ tokens ਪਹਿਲਾਂ ਹੀ ਖਰੀਦ ਚੁੱਕੇ ਹੋ — ਉਨ੍ਹਾਂ ਨੂੰ ਜਿੰਨੀ ਤੇਜ਼ੀ ਨਾਲ ਚਾਹੋ ਵਰਤੋ।
ਇਹ ਪੰਨਾ ਸਮਝਾਉਂਦਾ ਹੈ ਕਿ ਤੁਹਾਡਾ ਬੈਲੇਂਸ ਕਿਸ ਤੋਂ ਬਣਿਆ ਹੈ, ਇੱਕ ਰਿਕੁਐਸਟ ਕੀ ਰਿਜ਼ਰਵ ਕਰਦੀ ਹੈ ਅਤੇ ਉਸ ਦੀ ਕੀ ਲਾਗਤ ਹੈ, ਤੁਸੀਂ ਕਿੰਨੀਆਂ ਰਿਕੁਐਸਟਾਂ ਭੇਜ ਸਕਦੇ ਹੋ, ਅਤੇ ਉਹ ਕੁਝ ਸੀਮਾਵਾਂ ਜੋ ਇੱਕ ਇਕੱਲੀ ਰਿਕੁਐਸਟ ਨੂੰ ਮਿਲ ਸਕਦੀਆਂ ਹਨ।
- ਬੈਲੇਂਸ ਦੇ 1M tokens ਦਾ ਮੁੱਲ
- $5.00
- ਰੋਜ਼ਾਨਾ ਹਿੱਸਾ ਨਵਾਂ ਹੁੰਦਾ ਹੈ
- 00:00 UTC
- ਫਲੱਡ ਪ੍ਰੋਟੈਕਸ਼ਨ, ਪ੍ਰਤੀ ਖਾਤਾ
- 120 ਰਿਕੁਐਸਟਾਂ / ਮਿੰਟ
ਰਿਕੁਐਸਟਾਂ ਨੂੰ ਕਿਵੇਂ ਸੇਵਾ ਮਿਲਦੀ ਹੈ
- ਕੋਈ ਰੇਟ ਟੀਅਰ ਨਹੀਂ — ਇੱਕ ਨਿਯਮ ਸੀਮਤ ਕਰਦਾ ਹੈ ਕਿ ਰਿਕੁਐਸਟਾਂ ਕਿੰਨੀ ਤੇਜ਼ੀ ਨਾਲ ਪਹੁੰਚ ਸਕਦੀਆਂ ਹਨ, ਅਤੇ ਇਹ ਹਰ ਖਾਤੇ ਅਤੇ ਹਰ ਪਲਾਨ ਲਈ ਇੱਕੋ ਹੈ: ਪ੍ਰਤੀ ਮਿੰਟ 120 ਰਿਕੁਐਸਟਾਂ। ਪ੍ਰਤੀ ਮਿੰਟ tokens ਉੱਤੇ ਕੋਈ ਸੀਮਾ ਨਹੀਂ ਹੈ।
- ਕੋਈ ਵੱਖਰਾ API ਕੋਟਾ ਨਹੀਂ — API ਉਹੀ ਬੈਲੇਂਸ ਖਰਚ ਕਰਦੀ ਹੈ ਜੋ ਚੈਟ। ਪਲਾਨ ਅੱਜ ਦੇ ਰੋਜ਼ਾਨਾ ਹਿੱਸੇ ਦਾ ਆਕਾਰ ਤੈਅ ਕਰਦਾ ਹੈ। ਇਹ ਰਿਕੁਐਸਟ ਦਰ ਤੈਅ ਨਹੀਂ ਕਰਦਾ।
- ਜਿੰਨੀ ਤੇਜ਼ੀ ਨਾਲ ਚਾਹੋ — ਸਮਾਂਤਰ ਭੇਜੀਆਂ ਰਿਕੁਐਸਟਾਂ ਸਵੀਕਾਰ ਹੁੰਦੀਆਂ ਹਨ ਅਤੇ ਕਤਾਰ ਵਿੱਚ ਉਡੀਕ ਕਰਦੀਆਂ ਹਨ। ਉਨ੍ਹਾਂ ਨੂੰ ਸਮਾਂਤਰ ਹੋਣ ਕਰਕੇ ਰੱਦ ਨਹੀਂ ਕੀਤਾ ਜਾਂਦਾ।
ਤੁਹਾਡਾ ਬੈਲੇਂਸ
ਤੁਹਾਡਾ ਬੈਲੇਂਸ tokens ਵਿੱਚ ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ। ਬੈਲੇਂਸ ਦੇ 1,000,000 tokens ਦਾ ਮੁੱਲ $5.00 ਹੈ, ਅਤੇ ਮਾਡਲ ਅਤੇ ਕੀਮਤ ਪੰਨੇ ਉੱਤੇ ਹਰ ਕੀਮਤ ਉਸ ਮੁੱਲ ਦੇ ਮੁਕਾਬਲੇ ਇੱਕ ਦਰ ਹੈ।
ਕਿਸੇ ਵੀ ਪਲ ਬੈਲੇਂਸ ਦੋ ਹਿੱਸਿਆਂ ਦਾ ਜੋੜ ਹੁੰਦਾ ਹੈ।
- ਅੱਜ ਦਾ ਪਲਾਨ ਦਾ ਰੋਜ਼ਾਨਾ ਹਿੱਸਾ — ਤੁਹਾਡੇ ਪਲਾਨ ਵੱਲੋਂ ਤੈਅ ਕੀਤੀ tokens ਦੀ ਗਿਣਤੀ। ਇਹ ਹਰ ਦਿਨ 00:00 UTC ਉੱਤੇ ਨਵੀਂ ਹੋ ਜਾਂਦੀ ਹੈ। ਦਿਨ ਦੇ ਅੰਤ ਵਿੱਚ ਜੋ ਬਚਦਾ ਹੈ ਉਹ ਅੱਗੇ ਨਹੀਂ ਜਾਂਦਾ।
- ਖਰੀਦਿਆ ਕ੍ਰੈਡਿਟ — tokens ਜੋ ਤੁਸੀਂ ਪੈਕ ਵਜੋਂ ਖਰੀਦੇ। ਕ੍ਰੈਡਿਟ ਦੀ ਮਿਆਦ ਪੂਰੀ ਨਹੀਂ ਹੁੰਦੀ ਅਤੇ ਇਹ Free ਸਮੇਤ ਹਰ ਪਲਾਨ ਉੱਤੇ ਕੰਮ ਕਰਦਾ ਹੈ।
| ਪਲਾਨ | ਪ੍ਰਤੀ ਦਿਨ tokens | ਮੁੱਲ |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- ਖਰਚ ਦਾ ਕ੍ਰਮ — ਹਰ ਰਿਕੁਐਸਟ ਪਹਿਲਾਂ ਅੱਜ ਦਾ ਪਲਾਨ ਦਾ ਰੋਜ਼ਾਨਾ ਹਿੱਸਾ ਖਰਚ ਕਰਦੀ ਹੈ। ਖਰੀਦਿਆ ਕ੍ਰੈਡਿਟ ਸਿਰਫ਼ ਉਸ ਲਈ ਵਰਤਿਆ ਜਾਂਦਾ ਹੈ ਜੋ ਉਸ ਦਿਨ ਇਸ ਹਿੱਸੇ ਤੋਂ ਵੱਧ ਜਾਵੇ।
- ਚੈਟ ਅਤੇ API ਇਸ ਨੂੰ ਸਾਂਝਾ ਕਰਦੇ ਹਨ — ਹਰ ਖਾਤੇ ਦਾ ਇੱਕ ਬੈਲੇਂਸ ਹੁੰਦਾ ਹੈ। API key ਆਪਣੇ ਮਾਲਕ ਖਾਤੇ ਦੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ, ਚੈਟ ਵਾਲੀਆਂ ਹੀ ਕੀਮਤਾਂ ਉੱਤੇ, ਖਰਚ ਕਰਦੀ ਹੈ।
- ਪੈਕ — ਕ੍ਰੈਡਿਟ 1,000,000 ($5.00), 2,000,000 ($10.00) ਅਤੇ 5,000,000 ($25.00) tokens ਦੇ ਪੈਕਾਂ ਵਿੱਚ ਵੇਚਿਆ ਜਾਂਦਾ ਹੈ, ਜਾਂ ਤੁਹਾਡੀ ਚੁਣੀ ਹੋਈ ਰਕਮ ਵਜੋਂ 1,000,000 ਤੋਂ 100,000,000 tokens ਤੱਕ, ਪ੍ਰਤੀ 1,000,000 $5.00 ਦੀ ਦਰ ਨਾਲ।
ਰਿਕੁਐਸਟ ਕੀ ਰਿਜ਼ਰਵ ਕਰਦੀ ਹੈ ਅਤੇ ਉਸ ਦੀ ਕੀ ਲਾਗਤ ਹੈ
- ਰਿਜ਼ਰਵ — ਜਦੋਂ ਰਿਕੁਐਸਟ ਪਹੁੰਚਦੀ ਹੈ, ਤਾਂ ਉਹ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ ਆਪਣਾ ਆਉਟਪੁੱਟ ਬਜਟ ਰਿਜ਼ਰਵ ਕਰਦੀ ਹੈ:
/v1/chat/completionsਅਤੇ/v1/messagesਉੱਤੇmax_tokens,/v1/responsesਉੱਤੇmax_output_tokens।/v1/chat/completionsmax_completion_tokensਵੀ ਪੜ੍ਹਦਾ ਹੈ। ਡਿਫਾਲਟ 4,096 ਹੈ ਅਤੇ ਦਾਇਰਾ 1 ਤੋਂ 65,536 ਹੈ। - ਸਵੀਕਾਰ — ਰਿਕੁਐਸਟ ਸਿਰਫ਼ ਤਾਂ ਸਵੀਕਾਰ ਹੁੰਦੀ ਹੈ ਜੇ ਰਿਜ਼ਰਵੇਸ਼ਨ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚ ਬਚੇ ਹਿੱਸੇ ਵਿੱਚ ਸਮਾ ਜਾਵੇ। ਜਿਸ ਬੈਲੇਂਸ ਦੀ ਰਕਮ ਸਿਫ਼ਰ ਤੋਂ ਵੱਧ ਹੈ ਪਰ ਆਉਟਪੁੱਟ ਬਜਟ ਤੋਂ ਘੱਟ, ਉਸ ਨੂੰ
Quota exceededਜਵਾਬ ਮਿਲਦਾ ਹੈ। ਬਾਕੀ ਨੂੰ ਵਰਤਣ ਲਈ ਛੋਟਾmax_tokensਭੇਜੋ। - ਨਿਪਟਾਰਾ — ਜਦੋਂ ਜਵਾਬ ਪੂਰਾ ਹੋ ਜਾਂਦਾ ਹੈ, ਤਾਂ ਰਿਜ਼ਰਵੇਸ਼ਨ ਅਸਲ ਚਾਰਜ ਨਾਲ ਬਦਲ ਦਿੱਤੀ ਜਾਂਦੀ ਹੈ। ਚਾਰਜ ਰਿਜ਼ਰਵੇਸ਼ਨ ਤੋਂ ਘੱਟ ਜਾਂ ਵੱਧ ਹੋ ਸਕਦਾ ਹੈ।
- ਵਾਪਸੀ — ਜੋ ਰਿਕੁਐਸਟ ਗਲਤੀ ਸਟੇਟਸ ਨਾਲ ਖਤਮ ਹੁੰਦੀ ਹੈ, ਉਹ ਆਪਣੀ ਰਿਜ਼ਰਵੇਸ਼ਨ ਪੂਰੀ ਵਾਪਸ ਕਰ ਦਿੰਦੀ ਹੈ।
ਅਸਲ ਚਾਰਜ ਮਾਡਲ ਦੇ ਪਰਿਵਾਰ ਉੱਤੇ ਨਿਰਭਰ ਕਰਦਾ ਹੈ।
| ਮਾਡਲ | ਕੀ ਚਾਰਜ ਹੁੰਦਾ ਹੈ |
|---|---|
| Shannon ਮਾਡਲ | ਮਾਡਲ ਦੀ ਪ੍ਰਤੀ 1M ਕੀਮਤ ਉੱਤੇ usage.total_tokens। ਇਨਪੁਟ ਅਤੇ ਆਉਟਪੁੱਟ ਦੀ ਇੱਕ ਹੀ ਦਰ ਹੈ। |
| ਹੋਸਟ ਕੀਤੇ open-weight ਮਾਡਲ | ਕੈਸ਼ ਤੋਂ ਬਿਨਾਂ ਇਨਪੁਟ ਇਨਪੁਟ ਦਰ ਉੱਤੇ, ਕੈਸ਼ਡ ਇਨਪੁਟ ਕੈਸ਼ਡ ਦਰ ਉੱਤੇ, ਆਉਟਪੁੱਟ ਆਉਟਪੁੱਟ ਦਰ ਉੱਤੇ। |
USD ਦੀ ਰਕਮ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ tokens ਵਿੱਚ ਪ੍ਰਤੀ 1,000,000 $5.00 ਦੀ ਦਰ ਨਾਲ ਲਈ ਜਾਂਦੀ ਹੈ, ਪੂਰੇ token ਤੱਕ ਗੋਲ ਕਰ ਕੇ।
POST /v1/tokenize ਜਾਂ POST /v1/messages/count_tokens ਨਾਲ tokens ਦੀ ਗਿਣਤੀ ਮੁਫ਼ਤ ਹੈ ਅਤੇ ਕੁਝ ਰਿਜ਼ਰਵ ਨਹੀਂ ਕਰਦੀ। ਟੋਕਨ ਗਿਣਤੀ
ਬੈਲੇਂਸ ਅਤੇ ਵਰਤੋਂ ਕਿੱਥੇ ਵੇਖਣੀ ਹੈ
Keys & usage ਪੰਨਾ ਦਿਖਾਉਂਦਾ ਹੈ ਕਿ ਤੁਸੀਂ ਇਸ ਸਮੇਂ ਕੀ ਖਰਚ ਕਰ ਸਕਦੇ ਹੋ, ਅੱਜ ਦਾ ਪਲਾਨ ਦਾ ਰੋਜ਼ਾਨਾ ਹਿੱਸਾ, ਤੁਹਾਡਾ ਖਰੀਦਿਆ ਕ੍ਰੈਡਿਟ ਅਤੇ ਪਿਛਲੇ 30 ਦਿਨਾਂ ਦਾ API ਖਰਚ। ਉਸ ਦੇ ਹੇਠਾਂ ਇਹ ਤੁਹਾਡੀ key ਵੱਲੋਂ ਕੀਤੀ ਹਰ ਰਿਕੁਐਸਟ ਸੂਚੀਬੱਧ ਕਰਦਾ ਹੈ: ਸਮਾਂ, endpoint, ਮਾਡਲ, ਕੈਸ਼ਡ ਇਨਪੁਟ, ਬਿਲ ਕੀਤੇ tokens ਅਤੇ ਲਾਗਤ। Keys ਅਤੇ ਵਰਤੋਂ
ਹਰ ਜਵਾਬ ਵਿੱਚ ਇੱਕ usage object ਵੀ ਹੁੰਦਾ ਹੈ ਜਿਸ ਵਿੱਚ ਉਸ ਕਾਲ ਦੀਆਂ token ਗਿਣਤੀਆਂ ਹੁੰਦੀਆਂ ਹਨ।
| ਐਂਡਪੁਆਇੰਟ | usage ਦੇ ਫੀਲਡ | ਹੋਸਟ ਕੀਤੇ open-weight ਮਾਡਲਾਂ ਵੱਲੋਂ ਜੋੜੇ ਗਏ |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageਵਿੱਚ ਮਾਡਲ ਦੀਆਂ token ਗਿਣਤੀਆਂ ਹੁੰਦੀਆਂ ਹਨ। ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ ਲਈ ਗਈ ਰਕਮ ਜਵਾਬ ਵਿੱਚ ਨਹੀਂ ਹੁੰਦੀ: ਉਹ Keys & usage ਉੱਤੇ ਰਿਕੁਐਸਟਾਂ ਦੀ ਸੂਚੀ ਦਾ Billed tokens ਕਾਲਮ ਹੈ।- ਹੋਸਟ ਕੀਤੇ open-weight ਮਾਡਲ ਨਾਲ
/v1/messagesਉੱਤੇ,input_tokensਇਨਪੁਟ ਦਾ ਕੈਸ਼ ਤੋਂ ਬਿਨਾਂ ਹਿੱਸਾ ਹੈ,cache_read_input_tokensਕੈਸ਼ਡ ਹਿੱਸਾ ਹੈ ਅਤੇcache_creation_input_tokensਹਮੇਸ਼ਾ0ਹੈ। -
/v1/chat/completionsਉੱਤੇ stream[DONE]ਤੋਂ ਪਹਿਲਾਂ ਆਪਣੇ ਆਖਰੀ chunk ਵਿੱਚusageਲੈ ਕੇ ਆਉਂਦੀ ਹੈ। ਸਟ੍ਰੀਮਿੰਗ
ਜਦੋਂ ਬੈਲੇਂਸ ਖਤਮ ਹੋ ਜਾਵੇ
ਜਿਸ ਰਿਕੁਐਸਟ ਦੀ ਰਿਜ਼ਰਵੇਸ਼ਨ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚ ਨਹੀਂ ਸਮਾਉਂਦੀ, ਉਸ ਦਾ ਜਵਾਬ ਸਟੇਟਸ 429, ਕਿਸਮ rate_limit_error ਅਤੇ ਹੇਠਾਂ ਦਿੱਤੇ ਸੁਨੇਹੇ ਨਾਲ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ। ਕੁਝ ਚਾਰਜ ਨਹੀਂ ਹੁੰਦਾ। ਇਹੀ ਜਵਾਬ ਉਦੋਂ ਵੀ ਭੇਜਿਆ ਜਾਂਦਾ ਹੈ ਜਦੋਂ ਬੈਲੇਂਸ ਸਿਫ਼ਰ ਤੋਂ ਵੱਧ ਹੋਵੇ ਪਰ ਰਿਕੁਐਸਟ ਦੇ ਆਉਟਪੁੱਟ ਬਜਟ ਤੋਂ ਘੱਟ।
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses ਉੱਤੇ error object ਵਿੱਚ code ਅਤੇ param ਵੀ ਹੋ ਸਕਦੇ ਹਨ, ਦੋਵੇਂ null।
ਤੁਸੀਂ ਕੀ ਕਰ ਸਕਦੇ ਹੋ:
- 00:00 UTC ਉੱਤੇ ਅਗਲੇ ਪਲਾਨ ਦੇ ਰੋਜ਼ਾਨਾ ਹਿੱਸੇ ਦੀ ਉਡੀਕ ਕਰੋ।
- ਕ੍ਰੈਡਿਟ ਟੌਪ-ਅੱਪ ਕਰੋ। ਕ੍ਰੈਡਿਟ ਪਲਾਨ ਦੇ ਰੋਜ਼ਾਨਾ ਹਿੱਸੇ ਤੋਂ ਬਾਅਦ ਖਰਚ ਹੁੰਦਾ ਹੈ ਅਤੇ ਇਸ ਦੀ ਮਿਆਦ ਪੂਰੀ ਨਹੀਂ ਹੁੰਦੀ। ਕ੍ਰੈਡਿਟ ਟੌਪ-ਅੱਪ ਕਰੋ
- ਵੱਡੇ ਰੋਜ਼ਾਨਾ ਹਿੱਸੇ ਵਾਲੇ ਪਲਾਨ ਉੱਤੇ ਬਦਲੋ। ਪਲਾਨ ਬਦਲੋ
- ਜੇ ਕੁਝ ਬੈਲੇਂਸ ਬਚਿਆ ਹੈ, ਤਾਂ ਛੋਟਾ
max_tokensਭੇਜੋ: ਫਿਰ ਰਿਜ਼ਰਵੇਸ਼ਨ ਛੋਟੀ ਹੁੰਦੀ ਹੈ।
Shannon Coder ਕਾਲ ਹਿੱਸਾ
/v1/chat/completions ਅਤੇ /v1/messages ਉੱਤੇ shannon-coder-1 ਕਾਲਾਂ ਵਿੱਚ ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ, tokens ਵਿੱਚ ਨਹੀਂ। ਹਰ ਪਲਾਨ ਵਿੱਚ ਪ੍ਰਤੀ 4 ਘੰਟੇ ਦੀ ਵਿੰਡੋ ਕੁਝ ਕਾਲਾਂ ਸ਼ਾਮਲ ਹਨ। ਇੱਕ ਰਿਕੁਐਸਟ ਇੱਕ ਕਾਲ ਹੈ।
| ਪਲਾਨ | ਹਰ 4 ਘੰਟੇ ਦੀ ਵਿੰਡੋ ਵਿੱਚ ਕਾਲਾਂ |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- ਵਿੰਡੋਆਂ 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC ਉੱਤੇ ਸ਼ੁਰੂ ਹੁੰਦੀਆਂ ਹਨ। ਵਿੰਡੋ ਦੇ ਅੰਤ ਵਿੱਚ ਜੋ ਕਾਲਾਂ ਬਚਦੀਆਂ ਹਨ ਉਹ ਅੱਗੇ ਨਹੀਂ ਜਾਂਦੀਆਂ।
- ਕਾਲ ਉਦੋਂ ਗਿਣੀ ਜਾਂਦੀ ਹੈ ਜਦੋਂ ਰਿਕੁਐਸਟ ਸਵੀਕਾਰ ਹੁੰਦੀ ਹੈ, ਮਾਡਲ ਦੇ ਜਵਾਬ ਦੇਣ ਤੋਂ ਪਹਿਲਾਂ। ਜੋ ਰਿਕੁਐਸਟ ਬਾਅਦ ਵਿੱਚ ਅਸਫਲ ਹੋ ਜਾਵੇ, ਉਹ ਵੀ ਇੱਕ ਕਾਲ ਗਿਣੀ ਜਾਂਦੀ ਹੈ।
- ਇਹ ਕਾਲਾਂ ਕੋਈ tokens ਰਿਜ਼ਰਵ ਨਹੀਂ ਕਰਦੀਆਂ ਅਤੇ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ ਕੁਝ ਨਹੀਂ ਲੈਂਦੀਆਂ। Keys & usage ਉੱਤੇ ਰਿਕੁਐਸਟਾਂ ਦੀ ਸੂਚੀ ਉਨ੍ਹਾਂ ਦੀ token ਗਿਣਤੀ ਅਤੇ ਸੂਚੀਬੱਧ ਕੀਮਤ ਉੱਤੇ ਉਸ ਦਾ ਮੁੱਲ ਦਿਖਾਉਂਦੀ ਹੈ।
- ਇਨ੍ਹਾਂ ਦੋ endpoints ਉੱਤੇ
shannon-coder-1ਦਾ ਡਿਫਾਲਟmax_tokens65,536 ਹੈ। - ਕਾਲਾਂ ਬਾਕੀ ਨਾ ਰਹਿਣ ਉੱਤੇ ਜਵਾਬ ਸਟੇਟਸ
429, ਕਿਸਮrate_limit_error, ਸੁਨੇਹਾShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/planਹੁੰਦਾ ਹੈ। /v1/responsesਉੱਤੇshannon-coder-1ਲਈ ਕੋਈ ਕਾਲ ਹਿੱਸਾ ਨਹੀਂ ਹੈ: ਇਸ ਦਾ ਚਾਰਜ ਹਰ ਹੋਰ ਮਾਡਲ ਵਾਂਗ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਦੇ tokens ਵਿੱਚ ਪ੍ਰਤੀ 1M $8.00 ਉੱਤੇ ਲੱਗਦਾ ਹੈ।
ਫਲੱਡ ਪ੍ਰੋਟੈਕਸ਼ਨ
ਇੱਕ ਖਾਤਾ ਪ੍ਰਤੀ ਮਿੰਟ 120 ਰਿਕੁਐਸਟਾਂ ਭੇਜ ਸਕਦਾ ਹੈ। ਰਿਕੁਐਸਟ ਦਰ ਉੱਤੇ ਇਹੀ ਇੱਕੋ-ਇੱਕ ਸੀਮਾ ਹੈ, ਅਤੇ ਇਹ ਹਰ ਪਲਾਨ ਉੱਤੇ ਇੱਕੋ ਜਿਹੀ ਹੈ। ਇਹ ਹੜ੍ਹ ਰੋਕਣ ਲਈ ਹੈ, ਆਮ ਵਰਤੋਂ ਨੂੰ ਹੌਲੀ ਕਰਨ ਲਈ ਨਹੀਂ।
- ਮਿੰਟ 60 ਸਕਿੰਟ ਦੀ ਇੱਕ ਸਥਿਰ ਵਿੰਡੋ ਹੈ ਜੋ ਤੁਹਾਡੀ ਪਹਿਲੀ ਰਿਕੁਐਸਟ ਨਾਲ ਖੁੱਲ੍ਹਦੀ ਹੈ। ਜਦੋਂ ਇਹ ਖਤਮ ਹੁੰਦੀ ਹੈ, ਤਾਂ ਗਿਣਤੀ ਦੁਬਾਰਾ ਸਿਫ਼ਰ ਤੋਂ ਸ਼ੁਰੂ ਹੁੰਦੀ ਹੈ।
- ਗਿਣਤੀ ਪ੍ਰਤੀ ਖਾਤਾ ਹੈ, ਪ੍ਰਤੀ key ਨਹੀਂ ਅਤੇ ਪ੍ਰਤੀ IP ਪਤਾ ਨਹੀਂ। key ਬਦਲਣ ਨਾਲ ਨਵੀਂ ਵਿੰਡੋ ਨਹੀਂ ਖੁੱਲ੍ਹਦੀ।
- ਇੱਕ ਵਿੰਡੋ ਦੇ ਅੰਦਰ 121ਵੀਂ ਰਿਕੁਐਸਟ ਦਾ ਜਵਾਬ ਸਟੇਟਸ
429, ਕਿਸਮrate_limit_errorਅਤੇ ਸੁਨੇਹੇToo many requests. Retry in <N>s.ਨਾਲ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ।Nਵਿੰਡੋ ਖਤਮ ਹੋਣ ਤੱਕ ਦੇ ਸਕਿੰਟ ਹਨ, 1 ਤੋਂ 60 ਤੱਕ। - ਫਲੱਡ ਪ੍ਰੋਟੈਕਸ਼ਨ ਦੀ ਜਾਂਚ ਬੈਲੇਂਸ ਤੋਂ ਪਹਿਲਾਂ ਹੁੰਦੀ ਹੈ। ਜਿਸ ਰਿਕੁਐਸਟ ਨੂੰ ਇਹ ਰੱਦ ਕਰਦੀ ਹੈ, ਉਹ ਕੁਝ ਰਿਜ਼ਰਵ ਨਹੀਂ ਕਰਦੀ ਅਤੇ ਉਸ ਦੀ ਕੋਈ ਲਾਗਤ ਨਹੀਂ ਹੁੰਦੀ।
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | ਰਿਕੁਐਸਟ | ਫਲੱਡ ਪ੍ਰੋਟੈਕਸ਼ਨ |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ, ਪ੍ਰਤੀ ਰਿਕੁਐਸਟ ਇੱਕ। |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | ਨਹੀਂ ਗਿਣਿਆ ਜਾਂਦਾ। |
/v1/chat/completions ਅਤੇ /v1/messages ਉੱਤੇ shannon-coder-1 | ਇਸ ਦੀ ਥਾਂ Shannon Coder ਕਾਲ ਹਿੱਸੇ ਵਿੱਚ ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ। |
ਉਹ ਰਿਕੁਐਸਟ ਜਿਸ ਦਾ ਜਵਾਬ 401 ਨਾਲ ਦਿੱਤਾ ਗਿਆ, ਜਾਂ ਅਣਜਾਣ model ਲਈ 400 ਨਾਲ | ਨਹੀਂ ਗਿਣਿਆ ਜਾਂਦਾ। |
| ਫਲੱਡ ਪ੍ਰੋਟੈਕਸ਼ਨ ਵੱਲੋਂ ਰੱਦ ਕੀਤੀ ਰਿਕੁਐਸਟ | ਵਿੰਡੋ ਵਿੱਚ ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ। ਕੁਝ ਚਾਰਜ ਨਹੀਂ ਹੁੰਦਾ। |
ਸਮਾਂਤਰ ਰਿਕੁਐਸਟਾਂ
ਇੱਕ ਖਾਤਾ ਇੱਕੋ ਸਮੇਂ ਕਿੰਨੀਆਂ ਰਿਕੁਐਸਟਾਂ ਖੁੱਲ੍ਹੀਆਂ ਰੱਖ ਸਕਦਾ ਹੈ, ਇਸ ਦੀ ਕੋਈ ਸੀਮਾ ਨਹੀਂ, ਅਤੇ ਸਮਾਂਤਰ ਰਿਕੁਐਸਟਾਂ ਭੇਜਣ ਲਈ ਕੋਈ ਗਲਤੀ ਨਹੀਂ। ਜੋ ਰਿਕੁਐਸਟਾਂ ਤੁਰੰਤ ਸ਼ੁਰੂ ਨਹੀਂ ਹੋ ਸਕਦੀਆਂ ਉਹ ਕਤਾਰ ਵਿੱਚ ਉਡੀਕ ਕਰਦੀਆਂ ਹਨ ਅਤੇ ਵਾਰੀ ਨਾਲ ਜਵਾਬ ਪਾਉਂਦੀਆਂ ਹਨ।
- ਹਰ ਰਿਕੁਐਸਟ ਪਹੁੰਚਣ ਸਮੇਂ ਪ੍ਰਤੀ ਮਿੰਟ 120 ਵਿੱਚ ਗਿਣੀ ਜਾਂਦੀ ਹੈ, ਭਾਵੇਂ ਪਿਛਲੀਆਂ ਰਿਕੁਐਸਟਾਂ ਖਤਮ ਹੋਈਆਂ ਹੋਣ ਜਾਂ ਨਹੀਂ।
- ਹਰ ਰਿਕੁਐਸਟ ਆਪਣੇ ਅੰਤ ਤੱਕ ਆਪਣੀ ਰਿਜ਼ਰਵੇਸ਼ਨ ਫੜੀ ਰੱਖਦੀ ਹੈ। ਡਿਫਾਲਟ ਆਉਟਪੁੱਟ ਬਜਟ ਵਾਲੀਆਂ ਵੀਹ ਖੁੱਲ੍ਹੀਆਂ ਰਿਕੁਐਸਟਾਂ ਬੈਲੇਂਸ ਦੇ 20 × 4,096 = 81,920 tokens ਫੜਦੀਆਂ ਹਨ। ਜੇ ਰਿਜ਼ਰਵੇਸ਼ਨਾਂ ਮਿਲ ਕੇ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਤੋਂ ਵੱਡੀਆਂ ਹੋਣ, ਤਾਂ ਅਗਲੀ ਰਿਕੁਐਸਟ ਨੂੰ
Quota exceededਜਵਾਬ ਮਿਲਦਾ ਹੈ, ਭਾਵੇਂ ਪੂਰੀਆਂ ਹੋਈਆਂ ਕਾਲਾਂ ਦੀ ਲਾਗਤ ਘੱਟ ਹੁੰਦੀ। ਛੋਟਾmax_tokensਘੱਟ ਫੜਦਾ ਹੈ। - ਬਿਨਾਂ stream ਵਾਲੀ ਰਿਕੁਐਸਟ ਉਦੋਂ ਤੱਕ ਕੁਝ ਨਹੀਂ ਭੇਜਦੀ ਜਦੋਂ ਤੱਕ ਉਸ ਦਾ ਜਵਾਬ ਪੂਰਾ ਨਹੀਂ ਹੋ ਜਾਂਦਾ, ਇਸ ਲਈ ਆਪਣੇ ਕਲਾਇੰਟ ਨੂੰ ਅਜਿਹਾ ਟਾਈਮਆਊਟ ਦਿਓ ਜੋ ਉਡੀਕ ਨੂੰ ਕਵਰ ਕਰੇ। stream ਉਡੀਕ ਕਰਦੇ ਸਮੇਂ ਆਪਣਾ ਕਨੈਕਸ਼ਨ ਖੁੱਲ੍ਹਾ ਰੱਖਦੀ ਹੈ। ਸਟ੍ਰੀਮਿੰਗ
ਇੱਕ ਇਕੱਲੀ ਰਿਕੁਐਸਟ ਦੀਆਂ ਸੀਮਾਵਾਂ
| ਸੀਮਾ | ਮੁੱਲ | ਕਿਸ ਉੱਤੇ ਲਾਗੂ ਹੁੰਦਾ ਹੈ | ਸੀਮਾ ਉੱਤੇ |
|---|---|---|---|
| ਰਿਕੁਐਸਟ body | 32 MiB (33,554,432 ਬਾਈਟ) | ਹਰ endpoint | ਸਟੇਟਸ 413, ਕਿਸਮ invalid_request_error। |
ਆਉਟਪੁੱਟ ਬਜਟ: max_tokens, max_completion_tokens, max_output_tokens | 1 ਤੋਂ 65,536। ਡਿਫਾਲਟ 4,096; /v1/chat/completions ਅਤੇ /v1/messages ਉੱਤੇ shannon-coder-1 ਲਈ ਡਿਫਾਲਟ 65,536 ਹੈ। | ਹਰ ਮਾਡਲ, ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ ਰਿਜ਼ਰਵ ਕੀਤੀ ਰਕਮ ਵਜੋਂ। ਜਵਾਬ ਦੀ ਲੰਬਾਈ ਦੀ ਸੀਮਾ ਵਜੋਂ: ਹੋਸਟ ਕੀਤੇ open-weight ਮਾਡਲ, shannon-1.6-lite, shannon-1.6-pro ਅਤੇ shannon-coder-1। | ਦਾਇਰੇ ਤੋਂ ਬਾਹਰ ਦਾ ਮੁੱਲ ਦਾਇਰੇ ਦੇ ਨਜ਼ਦੀਕੀ ਸਿਰੇ ਤੱਕ ਲਿਆਂਦਾ ਜਾਂਦਾ ਹੈ। ਕੋਈ ਗਲਤੀ ਨਹੀਂ। |
ਰੁਕਣ ਵਾਲੇ ਕ੍ਰਮ: stop, stop_sequences | 4 strings | ਹੋਸਟ ਕੀਤੇ open-weight ਮਾਡਲ | ਪਹਿਲੀਆਂ 4 ਗੈਰ-ਖਾਲੀ strings ਵਰਤੀਆਂ ਜਾਂਦੀਆਂ ਹਨ। |
| URL ਵਜੋਂ ਦਿੱਤੀ ਇਮੇਜ ਜਾਂ ਫਾਈਲ | 8 MiB, 20 ਸਕਿੰਟ ਦੇ ਅੰਦਰ ਪੜ੍ਹੀ ਜਾਂਦੀ ਹੈ, ਵੱਧ ਤੋਂ ਵੱਧ 5 ਰੀਡਾਇਰੈਕਟ, ਜਨਤਕ http ਜਾਂ https ਪਤਾ | ਹਰ endpoint ਜੋ ਇਮੇਜਾਂ ਜਾਂ ਫਾਈਲਾਂ ਲੈਂਦਾ ਹੈ | ਰਿਕੁਐਸਟ ਦਾ ਜਵਾਬ ਉਸ part ਤੋਂ ਬਿਨਾਂ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ। ਕੋਈ ਗਲਤੀ ਨਹੀਂ। |
| ਇਨਲਾਈਨ (base64) ਭੇਜੀ ਇਮੇਜ ਜਾਂ ਫਾਈਲ | ਇਸ ਦੀ ਆਪਣੀ ਕੋਈ ਸੀਮਾ ਨਹੀਂ। ਇਹ 32 MiB ਰਿਕੁਐਸਟ body ਵਿੱਚ ਗਿਣੀ ਜਾਂਦੀ ਹੈ। | ਹਰ endpoint ਜੋ ਇਮੇਜਾਂ ਜਾਂ ਫਾਈਲਾਂ ਲੈਂਦਾ ਹੈ | ਪੂਰੀ ਰਿਕੁਐਸਟ ਲਈ ਸਟੇਟਸ 413। |
POST /v1/tokenize ਦਾ text | 4,000,000 ਬਾਈਟ | /v1/tokenize | ਸਟੇਟਸ 413, ਕਿਸਮ invalid_request_error, ਸੁਨੇਹਾ text too long। |
POST /v1/tokenize ਦਾ messages ਅਤੇ POST /v1/messages/count_tokens ਦੀ body | 32 MiB ਰਿਕੁਐਸਟ body | ਦੋਵੇਂ ਗਿਣਤੀ ਵਾਲੇ endpoints | ਸਟੇਟਸ 413। |
| ਕਾਂਟੈਕਸਟ ਵਿੰਡੋ | ਪ੍ਰਤੀ ਮਾਡਲ: GET /v1/models ਵਿੱਚ context_window | ਹਰ ਮਾਡਲ | ਲੰਮੀ ਗੱਲਬਾਤ ਨਾਲ ਕੀ ਹੁੰਦਾ ਹੈ, ਇਹ ਮਾਡਲ ਉੱਤੇ ਨਿਰਭਰ ਕਰਦਾ ਹੈ। ਮਾਡਲ ਅਤੇ ਕੀਮਤਾਂ |
ਵੈੱਬ ਖੋਜਾਂ (web_search: true) | ਪ੍ਰਤੀ ਪਲਾਨ ਅਤੇ ਦਿਨ: Free 3, Plus 30, Standard 50, Pro 60। ਜਿਸ ਰਿਕੁਐਸਟ ਦੀ ਖੋਜ ਨੂੰ ਨਤੀਜੇ ਮਿਲੇ, ਉਸ ਲਈ ਇੱਕ ਖੋਜ ਗਿਣੀ ਜਾਂਦੀ ਹੈ। | ਉਹ ਰਿਕੁਐਸਟਾਂ ਜੋ web_search: true ਸੈੱਟ ਕਰਦੀਆਂ ਹਨ | ਕੋਈ ਖੋਜ ਬਾਕੀ ਨਾ ਹੋਣ ਉੱਤੇ ਰਿਕੁਐਸਟ ਦਾ ਜਵਾਬ ਖੋਜ ਤੋਂ ਬਿਨਾਂ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ। ਕੋਈ ਗਲਤੀ ਨਹੀਂ। ਵੈੱਬ ਖੋਜ |
ਗਲਤੀਆਂ
ਇਸ ਪੰਨੇ ਦੇ ਜਵਾਬ। /v1/messages ਉੱਤੇ ਉਹੀ error object {"type": "error", "error": {…}} ਵਜੋਂ ਲਪੇਟਿਆ ਜਾਂਦਾ ਹੈ।
| ਸਟੇਟਸ | ਕਿਸਮ | ਸੁਨੇਹਾ | ਕਦੋਂ, ਅਤੇ ਕੀ ਕਰਨਾ ਹੈ |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | ਰਿਕੁਐਸਟ ਦੀ ਰਿਜ਼ਰਵੇਸ਼ਨ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚ ਨਹੀਂ ਸਮਾਉਂਦੀ। 00:00 UTC ਦੀ ਉਡੀਕ ਕਰੋ, ਕ੍ਰੈਡਿਟ ਟੌਪ-ਅੱਪ ਕਰੋ, ਪਲਾਨ ਬਦਲੋ, ਜਾਂ ਛੋਟਾ max_tokens ਭੇਜੋ। |
429 | rate_limit_error | Too many requests. Retry in <N>s. | ਮੌਜੂਦਾ ਮਿੰਟ ਵਿੱਚ 120 ਤੋਂ ਵੱਧ ਰਿਕੁਐਸਟਾਂ। N ਸਕਿੰਟ ਉਡੀਕ ਕਰੋ ਅਤੇ ਦੁਬਾਰਾ ਭੇਜੋ। |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | ਮੌਜੂਦਾ 4 ਘੰਟੇ ਦੀ ਵਿੰਡੋ ਦੀਆਂ Shannon Coder ਕਾਲਾਂ ਖਤਮ ਹੋ ਗਈਆਂ ਹਨ। |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | ਮਾਡਲ ਇਸ ਸਮੇਂ ਰਿਕੁਐਸਟ ਨਹੀਂ ਲੈ ਸਕਦਾ। ਥੋੜ੍ਹੇ ਵਿਰਾਮ ਤੋਂ ਬਾਅਦ ਇਸ ਨੂੰ ਦੁਬਾਰਾ ਭੇਜੋ। |
503 | api_error | Could not verify your quota right now. Please retry. | ਤੁਹਾਡਾ ਬੈਲੇਂਸ ਪੜ੍ਹਿਆ ਨਹੀਂ ਜਾ ਸਕਿਆ। ਕੁਝ ਚਾਰਜ ਨਹੀਂ ਹੁੰਦਾ; ਰਿਕੁਐਸਟ ਦੁਬਾਰਾ ਭੇਜੋ। Shannon ਮਾਡਲ ਨਾਲ /v1/responses ਉੱਤੇ ਸਟੇਟਸ 500 ਹੈ। |
413 | invalid_request_error | ਰਿਕੁਐਸਟ body 32 MiB ਤੋਂ ਵੱਡੀ ਹੈ। OpenAI-ਫਾਰਮੈਟ endpoints ਉੱਤੇ error object ਵਿੱਚ code: "request_too_large" ਹੁੰਦਾ ਹੈ। | |
413 | invalid_request_error | text too long | POST /v1/tokenize ਦਾ text 4,000,000 ਬਾਈਟ ਤੋਂ ਲੰਮਾ ਹੈ। |