ਸਮੱਗਰੀ ਤੇ ਜਾਓ
ਸੀਮਾਵਾਂ ਅਤੇ ਬੈਲੇਂਸ

ਸੀਮਾਵਾਂ ਅਤੇ ਬੈਲੇਂਸ

ਹਰ ਰਿਕੁਐਸਟ ਨੂੰ ਬਰਾਬਰ ਸੇਵਾ ਮਿਲਦੀ ਹੈ। ਕੋਈ ਰੇਟ ਟੀਅਰ ਨਹੀਂ। ਕੋਈ ਵੱਖਰਾ API ਕੋਟਾ ਨਹੀਂ। ਤੁਸੀਂ ਆਪਣੇ tokens ਪਹਿਲਾਂ ਹੀ ਖਰੀਦ ਚੁੱਕੇ ਹੋ — ਉਨ੍ਹਾਂ ਨੂੰ ਜਿੰਨੀ ਤੇਜ਼ੀ ਨਾਲ ਚਾਹੋ ਵਰਤੋ।

ਇਹ ਪੰਨਾ ਸਮਝਾਉਂਦਾ ਹੈ ਕਿ ਤੁਹਾਡਾ ਬੈਲੇਂਸ ਕਿਸ ਤੋਂ ਬਣਿਆ ਹੈ, ਇੱਕ ਰਿਕੁਐਸਟ ਕੀ ਰਿਜ਼ਰਵ ਕਰਦੀ ਹੈ ਅਤੇ ਉਸ ਦੀ ਕੀ ਲਾਗਤ ਹੈ, ਤੁਸੀਂ ਕਿੰਨੀਆਂ ਰਿਕੁਐਸਟਾਂ ਭੇਜ ਸਕਦੇ ਹੋ, ਅਤੇ ਉਹ ਕੁਝ ਸੀਮਾਵਾਂ ਜੋ ਇੱਕ ਇਕੱਲੀ ਰਿਕੁਐਸਟ ਨੂੰ ਮਿਲ ਸਕਦੀਆਂ ਹਨ।

ਬੈਲੇਂਸ ਦੇ 1M tokens ਦਾ ਮੁੱਲ
$5.00
ਰੋਜ਼ਾਨਾ ਹਿੱਸਾ ਨਵਾਂ ਹੁੰਦਾ ਹੈ
00:00 UTC
ਫਲੱਡ ਪ੍ਰੋਟੈਕਸ਼ਨ, ਪ੍ਰਤੀ ਖਾਤਾ
120 ਰਿਕੁਐਸਟਾਂ / ਮਿੰਟ

ਰਿਕੁਐਸਟਾਂ ਨੂੰ ਕਿਵੇਂ ਸੇਵਾ ਮਿਲਦੀ ਹੈ

  • ਕੋਈ ਰੇਟ ਟੀਅਰ ਨਹੀਂ — ਇੱਕ ਨਿਯਮ ਸੀਮਤ ਕਰਦਾ ਹੈ ਕਿ ਰਿਕੁਐਸਟਾਂ ਕਿੰਨੀ ਤੇਜ਼ੀ ਨਾਲ ਪਹੁੰਚ ਸਕਦੀਆਂ ਹਨ, ਅਤੇ ਇਹ ਹਰ ਖਾਤੇ ਅਤੇ ਹਰ ਪਲਾਨ ਲਈ ਇੱਕੋ ਹੈ: ਪ੍ਰਤੀ ਮਿੰਟ 120 ਰਿਕੁਐਸਟਾਂ। ਪ੍ਰਤੀ ਮਿੰਟ tokens ਉੱਤੇ ਕੋਈ ਸੀਮਾ ਨਹੀਂ ਹੈ।
  • ਕੋਈ ਵੱਖਰਾ API ਕੋਟਾ ਨਹੀਂ — API ਉਹੀ ਬੈਲੇਂਸ ਖਰਚ ਕਰਦੀ ਹੈ ਜੋ ਚੈਟ। ਪਲਾਨ ਅੱਜ ਦੇ ਰੋਜ਼ਾਨਾ ਹਿੱਸੇ ਦਾ ਆਕਾਰ ਤੈਅ ਕਰਦਾ ਹੈ। ਇਹ ਰਿਕੁਐਸਟ ਦਰ ਤੈਅ ਨਹੀਂ ਕਰਦਾ।
  • ਜਿੰਨੀ ਤੇਜ਼ੀ ਨਾਲ ਚਾਹੋ — ਸਮਾਂਤਰ ਭੇਜੀਆਂ ਰਿਕੁਐਸਟਾਂ ਸਵੀਕਾਰ ਹੁੰਦੀਆਂ ਹਨ ਅਤੇ ਕਤਾਰ ਵਿੱਚ ਉਡੀਕ ਕਰਦੀਆਂ ਹਨ। ਉਨ੍ਹਾਂ ਨੂੰ ਸਮਾਂਤਰ ਹੋਣ ਕਰਕੇ ਰੱਦ ਨਹੀਂ ਕੀਤਾ ਜਾਂਦਾ।

ਤੁਹਾਡਾ ਬੈਲੇਂਸ

ਤੁਹਾਡਾ ਬੈਲੇਂਸ tokens ਵਿੱਚ ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ। ਬੈਲੇਂਸ ਦੇ 1,000,000 tokens ਦਾ ਮੁੱਲ $5.00 ਹੈ, ਅਤੇ ਮਾਡਲ ਅਤੇ ਕੀਮਤ ਪੰਨੇ ਉੱਤੇ ਹਰ ਕੀਮਤ ਉਸ ਮੁੱਲ ਦੇ ਮੁਕਾਬਲੇ ਇੱਕ ਦਰ ਹੈ।

ਕਿਸੇ ਵੀ ਪਲ ਬੈਲੇਂਸ ਦੋ ਹਿੱਸਿਆਂ ਦਾ ਜੋੜ ਹੁੰਦਾ ਹੈ।

  • ਅੱਜ ਦਾ ਪਲਾਨ ਦਾ ਰੋਜ਼ਾਨਾ ਹਿੱਸਾ — ਤੁਹਾਡੇ ਪਲਾਨ ਵੱਲੋਂ ਤੈਅ ਕੀਤੀ tokens ਦੀ ਗਿਣਤੀ। ਇਹ ਹਰ ਦਿਨ 00:00 UTC ਉੱਤੇ ਨਵੀਂ ਹੋ ਜਾਂਦੀ ਹੈ। ਦਿਨ ਦੇ ਅੰਤ ਵਿੱਚ ਜੋ ਬਚਦਾ ਹੈ ਉਹ ਅੱਗੇ ਨਹੀਂ ਜਾਂਦਾ।
  • ਖਰੀਦਿਆ ਕ੍ਰੈਡਿਟ — tokens ਜੋ ਤੁਸੀਂ ਪੈਕ ਵਜੋਂ ਖਰੀਦੇ। ਕ੍ਰੈਡਿਟ ਦੀ ਮਿਆਦ ਪੂਰੀ ਨਹੀਂ ਹੁੰਦੀ ਅਤੇ ਇਹ Free ਸਮੇਤ ਹਰ ਪਲਾਨ ਉੱਤੇ ਕੰਮ ਕਰਦਾ ਹੈ।
ਪਲਾਨ ਪ੍ਰਤੀ ਦਿਨ tokens ਮੁੱਲ
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • ਖਰਚ ਦਾ ਕ੍ਰਮ — ਹਰ ਰਿਕੁਐਸਟ ਪਹਿਲਾਂ ਅੱਜ ਦਾ ਪਲਾਨ ਦਾ ਰੋਜ਼ਾਨਾ ਹਿੱਸਾ ਖਰਚ ਕਰਦੀ ਹੈ। ਖਰੀਦਿਆ ਕ੍ਰੈਡਿਟ ਸਿਰਫ਼ ਉਸ ਲਈ ਵਰਤਿਆ ਜਾਂਦਾ ਹੈ ਜੋ ਉਸ ਦਿਨ ਇਸ ਹਿੱਸੇ ਤੋਂ ਵੱਧ ਜਾਵੇ।
  • ਚੈਟ ਅਤੇ API ਇਸ ਨੂੰ ਸਾਂਝਾ ਕਰਦੇ ਹਨ — ਹਰ ਖਾਤੇ ਦਾ ਇੱਕ ਬੈਲੇਂਸ ਹੁੰਦਾ ਹੈ। API key ਆਪਣੇ ਮਾਲਕ ਖਾਤੇ ਦੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ, ਚੈਟ ਵਾਲੀਆਂ ਹੀ ਕੀਮਤਾਂ ਉੱਤੇ, ਖਰਚ ਕਰਦੀ ਹੈ।
  • ਪੈਕ — ਕ੍ਰੈਡਿਟ 1,000,000 ($5.00), 2,000,000 ($10.00) ਅਤੇ 5,000,000 ($25.00) tokens ਦੇ ਪੈਕਾਂ ਵਿੱਚ ਵੇਚਿਆ ਜਾਂਦਾ ਹੈ, ਜਾਂ ਤੁਹਾਡੀ ਚੁਣੀ ਹੋਈ ਰਕਮ ਵਜੋਂ 1,000,000 ਤੋਂ 100,000,000 tokens ਤੱਕ, ਪ੍ਰਤੀ 1,000,000 $5.00 ਦੀ ਦਰ ਨਾਲ।

ਕ੍ਰੈਡਿਟ ਟੌਪ-ਅੱਪ ਕਰੋ ਪਲਾਨ ਬਦਲੋ

ਰਿਕੁਐਸਟ ਕੀ ਰਿਜ਼ਰਵ ਕਰਦੀ ਹੈ ਅਤੇ ਉਸ ਦੀ ਕੀ ਲਾਗਤ ਹੈ

  • ਰਿਜ਼ਰਵ — ਜਦੋਂ ਰਿਕੁਐਸਟ ਪਹੁੰਚਦੀ ਹੈ, ਤਾਂ ਉਹ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ ਆਪਣਾ ਆਉਟਪੁੱਟ ਬਜਟ ਰਿਜ਼ਰਵ ਕਰਦੀ ਹੈ: /v1/chat/completions ਅਤੇ /v1/messages ਉੱਤੇ max_tokens, /v1/responses ਉੱਤੇ max_output_tokens। /v1/chat/completions max_completion_tokens ਵੀ ਪੜ੍ਹਦਾ ਹੈ। ਡਿਫਾਲਟ 4,096 ਹੈ ਅਤੇ ਦਾਇਰਾ 1 ਤੋਂ 65,536 ਹੈ।
  • ਸਵੀਕਾਰ — ਰਿਕੁਐਸਟ ਸਿਰਫ਼ ਤਾਂ ਸਵੀਕਾਰ ਹੁੰਦੀ ਹੈ ਜੇ ਰਿਜ਼ਰਵੇਸ਼ਨ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚ ਬਚੇ ਹਿੱਸੇ ਵਿੱਚ ਸਮਾ ਜਾਵੇ। ਜਿਸ ਬੈਲੇਂਸ ਦੀ ਰਕਮ ਸਿਫ਼ਰ ਤੋਂ ਵੱਧ ਹੈ ਪਰ ਆਉਟਪੁੱਟ ਬਜਟ ਤੋਂ ਘੱਟ, ਉਸ ਨੂੰ Quota exceeded ਜਵਾਬ ਮਿਲਦਾ ਹੈ। ਬਾਕੀ ਨੂੰ ਵਰਤਣ ਲਈ ਛੋਟਾ max_tokens ਭੇਜੋ।
  • ਨਿਪਟਾਰਾ — ਜਦੋਂ ਜਵਾਬ ਪੂਰਾ ਹੋ ਜਾਂਦਾ ਹੈ, ਤਾਂ ਰਿਜ਼ਰਵੇਸ਼ਨ ਅਸਲ ਚਾਰਜ ਨਾਲ ਬਦਲ ਦਿੱਤੀ ਜਾਂਦੀ ਹੈ। ਚਾਰਜ ਰਿਜ਼ਰਵੇਸ਼ਨ ਤੋਂ ਘੱਟ ਜਾਂ ਵੱਧ ਹੋ ਸਕਦਾ ਹੈ।
  • ਵਾਪਸੀ — ਜੋ ਰਿਕੁਐਸਟ ਗਲਤੀ ਸਟੇਟਸ ਨਾਲ ਖਤਮ ਹੁੰਦੀ ਹੈ, ਉਹ ਆਪਣੀ ਰਿਜ਼ਰਵੇਸ਼ਨ ਪੂਰੀ ਵਾਪਸ ਕਰ ਦਿੰਦੀ ਹੈ।

ਅਸਲ ਚਾਰਜ ਮਾਡਲ ਦੇ ਪਰਿਵਾਰ ਉੱਤੇ ਨਿਰਭਰ ਕਰਦਾ ਹੈ।

ਮਾਡਲ ਕੀ ਚਾਰਜ ਹੁੰਦਾ ਹੈ
Shannon ਮਾਡਲ ਮਾਡਲ ਦੀ ਪ੍ਰਤੀ 1M ਕੀਮਤ ਉੱਤੇ usage.total_tokens। ਇਨਪੁਟ ਅਤੇ ਆਉਟਪੁੱਟ ਦੀ ਇੱਕ ਹੀ ਦਰ ਹੈ।
ਹੋਸਟ ਕੀਤੇ open-weight ਮਾਡਲ ਕੈਸ਼ ਤੋਂ ਬਿਨਾਂ ਇਨਪੁਟ ਇਨਪੁਟ ਦਰ ਉੱਤੇ, ਕੈਸ਼ਡ ਇਨਪੁਟ ਕੈਸ਼ਡ ਦਰ ਉੱਤੇ, ਆਉਟਪੁੱਟ ਆਉਟਪੁੱਟ ਦਰ ਉੱਤੇ।

USD ਦੀ ਰਕਮ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ tokens ਵਿੱਚ ਪ੍ਰਤੀ 1,000,000 $5.00 ਦੀ ਦਰ ਨਾਲ ਲਈ ਜਾਂਦੀ ਹੈ, ਪੂਰੇ token ਤੱਕ ਗੋਲ ਕਰ ਕੇ।

POST /v1/tokenize ਜਾਂ POST /v1/messages/count_tokens ਨਾਲ tokens ਦੀ ਗਿਣਤੀ ਮੁਫ਼ਤ ਹੈ ਅਤੇ ਕੁਝ ਰਿਜ਼ਰਵ ਨਹੀਂ ਕਰਦੀ। ਟੋਕਨ ਗਿਣਤੀ

ਬੈਲੇਂਸ ਅਤੇ ਵਰਤੋਂ ਕਿੱਥੇ ਵੇਖਣੀ ਹੈ

Keys & usage ਪੰਨਾ ਦਿਖਾਉਂਦਾ ਹੈ ਕਿ ਤੁਸੀਂ ਇਸ ਸਮੇਂ ਕੀ ਖਰਚ ਕਰ ਸਕਦੇ ਹੋ, ਅੱਜ ਦਾ ਪਲਾਨ ਦਾ ਰੋਜ਼ਾਨਾ ਹਿੱਸਾ, ਤੁਹਾਡਾ ਖਰੀਦਿਆ ਕ੍ਰੈਡਿਟ ਅਤੇ ਪਿਛਲੇ 30 ਦਿਨਾਂ ਦਾ API ਖਰਚ। ਉਸ ਦੇ ਹੇਠਾਂ ਇਹ ਤੁਹਾਡੀ key ਵੱਲੋਂ ਕੀਤੀ ਹਰ ਰਿਕੁਐਸਟ ਸੂਚੀਬੱਧ ਕਰਦਾ ਹੈ: ਸਮਾਂ, endpoint, ਮਾਡਲ, ਕੈਸ਼ਡ ਇਨਪੁਟ, ਬਿਲ ਕੀਤੇ tokens ਅਤੇ ਲਾਗਤ। Keys ਅਤੇ ਵਰਤੋਂ

ਹਰ ਜਵਾਬ ਵਿੱਚ ਇੱਕ usage object ਵੀ ਹੁੰਦਾ ਹੈ ਜਿਸ ਵਿੱਚ ਉਸ ਕਾਲ ਦੀਆਂ token ਗਿਣਤੀਆਂ ਹੁੰਦੀਆਂ ਹਨ।

ਐਂਡਪੁਆਇੰਟ usage ਦੇ ਫੀਲਡ ਹੋਸਟ ਕੀਤੇ open-weight ਮਾਡਲਾਂ ਵੱਲੋਂ ਜੋੜੇ ਗਏ
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage ਵਿੱਚ ਮਾਡਲ ਦੀਆਂ token ਗਿਣਤੀਆਂ ਹੁੰਦੀਆਂ ਹਨ। ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ ਲਈ ਗਈ ਰਕਮ ਜਵਾਬ ਵਿੱਚ ਨਹੀਂ ਹੁੰਦੀ: ਉਹ Keys & usage ਉੱਤੇ ਰਿਕੁਐਸਟਾਂ ਦੀ ਸੂਚੀ ਦਾ Billed tokens ਕਾਲਮ ਹੈ।
  • ਹੋਸਟ ਕੀਤੇ open-weight ਮਾਡਲ ਨਾਲ /v1/messages ਉੱਤੇ, input_tokens ਇਨਪੁਟ ਦਾ ਕੈਸ਼ ਤੋਂ ਬਿਨਾਂ ਹਿੱਸਾ ਹੈ, cache_read_input_tokens ਕੈਸ਼ਡ ਹਿੱਸਾ ਹੈ ਅਤੇ cache_creation_input_tokens ਹਮੇਸ਼ਾ 0 ਹੈ।
  • /v1/chat/completions ਉੱਤੇ stream [DONE] ਤੋਂ ਪਹਿਲਾਂ ਆਪਣੇ ਆਖਰੀ chunk ਵਿੱਚ usage ਲੈ ਕੇ ਆਉਂਦੀ ਹੈ। ਸਟ੍ਰੀਮਿੰਗ

ਜਦੋਂ ਬੈਲੇਂਸ ਖਤਮ ਹੋ ਜਾਵੇ

ਜਿਸ ਰਿਕੁਐਸਟ ਦੀ ਰਿਜ਼ਰਵੇਸ਼ਨ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚ ਨਹੀਂ ਸਮਾਉਂਦੀ, ਉਸ ਦਾ ਜਵਾਬ ਸਟੇਟਸ 429, ਕਿਸਮ rate_limit_error ਅਤੇ ਹੇਠਾਂ ਦਿੱਤੇ ਸੁਨੇਹੇ ਨਾਲ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ। ਕੁਝ ਚਾਰਜ ਨਹੀਂ ਹੁੰਦਾ। ਇਹੀ ਜਵਾਬ ਉਦੋਂ ਵੀ ਭੇਜਿਆ ਜਾਂਦਾ ਹੈ ਜਦੋਂ ਬੈਲੇਂਸ ਸਿਫ਼ਰ ਤੋਂ ਵੱਧ ਹੋਵੇ ਪਰ ਰਿਕੁਐਸਟ ਦੇ ਆਉਟਪੁੱਟ ਬਜਟ ਤੋਂ ਘੱਟ।

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses ਉੱਤੇ error object ਵਿੱਚ code ਅਤੇ param ਵੀ ਹੋ ਸਕਦੇ ਹਨ, ਦੋਵੇਂ null।

ਤੁਸੀਂ ਕੀ ਕਰ ਸਕਦੇ ਹੋ:

  • 00:00 UTC ਉੱਤੇ ਅਗਲੇ ਪਲਾਨ ਦੇ ਰੋਜ਼ਾਨਾ ਹਿੱਸੇ ਦੀ ਉਡੀਕ ਕਰੋ।
  • ਕ੍ਰੈਡਿਟ ਟੌਪ-ਅੱਪ ਕਰੋ। ਕ੍ਰੈਡਿਟ ਪਲਾਨ ਦੇ ਰੋਜ਼ਾਨਾ ਹਿੱਸੇ ਤੋਂ ਬਾਅਦ ਖਰਚ ਹੁੰਦਾ ਹੈ ਅਤੇ ਇਸ ਦੀ ਮਿਆਦ ਪੂਰੀ ਨਹੀਂ ਹੁੰਦੀ। ਕ੍ਰੈਡਿਟ ਟੌਪ-ਅੱਪ ਕਰੋ
  • ਵੱਡੇ ਰੋਜ਼ਾਨਾ ਹਿੱਸੇ ਵਾਲੇ ਪਲਾਨ ਉੱਤੇ ਬਦਲੋ। ਪਲਾਨ ਬਦਲੋ
  • ਜੇ ਕੁਝ ਬੈਲੇਂਸ ਬਚਿਆ ਹੈ, ਤਾਂ ਛੋਟਾ max_tokens ਭੇਜੋ: ਫਿਰ ਰਿਜ਼ਰਵੇਸ਼ਨ ਛੋਟੀ ਹੁੰਦੀ ਹੈ।

Shannon Coder ਕਾਲ ਹਿੱਸਾ

/v1/chat/completions ਅਤੇ /v1/messages ਉੱਤੇ shannon-coder-1 ਕਾਲਾਂ ਵਿੱਚ ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ, tokens ਵਿੱਚ ਨਹੀਂ। ਹਰ ਪਲਾਨ ਵਿੱਚ ਪ੍ਰਤੀ 4 ਘੰਟੇ ਦੀ ਵਿੰਡੋ ਕੁਝ ਕਾਲਾਂ ਸ਼ਾਮਲ ਹਨ। ਇੱਕ ਰਿਕੁਐਸਟ ਇੱਕ ਕਾਲ ਹੈ।

ਪਲਾਨ ਹਰ 4 ਘੰਟੇ ਦੀ ਵਿੰਡੋ ਵਿੱਚ ਕਾਲਾਂ
Free 3
Plus 20
Standard 40
Pro 60
  • ਵਿੰਡੋਆਂ 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC ਉੱਤੇ ਸ਼ੁਰੂ ਹੁੰਦੀਆਂ ਹਨ। ਵਿੰਡੋ ਦੇ ਅੰਤ ਵਿੱਚ ਜੋ ਕਾਲਾਂ ਬਚਦੀਆਂ ਹਨ ਉਹ ਅੱਗੇ ਨਹੀਂ ਜਾਂਦੀਆਂ।
  • ਕਾਲ ਉਦੋਂ ਗਿਣੀ ਜਾਂਦੀ ਹੈ ਜਦੋਂ ਰਿਕੁਐਸਟ ਸਵੀਕਾਰ ਹੁੰਦੀ ਹੈ, ਮਾਡਲ ਦੇ ਜਵਾਬ ਦੇਣ ਤੋਂ ਪਹਿਲਾਂ। ਜੋ ਰਿਕੁਐਸਟ ਬਾਅਦ ਵਿੱਚ ਅਸਫਲ ਹੋ ਜਾਵੇ, ਉਹ ਵੀ ਇੱਕ ਕਾਲ ਗਿਣੀ ਜਾਂਦੀ ਹੈ।
  • ਇਹ ਕਾਲਾਂ ਕੋਈ tokens ਰਿਜ਼ਰਵ ਨਹੀਂ ਕਰਦੀਆਂ ਅਤੇ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ ਕੁਝ ਨਹੀਂ ਲੈਂਦੀਆਂ। Keys & usage ਉੱਤੇ ਰਿਕੁਐਸਟਾਂ ਦੀ ਸੂਚੀ ਉਨ੍ਹਾਂ ਦੀ token ਗਿਣਤੀ ਅਤੇ ਸੂਚੀਬੱਧ ਕੀਮਤ ਉੱਤੇ ਉਸ ਦਾ ਮੁੱਲ ਦਿਖਾਉਂਦੀ ਹੈ।
  • ਇਨ੍ਹਾਂ ਦੋ endpoints ਉੱਤੇ shannon-coder-1 ਦਾ ਡਿਫਾਲਟ max_tokens 65,536 ਹੈ।
  • ਕਾਲਾਂ ਬਾਕੀ ਨਾ ਰਹਿਣ ਉੱਤੇ ਜਵਾਬ ਸਟੇਟਸ 429, ਕਿਸਮ rate_limit_error, ਸੁਨੇਹਾ Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan ਹੁੰਦਾ ਹੈ।
  • /v1/responses ਉੱਤੇ shannon-coder-1 ਲਈ ਕੋਈ ਕਾਲ ਹਿੱਸਾ ਨਹੀਂ ਹੈ: ਇਸ ਦਾ ਚਾਰਜ ਹਰ ਹੋਰ ਮਾਡਲ ਵਾਂਗ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਦੇ tokens ਵਿੱਚ ਪ੍ਰਤੀ 1M $8.00 ਉੱਤੇ ਲੱਗਦਾ ਹੈ।

ਫਲੱਡ ਪ੍ਰੋਟੈਕਸ਼ਨ

ਇੱਕ ਖਾਤਾ ਪ੍ਰਤੀ ਮਿੰਟ 120 ਰਿਕੁਐਸਟਾਂ ਭੇਜ ਸਕਦਾ ਹੈ। ਰਿਕੁਐਸਟ ਦਰ ਉੱਤੇ ਇਹੀ ਇੱਕੋ-ਇੱਕ ਸੀਮਾ ਹੈ, ਅਤੇ ਇਹ ਹਰ ਪਲਾਨ ਉੱਤੇ ਇੱਕੋ ਜਿਹੀ ਹੈ। ਇਹ ਹੜ੍ਹ ਰੋਕਣ ਲਈ ਹੈ, ਆਮ ਵਰਤੋਂ ਨੂੰ ਹੌਲੀ ਕਰਨ ਲਈ ਨਹੀਂ।

  • ਮਿੰਟ 60 ਸਕਿੰਟ ਦੀ ਇੱਕ ਸਥਿਰ ਵਿੰਡੋ ਹੈ ਜੋ ਤੁਹਾਡੀ ਪਹਿਲੀ ਰਿਕੁਐਸਟ ਨਾਲ ਖੁੱਲ੍ਹਦੀ ਹੈ। ਜਦੋਂ ਇਹ ਖਤਮ ਹੁੰਦੀ ਹੈ, ਤਾਂ ਗਿਣਤੀ ਦੁਬਾਰਾ ਸਿਫ਼ਰ ਤੋਂ ਸ਼ੁਰੂ ਹੁੰਦੀ ਹੈ।
  • ਗਿਣਤੀ ਪ੍ਰਤੀ ਖਾਤਾ ਹੈ, ਪ੍ਰਤੀ key ਨਹੀਂ ਅਤੇ ਪ੍ਰਤੀ IP ਪਤਾ ਨਹੀਂ। key ਬਦਲਣ ਨਾਲ ਨਵੀਂ ਵਿੰਡੋ ਨਹੀਂ ਖੁੱਲ੍ਹਦੀ।
  • ਇੱਕ ਵਿੰਡੋ ਦੇ ਅੰਦਰ 121ਵੀਂ ਰਿਕੁਐਸਟ ਦਾ ਜਵਾਬ ਸਟੇਟਸ 429, ਕਿਸਮ rate_limit_error ਅਤੇ ਸੁਨੇਹੇ Too many requests. Retry in <N>s. ਨਾਲ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ। N ਵਿੰਡੋ ਖਤਮ ਹੋਣ ਤੱਕ ਦੇ ਸਕਿੰਟ ਹਨ, 1 ਤੋਂ 60 ਤੱਕ।
  • ਫਲੱਡ ਪ੍ਰੋਟੈਕਸ਼ਨ ਦੀ ਜਾਂਚ ਬੈਲੇਂਸ ਤੋਂ ਪਹਿਲਾਂ ਹੁੰਦੀ ਹੈ। ਜਿਸ ਰਿਕੁਐਸਟ ਨੂੰ ਇਹ ਰੱਦ ਕਰਦੀ ਹੈ, ਉਹ ਕੁਝ ਰਿਜ਼ਰਵ ਨਹੀਂ ਕਰਦੀ ਅਤੇ ਉਸ ਦੀ ਕੋਈ ਲਾਗਤ ਨਹੀਂ ਹੁੰਦੀ।
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
ਰਿਕੁਐਸਟ ਫਲੱਡ ਪ੍ਰੋਟੈਕਸ਼ਨ
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ, ਪ੍ਰਤੀ ਰਿਕੁਐਸਟ ਇੱਕ।
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens ਨਹੀਂ ਗਿਣਿਆ ਜਾਂਦਾ।
/v1/chat/completions ਅਤੇ /v1/messages ਉੱਤੇ shannon-coder-1 ਇਸ ਦੀ ਥਾਂ Shannon Coder ਕਾਲ ਹਿੱਸੇ ਵਿੱਚ ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ।
ਉਹ ਰਿਕੁਐਸਟ ਜਿਸ ਦਾ ਜਵਾਬ 401 ਨਾਲ ਦਿੱਤਾ ਗਿਆ, ਜਾਂ ਅਣਜਾਣ model ਲਈ 400 ਨਾਲ ਨਹੀਂ ਗਿਣਿਆ ਜਾਂਦਾ।
ਫਲੱਡ ਪ੍ਰੋਟੈਕਸ਼ਨ ਵੱਲੋਂ ਰੱਦ ਕੀਤੀ ਰਿਕੁਐਸਟ ਵਿੰਡੋ ਵਿੱਚ ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ। ਕੁਝ ਚਾਰਜ ਨਹੀਂ ਹੁੰਦਾ।

ਸਮਾਂਤਰ ਰਿਕੁਐਸਟਾਂ

ਇੱਕ ਖਾਤਾ ਇੱਕੋ ਸਮੇਂ ਕਿੰਨੀਆਂ ਰਿਕੁਐਸਟਾਂ ਖੁੱਲ੍ਹੀਆਂ ਰੱਖ ਸਕਦਾ ਹੈ, ਇਸ ਦੀ ਕੋਈ ਸੀਮਾ ਨਹੀਂ, ਅਤੇ ਸਮਾਂਤਰ ਰਿਕੁਐਸਟਾਂ ਭੇਜਣ ਲਈ ਕੋਈ ਗਲਤੀ ਨਹੀਂ। ਜੋ ਰਿਕੁਐਸਟਾਂ ਤੁਰੰਤ ਸ਼ੁਰੂ ਨਹੀਂ ਹੋ ਸਕਦੀਆਂ ਉਹ ਕਤਾਰ ਵਿੱਚ ਉਡੀਕ ਕਰਦੀਆਂ ਹਨ ਅਤੇ ਵਾਰੀ ਨਾਲ ਜਵਾਬ ਪਾਉਂਦੀਆਂ ਹਨ।

  • ਹਰ ਰਿਕੁਐਸਟ ਪਹੁੰਚਣ ਸਮੇਂ ਪ੍ਰਤੀ ਮਿੰਟ 120 ਵਿੱਚ ਗਿਣੀ ਜਾਂਦੀ ਹੈ, ਭਾਵੇਂ ਪਿਛਲੀਆਂ ਰਿਕੁਐਸਟਾਂ ਖਤਮ ਹੋਈਆਂ ਹੋਣ ਜਾਂ ਨਹੀਂ।
  • ਹਰ ਰਿਕੁਐਸਟ ਆਪਣੇ ਅੰਤ ਤੱਕ ਆਪਣੀ ਰਿਜ਼ਰਵੇਸ਼ਨ ਫੜੀ ਰੱਖਦੀ ਹੈ। ਡਿਫਾਲਟ ਆਉਟਪੁੱਟ ਬਜਟ ਵਾਲੀਆਂ ਵੀਹ ਖੁੱਲ੍ਹੀਆਂ ਰਿਕੁਐਸਟਾਂ ਬੈਲੇਂਸ ਦੇ 20 × 4,096 = 81,920 tokens ਫੜਦੀਆਂ ਹਨ। ਜੇ ਰਿਜ਼ਰਵੇਸ਼ਨਾਂ ਮਿਲ ਕੇ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਤੋਂ ਵੱਡੀਆਂ ਹੋਣ, ਤਾਂ ਅਗਲੀ ਰਿਕੁਐਸਟ ਨੂੰ Quota exceeded ਜਵਾਬ ਮਿਲਦਾ ਹੈ, ਭਾਵੇਂ ਪੂਰੀਆਂ ਹੋਈਆਂ ਕਾਲਾਂ ਦੀ ਲਾਗਤ ਘੱਟ ਹੁੰਦੀ। ਛੋਟਾ max_tokens ਘੱਟ ਫੜਦਾ ਹੈ।
  • ਬਿਨਾਂ stream ਵਾਲੀ ਰਿਕੁਐਸਟ ਉਦੋਂ ਤੱਕ ਕੁਝ ਨਹੀਂ ਭੇਜਦੀ ਜਦੋਂ ਤੱਕ ਉਸ ਦਾ ਜਵਾਬ ਪੂਰਾ ਨਹੀਂ ਹੋ ਜਾਂਦਾ, ਇਸ ਲਈ ਆਪਣੇ ਕਲਾਇੰਟ ਨੂੰ ਅਜਿਹਾ ਟਾਈਮਆਊਟ ਦਿਓ ਜੋ ਉਡੀਕ ਨੂੰ ਕਵਰ ਕਰੇ। stream ਉਡੀਕ ਕਰਦੇ ਸਮੇਂ ਆਪਣਾ ਕਨੈਕਸ਼ਨ ਖੁੱਲ੍ਹਾ ਰੱਖਦੀ ਹੈ। ਸਟ੍ਰੀਮਿੰਗ

ਇੱਕ ਇਕੱਲੀ ਰਿਕੁਐਸਟ ਦੀਆਂ ਸੀਮਾਵਾਂ

ਸੀਮਾ ਮੁੱਲ ਕਿਸ ਉੱਤੇ ਲਾਗੂ ਹੁੰਦਾ ਹੈ ਸੀਮਾ ਉੱਤੇ
ਰਿਕੁਐਸਟ body 32 MiB (33,554,432 ਬਾਈਟ) ਹਰ endpoint ਸਟੇਟਸ 413, ਕਿਸਮ invalid_request_error।
ਆਉਟਪੁੱਟ ਬਜਟ: max_tokens, max_completion_tokens, max_output_tokens 1 ਤੋਂ 65,536। ਡਿਫਾਲਟ 4,096; /v1/chat/completions ਅਤੇ /v1/messages ਉੱਤੇ shannon-coder-1 ਲਈ ਡਿਫਾਲਟ 65,536 ਹੈ। ਹਰ ਮਾਡਲ, ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚੋਂ ਰਿਜ਼ਰਵ ਕੀਤੀ ਰਕਮ ਵਜੋਂ। ਜਵਾਬ ਦੀ ਲੰਬਾਈ ਦੀ ਸੀਮਾ ਵਜੋਂ: ਹੋਸਟ ਕੀਤੇ open-weight ਮਾਡਲ, shannon-1.6-lite, shannon-1.6-pro ਅਤੇ shannon-coder-1। ਦਾਇਰੇ ਤੋਂ ਬਾਹਰ ਦਾ ਮੁੱਲ ਦਾਇਰੇ ਦੇ ਨਜ਼ਦੀਕੀ ਸਿਰੇ ਤੱਕ ਲਿਆਂਦਾ ਜਾਂਦਾ ਹੈ। ਕੋਈ ਗਲਤੀ ਨਹੀਂ।
ਰੁਕਣ ਵਾਲੇ ਕ੍ਰਮ: stop, stop_sequences 4 strings ਹੋਸਟ ਕੀਤੇ open-weight ਮਾਡਲ ਪਹਿਲੀਆਂ 4 ਗੈਰ-ਖਾਲੀ strings ਵਰਤੀਆਂ ਜਾਂਦੀਆਂ ਹਨ।
URL ਵਜੋਂ ਦਿੱਤੀ ਇਮੇਜ ਜਾਂ ਫਾਈਲ 8 MiB, 20 ਸਕਿੰਟ ਦੇ ਅੰਦਰ ਪੜ੍ਹੀ ਜਾਂਦੀ ਹੈ, ਵੱਧ ਤੋਂ ਵੱਧ 5 ਰੀਡਾਇਰੈਕਟ, ਜਨਤਕ http ਜਾਂ https ਪਤਾ ਹਰ endpoint ਜੋ ਇਮੇਜਾਂ ਜਾਂ ਫਾਈਲਾਂ ਲੈਂਦਾ ਹੈ ਰਿਕੁਐਸਟ ਦਾ ਜਵਾਬ ਉਸ part ਤੋਂ ਬਿਨਾਂ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ। ਕੋਈ ਗਲਤੀ ਨਹੀਂ।
ਇਨਲਾਈਨ (base64) ਭੇਜੀ ਇਮੇਜ ਜਾਂ ਫਾਈਲ ਇਸ ਦੀ ਆਪਣੀ ਕੋਈ ਸੀਮਾ ਨਹੀਂ। ਇਹ 32 MiB ਰਿਕੁਐਸਟ body ਵਿੱਚ ਗਿਣੀ ਜਾਂਦੀ ਹੈ। ਹਰ endpoint ਜੋ ਇਮੇਜਾਂ ਜਾਂ ਫਾਈਲਾਂ ਲੈਂਦਾ ਹੈ ਪੂਰੀ ਰਿਕੁਐਸਟ ਲਈ ਸਟੇਟਸ 413।
POST /v1/tokenize ਦਾ text 4,000,000 ਬਾਈਟ /v1/tokenize ਸਟੇਟਸ 413, ਕਿਸਮ invalid_request_error, ਸੁਨੇਹਾ text too long।
POST /v1/tokenize ਦਾ messages ਅਤੇ POST /v1/messages/count_tokens ਦੀ body 32 MiB ਰਿਕੁਐਸਟ body ਦੋਵੇਂ ਗਿਣਤੀ ਵਾਲੇ endpoints ਸਟੇਟਸ 413।
ਕਾਂਟੈਕਸਟ ਵਿੰਡੋ ਪ੍ਰਤੀ ਮਾਡਲ: GET /v1/models ਵਿੱਚ context_window ਹਰ ਮਾਡਲ ਲੰਮੀ ਗੱਲਬਾਤ ਨਾਲ ਕੀ ਹੁੰਦਾ ਹੈ, ਇਹ ਮਾਡਲ ਉੱਤੇ ਨਿਰਭਰ ਕਰਦਾ ਹੈ। ਮਾਡਲ ਅਤੇ ਕੀਮਤਾਂ
ਵੈੱਬ ਖੋਜਾਂ (web_search: true) ਪ੍ਰਤੀ ਪਲਾਨ ਅਤੇ ਦਿਨ: Free 3, Plus 30, Standard 50, Pro 60। ਜਿਸ ਰਿਕੁਐਸਟ ਦੀ ਖੋਜ ਨੂੰ ਨਤੀਜੇ ਮਿਲੇ, ਉਸ ਲਈ ਇੱਕ ਖੋਜ ਗਿਣੀ ਜਾਂਦੀ ਹੈ। ਉਹ ਰਿਕੁਐਸਟਾਂ ਜੋ web_search: true ਸੈੱਟ ਕਰਦੀਆਂ ਹਨ ਕੋਈ ਖੋਜ ਬਾਕੀ ਨਾ ਹੋਣ ਉੱਤੇ ਰਿਕੁਐਸਟ ਦਾ ਜਵਾਬ ਖੋਜ ਤੋਂ ਬਿਨਾਂ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ। ਕੋਈ ਗਲਤੀ ਨਹੀਂ। ਵੈੱਬ ਖੋਜ

ਗਲਤੀਆਂ

ਇਸ ਪੰਨੇ ਦੇ ਜਵਾਬ। /v1/messages ਉੱਤੇ ਉਹੀ error object {"type": "error", "error": {…}} ਵਜੋਂ ਲਪੇਟਿਆ ਜਾਂਦਾ ਹੈ।

ਸਟੇਟਸ ਕਿਸਮ ਸੁਨੇਹਾ ਕਦੋਂ, ਅਤੇ ਕੀ ਕਰਨਾ ਹੈ
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan ਰਿਕੁਐਸਟ ਦੀ ਰਿਜ਼ਰਵੇਸ਼ਨ ਤੁਹਾਡੇ ਬੈਲੇਂਸ ਵਿੱਚ ਨਹੀਂ ਸਮਾਉਂਦੀ। 00:00 UTC ਦੀ ਉਡੀਕ ਕਰੋ, ਕ੍ਰੈਡਿਟ ਟੌਪ-ਅੱਪ ਕਰੋ, ਪਲਾਨ ਬਦਲੋ, ਜਾਂ ਛੋਟਾ max_tokens ਭੇਜੋ।
429 rate_limit_error Too many requests. Retry in <N>s. ਮੌਜੂਦਾ ਮਿੰਟ ਵਿੱਚ 120 ਤੋਂ ਵੱਧ ਰਿਕੁਐਸਟਾਂ। N ਸਕਿੰਟ ਉਡੀਕ ਕਰੋ ਅਤੇ ਦੁਬਾਰਾ ਭੇਜੋ।
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan ਮੌਜੂਦਾ 4 ਘੰਟੇ ਦੀ ਵਿੰਡੋ ਦੀਆਂ Shannon Coder ਕਾਲਾਂ ਖਤਮ ਹੋ ਗਈਆਂ ਹਨ।
429 rate_limit_error Shannon routes are temporarily busy. Please retry. ਮਾਡਲ ਇਸ ਸਮੇਂ ਰਿਕੁਐਸਟ ਨਹੀਂ ਲੈ ਸਕਦਾ। ਥੋੜ੍ਹੇ ਵਿਰਾਮ ਤੋਂ ਬਾਅਦ ਇਸ ਨੂੰ ਦੁਬਾਰਾ ਭੇਜੋ।
503 api_error Could not verify your quota right now. Please retry. ਤੁਹਾਡਾ ਬੈਲੇਂਸ ਪੜ੍ਹਿਆ ਨਹੀਂ ਜਾ ਸਕਿਆ। ਕੁਝ ਚਾਰਜ ਨਹੀਂ ਹੁੰਦਾ; ਰਿਕੁਐਸਟ ਦੁਬਾਰਾ ਭੇਜੋ। Shannon ਮਾਡਲ ਨਾਲ /v1/responses ਉੱਤੇ ਸਟੇਟਸ 500 ਹੈ।
413 invalid_request_error ਰਿਕੁਐਸਟ body 32 MiB ਤੋਂ ਵੱਡੀ ਹੈ। OpenAI-ਫਾਰਮੈਟ endpoints ਉੱਤੇ error object ਵਿੱਚ code: "request_too_large" ਹੁੰਦਾ ਹੈ।
413 invalid_request_error text too long POST /v1/tokenize ਦਾ text 4,000,000 ਬਾਈਟ ਤੋਂ ਲੰਮਾ ਹੈ।