ವಿಷಯಕ್ಕೆ ಹೋಗಿ
ಮಿತಿಗಳು ಮತ್ತು ಬ್ಯಾಲೆನ್ಸ್

ಮಿತಿಗಳು ಮತ್ತು ಬ್ಯಾಲೆನ್ಸ್

ಪ್ರತಿ ವಿನಂತಿಯನ್ನು ಸಮಾನವಾಗಿ ನಿರ್ವಹಿಸಲಾಗುತ್ತದೆ. ದರ ಶ್ರೇಣಿಗಳಿಲ್ಲ. ಪ್ರತ್ಯೇಕ API ಕೋಟಾ ಇಲ್ಲ. ನಿಮ್ಮ ಟೋಕನ್‌ಗಳಿಗೆ ನೀವು ಈಗಾಗಲೇ ಪಾವತಿಸಿದ್ದೀರಿ, ಅವನ್ನು ನಿಮಗೆ ಇಷ್ಟವಾದಷ್ಟು ವೇಗವಾಗಿ ಬಳಸಿ.

ಈ ಪುಟ ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ ಯಾವುದರಿಂದ ಮಾಡಲ್ಪಟ್ಟಿದೆ, ಒಂದು ವಿನಂತಿ ಏನನ್ನು ಮೀಸಲಿಡುತ್ತದೆ ಮತ್ತು ಎಷ್ಟು ವೆಚ್ಚವಾಗುತ್ತದೆ, ನೀವು ಎಷ್ಟು ವಿನಂತಿಗಳನ್ನು ಕಳುಹಿಸಬಹುದು, ಮತ್ತು ಒಂದು ವಿನಂತಿ ಎದುರಿಸಬಹುದಾದ ಕೆಲವು ಮಿತಿಗಳನ್ನು ವಿವರಿಸುತ್ತದೆ.

1M ಟೋಕನ್‌ಗಳ ಬ್ಯಾಲೆನ್ಸ್‌ನ ಮೌಲ್ಯ
$5.00
ದೈನಂದಿನ ಭತ್ಯೆ ನವೀಕರಣ
00:00 UTC
ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್, ಪ್ರತಿ ಖಾತೆಗೆ
120 ವಿನಂತಿಗಳು / ನಿಮಿಷ

ವಿನಂತಿಗಳನ್ನು ಹೇಗೆ ನಿರ್ವಹಿಸಲಾಗುತ್ತದೆ

  • ದರ ಶ್ರೇಣಿಗಳಿಲ್ಲ — ವಿನಂತಿಗಳು ಎಷ್ಟು ವೇಗವಾಗಿ ಬರಬಹುದು ಎಂಬುದನ್ನು ಒಂದು ನಿಯಮ ಮಿತಿಗೊಳಿಸುತ್ತದೆ, ಮತ್ತು ಅದು ಪ್ರತಿ ಖಾತೆ ಹಾಗೂ ಪ್ರತಿ ಪ್ಲ್ಯಾನ್‌ಗೆ ಒಂದೇ: ನಿಮಿಷಕ್ಕೆ 120 ವಿನಂತಿಗಳು. ನಿಮಿಷಕ್ಕೆ ಟೋಕನ್‌ಗಳ ಮೇಲೆ ಮಿತಿ ಇಲ್ಲ.
  • ಪ್ರತ್ಯೇಕ API ಕೋಟಾ ಇಲ್ಲ — API ಚಾಟ್‌ನ ಅದೇ ಬ್ಯಾಲೆನ್ಸ್ ಅನ್ನು ಖರ್ಚು ಮಾಡುತ್ತದೆ. ಪ್ಲ್ಯಾನ್ ಇಂದಿನ ಭತ್ಯೆಯ ಗಾತ್ರವನ್ನು ನಿಗದಿಪಡಿಸುತ್ತದೆ. ಅದು ವಿನಂತಿ ದರವನ್ನು ನಿಗದಿಪಡಿಸುವುದಿಲ್ಲ.
  • ನಿಮಗೆ ಇಷ್ಟವಾದಷ್ಟು ವೇಗವಾಗಿ — ಸಮಾನಾಂತರವಾಗಿ ಕಳುಹಿಸಿದ ವಿನಂತಿಗಳನ್ನು ಸ್ವೀಕರಿಸಿ ಸರದಿಯಲ್ಲಿ ಕಾಯಿಸಲಾಗುತ್ತದೆ. ಸಮಾನಾಂತರ ಎಂಬ ಕಾರಣಕ್ಕೆ ಅವನ್ನು ನಿರಾಕರಿಸಲಾಗುವುದಿಲ್ಲ.

ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್

ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ ಅನ್ನು ಟೋಕನ್‌ಗಳಲ್ಲಿ ಎಣಿಸಲಾಗುತ್ತದೆ. 1,000,000 ಟೋಕನ್‌ಗಳ ಬ್ಯಾಲೆನ್ಸ್‌ನ ಮೌಲ್ಯ $5.00, ಮತ್ತು Models & pricing ಪುಟದ ಪ್ರತಿ ಬೆಲೆ ಆ ಮೌಲ್ಯದ ವಿರುದ್ಧದ ದರ.

ಯಾವುದೇ ಕ್ಷಣದಲ್ಲಿ ಬ್ಯಾಲೆನ್ಸ್ ಎರಡು ಭಾಗಗಳ ಮೊತ್ತ.

  • ಇಂದಿನ ಪ್ಲ್ಯಾನ್ ಭತ್ಯೆ — ನಿಮ್ಮ ಪ್ಲ್ಯಾನ್ ನಿಗದಿಪಡಿಸಿದ ಟೋಕನ್‌ಗಳ ಸಂಖ್ಯೆ. ಇದು ಪ್ರತಿದಿನ 00:00 UTC ಗೆ ಹೊಸದಾಗುತ್ತದೆ. ದಿನದ ಕೊನೆಯಲ್ಲಿ ಉಳಿದದ್ದು ಮುಂದಕ್ಕೆ ಹೋಗುವುದಿಲ್ಲ.
  • ಖರೀದಿಸಿದ ಕ್ರೆಡಿಟ್ — ನೀವು ಪ್ಯಾಕ್ ಆಗಿ ಖರೀದಿಸಿದ ಟೋಕನ್‌ಗಳು. ಕ್ರೆಡಿಟ್ ಅವಧಿ ಮುಗಿಯುವುದಿಲ್ಲ ಮತ್ತು Free ಸೇರಿದಂತೆ ಪ್ರತಿ ಪ್ಲ್ಯಾನ್‌ನಲ್ಲೂ ಕೆಲಸ ಮಾಡುತ್ತದೆ.
ಪ್ಲ್ಯಾನ್ ದಿನಕ್ಕೆ ಟೋಕನ್‌ಗಳು ಮೌಲ್ಯ
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • ಖರ್ಚಿನ ಕ್ರಮ — ಪ್ರತಿ ವಿನಂತಿ ಮೊದಲು ಇಂದಿನ ಪ್ಲ್ಯಾನ್ ಭತ್ಯೆಯನ್ನು ಖರ್ಚು ಮಾಡುತ್ತದೆ. ಖರೀದಿಸಿದ ಕ್ರೆಡಿಟ್ ಅನ್ನು ಆ ದಿನ ಭತ್ಯೆಯನ್ನು ಮೀರಿದ್ದಕ್ಕೆ ಮಾತ್ರ ಬಳಸಲಾಗುತ್ತದೆ.
  • ಚಾಟ್ ಮತ್ತು API ಇದನ್ನು ಹಂಚಿಕೊಳ್ಳುತ್ತವೆ — ಪ್ರತಿ ಖಾತೆಗೆ ಒಂದು ಬ್ಯಾಲೆನ್ಸ್ ಇದೆ. API ಕೀ ಅದನ್ನು ಹೊಂದಿರುವ ಖಾತೆಯ ಬ್ಯಾಲೆನ್ಸ್‌ನಿಂದ, ಚಾಟ್‌ನ ಅದೇ ಬೆಲೆಗಳಲ್ಲಿ ಖರ್ಚು ಮಾಡುತ್ತದೆ.
  • ಪ್ಯಾಕ್‌ಗಳು — ಕ್ರೆಡಿಟ್ ಅನ್ನು 1,000,000 ($5.00), 2,000,000 ($10.00) ಮತ್ತು 5,000,000 ($25.00) ಟೋಕನ್‌ಗಳ ಪ್ಯಾಕ್‌ಗಳಲ್ಲಿ, ಅಥವಾ 1,000,000 ರಿಂದ 100,000,000 ಟೋಕನ್‌ಗಳವರೆಗೆ ನೀವು ಆರಿಸಿದ ಮೊತ್ತದಲ್ಲಿ 1,000,000 ಕ್ಕೆ $5.00 ರಂತೆ ಮಾರಲಾಗುತ್ತದೆ.

ಕ್ರೆಡಿಟ್ ಟಾಪ್ ಅಪ್ ಮಾಡಿ ಪ್ಲ್ಯಾನ್ ಬದಲಾಯಿಸಿ

ವಿನಂತಿ ಏನನ್ನು ಮೀಸಲಿಡುತ್ತದೆ ಮತ್ತು ಎಷ್ಟು ವೆಚ್ಚವಾಗುತ್ತದೆ

  • ಮೀಸಲು — ವಿನಂತಿ ಬಂದಾಗ ಅದು ತನ್ನ ಔಟ್‌ಪುಟ್ ಬಜೆಟ್ ಅನ್ನು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಿಂದ ಮೀಸಲಿಡುತ್ತದೆ: /v1/chat/completions ಮತ್ತು /v1/messages ನಲ್ಲಿ max_tokens, /v1/responses ನಲ್ಲಿ max_output_tokens. /v1/chat/completions max_completion_tokens ಅನ್ನೂ ಓದುತ್ತದೆ. ಡೀಫಾಲ್ಟ್ 4,096 ಮತ್ತು ವ್ಯಾಪ್ತಿ 1 ರಿಂದ 65,536.
  • ಸ್ವೀಕಾರ — ಮೀಸಲು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಲ್ಲಿ ಉಳಿದಿರುವುದಕ್ಕೆ ಹೊಂದಿದರೆ ಮಾತ್ರ ವಿನಂತಿಯನ್ನು ಸ್ವೀಕರಿಸಲಾಗುತ್ತದೆ. ಸೊನ್ನೆಗಿಂತ ಹೆಚ್ಚಿದ್ದರೂ ಔಟ್‌ಪುಟ್ ಬಜೆಟ್‌ಗಿಂತ ಚಿಕ್ಕದಾದ ಬ್ಯಾಲೆನ್ಸ್‌ಗೆ Quota exceeded ಉತ್ತರ ಸಿಗುತ್ತದೆ. ಉಳಿದದ್ದನ್ನು ಬಳಸಲು ಚಿಕ್ಕ max_tokens ಕಳುಹಿಸಿ.
  • ಇತ್ಯರ್ಥ — ಉತ್ತರ ಪೂರ್ಣಗೊಂಡಾಗ, ಮೀಸಲನ್ನು ನಿಜವಾದ ಶುಲ್ಕದಿಂದ ಬದಲಾಯಿಸಲಾಗುತ್ತದೆ. ಶುಲ್ಕ ಮೀಸಲಿಗಿಂತ ಕಡಿಮೆ ಅಥವಾ ಹೆಚ್ಚು ಇರಬಹುದು.
  • ಹಿಂತಿರುಗಿಸುವಿಕೆ — ದೋಷ ಸ್ಥಿತಿಯೊಂದಿಗೆ ಕೊನೆಗೊಳ್ಳುವ ವಿನಂತಿ ತನ್ನ ಮೀಸಲನ್ನು ಪೂರ್ಣವಾಗಿ ಹಿಂತಿರುಗಿಸುತ್ತದೆ.

ನಿಜವಾದ ಶುಲ್ಕ ಮಾಡೆಲ್ ಕುಟುಂಬವನ್ನು ಅವಲಂಬಿಸಿದೆ.

ಮಾಡೆಲ್‌ಗಳು ಏನು ಶುಲ್ಕ ವಿಧಿಸಲಾಗುತ್ತದೆ
Shannon ಮಾಡೆಲ್‌ಗಳು ಮಾಡೆಲ್‌ನ 1M ಗೆ ಬೆಲೆಯಲ್ಲಿ usage.total_tokens. ಇನ್‌ಪುಟ್ ಮತ್ತು ಔಟ್‌ಪುಟ್‌ಗೆ ಒಂದೇ ದರ.
ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು ಕ್ಯಾಶ್ ಆಗದ ಇನ್‌ಪುಟ್ ಇನ್‌ಪುಟ್ ದರದಲ್ಲಿ, ಕ್ಯಾಶ್ ಆದ ಇನ್‌ಪುಟ್ ಕ್ಯಾಶ್ ದರದಲ್ಲಿ, ಔಟ್‌ಪುಟ್ ಔಟ್‌ಪುಟ್ ದರದಲ್ಲಿ.

USD ಮೊತ್ತವನ್ನು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಿಂದ 1,000,000 ಕ್ಕೆ $5.00 ರಂತೆ ಟೋಕನ್‌ಗಳಲ್ಲಿ ತೆಗೆದುಕೊಳ್ಳಲಾಗುತ್ತದೆ, ಪೂರ್ಣ ಟೋಕನ್‌ಗೆ ಸುತ್ತಲಾಗುತ್ತದೆ.

POST /v1/tokenize ಅಥವಾ POST /v1/messages/count_tokens ನೊಂದಿಗೆ ಟೋಕನ್ ಎಣಿಕೆ ಉಚಿತ ಮತ್ತು ಏನನ್ನೂ ಮೀಸಲಿಡುವುದಿಲ್ಲ. ಟೋಕನ್ ಎಣಿಕೆ

ಬ್ಯಾಲೆನ್ಸ್ ಮತ್ತು ಬಳಕೆಯನ್ನು ಎಲ್ಲಿ ನೋಡಬೇಕು

Keys & usage ಪುಟವು ನೀವು ಈಗ ಖರ್ಚು ಮಾಡಬಹುದಾದದ್ದನ್ನು, ಇಂದಿನ ಪ್ಲ್ಯಾನ್ ಭತ್ಯೆ, ನೀವು ಖರೀದಿಸಿದ ಕ್ರೆಡಿಟ್ ಮತ್ತು ಕಳೆದ 30 ದಿನಗಳ API ವೆಚ್ಚವನ್ನು ತೋರಿಸುತ್ತದೆ. ಅದರ ಕೆಳಗೆ ನಿಮ್ಮ ಕೀ ಮಾಡಿದ ಪ್ರತಿ ವಿನಂತಿಯನ್ನು ಪಟ್ಟಿ ಮಾಡುತ್ತದೆ: ಸಮಯ, ಎಂಡ್‌ಪಾಯಿಂಟ್, ಮಾಡೆಲ್, ಕ್ಯಾಶ್ ಆದ ಇನ್‌ಪುಟ್, ಬಿಲ್ ಮಾಡಿದ ಟೋಕನ್‌ಗಳು ಮತ್ತು ವೆಚ್ಚ. ಕೀಗಳು ಮತ್ತು ಬಳಕೆ

ಪ್ರತಿ ಉತ್ತರವೂ ಆ ಕರೆಯ ಟೋಕನ್ ಎಣಿಕೆಗಳಿರುವ usage ಆಬ್ಜೆಕ್ಟ್ ಅನ್ನು ಹೊಂದಿರುತ್ತದೆ.

ಎಂಡ್‌ಪಾಯಿಂಟ್ usage ನ ಫೀಲ್ಡ್‌ಗಳು ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು ಸೇರಿಸುವುದು
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage ಮಾಡೆಲ್‌ನ ಟೋಕನ್ ಎಣಿಕೆಗಳನ್ನು ಹೊಂದಿರುತ್ತದೆ. ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಿಂದ ತೆಗೆದುಕೊಂಡ ಮೊತ್ತ ಉತ್ತರದಲ್ಲಿಲ್ಲ: ಅದು Keys & usage ನ ವಿನಂತಿ ಪಟ್ಟಿಯ Billed tokens ಕಾಲಮ್.
  • ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ನೊಂದಿಗೆ /v1/messages ನಲ್ಲಿ, input_tokens ಇನ್‌ಪುಟ್‌ನ ಕ್ಯಾಶ್ ಆಗದ ಭಾಗ, cache_read_input_tokens ಕ್ಯಾಶ್ ಆದ ಭಾಗ ಮತ್ತು cache_creation_input_tokens ಯಾವಾಗಲೂ 0.
  • /v1/chat/completions ನಲ್ಲಿ stream [DONE] ಮೊದಲಿನ ತನ್ನ ಕೊನೆಯ chunk ನಲ್ಲಿ usage ಹೊತ್ತಿರುತ್ತದೆ. ಸ್ಟ್ರೀಮಿಂಗ್

ಬ್ಯಾಲೆನ್ಸ್ ಖಾಲಿಯಾದಾಗ

ಮೀಸಲು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ಗೆ ಹೊಂದದ ವಿನಂತಿಗೆ ಸ್ಥಿತಿ 429, ವಿಧ rate_limit_error ಮತ್ತು ಕೆಳಗಿನ ಸಂದೇಶದೊಂದಿಗೆ ಉತ್ತರಿಸಲಾಗುತ್ತದೆ. ಏನನ್ನೂ ಶುಲ್ಕ ವಿಧಿಸಲಾಗುವುದಿಲ್ಲ. ಬ್ಯಾಲೆನ್ಸ್ ಸೊನ್ನೆಗಿಂತ ಹೆಚ್ಚಿದ್ದರೂ ವಿನಂತಿಯ ಔಟ್‌ಪುಟ್ ಬಜೆಟ್‌ಗಿಂತ ಚಿಕ್ಕದಾಗಿದ್ದಾಗಲೂ ಇದೇ ಉತ್ತರ ಬರುತ್ತದೆ.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses ನಲ್ಲಿ error ಆಬ್ಜೆಕ್ಟ್ code ಮತ್ತು param ಅನ್ನೂ ಹೊಂದಿರಬಹುದು, ಎರಡೂ null.

ನೀವು ಏನು ಮಾಡಬಹುದು:

  • 00:00 UTC ಗೆ ಮುಂದಿನ ಪ್ಲ್ಯಾನ್ ಭತ್ಯೆಗಾಗಿ ಕಾಯಿರಿ.
  • ಕ್ರೆಡಿಟ್ ಟಾಪ್ ಅಪ್ ಮಾಡಿ. ಕ್ರೆಡಿಟ್ ಅನ್ನು ಪ್ಲ್ಯಾನ್ ಭತ್ಯೆಯ ನಂತರ ಖರ್ಚು ಮಾಡಲಾಗುತ್ತದೆ ಮತ್ತು ಅದರ ಅವಧಿ ಮುಗಿಯುವುದಿಲ್ಲ. ಕ್ರೆಡಿಟ್ ಟಾಪ್ ಅಪ್ ಮಾಡಿ
  • ದೊಡ್ಡ ದೈನಂದಿನ ಭತ್ಯೆಯ ಪ್ಲ್ಯಾನ್‌ಗೆ ಬದಲಾಗಿ. ಪ್ಲ್ಯಾನ್ ಬದಲಾಯಿಸಿ
  • ಸ್ವಲ್ಪ ಬ್ಯಾಲೆನ್ಸ್ ಉಳಿದಿದ್ದರೆ, ಚಿಕ್ಕ max_tokens ಕಳುಹಿಸಿ: ಆಗ ಮೀಸಲು ಚಿಕ್ಕದಾಗುತ್ತದೆ.

Shannon Coder ಕರೆ ಭತ್ಯೆ

/v1/chat/completions ಮತ್ತು /v1/messages ನಲ್ಲಿ shannon-coder-1 ಅನ್ನು ಟೋಕನ್‌ಗಳಲ್ಲಿ ಅಲ್ಲ, ಕರೆಗಳಲ್ಲಿ ಎಣಿಸಲಾಗುತ್ತದೆ. ಪ್ರತಿ ಪ್ಲ್ಯಾನ್ 4 ಗಂಟೆಗಳ ವಿಂಡೋಗೆ ಇಷ್ಟು ಕರೆಗಳನ್ನು ಒಳಗೊಂಡಿದೆ. ಒಂದು ವಿನಂತಿ ಒಂದು ಕರೆ.

ಪ್ಲ್ಯಾನ್ 4 ಗಂಟೆಗಳ ವಿಂಡೋಗೆ ಕರೆಗಳು
Free 3
Plus 20
Standard 40
Pro 60
  • ವಿಂಡೋಗಳು 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC ಗೆ ಆರಂಭವಾಗುತ್ತವೆ. ವಿಂಡೋದ ಕೊನೆಯಲ್ಲಿ ಉಳಿದ ಕರೆಗಳು ಮುಂದಕ್ಕೆ ಹೋಗುವುದಿಲ್ಲ.
  • ವಿನಂತಿ ಸ್ವೀಕಾರವಾದಾಗ, ಮಾಡೆಲ್ ಉತ್ತರಿಸುವ ಮೊದಲೇ ಕರೆಯನ್ನು ಎಣಿಸಲಾಗುತ್ತದೆ. ನಂತರ ವಿಫಲವಾಗುವ ವಿನಂತಿಯೂ ಒಂದು ಕರೆಯಾಗಿ ಎಣಿಕೆಯಾಗುತ್ತದೆ.
  • ಈ ಕರೆಗಳು ಟೋಕನ್‌ಗಳನ್ನು ಮೀಸಲಿಡುವುದಿಲ್ಲ ಮತ್ತು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಿಂದ ಏನನ್ನೂ ತೆಗೆದುಕೊಳ್ಳುವುದಿಲ್ಲ. Keys & usage ನ ವಿನಂತಿ ಪಟ್ಟಿ ಅವುಗಳ ಟೋಕನ್ ಎಣಿಕೆಯನ್ನು ಮತ್ತು ಪಟ್ಟಿ ಮಾಡಿದ ಬೆಲೆಯಲ್ಲಿ ಅದರ ಮೌಲ್ಯವನ್ನು ತೋರಿಸುತ್ತದೆ.
  • ಈ ಎರಡು ಎಂಡ್‌ಪಾಯಿಂಟ್‌ಗಳಲ್ಲಿ shannon-coder-1 ನ ಡೀಫಾಲ್ಟ್ max_tokens 65,536.
  • ಕರೆಗಳು ಉಳಿಯದಿದ್ದಾಗ ಉತ್ತರ ಸ್ಥಿತಿ 429, ವಿಧ rate_limit_error, ಸಂದೇಶ Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan.
  • /v1/responses ನಲ್ಲಿ shannon-coder-1 ಗೆ ಕರೆ ಭತ್ಯೆ ಇಲ್ಲ: ಇತರ ಪ್ರತಿ ಮಾಡೆಲ್‌ನಂತೆ ಅದಕ್ಕೆ ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಿಂದ 1M ಗೆ $8.00 ರಂತೆ ಟೋಕನ್‌ಗಳಲ್ಲಿ ಶುಲ್ಕ ವಿಧಿಸಲಾಗುತ್ತದೆ.

ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್

ಖಾತೆಯು ನಿಮಿಷಕ್ಕೆ 120 ವಿನಂತಿಗಳನ್ನು ಕಳುಹಿಸಬಹುದು. ವಿನಂತಿ ದರದ ಮೇಲಿನ ಏಕೈಕ ಮಿತಿ ಇದು, ಮತ್ತು ಪ್ರತಿ ಪ್ಲ್ಯಾನ್‌ನಲ್ಲೂ ಒಂದೇ. ಇದು ಪ್ರವಾಹವನ್ನು ತಡೆಯಲು ಇದೆ, ಸಾಮಾನ್ಯ ಬಳಕೆಯನ್ನು ನಿಧಾನಗೊಳಿಸಲು ಅಲ್ಲ.

  • ನಿಮಿಷ ಎಂದರೆ ನಿಮ್ಮ ಮೊದಲ ವಿನಂತಿಯೊಂದಿಗೆ ತೆರೆಯುವ 60 ಸೆಕೆಂಡ್‌ಗಳ ನಿಗದಿತ ವಿಂಡೋ. ಅದು ಮುಗಿದಾಗ ಎಣಿಕೆ ಮತ್ತೆ ಸೊನ್ನೆಯಿಂದ ಆರಂಭವಾಗುತ್ತದೆ.
  • ಎಣಿಕೆ ಪ್ರತಿ ಖಾತೆಗೆ, ಪ್ರತಿ ಕೀಗೆ ಅಲ್ಲ, ಪ್ರತಿ IP ವಿಳಾಸಕ್ಕೂ ಅಲ್ಲ. ಕೀ ಬದಲಾಯಿಸಿದರೆ ಹೊಸ ವಿಂಡೋ ತೆರೆಯುವುದಿಲ್ಲ.
  • ವಿಂಡೋದೊಳಗಿನ 121 ನೇ ವಿನಂತಿಗೆ ಸ್ಥಿತಿ 429, ವಿಧ rate_limit_error ಮತ್ತು ಸಂದೇಶ Too many requests. Retry in <N>s. ನೊಂದಿಗೆ ಉತ್ತರಿಸಲಾಗುತ್ತದೆ. N ಎಂದರೆ ವಿಂಡೋ ಮುಗಿಯುವವರೆಗಿನ ಸೆಕೆಂಡ್‌ಗಳ ಸಂಖ್ಯೆ, 1 ರಿಂದ 60.
  • ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್ ಅನ್ನು ಬ್ಯಾಲೆನ್ಸ್‌ಗಿಂತ ಮೊದಲು ಪರಿಶೀಲಿಸಲಾಗುತ್ತದೆ. ಅದು ನಿರಾಕರಿಸುವ ವಿನಂತಿ ಏನನ್ನೂ ಮೀಸಲಿಡುವುದಿಲ್ಲ ಮತ್ತು ಯಾವುದೇ ವೆಚ್ಚವಿಲ್ಲ.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
ವಿನಂತಿ ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses ಎಣಿಕೆಯಾಗುತ್ತದೆ, ಪ್ರತಿ ವಿನಂತಿಗೆ ಒಂದು.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens ಎಣಿಕೆಯಾಗುವುದಿಲ್ಲ.
/v1/chat/completions ಮತ್ತು /v1/messages ನಲ್ಲಿ shannon-coder-1 ಬದಲಿಗೆ Shannon Coder ಕರೆ ಭತ್ಯೆಯಿಂದ ಎಣಿಸಲಾಗುತ್ತದೆ.
401 ನೊಂದಿಗೆ, ಅಥವಾ ಗೊತ್ತಿಲ್ಲದ model ಗೆ 400 ನೊಂದಿಗೆ ಉತ್ತರಿಸಿದ ವಿನಂತಿ ಎಣಿಕೆಯಾಗುವುದಿಲ್ಲ.
ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್ ನಿರಾಕರಿಸಿದ ವಿನಂತಿ ವಿಂಡೋಗೆ ಎಣಿಕೆಯಾಗುತ್ತದೆ. ಏನನ್ನೂ ಶುಲ್ಕ ವಿಧಿಸಲಾಗುವುದಿಲ್ಲ.

ಸಮಾನಾಂತರ ವಿನಂತಿಗಳು

ಖಾತೆಯು ಒಂದೇ ಸಮಯದಲ್ಲಿ ಎಷ್ಟು ವಿನಂತಿಗಳನ್ನು ತೆರೆದಿಡಬಹುದು ಎಂಬುದಕ್ಕೆ ಮಿತಿ ಇಲ್ಲ, ಮತ್ತು ವಿನಂತಿಗಳನ್ನು ಸಮಾನಾಂತರವಾಗಿ ಕಳುಹಿಸಿದರೆ ದೋಷವಿಲ್ಲ. ತಕ್ಷಣ ಆರಂಭವಾಗಲಾಗದ ವಿನಂತಿಗಳು ಸರದಿಯಲ್ಲಿ ಕಾಯುತ್ತವೆ ಮತ್ತು ಕ್ರಮವಾಗಿ ಉತ್ತರಿಸಲ್ಪಡುತ್ತವೆ.

  • ಹಿಂದಿನ ವಿನಂತಿಗಳು ಮುಗಿದಿರಲಿ ಇಲ್ಲದಿರಲಿ, ಪ್ರತಿ ವಿನಂತಿ ಬಂದಾಗ ನಿಮಿಷಕ್ಕೆ 120 ರ ಎಣಿಕೆಗೆ ಸೇರುತ್ತದೆ.
  • ಪ್ರತಿ ವಿನಂತಿ ಮುಗಿಯುವವರೆಗೆ ತನ್ನದೇ ಮೀಸಲನ್ನು ಹಿಡಿದಿಡುತ್ತದೆ. ಡೀಫಾಲ್ಟ್ ಔಟ್‌ಪುಟ್ ಬಜೆಟ್‌ನೊಂದಿಗೆ ಇಪ್ಪತ್ತು ತೆರೆದ ವಿನಂತಿಗಳು 20 × 4,096 = 81,920 ಟೋಕನ್‌ಗಳ ಬ್ಯಾಲೆನ್ಸ್ ಅನ್ನು ಹಿಡಿದಿಡುತ್ತವೆ. ಮೀಸಲುಗಳು ಒಟ್ಟಾಗಿ ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ಗಿಂತ ದೊಡ್ಡದಾದರೆ, ಮುಗಿದ ಕರೆಗಳಿಗೆ ಕಡಿಮೆ ವೆಚ್ಚವಾಗುತ್ತಿದ್ದರೂ ಮುಂದಿನ ವಿನಂತಿಗೆ Quota exceeded ಉತ್ತರ ಸಿಗುತ್ತದೆ. ಚಿಕ್ಕ max_tokens ಕಡಿಮೆ ಹಿಡಿದಿಡುತ್ತದೆ.
  • stream ಇಲ್ಲದ ವಿನಂತಿ ಉತ್ತರ ಪೂರ್ಣಗೊಳ್ಳುವವರೆಗೆ ಏನನ್ನೂ ಕಳುಹಿಸುವುದಿಲ್ಲ, ಆದ್ದರಿಂದ ನಿಮ್ಮ ಕ್ಲೈಂಟ್‌ಗೆ ಕಾಯುವಿಕೆಯನ್ನು ಒಳಗೊಳ್ಳುವ timeout ನೀಡಿ. stream ಕಾಯುವಾಗ ತನ್ನ ಸಂಪರ್ಕವನ್ನು ತೆರೆದಿಡುತ್ತದೆ. ಸ್ಟ್ರೀಮಿಂಗ್

ಒಂದು ವಿನಂತಿಯ ಮಿತಿಗಳು

ಮಿತಿ ಮೌಲ್ಯ ಅನ್ವಯಿಸುವುದು ಮಿತಿಯಲ್ಲಿ
ವಿನಂತಿ ಬಾಡಿ 32 MiB (33,554,432 ಬೈಟ್‌ಗಳು) ಪ್ರತಿ ಎಂಡ್‌ಪಾಯಿಂಟ್ ಸ್ಥಿತಿ 413, ವಿಧ invalid_request_error.
ಔಟ್‌ಪುಟ್ ಬಜೆಟ್: max_tokens, max_completion_tokens, max_output_tokens 1 ರಿಂದ 65,536. ಡೀಫಾಲ್ಟ್ 4,096; /v1/chat/completions ಮತ್ತು /v1/messages ನಲ್ಲಿ shannon-coder-1 ಗೆ ಡೀಫಾಲ್ಟ್ 65,536. ಪ್ರತಿ ಮಾಡೆಲ್, ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಿಂದ ಮೀಸಲಿಡುವ ಮೊತ್ತವಾಗಿ. ಉತ್ತರದ ಉದ್ದದ ಮಿತಿಯಾಗಿ: ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು, shannon-1.6-lite, shannon-1.6-pro ಮತ್ತು shannon-coder-1. ವ್ಯಾಪ್ತಿಯ ಹೊರಗಿನ ಮೌಲ್ಯವನ್ನು ವ್ಯಾಪ್ತಿಯ ಹತ್ತಿರದ ತುದಿಗೆ ಸರಿಸಲಾಗುತ್ತದೆ. ದೋಷವಿಲ್ಲ.
ನಿಲ್ಲಿಸುವ ಅನುಕ್ರಮಗಳು: stop, stop_sequences 4 strings ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು ಮೊದಲ 4 ಖಾಲಿಯಲ್ಲದ strings ಬಳಕೆಯಾಗುತ್ತವೆ.
URL ಆಗಿ ನೀಡಿದ ಚಿತ್ರ ಅಥವಾ ಫೈಲ್ 8 MiB, 20 ಸೆಕೆಂಡ್‌ಗಳೊಳಗೆ ಓದಲಾಗುತ್ತದೆ, ಗರಿಷ್ಠ 5 ರೀಡೈರೆಕ್ಟ್‌ಗಳು, ಸಾರ್ವಜನಿಕ http ಅಥವಾ https ವಿಳಾಸ ಚಿತ್ರಗಳು ಅಥವಾ ಫೈಲ್‌ಗಳನ್ನು ತೆಗೆದುಕೊಳ್ಳುವ ಪ್ರತಿ ಎಂಡ್‌ಪಾಯಿಂಟ್ ವಿನಂತಿಗೆ ಆ ಭಾಗವಿಲ್ಲದೆ ಉತ್ತರಿಸಲಾಗುತ್ತದೆ. ದೋಷವಿಲ್ಲ.
ಇನ್‌ಲೈನ್ ಆಗಿ (base64) ಕಳುಹಿಸಿದ ಚಿತ್ರ ಅಥವಾ ಫೈಲ್ ತನ್ನದೇ ಮಿತಿ ಇಲ್ಲ. ಇದು 32 MiB ವಿನಂತಿ ಬಾಡಿಗೆ ಎಣಿಕೆಯಾಗುತ್ತದೆ. ಚಿತ್ರಗಳು ಅಥವಾ ಫೈಲ್‌ಗಳನ್ನು ತೆಗೆದುಕೊಳ್ಳುವ ಪ್ರತಿ ಎಂಡ್‌ಪಾಯಿಂಟ್ ಇಡೀ ವಿನಂತಿಗೆ ಸ್ಥಿತಿ 413.
POST /v1/tokenize ನ text 4,000,000 ಬೈಟ್‌ಗಳು /v1/tokenize ಸ್ಥಿತಿ 413, ವಿಧ invalid_request_error, ಸಂದೇಶ text too long.
POST /v1/tokenize ನ messages ಮತ್ತು POST /v1/messages/count_tokens ನ ಬಾಡಿ 32 MiB ವಿನಂತಿ ಬಾಡಿ ಎರಡೂ ಎಣಿಕೆ ಎಂಡ್‌ಪಾಯಿಂಟ್‌ಗಳು ಸ್ಥಿತಿ 413.
ಕಾಂಟೆಕ್ಸ್ಟ್ ವಿಂಡೋ ಪ್ರತಿ ಮಾಡೆಲ್‌ಗೆ: GET /v1/models ನಲ್ಲಿ context_window ಪ್ರತಿ ಮಾಡೆಲ್ ಉದ್ದವಾದ ಸಂಭಾಷಣೆಗೆ ಏನಾಗುತ್ತದೆ ಎಂಬುದು ಮಾಡೆಲ್ ಅನ್ನು ಅವಲಂಬಿಸಿದೆ. ಮಾಡೆಲ್‌ಗಳು ಮತ್ತು ಬೆಲೆ
ವೆಬ್ ಹುಡುಕಾಟಗಳು (web_search: true) ಪ್ರತಿ ಪ್ಲ್ಯಾನ್ ಮತ್ತು ದಿನಕ್ಕೆ: Free 3, Plus 30, Standard 50, Pro 60. ಹುಡುಕಾಟ ಫಲಿತಾಂಶಗಳನ್ನು ಕಂಡ ವಿನಂತಿಗೆ ಒಂದು ಹುಡುಕಾಟವನ್ನು ಎಣಿಸಲಾಗುತ್ತದೆ. web_search: true ಹೊಂದಿಸುವ ವಿನಂತಿಗಳು ಏನೂ ಉಳಿಯದಿದ್ದಾಗ ವಿನಂತಿಗೆ ಹುಡುಕಾಟವಿಲ್ಲದೆ ಉತ್ತರಿಸಲಾಗುತ್ತದೆ. ದೋಷವಿಲ್ಲ. ಒಳನಿರ್ಮಿತ ವೆಬ್ ಹುಡುಕಾಟ

ದೋಷಗಳು

ಈ ಪುಟದ ಉತ್ತರಗಳು. /v1/messages ನಲ್ಲಿ ಅದೇ error ಆಬ್ಜೆಕ್ಟ್ ಅನ್ನು {"type": "error", "error": {…}} ಆಗಿ ಸುತ್ತಲಾಗುತ್ತದೆ.

ಸ್ಥಿತಿ ವಿಧ ಸಂದೇಶ ಯಾವಾಗ, ಮತ್ತು ಏನು ಮಾಡಬೇಕು
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan ವಿನಂತಿಯ ಮೀಸಲು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ಗೆ ಹೊಂದುವುದಿಲ್ಲ. 00:00 UTC ವರೆಗೆ ಕಾಯಿರಿ, ಕ್ರೆಡಿಟ್ ಟಾಪ್ ಅಪ್ ಮಾಡಿ, ಪ್ಲ್ಯಾನ್ ಬದಲಾಯಿಸಿ, ಅಥವಾ ಚಿಕ್ಕ max_tokens ಕಳುಹಿಸಿ.
429 rate_limit_error Too many requests. Retry in <N>s. ಈಗಿನ ನಿಮಿಷದಲ್ಲಿ 120 ಕ್ಕಿಂತ ಹೆಚ್ಚು ವಿನಂತಿಗಳು. N ಸೆಕೆಂಡ್ ಕಾದು ಮತ್ತೆ ಕಳುಹಿಸಿ.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan ಈಗಿನ 4 ಗಂಟೆಗಳ ವಿಂಡೋದ Shannon Coder ಕರೆಗಳು ಖಾಲಿಯಾಗಿವೆ.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. ಮಾಡೆಲ್ ಈ ಕ್ಷಣದಲ್ಲಿ ವಿನಂತಿಯನ್ನು ತೆಗೆದುಕೊಳ್ಳಲಾಗದು. ಸ್ವಲ್ಪ ವಿರಾಮದ ನಂತರ ಮತ್ತೆ ಕಳುಹಿಸಿ.
503 api_error Could not verify your quota right now. Please retry. ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ ಅನ್ನು ಓದಲಾಗಲಿಲ್ಲ. ಏನನ್ನೂ ಶುಲ್ಕ ವಿಧಿಸಲಾಗುವುದಿಲ್ಲ; ವಿನಂತಿಯನ್ನು ಮತ್ತೆ ಕಳುಹಿಸಿ. Shannon ಮಾಡೆಲ್‌ನೊಂದಿಗೆ /v1/responses ನಲ್ಲಿ ಸ್ಥಿತಿ 500.
413 invalid_request_error ವಿನಂತಿ ಬಾಡಿ 32 MiB ಗಿಂತ ದೊಡ್ಡದಾಗಿದೆ. OpenAI-ಫಾರ್ಮ್ಯಾಟ್ ಎಂಡ್‌ಪಾಯಿಂಟ್‌ಗಳಲ್ಲಿ error ಆಬ್ಜೆಕ್ಟ್ code: "request_too_large" ಹೊತ್ತಿರುತ್ತದೆ.
413 invalid_request_error text too long POST /v1/tokenize ನ text 4,000,000 ಬೈಟ್‌ಗಳಿಗಿಂತ ಉದ್ದವಾಗಿದೆ.