ಮಿತಿಗಳು ಮತ್ತು ಬ್ಯಾಲೆನ್ಸ್
ಪ್ರತಿ ವಿನಂತಿಯನ್ನು ಸಮಾನವಾಗಿ ನಿರ್ವಹಿಸಲಾಗುತ್ತದೆ. ದರ ಶ್ರೇಣಿಗಳಿಲ್ಲ. ಪ್ರತ್ಯೇಕ API ಕೋಟಾ ಇಲ್ಲ. ನಿಮ್ಮ ಟೋಕನ್ಗಳಿಗೆ ನೀವು ಈಗಾಗಲೇ ಪಾವತಿಸಿದ್ದೀರಿ, ಅವನ್ನು ನಿಮಗೆ ಇಷ್ಟವಾದಷ್ಟು ವೇಗವಾಗಿ ಬಳಸಿ.
ಈ ಪುಟ ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ ಯಾವುದರಿಂದ ಮಾಡಲ್ಪಟ್ಟಿದೆ, ಒಂದು ವಿನಂತಿ ಏನನ್ನು ಮೀಸಲಿಡುತ್ತದೆ ಮತ್ತು ಎಷ್ಟು ವೆಚ್ಚವಾಗುತ್ತದೆ, ನೀವು ಎಷ್ಟು ವಿನಂತಿಗಳನ್ನು ಕಳುಹಿಸಬಹುದು, ಮತ್ತು ಒಂದು ವಿನಂತಿ ಎದುರಿಸಬಹುದಾದ ಕೆಲವು ಮಿತಿಗಳನ್ನು ವಿವರಿಸುತ್ತದೆ.
- 1M ಟೋಕನ್ಗಳ ಬ್ಯಾಲೆನ್ಸ್ನ ಮೌಲ್ಯ
- $5.00
- ದೈನಂದಿನ ಭತ್ಯೆ ನವೀಕರಣ
- 00:00 UTC
- ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್, ಪ್ರತಿ ಖಾತೆಗೆ
- 120 ವಿನಂತಿಗಳು / ನಿಮಿಷ
ವಿನಂತಿಗಳನ್ನು ಹೇಗೆ ನಿರ್ವಹಿಸಲಾಗುತ್ತದೆ
- ದರ ಶ್ರೇಣಿಗಳಿಲ್ಲ — ವಿನಂತಿಗಳು ಎಷ್ಟು ವೇಗವಾಗಿ ಬರಬಹುದು ಎಂಬುದನ್ನು ಒಂದು ನಿಯಮ ಮಿತಿಗೊಳಿಸುತ್ತದೆ, ಮತ್ತು ಅದು ಪ್ರತಿ ಖಾತೆ ಹಾಗೂ ಪ್ರತಿ ಪ್ಲ್ಯಾನ್ಗೆ ಒಂದೇ: ನಿಮಿಷಕ್ಕೆ 120 ವಿನಂತಿಗಳು. ನಿಮಿಷಕ್ಕೆ ಟೋಕನ್ಗಳ ಮೇಲೆ ಮಿತಿ ಇಲ್ಲ.
- ಪ್ರತ್ಯೇಕ API ಕೋಟಾ ಇಲ್ಲ — API ಚಾಟ್ನ ಅದೇ ಬ್ಯಾಲೆನ್ಸ್ ಅನ್ನು ಖರ್ಚು ಮಾಡುತ್ತದೆ. ಪ್ಲ್ಯಾನ್ ಇಂದಿನ ಭತ್ಯೆಯ ಗಾತ್ರವನ್ನು ನಿಗದಿಪಡಿಸುತ್ತದೆ. ಅದು ವಿನಂತಿ ದರವನ್ನು ನಿಗದಿಪಡಿಸುವುದಿಲ್ಲ.
- ನಿಮಗೆ ಇಷ್ಟವಾದಷ್ಟು ವೇಗವಾಗಿ — ಸಮಾನಾಂತರವಾಗಿ ಕಳುಹಿಸಿದ ವಿನಂತಿಗಳನ್ನು ಸ್ವೀಕರಿಸಿ ಸರದಿಯಲ್ಲಿ ಕಾಯಿಸಲಾಗುತ್ತದೆ. ಸಮಾನಾಂತರ ಎಂಬ ಕಾರಣಕ್ಕೆ ಅವನ್ನು ನಿರಾಕರಿಸಲಾಗುವುದಿಲ್ಲ.
ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್
ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ ಅನ್ನು ಟೋಕನ್ಗಳಲ್ಲಿ ಎಣಿಸಲಾಗುತ್ತದೆ. 1,000,000 ಟೋಕನ್ಗಳ ಬ್ಯಾಲೆನ್ಸ್ನ ಮೌಲ್ಯ $5.00, ಮತ್ತು Models & pricing ಪುಟದ ಪ್ರತಿ ಬೆಲೆ ಆ ಮೌಲ್ಯದ ವಿರುದ್ಧದ ದರ.
ಯಾವುದೇ ಕ್ಷಣದಲ್ಲಿ ಬ್ಯಾಲೆನ್ಸ್ ಎರಡು ಭಾಗಗಳ ಮೊತ್ತ.
- ಇಂದಿನ ಪ್ಲ್ಯಾನ್ ಭತ್ಯೆ — ನಿಮ್ಮ ಪ್ಲ್ಯಾನ್ ನಿಗದಿಪಡಿಸಿದ ಟೋಕನ್ಗಳ ಸಂಖ್ಯೆ. ಇದು ಪ್ರತಿದಿನ 00:00 UTC ಗೆ ಹೊಸದಾಗುತ್ತದೆ. ದಿನದ ಕೊನೆಯಲ್ಲಿ ಉಳಿದದ್ದು ಮುಂದಕ್ಕೆ ಹೋಗುವುದಿಲ್ಲ.
- ಖರೀದಿಸಿದ ಕ್ರೆಡಿಟ್ — ನೀವು ಪ್ಯಾಕ್ ಆಗಿ ಖರೀದಿಸಿದ ಟೋಕನ್ಗಳು. ಕ್ರೆಡಿಟ್ ಅವಧಿ ಮುಗಿಯುವುದಿಲ್ಲ ಮತ್ತು Free ಸೇರಿದಂತೆ ಪ್ರತಿ ಪ್ಲ್ಯಾನ್ನಲ್ಲೂ ಕೆಲಸ ಮಾಡುತ್ತದೆ.
| ಪ್ಲ್ಯಾನ್ | ದಿನಕ್ಕೆ ಟೋಕನ್ಗಳು | ಮೌಲ್ಯ |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- ಖರ್ಚಿನ ಕ್ರಮ — ಪ್ರತಿ ವಿನಂತಿ ಮೊದಲು ಇಂದಿನ ಪ್ಲ್ಯಾನ್ ಭತ್ಯೆಯನ್ನು ಖರ್ಚು ಮಾಡುತ್ತದೆ. ಖರೀದಿಸಿದ ಕ್ರೆಡಿಟ್ ಅನ್ನು ಆ ದಿನ ಭತ್ಯೆಯನ್ನು ಮೀರಿದ್ದಕ್ಕೆ ಮಾತ್ರ ಬಳಸಲಾಗುತ್ತದೆ.
- ಚಾಟ್ ಮತ್ತು API ಇದನ್ನು ಹಂಚಿಕೊಳ್ಳುತ್ತವೆ — ಪ್ರತಿ ಖಾತೆಗೆ ಒಂದು ಬ್ಯಾಲೆನ್ಸ್ ಇದೆ. API ಕೀ ಅದನ್ನು ಹೊಂದಿರುವ ಖಾತೆಯ ಬ್ಯಾಲೆನ್ಸ್ನಿಂದ, ಚಾಟ್ನ ಅದೇ ಬೆಲೆಗಳಲ್ಲಿ ಖರ್ಚು ಮಾಡುತ್ತದೆ.
- ಪ್ಯಾಕ್ಗಳು — ಕ್ರೆಡಿಟ್ ಅನ್ನು 1,000,000 ($5.00), 2,000,000 ($10.00) ಮತ್ತು 5,000,000 ($25.00) ಟೋಕನ್ಗಳ ಪ್ಯಾಕ್ಗಳಲ್ಲಿ, ಅಥವಾ 1,000,000 ರಿಂದ 100,000,000 ಟೋಕನ್ಗಳವರೆಗೆ ನೀವು ಆರಿಸಿದ ಮೊತ್ತದಲ್ಲಿ 1,000,000 ಕ್ಕೆ $5.00 ರಂತೆ ಮಾರಲಾಗುತ್ತದೆ.
ಕ್ರೆಡಿಟ್ ಟಾಪ್ ಅಪ್ ಮಾಡಿ ಪ್ಲ್ಯಾನ್ ಬದಲಾಯಿಸಿ
ವಿನಂತಿ ಏನನ್ನು ಮೀಸಲಿಡುತ್ತದೆ ಮತ್ತು ಎಷ್ಟು ವೆಚ್ಚವಾಗುತ್ತದೆ
- ಮೀಸಲು — ವಿನಂತಿ ಬಂದಾಗ ಅದು ತನ್ನ ಔಟ್ಪುಟ್ ಬಜೆಟ್ ಅನ್ನು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಿಂದ ಮೀಸಲಿಡುತ್ತದೆ:
/v1/chat/completionsಮತ್ತು/v1/messagesನಲ್ಲಿmax_tokens,/v1/responsesನಲ್ಲಿmax_output_tokens./v1/chat/completionsmax_completion_tokensಅನ್ನೂ ಓದುತ್ತದೆ. ಡೀಫಾಲ್ಟ್ 4,096 ಮತ್ತು ವ್ಯಾಪ್ತಿ 1 ರಿಂದ 65,536. - ಸ್ವೀಕಾರ — ಮೀಸಲು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಲ್ಲಿ ಉಳಿದಿರುವುದಕ್ಕೆ ಹೊಂದಿದರೆ ಮಾತ್ರ ವಿನಂತಿಯನ್ನು ಸ್ವೀಕರಿಸಲಾಗುತ್ತದೆ. ಸೊನ್ನೆಗಿಂತ ಹೆಚ್ಚಿದ್ದರೂ ಔಟ್ಪುಟ್ ಬಜೆಟ್ಗಿಂತ ಚಿಕ್ಕದಾದ ಬ್ಯಾಲೆನ್ಸ್ಗೆ
Quota exceededಉತ್ತರ ಸಿಗುತ್ತದೆ. ಉಳಿದದ್ದನ್ನು ಬಳಸಲು ಚಿಕ್ಕmax_tokensಕಳುಹಿಸಿ. - ಇತ್ಯರ್ಥ — ಉತ್ತರ ಪೂರ್ಣಗೊಂಡಾಗ, ಮೀಸಲನ್ನು ನಿಜವಾದ ಶುಲ್ಕದಿಂದ ಬದಲಾಯಿಸಲಾಗುತ್ತದೆ. ಶುಲ್ಕ ಮೀಸಲಿಗಿಂತ ಕಡಿಮೆ ಅಥವಾ ಹೆಚ್ಚು ಇರಬಹುದು.
- ಹಿಂತಿರುಗಿಸುವಿಕೆ — ದೋಷ ಸ್ಥಿತಿಯೊಂದಿಗೆ ಕೊನೆಗೊಳ್ಳುವ ವಿನಂತಿ ತನ್ನ ಮೀಸಲನ್ನು ಪೂರ್ಣವಾಗಿ ಹಿಂತಿರುಗಿಸುತ್ತದೆ.
ನಿಜವಾದ ಶುಲ್ಕ ಮಾಡೆಲ್ ಕುಟುಂಬವನ್ನು ಅವಲಂಬಿಸಿದೆ.
| ಮಾಡೆಲ್ಗಳು | ಏನು ಶುಲ್ಕ ವಿಧಿಸಲಾಗುತ್ತದೆ |
|---|---|
| Shannon ಮಾಡೆಲ್ಗಳು | ಮಾಡೆಲ್ನ 1M ಗೆ ಬೆಲೆಯಲ್ಲಿ usage.total_tokens. ಇನ್ಪುಟ್ ಮತ್ತು ಔಟ್ಪುಟ್ಗೆ ಒಂದೇ ದರ. |
| ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು | ಕ್ಯಾಶ್ ಆಗದ ಇನ್ಪುಟ್ ಇನ್ಪುಟ್ ದರದಲ್ಲಿ, ಕ್ಯಾಶ್ ಆದ ಇನ್ಪುಟ್ ಕ್ಯಾಶ್ ದರದಲ್ಲಿ, ಔಟ್ಪುಟ್ ಔಟ್ಪುಟ್ ದರದಲ್ಲಿ. |
USD ಮೊತ್ತವನ್ನು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಿಂದ 1,000,000 ಕ್ಕೆ $5.00 ರಂತೆ ಟೋಕನ್ಗಳಲ್ಲಿ ತೆಗೆದುಕೊಳ್ಳಲಾಗುತ್ತದೆ, ಪೂರ್ಣ ಟೋಕನ್ಗೆ ಸುತ್ತಲಾಗುತ್ತದೆ.
POST /v1/tokenize ಅಥವಾ POST /v1/messages/count_tokens ನೊಂದಿಗೆ ಟೋಕನ್ ಎಣಿಕೆ ಉಚಿತ ಮತ್ತು ಏನನ್ನೂ ಮೀಸಲಿಡುವುದಿಲ್ಲ. ಟೋಕನ್ ಎಣಿಕೆ
ಬ್ಯಾಲೆನ್ಸ್ ಮತ್ತು ಬಳಕೆಯನ್ನು ಎಲ್ಲಿ ನೋಡಬೇಕು
Keys & usage ಪುಟವು ನೀವು ಈಗ ಖರ್ಚು ಮಾಡಬಹುದಾದದ್ದನ್ನು, ಇಂದಿನ ಪ್ಲ್ಯಾನ್ ಭತ್ಯೆ, ನೀವು ಖರೀದಿಸಿದ ಕ್ರೆಡಿಟ್ ಮತ್ತು ಕಳೆದ 30 ದಿನಗಳ API ವೆಚ್ಚವನ್ನು ತೋರಿಸುತ್ತದೆ. ಅದರ ಕೆಳಗೆ ನಿಮ್ಮ ಕೀ ಮಾಡಿದ ಪ್ರತಿ ವಿನಂತಿಯನ್ನು ಪಟ್ಟಿ ಮಾಡುತ್ತದೆ: ಸಮಯ, ಎಂಡ್ಪಾಯಿಂಟ್, ಮಾಡೆಲ್, ಕ್ಯಾಶ್ ಆದ ಇನ್ಪುಟ್, ಬಿಲ್ ಮಾಡಿದ ಟೋಕನ್ಗಳು ಮತ್ತು ವೆಚ್ಚ. ಕೀಗಳು ಮತ್ತು ಬಳಕೆ
ಪ್ರತಿ ಉತ್ತರವೂ ಆ ಕರೆಯ ಟೋಕನ್ ಎಣಿಕೆಗಳಿರುವ usage ಆಬ್ಜೆಕ್ಟ್ ಅನ್ನು ಹೊಂದಿರುತ್ತದೆ.
| ಎಂಡ್ಪಾಯಿಂಟ್ | usage ನ ಫೀಲ್ಡ್ಗಳು | ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು ಸೇರಿಸುವುದು |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageಮಾಡೆಲ್ನ ಟೋಕನ್ ಎಣಿಕೆಗಳನ್ನು ಹೊಂದಿರುತ್ತದೆ. ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಿಂದ ತೆಗೆದುಕೊಂಡ ಮೊತ್ತ ಉತ್ತರದಲ್ಲಿಲ್ಲ: ಅದು Keys & usage ನ ವಿನಂತಿ ಪಟ್ಟಿಯ Billed tokens ಕಾಲಮ್.- ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ನೊಂದಿಗೆ
/v1/messagesನಲ್ಲಿ,input_tokensಇನ್ಪುಟ್ನ ಕ್ಯಾಶ್ ಆಗದ ಭಾಗ,cache_read_input_tokensಕ್ಯಾಶ್ ಆದ ಭಾಗ ಮತ್ತುcache_creation_input_tokensಯಾವಾಗಲೂ0. -
/v1/chat/completionsನಲ್ಲಿ stream[DONE]ಮೊದಲಿನ ತನ್ನ ಕೊನೆಯ chunk ನಲ್ಲಿusageಹೊತ್ತಿರುತ್ತದೆ. ಸ್ಟ್ರೀಮಿಂಗ್
ಬ್ಯಾಲೆನ್ಸ್ ಖಾಲಿಯಾದಾಗ
ಮೀಸಲು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ಗೆ ಹೊಂದದ ವಿನಂತಿಗೆ ಸ್ಥಿತಿ 429, ವಿಧ rate_limit_error ಮತ್ತು ಕೆಳಗಿನ ಸಂದೇಶದೊಂದಿಗೆ ಉತ್ತರಿಸಲಾಗುತ್ತದೆ. ಏನನ್ನೂ ಶುಲ್ಕ ವಿಧಿಸಲಾಗುವುದಿಲ್ಲ. ಬ್ಯಾಲೆನ್ಸ್ ಸೊನ್ನೆಗಿಂತ ಹೆಚ್ಚಿದ್ದರೂ ವಿನಂತಿಯ ಔಟ್ಪುಟ್ ಬಜೆಟ್ಗಿಂತ ಚಿಕ್ಕದಾಗಿದ್ದಾಗಲೂ ಇದೇ ಉತ್ತರ ಬರುತ್ತದೆ.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses ನಲ್ಲಿ error ಆಬ್ಜೆಕ್ಟ್ code ಮತ್ತು param ಅನ್ನೂ ಹೊಂದಿರಬಹುದು, ಎರಡೂ null.
ನೀವು ಏನು ಮಾಡಬಹುದು:
- 00:00 UTC ಗೆ ಮುಂದಿನ ಪ್ಲ್ಯಾನ್ ಭತ್ಯೆಗಾಗಿ ಕಾಯಿರಿ.
- ಕ್ರೆಡಿಟ್ ಟಾಪ್ ಅಪ್ ಮಾಡಿ. ಕ್ರೆಡಿಟ್ ಅನ್ನು ಪ್ಲ್ಯಾನ್ ಭತ್ಯೆಯ ನಂತರ ಖರ್ಚು ಮಾಡಲಾಗುತ್ತದೆ ಮತ್ತು ಅದರ ಅವಧಿ ಮುಗಿಯುವುದಿಲ್ಲ. ಕ್ರೆಡಿಟ್ ಟಾಪ್ ಅಪ್ ಮಾಡಿ
- ದೊಡ್ಡ ದೈನಂದಿನ ಭತ್ಯೆಯ ಪ್ಲ್ಯಾನ್ಗೆ ಬದಲಾಗಿ. ಪ್ಲ್ಯಾನ್ ಬದಲಾಯಿಸಿ
- ಸ್ವಲ್ಪ ಬ್ಯಾಲೆನ್ಸ್ ಉಳಿದಿದ್ದರೆ, ಚಿಕ್ಕ
max_tokensಕಳುಹಿಸಿ: ಆಗ ಮೀಸಲು ಚಿಕ್ಕದಾಗುತ್ತದೆ.
Shannon Coder ಕರೆ ಭತ್ಯೆ
/v1/chat/completions ಮತ್ತು /v1/messages ನಲ್ಲಿ shannon-coder-1 ಅನ್ನು ಟೋಕನ್ಗಳಲ್ಲಿ ಅಲ್ಲ, ಕರೆಗಳಲ್ಲಿ ಎಣಿಸಲಾಗುತ್ತದೆ. ಪ್ರತಿ ಪ್ಲ್ಯಾನ್ 4 ಗಂಟೆಗಳ ವಿಂಡೋಗೆ ಇಷ್ಟು ಕರೆಗಳನ್ನು ಒಳಗೊಂಡಿದೆ. ಒಂದು ವಿನಂತಿ ಒಂದು ಕರೆ.
| ಪ್ಲ್ಯಾನ್ | 4 ಗಂಟೆಗಳ ವಿಂಡೋಗೆ ಕರೆಗಳು |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- ವಿಂಡೋಗಳು 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC ಗೆ ಆರಂಭವಾಗುತ್ತವೆ. ವಿಂಡೋದ ಕೊನೆಯಲ್ಲಿ ಉಳಿದ ಕರೆಗಳು ಮುಂದಕ್ಕೆ ಹೋಗುವುದಿಲ್ಲ.
- ವಿನಂತಿ ಸ್ವೀಕಾರವಾದಾಗ, ಮಾಡೆಲ್ ಉತ್ತರಿಸುವ ಮೊದಲೇ ಕರೆಯನ್ನು ಎಣಿಸಲಾಗುತ್ತದೆ. ನಂತರ ವಿಫಲವಾಗುವ ವಿನಂತಿಯೂ ಒಂದು ಕರೆಯಾಗಿ ಎಣಿಕೆಯಾಗುತ್ತದೆ.
- ಈ ಕರೆಗಳು ಟೋಕನ್ಗಳನ್ನು ಮೀಸಲಿಡುವುದಿಲ್ಲ ಮತ್ತು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಿಂದ ಏನನ್ನೂ ತೆಗೆದುಕೊಳ್ಳುವುದಿಲ್ಲ. Keys & usage ನ ವಿನಂತಿ ಪಟ್ಟಿ ಅವುಗಳ ಟೋಕನ್ ಎಣಿಕೆಯನ್ನು ಮತ್ತು ಪಟ್ಟಿ ಮಾಡಿದ ಬೆಲೆಯಲ್ಲಿ ಅದರ ಮೌಲ್ಯವನ್ನು ತೋರಿಸುತ್ತದೆ.
- ಈ ಎರಡು ಎಂಡ್ಪಾಯಿಂಟ್ಗಳಲ್ಲಿ
shannon-coder-1ನ ಡೀಫಾಲ್ಟ್max_tokens65,536. - ಕರೆಗಳು ಉಳಿಯದಿದ್ದಾಗ ಉತ್ತರ ಸ್ಥಿತಿ
429, ವಿಧrate_limit_error, ಸಂದೇಶShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan. /v1/responsesನಲ್ಲಿshannon-coder-1ಗೆ ಕರೆ ಭತ್ಯೆ ಇಲ್ಲ: ಇತರ ಪ್ರತಿ ಮಾಡೆಲ್ನಂತೆ ಅದಕ್ಕೆ ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಿಂದ 1M ಗೆ $8.00 ರಂತೆ ಟೋಕನ್ಗಳಲ್ಲಿ ಶುಲ್ಕ ವಿಧಿಸಲಾಗುತ್ತದೆ.
ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್
ಖಾತೆಯು ನಿಮಿಷಕ್ಕೆ 120 ವಿನಂತಿಗಳನ್ನು ಕಳುಹಿಸಬಹುದು. ವಿನಂತಿ ದರದ ಮೇಲಿನ ಏಕೈಕ ಮಿತಿ ಇದು, ಮತ್ತು ಪ್ರತಿ ಪ್ಲ್ಯಾನ್ನಲ್ಲೂ ಒಂದೇ. ಇದು ಪ್ರವಾಹವನ್ನು ತಡೆಯಲು ಇದೆ, ಸಾಮಾನ್ಯ ಬಳಕೆಯನ್ನು ನಿಧಾನಗೊಳಿಸಲು ಅಲ್ಲ.
- ನಿಮಿಷ ಎಂದರೆ ನಿಮ್ಮ ಮೊದಲ ವಿನಂತಿಯೊಂದಿಗೆ ತೆರೆಯುವ 60 ಸೆಕೆಂಡ್ಗಳ ನಿಗದಿತ ವಿಂಡೋ. ಅದು ಮುಗಿದಾಗ ಎಣಿಕೆ ಮತ್ತೆ ಸೊನ್ನೆಯಿಂದ ಆರಂಭವಾಗುತ್ತದೆ.
- ಎಣಿಕೆ ಪ್ರತಿ ಖಾತೆಗೆ, ಪ್ರತಿ ಕೀಗೆ ಅಲ್ಲ, ಪ್ರತಿ IP ವಿಳಾಸಕ್ಕೂ ಅಲ್ಲ. ಕೀ ಬದಲಾಯಿಸಿದರೆ ಹೊಸ ವಿಂಡೋ ತೆರೆಯುವುದಿಲ್ಲ.
- ವಿಂಡೋದೊಳಗಿನ 121 ನೇ ವಿನಂತಿಗೆ ಸ್ಥಿತಿ
429, ವಿಧrate_limit_errorಮತ್ತು ಸಂದೇಶToo many requests. Retry in <N>s.ನೊಂದಿಗೆ ಉತ್ತರಿಸಲಾಗುತ್ತದೆ.Nಎಂದರೆ ವಿಂಡೋ ಮುಗಿಯುವವರೆಗಿನ ಸೆಕೆಂಡ್ಗಳ ಸಂಖ್ಯೆ, 1 ರಿಂದ 60. - ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್ ಅನ್ನು ಬ್ಯಾಲೆನ್ಸ್ಗಿಂತ ಮೊದಲು ಪರಿಶೀಲಿಸಲಾಗುತ್ತದೆ. ಅದು ನಿರಾಕರಿಸುವ ವಿನಂತಿ ಏನನ್ನೂ ಮೀಸಲಿಡುವುದಿಲ್ಲ ಮತ್ತು ಯಾವುದೇ ವೆಚ್ಚವಿಲ್ಲ.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | ವಿನಂತಿ | ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್ |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | ಎಣಿಕೆಯಾಗುತ್ತದೆ, ಪ್ರತಿ ವಿನಂತಿಗೆ ಒಂದು. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | ಎಣಿಕೆಯಾಗುವುದಿಲ್ಲ. |
/v1/chat/completions ಮತ್ತು /v1/messages ನಲ್ಲಿ shannon-coder-1 | ಬದಲಿಗೆ Shannon Coder ಕರೆ ಭತ್ಯೆಯಿಂದ ಎಣಿಸಲಾಗುತ್ತದೆ. |
401 ನೊಂದಿಗೆ, ಅಥವಾ ಗೊತ್ತಿಲ್ಲದ model ಗೆ 400 ನೊಂದಿಗೆ ಉತ್ತರಿಸಿದ ವಿನಂತಿ | ಎಣಿಕೆಯಾಗುವುದಿಲ್ಲ. |
| ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್ ನಿರಾಕರಿಸಿದ ವಿನಂತಿ | ವಿಂಡೋಗೆ ಎಣಿಕೆಯಾಗುತ್ತದೆ. ಏನನ್ನೂ ಶುಲ್ಕ ವಿಧಿಸಲಾಗುವುದಿಲ್ಲ. |
ಸಮಾನಾಂತರ ವಿನಂತಿಗಳು
ಖಾತೆಯು ಒಂದೇ ಸಮಯದಲ್ಲಿ ಎಷ್ಟು ವಿನಂತಿಗಳನ್ನು ತೆರೆದಿಡಬಹುದು ಎಂಬುದಕ್ಕೆ ಮಿತಿ ಇಲ್ಲ, ಮತ್ತು ವಿನಂತಿಗಳನ್ನು ಸಮಾನಾಂತರವಾಗಿ ಕಳುಹಿಸಿದರೆ ದೋಷವಿಲ್ಲ. ತಕ್ಷಣ ಆರಂಭವಾಗಲಾಗದ ವಿನಂತಿಗಳು ಸರದಿಯಲ್ಲಿ ಕಾಯುತ್ತವೆ ಮತ್ತು ಕ್ರಮವಾಗಿ ಉತ್ತರಿಸಲ್ಪಡುತ್ತವೆ.
- ಹಿಂದಿನ ವಿನಂತಿಗಳು ಮುಗಿದಿರಲಿ ಇಲ್ಲದಿರಲಿ, ಪ್ರತಿ ವಿನಂತಿ ಬಂದಾಗ ನಿಮಿಷಕ್ಕೆ 120 ರ ಎಣಿಕೆಗೆ ಸೇರುತ್ತದೆ.
- ಪ್ರತಿ ವಿನಂತಿ ಮುಗಿಯುವವರೆಗೆ ತನ್ನದೇ ಮೀಸಲನ್ನು ಹಿಡಿದಿಡುತ್ತದೆ. ಡೀಫಾಲ್ಟ್ ಔಟ್ಪುಟ್ ಬಜೆಟ್ನೊಂದಿಗೆ ಇಪ್ಪತ್ತು ತೆರೆದ ವಿನಂತಿಗಳು 20 × 4,096 = 81,920 ಟೋಕನ್ಗಳ ಬ್ಯಾಲೆನ್ಸ್ ಅನ್ನು ಹಿಡಿದಿಡುತ್ತವೆ. ಮೀಸಲುಗಳು ಒಟ್ಟಾಗಿ ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ಗಿಂತ ದೊಡ್ಡದಾದರೆ, ಮುಗಿದ ಕರೆಗಳಿಗೆ ಕಡಿಮೆ ವೆಚ್ಚವಾಗುತ್ತಿದ್ದರೂ ಮುಂದಿನ ವಿನಂತಿಗೆ
Quota exceededಉತ್ತರ ಸಿಗುತ್ತದೆ. ಚಿಕ್ಕmax_tokensಕಡಿಮೆ ಹಿಡಿದಿಡುತ್ತದೆ. - stream ಇಲ್ಲದ ವಿನಂತಿ ಉತ್ತರ ಪೂರ್ಣಗೊಳ್ಳುವವರೆಗೆ ಏನನ್ನೂ ಕಳುಹಿಸುವುದಿಲ್ಲ, ಆದ್ದರಿಂದ ನಿಮ್ಮ ಕ್ಲೈಂಟ್ಗೆ ಕಾಯುವಿಕೆಯನ್ನು ಒಳಗೊಳ್ಳುವ timeout ನೀಡಿ. stream ಕಾಯುವಾಗ ತನ್ನ ಸಂಪರ್ಕವನ್ನು ತೆರೆದಿಡುತ್ತದೆ. ಸ್ಟ್ರೀಮಿಂಗ್
ಒಂದು ವಿನಂತಿಯ ಮಿತಿಗಳು
| ಮಿತಿ | ಮೌಲ್ಯ | ಅನ್ವಯಿಸುವುದು | ಮಿತಿಯಲ್ಲಿ |
|---|---|---|---|
| ವಿನಂತಿ ಬಾಡಿ | 32 MiB (33,554,432 ಬೈಟ್ಗಳು) | ಪ್ರತಿ ಎಂಡ್ಪಾಯಿಂಟ್ | ಸ್ಥಿತಿ 413, ವಿಧ invalid_request_error. |
ಔಟ್ಪುಟ್ ಬಜೆಟ್: max_tokens, max_completion_tokens, max_output_tokens | 1 ರಿಂದ 65,536. ಡೀಫಾಲ್ಟ್ 4,096; /v1/chat/completions ಮತ್ತು /v1/messages ನಲ್ಲಿ shannon-coder-1 ಗೆ ಡೀಫಾಲ್ಟ್ 65,536. | ಪ್ರತಿ ಮಾಡೆಲ್, ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಿಂದ ಮೀಸಲಿಡುವ ಮೊತ್ತವಾಗಿ. ಉತ್ತರದ ಉದ್ದದ ಮಿತಿಯಾಗಿ: ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು, shannon-1.6-lite, shannon-1.6-pro ಮತ್ತು shannon-coder-1. | ವ್ಯಾಪ್ತಿಯ ಹೊರಗಿನ ಮೌಲ್ಯವನ್ನು ವ್ಯಾಪ್ತಿಯ ಹತ್ತಿರದ ತುದಿಗೆ ಸರಿಸಲಾಗುತ್ತದೆ. ದೋಷವಿಲ್ಲ. |
ನಿಲ್ಲಿಸುವ ಅನುಕ್ರಮಗಳು: stop, stop_sequences | 4 strings | ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು | ಮೊದಲ 4 ಖಾಲಿಯಲ್ಲದ strings ಬಳಕೆಯಾಗುತ್ತವೆ. |
| URL ಆಗಿ ನೀಡಿದ ಚಿತ್ರ ಅಥವಾ ಫೈಲ್ | 8 MiB, 20 ಸೆಕೆಂಡ್ಗಳೊಳಗೆ ಓದಲಾಗುತ್ತದೆ, ಗರಿಷ್ಠ 5 ರೀಡೈರೆಕ್ಟ್ಗಳು, ಸಾರ್ವಜನಿಕ http ಅಥವಾ https ವಿಳಾಸ | ಚಿತ್ರಗಳು ಅಥವಾ ಫೈಲ್ಗಳನ್ನು ತೆಗೆದುಕೊಳ್ಳುವ ಪ್ರತಿ ಎಂಡ್ಪಾಯಿಂಟ್ | ವಿನಂತಿಗೆ ಆ ಭಾಗವಿಲ್ಲದೆ ಉತ್ತರಿಸಲಾಗುತ್ತದೆ. ದೋಷವಿಲ್ಲ. |
| ಇನ್ಲೈನ್ ಆಗಿ (base64) ಕಳುಹಿಸಿದ ಚಿತ್ರ ಅಥವಾ ಫೈಲ್ | ತನ್ನದೇ ಮಿತಿ ಇಲ್ಲ. ಇದು 32 MiB ವಿನಂತಿ ಬಾಡಿಗೆ ಎಣಿಕೆಯಾಗುತ್ತದೆ. | ಚಿತ್ರಗಳು ಅಥವಾ ಫೈಲ್ಗಳನ್ನು ತೆಗೆದುಕೊಳ್ಳುವ ಪ್ರತಿ ಎಂಡ್ಪಾಯಿಂಟ್ | ಇಡೀ ವಿನಂತಿಗೆ ಸ್ಥಿತಿ 413. |
POST /v1/tokenize ನ text | 4,000,000 ಬೈಟ್ಗಳು | /v1/tokenize | ಸ್ಥಿತಿ 413, ವಿಧ invalid_request_error, ಸಂದೇಶ text too long. |
POST /v1/tokenize ನ messages ಮತ್ತು POST /v1/messages/count_tokens ನ ಬಾಡಿ | 32 MiB ವಿನಂತಿ ಬಾಡಿ | ಎರಡೂ ಎಣಿಕೆ ಎಂಡ್ಪಾಯಿಂಟ್ಗಳು | ಸ್ಥಿತಿ 413. |
| ಕಾಂಟೆಕ್ಸ್ಟ್ ವಿಂಡೋ | ಪ್ರತಿ ಮಾಡೆಲ್ಗೆ: GET /v1/models ನಲ್ಲಿ context_window | ಪ್ರತಿ ಮಾಡೆಲ್ | ಉದ್ದವಾದ ಸಂಭಾಷಣೆಗೆ ಏನಾಗುತ್ತದೆ ಎಂಬುದು ಮಾಡೆಲ್ ಅನ್ನು ಅವಲಂಬಿಸಿದೆ. ಮಾಡೆಲ್ಗಳು ಮತ್ತು ಬೆಲೆ |
ವೆಬ್ ಹುಡುಕಾಟಗಳು (web_search: true) | ಪ್ರತಿ ಪ್ಲ್ಯಾನ್ ಮತ್ತು ದಿನಕ್ಕೆ: Free 3, Plus 30, Standard 50, Pro 60. ಹುಡುಕಾಟ ಫಲಿತಾಂಶಗಳನ್ನು ಕಂಡ ವಿನಂತಿಗೆ ಒಂದು ಹುಡುಕಾಟವನ್ನು ಎಣಿಸಲಾಗುತ್ತದೆ. | web_search: true ಹೊಂದಿಸುವ ವಿನಂತಿಗಳು | ಏನೂ ಉಳಿಯದಿದ್ದಾಗ ವಿನಂತಿಗೆ ಹುಡುಕಾಟವಿಲ್ಲದೆ ಉತ್ತರಿಸಲಾಗುತ್ತದೆ. ದೋಷವಿಲ್ಲ. ಒಳನಿರ್ಮಿತ ವೆಬ್ ಹುಡುಕಾಟ |
ದೋಷಗಳು
ಈ ಪುಟದ ಉತ್ತರಗಳು. /v1/messages ನಲ್ಲಿ ಅದೇ error ಆಬ್ಜೆಕ್ಟ್ ಅನ್ನು {"type": "error", "error": {…}} ಆಗಿ ಸುತ್ತಲಾಗುತ್ತದೆ.
| ಸ್ಥಿತಿ | ವಿಧ | ಸಂದೇಶ | ಯಾವಾಗ, ಮತ್ತು ಏನು ಮಾಡಬೇಕು |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | ವಿನಂತಿಯ ಮೀಸಲು ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ಗೆ ಹೊಂದುವುದಿಲ್ಲ. 00:00 UTC ವರೆಗೆ ಕಾಯಿರಿ, ಕ್ರೆಡಿಟ್ ಟಾಪ್ ಅಪ್ ಮಾಡಿ, ಪ್ಲ್ಯಾನ್ ಬದಲಾಯಿಸಿ, ಅಥವಾ ಚಿಕ್ಕ max_tokens ಕಳುಹಿಸಿ. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | ಈಗಿನ ನಿಮಿಷದಲ್ಲಿ 120 ಕ್ಕಿಂತ ಹೆಚ್ಚು ವಿನಂತಿಗಳು. N ಸೆಕೆಂಡ್ ಕಾದು ಮತ್ತೆ ಕಳುಹಿಸಿ. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | ಈಗಿನ 4 ಗಂಟೆಗಳ ವಿಂಡೋದ Shannon Coder ಕರೆಗಳು ಖಾಲಿಯಾಗಿವೆ. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | ಮಾಡೆಲ್ ಈ ಕ್ಷಣದಲ್ಲಿ ವಿನಂತಿಯನ್ನು ತೆಗೆದುಕೊಳ್ಳಲಾಗದು. ಸ್ವಲ್ಪ ವಿರಾಮದ ನಂತರ ಮತ್ತೆ ಕಳುಹಿಸಿ. |
503 | api_error | Could not verify your quota right now. Please retry. | ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ ಅನ್ನು ಓದಲಾಗಲಿಲ್ಲ. ಏನನ್ನೂ ಶುಲ್ಕ ವಿಧಿಸಲಾಗುವುದಿಲ್ಲ; ವಿನಂತಿಯನ್ನು ಮತ್ತೆ ಕಳುಹಿಸಿ. Shannon ಮಾಡೆಲ್ನೊಂದಿಗೆ /v1/responses ನಲ್ಲಿ ಸ್ಥಿತಿ 500. |
413 | invalid_request_error | ವಿನಂತಿ ಬಾಡಿ 32 MiB ಗಿಂತ ದೊಡ್ಡದಾಗಿದೆ. OpenAI-ಫಾರ್ಮ್ಯಾಟ್ ಎಂಡ್ಪಾಯಿಂಟ್ಗಳಲ್ಲಿ error ಆಬ್ಜೆಕ್ಟ್ code: "request_too_large" ಹೊತ್ತಿರುತ್ತದೆ. | |
413 | invalid_request_error | text too long | POST /v1/tokenize ನ text 4,000,000 ಬೈಟ್ಗಳಿಗಿಂತ ಉದ್ದವಾಗಿದೆ. |