ຂີດຈຳກັດ ແລະ ຍອດເງິນ
ທຸກຄຳຮ້ອງຂໍໄດ້ຮັບການບໍລິການເທົ່າທຽມກັນ. ບໍ່ມີລະດັບ rate. ບໍ່ມີໂຄວຕາ API ແຍກຕ່າງຫາກ. ທ່ານຈ່າຍເງິນຄ່າ tokens ແລ້ວ — ໃຊ້ໄດ້ໄວເທົ່າທີ່ທ່ານຕ້ອງການ.
ໜ້ານີ້ອະທິບາຍວ່າຍອດເງິນຂອງທ່ານປະກອບດ້ວຍຫຍັງ, ໜຶ່ງຄຳຮ້ອງຂໍກັນໄວ້ ແລະ ມີຄ່າໃຊ້ຈ່າຍເທົ່າໃດ, ທ່ານສົ່ງຄຳຮ້ອງຂໍໄດ້ຈັກອັນ, ແລະ ຂີດຈຳກັດບໍ່ຫຼາຍທີ່ຄຳຮ້ອງຂໍດຽວອາດພົບ.
- ມູນຄ່າຂອງຍອດເງິນ 1M tokens
- $5.00
- ໂຄວຕາປະຈຳວັນເລີ່ມໃໝ່
- 00:00 UTC
- ການປ້ອງກັນຖ້ວມ (flood protection) ຕໍ່ບັນຊີ
- 120 ຄຳຮ້ອງຂໍ / ນາທີ
ຄຳຮ້ອງຂໍຖືກໃຫ້ບໍລິການແນວໃດ
- ບໍ່ມີລະດັບ rate — ມີກົດດຽວທີ່ຈຳກັດຄວາມໄວທີ່ຄຳຮ້ອງຂໍມາຮອດ, ແລະ ມັນຄືກັນສຳລັບທຸກບັນຊີ ແລະ ທຸກແຜນ: 120 ຄຳຮ້ອງຂໍຕໍ່ນາທີ. ບໍ່ມີຂີດຈຳກັດ tokens ຕໍ່ນາທີ.
- ບໍ່ມີໂຄວຕາ API ແຍກຕ່າງຫາກ — API ໃຊ້ຍອດເງິນດຽວກັນກັບ chat. ແຜນກຳນົດຂະໜາດຂອງໂຄວຕາມື້ນີ້. ມັນບໍ່ໄດ້ກຳນົດອັດຕາຄຳຮ້ອງຂໍ.
- ໄວເທົ່າທີ່ທ່ານຕ້ອງການ — ຄຳຮ້ອງຂໍທີ່ສົ່ງແບບຂະໜານຖືກຮັບ ແລະ ລໍຖ້າໃນຄິວ. ພວກມັນບໍ່ຖືກປະຕິເສດຍ້ອນເປັນແບບຂະໜານ.
ຍອດເງິນຂອງທ່ານ
ຍອດເງິນຂອງທ່ານຖືກນັບເປັນ tokens. ຍອດເງິນ 1,000,000 tokens ມີມູນຄ່າ $5.00, ແລະ ທຸກລາຄາໃນໜ້າ Models & pricing ແມ່ນອັດຕາທຽບກັບມູນຄ່ານັ້ນ.
ໃນທຸກເວລາ ຍອດເງິນແມ່ນຜົນລວມຂອງສອງສ່ວນ.
- ໂຄວຕາຂອງແຜນມື້ນີ້ — ຈຳນວນ tokens ທີ່ແຜນຂອງທ່ານກຳນົດ. ມັນໃໝ່ທຸກວັນເວລາ 00:00 UTC. ສິ່ງທີ່ເຫຼືອເມື່ອສິ້ນວັນຈະບໍ່ຍົກໄປມື້ຕໍ່ໄປ.
- ເຄຣດິດທີ່ຊື້ເພີ່ມ — Tokens ທີ່ທ່ານຊື້ເປັນແພັກ. ເຄຣດິດບໍ່ໝົດອາຍຸ ແລະ ໃຊ້ໄດ້ກັບທຸກແຜນ, ລວມທັງແຜນຟຣີ.
| ແຜນ | Tokens ຕໍ່ວັນ | ມູນຄ່າ |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- ລຳດັບການໃຊ້ຈ່າຍ — ທຸກຄຳຮ້ອງຂໍໃຊ້ໂຄວຕາຂອງແຜນມື້ນີ້ກ່ອນ. ເຄຣດິດທີ່ຊື້ເພີ່ມຖືກໃຊ້ສະເພາະສ່ວນທີ່ເກີນໂຄວຕາໃນມື້ນັ້ນ.
- Chat ແລະ API ໃຊ້ຮ່ວມກັນ — ມີໜຶ່ງຍອດເງິນຕໍ່ບັນຊີ. API key ໃຊ້ຈາກຍອດເງິນຂອງບັນຊີທີ່ເປັນເຈົ້າຂອງມັນ, ໃນລາຄາດຽວກັນກັບ chat.
- ແພັກ — ເຄຣດິດຂາຍເປັນແພັກ 1,000,000 ($5.00), 2,000,000 ($10.00) ແລະ 5,000,000 ($25.00) tokens, ຫຼື ເປັນຈຳນວນທີ່ທ່ານເລືອກຈາກ 1,000,000 ເຖິງ 100,000,000 tokens ໃນລາຄາ $5.00 ຕໍ່ 1,000,000.
ສິ່ງທີ່ຄຳຮ້ອງຂໍກັນໄວ້ ແລະ ມີຄ່າໃຊ້ຈ່າຍເທົ່າໃດ
- ກັນໄວ້ — ເມື່ອຄຳຮ້ອງຂໍມາຮອດ ມັນຈະກັນງົບ output ຈາກຍອດເງິນຂອງທ່ານ:
max_tokensໃນ/v1/chat/completionsແລະ/v1/messages,max_output_tokensໃນ/v1/responses./v1/chat/completionsຍັງອ່ານmax_completion_tokensນຳ. ຄ່າເລີ່ມຕົ້ນແມ່ນ 4,096 ແລະ ຊ່ວງແມ່ນ 1 ຫາ 65,536. - ຮັບ — ຄຳຮ້ອງຂໍຖືກຮັບສະເພາະເມື່ອຈຳນວນທີ່ກັນໄວ້ພໍດີກັບສິ່ງທີ່ເຫຼືອໃນຍອດເງິນຂອງທ່ານ. ຍອດເງິນທີ່ສູງກວ່າສູນ ແຕ່ນ້ອຍກວ່າງົບ output ຈະໄດ້ຄຳຕອບ
Quota exceeded. ສົ່ງmax_tokensທີ່ນ້ອຍລົງເພື່ອໃຊ້ສ່ວນທີ່ເຫຼືອ. - ຕັດຍອດ — ເມື່ອຄຳຕອບສົມບູນ, ຈຳນວນທີ່ກັນໄວ້ຖືກແທນທີ່ດ້ວຍຄ່າໃຊ້ຈ່າຍຈິງ. ຄ່າໃຊ້ຈ່າຍອາດຕ່ຳກວ່າ ຫຼື ສູງກວ່າຈຳນວນທີ່ກັນໄວ້.
- ຄືນ — ຄຳຮ້ອງຂໍທີ່ຈົບດ້ວຍ status ຂໍ້ຜິດພາດຈະຄືນຈຳນວນທີ່ກັນໄວ້ທັງໝົດ.
ຄ່າໃຊ້ຈ່າຍຈິງຂຶ້ນກັບຕະກູນຂອງ model.
| Model | ສິ່ງທີ່ຖືກຄິດເງິນ |
|---|---|
| model Shannon | usage.total_tokens ຕາມລາຄາຕໍ່ 1M ຂອງ model. Input ແລະ output ມີອັດຕາດຽວ. |
| Hosted open-weight models | Input ທີ່ບໍ່ໄດ້ cache ຄິດຕາມອັດຕາ input, input ທີ່ cache ແລ້ວຄິດຕາມອັດຕາ cached, output ຄິດຕາມອັດຕາ output. |
ຈຳນວນເງິນເປັນ USD ຖືກຫັກຈາກຍອດເງິນຂອງທ່ານເປັນ tokens ໃນອັດຕາ $5.00 ຕໍ່ 1,000,000, ປັດເປັນ token ເຕັມ.
ການນັບ tokens ດ້ວຍ POST /v1/tokenize ຫຼື POST /v1/messages/count_tokens ບໍ່ເສຍຄ່າ ແລະ ບໍ່ກັນຫຍັງ. ການນັບ token
ບ່ອນເບິ່ງຍອດເງິນ ແລະ ການນຳໃຊ້
ໜ້າ Keys & usage ສະແດງສິ່ງທີ່ທ່ານໃຊ້ຈ່າຍໄດ້ຕອນນີ້, ໂຄວຕາຂອງແຜນມື້ນີ້, ເຄຣດິດທີ່ຊື້ເພີ່ມ ແລະ ຍອດໃຊ້ຈ່າຍ API ໃນ 30 ວັນທີ່ຜ່ານມາ. ຂ້າງລຸ່ມນັ້ນມີລາຍການທຸກຄຳຮ້ອງຂໍທີ່ key ຂອງທ່ານສົ່ງ: ເວລາ, endpoint, model, cached input, tokens ທີ່ຄິດເງິນ ແລະ ຄ່າໃຊ້ຈ່າຍ. Keys & usage
ທຸກຄຳຕອບຍັງມີ object usage ທີ່ມີຈຳນວນ tokens ຂອງການເອີ້ນນັ້ນ.
| Endpoint | ຟີລດ໌ຂອງ usage | ເພີ່ມໂດຍ model open-weight ທີ່ host ໄວ້ |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usageເກັບຈຳນວນ tokens ຂອງ model. ຈຳນວນທີ່ຖືກຫັກຈາກຍອດເງິນຂອງທ່ານບໍ່ຢູ່ໃນຄຳຕອບ: ມັນຢູ່ໃນຖັນ Billed tokens ຂອງລາຍການຄຳຮ້ອງຂໍໃນ Keys & usage.- ໃນ
/v1/messagesກັບ hosted open-weight model,input_tokensແມ່ນສ່ວນຂອງ input ທີ່ບໍ່ໄດ້ cache,cache_read_input_tokensແມ່ນສ່ວນທີ່ cache ແລ້ວ ແລະcache_creation_input_tokensເປັນ0ສະເໝີ. - stream ໃນ
/v1/chat/completionsມີusageໃນ chunk ສຸດທ້າຍກ່ອນ[DONE]. ສະຕຣີມມິ້ງ
ເມື່ອຍອດເງິນໝົດ
ຄຳຮ້ອງຂໍທີ່ຈຳນວນກັນໄວ້ບໍ່ພໍດີກັບຍອດເງິນຂອງທ່ານຈະຖືກຕອບດ້ວຍ status 429, ປະເພດ rate_limit_error ແລະ ຂໍ້ຄວາມຂ້າງລຸ່ມ. ບໍ່ມີຫຍັງຖືກຄິດເງິນ. ຄຳຕອບດຽວກັນຖືກສົ່ງເມື່ອຍອດເງິນສູງກວ່າສູນ ແຕ່ນ້ອຍກວ່າງົບ output ຂອງຄຳຮ້ອງຂໍ.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} ໃນ /v1/responses object error ອາດມີ code ແລະ param ນຳ, ທັງສອງເປັນ null.
ສິ່ງທີ່ທ່ານເຮັດໄດ້:
- ລໍຖ້າໂຄວຕາຂອງແຜນຖັດໄປເວລາ 00:00 UTC.
- ເຕີມເຄຣດິດ. ເຄຣດິດຖືກໃຊ້ຫຼັງຈາກໂຄວຕາຂອງແຜນ ແລະ ບໍ່ໝົດອາຍຸ. ເຕີມເຄຣດິດ
- ປ່ຽນໄປແຜນທີ່ມີໂຄວຕາປະຈຳວັນໃຫຍ່ກວ່າ. ປ່ຽນແຜນ
- ສົ່ງ
max_tokensທີ່ນ້ອຍລົງ, ຖ້າຍັງເຫຼືອຍອດເງິນບາງສ່ວນ: ຈຳນວນທີ່ກັນໄວ້ຈະນ້ອຍລົງ.
ໂຄວຕາການເອີ້ນ Shannon Coder
shannon-coder-1 ໃນ /v1/chat/completions ແລະ /v1/messages ຖືກນັບເປັນການເອີ້ນ, ບໍ່ແມ່ນ tokens. ແຕ່ລະແຜນມີຈຳນວນການເອີ້ນຕໍ່ window 4 ຊົ່ວໂມງ. ໜຶ່ງຄຳຮ້ອງຂໍແມ່ນໜຶ່ງການເອີ້ນ.
| ແຜນ | ການເອີ້ນຕໍ່ window 4 ຊົ່ວໂມງ |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- window ເລີ່ມເວລາ 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC. ການເອີ້ນທີ່ເຫຼືອເມື່ອສິ້ນສຸດ window ຈະບໍ່ຍົກໄປ window ຕໍ່ໄປ.
- ການເອີ້ນຖືກນັບເມື່ອຄຳຮ້ອງຂໍຖືກຮັບ, ກ່ອນທີ່ model ຈະຕອບ. ຄຳຮ້ອງຂໍທີ່ລົ້ມເຫຼວຫຼັງຈາກນັ້ນກໍຍັງນັບເປັນໜຶ່ງການເອີ້ນ.
- ການເອີ້ນເຫຼົ່ານີ້ບໍ່ກັນ tokens ແລະ ບໍ່ຫັກຫຍັງຈາກຍອດເງິນຂອງທ່ານ. ລາຍການຄຳຮ້ອງຂໍໃນ Keys & usage ສະແດງຈຳນວນ tokens ແລະ ມູນຄ່າຂອງມັນໃນລາຄາທີ່ລະບຸ.
max_tokensເລີ່ມຕົ້ນຂອງshannon-coder-1ໃນສອງ endpoint ນີ້ແມ່ນ 65,536.- ເມື່ອບໍ່ເຫຼືອການເອີ້ນ ຄຳຕອບແມ່ນ status
429, ປະເພດrate_limit_error, ຂໍ້ຄວາມShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan. - ໃນ
/v1/responses,shannon-coder-1ບໍ່ມີໂຄວຕາການເອີ້ນ: ມັນຖືກຄິດເງິນເປັນ tokens ຈາກຍອດເງິນຂອງທ່ານໃນລາຄາ $8.00 ຕໍ່ 1M, ຄືກັບ model ອື່ນທັງໝົດ.
Flood protection
ບັນຊີສົ່ງໄດ້ 120 ຄຳຮ້ອງຂໍຕໍ່ນາທີ. ນັ້ນແມ່ນຂີດຈຳກັດດຽວທີ່ກ່ຽວກັບອັດຕາຄຳຮ້ອງຂໍ, ແລະ ຄືກັນທຸກແຜນ. ມັນມີໄວ້ເພື່ອຢຸດການຖ້ວມຄຳຮ້ອງຂໍ, ບໍ່ແມ່ນເພື່ອເຮັດໃຫ້ການໃຊ້ງານປົກກະຕິຊ້າລົງ.
- ນາທີແມ່ນ window ຄົງທີ່ 60 ວິນາທີທີ່ເປີດດ້ວຍຄຳຮ້ອງຂໍທຳອິດຂອງທ່ານ. ເມື່ອມັນຈົບ ການນັບເລີ່ມຈາກສູນອີກຄັ້ງ.
- ການນັບແມ່ນຕໍ່ບັນຊີ, ບໍ່ແມ່ນຕໍ່ key ແລະ ບໍ່ແມ່ນຕໍ່ທີ່ຢູ່ IP. ການປ່ຽນ key ບໍ່ເປີດ window ໃໝ່.
- ຄຳຮ້ອງຂໍທີ 121 ພາຍໃນ window ຖືກຕອບດ້ວຍ status
429, ປະເພດrate_limit_errorແລະ ຂໍ້ຄວາມToo many requests. Retry in <N>s.Nແມ່ນຈຳນວນວິນາທີຈົນກວ່າ window ຈະຈົບ, ຈາກ 1 ຫາ 60. - Flood protection ຖືກກວດກ່ອນຍອດເງິນ. ຄຳຮ້ອງຂໍທີ່ມັນປະຕິເສດບໍ່ກັນຫຍັງ ແລະ ບໍ່ເສຍຫຍັງ.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | ຄຳຮ້ອງຂໍ | Flood protection |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | ນັບ, ໜຶ່ງຕໍ່ຄຳຮ້ອງຂໍ. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | ບໍ່ນັບ. |
shannon-coder-1 ໃນ /v1/chat/completions ແລະ /v1/messages | ຖືກນັບດ້ວຍໂຄວຕາການເອີ້ນ Shannon Coder ແທນ. |
ຄຳຮ້ອງຂໍທີ່ຖືກຕອບດ້ວຍ 401, ຫຼື ດ້ວຍ 400 ສຳລັບ model ທີ່ບໍ່ຮູ້ຈັກ | ບໍ່ນັບ. |
| ຄຳຮ້ອງຂໍທີ່ຖືກ flood protection ປະຕິເສດ | ນັບເຂົ້າ window. ບໍ່ມີຫຍັງຖືກຄິດເງິນ. |
ຄຳຮ້ອງຂໍແບບຂະໜານ
ບໍ່ມີຂີດຈຳກັດວ່າບັນຊີເປີດຄຳຮ້ອງຂໍພ້ອມກັນໄດ້ຈັກອັນ, ແລະ ບໍ່ມີຂໍ້ຜິດພາດສຳລັບການສົ່ງຄຳຮ້ອງຂໍແບບຂະໜານ. ຄຳຮ້ອງຂໍທີ່ເລີ່ມທັນທີບໍ່ໄດ້ຈະລໍຖ້າໃນຄິວ ແລະ ຖືກຕອບຕາມລຳດັບ.
- ແຕ່ລະຄຳຮ້ອງຂໍນັບເຂົ້າ 120 ຕໍ່ນາທີເມື່ອມັນມາຮອດ, ບໍ່ວ່າຄຳຮ້ອງຂໍກ່ອນໜ້າຈະຈົບແລ້ວຫຼືບໍ່.
- ແຕ່ລະຄຳຮ້ອງຂໍຖືຈຳນວນທີ່ກັນໄວ້ຂອງຕົນເອງຈົນກວ່າມັນຈະຈົບ. ຄຳຮ້ອງຂໍທີ່ເປີດຢູ່ຊາວອັນດ້ວຍງົບ output ເລີ່ມຕົ້ນຖື 20 × 4,096 = 81,920 tokens ຂອງຍອດເງິນ. ຖ້າຈຳນວນທີ່ກັນໄວ້ລວມກັນໃຫຍ່ກວ່າຍອດເງິນຂອງທ່ານ, ຄຳຮ້ອງຂໍຖັດໄປຈະໄດ້ຄຳຕອບ
Quota exceeded, ເຖິງແມ່ນການເອີ້ນທີ່ຈົບແລ້ວຈະມີຄ່າໃຊ້ຈ່າຍໜ້ອຍກວ່າ.max_tokensທີ່ນ້ອຍກວ່າຖືໄວ້ໜ້ອຍກວ່າ. - ຄຳຮ້ອງຂໍທີ່ບໍ່ stream ຈະບໍ່ສົ່ງຫຍັງຈົນກວ່າຄຳຕອບຈະສົມບູນ, ດັ່ງນັ້ນໃຫ້ client ຂອງທ່ານມີ timeout ທີ່ຄອບຄຸມເວລາລໍຖ້າ. stream ເປີດການເຊື່ອມຕໍ່ໄວ້ໃນຂະນະທີ່ລໍຖ້າ. ສະຕຣີມມິ້ງ
ຂີດຈຳກັດຂອງຄຳຮ້ອງຂໍດຽວ
| ຂີດຈຳກັດ | ຄ່າ | ໃຊ້ກັບ | ເມື່ອຮອດຂີດຈຳກັດ |
|---|---|---|---|
| body ຂອງຄຳຮ້ອງຂໍ | 32 MiB (33,554,432 bytes) | ທຸກ endpoint | Status 413, ປະເພດ invalid_request_error. |
ງົບ output: max_tokens, max_completion_tokens, max_output_tokens | 1 ຫາ 65,536. ຄ່າເລີ່ມຕົ້ນ 4,096; ສຳລັບ shannon-coder-1 ໃນ /v1/chat/completions ແລະ /v1/messages ຄ່າເລີ່ມຕົ້ນແມ່ນ 65,536. | ທຸກ model, ເປັນຈຳນວນທີ່ກັນໄວ້ຈາກຍອດເງິນຂອງທ່ານ. ເປັນຂີດຈຳກັດຄວາມຍາວຂອງຄຳຕອບ: hosted open-weight models, shannon-1.6-lite, shannon-1.6-pro ແລະ shannon-coder-1. | ຄ່າທີ່ຢູ່ນອກຊ່ວງຖືກຍ້າຍໄປປາຍທີ່ໃກ້ທີ່ສຸດຂອງຊ່ວງ. ບໍ່ມີຂໍ້ຜິດພາດ. |
Stop sequence: stop, stop_sequences | 4 string | Hosted open-weight models | ໃຊ້ 4 string ທີ່ບໍ່ວ່າງອັນທຳອິດ. |
| ຮູບພາບ ຫຼື ໄຟລ໌ທີ່ໃຫ້ເປັນ URL | 8 MiB, ອ່ານພາຍໃນ 20 ວິນາທີ, redirect ສູງສຸດ 5 ຄັ້ງ, ທີ່ຢູ່ http ຫຼື https ສາທາລະນະ | ທຸກ endpoint ທີ່ຮັບຮູບພາບ ຫຼື ໄຟລ໌ | ຄຳຮ້ອງຂໍຖືກຕອບໂດຍບໍ່ມີສ່ວນນັ້ນ. ບໍ່ມີຂໍ້ຜິດພາດ. |
| ຮູບພາບ ຫຼື ໄຟລ໌ທີ່ສົ່ງແບບ inline (base64) | ບໍ່ມີຂີດຈຳກັດຂອງຕົນເອງ. ມັນນັບເຂົ້າ body ຄຳຮ້ອງຂໍ 32 MiB. | ທຸກ endpoint ທີ່ຮັບຮູບພາບ ຫຼື ໄຟລ໌ | Status 413 ສຳລັບທັງຄຳຮ້ອງຂໍ. |
text ຂອງ POST /v1/tokenize | 4,000,000 bytes | /v1/tokenize | Status 413, ປະເພດ invalid_request_error, ຂໍ້ຄວາມ text too long. |
messages ຂອງ POST /v1/tokenize ແລະ body ຂອງ POST /v1/messages/count_tokens | body ຄຳຮ້ອງຂໍ 32 MiB | ທັງສອງ endpoint ນັບ | Status 413. |
| Context window | ຕໍ່ model: context_window ໃນ GET /v1/models | ທຸກ model | ສິ່ງທີ່ເກີດກັບການສົນທະນາທີ່ຍາວກວ່ານັ້ນຂຶ້ນກັບ model. Model ແລະ ລາຄາ |
ການຄົ້ນຫາເວັບ (web_search: true) | ຕໍ່ແຜນແລະວັນ: Free 3, Plus 30, Standard 50, Pro 60. ນັບໜຶ່ງການຄົ້ນຫາສຳລັບຄຳຮ້ອງຂໍທີ່ການຄົ້ນຫາພົບຜົນ. | ຄຳຮ້ອງຂໍທີ່ຕັ້ງ web_search: true | ເມື່ອບໍ່ເຫຼືອ ຄຳຮ້ອງຂໍຖືກຕອບໂດຍບໍ່ມີການຄົ້ນຫາ. ບໍ່ມີຂໍ້ຜິດພາດ. ຄົ້ນຫາເວັບ |
ຂໍ້ຜິດພາດ
ຄຳຕອບຂອງໜ້ານີ້. ໃນ /v1/messages object error ດຽວກັນຖືກຫໍ່ເປັນ {"type": "error", "error": {…}}.
| ສະຖານະ | ປະເພດ | ຂໍ້ຄວາມ | ເມື່ອໃດ, ແລະ ຕ້ອງເຮັດຫຍັງ |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | ຈຳນວນທີ່ກັນໄວ້ຂອງຄຳຮ້ອງຂໍບໍ່ພໍດີກັບຍອດເງິນຂອງທ່ານ. ລໍຖ້າ 00:00 UTC, ເຕີມເຄຣດິດ, ປ່ຽນແຜນ, ຫຼື ສົ່ງ max_tokens ທີ່ນ້ອຍລົງ. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | ເກີນ 120 ຄຳຮ້ອງຂໍໃນນາທີປັດຈຸບັນ. ລໍຖ້າ N ວິນາທີ ແລ້ວສົ່ງອີກ. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | ການເອີ້ນ Shannon Coder ຂອງ window 4 ຊົ່ວໂມງປັດຈຸບັນຖືກໃຊ້ໝົດ. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | model ຮັບຄຳຮ້ອງຂໍບໍ່ໄດ້ໃນເວລານີ້. ສົ່ງອີກຫຼັງຢຸດຊົ່ວຄາວ. |
503 | api_error | Could not verify your quota right now. Please retry. | ອ່ານຍອດເງິນຂອງທ່ານບໍ່ໄດ້. ບໍ່ມີຫຍັງຖືກຄິດເງິນ; ສົ່ງຄຳຮ້ອງຂໍອີກ. ໃນ /v1/responses ກັບ model Shannon status ແມ່ນ 500. |
413 | invalid_request_error | body ຂອງຄຳຮ້ອງຂໍໃຫຍ່ກວ່າ 32 MiB. ໃນ endpoint ຮູບແບບ OpenAI object error ມີ code: "request_too_large". | |
413 | invalid_request_error | text too long | text ຂອງ POST /v1/tokenize ຍາວກວ່າ 4,000,000 bytes. |