Chat Completions
POST /v1/chat/completions ຮັບການສົນທະນາ ແລະ ສົ່ງຂໍ້ຄວາມຖັດໄປຂອງ model ກັບຄືນໃນຮູບແບບ OpenAI Chat Completions. ໃຊ້ໄດ້ຈາກ OpenAI SDK ໃດກໍໄດ້ ຫຼື ຜ່ານ HTTP ທຳມະດາ; ໜ້ານີ້ແມ່ນເອກະສານອ້າງອີງແຕ່ລະຟີລດ໌.
POST https://api.shannon-ai.com/v1/chat/completions
ຄຳຮ້ອງຂໍທີ່ນ້ອຍທີ່ສຸດແມ່ນ id ຂອງ model ແລະ ຂໍ້ຄວາມ user ໜຶ່ງຂໍ້ຄວາມ.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.shannon-ai.com/v1",
)
response = client.chat.completions.create(
model="shannon-3",
messages=[{"role": "user", "content": "Say hello in one sentence."}],
)
print(response.choices[0].message.content) import OpenAI from "openai";
const client = new OpenAI({
apiKey: "YOUR_API_KEY",
baseURL: "https://api.shannon-ai.com/v1",
});
const response = await client.chat.completions.create({
model: "shannon-3",
messages: [{ role: "user", content: "Say hello in one sentence." }],
});
console.log(response.choices[0].message.content); curl https://api.shannon-ai.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "shannon-3",
"messages": [{"role": "user", "content": "Say hello in one sentence."}]
}' ຄຳຕອບແມ່ນ object JSON ໜຶ່ງອັນ:
{
"id": "chatcmpl-5f0c1e7a9b3d4c62a8e1f07d2b46c9a3",
"object": "chat.completion",
"created": 1791625200,
"model": "shannon-3",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Hello, it is good to meet you.",
"reasoning_content": "The user wants a greeting in one sentence. Keep it short and friendly."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 1184,
"completion_tokens": 46,
"total_tokens": 1230
}
} Headers
Request headers
| Header | ຄ່າ | ຄຳອະທິບາຍ |
|---|---|---|
Authorization | Bearer YOUR_API_KEY | API key ຂອງທ່ານ. ໃຊ້ x-api-key: YOUR_API_KEY ແທນໄດ້ໃນທຸກ endpoint. |
Content-Type | application/json | ຕ້ອງມີ. ຄ່າອື່ນໃດຈະສົ່ງ 415 ກັບຄືນ. |
x-request-id | ບໍ່ບັງຄັບ. id ຂອງທ່ານເອງສຳລັບຄຳຮ້ອງຂໍ. ມັນຈະກັບມາໃນຄຳຕອບໂດຍບໍ່ປ່ຽນແປງ. |
Reply headers
| Header | ຄຳອະທິບາຍ |
|---|---|
x-request-id | ໃນທຸກຄຳຕອບ, ລວມທັງຂໍ້ຜິດພາດ ແລະ stream: ຄ່າທີ່ທ່ານສົ່ງມາ, ຫຼື ຕົວອັກສອນເລກຖານສິບຫົກ 12 ຕົວເມື່ອທ່ານບໍ່ໄດ້ສົ່ງ. ອ້າງອີງມັນເມື່ອທ່ານລາຍງານບັນຫາ. |
content-type | application/json, ຫຼື text/event-stream ເມື່ອ stream ເປັນ true. |
ຟີລດ໌ຂອງຄຳຮ້ອງຂໍ
ຕ້ອງມີພຽງ messages. ຄໍລຳ ໃຊ້ໂດຍ ລະບຸ model ທີ່ຟີວນັ້ນປ່ຽນຄຳຕອບ. Hosted open-weight models ແມ່ນສິບສອງ id ໃນລາຍການ model; ຕະກູນ Shannon 3 ແມ່ນ shannon-3, shannon-3-pro, shannon-3.1 ແລະ shannon-3.1-pro. Model ແລະ ລາຄາ
| ຟີວ | ປະເພດ | ຄ່າເລີ່ມຕົ້ນ | ຄຳອະທິບາຍ | ໃຊ້ໂດຍ |
|---|---|---|---|---|
model | string | shannon-1.6-lite | model ທີ່ຕອບ: id ຈາກລາຍຊື່ model. ສົ່ງມັນໄປກັບທຸກຄຳຮ້ອງຂໍ. ການຈັບຄູ່ບໍ່ແຍກຕົວພິມນ້ອຍ-ໃຫຍ່. id ທີ່ບໍ່ໄດ້ເຜີຍແຜ່ຈະສົ່ງ 400 unknown model ກັບຄືນ. | ທຸກ model |
messages | array | ຕ້ອງມີ. ບົດສົນທະນາ, ຂໍ້ຄວາມເກົ່າສຸດກ່ອນ. ເບິ່ງ Messages ຂ້າງລຸ່ມ. | ທຸກ model | |
stream | boolean | false | true ສົ່ງຄຳຕອບເປັນ server-sent events ໃນຂະນະທີ່ມັນກຳລັງຖືກຂຽນ. | ທຸກ model |
max_tokens | integer | 4096 | ຂີດຈຳກັດສູງສຸດຂອງຄຳຕອບ, ເປັນ tokens. ຄ່າທີ່ຢູ່ນອກຊ່ວງ 1 ຫາ 65,536 ຈະຖືກປັບເຂົ້າຊ່ວງນັ້ນ. ມັນຍັງເປັນຈຳນວນທີ່ກັນໄວ້ຈາກຍອດເງິນຂອງທ່ານໃນຂະນະທີ່ຄຳຮ້ອງຂໍກຳລັງເຮັດວຽກ. ເບິ່ງ Output length ຂ້າງລຸ່ມ. | Hosted open-weight models, shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 |
max_completion_tokens | integer | ຄືກັນກັບ max_tokens. ເມື່ອສົ່ງທັງສອງ, ຈະໃຊ້ max_tokens. | Hosted open-weight models, shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 | |
temperature | number | Sampling temperature. ໃນ hosted open-weight models ຄ່າເລີ່ມຕົ້ນແມ່ນ 1 ແລະ ຄ່າຈະຖືກຮັກສາໄວ້ລະຫວ່າງ 0 ຫາ 2. | Hosted open-weight models, shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 | |
top_p | number | 0.95 | Nucleus sampling. ຄ່າຖືກຮັກສາໄວ້ລະຫວ່າງ 0 ຫາ 1. | Hosted open-weight models |
seed | integer | Seed ຂອງ sampler, ເປັນຈຳນວນເຕັມໃດກໍໄດ້. ຖ້າບໍ່ສົ່ງ, seed ຈະຖືກຄິດຈາກ model ແລະ ການສົນທະນາ, ດັ່ງນັ້ນຄຳຮ້ອງຂໍດຽວກັນທີ່ສົ່ງສອງເທື່ອຈະໃຊ້ seed ດຽວກັນ. | Hosted open-weight models | |
stop | string | array | string ຫຼື array ຂອງ string. ໃຊ້ສູງສຸດ 4 ອັນ. ຄຳຕອບຈະຈົບກ່ອນອັນທຳອິດທີ່ປາກົດ; ຂໍ້ຄວາມ stop ເອງຈະບໍ່ຖືກສົ່ງກັບຄືນ. | Hosted open-weight models | |
reasoning_effort | string | high | model ຄິດຫາເຫດຜົນຫຼາຍເທົ່າໃດກ່ອນຕອບ: off, low, medium ຫຼື high. none ແລະ minimal ໝາຍເຖິງ off, default ໝາຍເຖິງ medium, max ໝາຍເຖິງ high. ຄ່າອື່ນໃດຈະສົ່ງ 400 ກັບຄືນ. | Hosted open-weight models |
reasoning | object | ການຕັ້ງຄ່າດຽວກັນໃນຮູບແບບ object: {"effort": "low"}. ເມື່ອສົ່ງທັງສອງ, ຈະໃຊ້ reasoning_effort. | Hosted open-weight models | |
tools | array | functions ທີ່ model ອາດເອີ້ນ, ແຕ່ລະອັນເປັນ {"type": "function", "function": {"name", "description", "parameters"}}. ການເອີ້ນຂອງ model ຈະກັບມາໃນ tool_calls; ໂຄ້ດຂອງທ່ານເປັນຜູ້ຮັນມັນ. | ທຸກ model | |
tool_choice | string | object | auto | "auto" ໃຫ້ model ຕັດສິນໃຈເອງ. "required" ບັງຄັບໃຫ້ມັນເອີ້ນ tool. {"type": "function", "function": {"name": "…"}} ບັງຄັບໃຫ້ມັນເອີ້ນ tool ນັ້ນ. | Hosted open-weight models |
response_format | object | {"type": "json_object"} ສຳລັບຄຳຕອບແບບ JSON, ຫຼື {"type": "json_schema", "json_schema": {…}} ສຳລັບຄຳຕອບທີ່ເປັນໄປຕາມ schema ຂອງທ່ານ. | ທຸກລະດັບ Shannon; ສຳລັບ hosted open-weight models ແມ່ນຕາມທີ່ລະບຸໄວ້ຂອງແຕ່ລະ id | |
web_search | boolean | false | true ໃຫ້ model ຄົ້ນຫາເວັບກ່ອນຕອບ. | shannon-1.6-*, shannon-2-*, ຕະກູນ Shannon 3 |
ຟີວອື່ນຂອງ OpenAI, ເຊັ່ນ n, user, stream_options, parallel_tool_calls, presence_penalty, frequency_penalty, logit_bias, logprobs, metadata, store ແລະ prompt_cache_key, ຖືກຮັບໄວ້ເພື່ອໃຫ້ໂຄ້ດ client ເດີມເຮັດວຽກໄດ້ໂດຍບໍ່ຕ້ອງແກ້. ມັນບໍ່ປ່ຽນຄຳຕອບ: ມີ choice ດຽວສະເໝີ, ແລະ stream ຈົບດ້ວຍ usage ສະເໝີ.
ຟີລດ໌ທີ່ມີປະເພດ JSON ຜິດ, ຕົວຢ່າງ "max_tokens": "100", ຈະສົ່ງ 422 ກັບຄືນ. ຄຳຮ້ອງຂໍທີ່ບໍ່ມີ messages ກໍຄືກັນ.
Tools, structured output, reasoning ແລະ web search ແຕ່ລະຢ່າງມີໜ້າຂອງຕົນເອງ: ການເອີ້ນຟັງຊັນ, ຜົນອອກມີໂຄງສ້າງ, Reasoning effort, ຄົ້ນຫາເວັບ.
ຄຳຮ້ອງຂໍທີ່ມີ options
ຄຳຮ້ອງຂໍນີ້ຕັ້ງຂໍ້ຄວາມ system, ຟີລດ໌ sampling ແລະ ລະດັບ reasoning effort. ມັນໃຊ້ hosted open-weight model ເຊິ່ງນຳໃຊ້ທັງໝົດນີ້.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.shannon-ai.com/v1",
)
response = client.chat.completions.create(
model="DeepSeek-V4-Flash-0731-W4A16-AUTOROUND-REAP",
messages=[
{"role": "system", "content": "You are a physics teacher. Answer in two sentences."},
{"role": "user", "content": "Why is the sky blue?"},
],
max_tokens=512,
temperature=0.3,
top_p=0.9,
seed=7,
stop=["\n\n"],
reasoning_effort="low",
)
message = response.choices[0].message
print(message.reasoning_content) # the reasoning
print(message.content) # the answer
print(response.usage) import OpenAI from "openai";
const client = new OpenAI({
apiKey: "YOUR_API_KEY",
baseURL: "https://api.shannon-ai.com/v1",
});
const response = await client.chat.completions.create({
model: "DeepSeek-V4-Flash-0731-W4A16-AUTOROUND-REAP",
messages: [
{ role: "system", content: "You are a physics teacher. Answer in two sentences." },
{ role: "user", content: "Why is the sky blue?" },
],
max_tokens: 512,
temperature: 0.3,
top_p: 0.9,
seed: 7,
stop: ["\n\n"],
reasoning_effort: "low",
});
const message = response.choices[0].message;
console.log(message.reasoning_content); // the reasoning
console.log(message.content); // the answer
console.log(response.usage); curl https://api.shannon-ai.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "DeepSeek-V4-Flash-0731-W4A16-AUTOROUND-REAP",
"messages": [
{"role": "system", "content": "You are a physics teacher. Answer in two sentences."},
{"role": "user", "content": "Why is the sky blue?"}
],
"max_tokens": 512,
"temperature": 0.3,
"top_p": 0.9,
"seed": 7,
"stop": ["\n\n"],
"reasoning_effort": "low"
}' ຄຳຕອບມີຮູບຮ່າງຄືກັບຂ້າງເທິງ. usage ຂອງມັນເພີ່ມສອງລາຍລະອຽດໃນ hosted open-weight models: prompt tokens ທີ່ອ່ານຈາກ cache ແລະ tokens ທີ່ໃຊ້ໄປກັບ reasoning.
{
"usage": {
"prompt_tokens": 31,
"completion_tokens": 62,
"total_tokens": 93,
"prompt_tokens_details": {
"cached_tokens": 0
},
"completion_tokens_details": {
"reasoning_tokens": 21
}
}
} ຄວາມຍາວຂອງ output
max_tokens ເຮັດສອງຢ່າງ. ຢ່າງທຳອິດ, ມັນແມ່ນຈຳນວນ tokens ທີ່ຖືກກັນໄວ້ຈາກ ຍອດເງິນ ຂອງທ່ານເມື່ອຄຳຮ້ອງຂໍເລີ່ມຕົ້ນ. ເມື່ອຄຳຕອບສົມບູນ, ຈຳນວນນັ້ນຈະຖືກແທນທີ່ດ້ວຍ tokens ທີ່ຄຳຮ້ອງຂໍໃຊ້ຈິງ. ຖ້າ max_tokens ໃຫຍ່ກວ່າສິ່ງທີ່ເຫຼືອຢູ່ໃນ ຍອດເງິນ ຂອງທ່ານ, ຄຳຮ້ອງຂໍຈະສົ່ງ 429 Quota exceeded ກັບຄືນ ເຖິງແມ່ນວ່າຄຳຕອບເອງຈະຢູ່ໃນຂອບເຂດກໍຕາມ. ສົ່ງ max_tokens ທີ່ຕ່ຳລົງເພື່ອກັນໄວ້ໜ້ອຍລົງ.
shannon-coder-1 ຖືກນັບແຕກຕ່າງກັນໃນ endpoint ນີ້: ແຕ່ລະຄຳຮ້ອງຂໍແມ່ນໜຶ່ງການເອີ້ນ Shannon Coder ຂອງແຜນຂອງທ່ານ, ແລະ ບໍ່ມີ tokens ຖືກກັນໄວ້ສຳລັບມັນ. ຂີດຈຳກັດ ແລະ ຍອດເງິນ
ຢ່າງທີສອງ, ມັນຈຳກັດຄວາມຍາວຂອງຄຳຕອບໃນ model ເຫຼົ່ານີ້:
| Models | ສິ່ງທີ່ max_tokens ເຮັດ |
|---|---|
shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 | ຄຳຕອບຢຸດເມື່ອຮອດຂີດຈຳກັດ. stream ຈະຈົບດ້ວຍ finish_reason length. |
| Hosted open-weight models | ຂໍ້ຄວາມຄຳຕອບຢຸດທີ່ max_tokens. Reasoning ບໍ່ຖືກນັບລວມ. ຄ່າທີ່ຕ່ຳກວ່າ 256 ຈະເຮັດວຽກເປັນ 256. |
ຖ້າບໍ່ມີ max_tokens ຫຼື max_completion_tokens, ຄ່າແມ່ນ 4,096. ໃນ shannon-coder-1 ແມ່ນ 65,536.
ຂໍ້ຄວາມ
ແຕ່ລະຂໍ້ຄວາມເປັນ object ທີ່ມີ role ແລະ content. content ເປັນ string, ຫຼື array ຂອງສ່ວນຕ່າງໆ ເມື່ອຂໍ້ຄວາມມີຫຼາຍກວ່າຂໍ້ຄວາມຕົວອັກສອນ.
| Role | ຄຳອະທິບາຍ | ໃຊ້ໂດຍ |
|---|---|---|
system | ຄຳແນະນຳສຳລັບ model. ໃສ່ມັນເປັນອັນທຳອິດ. ໃນລະດັບ Shannon, ຂໍ້ຄວາມ system ອັນທຳອິດແມ່ນອັນທີ່ຖືກນຳໃຊ້. | Hosted open-weight models, shannon-1.6-*, shannon-2-*, shannon-coder-1 |
developer | ຖືກອ່ານເປັນ system. | Hosted open-weight models |
user | ສິ່ງທີ່ທ່ານຖາມ. ໃນລະດັບ Shannon, ຂໍ້ຄວາມ user ສຸດທ້າຍແມ່ນ prompt ແລະ ຂໍ້ຄວາມກ່ອນໜ້າມັນແມ່ນປະຫວັດ. | ທຸກ model |
assistant | ຄຳຕອບກ່ອນໜ້ານີ້ຂອງ model. ຮັກສາ tool_calls ຂອງມັນໄວ້ເມື່ອທ່ານສົ່ງຜົນລັບຂອງ tool ຕໍ່ຈາກມັນ. | ທຸກ model |
tool | ຜົນລັບຂອງການເອີ້ນ tool: tool_call_id ເກັບ id ຂອງການເອີ້ນ ແລະ content ເກັບຜົນລັບເປັນ string. | ທຸກ model |
ກັບ id ໃນຕະກູນ Shannon 3, ໃຫ້ໃສ່ຄຳແນະນຳທີ່ຕ້ອງປະຕິບັດຕາມໄວ້ໃນຂໍ້ຄວາມ user.
ໃນລະດັບ Shannon, ຄຳຮ້ອງຂໍທີ່ບໍ່ມີຂໍ້ຄວາມຂອງ user ແລະ ບໍ່ມີ tools ຈະສົ່ງ 400 No user message provided ກັບຄືນ.
ສ່ວນຂອງເນື້ອຫາ
| ສ່ວນ | ຄຳອະທິບາຍ | ໃຊ້ໄດ້ໃນ |
|---|---|---|
{"type": "text", "text": "…"} | ຂໍ້ຄວາມທຳມະດາ. | ທຸກ model |
{"type": "image_url", "image_url": {"url": "…"}} | ຮູບພາບ, ເປັນ data: URL ທີ່ມີເນື້ອຫາ base64 ຫຼື ເປັນ http(s) URL. | ຕະກູນ Shannon 3, shannon-1.6-lite, shannon-1.6-pro, ແລະ hosted open-weight models ທີ່ລະບຸວ່າຮັບຮູບພາບເປັນ input |
{"type": "file", "source": {"type": "base64", "media_type": "application/pdf", "data": "…"}} | ເອກະສານ (PDF, Word, PowerPoint ຫຼື Excel), ເປັນ base64 ຫຼື ຜ່ານ URL. | ຕະກູນ Shannon 3 |
ຂະໜາດ, ຂີດຈຳກັດ ແລະ ລາຍຊື່ຮູບແບບທັງໝົດມີໜ້າຂອງຕົນເອງ. ຮູບພາບ ແລະ ໄຟລ໌
object ຂອງຄຳຕອບ
| ຟີວ | ປະເພດ | ຄຳອະທິບາຍ |
|---|---|---|
id | string | chatcmpl- ຕາມດ້ວຍຕົວອັກສອນເລກຖານສິບຫົກ 32 ຕົວ. |
object | string | ເປັນ chat.completion ສະເໝີ. |
created | integer | ເວລາຂອງຄຳຕອບ, ເປັນວິນາທີ Unix. |
model | string | id ມາດຕະຖານຂອງ model ທີ່ຕອບ. ການສະກົດອາດຕ່າງຈາກ id ທີ່ທ່ານສົ່ງ. |
choices | array | ມີ choice ດຽວສະເໝີ, ດ້ວຍ index 0. |
choices[0].message.role | string | ເປັນ assistant ສະເໝີ. |
choices[0].message.content | string | null | ຂໍ້ຄວາມຄຳຕອບ. ເມື່ອມີ tool_calls ມັນເປັນ null ໃນລະດັບ Shannon; hosted open-weight models ສາມາດສົ່ງຂໍ້ຄວາມຄຽງຄູ່ກັບການເອີ້ນໄດ້. |
choices[0].message.reasoning_content | string | null | reasoning ທີ່ model ຂຽນກ່ອນຄຳຕອບ, ຫຼື null ເມື່ອບໍ່ມີ. |
choices[0].message.tool_calls | array | ມີສະເພາະເມື່ອ model ເອີ້ນ tools. ແຕ່ລະລາຍການມີ id, type function, ແລະ function ທີ່ມີ name ແລະ arguments ເປັນ string JSON. |
choices[0].message.annotations | array | ມີສະເພາະໃນຄຳຮ້ອງຂໍທີ່ມີ web_search: true ເຊິ່ງການຄົ້ນຫາພົບບາງຢ່າງ. ໜຶ່ງ url_citation ຕໍ່ທຸກແຫຼ່ງທີ່ເຄື່ອງໝາຍໃນ content ຊີ້ເຖິງ, ມີ url, title, start_index ແລະ end_index (ຕຳແໜ່ງຂອງເຄື່ອງໝາຍ, ນັບເປັນຕົວອັກສອນ, ບໍ່ລວມຈຸດສິ້ນສຸດ). |
choices[0].finish_reason | string | ເປັນຫຍັງຄຳຕອບຈຶ່ງຈົບ. ເບິ່ງເຫດຜົນທີ່ຈົບ. |
usage | object | tokens ຂອງຄຳຮ້ອງຂໍ. ເບິ່ງການນຳໃຊ້. |
sources | array | ມີສະເພາະໃນຄຳຮ້ອງຂໍທີ່ມີ web_search: true ເຊິ່ງການຄົ້ນຫາພົບບາງຢ່າງ: ຜົນລັບທີ່ model ໄດ້ຮັບ, ແຕ່ລະອັນມີ index, title ແລະ url. [1] ໃນຄຳຕອບແມ່ນລາຍການທີ່ມີ index ເປັນ 1. |
ເຫດຜົນທີ່ຈົບ
| finish_reason | ຄຳອະທິບາຍ |
|---|---|
stop | model ຕອບຈົບແລ້ວ, ຫຼື string stop ປາກົດຂຶ້ນ. |
tool_calls | model ເອີ້ນ tool ໜຶ່ງອັນ ຫຼື ຫຼາຍອັນ. ຮັນມັນ ແລ້ວສົ່ງຜົນລັບໃນຂໍ້ຄວາມ tool. |
length | ຄຳຕອບຖືກຕັດທີ່ຂີດຈຳກັດ output. ລາຍງານໃນ stream ຂອງ shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 ແລະ ຕະກູນ Shannon 3. |
ຄຳຕອບທີ່ບໍ່ແມ່ນ stream ຈະລາຍງານ stop ຫຼື tool_calls.
ການນຳໃຊ້
| ຟີວ | ປະເພດ | ຄຳອະທິບາຍ | ໃຊ້ໄດ້ໃນ |
|---|---|---|---|
usage.prompt_tokens | integer | Input tokens. | ທຸກ model |
usage.completion_tokens | integer | Output tokens: reasoning, ຄຳຕອບ ແລະ ການເອີ້ນ tool ລວມກັນ. | ທຸກ model |
usage.total_tokens | integer | prompt_tokens ບວກ completion_tokens. | ທຸກ model |
usage.prompt_tokens_details.cached_tokens | integer | ສ່ວນຂອງ prompt_tokens ທີ່ອ່ານຈາກ prompt cache. | Hosted open-weight models |
usage.completion_tokens_details.reasoning_tokens | integer | ສ່ວນຂອງ completion_tokens ທີ່ໃຊ້ໄປກັບ reasoning. | Hosted open-weight models |
ໃນ hosted open-weight models, prompt_tokens ແມ່ນຂໍ້ຄວາມ ແລະ ຄຳນິຍາມ tool ຂອງທ່ານທີ່ນັບດ້ວຍ tokenizer ຂອງ model ເອງ, ບວກກັບ tokens ຂອງຮູບພາບໃດໆ. endpoint ນັບ tokens ສົ່ງຕົວເລກດຽວກັນກັບຄືນກ່ອນທີ່ທ່ານຈະສົ່ງ. ການນັບ token
ໃນລະດັບ Shannon, prompt_tokens ນັບທຸກຢ່າງທີ່ model ອ່ານເພື່ອຂຽນຄຳຕອບ, ດັ່ງນັ້ນມັນຈຶ່ງໃຫຍ່ກວ່າຂໍ້ຄວາມຂອງທ່ານເພາະຢ່າງດຽວ.
Streaming
ເມື່ອຕັ້ງ stream ເປັນ true ຄຳຕອບຈະມາເປັນ event chat.completion.chunk ແລະ ຈົບດ້ວຍ data: [DONE]. chunk ສຸດທ້າຍກ່ອນມັນມີ finish_reason ແລະ usage; ບໍ່ຕ້ອງການ stream_options. ຮູບຮ່າງຂອງ chunk, ແຖວ keep-alive ແລະ ຂໍ້ຜິດພາດພາຍໃນ stream ມີໜ້າຂອງຕົນເອງ. ສະຕຣີມມິ້ງ
ຂໍ້ຜິດພາດ
ຂໍ້ຜິດພາດແມ່ນ JSON object ທີ່ມີ member error. ການກວດເຮັດຕາມລຳດັບນີ້: API key, body ຂອງຄຳຮ້ອງຂໍ, model id, ແລ້ວຍອດເງິນ. ຕາຕະລາງລະບຸສິ່ງທີ່ endpoint ນີ້ສົ່ງຄືນເລື້ອຍທີ່ສຸດ. ລາຍການທັງໝົດ ພ້ອມສິ່ງທີ່ຄວນລອງໃໝ່ ມີໜ້າຂອງຕົນເອງ. ການຈັດການຂໍ້ຜິດພາດ
{
"error": {
"type": "invalid_request_error",
"message": "unknown model: no-such-model"
}
} | ສະຖານະ | ປະເພດ | ຂໍ້ຄວາມ | ເມື່ອໃດ |
|---|---|---|---|
401 | authentication_error | Missing authenticationInvalid API key | ບໍ່ໄດ້ສົ່ງ API key, ຫຼື key ບໍ່ຮູ້ຈັກ ຫຼື ຖືກຖອນແລ້ວ. |
400 | invalid_request_error | unknown model: <id> | model ບໍ່ແມ່ນ id ທີ່ເຜີຍແຜ່. |
400 | invalid_request_error | No user message provided | Shannon tiers: ຄຳຮ້ອງຂໍບໍ່ມີຂໍ້ຄວາມຂອງ user ແລະ ບໍ່ມີ tools. |
400 | invalid_request_error | <id> does not accept image input | ສົ່ງສ່ວນຮູບພາບໄປຫາ hosted open-weight model ທີ່ບໍ່ຮອງຮັບຮູບພາບເປັນ input. |
400 | invalid_request_error | <id> does not accept response_format | ໄດ້ສົ່ງ response_format ໄປຫາ hosted open-weight model ທີ່ບໍ່ຮອງຮັບ structured output (ຜົນລັບແບບມີໂຄງສ້າງ). |
400 | invalid_request_error | unknown reasoning effort '<value>'; expected off, low, medium or high | reasoning_effort ມີຄ່າທີ່ຢູ່ນອກລາຍການ. |
422 | invalid_request_error | Failed to deserialize the JSON body into the target type: … | ບໍ່ມີ messages, ຫຼື ມີຟີວທີ່ໃຊ້ປະເພດ JSON ຜິດ. |
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | max_tokens ໃຫຍ່ກວ່າຍອດເງິນທີ່ເຫຼືອຂອງທ່ານ. |
429 | rate_limit_error | Too many requests. Retry in <n>s. | Flood protection: ເກີນ 120 ຄຳຮ້ອງຂໍໃນໜຶ່ງນາທີຕໍ່ບັນຊີຂອງທ່ານ. |
500 | server_error | The model backend failed to answer. Please retry. | model ບໍ່ໄດ້ສ້າງຄຳຕອບ. ສົ່ງຄຳຮ້ອງຂໍອີກຄັ້ງ. |
502 | api_error | The model backend failed to answer. Please retry. | ຄືກັນ, ໃນຕະກູນ Shannon 3 ແລະ hosted open-weight models. |