Chat Completions
POST /v1/chat/completions ಒಂದು ಸಂಭಾಷಣೆಯನ್ನು ತೆಗೆದುಕೊಂಡು OpenAI Chat Completions ಫಾರ್ಮ್ಯಾಟ್ನಲ್ಲಿ ಮಾಡೆಲ್ನ ಮುಂದಿನ ಸಂದೇಶವನ್ನು ಹಿಂತಿರುಗಿಸುತ್ತದೆ. ಯಾವುದೇ OpenAI SDK ಯಿಂದ ಅಥವಾ ಸರಳ HTTP ಮೂಲಕ ಬಳಸಿ; ಈ ಪುಟ ಫೀಲ್ಡ್-ಬೈ-ಫೀಲ್ಡ್ ರೆಫರೆನ್ಸ್ ಆಗಿದೆ.
POST https://api.shannon-ai.com/v1/chat/completions
ಅತಿ ಚಿಕ್ಕ ವಿನಂತಿ ಎಂದರೆ ಒಂದು ಮಾಡೆಲ್ id ಮತ್ತು ಒಂದು user ಸಂದೇಶ.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.shannon-ai.com/v1",
)
response = client.chat.completions.create(
model="shannon-3",
messages=[{"role": "user", "content": "Say hello in one sentence."}],
)
print(response.choices[0].message.content) import OpenAI from "openai";
const client = new OpenAI({
apiKey: "YOUR_API_KEY",
baseURL: "https://api.shannon-ai.com/v1",
});
const response = await client.chat.completions.create({
model: "shannon-3",
messages: [{ role: "user", content: "Say hello in one sentence." }],
});
console.log(response.choices[0].message.content); curl https://api.shannon-ai.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "shannon-3",
"messages": [{"role": "user", "content": "Say hello in one sentence."}]
}' ಉತ್ತರ ಒಂದು JSON ಆಬ್ಜೆಕ್ಟ್:
{
"id": "chatcmpl-5f0c1e7a9b3d4c62a8e1f07d2b46c9a3",
"object": "chat.completion",
"created": 1791625200,
"model": "shannon-3",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Hello, it is good to meet you.",
"reasoning_content": "The user wants a greeting in one sentence. Keep it short and friendly."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 1184,
"completion_tokens": 46,
"total_tokens": 1230
}
} ಹೆಡರ್ಗಳು
ವಿನಂತಿ ಹೆಡರ್ಗಳು
| ಹೆಡರ್ | ಮೌಲ್ಯ | ವಿವರಣೆ |
|---|---|---|
Authorization | Bearer YOUR_API_KEY | ನಿಮ್ಮ API ಕೀ. ಪ್ರತಿ ಎಂಡ್ಪಾಯಿಂಟ್ನಲ್ಲಿ ಇದರ ಬದಲು x-api-key: YOUR_API_KEY ಸಹ ಸ್ವೀಕಾರವಾಗುತ್ತದೆ. |
Content-Type | application/json | ಕಡ್ಡಾಯ. ಬೇರೆ ಯಾವುದೇ ಮೌಲ್ಯಕ್ಕೆ 415 ಹಿಂತಿರುಗುತ್ತದೆ. |
x-request-id | ಐಚ್ಛಿಕ. ವಿನಂತಿಗೆ ನಿಮ್ಮದೇ ಆದ id. ಇದು ಉತ್ತರದಲ್ಲಿ ಬದಲಾಗದೆ ಹಿಂತಿರುಗುತ್ತದೆ. |
ಉತ್ತರ ಹೆಡರ್ಗಳು
| ಹೆಡರ್ | ವಿವರಣೆ |
|---|---|
x-request-id | ಪ್ರತಿ ಉತ್ತರದಲ್ಲಿ, ದೋಷಗಳು ಮತ್ತು streams ಸೇರಿದಂತೆ: ನೀವು ಕಳುಹಿಸಿದ ಮೌಲ್ಯ, ಅಥವಾ ಏನನ್ನೂ ಕಳುಹಿಸದಿದ್ದರೆ 12 ಹೆಕ್ಸಾಡೆಸಿಮಲ್ ಅಕ್ಷರಗಳು. ಸಮಸ್ಯೆಯನ್ನು ವರದಿ ಮಾಡುವಾಗ ಇದನ್ನು ಉಲ್ಲೇಖಿಸಿ. |
content-type | application/json, ಅಥವಾ stream true ಆಗಿದ್ದಾಗ text/event-stream. |
ವಿನಂತಿ ಕ್ಷೇತ್ರಗಳು
messages ಮಾತ್ರ ಅಗತ್ಯ. ಅನ್ವಯಿಸುವವರು ಕಾಲಮ್ ಒಂದು ಫೀಲ್ಡ್ ಪ್ರತಿಕ್ರಿಯೆಯನ್ನು ಬದಲಾಯಿಸುವ ಮಾಡೆಲ್ಗಳನ್ನು ಹೆಸರಿಸುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು ಮಾಡೆಲ್ ಪಟ್ಟಿಯ ಹನ್ನೆರಡು id ಗಳು; Shannon 3 ಕುಟುಂಬ ಎಂದರೆ shannon-3, shannon-3-pro, shannon-3.1 ಮತ್ತು shannon-3.1-pro. ಮಾಡೆಲ್ಗಳು ಮತ್ತು ಬೆಲೆ
| ಫೀಲ್ಡ್ | ವಿಧ | ಡಿಫಾಲ್ಟ್ | ವಿವರಣೆ | ಅನ್ವಯಿಸುವವರು |
|---|---|---|---|---|
model | string | shannon-1.6-lite | ಉತ್ತರಿಸುವ ಮಾಡೆಲ್: ಮಾಡೆಲ್ ಪಟ್ಟಿಯಿಂದ ಒಂದು id. ಪ್ರತಿ ವಿನಂತಿಯೊಂದಿಗೆ ಕಳುಹಿಸಿ. ಹೊಂದಾಣಿಕೆಯಲ್ಲಿ ಅಕ್ಷರ ಕೇಸ್ ಮುಖ್ಯವಲ್ಲ. ಪ್ರಕಟಿತವಲ್ಲದ id 400 unknown model ಹಿಂತಿರುಗಿಸುತ್ತದೆ. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು |
messages | array | ಅಗತ್ಯ. ಸಂಭಾಷಣೆ, ಹಳೆಯ ಸಂದೇಶ ಮೊದಲು. ಕೆಳಗಿನ ಸಂದೇಶಗಳು ನೋಡಿ. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು | |
stream | boolean | false | true ಆಗಿದ್ದರೆ ಉತ್ತರವನ್ನು ಬರೆಯುತ್ತಿರುವಾಗಲೇ server-sent events ಆಗಿ ಕಳುಹಿಸಲಾಗುತ್ತದೆ. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು |
max_tokens | integer | 4096 | ಪ್ರತಿಕ್ರಿಯೆಯ ಮೇಲಿನ ಮಿತಿ, ಟೋಕನ್ಗಳಲ್ಲಿ. 1 ರಿಂದ 65,536 ರ ಹೊರಗಿನ ಮೌಲ್ಯವನ್ನು ಆ ವ್ಯಾಪ್ತಿಗೆ ತರಲಾಗುತ್ತದೆ. ವಿನಂತಿ ನಡೆಯುವಾಗ ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಿಂದ ಕಾಯ್ದಿರಿಸುವ ಮೊತ್ತವೂ ಇದೇ. ಕೆಳಗಿನ ಔಟ್ಪುಟ್ ಉದ್ದ ನೋಡಿ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು, shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 |
max_completion_tokens | integer | max_tokens ನಂತೆಯೇ. ಎರಡನ್ನೂ ಕಳುಹಿಸಿದರೆ max_tokens ಬಳಸಲಾಗುತ್ತದೆ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು, shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 | |
temperature | number | ಸ್ಯಾಂಪ್ಲಿಂಗ್ temperature. ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳಲ್ಲಿ ಡೀಫಾಲ್ಟ್ 1 ಮತ್ತು ಮೌಲ್ಯಗಳನ್ನು 0 ರಿಂದ 2 ರ ನಡುವೆ ಇಡಲಾಗುತ್ತದೆ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು, shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 | |
top_p | number | 0.95 | ನ್ಯೂಕ್ಲಿಯಸ್ ಸ್ಯಾಂಪ್ಲಿಂಗ್. ಮೌಲ್ಯಗಳನ್ನು 0 ರಿಂದ 1 ರ ನಡುವೆ ಇಡಲಾಗುತ್ತದೆ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು |
seed | integer | ಸ್ಯಾಂಪ್ಲರ್ನ seed, ಯಾವುದೇ ಪೂರ್ಣಾಂಕ. ಇದನ್ನು ನೀಡದಿದ್ದರೆ, seed ಅನ್ನು ಮಾಡೆಲ್ ಮತ್ತು ಸಂಭಾಷಣೆಯಿಂದ ಪಡೆಯಲಾಗುತ್ತದೆ, ಆದ್ದರಿಂದ ಒಂದೇ ವಿನಂತಿಯನ್ನು ಎರಡು ಬಾರಿ ಕಳುಹಿಸಿದರೆ ಒಂದೇ seed ಬಳಕೆಯಾಗುತ್ತದೆ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು | |
stop | string | array | ಒಂದು string ಅಥವಾ strings ಗಳ array. ಗರಿಷ್ಠ 4 ಬಳಕೆಯಾಗುತ್ತವೆ. ಮೊದಲು ಕಾಣಿಸಿಕೊಳ್ಳುವ ಒಂದರ ಮೊದಲೇ ಉತ್ತರ ಕೊನೆಗೊಳ್ಳುತ್ತದೆ; stop ಪಠ್ಯವನ್ನು ಹಿಂತಿರುಗಿಸಲಾಗುವುದಿಲ್ಲ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು | |
reasoning_effort | string | high | ಉತ್ತರಿಸುವ ಮೊದಲು ಮಾಡೆಲ್ ಎಷ್ಟು ರೀಸನಿಂಗ್ ಮಾಡುತ್ತದೆ: off, low, medium ಅಥವಾ high. none ಮತ್ತು minimal ಎಂದರೆ off, default ಎಂದರೆ medium, max ಎಂದರೆ high. ಬೇರೆ ಯಾವುದೇ ಮೌಲ್ಯಕ್ಕೆ 400 ಹಿಂತಿರುಗುತ್ತದೆ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು |
reasoning | object | ಅದೇ ಸೆಟ್ಟಿಂಗ್ ಆಬ್ಜೆಕ್ಟ್ ರೂಪದಲ್ಲಿ: {"effort": "low"}. ಎರಡನ್ನೂ ಕಳುಹಿಸಿದರೆ reasoning_effort ಬಳಸಲಾಗುತ್ತದೆ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು | |
tools | array | ಮಾಡೆಲ್ ಕರೆಯಬಹುದಾದ ಫಂಕ್ಷನ್ಗಳು, ಪ್ರತಿಯೊಂದೂ {"type": "function", "function": {"name", "description", "parameters"}} ರೂಪದಲ್ಲಿ. ಮಾಡೆಲ್ನ ಕರೆಗಳು tool_calls ನಲ್ಲಿ ಬರುತ್ತವೆ; ಅವನ್ನು ನಿಮ್ಮ ಕೋಡ್ ಚಲಾಯಿಸುತ್ತದೆ. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು | |
tool_choice | string | object | auto | "auto" ಮಾಡೆಲ್ಗೆ ನಿರ್ಧರಿಸಲು ಬಿಡುತ್ತದೆ. "required" ಅದು ಒಂದು ಟೂಲ್ ಅನ್ನು ಕರೆಯುವಂತೆ ಮಾಡುತ್ತದೆ. {"type": "function", "function": {"name": "…"}} ಆ ನಿರ್ದಿಷ್ಟ ಟೂಲ್ ಅನ್ನು ಕರೆಯುವಂತೆ ಮಾಡುತ್ತದೆ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು |
response_format | object | JSON ಉತ್ತರಕ್ಕಾಗಿ {"type": "json_object"}, ಅಥವಾ ನಿಮ್ಮ schema ಅನ್ನು ಅನುಸರಿಸುವ ಉತ್ತರಕ್ಕಾಗಿ {"type": "json_schema", "json_schema": {…}}. | ಎಲ್ಲ Shannon ಹಂತಗಳು; ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು ಪ್ರತಿ id ಗೆ ಪಟ್ಟಿ ಮಾಡಿದಂತೆ | |
web_search | boolean | false | true ಆಗಿದ್ದರೆ ಮಾಡೆಲ್ ಉತ್ತರಿಸುವ ಮೊದಲು ವೆಬ್ನಲ್ಲಿ ಹುಡುಕಬಹುದು. | shannon-1.6-*, shannon-2-*, Shannon 3 ಕುಟುಂಬ |
n, user, stream_options, parallel_tool_calls, presence_penalty, frequency_penalty, logit_bias, logprobs, metadata, store ಮತ್ತು prompt_cache_key ನಂತಹ ಇತರ OpenAI ಫೀಲ್ಡ್ಗಳನ್ನು ಸ್ವೀಕರಿಸಲಾಗುತ್ತದೆ, ಇದರಿಂದ ಈಗಿರುವ ಕ್ಲೈಂಟ್ ಕೋಡ್ ಬದಲಾವಣೆಯಿಲ್ಲದೆ ಓಡುತ್ತದೆ. ಅವು ಪ್ರತಿಕ್ರಿಯೆಯನ್ನು ಬದಲಾಯಿಸುವುದಿಲ್ಲ: ಯಾವಾಗಲೂ ಒಂದೇ choice ಇರುತ್ತದೆ, ಮತ್ತು ಸ್ಟ್ರೀಮ್ ಯಾವಾಗಲೂ ಬಳಕೆಯೊಂದಿಗೆ ಕೊನೆಗೊಳ್ಳುತ್ತದೆ.
ತಪ್ಪಾದ JSON ಪ್ರಕಾರದ ಫೀಲ್ಡ್, ಉದಾಹರಣೆಗೆ "max_tokens": "100", 422 ಹಿಂತಿರುಗಿಸುತ್ತದೆ. messages ಇಲ್ಲದ ವಿನಂತಿಗೂ ಇದೇ ಆಗುತ್ತದೆ.
ಟೂಲ್ಗಳು, ರಚಿತ ಔಟ್ಪುಟ್, ರೀಸನಿಂಗ್ ಮತ್ತು ವೆಬ್ ಹುಡುಕಾಟ ಪ್ರತಿಯೊಂದಕ್ಕೂ ತನ್ನದೇ ಪುಟವಿದೆ: ಫಂಕ್ಷನ್ ಕಾಲಿಂಗ್, ರಚಿತ ಔಟ್ಪುಟ್ಗಳು, ರೀಸನಿಂಗ್ ಪ್ರಯತ್ನ, ಒಳನಿರ್ಮಿತ ವೆಬ್ ಹುಡುಕಾಟ.
ಆಯ್ಕೆಗಳೊಂದಿಗೆ ವಿನಂತಿ
ಈ ವಿನಂತಿ system ಸಂದೇಶ, ಸ್ಯಾಂಪ್ಲಿಂಗ್ ಫೀಲ್ಡ್ಗಳು ಮತ್ತು ರೀಸನಿಂಗ್ effort ಅನ್ನು ಹೊಂದಿಸುತ್ತದೆ. ಇದು ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ ಅನ್ನು ಬಳಸುತ್ತದೆ, ಅದು ಇವೆಲ್ಲವನ್ನೂ ಅನ್ವಯಿಸುತ್ತದೆ.
from openai import OpenAI
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://api.shannon-ai.com/v1",
)
response = client.chat.completions.create(
model="DeepSeek-V4-Flash-0731-W4A16-AUTOROUND-REAP",
messages=[
{"role": "system", "content": "You are a physics teacher. Answer in two sentences."},
{"role": "user", "content": "Why is the sky blue?"},
],
max_tokens=512,
temperature=0.3,
top_p=0.9,
seed=7,
stop=["\n\n"],
reasoning_effort="low",
)
message = response.choices[0].message
print(message.reasoning_content) # the reasoning
print(message.content) # the answer
print(response.usage) import OpenAI from "openai";
const client = new OpenAI({
apiKey: "YOUR_API_KEY",
baseURL: "https://api.shannon-ai.com/v1",
});
const response = await client.chat.completions.create({
model: "DeepSeek-V4-Flash-0731-W4A16-AUTOROUND-REAP",
messages: [
{ role: "system", content: "You are a physics teacher. Answer in two sentences." },
{ role: "user", content: "Why is the sky blue?" },
],
max_tokens: 512,
temperature: 0.3,
top_p: 0.9,
seed: 7,
stop: ["\n\n"],
reasoning_effort: "low",
});
const message = response.choices[0].message;
console.log(message.reasoning_content); // the reasoning
console.log(message.content); // the answer
console.log(response.usage); curl https://api.shannon-ai.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "DeepSeek-V4-Flash-0731-W4A16-AUTOROUND-REAP",
"messages": [
{"role": "system", "content": "You are a physics teacher. Answer in two sentences."},
{"role": "user", "content": "Why is the sky blue?"}
],
"max_tokens": 512,
"temperature": 0.3,
"top_p": 0.9,
"seed": 7,
"stop": ["\n\n"],
"reasoning_effort": "low"
}' ಉತ್ತರವು ಮೇಲಿನಂತೆಯೇ ರೂಪ ಹೊಂದಿದೆ. ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳಲ್ಲಿ ಅದರ usage ಎರಡು ವಿವರಗಳನ್ನು ಸೇರಿಸುತ್ತದೆ: ಕ್ಯಾಶ್ನಿಂದ ಓದಿದ ಪ್ರಾಂಪ್ಟ್ ಟೋಕನ್ಗಳು ಮತ್ತು ರೀಸನಿಂಗ್ಗೆ ಖರ್ಚಾದ ಟೋಕನ್ಗಳು.
{
"usage": {
"prompt_tokens": 31,
"completion_tokens": 62,
"total_tokens": 93,
"prompt_tokens_details": {
"cached_tokens": 0
},
"completion_tokens_details": {
"reasoning_tokens": 21
}
}
} ಔಟ್ಪುಟ್ ಉದ್ದ
max_tokens ಎರಡು ಕೆಲಸ ಮಾಡುತ್ತದೆ. ಮೊದಲನೆಯದಾಗಿ, ವಿನಂತಿ ಆರಂಭವಾದಾಗ ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಿಂದ ಮೀಸಲಿಡುವ ಟೋಕನ್ಗಳ ಸಂಖ್ಯೆ ಇದು. ಉತ್ತರ ಪೂರ್ಣಗೊಂಡಾಗ, ಆ ಮೊತ್ತವನ್ನು ವಿನಂತಿ ಬಳಸಿದ ಟೋಕನ್ಗಳಿಂದ ಬದಲಾಯಿಸಲಾಗುತ್ತದೆ. max_tokens ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಲ್ಲಿ ಉಳಿದಿರುವುದಕ್ಕಿಂತ ದೊಡ್ಡದಾಗಿದ್ದರೆ, ಉತ್ತರವೇ ಹೊಂದಿಕೊಳ್ಳುತ್ತಿದ್ದರೂ ವಿನಂತಿಗೆ 429 Quota exceeded ಹಿಂತಿರುಗುತ್ತದೆ. ಕಡಿಮೆ ಮೀಸಲಿಡಲು ಕಡಿಮೆ max_tokens ಕಳುಹಿಸಿ.
ಈ ಎಂಡ್ಪಾಯಿಂಟ್ನಲ್ಲಿ shannon-coder-1 ಅನ್ನು ಬೇರೆ ರೀತಿ ಎಣಿಸಲಾಗುತ್ತದೆ: ಪ್ರತಿ ವಿನಂತಿ ನಿಮ್ಮ ಪ್ಲ್ಯಾನ್ನ ಒಂದು Shannon Coder ಕರೆಯಾಗಿದೆ, ಮತ್ತು ಅದಕ್ಕಾಗಿ ಯಾವುದೇ ಟೋಕನ್ಗಳನ್ನು ಮೀಸಲಿಡಲಾಗುವುದಿಲ್ಲ. ಮಿತಿಗಳು ಮತ್ತು ಬ್ಯಾಲೆನ್ಸ್
ಎರಡನೆಯದಾಗಿ, ಈ ಮಾಡೆಲ್ಗಳಲ್ಲಿ ಇದು ಉತ್ತರದ ಉದ್ದವನ್ನು ಮಿತಿಗೊಳಿಸುತ್ತದೆ:
| ಮಾಡೆಲ್ಗಳು | max_tokens ಏನು ಮಾಡುತ್ತದೆ |
|---|---|
shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 | ಮಿತಿ ತಲುಪಿದಾಗ ಉತ್ತರ ನಿಲ್ಲುತ್ತದೆ. ಆಗ stream finish_reason length ನೊಂದಿಗೆ ಕೊನೆಗೊಳ್ಳುತ್ತದೆ. |
| ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು | ಉತ್ತರ ಪಠ್ಯ max_tokens ನಲ್ಲಿ ನಿಲ್ಲುತ್ತದೆ. ರೀಸನಿಂಗ್ ಅದರ ವಿರುದ್ಧ ಎಣಿಕೆಯಾಗುವುದಿಲ್ಲ. 256 ಕ್ಕಿಂತ ಕಡಿಮೆ ಮೌಲ್ಯಗಳು 256 ಆಗಿ ವರ್ತಿಸುತ್ತವೆ. |
max_tokens ಅಥವಾ max_completion_tokens ಇಲ್ಲದಿದ್ದರೆ, ಮೌಲ್ಯ 4,096. shannon-coder-1 ನಲ್ಲಿ ಅದು 65,536.
ಸಂದೇಶಗಳು
ಪ್ರತಿ ಸಂದೇಶವು role ಮತ್ತು content ಹೊಂದಿರುವ ಆಬ್ಜೆಕ್ಟ್ ಆಗಿದೆ. content ಒಂದು string, ಅಥವಾ ಸಂದೇಶವು ಪಠ್ಯಕ್ಕಿಂತ ಹೆಚ್ಚನ್ನು ಹೊತ್ತಿರುವಾಗ ಭಾಗಗಳ array ಆಗಿರುತ್ತದೆ.
| ಪಾತ್ರ | ವಿವರಣೆ | ಅನ್ವಯಿಸುವವರು |
|---|---|---|
system | ಮಾಡೆಲ್ಗೆ ಸೂಚನೆಗಳು. ಇದನ್ನು ಮೊದಲಿಗೆ ಇಡಿ. Shannon ಟಿಯರ್ಗಳಲ್ಲಿ ಮೊದಲ system ಸಂದೇಶವೇ ಬಳಕೆಯಾಗುತ್ತದೆ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು, shannon-1.6-*, shannon-2-*, shannon-coder-1 |
developer | system ಎಂದು ಓದಲಾಗುತ್ತದೆ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು |
user | ನೀವು ಕೇಳುವುದು. Shannon ಟಿಯರ್ಗಳಲ್ಲಿ ಕೊನೆಯ user ಸಂದೇಶವೇ ಪ್ರಾಂಪ್ಟ್, ಅದರ ಮೊದಲಿನ ಸಂದೇಶಗಳು ಇತಿಹಾಸ. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು |
assistant | ಮಾಡೆಲ್ನ ಹಿಂದಿನ ಉತ್ತರಗಳು. ಇದರ ನಂತರ ಟೂಲ್ ಫಲಿತಾಂಶವನ್ನು ಕಳುಹಿಸುವಾಗ ಅದರ tool_calls ಅನ್ನು ಉಳಿಸಿಕೊಳ್ಳಿ. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು |
tool | ಟೂಲ್ ಕರೆಯ ಫಲಿತಾಂಶ: tool_call_id ಕರೆಯ id ಯನ್ನು ಮತ್ತು content ಫಲಿತಾಂಶವನ್ನು string ಆಗಿ ಹೊಂದಿರುತ್ತದೆ. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು |
Shannon 3 ಕುಟುಂಬದ id ಯೊಂದಿಗೆ, ಪಾಲಿಸಲೇಬೇಕಾದ ಸೂಚನೆಗಳನ್ನು user ಸಂದೇಶದಲ್ಲಿ ಇಡಿ.
Shannon ಟಿಯರ್ಗಳಲ್ಲಿ user ಪಠ್ಯವೂ tools ಸಹ ಇಲ್ಲದ ವಿನಂತಿಗೆ 400 No user message provided ಹಿಂತಿರುಗುತ್ತದೆ.
ವಿಷಯ ಭಾಗಗಳು
| ಭಾಗ | ವಿವರಣೆ | ಲಭ್ಯವಿರುವುದು |
|---|---|---|
{"type": "text", "text": "…"} | ಸರಳ ಪಠ್ಯ. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು |
{"type": "image_url", "image_url": {"url": "…"}} | ಒಂದು ಚಿತ್ರ, base64 ವಿಷಯವಿರುವ data: URL ಆಗಿ ಅಥವಾ http(s) URL ಆಗಿ. | Shannon 3 ಕುಟುಂಬ, shannon-1.6-lite, shannon-1.6-pro, ಮತ್ತು ಚಿತ್ರ ಇನ್ಪುಟ್ ಪಟ್ಟಿ ಮಾಡಿರುವ ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು |
{"type": "file", "source": {"type": "base64", "media_type": "application/pdf", "data": "…"}} | ಒಂದು ಡಾಕ್ಯುಮೆಂಟ್ (PDF, Word, PowerPoint ಅಥವಾ Excel), base64 ಆಗಿ ಅಥವಾ URL ಮೂಲಕ. | Shannon 3 ಕುಟುಂಬ |
ಗಾತ್ರಗಳು, ಮಿತಿಗಳು ಮತ್ತು ರೂಪಗಳ ಪೂರ್ಣ ಪಟ್ಟಿಗೆ ತನ್ನದೇ ಪುಟವಿದೆ. ಚಿತ್ರಗಳು ಮತ್ತು ಫೈಲ್ಗಳು
ಉತ್ತರ ಆಬ್ಜೆಕ್ಟ್
| ಫೀಲ್ಡ್ | ವಿಧ | ವಿವರಣೆ |
|---|---|---|
id | string | chatcmpl- ನಂತರ 32 ಹೆಕ್ಸಾಡೆಸಿಮಲ್ ಅಕ್ಷರಗಳು. |
object | string | ಯಾವಾಗಲೂ chat.completion. |
created | integer | ಉತ್ತರದ ಸಮಯ, Unix ಸೆಕೆಂಡ್ಗಳಲ್ಲಿ. |
model | string | ಉತ್ತರಿಸಿದ ಮಾಡೆಲ್ನ ಅಧಿಕೃತ id. ನೀವು ಕಳುಹಿಸಿದ id ಗಿಂತ ಕಾಗುಣಿತದಲ್ಲಿ ಭಿನ್ನವಾಗಿರಬಹುದು. |
choices | array | ಯಾವಾಗಲೂ ನಿಖರವಾಗಿ ಒಂದು choice, index 0 ಯೊಂದಿಗೆ. |
choices[0].message.role | string | ಯಾವಾಗಲೂ assistant. |
choices[0].message.content | string | null | ಉತ್ತರ ಪಠ್ಯ. tool_calls ಇದ್ದಾಗ Shannon ಟಿಯರ್ಗಳಲ್ಲಿ ಇದು null; ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು ಕರೆಗಳ ಜೊತೆಗೆ ಪಠ್ಯವನ್ನೂ ಕಳುಹಿಸಬಹುದು. |
choices[0].message.reasoning_content | string | null | ಉತ್ತರದ ಮೊದಲು ಮಾಡೆಲ್ ಬರೆದ ರೀಸನಿಂಗ್, ಅಥವಾ ಯಾವುದೂ ಇಲ್ಲದಿದ್ದರೆ null. |
choices[0].message.tool_calls | array | ಮಾಡೆಲ್ ಟೂಲ್ಗಳನ್ನು ಕರೆದಾಗ ಮಾತ್ರ ಇರುತ್ತದೆ. ಪ್ರತಿ ನಮೂದು id, type function, ಮತ್ತು name ಹಾಗೂ JSON string ಆಗಿರುವ arguments ಹೊಂದಿರುವ function ಹೊಂದಿದೆ. |
choices[0].message.annotations | array | ಹುಡುಕಾಟ ಏನನ್ನಾದರೂ ಕಂಡ web_search: true ವಿನಂತಿಯಲ್ಲಿ ಮಾತ್ರ. content ನಲ್ಲಿನ ಗುರುತು ಹೆಸರಿಸುವ ಪ್ರತಿ ಮೂಲಕ್ಕೆ ಒಂದು url_citation, url, title, start_index ಮತ್ತು end_index ಜೊತೆಗೆ (ಗುರುತಿನ ಸ್ಥಾನ, ಅಕ್ಷರಗಳಲ್ಲಿ ಎಣಿಸಿದ್ದು, ಕೊನೆ ಸೇರಿಲ್ಲ). |
choices[0].finish_reason | string | ಉತ್ತರ ಏಕೆ ಕೊನೆಗೊಂಡಿತು. ಮುಕ್ತಾಯದ ಕಾರಣಗಳನ್ನು ನೋಡಿ. |
usage | object | ವಿನಂತಿಯ ಟೋಕನ್ಗಳು. ಬಳಕೆಯನ್ನು ನೋಡಿ. |
sources | array | ಹುಡುಕಾಟ ಏನನ್ನಾದರೂ ಕಂಡ web_search: true ವಿನಂತಿಯಲ್ಲಿ ಮಾತ್ರ: ಮಾಡೆಲ್ಗೆ ನೀಡಿದ ಫಲಿತಾಂಶಗಳು, ಪ್ರತಿಯೊಂದೂ index, title ಮತ್ತು url ಜೊತೆಗೆ. ಉತ್ತರದಲ್ಲಿನ [1] ಎಂದರೆ index 1 ಇರುವ ಎಂಟ್ರಿ. |
ಮುಕ್ತಾಯದ ಕಾರಣಗಳು
| finish_reason | ವಿವರಣೆ |
|---|---|
stop | ಮಾಡೆಲ್ ತನ್ನ ಉತ್ತರವನ್ನು ಮುಗಿಸಿತು, ಅಥವಾ stop string ಕಾಣಿಸಿಕೊಂಡಿತು. |
tool_calls | ಮಾಡೆಲ್ ಒಂದು ಅಥವಾ ಹೆಚ್ಚು ಟೂಲ್ಗಳನ್ನು ಕರೆಯುತ್ತದೆ. ಅವನ್ನು ಚಲಾಯಿಸಿ ಫಲಿತಾಂಶಗಳನ್ನು tool ಸಂದೇಶಗಳಲ್ಲಿ ಕಳುಹಿಸಿ. |
length | ಔಟ್ಪುಟ್ ಮಿತಿಯಲ್ಲಿ ಉತ್ತರ ಕತ್ತರಿಸಲ್ಪಟ್ಟಿತು. shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 ಮತ್ತು Shannon 3 ಕುಟುಂಬದ streams ಗಳಲ್ಲಿ ವರದಿಯಾಗುತ್ತದೆ. |
stream ಮಾಡದ ಉತ್ತರವು stop ಅಥವಾ tool_calls ಎಂದು ವರದಿ ಮಾಡುತ್ತದೆ.
ಬಳಕೆ
| ಫೀಲ್ಡ್ | ವಿಧ | ವಿವರಣೆ | ಲಭ್ಯವಿರುವುದು |
|---|---|---|---|
usage.prompt_tokens | integer | ಇನ್ಪುಟ್ ಟೋಕನ್ಗಳು. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು |
usage.completion_tokens | integer | ಔಟ್ಪುಟ್ ಟೋಕನ್ಗಳು: ರೀಸನಿಂಗ್, ಉತ್ತರ ಮತ್ತು ಟೂಲ್ ಕರೆಗಳು ಒಟ್ಟಾಗಿ. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು |
usage.total_tokens | integer | prompt_tokens ಜೊತೆಗೆ completion_tokens. | ಎಲ್ಲ ಮಾಡೆಲ್ಗಳು |
usage.prompt_tokens_details.cached_tokens | integer | ಪ್ರಾಂಪ್ಟ್ ಕ್ಯಾಶ್ನಿಂದ ಓದಿದ prompt_tokens ನ ಭಾಗ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು |
usage.completion_tokens_details.reasoning_tokens | integer | ರೀಸನಿಂಗ್ಗೆ ಖರ್ಚಾದ completion_tokens ನ ಭಾಗ. | ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳು |
ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳಲ್ಲಿ, prompt_tokens ಎಂದರೆ ನಿಮ್ಮ ಸಂದೇಶಗಳು ಮತ್ತು ಟೂಲ್ ವ್ಯಾಖ್ಯಾನಗಳನ್ನು ಮಾಡೆಲ್ನ ಸ್ವಂತ tokenizer ನಿಂದ ಎಣಿಸಿದ್ದು, ಜೊತೆಗೆ ಯಾವುದೇ ಚಿತ್ರಗಳ ಟೋಕನ್ಗಳು. ಟೋಕನ್ ಎಣಿಕೆ ಎಂಡ್ಪಾಯಿಂಟ್ಗಳು ನೀವು ಕಳುಹಿಸುವ ಮೊದಲೇ ಅದೇ ಸಂಖ್ಯೆಯನ್ನು ಹಿಂತಿರುಗಿಸುತ್ತವೆ. ಟೋಕನ್ ಎಣಿಕೆ
Shannon ಟಿಯರ್ಗಳಲ್ಲಿ, prompt_tokens ಉತ್ತರ ಬರೆಯಲು ಮಾಡೆಲ್ ಓದಿದ ಎಲ್ಲವನ್ನೂ ಎಣಿಸುತ್ತದೆ, ಆದ್ದರಿಂದ ಅದು ನಿಮ್ಮ ಸಂದೇಶಗಳ ಪಠ್ಯಕ್ಕಿಂತ ದೊಡ್ಡದಾಗಿರುತ್ತದೆ.
ಸ್ಟ್ರೀಮಿಂಗ್
stream ಅನ್ನು true ಗೆ ಹೊಂದಿಸಿದರೆ ಉತ್ತರ chat.completion.chunk ಈವೆಂಟ್ಗಳಾಗಿ ಬರುತ್ತದೆ ಮತ್ತು data: [DONE] ನೊಂದಿಗೆ ಕೊನೆಗೊಳ್ಳುತ್ತದೆ. ಅದರ ಮೊದಲಿನ ಕೊನೆಯ chunk finish_reason ಮತ್ತು usage ಅನ್ನು ಹೊತ್ತಿರುತ್ತದೆ; stream_options ಬೇಕಿಲ್ಲ. chunk ರೂಪಗಳು, keep-alive ಸಾಲುಗಳು ಮತ್ತು stream ಒಳಗಿನ ದೋಷಗಳಿಗೆ ತನ್ನದೇ ಪುಟವಿದೆ. ಸ್ಟ್ರೀಮಿಂಗ್
ದೋಷಗಳು
ದೋಷ ಎಂದರೆ error ಸದಸ್ಯ ಇರುವ JSON ಆಬ್ಜೆಕ್ಟ್. ಪರಿಶೀಲನೆಗಳು ಈ ಕ್ರಮದಲ್ಲಿ ನಡೆಯುತ್ತವೆ: API ಕೀ, ವಿನಂತಿ ಬಾಡಿ, ಮಾಡೆಲ್ id, ನಂತರ ಬ್ಯಾಲೆನ್ಸ್. ಈ ಎಂಡ್ಪಾಯಿಂಟ್ ಹೆಚ್ಚಾಗಿ ಹಿಂತಿರುಗಿಸುವುದನ್ನು ಕೋಷ್ಟಕ ಪಟ್ಟಿ ಮಾಡುತ್ತದೆ. ಯಾವುದನ್ನು ಮರುಪ್ರಯತ್ನಿಸಬೇಕು ಎಂಬುದರೊಂದಿಗೆ ಪೂರ್ಣ ಪಟ್ಟಿಗೆ ತನ್ನದೇ ಪುಟವಿದೆ. ದೋಷ ನಿರ್ವಹಣೆ
{
"error": {
"type": "invalid_request_error",
"message": "unknown model: no-such-model"
}
} | ಸ್ಥಿತಿ | ವಿಧ | ಸಂದೇಶ | ಯಾವಾಗ |
|---|---|---|---|
401 | authentication_error | Missing authenticationInvalid API key | API ಕೀ ಕಳುಹಿಸಿಲ್ಲ, ಅಥವಾ ಕೀ ಅಪರಿಚಿತ ಅಥವಾ ಹಿಂಪಡೆಯಲಾಗಿದೆ. |
400 | invalid_request_error | unknown model: <id> | model ಪ್ರಕಟಿತ id ಅಲ್ಲ. |
400 | invalid_request_error | No user message provided | Shannon ಹಂತಗಳು: ವಿನಂತಿಯಲ್ಲಿ ಬಳಕೆದಾರರ ಪಠ್ಯವಿಲ್ಲ ಮತ್ತು tools ಇಲ್ಲ. |
400 | invalid_request_error | <id> does not accept image input | ಚಿತ್ರ ಇನ್ಪುಟ್ ಇಲ್ಲದ ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗೆ ಚಿತ್ರ ಭಾಗ ಕಳುಹಿಸಲಾಗಿದೆ. |
400 | invalid_request_error | <id> does not accept response_format | ರಚಿತ ಔಟ್ಪುಟ್ ಇಲ್ಲದ ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗೆ response_format ಕಳುಹಿಸಲಾಗಿದೆ. |
400 | invalid_request_error | unknown reasoning effort '<value>'; expected off, low, medium or high | reasoning_effort ಪಟ್ಟಿಯ ಹೊರಗಿನ ಮೌಲ್ಯವನ್ನು ಹೊಂದಿದೆ. |
422 | invalid_request_error | Failed to deserialize the JSON body into the target type: … | messages ಇಲ್ಲ, ಅಥವಾ ಒಂದು ಫೀಲ್ಡ್ನ JSON ವಿಧ ತಪ್ಪಾಗಿದೆ. |
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | max_tokens ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್ನಲ್ಲಿ ಉಳಿದಿರುವುದಕ್ಕಿಂತ ದೊಡ್ಡದಾಗಿದೆ. |
429 | rate_limit_error | Too many requests. Retry in <n>s. | ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್: ನಿಮ್ಮ ಖಾತೆಯಲ್ಲಿ ಒಂದು ನಿಮಿಷದಲ್ಲಿ 120 ಕ್ಕಿಂತ ಹೆಚ್ಚು ವಿನಂತಿಗಳು. |
500 | server_error | The model backend failed to answer. Please retry. | ಮಾಡೆಲ್ ಪ್ರತಿಕ್ರಿಯೆ ನೀಡಲಿಲ್ಲ. ವಿನಂತಿಯನ್ನು ಮತ್ತೆ ಕಳುಹಿಸಿ. |
502 | api_error | The model backend failed to answer. Please retry. | Shannon 3 ಕುಟುಂಬ ಮತ್ತು ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ಗಳಲ್ಲಿ ಅದೇ. |