ವಿಷಯಕ್ಕೆ ಹೋಗಿ
Chat Completions

Chat Completions

POST /v1/chat/completions ಒಂದು ಸಂಭಾಷಣೆಯನ್ನು ತೆಗೆದುಕೊಂಡು OpenAI Chat Completions ಫಾರ್ಮ್ಯಾಟ್‌ನಲ್ಲಿ ಮಾಡೆಲ್‌ನ ಮುಂದಿನ ಸಂದೇಶವನ್ನು ಹಿಂತಿರುಗಿಸುತ್ತದೆ. ಯಾವುದೇ OpenAI SDK ಯಿಂದ ಅಥವಾ ಸರಳ HTTP ಮೂಲಕ ಬಳಸಿ; ಈ ಪುಟ ಫೀಲ್ಡ್-ಬೈ-ಫೀಲ್ಡ್ ರೆಫರೆನ್ಸ್ ಆಗಿದೆ.

POST https://api.shannon-ai.com/v1/chat/completions

ಅತಿ ಚಿಕ್ಕ ವಿನಂತಿ ಎಂದರೆ ಒಂದು ಮಾಡೆಲ್ id ಮತ್ತು ಒಂದು user ಸಂದೇಶ.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.shannon-ai.com/v1",
)

response = client.chat.completions.create(
    model="shannon-3",
    messages=[{"role": "user", "content": "Say hello in one sentence."}],
)

print(response.choices[0].message.content)

ಉತ್ತರ ಒಂದು JSON ಆಬ್ಜೆಕ್ಟ್:

200 JSON
{
  "id": "chatcmpl-5f0c1e7a9b3d4c62a8e1f07d2b46c9a3",
  "object": "chat.completion",
  "created": 1791625200,
  "model": "shannon-3",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "Hello, it is good to meet you.",
        "reasoning_content": "The user wants a greeting in one sentence. Keep it short and friendly."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 1184,
    "completion_tokens": 46,
    "total_tokens": 1230
  }
}

ಹೆಡರ್‌ಗಳು

ವಿನಂತಿ ಹೆಡರ್‌ಗಳು

ಹೆಡರ್ ಮೌಲ್ಯ ವಿವರಣೆ
Authorization Bearer YOUR_API_KEY ನಿಮ್ಮ API ಕೀ. ಪ್ರತಿ ಎಂಡ್‌ಪಾಯಿಂಟ್‌ನಲ್ಲಿ ಇದರ ಬದಲು x-api-key: YOUR_API_KEY ಸಹ ಸ್ವೀಕಾರವಾಗುತ್ತದೆ.
Content-Type application/json ಕಡ್ಡಾಯ. ಬೇರೆ ಯಾವುದೇ ಮೌಲ್ಯಕ್ಕೆ 415 ಹಿಂತಿರುಗುತ್ತದೆ.
x-request-id ಐಚ್ಛಿಕ. ವಿನಂತಿಗೆ ನಿಮ್ಮದೇ ಆದ id. ಇದು ಉತ್ತರದಲ್ಲಿ ಬದಲಾಗದೆ ಹಿಂತಿರುಗುತ್ತದೆ.

ಉತ್ತರ ಹೆಡರ್‌ಗಳು

ಹೆಡರ್ ವಿವರಣೆ
x-request-id ಪ್ರತಿ ಉತ್ತರದಲ್ಲಿ, ದೋಷಗಳು ಮತ್ತು streams ಸೇರಿದಂತೆ: ನೀವು ಕಳುಹಿಸಿದ ಮೌಲ್ಯ, ಅಥವಾ ಏನನ್ನೂ ಕಳುಹಿಸದಿದ್ದರೆ 12 ಹೆಕ್ಸಾಡೆಸಿಮಲ್ ಅಕ್ಷರಗಳು. ಸಮಸ್ಯೆಯನ್ನು ವರದಿ ಮಾಡುವಾಗ ಇದನ್ನು ಉಲ್ಲೇಖಿಸಿ.
content-type application/json, ಅಥವಾ stream true ಆಗಿದ್ದಾಗ text/event-stream.

ವಿನಂತಿ ಕ್ಷೇತ್ರಗಳು

messages ಮಾತ್ರ ಅಗತ್ಯ. ಅನ್ವಯಿಸುವವರು ಕಾಲಮ್ ಒಂದು ಫೀಲ್ಡ್ ಪ್ರತಿಕ್ರಿಯೆಯನ್ನು ಬದಲಾಯಿಸುವ ಮಾಡೆಲ್‌ಗಳನ್ನು ಹೆಸರಿಸುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು ಮಾಡೆಲ್ ಪಟ್ಟಿಯ ಹನ್ನೆರಡು id ಗಳು; Shannon 3 ಕುಟುಂಬ ಎಂದರೆ shannon-3, shannon-3-pro, shannon-3.1 ಮತ್ತು shannon-3.1-pro. ಮಾಡೆಲ್‌ಗಳು ಮತ್ತು ಬೆಲೆ

ಫೀಲ್ಡ್ ವಿಧ ಡಿಫಾಲ್ಟ್ ವಿವರಣೆ ಅನ್ವಯಿಸುವವರು
model string shannon-1.6-lite ಉತ್ತರಿಸುವ ಮಾಡೆಲ್: ಮಾಡೆಲ್ ಪಟ್ಟಿಯಿಂದ ಒಂದು id. ಪ್ರತಿ ವಿನಂತಿಯೊಂದಿಗೆ ಕಳುಹಿಸಿ. ಹೊಂದಾಣಿಕೆಯಲ್ಲಿ ಅಕ್ಷರ ಕೇಸ್ ಮುಖ್ಯವಲ್ಲ. ಪ್ರಕಟಿತವಲ್ಲದ id 400 unknown model ಹಿಂತಿರುಗಿಸುತ್ತದೆ. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು
messages array ಅಗತ್ಯ. ಸಂಭಾಷಣೆ, ಹಳೆಯ ಸಂದೇಶ ಮೊದಲು. ಕೆಳಗಿನ ಸಂದೇಶಗಳು ನೋಡಿ. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು
stream boolean false true ಆಗಿದ್ದರೆ ಉತ್ತರವನ್ನು ಬರೆಯುತ್ತಿರುವಾಗಲೇ server-sent events ಆಗಿ ಕಳುಹಿಸಲಾಗುತ್ತದೆ. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು
max_tokens integer 4096 ಪ್ರತಿಕ್ರಿಯೆಯ ಮೇಲಿನ ಮಿತಿ, ಟೋಕನ್‌ಗಳಲ್ಲಿ. 1 ರಿಂದ 65,536 ರ ಹೊರಗಿನ ಮೌಲ್ಯವನ್ನು ಆ ವ್ಯಾಪ್ತಿಗೆ ತರಲಾಗುತ್ತದೆ. ವಿನಂತಿ ನಡೆಯುವಾಗ ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಿಂದ ಕಾಯ್ದಿರಿಸುವ ಮೊತ್ತವೂ ಇದೇ. ಕೆಳಗಿನ ಔಟ್‌ಪುಟ್ ಉದ್ದ ನೋಡಿ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು, shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1
max_completion_tokens integer max_tokens ನಂತೆಯೇ. ಎರಡನ್ನೂ ಕಳುಹಿಸಿದರೆ max_tokens ಬಳಸಲಾಗುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು, shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1
temperature number ಸ್ಯಾಂಪ್ಲಿಂಗ್ temperature. ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳಲ್ಲಿ ಡೀಫಾಲ್ಟ್ 1 ಮತ್ತು ಮೌಲ್ಯಗಳನ್ನು 0 ರಿಂದ 2 ರ ನಡುವೆ ಇಡಲಾಗುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು, shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1
top_p number 0.95 ನ್ಯೂಕ್ಲಿಯಸ್ ಸ್ಯಾಂಪ್ಲಿಂಗ್. ಮೌಲ್ಯಗಳನ್ನು 0 ರಿಂದ 1 ರ ನಡುವೆ ಇಡಲಾಗುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು
seed integer ಸ್ಯಾಂಪ್ಲರ್‌ನ seed, ಯಾವುದೇ ಪೂರ್ಣಾಂಕ. ಇದನ್ನು ನೀಡದಿದ್ದರೆ, seed ಅನ್ನು ಮಾಡೆಲ್ ಮತ್ತು ಸಂಭಾಷಣೆಯಿಂದ ಪಡೆಯಲಾಗುತ್ತದೆ, ಆದ್ದರಿಂದ ಒಂದೇ ವಿನಂತಿಯನ್ನು ಎರಡು ಬಾರಿ ಕಳುಹಿಸಿದರೆ ಒಂದೇ seed ಬಳಕೆಯಾಗುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು
stop string | array ಒಂದು string ಅಥವಾ strings ಗಳ array. ಗರಿಷ್ಠ 4 ಬಳಕೆಯಾಗುತ್ತವೆ. ಮೊದಲು ಕಾಣಿಸಿಕೊಳ್ಳುವ ಒಂದರ ಮೊದಲೇ ಉತ್ತರ ಕೊನೆಗೊಳ್ಳುತ್ತದೆ; stop ಪಠ್ಯವನ್ನು ಹಿಂತಿರುಗಿಸಲಾಗುವುದಿಲ್ಲ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು
reasoning_effort string high ಉತ್ತರಿಸುವ ಮೊದಲು ಮಾಡೆಲ್ ಎಷ್ಟು ರೀಸನಿಂಗ್ ಮಾಡುತ್ತದೆ: off, low, medium ಅಥವಾ high. none ಮತ್ತು minimal ಎಂದರೆ off, default ಎಂದರೆ medium, max ಎಂದರೆ high. ಬೇರೆ ಯಾವುದೇ ಮೌಲ್ಯಕ್ಕೆ 400 ಹಿಂತಿರುಗುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು
reasoning object ಅದೇ ಸೆಟ್ಟಿಂಗ್ ಆಬ್ಜೆಕ್ಟ್ ರೂಪದಲ್ಲಿ: {"effort": "low"}. ಎರಡನ್ನೂ ಕಳುಹಿಸಿದರೆ reasoning_effort ಬಳಸಲಾಗುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು
tools array ಮಾಡೆಲ್ ಕರೆಯಬಹುದಾದ ಫಂಕ್ಷನ್‌ಗಳು, ಪ್ರತಿಯೊಂದೂ {"type": "function", "function": {"name", "description", "parameters"}} ರೂಪದಲ್ಲಿ. ಮಾಡೆಲ್‌ನ ಕರೆಗಳು tool_calls ನಲ್ಲಿ ಬರುತ್ತವೆ; ಅವನ್ನು ನಿಮ್ಮ ಕೋಡ್ ಚಲಾಯಿಸುತ್ತದೆ. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು
tool_choice string | object auto "auto" ಮಾಡೆಲ್‌ಗೆ ನಿರ್ಧರಿಸಲು ಬಿಡುತ್ತದೆ. "required" ಅದು ಒಂದು ಟೂಲ್ ಅನ್ನು ಕರೆಯುವಂತೆ ಮಾಡುತ್ತದೆ. {"type": "function", "function": {"name": "…"}} ಆ ನಿರ್ದಿಷ್ಟ ಟೂಲ್ ಅನ್ನು ಕರೆಯುವಂತೆ ಮಾಡುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು
response_format object JSON ಉತ್ತರಕ್ಕಾಗಿ {"type": "json_object"}, ಅಥವಾ ನಿಮ್ಮ schema ಅನ್ನು ಅನುಸರಿಸುವ ಉತ್ತರಕ್ಕಾಗಿ {"type": "json_schema", "json_schema": {…}}. ಎಲ್ಲ Shannon ಹಂತಗಳು; ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು ಪ್ರತಿ id ಗೆ ಪಟ್ಟಿ ಮಾಡಿದಂತೆ
web_search boolean false true ಆಗಿದ್ದರೆ ಮಾಡೆಲ್ ಉತ್ತರಿಸುವ ಮೊದಲು ವೆಬ್‌ನಲ್ಲಿ ಹುಡುಕಬಹುದು. shannon-1.6-*, shannon-2-*, Shannon 3 ಕುಟುಂಬ

n, user, stream_options, parallel_tool_calls, presence_penalty, frequency_penalty, logit_bias, logprobs, metadata, store ಮತ್ತು prompt_cache_key ನಂತಹ ಇತರ OpenAI ಫೀಲ್ಡ್‌ಗಳನ್ನು ಸ್ವೀಕರಿಸಲಾಗುತ್ತದೆ, ಇದರಿಂದ ಈಗಿರುವ ಕ್ಲೈಂಟ್ ಕೋಡ್ ಬದಲಾವಣೆಯಿಲ್ಲದೆ ಓಡುತ್ತದೆ. ಅವು ಪ್ರತಿಕ್ರಿಯೆಯನ್ನು ಬದಲಾಯಿಸುವುದಿಲ್ಲ: ಯಾವಾಗಲೂ ಒಂದೇ choice ಇರುತ್ತದೆ, ಮತ್ತು ಸ್ಟ್ರೀಮ್ ಯಾವಾಗಲೂ ಬಳಕೆಯೊಂದಿಗೆ ಕೊನೆಗೊಳ್ಳುತ್ತದೆ.

ತಪ್ಪಾದ JSON ಪ್ರಕಾರದ ಫೀಲ್ಡ್, ಉದಾಹರಣೆಗೆ "max_tokens": "100", 422 ಹಿಂತಿರುಗಿಸುತ್ತದೆ. messages ಇಲ್ಲದ ವಿನಂತಿಗೂ ಇದೇ ಆಗುತ್ತದೆ.

ಟೂಲ್‌ಗಳು, ರಚಿತ ಔಟ್‌ಪುಟ್, ರೀಸನಿಂಗ್ ಮತ್ತು ವೆಬ್ ಹುಡುಕಾಟ ಪ್ರತಿಯೊಂದಕ್ಕೂ ತನ್ನದೇ ಪುಟವಿದೆ: ಫಂಕ್ಷನ್ ಕಾಲಿಂಗ್, ರಚಿತ ಔಟ್‌ಪುಟ್‌ಗಳು, ರೀಸನಿಂಗ್ ಪ್ರಯತ್ನ, ಒಳನಿರ್ಮಿತ ವೆಬ್ ಹುಡುಕಾಟ.

ಆಯ್ಕೆಗಳೊಂದಿಗೆ ವಿನಂತಿ

ಈ ವಿನಂತಿ system ಸಂದೇಶ, ಸ್ಯಾಂಪ್ಲಿಂಗ್ ಫೀಲ್ಡ್‌ಗಳು ಮತ್ತು ರೀಸನಿಂಗ್ effort ಅನ್ನು ಹೊಂದಿಸುತ್ತದೆ. ಇದು ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್ ಅನ್ನು ಬಳಸುತ್ತದೆ, ಅದು ಇವೆಲ್ಲವನ್ನೂ ಅನ್ವಯಿಸುತ್ತದೆ.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://api.shannon-ai.com/v1",
)

response = client.chat.completions.create(
    model="DeepSeek-V4-Flash-0731-W4A16-AUTOROUND-REAP",
    messages=[
        {"role": "system", "content": "You are a physics teacher. Answer in two sentences."},
        {"role": "user", "content": "Why is the sky blue?"},
    ],
    max_tokens=512,
    temperature=0.3,
    top_p=0.9,
    seed=7,
    stop=["\n\n"],
    reasoning_effort="low",
)

message = response.choices[0].message
print(message.reasoning_content)  # the reasoning
print(message.content)            # the answer
print(response.usage)

ಉತ್ತರವು ಮೇಲಿನಂತೆಯೇ ರೂಪ ಹೊಂದಿದೆ. ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳಲ್ಲಿ ಅದರ usage ಎರಡು ವಿವರಗಳನ್ನು ಸೇರಿಸುತ್ತದೆ: ಕ್ಯಾಶ್‌ನಿಂದ ಓದಿದ ಪ್ರಾಂಪ್ಟ್ ಟೋಕನ್‌ಗಳು ಮತ್ತು ರೀಸನಿಂಗ್‌ಗೆ ಖರ್ಚಾದ ಟೋಕನ್‌ಗಳು.

200 JSON
{
  "usage": {
    "prompt_tokens": 31,
    "completion_tokens": 62,
    "total_tokens": 93,
    "prompt_tokens_details": {
      "cached_tokens": 0
    },
    "completion_tokens_details": {
      "reasoning_tokens": 21
    }
  }
}

ಔಟ್‌ಪುಟ್ ಉದ್ದ

max_tokens ಎರಡು ಕೆಲಸ ಮಾಡುತ್ತದೆ. ಮೊದಲನೆಯದಾಗಿ, ವಿನಂತಿ ಆರಂಭವಾದಾಗ ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಿಂದ ಮೀಸಲಿಡುವ ಟೋಕನ್‌ಗಳ ಸಂಖ್ಯೆ ಇದು. ಉತ್ತರ ಪೂರ್ಣಗೊಂಡಾಗ, ಆ ಮೊತ್ತವನ್ನು ವಿನಂತಿ ಬಳಸಿದ ಟೋಕನ್‌ಗಳಿಂದ ಬದಲಾಯಿಸಲಾಗುತ್ತದೆ. max_tokens ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಲ್ಲಿ ಉಳಿದಿರುವುದಕ್ಕಿಂತ ದೊಡ್ಡದಾಗಿದ್ದರೆ, ಉತ್ತರವೇ ಹೊಂದಿಕೊಳ್ಳುತ್ತಿದ್ದರೂ ವಿನಂತಿಗೆ 429 Quota exceeded ಹಿಂತಿರುಗುತ್ತದೆ. ಕಡಿಮೆ ಮೀಸಲಿಡಲು ಕಡಿಮೆ max_tokens ಕಳುಹಿಸಿ.

ಈ ಎಂಡ್‌ಪಾಯಿಂಟ್‌ನಲ್ಲಿ shannon-coder-1 ಅನ್ನು ಬೇರೆ ರೀತಿ ಎಣಿಸಲಾಗುತ್ತದೆ: ಪ್ರತಿ ವಿನಂತಿ ನಿಮ್ಮ ಪ್ಲ್ಯಾನ್‌ನ ಒಂದು Shannon Coder ಕರೆಯಾಗಿದೆ, ಮತ್ತು ಅದಕ್ಕಾಗಿ ಯಾವುದೇ ಟೋಕನ್‌ಗಳನ್ನು ಮೀಸಲಿಡಲಾಗುವುದಿಲ್ಲ. ಮಿತಿಗಳು ಮತ್ತು ಬ್ಯಾಲೆನ್ಸ್

ಎರಡನೆಯದಾಗಿ, ಈ ಮಾಡೆಲ್‌ಗಳಲ್ಲಿ ಇದು ಉತ್ತರದ ಉದ್ದವನ್ನು ಮಿತಿಗೊಳಿಸುತ್ತದೆ:

ಮಾಡೆಲ್‌ಗಳು max_tokens ಏನು ಮಾಡುತ್ತದೆ
shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 ಮಿತಿ ತಲುಪಿದಾಗ ಉತ್ತರ ನಿಲ್ಲುತ್ತದೆ. ಆಗ stream finish_reason length ನೊಂದಿಗೆ ಕೊನೆಗೊಳ್ಳುತ್ತದೆ.
ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು ಉತ್ತರ ಪಠ್ಯ max_tokens ನಲ್ಲಿ ನಿಲ್ಲುತ್ತದೆ. ರೀಸನಿಂಗ್ ಅದರ ವಿರುದ್ಧ ಎಣಿಕೆಯಾಗುವುದಿಲ್ಲ. 256 ಕ್ಕಿಂತ ಕಡಿಮೆ ಮೌಲ್ಯಗಳು 256 ಆಗಿ ವರ್ತಿಸುತ್ತವೆ.

max_tokens ಅಥವಾ max_completion_tokens ಇಲ್ಲದಿದ್ದರೆ, ಮೌಲ್ಯ 4,096. shannon-coder-1 ನಲ್ಲಿ ಅದು 65,536.

ಸಂದೇಶಗಳು

ಪ್ರತಿ ಸಂದೇಶವು role ಮತ್ತು content ಹೊಂದಿರುವ ಆಬ್ಜೆಕ್ಟ್ ಆಗಿದೆ. content ಒಂದು string, ಅಥವಾ ಸಂದೇಶವು ಪಠ್ಯಕ್ಕಿಂತ ಹೆಚ್ಚನ್ನು ಹೊತ್ತಿರುವಾಗ ಭಾಗಗಳ array ಆಗಿರುತ್ತದೆ.

ಪಾತ್ರ ವಿವರಣೆ ಅನ್ವಯಿಸುವವರು
system ಮಾಡೆಲ್‌ಗೆ ಸೂಚನೆಗಳು. ಇದನ್ನು ಮೊದಲಿಗೆ ಇಡಿ. Shannon ಟಿಯರ್‌ಗಳಲ್ಲಿ ಮೊದಲ system ಸಂದೇಶವೇ ಬಳಕೆಯಾಗುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು, shannon-1.6-*, shannon-2-*, shannon-coder-1
developer system ಎಂದು ಓದಲಾಗುತ್ತದೆ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು
user ನೀವು ಕೇಳುವುದು. Shannon ಟಿಯರ್‌ಗಳಲ್ಲಿ ಕೊನೆಯ user ಸಂದೇಶವೇ ಪ್ರಾಂಪ್ಟ್, ಅದರ ಮೊದಲಿನ ಸಂದೇಶಗಳು ಇತಿಹಾಸ. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು
assistant ಮಾಡೆಲ್‌ನ ಹಿಂದಿನ ಉತ್ತರಗಳು. ಇದರ ನಂತರ ಟೂಲ್ ಫಲಿತಾಂಶವನ್ನು ಕಳುಹಿಸುವಾಗ ಅದರ tool_calls ಅನ್ನು ಉಳಿಸಿಕೊಳ್ಳಿ. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು
tool ಟೂಲ್ ಕರೆಯ ಫಲಿತಾಂಶ: tool_call_id ಕರೆಯ id ಯನ್ನು ಮತ್ತು content ಫಲಿತಾಂಶವನ್ನು string ಆಗಿ ಹೊಂದಿರುತ್ತದೆ. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು

Shannon 3 ಕುಟುಂಬದ id ಯೊಂದಿಗೆ, ಪಾಲಿಸಲೇಬೇಕಾದ ಸೂಚನೆಗಳನ್ನು user ಸಂದೇಶದಲ್ಲಿ ಇಡಿ.

Shannon ಟಿಯರ್‌ಗಳಲ್ಲಿ user ಪಠ್ಯವೂ tools ಸಹ ಇಲ್ಲದ ವಿನಂತಿಗೆ 400 No user message provided ಹಿಂತಿರುಗುತ್ತದೆ.

ವಿಷಯ ಭಾಗಗಳು

ಭಾಗ ವಿವರಣೆ ಲಭ್ಯವಿರುವುದು
{"type": "text", "text": "…"} ಸರಳ ಪಠ್ಯ. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು
{"type": "image_url", "image_url": {"url": "…"}} ಒಂದು ಚಿತ್ರ, base64 ವಿಷಯವಿರುವ data: URL ಆಗಿ ಅಥವಾ http(s) URL ಆಗಿ. Shannon 3 ಕುಟುಂಬ, shannon-1.6-lite, shannon-1.6-pro, ಮತ್ತು ಚಿತ್ರ ಇನ್‌ಪುಟ್ ಪಟ್ಟಿ ಮಾಡಿರುವ ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು
{"type": "file", "source": {"type": "base64", "media_type": "application/pdf", "data": "…"}} ಒಂದು ಡಾಕ್ಯುಮೆಂಟ್ (PDF, Word, PowerPoint ಅಥವಾ Excel), base64 ಆಗಿ ಅಥವಾ URL ಮೂಲಕ. Shannon 3 ಕುಟುಂಬ

ಗಾತ್ರಗಳು, ಮಿತಿಗಳು ಮತ್ತು ರೂಪಗಳ ಪೂರ್ಣ ಪಟ್ಟಿಗೆ ತನ್ನದೇ ಪುಟವಿದೆ. ಚಿತ್ರಗಳು ಮತ್ತು ಫೈಲ್‌ಗಳು

ಉತ್ತರ ಆಬ್ಜೆಕ್ಟ್

ಫೀಲ್ಡ್ ವಿಧ ವಿವರಣೆ
id string chatcmpl- ನಂತರ 32 ಹೆಕ್ಸಾಡೆಸಿಮಲ್ ಅಕ್ಷರಗಳು.
object string ಯಾವಾಗಲೂ chat.completion.
created integer ಉತ್ತರದ ಸಮಯ, Unix ಸೆಕೆಂಡ್‌ಗಳಲ್ಲಿ.
model string ಉತ್ತರಿಸಿದ ಮಾಡೆಲ್‌ನ ಅಧಿಕೃತ id. ನೀವು ಕಳುಹಿಸಿದ id ಗಿಂತ ಕಾಗುಣಿತದಲ್ಲಿ ಭಿನ್ನವಾಗಿರಬಹುದು.
choices array ಯಾವಾಗಲೂ ನಿಖರವಾಗಿ ಒಂದು choice, index 0 ಯೊಂದಿಗೆ.
choices[0].message.role string ಯಾವಾಗಲೂ assistant.
choices[0].message.content string | null ಉತ್ತರ ಪಠ್ಯ. tool_calls ಇದ್ದಾಗ Shannon ಟಿಯರ್‌ಗಳಲ್ಲಿ ಇದು null; ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು ಕರೆಗಳ ಜೊತೆಗೆ ಪಠ್ಯವನ್ನೂ ಕಳುಹಿಸಬಹುದು.
choices[0].message.reasoning_content string | null ಉತ್ತರದ ಮೊದಲು ಮಾಡೆಲ್ ಬರೆದ ರೀಸನಿಂಗ್, ಅಥವಾ ಯಾವುದೂ ಇಲ್ಲದಿದ್ದರೆ null.
choices[0].message.tool_calls array ಮಾಡೆಲ್ ಟೂಲ್‌ಗಳನ್ನು ಕರೆದಾಗ ಮಾತ್ರ ಇರುತ್ತದೆ. ಪ್ರತಿ ನಮೂದು id, type function, ಮತ್ತು name ಹಾಗೂ JSON string ಆಗಿರುವ arguments ಹೊಂದಿರುವ function ಹೊಂದಿದೆ.
choices[0].message.annotations array ಹುಡುಕಾಟ ಏನನ್ನಾದರೂ ಕಂಡ web_search: true ವಿನಂತಿಯಲ್ಲಿ ಮಾತ್ರ. content ನಲ್ಲಿನ ಗುರುತು ಹೆಸರಿಸುವ ಪ್ರತಿ ಮೂಲಕ್ಕೆ ಒಂದು url_citation, url, title, start_index ಮತ್ತು end_index ಜೊತೆಗೆ (ಗುರುತಿನ ಸ್ಥಾನ, ಅಕ್ಷರಗಳಲ್ಲಿ ಎಣಿಸಿದ್ದು, ಕೊನೆ ಸೇರಿಲ್ಲ).
choices[0].finish_reason string ಉತ್ತರ ಏಕೆ ಕೊನೆಗೊಂಡಿತು. ಮುಕ್ತಾಯದ ಕಾರಣಗಳನ್ನು ನೋಡಿ.
usage object ವಿನಂತಿಯ ಟೋಕನ್‌ಗಳು. ಬಳಕೆಯನ್ನು ನೋಡಿ.
sources array ಹುಡುಕಾಟ ಏನನ್ನಾದರೂ ಕಂಡ web_search: true ವಿನಂತಿಯಲ್ಲಿ ಮಾತ್ರ: ಮಾಡೆಲ್‌ಗೆ ನೀಡಿದ ಫಲಿತಾಂಶಗಳು, ಪ್ರತಿಯೊಂದೂ index, title ಮತ್ತು url ಜೊತೆಗೆ. ಉತ್ತರದಲ್ಲಿನ [1] ಎಂದರೆ index 1 ಇರುವ ಎಂಟ್ರಿ.

ಮುಕ್ತಾಯದ ಕಾರಣಗಳು

finish_reason ವಿವರಣೆ
stop ಮಾಡೆಲ್ ತನ್ನ ಉತ್ತರವನ್ನು ಮುಗಿಸಿತು, ಅಥವಾ stop string ಕಾಣಿಸಿಕೊಂಡಿತು.
tool_calls ಮಾಡೆಲ್ ಒಂದು ಅಥವಾ ಹೆಚ್ಚು ಟೂಲ್‌ಗಳನ್ನು ಕರೆಯುತ್ತದೆ. ಅವನ್ನು ಚಲಾಯಿಸಿ ಫಲಿತಾಂಶಗಳನ್ನು tool ಸಂದೇಶಗಳಲ್ಲಿ ಕಳುಹಿಸಿ.
length ಔಟ್‌ಪುಟ್ ಮಿತಿಯಲ್ಲಿ ಉತ್ತರ ಕತ್ತರಿಸಲ್ಪಟ್ಟಿತು. shannon-1.6-lite, shannon-1.6-pro, shannon-coder-1 ಮತ್ತು Shannon 3 ಕುಟುಂಬದ streams ಗಳಲ್ಲಿ ವರದಿಯಾಗುತ್ತದೆ.

stream ಮಾಡದ ಉತ್ತರವು stop ಅಥವಾ tool_calls ಎಂದು ವರದಿ ಮಾಡುತ್ತದೆ.

ಬಳಕೆ

ಫೀಲ್ಡ್ ವಿಧ ವಿವರಣೆ ಲಭ್ಯವಿರುವುದು
usage.prompt_tokens integer ಇನ್‌ಪುಟ್ ಟೋಕನ್‌ಗಳು. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು
usage.completion_tokens integer ಔಟ್‌ಪುಟ್ ಟೋಕನ್‌ಗಳು: ರೀಸನಿಂಗ್, ಉತ್ತರ ಮತ್ತು ಟೂಲ್ ಕರೆಗಳು ಒಟ್ಟಾಗಿ. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು
usage.total_tokens integer prompt_tokens ಜೊತೆಗೆ completion_tokens. ಎಲ್ಲ ಮಾಡೆಲ್‌ಗಳು
usage.prompt_tokens_details.cached_tokens integer ಪ್ರಾಂಪ್ಟ್ ಕ್ಯಾಶ್‌ನಿಂದ ಓದಿದ prompt_tokens ನ ಭಾಗ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು
usage.completion_tokens_details.reasoning_tokens integer ರೀಸನಿಂಗ್‌ಗೆ ಖರ್ಚಾದ completion_tokens ನ ಭಾಗ. ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳು

ಹೋಸ್ಟ್ ಮಾಡಿದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳಲ್ಲಿ, prompt_tokens ಎಂದರೆ ನಿಮ್ಮ ಸಂದೇಶಗಳು ಮತ್ತು ಟೂಲ್ ವ್ಯಾಖ್ಯಾನಗಳನ್ನು ಮಾಡೆಲ್‌ನ ಸ್ವಂತ tokenizer ನಿಂದ ಎಣಿಸಿದ್ದು, ಜೊತೆಗೆ ಯಾವುದೇ ಚಿತ್ರಗಳ ಟೋಕನ್‌ಗಳು. ಟೋಕನ್ ಎಣಿಕೆ ಎಂಡ್‌ಪಾಯಿಂಟ್‌ಗಳು ನೀವು ಕಳುಹಿಸುವ ಮೊದಲೇ ಅದೇ ಸಂಖ್ಯೆಯನ್ನು ಹಿಂತಿರುಗಿಸುತ್ತವೆ. ಟೋಕನ್ ಎಣಿಕೆ

Shannon ಟಿಯರ್‌ಗಳಲ್ಲಿ, prompt_tokens ಉತ್ತರ ಬರೆಯಲು ಮಾಡೆಲ್ ಓದಿದ ಎಲ್ಲವನ್ನೂ ಎಣಿಸುತ್ತದೆ, ಆದ್ದರಿಂದ ಅದು ನಿಮ್ಮ ಸಂದೇಶಗಳ ಪಠ್ಯಕ್ಕಿಂತ ದೊಡ್ಡದಾಗಿರುತ್ತದೆ.

ಸ್ಟ್ರೀಮಿಂಗ್

stream ಅನ್ನು true ಗೆ ಹೊಂದಿಸಿದರೆ ಉತ್ತರ chat.completion.chunk ಈವೆಂಟ್‌ಗಳಾಗಿ ಬರುತ್ತದೆ ಮತ್ತು data: [DONE] ನೊಂದಿಗೆ ಕೊನೆಗೊಳ್ಳುತ್ತದೆ. ಅದರ ಮೊದಲಿನ ಕೊನೆಯ chunk finish_reason ಮತ್ತು usage ಅನ್ನು ಹೊತ್ತಿರುತ್ತದೆ; stream_options ಬೇಕಿಲ್ಲ. chunk ರೂಪಗಳು, keep-alive ಸಾಲುಗಳು ಮತ್ತು stream ಒಳಗಿನ ದೋಷಗಳಿಗೆ ತನ್ನದೇ ಪುಟವಿದೆ. ಸ್ಟ್ರೀಮಿಂಗ್

ದೋಷಗಳು

ದೋಷ ಎಂದರೆ error ಸದಸ್ಯ ಇರುವ JSON ಆಬ್ಜೆಕ್ಟ್. ಪರಿಶೀಲನೆಗಳು ಈ ಕ್ರಮದಲ್ಲಿ ನಡೆಯುತ್ತವೆ: API ಕೀ, ವಿನಂತಿ ಬಾಡಿ, ಮಾಡೆಲ್ id, ನಂತರ ಬ್ಯಾಲೆನ್ಸ್. ಈ ಎಂಡ್‌ಪಾಯಿಂಟ್ ಹೆಚ್ಚಾಗಿ ಹಿಂತಿರುಗಿಸುವುದನ್ನು ಕೋಷ್ಟಕ ಪಟ್ಟಿ ಮಾಡುತ್ತದೆ. ಯಾವುದನ್ನು ಮರುಪ್ರಯತ್ನಿಸಬೇಕು ಎಂಬುದರೊಂದಿಗೆ ಪೂರ್ಣ ಪಟ್ಟಿಗೆ ತನ್ನದೇ ಪುಟವಿದೆ. ದೋಷ ನಿರ್ವಹಣೆ

400 JSON
{
  "error": {
    "type": "invalid_request_error",
    "message": "unknown model: no-such-model"
  }
}
ಸ್ಥಿತಿ ವಿಧ ಸಂದೇಶ ಯಾವಾಗ
401 authentication_error Missing authentication
Invalid API key
API ಕೀ ಕಳುಹಿಸಿಲ್ಲ, ಅಥವಾ ಕೀ ಅಪರಿಚಿತ ಅಥವಾ ಹಿಂಪಡೆಯಲಾಗಿದೆ.
400 invalid_request_error unknown model: <id> model ಪ್ರಕಟಿತ id ಅಲ್ಲ.
400 invalid_request_error No user message provided Shannon ಹಂತಗಳು: ವಿನಂತಿಯಲ್ಲಿ ಬಳಕೆದಾರರ ಪಠ್ಯವಿಲ್ಲ ಮತ್ತು tools ಇಲ್ಲ.
400 invalid_request_error <id> does not accept image input ಚಿತ್ರ ಇನ್‌ಪುಟ್ ಇಲ್ಲದ ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗೆ ಚಿತ್ರ ಭಾಗ ಕಳುಹಿಸಲಾಗಿದೆ.
400 invalid_request_error <id> does not accept response_format ರಚಿತ ಔಟ್‌ಪುಟ್ ಇಲ್ಲದ ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗೆ response_format ಕಳುಹಿಸಲಾಗಿದೆ.
400 invalid_request_error unknown reasoning effort '<value>'; expected off, low, medium or high reasoning_effort ಪಟ್ಟಿಯ ಹೊರಗಿನ ಮೌಲ್ಯವನ್ನು ಹೊಂದಿದೆ.
422 invalid_request_error Failed to deserialize the JSON body into the target type: … messages ಇಲ್ಲ, ಅಥವಾ ಒಂದು ಫೀಲ್ಡ್‌ನ JSON ವಿಧ ತಪ್ಪಾಗಿದೆ.
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan max_tokens ನಿಮ್ಮ ಬ್ಯಾಲೆನ್ಸ್‌ನಲ್ಲಿ ಉಳಿದಿರುವುದಕ್ಕಿಂತ ದೊಡ್ಡದಾಗಿದೆ.
429 rate_limit_error Too many requests. Retry in <n>s. ಫ್ಲಡ್ ಪ್ರೊಟೆಕ್ಷನ್: ನಿಮ್ಮ ಖಾತೆಯಲ್ಲಿ ಒಂದು ನಿಮಿಷದಲ್ಲಿ 120 ಕ್ಕಿಂತ ಹೆಚ್ಚು ವಿನಂತಿಗಳು.
500 server_error The model backend failed to answer. Please retry. ಮಾಡೆಲ್ ಪ್ರತಿಕ್ರಿಯೆ ನೀಡಲಿಲ್ಲ. ವಿನಂತಿಯನ್ನು ಮತ್ತೆ ಕಳುಹಿಸಿ.
502 api_error The model backend failed to answer. Please retry. Shannon 3 ಕುಟುಂಬ ಮತ್ತು ಹೋಸ್ಟ್ ಮಾಡಲಾದ ಓಪನ್-ವೇಟ್ ಮಾಡೆಲ್‌ಗಳಲ್ಲಿ ಅದೇ.