Imagens e arquivos
Envie imagens com uma mensagem: quais modelos as aceitam, as formas aceitas e seus limites.
POST https://api.shannon-ai.com/v1/chat/completions
Uma imagem viaja dentro de uma mensagem de usuário, como uma parte do seu content. O exemplo lê um arquivo local e o envia como data URL.
import base64
from openai import OpenAI
client = OpenAI(api_key="YOUR_API_KEY", base_url="https://api.shannon-ai.com/v1")
with open("photo.jpg", "rb") as f:
image = base64.b64encode(f.read()).decode()
response = client.chat.completions.create(
model="shannon-3",
messages=[{
"role": "user",
"content": [
{"type": "text", "text": "What is in this picture?"},
{"type": "image_url", "image_url": {"url": "data:image/jpeg;base64," + image}},
],
}],
)
print(response.choices[0].message.content) import fs from "node:fs";
import OpenAI from "openai";
const client = new OpenAI({ apiKey: "YOUR_API_KEY", baseURL: "https://api.shannon-ai.com/v1" });
const image = fs.readFileSync("photo.jpg").toString("base64");
const response = await client.chat.completions.create({
model: "shannon-3",
messages: [{
role: "user",
content: [
{ type: "text", text: "What is in this picture?" },
{ type: "image_url", image_url: { url: "data:image/jpeg;base64," + image } },
],
}],
});
console.log(response.choices[0].message.content); # Linux: base64 -w0 photo.jpg macOS: base64 -i photo.jpg
IMAGE=$(base64 -w0 photo.jpg)
curl https://api.shannon-ai.com/v1/chat/completions \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d @- <<EOF
{
"model": "shannon-3",
"messages": [{
"role": "user",
"content": [
{"type": "text", "text": "What is in this picture?"},
{"type": "image_url", "image_url": {"url": "data:image/jpeg;base64,${IMAGE}"}}
]
}]
}
EOF {
"id": "chatcmpl-8d1f3a5c7e9b4d2f6a8c0e2b4d6f8a1c",
"object": "chat.completion",
"created": 1791590400,
"model": "shannon-3",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "A grey cat asleep on a windowsill, with a potted fern beside it.",
"reasoning_content": null
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 286,
"completion_tokens": 19,
"total_tokens": 305
}
} Quais modelos aceitam imagens
| Modelos | Lê |
|---|---|
shannon-3, shannon-3-pro, shannon-3.1, shannon-3.1-pro | Imagens e documentos: PDF, Word, PowerPoint, Excel e arquivos de texto simples. |
shannon-1.6-lite, shannon-1.6-pro | Imagens. |
shannon-2-lite, shannon-2-pro | Imagens, em requisições que também enviam tools ou response_format. |
Kimi-K3-3BIT-REAP, MiniMax-M3-3BIT-REAP, Kimi-K2.6-W4A16-AUTOROUND-REAP, inkling-W4A16-AUTOROUND-REAP, MiMo-V2.5-W8A16 | Imagens. |
DeepSeek-V4-Pro-0813-3BIT-REAP, GLM-5.2-3BIT-REAP, Nemotron3Ultra-3BIT-REAP, DeepSeek-V4-Flash-0731-W4A16-AUTOROUND-REAP, Laguna-S-2.1-W4A16-AUTOROUND-REAP, MiMo-V2.5-Pro-W8A16, Hy3-W8A16 | Texto. Uma requisição com imagem é respondida com status 400. |
shannon-coder-1 | Texto. |
GET /v1/models informa a entrada de imagem por id como capabilities.vision. Modelos e preços
- Os modelos Shannon leem os arquivos da última mensagem de usuário. Coloque a imagem na mensagem que pergunta sobre ela.
- A família Shannon 3 também mantém à vista algumas imagens e documentos de mensagens de usuário anteriores, quando foram enviados inline, e lê um número máximo definido de imagens por requisição, contadas a partir da primeira.
- Os modelos open-weight hospedados leem as imagens de todas as mensagens da conversa.
Formas aceitas
Um arquivo é enviado de uma de duas formas: dentro da requisição como base64, ou como um endereço que a API busca. Todo arquivo viaja com a requisição; a API não tem endpoint de upload.
| Endpoint | Na requisição (base64) | Por endereço |
|---|---|---|
/v1/chat/completions | {"type": "image_url", "image_url": {"url": "data:image/jpeg;base64,…"}} | {"type": "image_url", "image_url": {"url": "https://…"}} |
/v1/responses | {"type": "input_image", "image_url": "data:image/jpeg;base64,…"} | {"type": "input_image", "image_url": "https://…"} |
/v1/messages | {"type": "image", "source": {"type": "base64", "media_type": "image/jpeg", "data": "…"}} | {"type": "image", "source": {"type": "url", "url": "https://…"}} |
A mesma mensagem de usuário em cada formato:
{
"role": "user",
"content": [
{"type": "text", "text": "What is in this picture?"},
{
"type": "image_url",
"image_url": {
"url": "data:image/jpeg;base64,/9j/4AAQSkZJRgABAQAAAQABAAD…"
}
}
]
} {
"role": "user",
"content": [
{"type": "input_text", "text": "What is in this picture?"},
{
"type": "input_image",
"image_url": "data:image/jpeg;base64,/9j/4AAQSkZJRgABAQAAAQABAAD…"
}
]
} {
"role": "user",
"content": [
{"type": "text", "text": "What is in this picture?"},
{
"type": "image",
"source": {
"type": "base64",
"media_type": "image/jpeg",
"data": "/9j/4AAQSkZJRgABAQAAAQABAAD…"
}
}
]
} - Uma data URL tem a forma
data:<media type>;base64,<data>. A parte;base64é obrigatória. - Em
/v1/chat/completionse/v1/responses,image_urlpode ser a própria string ou um objeto{"url": "…"}. - O tipo do arquivo vem da data URL ou de
media_type. Sem ele, uma imagem é lida comoimage/png. - Os arquivos inline contam para o tamanho do corpo da requisição, que pode ter até 32 MiB.
- Aceito por compatibilidade:
image_url.detail.
Limites para arquivos remotos
Quando você envia um endereço, a API busca o arquivo antes de o modelo ser executado, dentro destes limites:
| Limite | Regra |
|---|---|
| Tamanho | Até 8 MiB por arquivo. |
| Tempo | 20 segundos para responder. |
| Redirecionamentos | No máximo 5. |
| Endereço | http:// ou https://, sem nome de usuário nem senha no endereço, em um host com endereço público. |
| Resposta do host | Um status na faixa 200 e um corpo que não esteja vazio. O tipo do arquivo é lido de Content-Type. |
| Requisitado como | User-Agent: ShannonBot/1.0 (+https://shannon-ai.com) |
Como as imagens contam em tokens
Nos modelos open-weight hospedados, uma imagem conta um token para cada bloco de 28 × 28 pixels: a largura dividida por 28, arredondada para cima, vezes a altura dividida por 28, arredondada para cima. O resultado faz parte de usage.prompt_tokens e é cobrado como entrada.
- 1024 × 1024
- 1,369 tokens
- 1920 × 1080
- 2,691 tokens
- 512 × 512
- 361 tokens
- Uma imagem remota é buscada primeiro, então o seu tamanho real é contado.
- Uma imagem cujo tamanho não pode ser lido conta 1,024 tokens.
- Os endpoints de contagem usam a mesma regra para data URLs. Eles não buscam um endereço remoto e o contam como 1,024 tokens. Contagem de tokens
- Para um modelo Shannon, veja em
usagena resposta quanto custou uma requisição com imagens.
Documentos e outros arquivos
A família Shannon 3 (shannon-3, shannon-3-pro, shannon-3.1, shannon-3.1-pro) também lê documentos. O texto do documento é extraído e entregue ao modelo junto com a sua mensagem.
| Documento | Tipo de mídia |
|---|---|
application/pdf | |
| Word | application/vnd.openxmlformats-officedocument.wordprocessingml.document |
| PowerPoint | application/vnd.openxmlformats-officedocument.presentationml.presentation |
| Excel | application/vnd.openxmlformats-officedocument.spreadsheetml.sheet |
Um documento é uma parte da mensagem do usuário, como uma imagem:
| Endpoint | Na requisição (base64) | Por endereço |
|---|---|---|
/v1/chat/completions, /v1/messages | {"type": "document", "source": {"type": "base64", "media_type": "application/pdf", "data": "…"}} | {"type": "document", "source": {"type": "url", "url": "https://…"}} |
/v1/responses | {"type": "input_file", "file_data": "data:application/pdf;base64,…"} | {"type": "input_file", "file_url": "https://…"} |
{
"model": "shannon-3",
"messages": [
{
"role": "user",
"content": [
{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "JVBERi0xLjcKJeLjz9MK…"
}
},
{"type": "text", "text": "Summarise this report in five points."}
]
}
]
} {
"model": "shannon-3",
"input": [
{
"role": "user",
"content": [
{
"type": "input_file",
"file_data": "data:application/pdf;base64,JVBERi0xLjcKJeLjz9MK…"
},
{
"type": "input_text",
"text": "Summarise this report in five points."
}
]
}
]
} {
"model": "shannon-3",
"messages": [
{
"role": "user",
"content": [
{
"type": "document",
"source": {
"type": "base64",
"media_type": "application/pdf",
"data": "JVBERi0xLjcKJeLjz9MK…"
}
},
{"type": "text", "text": "Summarise this report in five points."}
]
}
]
} - Informe o tipo de mídia real do arquivo. Sem ele, um documento é lido como
application/pdf. - Um arquivo de texto simples, como CSV, é lido como texto e anexado da mesma forma.
- Quando um documento não pode ser lido, ou o arquivo é de outro tipo, o modelo é informado disso e pode dizê-lo na resposta. O status continua
200. - Em todos os outros modelos, uma parte de documento é omitida do que o modelo lê, e a requisição é respondida com o restante.
- Um documento enviado por endereço é buscado sob os limites para arquivos remotos acima.
Erros
| Status | Tipo | Mensagem | Quando |
|---|---|---|---|
400 | invalid_request_error | <id> does not accept image input | Uma imagem foi enviada a um modelo open-weight hospedado que aceita apenas texto. Nada é descontado do seu saldo. |
400 | invalid_request_error | audio and video input are not supported by any hosted model | Uma parte de áudio ou vídeo foi enviada a um modelo open-weight hospedado. |
413 | invalid_request_error | Failed to buffer the request body: … | O corpo da requisição, com seus arquivos inline, é maior que 32 MiB. O erro traz code: "request_too_large". |
Um modelo Shannon responde com status 200 sejam quais forem os arquivos que a requisição traz: uma parte que ele não lê é omitida. Tratamento de erros