Conspectus
Tabula API: omne endpoint, qualis petitio et error sint, quomodo vocationes solvantur, et quid scire oporteat cum ex SDK OpenAI vel Anthropic venis.
Endpoints
Omne endpoint sub uno base URL est et per HTTPS servitur.
https://api.shannon-ai.com | Endpoint | Forma | Ad quid |
|---|---|---|
POST /v1/chat/completions | OpenAI Chat Completions | Mitte conversationem, accipe responsionem proximam. Cum streaming aut sine. |
POST /v1/messages | Anthropic Messages | Idem, in formis petitionis et responsionis SDK Anthropic. |
POST /v1/responses | OpenAI Responses | Idem, in formis Responses. Endpoint nullum statum servat: mitte conversationem cum omni petitione. |
GET /v1/models | Index modellorum OpenAI | Enumera modellos cum context window, pretiis et facultatibus. Nullam clavem requirit. |
POST /v1/tokenize | Shannon API | Computa tokens textus vel petitionis chat pro modello open-weight hosted. Gratis. |
POST /v1/messages/count_tokens | Computatio tokenum Anthropic | Computa tokens input petitionis Messages pro modello open-weight hosted. Gratis. |
Tria endpoints quae textum producunt ad eadem modelli perveniunt. Elige illud cuius formam codex tuus iam utitur.
Fundamenta petitionis
| Header | Descriptio |
|---|---|
Authorization: Bearer <key> | Clavis tua API. Necessaria in omni endpoint praeter GET /v1/models, nisi x-api-key mittis. |
x-api-key: <key> | Eadem clavis in header quem SDK Anthropic mittunt. In omni endpoint legitur. |
Content-Type: application/json | Necessarium in omni POST. Sine eo responsio est 415. |
x-request-id: <your id> | Optionale. Id tuum proprium pro petitione; in header responsionis x-request-id redit. Sine eo API unum ex 12 notis hexadecimalibus creat. |
- Corpus omnis
POSTest unum objectum JSON, ad 32 MiB. - Campus quem API non novit nullum errorem causat et nullum effectum habet. Petitio pro alio provisore scripta propter campum additum non deficit.
- Campus notus cum typo JSON falso, aut campus necessarius deest, respondetur cum
422. Corpus quod JSON validum non est respondetur cum400. modelest unum ex ids in Models & pricing. Litterae maiusculae et minusculae nihil referunt.
Responsio est JSON, aut stream server-sent events cum petitio stream ad true ponit. Quodque endpoint in sua forma respondet. Omnis responsio header x-request-id habet.
Quae petitio transit
Petitio certo ordine inspicitur antequam modellum currit. Prima inspectio quae deficit respondet, itaque 401 nihil adhuc de corpore dicit.
| Inspectum, hoc ordine | Status cum deficit |
|---|---|
| Clavis API | 401 |
| Corpus: magnitudo, content type, JSON, typi camporum | 413 · 415 · 400 · 422 |
| Id modelli | 400 |
| Defensio inundationis: 120 petitiones per minutum per rationem | 429 |
| Saldum: budget outputi petitionis capi debet | 429 |
Forma erroris
Error est objectum JSON cum error quod type et message tenet. /v1/messages eum involvit ut SDK Anthropic exspectant; omnis alia via forma OpenAI utitur.
{
"error": {
"type": "invalid_request_error",
"message": "unknown model: gpt-4o"
}
} {
"type": "error",
"error": {
"type": "invalid_request_error",
"message": "unknown model: gpt-4o"
}
} - Lege
typeetmessage.codeetparamin quibusdam erroribus tantum adsunt: tracta eos ut optionales.paramsemper estnull. - Postquam stream incepit, status iam est
200. Defectus tunc ut error frame intra stream advenit. - Omnis responsio erroris header
x-request-idfert.
| Status | Genus | Quando |
|---|---|---|
400 | invalid_request_error | Corpus JSON validum non est, id modelli ignotum est, aut modellum genus inputi quod misisti non accipit. |
401 | authentication_error | Clavis deest aut valida non est. |
404 | not_found_error | Via non exstat. |
405 | api_error | Via exstat, methodus falsa est. |
413 | invalid_request_error | Corpus maius est quam 32 MiB. |
415 | invalid_request_error | Content-Type non est application/json. |
422 | invalid_request_error | Campus typum JSON falsum habet aut campus necessarius deest. |
429 | rate_limit_error | Saldum petitionem non tegit, plus quam 120 petitiones intra minutum advenerunt, vocationes Shannon Coder fenestrae consumptae sunt, aut modellum occupatum est. Nuntius dicit quod. |
5xx | api_error | Status 500, 502, 503 vel 504: petitio valida erat et responderi non potuit. Mitte eam iterum. 500 typum server_error ferre potest. |
Factura et saldum
- Unum saldum est per rationem, et chat et API id communicant: primum quota plani diei, deinde creditum emptum. API quotam propriam non habet.
- Petitio budget outputi suum (
max_tokens, defaultum 4,096) reservat et deinde pro tokens quos vere usa est computatur, ad pretium modelli. - Omnis responsio numeros tokenum suos in
usagenuntiat. Pagina Keys & usage saldum ostendit et quanti quaeque petitio constiterit. - Omnis petitio aequaliter servitur. Solus limes celeritatis petitionum est defensio inundationis: 120 petitiones per minutum per rationem. Petitiones parallele missae in ordine exspectant.
Limites et saldum Modella et pretia Claves et usus
Campi qui a modello pendent
Omne modellum eandem petitionem accipit. Pauci campi in quibusdam modellis tantum valent; tabula ubi nominat. Paginae endpoints omnes campos enumerant.
| Campus | Descriptio | Applicatur a |
|---|---|---|
system | Instructiones pro modello: nuntius system in Chat Completions, system in Messages, instructions in Responses. | Modelli open-weight hosted, shannon-1.6-*, shannon-2-*, shannon-coder-1 |
temperature | Temperatura sampling. | Modelli open-weight hosted, shannon-1.6-*, shannon-coder-1 |
top_p | Nucleus sampling. | Modelli open-weight hosted |
seed | Seed fixum pro sampling. | Modelli open-weight hosted |
stop | Ad 4 sequentiae stop. | Modelli open-weight hosted |
reasoning_effort | Quantum modellum ratiocinetur antequam respondet. reasoning.effort in Responses, thinking in Messages. | Modelli open-weight hosted |
web_search | true modello permittit ut pro hac petitione interretem quaerat. Campus huius API, in Chat Completions et Messages. | Modelli Shannon praeter shannon-coder-1 |
max_tokens | Budget outputi. In omni modello quantitatem de saldo tuo reservatam ponit. | Ut limes longitudinis responsionis: modelli open-weight hosted, shannon-1.6-*, shannon-coder-1 |
Si ex SDK OpenAI venis
- Pone base URL ad
https://api.shannon-ai.com/v1et clavem ad clavem tuam Shannon. Vocationes Chat Completions et Responses tunc cum SDK ut est operantur. modeldebet esse id Shannon. Nomen modelli alterius provisoris, utgpt-4o, respondetur cum400etunknown model.- Ratiocinatio in campo proprio venit:
reasoning_contentiuxtacontent, in nuntio et in deltas stream. - Stream semper
usagein ultimo chunk fert, una cumfinish_reason. - Vocatio tool in stream ut unum chunk cum toto string
argumentsadvenit. - Responsio unam choice habet.
- Viae API OpenAI quae in tabula supra non sunt, ut
/v1/embeddings, respondentur cum404.
Si ex SDK Anthropic venis
- Pone base URL ad
https://api.shannon-ai.com, sine/v1, et clavem ad clavem tuam Shannon. SDK eam utx-api-keymittit. modeldebet esse id Shannon.max_tokensin hac API optionalis est. Defaultum eius est 4,096.- Responsio content blocks typorum
thinking,textettool_usetenet. Primus block non semper est textus: elige blocks pertype. stop_reasonestend_turnveltool_use. Stream modelli Shannon etiam cummax_tokensfinire potest.anthropic-versionetanthropic-betaaccipiuntur, itaque SDK sine mutatione operatur. Petitio eis non eget.- Errores in
/v1/messagesformam Anthropic habent:{"type": "error", "error": {…}}.
Instrumenta codicis quae has formas loquuntur eodem modo parantur: base URL, clavis, et id Shannon ut modellum. Instrumenta CLI ad codicem scribendum