Ad contentum transili
Conspectus

Conspectus

Tabula API: omne endpoint, qualis petitio et error sint, quomodo vocationes solvantur, et quid scire oporteat cum ex SDK OpenAI vel Anthropic venis.

Endpoints

Omne endpoint sub uno base URL est et per HTTPS servitur.

Base URL
https://api.shannon-ai.com
Endpoint Forma Ad quid
POST /v1/chat/completions OpenAI Chat Completions Mitte conversationem, accipe responsionem proximam. Cum streaming aut sine.
POST /v1/messages Anthropic Messages Idem, in formis petitionis et responsionis SDK Anthropic.
POST /v1/responses OpenAI Responses Idem, in formis Responses. Endpoint nullum statum servat: mitte conversationem cum omni petitione.
GET /v1/models Index modellorum OpenAI Enumera modellos cum context window, pretiis et facultatibus. Nullam clavem requirit.
POST /v1/tokenize Shannon API Computa tokens textus vel petitionis chat pro modello open-weight hosted. Gratis.
POST /v1/messages/count_tokens Computatio tokenum Anthropic Computa tokens input petitionis Messages pro modello open-weight hosted. Gratis.

Tria endpoints quae textum producunt ad eadem modelli perveniunt. Elige illud cuius formam codex tuus iam utitur.

Fundamenta petitionis

Header Descriptio
Authorization: Bearer <key> Clavis tua API. Necessaria in omni endpoint praeter GET /v1/models, nisi x-api-key mittis.
x-api-key: <key> Eadem clavis in header quem SDK Anthropic mittunt. In omni endpoint legitur.
Content-Type: application/json Necessarium in omni POST. Sine eo responsio est 415.
x-request-id: <your id> Optionale. Id tuum proprium pro petitione; in header responsionis x-request-id redit. Sine eo API unum ex 12 notis hexadecimalibus creat.
  • Corpus omnis POST est unum objectum JSON, ad 32 MiB.
  • Campus quem API non novit nullum errorem causat et nullum effectum habet. Petitio pro alio provisore scripta propter campum additum non deficit.
  • Campus notus cum typo JSON falso, aut campus necessarius deest, respondetur cum 422. Corpus quod JSON validum non est respondetur cum 400.
  • model est unum ex ids in Models & pricing. Litterae maiusculae et minusculae nihil referunt.

Responsio est JSON, aut stream server-sent events cum petitio stream ad true ponit. Quodque endpoint in sua forma respondet. Omnis responsio header x-request-id habet.

Quae petitio transit

Petitio certo ordine inspicitur antequam modellum currit. Prima inspectio quae deficit respondet, itaque 401 nihil adhuc de corpore dicit.

Forma erroris

Error est objectum JSON cum error quod type et message tenet. /v1/messages eum involvit ut SDK Anthropic exspectant; omnis alia via forma OpenAI utitur.

{
  "error": {
    "type": "invalid_request_error",
    "message": "unknown model: gpt-4o"
  }
}
  • Lege type et message. code et param in quibusdam erroribus tantum adsunt: tracta eos ut optionales. param semper est null.
  • Postquam stream incepit, status iam est 200. Defectus tunc ut error frame intra stream advenit.
  • Omnis responsio erroris header x-request-id fert.
Status Genus Quando
400 invalid_request_error Corpus JSON validum non est, id modelli ignotum est, aut modellum genus inputi quod misisti non accipit.
401 authentication_error Clavis deest aut valida non est.
404 not_found_error Via non exstat.
405 api_error Via exstat, methodus falsa est.
413 invalid_request_error Corpus maius est quam 32 MiB.
415 invalid_request_error Content-Type non est application/json.
422 invalid_request_error Campus typum JSON falsum habet aut campus necessarius deest.
429 rate_limit_error Saldum petitionem non tegit, plus quam 120 petitiones intra minutum advenerunt, vocationes Shannon Coder fenestrae consumptae sunt, aut modellum occupatum est. Nuntius dicit quod.
5xx api_error Status 500, 502, 503 vel 504: petitio valida erat et responderi non potuit. Mitte eam iterum. 500 typum server_error ferre potest.

Tractatio errorum

Factura et saldum

  • Unum saldum est per rationem, et chat et API id communicant: primum quota plani diei, deinde creditum emptum. API quotam propriam non habet.
  • Petitio budget outputi suum (max_tokens, defaultum 4,096) reservat et deinde pro tokens quos vere usa est computatur, ad pretium modelli.
  • Omnis responsio numeros tokenum suos in usage nuntiat. Pagina Keys & usage saldum ostendit et quanti quaeque petitio constiterit.
  • Omnis petitio aequaliter servitur. Solus limes celeritatis petitionum est defensio inundationis: 120 petitiones per minutum per rationem. Petitiones parallele missae in ordine exspectant.

Limites et saldum Modella et pretia Claves et usus

Campi qui a modello pendent

Omne modellum eandem petitionem accipit. Pauci campi in quibusdam modellis tantum valent; tabula ubi nominat. Paginae endpoints omnes campos enumerant.

Campus Descriptio Applicatur a
system Instructiones pro modello: nuntius system in Chat Completions, system in Messages, instructions in Responses. Modelli open-weight hosted, shannon-1.6-*, shannon-2-*, shannon-coder-1
temperature Temperatura sampling. Modelli open-weight hosted, shannon-1.6-*, shannon-coder-1
top_p Nucleus sampling. Modelli open-weight hosted
seed Seed fixum pro sampling. Modelli open-weight hosted
stop Ad 4 sequentiae stop. Modelli open-weight hosted
reasoning_effort Quantum modellum ratiocinetur antequam respondet. reasoning.effort in Responses, thinking in Messages. Modelli open-weight hosted
web_search true modello permittit ut pro hac petitione interretem quaerat. Campus huius API, in Chat Completions et Messages. Modelli Shannon praeter shannon-coder-1
max_tokens Budget outputi. In omni modello quantitatem de saldo tuo reservatam ponit. Ut limes longitudinis responsionis: modelli open-weight hosted, shannon-1.6-*, shannon-coder-1

Chat Completions

Si ex SDK OpenAI venis

  • Pone base URL ad https://api.shannon-ai.com/v1 et clavem ad clavem tuam Shannon. Vocationes Chat Completions et Responses tunc cum SDK ut est operantur.
  • model debet esse id Shannon. Nomen modelli alterius provisoris, ut gpt-4o, respondetur cum 400 et unknown model.
  • Ratiocinatio in campo proprio venit: reasoning_content iuxta content, in nuntio et in deltas stream.
  • Stream semper usage in ultimo chunk fert, una cum finish_reason.
  • Vocatio tool in stream ut unum chunk cum toto string arguments advenit.
  • Responsio unam choice habet.
  • Viae API OpenAI quae in tabula supra non sunt, ut /v1/embeddings, respondentur cum 404.

Si ex SDK Anthropic venis

  • Pone base URL ad https://api.shannon-ai.com, sine /v1, et clavem ad clavem tuam Shannon. SDK eam ut x-api-key mittit.
  • model debet esse id Shannon.
  • max_tokens in hac API optionalis est. Defaultum eius est 4,096.
  • Responsio content blocks typorum thinking, text et tool_use tenet. Primus block non semper est textus: elige blocks per type.
  • stop_reason est end_turn vel tool_use. Stream modelli Shannon etiam cum max_tokens finire potest.
  • anthropic-version et anthropic-beta accipiuntur, itaque SDK sine mutatione operatur. Petitio eis non eget.
  • Errores in /v1/messages formam Anthropic habent: {"type": "error", "error": {…}}.

Instrumenta codicis quae has formas loquuntur eodem modo parantur: base URL, clavis, et id Shannon ut modellum. Instrumenta CLI ad codicem scribendum