Hoppa till innehållet

Protokollöversättning

Alla modeller på alla slutpunkter, vad som vidarebefordras orört och det fåtal saker som inte kan följa med i översättningen.

Alla modeller kan nås från alla slutpunkter. Det går att begära en Claude-modell via /v1/responses eller en GPT-modell via /v1/messages.

Detta gör att en klient som använder ett protokoll kan använda modeller från leverantörer som använder ett annat, utan att köra en andra gateway.

Slutpunkt Protokoll Typiska klienter
/v1/chat/completions OpenAI chat completions OpenAI SDK:er, OpenClaw, Hermes, de flesta redigerare
/v1/messages Anthropic Messages Anthropic SDK:er, Claude Code
/v1/responses OpenAI Responses Codex, nyare OpenAI SDK:er

Autentiseringsuppgifter accepteras som Authorization: Bearer, x-api-key eller api-key, eftersom klienterna inte är överens om vilket som ska skickas.

När ingenting översätts

Om din slutpunkt och modellens leverantör redan använder samma protokoll vidarebefordras begärans innehåll i stället för att byggas om. Endast modell-ID:t skrivs om.

Cachebrytpunkter, resonemangssignaturer och fält som Webway aldrig har hört talas om når leverantören orörda, och en leverantörsfunktion som lanseras efter att den här sidan skrevs fungerar samma dag som den lanseras.

Vad översättningen inte kan föra över

Utanför den vägen finns det ett fåtal saker som inte har någon motsvarighet i målprotokollet:

  • Cachebrytpunkter tas bort när målet är chat completions, som inte har något cache_control. Leverantörerna cachelagrar där automatiskt, så du förlorar kontroll, inte pengar.
  • Resonemangssignaturer är en leverantörs bevis på att ett tankeblock kom tillbaka oförändrat. De är specifika för leverantören som utfärdade dem och kan inte föras över till en annan leverantörs protokoll, så de tas bort i stället för att förfalskas.
  • previous_response_id avvisas med 400. Webway lagrar inte konversationstillstånd. Skicka hela input-matrisen. Om fältet ignorerades skulle din historik tas bort utan förvarning.

Verktyg, verktygsresultat, bilder, systempromptar, stopporsaker, strömningsordning och tokenantal bevaras åt båda hållen.

Tokenantal

/v1/messages/count_tokens är tillgänglig för alla modeller, även sådana vars leverantör inte erbjuder den, så att Claude Codes kontextmätare fungerar överallt. Antalen för dessa modeller är uppskattningar.

Cachelagrad indata debiteras enligt cachepriset och cacheskrivningar enligt skrivpriset. Användningen normaliseras innan den når din faktura: Anthropic undantar cachelagrade token från input_tokens, medan OpenAI inkluderar dem i prompt_tokens, och GET /v1/models publicerar varje pris separat.