Protokollöversättning
Alla modeller på alla slutpunkter, vad som vidarebefordras orört och det fåtal saker som inte kan följa med i översättningen.
Alla modeller kan nås från alla slutpunkter. Det går att begära en Claude-modell via
/v1/responses eller en GPT-modell via /v1/messages.
Detta gör att en klient som använder ett protokoll kan använda modeller från leverantörer som använder ett annat, utan att köra en andra gateway.
| Slutpunkt | Protokoll | Typiska klienter |
|---|---|---|
/v1/chat/completions |
OpenAI chat completions | OpenAI SDK:er, OpenClaw, Hermes, de flesta redigerare |
/v1/messages |
Anthropic Messages | Anthropic SDK:er, Claude Code |
/v1/responses |
OpenAI Responses | Codex, nyare OpenAI SDK:er |
Autentiseringsuppgifter accepteras som Authorization: Bearer, x-api-key eller api-key,
eftersom klienterna inte är överens om vilket som ska skickas.
När ingenting översätts
Om din slutpunkt och modellens leverantör redan använder samma protokoll vidarebefordras begärans innehåll i stället för att byggas om. Endast modell-ID:t skrivs om.
Cachebrytpunkter, resonemangssignaturer och fält som Webway aldrig har hört talas om når leverantören orörda, och en leverantörsfunktion som lanseras efter att den här sidan skrevs fungerar samma dag som den lanseras.
Vad översättningen inte kan föra över
Utanför den vägen finns det ett fåtal saker som inte har någon motsvarighet i målprotokollet:
- Cachebrytpunkter tas bort när målet är chat completions, som inte har något
cache_control. Leverantörerna cachelagrar där automatiskt, så du förlorar kontroll, inte pengar. - Resonemangssignaturer är en leverantörs bevis på att ett tankeblock kom tillbaka oförändrat. De är specifika för leverantören som utfärdade dem och kan inte föras över till en annan leverantörs protokoll, så de tas bort i stället för att förfalskas.
previous_response_idavvisas med400. Webway lagrar inte konversationstillstånd. Skicka helainput-matrisen. Om fältet ignorerades skulle din historik tas bort utan förvarning.
Verktyg, verktygsresultat, bilder, systempromptar, stopporsaker, strömningsordning och tokenantal bevaras åt båda hållen.
Tokenantal
/v1/messages/count_tokens är tillgänglig för alla modeller, även sådana vars
leverantör inte erbjuder den, så att Claude Codes kontextmätare fungerar överallt.
Antalen för dessa modeller är uppskattningar.
Cachelagrad indata debiteras enligt cachepriset och cacheskrivningar enligt skrivpriset.
Användningen normaliseras innan den når din faktura: Anthropic undantar cachelagrade
token från input_tokens, medan OpenAI inkluderar dem i prompt_tokens, och
GET /v1/models publicerar varje pris separat.