Traduction de protocole
Tous les modèles sur tous les endpoints, ce qui est transmis sans modification et les rares éléments que la traduction ne peut pas préserver.
Chaque modèle est accessible depuis chaque endpoint. Demander un modèle Claude via
/v1/responses, ou un modèle GPT via /v1/messages, est pris en charge.
C'est ce qui permet à un client utilisant un protocole d'accéder aux modèles de fournisseurs qui en utilisent un autre, sans faire fonctionner une seconde passerelle.
| Endpoint | Protocole | Clients courants |
|---|---|---|
/v1/chat/completions |
Chat Completions d'OpenAI | SDK OpenAI, OpenClaw, Hermes, la plupart des éditeurs |
/v1/messages |
Messages d'Anthropic | SDK Anthropic, Claude Code |
/v1/responses |
Responses d'OpenAI | Codex, SDK OpenAI récents |
Les identifiants sont acceptés sous la forme Authorization: Bearer, x-api-key ou api-key,
car les clients ne s'accordent pas sur celui à envoyer.
Quand rien n'est traduit
Si votre endpoint et le fournisseur du modèle utilisent déjà le même protocole, le corps de la requête est transmis au lieu d'être reconstruit. Seul l'identifiant du modèle est réécrit.
Les points de contrôle du cache, les signatures de raisonnement et les champs inconnus de Webway parviennent tous au fournisseur sans modification, et toute fonctionnalité publiée par un fournisseur après la rédaction de cette page fonctionne dès sa sortie.
Ce que la traduction ne peut pas préserver
Lorsque la requête ne suit pas ce chemin, certains éléments n'ont aucun équivalent dans le protocole cible :
- Les points de contrôle du cache sont supprimés lorsque la cible est Chat Completions, qui
ne possède pas de
cache_control. Les fournisseurs y utilisent implicitement le cache : vous perdez donc du contrôle, pas de l'argent. - Les signatures de raisonnement sont la preuve fournie par un fournisseur qu'un bloc de raisonnement a été renvoyé sans modification. Elles sont propres au fournisseur qui les a émises et ne peuvent pas être transférées vers le protocole d'un autre fournisseur ; elles sont donc supprimées plutôt que falsifiées.
previous_response_idest refusé avec une erreur400. Webway ne stocke pas l'état des conversations ; envoyez le tableauinputcomplet. Ignorer ce champ supprimerait silencieusement votre historique.
Les outils, leurs résultats, les images, les prompts système, les raisons d'arrêt, l'ordre du streaming et le nombre de tokens sont tous conservés dans les deux sens.
Comptage des tokens
/v1/messages/count_tokens est disponible pour chaque modèle, y compris ceux dont le
fournisseur ne le propose pas, afin que la jauge de contexte de Claude Code fonctionne partout.
Pour ces modèles, le nombre de tokens est estimé.
Les entrées mises en cache sont facturées au tarif du cache, et les écritures en cache au tarif d'écriture.
L'utilisation est normalisée avant d'apparaître sur votre facture : Anthropic exclut les tokens mis en cache
de input_tokens, tandis qu'OpenAI les inclut dans prompt_tokens, et
GET /v1/models publie chaque tarif séparément.