Traducción de protocolos
Cualquier modelo en cualquier endpoint, qué se reenvía intacto y las pocas cosas que la traducción no puede trasladar.
Puedes acceder a cualquier modelo desde cualquier endpoint. Solicitar un modelo Claude mediante
/v1/responses, o un modelo GPT mediante /v1/messages, es una solicitud compatible.
Esto permite que un cliente que utiliza un protocolo acceda a modelos de proveedores que utilizan otro, sin tener que ejecutar una segunda puerta de enlace.
| Endpoint | Protocolo | Clientes habituales |
|---|---|---|
/v1/chat/completions |
Completado de chat de OpenAI | SDK de OpenAI, OpenClaw, Hermes, la mayoría de los editores |
/v1/messages |
Mensajes de Anthropic | SDK de Anthropic, Claude Code |
/v1/responses |
Respuestas de OpenAI | Codex, SDK más recientes de OpenAI |
Las credenciales se aceptan como Authorization: Bearer, x-api-key o api-key,
porque los clientes no se ponen de acuerdo sobre cuál enviar.
Cuando no se traduce nada
Si tu endpoint y el proveedor del modelo ya utilizan el mismo protocolo, el cuerpo de la solicitud se reenvía en lugar de reconstruirse. Solo se reescribe el ID del modelo.
Los puntos de corte de caché, las firmas de razonamiento y los campos que Webway nunca ha visto llegan intactos al proveedor, y cualquier función de un proveedor publicada después de escribir esta página funciona desde el mismo día de su lanzamiento.
Lo que la traducción no puede trasladar
Fuera de esa ruta, algunas cosas no tienen cabida en el protocolo de destino:
- Los puntos de corte de caché se descartan cuando el destino es el protocolo de completado de chat, que
no tiene
cache_control. En ese caso, los proveedores almacenan en caché de forma implícita, por lo que esto supone perder control, no dinero. - Las firmas de razonamiento son la prueba de un proveedor de que un bloque de razonamiento se recibió sin modificaciones. Son específicas del proveedor que las emitió y no pueden trasladarse al protocolo de otro, por lo que se descartan en lugar de falsificarse.
previous_response_idse rechaza con un400. Webway no almacena el estado de la conversación; envía el arrayinputcompleto. Ignorar el campo descartaría silenciosamente tu historial.
Las herramientas, los resultados de herramientas, las imágenes, los prompts del sistema, los motivos de finalización, el orden del streaming y los recuentos de tokens se conservan en ambas direcciones.
Recuento de tokens
/v1/messages/count_tokens está disponible para todos los modelos, incluidos aquellos cuyo
proveedor no lo ofrece, para que el medidor de contexto de Claude Code funcione en todos ellos.
Los recuentos de esos modelos son estimaciones.
La entrada almacenada en caché se factura a la tarifa de caché y las escrituras en caché, a la tarifa de escritura.
El uso se normaliza antes de llegar a tu factura: Anthropic excluye los tokens almacenados en caché
de input_tokens, mientras que OpenAI los incluye en prompt_tokens, y
GET /v1/models publica cada tarifa por separado.