OpenRouter

OpenRouter es un proxy de APIs de modelos de IA. Con una sola API key accedes a Claude, GPT, Gemini, Llama, Mistral, DeepSeek, Command R y más de 400 modelos de más de 70 proveedores. Pagas por uso, sin suscripciones separadas a cada proveedor ni contratos anuales.

El problema que resuelve

Cada proveedor de modelos tiene su propia API, su propio sistema de facturación, sus propios rate limits y su propia forma de manejar errores. Si tu aplicación usa Claude para razonamiento complejo, Llama para tareas simples de clasificación y GPT para visión de imágenes, necesitas tres integraciones, tres cuentas y tres facturas. Con OpenRouter necesitas una sola integración. Cambias de modelo cambiando un string en el campo `model` de la petición.

Qué hace exactamente

Enruta cada petición al proveedor que elijas y factura el consumo en una cuenta única. Procesa más de 100 billones de tokens al mes y da servicio a más de 10 millones de usuarios, así que la infraestructura está rodada. Cuando un modelo está disponible en varios proveedores (por ejemplo Claude en Anthropic directo, Amazon Bedrock o Google Vertex), OpenRouter reparte el tráfico y aplica fallback entre ellos.

Funcionalidades que importan

Fallback automático: si un proveedor está caído o responde lento, redirige la petición a otro que sirva el mismo modelo, sin que tu aplicación se entere. Routing y ordenación de proveedores: eliges por coste, por latencia o por política de datos, con controles finos por proveedor. Infraestructura en el edge para reducir la latencia inicial. Dashboard de uso con desglose por modelo y por proyecto, útil para ver dónde se te va el gasto.

Para desarrolladores

La API es compatible con el SDK de OpenAI, así que funciona sin cambios si ya lo usabas. Cambiar de modelo es cambiar un string en el campo `model` del request. Soporta streaming, tool use, visión y JSON mode. Los rate limits son por modelo, no globales, así que puedes saturar Llama sin afectar tus llamadas a Claude. Puedes traer tu propia API key de un proveedor (BYOK) y OpenRouter la usa para enrutar sin cobrarte el margen sobre esas llamadas.

Precio

Sin suscripción. Compras créditos prepago (los paquetes visibles van desde 10 USD) o pagas con tarjeta y facturación mensual. Pagas el precio del modelo original más un pequeño margen; en varios modelos el margen es cero. El coste real depende del modelo que uses en cada llamada, no de OpenRouter.

Caso práctico

Un equipo de producto que construye un asistente de atención al cliente usa Claude Sonnet para consultas complejas que requieren razonamiento y Llama para preguntas frecuentes con respuesta predecible. El routing de OpenRouter envía cada consulta al modelo correcto y el fallback cubre las caídas puntuales de un proveedor. El resultado es una factura única y menos código de integración que mantener.

Casos de uso concretos

Estos son los usos donde OpenRouter suele ganar frente a integrar cada proveedor a mano:

  • Enrutar por tarea: mandas las consultas complejas a un modelo potente y las repetitivas a uno barato, todo desde la misma API key.
  • Fallback en producción: si el proveedor principal se cae o va lento, la petición salta a otro que sirva el mismo modelo, sin caída de servicio.
  • Comparar antes de decidir: pruebas cinco modelos con el mismo prompt y comparas coste, latencia y calidad de respuesta antes de fijar uno.
  • Facturación única: en lugar de tres facturas de tres proveedores, un solo consumo y un solo dashboard.

Diferencia con integrar cada proveedor a mano

Si integras Anthropic, OpenAI y un proveedor de Llama por separado, mantienes tres SDKs, tres sistemas de rate limits y tres flujos de errores. Con OpenRouter escribes una vez y cambias de modelo con un string. El coste de esa comodidad es el pequeño margen sobre el precio del modelo (cero en varios) y depender de un intermediario, que se compensa con la opción de traer tu propia key.

Cuándo encaja

Encaja si pruebas varios modelos y no quieres abrir cuenta en cada proveedor, si necesitas fallback entre modelos equivalentes, o si quieres comparar coste y velocidad antes de fijar un modelo. No encaja tanto si ya has decidido usar un solo modelo en producción y quieres el precio y los límites directos del proveedor. Alternativas: LiteLLM (open source, self-hosted), Portkey y Martian.


Relacionado