Alternativas a OpenRouter en 2026: qué gateway elegir

Comparamos seis alternativas a OpenRouter por precio, control, tolerancia a fallos y costo de migración tras el acuerdo de adquisición de Stripe.

Wednesday, September 2, 2026Omid Saffari
Alternativas a OpenRouter en 2026: qué gateway elegir

Entre las alternativas a OpenRouter, LiteLLM es la mejor cuando hay una persona responsable de plataforma capaz de operar el gateway; Vercel AI Gateway es el mejor reemplazo gestionado. El acuerdo de adquisición por parte de Stripe no obliga a una migración urgente, pero sí vuelve innegociable una regla presupuestaria: con $50,000 de gasto mensual en modelos, la comisión de plataforma de OpenRouter, del 5.5%, asciende a $2,750, y ningún intermediario debería ser la única ruta disponible.

Stripe anunció el 19 de agosto de 2026 que había acordado adquirir OpenRouter. El comunicado mantiene la propuesta que OpenRouter ya ofrecía: dirigir cada solicitud según la tarea, el precio, la velocidad y la fiabilidad entre cientos de modelos. No anuncia una subida de precios, un cierre ni una reducción del catálogo.

La consecuencia operativa es una mayor concentración de la propiedad. Una aplicación neutral respecto a los modelos puede acabar dependiendo del gateway si sus claves, alias de modelos, presupuestos, reglas de respaldo, registros y facturación quedan en manos de un solo intermediario. La respuesta es la regla de las dos rutas: usar un gateway para el tráfico habitual y conservar una vía directa a un proveedor que pueda sostener un flujo de producción sin modificar la lógica de negocio.

Los precios, planes, límites y funciones que aparecen a continuación se verificaron en las páginas activas de los proveedores el 20 de agosto de 2026. Este es un análisis de precios y documentación; no afirma que las seis plataformas se hayan probado bajo carga ni desplegado.

Alternativas a OpenRouter: ¿cuál conviene elegir?

Elija LiteLLM para obtener el máximo control, Vercel AI Gateway para simplificar la gestión, Portkey para gobernanza empresarial, Cloudflare AI Gateway para una infraestructura centrada en Cloudflare, Requesty para un modelo de uso parecido al de OpenRouter y Bifrost para un gateway ligero en infraestructura propia. Son seis decisiones de compra distintas, aunque todas permiten colocar varios proveedores de modelos detrás de un único endpoint.

HerramientaIdeal paraPrecio inicialPrueba gratuita
LiteLLMEnrutamiento bajo control de la aplicación$0 Open SourcePrueba Enterprise de 30 días
Vercel AI GatewayEquipos de producto que buscan un servicio gestionadoCrédito Free mensual de $5Plan Free permanente
PortkeyGobernanza empresarial$0 Developer; $49 ProductionPlan Developer permanente
Cloudflare AI GatewayInfraestructuras que ya usan Cloudflare$0 por el gateway baseFunciones base gratuitas de forma permanente
RequestyEnrutamiento gestionado con precio porcentual$0 Free; 5% Pay as you goPlan Free permanente
BifrostEnrutamiento ligero en infraestructura propia$0 OSSPrueba Enterprise de 14 días

La primera decisión es quién opera la ruta de las solicitudes. LiteLLM y Bifrost ejecutan el gateway en la infraestructura de la empresa. Eso permite controlar el despliegue, los datos, las credenciales, las actualizaciones y la gestión de fallos. También deja las guardias operativas en manos del equipo. Una licencia gratuita no convierte un sistema de producción en gratuito.

Vercel, Cloudflare, Requesty y Portkey gestionan una parte mayor del servicio. Reducen el trabajo de plataforma, pero la disponibilidad y las políticas de la aplicación pasan a depender de otra empresa. Es razonable cuando el tiempo operativo ahorrado vale más que la comisión. Solo se vuelve peligroso cuando la aplicación carece de una ruta alternativa.

La decisión económica cambia en puntos distintos. Vercel no añade margen al costo de los tokens, aunque algunos controles opcionales tienen sus propios medidores. Requesty suma un 5% al costo del modelo. Cloudflare añade un 5% únicamente al comprar créditos mediante Unified Billing; el gateway base sigue siendo gratuito. Portkey cobra una suscripción de plataforma y excesos de registros. LiteLLM y Bifrost ofrecen planes de código abierto por $0, mientras que la ingeniería y la infraestructura propias asumen el costo operativo.

OpenRouter sigue siendo una opción válida. Su página de precios actual muestra 500+ modelos y 80+ proveedores en los planes de pago, frente a los 400+ modelos que citaba el anuncio de adquisición de Stripe. El catálogo evoluciona más rápido que la comunicación corporativa, una buena advertencia para no clasificar gateways solo por cantidad de modelos.

Para entender mejor las categorías disponibles, consulte la comparativa de diez gateways de IA. Como referencia sobre OpenRouter, el análisis actualizado de sus precios distingue entre créditos compartidos y BYOK.

Cómo cambia el presupuesto de enrutamiento tras el acuerdo con Stripe

La adquisición modifica el plan de contingencia antes que la factura. Stripe y OpenRouter podrían cumplir exactamente lo prometido. El asunto es más sencillo: el acceso a modelos, la facturación de tokens, las políticas de enrutamiento y la propiedad del gateway quedan ahora más cerca entre sí. Quien adoptó un router para no depender de un proveedor de modelos no debería reproducir esa misma dependencia una capa más arriba.

Los planes de pago activos de OpenRouter siguen mostrando una comisión de plataforma del 5.5% para Pay-as-you-go y descuentos sobre esa comisión para Enterprise. Free se mantiene en $0 con 25+ modelos gratuitos, cuatro proveedores y 50 solicitudes diarias. Pay-as-you-go BYOK incluye cada mes $25,000 de inferencia a precio de lista sin comisión de gateway y después cobra un 5%. Enterprise eleva esa franquicia mensual de BYOK sin comisión a $200,000 y después cobra un 5%.

Nada en las condiciones actuales exige una mudanza precipitada. Con $5,000 de gasto mensual en modelos mediante créditos compartidos, el 5.5% equivale a $275. Con $50,000, asciende a $2,750. El porcentaje es el mismo, pero la decisión empresarial no. A un equipo de producto pequeño no le conviene crear un nuevo servicio interno para ahorrar $275 si el gateway ya evita más de unas pocas horas de integración e incidentes. Un equipo de plataforma que paga $2,750 cada mes sí dispone de suficiente presupuesto para comparar alternativas en serio.

Conviene plantear una hipótesis operativa explícita en lugar de fingir que el código abierto no cuesta nada. Si un gateway alojado en infraestructura propia requiere 12 horas mensuales de ingeniería a un costo total de $150 por hora, su partida operativa es de $1,800 al mes, antes de cómputo y almacenamiento. Con esa hipótesis ilustrativa, la comisión del 5.5% de OpenRouter alcanza $1,800 cuando el gasto mensual en modelos ronda los $32,727. Una comisión del 5% llega a ese punto con $36,000.

No son umbrales universales de rentabilidad. Una carga regulada puede exigir alojamiento propio con apenas $2,000 de gasto mensual en modelos porque el despliegue privado es innegociable. Una startup de cinco personas puede seguir pagando por un servicio gestionado muy por encima de $36,000 si la alternativa es contratar o distraer a un ingeniero de plataforma. El cálculo hace visible la hipótesis para que finanzas e ingeniería debatan sobre el factor correcto.

La ruta alternativa también tiene un presupuesto, aunque menor. Supongamos ocho horas de ingeniería a $150 por hora para crear y ensayar una vía directa a un proveedor. Es un costo único de $1,200. Con $50,000 de gasto mensual en OpenRouter, equivale a 0.44 meses de la comisión de $2,750. Con $5,000 de gasto, representa 4.36 meses de la comisión de $275. Los clientes grandes pueden financiar la reversibilidad con una fracción de la comisión de un mes; los más pequeños deberían construir la vía alternativa solo para un flujo cuyo tiempo de inactividad o riesgo de políticas lo justifique.

Columnas de costo del gateway con cincuenta mil dólares de gasto mensual en modelos
La partida de enrutamiento sobre $50,000 de gasto mensual en modelos, según la hipótesis indicada para el alojamiento propio

La gráfica de costos requiere una precisión. El $0 de Vercel se refiere al margen sobre tokens, no a todos los controles opcionales. Su lista de proveedores permitidos para todo el equipo cuesta $0.10 por cada 1,000 solicitudes correctas; la retención cero de datos para todo el equipo cuesta otros $0.10 por cada 1,000 solicitudes, y las trazas cuestan $0.05 por cada 1,000 más la salida de datos. Con un millón de solicitudes, las tres funciones activas y una traza por solicitud, esos medidores suman $250 más la salida de las trazas.

Cloudflare y Requesty generan cada uno una partida de $2,500 en un ejemplo de $50,000 de uso, pero facturan conceptos distintos. Requesty aplica un margen del 5% al costo del modelo. El 5% de Cloudflare se aplica a los créditos comprados mediante Unified Billing, mientras que BYOK permite usar el gateway base gratuito sin esa comisión sobre créditos. El lenguaje de compras importa tanto como el porcentaje.

Las comisiones del gateway se añaden a la factura del modelo; no la sustituyen. La comparativa de las API de IA más baratas analiza por separado el costo de los tokens para evitar que una comisión baja del gateway oculte la elección de un modelo caro.

La regla de decisión es directa: conviene quedarse cuando el gateway ahorra más en ingeniería, fallos y facturación de lo que cobra; conviene cambiar cuando la falta de un control o una comisión recurrente supera el costo de operar la alternativa. En ambos casos, hay que construir una vía de respaldo. Sustituir una ruta central por otra ruta central no resuelve por sí solo la concentración.

Cómo se eligieron estas alternativas a OpenRouter

La clasificación premia la reversibilidad antes que el tamaño del catálogo. Una empresa puede explorar 100 modelos y aprobar tres para producción. El gateway útil es el que mantiene esos tres disponibles, observables, presupuestados y reemplazables sin dejar que el comportamiento específico de cada proveedor se filtre a la aplicación.

Cada alternativa se evaluó con cinco criterios:

  1. Propiedad: ¿quién controla las claves de proveedores, la política de enrutamiento, los alias de modelos, los registros y el proceso que ejecuta el gateway?
  2. Respuesta ante fallos: ¿pueden los operadores definir el orden de proveedores, los límites de reintentos, los topes presupuestarios y los errores ante los que nunca se debe continuar sin bloqueo?
  3. Visibilidad de costos: ¿la comisión es pública, calculable y atribuible al equipo o la aplicación que la generó?
  4. Límite de despliegue: ¿puede ejecutarse el gateway donde lo exigen las reglas de datos, red, identidad y cumplimiento del comprador?
  5. Costo de salida: ¿puede un flujo de producción evitar el gateway mediante configuración y un despliegue controlado, sin reescribir la aplicación?

La lista se detiene en seis porque cada producto funciona como una auténtica capa de solicitudes multiproveedor y ofrece suficientes precios y documentos vigentes para respaldar una decisión de compra. Se descartaron hosts de modelos y nubes de inferencia cuando no podían sustituir el enrutamiento neutral sin trasladar la carga a su propio ecosistema de modelos. Un catálogo largo de modelos ejecutables resulta útil, pero responde a otra pregunta.

Los precios de todos los proveedores se verificaron el 20 de agosto de 2026. Ningún plan gratuito se presentó como promesa de producción si el proveedor lo definía como un plan para prototipos o si sus límites documentados hacían insegura esa interpretación. Ningún producto recibió puntos por funciones aún en la hoja de ruta.

La primera posición también debía superar una prueba de propiedad. El alojamiento propio solo gana cuando una persona o un equipo identificable se ocupa de las actualizaciones, la salud de la base de datos, los secretos, el escalado, la telemetría y los incidentes. El enrutamiento gestionado solo gana cuando la aplicación conserva una vía directa a un proveedor. Por eso una misma lista de funciones puede producir clasificaciones diferentes para un fundador, un CTO de una empresa mediana y un equipo de plataforma empresarial.

1. LiteLLM: la mejor opción general para no depender de un proveedor

LiteLLM es la mejor alternativa a OpenRouter cuando la empresa puede gestionar el gateway como un producto. Reúne 100+ proveedores detrás de una API compatible con OpenAI e incluye claves virtuales, usuarios y equipos, seguimiento del gasto, presupuestos, límites de velocidad, rutas de respaldo, registro de solicitudes y respuestas y métricas de Prometheus en el plan de código abierto de $0. La limitación no es la capacidad, sino la responsabilidad operativa.

Página de precios de LiteLLM con los planes Open Source y Enterprise
LiteLLM

Una startup financiada con dos agentes de cara al cliente puede usar LiteLLM para asignar a cada servicio una clave virtual, alias de modelos aprobados, un presupuesto mensual y una ruta de respaldo controlada. Un equipo de plataforma de una empresa mediana puede ejecutar el mismo gateway con sus estándares de contenedores, secretos, bases de datos y supervisión. Un desarrollador independiente que no quiera pensar en infraestructura debería elegir Vercel o Requesty.

Ideal para: Empresas de producto con una persona responsable de plataforma
Punto fuerte: La aplicación controla el proceso del gateway, las cuentas de proveedores, las políticas y la ruta de datos
Precio: Open Source $0; precio Enterprise anual y personalizado según la capacidad de solicitudes, la arquitectura de despliegue y el soporte
Prueba gratuita: Prueba Enterprise de 30 días sin tarjeta de crédito; Open Source sigue siendo gratuito

La página de precios activa de LiteLLM solo marca dos límites comerciales. Open Source es gratuito para siempre en producción con alojamiento propio. Enterprise se cotiza anualmente y su precio depende explícitamente de la capacidad anual de solicitudes del gateway, la arquitectura de despliegue y las necesidades de soporte, no del gasto en tokens de los modelos.

Enterprise añade SSO y SCIM, autenticación OIDC o JWT, registros de auditoría, integración con gestores de secretos, rotación de claves, administración de la organización, un plano de control multirregional, despliegue aislado de Internet y soporte de hasta 24/7. Estos controles importan cuando el gateway se convierte en infraestructura compartida. No eliminan la necesidad de operar el plano de datos que la empresa decidió controlar.

La licencia de $0 puede resultar engañosa para un equipo pequeño. Alguien tiene que operar el proxy, la base de datos persistente, las credenciales, las copias de seguridad, las actualizaciones, las métricas, los cambios de los proveedores de modelos y la respuesta ante incidentes. Con la hipótesis indicada de 12 horas a $150, ese trabajo cuesta $1,800 al mes antes de la infraestructura. LiteLLM supera a una comisión gestionada del 5.5% en costo mensual puro por encima de unos $32,727 de gasto en modelos, aunque el control o el cumplimiento pueden justificarlo antes.

El diseño más sólido oculta LiteLLM detrás de alias internos como support-primary y support-fallback. La lógica de negocio debería solicitar una capacidad interna, no anthropic/claude-something ni una ruta específica de LiteLLM. El adaptador directo del proveedor debe entender el mismo alias interno. Así, el gateway sigue siendo reemplazable incluso después de volverse muy útil.

  1. Empiece con un flujo acotado

    Elija una ruta representativa de producción con esquema, objetivo de latencia, regla de datos y gasto mensual conocidos. No comience trasladando todas las llamadas a modelos.

  2. Cree alias internos de modelos

    Defina un modelo principal estable y un respaldo compatible sin exponer a la lógica de negocio las cadenas públicas de los proveedores. Mantenga el mapeo en la configuración del gateway.

  3. Emita una sola clave virtual

    Asigne a la aplicación su propia clave, los modelos aprobados, un presupuesto y un límite de velocidad. Mantenga la clave administrativa de LiteLLM fuera de la carga de trabajo.

  4. Configure un adaptador directo

    Guarde fuera de LiteLLM una credencial de proveedor y asigne la misma capacidad interna a la API de ese proveedor. El adaptador queda inactivo durante el tráfico normal, pero preparado para una conmutación controlada.

  5. Provoque un fallo

    Desactive el modelo principal en una ventana sin clientes. Confirme que el respaldo, los registros, el esquema, el límite de latencia y la vía directa funcionan como se espera antes de añadir más tráfico.

Lo bueno
Lo que hace bien
9 points

  • Licencia de código abierto de $0 para producción, sin comisión porcentual de gateway
  • 100+ proveedores, además de claves, presupuestos, límites, respaldos, registros y Prometheus
  • Las cuentas de proveedores y la ruta de solicitudes permanecen en la infraestructura de la empresa
  • Opción Enterprise para identidad, auditoría, secretos, operación multirregional y entornos aislados
  • El precio anual de Enterprise no aumenta automáticamente con el gasto en tokens
  • La empresa se responsabiliza de la disponibilidad, las actualizaciones, la persistencia, los secretos y los incidentes
  • El precio de Enterprise no es público
  • Un despliegue rápido puede convertirse en infraestructura compartida antes de financiar su operación
  • El alojamiento propio no elimina las caídas ni los límites contractuales de los proveedores subyacentes

LiteLLM ocupa el primer lugar porque puede eliminar tanto la dependencia de proveedores de modelos como la dependencia de un proveedor de gateway. Debe bajar al segundo puesto de inmediato si nadie asume su operación. Un plano de control sin responsable no es independencia: es una caída esperando la semana más inoportuna.

2. Vercel AI Gateway: el mejor reemplazo gestionado

Vercel AI Gateway es la mejor alternativa gestionada a OpenRouter para un equipo de producto que busca un único endpoint sin margen sobre los tokens. Da acceso a cientos de modelos e incluye presupuestos, seguimiento de uso, balanceo de carga, rutas de respaldo y reintentos automáticos con otros proveedores. La contrapartida está clara: Vercel opera el gateway, por lo que la regla de las dos rutas sigue siendo necesaria.

Documentación de precios de Vercel AI Gateway
Vercel AI Gateway

Un fundador con financiación puede colocar un flujo orientado a clientes detrás de Vercel sin contratar a una persona para operar el gateway. Un equipo que ya use AI SDK dispone de una integración especialmente corta, aunque el gateway también admite API compatibles con OpenAI y Anthropic. Un equipo de plataforma que necesite el gateway dentro de un clúster privado debería optar por LiteLLM o Bifrost.

Ideal para: Startups y equipos de producto que compran enrutamiento gestionado
Punto fuerte: Tokens al precio de lista del proveedor, sin margen del gateway, también con BYOK
Precio: Free incluye un crédito mensual de $5; Paid funciona mediante créditos comprados y pago por uso; Enterprise permite facturación con factura
Prueba gratuita: Plan Free permanente en modelos aptos, con límites inferiores para cada modelo

La documentación de precios actual separa Free de Paid. Free concede a cada equipo $5 de crédito mensual en modelos aptos, cobra las tarifas de lista del proveedor sin margen y aplica límites inferiores específicos de cada modelo. BYOK no está disponible. La compra de créditos traslada al equipo a Paid, abre todo el catálogo de modelos disponible, eleva los límites y elimina el crédito mensual de $5.

Paid mantiene las tarifas de lista del proveedor sin margen sobre los tokens. También añade BYOK, pero exige conservar créditos comprados para el gateway. Si falla una solicitud que usa la credencial del proveedor, Vercel puede reintentar con sus credenciales de sistema y descontar el respaldo de ese saldo. Mejora la disponibilidad, pero puede sorprender al área de compras. Un equipo que use BYOK para consumir un compromiso ya contratado con un proveedor debería revisar la facturación del respaldo antes de que finanzas considere que todas las llamadas son gasto directo.

Los equipos Enterprise pueden acordar la facturación de AI Gateway mediante factura y sin comisiones de procesamiento de pagos. Esa es toda la estructura visible de planes del propio gateway. Los controles opcionales añaden medidores independientes pese al mensaje de margen cero.

Custom Reporting cuesta $0.075 por cada 1,000 escrituras y $5 por cada 1,000 consultas de informes. Una lista de proveedores permitidos para todo el equipo cuesta $0.10 por cada 1,000 solicitudes correctas, mientras que filtrar proveedores por solicitud no tiene costo adicional. La retención cero de datos para todo el equipo cuesta $0.10 por cada 1,000 solicitudes; la opción por solicitud no tiene costo extra en Pro y Enterprise. Trace Drains cuesta $0.05 por cada 1,000 trazas más $0.50 por GB de salida.

Con un millón de solicitudes, la lista permitida para todo el equipo, la retención cero de datos para todo el equipo y una traza por solicitud suman $250 más la salida de las trazas. Es una cantidad modesta frente a muchas facturas de modelos, pero suficiente para presupuestarla. No se trata de que Vercel oculte cargos; su documentación es explícita. La cuestión es que «sin margen sobre tokens» no significa «sin costo de plataforma».

El límite para producción es el control del despliegue. La documentación de Vercel describe un endpoint gestionado, no un proceso de gateway que el cliente pueda ejecutar en su propia red. Esa es la ventaja para un equipo pequeño y el impedimento para quien exige un límite estricto de despliegue privado.

Lo bueno
Lo que hace bien
9 points

  • Margen cero sobre tokens en Free, Paid y el uso de BYOK
  • Crédito Free mensual de $5 para una evaluación acotada
  • Cientos de modelos con balanceo de carga, respaldos, presupuestos y seguimiento de uso
  • El equipo no tiene que operar ciclos de actualización del proxy, la base de datos ni el gateway
  • Rutas oficiales de API compatibles con OpenAI y Anthropic
  • No hay un plan documentado para alojar el gateway en infraestructura propia
  • BYOK exige comprar créditos
  • Las llamadas BYOK fallidas pueden recurrir a credenciales facturables de Vercel
  • Los medidores de informes, políticas para todo el equipo y trazas quedan fuera del precio de los tokens

Vercel queda por debajo de LiteLLM porque sustituye OpenRouter por otra dependencia gestionada. Supera a las demás opciones gestionadas porque el margen cero sobre tokens deja una partida recurrente de gateway especialmente clara. Si se conserva un adaptador directo a un proveedor, esa dependencia se convierte en una decisión operativa práctica y no en cautividad.

3. Portkey: la mejor opción para gobernanza empresarial

Portkey es la mejor alternativa a OpenRouter cuando la gobernanza es el motivo de la compra y no un complemento. Su API universal combina respaldos, balanceo de carga, reintentos, observabilidad, gestión de prompts, caché y barreras de seguridad. Sus planes públicos también delimitan con una claridad poco habitual las necesidades de prototipo, producción y empresa.

Página de precios de Portkey con los planes Developer, Production y Enterprise
Portkey

El CTO de una empresa mediana con varias aplicaciones puede usar Portkey para centralizar claves, registros, prompts, gasto y gestión de fallos sin operar un gateway de código abierto. Una organización grande puede avanzar hacia una nube privada o alojamiento en VPC con controles de identidad y cumplimiento. Un desarrollador independiente que paga por una aplicación pequeña no debería comprar un plano de control empresarial antes de demostrar que el flujo lo necesita.

Ideal para: Organizaciones que centralizan políticas, identidad, retención y soporte
Punto fuerte: Un plan Production público de $49 con una vía Enterprise de despliegue privado
Precio: Developer $0; Production $49 al mes más excesos de registros; Enterprise personalizado
Prueba gratuita: Developer es gratuito para siempre para prototipos y evaluación

La página de precios activa de Portkey indica que Developer no es adecuado para cargas de producción. Registra 10,000 eventos al mes, conserva los registros durante tres días y las métricas durante 30 días. Las funciones del gateway sirven para una prueba de concepto, pero la retención y la propia advertencia del proveedor dejan claro el punto final del plan.

Production cuesta $49 al mes. Incluye 100,000 registros almacenados, cobra $9 por cada 100,000 adicionales, conserva los registros durante 30 días y las métricas durante 90 días. Con un millón de registros almacenados, el precio es de $130 al mes: una base de $49 más nueve bloques adicionales de $9. El proveedor también advierte que este plan no se recomienda para organizaciones que requieren controles de seguridad personalizados o garantías de residencia de datos.

Enterprise utiliza precios personalizados y parte de 10 millones o más de registros almacenados al mes. Añade retención personalizada de registros y métricas, integraciones personalizadas de barreras de seguridad, SSO, presupuestos y límites de velocidad granulares, nube privada, alojamiento en VPC, exportación a un lago de datos, cumplimiento avanzado, acuerdos personalizados, incorporación dedicada y soporte prioritario.

Ese empaquetado es el motivo para comprar Portkey. Una empresa con diez flujos de IA no solo necesita una URL base. Debe responder quién puede llamar a qué modelos, quién gastó el dinero, qué versión del prompt se ejecutó, dónde residen los registros, qué barrera bloqueó una salida y quién responde cuando falla el gateway. Portkey reúne esas preguntas en una sola plataforma y una única relación de soporte.

La limitación es el alcance de la compra. La misma superficie de control que reduce la fragmentación en una empresa puede introducir trámites innecesarios para una sola aplicación. Production es asequible, pero los requisitos de seguridad y residencia que suelen motivar la compra de un gateway trasladan al cliente a los precios personalizados de Enterprise. Hay que calcular el precio para la organización en la que se convertirá la empresa, no solo para el volumen actual de solicitudes.

Lo bueno
Lo que hace bien
9 points

  • Rutas Free para evaluación, Production público de $49 y Enterprise personalizado
  • Respaldos, reintentos, balanceo de carga, caché, barreras de seguridad y observabilidad en un solo producto
  • Límites claros de registros, retención y cargos por exceso
  • Opciones de nube privada y VPC para clientes Enterprise
  • Identidad, presupuestos, exportación de datos y soporte para varias aplicaciones
  • Developer está explícitamente marcado como no apto para producción
  • Production no se recomienda cuando hay requisitos personalizados de seguridad o residencia
  • El precio de Enterprise no es público
  • Los equipos pequeños pueden pagar por controles organizativos que no usarán

Portkey queda tercero porque resuelve un problema empresarial mayor que el enrutamiento. Es una ventaja cuando las políticas y la rendición de cuentas frenan la adopción. Se convierte en peso de plataforma cuando el trabajo inmediato consiste simplemente en colocar tres modelos detrás de un endpoint.

4. Cloudflare AI Gateway: la mejor opción para entornos Cloudflare

Cloudflare AI Gateway es la mejor alternativa de bajo costo a OpenRouter cuando Cloudflare ya gestiona el borde, la seguridad o el entorno Workers de la aplicación. Sus funciones básicas de analítica, caché y limitación de velocidad son gratuitas en todos los planes, y Dynamic Routing permite aplicar rutas condicionales, repartos de tráfico, límites de velocidad, topes presupuestarios y respaldos.

Precios y límites de registros de Cloudflare AI Gateway
Cloudflare AI Gateway

Una startup que ya despliega en Workers puede sumar visibilidad y enrutamiento de modelos sin otra suscripción. Un equipo más grande puede conectar DLP, registros y enrutamiento con su modelo operativo actual de Cloudflare. Una empresa que adopte Cloudflare únicamente para evitar una pequeña comisión de gateway podría generar más trabajo de cuentas y plataforma del que ahorra.

Ideal para: Equipos que ya usan productos de red, seguridad o Workers de Cloudflare
Punto fuerte: Gateway base de $0, análisis DLP gratuito y rutas dinámicas versionadas
Precio: Base $0; Unified Billing añade un 5% a los créditos comprados; Workers y las barreras de seguridad adyacentes pueden generar cargos
Prueba gratuita: Las funciones básicas siguen siendo gratuitas en lugar de caducar

La documentación de precios de Cloudflare indica que el gateway base está disponible gratis en todos los planes. Workers Free almacena 100,000 registros en total entre todos los gateways de la cuenta. Workers Paid almacena 10 millones de registros por gateway. El análisis DLP es gratuito, aunque una cuenta sin suscripción a Zero Trust solo recibe dos perfiles DLP predefinidos.

Unified Billing aplica una comisión del 5% a los créditos comprados mediante Cloudflare y traslada las tarifas de inferencia del proveedor sin margen. Por tanto, una compra mensual de $50,000 en créditos genera una comisión de Cloudflare de $2,500. BYOK sigue otra ruta: la comisión del 5% sobre la compra de créditos no se aplica porque el proveedor del modelo factura la clave propia.

La página de límites actual muestra una restricción importante. Las solicitudes que emplean credenciales gestionadas por Cloudflare mediante Unified Billing están limitadas a 200 solicitudes por cada 60 segundos y por gateway, y reciben un error 429 cuando superan esa tasa. El límite no afecta al tráfico BYOK. Una aplicación de consumo que promedie cuatro solicitudes por segundo ya rebasa 200 por minuto, así que Unified Billing exige comprobar expresamente la capacidad antes del lanzamiento.

Otros límites documentados son 500 registros almacenados por segundo y por gateway, 25 MB por solicitud apta para caché, un TTL de caché de un mes, cinco entradas de metadatos personalizados por solicitud, 10 gateways en el plan gratuito y 20 en el plan de pago. Estas cifras bastan para muchas aplicaciones, pero deben tratarse como datos de arquitectura y no descubrirse durante un incidente.

Dynamic Routing va más allá de una simple lista de respaldos. Puede bifurcar según la solicitud o los metadatos personalizados, repartir tráfico por porcentaje, aplicar límites de solicitudes o presupuesto, elegir un respaldo, guardar versiones, desplegar una versión y revertirla. Resulta útil para enrutar por nivel de cliente, cambiar de modelo gradualmente y ejecutar experimentos controlados. También hace que la política de enrutamiento pase a ser configuración de Cloudflare, por lo que conviene exportar y documentar la intención de cada ruta.

La limitación es el encaje con el resto de la plataforma. Cloudflare resulta convincente cuando un equipo ya domina sus cuentas, seguridad, registros, planes Workers y modelo de despliegue. Lo es menos cuando todos esos conceptos son nuevos y la aplicación solo necesita un endpoint gestionado para modelos.

Lo bueno
Lo que hace bien
9 points

  • Analítica, caché y limitación de velocidad básicas gratuitas en todos los planes
  • Análisis DLP gratuito con dos perfiles predefinidos fuera de Zero Trust
  • Controles condicionales, porcentuales, de tasa, presupuesto, respaldo, versión y reversión
  • Buen encaje con operaciones existentes de borde y seguridad en Cloudflare
  • BYOK evita la comisión sobre créditos de Unified Billing y su límite de solicitudes
  • Unified Billing añade un 5% a los créditos comprados
  • Unified Billing tiene un tope de 200 solicitudes por cada 60 segundos y por gateway
  • El almacenamiento gratuito se detiene en 100,000 registros para toda la cuenta
  • Los costos adyacentes de Workers, barreras de seguridad, Logpush y Zero Trust pueden sumarse a la infraestructura

Cloudflare ocupa el cuarto lugar porque su mejor combinación de precio y control depende de un contexto previo de Cloudflare. Dentro de ese contexto puede ser la ruta competente más barata de la lista. Fuera de él, Vercel o Requesty suele exigir una decisión de adopción menor.

5. Requesty: el reemplazo más cercano con precio por uso

Requesty es la alternativa a OpenRouter más parecida para un equipo pequeño que busca enrutamiento gestionado, un catálogo amplio y una comisión vinculada directamente al uso de modelos. Pay as you go ofrece 600+ modelos de 20+ proveedores e incluye BYOK, políticas de enrutamiento, caché, respaldos, controles presupuestarios, un MCP Gateway, residencia de datos en la UE, observabilidad avanzada y soporte por correo electrónico.

Página de precios de Requesty con los planes Free, Pay as you go y Enterprise
Requesty

Una startup puede comenzar con modelos gratuitos, pasar a un margen del 5% cuando llegue el tráfico de pago y evitar una decisión sobre puestos o suscripciones. Un equipo de SaaS B2B con clientes europeos quizá valore la residencia de datos en la UE antes que el catálogo. Una empresa con gasto estable y elevado en tokens, además de una persona responsable de plataforma, debería comparar el porcentaje con LiteLLM o Bifrost antes de aceptarlo de forma indefinida.

Ideal para: Equipos pequeños que prefieren un porcentaje gestionado a una suscripción
Punto fuerte: Sin cargo por puesto ni gasto mínimo, con enrutamiento y residencia en la UE en toda la oferta
Precio: Free $0; Pay as you go añade un 5%; Enterprise personalizado
Prueba gratuita: Plan Free con 200 solicitudes diarias en modelos gratuitos y sin tarjeta de crédito

La página de precios activa de Requesty concreta el modelo: un modelo cuyo proveedor cobra $10 por millón de tokens cuesta $10.50 mediante Requesty. Free ofrece la plataforma completa con modelos gratuitos, permite 200 solicitudes al día e incluye enrutamiento, caché, respaldos, seguimiento del gasto, analítica y residencia de datos en la UE.

Pay as you go no tiene precio por puesto ni gasto mínimo. El margen del 5% incluye los 600+ modelos, los 20+ proveedores, BYOK, políticas de enrutamiento, caché, respaldos, límites de gasto, topes presupuestarios, un MCP Gateway, residencia de datos en la UE, observabilidad avanzada y soporte por correo electrónico. Con $5,000 de costo mensual de modelos, la comisión es de $250. Con $50,000, asciende a $2,500.

Enterprise utiliza precios personalizados. Añade SSO mediante Okta, Azure AD, Google Workspace u OIDC personalizado; RBAC completo; registros de auditoría; modelos y políticas aprobados; controles de gasto por equipo; barreras de seguridad; detección de PII; cuentas de servicio para CI/CD; soporte dedicado y SLA personalizados.

El porcentaje es fácil de aprobar mientras el tráfico es incierto. Ese mismo porcentaje se convierte en la limitación cuando el uso se estabiliza. Con el costo operativo ilustrativo de $1,800 al mes para el alojamiento propio, la comisión del 5% de Requesty alcanza el punto de equilibrio con $36,000 de gasto mensual en modelos. El cliente puede seguir con el servicio gestionado por encima de ese punto si el trabajo de plataforma ahorrado vale más de $1,800, pero debe revisar la decisión en lugar de dejar que el costo se acumule sin examen.

Requesty no es una copia perfecta de OpenRouter, y eso es positivo. Su catálogo es suficientemente amplio para la mayoría de los equipos de producto, mientras que sus diferencias más claras son los controles de enrutamiento, la gestión presupuestaria, la observabilidad y la residencia en la UE. Si la tarea principal consiste en descubrir el endpoint del modelo desconocido más reciente, los 500+ modelos y 80+ proveedores de OpenRouter siguen siendo difíciles de superar. Si la tarea es operar un conjunto aprobado con un porcentaje algo menor, Requesty resulta más fácil de justificar.

Lo bueno
Lo que hace bien
9 points

  • Sin suscripción, cargo por puesto ni gasto mínimo en Pay as you go
  • 600+ modelos de 20+ proveedores
  • Enrutamiento, caché, respaldos, presupuestos, BYOK y acceso MCP en la ruta de pago
  • La residencia de datos en la UE se incluye en toda la oferta
  • Opción Enterprise para identidad, auditoría, políticas, controles de PII y SLA
  • La comisión del 5% aumenta directamente con el gasto en modelos
  • El precio de Enterprise no es público
  • El tráfico Free se limita a modelos gratuitos y 200 solicitudes diarias
  • El catálogo es menos amplio que el mercado actual de OpenRouter, con 500+ modelos y 80+ proveedores

Requesty queda quinto porque es un reemplazo gestionado sencillo, pero carece tanto de la ventaja de margen cero de Vercel como de la profundidad organizativa de Portkey. Para un equipo pequeño que busca un modelo de compra similar al de OpenRouter con un porcentaje algo inferior, aun así puede ser la opción correcta más sencilla.

6. Bifrost: la mejor alternativa ligera en infraestructura propia

Bifrost es la mejor alternativa ligera y alojada en infraestructura propia a OpenRouter cuando importan más el comportamiento explícito de los reintentos y OpenTelemetry que el tamaño del ecosistema. Su plan OSS de $0 puede ejecutarse como Docker, Kubernetes o un binario de Go y agrupa 1,000+ modelos detrás de una API con observabilidad, presupuestos, límites, claves virtuales, enrutamiento personalizado, respaldos, caché y un gateway MCP.

Página de precios de Bifrost con los planes OSS y Enterprise
Bifrost

Un equipo de plataforma que prefiera un servicio nativo de Go puede integrar Bifrost en sus estándares actuales de contenedores o Kubernetes sin pagar un porcentaje sobre los tokens. Un desarrollador sénior puede inspeccionar la ruta de reintentos en lugar de aceptar un respaldo opaco. Una empresa sin responsable del gateway no debería elegirlo solo porque la licencia dice que es gratuito.

Ideal para: Equipos de plataforma que quieren una superficie de enrutamiento propia más pequeña
Punto fuerte: Comportamiento documentado de reintentos, rotación de claves, respaldos y telemetría
Precio: OSS $0; Enterprise personalizado
Prueba gratuita: Prueba Enterprise de 14 días

La página de precios de Bifrost incluye en OSS reglas y flujos de enrutamiento personalizados, métricas y trazas de OpenTelemetry, observabilidad integrada, presupuestos y límites por clave virtual, respaldos, caché simple y semántica, un gateway MCP, métricas de Prometheus y varias formas de despliegue. Enterprise añade barreras de seguridad, modo clúster, balanceo de carga adaptativo, SAML y OIDC, integración con bóvedas, exportación de registros, registros de auditoría, RBAC, despliegue en VPC, despliegue local, operación aislada de Internet, SLA personalizados y soporte dedicado.

El precio es sencillo porque el modelo operativo no lo es. OSS es gratuito para siempre. Enterprise tiene precio personalizado. Fuera de la licencia, la organización paga el servicio, la base de datos o el estado que requiera, la telemetría, los secretos, el cómputo, las actualizaciones y las guardias.

La documentación de reintentos de Bifrost es un motivo para considerarlo. El número máximo predeterminado de reintentos es cero. Cuando se activan, la espera comienza en 500 milisegundos y tiene un tope de 5,000 milisegundos. Los fallos de red y 5xx reutilizan la clave del proveedor con espera progresiva. Los fallos de credenciales y facturación pueden rotar las claves. La solicitud pasa a un respaldo solo después de que el modelo principal agota su presupuesto de reintentos, y cada respaldo recibe su propio presupuesto completo.

Esa claridad también revela la limitación. Un número elevado de reintentos combinado con varios respaldos puede transformar la caída de un proveedor en una demora larga para el usuario y varios intentos facturados. Una respuesta de respaldo también puede ser correcta en sintaxis, pero incumplir las expectativas de esquema, herramientas o datos de la aplicación. Establezca un límite total de latencia para toda la cadena, deténgase ante fallos de política y mantenga los modelos principal y de respaldo compatibles con el contrato del flujo.

Bifrost compite de forma más directa con LiteLLM. LiteLLM gana por la familiaridad de su ecosistema y un plano de control más amplio y consolidado. Bifrost gana cuando su despliegue en Go, el detalle de los reintentos, su enfoque de OTel o una superficie operativa menor encajan mejor con el estándar de plataforma. Ambos pierden frente a un gateway gestionado cuando no existe una persona responsable.

Lo bueno
Lo que hace bien
9 points

  • Plan OSS de $0 con despliegue como Docker, Kubernetes y binario de Go
  • 1,000+ modelos con claves, presupuestos, enrutamiento, respaldos, caché y telemetría
  • Comportamiento específico y documentado de reintentos y respaldos
  • OpenTelemetry y Prometheus encajan con la supervisión de plataforma existente
  • Opción Enterprise para clústeres, identidad, bóvedas, despliegue privado y soporte
  • El equipo se responsabiliza de la disponibilidad, las actualizaciones, los secretos, la telemetría y los incidentes
  • El precio de Enterprise no es público
  • Los presupuestos de reintentos y respaldos pueden multiplicar la latencia y el costo
  • Ecosistema e historial operativo más reducidos que los de LiteLLM

Bifrost queda sexto porque es un especialista sólido, no un producto inferior. Supera a LiteLLM cuando la semántica explícita de reintentos y una huella nativa de Go determinan el despliegue. Queda detrás cuando el equipo valora más el ecosistema mayor de LiteLLM o quiere un servicio gestionado.

¿Qué gateway de IA conviene en cada caso?

Elija la ruta cuya limitación más difícil coincida con una capacidad que la organización ya financia. Un gateway en infraestructura propia solo es barato cuando ya existe responsabilidad de plataforma. Un gateway gestionado solo ofrece independencia cuando la aplicación puede evitarlo. La gobernanza empresarial solo aporta valor cuando alguien debe aplicar y auditar la política.

Elija LiteLLM para una empresa de producto con una persona responsable de plataforma, estándares existentes de despliegue y supervisión y, además, un requisito estricto sobre la ruta de datos o un gasto mensual en modelos cercano al punto de equilibrio indicado de $32,727. Bifrost pasa a ser preferible cuando Go, OpenTelemetry y la semántica explícita de reintentos encajan mejor con la plataforma.

Elija Vercel AI Gateway para una startup o un equipo de producto que necesita un endpoint gestionado y no quiere margen sobre los tokens. Cloudflare pasa a ser preferible cuando ya controla el borde y la infraestructura de seguridad, y Requesty cuando la residencia de datos en la UE y un modelo simple del 5% importan más que la estructura de complementos de Vercel.

Elija Portkey para una empresa mediana o grande que necesita gestionar identidad, retención, prompts, barreras de seguridad, opciones de despliegue privado y soporte entre varias aplicaciones. LiteLLM o Bifrost pasan a ser preferibles cuando la empresa debe controlar el proceso del gateway y ya financia al equipo capaz de hacerlo.

Elija Cloudflare AI Gateway cuando sus funciones básicas gratuitas, DLP, registros, rutas dinámicas y contexto de Workers consoliden tareas que el equipo ya opera. Conviene abandonar Unified Billing cuando el tráfico máximo pueda superar 200 solicitudes por minuto y por gateway; BYOK elimina ese límite documentado.

Elija Requesty mientras un tráfico incierto haga más sencillo aprobar un porcentaje que un proyecto de plataforma. Revise la decisión en torno a $36,000 de gasto mensual en modelos según la hipótesis operativa indicada. La comisión puede seguir siendo la elección correcta por encima de esa cifra, pero debe decidirse de forma deliberada.

Flujo de decisión entre gateways gestionados, alojados en infraestructura propia y orientados a gobernanza
Primero determine quién opera la ruta; después elija la estructura de precio y políticas

La condición explícita para cambiar cabe en una frase: cambie de gateway cuando una comisión medida, un límite de despliegue, una carencia de políticas o un modo de fallo cuesten más que la migración y la operación continua de la siguiente opción. No hay que mudarse porque Stripe haya comprado una empresa, sino porque la nueva ruta gane una decisión operativa documentada.

Opciones que conviene evitar como única ruta

Evite cualquier opción que concentre una carga crítica sin una vía alternativa probada. Todos los productos siguientes pueden ser buenas elecciones. Cada uno se vuelve una mala ruta única al cruzar un límite concreto.

Evite OpenRouter como única ruta durante la transición de propiedad. Sus precios actuales siguen ofreciendo 500+ modelos, 80+ proveedores, enrutamiento sofisticado y franquicias BYOK útiles. El problema no es predecir que Stripe lo empeorará, sino que el acceso, el enrutamiento, la facturación y las políticas ya se concentran detrás de una cuenta. Manténgalo si justifica la comisión, pero conserve una vía directa al proveedor.

Evite LiteLLM o Bifrost sin una persona responsable. Una licencia gratuita no aplica parches al proxy, protege la base de datos, rota credenciales, ajusta reintentos, investiga incidentes ni actualiza el comportamiento de los proveedores. Si la responsabilidad recae en quien haya tocado la configuración por última vez, elija un gateway gestionado.

Evite Portkey Developer en producción. El proveedor lo marca explícitamente como inadecuado para producción, limita los registros almacenados a 10,000 al mes y los conserva durante tres días. Production comienza en $49. Enterprise es la ruta pertinente cuando se necesitan controles de seguridad personalizados, residencia de datos, despliegue privado o cumplimiento más avanzado.

Evite Cloudflare Unified Billing como única ruta de alto rendimiento cuando el pico de tráfico pueda superar 200 solicitudes por cada 60 segundos y por gateway. BYOK está exento de ese límite documentado, de modo que la solución puede ser cambiar la facturación en lugar del gateway.

Evite un proxy casero de URL base cuando dependa de él más de una aplicación. El streaming, la normalización de errores, los parámetros específicos de cada proveedor, los presupuestos de reintentos, los esquemas de herramientas, los presupuestos, el aislamiento de claves, los registros y las retiradas de funciones forman un producto interno que exige mantenimiento. Solo hay que construirlo cuando una política o unos costos únicos justifiquen su propiedad permanente.

Preguntas frecuentes

¿Existe algo mejor que OpenRouter?

LiteLLM es mejor cuando se necesita un gateway alojado y controlado por la propia aplicación. Vercel AI Gateway es mejor cuando lo principal es la gestión externa sin margen sobre los tokens. OpenRouter sigue siendo superior por amplitud de mercado, con 500+ modelos y 80+ proveedores en sus planes de pago actuales.

¿Qué proveedores de IA se parecen a OpenRouter?

Vercel AI Gateway, Requesty, Cloudflare AI Gateway, Portkey, LiteLLM y Bifrost ofrecen funciones coincidentes de enrutamiento multiproveedor. Vercel, Requesty, Cloudflare y Portkey son opciones gestionadas; LiteLLM y Bifrost son las alternativas más sólidas para infraestructura propia.

¿Hay una versión gratuita de OpenRouter?

Sí. OpenRouter Free incluye actualmente 25+ modelos gratuitos de cuatro proveedores y 50 solicitudes diarias. Es una vía de evaluación, no capacidad de producción garantizada.

¿Cómo gana dinero OpenRouter?

OpenRouter Pay-as-you-go aplica una comisión de plataforma del 5.5%. Enterprise ofrece descuentos en la comisión y compromisos de volumen personalizados. BYOK no paga comisión hasta $25,000 de inferencia mensual a precio de lista en Pay-as-you-go o $200,000 en Enterprise; después cuesta un 5% sobre el exceso.

¿Puedo usar Claude Code con OpenRouter?

Sí, siempre que el cliente admita una URL base y una configuración de modelo compatibles. Se mantiene la misma advertencia que con cualquier integración de gateway: si se busca una salida limpia, no conviene dispersar nombres de modelos o encabezados específicos de OpenRouter por la lógica del repositorio.

La tarea del lunes: construir la vía alternativa antes de reemplazar el gateway

No empiece la próxima semana con una migración total. Construya una vía directa a un proveedor, pruébela en un flujo acotado y después decida si OpenRouter sigue justificando su comisión. El resultado debe ser una decisión operativa con tiempo y precio medidos, no un diagrama de arquitectura más limpio.

  1. Haga un inventario de una ruta representativa de producción

    Registre el modelo actual del gateway, el proveedor subyacente, la ruta de autenticación, el gasto mensual en modelos, el objetivo de latencia p95, los requisitos de salida estructurada o herramientas, la política de datos y el comportamiento de respaldo para un flujo importante.

  2. Cree un nombre interno para la capacidad

    Sustituya en la lógica de negocio la cadena pública del modelo del gateway por un alias estable como support-primary. Asigne ese alias a OpenRouter en la configuración normal y a un proveedor directo en la configuración alternativa.

  3. Construya el adaptador directo

    Use una cuenta y una clave de proveedor controladas por la empresa. Mantenga los encabezados específicos del proveedor y las diferencias entre solicitudes dentro del adaptador para que el resto de la aplicación reciba el mismo contrato de entrada y salida.

  4. Reproduzca 100 solicitudes depuradas

    Use prompts representativos sin datos de clientes ni información confidencial. Compare la validez del esquema, el comportamiento de las herramientas, las salidas aceptadas, la latencia, los errores de proveedor, los reintentos y el costo total entre el gateway y la ruta directa.

  5. Fuerce el cambio de ruta

    Traslade el flujo acotado al adaptador directo mediante configuración y un despliegue controlado. Cronometre el cambio, compruebe registros y presupuestos y después vuelva a la ruta anterior. Corrija toda dependencia que haya exigido modificar la lógica de negocio.

  6. Tome la decisión presupuestaria

    Mantenga OpenRouter cuando su catálogo, enrutamiento, facturación y gestión de fallos ahorren más que la comisión de plataforma medida. Pase a LiteLLM, Vercel, Portkey, Cloudflare, Requesty o Bifrost solo cuando esa opción gane según el criterio documentado de comisión, políticas, despliegue o fallos.

Para una startup técnica sin una persona responsable de plataforma, el piloto del lunes normalmente debería comparar OpenRouter con Vercel AI Gateway y la ruta directa al proveedor. Para una empresa con responsabilidad de plataforma y un límite privado estricto, conviene comparar LiteLLM con la misma ruta directa. En un programa de gobernanza empresarial, hay que validar Portkey frente a los requisitos de identidad, retención, despliegue, exportación y soporte antes de dirigir tráfico de clientes.

La adquisición es el detonante. La medida duradera es la regla de las dos rutas: un gateway práctico, una vía independiente al proveedor y una razón medida para cada dólar y cada dependencia entre la aplicación y el modelo.

Última actualización

2 sept 2026

CategoríaBuild

Prefiera este sitio en Google

Añadir omidsaffari.com como fuente preferida en la Búsqueda de Google

Marque omidsaffari.com como fuente preferida y Google lo destacará para usted en Top Stories, AI Overviews y AI Mode.

Newsletter

Una carta, cada domingo. Sistemas que funcionan, no opiniones calientes.

Build logs, sistemas en producción y notas de campo de un portafolio de ventures de IA.

Semanal. Sin spam. Cancele cuando quiera.