API de inteligencia artificial: los 10 mejores gateways para aplicaciones con varios modelos en 2026

Compara 10 gateways para una API de inteligencia artificial en 2026: precios, enrutamiento, gobernanza, autohospedaje y opciones para startups y empresas.

Thursday, September 3, 2026Omid Saffari
API de inteligencia artificial: los 10 mejores gateways para aplicaciones con varios modelos en 2026

LiteLLM es el mejor gateway en términos generales para una API de inteligencia artificial multimodelo cuando hay un responsable de plataforma capaz de operarlo; Vercel AI Gateway es la mejor opción administrada por defecto. El acuerdo, valorado en más de $8 mil millones, por el que Stripe adquiriría OpenRouter deja claro el requisito decisivo: una aplicación en producción necesita un gateway que pueda eludir sin tener que reescribirse.

Axios informó el 17 de agosto de 2026 que Stripe había acordado adquirir OpenRouter por más de $8 mil millones en efectivo y acciones. También indicó que las empresas no habían hecho comentarios y que aún se esperaba un anuncio oficial. La distinción importa, pero la lección operativa no depende de que la operación se cierre: un gateway solo elimina la dependencia de los proveedores de modelos si no se convierte en la siguiente dependencia.

Respuesta rápida: ¿qué gateway elegir para una API de inteligencia artificial?

Elija LiteLLM si busca control, Vercel AI Gateway si prioriza la sencillez administrada, Portkey para la gobernanza empresarial y OpenRouter únicamente cuando la amplitud del catálogo compense una comisión porcentual y la dependencia de otro proveedor. Un gateway de IA es la capa de solicitudes situada entre la aplicación y los proveedores de modelos. Puede normalizar API, custodiar credenciales, enrutar tráfico, reintentar solicitudes fallidas, registrar costos y aplicar políticas.

Los precios y límites de producto que aparecen a continuación se verificaron en las páginas activas de cada proveedor el 18 de agosto de 2026. La clasificación abarca 10 productos y evalúa cada opción por el obstáculo real que encontrará un comprador en producción, no por la cantidad de etiquetas de funciones que quepan en una tarjeta.

HerramientaIdeal paraPrecio inicialPrueba gratuita
LiteLLMPlano de control gestionado por la aplicación$0 OSS; Enterprise personalizadoPrueba Enterprise de 30 días
Vercel AI GatewayEquipos de producto que prefieren un servicio administrado$5 de crédito gratuito mensual; sin recargo por tokensNivel Free permanente
PortkeyGobernanza empresarial administradaDeveloper por $0; Production por $49/mesNivel Developer gratuito
Cloudflare AI GatewayControl en el edge dentro de CloudflareFunciones base por $0; Unified Billing añade 5%Funciones principales gratuitas
OpenRouterAcceso amplio a modelos y proveedoresFree por $0; Pay as you go añade 5.5%Nivel Free
BifrostControl explícito de reintentos en OSS$0 OSS; Enterprise personalizadoPrueba Enterprise de 14 días
HeliconeEquipos que anteponen la observabilidadHobby por $0; Pro por $79/mesPrueba Pro y Team de 7 días
Braintrust GatewayDecisiones de lanzamiento guiadas por evaluacionesStarter por $0; Pro por $249/mesGateway gratuito durante la beta
RequestyEnrutamiento administrado sencilloFree por $0; Pay as you go añade 5%Nivel Free, sin tarjeta
Kong AI GatewayEntornos que ya usan KongPlano de control serverless por $25/mes más $100/modeloPrueba de 30 días

La primera decisión no depende del número de funciones, sino de quién controla la ruta de las solicitudes. Un gateway autohospedado mantiene el proceso, las credenciales, la base de datos, los registros y las políticas en su entorno, pero deja las alertas en manos de su equipo. Un servicio administrado elimina esa carga operativa; a cambio, sus caídas, cambios de precio, adquisiciones y hoja de ruta pasan a formar parte de cada llamada a un modelo.

El umbral de costos es más nítido de lo que sugieren las páginas de funciones. Supongamos que un gateway autohospedado consume ocho horas mensuales del equipo de plataforma, a un costo total de $150 por hora. El resultado es un costo operativo ilustrativo de $1,200 al mes, no una cotización de un proveedor. Una comisión de 5.5% alcanza $1,200 cuando el gasto mensual en modelos llega a $21,818; una comisión de 5% lo hace al llegar a $24,000.

Comisiones de gateways con un gasto mensual de veinte mil dólares en modelos
Las comisiones porcentuales siguen por debajo del costo ilustrativo del autohospedaje con $20,000, pero la diferencia se cierra rápidamente

Ese cálculo solo cubre la partida presupuestaria. Un límite de despliegue, una ruta de datos regulada, un contrato con un proveedor o una trazabilidad de auditoría obligatoria pueden justificar el autohospedaje mucho antes del punto de equilibrio financiero. En el otro extremo, una startup pequeña no debería crear una tarea interna de plataforma para ahorrarse una comisión inferior al costo de una jornada de ingeniería.

Por qué un gateway de IA ya es una partida presupuestaria y un plan de salida

Un gateway aporta valor porque los modelos cambian con rapidez, pero se vuelve peligroso cuando la aplicación ya no puede funcionar sin él. La información sobre OpenRouter llega menos de tres meses después de que Palo Alto Networks cerrara la adquisición de Portkey y anunciara que Portkey se convertiría en una pieza central de Prisma AIRS. Dos planos de control independientes pueden integrarse en plataformas mayores durante un mismo trimestre. Los compradores deberían asumir que habrá cambios de propiedad en esta categoría, no tratarlos como casos excepcionales.

La consecuencia empresarial es la concentración. Una aplicación multimodelo puede recurrir a OpenAI para un flujo de trabajo, a Anthropic para otro y a un modelo abierto para una tarea de fondo de gran volumen. Colocar los tres detrás de un único gateway simplifica el código, la facturación, las políticas y la observabilidad. También permite que un solo cambio de precio o de política afecte a los tres a la vez.

El patrón seguro tiene tres capas:

  • Un cliente de modelos interno define el pequeño conjunto de operaciones que necesita la aplicación, como generación de texto, salida estructurada, embeddings y uso de herramientas.
  • Un adaptador del gateway traduce esas operaciones al gateway elegido sin propagar encabezados específicos del gateway por el resto del código.
  • Un adaptador directo al proveedor se mantiene configurado y documentado, aunque no reciba tráfico habitual de producción.

Esta estructura crea lo que esta guía denomina la salida en 10 minutos: un operador debería poder desviar una carga de producción para evitar el gateway mediante configuración y un despliegue controlado, sin modificar la lógica de negocio. Diez minutos es un objetivo operativo editorial, no un SLA de proveedor. Si evitar el gateway exige reescribir el cliente, diseñar de nuevo la identidad o migrar todos los nombres de modelos, el gateway controla una parte mayor de la aplicación que los propios proveedores.

Por eso también hay que examinar con cuidado funciones como el fallback automático. Un fallback solo resulta útil si conserva el protocolo de respuesta, el esquema de herramientas, la política de datos y el límite de costos que espera la aplicación. Una respuesta HTTP correcta procedente de otro modelo puede seguir siendo un fallo de aplicación si cambia la salida estructurada o si la llamada a una herramienta es incompatible.

Para profundizar en la capa de inferencia situada bajo el gateway, la comparativa de las API de IA más baratas separa el precio del modelo de la comisión de enrutamiento. Si el caso de uso inmediato son herramientas para desarrolladores y no una aplicación orientada a clientes, la guía específica sobre gateways de IA para agentes de programación aborda la configuración de estos agentes y la atribución en repositorios.

Cómo elegimos estos gateways para una API de inteligencia artificial

La clasificación premia la reversibilidad y el encaje operativo antes que la cantidad de modelos. Un catálogo con cientos de modelos es útil durante la exploración, pero pierde casi toda su relevancia cuando una aplicación en producción estandariza tres rutas aprobadas.

Cada gateway se evaluó según cinco criterios:

  1. Portabilidad: ¿Puede la aplicación conservar sus propias cuentas de proveedor, nombres de modelo, políticas y ruta directa?
  2. Resiliencia determinista: ¿Pueden los operadores controlar los reintentos, el orden de los proveedores, el comportamiento de fallback y las condiciones que detienen una solicitud?
  3. Visibilidad de costos: ¿Es posible atribuir el gasto a una aplicación, un cliente, un equipo o una clave, y prever la comisión a partir de precios públicos?
  4. Límite de gobernanza: ¿Puede el gateway cumplir los requisitos de despliegue, identidad, retención, auditoría y residencia de datos de quien lo compra?
  5. Madurez operativa: ¿El gateway está disponible de forma general, cuenta con soporte y observabilidad, y tiene un precio acorde con la etapa en la que se utilizará?

Este trabajo consistió en verificar precios y documentación, no en disfrazar una prueba de producto. No se afirma haber realizado despliegues en vivo, pruebas de carga ni suscripciones. Cada nivel, límite y capacidad concreta procede de una página del proveedor consultada el 18 de agosto de 2026; las comparaciones de costos son operaciones aritméticas aplicadas a esos datos.

La selección se redujo a productos capaces de situarse hoy en la ruta de solicitudes de una aplicación multimodelo. El catálogo de modelos de un único proveedor de nube aún puede ser la plataforma correcta, pero no constituye un enrutamiento neutral. Un producto que solo existe en una hoja de ruta no puede situarse por encima de un gateway que el comprador puede desplegar y presupuestar ahora.

1. LiteLLM: la mejor opción general para un plano de control propio

LiteLLM es el mejor gateway de IA en términos generales cuando hay un responsable de plataforma designado para operarlo. El proxy de código abierto coloca 100+ proveedores detrás de una única API compatible con OpenAI e incluye claves virtuales, equipos, seguimiento de gasto, presupuestos, límites de solicitudes, fallbacks, registros de solicitudes y respuestas, y métricas de Prometheus.

Comparación de precios y planes de LiteLLM
LiteLLM

Ideal para: Empresas de producto que necesitan un gateway autohospedado y controlado por la aplicación
Lo más destacado: Amplio soporte de proveedores con presupuestos, claves, fallbacks y métricas en el plan OSS de $0
Precio: Open Source por $0; Enterprise anual y personalizado según capacidad, arquitectura y soporte
Prueba gratuita: Prueba Enterprise de 30 días sin tarjeta de crédito; OSS sigue siendo gratuito

La página de precios activa de LiteLLM delimita claramente el software. Open Source es gratuito para el autohospedaje en producción. Enterprise no se cobra por tokens: su cotización anual depende de la capacidad de solicitudes, la arquitectura de despliegue y las necesidades de soporte. Enterprise añade SSO y SCIM, autenticación mediante OIDC o JWT, registros de auditoría, integraciones con gestores de secretos, rotación de claves, un plano de control multirregión, despliegue aislado y soporte de hasta 24/7.

La etiqueta de $0 es cierta, pero incompleta. El equipo se hace cargo del proxy, Postgres, los secretos, el escalado, las actualizaciones, los cambios en las API de los proveedores, el almacenamiento de registros, los paneles y los incidentes. Con el supuesto ilustrativo de ocho horas a $150, esa responsabilidad cuesta $1,200 al mes antes de sumar la infraestructura. LiteLLM resulta más económico que una comisión de 5.5% cuando el gasto mensual en modelos supera $21,818, aunque un entorno regulado puede elegirlo mucho antes por el control, no por el ahorro.

El inicio rápido documentado con Docker inicia el gateway y Postgres con curl -sSL https://docs.litellm.ai/docker-compose.yml | docker compose -f - up -d y después expone la interfaz administrativa en el puerto 4000. Es una ruta útil para evaluar el producto, no un diseño completo de producción. La misma guía advierte que se debe reemplazar el valor provisional de LITELLM_SALT_KEY antes de añadir credenciales persistentes y que luego no se debe modificar: las claves de proveedor cifradas con el valor anterior no pueden recuperarse con uno nuevo.

El verdadero obstáculo en producción es la ambigüedad sobre la responsabilidad. LiteLLM es un excelente componente de plataforma y un mal proyecto secundario. Si el proxy pertenece a «quien lo añadió», un cambio de proveedor puede convertir a un ingeniero de aplicaciones en el equipo del gateway, sin presupuesto, cobertura de guardia ni política de actualizaciones.

  1. Empiece con un despliegue descartable

    Utilice el inicio rápido documentado con Docker Compose en una cuenta que no sea de producción. Confirme que el gateway y Postgres arrancan, sustituya los secretos provisionales y mantenga este entorno separado del tráfico de clientes.

  2. Exponga dos rutas con nombre

    Añada solo el modelo principal y un fallback compatible. Use alias internos estables como support-primary y support-fallback para que el código de la aplicación no dependa del identificador público de modelo de cada proveedor.

  3. Emita una clave virtual para la aplicación

    Cree una clave virtual para un servicio, con su propio acceso a modelos, presupuesto mensual y límite de solicitudes. No distribuya la clave maestra de LiteLLM entre las cargas de la aplicación.

  4. Conserve un adaptador directo

    Configure el mismo servicio para llamar directamente al proveedor principal mediante un feature flag. La ruta del gateway es la predeterminada; la ruta del proveedor es el bypass probado.

  5. Fuerce el fallo del modelo principal

    Provoque de forma controlada que la ruta quede indisponible, confirme que el fallback aparece en los registros, active después el adaptador directo y mida el tiempo del cambio. Si el bypass no cumple el objetivo de salida en 10 minutos, corrija la abstracción antes de añadir tráfico.

Lo bueno
Lo que hace bien
9 points

  • Licencia OSS de producción por $0 y sin comisión por token del gateway
  • 100+ proveedores detrás de una única API compatible con OpenAI
  • Claves virtuales, presupuestos de equipo, límites de solicitudes, fallbacks, registros y Prometheus en OSS
  • Ruta de datos autohospedada, con opciones Enterprise aisladas y multirregión
  • El precio Enterprise escala por capacidad, no por gasto en modelos
  • El comprador asume la disponibilidad, las actualizaciones, la salud de la base de datos, los secretos y los incidentes
  • El precio Enterprise no es público
  • La comodidad del inicio rápido puede ocultar el trabajo de endurecimiento para producción
  • Un proxy compartido crea un nuevo dominio interno de fallos

2. Vercel AI Gateway: la mejor opción administrada por defecto

Vercel AI Gateway es la mejor opción administrada por defecto para un equipo de producto que quiere un único endpoint sin recargo por tokens. Sus controles de enrutamiento permiten filtrar y ordenar proveedores, definir fallbacks de modelos y elegir el proveedor según los datos recientes de disponibilidad y latencia.

Documentación vigente de precios de Vercel AI Gateway
Vercel AI Gateway

Ideal para: Startups y equipos de producto que valoran una adopción administrada rápida
Lo más destacado: Tokens a precio de lista del proveedor, sin recargo del gateway
Precio: Free incluye $5 de crédito mensual; Paid utiliza créditos adquiridos a precios de lista del proveedor
Prueba gratuita: Nivel Free permanente en los modelos elegibles, con límites inferiores para cada modelo

La página de precios actual separa con claridad los estados gratuito y de pago. Free incluye $5 de crédito al mes. Al comprar créditos, la cuenta pasa a Pay as you go, habilita todos los modelos disponibles, aumenta los límites y deja de recibir ese crédito mensual de $5. Ambos niveles aplican los precios de lista de los proveedores sin recargo por tokens.

Bring Your Own Key solo está disponible después de que la cuenta pase a Paid. Vercel no cobra comisión de gateway por BYOK, pero una solicitud fallida que use su credencial puede reintentarse con credenciales del sistema de Vercel y cargar ese fallback al saldo de créditos del gateway. Este comportamiento mejora la disponibilidad, pero puede romper el supuesto financiero de que todo el consumo permanece dentro de un contrato vigente con el proveedor. Revíselo antes de usar BYOK como atajo de contratación.

La capa de tokens no tiene recargo, pero algunos controles sí tienen costo. Custom Reporting cuesta $0.075 por cada 1,000 escrituras y $5 por cada 1,000 consultas de informes. Una lista de proveedores permitidos para todo el equipo cuesta $0.10 por cada 1,000 solicitudes correctas, mientras que un filtro only a nivel de solicitud no añade costo. La retención cero de datos para todo el equipo también cuesta $0.10 por cada 1,000 solicitudes. Los trace drains cuestan $0.05 por cada 1,000 trazas más $0.50 por GB de egreso.

Con un millón de solicitudes, activar la lista de permitidos para todo el equipo, la retención cero de datos para todo el equipo y una traza por solicitud añade $250 más el egreso de trazas. Sigue siendo una cantidad moderada frente al gasto en modelos de muchas aplicaciones, pero «sin recargo» no significa que «todos los controles sean gratuitos».

El límite está en la propiedad del despliegue. Vercel administra el gateway; usted no ejecuta su plano de datos dentro de su propio clúster. Elíjalo cuando ese límite administrado sea aceptable y la velocidad operativa importe. Elija LiteLLM o Bifrost cuando el despliegue privado sea un requisito, no una preferencia.

Lo bueno
Lo que hace bien
9 points

  • Sin recargo por tokens en el uso de Free, Paid y BYOK
  • $5 de crédito mensual en Free para un piloto acotado
  • Orden y filtrado de proveedores, fallbacks y acceso administrado a modelos
  • Sin operaciones del gateway ni base de datos que administrar
  • Los controles de proveedor y retención cero de datos por solicitud pueden evitar recargos para todo el equipo
  • No hay un proceso de gateway autohospedado
  • BYOK requiere comprar créditos
  • Las llamadas BYOK fallidas pueden pasar a credenciales facturables de Vercel
  • Los informes, las políticas para todo el equipo y los trace drains se facturan por separado

3. Portkey: la mejor opción para la gobernanza empresarial administrada

Portkey es la mejor opción administrada cuando las políticas, los guardrails, los presupuestos y las alternativas de despliegue privado justifican la compra. Su gateway combina una API universal con reintentos, timeouts, fallbacks, balanceo de carga, caché, claves virtuales y observabilidad.

Niveles de precios del gateway de IA de Portkey
Portkey

Ideal para: Equipos medianos y empresariales que compran gobernanza administrada
Lo más destacado: Nivel público para producción y una ruta Enterprise para nube privada y alojamiento en VPC
Precio: Open Source autohospedado; Developer por $0; Production por $49/mes; Enterprise personalizado
Prueba gratuita: Developer es gratuito para siempre en prototipos y evaluaciones

La página de precios delimita los niveles con una claridad poco habitual. Developer registra 10,000 logs al mes, los conserva durante tres días, mantiene las métricas durante 30 días y declara expresamente que no es apto para producción. Production cuesta $49 al mes, incluye 100,000 logs registrados, cobra $9 por cada 100,000 adicionales hasta tres millones, conserva los logs durante 30 días y las métricas durante 90 días.

Con un millón de logs registrados, Production cuesta $130 al mes: la base de $49 más nueve bloques adicionales de $9. El precio sigue siendo accesible para una aplicación en crecimiento. La misma página aclara que Production no se recomienda cuando se requieren controles de seguridad personalizados o garantías de residencia de datos. Esos compradores pasan a Enterprise, con más de 10 millones de logs registrados, retención personalizada, SSO, presupuestos y límites granulares, nube privada, alojamiento en VPC, exportaciones a data lakes y cumplimiento avanzado.

El obstáculo no es la capacidad del producto, sino el alcance de la compra. Una startup que solo necesita una URL base y un fallback obtiene menos valor organizacional del que Portkey está diseñado para aportar. Un equipo de plataforma con varias aplicaciones, una política de modelos aprobados, controles de PII y requisitos de auditoría puede aprovechar esas mismas funciones todas las semanas.

La estructura de propiedad merece una pregunta durante la compra. Palo Alto Networks cerró la adquisición de Portkey el 29 de mayo de 2026 y afirmó que Portkey se convertiría en un gateway de IA central para Prisma AIRS. Esto puede reforzar la integración de seguridad y el soporte empresarial. También puede cambiar el empaquetado y las prioridades de la hoja de ruta. Pregunte qué nombre de producto aparecerá en el contrato, cómo se integran las cuentas independientes con Prisma AIRS y qué ruta de exportación sobrevivirá a una consolidación futura.

Lo bueno
Lo que hace bien
9 points

  • Opciones Open Source, Developer gratuito, Production público por $49 y Enterprise privado
  • Fallbacks, reintentos, timeouts, balanceo de carga, caché, claves y observabilidad
  • Límites claros de logs y retención en los niveles de autoservicio
  • Opciones Enterprise de despliegue y cumplimiento
  • Ejemplo predecible de $130 con un millón de logs registrados
  • Developer no es, de forma explícita, un nivel para producción
  • Production no es el nivel adecuado para garantías personalizadas de seguridad o residencia
  • El precio Enterprise requiere una cotización
  • La integración tras la adquisición abre dudas sobre el empaquetado y la hoja de ruta

4. Cloudflare AI Gateway: el mejor control de bajo costo en el edge

Cloudflare AI Gateway es la mejor opción de bajo costo cuando Cloudflare ya controla el edge, la seguridad o el entorno de ejecución Workers de la aplicación. Las funciones centrales de analítica, caché y limitación de solicitudes son gratuitas en todos los planes.

Documentación de precios de Cloudflare AI Gateway
Cloudflare AI Gateway

Ideal para: Aplicaciones que ya utilizan la red y los controles de seguridad de Cloudflare
Lo más destacado: Funciones base del gateway por $0 con análisis DLP gratuito
Precio: Funciones base por $0; las compras de créditos con Unified Billing añaden 5%; los guardrails usan precios de Workers AI
Prueba gratuita: Las funciones principales siguen siendo gratuitas, sin fecha de vencimiento

La documentación activa de precios de Cloudflare asigna límites concretos de almacenamiento a la oferta gratuita. Workers Free almacena 100,000 logs entre todos los gateways de la cuenta. Workers Paid almacena 10 millones de logs por gateway. El análisis DLP es gratuito, aunque una cuenta sin suscripción a Zero Trust solo recibe dos perfiles DLP predefinidos. La evaluación de guardrails se factura aparte como inferencia de tokens de Workers AI.

Unified Billing cobra 5% al comprar créditos, mientras que los precios de inferencia de terceros se trasladan sin recargo por tokens. Con $20,000 mensuales en créditos adquiridos, la comisión es de $1,000. Ese 5% se aplica a los créditos comprados mediante Unified Billing, no a las funciones base del gateway por $0.

Hay un límite de rendimiento que conviene detectar antes del lanzamiento. La página de límites vigente restringe el tráfico de Unified Billing a 200 solicitudes por cada 60 segundos y por gateway, y devuelve un error 429 al superar esa tasa. El límite no se aplica al tráfico BYOK. Cloudflare también limita los logs almacenados a 500 por segundo y por gateway, las solicitudes almacenables en caché a 25 MB, el TTL de caché a un mes y los metadatos personalizados a cinco entradas por solicitud.

El verdadero obstáculo es el encaje con la plataforma circundante. Cloudflare resulta atractivo cuando el equipo ya conoce su modelo de cuentas, logs, DLP, Workers y comportamiento en el edge. Lo es menos si debe adoptar todos esos conceptos solo para evitar una suscripción de gateway de $49. El gateway con el precio más bajo de la lista puede generar la factura de integración más alta.

Lo bueno
Lo que hace bien
9 points

  • Analítica, caché y limitación de solicitudes en las funciones base por $0
  • Análisis DLP gratuito en todos los planes
  • Gran encaje con operaciones existentes de edge y seguridad de Cloudflare
  • Amplio cupo de logs en el plan de pago
  • BYOK evita el límite de solicitudes de Unified Billing
  • Unified Billing añade 5% a las compras de créditos
  • Unified Billing está limitado a 200 solicitudes por cada 60 segundos y por gateway
  • El nivel gratuito se limita a 100,000 logs para toda la cuenta
  • Los guardrails y los perfiles DLP adicionales pueden generar costos en productos adyacentes

5. OpenRouter: el mejor marketplace de modelos, pero no la ruta única más segura

OpenRouter es el mejor gateway cuando la amplitud de modelos y proveedores sigue siendo una cuestión abierta. Su plan Pay as you go reúne 400+ modelos de 80+ proveedores bajo una sola cuenta.

Niveles de precios y comisiones del gateway OpenRouter
OpenRouter

Ideal para: Explorar modelos rápidamente, comparar proveedores y acceder a un catálogo amplio
Lo más destacado: Enrutamiento granular de proveedores por precio, rendimiento, latencia, política y disponibilidad
Precio: Free por $0; Pay as you go con una comisión de plataforma de 5.5%; Enterprise personalizado con descuentos
Prueba gratuita: Nivel Free con 25+ modelos, 4 proveedores y 50 solicitudes diarias

La página de precios activa presenta tres niveles. Free permite usar 25+ modelos gratuitos de cuatro proveedores, con 50 solicitudes diarias. Pay as you go añade 400+ modelos, 80+ proveedores, límites globales altos y ningún gasto mínimo, con una comisión de plataforma de 5.5%. Enterprise conserva el catálogo, añade descuentos en las comisiones, facturación, SSO o SAML, SLA contractuales y un SLA de soporte con un canal compartido en Slack.

BYOK cambia el límite de las comisiones. Pay as you go incluye $25,000 de inferencia a precio de lista al mes sin comisión BYOK y después cobra 5%. Enterprise eleva ese cupo a $200,000 y luego cobra 5%. Un comprador con compromisos directos con proveedores debería calcular el cupo BYOK aparte de los créditos adquiridos a OpenRouter.

La profundidad del enrutamiento es el punto fuerte de OpenRouter. Su documentación sobre selección de proveedores indica que, por defecto, evita proveedores con caídas importantes en los 30 segundos anteriores, pondera después a los proveedores estables y económicos según el inverso del cuadrado del precio, y utiliza los restantes como fallbacks. En su lugar, los operadores pueden ordenar por precio, rendimiento o latencia; establecer el orden de proveedores concretos; desactivar fallbacks; exigir compatibilidad con parámetros; excluir proveedores que recopilan datos; exigir endpoints con retención cero de datos; o fijar un precio máximo.

Estos controles pueden mejorar tanto la disponibilidad como los costos. También convierten el comportamiento predeterminado en parte del contrato de producción. Si la aplicación necesita salida estructurada o uso de herramientas, configure require_parameters y una lista de permitidos en vez de asumir que todos los endpoints bajo un mismo slug de modelo se comportan igual.

Con $20,000 en créditos adquiridos, 5.5% equivale a $1,100 al mes. Todavía queda por debajo del costo mensual ilustrativo de autohospedaje de $1,200. La comisión porcentual continúa aumentando cuando la carga operativa de un gateway autohospedado estable quizá ya se haya aplanado, por lo que conviene revisar la comparación a medida que el gasto cruza $21,818.

El acuerdo con Stripe del que se ha informado aumenta el costo de la dependencia, pero no justifica una migración precipitada. OpenRouter sigue siendo la opción con el marketplace más amplio de esta clasificación. La respuesta prudente consiste en mantener un adaptador directo al proveedor, exportar las políticas y probar el bypass. El análisis completo de los precios de OpenRouter profundiza en los límites de las comisiones y BYOK.

Lo bueno
Lo que hace bien
9 points

  • 400+ modelos y 80+ proveedores en los planes de pago
  • Controles avanzados para ordenar y clasificar proveedores, aplicar políticas y definir fallbacks
  • Sin gasto mínimo en Pay as you go
  • Cupos BYOK útiles antes de que comience la comisión de 5%
  • La vía más rápida para mantener abierta la exploración de modelos
  • La comisión de 5.5% sobre créditos adquiridos crece directamente con el gasto
  • Las 50 solicitudes diarias de Free no constituyen un cupo de producción
  • La configuración predeterminada puede enrutar entre proveedores si no se explicita la política
  • El cambio de propiedad del que se ha informado aumenta el trabajo de contingencia frente al proveedor

6. Bifrost: la mejor alternativa OSS para controlar explícitamente los reintentos

Bifrost es la mejor alternativa de código abierto cuando el equipo busca un comportamiento explícito de reintentos, OpenTelemetry y una superficie de gateway más reducida. El nivel OSS es gratuito para siempre y puede ejecutarse como despliegue Docker, carga de trabajo de Kubernetes o binario de Go.

Precios del gateway Bifrost en OSS y Enterprise
Bifrost

Ideal para: Equipos de plataforma que quieren autohospedaje con controles transparentes de resiliencia
Lo más destacado: Comportamiento anidado de reintentos y fallbacks, con un historial de enrutamiento por solicitud
Precio: OSS por $0; Enterprise personalizado
Prueba gratuita: Prueba Enterprise de 14 días

La página de precios de Bifrost incluye en OSS una única API compatible con OpenAI para 1,000+ modelos, métricas y trazas OTel, observabilidad, presupuestos y límites mediante claves virtuales, enrutamiento personalizado, fallbacks automáticos, caché y un gateway MCP. Enterprise añade despliegues en VPC, locales y aislados; modo clúster; balanceo de carga adaptativo; SAML y OIDC; integraciones con bóvedas; logs de auditoría; RBAC; y soporte respaldado por SLA.

La documentación de reintentos y fallbacks de Bifrost es inusualmente precisa. Los errores de red y las respuestas 5xx provocan un reintento con el mismo proveedor. Los límites de solicitudes y los fallos por clave pueden rotar las credenciales. Solo cuando la ruta principal agota su presupuesto de reintentos, la solicitud pasa al siguiente fallback, y cada fallback recibe su propio presupuesto completo.

Esa claridad revela el obstáculo: los reintentos pueden multiplicarse. Un modelo principal con tres reintentos y dos fallbacks que también disponen de tres reintentos cada uno puede generar hasta 12 intentos antes de devolver un error. En una aplicación interactiva, esto puede convertir un incidente del proveedor en un incidente de latencia y una factura más alta. Defina un presupuesto total de latencia y haga que los errores de seguridad o cumplimiento detengan la cadena, en lugar de permitir que falle en modo abierto.

Bifrost compite de forma más directa con LiteLLM. LiteLLM gana por la familiaridad de su ecosistema y la amplitud de su plano de control consolidado. Bifrost gana cuando su huella nativa en Go, su historial de enrutamiento explícito o la semántica de reintentos encajan mejor con el modelo operativo del equipo de plataforma. Ambos pierden cuando nadie tiene presupuesto para hacerse cargo del proxy.

Lo bueno
Lo que hace bien
9 points

  • Nivel OSS por $0
  • Opciones de despliegue con Docker, Kubernetes y un binario de Go
  • OTel, presupuestos, límites, caché, enrutamiento y fallbacks en OSS
  • Semántica específica para reintentos, rotación de claves y fallbacks
  • Controles Enterprise de despliegue privado e identidad
  • El comprador se hace cargo del gateway y de su dominio de fallos
  • El precio Enterprise es personalizado
  • Los presupuestos anidados de reintentos pueden multiplicar la latencia y el gasto
  • Ecosistema más pequeño que el de LiteLLM

7. Helicone: el mejor gateway centrado en la observabilidad

Helicone es la mejor opción cuando depurar sesiones y explicar el gasto importan tanto como el enrutamiento de modelos de IA. Combina un gateway sin recargo con observabilidad, caché, límites de solicitudes, fallbacks automáticos, gestión de prompts y búsqueda de solicitudes.

Planes de precios y límites del gateway Helicone
Helicone

Ideal para: Equipos cuyo mayor problema es comprender el comportamiento de los modelos en producción
Lo más destacado: El tráfico del gateway llega directamente a un producto de observabilidad y depuración
Precio: Hobby gratuito; Pro por $79/mes; Team por $799/mes; Enterprise personalizado
Prueba gratuita: 7 días en Pro y Team

La página de precios muestra con claridad qué activa cada subida de nivel. Hobby incluye 10,000 solicitudes, 1 GB de almacenamiento, un puesto, una organización, siete días de retención y 10 logs por minuto. Pro cuesta $79 al mes e incluye puestos ilimitados, una organización, un mes de retención, 1,000 logs por minuto y 10 llamadas a la API por minuto; se aplican precios por uso al superar las solicitudes y el almacenamiento incluidos.

Team cuesta $799 al mes y amplía los límites a cinco organizaciones, tres meses de retención, 15,000 logs por minuto, 60 llamadas a la API por minuto, soporte para SOC 2 y HIPAA y un canal dedicado de Slack. Enterprise tiene un precio personalizado y añade organizaciones ilimitadas, retención indefinida, 30,000 logs por minuto, 1,000 llamadas a la API por minuto, SAML SSO, despliegue local y condiciones comerciales personalizadas.

La documentación de la plataforma describe dos modos operativos: créditos sin recargo para 100+ modelos, o BYOK para equipos que conservan la facturación del proveedor. Ambos mantienen la observabilidad a nivel de solicitud. Esa es la ventaja de Helicone frente a un proxy ligero. Una interacción fallida puede seguirse a lo largo de una sesión, en lugar de reducirse al contador de errores de un proveedor.

El límite de Hobby aparece de inmediato. Diez logs por minuto bastan para examinar un prototipo y son demasiado pocos para muchas aplicaciones en vivo. Los 1,000 logs por minuto de Pro constituyen el primer umbral realista para tráfico moderado en producción. El comprador elige al mismo tiempo un plan de observabilidad y un gateway, así que debe comparar el valor conjunto en vez de tratar la capa de enrutamiento como gratuita.

Lo bueno
Lo que hace bien
9 points

  • Créditos sin recargo o BYOK
  • Gateway, fallbacks, caché, límites y observabilidad en un solo sistema
  • Límites públicos por plan y por ingesta
  • Puestos ilimitados a partir de Pro
  • Opción Enterprise local
  • El límite de ingesta de 10 logs por minuto en Hobby es reducido
  • Pro y Team añaden cargos por uso al superar los importes incluidos
  • Team salta de $79 a $799 al mes
  • La superficie de observabilidad puede ser excesiva para una aplicación sencilla

8. Braintrust Gateway: el mejor cuando las evaluaciones deciden los lanzamientos

Braintrust Gateway encaja mejor cuando las trazas deben convertirse en evaluaciones, conjuntos de datos, puntuaciones y controles de lanzamiento. El gateway admite OpenAI, Anthropic, Google, AWS y otros proveedores mediante una API unificada con caché, observabilidad y soporte para varios proveedores.

Documentación e inicio rápido de Braintrust Gateway
Braintrust Gateway

Ideal para: Equipos de producto de IA cuyos cambios de enrutamiento dependen de los resultados de evaluaciones
Lo más destacado: Las trazas del gateway se conectan directamente con una plataforma de evaluación
Precio: Starter por $0; Pro por $249/mes; Enterprise personalizado; Gateway alojado gratuito durante la beta
Prueba gratuita: Starter no exige tarjeta de crédito; Gateway es gratuito mientras esté en beta

Los precios de la plataforma de Braintrust comienzan con Starter por $0. Incluye 1 GB de datos procesados y después cobra $4 por GB; 10,000 puntuaciones y después $2.50 por cada 1,000; 14 días de retención; y usuarios, proyectos, conjuntos de datos, playgrounds y experimentos ilimitados. Pro cuesta $249 al mes e incluye 5 GB de datos procesados y después cobra $3 por GB; 50,000 puntuaciones y después $1.50 por cada 1,000; y 30 días de retención, con los datos adicionales retenidos facturados a $0.50 por GB al mes. Enterprise es personalizado.

El propio gateway tiene una situación distinta. La documentación de Gateway de Braintrust señala que el endpoint alojado está en beta y su uso es gratuito, y que los precios se anunciarán antes de la disponibilidad general. El endpoint global utiliza enrutamiento DNS por latencia y comprobaciones de estado entre las regiones alojadas. El sistema de logging puede guardar las trazas del gateway en el plano de datos configurado por la organización.

Esta integración cambia el motivo de compra. Si un equipo toma muestras de trazas de producción, puntúa respuestas, crea conjuntos de datos de regresión y bloquea lanzamientos cuando baja la calidad, el gateway elimina pasos de instrumentación y mantiene la evidencia vinculada al tráfico. Si el equipo solo necesita reintentos y topes de gasto, resulta difícil justificar la plataforma Pro de $249 frente a un gateway más sencillo.

El obstáculo son el precio futuro y el estado beta. Es posible diseñar para producción con una beta gratuita aunque aún no exista una tarifa comercial estable. Úselo con un bypass directo al proveedor, fije internamente un precio máximo antes de la disponibilidad general y no permita que un precio temporal de $0 determine una arquitectura permanente.

Lo bueno
Lo que hace bien
9 points

  • Las trazas del gateway se conectan con evaluaciones, conjuntos de datos, puntuaciones y flujos de lanzamiento
  • Acceso unificado a las principales familias de proveedores
  • El gateway alojado es gratuito durante la beta
  • Enrutamiento global por latencia y comprobaciones de estado
  • Usuarios ilimitados en los niveles Starter y Pro de la plataforma
  • El gateway alojado sigue en beta
  • El precio del gateway cambiará antes de la disponibilidad general
  • Pro cuesta $249 al mes antes de los cargos por uso adicional
  • La plataforma ofrece demasiada profundidad para equipos que solo necesitan enrutamiento

9. Requesty: el mejor plano de control sencillo con comisión porcentual

Requesty es la mejor opción administrada con comisión porcentual para un equipo pequeño que quiere enrutamiento, caché, fallbacks, presupuestos y residencia de datos en la UE sin suscripción. Pay as you go ofrece 600+ modelos de 20+ proveedores.

Comparación de precios y planes de Requesty AI Gateway
Requesty

Ideal para: Startups que prefieren una comisión vinculada directamente al uso de modelos
Lo más destacado: Sin suscripción, costo por puesto, gasto mínimo ni cargo independiente por los controles principales de enrutamiento
Precio: Free por $0; Pay as you go añade 5%; Enterprise personalizado
Prueba gratuita: Nivel Free con 200 solicitudes diarias en modelos gratuitos, sin tarjeta

La página de precios asigna a Free 200 solicitudes diarias en modelos gratuitos, además de enrutamiento, caché, fallbacks, analítica de gasto y residencia de datos en la UE. Pay as you go aplica un recargo de 5% sobre los costos base de los modelos e incluye BYOK, políticas de enrutamiento, caché, fallbacks, límites de gasto, un gateway MCP, observabilidad avanzada y soporte por correo electrónico. Enterprise añade SSO, RBAC, logs de auditoría, políticas de modelos aprobados, presupuestos de equipo, guardrails, detección de PII, cuentas de servicio, soporte dedicado y SLA personalizados.

El porcentaje simplifica el presupuesto inicial. Con $2,000 de gasto en modelos, la comisión es de $100. Con $20,000, asciende a $1,000. Al llegar a $24,000, iguala el costo mensual ilustrativo de autohospedaje de $1,200. Una startup puede evitar un proyecto de plataforma mientras el tráfico sea incierto y reabrir la decisión cuando el uso se estabilice.

El obstáculo nace de esa misma sencillez. La comisión aumenta con el gasto en modelos aunque el trabajo operativo del gateway no lo haga. Una empresa con un consumo elevado de tokens, un equipo de plataforma y contratos existentes con proveedores debería comparar la cotización Enterprise de Requesty o un proxy autohospedado antes de aceptar 5% indefinidamente.

Requesty queda por debajo de Helicone porque su principal argumento aquí es un control administrado eficiente, no un ciclo diferenciado de evidencia de producción. Aun así, puede ser la mejor compra cuando la ausencia de suscripción y una comisión porcentual predecible importan más que una evaluación más profunda o una política empresarial.

Lo bueno
Lo que hace bien
9 points

  • Sin suscripción, costo por puesto ni mínimo en Pay as you go
  • 600+ modelos de 20+ proveedores
  • Enrutamiento, caché, fallbacks, presupuestos, MCP y residencia en la UE
  • El nivel Free no requiere tarjeta de crédito
  • Ruta Enterprise para identidad, auditoría, políticas y controles de PII
  • La comisión de 5% crece directamente con el gasto en modelos
  • El precio Enterprise es personalizado
  • El tráfico gratuito se limita a modelos gratuitos y 200 solicitudes al día
  • Pierde atractivo cuando un equipo de plataforma con presupuesto puede operar un proxy

10. Kong AI Gateway: el mejor para un entorno que ya usa Kong

Kong AI Gateway es la mejor opción cuando Kong ya gobierna las API de la empresa y el tráfico de IA debe heredar ese modelo operativo. Plus incluye una API universal para LLM, hasta cinco modelos únicos conectados por proxy, tráfico ilimitado entre agentes, proxies ilimitados para servidores MCP, saneamiento de PII, guardrails, control de acceso, límites de tasa por tokens, caché semántica y analítica de costos.

Precios de Kong Konnect y AI Gateway
Kong AI Gateway

Ideal para: Empresas que ya utilizan Kong Konnect o Kong Gateway
Lo más destacado: Políticas de IA dentro de una plataforma más amplia de API, identidad, portales y gobernanza de servicios
Precio: Prueba de 30 días por $0; Plus con precio por uso; Enterprise personalizado anual
Prueba gratuita: 30 días sin tarjeta de crédito ni límites del gateway

La página de precios activa detalla las tarifas de Plus. Un plano de control Serverless cuesta $25 al mes, Hybrid cuesta $200 y Dedicated Cloud cuesta $500 más $0.15 por GB. Plus incluye un millón de solicitudes API y después cobra $200 por cada millón adicional, con un máximo mensual de 10 millones.

El proxy para modelos de IA cuesta otros $100 al mes por cada modelo LLM único, con un límite de cinco en Plus. Por tanto, una aplicación con cuatro modelos y un plano de control Serverless comienza en $425 al mes antes de los tokens de los modelos: $25 por el plano de control más $400 por los cuatro proxies de modelos. Los plugins de IA de pago son complementos independientes en Plus y están incluidos en Enterprise.

Enterprise elimina los límites de gateways y modelos, admite gateways de API completamente autohospedados y añade logs de auditoría, SSO, soporte dedicado, servicios profesionales y SLA superiores. El precio es personalizado y se factura anualmente.

El obstáculo es el peso de la plataforma. Kong tiene sentido cuando la gobernanza de API, los planos de control, la identidad, la analítica, el catálogo de servicios y el soporte ya figuran en el presupuesto. Para una aplicación multimodelo nueva, pagar por plano de control, modelo y solicitud introduce conceptos antes de que el producto demuestre necesitarlos. Vercel, Cloudflare, Requesty o un proxy OSS permiten tomar una decisión más acotada con mayor rapidez.

Lo bueno
Lo que hace bien
9 points

  • Encaja con el modelo existente de control y soporte de Kong
  • API universal para LLM con políticas, caché, guardrails y analítica de costos
  • Opciones Serverless, Hybrid, Dedicated Cloud y Enterprise autohospedada
  • Las tarifas públicas de Plus permiten calcular una configuración básica
  • Ruta sólida de identidad y auditoría empresarial
  • $100 por modelo conectado mediante proxy en Plus
  • El ejemplo Serverless con cuatro modelos comienza en $425 antes de la inferencia
  • Plus limita el proxy de IA a cinco modelos y el tráfico a 10 millones de solicitudes
  • Excesivo y costoso como opción predeterminada para una aplicación nueva

¿Qué gateway conviene en cada caso?

Empiece por la restricción capaz de impedir el lanzamiento y compare después las comisiones. Un enrutamiento sofisticado no compensa un límite de despliegue equivocado, y una comisión baja no suple controles de auditoría o reversión ausentes.

Elija Vercel AI Gateway para una startup que lanza una aplicación orientada a clientes, con un conjunto pequeño de modelos aprobados y sin necesidad de despliegue privado. La elección cambia a Cloudflare cuando esa empresa ya controla el edge y la capa de seguridad, o a Requesty cuando resulta más fácil financiar una comisión de uso del 5% que una suscripción de plataforma.

Elija LiteLLM para una empresa de producto con un responsable de plataforma, estándares existentes para contenedores y bases de datos, y un requisito firme sobre la ruta de datos o un gasto mensual en modelos que ya se sitúe por encima de unos $22,000 a $24,000 bajo el supuesto operativo indicado. La elección cambia a Bifrost cuando su semántica de reintentos, su despliegue en Go o su enfoque OTel encajan mejor con el equipo.

Elija Portkey para una empresa mediana o grande que necesite identidad administrada, guardrails, presupuestos, retención, opciones de despliegue privado y soporte. La elección cambia a Kong cuando la empresa ya utiliza Kong como plataforma de API y consolidar el control compensa la tarifa por modelo.

Elija Helicone cuando investigar solicitudes, depurar sesiones y atribuir el gasto sea el trabajo diario. Elija Braintrust Gateway cuando esas mismas trazas deban alimentar evaluaciones y controles de lanzamiento. El estado beta de Braintrust obliga a mantener un bypass directo y un precio máximo interno.

Elija OpenRouter mientras un equipo técnico pequeño siga comparando numerosos modelos o necesite la amplitud de un marketplace de proveedores. Mantenga una ruta directa al proveedor. Cuando la aplicación estandarice un conjunto reducido de modelos aprobados, compare la comisión de 5.5% sobre créditos con la ausencia de recargo por tokens de Vercel, la comisión de 5% de Requesty o un autohospedaje con presupuesto asignado.

Flujo de decisión para elegir un gateway de IA autohospedado, administrado, con gobernanza o basado en marketplace
Empiece por la propiedad y la gobernanza; después deje que las funciones de enrutamiento y las comisiones decidan la opción final

La condición explícita para cambiar es sencilla: cambie de gateway cuando el costo o el control que le falta supere la carga de migración y operación de la siguiente opción. No migre porque un competidor muestre una lista de funciones más larga. Migre porque el gateway actual no puede cumplir un presupuesto de latencia medido, un límite de despliegue, un requisito de auditoría, un techo de comisiones o un objetivo de salida.

Qué opciones no conviene usar como única ruta de producción

Evite depender de un único gateway cuando sus límites comerciales u operativos aún estén cambiando. Tres opciones concretas exigen cautela por razones distintas.

Evite usar OpenRouter como única ruta de producción durante la transición de propiedad de la que se ha informado. Su catálogo y su enrutamiento siguen siendo excelentes, y no hay fundamento para afirmar que sus condiciones empeorarán. El problema es la concentración: el acceso a modelos, las políticas de proveedores, los créditos y el comportamiento de fallback residen en la misma cuenta. Conserve una clave directa de proveedor y un adaptador probado fuera de ella.

Evite usar Braintrust Gateway como única ruta mientras siga en beta. Braintrust afirma que su gateway alojado está diseñado para producción, publica el seguimiento de su disponibilidad y lo ofrece gratis durante la beta. También señala que los precios se anunciarán antes de la disponibilidad general. Trate $0 como un precio piloto, defina qué precio activaría un cambio y mantenga listo el bypass.

Evite usar Kong AI Gateway como opción inicial cuando la empresa aún no opera Kong. Cuatro modelos conectados mediante proxy en un plano de control Serverless Plus parten de $425 al mes antes de la inferencia, y el comprador también hereda los conceptos de plano de control y programa de API de Kong. Puede ser una consolidación excelente para un cliente existente de Kong y una carga de plataforma innecesaria para una aplicación nueva.

También conviene evitar un passthrough casero una vez que más de una aplicación dependa de él. Un proxy que cambia la URL base es sencillo. El streaming correcto, la normalización de errores, los parámetros específicos de cada proveedor, los fallbacks, los presupuestos, el aislamiento de claves, los logs y la gestión de modelos retirados conforman un producto que debe mantenerse. Desarróllelo solo cuando la política particular justifique asumir esa responsabilidad de forma permanente.

La tarea del lunes: demostrar que el gateway es reversible

No empiece la próxima semana con una migración para toda la empresa. Empiece con una ruta que refleje las condiciones de producción y demuestre la salida en 10 minutos. El resultado debe ser una decisión operativa medible, no un diagrama de arquitectura más limpio.

  1. Inventaríe una ruta

    Elija un flujo de trabajo orientado a clientes y registre su proveedor actual, modelo, método de autenticación, gasto mensual, objetivo de latencia p95, requisitos de salida estructurada o herramientas y política de datos. Escoja una ruta lo bastante representativa para revelar las dificultades, pero lo bastante pequeña para revertirla.

  2. Coloque el gateway detrás de un cliente interno

    Mueva únicamente el adaptador del gateway a la ruta de solicitudes. Mantenga los encabezados específicos de proveedores, los alias de modelos y la política de fallback fuera de la lógica de negocio. Guarde la configuración directa anterior junto a la del gateway.

  3. Defina un modelo principal y un fallback compatible

    No comience con un árbol de enrutamiento. Elija un fallback que admita el mismo protocolo de respuesta, salida estructurada, herramientas y límite de datos. Fije un techo de latencia total para toda la cadena de reintentos.

  4. Fuerce el fallo

    Desactive o enrute mal el modelo principal durante una ventana controlada. Confirme qué intentos se realizaron, cuáles se facturaron, qué proveedor respondió, cuánto tardó la cadena y si la aplicación recibió el esquema esperado.

  5. Ejecute la salida en 10 minutos

    Evite el gateway mediante configuración y un despliegue controlado. Si el servicio no puede volver a su ruta directa al proveedor en 10 minutos, registre qué dependencia lo impidió y corríjala antes de ampliar el despliegue.

  6. Compre el control que cambió una decisión

    Adopte el gateway solo si rescató solicitudes, aplicó una política, reveló quién genera el gasto, cumplió un límite de despliegue o redujo un costo operativo medible. Un panel que ningún responsable consulta no es un resultado de producción.

Para la mayoría de los equipos de producto pequeños, el piloto del lunes debería utilizar Vercel AI Gateway sin complementos de pago hasta que algún requisito los justifique. Un equipo de plataforma con un límite privado innegociable debería usar LiteLLM y asignar al responsable antes de que el proxy reciba tráfico. En un proyecto de gobernanza empresarial, las compras y la validación técnica deben comenzar a la vez, porque la retención, la identidad, el despliegue, el soporte y las condiciones de salida afectan a la arquitectura.

La adquisición de la que se ha informado es el detonante, no la decisión. La decisión consiste en determinar si el próximo cambio de modelo, proveedor o gateway podrá resolverse mediante una actualización controlada de configuración, en lugar de una reescritura y una solicitud presupuestaria de emergencia.

Preguntas frecuentes

¿Cuál es el mejor gateway LLM?

LiteLLM es la mejor opción general cuando hay un responsable de plataforma que puede operar el gateway y la empresa valora el control del despliegue. Vercel AI Gateway es la mejor opción administrada por defecto. Portkey es más sólido para la gobernanza empresarial administrada y OpenRouter cuando la exploración amplia de modelos sigue siendo la tarea principal.

¿Qué ejemplos de gateways de IA existen?

Entre las opciones actuales están LiteLLM, Vercel AI Gateway, Portkey, Cloudflare AI Gateway, OpenRouter, Bifrost, Helicone, Braintrust Gateway, Requesty y Kong AI Gateway. El grupo abarca proxies autohospedados, gateways administrados, marketplaces de modelos, plataformas centradas en la observabilidad y plataformas empresariales de API.

¿Cuál es el mejor gateway de IA de código abierto?

LiteLLM es la mejor opción de código abierto por defecto porque su plan de $0 reúne 100+ proveedores, claves virtuales, presupuestos, límites de solicitudes, fallbacks, logs y Prometheus. Bifrost es la mejor alternativa cuando el factor decisivo es el comportamiento explícito de reintentos anidados, un binario de Go o su implementación de OpenTelemetry.

¿Qué gateway de IA conviene a una startup y cuál a una empresa?

Una startup normalmente debería comenzar con Vercel, Cloudflare o Requesty para no crear una tarea interna de plataforma. Una empresa debe decidir según sus requisitos de gobernanza y despliegue: Portkey para controles administrados, LiteLLM o Bifrost para infraestructura propia y Kong cuando la organización ya estandariza allí el tráfico de API.

Última actualización

3 sept 2026

CategoríaBuild

Prefiera este sitio en Google

Añadir omidsaffari.com como fuente preferida en la Búsqueda de Google

Marque omidsaffari.com como fuente preferida y Google lo destacará para usted en Top Stories, AI Overviews y AI Mode.

Newsletter

Una carta, cada domingo. Sistemas que funcionan, no opiniones calientes.

Build logs, sistemas en producción y notas de campo de un portafolio de ventures de IA.

Semanal. Sin spam. Cancele cuando quiera.