Mejores AI Gateways con herramientas gestionadas para agentes en 2026

Compara AWS AgentCore, Vercel, Portkey, TrueFoundry, Kong y Cloudflare en herramientas para agentes, precios reales y reducción de costes operativos.

Thursday, September 3, 2026Omid Saffari
Mejores AI Gateways con herramientas gestionadas para agentes en 2026

Amazon Bedrock AgentCore Gateway es el gateway de herramientas gestionadas más sólido en general; Vercel AI Gateway es la vía más rápida para dotar a un agente de búsqueda web en producción. A un millón de interacciones mensuales de agentes, la capa de gateway de AgentCore puede costar unos $40.02 antes de sumar costes de modelo, búsqueda web y backend, mientras que Vercel elimina la necesidad de contar con una cuenta y clave independientes de Exa, pero cobra $7 por cada 1,000 búsquedas a partir del 31 de agosto de 2026.

La respuesta corta: ¿qué gateway resuelve mejor cada necesidad?

Un AI gateway merece su lugar en la arquitectura de un agente cuando elimina una superficie de control compleja, no simplemente cuando coloca otro endpoint frente a un modelo. Para herramientas gestionadas, las preguntas determinantes son si el gateway puede transformar servicios existentes en herramientas, almacenar credenciales, decidir quién puede invocarlas, ayudar al agente a encontrar la herramienta correcta y registrar una traza auditable de lo sucedido.

HerramientaIdeal paraPrecio inicialPrueba gratuita
Amazon Bedrock AgentCore GatewayUn plano empresarial amplio de herramientas gestionadas$0.005 por 1,000 invocaciones de gatewayPor consumo; nuevos clientes de AWS pueden recibir hasta $200 en créditos
Vercel AI GatewayBúsqueda web gestionada sin configuración previa$5 mensuales de crédito FreeNivel gratuito
PortkeyAutenticación y políticas entre servidores MCP remotos$0 DeveloperNivel Free Forever
TrueFoundryGobernanza MCP en VPC, entornos air-gapped o alojados$0 DeveloperPrueba de siete días
Kong AI GatewayInfraestructuras Konnect existentes que gobiernan tráfico de LLM, MCP y A2A$0 durante 30 díasPrueba de 30 días
Cloudflare AI GatewayStack en el edge de bajo coste con entorno de ejecución adyacente para agentes$0 en gateway básicoCore gratuito en todos los planes

Elija Amazon Bedrock AgentCore Gateway cuando los agentes deban invocar APIs internas y sistemas SaaS bajo una frontera de identidad gestionada unificada. Puede convertir definiciones OpenAPI, Smithy y funciones Lambda en herramientas compatibles con MCP, gestionando tanto la autenticación entrante como la saliente.

Elija Vercel AI Gateway si su problema inmediato es la búsqueda web. Su integración nativa con Exa elimina la necesidad de gestionar una cuenta independiente, credenciales y facturación externa. Representa una simplificación de flujo real, aunque su alcance es más acotado que transformar las APIs internas de una empresa en herramientas gobernadas.

Elija Portkey cuando los servidores MCP ya estén operativos y la pieza ausente sea la autenticación, la aprobación humana y la auditoría. Elija TrueFoundry si la ubicación del despliegue, los servidores stdio alojados, los MCP virtuales o los guardrails antes y después de la llamada a la herramienta son prioritarios. Elija Kong si Konnect ya administra el ecosistema de APIs de su organización. Elija Cloudflare si el equipo busca funciones básicas de gateway gratuitas y prefiere integrar herramientas gestionadas en la plataforma adyacente Cloudflare Agents.

Qué significa contar con herramientas gestionadas para agentes, y qué no

Un gateway de modelos enruta prompts hacia modelos de lenguaje. Un gateway MCP controla cómo los agentes descubren e invocan herramientas. Algunos productos asumen ambas funciones, pero las dos líneas de facturación y sus modos de fallo operan por separado.

Esta diferencia es crítica: una llamada a un modelo suele limitarse a leer información y generar texto, mientras que una llamada a una herramienta puede alterar el estado de un sistema. Un agente de soporte técnico puede emplear un modelo para interpretar una consulta, y luego utilizar herramientas para consultar una cuenta, emitir un reembolso y actualizar un ticket. El gateway de modelos puede auditar el primer paso sin saber si el segundo contaba con la autorización requerida.

Un gateway de herramientas gestionadas solvente debe resolver varias tareas:

  • Aprovisionamiento: expone una API, función o servidor MCP remoto sin exigir que cada equipo de desarrollo reescriba la integración.
  • Identidad: valida la identidad del agente o usuario emisor e inyecta la credencial autorizada hacia la herramienta destino.
  • Políticas: restringe qué herramienta y qué acción exacta puede ejecutar el agente, permitiendo pasos de aprobación humana intermedia.
  • Descubrimiento: ayuda al modelo a localizar la herramienta adecuada sin saturar el prompt cargando los esquemas completos de todo el catálogo.
  • Auditoría: registra con precisión qué identidad invocó qué herramienta, con qué parámetros y cuál fue la respuesta devuelta.

El término gestionado no siempre implica ejecución hospedada. Portkey puede actuar como proxy y gobernar un servidor MCP remoto mientras este corre en otra plataforma. Cloudflare Agents puede hospedar la lógica del agente y proveer herramientas gestionadas, mientras que Cloudflare AI Gateway se encarga del control de acceso a los modelos. Vercel integra Exa Search nativamente, pero esa función aislada no ofrece la capa de conversión de OpenAPI a MCP que aporta AgentCore.

La consecuencia directa es la aparición de una factura independiente para el plano de herramientas. Esta incluye llamadas al gateway, consumo de búsquedas web o navegadores headless, alojamiento de herramientas, gestión de secretos, logs, flujos de aprobación y el tiempo de ingeniería necesario para responder cuando una herramienta falla. Un gateway de modelos sin recargo por token deja intacta la mayor parte de esos costes.

Por ello, la ruta de modelo más barata rara vez coincide con el flujo de trabajo de agentes más económico. Nuestra comparativa de costes en gateways de modelos de IA resulta idónea para decidir el enrutamiento de tokens. Sin embargo, evaluar herramientas gestionadas para agentes requiere un análisis financiero propio.

Cómo evaluamos los mejores AI gateways

Nuestra selección evalúa cuatro aspectos clave. Primero, el alcance del trabajo de herramientas que el producto asume: transformación, registro, credenciales, descubrimiento semántico, ejecución o tráfico agente a agente (A2A). Segundo, si el control de acceso puede segmentarse por persona, agente, espacio de trabajo o herramienta concreta. Tercero, si es posible proyectar la factura de producción a partir de precios públicos vigentes. Cuarto, dónde aparece el límite operativo de la solución: una barrera de despliegue, un producto complementario, un tope de peticiones o una suscripción fija al plano de control.

Las tarifas, la documentación técnica, los límites de cada plan y los anuncios de lanzamiento se verificaron en directo el 27 de agosto de 2026. Cada sección analizada incluye una captura de pantalla actual de su interfaz o documentación. Durante esta revisión no sometimos los productos a tráfico sintético en producción, por lo que no se presentan afirmaciones de latencia, disponibilidad, tasa de éxito en llamadas a herramientas ni tiempos de soporte técnico a modo de benchmark.

Seis gateways superaron el corte porque cada uno destaca en un escenario de uso específico. Descartamos productos que únicamente ofrecían enrutamiento de modelos sin gestión de herramientas, aquellos que no permitían evaluar el manejo de herramientas de forma demostrable y las opciones que ocultaban todas sus tarifas tras procesos comerciales. Un modelo de precios público no garantizó una posición privilegiada, pero facilitó proyectar el impacto operativo real.

El orden prioriza la reducción de carga técnica y de seguridad frente a la acumulación de funcionalidades secundarias. Una integración puntual pero fluida puede superar a una plataforma compleja si resuelve el obstáculo exacto que enfrenta un equipo de ingeniería esta semana. Las plataformas integrales solo lideran cuando su mayor amplitud reemplaza capas que el comprador tendría que desarrollar y mantener por su cuenta.

1. Amazon Bedrock AgentCore Gateway: el mejor en general para planos de herramientas empresariales

Amazon Bedrock AgentCore Gateway se posiciona como la opción general más robusta cuando los agentes deben interactuar con un entorno heterogéneo de APIs internas, funciones AWS, herramientas SaaS, otros agentes y modelos a través de un único punto de control gobernado.

Página de Amazon Bedrock AgentCore mostrando su infraestructura gestionada para agentes
Amazon Bedrock AgentCore Gateway

Su principal fortaleza es la capacidad de transformación. AgentCore Gateway puede ingerir una especificación OpenAPI, un modelo Smithy o una función AWS Lambda y exponerlos automáticamente como herramientas compatibles con MCP. Un equipo de plataforma puede conectar una API interna existente de gestión de vacaciones detrás del gateway en lugar de forzar a cada equipo de agentes a programar y desplegar un adaptador MCP independiente.

Su capa de identidad es igualmente crítica. AgentCore gestiona tanto la autenticación entrante del agente emisor como la autenticación saliente hacia el servicio destino. Admite flujos OAuth, renovación de tokens y custodia segura de secretos. El agente recibe permiso granular para ejecutar una herramienta concreta, sin necesidad de tener acceso directo a las credenciales de Salesforce, Slack o Jira que ejecutan la operación. Incorpora además conectores rápidos con un solo clic para Salesforce, Slack, Jira, Asana y Zendesk.

A medida que el catálogo de herramientas crece, la selección semántica permite que el agente descubra la herramienta requerida sin necesidad de cargar todos los esquemas JSON completos en el contexto del prompt. Esto optimiza el consumo de tokens y hace viable operar catálogos con cientos de acciones corporativas. El gateway también puede intermediar servicios HTTP y tráfico A2A, permitiendo extender la misma frontera de seguridad más allá del protocolo MCP.

Su principal desventaja es la complejidad operativa dentro de AWS. AgentCore elimina el desarrollo de adaptadores, pero exige dominar la gestión de identidades IAM, configuración de regiones, permisos de servicios, CloudWatch y los sistemas internos conectados. Para un equipo sin experiencia en AWS, el ahorro en código puede convertirse en un nuevo reto de administración cloud. Es la solución ideal cuando AWS ya es el entorno corporativo estándar o cuando la necesidad de unificar identidad y conversión de APIs justifica su adopción.

Ideal para: empresas que necesitan transformar APIs y funciones existentes en herramientas gobernadas para agentes
Puntos destacados: transformación de OpenAPI, Smithy y Lambda junto con autenticación entrante y saliente
Precios: $0.005 por 1,000 invocaciones a la API del gateway, $0.025 por 1,000 llamadas a la Search API y $0.02 por cada 100 herramientas indexadas al mes; sin compromisos de permanencia ni cuotas mínimas
Prueba gratuita: basada en consumo; nuevos clientes de AWS pueden recibir hasta $200 en créditos del AWS Free Tier

Lo bueno
Lo que hace bien
4 points

  • Transforma tres orígenes corporativos habituales en herramientas compatibles con MCP
  • Gestiona la identidad del emisor y las credenciales salientes hacia el destino
  • Incorpora selección semántica de herramientas para catálogos extensos
  • Modelo de cobro por uso real en lugar de suscripciones fijas de gateway
Lo malo
Dónde se queda corto
3 points

  • Requiere gestión de identidades y operaciones dentro del ecosistema AWS
  • Web Search se factura como concepto independiente a $7 por 1,000 consultas
  • Inferencia de modelos, runtime, observabilidad, políticas y consumo de servicios backend no están incluidos en la tarifa base

Primer despliegue recomendado en AgentCore Gateway

El despliegue inicial más sensato consiste en limitar el alcance a una sola acción acotada, evitando migrar todo el inventario de APIs a la vez. Seleccione un flujo con un responsable claro, impacto reversible y un modelo de permisos bien comprendido por el equipo de seguridad.

  1. Defina una sola acción aprobada

    Elija un servicio OpenAPI o una función Lambda específica, como la consulta de saldo de vacaciones. Exponga estrictamente la operación que el primer agente requiere. Limitar la superficie inicial facilita la auditoría de autorizaciones y el diagnóstico de errores.

  2. Configure ambas fronteras de identidad

    Establezca qué agente o identidad puede interactuar con el gateway y qué credencial saliente utilizará el gateway para acceder al servicio final. Trátelas de forma separada: el agente nunca debe heredar directamente las credenciales del servicio de destino.

  3. Indexe descripciones precisas, no todo el catálogo

    Redacte nombres y descripciones sin ambigüedades para el conjunto inicial de herramientas. Active la selección semántica solo después de comprobar que las descripciones permiten una discriminación clara. La búsqueda semántica no puede desambiguar dos herramientas con descripciones idénticas.

  4. Calcule costes y supervise una fracción de tráfico

    Enrute un porcentaje acotado del tráfico productivo, supervise las llamadas a Search API e InvokeTool, y mantenga los costes de modelos, búsqueda web, runtime y backend desglosados en líneas separadas. Escale el uso únicamente cuando la tasa de éxito de las llamadas y los registros de auditoría alcancen los niveles exigidos.

AgentCore deja de ser la opción adecuada si su equipo ya opera servidores MCP remotos y solo necesita un proxy centralizado de autenticación y auditoría. En ese escenario, Portkey resulta más directo. Tampoco es la vía óptima si la única herramienta requerida es la búsqueda web y la prioridad es la velocidad de implementación: en ese caso, Vercel ofrece una ruta mucho más corta.

2. Vercel AI Gateway: el mejor para búsqueda web gestionada sin configuración

Vercel AI Gateway es la elección más rápida cuando un agente requiere acceso a información web actualizada y el obstáculo principal es gestionar un nuevo proveedor, credenciales adicionales, código de integración y otra factura externa.

Página de Vercel AI Gateway mostrando acceso unificado a modelos y controles de gateway
Vercel AI Gateway

Exa Search ahora está disponible como herramienta nativa en AI Gateway. Funciona con cualquier modelo disponible en la plataforma y no exige crear una cuenta ni configurar claves API de Exa. La aplicación simplemente pasa gateway.tools.exaSearch() en la definición de herramientas; el gateway despacha la consulta a Exa, devuelve los resultados al modelo y gestiona el bucle de ejecución hasta que el modelo concluye la búsqueda.

Esto simplifica notablemente la operativa. Un equipo pequeño puede integrar búsqueda web fundamentada sin abrir procesos de compras ni administrar nuevas variables de entorno. La ventaja radica en la reducción de fricción de despliegue, no en un descuento permanente. Vercel factura Exa Search a su precio oficial de $7 por 1,000 consultas sin sobreprecio. Esta herramienta es gratuita únicamente hasta el 31 de agosto de 2026, por lo que cualquier presupuesto de producción debe considerar la tarifa posterior a la promoción.

Para un volumen de 100,000 búsquedas mensuales, la factura de Exa alcanzará los $700. Vercel no aplica cuota fija de plataforma ni recargo en los tokens del modelo, pero las funciones avanzadas de gobernanza se tarifican aparte. Custom Reporting cuesta $0.075 por 1,000 escrituras y $5 por 1,000 consultas analíticas. La lista de proveedores permitidos a nivel de equipo cuesta $0.10 por 1,000 peticiones exitosas en planes Pro y Enterprise, mientras que el filtro individual only por petición no tiene coste adicional. La retención cero de datos (ZDR) para todo el equipo añade $0.10 por 1,000 peticiones en Pro y Enterprise, mientras que la configuración ZDR por petición está incluida sin recargo en dichos planes.

Su principal limitación es el alcance funcional. Vercel ha resuelto el aprovisionamiento de una herramienta de búsqueda web crítica, pero no proporciona una plataforma de transformación integral para APIs privadas sobre OpenAPI. Si su caso de uso exige "convertir nuestras APIs internas de facturación, inventario y recursos humanos en herramientas detectables mediante OAuth saliente", AgentCore o TrueFoundry son las soluciones adecuadas.

Ideal para: equipos de producto que integran búsqueda web gestionada en aplicaciones construidas con AI SDK
Puntos destacados: integración directa de Exa Search sin requerir cuenta ni API key independiente de Exa
Precios: el plan Free incluye $5 mensuales de crédito en modelos seleccionados; el plan Paid opera mediante créditos prepagados a tarifas oficiales sin recargo en tokens; el plan Enterprise permite facturación mediante factura comercial y descuentos por volumen
Prueba gratuita: nivel Free disponible; la adquisición de créditos de pago cancela el crédito mensual gratuito de $5

Lo bueno
Lo que hace bien
4 points

  • Elimina la gestión de cuentas, claves y contratos independientes con Exa
  • Compatible con cualquier modelo integrado en AI Gateway
  • Sin cuota fija de suscripción ni recargo sobre el consumo de tokens
  • Permite a equipos reducidos pasar del prototipo a búsqueda web en producción rápidamente
Lo malo
Dónde se queda corto
4 points

  • La promoción gratuita de Exa finaliza el 31 de agosto de 2026
  • La búsqueda cuesta $7 por 1,000 consultas tras el periodo promocional
  • No ofrece una capa general de conversión de APIs internas a MCP
  • La observabilidad y las políticas de control a nivel de equipo conllevan cargos adicionales por uso

El plan Free incluye $5 mensuales de crédito, acceso a un subconjunto de modelos compatibles, límites de tasa más restrictivos y no admite BYOK (Bring Your Own Key). El plan Paid funciona mediante créditos adquiridos según consumo, desbloquea todo el catálogo de modelos, admite límites personalizados y BYOK, sin permanencia obligatoria. Al comprar créditos, cesa la asignación mensual gratuita de $5. Las organizaciones con plan Enterprise pueden solicitar facturación tradicional sin comisiones de pasarela y negociar acuerdos personalizados por volumen.

Vercel ocupa la segunda posición debido a que su herramienta gestionada resuelve una necesidad muy extendida con una fricción casi nula, no porque abarque todo el abanico de gobernanza de herramientas. Es la opción idónea cuando la búsqueda web es el elemento que aporta valor al agente. Evítelo como gateway único si su agente debe interactuar de forma segura con sistemas internos de misión crítica.

3. Portkey: el mejor para unificar la autenticación sobre servidores MCP remotos

Portkey destaca cuando los servidores MCP ya están desarrollados y en funcionamiento, y la necesidad primordial es disponer de un punto centralizado para la administración de credenciales, permisos, aprobaciones y auditoría.

Documentación de Portkey MCP Gateway mostrando el acceso centralizado a servidores MCP
Portkey MCP Gateway

El Portkey MCP Gateway se intercala entre los clientes y los servidores MCP. El cliente se autentica una sola vez ante Portkey. El gateway valida los permisos para el servidor y la herramienta solicitados, inyecta la credencial corporativa correspondiente, redirige la petición y genera un registro detallado de la entrada y la salida. La autenticación con los servicios de destino soporta tokens OAuth, API keys o encabezados personalizados, mientras que los clientes pueden autenticarse mediante API keys de Portkey o tokens de su proveedor de identidad habitual.

Esta arquitectura resuelve el problema recurrente de distribuir credenciales de GitHub, Slack o servicios internos en cada entorno de desarrollo de agentes. Su MCP Registry almacena la configuración de los servidores y sus credenciales, permitiendo asignar permisos granulares por espacio de trabajo. Los filtros de contenido y los flujos de aprobación manual añaden una capa de control adicional antes de que se ejecuten acciones sensibles.

El límite funcional de Portkey es claro: gobierna el acceso a los servidores MCP, pero no actúa como la infraestructura de alojamiento de esas herramientas. Los servidores deben estar desplegados, mantenerse operativos y exponer las acciones correctamente en su propia infraestructura. Si su organización necesita transformar especificaciones OpenAPI o alojar servidores MCP basados en CLI, TrueFoundry o AgentCore asumen una mayor carga técnica.

Su plan inicial es accesible, pero se mide en función de los logs registrados. El nivel Developer es Free Forever y no bloquea el tráfico al superar el límite mensual de logs, aunque las peticiones excedentes no quedan registradas. Esto lo hace útil para prototipos, pero inviable para entornos de producción donde se requiere auditar qué usuario o agente alteró un registro de cliente.

Ideal para: equipos de plataforma que necesitan centralizar el acceso a servidores MCP remotos existentes
Puntos destacados: vía única de autenticación para clientes con inyección de credenciales salientes y control por workspace
Precios: el plan Developer es gratuito; el plan Production cuesta $49 al mes; el plan Enterprise tiene precio personalizado
Prueba gratuita: nivel Developer gratuito de forma permanente (Free Forever)

Lo bueno
Lo que hace bien
4 points

  • Centraliza autenticación de clientes, credenciales de destino, permisos y logs de auditoría
  • Soporta OAuth, API keys, cabeceras personalizadas y proveedores de identidad externos
  • Incluye registro de servidores MCP, filtros de contenido y flujos de aprobación humana
  • El plan Production ofrece un punto de partida asequible de $49 al mes
Lo malo
Dónde se queda corto
3 points

  • No elimina la necesidad de alojar y mantener la infraestructura de los servidores MCP remotos
  • El plan Developer registra únicamente 10,000 logs al mes con tres días de retención
  • Portkey desaconseja el plan Production para requisitos complejos de residencia de datos o seguridad a medida

El nivel Developer es Free Forever con 10,000 logs registrados al mes, tres días de retención de registros y 30 días de métricas. Portkey aclara explícitamente que no está concebido para producción. El plan Production cuesta $49 al mes e incluye 100,000 logs registrados, 30 días de retención, 90 días de métricas, RBAC, claves de cuentas de servicio, soporte para producción y caché estándar y semántica. Cada bloque adicional de 100,000 peticiones cuesta $9. Para un millón de peticiones registradas, el coste asciende a $130 mensuales antes de computar el uso de modelos.

El plan Enterprise requiere presupuesto a medida y está pensado para más de 10 millones de logs al mes. Añade retención personalizada, SSO, límites de consumo y rate limits detallados, soporte para nube privada, despliegue en VPC, exportación a data lakes, guardrails personalizados y controles avanzados de cumplimiento normativo.

Elija Portkey si su infraestructura de herramientas ya está desplegada de forma remota y opera de forma estable. Descártelo si el principal reto técnico es hospedar, transformar o desplegar privadamente los servidores MCP: en ese caso, adquirir únicamente la capa de proxy dejará sin resolver la parte más costosa de la implementación.

4. TrueFoundry: el mejor para control privado de MCP y formatos mixtos de herramientas

TrueFoundry es la opción más adaptada para organizaciones que necesitan un plano de control MCP gestionado con opción de despliegue en VPC propia o en entornos aislados (air-gapped).

Página de TrueFoundry AI Gateway mostrando gobernanza de modelos y servidores MCP
TrueFoundry AI Gateway

Su cobertura sobre MCP va más allá de un proxy remoto convencional. El TrueFoundry MCP Gateway incluye un registro centralizado, soporte para flujos OAuth estándar, servidores MCP virtuales, conversión de OpenAPI a MCP, alojamiento directo de servidores MCP basados en stdio y ejecución de comprobaciones de seguridad antes y después de cada llamada a una herramienta. Un servidor MCP virtual permite unificar y exponer un subconjunto específico de herramientas procedentes de múltiples servidores subyacentes para un equipo o flujo concreto.

Esta capacidad es muy valiosa en entornos empresariales mixtos. Una compañía puede contar con un servidor MCP remoto para recursos humanos, una API de facturación bajo OpenAPI y una herramienta interna de análisis de datos basada en línea de comandos. TrueFoundry permite gobernar las tres sin imponerles un modelo de despliegue homogéneo. Su nivel Enterprise admite instalaciones completas en VPC y redes aisladas tanto para el plano de control como para el plano de datos.

La dificultad radica en la transición de un prototipo básico a un entorno de control corporativo. El plan Developer es funcional pero ajustado. El plan Pro cuesta $499 al mes. Pro Plus sube a $2,999 al mes, y el plan Enterprise exige negociación comercial. La escala de precios pública no reduce el coste unitario por llamada a herramienta incluida: el plan Pro sitúa el millar de llamadas incluidas en $0.499, mientras que Pro Plus se sitúa en torno a $0.600 por cada 1,000 llamadas. Lo que se adquiere al subir de plan son mayores controles, más usuarios, más servidores y soporte ampliado, no un descuento por volumen.

Ideal para: organizaciones que necesitan unificar herramientas MCP remotas, basadas en OpenAPI y ejecutadas en stdio bajo gobernanza apta para entornos privados
Puntos destacados: servidores MCP virtuales, transformación de OpenAPI, soporte para stdio alojado y guardrails previos y posteriores a la invocación
Precios: Developer $0; Pro $499 al mes; Pro Plus $2,999 al mes; Enterprise personalizado
Prueba gratuita: siete días, sin necesidad de tarjeta de crédito

Lo bueno
Lo que hace bien
4 points

  • Soporta servidores MCP remotos, virtuales, generados desde OpenAPI y basados en stdio alojado
  • Proporciona opciones de despliegue en VPC y entornos air-gapped para clientes Enterprise
  • Evalúa guardrails antes y después de invocar las herramientas
  • Especifica con claridad los límites de servidores MCP y llamadas a herramientas en cada nivel
Lo malo
Dónde se queda corto
4 points

  • El plan Pro supone un salto de entrada a $499 al mes tras el nivel gratuito
  • Pro Plus cuesta $2,500 más que Pro sin reducir el coste unitario por llamada incluida
  • El despliegue en VPC y entornos air-gapped se reserva al plan Enterprise
  • Los excesos de consumo en Pro Plus requieren gestión con el departamento de ventas

El plan Developer cuesta $0 al mes e incluye 50,000 peticiones, tres usuarios, hasta cinco servidores MCP registrados y 50,000 llamadas a herramientas al mes. El plan Pro cuesta $499 al mes para 1 millón de peticiones, 10 usuarios, hasta 25 servidores MCP y 1 millón de llamadas a herramientas. Añadir capacidad en Pro cuesta $499 al mes por cada bloque adicional de 2 millones de peticiones y cinco claves API.

El plan Pro Plus cuesta $2,999 al mes e incluye 1 millón de peticiones, 25 usuarios, hasta 50 servidores MCP y 5 millones de llamadas a herramientas. Consumos superiores requieren acuerdo con ventas. El plan Enterprise utiliza tarifas personalizadas orientadas a más de 10 millones de peticiones mensuales, con límites a medida para usuarios, servidores y llamadas a herramientas.

TrueFoundry aventaja a Portkey si la heterogeneidad de formatos de las herramientas y la necesidad de aislamiento en infraestructura privada son prioritarias. Portkey es preferible si los servidores ya están operativos y se busca un proxy de autenticación más accesible. Por su parte, AgentCore resulta más adecuado si la arquitectura está fuertemente anclada en AWS, basándose en funciones Lambda y servicios OpenAPI nativos.

5. Kong AI Gateway: el mejor para infraestructuras basadas en Konnect

Kong AI Gateway es la alternativa más lógica cuando la organización ya utiliza Konnect para gestionar su catálogo corporativo de APIs y necesita extender esa gobernanza al tráfico de modelos, servidores MCP y comunicación entre agentes (A2A).

Página de Kong AI Gateway mostrando gobernanza de tráfico de IA empresarial
Kong AI Gateway

Con la versión Kong AI Gateway 3.14, Agent Gateway alcanzó disponibilidad general (GA) para producción el 13 de abril de 2026. La plataforma estructura el control en tres áreas complementarias: un LLM Gateway para el tráfico hacia modelos, un MCP Gateway para el acceso a herramientas y datos, y un Agent Gateway enfocado en el intercambio A2A. El lanzamiento oficial de Kong incorporó identidad y autenticación de agentes, observabilidad transversal para todos estos tipos de tráfico e inspección de mensajes entre agentes.

Para un usuario activo de Konnect, esto representa una unificación técnica real. El mismo equipo de plataforma puede extender las políticas de seguridad y los flujos operativos existentes al tráfico de agentes en lugar de evaluar, contratar y operar un gateway independiente para cada nuevo protocolo. El plan Plus admite proxies MCP ilimitados y agentes A2A ilimitados, con hasta cinco modelos de LLM distintos.

Para proyectos desde cero, el precio de entrada representa una barrera. El plano de control más básico en Plus es serverless y parte de $25 al mes, pero cada modelo de LLM administrado mediante los plugins de pago de AI cuesta $100 al mes. Proteger cinco modelos en un plano serverless cuesta $525 al mes antes de computar inferencia, volumen extra de peticiones, ancho de banda o complementos adicionales. La modalidad Hybrid incrementa el plano de control a $200 al mes. La opción Dedicated Cloud cuesta $500 mensuales más $0.15 por GB transferido.

Ideal para: organizaciones con despliegues previos de Kong que buscan unificar la gobernanza de APIs con tráfico LLM, MCP y A2A
Puntos destacados: marco de gobernanza homogéneo que cubre todo el ciclo de datos de IA
Precios: prueba de 30 días a $0; el plan Plus factura por gateway y por modelo; el plan Enterprise requiere presupuesto a medida y facturación anual
Prueba gratuita: 30 días, sin requerir tarjeta de crédito

Lo bueno
Lo que hace bien
4 points

  • Administra llamadas a modelos, consumo de herramientas MCP y tráfico entre agentes (A2A)
  • Incluye proxies MCP y agentes A2A ilimitados en el plan Plus
  • Aprovecha los procesos operativos y de cumplimiento ya implantados en la empresa
  • Desglosa métricas claras para plano de control, peticiones, proxies de modelos y ancho de banda
Lo malo
Dónde se queda corto
4 points

  • Un despliegue inicial con cinco modelos parte de $525 al mes en el plano de control más económico
  • El plan Plus limita a cinco los modelos de LLM únicos conectados
  • Dedicated Cloud añade un coste de $0.15 por GB además de la tarifa base del plano de control
  • Los planes Enterprise exigen acuerdos a medida con facturación anual obligatoria

La prueba gratuita de 30 días cuesta $0, no requiere tarjeta de crédito, desbloquea las limitaciones de gateway e incluye 30 días de retención de analítica. El plan Plus permite hasta cinco gateways serverless, dos híbridos y dos en nube dedicada. Incluye 1 millón de peticiones API al mes, cobrando $200 por cada millón adicional, con un techo máximo de 10 millones de peticiones mensuales en esta categoría.

El plan Enterprise suprime las limitaciones de gateways y proxies de modelos, añade plugins avanzados de AI Gateway y la consola AI Gateway Manager, operando bajo contratos anuales personalizados. Este esquema se ajusta a compromisos corporativos globales, pero impide estimar con antelación un presupuesto de costes directos.

El criterio con Kong es claro: rentabilizar la inversión existente. Si su organización ya financia, administra y confía en Konnect, Agent Gateway evita sumar otro proveedor al stack. Si no utiliza Kong previamente, pagar un mínimo de $525 al mes por cinco modelos implica asumir los costes de una plataforma de APIs compleja antes de comprobar si el proyecto de agentes realmente la requiere.

6. Cloudflare AI Gateway y Agents: el mejor stack en el edge de bajo coste

Cloudflare AI Gateway se posiciona como la alternativa de menor coste de plataforma para equipos dispuestos a combinar su gateway de modelos gratuito con el entorno de ejecución y herramientas disponible en Cloudflare Agents.

Documentación de Cloudflare AI Gateway detallando la configuración y controles del gateway
Cloudflare AI Gateway

Las funciones básicas de Cloudflare AI Gateway (panel de analítica, almacenamiento en caché, limitación de tasa y escaneo de DLP) son gratuitas en todos los planes. La inferencia de los proveedores se factura a precio de coste sin margen añadido. El servicio opcional de Unified Billing agrega un recargo del 5% sobre los créditos adquiridos, lo que significa que comprar $2,000 en créditos representa un coste de gestión de $100.

Las herramientas gestionadas para agentes se articulan a través de Cloudflare Agents, una plataforma diseñada para agentes de larga duración que proporciona herramientas nativas para Browser, Sandbox, AI Search, MCP y Payments. Sus plantillas iniciales soportan herramientas del lado del servidor y del cliente, flujos de supervisión humana (human-in-the-loop) y programación periódica de tareas. El runtime es compatible con OpenAI, Anthropic, Google Gemini y otros proveedores.

Se trata de un stack flexible, aunque distribuido en distintos módulos. AI Gateway administra el tráfico hacia los modelos. Cloudflare Agents aloja la lógica y expone las herramientas. Workers y las utilidades complementarias facturan su propio consumo y mantienen límites operativos independientes. Si su equipo busca un único panel donde transformar APIs internas, almacenar credenciales OAuth salientes y auditar cada llamada a herramientas, no debe asumir que el gateway gratuito resuelve todos esos aspectos de forma automática.

Ideal para: equipos que desarrollan sobre arquitecturas edge y buscan gobernanza de modelos sin coste de plataforma junto a un runtime gestionado para agentes
Puntos destacados: gateway central gratuito junto a herramientas de Browser, Sandbox, AI Search, MCP y Payments en Cloudflare Agents
Precios: el gateway básico es gratuito en todos los planes; Workers Free y Workers Paid ofrecen diferentes límites de retención de logs; Unified Billing aplica una comisión del 5%
Prueba gratuita: core del gateway sin coste y límites de uso del plan Workers Free

Lo bueno
Lo que hace bien
4 points

  • Analítica básica, caché, rate limiting y escaneo de DLP incluidos a coste $0
  • Inferencia directa sin márgenes adicionales sobre los proveedores
  • Agents proporciona herramientas gestionadas variadas sobre un runtime con persistencia de estado
  • Integración con los principales proveedores de modelos del mercado
Lo malo
Dónde se queda corto
4 points

  • El gateway y las herramientas para agentes se gestionan en productos y paneles independientes
  • Unified Billing aplica un recargo del 5% sobre los créditos adquiridos
  • El consumo de Workers, la ejecución de herramientas y la inferencia se facturan fuera del gateway gratuito
  • La cuota de logs gratuitos se comparte entre todos los gateways configurados en la cuenta

El plan Workers Free almacena hasta 100,000 logs persistentes en total para todos los gateways. Workers Paid amplía esta capacidad a 10 millones de logs por gateway. La funcionalidad de Logpush está disponible en Workers Paid e incluye 10 millones de peticiones al mes, facturando $0.05 por cada millón adicional. La evaluación de guardrails se procesa mediante inferencia por tokens en Workers AI, lo que implica que el gateway gratuito no exime de costes al aplicar políticas de seguridad automatizadas.

Cloudflare es la alternativa idónea si su infraestructura ya corre sobre Workers y busca ejecutar modelos, agentes con estado, navegación web, búsqueda y protocolos MCP cerca del usuario final. No resulta adecuado si su prioridad organizativa es contar con un plano unificado y estrictamente auditable para el control de herramientas, por encima del ahorro en el gateway. En este último escenario, AgentCore y TrueFoundry ofrecen una delimitación de seguridad mucho más clara.

Qué gateway elegir según su caso de uso

Elija Amazon Bedrock AgentCore Gateway si sus agentes necesitan conectarse a sistemas corporativos internos y su organización prefiere un servicio gestionado que se encargue de la transformación, autenticación, descubrimiento semántico y ejecución de esas herramientas. La balanza se inclina hacia soluciones más ligeras si la mayoría de sus servicios ya están disponibles como servidores MCP estables.

Elija Vercel AI Gateway si la búsqueda web es el único componente pendiente para lanzar su producto a producción. Descarte esta opción si su agente debe interactuar con sistemas internos mediante escritura, coordinar un catálogo privado de herramientas heterogéneas o administrar múltiples conexiones OAuth salientes.

Elija Portkey si los servidores MCP ya están desplegados y desea que las aplicaciones cliente se autentiquen en un único punto. Es la solución adecuada para equipos de plataforma que demandan un registro unificado, asignación por espacios de trabajo, filtrado de contenidos, autorizaciones manuales y logs detallados sin verse obligados a adoptar un runtime completo de agentes. Cambie de opción si su equipo aún necesita desarrollar o alojar la infraestructura de los servidores.

Elija TrueFoundry si la prioridad estratégica es el despliegue en VPC privada o entornos desconectados, el soporte para herramientas basadas en stdio, la conversión automática de OpenAPI a MCP, el uso de MCPs virtuales o la aplicación de guardrails antes y después de cada llamada. Considere Portkey si busca un proxy remoto más económico, o AgentCore si su infraestructura central está en AWS.

Elija Kong AI Gateway si Konnect ya es la plataforma homologada para la gestión de APIs en su empresa. La reutilización de equipos técnicos, políticas de seguridad y contratos de proveedor existentes puede hacer que la capa de agentes resulte más rentable que lo sugerido por sus precios para proyectos nuevos. Evítelo si pretende adquirir Kong exclusivamente para un piloto aislado de agentes.

Elija Cloudflare AI Gateway y Agents si su desarrollo se basa en Workers y su equipo se siente cómodo orquestando el gateway, el runtime y las herramientas de forma modular. Reconsidere la elección si las áreas de seguridad o compras exigen una plataforma única con un único responsable para supervisar conjuntamente el tráfico de modelos y de herramientas.

Flujo de decisión que orienta a los compradores hacia AWS, Vercel, Portkey, TrueFoundry, Kong o Cloudflare en función de la frontera operativa que necesitan controlar
Oriente la elección del gateway según la frontera operativa más compleja de su flujo de agentes

Tenga en cuenta que no incorporar un gateway adicional también es una decisión válida. Si un único proveedor ya resuelve los modelos, herramientas, identidades, logs y límites presupuestarios que su flujo demanda, introducir una capa intermedia añade puntos potenciales de fallo sin simplificar el trabajo técnico. Antes de contratar un servicio, defina qué cuenta externa, secreto, adaptador de código, política manual o guardia de guardia dejará de ser necesario gracias a ese gateway.

La factura del plano de herramientas: por qué un gateway gratuito puede resultar más caro

La facturación del gateway y la de las herramientas deben analizarse en líneas separadas. El caso de la búsqueda web expone esta diferencia con total claridad, dado que AWS Web Search y Vercel Exa Search establecen idéntica tarifa: $7 por cada 1,000 consultas.

Para un volumen de 100,000 interacciones mensuales de agentes, considere una búsqueda semántica de herramientas, tres invocaciones a herramientas internas, 100 herramientas indexadas y una consulta de búsqueda web por interacción. La capa de gateway de AgentCore supone $4.02 al mes: $2.50 por llamadas a Search API, $1.50 por llamadas a InvokeTool y $0.02 por indexación. La búsqueda web añade $700. El subtotal visible alcanza los $704.02 antes de sumar costes de modelos, entorno de ejecución, guardrails, observabilidad, red y servicios backend.

Por su parte, el gateway de tokens de Vercel no aplica cuota fija de plataforma. Para 100,000 búsquedas con Exa tras el 31 de agosto, el coste de la herramienta añade $700. El subtotal visible resulta ser de $700 exactos antes de computar el uso de modelos y los cargos opcionales por informes o políticas de seguridad para todo el equipo.

Dos balances contables que separan los costes de gateway de los costes de búsqueda gestionada para un mes con 100,000 tareas
El coste de búsqueda es idéntico en este escenario; cada solución elimina una carga operativa distinta

Una diferencia de $4.02 no debería definir la arquitectura técnica. El cálculo de AgentCore contempla además el descubrimiento semántico y tres invocaciones a herramientas internas por cada interacción. El caso de Vercel cubre la integración directa de la búsqueda web. La conclusión fundamental no es cuál resulta cuatro dólares más económica, sino que ambas soluciones sitúan un coste de herramientas de $700 detrás de un gateway con una cuota de plataforma ínfima o inexistente.

Esta misma realidad se repite en el resto de proveedores:

  • Portkey: un millón de peticiones registradas cuesta $130 en el plan Production antes de sumar modelos y el hosting de los servidores MCP.
  • TrueFoundry: el plan Pro cuesta $499 por 1 millón de llamadas a herramientas al mes; Pro Plus cuesta $2,999 por 5 millones. Subir de plan no reduce el coste por llamada.
  • Kong: proteger cinco modelos con el plano de control serverless más económico cuesta $525 antes de incluir inferencia y complementos.
  • Cloudflare: el núcleo del gateway es gratuito, pero Unified Billing añade $100 al adquirir $2,000 en créditos, mientras que el uso de Workers y de las herramientas se factura por separado.

Configure límites estrictos de gasto en el proveedor de modelos siempre que este lo soporte. Un techo presupuestario en el gateway detiene el tráfico en la capa de control, pero no debe ser la única barrera de seguridad sobre credenciales que puedan ser utilizadas en otros entornos.

Opciones a evitar según el contexto

Evite Vercel si la necesidad primordial es transformar APIs internas

La integración gestionada de Exa en Vercel es efectiva precisamente por su diseño específico. No cometa el error de asumir que este gateway transformará un catálogo privado de APIs OpenAPI, custodiará credenciales salientes complejas y gobernará todas las operaciones internas de la empresa. Para esos requerimientos, utilice AgentCore o TrueFoundry.

Evite Kong para pilotos pequeños que parten desde cero

Kong puede ser una plataforma corporativa excelente, pero suele ser la opción equivocada para un experimento inicial. Configurar cinco proxies de modelos en el plano de control serverless Plus más asequible supone $525 mensuales antes de computar inferencia. Si su organización no dispone de una infraestructura previa de Konnect, comience validando las necesidades reales del flujo antes de adoptar una plataforma de esta escala.

Evite Cloudflare si es imprescindible contar con un plano único de políticas

Cloudflare AI Gateway y Cloudflare Agents se complementan de manera eficiente, pero operan como productos independientes. No permita que la gratuidad del gateway básico condicione el análisis de la arquitectura. Establezca con precisión qué producto asumirá los logs de modelos, la ejecución de herramientas, las autorizaciones humanas, la gestión de secretos y la respuesta a incidentes antes de catalogarlo como una plataforma unificada.

Evite Portkey si no hay un responsable claro de los servidores MCP

Un proxy con gobernanza no puede compensar la falta de mantenimiento de los servidores de herramientas. Si un endpoint MCP remoto se interrumpe, devuelve respuestas no autorizadas o altera su esquema sin aviso, Portkey registrará la incidencia, pero otro equipo tendrá que resolver la avería del servicio. Elija un producto con capacidades de alojamiento o transformación directa cuando esa sea la carencia principal de su equipo.

Evite contratar un plan de pago antes de rentabilizar una primera acción

Un agente con un catálogo sobredimensionado de herramientas resulta llamativo, pero es sumamente complejo de autorizar y auditar con seguridad. Comience por una única acción de impacto reversible, con un responsable identificado y una condición de parada clara. La distinción entre instrucciones reutilizables y herramientas ejecutables también es crucial: las habilidades de agentes y las APIs de herramientas resuelven problemas de reutilización diferentes. Evite adquirir un gateway para solucionar lo que en realidad es una deficiencia de diseño en su arquitectura.

El paso para el lunes: presupueste un flujo de agentes de extremo a extremo

Seleccione un flujo de trabajo concreto por el que su empresa ya pague a personas para ejecutarlo hoy, como verificar el estado de un pedido y actualizar un ticket en el sistema de soporte. Documente el flujo como una secuencia lineal: consulta del usuario, llamada al modelo, descubrimiento de la herramienta, intercambio de credenciales, invocación de la herramienta, recepción del resultado, paso de aprobación humana y registro de auditoría.

Asigne un responsable técnico y una línea de coste mensual estimada a cada paso. Incluya tokens de modelos, peticiones al gateway, llamadas a motores de búsqueda o navegadores headless, hosting de herramientas, almacenamiento de logs, revisiones de seguridad y guardias de soporte. Refleje las promociones temporales en una columna aparte dentro de su hoja de cálculo para evitar que distorsionen los supuestos estructurales de costes.

A continuación, ejecute ese flujo de forma controlada durante una semana. Asegúrese de que la primera acción ejecutada sea reversible. Establezca un límite presupuestario en el proveedor, un tope de consumo en el gateway y una condición de parada automática ante fallos de autorización, errores de herramientas o salidas anómalas. Analice los registros de auditoría conjuntamente con el responsable del sistema modificado, no únicamente dentro del equipo de IA.

La decisión a tomar se resume en criterios directos:

  • Si la mayor carga radica en desarrollar adaptadores y gestionar identidades internas, evalúe un prototipo en AgentCore o TrueFoundry.
  • Si el lanzamiento depende exclusivamente de habilitar búsqueda web, utilice Vercel y reserve un presupuesto de $7 por 1,000 consultas para después del 31 de agosto.
  • Si el principal problema es la dispersión de credenciales, instale Portkey frente a sus servidores MCP actuales.
  • Si la prioridad es la estandarización de plataforma, amplíe el uso de Kong o Cloudflare solo si su organización ya cuenta con personal asignado a esas plataformas.
  • Si la solución evaluada no elimina un coste tangible ni reduce una superficie de control operativa, conserve su arquitectura actual.

El gateway ganador es aquel que suprime una partida de gasto real o libera a un responsable técnico de tareas de mantenimiento, respetando en todo momento el esquema de permisos de los sistemas corporativos subyacentes. Cualquier funcionalidad que no produzca ese impacto directo no justifica una migración de infraestructura.

Preguntas frecuentes

¿Qué es un AI gateway?

Un AI gateway es una capa de control intermedia entre una aplicación y los proveedores de inteligencia artificial. Permite incorporar enrutamiento inteligente, reintentos automáticos, observabilidad, políticas de seguridad y límites de gasto. Algunos gateways modernos también gestionan herramientas y tráfico entre agentes (A2A), aunque estas capacidades deben verificarse de forma independiente a la gestión de modelos.

¿Qué es un MCP gateway?

Un MCP gateway administra el modo en que las aplicaciones cliente descubren e invocan servidores y herramientas bajo el estándar Model Context Protocol. Sus funciones principales incluyen la autenticación de clientes, la inyección de credenciales hacia los servicios de destino, el control de acceso por herramienta, flujos de aprobación, registro de auditoría y, en determinados casos, la transformación o alojamiento de herramientas.

¿Qué AI gateway es gratuito?

Vercel incluye $5 mensuales de crédito en su plan Free, Portkey cuenta con un nivel Developer gratuito de forma permanente (Free Forever), TrueFoundry ofrece un nivel Developer a $0 y una prueba de siete días, Kong dispone de una prueba de 30 días a $0, y Cloudflare ofrece su gateway básico de forma gratuita en todos sus planes. Por su parte, AgentCore Gateway opera bajo cobro por uso real, si bien los nuevos clientes de AWS pueden recibir hasta $200 en créditos promocionales. El consumo de modelos, herramientas, ejecución, logs y políticas avanzadas puede generar costes adicionales.

¿Cuál es el mejor gateway para LLM?

Para la gestión integral de herramientas para agentes, Amazon Bedrock AgentCore Gateway es la opción más completa del mercado. Vercel destaca para habilitar búsqueda web sin configuración previa, Portkey para gobernar el acceso a servidores MCP existentes, TrueFoundry para entornos privados de MCP, Kong para infraestructuras que ya operan sobre Konnect, y Cloudflare para arquitecturas nativas en el edge. Si su necesidad se restringe al enrutamiento de modelos, compare de forma independiente los márgenes por token, algoritmos de enrutamiento, almacenamiento en caché y controles de cada proveedor.

Obtenga la lista de verificación para auditar flujos de trabajo de IA en su negocio

Convierta una iniciativa de agentes en un flujo de trabajo claramente acotado con un responsable técnico, un presupuesto asignado, una frontera de permisos y una condición de parada definida. Suscríbase para descargar la checklist de forma gratuita.

Última actualización

3 sept 2026

CategoríaBuild

Prefiera este sitio en Google

Añadir omidsaffari.com como fuente preferida en la Búsqueda de Google

Marque omidsaffari.com como fuente preferida y Google lo destacará para usted en Top Stories, AI Overviews y AI Mode.

Newsletter

Una carta, cada domingo. Sistemas que funcionan, no opiniones calientes.

Build logs, sistemas en producción y notas de campo de un portafolio de ventures de IA.

Semanal. Sin spam. Cancele cuando quiera.