Melhores Gateways de IA Com Ferramentas Gerenciadas para Agentes 2026
Compare AWS AgentCore, Vercel, Portkey, TrueFoundry, Kong e Cloudflare em ferramentas gerenciadas, preços reais e custos operacionais eliminados.

O Amazon Bedrock AgentCore Gateway é o gateway de ferramentas gerenciadas mais robusto no geral; o Vercel AI Gateway é a forma mais rápida de fornecer busca web em produção para um agente. Em um milhão de interações mensais de agentes, a camada de gateway do AgentCore custa cerca de $40.02 antes dos custos de modelo, busca web e backend, enquanto a Vercel elimina a necessidade de conta e chave separadas da Exa, mas passa a cobrar $7 por 1,000 buscas após 31 de agosto de 2026.
Qual é o melhor gateway de IA para ferramentas gerenciadas?
Um gateway de IA justifica seu lugar na arquitetura de agentes quando elimina uma superfície de controle, e não quando apenas insere outro endpoint na frente de um modelo. Para ferramentas gerenciadas, as perguntas decisivas são se o gateway consegue transformar serviços existentes em ferramentas, armazenar credenciais, definir quem pode acioná-las, ajudar o agente a encontrar a ferramenta certa e registrar exatamente o que aconteceu.
Escolha o Amazon Bedrock AgentCore Gateway quando os agentes precisarem chamar APIs internas e sistemas SaaS sob uma única fronteira de identidade gerenciada. Ele consegue converter fontes OpenAPI, Smithy e Lambda em ferramentas compatíveis com MCP, intermediando a autenticação de entrada e de saída.
Escolha o Vercel AI Gateway quando o problema imediato for busca web. Sua integração com a Exa elimina contas, chaves e faturamento separados. Essa é uma redução operacional significativa, embora mais restrita do que transformar as APIs internas de uma empresa em ferramentas governadas.
Escolha o Portkey quando os servidores MCP já existirem e a camada ausente for autenticação, aprovações e auditoria. Escolha o TrueFoundry quando a localização de implantação, servidores stdio hospedados, MCPs virtuais ou guardrails pré e pós-chamada forem essenciais. Escolha a Kong se o Konnect já controla o ecossistema de APIs da empresa. Escolha a Cloudflare se o time busca recursos básicos de gateway gratuitos e se sente confortável configurando ferramentas gerenciadas na plataforma separada de Agents.
O que são ferramentas gerenciadas para agentes e o que elas não cobrem
Um gateway de modelos roteia prompts para modelos. Um MCP gateway controla como os agentes descobrem e acionam ferramentas. Alguns produtos fazem as duas coisas, mas as faturas e os modos de falha continuam completamente separados.
Essa distinção é fundamental porque uma chamada de modelo normalmente lê informações e gera uma resposta, enquanto uma chamada de ferramenta pode alterar um sistema. Um agente de suporte pode usar um modelo para interpretar uma solicitação e, em seguida, usar ferramentas para ler uma conta, emitir um estorno e atualizar um ticket. O gateway de modelos pode governar a primeira etapa sem ter qualquer visibilidade se a segunda etapa foi autorizada.
Um gateway confiável de ferramentas gerenciadas assume diversas responsabilidades:
- Provisionamento: Disponibiliza uma API, função ou servidor MCP remoto sem que cada time de aplicação precise recriar a conexão.
- Identidade: Verifica o agente ou usuário chamador e entrega a credencial autorizada para a ferramenta de destino.
- Políticas: Limita qual ferramenta e qual ação o chamador pode executar, às vezes exigindo uma etapa de aprovação humana.
- Descoberta: Ajuda o modelo a selecionar a ferramenta adequada sem carregar o esquema de todas as ferramentas no prompt.
- Auditoria: Registra qual identidade acionou qual ferramenta, com quais parâmetros e qual foi o resultado retornado.
Gerenciado nem sempre significa execução hospedada. O Portkey pode atuar como proxy e governar um servidor MCP remoto enquanto outra infraestrutura cuida da execução. O Cloudflare Agents pode hospedar um agente e fornecer ferramentas gerenciadas, enquanto o Cloudflare AI Gateway continua sendo apenas a camada de controle do modelo. A Vercel consegue provisionar o Exa Search de forma nativa, mas essa integração isolada não oferece a camada de transformação de OpenAPI para MCP que o AgentCore possui.
A consequência prática disso é uma fatura separada para o plano de ferramentas. Ela engloba chamadas de gateway, consumo de busca ou navegador, hospedagem de ferramentas, gestão de segredos, logs, aprovações e o custo do engenheiro responsável por intervir quando uma ferramenta começa a falhar. Um gateway de modelos com markup zero ainda pode deixar a maior parte dessa conta intacta.
É exatamente por isso que a rota de modelo mais barata nem sempre representa o fluxo de trabalho de agente mais econômico. O comparativo amplo de custos de gateways de modelos de IA é indicado quando a decisão principal envolve roteamento de tokens. Ferramentas gerenciadas para agentes exigem uma planilha própria de custos.
Como estes gateways de IA foram avaliados
A classificação baseia-se em quatro critérios de compra. Primeiro, quanto trabalho operacional de ferramentas o produto realmente gerencia: transformação, registro, credenciais, descoberta, execução ou tráfego A2A. Segundo, se o acesso pode ser restringido por pessoa, agente, workspace ou ferramenta. Terceiro, se o comprador consegue estimar o custo de produção a partir de preços públicos atualizados. Quarto, onde surge a barreira técnica do produto: uma restrição de implantação, uma interface de produto separada, limites de requisições ou cobranças fixas de plano de controle.
Páginas de preços, documentações técnicas, limites de planos e anúncios de lançamento foram verificados diretamente em 27 de agosto de 2026. Cada seção classificada traz uma captura de tela atual do produto ou documentação. Os sistemas não foram submetidos a tráfego de produção real durante esta análise; portanto, nenhum dado de latência, disponibilidade, taxa de sucesso de chamadas de ferramentas ou suporte deve ser interpretado como benchmark de laboratório.
Seis gateways foram selecionados porque cada um atende com solidez a uma necessidade específica. Ferramentas que ofereciam apenas roteamento de modelos, não apresentavam governança clara de ferramentas ou ocultavam todos os valores comerciais atrás de equipes de vendas foram descartadas. Preços transparentes não garantiram o topo do ranking, mas facilitaram muito o cálculo do impacto operacional.
A ordem prioriza a eliminação de trabalho de engenharia e segurança em vez da maior lista de funcionalidades. Uma integração focada pode superar uma plataforma ampla se ela resolver exatamente o gargalo que um time pequeno enfrenta agora. Uma plataforma ampla só se torna vencedora geral quando sua estrutura substitui tarefas que o comprador teria de construir internamente.
1. Amazon Bedrock AgentCore Gateway: melhor para ecossistemas corporativos de ferramentas
O Amazon Bedrock AgentCore Gateway é a melhor escolha geral quando o agente precisa acessar um conjunto heterogêneo de APIs internas, funções AWS, serviços SaaS, outros agentes e modelos por meio de um ponto central de controle.

Seu principal diferencial é a capacidade de transformação. O AgentCore Gateway aceita especificações OpenAPI, modelos Smithy ou funções AWS Lambda e os expõe como ferramentas compatíveis com MCP. Uma equipe de plataforma pode colocar uma API existente de gestão de férias atrás do gateway em vez de exigir que cada time de aplicação desenvolva e hospede um adaptador MCP próprio.
A camada de identidade é igualmente robusta. O AgentCore gerencia a autenticação de entrada para o chamador e a autenticação de saída para o destino. Ele suporta fluxos OAuth, renovação de tokens e armazenamento seguro de credenciais. O agente recebe permissão para acionar uma ferramenta; ele não precisa ter a chave de API ou credencial do Salesforce, Slack ou Jira para executar a ação. Há integrações diretas em um clique para Salesforce, Slack, Jira, Asana e Zendesk.
Conforme o catálogo cresce, a seleção semântica de ferramentas ajuda o agente a encontrar a função certa sem precisar carregar todas as definições de esquemas no contexto. Isso reduz o tamanho do prompt e torna viável um catálogo com dezenas de ações internas. O gateway também pode atuar na frente de serviços HTTP e tráfego A2A (agent-to-agent), permitindo expandir a governança para além do protocolo MCP.
O ponto de atrito é a complexidade operacional da AWS. O AgentCore remove a infraestrutura do gateway, mas exige conhecimento de gestão de identidade da AWS, regiões, permissões de serviço, logs e os sistemas que estão sendo expostos. Equipes que não operam na AWS podem economizar código de adaptadores, mas criam um novo desafio de gestão de nuvem. O produto é ideal quando a AWS já é um ambiente aprovado ou quando a governança de identidade e a conversão de APIs compensam essa curva.
Melhor para: Empresas transformando APIs e funções legadas em ferramentas governadas para agentes
Destaque: Conversão de OpenAPI, Smithy e Lambda com autenticação de entrada e saída
Preços: $0.005 por 1,000 invocações de API do gateway, $0.025 por 1,000 chamadas de Search API e $0.02 por 100 ferramentas indexadas por mês; sem compromisso inicial ou taxa mínima
Avaliação gratuita: Baseado em consumo; novos clientes AWS podem receber até $200 em créditos no AWS Free Tier
- Converte três formatos empresariais comuns em ferramentas compatíveis com MCP
- Intermedeia a identidade do chamador e as credenciais dos serviços de destino
- Inclui seleção semântica para catálogos extensos de ferramentas
- Modelo de cobrança puramente baseado em consumo, sem assinaturas fixas
- Exige configuração operacional e de identidade na AWS para equipes fora desse ecossistema
- O Web Search é cobrado separadamente a $7 por 1,000 consultas
- Custos de modelo, runtime, observabilidade, políticas e serviços de destino ficam fora da conta do gateway
Uma estratégia segura para implementar o AgentCore Gateway
A forma mais prudente de iniciar a implantação é com uma ação isolada, e não com o ecossistema inteiro de APIs. Escolha um fluxo com um responsável definido, um impacto reversível e um modelo de permissões já aprovado pelo time de segurança.
Mapeie uma única ação autorizada
Escolha um serviço com OpenAPI ou uma função Lambda, como a consulta de saldo de férias. Exponha exclusivamente a operação necessária para o primeiro agente. Um escopo reduzido facilita a auditoria de autorizações e o diagnóstico de falhas.
Defina as duas camadas de identidade
Determine quem tem autorização para chamar o gateway e qual credencial de saída acessará o destino. Trate isso como duas decisões independentes. A identidade do agente não deve ser uma cópia direta da credencial do serviço final.
Indexe descrições claras, não todo o inventário
Crie nomes e descrições objetivos para o conjunto selecionado. Utilize a seleção semântica apenas quando as descrições tornarem a intenção inequívoca. Uma busca semântica não consegue diferenciar duas ferramentas com descrições ambíguas.
Monitore custos e valide com tráfego reduzido
Direcione uma fração controlada do tráfego, contabilize chamadas de Search API e InvokeTool, e acompanhe os custos de modelos, busca web, runtime e backend separadamente. Escale somente após validar a taxa de sucesso e os logs de autorização.
A escolha deixa de favorecer o AgentCore se o time já mantém servidores MCP remotos e precisa apenas de um proxy centralizado para autenticação e auditoria. O Portkey resolve esse cenário de forma mais direta. Da mesma forma, se a busca web for a única ferramenta pendente e a rapidez de deploy for a prioridade, a Vercel é o caminho mais curto.
2. Vercel AI Gateway: melhor para busca gerenciada sem fricção
O Vercel AI Gateway é a melhor opção quando o agente precisa de busca web em tempo real e o maior atrito é criar outra conta de fornecedor, gerar novas chaves, implementar integrações e configurar faturamento adicional.

O Exa Search agora é uma ferramenta nativa do AI Gateway. Ele funciona com qualquer modelo compatível com o AI Gateway sem precisar de conta ou chave de API separada na Exa. A aplicação simplesmente passa gateway.tools.exaSearch(), o gateway direciona a consulta para a Exa, entrega o resultado ao modelo e mantém o ciclo de ferramentas ativo até que a busca seja concluída.
Isso elimina tarefas burocráticas imediatas. Um time enxuto pode adicionar busca fundamentada na web sem novos contratos de compras ou gestão de novos segredos. A vantagem é a agilidade de configuração, e não um desconto permanente. A Vercel lista o Exa Search a $7 por 1,000 consultas, repassando o preço de tabela sem margem adicional. Essa busca é gratuita apenas até 31 de agosto de 2026; portanto, qualquer planejamento de produção deve considerar o valor pós-promoção.
Com 100,000 buscas mensais, o custo de Exa atinge $700. A Vercel não cobra taxas de plataforma ou markup sobre tokens de modelos, mas controles opcionais de governança geram linhas de custo adicionais. Relatórios customizados custam $0.075 por 1,000 gravações e $5 por 1,000 consultas de relatório. Uma allowlist de provedores para toda a equipe custa $0.10 por 1,000 requisições bem-sucedidas nos planos Pro e Enterprise (o filtro individual por requisição com only não tem custo extra). A política de retenção zero de dados (ZDR) em nível de equipe também custa $0.10 por 1,000 requisições nesses planos, enquanto o ZDR por requisição não tem taxa extra.
A limitação é o escopo funcional. A Vercel eliminou a barreira de provisionamento para uma ferramenta de busca útil, mas não funciona como uma camada genérica de transformação para APIs internas OpenAPI. Se a meta for expor APIs privadas de faturamento, estoque ou RH com OAuth de saída, soluções como AgentCore ou TrueFoundry atendem melhor.
Melhor para: Equipes adicionando busca gerenciada a aplicações baseadas no AI SDK
Destaque: Exa Search nativo sem necessidade de conta ou chave separada
Preços: Plano Free inclui $5 mensais em créditos para modelos selecionados; planos pagos utilizam créditos comprados pelo preço de tabela dos provedores sem markup sobre tokens; clientes Enterprise contam com faturamento por fatura e descontos por volume negociados
Avaliação gratuita: Nível gratuito disponível; a compra de créditos encerra o benefício de $5 mensais gratuitos
- Dispensa conta, chaves e faturamento separados com a Exa
- Compatível com qualquer modelo disponível no AI Gateway
- Sem taxa de plataforma ou acréscimo no valor dos tokens
- Reduz o tempo necessário para conectar modelos a buscas web reais
- Promoção de busca gratuita com Exa termina em 31 de agosto de 2026
- Custo de $7 por 1,000 consultas após o período promocional
- Não substitui uma camada corporativa de transformação de APIs para MCP
- Relatórios globais e regras de governança podem gerar custos adicionais por requisição
O nível Free oferece $5 em créditos mensais, um catálogo limitado de modelos elegíveis, limites operacionais menores por modelo e não permite BYOK. O modelo pago funciona no formato pay as you go mediante compra de créditos, libera o catálogo integral, autoriza limites personalizados e BYOK, sem exigência de contrato mínimo. Assim que novos créditos são adquiridos, o crédito mensal de $5 é cancelado. Contratos Enterprise permitem pagamento via fatura sem taxas de processamento e descontos negociados por volume de tokens.
A Vercel ocupa a segunda posição pela facilidade de adoção e impacto imediato dessa ferramenta, e não por cobrir todos os cenários de ferramentas. Adote-a se a busca for o recurso principal que o agente precisa. Não a utilize como gateway único se o agente precisar modificar sistemas internos com segurança.
3. Portkey: melhor plano de autenticação unificado para servidores MCP remotos
O Portkey se destaca quando os servidores MCP já estão em execução e a organização necessita de uma camada unificada de credenciais, permissões, aprovações e auditoria.

O Portkey MCP Gateway opera entre os clientes MCP e os servidores. O cliente faz uma única autenticação no Portkey. O gateway valida se ele tem permissão para acessar o servidor e a ferramenta solicitados, injeta a credencial aprovada no destino, encaminha a chamada e grava o log da requisição e da resposta. A autenticação de destino pode usar tokens OAuth, chaves de API ou headers customizados, enquanto os chamadores podem se autenticar via chaves do Portkey ou provedores de identidade corporativos.
Essa é a solução prática para equipes de plataforma que querem parar de espalhar credenciais do GitHub, Slack ou APIs internas em múltiplos workspaces de agentes. O MCP Registry centraliza a configuração e as credenciais dos servidores, permitindo liberar acesso granular para cada workspace. Filtros de conteúdo e etapas de aprovação garantem controle extra antes da execução de operações sensíveis.
A fronteira do Portkey é clara: ele controla o acesso a servidores MCP, mas não atua como infraestrutura de execução das ferramentas. O servidor precisa estar rodando de forma estável em outro lugar. Se a demanda for converter APIs OpenAPI ou hospedar ferramentas MCP de linha de comando, TrueFoundry ou AgentCore resolvem melhor o problema.
O plano de entrada gratuito é interessante, mas limitado pela contagem de logs gravados. O plano Developer é gratuito para sempre e continua permitindo tráfego após o limite de logs, mas as requisições excedentes não são armazenadas. Isso torna o plano viável para protótipos, mas inadequado para provar quem alterou um registro em produção.
Melhor para: Equipes de plataforma centralizando o acesso a servidores MCP remotos existentes
Destaque: Autenticação única para o cliente com injeção segura de credenciais e provisionamento por workspace
Preços: Developer gratuito; Production por $49 por mês; Enterprise sob consulta
Avaliação gratuita: Plano Developer gratuito para sempre
- Centraliza autenticação do cliente, credenciais de destino, permissões e registros de auditoria
- Suporte a OAuth, chaves de API, headers de identidade e IdPs externos
- Conta com MCP Registry, filtros de moderação e fluxos de aprovação humana
- Plano Production tem preço inicial acessível de $49 mensais
- Não gerencia a hospedagem ou execução do servidor MCP remoto
- Plano Developer armazena apenas 10,000 logs por mês com retenção de apenas três dias
- O próprio Portkey não recomenda o plano Production para requisitos complexos de residência de dados ou conformidade personalizada
O plano Developer é gratuito para sempre, inclui 10,000 logs mensais gravados, retenção de três dias e 30 dias de métricas. O Portkey indica formalmente que ele não é voltado para produção. O plano Production custa $49 por mês para 100,000 logs gravados, retenção de 30 dias, 90 dias de métricas, RBAC, chaves para contas de serviço, suporte de produção e cache semântico e simples. Cada lote extra de 100,000 requisições custa $9. Com um milhão de requisições gravadas, o custo fica em $130 antes do consumo de modelos.
O plano Enterprise trabalha com preços customizados e é indicado a partir de 10 milhões de logs mensais. Ele traz retenção personalizada, SSO, orçamentos detalhados, limites de taxa, implantação em nuvem privada ou VPC, exportação para data lakes, hooks de guardrails customizados e recursos avançados de conformidade.
A balança pende para o Portkey quando o ecossistema de ferramentas já é remoto e estável. Ela pende para outras opções quando hospedar, transformar ou isolar os servidores MCP for a demanda técnica prioritária. Comprar apenas um proxy nesse caso deixa o trabalho pesado sem solução.
4. TrueFoundry: melhor para controle privado de MCP e formatos híbridos
O TrueFoundry é a opção ideal quando a organização exige um plano de controle MCP gerenciado com suporte para implantação em VPC ou ambiente air-gapped.

Sua atuação em MCP vai além do proxy tradicional. O TrueFoundry MCP Gateway traz um registro curado, fluxos padrão de OAuth, servidores MCP virtuais, conversão de OpenAPI para MCP, hospedagem de servidores MCP baseados em stdio e guardrails aplicados antes e depois das chamadas de ferramentas. Um servidor MCP virtual pode agrupar ferramentas específicas de múltiplos servidores de backend e entregá-las para uma equipe ou fluxo exclusivo.
Essa flexibilidade é útil em arquiteturas com ferramentas variadas. Uma empresa pode ter um servidor MCP remoto de RH, uma API de faturamento em OpenAPI e uma ferramenta CLI de análise de dados. O TrueFoundry consegue unificar a governança dessas três origens sem exigir que todas adotem a mesma infraestrutura de hospedagem. O plano Enterprise inclui instalações completas em VPC e ambientes isolados para o plano de dados e controle.
O principal obstáculo é o salto de custo entre a prototipagem e a governança corporativa. O plano Developer é útil, porém restrito. O plano Pro custa $499 por mês. O Pro Plus sobe para $2,999 mensais, e o plano Enterprise exige orçamento comercial. O plano pago mais caro não reduz o custo unitário da capacidade incluída de chamadas: o Pro custa $0.499 por 1,000 chamadas inclusas, enquanto o Pro Plus custa cerca de $0.600 por 1,000. O cliente está pagando por controles administrativos, usuários e volume absoluto, e não por desconto em escala.
Melhor para: Ambientes combinando ferramentas MCP remotas, OpenAPI e stdio hospedado sob governança privada
Destaque: MCPs virtuais, conversão de OpenAPI, execução de stdio e guardrails pré e pós-execução
Preços: Developer $0, Pro $499 por mês, Pro Plus $2,999 por mês, Enterprise sob medida
Avaliação gratuita: Sete dias de teste, sem exigência de cartão de crédito
- Compatível com servidores MCP remotos, virtuais, derivados de OpenAPI e stdio hospedado
- Opções de implantação em VPC e ambiente air-gapped no plano Enterprise
- Validação por guardrails antes e depois da execução de ferramentas
- Apresenta limites objetivos de servidores MCP e chamadas de ferramentas por plano
- Plano Pro tem valor de entrada de $499 por mês após a camada gratuita
- Pro Plus custa $2,500 a mais que o Pro sem diminuir o custo unitário por chamada incluída
- Ambientes VPC e air-gapped dependem de negociação comercial no Enterprise
- Consumo excedente no Pro Plus exige contato com o departamento de vendas
O plano Developer custa $0 por mês para 50,000 requisições, três usuários, até cinco servidores MCP registrados e 50,000 chamadas de ferramentas. O Pro custa $499 por mês para 1 milhão de requisições, 10 usuários, até 25 servidores MCP e 1 milhão de chamadas de ferramentas. Um pacote extra de uso no Pro adiciona 2 milhões de requisições e cinco chaves de API por mais $499 mensais.
O Pro Plus custa $2,999 por mês para 1 milhão de requisições, 25 usuários, até 50 servidores MCP e 5 milhões de chamadas de ferramentas. Uso além disso requer alinhamento comercial. O Enterprise oferece limites customizados de requisições, usuários, servidores e ferramentas para operações com mais de 10 milhões de requisições por mês.
O TrueFoundry supera o Portkey quando o formato das ferramentas e a necessidade de isolamento de infraestrutura são o maior desafio. O Portkey ganha se os servidores já estiverem disponíveis e o foco for um proxy de autenticação mais acessível. Já o AgentCore é superior quando a transformação de APIs e Lambdas na AWS for o centro do projeto.
5. Kong AI Gateway: melhor para empresas que já utilizam o Konnect
O Kong AI Gateway é a solução ideal quando a plataforma Konnect já gerencia o tráfego de APIs da empresa e o objetivo é estender essas políticas para modelos, MCP e comunicação entre agentes.

Com a versão 3.14 do Kong AI Gateway, lançada em 13 de abril de 2026, o Agent Gateway entrou em disponibilidade geral (GA) para produção. O produto estrutura três frentes de tráfego: o LLM Gateway para chamadas a modelos, o MCP Gateway para acesso a ferramentas e dados, e o Agent Gateway para comunicação A2A (agent-to-agent). O lançamento da Kong incorporou identidade de agentes, observabilidade integrada para esses fluxos e inspeção completa de mensagens trocadas entre agentes.
Para empresas que já operam com Konnect, essa convergência faz sentido. A equipe de plataforma aproveita as políticas e práticas operacionais já homologadas para gerenciar a nova camada de IA, evitando contratar outro gateway para cada protocolo. O plano Plus oferece proxies MCP e agentes A2A ilimitados, limitando a até cinco modelos LLM únicos.
Para novos projetos sem histórico no Konnect, o preço é um fator restritivo. O plano de controle mais básico no Plus é o serverless, que custa $25 por mês, mas cada modelo LLM exclusivo roteado pelos plugins pagos de IA custa $100 mensais. Cinco modelos somados a um plano de controle serverless resultam em $525 por mês antes de qualquer gasto com inferência, requisições extras de API, largura de banda ou complementos. O modelo híbrido eleva o plano de controle para $200 mensais. A opção de nuvem dedicada custa $500 por mês mais $0.15 por GB transferido.
Melhor para: Clientes atuais da Kong que precisam levar governança corporativa de APIs para tráfego LLM, MCP e A2A
Destaque: Ecossistema unificado de políticas cobrindo todo o tráfego de dados de IA
Preços: Teste de 30 dias por $0; plano Plus cobra por gateway e modelo; Enterprise negociado anualmente sob medida
Avaliação gratuita: 30 dias de avaliação completa, sem cartão de crédito
- Monitora chamadas de modelos, ferramentas MCP e comunicação entre agentes (A2A)
- Proxies MCP e agentes A2A ilimitados no plano Plus
- Reaproveita a estrutura e os padrões já existentes de governança de APIs
- Traz métricas claras para planos de controle, requisições, modelos e largura de banda
- Uma nova implantação com cinco modelos começa em $525 por mês no plano de controle mais barato
- O plano Plus limita o uso a cinco modelos LLM únicos
- A opção de nuvem dedicada adiciona $0.15 por GB além da mensalidade
- Preços do Enterprise exigem negociação contratual com faturamento anual
O período de testes de 30 dias é gratuito, dispensa cartão de crédito, remove limites de gateway e retém 30 dias de análises. O plano Plus aceita até cinco gateways serverless, dois híbridos e dois em nuvem dedicada. Ele inclui 1 milhão de requisições de API por mês, cobra $200 por cada milhão adicional e possui um teto de 10 milhões de requisições mensais.
O plano Enterprise remove os limites de gateways e proxies de modelos, inclui os plugins avançados do AI Gateway e o AI Gateway Manager, com contratos anuais customizados. Isso se alinha a grandes migrações corporativas, mas impede o cálculo de um orçamento direto sem contato comercial.
A regra para adotar o Kong depende do investimento prévio: se a empresa já paga, mantém e confia no Konnect, o Agent Gateway simplifica a arquitetura evitando novos fornecedores. Se esse não for o caso, pagar a partir de $525 por mês apenas para testar agentes é um investimento desnecessário antes de validar a demanda real.
6. Cloudflare AI Gateway e Agents: a melhor stack de borda com custo fixo mínimo
O Cloudflare AI Gateway é a opção ideal de menor custo fixo para quem deseja unir um gateway de modelos gratuito com o runtime e ferramentas do Cloudflare Agents.

As funcionalidades principais do Cloudflare AI Gateway — como painel analítico, caching, rate limiting e inspeção DLP — são gratuitas em todos os planos. A inferência dos provedores é repassada sem sobretaxa. O recurso de Unified Billing é opcional e aplica uma taxa de 5% sobre os créditos comprados; logo, $2,000 em créditos geram uma cobrança adicional de $100.
O suporte a ferramentas gerenciadas opera no ambiente Cloudflare Agents, uma plataforma para agentes duráveis com módulos para Browser, Sandbox, AI Search, MCP, Payments e outras ferramentas integradas. Os modelos de início trazem ferramentas client-side e server-side, aprovação humana (human-in-the-loop) e agendamento de tarefas. O runtime conecta-se a OpenAI, Anthropic, Google Gemini e outros provedores.
Trata-se de uma arquitetura versátil, mas dividida em dois produtos. O AI Gateway monitora o tráfego dos modelos. O Agents executa o loop de decisões e conecta as ferramentas. O Workers e os serviços acionados possuem custos e limites próprios. Uma equipe que procura uma interface única para transformar APIs internas, armazenar credenciais OAuth de saída e auditar todas as chamadas de ferramentas não deve assumir que o gateway gratuito cobre essas etapas por padrão.
Melhor para: Times focados em desenvolvimento na borda (edge) que precisam de gateway gratuito ao lado de um runtime de agentes
Destaque: Gateway básico gratuito complementado por Browser, Sandbox, AI Search, MCP e Payments no Cloudflare Agents
Preços: Núcleo do gateway gratuito em todos os planos; Workers Free e Workers Paid com limites distintos de logs; taxa de 5% caso opte pelo Unified Billing
Avaliação gratuita: Recursos essenciais do gateway gratuitos com cota do plano Workers Free
- Métricas essenciais, cache, controle de taxa e inspeção DLP a custo $0
- Sem cobrança de markup sobre a inferência dos provedores
- O ecossistema Agents oferece ferramentas nativas e runtime durável
- Conexão facilitada com os principais provedores de modelos do mercado
- Gateway e ferramentas gerenciadas residem em produtos e configurações separadas
- O faturamento unificado (Unified Billing) acrescenta 5% sobre os créditos adquiridos
- Gastos com Workers, ferramentas e inferência não estão inclusos na gratuidade do gateway
- O limite gratuito de logs é compartilhado entre todos os gateways configurados
O plano Workers Free mantém até 100,000 logs persistentes somando todos os gateways da conta. O plano Workers Paid eleva para 10 milhões de logs por gateway. A ferramenta Logpush está disponível no Workers Paid e inclui 10 milhões de requisições mensais, cobrando $0.05 por milhão excedente. A validação de guardrails depende de inferência de tokens no Workers AI; portanto, o fato de o gateway ser gratuito não significa que toda regra de moderação terá custo zero.
A Cloudflare se destaca quando a infraestrutura do projeto já roda sobre Workers e o time pretende manter modelos, estado dos agentes, navegador, busca e MCP próximos da borda. Fica em desvantagem quando a exigência técnica for um console unificado de auditoria para governar ferramentas com rigor. Nesses cenários, AgentCore ou TrueFoundry oferecem delimitações mais diretas.
Qual gateway de IA escolher para o seu projeto?
Opte pelo Amazon Bedrock AgentCore Gateway quando o agente precisar acessar sistemas legados internos e a empresa buscar um serviço totalmente gerenciado para converter, autenticar, descobrir e executar essas ferramentas. A recomendação muda para uma solução mais leve se a maior parte das ferramentas já existir em servidores MCP estáveis.
Opte pelo Vercel AI Gateway quando a integração de busca na web for a única pendência para colocar o produto em produção. A recomendação muda se o agente precisar gravar dados em bancos internos, conectar-se a ecossistemas heterogêneos de APIs ou gerenciar fluxos complexos de OAuth de saída.
Opte pelo Portkey quando os servidores MCP já estiverem implantados e o objetivo for exigir uma autenticação única por parte dos clientes. É a alternativa certa para equipes de plataforma que querem catálogo centralizado, permissões por workspace, filtros de conteúdo, fluxos de aprovação e logs sem a necessidade de adotar um framework complexo de agentes. A recomendação muda se a equipe ainda precisar criar ou hospedar os próprios servidores MCP.
Opte pelo TrueFoundry quando implantação privada, suporte a ferramentas stdio hospedadas, conversão de OpenAPI, MCPs virtuais ou guardrails pré e pós-chamada forem indispensáveis. A recomendação muda para o Portkey se bastar um proxy de menor custo para servidores remotos, ou para o AgentCore caso a arquitetura gire em torno da AWS.
Opte pelo Kong AI Gateway se o Konnect já for a ferramenta oficial de governança de APIs da empresa. A infraestrutura existente, a equipe treinada e as homologações internas tornam a adição de agentes mais barata do que o custo de uma contratação do zero sugere. A recomendação muda se o objetivo for contratar o Kong apenas para validar um piloto inicial de agentes.
Opte pelo Cloudflare AI Gateway e Agents se a equipe já desenvolve sobre a plataforma Workers e prefere integrar os blocos de gateway, execução e ferramentas sob demanda. A recomendação muda caso as áreas de segurança ou compliance exijam um único painel e um único responsável contratual pelo tráfego de modelos e de ferramentas.

Também existe um resultado perfeitamente válido: não adotar nenhum gateway adicional. Se o seu provedor atual já entrega os modelos, ferramentas, gestão de identidade, logs e limites de gastos que o fluxo exige, adicionar outra camada cria mais pontos de falha sem diminuir o esforço técnico. Antes de assinar um serviço, identifique com precisão qual conta, segredo, conector, regra de segurança ou chamado de suporte esse gateway eliminará da rotina da equipe.
A conta oculta do plano de ferramentas: por que um gateway grátis pode sair mais caro
Os custos do gateway e das ferramentas ocupam linhas orçamentárias completamente diferentes. O cenário de busca web deixa essa diferença evidente, já que tanto o AWS Web Search quanto o Vercel Exa Search custam exatamente $7 por 1,000 consultas.
Para uma operação com 100,000 interações mensais de agentes, considere uma busca semântica por ferramenta, três chamadas de ferramentas, 100 ferramentas indexadas e uma consulta de busca web por interação. A camada de gateway do AgentCore custará $4.02: $2.50 para a Search API, $1.50 para as invocações de ferramentas e $0.02 para a indexação. A busca web acrescenta $700. O total visível atinge $704.02 antes de contabilizar modelos, runtime, políticas, observabilidade, tráfego de rede e serviços de backend.
O gateway de tokens da Vercel não cobra mensalidade de plataforma. Para 100,000 buscas com a Exa após 31 de agosto, o custo adicional será de $700. O total visível da fatura será de $700 antes do consumo de modelos e de recursos opcionais de relatórios ou regras para toda a equipe.

A diferença de $4.02 não é o critério para definir a arquitetura. No exemplo do AgentCore, o cálculo inclui descoberta semântica e três execuções de ferramentas internas por interação. No exemplo da Vercel, o cálculo reflete apenas a busca externa integrada. A questão não é uma opção ser quatro dólares mais barata, mas sim o fato de ambas gerarem uma despesa de $700 com ferramentas atrás de um gateway cuja taxa de uso é mínima ou nula.
Essa mesma lógica se aplica aos demais gateways:
- Portkey: Um milhão de requisições registradas custa $130 no plano Production antes dos custos de modelos e da hospedagem dos servidores MCP.
- TrueFoundry: O plano Pro custa $499 para 1 milhão de chamadas de ferramentas mensais; o Pro Plus custa $2,999 para 5 milhões. O plano maior não oferece desconto por chamada unitária.
- Kong: O roteamento de cinco modelos com o plano de controle serverless mais barato custa $525 antes dos gastos com tokens e plugins complementares.
- Cloudflare: O núcleo do gateway é gratuito, mas o faturamento unificado (Unified Billing) consome $100 em uma compra de $2,000 em créditos, e o uso de Workers e ferramentas adicionais continua sendo faturado à parte.
Sempre que o provedor permitir, configure limites rígidos de gastos por API na ponta final. Um teto orçamentário no gateway bloqueia requisições na camada de controle, mas não deve ser a única trava para credenciais que possam ser utilizadas fora dele.
Quais gateways de IA você deve evitar conforme o cenário
Evite a Vercel quando a demanda principal for transformar APIs internas
A busca gerenciada via Exa na Vercel funciona bem justamente por ser focada. Não utilize essa funcionalidade para justificar que o gateway gerenciará todo um ecossistema de APIs privadas OpenAPI, armazenará credenciais de saída e controlará cada ação de sistemas corporativos. Se esses forem os requisitos, adote AgentCore ou TrueFoundry.
Evite o Kong para pilotos novos e pequenos
O Kong pode ser uma plataforma corporativa madura, mas a escolha errada para um primeiro teste isolado. Cinco modelos somados ao plano de controle serverless no Plus custam $525 por mês antes do gasto com tokens. Se o time não tem um ambiente Konnect já contratado, comece construindo o fluxo de trabalho e comprove as necessidades de governança antes de contratar uma plataforma completa de APIs.
Evite a Cloudflare quando uma interface única de políticas for mandatória
O Cloudflare AI Gateway e o Cloudflare Agents atuam em conjunto, mas permanecem como ferramentas separadas no painel. Não permita que o gateway básico gratuito prejudique a análise da arquitetura técnica. Defina com antecedência qual console registrará os logs de modelos, execução de ferramentas, aprovações humanas, armazenamento de chaves e resposta a incidentes antes de tratá-la como uma solução integrada.
Evite o Portkey se ninguém for responsável pelos servidores MCP
Um proxy de governança não corrige servidores de ferramentas sem manutenção. Se um endpoint MCP remoto cair, expuser dados indevidos ou quebrar contratos de esquema, o Portkey registrará o erro, mas caberá à sua equipe reestabelecer o serviço. Escolha plataformas com suporte a hospedagem ou conversão de APIs se a criação e a manutenção das ferramentas forem os principais desafios pendentes.
Evite assinar planos pagos antes de validar uma ação real em produção
Criar um agente com um catálogo enorme de ferramentas pode parecer avançado, mas torna o processo de aprovação de segurança quase inviável. Comece com uma ação isolada, reversível, com um responsável definido e um critério claro de interrupção. Entenda também que instruções reutilizáveis e ferramentas executáveis atendem a propósitos diferentes: habilidades de agentes e APIs de ferramentas resolvem problemas distintos de reutilização. Não adquira um gateway para resolver ambiguidades conceituais do seu software.
O que fazer na prática: calcule os custos de uma rota de agente de ponta a ponta
Selecione um processo rotineiro que a empresa já executa manualmente, como validar o status de um pedido e atualizar um ticket de atendimento. Descreva esse fluxo detalhadamente: entrada do usuário, chamada ao modelo, descoberta de ferramentas, troca de credenciais, execução da ação, retorno do sistema, aprovação humana e geração do registro de auditoria.
Atribua um proprietário técnico e uma linha de custo mensal para cada etapa. Liste tokens de modelo, requisições no gateway, chamadas de busca ou automação de navegador, hospedagem de ferramentas, retenção de logs, validação de conformidade e resposta a falhas. Em sua planilha de planejamento, registre promoções ou períodos gratuitos em uma coluna à parte para evitar que benefícios temporários sejam tratados como premissas definitivas da arquitetura.
Em seguida, execute esse caminho estruturado em ambiente controlado durante uma semana. Garanta que a ação inicial possa ser revertida. Estipule limites de gastos no provedor e no gateway, além de regras de parada para erros de autenticação, falhas de ferramentas ou dados incoerentes. Revise os registros diretamente com os administradores do sistema de destino afetado, e não apenas com o time de engenharia de IA.
A definição prática para o seu projeto:
- Se o maior tempo de desenvolvimento for gasto em adaptadores internos e gestão de identidade, avalie o AgentCore ou o TrueFoundry.
- Se o bloqueio para lançamento for apenas adicionar busca web atualizada, adote a Vercel e reserve $7 por 1,000 buscas para o período pós-31 de agosto.
- Se a distribuição e o vazamento de credenciais forem a maior dor de cabeça, coloque o Portkey à frente dos servidores MCP existentes.
- Se a consistência de governança for prioritária, expanda o Kong ou a Cloudflare apenas se a empresa já mantiver infraestrutura ativa nessas plataformas.
- Se a contratação não eliminar custos claros ou responsabilidades operacionais, preserve a arquitetura atual sem gateways adicionais.
O gateway ideal é aquele que elimina uma linha orçamentária ou uma sobrecarga operacional de engenharia, mantendo intactas as permissões dos sistemas integrados. Um recurso que não gere essa economia direta não justifica o esforço de migração da infraestrutura.
Perguntas frequentes
O que é um gateway de IA?
Um gateway de IA é uma camada intermediária de controle entre as aplicações e os provedores de modelos de linguagem. Ele centraliza roteamento, tentativas automáticas, observabilidade, políticas de segurança e regras de orçamento. Algumas opções modernas também monitoram ferramentas e tráfego entre agentes, embora esses recursos devam ser avaliados separadamente do roteamento de modelos.
O que é um MCP gateway?
Um MCP gateway gerencia como clientes e agentes descobrem e executam ferramentas baseadas no Model Context Protocol. Suas atribuições envolvem autenticação do chamador, injeção segura de credenciais no destino, permissões de acesso por ferramenta, fluxos de aprovação, auditoria de requisições e, em alguns cenários, conversão e hospedagem de ferramentas.
Qual gateway de IA é gratuito?
A Vercel oferece $5 mensais em créditos no plano Free; o Portkey disponibiliza o plano Developer gratuito para sempre; o TrueFoundry tem o plano Developer a $0 e sete dias de testes; a Kong disponibiliza 30 dias de avaliação gratuita; e o núcleo do Cloudflare AI Gateway é gratuito em qualquer categoria. O AgentCore Gateway cobra por consumo, com novos clientes podendo acessar até $200 em créditos na AWS. Custos de modelos, ferramentas, infraestrutura de runtime e políticas avançadas ainda incidem normalmente.
Qual é o melhor gateway para LLMs?
Para ferramentas gerenciadas de agentes, o Amazon Bedrock AgentCore Gateway é o mais robusto na avaliação geral. A Vercel destaca-se para busca imediata sem configuração, o Portkey para centralizar servidores MCP já ativos, o TrueFoundry para governança privada de MCP, o Kong para quem já opera no ecossistema Konnect e a Cloudflare para implementações focadas em edge computing. Para decisões voltadas apenas ao roteamento de prompts, avalie custos de tokens, cache, latência e regras de tráfego de maneira independente.
Baixe o Checklist de Auditoria de Fluxos de Negócio com IA
Transforme ideias de automação com agentes em processos estruturados com responsáveis claros, estimativa de custos, barreiras de permissão e condições de parada. Inscreva-se para receber o checklist gratuitamente.
3 de set. de 2026







