Alternativas ao OpenRouter: 6 gateways de IA para 2026
Compare seis alternativas ao OpenRouter para roteamento multimodelo: custos, controle, failover e o melhor gateway de IA para cada tipo de equipe.

LiteLLM é a melhor entre as alternativas ao OpenRouter quando há alguém responsável pela plataforma para operar o gateway; Vercel AI Gateway é a melhor substituição gerenciada. O acordo de aquisição pela Stripe não exige uma migração de emergência, mas torna uma regra orçamentária inegociável: com $50,000 em gastos mensais com modelos, a taxa de plataforma de 5.5% do OpenRouter chega a $2,750 — e nenhum intermediário deve ser sua única rota.
A Stripe informou em 19 de agosto de 2026 que havia firmado um acordo para adquirir o OpenRouter. O anúncio descreve a mesma proposta que a plataforma já oferecia: encaminhar cada solicitação conforme tarefa, preço, velocidade e confiabilidade entre centenas de modelos. Não há anúncio de aumento de preço, encerramento do serviço nem redução do catálogo.
Na prática, a consequência é a concentração de controle. Mesmo uma aplicação neutra em relação aos modelos pode se tornar dependente do gateway quando chaves, aliases de modelos, orçamentos, regras de fallback, logs e cobrança ficam todos em um único intermediário. A resposta é a regra das duas rotas: use um gateway no tráfego normal e mantenha um caminho direto para um provedor, capaz de sustentar um fluxo de produção sem alterar a lógica de negócio.
Os preços, planos, limites e recursos abaixo foram verificados nas páginas oficiais dos fornecedores em 20 de agosto de 2026. Esta é uma análise de preços e documentação, não uma afirmação de que as seis plataformas foram submetidas a testes de carga ou implantadas.
Resposta rápida: qual das alternativas ao OpenRouter escolher?
Escolha LiteLLM para ter o máximo de controle, Vercel AI Gateway para simplificar com um serviço gerenciado, Portkey para governança empresarial, Cloudflare AI Gateway para uma stack centrada na Cloudflare, Requesty para um modelo de cobrança parecido com o OpenRouter e Bifrost para um gateway self-hosted enxuto. Embora todos reúnam vários provedores de modelos atrás de um único endpoint, são seis decisões de compra diferentes.
A primeira decisão é definir quem opera o caminho das solicitações. LiteLLM e Bifrost colocam o gateway no seu ambiente. Isso dá controle sobre implantação, dados, credenciais, atualizações e tratamento de falhas. Também coloca o plantão nas suas mãos. Licença grátis não significa sistema de produção grátis.
Vercel, Cloudflare, Requesty e Portkey gerenciam uma parcela maior do serviço. Eles reduzem o trabalho de plataforma, mas a disponibilidade e as políticas da aplicação passam a depender de outra empresa. É uma troca razoável quando o tempo operacional economizado vale mais que a taxa. O risco aparece quando a aplicação não tem uma rota alternativa.
A conta muda em pontos diferentes. A Vercel não adiciona margem ao preço dos tokens, embora controles opcionais tenham medidores próprios. A Requesty acrescenta 5% ao custo dos modelos. A Cloudflare cobra 5% apenas na compra de créditos pelo Unified Billing; o gateway principal continua gratuito. A Portkey cobra assinatura da plataforma e excedentes de logs. LiteLLM e Bifrost custam $0 nos planos open source, enquanto engenharia e infraestrutura próprias formam a despesa operacional.
O próprio OpenRouter continua sendo uma escolha válida. Sua página de preços atual informa 500+ modelos e 80+ provedores nos planos pagos, acima dos 400+ modelos citados no anúncio de aquisição da Stripe. O catálogo avança mais rápido que o texto corporativo — um bom alerta para não classificar gateways apenas pela quantidade de modelos.
Para uma visão mais ampla das categorias, consulte a comparação de dez gateways de IA. Como referência do OpenRouter, a análise atual de preços do OpenRouter separa créditos compartilhados de BYOK.
O que o acordo com a Stripe muda no orçamento de roteamento de modelos de IA
A aquisição altera o plano de contingência antes de alterar a fatura. Stripe e OpenRouter podem cumprir exatamente o que prometeram. A questão é mais simples: acesso a modelos, cobrança de tokens, política de roteamento e propriedade do gateway agora estão mais próximos. Quem adotou um roteador para evitar dependência de um fornecedor de modelos não deve recriar a mesma dependência uma camada acima.
Os planos pagos atuais do OpenRouter ainda exibem uma taxa de plataforma de 5.5% no Pay-as-you-go e descontos na taxa para Enterprise. O Free permanece em $0, com 25+ modelos gratuitos, quatro provedores e 50 solicitações por dia. No Pay-as-you-go, o BYOK inclui mensalmente $25,000 em inferência pelo preço de tabela sem taxa de gateway; acima dessa franquia, a cobrança é de 5%. No Enterprise, a franquia mensal de BYOK sem taxa sobe para $200,000; depois disso, também são cobrados 5%.
Nada nesses termos atuais exige uma mudança precipitada. Com $5,000 em gastos mensais de modelo por créditos compartilhados, os 5.5% representam $275. Com $50,000, representam $2,750. O percentual é o mesmo, mas a decisão de negócio não. Uma equipe de produto pequena não deveria criar um novo serviço interno para economizar $275 se o gateway já poupa mais que algumas horas de integração e tratamento de incidentes. Já uma equipe de plataforma que paga $2,750 todo mês tem orçamento suficiente para comparar alternativas com seriedade.
Em vez de fingir que open source não custa nada, trabalhe com uma premissa operacional explícita. Se um gateway self-hosted exigir 12 horas mensais de engenharia a um custo total de $150 por hora, a operação sai por $1,800 por mês, antes de computação e armazenamento. Nessa hipótese ilustrativa, a taxa de 5.5% do OpenRouter alcança $1,800 quando o gasto mensal com modelos chega a cerca de $32,727. Uma taxa de 5% atinge o mesmo valor em $36,000.
Esses pontos de equilíbrio não são universais. Uma carga regulada pode optar pelo self-hosting com apenas $2,000 em gastos mensais com modelos porque a implantação privada é inegociável. Uma startup de cinco pessoas pode continuar pagando um serviço gerenciado bem acima de $36,000 porque a alternativa seria contratar ou desviar a atenção de um engenheiro de plataforma. O cálculo explicita a premissa para que finanças e engenharia discutam o que realmente importa.
A rota alternativa também tem um orçamento, ainda que menor. Considere oito horas de engenharia a $150 por hora para construir e testar um caminho direto a um provedor. É um investimento único de $1,200. Com $50,000 mensais gastos no OpenRouter, isso equivale a 0.44 mês da taxa de gateway de $2,750. Com $5,000 em gastos, equivale a 4.36 meses da taxa de $275. Grandes usuários conseguem financiar a reversibilidade com uma fração da taxa de um único mês; usuários menores devem criar o bypass apenas para um fluxo cujo risco de indisponibilidade ou de política o justifique.

O gráfico de custos exige uma ressalva. O $0 da Vercel se refere à margem sobre tokens, não a todos os controles opcionais. A lista de provedores permitidos para toda a equipe custa $0.10 por 1,000 solicitações bem-sucedidas; a retenção zero de dados aplicada a toda a equipe custa outros $0.10 por 1,000 solicitações; e os traces custam $0.05 por 1,000, mais egress. Em um milhão de solicitações, com os três recursos ativados e um trace por solicitação, esses medidores somam $250 mais o egress dos traces.
Cloudflare e Requesty geram, cada uma, uma linha de $2,500 em um exemplo de $50,000 em uso, mas cobram por coisas diferentes. A Requesty acrescenta uma margem de 5% ao custo dos modelos. Os 5% da Cloudflare se aplicam aos créditos comprados pelo Unified Billing, enquanto o BYOK pode usar o gateway principal gratuito sem essa taxa sobre créditos. A linguagem usada em compras e contratos importa tanto quanto o percentual.
As taxas do gateway ficam acima da conta do modelo, não no lugar dela. A comparação das APIs de IA mais baratas analisa separadamente a camada de tokens, evitando que uma taxa baixa de gateway esconda a escolha de um modelo caro.
A regra de decisão é objetiva: fique quando o gateway poupar mais em engenharia, falhas e cobrança do que custa; troque quando um controle ausente ou uma taxa recorrente superar o custo de operar a alternativa. Em ambos os casos, construa o bypass. Substituir uma rota central por outra rota central não elimina a concentração.
Como selecionamos estas alternativas ao OpenRouter
O ranking prioriza reversibilidade antes de tamanho de catálogo. Uma empresa pode experimentar 100 modelos e aprovar três para produção. O gateway útil é aquele que mantém esses três disponíveis, observáveis, dentro do orçamento e substituíveis, sem espalhar comportamentos específicos dos fornecedores pela aplicação.
Cada alternativa foi avaliada com cinco critérios:
- Controle: Quem controla as chaves dos provedores, a política de roteamento, os aliases de modelos, os logs e o processo em execução do gateway?
- Comportamento de failover: A operação consegue definir a ordem dos provedores, limites de novas tentativas, interrupções por orçamento e os erros diante dos quais o sistema jamais deve prosseguir sem bloqueio?
- Visibilidade de custos: A taxa é pública, calculável e atribuível à equipe ou aplicação que a gerou?
- Limite de implantação: O gateway pode ser executado onde as regras de dados, rede, identidade e conformidade do comprador exigem?
- Custo de saída: Um fluxo de produção consegue ignorar o gateway por configuração e implantação controlada, em vez de exigir a reescrita da aplicação?
O ranking termina em seis porque cada produto é uma camada genuína de solicitações multiprovedor, com preços e documentação atuais suficientes para embasar uma decisão de compra. Hosts de modelos e nuvens de inferência foram excluídos quando não conseguiam substituir o roteamento neutro sem transferir a carga para o próprio ecossistema de modelos. Um catálogo longo de modelos executáveis é útil, mas responde a outra pergunta.
Os preços de todos os fornecedores foram verificados em 20 de agosto de 2026. Nenhum plano gratuito foi tratado como promessa de produção quando o próprio fornecedor o classificava como plano para protótipos ou quando seus limites documentados tornavam essa interpretação insegura. Nenhum produto recebeu crédito por um item de roadmap.
A primeira colocação também precisava passar por um teste de responsabilidade. Self-hosting só vence quando uma pessoa ou equipe definida responde por atualizações, integridade do banco de dados, segredos, escalabilidade, telemetria e incidentes. Roteamento gerenciado só vence quando a aplicação conserva um caminho direto para um provedor. É por isso que a mesma lista de recursos pode gerar rankings diferentes para um fundador, um CTO de empresa média e uma equipe de plataforma empresarial.
1. LiteLLM: melhor opção geral para independência de provedores
LiteLLM é a melhor alternativa ao OpenRouter quando sua empresa consegue tratar o gateway como um produto próprio. Ele reúne 100+ provedores em uma única API compatível com OpenAI e inclui chaves virtuais, usuários e equipes, acompanhamento de gastos, orçamentos, limites de taxa, fallbacks, logs de solicitações e respostas e métricas do Prometheus no plano open source de $0. A barreira não é a capacidade, mas a responsabilidade operacional.

Uma startup financiada, com dois agentes voltados a clientes, pode usar LiteLLM para atribuir a cada serviço uma chave virtual, aliases de modelos aprovados, orçamento mensal e fallback controlado. Uma equipe de plataforma de médio porte pode executar o mesmo gateway dentro de seus padrões de contêineres, segredos, banco de dados e monitoramento. Quem trabalha sozinho e não quer mais pensar em infraestrutura deve escolher Vercel ou Requesty.
Melhor para: Empresas de produto com um responsável de plataforma definido
Destaque: A aplicação controla o processo do gateway, as contas dos provedores, a política e o caminho dos dados
Preço: Open Source $0; Enterprise com preço anual personalizado conforme capacidade de solicitações, arquitetura de implantação e suporte
Teste grátis: 30 dias de Enterprise sem cartão de crédito; Open Source continua gratuito
A página de preços atual do LiteLLM mostra apenas duas fronteiras comerciais. O Open Source é gratuito para sempre em produção self-hosted. O Enterprise tem cotação anual e preço explicitamente definido pela capacidade anual de solicitações do gateway, pela arquitetura de implantação e pelas necessidades de suporte, não pelo gasto com tokens dos modelos.
O Enterprise acrescenta SSO e SCIM, autenticação OIDC ou JWT, logs de auditoria, integrações com gerenciadores de segredos, rotação de chaves, administração organizacional, um plano de controle multirregional, implantação air-gapped e suporte de até 24/7. Esses controles importam quando o gateway se torna infraestrutura compartilhada. Eles não eliminam a necessidade de operar o plano de dados que a empresa decidiu controlar.
A licença de $0 pode induzir uma equipe pequena ao erro. Alguém precisa operar o proxy, o banco de dados persistente, as credenciais, os backups, as atualizações, as métricas, as mudanças dos provedores de modelos e a resposta a incidentes. Com a premissa informada de 12 horas a $150, esse trabalho custa $1,800 por mês antes da infraestrutura. Em custo mensal puro, LiteLLM supera uma taxa gerenciada de 5.5% acima de aproximadamente $32,727 em gastos com modelos, mas controle ou conformidade podem justificá-lo antes disso.
O desenho mais robusto esconde o LiteLLM atrás de aliases internos como support-primary e support-fallback. A lógica de negócio deve pedir uma capacidade interna, não anthropic/claude-something nem uma rota específica do LiteLLM. O adaptador direto para o provedor deve entender o mesmo alias interno. Assim, o gateway continua substituível mesmo depois de se tornar extremamente útil.
Comece com um fluxo bem delimitado
Escolha uma rota com características de produção, schema conhecido, meta de latência, regra de dados e gasto mensal definidos. Não comece migrando todas as chamadas de modelos.
Crie aliases internos para os modelos
Defina um modelo principal estável e um fallback compatível sem expor strings públicas de modelos dos provedores à lógica de negócio. Mantenha o mapeamento na configuração do gateway.
Emita uma única chave virtual
Entregue à aplicação uma chave própria, modelos aprovados, orçamento e limite de taxa. Mantenha a chave administrativa do LiteLLM fora da carga de trabalho.
Configure um adaptador direto
Armazene fora do LiteLLM uma credencial de provedor e mapeie a mesma capacidade interna para a API desse provedor. O adaptador fica inativo no tráfego normal, mas pronto para um bypass controlado.
Provoque uma falha
Indisponibilize o modelo principal em uma janela sem clientes. Antes de aumentar o tráfego, confirme que fallback, logs, schema, limite de latência e bypass direto se comportam como esperado.
- Licença open source de $0 para produção, sem taxa percentual de gateway
- 100+ provedores, além de chaves, orçamentos, limites, fallbacks, logs e Prometheus
- Contas dos provedores e caminho das solicitações permanecem no seu ambiente
- Opção Enterprise para identidade, auditoria, segredos, multirregião e air gap
- O preço anual do Enterprise não aumenta automaticamente com o gasto em tokens
- Sua empresa responde por disponibilidade, atualizações, persistência, segredos e incidentes
- O preço do Enterprise não é público
- Uma implantação rápida pode virar infraestrutura compartilhada antes de haver orçamento para mantê-la
- Self-hosting não elimina indisponibilidades nem limites contratuais dos provedores
LiteLLM ocupa o primeiro lugar porque consegue eliminar tanto a dependência do fornecedor do modelo quanto a dependência do fornecedor do gateway. Deve cair imediatamente para a segunda posição quando não houver ninguém responsável por ele. Um plano de controle sem gestão não é independência; é uma indisponibilidade à espera da semana mais inconveniente.
2. Vercel AI Gateway: melhor substituição gerenciada
Vercel AI Gateway é a melhor alternativa gerenciada ao OpenRouter para equipes de produto que querem um único endpoint sem margem sobre os tokens. Ele oferece centenas de modelos, orçamentos, monitoramento de uso, balanceamento de carga, fallbacks e novas tentativas automáticas em outros provedores. A troca é clara: a Vercel opera o gateway, portanto a regra das duas rotas continua valendo.

Um fundador com investimento pode colocar um fluxo voltado a clientes atrás da Vercel sem contratar alguém para cuidar do gateway. Para equipes que já usam o AI SDK, a integração é especialmente curta, mas o gateway também oferece APIs compatíveis com OpenAI e Anthropic. Uma equipe de plataforma que precise executar o gateway dentro de um cluster privado deve escolher LiteLLM ou Bifrost.
Melhor para: Startups e equipes de produto que compram roteamento gerenciado
Destaque: Tokens pelo preço de tabela dos provedores, sem margem do gateway, inclusive com BYOK
Preço: Free inclui $5/mês em créditos; Paid funciona em pay as you go com créditos comprados; Enterprise pode usar cobrança por fatura
Teste grátis: Plano Free contínuo em modelos elegíveis, com limites menores por modelo
A documentação atual de preços separa Free de Paid. O Free dá a cada equipe $5 em créditos mensais para modelos elegíveis, cobra os preços de tabela dos provedores sem margem e aplica limites menores específicos para cada modelo. BYOK não está disponível. A compra de créditos transfere a equipe para o Paid, libera todo o catálogo de modelos disponível, aumenta os limites e elimina o crédito mensal de $5.
O Paid também cobra os preços de tabela dos provedores sem margem sobre tokens. Ele acrescenta BYOK, mas exige a manutenção de créditos comprados no gateway. Se uma solicitação feita com sua credencial de provedor falhar, a Vercel pode tentar novamente com credenciais do sistema e descontar o fallback desse saldo. Isso melhora a disponibilidade, mas pode surpreender compras e finanças. Uma equipe que usa BYOK para consumir um compromisso já contratado com o provedor deve revisar a cobrança dos fallbacks antes de considerar todas as chamadas como gasto direto.
Equipes Enterprise podem negociar a cobrança do AI Gateway por fatura, sem tarifas de processamento de pagamento. Essa é toda a estrutura de planos visível do gateway. Controles opcionais adicionam medidores próprios, apesar da proposta de margem zero.
O Custom Reporting cobra $0.075 por 1,000 gravações e $5 por 1,000 consultas de relatório. Uma lista de provedores permitidos para toda a equipe custa $0.10 por 1,000 solicitações bem-sucedidas, enquanto o filtro de provedor por solicitação não tem custo adicional. A retenção zero de dados para toda a equipe custa $0.10 por 1,000 solicitações; a opção por solicitação não custa a mais nos planos Pro e Enterprise. Os Trace Drains custam $0.05 por 1,000 traces, mais $0.50 por GB de egress.
Em um milhão de solicitações, a lista de provedores da equipe, a retenção zero de dados da equipe e um trace por solicitação totalizam $250 mais o egress dos traces. É pouco diante de muitas contas de modelos, mas suficiente para entrar no orçamento. A questão não é que a Vercel esconda taxas — a documentação é explícita. A questão é não interpretar ausência de margem sobre tokens como ausência de custo de plataforma.
A barreira em produção é o controle da implantação. A documentação da Vercel descreve um endpoint gerenciado, não um processo de gateway executado na sua própria rede. Isso é um recurso para equipes enxutas e um impedimento para compradores com uma exigência rígida de implantação privada.
- Margem zero sobre tokens nos usos Free, Paid e BYOK
- Crédito Free mensal de $5 para uma avaliação delimitada
- Centenas de modelos com balanceamento de carga, fallbacks, orçamentos e monitoramento de uso
- Sua equipe não precisa operar proxy, banco de dados nem ciclo de atualização do gateway
- Rotas de API oficialmente compatíveis com OpenAI e Anthropic
- Não há plano documentado para executar o gateway por conta própria
- BYOK exige créditos comprados
- Chamadas BYOK com falha podem recorrer às credenciais cobradas da Vercel
- Medidores de relatórios, políticas para toda a equipe e traces ficam fora do preço dos tokens
Vercel fica abaixo de LiteLLM porque troca o OpenRouter por outra dependência gerenciada. Fica acima das demais opções gerenciadas porque a ausência de margem sobre tokens deixa a despesa recorrente do gateway excepcionalmente clara. Mantenha um adaptador direto para um provedor e essa dependência se torna uma troca operacional prática, não lock-in.
3. Portkey: melhor opção para governança empresarial
Portkey é a melhor alternativa ao OpenRouter quando a governança é o motivo da compra, não um recurso adicional. Sua API universal reúne fallbacks, balanceamento de carga, novas tentativas, observabilidade, gestão de prompts, cache e guardrails. Os planos públicos também deixam especialmente clara a fronteira entre protótipo, produção e requisitos empresariais.

Um CTO de empresa média com várias aplicações pode usar Portkey para centralizar chaves, logs, prompts, gastos e tratamento de falhas sem operar um gateway open source. Um comprador empresarial pode avançar para hospedagem em nuvem privada ou VPC, com controles de identidade e conformidade. Quem desenvolve sozinho e paga por uma aplicação pequena não deve comprar um plano de controle empresarial antes que o fluxo demonstre essa necessidade.
Melhor para: Organizações que centralizam políticas, identidade, retenção e suporte
Destaque: Um plano Production público de $49 com caminho Enterprise para implantação privada
Preço: Developer $0; Production $49/mês mais excedentes de logs; Enterprise personalizado
Teste grátis: Developer é gratuito para sempre para protótipos e avaliações
A página de preços atual da Portkey informa que o Developer não é adequado para cargas de produção. Ele registra 10,000 logs por mês, conserva os logs por três dias e as métricas por 30 dias. As funções do gateway servem para uma prova de conceito, mas a retenção e o alerta do fornecedor deixam claro onde esse plano deve parar.
O Production custa $49 por mês. Inclui 100,000 logs registrados, cobra $9 a cada 100,000 adicionais, conserva os logs por 30 dias e as métricas por 90 dias. Com um milhão de logs registrados, o preço é de $130 por mês: a base de $49 mais nove blocos excedentes de $9. O fornecedor também afirma que esse plano não é recomendado para organizações que exigem controles de segurança personalizados ou garantias de residência de dados.
O Enterprise usa preços personalizados e começa em 10 milhões ou mais de logs registrados por mês. Acrescenta retenção personalizada de logs e métricas, hooks personalizados de guardrails, SSO, orçamentos granulares e limites de taxa, nuvem privada, hospedagem em VPC, exportação para data lake, conformidade avançada, contratos personalizados, onboarding dedicado e suporte prioritário.
É esse pacote que justifica comprar Portkey. Uma empresa com dez fluxos de IA não precisa apenas de uma URL base. Precisa responder quem pode chamar quais modelos, quem gastou o dinheiro, qual versão de prompt foi executada, onde os logs ficam, qual guardrail bloqueou uma saída e quem reage quando o gateway falha. Portkey transforma essas perguntas em uma única plataforma e relação de suporte.
A barreira é o escopo da compra. A mesma superfície de controle que reduz a fragmentação em uma empresa pode criar burocracia desnecessária para uma única aplicação. O Production é acessível, mas os requisitos de segurança e residência que muitas vezes motivam a compra de um gateway levam o cliente ao preço personalizado do Enterprise. Calcule o custo para a organização que você está construindo, não apenas para o volume atual de solicitações.
- Caminhos Free para avaliação, Production público de $49 e Enterprise personalizado
- Fallbacks, novas tentativas, balanceamento de carga, cache, guardrails e observabilidade em um só produto
- Limites claros para logs, retenção e excedentes
- Opções de nuvem privada e VPC para clientes Enterprise
- Identidade, orçamentos, exportação de dados e suporte podem atender várias aplicações
- Developer é explicitamente um plano que não serve para produção
- Production não é recomendado para requisitos personalizados de segurança ou residência
- O preço do Enterprise não é público
- Equipes menores podem pagar por controles organizacionais que não usarão
Portkey ocupa o terceiro lugar porque resolve um problema empresarial maior que o roteamento. Isso é uma vantagem quando políticas e prestação de contas travam a adoção. É peso de plataforma quando a necessidade imediata é apenas colocar três modelos atrás de um endpoint.
4. Cloudflare AI Gateway: melhor para stacks centradas na Cloudflare
Cloudflare AI Gateway é a melhor alternativa de baixo custo ao OpenRouter quando a Cloudflare já opera a borda, a segurança ou o runtime Workers da aplicação. Os recursos principais de analytics, cache e limitação de taxa são gratuitos em todos os planos, e o Dynamic Routing pode aplicar caminhos condicionais, divisões de tráfego, limites de taxa, limites de orçamento e fallbacks.

Uma startup que já implanta no Workers pode adicionar visibilidade e roteamento de modelos sem outra assinatura. Uma equipe maior pode integrar DLP, logs e roteamento ao modelo operacional que já utiliza na Cloudflare. Uma empresa que adotar Cloudflare somente para evitar uma taxa pequena de gateway talvez crie mais trabalho de conta e plataforma do que economiza.
Melhor para: Equipes que já usam produtos de rede, segurança ou Workers da Cloudflare
Destaque: Gateway principal de $0, com verificação DLP gratuita e rotas dinâmicas versionadas
Preço: Núcleo $0; Unified Billing acrescenta 5% aos créditos comprados; uso adjacente de Workers e guardrails pode gerar cobranças
Teste grátis: Os recursos principais continuam gratuitos, em vez de expirar
A documentação de preços da Cloudflare informa que o gateway principal está disponível gratuitamente em todos os planos. O Workers Free armazena 100,000 logs no total, considerando todos os gateways da conta. O Workers Paid armazena 10 milhões de logs por gateway. A verificação DLP é gratuita, embora uma conta sem assinatura Zero Trust receba apenas dois perfis DLP predefinidos.
O Unified Billing aplica uma taxa de 5% aos créditos comprados pela Cloudflare e repassa as tarifas de inferência dos provedores sem margem. Portanto, uma compra mensal de $50,000 em créditos gera uma taxa de $2,500 para a Cloudflare. BYOK segue outro caminho: a taxa de 5% sobre a compra de créditos não se aplica porque o provedor do modelo cobra sua própria chave.
A página atual de limites revela uma fronteira importante. Solicitações que usam credenciais gerenciadas pela Cloudflare via Unified Billing ficam limitadas a 200 solicitações a cada 60 segundos por gateway e recebem um erro 429 acima dessa taxa. O limite não se aplica ao tráfego BYOK. Uma aplicação de consumo com média de quatro solicitações por segundo já ultrapassa 200 por minuto, portanto o Unified Billing exige uma verificação explícita de capacidade antes do lançamento.
Outros limites documentados incluem 500 logs armazenados por segundo por gateway, 25 MB para uma solicitação que pode entrar em cache, TTL de cache de um mês, cinco entradas de metadados personalizados por solicitação, 10 gateways no plano gratuito e 20 no plano pago. Esses números são generosos para muitas aplicações e devem ser tratados como dados de arquitetura, não descobertos durante um incidente.
O Dynamic Routing vai além de uma lista simples de fallbacks. Ele pode criar ramificações com base na solicitação ou em metadados personalizados, dividir o tráfego por percentual, impor limites de solicitações ou de orçamento, escolher um fallback, salvar versões, implantar uma versão e fazer rollback. Isso ajuda no roteamento por plano de cliente, em mudanças graduais de modelos e em experimentos controlados. Também significa que a política de roteamento se torna configuração da Cloudflare; por isso, exporte e documente a intenção por trás de cada rota.
A barreira é a adequação ao restante da plataforma. Cloudflare é uma escolha forte quando uma equipe já domina suas contas, segurança, logs, planos Workers e modelo de implantação. É menos atraente quando todos esses conceitos são novos e a aplicação precisa apenas de um endpoint gerenciado para modelos.
- Analytics, cache e limitação de taxa gratuitos em todos os planos
- Verificação DLP gratuita com dois perfis predefinidos fora do Zero Trust
- Controles condicionais, percentuais, de taxa, orçamento, fallback, versão e rollback
- Ótima adequação a operações que já usam borda e segurança da Cloudflare
- BYOK evita a taxa de créditos do Unified Billing e seu limite de solicitações
- Unified Billing acrescenta 5% aos créditos comprados
- Unified Billing é limitado a 200 solicitações a cada 60 segundos por gateway
- O armazenamento gratuito de logs termina em 100,000 para toda a conta
- Custos adjacentes de Workers, guardrails, Logpush e Zero Trust podem entrar na stack
Cloudflare ocupa o quarto lugar porque sua melhor combinação de preço e controle depende de um contexto Cloudflare já existente. Dentro desse contexto, pode ser a rota capaz mais barata da lista. Fora dele, Vercel ou Requesty geralmente representa uma decisão de adoção menor.
5. Requesty: substituição mais próxima com preço por uso
Requesty é a alternativa ao OpenRouter mais próxima para uma equipe pequena que quer roteamento gerenciado, catálogo amplo e uma taxa ligada diretamente ao uso dos modelos. O Pay as you go oferece 600+ modelos de 20+ provedores e inclui BYOK, políticas de roteamento, cache, fallbacks, controles de orçamento, um MCP Gateway, residência de dados na UE, observabilidade avançada e suporte por e-mail.

Uma startup pode começar nos modelos gratuitos, passar a pagar uma margem de 5% quando surgir tráfego pago e evitar uma decisão sobre assentos ou assinatura. Uma equipe de SaaS B2B que atende clientes europeus talvez valorize a residência de dados na UE antes do catálogo. Uma empresa com gasto alto e estável em tokens e alguém responsável pela plataforma deve comparar esse percentual com LiteLLM ou Bifrost antes de aceitá-lo por tempo indeterminado.
Melhor para: Equipes pequenas que preferem um serviço gerenciado percentual a uma assinatura
Destaque: Sem taxa por assento nem gasto mínimo, com roteamento e residência na UE em toda a oferta
Preço: Free $0; Pay as you go acrescenta 5%; Enterprise personalizado
Teste grátis: Plano Free com 200 solicitações por dia em modelos gratuitos e sem cartão de crédito
A página de preços atual da Requesty deixa o modelo concreto: um modelo que custa $10 por milhão de tokens no provedor custa $10.50 por meio da Requesty. O Free oferece a plataforma completa nos modelos gratuitos, permite 200 solicitações por dia e inclui roteamento, cache, fallbacks, acompanhamento de gastos, analytics e residência de dados na UE.
O Pay as you go não cobra por assento nem exige gasto mínimo. A margem de 5% compra acesso a todos os 600+ modelos, 20+ provedores, BYOK, políticas de roteamento, cache, fallbacks, limites de gastos, tetos de orçamento, um MCP Gateway, residência de dados na UE, observabilidade avançada e suporte por e-mail. Com custo mensal de modelos de $5,000, a taxa é de $250. Com $50,000, é de $2,500.
O Enterprise usa preços personalizados. Ele acrescenta SSO por Okta, Azure AD, Google Workspace ou OIDC personalizado; RBAC completo; logs de auditoria; modelos e políticas aprovados; controles de gastos por equipe; guardrails; detecção de PII; contas de serviço para CI/CD; suporte dedicado; e SLAs personalizados.
É fácil aprovar o percentual enquanto o tráfego ainda é incerto. Esse mesmo percentual vira a barreira depois que o uso se estabiliza. Com o custo operacional ilustrativo de $1,800 mensais para self-hosting, a taxa de 5% da Requesty atinge o ponto de equilíbrio em $36,000 de gastos mensais com modelos. O comprador pode continuar no serviço gerenciado acima desse patamar se o trabalho de plataforma economizado valer mais de $1,800, mas a decisão deve ser reavaliada, não deixada para se acumular silenciosamente.
Requesty não é uma cópia perfeita do OpenRouter — e isso é positivo. Seu catálogo é amplo o bastante para a maioria das equipes de produto, enquanto seus diferenciais mais claros são controles de roteamento, gestão de orçamento, observabilidade e residência na UE. Se o principal objetivo for descobrir o endpoint do modelo obscuro mais recente, os 500+ modelos e 80+ provedores do OpenRouter continuam difíceis de superar. Se o objetivo for operar um conjunto aprovado com um percentual um pouco menor, Requesty é mais fácil de justificar.
- Sem assinatura, taxa por assento ou gasto mínimo no Pay as you go
- 600+ modelos de 20+ provedores
- Roteamento, cache, fallbacks, orçamentos, BYOK e acesso MCP na opção paga
- Residência de dados na UE incluída em toda a oferta
- Caminho Enterprise para identidade, auditoria, políticas, controles de PII e SLAs
- A taxa de 5% cresce diretamente com o gasto em modelos
- O preço do Enterprise não é público
- O tráfego Free é limitado a modelos gratuitos e 200 solicitações por dia
- A amplitude do catálogo é menor que o marketplace atual do OpenRouter, com 500+ modelos e 80+ provedores
Requesty fica em quinto lugar porque é uma substituição gerenciada clara, mas não tem a vantagem de margem zero da Vercel nem a profundidade organizacional da Portkey. Para uma equipe pequena que busca uma compra semelhante à do OpenRouter com percentual ligeiramente menor, ainda pode ser a escolha correta mais simples.
6. Bifrost: melhor alternativa self-hosted enxuta
Bifrost é a melhor alternativa self-hosted enxuta ao OpenRouter quando o comportamento explícito de novas tentativas e o OpenTelemetry importam mais que o tamanho do ecossistema. Seu plano OSS de $0 pode ser executado como Docker, Kubernetes ou binário Go e reúne 1,000+ modelos atrás de uma API, com observabilidade, orçamentos, limites, chaves virtuais, roteamento personalizado, fallbacks, cache e um gateway MCP.

Uma equipe de plataforma que prefere um serviço nativo em Go pode encaixar Bifrost em um padrão existente de contêineres ou Kubernetes sem pagar percentual sobre tokens. Um profissional sênior pode inspecionar o caminho de novas tentativas, em vez de aceitar um fallback como caixa-preta. Uma empresa sem alguém responsável pelo gateway não deve escolhê-lo apenas porque a licença é grátis.
Melhor para: Equipes de plataforma que querem uma superfície menor de roteamento self-hosted
Destaque: Comportamentos documentados de novas tentativas, rotação de chaves, fallback e telemetria
Preço: OSS $0; Enterprise personalizado
Teste grátis: 14 dias de Enterprise
A página de preços do Bifrost oferece no OSS regras e fluxos personalizados de roteamento, métricas e traces do OpenTelemetry, observabilidade integrada, orçamentos e limites por chave virtual, fallbacks, cache simples e semântico, um gateway MCP, métricas do Prometheus e várias formas de implantação. O Enterprise acrescenta guardrails, modo cluster, balanceamento de carga adaptativo, SAML e OIDC, integrações com cofres, exportação de logs, logs de auditoria, RBAC, implantação em VPC, implantação on-premises, suporte a air gap, SLAs personalizados e suporte dedicado.
O preço é simples porque o modelo operacional não é. OSS é gratuito para sempre. Enterprise é personalizado. Fora do custo da licença, sua organização paga pelo serviço, pelo banco de dados ou estado necessário, pela telemetria, pelos segredos, pela computação, pelas atualizações e pelo plantão.
A documentação de novas tentativas do Bifrost é um bom motivo para considerá-lo. A quantidade máxima padrão de novas tentativas é zero. Quando ativado, o intervalo começa em 500 milissegundos e chega ao teto de 5,000 milissegundos. Falhas de rede e 5xx reutilizam a chave do provedor com espera progressiva. Falhas de credencial e cobrança podem alternar chaves. A solicitação só segue para um fallback depois que o modelo principal esgota seu orçamento de tentativas, e cada fallback recebe seu próprio orçamento completo.
Essa clareza também revela a barreira. Um número alto de tentativas combinado com vários fallbacks pode transformar a indisponibilidade de um serviço upstream em longa espera para o usuário e várias tentativas cobradas. Uma resposta de fallback também pode estar sintaticamente correta e, ao mesmo tempo, violar as expectativas de schema, ferramenta ou dados da aplicação. Defina um limite total de latência sobre toda a cadeia, interrompa em falhas de política e mantenha os modelos principal e fallback compatíveis com o contrato do fluxo.
Bifrost concorre mais diretamente com LiteLLM. LiteLLM vence pela familiaridade do ecossistema e por um plano de controle mais amplo e estabelecido. Bifrost vence quando sua implantação em Go, rastreabilidade de tentativas, postura de OTel ou superfície operacional menor combinam melhor com o padrão da plataforma. Ambos perdem para um gateway gerenciado quando não existe alguém responsável por operá-los.
- Plano OSS de $0 com implantação por Docker, Kubernetes e binário Go
- 1,000+ modelos com chaves, orçamentos, roteamento, fallbacks, cache e telemetria
- Comportamento específico e documentado de novas tentativas e fallbacks
- OpenTelemetry e Prometheus se encaixam no monitoramento existente da plataforma
- Caminho Enterprise para cluster, identidade, cofres, implantação privada e suporte
- Sua equipe responde por disponibilidade, atualizações, segredos, telemetria e incidentes
- O preço do Enterprise não é público
- Orçamentos de novas tentativas e fallbacks podem ampliar latência e custo
- Ecossistema e histórico operacional menores que os do LiteLLM
Bifrost ocupa o sexto lugar porque é um especialista forte, não um produto inferior. Supera LiteLLM quando a semântica explícita de tentativas e uma presença nativa em Go determinam a implantação. Fica atrás quando a equipe valoriza o ecossistema maior do LiteLLM ou quer um serviço gerenciado.
Qual gateway de IA escolher em cada cenário?
Escolha a rota cuja barreira mais difícil corresponda a uma capacidade que sua organização já financia. Um gateway self-hosted só é barato quando existe responsabilidade de plataforma. Um gateway gerenciado só é independente quando a aplicação consegue ignorá-lo. Governança empresarial só tem valor quando alguém precisa aplicar e auditar a política.
Escolha LiteLLM para uma empresa de produto que tenha responsável de plataforma, padrões existentes de implantação e monitoramento e uma exigência rígida para o caminho dos dados ou gasto mensal com modelos próximo do ponto de equilíbrio informado de $32,727. A escolha muda para Bifrost quando Go, OpenTelemetry e a semântica explícita de novas tentativas se encaixam melhor na plataforma.
Escolha Vercel AI Gateway para uma startup ou equipe de produto que precisa de endpoint gerenciado sem margem sobre tokens. A escolha muda para Cloudflare quando ela já opera a borda e a stack de segurança, ou para Requesty quando residência de dados na UE e um modelo simples de 5% importam mais que a estrutura de adicionais da Vercel.
Escolha Portkey para uma empresa média ou grande que precisa gerenciar identidade, retenção, governança de prompts, guardrails, opções de implantação privada e suporte em várias aplicações. A escolha muda para LiteLLM ou Bifrost quando a empresa precisa controlar o gateway em execução e já financia a equipe para operá-lo.
Escolha Cloudflare AI Gateway quando o núcleo gratuito, DLP, logs, rotas dinâmicas e o contexto Workers consolidarem trabalho que você já opera. Abandone o Unified Billing quando o pico de tráfego puder ultrapassar 200 solicitações por minuto por gateway; BYOK remove esse limite documentado.
Escolha Requesty enquanto o tráfego incerto tornar um percentual mais fácil de aprovar que um projeto de plataforma. Reavalie a decisão em torno de $36,000 de gastos mensais com modelos, de acordo com a premissa operacional apresentada. A taxa ainda pode ser a escolha correta acima desse valor, mas deve ser deliberada.

A condição explícita para mudar cabe em uma frase: troque de gateway quando uma taxa medida, limite de implantação, lacuna de política ou modo de falha custar mais que a migração e a manutenção da próxima opção. Não mude porque a Stripe comprou uma empresa. Mude porque a nova rota vence uma decisão operacional documentada.
Opções que devem ser evitadas como rota única
Evite qualquer opção que concentre uma carga crítica sem um bypass testado. Todos os produtos citados abaixo podem ser boas escolhas. Cada um se torna uma rota única ruim ao cruzar um limite específico.
Evite OpenRouter como única rota durante a transição de propriedade. Os preços atuais ainda oferecem 500+ modelos, 80+ provedores, roteamento sofisticado e franquias BYOK úteis. O problema não é uma previsão de que a Stripe vá piorar o serviço. O problema é que acesso, roteamento, cobrança e políticas já estão concentrados em uma conta. Continue usando enquanto justificar a taxa e mantenha uma rota direta para um provedor.
Evite LiteLLM ou Bifrost sem um responsável definido. Uma licença grátis não corrige o proxy, protege o banco de dados, gira credenciais, ajusta tentativas, investiga incidentes nem atualiza o comportamento dos provedores. Se a responsabilidade recair sobre a última pessoa que alterou a configuração, escolha um gateway gerenciado.
Evite Portkey Developer em produção. O fornecedor o classifica explicitamente como inadequado para produção, limita o registro a 10,000 logs por mês e os conserva por três dias. O ponto de partida para produção é $49. Enterprise é a opção relevante quando segurança personalizada, residência de dados, implantação privada ou controles mais profundos de conformidade são requisitos.
Evite Cloudflare Unified Billing como única rota de alto throughput quando o pico de tráfego puder superar 200 solicitações a cada 60 segundos por gateway. BYOK está isento desse limite documentado, portanto a solução pode ser mudar a cobrança, não o gateway.
Evite um proxy caseiro de URL base depois que mais de uma aplicação passar a depender dele. Streaming, normalização de erros, parâmetros específicos dos provedores, orçamentos de tentativas, schemas de ferramentas, orçamentos financeiros, isolamento de chaves, logs e descontinuações formam um produto interno que precisa de manutenção. Só construa quando uma política única ou a economia justificar responsabilidade permanente.
Perguntas frequentes
Existe algo melhor que o OpenRouter?
LiteLLM é melhor quando você precisa de um gateway self-hosted controlado pela aplicação. Vercel AI Gateway é melhor quando margem zero sobre tokens e operação gerenciada são prioridade. OpenRouter continua melhor em amplitude de marketplace, com 500+ modelos e 80+ provedores nos planos pagos atuais.
Quais provedores de IA são parecidos com o OpenRouter?
Vercel AI Gateway, Requesty, Cloudflare AI Gateway, Portkey, LiteLLM e Bifrost oferecem diferentes combinações de roteamento multiprovedor. Vercel, Requesty, Cloudflare e Portkey são opções gerenciadas; LiteLLM e Bifrost são as alternativas self-hosted mais fortes.
O OpenRouter tem uma versão gratuita?
Sim. Atualmente, o OpenRouter Free inclui 25+ modelos gratuitos de quatro provedores e 50 solicitações por dia. É uma opção para avaliação, não capacidade garantida de produção.
Como o OpenRouter ganha dinheiro?
O OpenRouter Pay-as-you-go cobra uma taxa de plataforma de 5.5%. Enterprise oferece descontos na taxa e compromissos personalizados de volume. BYOK não paga taxa até $25,000 de inferência mensal pelo preço de tabela no Pay-as-you-go ou $200,000 no Enterprise; acima da franquia, custa 5%.
Posso usar Claude Code com OpenRouter?
Sim, quando o cliente aceita configuração compatível de URL base e modelo. Vale o mesmo alerta de qualquer integração com gateway: não espalhe nomes de modelos nem cabeçalhos específicos do OpenRouter pela lógica do repositório se quiser manter uma rota de saída limpa.
A tarefa de segunda-feira: crie o bypass antes de trocar de gateway
Não comece a próxima semana com uma migração completa. Crie um bypass direto para um provedor, comprove seu funcionamento em um fluxo delimitado e só então decida se o OpenRouter ainda justifica a taxa. O resultado deve ser uma decisão operacional cronometrada e precificada, não apenas um diagrama de arquitetura mais bonito.
Mapeie uma rota com características de produção
Registre, para um fluxo importante, o modelo atual no gateway, o provedor subjacente, o caminho de autenticação, o gasto mensal com modelos, a meta de latência p95, os requisitos de saída estruturada ou ferramentas, a política de dados e o comportamento de fallback.
Crie um nome interno para a capacidade
Substitua a string pública do modelo do gateway na lógica de negócio por um alias estável, como
support-primary. Mapeie esse alias para o OpenRouter na configuração normal e para um provedor direto na configuração de bypass.Crie o adaptador direto
Use uma conta e uma chave de provedor controladas pela sua empresa. Mantenha cabeçalhos e diferenças de solicitação específicos do provedor dentro do adaptador, para que o restante da aplicação continue vendo o mesmo contrato de entrada e saída.
Reproduza 100 solicitações sanitizadas
Use prompts representativos sem dados de clientes nem informações confidenciais. Compare validade do schema, comportamento das ferramentas, saídas aceitas, latência, erros dos provedores, novas tentativas e custo total entre o gateway e a rota direta.
Force a troca de rota
Transfira o fluxo delimitado para o adaptador direto por configuração e implantação controlada. Cronometre a mudança, verifique logs e orçamentos e, depois, retorne à rota anterior. Corrija toda dependência que tenha exigido alterações na lógica de negócio.
Tome a decisão de orçamento
Mantenha OpenRouter quando catálogo, roteamento, cobrança e tratamento de falhas economizarem mais que a taxa medida da plataforma. Só mude para LiteLLM, Vercel, Portkey, Cloudflare, Requesty ou Bifrost quando a opção vencer nos critérios documentados de taxa, política, implantação ou falhas.
Para uma startup técnica sem responsável de plataforma, o piloto de segunda-feira normalmente deve comparar OpenRouter com Vercel AI Gateway e a rota direta ao provedor. Para uma empresa com responsabilidade de plataforma e um limite privado rígido, compare LiteLLM com a mesma rota direta. Em um programa de governança empresarial, valide Portkey em relação a requisitos de identidade, retenção, implantação, exportação e suporte antes de encaminhar tráfego de clientes.
A aquisição é o gatilho. A solução duradoura é a regra das duas rotas: um gateway conveniente, um caminho independente para um provedor e um motivo mensurável para cada dólar e dependência entre a aplicação e o modelo.
2 de set. de 2026







