Jev Router é grátis? Veja o custo real de uma sessão
Jev Router é grátis no anúncio, mas isso não garante uma sessão a custo zero. Veja como conferir modelo escolhido, cache, ferramentas e cobrança real.

Jev Router é grátis? A página oficial da OpenRouter mostra $0 para tokens de prompt e de conclusão, mas isso, por si só, não prova que uma sessão roteada de agente tenha custo total de $0. O endpoint gerenciado escolhe outro modelo e um nível de esforço de raciocínio. Por isso, o valor que realmente fecha a conta é o usage.cost da resposta, conferido com o registro da geração correspondente.
Jev Router é o endpoint gerenciado typesafe/jev-router da OpenRouter, lançado em 25 de setembro de 2026. Trata-se de um endpoint de chat que decide qual modelo deve responder a cada turno. É um produto diferente tanto do modelo original de decisão Jev quanto do wrapper de CLI open source com nome parecido.

Jev Router é grátis? A resposta verificada
A resposta comprovável é mais restrita do que o selo verde “grátis” faz parecer: a OpenRouter anuncia o Jev Router por $0 tanto para tokens de prompt quanto de conclusão, mas o custo total do modelo escolhido não está documentado com clareza suficiente para afirmar que toda sessão roteada é gratuita.
A página oficial do Jev Router foi verificada em 26 de setembro de 2026. O FAQ responde que sim, o roteador é grátis e informa que não há cobrança por tokens de prompt nem de conclusão. A página também descreve uma janela de contexto de 1,000,000 tokens e um único endpoint que escolhe o modelo e o esforço de raciocínio à medida que a conversa muda.
Dois detalhes do catálogo impedem uma conclusão mais ampla. Na mesma data, a API de modelos pública da OpenRouter retornou -1, e não um valor fixo convencional, para os preços de prompt e conclusão do roteador. Já o registro do endpoint não retornou endpoints de provedores. Esses campos legíveis por máquina não demonstram que exista cobrança, mas tampouco transformam o rótulo de $0 da página em uma fatura detalhada da sessão.
Este ambiente de publicação não disponibilizou uma chave autorizada da API da OpenRouter nem uma sessão autenticada na plataforma. Portanto, nenhuma requisição faturável foi feita e não há um usage.cost observado ou registro em Activity por trás desta resposta. Para montar um orçamento responsável, trate $0 como o preço anunciado do endpoint e valide a chamada completa antes de prometer inferência gratuita a um cliente ou à equipe financeira.
O que mudou de fato em 25 de setembro
A mudança foi a passagem do Jev de um componente usado para construir um roteador para a camada de decisão dentro de um endpoint de chat gerenciado.
Jev 1.13 é um modelo System One: em vez de texto corrido, ele devolve decisões restritas. A aplicação fornece um estado e solicita uma Choice, um Score ou uma pergunta Noul de sim ou não. O modelo pode decidir “use a categoria mais potente”, mas ainda cabe ao seu código chamar essa categoria, preservar a conversa e contabilizar as duas requisições.
O roteador gerenciado reúne esse fluxo em typesafe/jev-router. Segundo a thread de lançamento da OpenRouter, antes de cada turno o Jev avalia a dificuldade e a precisão exigidas pelo prompt, considera se um modelo maior ou mais raciocínio traria benefício e verifica se a tarefa mudou. Depois, a OpenRouter envia o turno ao modelo selecionado e devolve o texto gerado por ele.
O projeto open source gargpratyush/jev-router é especialmente fácil de confundir com o novo endpoint. Ele inicia a CLI real do Claude Code ou do Codex, toma uma decisão com Jev a cada turno novo, converte o resultado em categorias específicas da conta e reaproveita a autenticação existente da CLI. Não é o slug do modelo gerenciado na OpenRouter, e sua cobrança segue outro caminho.
Essa distinção muda a implementação. No fluxo original, o Jev entrega uma primitiva de decisão. O roteador faça-você-mesmo adiciona uma política local às assinaturas das ferramentas de programação. Já o endpoint gerenciado oferece uma única chamada de API, cuja saída vem de um modelo escolhido por ele.
Como o Jev Router conduz uma conversa
O Jev Router foi projetado para não trocar de modelo só porque a mensagem seguinte parece diferente. Isso importa porque a mudança pode descartar o cache da conversa mantido por um provedor e obrigar o novo modelo a reler todo o histórico.
Segundo a OpenRouter, o roteador mantém um modelo que esteja funcionando pelo restante da sessão, pode aumentar ou reduzir o esforço de raciocínio sem trocar de modelo e só faz a mudança quando a melhoria esperada compensa o custo do cache perdido. Para decidir, ele lê o texto da conversa. A thread de lançamento afirma que anexos não são enviados ao Jev e que requisições com zdr: true são compatíveis.

Isso vai além de classificar cada prompt isoladamente. Um modelo econômico pode continuar em uma sequência simples porque preservar seu cache talvez valha mais do que fazer uma troca. Um turno difícil pode receber mais esforço de raciocínio sem pagar o custo de reiniciar o contexto ao mover a conversa inteira. Quando a tarefa realmente muda, o roteador pode migrar.
Há também uma barreira operacional. Se a decisão do Jev exceder o tempo limite ou retornar uma saída inválida, a OpenRouter informa que a requisição falha, em vez de recorrer a outro roteador. O projeto faça-você-mesmo, por sua vez, opera em modo fail-open e mantém o modelo atual ou um fallback. Portanto, adotar o endpoint gerenciado significa colocar uma nova dependência no caminho crítico, e não apenas acrescentar um otimizador de preço.
O que o preço de $0 cobre — e o que ele não prova
O preço de $0 cobre exatamente o que a OpenRouter publica: os valores de prompt e conclusão na página do Jev Router. Ele não detalha como um modelo pago selecionado, tokens de raciocínio, leituras de cache, ferramentas e compra de créditos entram naquele valor.
As regras gerais de cobrança da OpenRouter dizem que uma requisição comum é faturada conforme a tarifa do modelo e do provedor escolhidos. A nova página do Jev diz que o roteador é grátis. Nenhuma das fontes esclarece se o endpoint gerenciado subsidia temporariamente o modelo selecionado, repassa essa inferência como uma linha separada ou usa outro arranjo específico do lançamento. Aplicar aqui a regra comum do Auto Router seria uma suposição — assim como seria supor que toda inferência de modelos pagos é gratuita.
A resposta é a primeira fonte confiável. A documentação de contabilização de uso da OpenRouter informa que toda resposta inclui dados de prompt, conclusão, raciocínio, tokens em cache e custo. O usage.cost representa o total cobrado da conta, enquanto o campo model da resposta identifica qual modelo produziu o conteúdo.
O registro da geração é a segunda fonte. O recurso Logs da OpenRouter expõe modelo, provedor, custo, contagem de tokens, latência, descontos de cache, custo de BYOK e cobranças por busca na web, acesso a páginas ou processamento de arquivos. Já o painel agregado Activity mostra gastos, requisições, tipos de token e taxa de acerto de cache, com filtros por modelo, provedor, chave, app ou usuário.
Assim, cada item em dúvida tem onde ser conferido:
- Modelo escolhido: compare o
modelretornado com ousage.coste ototal_costda geração. - Raciocínio: salve
completion_tokens_details.reasoning_tokense a explicação de roteamento do turno. - Reuso de cache: salve
prompt_tokens_details.cached_tokense procure por desconto de cache nos detalhes da geração. - Ferramentas: deixe-as fora do teste inicial e, antes de ativá-las em produção, verifique suas linhas separadas na geração.
- Taxa dos créditos: distribua a taxa de compra separadamente. O FAQ atual da OpenRouter informa 5.5%, com mínimo de $0.80, para créditos pagos por cartão e 5% para criptomoedas. Trata-se de uma taxa de aquisição de créditos, não de evidência de sobretaxa do Jev Router.

Os números: uma decisão grátis não torna a sessão gratuita
A linha referente à decisão de roteamento já é mínima. A questão econômica mais importante é se o Jev escolhe um modelo adequado, preserva um cache útil e entrega um resultado aceito.
Comece pela rota antiga, com decisão explícita. O Jev 1.13 custa $0.042 por milhão de tokens de entrada e $0 por milhão de tokens de saída. Considere 500 tokens de entrada em cada decisão de roteamento e 100,000 turnos. O resultado é 50 milhões de tokens de entrada no Jev, ou $2.10 pela camada de decisão. O modelo generativo que responde a cada turno continua sendo cobrado à parte.
Com a tarifa anunciada na página gerenciada, essa mesma linha de roteamento fica em $0. A economia aparente, portanto, é de $2.10 a cada 100,000 decisões nessa carga de trabalho. É um ganho útil, mas insuficiente para definir a escolha do produto. Uma troca de modelo ruim pode pesar mais do que milhares de decisões do Jev.
Imagine uma conversa com 20,000 tokens de prompt acumulados. Usando, como exemplo, um modelo selecionado com entrada a $2 por milhão de tokens, obrigar um novo modelo a reler o histórico custa $0.04 antes de descontos de cache ou de qualquer saída nova. Cinquenta e três trocas desnecessárias custam $2.12, um pouco mais do que toda a linha de decisões do Jev 1.13 no exemplo de 100,000 turnos.
Esse é o argumento de custo mais duradouro a favor de um roteador que entende a sessão: preservar o cache certo pode importar mais do que zerar o preço do classificador de rotas. O cálculo é um cenário explícito, não uma afirmação de que o Jev Router escolherá um modelo de $2 ou evitará 53 trocas.
As evidências de desempenho são promissoras, mas ainda incompletas. A OpenRouter relata que o Jev Router resolveu 237 contra 130 de 423 tarefas, ou 82% a mais do que o Auto Router, em quatro benchmarks de agentes. A empresa também afirma que a mediana do tempo até o primeiro token foi menor do que a de todos os outros roteadores testados em cinco benchmarks de agentes. São resultados do fornecedor, não uma reprodução independente.
Theo Browne trouxe um contraponto útil em um relato de benchmark de 26 de setembro. Segundo ele, foram gastos $1,000, o desempenho no DeepSWE ficou aproximadamente no mesmo nível do GPT-6 Astra com baixo esforço, o custo foi um pouco maior e a espera quase cinco vezes mais longa. É um resultado atribuído de benchmark. Não demonstra uma taxa de $1,000 pelo roteador, e a publicação não apresenta dados de cobrança por requisição suficientes para responder à pergunta de custo deste artigo.
Para quem compra, o número decisivo continua sendo o custo por tarefa aceita:
(selected-model cost + tools + allocated funding fee + retries + review time) / accepted tasks
Uma linha de roteamento a $0 pode reduzir esse numerador. Ela não faz o restante da equação desaparecer.
O impacto para quem desenvolve, opera e compra
Para quem desenvolve, a integração fica mais simples, mas a dependência fica mais crítica. Um único slug de modelo compatível com OpenAI pode substituir um classificador próprio, uma tabela de políticas, a chamada ao modelo e parte da lógica de sessão. Em contrapartida, o roteador passa a anteceder todas as respostas. Como o comportamento documentado é fail-closed, a aplicação precisa definir como reagir a uma falha do Jev: tentar novamente uma vez, pedir que o usuário repita a ação ou chamar deliberadamente um modelo fixo conforme uma política própria.
O registro mínimo útil inclui ID da resposta, slug solicitado, modelo escolhido, justificativa da rota, esforço de raciocínio, tokens de prompt, tokens em cache, tokens de conclusão, tokens de raciocínio, usage.cost, latência e resultado. Sem esses campos, uma troca de modelo parece uma oscilação aleatória de preço, e uma queda de qualidade se confunde com um bug do agente.
A operação deve ser gerenciada por sessão, não pelo preço unitário do token. Um copiloto de atendimento, agente de pesquisa ou fluxo de programação pode reunir turnos simples, turnos difíceis e uma mudança de tarefa na mesma conversa. O valor está em gastar mais apenas quando o turno complexo justificar, preservando o cache quando não justificar. Meça em conjunto tarefas aceitas, novas tentativas, correções humanas e total da sessão.
Na planilha de orçamento, compradores devem separar inferência, roteamento e aquisição de créditos. O $0 anunciado pelo endpoint entra na linha de roteamento. O total do modelo escolhido entra na linha de uso quando for observado. Busca, acesso a páginas, processamento de arquivos e outras ferramentas ficam em linhas próprias. A taxa de 5.5% do cartão pertence à compra dos créditos, não a uma margem fictícia por requisição.
Para entender a conta mais ampla da plataforma, a análise de preços da OpenRouter aborda créditos compartilhados, BYOK e taxas de compra. Para o fluxo original do modelo de decisão, Como usar o Jev explica o roteamento tipado de tickets e a tarifa de $0.042/M do Jev 1.13.
Quem deve testar agora, quem deve esperar e quem não precisa mudar
Vale agir agora quando o fluxo de agente é limitado e reversível, o gasto da avaliação pode ser mantido abaixo de $1 e cada geração já é registrada. Uma tarefa de programação não crítica, um ciclo interno de pesquisa ou um assistente de suporte em modo sombra são bons ambientes de avaliação. O objetivo não é demonstrar que o roteamento parece inteligente, mas comparar custo por tarefa aceita e latência com um modelo fixo diante dos mesmos prompts.
É melhor esperar quando uma requisição voltada ao cliente não tolera outra dependência fail-closed, quando a equipe financeira exige uma regra de cobrança assinada antes de ativar qualquer rota variável ou quando os prompts contêm dados regulados que ainda não passaram por uma análise de privacidade. O suporte a retenção zero de dados é útil, mas não substitui a aprovação interna do fluxo de dados.
Pouco muda se um único modelo fixo já cumpre as metas de qualidade e latência, se a carga de trabalho é uma decisão tipada e restrita mais adequada ao Jev 1.13 ou se Claude Code e Codex são roteados deliberadamente pelo projeto local faça-você-mesmo. Um roteador gerenciado não é automaticamente melhor do que uma chamada direta e estável.
Se o controle determinístico sobre o provedor for mais importante do que a seleção adaptativa, compare as alternativas à OpenRouter para roteamento multimodelo antes de transferir o caminho crítico.
O exagero por trás da ideia de que o Jev Router é grátis
O exagero mais forte é dizer que uma ficha de modelo com $0 torna gratuito todo o ecossistema de modelos. A OpenRouter ainda não publicou detalhes de cobrança específicos do Jev suficientes para sustentar essa afirmação, e o catálogo público legível por máquina não mostra uma rota fixa convencional.
O exagero oposto é afirmar que deve existir uma sobretaxa oculta do roteador. Nenhuma sobretaxa foi documentada ou observada nesta apuração. Incluí-la em uma previsão seria inventar um custo.
Os benchmarks também precisam ser vistos na proporção certa. A alegação da OpenRouter de ganho de 82% em tarefas vem de uma comparação do fornecedor com seu próprio Auto Router. O relato de $1,000 de Theo sobre o DeepSWE é o benchmark de uma pessoa contra uma configuração de modelo fixo. Nenhum dos dois mostra o custo por tarefa aceita do seu agente, e nenhum substitui uma conciliação rápida no nível da conta.
Por fim, uma janela de contexto de 1,000,000 tokens não torna econômica uma conversa com um milhão de tokens. O modelo escolhido, o comportamento do cache, o esforço de raciocínio e as mudanças de tarefa é que determinam a eficiência de uma sessão longa. O limite de contexto representa capacidade, não orçamento.
O teste de custo com quatro requisições para fazer na segunda-feira
Quatro requisições sintéticas e pequenas podem esclarecer mais do que outra semana interpretando páginas de preço. Mantenha as ferramentas desativadas, não use dados privados, solicite respostas curtas e interrompa o teste se o usage.cost acumulado se aproximar de $1.
Envie uma requisição inicial de referência
Chame
typesafe/jev-routercom “Return only the word READY.”. AdicioneX-OpenRouter-Metadata: enabled. Salve o JSON completo, especialmenteid,model,usageeopenrouter_metadata.Inicie uma sessão curta de trabalho
Pergunte: “In one sentence, explain why an idempotency key prevents duplicate charges.”. Salve os mesmos campos. Assim, você cria um turno técnico simples, sem ferramentas nem dados externos.
Continue com todo o histórico
Envie novamente a mensagem anterior do usuário e a resposta do assistente. Em seguida, acrescente: “Give one counterexample in one sentence.”. Registre se o modelo escolhido permanece, se o esforço de raciocínio muda e se
cached_tokensaparece.Mude a tarefa e confira a cobrança
Mantenha o histórico da conversa e peça uma função de shell com quatro linhas que verifique se uma URL retorna HTTP 200. Some os quatro valores de
usage.cost. Busque cada geração pelo ID e compare modelo escolhido, contagem de tokens, tokens de raciocínio, campos de cache etotal_costcom Logs ou Activity.
A primeira requisição pode usar exatamente esta estrutura:
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-H "X-OpenRouter-Metadata: enabled" \
-d '{
"model": "typesafe/jev-router",
"messages": [
{"role": "user", "content": "Return only the word READY."}
]
}' | tee jev-router-response.jsonDepois, use o ID da resposta para buscar os metadados da geração correspondente:
GENERATION_ID=$(jq -r '.id' jev-router-response.json)
curl --get https://openrouter.ai/api/v1/generation \
--data-urlencode "id=$GENERATION_ID" \
-H "Authorization: Bearer $OPENROUTER_API_KEY"A regra de decisão é objetiva:
- Se as quatro respostas mostrarem
usage.cost: 0, os quatro registros de geração indicarem custo total zero e a visão Activity da mesma chave não somar nenhum gasto, você observou uma sessão sintética de custo zero nessa conta e nessa data. - Se qualquer registro tiver valor diferente de zero, use o modelo escolhido e seu detalhamento de custo. Para aquela requisição, o endpoint não foi gratuito de ponta a ponta, independentemente do selo no catálogo.
- Se houver divergência entre resposta, geração e Activity, não extrapole. Salve os IDs e pergunte ao suporte da OpenRouter qual registro determina a cobrança.
Não adicione ferramentas antes de conciliar o teste inicial. Quando busca, acesso a páginas ou processamento de arquivos entrarem no agente, repita uma requisição controlada e trate essas linhas da geração como custos separados. Não tente deduzi-los da ficha do Jev Router.
Na segunda-feira, rode essas quatro requisições ao lado de quatro controles com modelo fixo e compare custo da sessão, latência, respostas aceitas e taxa de falha. Só adote o Jev Router se a decisão de roteamento melhorar o resultado completo — não porque uma linha do catálogo contém dois zeros.
Receba no newsletter a próxima mudança verificada no roteamento de modelos e seu impacto no orçamento.
- Última atualização
- 26 de set. de 2026
- Categoria
- Build







