OpenRouter pricing: Jev Router è davvero gratis?

Jev Router mostra un prezzo di $0, ma una sessione instradata è davvero gratuita? Ecco quali dati di OpenRouter verificare prima di stimare i costi.

Saturday, September 26, 2026Omid Saffari
OpenRouter pricing: Jev Router è davvero gratis?

Sul fronte dell’OpenRouter pricing, Jev Router è gratis? La pagina aggiornata di OpenRouter indica $0 per i token di prompt e completamento, ma questo non basta a dimostrare che il costo totale di una sessione instradata sia $0. L’endpoint gestito seleziona un altro modello e il livello di ragionamento: per definire davvero il budget bisogna quindi controllare usage.cost nella risposta e riconciliarlo con il relativo record di generazione.

Jev Router, l’endpoint gestito typesafe/jev-router di OpenRouter, è stato lanciato il 25 settembre 2026. È un endpoint di chat che sceglie quale modello deve rispondere a ogni turno. Si tratta di un prodotto diverso sia dal modello decisionale Jev originale sia dal wrapper CLI open source dal nome simile.

Pagina del modello Jev Router su OpenRouter con l’endpoint gestito e i prezzi correnti
TypeSafe: Jev Router su OpenRouter, verificato il 26 settembre 2026

OpenRouter pricing: Jev Router è gratis? La risposta verificata

La risposta verificata è più circoscritta di quanto suggerisca il badge verde «gratis»: Jev Router viene pubblicizzato a $0 sia per i token di prompt sia per quelli di completamento, ma il costo totale del modello selezionato non è documentato con sufficiente chiarezza da poter definire gratuita ogni sessione instradata.

La pagina aggiornata di Jev Router è stata verificata il 26 settembre 2026. Nelle FAQ si legge che il router è gratuito e che i token di prompt e completamento non vengono addebitati. La stessa pagina descrive inoltre una finestra di contesto da 1,000,000 token e un unico endpoint capace di selezionare modello e livello di ragionamento al variare della conversazione.

Due dettagli del catalogo impediscono però di formulare una conclusione più netta. Alla stessa data, la Models API pubblica di OpenRouter restituiva -1, anziché un normale valore fisso, per i prezzi di prompt e completamento del router. Il relativo record dell’endpoint non restituiva alcun endpoint provider. Questi campi machine-readable non dimostrano che esista un addebito, ma nemmeno trasformano l’etichetta $0 della pagina in una fattura dettagliata della sessione.

L’ambiente usato per pubblicare questo articolo non esponeva né una chiave API OpenRouter autorizzata né una sessione OpenRouter autenticata, quindi non è stata effettuata alcuna richiesta fatturabile. Di conseguenza, questa risposta non è supportata da un valore usage.cost osservato o da un record in Activity. Per pianificare il budget in modo prudente, conviene considerare $0 come il prezzo pubblicizzato dell’endpoint e verificare poi l’intera chiamata prima di promettere inferenza gratuita a un cliente o al team finanziario.

Voce di costoDato verificatoCosa fornisce la provaTrattamento a budget
Scheda typesafe/jev-router$0 prompt, $0 completamentoPagina aggiornata del modelloPubblicizzato come gratuito
Inferenza del modello selezionatoNessuna regola di fatturazione specifica per Jev individuatausage.cost della risposta più log della generazioneNon verificato
Ragionamento e cacheIl router sceglie il livello e considera la perdita della cacheCampi relativi a ragionamento e token in cacheMisurare a ogni turno
Tool e acquisto dei creditiPossono applicarsi contatori separati; la commissione sui crediti acquistati con carta è del 5.5%, con un minimo di $0.80Dettaglio dei costi della generazione e ricevuta dei creditiFuori dal badge $0

Che cosa è cambiato davvero il 25 settembre

La novità è che Jev è passato dall’essere un componente con cui costruire un router a diventare il livello decisionale interno di un endpoint di chat gestito.

Jev 1.13 è un modello System One: restituisce decisioni vincolate, non testo discorsivo. L’applicazione gli fornisce uno stato e richiede una scelta tipizzata di tipo Choice, Score oppure una domanda Noul con risposta sì/no. Il modello può decidere «usa il livello più potente», ma spetta ancora al codice chiamare quel livello, conservare la conversazione e contabilizzare entrambe le richieste.

Il router gestito riunisce tutto questo in typesafe/jev-router. Secondo il thread di lancio di OpenRouter, prima di ogni turno Jev valuta difficoltà e precisione del prompt, considera se un modello più grande o un ragionamento più intenso possano aiutare e controlla se l’attività è cambiata. OpenRouter inoltra quindi il turno al modello selezionato e ne restituisce il testo.

ProdottoInterfacciaChe cosa controllaIndicazione di costo attuale
Jev Router gestitoAPI Chat, Responses o Messages di OpenRouterModello e livello di ragionamento nel corso di una conversazioneLa pagina indica $0/$0; il totale della sessione va verificato
Jev 1.13Decisions APIUna decisione tipizzata su cui interviene il codice$0.042/M in input, $0/M in output
gargpratyush/jev-routerProxy locale per Claude Code o CodexUn livello scelto per ogni nuovo turno CLIChiamata Jev più l’abbonamento CLI esistente dell’utente

Il progetto open source gargpratyush/jev-router si presta particolarmente a essere confuso con il nuovo endpoint. Avvia la vera CLI di Claude Code o Codex, esegue una decisione Jev per ogni nuovo turno, associa il risultato a livelli specifici dell’account e inoltra l’autenticazione già in uso nella CLI. Non è lo slug del modello gestito su OpenRouter e segue un percorso di fatturazione diverso.

Questa distinzione cambia l’architettura. Il flusso Jev originale offre una primitiva decisionale. Il router fai da te aggiunge una policy locale agli abbonamenti per strumenti di coding. L’endpoint gestito offre invece un’unica chiamata API, la cui risposta viene generata dal modello scelto dal router.

Come Jev Router gestisce una conversazione

Jev Router è progettato per non cambiare modello solo perché il messaggio successivo appare diverso. È un aspetto importante: un cambio può invalidare la conversazione memorizzata nella cache del provider e costringere il nuovo modello a rileggere l’intera cronologia.

Secondo OpenRouter, il router mantiene per il resto della sessione un modello che sta funzionando, può aumentare o ridurre il livello di ragionamento senza cambiare modello e passa a un altro modello soltanto quando il miglioramento atteso giustifica il costo della cache che andrebbe persa. Per decidere, legge il testo della conversazione. Il thread di lancio precisa che gli allegati non vengono inviati a Jev e che sono supportate le richieste con zdr: true.

Percorso decisionale architetturale dal prompt a Jev, quindi al modello selezionato e alla risposta, con il livello di ragionamento regolato accanto all’instradamento
Jev sceglie modello e livello di ragionamento prima che il modello selezionato produca la risposta.

Non è una semplice classificazione prompt per prompt. Un modello economico può restare attivo per una richiesta di follow-up facile, perché conservare la sua cache può valere più di un cambio. Un turno difficile può ricevere più ragionamento senza sostenere il costo di azzerare il contesto passando altrove l’intera conversazione. Quando l’attività cambia davvero, il router può spostarla.

C’è poi un limite importante per l’uso in produzione. Se la decisione di Jev va in timeout o restituisce un output non valido, OpenRouter dichiara che la richiesta fallisce invece di passare a un altro router. Il progetto fai da te, separato, adotta invece una strategia fail-open e mantiene il modello corrente o quello di fallback. Scegliere l’endpoint gestito significa quindi inserire una nuova dipendenza nel percorso critico, non soltanto aggiungere un ottimizzatore dei prezzi.

Che cosa copre il prezzo $0 e che cosa non dimostra

La dicitura $0 copre esattamente ciò che OpenRouter pubblica: i prezzi di prompt e completamento nella pagina di Jev Router. Non spiega nel dettaglio come confluiscano in quel numero un modello a pagamento selezionato, i token di ragionamento, le letture della cache, i tool e l’acquisto dei crediti.

Le regole generali di fatturazione di OpenRouter prevedono che una richiesta ordinaria venga addebitata alla tariffa del modello e del provider selezionati. La nuova pagina di Jev afferma invece che il router è gratuito. Nessuna delle due fonti chiarisce esplicitamente se l’endpoint gestito sovvenzioni temporaneamente il modello selezionato, trasferisca quell’inferenza in una voce separata o applichi un’altra formula legata al lancio. Usare qui la regola ordinaria di Auto Router sarebbe un’ipotesi, proprio come lo sarebbe dichiarare gratuita tutta l’inferenza dei modelli a pagamento.

La prima fonte attendibile è la risposta. La documentazione sulla contabilizzazione dell’utilizzo di OpenRouter specifica che ogni risposta include informazioni su prompt, completamento, ragionamento, token in cache e costi. usage.cost è l’importo totale addebitato all’account. Il campo model della risposta identifica il modello che ha generato l’output.

Il record della generazione è la seconda fonte. I Logs di OpenRouter mostrano modello, provider, costo, numero di token, latenza, sconti della cache, costo BYOK e addebiti per ricerca web, recupero di pagine o elaborazione di file. La dashboard Activity, in forma aggregata, mostra poi spesa, richieste, tipi di token e percentuale di cache hit, con filtri per modello, provider, chiave, app o utente.

Ogni voce contestata ha così un riscontro preciso:

  • Modello selezionato: confrontare il valore model restituito con usage.cost e con total_cost della generazione.
  • Ragionamento: salvare completion_tokens_details.reasoning_tokens e la spiegazione dell’instradamento relativa al turno.
  • Riutilizzo della cache: salvare prompt_tokens_details.cached_tokens, poi controllare nei dettagli della generazione l’eventuale sconto della cache.
  • Tool: escluderli dal test di base, quindi leggere le rispettive voci della generazione prima di abilitarli in produzione.
  • Commissione sui crediti: contabilizzare separatamente il costo di acquisto. Le FAQ aggiornate di OpenRouter indicano il 5.5%, con un minimo di $0.80, per i crediti acquistati con carta e il 5% per le criptovalute. È una commissione di acquisto, non la prova di un sovrapprezzo di Jev Router.
Sezione architetturale che separa la scheda del router a zero dollari dai livelli di costo per modello selezionato, tool e acquisto dei crediti
L’etichetta $0 di un endpoint risponde soltanto a un livello del budget della sessione instradata.

I numeri: una decisione di routing gratuita non rende gratuita la sessione

La voce relativa alla decisione del router è già minuscola. La domanda economica più importante è se Jev scelga un modello adatto, conservi la cache utile e produca un risultato accettato.

Partiamo dal vecchio percorso con decisione esplicita. Jev 1.13 costa $0.042 per milione di token in input e $0 per milione di token in output. Ipotizzando 500 token in input per ogni decisione di routing e 100,000 turni, si ottengono 50 milioni di token Jev in input, cioè $2.10 per il livello decisionale. Il modello generativo che risponde a ciascun turno resta un costo aggiuntivo.

Alla tariffa pubblicizzata nella pagina dell’endpoint gestito, la stessa voce di routing scende a $0. In questo carico di lavoro, il risparmio apparente è quindi di $2.10 ogni 100,000 decisioni. È un dato utile, ma non sufficiente per scegliere il prodotto: un solo cambio di modello sbagliato può pesare più di migliaia di decisioni Jev.

Consideriamo una conversazione con 20,000 token precedenti nel prompt. Con una tariffa esemplificativa di $2 per milione di token in input del modello selezionato, far rileggere quella cronologia a un nuovo modello costa $0.04, prima degli sconti della cache o del nuovo output. Cinquantatré cambi non necessari costano $2.12, poco più dell’intera voce decisionale di Jev 1.13 nell’esempio da 100,000 turni.

È questo il vantaggio economico duraturo di un router consapevole della sessione: conservare la cache giusta può contare più che rendere gratuito il classificatore di routing. Il calcolo rappresenta uno scenario esplicito, non l’affermazione che Jev Router sceglierà un modello da $2 o eviterà 53 cambi.

I dati sulle prestazioni sono promettenti, ma incompleti. OpenRouter afferma che Jev Router ha risolto 237 attività contro 130 su 423, cioè l’82% in più, rispetto ad Auto Router su quattro benchmark per agenti. Dichiara inoltre un tempo mediano al primo token più rapido di ogni altro router testato su cinque benchmark per agenti. Sono risultati del fornitore, non una riproduzione indipendente.

Theo Browne ha offerto un utile contrappunto in un report di benchmark del 26 settembre. Ha dichiarato di aver speso $1,000, di aver riscontrato prestazioni di DeepSWE grossomodo equivalenti a GPT-6 Astra con livello di ragionamento basso, di aver pagato leggermente di più e di aver atteso quasi cinque volte tanto. È il risultato di un benchmark attribuito alla fonte. Non dimostra l’esistenza di una commissione di routing da $1,000 e il post non espone dati di fatturazione sufficientemente granulari da risolvere la questione dei costi affrontata qui.

Per chi acquista, il parametro decisivo resta il costo per attività accettata:

(selected-model cost + tools + allocated funding fee + retries + review time) / accepted tasks

Una voce di routing da $0 può migliorare il numeratore. Non può far sparire il resto dell’equazione.

Che cosa cambia per sviluppatori, operatori e acquirenti

Per gli sviluppatori, l’integrazione è più semplice ma la dipendenza è più critica. Un solo slug di modello compatibile con OpenAI può sostituire un classificatore costruito in casa, una tabella di policy, la chiamata al modello e parte della logica di sessione. In cambio, il router si colloca prima di ogni risposta. Poiché il comportamento documentato è fail-closed, serve una gestione applicativa degli errori di Jev: per esempio riprovare una volta, chiedere all’utente di tentare di nuovo oppure chiamare deliberatamente un modello fisso secondo una policy interna.

Il log minimo utile comprende ID della risposta, slug richiesto, modello selezionato, motivazione dell’instradamento, livello di ragionamento, token del prompt, token in cache, token di completamento, token di ragionamento, usage.cost, latenza ed esito. Senza questi campi, un cambio di modello sembra una variazione casuale dei prezzi e un calo di qualità sembra un bug dell’agente.

Gli operatori dovrebbero gestirlo per sessione, non in base al prezzo unitario dei token. Un copilota per l’assistenza, un agente di ricerca o un flusso di coding possono includere nella stessa conversazione turni facili, turni difficili e un cambio di attività. Il comportamento utile consiste nello spendere di più soltanto quando il turno complesso lo giustifica, mantenendo la cache negli altri casi. Occorre misurare insieme attività accettate, tentativi ripetuti, correzioni umane e totale della sessione.

Gli acquirenti dovrebbero separare inferenza, routing e acquisto dei crediti nel budget. Lo $0 pubblicizzato per l’endpoint va inserito nella voce di routing. Il totale del modello selezionato va nella voce di utilizzo, una volta osservato. Ricerca, recupero di pagine, elaborazione di file e altri tool restano voci distinte. Il 5.5% applicato alle carte appartiene all’acquisto dei crediti, non a un sovrapprezzo per richiesta inventato.

Per una panoramica più ampia sui prezzi della piattaforma, l’analisi dei costi di OpenRouter approfondisce crediti condivisi, BYOK e commissioni di acquisto. Per il flusso del modello decisionale originale, come usare Jev illustra l’instradamento tipizzato dei ticket e la tariffa di $0.042/M di Jev 1.13.

Chi dovrebbe provarlo subito, chi dovrebbe aspettare e chi non ne ha bisogno

Conviene agire subito quando il flusso agente è circoscritto e reversibile, è possibile limitare la spesa di valutazione a meno di $1 e ogni generazione viene già registrata. Un’attività di coding non critica, un ciclo di ricerca interno o un assistente di supporto in modalità shadow sono contesti di valutazione ragionevoli. L’obiettivo non è dimostrare che il routing sembri brillante, ma confrontare costi per attività accettata e latenza con quelli di un modello fisso sugli stessi prompt.

Meglio aspettare se una richiesta rivolta ai clienti non può tollerare un’ulteriore dipendenza fail-closed, se il team finanziario richiede una regola di fatturazione formalizzata prima di attivare un percorso variabile o se i prompt contengono dati regolamentati non ancora sottoposti a verifica della privacy. Il supporto alla zero data retention è utile, ma non sostituisce l’approvazione interna del flusso dei dati.

Il cambiamento è in gran parte irrilevante se un unico modello fisso raggiunge già gli obiettivi di qualità e latenza, se il carico di lavoro consiste in una decisione tipizzata e circoscritta più adatta a Jev 1.13 oppure se Claude Code e Codex vengono instradati intenzionalmente tramite il progetto locale fai da te. Un router gestito non è automaticamente migliore di una chiamata diretta stabile.

Se il controllo deterministico del provider conta più della selezione adattiva, è meglio confrontare le alternative a OpenRouter per il routing multi-modello prima di spostare il percorso critico.

Perché la promessa «Jev Router gratis» è sopravvalutata

L’esagerazione più evidente consiste nel sostenere che una scheda modello da $0 renda gratuito l’intero ecosistema di modelli. OpenRouter non ha pubblicato dettagli di fatturazione specifici per Jev sufficienti a sostenere questa tesi, mentre il catalogo machine-readable pubblico non mostra un percorso fisso convenzionale.

L’esagerazione opposta è dare per certo che esista un sovrapprezzo nascosto del router. Nel corso di questa analisi non è stato né documentato né osservato alcun sovrapprezzo. Inserirne uno nelle previsioni sarebbe un’invenzione.

Anche i benchmark vanno ridimensionati. L’aumento dell’82% nelle attività dichiarato da OpenRouter è un confronto del fornitore con il proprio Auto Router. Il report DeepSWE da $1,000 di Theo è il benchmark di un singolo professionista rispetto a una configurazione con modello fisso. Nessuno dei due risultati indica il costo per attività accettata del proprio agente e nessuno sostituisce una breve riconciliazione a livello di account.

Infine, una finestra di contesto da 1,000,000 token non rende conveniente una conversazione da un milione di token. Sono il modello selezionato, il comportamento della cache, il livello di ragionamento e i cambi di attività a determinare l’efficienza di una sessione lunga. Il limite di contesto indica capacità, non budget.

Il controllo dei costi in quattro richieste da eseguire lunedì

Quattro piccole richieste sintetiche possono chiarire più di un’altra settimana trascorsa a interpretare la pagina dei prezzi. I tool vanno disattivati, i dati privati esclusi e gli output mantenuti brevi; il test va interrotto se il valore cumulativo di usage.cost si avvicina a $1.

  1. Inviare una richiesta di base su un solo turno

    Chiamare typesafe/jev-router con «Restituisci soltanto la parola READY». Aggiungere X-OpenRouter-Metadata: enabled. Salvare il JSON completo, in particolare id, model, usage e openrouter_metadata.

  2. Avviare una breve sessione di lavoro

    Chiedere: «Spiega in una frase perché una chiave di idempotenza evita addebiti duplicati». Salvare gli stessi campi. Si crea così un turno tecnico semplice, senza tool né dati esterni.

  3. Proseguire con l’intera cronologia

    Inviare di nuovo il messaggio precedente dell’utente e la risposta dell’assistente, poi aggiungere: «Fornisci un controesempio in una frase». Annotare se il modello selezionato resta lo stesso, se cambia il livello di ragionamento e se compare cached_tokens.

  4. Cambiare attività e riconciliare il conto

    Mantenere la cronologia della conversazione, quindi chiedere una funzione shell di quattro righe che controlli se un URL restituisce HTTP 200. Sommare i quattro valori di usage.cost. Recuperare ogni generazione tramite ID e confrontare modello selezionato, conteggi dei token, token di ragionamento, campi della cache e total_cost con Logs o Activity.

Per la prima richiesta si può usare esattamente questa struttura:

Bash
curl https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -H "X-OpenRouter-Metadata: enabled" \
  -d '{
    "model": "typesafe/jev-router",
    "messages": [
      {"role": "user", "content": "Return only the word READY."}
    ]
  }' | tee jev-router-response.json

Successivamente, recuperare i metadati della generazione corrispondente usando l’ID della risposta:

Bash
GENERATION_ID=$(jq -r '.id' jev-router-response.json)
curl --get https://openrouter.ai/api/v1/generation \
  --data-urlencode "id=$GENERATION_ID" \
  -H "Authorization: Bearer $OPENROUTER_API_KEY"

La regola decisionale è meccanica:

  • Se tutte e quattro le risposte mostrano usage.cost: 0, tutti e quattro i record di generazione indicano un costo totale pari a zero e la vista Activity della stessa chiave non registra nuove spese, allora è stata osservata una sessione sintetica a costo zero per quell’account e in quella data.
  • Se uno dei record è diverso da zero, usare il modello selezionato e il relativo dettaglio dei costi. Per quella richiesta, l’endpoint non è gratuito end-to-end, indipendentemente dal badge del catalogo.
  • Se risposta, generazione e Activity non coincidono, non estrapolare. Salvare gli ID e chiedere al supporto OpenRouter quale record determina la fatturazione.

Non aggiungere tool finché il test di base non è stato riconciliato. Quando ricerca, recupero di pagine o elaborazione di file entrano nell’agente, ripetere una richiesta controllata e trattare le rispettive voci della generazione come costi separati. Non dedurli dalla scheda modello di Jev Router.

L’azione da compiere lunedì è affiancare queste quattro richieste a quattro controlli con modello fisso, quindi confrontare costo della sessione, latenza, output accettati e tasso di errore. Jev Router va adottato soltanto se la decisione di routing migliora il risultato complessivo, non perché una riga del catalogo contiene due zeri.

Per ricevere il prossimo aggiornamento verificato sul routing dei modelli e il suo impatto sul budget, iscriviti alla newsletter.

Ultimo aggiornamento
26 set 2026
Categoria
Build

Preferisca questo sito su Google

Aggiungi omidsaffari.com come fonte preferita nella Ricerca Google

Segni omidsaffari.com come fonte preferita e Google lo mette in evidenza per lei in Top Stories, AI Overviews e AI Mode.

Server MCP Claude e plugin: come pubblicarli nella directory

Server MCP Claude e plugin: come pubblicarli nella directory

Scopri come preparare, validare e pubblicare un plugin Claude e il relativo server MCP Claude nella directory, dal repository GitHub alla review finale.26 set 2026Build
Cloudflare MCP è gratis? Prezzi e limiti del portale

Cloudflare MCP è gratis? Prezzi e limiti del portale

Scopri quando Cloudflare MCP Portals è gratis, quanto costano gli utenti attivi e quali spese per modelli, SaaS e server restano escluse dal piano.26 set 2026Build
Prestazioni GPU: mettere alla prova Agentic CUDA Optimizer

Prestazioni GPU: mettere alla prova Agentic CUDA Optimizer

Scopri come testare Agentic CUDA Optimizer in sette tentativi, verificare ogni kernel e capire se il guadagno sulle prestazioni GPU ripaga davvero.25 set 2026Build
Runpod pricing 2026: quanto costano Pod e Serverless

Runpod pricing 2026: quanto costano Pod e Serverless

Runpod pricing spiegato con costi di Pod, Serverless e storage, un calcolo H100 con data certa e la soglia di pareggio basata sul tempo fatturabile.25 set 2026Build
Vercel Sandbox Drives: workspace persistenti per agenti

Vercel Sandbox Drives: workspace persistenti per agenti

Scopri come usare Vercel Sandbox Drives per conservare workspace, cache e file tra sandbox diverse, gestendo snapshot, regioni, limiti e costi.25 set 2026Build
Web crawler alternativi a Firecrawl: 7 opzioni a confronto

Web crawler alternativi a Firecrawl: 7 opzioni a confronto

Confronto tra 7 web crawler alternativi a Firecrawl: prezzi, modelli operativi e costi per pagina accettata, con un piano pratico per migrare.25 set 2026Build
AI code review: 7 alternative a CodeRabbit a confronto

AI code review: 7 alternative a CodeRabbit a confronto

Confronto tra 7 alternative a CodeRabbit per AI code review: prezzi, host Git, privacy, self-hosting e costi reali per un team di cinque sviluppatori.25 set 2026Build
AI code review: Greptile o CodeRabbit, quale conviene?

AI code review: Greptile o CodeRabbit, quale conviene?

Confronto tra Greptile e CodeRabbit per AI code review: prezzi, limiti, piattaforme, crediti e costi reali per un team di cinque sviluppatori.25 set 2026Build
Newsletter

Una lettera, ogni domenica.Sistemi che funzionano, non hot take.

Settimanale. Niente spam. Si cancella quando vuole.