Vercel AI Gateway: un budget di spesa per ogni utente

Imposta un budget per utente su Vercel AI Gateway, separa le chiavi di produzione condivise e scopri cosa accade quando il limite di spesa si esaurisce.

Sunday, September 6, 2026Omid Saffari
Tools
Vercel AI Gateway: un budget di spesa per ogni utente

Un coding agent fuori controllo non deve più condividere lo stesso interruttore finanziario di emergenza dell'app in produzione. Il 31 agosto 2026, Vercel AI Gateway ha introdotto i budget per utente: la spesa generata dalle chiavi API attribuite a un singolo membro può fermarsi, mentre una chiave di produzione attribuita al team continua a funzionare, purché quella chiave e il team abbiano ancora budget disponibile. Cambia il modo in cui il team governa la fattura, non il prezzo del modello.

La funzionalità dei budget utente di Vercel AI Gateway con i membri del team e i relativi limiti di spesa
Vercel AI Gateway

Il budget per utente di Vercel AI Gateway in una frase

Assegna alle chiavi degli agenti intestate a una persona un budget individuale e lascia al team la titolarità delle chiavi di produzione condivise.

Il meccanismo è tutto qui. Un budget utente somma la spesa di tutte le chiavi API di AI Gateway attribuite allo stesso membro. Quando il budget si esaurisce, le nuove richieste effettuate con quelle chiavi restituiscono un HTTP 402, mentre il traffico che non ricade nel budget di quell'utente può continuare.

Prima di questa novità, Vercel poteva imporre un tetto al team, a un progetto o a una singola chiave API. Il nuovo livello utente si affianca a questi controlli e risolve un problema diverso: uno sviluppatore può usare più chiavi con Codex, Claude Code, Cursor o un altro carico di lavoro non presidiato, ma chi gestisce i costi vuole comunque un unico limite per la spesa complessiva di quella persona sul gateway.

Quale spesa viene davvero attribuita a un utente

L'impostazione decisiva è Spend attribution, cioè l'etichetta di titolarità che Vercel associa a una chiave API per contabilizzarne la spesa rispetto ai budget.

Le nuove chiavi hanno per impostazione predefinita l'attribuzione User. Per compatibilità con le versioni precedenti, le chiavi meno recenti prive di attribuzione restano associate al Team. Anche una chiave creata via API senza metadata.spendAttribution viene conteggiata per il Team.

Si creano così quattro percorsi distinti per le richieste:

Percorso della richiestaBudget che possono bloccarlaSi applica il budget utente
Chiave API attribuita a un membroChiave API, utente, team
Chiave API attribuita al teamChiave API, teamNo
Deployment di progetto tramite OIDCProgetto, teamNo
Spesa tramite credenziali provider BYOKNessun budget di AI GatewayNo

La spesa non viene suddivisa tra questi budget: viene registrata contemporaneamente su ogni contatore applicabile. Una richiesta effettuata con una chiave attribuita a un membro deve rientrare sia nel budget della chiave sia in quello dell'utente e del team. Se anche uno solo si esaurisce, la richiesta si ferma.

Percorsi dei budget: una chiave personale attraversa i limiti utente e team, mentre una chiave di produzione condivisa evita il limite utente
Le chiavi personali passano dal limite utente. Una chiave di produzione attribuita al team, invece, no.

È qui che il traffico di produzione condiviso richiede una scelta esplicita. Se uno sviluppatore crea una nuova chiave per un'app destinata ai clienti, quella chiave viene attribuita per impostazione predefinita allo sviluppatore e il suo budget personale può quindi fermare l'app. Nella pagina AI Gateway API Keys, modifica la voce Spend attribution della chiave impostandola su Team: in questo modo si applicheranno soltanto il budget della chiave e quello del team.

Come cambia il calcolo della spesa

I limiti per utente trasformano un rischio condiviso in un budget assegnabile prima dell'arrivo della fattura.

Consideriamo un esempio dichiarato, non un prezzo Vercel. Un team di 8 persone dispone di un budget mensile complessivo di $1,000. A sette membri viene assegnato il budget predefinito di $50 al mese; un responsabile riceve invece un budget personalizzato di $150, perché il suo ruolo prevede attività più intensive con gli agenti.

Il tetto complessivo per le chiavi personali è:

7 × $50 + 1 × $150 = $500 per month

Quei $500 non si aggiungono al budget del team: ne fanno parte. Se le chiavi attribuite ai membri consumano per prime tutti i $500, gli stessi $500 vengono conteggiati anche rispetto al limite complessivo di $1,000. In questo esempio semplificato, prima di raggiungere il tetto del team restano $500 per il traffico di produzione attribuito al Team.

Non esiste però alcuna quota riservata. La produzione può spendere per prima e ogni richiesta deve comunque trovare capienza nel budget del team. Il vantaggio è più circoscritto: nessun singolo membro può superare il proprio budget con le chiavi a lui attribuite prima che tutti gli altri perdano l'accesso.

Il modello è diverso dal controllo nativo di OpenAI, nel quale un agente deve avere un progetto dedicato per ottenere un limite di progetto effettivamente applicato. L'approfondimento sui limiti rigidi di spesa dell'API OpenAI spiega quel modello di isolamento. Il livello utente di Vercel può invece coprire più chiavi attribuite a un membro senza creare un progetto per ogni persona.

La funzionalità non riduce il prezzo dei token. AI Gateway continua ad applicare i prezzi di listino dei provider, senza ricarichi sui token né commissioni di piattaforma. Il beneficio è contenere le perdite e rendere più chiara la responsabilità della spesa, non abbassare il costo dell'inferenza.

Quattro scenari in cui il workflow cambia davvero

Un responsabile dell'engineering di prodotto con più coding agent

Imposta un budget utente predefinito per il team, poi assegna un importo personalizzato a chi ha consumi maggiori. Uno sviluppatore può eseguire agenti diversi con chiavi separate, che confluiscono comunque in un unico limite personale.

Il vantaggio è porre un tetto ai loop notturni. Se un agente continua a riprovare un'attività fallita, le richieste di quello sviluppatore si fermano senza interrompere automaticamente un servizio di produzione attribuito al team.

Un'agenzia che deve proteggere il margine sui clienti

Assegna a ogni operatore una chiave attribuita al rispettivo membro e un budget predefinito. Aggiungi un budget personalizzato per chi segue una migrazione ad alto consumo di modelli o uno sprint breve per un cliente.

Il vantaggio è poter gestire un'eccezione nominativa. Si può autorizzare una spesa maggiore per una persona senza aumentare il budget di tutti i colleghi né trasformare il budget dell'intera agenzia nell'unico interruttore di emergenza.

Un responsabile di piattaforma che separa persone e produzione

Verifica ogni chiave di AI Gateway e contrassegna come Team quelle usate dai servizi condivisi. Le chiavi personali dei coding agent restano invece attribuite a chi le ha create.

Il vantaggio è l'isolamento dei guasti. L'esaurimento del budget personale blocca il traffico degli agenti di quell'utente, mentre il carico destinato ai clienti continua a funzionare finché non si esaurisce il budget della propria chiave o quello del team.

Un responsabile finance o operations che governa la policy

Un Owner può assegnare il permesso AI Gateway Budget Manager senza concedere l'intero ruolo Owner. Chi riceve il permesso può gestire budget utente, valori predefiniti e attribuzione delle chiavi; tutte le persone del team, a eccezione di chi ha il ruolo Contributor, possono consultare le pagine dei budget.

Il vantaggio è attribuire la gestione operativa a una figura precisa. Finance può definire il perimetro, engineering può consultarlo e una modifica al budget non deve attendere l'unica persona titolare dell'intero team Vercel.

Come configurare i limiti senza legare la produzione a una persona

Per usare i budget utente, Vercel richiede la CLI 59.6.2 o una versione successiva. I comandi riportati di seguito sono stati verificati con la versione 59.6.2 durante questa analisi.

  1. Aggiorna e verifica la CLI

    Esegui l'aggiornamento documentato, quindi controlla che la versione installata sia almeno la 59.6.2.

    Bash
    vercel upgrade
    vercel --version
  2. Imposta il budget predefinito

    In questo esempio, ogni membro senza un budget utente personalizzato riceve un proprio budget mensile di $50. Non si tratta di $50 condivisi dal gruppo.

    Bash
    vercel ai-gateway budgets defaults set user --limit 50 --refresh-period monthly
  3. Assegna un limite personalizzato all'utente ad alto consumo

    Un budget personalizzato sostituisce quello predefinito per la persona interessata. Vercel accetta un indirizzo email, un nome utente o un ID utente.

    Bash
    vercel ai-gateway budgets set user lead@example.com --limit 150 --refresh-period monthly
    vercel ai-gateway budgets list
  4. Sposta le chiavi condivise sul team

    Apri AI Gateway, vai su API Keys, modifica ogni chiave usata per un carico condiviso o destinato ai clienti e imposta Spend attribution su Team. Le nuove chiavi vengono attribuite per impostazione predefinita a User: inserisci quindi questo controllo nella procedura di creazione delle chiavi di produzione.

  5. Configura gli avvisi quando serve l'intervento di una persona

    I budget personalizzati possono inviare email al raggiungimento del 50%, 75% e 100% del limite. Gli avvisi sono disattivati per impostazione predefinita e i budget predefiniti non inviano notifiche: se una persona deve ricevere un avviso prima del blocco, occorre quindi configurare un budget personalizzato.

I budget mensili si azzerano il primo giorno del mese a mezzanotte UTC. Quelli giornalieri si azzerano a mezzanotte UTC, quelli settimanali il lunedì a mezzanotte UTC, mentre none crea un limite cumulativo che non si azzera mai.

Come verificare blocco e ripristino in staging

Per questo articolo non è stato modificato alcun budget di un team Vercel reale, perché durante l'analisi non erano disponibili un team e una chiave sacrificabili. Il test sicuro va quindi eseguito in staging. Il comportamento 402 e i tempi di propagazione riportati di seguito sono quelli dichiarati da Vercel, non un benchmark a livello di account ottenuto durante questa analisi.

Usa un membro dedicato allo staging e una chiave attribuita a quel membro. Non eseguire questa prova con una chiave di produzione.

  1. Parti da una spesa visibile

    Usa vercel ai-gateway budgets list per verificare la spesa del membro di staging nel periodo corrente. Se è già superiore al minimo documentato di $1, puoi innescare il superamento del limite senza generare un altro dollaro di traffico di prova.

  2. Riduci il limite dell'utente di staging

    Quando si modifica un budget, la spesa già accumulata nel periodo corrente non viene azzerata. Imposta il limite dell'utente di staging a $1, poi attendi la propagazione.

    Bash
    vercel ai-gateway budgets set user staging@example.com --limit 1 --refresh-period monthly
  3. Invia una richiesta con la chiave di quel membro

    Esporta come AI_GATEWAY_API_KEY la chiave di staging attribuita al membro, quindi usa il formato della richiesta HTTP grezza documentato da Vercel.

    Bash
    curl https://ai-gateway.vercel.sh/v1/chat/completions \
      -H "Authorization: Bearer $AI_GATEWAY_API_KEY" \
      -H "Content-Type: application/json" \
      -d '{
        "model": "openai/gpt-5.6-sol",
        "messages": [
          {
            "role": "user",
            "content": "Invent a new holiday and describe its traditions."
          }
        ]
      }'

    Quando il budget utente è attivo ed esaurito, la richiesta dovrebbe restituire un HTTP 402 con tipo di errore quota_for_entity_exceeded. Se il 402 riporta un tipo diverso, il problema potrebbe essere il saldo dei crediti del team anziché un budget.

  4. Alza il limite e riprova

    Porta il limite personalizzato al di sopra della spesa indicata da budgets list. Questo comando, nel formato documentato, usa $100.

    Bash
    vercel ai-gateway budgets set user staging@example.com --limit 100 --refresh-period monthly

    Le modifiche ai budget si propagano in genere in qualche decina di secondi, ma per una chiave attiva possono richiedere fino a circa cinque minuti. Attendi, quindi invia di nuovo la stessa richiesta. Dovrebbe riprendere a funzionare, a meno che non sia esaurito un altro budget applicabile alla chiave o al team.

  5. Ripristina la policy prevista

    Riporta l'utente di staging al limite personalizzato stabilito. Rimuovere il budget personalizzato non è sempre una via d'uscita, perché l'utente torna al valore predefinito quando questo esiste. Se anche quel budget è già esaurito, il traffico resta bloccato.

Due aspetti da non trascurare

Primo: la spesa BYOK resta fuori da ogni budget di AI Gateway. Se il gateway usa le credenziali del proprio provider, quella spesa viene contabilizzata separatamente e un limite utente non può contenerla. Inoltre, una richiesta BYOK non riuscita può passare alle credenziali di sistema Vercel e addebitare il saldo dei crediti AI Gateway del team.

Secondo: le stesse pagine Vercel al momento forniscono indicazioni discordanti sugli app token. L'annuncio del 31 agosto afferma che i limiti utente coprono le chiavi API attribuite e gli app token. La documentazione sui budget attuale sostiene invece che gli app token non hanno alcuna attribuzione a un membro e non rientrano mai in un budget utente.

Cosa fare lunedì

Conviene intervenire questa settimana se più membri del team eseguono coding agent o altri carichi non presidiati usando le proprie chiavi di AI Gateway. Si può attendere se il traffico usa soltanto token OIDC di progetto o credenziali provider BYOK, perché i budget utente non controllano questi percorsi. Per chi lavora da solo con una chiave e un budget di team, cambia ben poco.

Lunedì, classifica ogni chiave del gateway come PERSON o SHARED. Sposta prima le chiavi di produzione condivise sull'attribuzione Team. Poi imposta un unico budget utente mensile predefinito, aggiungi soltanto le eccezioni personalizzate che l'azienda sa motivare ed esegui in staging l'intero test 402: blocco, aumento del limite e ripristino. Il budget è pronto solo quando la produzione resta fuori dal limite di una singola persona e chi lo gestisce sa quale soglia ha bloccato la richiesta.

Per altri approfondimenti pratici sul controllo costi AI e sui workflow di produzione, iscriviti alla newsletter.

Ultimo aggiornamento

6 set 2026

CategoriaExplained

Preferisca questo sito su Google

Aggiungi omidsaffari.com come fonte preferita nella Ricerca Google

Segni omidsaffari.com come fonte preferita e Google lo mette in evidenza per lei in Top Stories, AI Overviews e AI Mode.

Newsletter

Una lettera, ogni domenica. Sistemi che funzionano, non hot take.

Build log, sistemi in produzione e note dal campo da un portafoglio di venture AI.

Settimanale. Niente spam. Si cancella quando vuole.