I migliori AI gateway con managed agent tools nel 2026
Confronto tra AWS AgentCore, Vercel, Portkey, TrueFoundry, Kong e Cloudflare su managed agent tools, prezzi reali e costi operativi eliminati.

Amazon Bedrock AgentCore Gateway è complessivamente il gateway più solido per i tool gestiti; Vercel AI Gateway è la via più rapida per dotare un agente di web search pronta per la produzione. A un milione di interazioni mensili dell'agente, il layer di gateway di AgentCore costa circa $40.02 prima dei costi di modello, web search e backend, mentre Vercel elimina l'account e la chiave Exa separati ma applica una tariffa di $7 ogni 1,000 ricerche dopo il 31 agosto 2026.
Quale gateway scegliere in base all'esigenza operativa?
Un AI gateway merita spazio nello stack di un agente quando rimuove una superficie di controllo, non quando aggiunge semplicemente un altro endpoint davanti a un modello. Per i managed tool, le domande decisive sono se il gateway possa trasformare i servizi esistenti in tool, custodire le credenziali, decidere chi può invocarli, aiutare l'agente a trovare lo strumento corretto e registrare ciò che accade.
Scegli Amazon Bedrock AgentCore Gateway quando gli agenti devono invocare API interne e sistemi SaaS all'interno di un unico perimetro di identità gestito. È in grado di convertire sorgenti OpenAPI, Smithy e Lambda in tool compatibili con MCP, per poi gestire sia l'autenticazione in entrata che quella in uscita.
Scegli Vercel AI Gateway quando il problema immediato è la ricerca web. La sua integrazione con Exa rimuove la necessità di un account separato, di una chiave dedicata e di una fatturazione distinta. Si tratta di una concreta semplificazione del flusso di lavoro, sebbene più limitata rispetto alla conversione di API interne aziendali in strumenti governati.
Scegli Portkey quando i server MCP esistono già e il livello mancante è costituito da autenticazione, approvazione e audit. Scegli TrueFoundry quando contano la sede di deployment, i server stdio ospitati, gli MCP virtuali o le guardrail pre e post chiamata. Scegli Kong se Konnect controlla già il parco API. Scegli Cloudflare se il team desidera le funzioni base del gateway a costo zero ed è a suo agio nell'assemblare i tool gestiti sulla piattaforma separata Agents.
Cosa significa disporre di managed agent tools e cosa no
Un model gateway instrada i prompt verso i modelli. Un gateway MCP controlla il modo in cui gli agenti individuano e invocano gli strumenti. Alcuni prodotti svolgono entrambi i ruoli, ma le due fatture e le relative modalità di errore restano distinte.
Questa distinzione è cruciale: una chiamata al modello legge informazioni e genera una risposta, mentre una chiamata a un tool può modificare lo stato di un sistema. Un agente di supporto può utilizzare un modello per interpretare una richiesta e poi impiegare i tool per consultare un account, emettere un rimborso e aggiornare un ticket. Il gateway del modello può governare il primo passaggio senza avere alcuna visibilità sull'autorizzazione del secondo.
Un gateway per managed tool credibile assolve a diversi compiti:
- Provisioning: rende disponibile un'API, una funzione o un server MCP remoto senza costringere ogni team applicativo a ricreare la connessione.
- Identity: verifica l'agente o l'utente chiamante, quindi fornisce la credenziale approvata al tool a monte.
- Policy: stabilisce quale tool e quale azione il chiamante possa usare, eventualmente prevedendo un passaggio di approvazione umana.
- Discovery: aiuta il modello a individuare lo strumento pertinente senza caricare l'intero schema dei tool nel prompt.
- Audit: registra quale identità ha invocato un determinato strumento, con quali parametri e quale esito.
Gestito non significa necessariamente con esecuzione hosted. Portkey può fare da proxy e governare un server MCP remoto mentre un'altra piattaforma ne gestisce l'esecuzione. Cloudflare Agents può ospitare un agente e fornire managed tools, mentre Cloudflare AI Gateway rimane la superficie di controllo del modello. Vercel può effettuare il provisioning di Exa Search nativamente, ma questa singola integrazione non gli conferisce il layer di trasformazione da OpenAPI a MCP offerto da AgentCore.
La conseguenza pratica è una fattura separata per il piano dei tool. Essa comprende chiamate gateway, utilizzo di search o browser, hosting dei tool, gestione dei segreti, log, approvazioni e il supporto ingegneristico che interviene in caso di guasto. Un gateway per modelli a ricarico zero può lasciare invariata gran parte di questa spesa.
Questo spiega perché il percorso più economico per il modello e il flusso di lavoro più economico per l'agente non coincidono sempre. Il confronto dei costi dei model gateway è utile quando la scelta riguarda il routing dei token. I managed agent tools richiedono un foglio di calcolo a parte.
Come sono stati selezionati questi gateway
La valutazione poggia su quattro questioni d'acquisto. Primo: quanta parte del lavoro sui tool viene gestita dal prodotto (trasformazione, registro, credenziali, discovery, esecuzione o traffico A2A). Secondo: se l'accesso possa essere limitato per persona, agente, workspace o tool. Terzo: se l'acquirente possa calcolare il costo di produzione partendo dai prezzi pubblici correnti. Quarto: dove si colloca il limite del prodotto (un perimetro di deployment, una superficie separata, una soglia di richieste o un costo per il piano di controllo).
Pagine prezzi, documentazione tecnica, limiti di livello e annunci di lancio sono stati verificati in data 27 agosto 2026. Ogni sezione classificata include uno screenshot attuale del prodotto o della documentazione. I prodotti non sono stati testati con traffico di produzione reale durante questa analisi; pertanto, nessun dato su latenza, uptime, successo delle chiamate o supporto viene presentato come test sul campo.
Sei gateway hanno superato la selezione poiché ciascuno risponde a un'esigenza specifica. I prodotti che offrivano unicamente routing di modelli, che non consentivano una valutazione chiara sui tool gestiti o che celavano i costi dietro trattative di vendita sono stati esclusi. La trasparenza dei prezzi non ha garantito un piazzamento elevato, ma ha reso più agevole valutarne l'impatto operativo.
L'ordinamento premia la rimozione del carico ingegneristico e di sicurezza rispetto alla lunghezza dell'elenco delle funzionalità. Un'integrazione circoscritta può superare una vasta piattaforma se elimina l'ostacolo esatto che un piccolo team affronta oggi. Una piattaforma completa vince solo quando la sua superficie aggiuntiva sostituisce lavoro che l'acquirente dovrebbe gestire in autonomia.
1. Amazon Bedrock AgentCore Gateway: la scelta migliore per gli enterprise tool plane
Amazon Bedrock AgentCore Gateway rappresenta la migliore soluzione complessiva quando un agente deve interagire con un parco eterogeneo di API interne, funzioni AWS, strumenti SaaS, altri agenti e modelli tramite un unico punto di controllo gestito.

Il suo punto di forza risiede nella capacità di trasformazione. AgentCore Gateway può elaborare una definizione OpenAPI, un modello Smithy o una funzione AWS Lambda esponendoli come tool compatibili con MCP. Il team di piattaforma può collocare una preesistente API per la gestione dei congedi dietro il gateway, evitando che ogni team di sviluppo debba scrivere e manutenere un adapter MCP dedicato.
Il layer di gestione dell'identità è altrettanto rilevante. AgentCore gestisce l'autenticazione in entrata per il chiamante e quella in uscita per la risorsa di destinazione. Supporta flussi OAuth, refresh dei token e archiviazione sicura delle credenziali. L'agente riceve l'autorizzazione a invocare un tool senza dover possedere direttamente la credenziale di Salesforce, Slack o Jira che rende possibile l'azione. Sono disponibili integrazioni native con un clic per Salesforce, Slack, Jira, Asana e Zendesk.
Con la crescita del catalogo, la selezione semantica dei tool consente all'agente di individuare lo strumento adeguato senza dover includere l'intero schema descrittivo nel contesto. Ciò riduce il volume del prompt e rende gestibile un ampio catalogo di azioni interne. Il gateway può inoltre porsi a monte di servizi HTTP e traffico A2A, estendendo il perimetro di policy oltre lo standard MCP.
Il limite principale è la complessità operativa dell'ecosistema. AgentCore solleva dall'onere di gestire l'infrastruttura gateway, ma richiede familiarità con identità AWS, regioni, permessi di servizio, logging e sistemi a monte esposti. Un team privo di esperienza operativa su AWS potrebbe risparmiare codice di adattamento ma trovarsi ad affrontare la gestione del cloud. Il prodotto risulta ideale se AWS costituisce già un control plane approvato o se la gestione di identità e API giustifica tale transizione.
Ideale per: Imprese che convertono API e funzioni esistenti in tool per agenti governati
Caratteristica distintiva: Trasformazione OpenAPI, Smithy e Lambda con autenticazione inbound e outbound
Prezzi: $0.005 per 1,000 invocazioni API gateway, $0.025 per 1,000 chiamate Search API e $0.02 per 100 tool indicizzati al mese; nessun impegno iniziale o canone minimo
Prova gratuita: Basata sui consumi; i nuovi clienti AWS possono ottenere fino a $200 in crediti AWS Free Tier
- Converte tre formati enterprise comuni in tool compatibili con MCP
- Gestisce l'identità del chiamante e le credenziali verso i servizi a monte
- Offre selezione semantica per cataloghi di strumenti estesi
- Adotta un modello a consumo anziché un abbonamento fisso
- Introduce oneri di gestione e identità AWS per i team esterni a tale ecosistema
- Web Search rappresenta una voce separata a $7 per 1,000 query
- I costi di modelli, runtime, osservabilità, policy e servizi a monte restano esclusi dal calcolo del gateway
Una prima implementazione sensata con AgentCore gateway
L'approccio iniziale più prudente prevede una singola azione circoscritta, non l'intero catalogo API. Seleziona un workflow con un responsabile designato, un esito reversibile e un modello di permessi già verificato dal team di sicurezza.
Mappa una singola azione approvata
Seleziona un servizio OpenAPI o una funzione Lambda, come la consultazione del saldo ferie. Esponi unicamente l'operazione richiesta dal primo agente. Un perimetro iniziale ridotto rende trasparente la revisione delle autorizzazioni e degli errori.
Definisci entrambe le identità
Identifica il chiamante autorizzato ad accedere al gateway e la credenziale in uscita autorizzata a raggiungere la risorsa finale. Tratta questi due aspetti come decisioni separate. L'identità dell'agente non deve ridursi a una copia della credenziale del servizio a monte.
Indicizza le descrizioni, non l'intera infrastruttura
Assegna nomi e descrizioni chiari al gruppo ristretto di tool. Attiva la selezione semantica solo quando le descrizioni eliminano ogni ambiguità d'uso. Un livello di ricerca non può risolvere la presenza di due tool con finalità apparentemente identiche.
Monitora i costi su una frazione di traffico
Instrada una quota controllata del workflow, calcola le chiamate Search API e InvokeTool e separa i costi di modelli, ricerca web, runtime e backend. Estendi l'adozione solo quando il tasso di successo e i log di autorizzazione risultano conformi.
AgentCore diventa meno competitivo se il team gestisce già server MCP remoti e necessita soltanto di un proxy condiviso per autenticazione e audit. In questo scenario circoscritto, Portkey risulta più snello. La preferenza cambia anche se la ricerca web è l'unico strumento mancante e la rapidità di rilascio prevale sulla trasformazione di sistemi interni: in tal caso Vercel rappresenta il percorso più diretto.
2. Vercel AI Gateway: la scelta migliore per una managed search a zero configurazione
Vercel AI Gateway è la soluzione più rapida quando un agente necessita di ricerca web aggiornata e la barriera principale è rappresentata dalla configurazione di un ulteriore fornitore, con relative chiavi, integrazioni e fatturazione.

Exa Search è ora un tool integrato nativamente in AI Gateway. Funziona con qualsiasi modello supportato da AI Gateway e non richiede un account Exa separato né chiavi API. L'applicazione invoca gateway.tools.exaSearch() come strumento: il gateway inoltra la query a Exa, restituisce i risultati al modello e mantiene attivo il ciclo fino al termine della ricerca da parte dell'agente.
Questo semplifica notevolmente l'avvio operativo. Un team snello può integrare la ricerca con grounding senza aprire un nuovo canale di acquisto né gestire un ulteriore secret. Il vantaggio risiede nell'azzeramento dei tempi di configurazione, non in uno sconto tariffario permanente. Vercel tariffa Exa Search a $7 per 1,000 query, fatturandolo a prezzo di listino senza ricarichi. La ricerca è gratuita solo fino al 31 agosto 2026; un piano di produzione deve quindi considerare il costo successivo alla promozione.
Con 100,000 ricerche mensili, la spesa per Exa ammonta a $700. Vercel non applica costi di piattaforma o ricarichi sui token dei modelli, ma i controlli di governance opzionali prevedono voci di spesa aggiuntive. I Custom Reporting costano $0.075 per 1,000 scritture e $5 per 1,000 query di reportistica. Una allowlist di provider per l'intero team costa $0.10 per 1,000 richieste riuscite nei piani Pro ed Enterprise, mentre il filtro only per singola richiesta non comporta costi aggiuntivi. Anche la zero-data retention a livello di team costa $0.10 per 1,000 richieste sui piani Pro ed Enterprise, mentre la ZDR per singola richiesta è gratuita su tali piani.
Il limite è dato dalla portata funzionale. Vercel ha eliminato l'onere di configurazione per un utile strumento di ricerca, ma non costituisce un layer di trasformazione per parchi OpenAPI privati. Se l'obiettivo è "convertire le nostre API di welfare, fatturazione e magazzino in strumenti reperibili con OAuth in uscita", AgentCore o TrueFoundry rispondono meglio all'esigenza.
Ideale per: Team di prodotto che integrano ricerca gestita in applicazioni basate su AI SDK
Caratteristica distintiva: Exa Search senza account o chiave Exa dedicati
Prezzi: Il piano Free include $5 di credito mensile sui modelli idonei; Paid consuma crediti acquistati alle tariffe di listino dei provider senza ricarico sui token; Enterprise consente fatturazione su fattura e sconti sui volumi
Prova gratuita: Tier gratuito; l'acquisto di crediti interrompe il credito mensile gratuito di $5
- Rimuove account, chiave e fatturazione separati per Exa
- Funziona con qualsiasi modello disponibile tramite AI Gateway
- Nessun costo di piattaforma o ricarico sui token dei modelli
- Percorso rapido tra risposta del modello e ricerca documentata per piccoli team
- La promozione per l'uso gratuito di Exa scade il 31 agosto 2026
- La ricerca costa $7 per 1,000 query al termine della promozione
- Non sostituisce un layer generale di trasformazione da API interne a MCP
- Reporting e policy a livello di team possono generare voci di costo d'uso distinte
Il tier Free include $5 di credito mensile, un sottoinsieme di modelli abilitati, limiti inferiori per modello e non supporta il BYOK. Il piano Paid funziona a consumo tramite l'acquisto di crediti, sblocca il catalogo completo, permette limiti personalizzati e BYOK, senza vincoli contrattuali. L'acquisto di crediti interrompe l'erogazione del credito mensile gratuito. I team Enterprise possono richiedere la fatturazione tradizionale senza commissioni di pagamento e negoziare riduzioni di prezzo sui volumi di token.
Vercel si posiziona al secondo posto perché il suo nuovo managed tool è immediatamente operativo e riduce al minimo l'attrito iniziale, pur non coprendo l'intero spettro di gestione dei tool. È la scelta corretta se la ricerca web è l'elemento chiave per l'utilità dell'agente; non è invece adatta come unico gateway se l'agente deve apportare modifiche sicure a sistemi interni.
3. Portkey: la scelta migliore per l'autenticazione unificata su server MCP remoti
Portkey rappresenta la soluzione più indicata quando i server MCP sono già operativi e l'elemento mancante è un punto di accesso centralizzato per credenziali, permessi, autorizzazioni e audit.

Il Portkey MCP Gateway si interpone tra i client e i server MCP. Il client si autentica una sola volta verso Portkey. Il gateway verifica i permessi per il server e lo strumento richiesti, inietta la credenziale autorizzata verso il servizio a monte, inoltra la chiamata e registra richiesta e risposta. L'autenticazione verso i servizi upstream supporta token OAuth, chiavi API o header personalizzati, mentre i chiamanti possono usare chiavi API Portkey o token del proprio identity provider.
Questa architettura risolve il problema dei team di piattaforma che vogliono evitare di distribuire credenziali di GitHub, Slack o servizi interni a ogni singolo ambiente dell'agente. L'MCP Registry memorizza configurazione e parametri di autenticazione del server, consentendo l'assegnazione selettiva degli accessi ai singoli workspace. Filtri sui contenuti e flussi di approvazione costituiscono un ulteriore livello di controllo prima dell'esecuzione di azioni critiche.
Il perimetro operativo di Portkey è ben delineato: amministra l'accesso ai server MCP anziché fungere da runtime gestito per i singoli strumenti. Il server deve pertanto essere ospitato altrove, rimanere operativo ed esporre correttamente le azioni. Se l'esigenza aziendale è convertire un servizio OpenAPI o eseguire un server MCP da riga di comando, TrueFoundry o AgentCore eliminano una quantità maggiore di lavoro infrastrutturale.
Il prezzo di partenza è accessibile, ma parametrizzato sui log registrati. Il piano Developer è Free Forever e consente il transito del traffico oltre la soglia inclusa, ma i log eccedenti non vengono memorizzati. Questo rende il piano ideale per prototipi, ma inadatto per verificare chi abbia modificato un record cliente in produzione.
Ideale per: Team di piattaforma che centralizzano l'accesso a server MCP remoti preesistenti
Caratteristica distintiva: Singolo percorso di autenticazione client con injection di credenziali upstream e provisioning per workspace
Prezzi: Developer gratuito; Production a $49 al mese; Enterprise con quotazione personalizzata
Prova gratuita: Tier Developer Free Forever
- Centralizza autenticazione dei client, credenziali a monte, permessi e log delle richieste
- Supporta OAuth, chiavi API, header di identità personalizzati e provider ID esterni
- Include MCP Registry, filtri per i contenuti e flussi di approvazione
- Piano Production accessibile a partire da $49 al mese
- Richiede la gestione e l'hosting separato del server MCP remoto
- Il piano Developer memorizza solo 10,000 log al mese con retention di tre giorni
- Production non è consigliato da Portkey per requisiti stringenti di sicurezza su misura o data residency
Il piano Developer è Free Forever con 10,000 log registrati al mese, conservazione dei log per tre giorni e metriche per 30 giorni. Portkey ne sconsiglia esplicitamente l'impiego in contesti di produzione. Il piano Production costa $49 al mese per 100,000 log registrati, conservazione di 30 giorni, metriche per 90 giorni, RBAC, service account key, supporto di produzione e caching semplice e semantico. Ogni blocco aggiuntivo di 100,000 richieste costa $9. Per un milione di richieste registrate, la spesa ammonta a $130, costi dei modelli esclusi.
Enterprise adotta prezzi personalizzati partendo da volumi superiori a 10 milioni di log mensili registrati. Introduce retention su misura, SSO, budget e rate limit granulari, opzioni private cloud, deployment in VPC, esportazione su data lake, hook per guardrail custom e controlli di conformità avanzati.
Portkey si rivela la scelta ideale quando i server dei tool sono già remoti e stabili. Al contrario, se l'onere principale è rappresentato da hosting, trasformazione o deployment privato dei server, l'adozione del solo proxy lascerebbe irrisolte le complessità architetturali di fondo.
4. TrueFoundry: la scelta migliore per governance MCP privata e formati tool hosted
TrueFoundry è la soluzione di riferimento per chi necessita di un piano di controllo MCP gestito con possibilità di deployment su VPC o ambienti air-gapped.

La sua offerta MCP va oltre il semplice proxying remoto. TrueFoundry MCP Gateway supporta un registro verificato, flussi OAuth standard, server MCP virtuali, conversione da OpenAPI a MCP, server MCP stdio hosted e verifiche pre e post chiamata. Un server MCP virtuale può aggregare un sottoinsieme di strumenti provenienti da server diversi per esporli a un team o a un workflow specifico.
Questo approccio si adatta bene a contesti tecnologici eterogenei. Un'organizzazione può disporre di un server HR remoto, un servizio di billing basato su OpenAPI e un tool di analisi dati da riga di comando. TrueFoundry consente di governare tutti e tre i componenti senza vincolarli a un identico modello di hosting. Il piano Enterprise supporta installazioni complete su VPC e configurazioni air-gapped sia per il piano di controllo che per il gateway.
L'ostacolo principale è il passaggio economico dal prototipo iniziale al controllo enterprise. Il piano Developer è funzionale ma circoscritto. Pro ha un costo di $499 al mese. Pro Plus sale a $2,999 al mese, mentre Enterprise richiede una trattativa diretta. Il piano superiore non riduce il costo unitario per chiamata inclusa: Pro costa $0.499 per 1,000 chiamate incluse, mentre Pro Plus si attesta a circa $0.600 per 1,000. Il sovrapprezzo è motivato da controlli, utenti, server gestiti e scalabilità, non da uno sconto volume.
Ideale per: Team che integrano tool MCP remoti, OpenAPI e stdio hosted sotto una governance predisposta per ambienti privati
Caratteristica distintiva: MCP virtuali, conversione OpenAPI, stdio hosted e guardrail pre e post chiamata
Prezzi: Developer $0, Pro $499 al mese, Pro Plus $2,999 al mese, Enterprise con preventivo
Prova gratuita: Sette giorni, senza carta di credito
- Supporta server MCP remoti, virtuali, derivati da OpenAPI e stdio ospitati
- Offre opzioni di deployment su VPC e air-gapped per clienti Enterprise
- Applica controlli e guardrail prima e dopo l'invocazione degli strumenti
- Specifica chiaramente i limiti per server MCP e chiamate ai tool per ciascun tier
- Pro parte da $499 al mese superato il piano gratuito
- Pro Plus richiede $2,500 in più al mese senza abbassare il costo unitario per chiamata inclusa
- Le distribuzioni VPC e air-gapped sono riservate al piano Enterprise personalizzato
- I volumi extra su Pro Plus richiedono una trattativa commerciale
Developer costa $0 al mese per 50,000 richieste, tre utenti, fino a cinque server MCP registrati e 50,000 chiamate a tool al mese. Pro costa $499 al mese per 1 milione di richieste, 10 utenti, fino a 25 server MCP e 1 milione di chiamate a tool. Un pacchetto di overage per Pro aggiunge 2 milioni di richieste e cinque chiavi API per ulteriori $499 al mese.
Pro Plus costa $2,999 al mese per 1 milione di richieste, 25 utenti, fino a 50 server MCP e 5 milioni di chiamate a tool. Le richieste eccedenti richiedono un contatto commerciale. Enterprise prevede prezzi su misura, si rivolge a volumi superiori a 10 milioni di richieste mensili e offre limiti dedicati per utenti, server MCP e chiamate ai tool.
TrueFoundry supera Portkey quando la varietà dei formati dei tool e il perimetro di deployment rappresentano le sfide primarie. Portkey risulta vincente se i server sono già attivi e l'obiettivo è un proxy di autenticazione a costo più contenuto. AgentCore prevale quando l'architettura poggia nativamente su funzioni AWS, trasformazione di API e un'amministrazione unificata dell'identità.
5. Kong AI Gateway: la scelta migliore per team già strutturati su Konnect
Kong AI Gateway rappresenta la soluzione naturale quando Konnect governa già le API aziendali e l'esigenza successiva è estendere tale controllo al traffico generato da modelli, protocolli MCP e comunicazioni agent-to-agent.

Con Kong AI Gateway 3.14, Agent Gateway è diventato disponibile a livello generale per la produzione il 13 aprile 2026. L'architettura individua ora tre perimetri distinti: un LLM Gateway per il traffico verso i modelli, un MCP Gateway per l'accesso a dati e tool, e un Agent Gateway per le comunicazioni A2A. La release di Kong introduce identità e autenticazione per gli agenti, osservabilità integrata tra le diverse tipologie di traffico e analisi dei messaggi inter-agente.
Per chi già utilizza Konnect, questa configurazione consente un consolidamento efficace. Il team di piattaforma può estendere criteri di sicurezza e modelli operativi consolidati al nuovo traffico degli agenti, evitando l'acquisizione di gateway separati per ciascun protocollo. Il piano Plus consente proxy MCP illimitati e agenti A2A illimitati, con un tetto massimo di cinque modelli LLM distinti.
Per una nuova implementazione indipendente, il costo costituisce una barriera. Il piano di controllo Plus più accessibile è serverless a $25 al mese, a cui si aggiungono $100 al mese per ciascun modello LLM gestito tramite i plugin AI a pagamento. Cinque modelli associati a un piano di controllo serverless comportano una spesa di $525 al mese prima di considerare inferenza, richieste API aggiuntive, traffico di rete o componenti extra. L'opzione Hybrid porta il piano di controllo a $200 al mese. La versione Dedicated cloud richiede $500 al mese più $0.15 per GB.
Ideale per: Clienti Kong che estendono la governance delle API al traffico LLM, MCP e A2A
Caratteristica distintiva: Unico perimetro di governance per l'intero ciclo di elaborazione dati dell'IA
Prezzi: Prova di 30 giorni a $0; Plus fattura in base a gateway e modelli; Enterprise su preventivo con fatturazione annuale
Prova gratuita: 30 giorni, nessuna carta di credito richiesta
- Comprende chiamate ai modelli, accesso ai tool MCP e comunicazioni A2A
- Il piano Plus offre proxy MCP e agenti A2A illimitati
- Sfrutta un modello di gestione delle API già attivo e collaudato
- Parametri di spesa trasparenti per control plane, richieste, proxy di modelli e banda
- Un'installazione ex-novo con cinque modelli parte da $525 al mese sul control plane base
- Il piano Plus limita a cinque i modelli LLM instradabili
- La modalità Dedicated cloud aggiunge $0.15 per GB oltre al canone del control plane
- I prezzi Enterprise sono solo su preventivo con vincolo annuale
La prova gratuita di 30 giorni è a costo $0, non richiede carta di credito, azzera i limiti sui gateway e conserva le metriche analitiche per 30 giorni. Il piano Plus ammette fino a cinque gateway serverless, due ibridi e due cloud dedicati. Include 1 milione di richieste API al mese, applica una tariffa di $200 per ogni milione aggiuntivo e fissa un limite massimo di 10 milioni di richieste mensili.
Enterprise rimuove i vincoli sui gateway e sui proxy dei modelli, include i plugin AI Gateway a pagamento e l'AI Gateway Manager, con quotazione annuale personalizzata. Questa opzione è indicata per impegni infrastrutturali su larga scala, ma non consente di quantificare preventivamente la spesa tramite tariffari pubblici.
La scelta su Kong dipende dal valore dell'infrastruttura preesistente. Se Konnect è già operativo, finanziato e approvato dai team interni, Agent Gateway evita l'introduzione di un fornitore aggiuntivo. In assenza di tale contesto, il costo base di $525 per cinque modelli equivale ad acquistare una piattaforma API avanzata prima ancora di aver convalidato l'effettiva necessità dell'agente.
6. Cloudflare AI Gateway e Agents: il miglior stack edge a basso costo
Cloudflare AI Gateway rappresenta la migliore opzione a costi di piattaforma contenuti per i team disposti ad affiancare il gateway di modelli gratuito al runtime e agli strumenti della piattaforma separata Cloudflare Agents.

Le funzionalità core di Cloudflare AI Gateway — dashboard di analisi, caching, rate limiting e scansione DLP — sono gratuite su tutti i piani. L'inferenza dei provider viene trasferita senza alcun ricarico sui prezzi originali. La Unified Billing è opzionale e prevede una maggiorazione del 5% sui crediti acquistati: $2,000 di crediti comportano una commissione di fatturazione di $100.
I managed agent tools risiedono nell'ambiente contiguo di Cloudflare Agents, una piattaforma per agenti persistenti dotata di strumenti come Browser, Sandbox, AI Search, MCP, Payments e altre integrazioni standard. I modelli di base includono supporto per strumenti client-side e server-side, approvazione human-in-the-loop e pianificazione di attività differite. Il runtime può utilizzare modelli di OpenAI, Anthropic, Google Gemini e altri provider.
L'architettura è flessibile, ma non costituisce un'unica interfaccia unificata. AI Gateway controlla il flusso verso i modelli; Agents gestisce il ciclo di esecuzione ed espone gli strumenti. Workers e le utility impiegate mantengono soglie e consumi autonomi. L'acquirente che necessita di un unico pannello per convertire API interne, archiviare credenziali OAuth in uscita e approvare ogni singola esecuzione deve tenere presente che il gateway gratuito copre solo una parte di queste funzioni.
Ideale per: Team edge-native che cercano controlli gateway gratuiti integrati con un runtime per agenti gestito
Caratteristica distintiva: Funzionalità gateway core a costo zero, con Browser, Sandbox, AI Search, MCP e Payments disponibili su Cloudflare Agents
Prezzi: Core del gateway gratuito su tutti i piani; Workers Free e Workers Paid hanno soglie di log differenti; Unified Billing applica una commissione del 5%
Prova gratuita: Funzioni core gratuite con le soglie previste dal piano Workers Free
- Analisi di base, caching, limitazione delle richieste e DLP a costo $0
- Nessun margine aggiunto sul costo di inferenza dei provider
- La suite Agents fornisce diverse categorie di strumenti e un ambiente persistente
- Compatibile con i principali provider di modelli LLM
- Gateway e managed agent tools appartengono a interfacce e componenti distinti
- L'opzione Unified Billing addebita il 5% sui crediti acquistati
- I consumi di Workers, tool ed elaborazione restano esclusi dal core gratuito
- La soglia dei log gratuiti è condivisa tra tutti i gateway configurati
Workers Free consente di archiviare 100,000 log persistenti totali condivisi tra tutti i gateway. Workers Paid eleva la soglia a 10 milioni di log per gateway. Logpush è disponibile sul piano Workers Paid e include 10 milioni di richieste mensili, con un costo di $0.05 per ogni milione aggiuntivo. La valutazione delle guardrail sfrutta l'inferenza a token di Workers AI: di conseguenza, il gateway a costo zero non implica la gratuità di ogni operazione di verifica delle policy.
Cloudflare risulta vincente se il team sviluppa già all'interno dell'ecosistema Workers e vuole mantenere il routing dei modelli, gli agenti con stato, l'automazione browser, la ricerca e i protocolli MCP a ridosso dell'edge. Risulta meno indicata qualora la priorità aziendale sia disporre di un unico piano di controllo strutturato per l'audit dei tool, preferibile rispetto al semplice risparmio sui costi di gateway. AgentCore e TrueFoundry definiscono questo perimetro in modo più esplicito.
Come orientare la scelta tra i diversi prodotti
Scegli Amazon Bedrock AgentCore Gateway se l'agente deve interagire con sistemi interni e l'azienda richiede un servizio gestito per trasformare, autenticare, individuare ed eseguire tali strumenti. La soluzione è meno vantaggiosa se la maggior parte dei tool è già strutturata come server MCP autonomi e stabili.
Scegli Vercel AI Gateway se l'integrazione della ricerca web è l'unico blocco che separa il prototipo dal rilascio. La scelta cambia se l'agente deve eseguire scritture su sistemi aziendali, gestire strumenti privati eterogenei o amministrare connessioni OAuth in uscita su larga scala.
Scegli Portkey quando i server sono operativi e l'obiettivo è consentire l'autenticazione centralizzata dei client. È la scelta più logica per un team di piattaforma che necessita di registro, accesso per workspace, filtri di sicurezza, approvazioni e tracciamento senza voler adottare un runtime per agenti vincolante. Diventa meno idoneo se il team deve ancora implementare o ospitare i server stessi.
Scegli TrueFoundry se l'architettura impone deployment privati, esecuzione di server stdio, conversione OpenAPI, MCP virtuali o guardrail pre e post esecuzione. La preferenza va a Portkey se si cerca un proxy remoto a costi ridotti, o ad AgentCore se l'infrastruttura di riferimento è incentrata su AWS.
Scegli Kong AI Gateway se Konnect rappresenta già il control plane standard per le API. Le competenze interne, le policy configurate e le omologazioni di sicurezza già ottenute possono rendere il costo marginale dell'agente inferiore rispetto all'avvio da zero con listini pubblici. La soluzione è sconsigliata se si acquista Kong unicamente per un progetto pilota isolato.
Scegli Cloudflare AI Gateway and Agents se l'infrastruttura poggia su Workers e il team gestisce agilmente l'integrazione autonoma tra gateway, runtime e librerie di tool. Non è la scelta corretta se i requisiti di sicurezza o procurement esigono un'unica interfaccia e un solo responsabile architetturale per il traffico dei modelli e dei tool.

Esiste inoltre una valida opzione di non adozione di un nuovo gateway. Se un singolo fornitore copre già modelli, strumenti, identità, log e budget richiesti dal flusso di lavoro, inserire un ulteriore layer introduce potenziali punti di guasto senza alcun risparmio operativo. Prima di procedere, definisci con precisione quale account, credenziale, connettore, policy o onere di reperibilità verrà concretamente eliminato dal gateway.
I costi del piano dei tool: perché un gateway gratuito può costare di più
I prezzi del gateway e i costi di utilizzo dei singoli tool devono essere calcolati separatamente. Il caso della ricerca evidenzia chiaramente questo divario: sia AWS Web Search che Vercel Exa Search indicano una tariffa di $7 ogni 1,000 query.
Prendiamo come riferimento 100,000 interazioni mensili dell'agente, con una ricerca semantica dei tool, tre esecuzioni di strumenti, 100 tool a catalogo e una query di ricerca web per ogni interazione. L'incidenza del gateway con AgentCore ammonta a $4.02: $2.50 per le chiamate Search API, $1.50 per l'esecuzione dei tool e $0.02 per l'indicizzazione. Web Search aggiunge $700. Il costo totale visibile è di $704.02 al mese, esclusi modelli, runtime, policy, osservabilità, rete e servizi backend.
Con Vercel, il gateway per i token non prevede costi di piattaforma. Applicando 100,000 ricerche Exa dopo il 31 agosto, il costo di Exa aggiunge $700. La spesa visibile aggregata si attesta a $700, prima di conteggiare modelli, reportistica avanzata o policy opzionali a livello di team.

La differenza di $4.02 non deve guidare la decisione architetturale. L'esempio di AgentCore include l'individuazione semantica dei tool e tre chiamate a strumenti interni per ciascuna interazione; l'esempio di Vercel quantifica l'integrazione nativa della ricerca web. Il punto cardine non è il risparmio di quattro dollari: entrambi i modelli evidenziano un costo di $700 per i tool a fronte di tariffe gateway trascurabili o nulle.
La stessa analisi si riflette sugli altri prodotti esaminati:
- Portkey: Un milione di richieste registrate costa $130 con il piano Production, al netto dei consumi dei modelli e dell'hosting dei server MCP.
- TrueFoundry: Il piano Pro costa $499 per 1 milione di chiamate a tool al mese; Pro Plus costa $2,999 per 5 milioni. La fascia superiore non offre sconti sui volumi unitari.
- Kong: L'uso di cinque modelli con il control plane serverless più economico comporta una spesa di $525 prima di conteggiare inferenza e moduli addizionali.
- Cloudflare: Il core del gateway è gratuito, ma Unified Billing addebita $100 per ogni blocco di $2,000 in crediti acquistati, con costi per Workers e strumenti computati a parte.
Imposta sempre limiti di spesa rigidi presso i provider laddove supportati. Il budget configurato nel gateway blocca il traffico a livello di controllo, ma non deve essere considerato l'unico presidio per credenziali potenzialmente utilizzabili anche su altri canali.
Le situazioni da evitare
Evita Vercel se l'obiettivo primario è la trasformazione di API interne
L'integrazione di Exa in Vercel è efficace proprio per il suo perimetro mirato. Non bisogna presupporre che il gateway sia in grado di convertire un intero catalogo OpenAPI privato, archiviare credenziali OAuth esterne e governare ogni chiamata a sistemi interni. In presenza di tali requisiti, la scelta deve ricadere su AgentCore o TrueFoundry.
Evita Kong per progetti pilota circoscritti e isolati
Kong può rappresentare una soluzione aziendale ottimale ma risultare sovradimensionato per una prima sperimentazione. Cinque proxy di modelli sul piano di controllo Plus serverless comportano un costo base di $525 al mese esclusa l'inferenza. Se l'azienda non dispone già di un'infrastruttura Konnect, è opportuno iniziare validando il singolo flusso e le sue reali esigenze di governance prima di impegnarsi su una piattaforma complessa.
Evita Cloudflare se è indispensabile un unico piano di policy centralizzato
Cloudflare AI Gateway e Cloudflare Agents sono complementari, ma costituiscono ambienti operativi separati. Il gateway gratuito non deve far trascurare la verifica dell'architettura complessiva. Prima di definirlo un piano di controllo unificato, chiarisci quale componente sia effettivamente titolare di log dei modelli, esecuzione dei tool, processi di approvazione, gestione dei secret e gestione degli incidenti.
Evita Portkey se la proprietà e la manutenzione dei server MCP non sono assegnate
Un proxy governato non può sopperire alla mancata manutenzione di un server di tool. Se un endpoint MCP remoto non risponde, modifica i propri schemi o presenta vulnerabilità nei permessi, Portkey è in grado di tracciare la richiesta ma spetterà a un team interno ripristinarne il funzionamento. Se la criticità riguarda l'hosting o la trasformazione, orientati su prodotti che includono tali capacità.
Evita i piani a pagamento prima che una singola azione abbia dimostrato il suo valore
Un agente dotato di decine di strumenti può apparire performante nei test, ma si rivela complesso da autorizzare in produzione. Parti da un'unica operazione reversibile, affidata a un responsabile chiaro e con una condizione di arresto definita. Considera inoltre che istruzioni riutilizzabili e API di strumenti rispondono a logiche diverse: le skill per agenti e le API dei tool risolvono problemi di riutilizzo differenti. Non acquistare un gateway per mascherare un'imprecisione di fondo nella progettazione del sistema.
I passi operativi: stima i costi end-to-end di un singolo percorso
Seleziona un processo operativo già gestito da operatori umani, come la verifica dello stato di un ordine e l'aggiornamento del relativo ticket di supporto. Suddividi il percorso in passaggi elementari: richiesta utente, invocazione del modello, individuazione del tool, negoziazione delle credenziali, esecuzione dello strumento, ricezione del risultato, approvazione e registrazione di audit.
Assegna a ogni passaggio un responsabile tecnico e una voce di spesa mensile. Includi token per i modelli, richieste al gateway, chiamate a motori di ricerca o browser headless, hosting dei tool, conservazione dei log, verifiche di sicurezza e reperibilità per gli incidenti. Isola eventuali agevolazioni o promozioni temporanee in una colonna separata, per non basare l'architettura su assunzioni di costo provvisorie.
Esegui il flusso così delimitato per una settimana. Assicurati che l'azione iniziale sia del tutto reversibile. Fissa soglie massime di spesa presso il provider e nel gateway, definendo interruzioni automatiche in caso di errori di autorizzazione, malfunzionamenti del tool o output non conformi. Analizza i log operativi confrontandoti direttamente con il titolare del sistema modificato, non solo all'interno del team IA.
La sintesi operativa è lineare:
- Se prevale l'onere di connettori interni e gestione delle identità, valuta un prototipo con AgentCore o TrueFoundry.
- Se l'unico ostacolo al rilascio è l'integrazione della ricerca, adotta Vercel, preventivando $7 per 1,000 query a partire dal 31 agosto.
- Se la difficoltà principale risiede nella distribuzione e sicurezza delle credenziali, interponi Portkey a monte dei server MCP esistenti.
- Se l'omogeneità della piattaforma è il fattore guida, estendi Kong o Cloudflare solo nei contesti in cui tale infrastruttura ha già una proprietà definita.
- Se l'analisi non evidenzia una riduzione tangibile di costi o di carichi operativi, mantieni l'architettura attuale.
Il gateway migliore è quello che cancella una voce di bilancio o una mansione operativa, garantendo al contempo l'integrità dei permessi del sistema sottostante. Una funzionalità che non produce questo beneficio pratico non costituisce una motivazione sufficiente per una migrazione.
Domande frequenti
Cos'è un AI gateway?
Un AI gateway è un layer di controllo interposto tra un'applicazione e i provider di intelligenza artificiale. Può integrare funzioni di instradamento, tentativi automatici (retry), osservabilità, applicazione di policy e controllo dei costi. Alcuni gateway gestiscono oggi anche strumenti esterni e comunicazioni tra agenti, ma queste funzionalità vanno valutate indipendentemente dal semplice routing dei modelli.
Cos'è un MCP gateway?
Un gateway MCP governa le modalità con cui i client individuano e invocano strumenti e server basati su Model Context Protocol. Tra i suoi compiti figurano l'autenticazione dei chiamanti, l'iniezione delle credenziali verso i servizi a monte, i permessi d'accesso per singolo strumento, i flussi di approvazione, la registrazione dei log e, in alcuni casi, la trasformazione o l'hosting diretto dei tool.
Quali AI gateway offrono un piano gratuito?
Vercel include $5 di credito mensile nel tier Free; Portkey propone un piano Developer denominato Free Forever; TrueFoundry offre un tier Developer a $0 e una prova di sette giorni; Kong mette a disposizione 30 giorni di prova a $0; Cloudflare include il core del gateway gratuitamente su ogni piano. AgentCore Gateway adotta un modello a consumo puro, ma i nuovi clienti AWS possono beneficiare di crediti promozionali fino a $200. Restano comunque applicabili i costi per modelli, tool, runtime, log e moduli di policy addizionali.
Qual è il miglior gateway per LLM?
Per la gestione operativa dei managed agent tools, Amazon Bedrock AgentCore Gateway rappresenta la soluzione più completa. Vercel risulta preferibile per l'integrazione immediata della ricerca web; Portkey per la governance di server MCP esistenti; TrueFoundry per implementazioni MCP in ambienti privati; Kong per infrastrutture Konnect già avviate; Cloudflare per stack basati su architetture edge. Chi necessita esclusivamente di routing verso i modelli dovrebbe valutare tariffe dei token, caching, latenza e controlli specifici dei singoli provider in modo indipendente.
Scarica la checklist per l'audit dei workflow aziendali con IA
Trasforma l'idea di un agente in un flusso operativo strutturato con responsabili assegnati, budget dedicati, perimetri di autorizzazione verificati e condizioni d'arresto controllate. Iscriviti per scaricare gratuitamente la checklist.
3 set 2026







