Abonnement Claude Code : qui paie avec Vercel AI SDK ?
Vercel AI SDK peut imputer les agents à un abonnement Claude Code ou ChatGPT existant. Comprenez l’ordre des identifiants, les coûts et les limites.

Le 14 septembre 2026, Vercel a changé le compte auquel peut être imputé un agent de code intégré. AI SDK peut désormais exploiter un abonnement Claude Code ou un autre abonnement compatible déjà connecté sur la machine hôte : la prochaine exécution éligible n’entraîne alors aucun coût supplémentaire ($0), jusqu’à épuisement du quota du forfait. Le calcul du Sandbox reste facturé séparément.
Le payeur change, pas l’agent
AI SDK propose une couche capable d’exécuter des agents de code complets derrière une interface HarnessAgent unique. Vercel appelle chaque adaptateur un « harness », car il ne se contente pas d’encapsuler un appel au modèle : l’agent conserve ses propres outils, son comportement dans l’espace de travail, son état de session, ses autorisations et son mécanisme de compaction.
La nuance est importante. Cette nouveauté n’améliore pas les capacités de programmation de Claude Code, Codex, Cursor ou d’un autre agent. Elle offre à l’adaptateur un nouvel endroit où chercher les identifiants : la session d’un abonnement natif enregistrée sur la machine qui exécute l’application.
Auparavant, une exécution intégrée exigeait explicitement des identifiants du fournisseur ou d’AI Gateway. Désormais, un adaptateur éligible peut se rabattre sur l’abonnement déjà authentifié sur l’hôte. Cette détection ne nécessite ni modification du code de l’application ni nouveau réglage.
La note de version cite neuf adaptateurs : Claude Code, Cline, Codex, Cursor, fx, GitHub Copilot, Grok Build, OpenCode et Pi. Cela ne garantit pas pour autant la compatibilité de tous les comptes. L’agent sous-jacent doit prendre en charge la connexion par abonnement, et les règles de son propre forfait continuent de déterminer ce que cette connexion peut consommer.
Pour l’entreprise, la conséquence tient en une phrase : un même appel agent.generate() peut être imputé à trois budgets différents selon les identifiants présents dans son environnement.
L’ordre des identifiants détermine la facture
Trois modes d’authentification existent. Le mode par défaut est auto. Pour les adaptateurs directs comme Claude Code et Codex, l’ordre appliqué en pratique est le suivant :
C’est ici qu’une simple variable d’environnement peut déplacer la dépense sans bruit. En mode direct, une exécution Claude Code utilise ANTHROPIC_API_KEY ou ANTHROPIC_AUTH_TOKEN avant l’abonnement Claude. Une exécution Codex privilégie OPENAI_API_KEY ou CODEX_API_KEY avant les droits inclus dans ChatGPT.
Le mode auto ajoute un niveau au-dessus. S’il détecte un identifiant Gateway, celui-ci passe avant la clé du fournisseur comme avant l’abonnement.
Le chemin réseau et la source de facturation ne se confondent pas pour tous les adaptateurs. En modes direct et ai-gateway, fx continue d’envoyer les requêtes au modèle via AI Gateway. Il peut toutefois résoudre un abonnement natif compatible lorsqu’aucun identifiant d’environnement applicable n’est défini et que ai-gateway n’a pas été sélectionné. Avant d’appliquer ce tableau comme une carte universelle des flux, consultez la page de l’adaptateur concerné.

Cette séparation protège mieux les secrets que la copie d’un jeton OAuth brut dans une machine isolée. Vercel résout les identifiants sur l’hôte et y actualise OAuth. Lorsque le Sandbox accepte la transformation des requêtes, l’agent ne voit qu’une valeur de substitution ; l’hôte injecte l’identifiant réel uniquement dans la requête sortante correspondante.
Le secret reste ainsi hors du Sandbox. Pour autant, un abonnement personnel ne devient pas une capacité mutualisée pour l’entreprise.
Abonnement Claude Code et coût réel : le calcul
Le coût du modèle peut être transféré vers un quota. Celui du runtime, lui, ne bouge pas.
Quota de l’abonnement
Claude Code offre aujourd’hui l’exemple le plus lisible. Claude Pro coûte $20 avec un paiement mensuel, ou $200 pour un an. Claude Max coûte $100 ou $200 par mois pour un usage équivalent à 5x ou 20x celui de Pro. Si vous payez déjà l’un de ces forfaits, une exécution éligible avec authentification native n’ajoute aucun coût de modèle distinct jusqu’à épuisement du quota partagé.
Le mot partagé est essentiel. Anthropic indique actuellement que Claude Agent SDK, claude -p et les applications tierces fondées sur Agent SDK continuent de puiser dans les limites de l’abonnement. L’entreprise précise aussi que claude.ai, Claude Code et Claude Desktop sont décomptés de la même limite d’utilisation. L’adaptateur Claude Code de Vercel s’appuyant sur l’Agent SDK d’Anthropic, il faut donc considérer que le travail intégré entre en concurrence avec les autres usages Claude de l’abonné.
OpenAI suit la même logique budgétaire, avec des compteurs différents. ChatGPT Plus coûte $20 par mois, Codex est inclus dans les forfaits ChatGPT et les limites varient selon le forfait. Codex partage un quota agentique avec ChatGPT Work, ChatGPT for Excel et Workspace Agents lorsque ces produits sont disponibles. Les utilisateurs Plus et Pro éligibles peuvent acheter des crédits après avoir consommé leur quota inclus, mais il ne s’agit pas de crédits API.
Le chemin par abonnement n’offre donc pas une inférence gratuite. Il mobilise une capacité prépayée dont le plafond varie. Basculer des tâches en arrière-plan dans l’adaptateur peut réduire la facture API aujourd’hui, mais écourter la session interactive de l’utilisateur demain.
API directe du fournisseur
Lorsqu’une clé fournisseur est prioritaire, la consommation est facturée au compte correspondant. Au tarif API standard, Claude Sonnet 4.6 coûte actuellement $3 par million de tokens en entrée et $15 par million de tokens en sortie. GPT-5.6 Luna d’OpenAI coûte $0.20 par million de tokens en entrée, $0.02 par million de tokens d’entrée mis en cache et $1.20 par million de tokens en sortie.
Ces tarifs facilitent l’attribution des coûts sur le chemin API. Ils ne rendent pas pour autant la dépense d’un agent de code prévisible. La taille du dépôt, l’historique de la conversation, l’effort de raisonnement, les nouvelles tentatives et les boucles d’outils font tous varier le nombre de tokens. Mesurez les tâches terminées, pas les prompts.
AI Gateway
Lorsqu’un identifiant Gateway est prioritaire, la consommation apparaît dans AI Gateway. Vercel applique le tarif public du fournisseur en amont, sans marge sur les tokens ni frais de plateforme. Le paiement passe généralement par un crédit Gateway prépayé ; les clients Enterprise peuvent utiliser une facture Vercel consolidée.
Ce chemin centralise les dépenses de l’équipe. Il donne aussi accès aux budgets Gateway. Ces contrôles ne suivent pas une exécution qui contourne Gateway au profit d’un abonnement natif : il faut donc arbitrer consciemment entre économie marginale et contrôle centralisé des budgets.
Calcul du Sandbox
Chaque runtime d’agent AI SDK continue de fonctionner dans un Sandbox. Dans la région iad1 utilisée par défaut chez Vercel, le Sandbox coûte $0.128 par heure de CPU actif et $0.0212 par Go-heure provisionné. Le CPU se met en pause lorsque le processus attend le modèle ou des entrées-sorties réseau, mais la mémoire reste comptabilisée pendant toute la durée réelle d’exécution.
L’exemple de validation de code par IA fourni par Vercel s’exécute pendant cinq minutes avec deux vCPU et quatre Go de mémoire. À 100% d’utilisation CPU, il coûte environ $0.03. Si la totalité du crédit Pro de $20 était réservée à cette seule charge de travail, le calcul donnerait un plafond approximatif de 666 exécutions avant le début de la facturation du Sandbox. La capacité réelle sera différente : d’autres services Vercel peuvent consommer le crédit, les tâches n’utilisent pas toutes les mêmes ressources, et le transfert ou le stockage peuvent alourdir la note.
Voilà l’intégralité du budget :
- Chemin par abonnement : prix du forfait existant, quota partagé, plus le Sandbox.
- Chemin par fournisseur : tokens facturés par le fournisseur, plus le Sandbox.
- Chemin par Gateway : tokens au tarif public du fournisseur, imputés au solde Gateway ou à la facture, plus le Sandbox.
Quel chemin choisir selon le cas d’usage ?
Un fondateur solo qui automatise un dépôt interne
Un fondateur qui paie déjà Claude Pro ou ChatGPT Plus peut placer un outil de correction de tests ou de synthèse de dépôt à faible volume derrière HarnessAgent, choisir direct et laisser le forfait natif couvrir le travail de modèle éligible. L’intérêt, pendant le pilote, est d’éviter d’ouvrir un autre solde pour le modèle.
Gardez ce périmètre en interne et surveillez la page d’utilisation du fournisseur. L’abonnement finance aussi le travail du fondateur dans le terminal et dans l’application : une tâche en arrière-plan peut donc consommer la capacité dont il aura besoin plus tard dans la journée.
Un responsable technique d’agence qui standardise les tâches des opérateurs
Une agence peut confier à chaque opérateur identifié une tâche délimitée sur un dépôt et utiliser, sur l’hôte, l’abonnement éligible de cette personne. Le contrôle décisif n’est pas le choix de l’adaptateur : il consiste à vérifier, avant l’exécution, l’absence des variables API du fournisseur.
La finance obtient ainsi une règle claire : le quota du forfait d’abord pour les travaux internes bornés, puis l’API du fournisseur uniquement lorsqu’une clé a été montée volontairement. Cette approche évite aussi de partager la connexion d’une seule personne dans toute l’agence.
Une équipe de plateforme pour développeurs qui exécute une automatisation partagée
Une équipe plateforme a généralement intérêt à fixer les tâches partagées ou sans supervision sur ai-gateway. Elle renonce à la fenêtre où l’abonnement ramène le coût supplémentaire à $0, mais gagne un propriétaire unique pour la facturation, une réserve commune de crédits ou une facture unique, ainsi que des contrôles de dépense alignés sur le service plutôt que sur une personne.
L’ancien décryptage de l’adaptateur fx reste juste sur un point important : dans les deux modes de fx, les requêtes au modèle passent par AI Gateway. Ce qui a changé le 14 septembre, c’est le mécanisme de repli des identifiants. Les sections consacrées à la configuration et aux coûts doivent désormais tenir compte d’un abonnement natif compatible lorsqu’aucun identifiant prioritaire ne prend le dessus.
Un fondateur SaaS qui vend du travail agentique à ses clients
Pour une fonctionnalité de code destinée aux clients, l’abonnement d’un salarié ne doit pas servir de plan de capacité. Le trafic client est mutualisé, variable et doit continuer à fonctionner malgré les changements d’équipe. Utilisez AI Gateway ou un compte API fournisseur doté d’un propriétaire explicite, puis intégrez le Sandbox au calcul économique unitaire.
Le comparatif indépendant des agents de code utilisables avec des abonnements existants aide un développeur à choisir le client local ou open source à employer avec un forfait qu’il possède déjà. Cette nouveauté concerne l’intégration d’un runtime compatible dans une application AI SDK. La connexion peut être similaire ; le modèle d’exploitation ne l’est pas.
Exécuter une tâche Claude Code sur le quota du forfait
Ce parcours vise une tâche interne bien délimitée, exécutée sur un hôte où l’utilisateur identifié s’est déjà connecté à Claude Code. Il sélectionne volontairement direct avec le réglage documenté de l’adaptateur Claude Code, afin que le jeton OIDC de Vercel puisse authentifier le Sandbox sans faire passer le travail du modèle par Gateway.
Installer les packages documentés
Dans un projet Node existant, ajoutez le package principal de l’agent, l’adaptateur Claude Code et l’adaptateur Vercel Sandbox.
Bashpnpm add @ai-sdk/harness @ai-sdk/harness-claude-code @ai-sdk/sandbox-vercelSe connecter sur l’hôte
Lancez Claude Code sur ce même hôte, puis choisissez le compte Claude associé à l’abonnement éligible.
BashclaudeConservez
VERCEL_OIDC_TOKENpour le Sandbox. Inspectez l’environnement du processus et retirezANTHROPIC_API_KEYainsi queANTHROPIC_AUTH_TOKENde cette exécution si l’abonnement doit payer. Chacune de ces variables fournisseur est prioritaire sur la connexion native.Forcer le chemin direct
Enregistrez le fichier sous
agent.mjs. Le code utilise le sélecteurdirectdocumenté, le runtime Sandbox actuelnode24et le port exposé4000requis par le bridge.JavaScriptimport { HarnessAgent } from '@ai-sdk/harness/agent'; import { createClaudeCode } from '@ai-sdk/harness-claude-code'; import { createVercelSandbox } from '@ai-sdk/sandbox-vercel'; const agent = new HarnessAgent({ harness: createClaudeCode({ auth: 'direct' }), model: 'claude-sonnet-4-6', sandbox: createVercelSandbox({ runtime: 'node24', ports: [4000], }), }); const session = await agent.createSession(); let exitCode = 0; try { const result = await agent.generate({ session, prompt: 'Create a short TODO.md for this repository.', }); console.log(result.text); } catch (err) { exitCode = 1; console.error(err); } finally { await session.destroy(); process.exit(exitCode); }Vérifier les deux relevés
Exécutez une tâche sans risque. Vérifiez que la page d’utilisation du fournisseur enregistre une consommation du quota du forfait, sans nouvelle dépense API. Consultez ensuite Vercel Usage pour la ligne Sandbox.
Si AI Gateway enregistre la requête au modèle, un identifiant Gateway était prioritaire. Si le tableau de bord API du fournisseur affiche une dépense, c’est un identifiant fournisseur qui a gagné. Arrêtez le pilote et corrigez l’environnement avant de passer à l’échelle.
Les limites à ne pas masquer
La connexion native reste liée à l’hôte. Elle ne constitue pas un flux OAuth prêt à l’emploi pour chaque client de votre application et ne mutualise pas les quotas individuels à l’échelle d’une équipe.
La capacité des forfaits évolue elle aussi. OpenAI précise que les limites de Codex varient selon le forfait et la tâche. Anthropic indique que l’usage de Claude dépend du modèle, de la complexité de la tâche, du contexte et de l’effort. Aucun des deux fournisseurs n’attribue à ce chemin Vercel un nombre fixe de tâches en production.
Les packages d’agents AI SDK restent expérimentaux, et des changements incompatibles peuvent survenir entre deux versions. Ce risque est acceptable pour un pilote interne mesuré. Il justifie en revanche d’épingler les dépendances, de tester la sélection des identifiants et de prévoir un chemin Gateway ou fournisseur avant d’en faire une promesse client.
L’action à mener lundi
Choisissez une tâche sur un dépôt interne et un utilisateur éligible. Réglez l’adaptateur sur direct, recensez les variables fournisseur présentes sur cet hôte, exécutez une fois la tâche et consignez le tableau de facturation qui a évolué, le changement éventuel du quota d’abonnement, le coût du Sandbox et la réussite ou non de la tâche.
Agissez cette semaine si vous possédez déjà un forfait compatible et disposez d’un workflow interne bien borné. Attendez si l’agent sous-jacent ne sait pas se connecter par abonnement ou si le statut expérimental du package est incompatible avec votre politique de dépendances. Restez sur ai-gateway si les budgets centralisés et la responsabilité partagée en production priment sur l’économie marginale du modèle. Rien ne change pour vous si vous appelez des fournisseurs de modèles AI SDK ordinaires sans jamais utiliser HarnessAgent.
Pour recevoir d’autres analyses opérationnelles sur les outils d’IA qui transforment concrètement les budgets et les workflows, inscrivez-vous à la newsletter.
- Dernière mise à jour
- 15 sept. 2026
- Catégorie
- Explained







