Claude Code Skills : comment réduire leur coût de contexte
Repérez les skills Claude Code qui gaspillent du contexte avec /skill-doctor, puis réduisez leur coût sans sacrifier les workflows dont vous dépendez.

Vous pouvez désormais repérer les Claude Code skills qui mobilisent du contexte sans jamais servir, puis éliminer ce coût sans sacrifier les consignes dont vos workflows opérationnels ont besoin. Avec le nouveau rapport /skill-doctor, le nettoyage des skills n'est plus une affaire d'intuition : il devient une pratique mesurable et réversible.
La méthode tient en quelques mots : lancez /skill-doctor, classez chaque skill inutilisé selon les conséquences qu'aurait sa disparition, appliquez le réglage de visibilité le moins radical, puis testez le résultat dans une nouvelle session. Ne commencez pas par supprimer des dossiers. Un skill resté silencieux pendant une semaine peut très bien sécuriser votre prochain déploiement ou votre prochaine gestion d'incident.
Claude Code 2.1.261, publié le 4 septembre 2026, a introduit /skill-doctor pour révéler les skills chargés mais inutilisés, ainsi que le contexte consommé par chacun. C'est important, car chaque skill répertorié ajoute son nom et, le plus souvent, sa description à chaque tour, même lorsque Claude ne charge jamais l'intégralité de ses consignes.
Claude Code skills : ce que coûte réellement le contexte
Le contexte des skills engendre deux coûts distincts. Les confondre conduit à supprimer les mauvais éléments.
Le premier est le coût du catalogue. Avant même votre première saisie, Claude reçoit le nom et la description des skills disponibles afin de déterminer lequel correspond à votre demande. Par défaut, Anthropic limite ce catalogue à 1% de la fenêtre de contexte du modèle, tandis que l'ensemble formé par description et when_to_use est plafonné à 1,536 caractères par skill.
Le second est le coût d'invocation. Le contenu complet de SKILL.md n'est chargé que lorsque vous ou Claude invoquez le skill. Il reste ensuite présent dans la conversation au fil des tours. Après une compaction, Claude Code peut rattacher jusqu'à 5,000 tokens par skill invoqué, dans la limite d'un budget cumulé de 25,000 tokens pour l'ensemble des skills rattachés.
Imaginez le catalogue comme une vitrine et le corps du skill comme le stock amené au comptoir. Chaque enseigne occupe de la place dans la rue. Le stock en exige bien davantage, mais seulement lorsqu'un client le demande.

Cette distinction détermine le bon remède. Un skill inutilisé assorti d'une longue description impose un coût récurrent au catalogue. Un skill souvent invoqué mais doté d'un corps énorme alourdit durablement la session. /skill-doctor excelle sur le premier problème ; une architecture de skill bien conçue règle le second.
Le calcul économique se fait par tour, pas par installation
Un skill inactif n'est pas une dépense de configuration ponctuelle. Son texte de présentation est de nouveau transmis à mesure que la conversation avance. Cette estimation donne un bon ordre de grandeur :
Contexte évitable par jour = tokens de catalogue inutiles par tour × tours Claude par jour
Si, par exemple, le rapport signale 2,000 tokens de contexte de catalogue inutilisé et que votre travail génère 40 tours de modèle, 80,000 tokens d'entrée auront été présentés au cours de la journée. Il s'agit d'un exemple, pas d'un benchmark. La mise en cache des prompts peut réduire le tarif facturé pour les textes répétés, mais elle ne les fait pas disparaître du contexte.
Pour les utilisateurs de l'API et des fournisseurs cloud, ces tokens supplémentaires alourdissent la facture. Pour les abonnés, ils entament le quota du forfait et réduisent l'espace de travail disponible avant la compaction. Selon Anthropic, le coût moyen d'un déploiement Claude Code en entreprise s'élève à environ $13 par développeur et par jour actif, et $150 à $250 par développeur et par mois. Le gaspillage lié aux skills ne représente qu'une partie de cette dépense, mais c'est désormais l'une des rares que l'on peut isoler par nom.
Le budget touché ne se limite pas au coût du modèle : la productivité des développeurs est également en jeu. Un catalogue surchargé peut obliger Claude Code à retirer les descriptions des skills les moins utilisés. Cela libère de la place, mais réduit aussi les chances que Claude les sélectionne automatiquement.
La méthode pour alléger, retester et restaurer
Le workflow le plus sûr comporte sept étapes.
1. Partez d'une session de terminal à jour
Passez à Claude Code 2.1.261 ou à une version ultérieure, puis vérifiez la version installée avec claude --version. La documentation d'Anthropic indique que /skill-doctor nécessite au minimum la version 2.1.252, tandis que la version 2.1.261 est celle dont le changelog a annoncé la commande.
Exécutez /skill-doctor dans le terminal de la machine qui héberge la session. En mode interactif, le rapport s'ouvre dans l'onglet Stats du gestionnaire /plugin. En mode non interactif avec -p, il s'affiche sous forme de texte, ce qui permet de le conserver facilement pour un audit local. Remote Control ne peut pas renvoyer ce rapport.
2. Consignez l'état initial
Avant toute modification, enregistrez trois éléments : le coût total du catalogue de skills, les principaux contributeurs inutilisés, et les skills ou plugins que vous comptez modifier. Lancez aussi /context pour consulter la ligne Skills après application du budget, puis /doctor pour identifier les éléments qui pèsent le plus dans le catalogue.
Ne convertissez pas directement le nombre de tokens en dollars sans connaître le modèle utilisé, le comportement du cache et vos tarifs contractuels. Gardez les tokens comme unité stable et calculez séparément le coût financier.
3. Classez les candidats selon le coût d'un échec
Répartissez chaque candidat dans l'une de ces trois catégories :
C'est ici que le rapport doit être interprété avec discernement. « Jamais invoqué » mesure une fréquence, pas une valeur. Un extincteur peut ne jamais servir tout en restant indispensable.
4. Choisissez le réglage le moins destructeur
Pour les skills locaux, personnels, propres au projet ou synchronisés, le menu /skills peut inscrire un réglage skillOverrides réversible dans .claude/settings.local.json.
- Choisissez
name-onlylorsque Claude doit savoir que le skill existe sans avoir besoin de sa description complète dans le catalogue. - Choisissez
user-invocable-onlypour garder/skill-namedisponible tout en interdisant sa sélection automatique. - Réservez
offaux cas où ni vous ni Claude ne devez voir le skill. - Utilisez
onpour rétablir le comportement d'origine.
Si vous êtes l'auteur du skill, disable-model-invocation: true constitue la version portable, définie par l'auteur, d'une politique réservée à l'utilisateur. La description disparaît du catalogue de Claude, mais l'invocation directe reste possible.
Les skills de plugins obéissent à une autre logique : skillOverrides n'a aucun effet sur eux. Désactivez le plugin sans le désinstaller avec /plugin disable plugin-name@marketplace-name, puis réactivez-le avec /plugin enable plugin-name@marketplace-name. Un plugin peut aussi fournir des agents, des hooks, des serveurs MCP ou des outils de langage ; examinez donc ses composants avant de le couper.

5. Allégez le contenu sans réduire les capacités
Lorsqu'un skill utile possède un contenu volumineux, utilisez SKILL.md comme fiche d'aiguillage et déplacez les exemples détaillés, les références d'API et les cas limites dans des fichiers annexes. Anthropic recommande de limiter SKILL.md à moins de 500 lignes. Les fichiers annexes ne sont chargés que lorsque Claude en a besoin, et les scripts utilitaires peuvent s'exécuter sans que leur code source n'entre dans le prompt.
Placez en tête la mission, le déclencheur, les règles non négociables et la carte des fichiers annexes. Cette organisation protège aussi l'essentiel après la compaction, puisque seuls les 5,000 premiers tokens de chaque skill rattaché sont conservés.
6. Testez dans une nouvelle session
Modifier un skill ne retire pas les consignes déjà chargées dans la conversation en cours. Ouvrez une nouvelle session, lancez quelques prompts censés déclencher le skill, puis comparez les résultats avec ceux obtenus lorsque le skill est masqué. Mesurez d'abord la réussite de la tâche, ensuite les tokens.
Anthropic préconise des comparaisons dans des sessions neuves, car des éléments résiduels liés à la création du skill ou à son contexte peuvent masquer sa contribution réelle. Si les changements de plugins nécessitent /reload-plugins, attendez-vous à un coût en tokens sur la requête suivante, et éventuellement à la reconstruction du cache de prompts lorsque le plugin expose des outils MCP non différés.
7. Restaurez ce qui manque, puis relancez l'audit
Si la qualité baisse, revenez d'un cran : de off à user-invocable-only, du mode réservé à l'utilisateur à name-only, ou d'un plugin désactivé à un plugin actif. Si la qualité reste stable, conservez l'état allégé et relancez /skill-doctor après une période représentative de travail réel.
Cette dernière vérification compte. Le but n'est pas d'obtenir la plus petite liste de skills possible, mais la liste la moins coûteuse qui sache encore orienter correctement vos tâches récurrentes.
Qui a le plus à gagner ?
Voici les cas d'usage classés selon leur impact économique probable.
1. Les équipes plateforme qui gèrent une configuration Claude Code partagée
Un responsable plateforme entouré de dizaines de développeurs peut demander à un groupe pilote d'exporter ses rapports /skill-doctor locaux, repérer les skills présents partout mais jamais déclenchés, puis réserver les workflows facultatifs à l'utilisateur ou à certains projets. Le gain se cumule à chaque tour de chaque développeur, tandis que le fichier de restauration rend l'expérience réversible. Les skills administrés à l'échelle de l'entreprise étant exclus du rapport, cette méthode fournit un échantillon local du parc et non un audit exhaustif des politiques.
2. Les équipes d'ingénierie qui utilisent beaucoup de plugins
Une équipe peut installer un plugin le temps d'une migration, puis laisser ses skills, agents, hooks et outils MCP actifs pendant des mois. /skill-doctor fait ressortir les plugins récemment inutilisés, que le gestionnaire permet de désactiver sans les désinstaller. Le bénéfice dépasse la seule description du skill, puisqu'un plugin inutilisé peut ajouter plusieurs composants qui consomment du contexte. Le risque est tout aussi large : sa désactivation peut également retirer d'autres composants utiles.
3. Les consultants qui passent d'une stack client à l'autre
Un consultant peut conserver globalement des skills de frontend, de data, d'e-commerce et d'infrastructure alors qu'un seul groupe correspond au client du moment. Il peut créer des profils nommés dans les réglages locaux, n'exposer que le groupe pertinent et réserver les rares workflows de sécurité à l'invocation manuelle. Chaque mission commence ainsi avec un contexte propre, sans devoir reconstruire toute la boîte à outils chaque lundi.
4. Les responsables de grands monorepos
Claude Code peut découvrir des skills imbriqués à mesure qu'il parcourt des répertoires plus profonds ; ceux-ci restent ensuite disponibles jusqu'à la fin de la session. Après une tâche couvrant plusieurs packages, le responsable d'un monorepo peut lancer un audit, déplacer les consignes propres à un package dans le bon répertoire imbriqué et raccourcir les descriptions placées à la racine. Le routage y gagne : une tâche backend ne s'encombre plus d'un cortège de descriptions de workflows frontend.
5. Les équipes qui disposent de commandes rares mais critiques
Les skills de déploiement, de rollback, de migration de données et de gestion d'incident peuvent rester inutilisés pendant des semaines. Il serait imprudent de les supprimer uniquement parce que le rapport les classe comme inutilisés. Les passer en invocation manuelle retire leur description du catalogue récurrent de Claude tout en préservant l'accès exact via /skill-name. Le contexte des sessions ordinaires diminue, sans qu'il faille réécrire le runbook en pleine urgence.
6. Les auteurs de skills riches en documentation
Le rapport permet à l'auteur d'un skill d'en repérer un qui coûte cher, puis de répartir ses longs exemples et ses spécifications dans des fichiers annexes. Le fichier principal devient une carte de décision concise. Le coût du contexte est ainsi différé : les détails n'arrivent qu'au moment où la tâche atteint la branche qui en a besoin.
7. Les créateurs indépendants limités par leur abonnement
Un créateur indépendant ne constatera pas forcément une baisse directe de sa facture, puisque les offres Pro et Max incluent l'usage dans l'abonnement. Le véritable gain consiste à accomplir davantage de travail avec le même quota et à garder plus d'espace avant la compaction. Associez /skill-doctor à une configuration Claude Code propre, puis videz la session lorsque vous changez complètement de tâche.
Trois produits qui méritent d'être créés
Le marché lié à ces recherches est plus vaste que ne le laisse penser cette nouvelle requête. D'après DataForSEO, claude code skills génère 12,100 recherches mensuelles aux États-Unis, avec un CPC de $8.26. Les expressions précises sur la réduction du contexte des skills n'ont renvoyé aucune suggestion : c'est donc une opportunité éditoriale sur un sujet neuf au sein d'un marché des skills déjà établi, et non une catégorie autonome arrivée à maturité.
1. Skill Budget Guard, le pari le plus solide
Créez un CLI local-first et un contrôle CI capables de lire les skills d'un dépôt, les réglages de visibilité et un rapport /skill-doctor exporté, puis d'afficher la variation de contexte provoquée par chaque pull request. Les équipes plateforme paieront pour transformer le nettoyage effectué par un développeur en budget collectif reproductible.
Le signal de demande est particulièrement net : claude code skills totalise 12,100 recherches mensuelles, avec un CPC de $8.26, tandis qu'Anthropic évalue le coût moyen de Claude Code en entreprise entre $150 et $250 par développeur et par mois. La plus petite version commercialisable demande un parseur local, un fichier de budget versionné, une GitHub Action et des recommandations réversibles comme « passer en invocation manuelle » ou « scinder les références ».
Le risque de plateforme est réel. Anthropic peut enrichir /skill-doctor, et son Analytics API est déjà gratuite pour les organisations éligibles. La couche défendable repose sur l'historique des politiques, la comparaison entre dépôts et la preuve qu'une réduction de contexte n'a pas dégradé la réussite des tâches.
2. Project Skill Profile Switcher
Créez des profils nommés comme frontend, data, incident et release, capables d'appliquer des modifications de skillOverrides ainsi que l'activation ou la désactivation de plugins, puis de restaurer l'état précédent en une seule commande. Les consultants et les équipes qui gèrent des monorepos en sont les acheteurs naturels.
DataForSEO recense 590 recherches mensuelles pour best claude code skills, avec une intention commerciale et un CPC de $11.91. Le MVP doit inclure un manifeste, un aperçu des différences, la modification sécurisée des réglages locaux, les commandes de plugins et un point de restauration. Le principal écueil est la faible barrière à l'entrée : les menus de Claude Code donnent déjà accès aux réglages sous-jacents, et le rechargement des plugins peut entraîner un coût de cache pendant un tour.
3. Skill Outcome Lab
Créez un banc de test qui soumet le même prompt réaliste à de nouvelles sessions, d'abord avec le skill actif puis sans lui, et compare le taux de réussite, le temps et le nombre de tokens. Les auteurs de skills et les équipes internes chargées de leur adoption paieront pour démontrer qu'une consigne mérite le contexte qu'elle occupe.
DataForSEO recense 110 recherches mensuelles pour claude code skills best practices, avec une intention commerciale et des enchères en haut de page comprises entre $4.14 et $6.01. Un MVP utile exige des jeux de prompts, des contrôles du résultat attendu, une isolation dans des sessions neuves et un rapport avant-après simple.
L'objection est décisive : le plugin officiel skill-creator d'Anthropic compare déjà les exécutions avec et sans skill. Skill Outcome Lab devrait donc être une fonctionnalité de Skill Budget Guard, et non une entreprise à part entière.

Si votre équipe distribue des skills entre plusieurs produits ou agents, ce comparatif entre Notion Skills et Claude Skills API complète la réflexion sur le volet gouvernance.
Ce que /skill-doctor ne résout pas
/skill-doctor profile le gaspillage lié au catalogue de skills ; ce n'est pas un optimiseur complet des coûts de Claude Code.
- Il n'audite ni les skills intégrés ni ceux administrés par l'entreprise.
- Il ne retire pas le corps d'un skill déjà chargé dans la conversation en cours.
- Il ne mesure pas CLAUDE.md, l'ancien historique de conversation, le choix du modèle, les tokens de réflexion, les sorties d'outils trop détaillées ni la surcharge MCP.
- Il ne peut pas renvoyer de rapport d'usage via Remote Control.
- Il ne peut pas déterminer si un skill rarement utilisé a évité une erreur coûteuse.
- Il ne rend pas le contexte mis en cache gratuit. Le prix du cache et l'occupation du contexte sont deux sujets distincts.
Ne commencez pas par réduire skillListingBudgetFraction. Quand le catalogue dépasse son budget, Claude Code conserve les noms mais supprime les descriptions en commençant par les skills les moins utilisés. Le volume du catalogue peut diminuer, mais le bon skill risque alors de moins bien se déclencher. Masquez ou retirez délibérément les entrées de faible valeur.
Autre mauvais réflexe : désinstaller les plugins au premier regard. Désactivez-les d'abord, testez, puis ne les désinstallez qu'une fois certain que leurs autres composants ne servent plus.
Ce que vous pouvez faire lundi
Choisissez un vrai dépôt et un développeur qui utilise beaucoup Claude Code. Lancez /skill-doctor, notez les cinq principaux contributeurs inutilisés et n'en modifiez que deux : réservez un workflow rare à l'invocation manuelle et désactivez un plugin réellement hors sujet. Ouvrez une nouvelle session, répétez trois tâches habituelles, puis restaurez tout élément qui modifie le résultat. Vous aurez ainsi, d'ici vendredi, une politique défendable de réduction du contexte plutôt qu'une configuration simplement plus propre qui aurait discrètement rendu l'agent moins performant.
Comment faire pour que Claude Code utilise moins de contexte ?
Lancez /skill-doctor pour repérer le coût des skills inutilisés dans le catalogue, utilisez /context pour obtenir la répartition globale, masquez les skills hors sujet, réservez les workflows rares à l'utilisateur, déplacez les longues références vers des fichiers annexes et lancez /clear entre deux tâches sans rapport.
Comment réduire le coût de Claude Code ?
Commencez par réduire le contexte récurrent, puis examinez le choix du modèle, les longues sessions, les réglages de réflexion, les sorties d'outils trop détaillées et les serveurs MCP inutilisés. /skill-doctor ne couvre que la part de la facture liée aux skills.
Les skills Claude Code sont-ils gratuits ?
La documentation d'Anthropic sur les skills n'indique aucun frais distinct pour un fichier SKILL.md local. En revanche, son nom et sa description peuvent consommer du contexte à chaque tour, tandis que son corps complet en consomme après invocation. Les utilisateurs de l'API paient selon le nombre de tokens ; les abonnés puisent dans leur quota inclus.
Comment compacter le contexte de Claude Code ?
Utilisez /compact lorsque vous devez préserver la continuité d'une tâche longue et /clear lorsque vous passez à un sujet sans rapport. Les corps des skills invoqués peuvent être rattachés après la compaction, dans la limite de 5,000 tokens par skill et de 25,000 tokens au total.
Faut-il effacer le contexte dans Claude Code ?
Oui, lorsque vous passez à une tâche sans rapport. Pour tester l'allègement des skills, il est important d'ouvrir une nouvelle session : le corps d'un skill déjà chargé dans l'ancienne conversation peut masquer l'effet de sa désactivation.
Si vous souhaitez mettre en place un workflow mesuré de gouvernance des skills pour votre équipe d'ingénierie, découvrez les systèmes d'IA en production.
5 sept. 2026







