Cómo reducir el costo de contexto de las skills de Claude Code

Descubre cuánto contexto consumen las skills de Claude Code, cómo detectar las que no se usan con /skill-doctor y reducir costos sin perder funciones.

Saturday, September 5, 2026Omid Saffari
Tools
Cómo reducir el costo de contexto de las skills de Claude Code

Ahora puedes identificar qué skills de Claude Code consumen contexto sin aportar trabajo útil y recortar ese gasto sin perder las instrucciones que tus flujos reales todavía necesitan. El nuevo informe /skill-doctor convierte la limpieza de las skills de Claude Code en una práctica operativa medible y reversible, en lugar de dejarla al azar.

La respuesta corta es esta: ejecuta /skill-doctor, clasifica cada skill sin uso según el impacto que tendría perderla, aplica el cambio de visibilidad menos drástico y prueba el resultado en una sesión nueva. No empieces borrando carpetas. Que una skill lleve una semana inactiva no significa que haya dejado de ser la pieza que protege un despliegue o una respuesta ante incidentes.

Claude Code 2.1.261, publicado el 4 de septiembre de 2026, incorporó /skill-doctor para mostrar qué skills cargadas no se utilizan y cuánto contexto cuesta cada una. Es importante porque todas las skills enumeradas aportan un nombre y, por lo general, una descripción en cada turno, incluso cuando Claude nunca llega a invocar sus instrucciones completas.

Qué significa realmente el costo de contexto de las skills de Claude Code

El contexto de una skill tiene dos costos, y confundirlos lleva a recortes equivocados.

El primero es el costo de enumeración. Antes de que escribas nada, Claude recibe los nombres y las descripciones de las skills disponibles para decidir cuál corresponde a tu petición. De forma predeterminada, Anthropic limita esta lista al 1% de la ventana de contexto del modelo, y el texto combinado de description y when_to_use de cada skill tiene un límite predeterminado de 1,536 caracteres.

El segundo es el costo de invocación. El contenido completo de SKILL.md solo se carga cuando tú o Claude invocan esa skill. Una vez cargado, permanece en la conversación durante los turnos posteriores. Después de la compactación, Claude Code puede volver a adjuntar hasta 5,000 tokens de cada skill invocada, con un presupuesto conjunto de 25,000 tokens para las skills reincorporadas.

Imagina que la lista es el escaparate de una tienda y que el cuerpo de la skill es la mercancía que se lleva al mostrador. Cada letrero ocupa espacio en la calle. La mercancía exige mucho más, pero solo cuando alguien la pide.

Capas de contexto de las skills de Claude Code y sus límites predeterminados
Las descripciones de las skills aparecen en la lista de cada turno. El cuerpo completo llega al invocarlas, mientras que los archivos de apoyo pueden esperar hasta que hagan falta.

Esta diferencia determina la solución. Una skill que no se usa y tiene una descripción larga genera un costo de enumeración recurrente. Una skill que se invoca a menudo y tiene un cuerpo enorme produce un costo persistente durante la sesión. /skill-doctor resulta más eficaz para el primer problema; una buena arquitectura de skills resuelve el segundo.

El costo se calcula por turno, no por instalación

Una skill inactiva no es un gasto de configuración que se paga una sola vez. El texto de su ficha vuelve a presentarse a medida que avanza la conversación. Una estimación práctica es:

Contexto evitable al día = tokens de fichas sin uso por turno × turnos de Claude al día

Por ejemplo, si el informe detecta 2,000 tokens de contexto sin uso en la lista y tu trabajo genera 40 turnos del modelo, durante el día se presentan 80,000 tokens de entrada. Es un ejemplo, no un benchmark. El almacenamiento en caché del prompt puede reducir la tarifa facturada por el texto repetido, pero no hace desaparecer ese contexto.

Para quienes usan la API o un proveedor de nube, esos tokens adicionales elevan la factura. Para quienes tienen una suscripción, consumen capacidad del plan y dejan menos espacio de trabajo antes de la compactación. Anthropic señala que los despliegues empresariales de Claude Code cuestan en promedio alrededor de $13 por desarrollador y día activo, y entre $150 y $250 por desarrollador al mes. El desperdicio causado por las skills es solo una parte del gasto, pero ahora es una de las pocas que se pueden aislar por nombre.

El presupuesto afectado no es únicamente el del modelo. También está en juego la productividad de los desarrolladores. Cuando la lista está saturada, Claude Code puede descartar las descripciones de las skills menos utilizadas. Así ahorra espacio, pero también reduce la probabilidad de seleccionarlas automáticamente cuando sí hacen falta.

El flujo para recortar, volver a medir y restaurar

El proceso más seguro consta de siete pasos.

1. Empieza con una sesión de terminal actualizada

Actualiza Claude Code a la versión 2.1.261 o una posterior y comprueba la versión instalada con claude --version. Según la referencia de Anthropic, /skill-doctor requiere la versión 2.1.252 o una posterior; la versión 2.1.261 es la que anunció el comando en el registro de cambios.

Ejecuta /skill-doctor en la terminal del equipo donde se aloja la sesión. En una sesión interactiva, el informe se abre en la pestaña Stats del administrador /plugin. En modo no interactivo con -p, se imprime como texto, lo que permite guardarlo para una auditoría local. Remote Control no puede devolver el informe.

2. Registra el punto de partida

Antes de tocar nada, guarda tres datos: el costo total de la lista de skills, los mayores contribuyentes sin uso y las skills o los plugins que planeas modificar. Ejecuta también /context para consultar la fila Skills después de aplicar el presupuesto, y /doctor para detectar qué elementos pesan más en la lista.

No conviertas directamente el recuento de tokens en dinero salvo que conozcas el modelo, el comportamiento de la caché y las tarifas contratadas. Utiliza los tokens como unidad estable y calcula el costo monetario por separado.

3. Clasifica las candidatas por el costo de un fallo

Distribuye cada candidata en uno de estos tres grupos:

GrupoQué significaAcción predeterminada
Nunca es pertinenteProyecto equivocado, herramienta abandonada o skill duplicadaDesactivarla
Poco frecuente, pero importanteDespliegues, migraciones, seguridad o incidentesMantener la invocación manual
Útil, pero demasiado extensaActivador correcto, descripción o cuerpo sobredimensionadosComprimirla y separar los archivos de apoyo

Aquí es donde el informe necesita criterio. “Nunca invocada” mide frecuencia, no valor. Un extintor puede no haberse utilizado y aun así merecer un lugar.

4. Aplica el control menos drástico

En las skills locales, personales, de proyecto o sincronizadas, el menú /skills puede escribir un cambio reversible de skillOverrides en .claude/settings.local.json.

  • Usa name-only cuando Claude deba saber que la skill existe, pero no necesite ver su descripción completa en la lista.
  • Usa user-invocable-only cuando quieras conservar /skill-name, pero impedir siempre la selección automática.
  • Usa off solo cuando ni tú ni Claude deban verla.
  • Usa on para recuperar el comportamiento original.

Si la skill es tuya, disable-model-invocation: true es la versión portátil, a nivel de autor, de una política de invocación exclusiva por el usuario. Elimina la descripción de la lista de Claude, pero mantiene disponible la invocación directa.

Las skills de plugins funcionan de otra manera: skillOverrides no tiene efecto sobre ellas. Desactiva el plugin sin desinstalarlo mediante /plugin disable plugin-name@marketplace-name y restáuralo con /plugin enable plugin-name@marketplace-name. Recuerda que un plugin también puede aportar agentes, hooks, servidores MCP o herramientas de lenguaje; revisa sus componentes antes de desactivarlo.

Escala reversible de visibilidad para skills de Claude Code con una rama independiente para plugins
Avanza paso a paso: acorta la ficha, conserva el acceso manual o desactiva la skill. Los plugins tienen su propia ruta de desactivación y activación.

5. Reduce el cuerpo sin reducir la capacidad

Si una skill útil tiene un cuerpo grande, deja SKILL.md como ficha de navegación y traslada los ejemplos detallados, las referencias de API y los casos límite a archivos de apoyo. Anthropic recomienda mantener SKILL.md por debajo de 500 líneas. Los archivos de apoyo solo se cargan cuando Claude los necesita, y los scripts auxiliares pueden ejecutarse sin incorporar su código fuente al prompt.

Coloca al principio la tarea, el activador, las reglas innegociables y el mapa de archivos de apoyo. Así también proteges la parte importante tras la compactación, cuando solo se conservan los primeros 5,000 tokens de cada skill que se vuelve a adjuntar.

6. Haz la prueba en una sesión nueva

Modificar una skill no elimina las instrucciones ya cargadas en la conversación actual. Abre una sesión nueva, ejecuta algunos prompts que deberían activar la skill y compáralos con los mismos prompts mientras está oculta. Mide primero si la tarea se completa bien y después los tokens.

Anthropic recomienda comparar sesiones nuevas porque el contexto residual de creación o de uso de la skill puede ocultar su aporte real. Si los cambios en plugins requieren /reload-plugins, ten en cuenta que la siguiente petición tendrá un costo en tokens y quizá obligue a reconstruir la caché del prompt cuando el plugin exponga herramientas MCP no diferidas.

7. Restaura lo que falle y repite la auditoría

Si baja la calidad, retrocede un nivel: de off a user-invocable-only, de acceso exclusivo del usuario a name-only, o de plugin desactivado a activado. Si la calidad se mantiene, conserva el estado más ligero y vuelve a ejecutar /skill-doctor después de un periodo representativo de trabajo real.

Esa última comprobación es esencial. El objetivo no es tener la lista de skills más pequeña posible, sino la más económica que todavía dirija correctamente tus tareas recurrentes.

Quién obtiene más beneficio

Estos casos de uso están ordenados por su impacto económico probable.

1. Equipos de plataforma que mantienen una configuración compartida de Claude Code

Un responsable de plataforma con decenas de desarrolladores puede pedir a un grupo piloto que exporte sus informes locales de /skill-doctor, detectar skills que aparecen en todas partes pero nunca se activan y trasladar los flujos opcionales a una disponibilidad exclusiva del usuario o del proyecto. El ahorro se acumula en cada turno de cada desarrollador, mientras que el archivo de restauración mantiene reversible el experimento. Las skills administradas a nivel empresarial no aparecen en el informe, por lo que este método sirve como muestra local de la flota, no como auditoría completa de políticas.

2. Equipos de ingeniería con muchos plugins

Un equipo puede instalar un plugin para una migración puntual y dejar activados durante meses sus skills, agentes, hooks y herramientas MCP. /skill-doctor muestra los plugins que no se han utilizado recientemente, y el administrador de plugins permite desactivarlos sin desinstalarlos. El beneficio va más allá de la descripción de una skill, porque un plugin inactivo puede añadir varios componentes que ocupan contexto. La contrapartida también es amplia: desactivarlo puede retirar otros componentes útiles que no son skills.

3. Consultores que alternan entre stacks de distintos clientes

Un consultor puede cargar globalmente skills de frontend, datos, comercio electrónico e infraestructura aunque solo un grupo sea pertinente para el cliente actual. Puede mantener perfiles con nombre en la configuración local, mostrar el grupo adecuado y reservar los flujos de seguridad poco frecuentes para la invocación manual. El resultado es un contexto inicial limpio en cada proyecto, sin tener que reconstruir el conjunto de herramientas todos los lunes.

4. Responsables de monorepos grandes

Claude Code puede descubrir skills anidadas a medida que lee directorios más profundos, y esas skills siguen disponibles durante el resto de la sesión. Quien mantiene un monorepo puede auditar después de una tarea entre paquetes, mover las instrucciones específicas de cada paquete al directorio anidado correspondiente y acortar las descripciones del nivel raíz. El resultado es una selección más precisa: el trabajo de backend no arrastra un desfile de descripciones de flujos de frontend.

5. Equipos con comandos poco frecuentes y de alto riesgo

Las skills de despliegue, rollback, migración de datos y respuesta ante incidentes pueden pasar semanas sin activarse. No conviene borrarlas solo porque el informe las marque como inactivas. Configurarlas como manuales elimina sus descripciones de la lista recurrente de Claude, pero conserva el acceso directo exacto mediante /skill-name. Así se reduce el contexto de las sesiones normales sin tener que recrear el runbook durante una emergencia.

6. Autores de skills con instrucciones cargadas de referencias

Un autor puede utilizar el informe para encontrar una skill costosa y trasladar sus ejemplos extensos y especificaciones a archivos de apoyo. El archivo principal queda como un mapa de decisiones conciso. El beneficio es aplazar el costo de contexto: el detalle solo llega cuando el trabajo alcanza la rama que lo necesita.

7. Desarrolladores independientes con límite de suscripción

Quien trabaja por su cuenta quizá no vea una reducción directa en dinero, porque Pro y Max incluyen el uso en la suscripción. La ventaja práctica es completar más trabajo dentro del mismo cupo y disponer de más espacio antes de la compactación. Combina /skill-doctor con una configuración limpia de Claude Code y borra la sesión cuando cambies a un trabajo sin relación con el anterior.

Tres productos que vale la pena crear

El mercado de búsquedas es mayor de lo que sugiere la novedad de esta consulta. Según DataForSEO, claude code skills recibe 12,100 búsquedas mensuales en Estados Unidos y tiene un CPC de $8.26. Las frases específicas sobre cómo reducir el contexto de las skills no devolvieron sugerencias, así que estamos ante una oportunidad reciente dentro de un mercado de skills consolidado, no ante una categoría independiente y madura.

1. Skill Budget Guard, la apuesta más sólida

Crea una herramienta CLI y CI, local primero, que lea las skills del repositorio, la configuración de visibilidad y un informe exportado de /skill-doctor, y después muestre cuánto contexto añade o elimina cada pull request. Los equipos de plataforma pagarían por ella porque convierte la limpieza aislada de un desarrollador en un presupuesto repetible para todo el equipo.

La señal de demanda es especialmente clara: claude code skills registra 12,100 búsquedas mensuales, tiene un CPC de $8.26 y Anthropic informa de un costo empresarial promedio de Claude Code de entre $150 y $250 por desarrollador al mes. La versión mínima vendible necesita un parser local, un archivo de presupuesto dentro del repositorio, una GitHub Action y sugerencias reversibles como “pasar a invocación exclusiva del usuario” o “separar las referencias”.

El riesgo real es depender de la plataforma. Anthropic puede ampliar /skill-doctor, y su Analytics API ya es gratuita para las organizaciones que cumplen los requisitos. La ventaja defendible está en el historial de políticas, la comparación entre repositorios y la prueba de que reducir contexto no perjudicó el resultado de las tareas.

2. Project Skill Profile Switcher

Crea perfiles con nombre, como frontend, data, incident y release, que apliquen cambios en skillOverrides y en la activación o desactivación de plugins, y que después restauren el estado anterior con un solo comando. Los compradores serían consultores y equipos que trabajan con monorepos.

DataForSEO informa de 590 búsquedas mensuales para best claude code skills, con intención comercial y un CPC de $11.91. El MVP consiste en un manifiesto, una vista previa de los cambios, escrituras seguras en la configuración local, comandos para plugins y un punto de restauración. El problema es que la ventaja competitiva es limitada: los propios menús de Claude Code ya ofrecen los controles básicos, y recargar los plugins puede generar un costo de caché durante un turno.

3. Skill Outcome Lab

Crea un sistema de pruebas que envíe el mismo prompt realista a sesiones nuevas con una skill activada y desactivada, y que después compare la tasa de éxito, el tiempo y el uso de tokens. Los autores de skills y los equipos internos de capacitación pagarían por comprobar con datos que una instrucción justifica el contexto que consume.

DataForSEO registra 110 búsquedas mensuales para claude code skills best practices, con intención comercial y pujas en la parte superior de la página de entre $4.14 y $6.01. Un MVP útil necesita fixtures de prompts, comprobaciones de resultados esperados, aislamiento entre sesiones nuevas y un informe sencillo del antes y el después.

La limitación es determinante: el plugin oficial skill-creator de Anthropic ya compara ejecuciones con y sin una skill. Por eso debería ser una función de Skill Budget Guard y no una empresa independiente.

Tres oportunidades de producto en torno al costo de las skills de Claude Code, ordenadas por demanda de búsqueda
Skill Budget Guard ofrece la mejor combinación de demanda, valor recurrente para equipos y margen de mejora sobre el informe nativo de Anthropic.

Si tu equipo distribuye skills entre distintos productos o agentes, esta comparación entre Notion Skills y Claude Skills API incorpora la dimensión de gobernanza a la decisión.

Qué no resuelve /skill-doctor

/skill-doctor analiza el desperdicio causado por la lista de skills; no es un optimizador integral de costos de Claude Code.

  • No audita las skills integradas ni las empresariales.
  • No elimina el cuerpo de una skill que ya se haya cargado en la conversación actual.
  • No mide CLAUDE.md, el historial antiguo de la conversación, la elección del modelo, los tokens de razonamiento, la salida detallada de herramientas ni la sobrecarga de MCP.
  • No puede devolver informes de uso mediante Remote Control.
  • No puede determinar si una skill poco frecuente evitó un error costoso.
  • No convierte en gratuito el contexto almacenado en caché. El precio de la caché y la ocupación de contexto son asuntos distintos.

No empieces reduciendo skillListingBudgetFraction. Cuando la lista supera su presupuesto, Claude Code mantiene los nombres, pero descarta descripciones empezando por las skills menos utilizadas. Eso puede reducir el texto de la lista y, al mismo tiempo, hacer menos probable que se active la skill correcta. Es mejor retirar u ocultar de forma deliberada las entradas de poco valor.

El otro error es desinstalar plugins a primera vista. Primero desactiva, luego prueba y desinstala únicamente cuando hayas confirmado que los demás componentes del plugin no son necesarios.

Lo que puedes hacer este lunes

Elige un repositorio real y un desarrollador que utilice Claude Code de forma intensiva. Ejecuta /skill-doctor, registra los cinco mayores contribuyentes sin uso y modifica solo dos: configura un flujo poco frecuente para que solo el usuario pueda invocarlo y desactiva un plugin que realmente no sea pertinente. Abre una sesión nueva, repite tres tareas habituales y restaura cualquier elemento que cambie el resultado. Así tendrás para el viernes una política defendible de ahorro de contexto, no una configuración más ordenada que, en silencio, haya empeorado el agente.

¿Cómo hacer que Claude Code use menos contexto?

Ejecuta /skill-doctor para encontrar el costo de las skills sin uso en la lista, consulta el desglose general con /context, oculta las skills irrelevantes, reserva los flujos poco frecuentes para la invocación manual, traslada las referencias largas a archivos de apoyo y usa /clear entre tareas que no estén relacionadas.

¿Cómo reducir al mínimo el costo de Claude Code?

Reduce primero el contexto recurrente y después aborda la elección del modelo, las sesiones largas, la configuración de razonamiento, la salida detallada de herramientas y los servidores MCP que no se usan. /skill-doctor solo cubre la parte de la factura asociada a las skills.

¿Las skills de Claude Code son gratuitas?

La documentación de Anthropic sobre skills no indica un cargo independiente por un SKILL.md local, pero su nombre y su descripción pueden consumir contexto en cada turno, y su cuerpo completo consume contexto después de invocarlo. Quienes usan la API pagan según los tokens consumidos; quienes tienen una suscripción utilizan el cupo incluido.

¿Cómo compactar el contexto de Claude Code?

Usa /compact cuando necesites mantener la continuidad en una tarea larga y /clear cuando cambies a un trabajo sin relación con el anterior. Los cuerpos de las skills invocadas pueden volver a adjuntarse después de la compactación, con un límite de 5,000 tokens por skill y de 25,000 tokens en total.

¿Conviene borrar el contexto de Claude Code?

Sí, cuando vayas a comenzar una tarea no relacionada. Para probar un recorte de skills es importante abrir una sesión nueva, porque el cuerpo de una skill ya cargado en la conversación anterior puede ocultar el efecto de desactivarla.

Si buscas implantar en tu equipo de ingeniería un flujo medible para gobernar skills, consulta sistemas de IA en producción.

Última actualización

5 sept 2026

CategoríaBuild

Prefiera este sitio en Google

Añadir omidsaffari.com como fuente preferida en la Búsqueda de Google

Marque omidsaffari.com como fuente preferida y Google lo destacará para usted en Top Stories, AI Overviews y AI Mode.

Newsletter

Una carta, cada domingo. Sistemas que funcionan, no opiniones calientes.

Build logs, sistemas en producción y notas de campo de un portafolio de ventures de IA.

Semanal. Sin spam. Cancele cuando quiera.