Claude Sonnet 5 en 2026: precio real, cuándo supera a Opus y la trampa del tokenizador

Analizamos Claude Sonnet 5: precio real, rendimiento frente a Opus 4.8, cambios de API y el nuevo tokenizador que eleva el consumo cerca de un 30%.

Thursday, September 3, 2026Omid Saffari
Claude Sonnet 5 en 2026: precio real, cuándo supera a Opus y la trampa del tokenizador

Claude Sonnet 5 ya es el modelo predeterminado de todas las cuentas Free y Pro. Su rendimiento en tareas agénticas se acerca al de Opus 4.8 y, hasta el 31 de agosto, su precio anunciado es de $2 por millón de tokens de entrada. Hay un detalle que no aparece en la página de precios: el nuevo tokenizador hace que el mismo trabajo consuma cerca de un 30% más de tokens que con Sonnet 4.6, así que la factura real resulta más alta de lo que sugiere la tarifa.

El veredicto en una línea

Conviene pasar a Sonnet 5 para agentes, programación y automatizaciones que usan muchas herramientas, pero hay que calcular el efecto del nuevo tokenizador antes de dar por hecho que será más barato.

Anthropic lanzó Sonnet 5 el 30 de junio de 2026 como su Sonnet con mayores capacidades agénticas hasta la fecha: planifica trabajos de varios pasos, maneja herramientas como navegadores y terminales, y termina tareas en las que los modelos Sonnet anteriores se quedaban atascados. Tanto en la API como en Claude Code, funciona de forma predeterminada con effort=high. Con ese ajuste se acerca a Opus 4.8 en algunas tareas, pero cuesta una fracción de su precio. Para la mayoría de quienes ya trabajan en Claude Code o desarrollan agentes, ahora es la opción predeterminada más sensata.

La razón para avanzar con cautela es el costo, no la capacidad. La tarifa de lanzamiento parece una rebaja, pero el nuevo tokenizador contabiliza alrededor de un 30% más de tokens para el mismo texto. Además, hay tres cambios incompatibles en la API que harán que las solicitudes devuelvan un error 400 si la migración se hace sin revisarlos. Ambos puntos se explican más adelante.

Página del producto Claude Sonnet 5
Claude Sonnet 5

Qué cambió realmente frente a Sonnet 4.6

Sonnet 5 puede sustituir directamente a Sonnet 4.6: cede algo de control manual a cambio de mucha más autonomía.

La mejora decisiva está en su capacidad para completar tareas agénticas. Según la propia explicación de Anthropic, los saltos de capacidad más claros de los últimos tiempos se habían concentrado en los modelos de la categoría Opus. Sonnet 5 reduce esa distancia: ofrece un rendimiento cercano al de Opus 4.8 a menor precio y abre un abanico de opciones de costo y velocidad mucho más amplio que Sonnet 4.6. Supera a 4.6 en razonamiento, uso de herramientas, programación y trabajo de conocimiento. Los socios con acceso anticipado también describieron cómo completaba tareas de software de varios pasos y revisaba sus propios resultados sin que se lo pidieran. En las pruebas que destaca Anthropic —búsqueda agéntica (BrowseComp) y uso de computadoras (OSWorld-Verified)— mejora de forma inequívoca sobre 4.6 y, con un nivel de esfuerzo mayor, puede igualar a Opus 4.8 en algunas tareas. Según el informe de seguridad de Anthropic, también muestra menos conductas indeseables que 4.6 y es notablemente menos capaz en tareas de ciberseguridad que los modelos Opus actuales; para la mayoría de los usos empresariales, esto es una ventaja, no una carencia.

El cambio de comportamiento más útil es este: el razonamiento adaptativo viene activado de forma predeterminada. En Sonnet 4.6, una solicitud sin el campo thinking se ejecutaba sin razonamiento. En Sonnet 5, esa misma solicitud razona de manera adaptativa. La calidad inicial mejora, pero max_tokens limita en conjunto los tokens de razonamiento y el texto de la respuesta. Por eso, un tope de salida ajustado para 4.6 ahora puede truncar la respuesta visible. Conviene revisar max_tokens en cualquier carga de trabajo que antes se ejecutara sin razonamiento.

El precio real de Claude Sonnet 5 dentro de toda la gama

El precio de lanzamiento de Sonnet 5 es de $2 por millón de tokens de entrada y $10 por millón de tokens de salida hasta el 31 de agosto de 2026. Después pasa a $3 de entrada y $15 de salida. Así queda frente al resto de la familia con las cifras actuales:

ModeloID de APIPrecio (entrada / salida por MTok)ContextoSalida máxima
Claude Fable 5claude-fable-5$10 / $501M128k
Claude Opus 4.8claude-opus-4-8$5 / $251M128k
Claude Sonnet 5claude-sonnet-5$2 / $10 inicial, luego $3 / $151M128k
Claude Haiku 4.5claude-haiku-4-5$1 / $5200k64k

Al expresar la gama como proporciones, la decisión se vuelve sencilla. Durante el periodo inicial, Sonnet 5 cuesta por token el 40% de Opus 4.8; incluso con la tarifa estándar posterior a agosto, cuesta el 60% de Opus. Frente a Haiku 4.5, en cambio, su tarifa estándar es 3x mayor, y Haiku se limita a una ventana de contexto de 200k, mientras Sonnet 5 ofrece 1M completo. Sonnet 5 ocupa deliberadamente el punto medio: es más barato que Opus y bastante más capaz que Haiku, pero mantiene el mismo contexto de 1M y el mismo límite de salida de 128k que los modelos insignia.

Hay una especificación discreta, pero importante para los trabajos largos: Sonnet 5 conserva un contexto de 1M tokens tanto de forma predeterminada como máxima —no existe una variante con menos contexto— y puede alcanzar 300k tokens de salida en la Batch API con el encabezado beta output-300k-2026-03-24. Lo que sí pierde frente a la categoría Opus es el acceso a Priority Tier, que no está disponible para Sonnet 5.

Escala de precio y capacidad de la familia Claude 5
La posición de Sonnet 5: más barato que Opus, muy por encima de Haiku y con el mismo contexto de 1M.

El costo oculto del tokenizador que nadie incluye

La tarifa anunciada bajó, pero el precio efectivo por unidad de trabajo no disminuyó en la misma proporción. Sonnet 5 incorpora un tokenizador nuevo que convierte el mismo texto en cerca de un 30% más de tokens que Sonnet 4.6.

El tokenizador es la parte del modelo que divide el texto en las unidades facturables llamadas tokens. El de Sonnet 5 es distinto al de 4.6, y Anthropic señala claramente que un mismo texto de entrada genera alrededor de un 30% más de tokens —la cifra exacta depende del contenido—. El precio por token no cambia. Sin embargo, la facturación depende del número de tokens: si una solicitud ocupaba 10,000 tokens con 4.6 y ahora ronda los 13,000, un trabajo equivalente cuesta cerca de un 30% más antes incluso de considerar el cambio de tarifa. También implica que la ventana de contexto de 1M admite menos texto real y que un límite max_tokens calculado para la salida de 4.6 puede cortar una respuesta antes de tiempo.

La regla práctica es clara: hay que dejar de reutilizar mediciones de tokens hechas con modelos anteriores y volver a medir con Sonnet 5. Si las previsiones de costos, los presupuestos por solicitud o la lógica para llenar el contexto se basan en cifras de 4.6, ahora pecan de optimistas. Es el mismo patrón que afectó antes a la línea Opus y que analicé en el cambio de tokenizador de Opus 4.7. La solución también es la misma: volver a contar y decidir después.

La misma frase usa cerca de un 30% más de tokens en Sonnet 5
El precio por token no cambia, pero el mismo texto factura cerca de un 30% más de tokens.

Nada de esto convierte a Sonnet 5 en un modelo caro. Con la tarifa inicial sigue muy por debajo de Opus para resultados comparables. La comparación honesta no es «se volvió barato», sino «precio anunciado de $2, menos una mejora real de capacidad, más una sobrecarga de tokens cercana al 30%». Antes de asumir que habrá ahorro, hay que hacer las cuentas con la carga de trabajo propia.

Tres cambios incompatibles antes de hacer la migración

Migrar desde 4.6 es sencillo en general, pero hay tres solicitudes que antes funcionaban y ahora devuelven un error 400. Es mejor resolverlas primero, o el bucle del agente se detendrá en la primera llamada.

  1. Eliminar los parámetros de muestreo

    Asignar un valor distinto del predeterminado a temperature, top_p o top_k devuelve un error 400 en Sonnet 5. Hay que eliminarlos de la solicitud; se acepta tanto el valor predeterminado como omitir el parámetro. Para orientar el comportamiento, esas instrucciones deben pasar al prompt del sistema. Esta restricción es nueva para los modelos Sonnet, aunque ya se aplicaba a Opus 4.7.

  2. Descartar el razonamiento extendido manual

    El formato anterior thinking: {type: "enabled", budget_tokens: N} fue eliminado y devuelve un error 400. En su lugar, hay que usar razonamiento adaptativo con el parámetro effort, igual que en Opus 4.8. Para desactivar por completo el razonamiento, se debe enviar thinking: {type: "disabled"}.

  3. Volver a comprobar max_tokens

    Como el razonamiento adaptativo está activo de forma predeterminada y max_tokens limita en conjunto el razonamiento y la respuesta, hay que probar de nuevo cualquier tope calculado para 4.6. Las cargas que antes se ejecutaban sin razonamiento son las que tienen más probabilidades de quedar truncadas.

Python
# Fails on Sonnet 5 (returns 400)
resp = client.messages.create(
    model="claude-sonnet-5",
    temperature=0.7,
    thinking={"type": "enabled", "budget_tokens": 32000},
    max_tokens=4000,
    messages=[...],
)

# Works: no sampling params, adaptive thinking, roomier max_tokens
resp = client.messages.create(
    model="claude-sonnet-5",
    thinking={"type": "adaptive"},
    max_tokens=8000,
    messages=[...],
)

Claude Sonnet 5 vs Opus 4.8: cuándo conviene el modelo más barato

Para programación agéntica y automatizaciones que usan herramientas, Sonnet 5 con effort=high es la opción predeterminada. Solo conviene subir a Opus 4.8 cuando la tarea realmente necesita su techo de capacidad.

El argumento a favor de Sonnet 5 es el selector de esfuerzo. Ofrece los mismos niveles medium, high y extra-high que la categoría Opus, y las curvas de costo y rendimiento de Anthropic muestran que cubre un rango mucho más amplio que 4.6: es muy eficiente con un esfuerzo medio y, al subirlo, alcanza la capacidad de Opus 4.8 en algunas tareas. Como cuesta el 40% de Opus durante el periodo inicial —y el 60% después de agosto—, las cifras favorecen empezar con Sonnet 5 y escalar únicamente las tareas difíciles a Opus, en lugar de pagar la tarifa de Opus para todo.

El argumento para seguir con Opus 4.8 es más acotado, pero válido: trabajos en los que el máximo nivel de capacidad compensa su costo; la programación agéntica más difícil; ejecuciones autónomas largas en las que un solo paso fallido sale caro; o cualquier caso en que «iguala el rendimiento en algunas tareas» no sea suficiente porque las tareas importantes sean precisamente aquellas en las que no lo iguala. Al delegar trabajo de producción desatendido a gran escala, la diferencia de precio puede resultar más barata que una sola ejecución fallida de Sonnet.

La recepción sin filtros: por qué algunos lo consideran un retroceso

La reacción de la comunidad está dividida, y fingir lo contrario sería poco honesto. Junto a los elogios de quienes afirman que «termina tareas que 4.6 no podía completar», este mes aparecieron en r/ClaudeAI hilos públicos con títulos tan directos como "Sonnet 5 is a downgrade", además de una sucesión constante de publicaciones que preguntan "is it actually worth using" y "what's the consensus". Vale la pena reconocer la distancia entre el mensaje de Anthropic —"close to Opus 4.8"— y la experiencia cotidiana de algunos usuarios.

Hay dos razones que explican buena parte de esa diferencia. Primero, el razonamiento adaptativo predeterminado cambia la forma y la latencia de las respuestas. Por eso, los flujos ajustados para las respuestas más breves y sin razonamiento de 4.6 pueden sentirse distintos aunque la calidad haya mejorado. Segundo, el cambio de tokenizador empeora a primera vista las comparaciones de costos hasta que se vuelven a medir; antes de entenderse como un «tokenizador distinto», se percibe como un modelo «más caro». Nada de esto significa que el modelo sea malo. Significa que una sustitución directa nunca es tan directa. Hay que probarlo con los prompts propios antes de confiar en el veredicto de cualquiera, incluido el mío.

Quién debería cambiar y quién debería esperar

Quienes desarrollan agentes, entregan código con Claude Code o ejecutan automatizaciones que usan muchas herramientas deberían cambiar. Sonnet 5 con effort=high ofrece una capacidad para completar tareas cercana a Opus por el precio de Sonnet. Eso sí: primero hay que volver a calcular el presupuesto de tokens.

Mapa de decisión para migrar a Sonnet 5
Un mapa rápido para decidir si conviene cambiar o esperar.
¿Claude Sonnet 5 ya está disponible?

Sí. Se lanzó el 30 de junio de 2026 y es el modelo predeterminado de los planes Free y Pro. Está disponible para los usuarios de Max, Team y Enterprise, y puede usarse en Claude Code y mediante la API de Claude como claude-sonnet-5.

¿Cuánto cuesta Claude Sonnet 5?

El precio inicial de la API es de $2 por millón de tokens de entrada y $10 por millón de tokens de salida hasta el 31 de agosto de 2026; después pasa a $3 de entrada y $15 de salida. Equivale al 40% de la tarifa de Opus 4.8 durante el periodo inicial y al 60% después. Hay que considerar que el nuevo tokenizador contabiliza cerca de un 30% más de tokens para el mismo texto que Sonnet 4.6.

¿Sonnet 5 es realmente bueno o supone un retroceso?

Es una mejora clara frente a Sonnet 4.6 en tareas agénticas, programación y uso de herramientas, y se acerca a Opus 4.8 con un nivel de esfuerzo mayor. Algunos usuarios afirman que se siente peor, sobre todo porque el razonamiento adaptativo ahora viene activado y porque el cambio de tokenizador hace que el costo parezca mayor hasta que se vuelve a medir. Lo adecuado es probarlo con los prompts propios.

¿Claude Sonnet 5 es mejor que GPT-5.6?

Cada uno se impone según la tarea. La fortaleza de Sonnet 5 es completar trabajos agénticos y usar herramientas a bajo costo. Para conocer la otra cara de la comparación, consulte el análisis de GPT-5.6.

¿Está migrando una configuración de programación o agentes y quiere ajustar primero lo que de verdad importa? Descargue gratis la lista de comprobación para configurar Claude Code + Codex, con los pasos de configuración y control de costos que conviene ejecutar antes de cambiar un modelo en producción, y reciba cada nuevo análisis en cuanto se publique.

Última actualización

3 sept 2026

CategoríaAI

Prefiera este sitio en Google

Añadir omidsaffari.com como fuente preferida en la Búsqueda de Google

Marque omidsaffari.com como fuente preferida y Google lo destacará para usted en Top Stories, AI Overviews y AI Mode.

Newsletter

Una carta, cada domingo. Sistemas que funcionan, no opiniones calientes.

Build logs, sistemas en producción y notas de campo de un portafolio de ventures de IA.

Semanal. Sin spam. Cancele cuando quiera.