Обзор Claude Sonnet 5: реальная цена, сравнение с Opus и подвох токенизатора

Обзор Claude Sonnet 5: цена API, сравнение с Opus 4.8, новый токенизатор с расходом примерно на 30% выше и три несовместимых изменения при переходе.

Thursday, September 3, 2026Omid Saffari
Обзор Claude Sonnet 5: реальная цена, сравнение с Opus и подвох токенизатора

Обзор Claude Sonnet 5: модель уже стала стандартной для всех аккаунтов Free и Pro, почти догоняет Opus 4.8 в агентных задачах и до 31 августа стоит $2 за миллион входных токенов. Но на странице с тарифами не пишут о главном нюансе: из-за нового токенизатора одна и та же задача теперь расходует примерно на 30% больше токенов, чем в Sonnet 4.6, поэтому фактический счет окажется выше, чем можно предположить по заявленной цене.

Вердикт в одной строке

Для агентов, программирования и автоматизации с активным использованием инструментов стоит перейти на Sonnet 5 — но сначала учесть новый токенизатор в расчетах, а не считать модель автоматически более дешевой.

Anthropic выпустила Sonnet 5 30 июня 2026 года как самую агентную модель в линейке Sonnet: она планирует многошаговую работу, управляет такими инструментами, как браузер и терминал, и доводит до конца задачи, на которых предыдущие версии Sonnet останавливались. В API и Claude Code она по умолчанию работает с effort=high; в этом режиме на некоторых задачах ее результаты приближаются к Opus 4.8 при гораздо более низкой заявленной цене. Для тех, кто уже работает в Claude Code или создает агентов, теперь это оптимальный вариант по умолчанию.

Повод не торопиться связан с деньгами, а не с возможностями. Стартовый тариф выглядит как снижение цены, однако новый токенизатор насчитывает примерно на 30% больше токенов для того же текста. Кроме того, в API появились три несовместимых изменения: если перенести интеграцию, не изучив их, запросы начнут возвращать ошибку 400. Ниже подробно разобраны оба нюанса.

Страница продукта Claude Sonnet 5
Claude Sonnet 5

Обзор Claude Sonnet 5: что изменилось после Sonnet 4.6

Sonnet 5 можно использовать как прямую замену Sonnet 4.6: немного меньше ручного контроля в обмен на гораздо большую автономность.

Главное улучшение — способность самостоятельно доводить агентные задачи до результата. По оценке самой Anthropic, последние заметные скачки возможностей происходили прежде всего в моделях класса Opus, а Sonnet 5 сокращает этот разрыв: при более низкой цене ее производительность близка к Opus 4.8, а выбор баланса между стоимостью и скоростью гораздо шире, чем у Sonnet 4.6. Новая модель лучше справляется с рассуждениями, использованием инструментов, программированием и интеллектуальной работой. Партнеры с ранним доступом отмечали, что она завершает многошаговые задачи по разработке ПО и без дополнительных указаний проверяет собственный результат. В тестах, которые выделяет Anthropic, — агентном поиске BrowseComp и управлении компьютером OSWorld-Verified — это однозначный шаг вперед относительно 4.6; при повышенном уровне усилий на некоторых задачах модель может сравняться с Opus 4.8. Согласно отчету Anthropic о безопасности, нежелательное поведение у нее встречается реже, чем у 4.6, а в задачах по кибербезопасности она заметно слабее актуальных моделей Opus. Для большинства корпоративных сценариев это преимущество, а не недостаток.

Самое полезное изменение в поведении: адаптивное мышление включено по умолчанию. В Sonnet 4.6 запрос без поля thinking выполнялся без рассуждений. В Sonnet 5 тот же запрос запускает адаптивное мышление. Качество ответа без дополнительной настройки становится выше, но max_tokens ограничивает суммарный объем рассуждений и текста ответа. Поэтому лимит, подобранный для 4.6, теперь может обрезать видимую часть результата. Пересмотрите max_tokens во всех сценариях, которые раньше работали без рассуждений.

Реальная цена: вся линейка Claude 5

До 31 августа 2026 года для Sonnet 5 действует стартовый тариф: $2 за миллион входных токенов и $10 за миллион выходных токенов. Затем цена составит $3 за входные и $15 за выходные токены. Вот как модель выглядит на фоне остальной линейки по текущим данным:

МодельИдентификатор APIЦена (вход / выход за MTok)КонтекстМакс. ответ
Claude Fable 5claude-fable-5$10 / $501M128k
Claude Opus 4.8claude-opus-4-8$5 / $251M128k
Claude Sonnet 5claude-sonnet-5$2 / $10 на старте, затем $3 / $151M128k
Claude Haiku 4.5claude-haiku-4-5$1 / $5200k64k

В соотношениях выбор выглядит проще. По стартовому тарифу токены Sonnet 5 стоят 40% от цены Opus 4.8; даже после перехода на обычный тариф по окончании августа это будет 60% от цены Opus. С другой стороны, обычный тариф Sonnet 5 втрое превышает тариф Haiku 4.5 (3x), а контекст Haiku ограничен 200k против полноценных 1M у Sonnet 5. Таким образом, Sonnet 5 намеренно занимает середину линейки: дешевле Opus, существенно мощнее Haiku и при этом предлагает те же контекст 1M и максимальный ответ 128k, что и флагманские модели.

Есть еще одна характеристика, важная для долгих задач: контекст Sonnet 5 в 1M токенов одновременно является стандартным и максимальным — варианта с меньшим контекстом нет. В Batch API модель может выдавать до 300k выходных токенов при использовании бета-заголовка output-300k-2026-03-24. В отличие от уровня Opus, Sonnet 5 не поддерживает Priority Tier.

Соотношение цены и возможностей моделей семейства Claude 5
Место Sonnet 5 в линейке: дешевле Opus, заметно мощнее Haiku и тот же контекст 1M.

Скрытая наценка нового токенизатора

Заявленная цена снизилась, но фактическая стоимость единицы работы уменьшилась не так сильно: новый токенизатор Sonnet 5 разбивает тот же текст примерно на 30% большее число токенов, чем Sonnet 4.6.

Токенизатор — это компонент модели, который делит текст на оплачиваемые единицы, то есть токены. В Sonnet 5 он отличается от версии в 4.6, и Anthropic прямо указывает: один и тот же входной текст дает примерно на 30% больше токенов, хотя точное значение зависит от содержимого. Цена одного токена не изменилась. Но оплата идет за каждый токен, поэтому запрос, который в 4.6 занимал 10,000 токенов, теперь может занимать около 13,000 — и до учета разницы тарифов эквивалентная задача обходится примерно на 30% дороже. По этой же причине контекстное окно 1M вмещает меньше фактического текста, а лимит max_tokens, рассчитанный по выходу 4.6, способен преждевременно оборвать ответ.

Практическое правило: перестаньте использовать замеры токенов старых моделей и выполните расчеты заново на Sonnet 5. Если прогнозы расходов, лимиты на один запрос или логика заполнения контекста строились на показателях 4.6, теперь они слишком оптимистичны. Ранее то же произошло с линейкой Opus — этот случай подробно разобран в материале об изменении токенизатора Opus 4.7. Решение прежнее: сначала пересчитать, затем принимать решение.

Одна и та же фраза использует примерно на 30% больше токенов в Sonnet 5
Цена токена не изменилась, однако тот же текст расходует примерно на 30% больше токенов.

Все это не делает Sonnet 5 дорогой. По стартовому тарифу она по-прежнему значительно дешевле Opus при сопоставимом результате. Честная формула сравнения звучит так: «заявленные $2 минус реальный прирост возможностей плюс около 30% дополнительных токенов», а не просто «модель стала дешевой». Прежде чем рассчитывать на экономию, посчитайте стоимость на собственной нагрузке.

Три несовместимых изменения перед переходом

Переезд с 4.6 в основном проходит безболезненно, но три типа запросов, работавших еще вчера, теперь возвращают ошибку 400. Исправьте их заранее, иначе цикл агента остановится уже на первом вызове.

  1. Удалите параметры семплирования

    Если задать для temperature, top_p или top_k нестандартное значение, Sonnet 5 вернет ошибку 400. Удалите эти параметры из запроса: значение по умолчанию и полное отсутствие параметра поддерживаются. Необходимое поведение лучше описать в системном промпте. Для моделей класса Sonnet это новое ограничение, хотя в Opus 4.7 оно уже действовало.

  2. Откажитесь от ручного режима расширенного мышления

    Прежний формат thinking: {type: "enabled", budget_tokens: N} удален и возвращает ошибку 400. Вместо него используйте адаптивное мышление и параметр effort, как в Opus 4.8. Чтобы полностью отключить рассуждения, передайте thinking: {type: "disabled"}.

  3. Еще раз проверьте max_tokens

    Адаптивное мышление теперь включено по умолчанию, а max_tokens ограничивает общий объем рассуждений и ответа. Поэтому заново протестируйте все лимиты, рассчитанные для 4.6. Сильнее всего рискуют получить обрезанный ответ процессы, которые прежде выполнялись без рассуждений.

Python
# Fails on Sonnet 5 (returns 400)
resp = client.messages.create(
    model="claude-sonnet-5",
    temperature=0.7,
    thinking={"type": "enabled", "budget_tokens": 32000},
    max_tokens=4000,
    messages=[...],
)

# Works: no sampling params, adaptive thinking, roomier max_tokens
resp = client.messages.create(
    model="claude-sonnet-5",
    thinking={"type": "adaptive"},
    max_tokens=8000,
    messages=[...],
)

Sonnet 5 и Opus 4.8: когда стоит выбрать более дешевую модель

Для агентного программирования и автоматизации с инструментами Sonnet 5 при effort=high — оптимальный вариант по умолчанию. Переходить на Opus 4.8 имеет смысл лишь тогда, когда задаче действительно нужен максимум возможностей.

Главный аргумент в пользу Sonnet 5 — регулятор усилий. Модель предлагает те же уровни medium, high и extra-high, что и линейка Opus, а графики Anthropic по соотношению затрат и качества показывают гораздо более широкий диапазон, чем у 4.6: высокая эффективность на среднем уровне и возможности Opus 4.8 на некоторых задачах при повышенном. Поскольку на старте Sonnet 5 стоит 40% от цены Opus, а после августа — 60%, выгоднее начинать с нее и переводить на Opus только отдельные сложные задачи, а не оплачивать тариф Opus для всей нагрузки.

Причины остаться на Opus 4.8 немногочисленны, но весомы. Это задачи, где окупается верхний предел возможностей: самое сложное агентное программирование, долгие автономные запуски с высокой ценой одной ошибки и любые сценарии, в которых формулировки «сравнима на некоторых задачах» недостаточно, поскольку важны как раз остальные задачи. При масштабной передаче производственной работы автономным агентам доплата за Opus может оказаться меньше стоимости одного неудачного запуска Sonnet.

Честная реакция пользователей: почему Sonnet 5 называют ухудшением

Сообщество встретило модель неоднозначно, и скрывать это было бы нечестно. Наряду с похвалой за то, что она завершает задачи, непосильные для 4.6, в публичных обсуждениях на r/ClaudeAI в этом месяце встречается прямолинейный заголовок «Sonnet 5 is a downgrade», а также целый ряд публикаций в духе «is it actually worth using» и «what's the consensus». Этот разрыв между заявлением Anthropic о близости к Opus 4.8 и субъективными впечатлениями части пользователей заслуживает внимания.

Большую часть расхождений объясняют две причины. Во-первых, адаптивное мышление по умолчанию меняет форму ответа и задержку, поэтому процессы, настроенные на более краткие ответы 4.6 без рассуждений, могут ощущаться иначе даже при повышении качества. Во-вторых, из-за нового токенизатора сравнение затрат выглядит хуже, пока пользователи не выполнят новые замеры: сначала это воспринимается как «стало дороже», а уже потом — как «токенизатор работает иначе». Ни то ни другое не делает модель плохой; просто «бесшовный» переход редко бывает полностью бесшовным. Протестируйте модель на собственных промптах, прежде чем доверять чьему-либо вердикту, включая мой.

Кому стоит перейти сейчас, а кому — подождать

Если вы создаете агентов, пишете код в Claude Code или запускаете автоматизацию с активным использованием инструментов, Sonnet 5 при effort=high обеспечивает близкую к Opus способность доводить задачи до конца по цене Sonnet. Переходить стоит, но сначала пересчитайте токенные бюджеты.

Схема принятия решения о переходе на Sonnet 5
Краткая схема: переходить на Sonnet 5 или остаться на прежней модели.
Claude Sonnet 5 уже доступна?

Да. Модель вышла 30 июня 2026 года и используется по умолчанию на тарифах Free и Pro; она доступна пользователям Max, Team и Enterprise, работает в Claude Code и через Claude API под идентификатором claude-sonnet-5.

Сколько стоит Claude Sonnet 5?

До 31 августа 2026 года стартовый тариф API составляет $2 за миллион входных токенов и $10 за миллион выходных токенов, затем — $3 за входные и $15 за выходные. Это 40% от тарифа Opus 4.8 на старте и 60% после. Учтите, что новый токенизатор насчитывает для того же текста примерно на 30% больше токенов, чем Sonnet 4.6.

Sonnet 5 действительно хороша или это ухудшение?

В агентных задачах, программировании и использовании инструментов модель однозначно превосходит Sonnet 4.6, а при высоком уровне усилий приближается к Opus 4.8. Некоторые пользователи воспринимают ее хуже — главным образом потому, что адаптивное мышление теперь включено по умолчанию, а из-за нового токенизатора расходы кажутся выше до повторного замера. Проверьте модель на собственных промптах.

Claude Sonnet 5 лучше GPT-5.6?

Преимущество зависит от задачи; сильные стороны Sonnet 5 — умение доводить агентную работу до конца и использовать инструменты при низкой цене. Другую сторону сравнения раскрывает обзор GPT-5.6.

Переносите систему для программирования или агентов и хотите сначала настроить действительно важные компоненты? Скачайте бесплатный чек-лист по настройке Claude Code и Codex: в нем собраны шаги по конфигурации и контролю расходов, которые стоит пройти до смены модели в продакшене. Заодно будете получать разбор каждой новой модели сразу после ее выхода.

Последнее обновление

3 сент. 2026 г.

КатегорияAI

Сделать этот сайт предпочтительным в Google

Добавить omidsaffari.com как предпочтительный источник в Google Поиске

Отметьте omidsaffari.com как предпочтительный источник — и Google будет поднимать его для вас в Top Stories, AI Overviews и AI Mode.

Рассылка

Одно письмо, каждое воскресенье. Работающие системы, а не горячие мнения.

Билд-логи, системы в продакшене и полевые заметки из портфеля ИИ-проектов.

Еженедельно. Без спама. Отписка в любой момент.