Обзор Claude Sonnet 5: реальная цена, сравнение с Opus и подвох токенизатора

Обзор Claude Sonnet 5: цена API, сравнение с Opus 4.8, новый токенизатор с расходом примерно на 30% выше и три несовместимых изменения при переходе.

Thursday, September 3, 2026Omid Saffari
Обзор Claude Sonnet 5: реальная цена, сравнение с Opus и подвох токенизатора

Обзор Claude Sonnet 5: модель уже стала стандартной для всех аккаунтов Free и Pro, почти догоняет Opus 4.8 в агентных задачах и до 31 августа стоит $2 за миллион входных токенов. Но на странице с тарифами не пишут о главном нюансе: из-за нового токенизатора одна и та же задача теперь расходует примерно на 30% больше токенов, чем в Sonnet 4.6, поэтому фактический счет окажется выше, чем можно предположить по заявленной цене.

Вердикт в одной строке

Для агентов, программирования и автоматизации с активным использованием инструментов стоит перейти на Sonnet 5 — но сначала учесть новый токенизатор в расчетах, а не считать модель автоматически более дешевой.

Anthropic выпустила Sonnet 5 30 июня 2026 года как самую агентную модель в линейке Sonnet: она планирует многошаговую работу, управляет такими инструментами, как браузер и терминал, и доводит до конца задачи, на которых предыдущие версии Sonnet останавливались. В API и Claude Code она по умолчанию работает с effort=high; в этом режиме на некоторых задачах ее результаты приближаются к Opus 4.8 при гораздо более низкой заявленной цене. Для тех, кто уже работает в Claude Code или создает агентов, теперь это оптимальный вариант по умолчанию.

Повод не торопиться связан с деньгами, а не с возможностями. Стартовый тариф выглядит как снижение цены, однако новый токенизатор насчитывает примерно на 30% больше токенов для того же текста. Кроме того, в API появились три несовместимых изменения: если перенести интеграцию, не изучив их, запросы начнут возвращать ошибку 400. Ниже подробно разобраны оба нюанса.

Страница продукта Claude Sonnet 5
Claude Sonnet 5

Обзор Claude Sonnet 5: что изменилось после Sonnet 4.6

Sonnet 5 можно использовать как прямую замену Sonnet 4.6: немного меньше ручного контроля в обмен на гораздо большую автономность.

Главное улучшение — способность самостоятельно доводить агентные задачи до результата. По оценке самой Anthropic, последние заметные скачки возможностей происходили прежде всего в моделях класса Opus, а Sonnet 5 сокращает этот разрыв: при более низкой цене ее производительность близка к Opus 4.8, а выбор баланса между стоимостью и скоростью гораздо шире, чем у Sonnet 4.6. Новая модель лучше справляется с рассуждениями, использованием инструментов, программированием и интеллектуальной работой. Партнеры с ранним доступом отмечали, что она завершает многошаговые задачи по разработке ПО и без дополнительных указаний проверяет собственный результат. В тестах, которые выделяет Anthropic, — агентном поиске BrowseComp и управлении компьютером OSWorld-Verified — это однозначный шаг вперед относительно 4.6; при повышенном уровне усилий на некоторых задачах модель может сравняться с Opus 4.8. Согласно отчету Anthropic о безопасности, нежелательное поведение у нее встречается реже, чем у 4.6, а в задачах по кибербезопасности она заметно слабее актуальных моделей Opus. Для большинства корпоративных сценариев это преимущество, а не недостаток.

Самое полезное изменение в поведении: адаптивное мышление включено по умолчанию. В Sonnet 4.6 запрос без поля thinking выполнялся без рассуждений. В Sonnet 5 тот же запрос запускает адаптивное мышление. Качество ответа без дополнительной настройки становится выше, но max_tokens ограничивает суммарный объем рассуждений и текста ответа. Поэтому лимит, подобранный для 4.6, теперь может обрезать видимую часть результата. Пересмотрите max_tokens во всех сценариях, которые раньше работали без рассуждений.

Реальная цена: вся линейка Claude 5

До 31 августа 2026 года для Sonnet 5 действует стартовый тариф: $2 за миллион входных токенов и $10 за миллион выходных токенов. Затем цена составит $3 за входные и $15 за выходные токены. Вот как модель выглядит на фоне остальной линейки по текущим данным:

МодельИдентификатор APIЦена (вход / выход за MTok)КонтекстМакс. ответ
Claude Fable 5claude-fable-5$10 / $501M128k
Claude Opus 4.8claude-opus-4-8$5 / $251M128k
Claude Sonnet 5claude-sonnet-5$2 / $10 на старте, затем $3 / $151M128k
Claude Haiku 4.5claude-haiku-4-5$1 / $5200k64k

В соотношениях выбор выглядит проще. По стартовому тарифу токены Sonnet 5 стоят 40% от цены Opus 4.8; даже после перехода на обычный тариф по окончании августа это будет 60% от цены Opus. С другой стороны, обычный тариф Sonnet 5 втрое превышает тариф Haiku 4.5 (3x), а контекст Haiku ограничен 200k против полноценных 1M у Sonnet 5. Таким образом, Sonnet 5 намеренно занимает середину линейки: дешевле Opus, существенно мощнее Haiku и при этом предлагает те же контекст 1M и максимальный ответ 128k, что и флагманские модели.

Есть еще одна характеристика, важная для долгих задач: контекст Sonnet 5 в 1M токенов одновременно является стандартным и максимальным — варианта с меньшим контекстом нет. В Batch API модель может выдавать до 300k выходных токенов при использовании бета-заголовка output-300k-2026-03-24. В отличие от уровня Opus, Sonnet 5 не поддерживает Priority Tier.

Соотношение цены и возможностей моделей семейства Claude 5
Место Sonnet 5 в линейке: дешевле Opus, заметно мощнее Haiku и тот же контекст 1M.

Скрытая наценка нового токенизатора

Заявленная цена снизилась, но фактическая стоимость единицы работы уменьшилась не так сильно: новый токенизатор Sonnet 5 разбивает тот же текст примерно на 30% большее число токенов, чем Sonnet 4.6.

Токенизатор — это компонент модели, который делит текст на оплачиваемые единицы, то есть токены. В Sonnet 5 он отличается от версии в 4.6, и Anthropic прямо указывает: один и тот же входной текст дает примерно на 30% больше токенов, хотя точное значение зависит от содержимого. Цена одного токена не изменилась. Но оплата идет за каждый токен, поэтому запрос, который в 4.6 занимал 10,000 токенов, теперь может занимать около 13,000 — и до учета разницы тарифов эквивалентная задача обходится примерно на 30% дороже. По этой же причине контекстное окно 1M вмещает меньше фактического текста, а лимит max_tokens, рассчитанный по выходу 4.6, способен преждевременно оборвать ответ.

Практическое правило: перестаньте использовать замеры токенов старых моделей и выполните расчеты заново на Sonnet 5. Если прогнозы расходов, лимиты на один запрос или логика заполнения контекста строились на показателях 4.6, теперь они слишком оптимистичны. Ранее то же произошло с линейкой Opus — этот случай подробно разобран в материале об изменении токенизатора Opus 4.7. Решение прежнее: сначала пересчитать, затем принимать решение.

Одна и та же фраза использует примерно на 30% больше токенов в Sonnet 5
Цена токена не изменилась, однако тот же текст расходует примерно на 30% больше токенов.

Все это не делает Sonnet 5 дорогой. По стартовому тарифу она по-прежнему значительно дешевле Opus при сопоставимом результате. Честная формула сравнения звучит так: «заявленные $2 минус реальный прирост возможностей плюс около 30% дополнительных токенов», а не просто «модель стала дешевой». Прежде чем рассчитывать на экономию, посчитайте стоимость на собственной нагрузке.

Три несовместимых изменения перед переходом

Переезд с 4.6 в основном проходит безболезненно, но три типа запросов, работавших еще вчера, теперь возвращают ошибку 400. Исправьте их заранее, иначе цикл агента остановится уже на первом вызове.

  1. Удалите параметры семплирования

    Если задать для temperature, top_p или top_k нестандартное значение, Sonnet 5 вернет ошибку 400. Удалите эти параметры из запроса: значение по умолчанию и полное отсутствие параметра поддерживаются. Необходимое поведение лучше описать в системном промпте. Для моделей класса Sonnet это новое ограничение, хотя в Opus 4.7 оно уже действовало.

  2. Откажитесь от ручного режима расширенного мышления

    Прежний формат thinking: {type: "enabled", budget_tokens: N} удален и возвращает ошибку 400. Вместо него используйте адаптивное мышление и параметр effort, как в Opus 4.8. Чтобы полностью отключить рассуждения, передайте thinking: {type: "disabled"}.

  3. Еще раз проверьте max_tokens

    Адаптивное мышление теперь включено по умолчанию, а max_tokens ограничивает общий объем рассуждений и ответа. Поэтому заново протестируйте все лимиты, рассчитанные для 4.6. Сильнее всего рискуют получить обрезанный ответ процессы, которые прежде выполнялись без рассуждений.

Python
# Fails on Sonnet 5 (returns 400)
resp = client.messages.create(
    model="claude-sonnet-5",
    temperature=0.7,
    thinking={"type": "enabled", "budget_tokens": 32000},
    max_tokens=4000,
    messages=[...],
)

# Works: no sampling params, adaptive thinking, roomier max_tokens
resp = client.messages.create(
    model="claude-sonnet-5",
    thinking={"type": "adaptive"},
    max_tokens=8000,
    messages=[...],
)

Sonnet 5 и Opus 4.8: когда стоит выбрать более дешевую модель

Для агентного программирования и автоматизации с инструментами Sonnet 5 при effort=high — оптимальный вариант по умолчанию. Переходить на Opus 4.8 имеет смысл лишь тогда, когда задаче действительно нужен максимум возможностей.

Главный аргумент в пользу Sonnet 5 — регулятор усилий. Модель предлагает те же уровни medium, high и extra-high, что и линейка Opus, а графики Anthropic по соотношению затрат и качества показывают гораздо более широкий диапазон, чем у 4.6: высокая эффективность на среднем уровне и возможности Opus 4.8 на некоторых задачах при повышенном. Поскольку на старте Sonnet 5 стоит 40% от цены Opus, а после августа — 60%, выгоднее начинать с нее и переводить на Opus только отдельные сложные задачи, а не оплачивать тариф Opus для всей нагрузки.

Причины остаться на Opus 4.8 немногочисленны, но весомы. Это задачи, где окупается верхний предел возможностей: самое сложное агентное программирование, долгие автономные запуски с высокой ценой одной ошибки и любые сценарии, в которых формулировки «сравнима на некоторых задачах» недостаточно, поскольку важны как раз остальные задачи. При масштабной передаче производственной работы автономным агентам доплата за Opus может оказаться меньше стоимости одного неудачного запуска Sonnet.

Честная реакция пользователей: почему Sonnet 5 называют ухудшением

Сообщество встретило модель неоднозначно, и скрывать это было бы нечестно. Наряду с похвалой за то, что она завершает задачи, непосильные для 4.6, в публичных обсуждениях на r/ClaudeAI в этом месяце встречается прямолинейный заголовок «Sonnet 5 is a downgrade», а также целый ряд публикаций в духе «is it actually worth using» и «what's the consensus». Этот разрыв между заявлением Anthropic о близости к Opus 4.8 и субъективными впечатлениями части пользователей заслуживает внимания.

Большую часть расхождений объясняют две причины. Во-первых, адаптивное мышление по умолчанию меняет форму ответа и задержку, поэтому процессы, настроенные на более краткие ответы 4.6 без рассуждений, могут ощущаться иначе даже при повышении качества. Во-вторых, из-за нового токенизатора сравнение затрат выглядит хуже, пока пользователи не выполнят новые замеры: сначала это воспринимается как «стало дороже», а уже потом — как «токенизатор работает иначе». Ни то ни другое не делает модель плохой; просто «бесшовный» переход редко бывает полностью бесшовным. Протестируйте модель на собственных промптах, прежде чем доверять чьему-либо вердикту, включая мой.

Кому стоит перейти сейчас, а кому — подождать

Если вы создаете агентов, пишете код в Claude Code или запускаете автоматизацию с активным использованием инструментов, Sonnet 5 при effort=high обеспечивает близкую к Opus способность доводить задачи до конца по цене Sonnet. Переходить стоит, но сначала пересчитайте токенные бюджеты.

Схема принятия решения о переходе на Sonnet 5
Краткая схема: переходить на Sonnet 5 или остаться на прежней модели.
Claude Sonnet 5 уже доступна?

Да. Модель вышла 30 июня 2026 года и используется по умолчанию на тарифах Free и Pro; она доступна пользователям Max, Team и Enterprise, работает в Claude Code и через Claude API под идентификатором claude-sonnet-5.

Сколько стоит Claude Sonnet 5?

До 31 августа 2026 года стартовый тариф API составляет $2 за миллион входных токенов и $10 за миллион выходных токенов, затем — $3 за входные и $15 за выходные. Это 40% от тарифа Opus 4.8 на старте и 60% после. Учтите, что новый токенизатор насчитывает для того же текста примерно на 30% больше токенов, чем Sonnet 4.6.

Sonnet 5 действительно хороша или это ухудшение?

В агентных задачах, программировании и использовании инструментов модель однозначно превосходит Sonnet 4.6, а при высоком уровне усилий приближается к Opus 4.8. Некоторые пользователи воспринимают ее хуже — главным образом потому, что адаптивное мышление теперь включено по умолчанию, а из-за нового токенизатора расходы кажутся выше до повторного замера. Проверьте модель на собственных промптах.

Claude Sonnet 5 лучше GPT-5.6?

Преимущество зависит от задачи; сильные стороны Sonnet 5 — умение доводить агентную работу до конца и использовать инструменты при низкой цене. Другую сторону сравнения раскрывает обзор GPT-5.6.

Переносите систему для программирования или агентов и хотите сначала настроить действительно важные компоненты? Скачайте бесплатный чек-лист по настройке Claude Code и Codex: в нем собраны шаги по конфигурации и контролю расходов, которые стоит пройти до смены модели в продакшене. Заодно будете получать разбор каждой новой модели сразу после ее выхода.

Последнее обновление
3 сент. 2026 г.
Категория
AI

Сделать этот сайт предпочтительным в Google

Добавить omidsaffari.com как предпочтительный источник в Google Поиске

Отметьте omidsaffari.com как предпочтительный источник — и Google будет поднимать его для вас в Top Stories, AI Overviews и AI Mode.

Похожие статьи
Claude Opus 5.5 vs Opus 5: цены, кодинг и миграция

Claude Opus 5.5 vs Opus 5: цены, кодинг и миграция

Сравниваем Claude Opus 5.5 и Opus 5: цены, кодинг, thinking, изменения API и пять проверок, без которых нельзя безопасно перенести рабочие нагрузки.23 сент. 2026 г.AI
GPT-6 Sol или Luna: какую модель выбрать для работы

GPT-6 Sol или Luna: какую модель выбрать для работы

Сравниваем GPT-6 Sol и Luna по цене, возможностям и качеству кода. Разбираем, когда достаточно Luna, а когда переплата за Sol действительно оправдана.23 сент. 2026 г.AI
GPT-6 Luna бесплатно: где доступна и сколько стоит API

GPT-6 Luna бесплатно: где доступна и сколько стоит API

Разбираем, где GPT-6 Luna доступна бесплатно, какие тарифы нужны для Work и Codex, сколько стоит API и какие лимиты OpenAI пока не раскрыла.22 сент. 2026 г.AI
Как пользоваться MiMo V2.6: первый рабочий сценарий

Как пользоваться MiMo V2.6: первый рабочий сценарий

Как пользоваться MiMo V2.6 в Studio и через API: выберите подходящий ключ и модель, запустите первую бизнес-задачу и сразу проверьте результат.22 сент. 2026 г.AI
MiMo V2.6 Pro vs Flash: когда стоит платить больше

MiMo V2.6 Pro vs Flash: когда стоит платить больше

Сравниваем MiMo V2.6 Pro vs Flash по цене, возможностям и тестам. Разбираем, когда брать Flash, а когда доплата за Pro действительно окупается.22 сент. 2026 г.AI
MiMo V2.6 бесплатно: доступ через OpenCode и цены API

MiMo V2.6 бесплатно: доступ через OpenCode и цены API

Разбираем, где MiMo V2.6 доступна бесплатно, какие ограничения есть у OpenCode, сколько стоит Xiaomi API и во что обойдётся самостоятельный запуск.22 сент. 2026 г.AI
Grok 4.7 vs Grok 4.6: что выбрать для кода и API

Grok 4.7 vs Grok 4.6: что выбрать для кода и API

Сравниваем Grok 4.7 и Grok 4.6: качество кода, API-тарифы, контекст и риски перехода. Парный тест покажет, когда обновление действительно выгодно.21 сент. 2026 г.AI
ИИ-агенты в продакшене: как метрики уводят от цели

ИИ-агенты в продакшене: как метрики уводят от цели

ИИ-редактор прошёл все проверки, но увёл 50 из 96 статей в нерелевантную тему. Разбираем метрики, которые поощрили дрейф, и новые ограничения.21 сент. 2026 г.AI
Рассылка

Одно письмо, каждое воскресенье.Работающие системы, а не горячие мнения.

Еженедельно. Без спама. Отписка в любой момент.