Обзор Grok 4.5: выгодная цена вместо лидерства в кодинге

Обзор Grok 4.5 с ценами API, бенчмарками и порогом 200K: кому на практике выгодна модель для ИИ-агентов, а кому лучше выбрать Fable 5 или Composer 2.5.

Thursday, September 3, 2026Omid Saffari
Обзор Grok 4.5: выгодная цена вместо лидерства в кодинге

Обзор Grok 4.5 даёт простой вывод: модель стоит $2 за миллион входных токенов и $6 за миллион выходных, но новым лидером в программировании её не назвать. Её стоит выбирать, когда стоимость работы агента и эффективность расхода токенов важнее победы в каждом бенчмарке — при условии, что объём промпта остаётся ниже ценового порога 200K.

Обзор Grok 4.5: вердикт в одной таблице

Grok 4.5 — выгодный компромисс между самой дешёвой моделью для программирования и лидером бенчмарков. Она дороже Cursor Composer 2.5 и уступает Claude Fable 5 в большинстве тестов на собственной инженерной диаграмме SpaceXAI. Однако для долго работающих агентов у неё есть весомый аргумент: внутри Cursor выходные токены стоят $6, а у Fable — $50.

Документация модели SpaceXAI Grok 4.5 с ценами, возможностями и вариантами доступа
Документация модели Grok 4.5

Нагляднее всего сравнивать модели по актуальным тарифам Cursor: собственные модели платформы и передовые сторонние решения здесь сведены к единой системе расчёта. Все цены ниже указаны за миллион токенов.

Модель в CursorДля чего подходит лучше всегоВходные токеныЧтение кэшаВыходные токеныВывод
Grok 4.5Долго работающие агенты с ограниченным бюджетом$2$0.50$6Лучший баланс передовых возможностей и стоимости агента
Composer 2.5Самое дешёвое выполнение типовых задач по программированию$0.50$0.20$2.50Выбирайте, если цена важнее максимальных возможностей
Claude Fable 5Самая высокая доля успешных решений в показанном наборе тестов по программированию$10$1$50Доплата оправданна, когда ошибка обходится дороже токенов
GPT-5.6 SolПродакшен-стеки, построенные вокруг OpenAI$5$0.50$30Более тесная интеграция с экосистемой может оправдать высокую цену

При месячной нагрузке в 10 миллионов новых входных токенов и 2 миллиона выходных расчёт прост: $32 для Grok 4.5, $10 для Composer 2.5, $200 для Claude Fable 5 и $110 для GPT-5.6 Sol. Кроме того, на тарифах Teams и Enterprise Cursor добавляет к сторонним моделям $0.25 за миллион токенов, тогда как собственные Grok и Composer от этой надбавки освобождены.

Именно в Cursor позиционирование Grok 4.5 видно особенно хорошо: это не самая дешёвая модель и не лидер по результатам тестов, а рабочий компромисс между двумя крайностями.

Страница моделей и цен Cursor с тарифами Grok 4.5 и конкурирующих моделей
Цены моделей в Cursor

Таков итог. Чтобы принять окончательное решение, остаётся проверить, соответствует ли этому сценарию именно ваша нагрузка.

Что такое Grok 4.5 и где доступна модель

Grok 4.5 — модель с поддержкой рассуждений для программирования, агентных задач и работы с информацией, а не просто новый режим чата. Cursor и SpaceXAI называют её совместно обученной моделью со смесью экспертов: для каждого токена активируется выбранная группа специализированных компонентов, а не вся сеть целиком.

Запуск прошёл в два этапа. Cursor выпустила Grok 4.5 8 июля, а SpaceXAI объявила о полноценном запуске 16 июля. По данным Cursor, обучающая выборка включала триллионы токенов из взаимодействий разработчиков с агентами, а также задачи по STEM-дисциплинам, научные статьи и более широкий корпус интеллектуальной работы.

Текущий идентификатор модели — grok-4.5. Она принимает текст и изображения, выдаёт текст, располагает контекстным окном на 500,000 токенов и поддерживает низкий, средний или высокий уровень рассуждения; по умолчанию используется высокий. Встроенные инструменты включают вызов функций, веб-поиск, поиск по X и выполнение кода через Responses API или Chat Completions.

Для новой модели охват необычно широк. Она доступна через SpaceXAI API, используется по умолчанию в Grok Build, работает в Cursor на всех тарифах, лежит в основе надстроек для Word, PowerPoint и Excel, а также представлена в OpenRouter, Vercel, Cloudflare, Snowflake и Databricks Mosaic. В экосистеме Cursor модель доступна в настольном и веб-приложениях, на iOS, в CLI и SDK.

Широкая доступность упрощает внедрение, но модель всё равно нельзя путать с продуктами вокруг неё. У Grok 4.5 через прямой API и Grok 4.5 внутри Cursor разные тарифы на кэш, а Grok Build добавляет поверх модели собственный агентный цикл. Экономика прежней версии Grok Build в основном определялась фиксированной подпиской. С Grok 4.5 разговор меняется: и у модели, и у агента теперь появились более прозрачные варианты оплаты по фактическому использованию.

Бенчмарки говорят о выгоде, а не о безусловном лидерстве

Grok 4.5 побеждает в одном из пяти инженерных бенчмарков, показанных SpaceXAI, почти сравнивается с лидерами ещё в одном и уступает Claude Fable 5 в остальных трёх. Назвать её новым чемпионом в программировании можно, только если проигнорировать цифры самого поставщика.

БенчмаркGrok 4.5Лучший показанный результатМесто GrokПрактический вывод
DeepSWE 1.062.0%Fable 5 — 66.1%ТретьеКонкурентоспособна, но не первая
DeepSWE 1.153%Fable 5 — 70%ЧетвёртоеЗаметный разрыв в надёжности
SWE Marathon29.0%Grok 4.5 — 29.0%ПервоеЛучший результат в долгих задачах по устранению проблем
Terminal Bench 2.183.3%Fable 5 — 84.3%Третье, на 0.1 позади GPT-5.5Фактически входит в группу лидеров
SWE Bench Pro64.7%Fable 5 — 80.4%ТретьеПригодна для работы, но значительно отстаёт от лидера

Согласно диаграмме запуска SpaceXAI, показатели конкурентов взяты из системных карточек поставщиков или таблиц лидеров бенчмарков. Поэтому таблица задаёт направление, но не заменяет проверку на вашей нагрузке. Среда выполнения, настройки рассуждения, повторные попытки и лимиты токенов способны изменить результат по программированию настолько, что решение о покупке окажется другим.

Разрывы вполне конкретны. Grok уступает Fable 5 на 4.1 пункта в DeepSWE 1.0, на 17 пунктов в DeepSWE 1.1, на 1 пункт в Terminal Bench 2.1 и на 15.7 пункта в SWE Bench Pro. Уверенная победа приходится на SWE Marathon: результат 29.0% превосходит Opus 4.8 с 26.0% и Fable 5 с 24.0%.

Гораздо убедительнее выглядит заявленная эффективность. По данным SpaceXAI, в одной задаче SWE Bench Pro Grok в среднем генерирует 15,954 выходных токена против 67,020 у Opus 4.8 max — примерно в 4.2 раза меньше. Это данные поставщика, но они указывают на правильную экономическую единицу: завершённую задачу, а не цену отдельного токена на витрине.

Независимые измерения помогают сохранить трезвый взгляд. Artificial Analysis высоко оценивает Grok 4.5 — в 54 балла, тогда как GPT-5.5 xhigh получает 55. При смешанном соотношении кэшированных, входных и выходных токенов 7:2:1 цена Grok составляет $1.35 за миллион токенов против $4.35 у GPT-5.5. В том же актуальном сравнении скорость Grok составила около 70 выходных токенов в секунду против примерно 76 у GPT-5.5.

SpaceXAI заявляет 80 выходных токенов в секунду, тогда как независимое измерение показывает около 70. Сам по себе этот разрыв не означает провала, но напоминает: фактическая скорость зависит от условий обслуживания, а пропускная способность при запуске не равна гарантированному уровню сервиса.

Вывод по бенчмаркам прямолинеен: Grok 4.5 достаточно близка к передовому уровню, чтобы быть экономически интересной, но недостаточно сильна, чтобы заменить контроль качества таблицей с ценами.

Реальная цена Grok 4.5

Заявленная цена Grok 4.5 в $2/$6 верна только для контекста короче 200,000 токенов. После пересечения этого порога SpaceXAI удваивает тарифы на новые входные, кэшированные входные и выходные токены для всего запроса.

Прямой SpaceXAI APIНовые входные токеныКэшированные входные токеныВыходные токены
Контекст короче 200K$2$0.30$6
Контекст 200K и больше$4$0.60$12

Разница принципиальна: контекстное окно на 500,000 токенов говорит о вместимости, а не о низкой цене всей этой вместимости. Запрос с 250K входных токенов и 50K выходных обойдётся в $1.60 по тарифу для длинного контекста. При тарифах короткого контекста те же объёмы стоили бы $0.80. Порог удваивает счёт за токены ещё до учёта веб-поиска, выполнения кода и повторных попыток.

Ценовой порог Grok 4.5 для контекста меньше и больше 200K токенов
После порога 200K все тарифы на токены в прямом запросе удваиваются.

Кэширование, напротив, может снизить расходы. Нагрузка в 10 миллионов новых входных токенов и 2 миллиона выходных стоит $32. Если половина входных данных обслуживается из кэша прямого API, счёт снижается до $23.50: экономия составляет $8.50, или около 26.6%.

Такая экономия не возникает сама собой. SpaceXAI рекомендует задавать prompt_cache_key в Responses API или x-grok-conv-id в Chat Completions, чтобы диалог направлялся на один и тот же сервер. Иначе сервер без прогретого кэша может превратить ожидаемые попадания в кэш в полнотарифные входные токены.

У использования инструментов есть отдельный счётчик. Веб-поиск, поиск по X и выполнение кода стоят по $5 за 1,000 вызовов. Запуск с 25 такими вызовами добавит $0.125 ещё до оплаты токенов модели, связанных с этими вызовами. Поиск по вложениям стоит $10 за 1,000 вызовов, а поиск по коллекциям — $2.50 за 1,000.

Что ломается в продакшене

Первая продакшен-проблема — незаметное изменение цены, а не недостаток интеллекта модели. Промпт размером с репозиторий постепенно переваливает за 200K, весь запрос переходит на тариф длинного контекста, и расчёт стоимости на основе рекламных $2/$6 мгновенно становится неверным.

Вторая проблема — чрезмерный оптимизм насчёт кэша. Повторяющиеся шаги агента выглядят подходящими для кэширования, но тариф $0.30 за входные данные прямого API действует лишь тогда, когда маршрутизация позволяет повторно использовать предыдущий префикс. Явную рекомендацию SpaceXAI по ключу кэша нужно учитывать в биллинге с первого запроса.

Третья — накопление контекста. Долго работающие агенты снова и снова читают планы, результаты инструментов, диффы, тесты и предыдущие объяснения. Окно на 500,000 токенов лишь откладывает проблему; оно не делает разумным хранение каждого старого шага. Для длинных циклов SpaceXAI рекомендует сжатие контекста — замену устаревших деталей компактным рабочим состоянием до того, как агент достигнет ценового порога или потеряет фокус в собственной истории.

Четвёртая — использование бенчмарков поставщика как критерия выпуска. Показанные результаты Grok 4.5 варьируются от первого места в SWE Marathon до отставания на 17 пунктов от Fable 5 в DeepSWE 1.1. Качество в продакшене будет зависеть от вашего репозитория, среды выполнения, покрытия тестами, разрешений инструментов и определения успеха.

Пятая — доступность на конкретной платформе. На актуальной странице Grok 4.5 в Cursor указано, что модель пока недоступна через Cursor в Европейском союзе. Это ограничение Cursor, а не свидетельство блокировки всех каналов SpaceXAI, но его уже достаточно, чтобы команда из ЕС не могла сегодня строить план миграции на Cursor вокруг этой модели.

Кому стоит использовать Grok 4.5, а кому лучше отказаться

Grok 4.5 подходит для чувствительных к цене агентных циклов, которые остаются ниже 200K и способны проверять собственную работу. От неё лучше отказаться, если высокая доля успешных решений в показанных тестах стоит доплаты, если Composer 2.5 уже справляется достаточно хорошо или если ваши пользователи Cursor находятся в ЕС.

Ваш сценарийЧто выбратьПочемуЧто изменит выбор
Долго работающий API-агент, промпты короче 200KGrok 4.5$2 за входные, $0.30 за кэшированные входные и $6 за выходные токеныFable настолько реже ошибается, что её премия окупается
Типовые задачи в Cursor при жёстком лимите расходовComposer 2.5$0.50 за входные и $2.50 за выходные токеныДоля успешных решений Grok настолько сокращает повторы, что компенсирует более высокий тариф
Ошибка намного дороже токеновClaude Fable 5Лидирует в четырёх из пяти показанных бенчмарковGrok сравнивается с ней на вашем репрезентативном наборе задач
В Cursor нужна именно версия FastGrok 4.5 FastДоступна по цене $4 за входные и $18 за выходные токеныСтандартная Grok укладывается в целевую задержку
Запрос регулярно превышает 200KСначала сожмите контекст или измените маршрутизациюТарифы прямого доступа к Grok удваиваются для всего запросаДлинный контекст настолько снижает затраты на поиск данных или оркестрацию, что окупает разницу
Пользователи Cursor находятся в ЕСПодождите или выберите доступную модельCursor отмечает Grok 4.5 как недоступную в регионеCursor изменяет региональный статус
Схема выбора между Grok 4.5, Fable 5, Composer 2.5 и ожиданием
Выбор зависит от стоимости агента, ценности высокой доли успешных решений, скоростного тарифа, размера контекста и региона.
Сильные стороны
Что получается хорошо
8 points

  • Тарифы $2 за входные и $6 за выходные токены делают работу агентов почти передового уровня заметно дешевле, чем с Fable 5 или GPT-5.6 Sol в Cursor.
  • Контекстное окно на 500,000 токенов вмещает крупные репозитории и длинную историю задач.
  • Вызов функций, веб-поиск, поиск по X, выполнение кода, структурированный вывод и два стандартных API-интерфейса упрощают интеграцию.
  • Данные поставщика показывают реальную победу в SWE Marathon и значительно меньший расход выходных токенов по сравнению с Opus 4.8 max в SWE Bench Pro.
  • Grok 4.5 не лидирует в четырёх из пяти инженерных бенчмарков на собственной диаграмме SpaceXAI.
  • Тарифы прямого API на каждый токен удваиваются, как только контекст запроса достигает 200K.
  • Стабильная экономия на кэше требует продуманной маршрутизации.
  • В независимом тесте скорость ниже заявленных поставщиком 80 токенов в секунду, а Cursor раскрыла факт загрязнения одного исключённого бенчмарка.

Как безопасно оценить модель для программирования

Правильный тест внедрения сравнивает завершённую работу при едином уровне качества, а не отдельные промпты. Набор задач, среда агента, разрешения инструментов и критерии приёмки должны быть одинаковыми для всех моделей.

  1. Зафиксируйте репрезентативный набор задач

    Возьмите реальные задачи из той работы, которую собираетесь делегировать: исправление бага с тестами, изменение всего репозитория, исследовательскую задачу с инструментами, а также результат в виде документа или таблицы, если это важно. Определите критерии успеха и провала до того, как модели увидят задания.

  2. Уравняйте настройки рассуждения и контекста

    Используйте одинаковую настройку рассуждения для каждого запуска Grok, записывайте точный размер промпта и оценивайте задачи короче 200K отдельно от длинноконтекстных. Ни одна модель не должна получать дополнительные файлы или другой лимит инструментов.

  3. Сделайте кэширование измеримым

    Задайте prompt_cache_key или x-grok-conv-id для повторяющихся диалогов. Учитывайте новые и кэшированные входные данные раздельно, чтобы сравнение стоимости отражало воспроизводимый счёт.

  4. Оценивайте экономику завершённой задачи

    Фиксируйте долю успешных решений, ручные исправления, повторные попытки, общее число токенов, вызовы инструментов и затраченное время. Внедряйте Grok, только если цена принятого результата ниже, чем у текущей модели, без снижения требований к выпуску.

Для основателя стартапа с финансированием таким критерием может быть время разработчика на ревью. Для технического директора средней компании — дефекты, дошедшие до продакшена, и возможность аудита. Для опытного руководителя — прохождение фактологической проверки результатом в Excel или исследовательским отчётом. Для самостоятельного технического специалиста — позволяет ли более низкий тариф завершать больше работы, не превращая проверку агента во вторую работу.

Часто задаваемые вопросы

Насколько хороша Grok 4.5?

Она хороша, когда нужны сильные агентные возможности при меньшей стоимости токенов. Но это не самый безопасный выбор по умолчанию для максимальной точности программирования: Fable 5 лидирует в четырёх из пяти инженерных бенчмарков, показанных SpaceXAI, тогда как главное преимущество Grok — экономичная работа над долгими задачами.

Сколько стоит Grok 4.5?

В прямом SpaceXAI API миллион новых входных токенов стоит $2, кэшированных входных — $0.30, а выходных — $6 при контексте короче 200K. При 200K и больше тарифы для всего запроса составляют $4, $0.60 и $12 соответственно. В собственном пуле Cursor указаны цены $2 за входные токены, $0.50 за чтение кэша и $6 за выходные.

Где можно использовать Grok 4.5?

SpaceXAI указывает доступ через собственный API, Grok Build, Cursor, Word, PowerPoint, Excel, OpenRouter, Vercel, Cloudflare, Snowflake и Databricks Mosaic. Cursor поддерживает модель в настольном и веб-приложениях, на iOS, в CLI и SDK, но сейчас отмечает её как недоступную в Европейском союзе.

Нужен чек-лист по настройке Claude Code и Codex? Получите его в рассылке.

Последнее обновление

3 сент. 2026 г.

КатегорияAI

Сделать этот сайт предпочтительным в Google

Добавить omidsaffari.com как предпочтительный источник в Google Поиске

Отметьте omidsaffari.com как предпочтительный источник — и Google будет поднимать его для вас в Top Stories, AI Overviews и AI Mode.

Рассылка

Одно письмо, каждое воскресенье. Работающие системы, а не горячие мнения.

Билд-логи, системы в продакшене и полевые заметки из портфеля ИИ-проектов.

Еженедельно. Без спама. Отписка в любой момент.