Цены DeepSeek в 2026 году: бесплатный чат и API дешевле $1 за 1 млн токенов
Подробно разбираем цены DeepSeek: бесплатный чат, тарифы API V4 Flash и V4 Pro, кэширование, возвраты, точку окупаемости и альтернативы на 2026 год.

DeepSeek предлагает чат за $0. Цены DeepSeek API зависят от объёма использования: для V4 Flash ввод стоит $0.14, а вывод — $0.28 за миллион токенов; для V4 Pro — $0.435 и $0.87 соответственно. Правило выбора простое: личные задачи решайте в бесплатном чате, для основной нагрузки в продакшене используйте Flash, а за Pro платите лишь тогда, когда сокращение повторных попыток оправдывает разницу в цене 3.11x.
Цены DeepSeek: главное в одной таблице
У DeepSeek есть один бесплатный продукт для обычных пользователей и две платные API-модели. Самостоятельно подключаемой месячной или годовой подписки на API нет: стоимость токенов списывается с баланса аккаунта по мере использования.
Эти цены сверены с актуальной страницей DeepSeek Models & Pricing 12 августа 2026 года.

Токен — единица тарификации модели, а не запрос или слово. Ввод включает всё, что отправляется модели: инструкции, историю, документы и контекст инструментов. Вывод — всё, что возвращает модель. При попадании в кэш DeepSeek повторно использует уже обработанный ввод и применяет более низкую ставку; при промахе ввод обрабатывается полностью и оплачивается по обычной цене.
Обе API-модели поддерживают контекстное окно в 1M токенов и максимальный вывод 384K. Поэтому внутри DeepSeek не приходится доплачивать за длинный контекст, как это часто бывает у других провайдеров. Рабочие лимиты различаются: для V4 Flash заявлено 2,500 одновременных запросов, для V4 Pro — 500.
Чат DeepSeek бесплатный, но API оплачивается отдельно
Пользовательское приложение DeepSeek ничего не стоит. В официальном анонсе приложения сказано, что оно на 100% бесплатное, без рекламы и встроенных покупок; на нынешней главной странице доступ к чату также указан как бесплатный.
Но бесплатный чат не означает бесплатный API. Пользовательское приложение — интерфейс для человека, а API — тарифицируемый продукт, к которому обращаются программы. Плата за использование API DeepSeek списывается с предоставленного или пополненного баланса. Поэтому бесплатный аккаунт в чате не делает программный трафик бесплатным.
Такое разделение продуктов встречается и у других сервисов: подписка на приложение и оплата API могут существовать под одним брендом, оставаясь разными продуктами, как показано в разборе цен Perplexity. У DeepSeek граница ещё очевиднее: для приложения не заявлена цена подписки, тогда как для каждого типа API-токенов предусмотрена отдельная ставка.
Кому вообще не придётся платить
Платить не нужно, если вы пользуетесь DeepSeek время от времени, взаимодействуете с ним вручную и вам достаточно официального сайта или мобильного приложения. Сюда относятся личные вопросы, разовые тексты, обсуждение документов и задачи студентов, которым не требуется подключать DeepSeek к другому продукту.
На страницах с ценами, FAQ и описанием приложения, проверенных для этого обзора, DeepSeek не указывает отдельный студенческий тариф или скидку. Для обычного пользовательского доступа они и не нужны: он уже стоит $0.
Граница проходит по автоматизации. Как только CRM, службе поддержки, внутреннему инструменту или клиентскому продукту нужно обращаться к DeepSeek без человека, открывающего приложение, в бюджет необходимо заложить токены API. Не стоит считать бесплатный чат производственной инфраструктурой: страница приложения не обещает неограниченную мощность и не публикует гарантии уровня сервиса.
V4 Flash — основная модель для продакшена, V4 Pro — для сложных случаев
В большинстве производственных сценариев первый запрос стоит направлять в DeepSeek V4 Flash-0731. Эта модель дешевле, поддерживает больше одновременных запросов и сейчас совместима с большим числом способов интеграции.
V4 Flash-0731
Для V4 Flash миллион входных токенов стоит $0.14 при промахе кэша и $0.0028 при попадании в кэш, а миллион выходных токенов — $0.28. Модель поддерживает режимы с рассуждением и без него, вывод JSON, вызовы инструментов, Anthropic-совместимый API DeepSeek и Responses API. На актуальной странице указаны контекстное окно 1M, максимальный вывод 384K и 2,500 одновременных запросов.
Поэтому Flash разумно использовать для классификации, извлечения данных, суммаризации, подготовки первых черновиков, типовых изменений кода и ограниченных шагов ИИ-агентов. Для таких задач можно задать понятные критерии приёмки, обнаружить неудачный результат и отправить его на следующий уровень, не позволив дешёвой ошибке дойти до клиента.
Не оставляйте Flash единственным маршрутом, если ошибка дорого обходится и её трудно заметить. Для юридических, финансовых или влияющих на клиента рекомендаций нельзя выбирать модель только по цене токенов. Низкая ставка даёт возможность провести больше проверок, но не заменяет их.
V4 Pro
Для V4 Pro миллион входных токенов стоит $0.435 при промахе кэша и $0.003625 при попадании, а миллион выходных токенов — $0.87. Модель предлагает то же контекстное окно 1M, максимальный вывод 384K, режимы рассуждения, вывод JSON, вызовы инструментов и Anthropic-совместимый формат. Заявленный лимит одновременных запросов — 500.
Pro предназначен для сложного хвоста задач: неоднозначного запроса, комплексного плана, трудной задачи по программированию или второй попытки после того, как Flash не прошёл детерминированную проверку. Одно лишь слово Pro в названии не делает эту модель выбором по умолчанию.
В актуальной таблице есть и ограничение интеграции. Сейчас DeepSeek указывает поддержку Responses API для Flash, но не для Pro. На странице по-прежнему сказано, что поддержка Pro планировалась на начало августа 2026 года, однако по состоянию на 12 августа она всё ещё отсутствует. Если приложение зависит от этой конечной точки, цена токенов Pro не имеет значения, пока нужная интеграция недоступна.
- Пользовательское приложение стоит $0, в нём нет рекламы и встроенных покупок.
- Все актуальные ставки API ниже $1 за миллион токенов.
- Обе API-модели имеют контекстное окно 1M и максимальный вывод 384K.
- Автоматическое кэширование контекста способно заметно удешевить повторяющиеся префиксы.
- V4 Flash сочетает минимальную цену, более широкую поддержку конечных точек и более высокий лимит одновременных запросов.
- DeepSeek предупреждает о предстоящем значительном повышении цен API, но не называет ни величину, ни дату.
- Попадание в кэш не гарантируется и происходит по принципу best effort.
- Для промахов кэша и вывода ценовой коэффициент V4 Pro к Flash составляет примерно 3.11x.
- У V4 Pro заявлена лишь пятая часть лимита одновременных запросов Flash, а текущей поддержки Responses API нет.
- Для бесплатного чата не опубликованы обещание неограниченной мощности или гарантии уровня сервиса.
Токены DeepSeek стоят очень дёшево, но важна цена принятого результата
Расходы на сам API настолько малы, что одна лишняя ручная проверка может стоить дороже тысяч обращений к модели. Полезно считать не цену одного запроса, а стоимость принятого результата.
Для запроса без попаданий в кэш формула выглядит так:
cost = input tokens / 1,000,000 × input rate + output tokens / 1,000,000 × output rate
При 1,000 токенов ввод V4 Flash с промахом кэша стоит $0.00014, а вывод — $0.00028. Для V4 Pro те же показатели равны $0.000435 и $0.00087.
Возьмём процесс подготовки ответов службы поддержки: на каждый ответ приходится 2,000 входных и 500 выходных токенов. Для 1,000 ответов без попаданий в кэш Flash обойдётся в $0.42, а Pro — в $1.305. Вся доплата за Pro составит $0.885 на тысячу ответов.
Теперь добавим трудозатраты. Пять минут проверки при условной ставке $60 в час стоят $5. Одна дополнительная проверка обходится дороже пяти полных пакетов такой доплаты за Pro. Поэтому правильный вопрос звучит не «У какой модели ниже ставка?», а «Какой маршрут проходит проверку приёмки с минимальными суммарными расходами на модель и проверку человеком?»
Как выглядит месячный счёт за DeepSeek
У DeepSeek нет ежемесячной платы за пользовательское место, с которой можно было бы сравнить подписку на ПО. Месячная стоимость определяется исключительно характером трафика: сколько контекста поступает на вход, сколько текста генерируется, как часто префиксы попадают в кэш и сколько попыток требуется для принятого результата.
Если прототип одного разработчика за месяц использует 10M входных токенов с промахом кэша и 2M выходных, Flash будет стоить $1.96, а Pro — $6.09. Разница в $4.13 не определит судьбу продукта. Важнее, какая модель выдаст корректный результат с меньшими затратами на отладку.
Для службы поддержки, которая готовит 100,000 ответов по 2,000 входных и 500 выходных токенов, счёт без кэширования составит $42.00 для Flash или $130.50 для Pro. При условной доле попаданий входных токенов в кэш 80% суммы снизятся до $20.048 и $61.48. Даже при таком объёме один час ручной проверки может оказаться дороже всего месячного счёта за Flash, если исходить из ставки $60 в час.
Для 1,000 задач по анализу документов, каждая из которых использует 50,000 входных и 2,000 выходных токенов, счёт без кэша равен $7.56 для Flash или $23.49 для Pro. Если 80% входных токенов попадают в кэш, суммы снижаются до $2.072 и $6.235. Большой объём ввода сам по себе не означает крупный счёт DeepSeek: повторяющийся длинный контекст способен сделать стоимость единицы работы необычайно низкой.
Эти примеры показывают и другое: фиксированная месячная оценка, скопированная у другой компании, бесполезна. В ответе службы поддержки доля вывода относительно промпта велика, а в задаче обработки документов преобладает ввод. ИИ-агент способен умножить оба показателя за счёт повторных попыток и циклов инструментов. Сохраняйте структуру токенов рядом с суммой в долларах — тогда финансовая команда поймёт, что изменило расходы: трафик, качество или ставка поставщика.
Когда переход с Flash на Pro окупается
Ставки V4 Pro для входа с промахом кэша и для вывода в 3.107143 раза выше ставок Flash, или 3.11x после округления. При одинаковой структуре токенов Pro должна сократить число оплачиваемых попыток или объём токенов на 67.82%, чтобы сравняться с Flash только по расходам на модель.
Если Pro выполняет задачу с одной попытки, Flash может в среднем сделать до 3.11 сопоставимых попыток, прежде чем её счёт за токены станет выше. Если Flash справляется за одну или две попытки, ценовое сравнение остаётся не в пользу Pro. Если же Flash постоянно требуется четыре попытки, Pro выигрывает ещё до учёта ручной проверки.

Такой принцип маршрутизации предотвращает распространённую ошибку при закупке. Команда видит ставки ниже одного доллара, направляет все задачи в Pro и считает итоговую сумму небольшой. Абсолютные расходы действительно могут остаться низкими, но неизмеряемая доплата на миллионах запросов — это не стратегия. Flash должна обрабатывать основную массу задач с чёткими границами, а Pro — те неудачные случаи, где более высокая цена оправданна.
Кэширование контекста снижает счёт только при точном повторении префиксов
Низкая ставка при попадании в кэш DeepSeek выгодна, но её нельзя заранее закладывать в таблицу как гарантированную скидку. В руководстве по кэшированию контекста сказано, что кэширование включено по умолчанию, работает с полными сохранёнными блоками префикса и предоставляется по принципу best effort.
Стабильный системный промпт, за которым следует неизменный справочный документ, — хороший кандидат для кэша. Следующий запрос может повторно использовать это начало и добавить новый вопрос. Совпадения фразы в середине другого промпта недостаточно: целиком должен совпасть блок префикса, который сохранил DeepSeek.
Важно учитывать и срок жизни кэша. Запись создаётся за секунды, а при отсутствии обращений обычно удаляется через несколько часов или дней. Еженедельный отчёт может не застать запись, на которую попала бы серия почти одинаковых запросов. DeepSeek не гарантирует 100% попаданий.
При условной доле попаданий входных токенов в кэш 80% смешанная стоимость миллиона входных токенов снижается до $0.03024 для Flash и $0.08990 для Pro. В примере с 1,000 ответов службы поддержки общая сумма уменьшается с $0.42 до $0.20048 для Flash и с $1.305 до $0.61480 для Pro.
В этой нагрузке, где есть и выходные токены, итоговый счёт сокращается примерно вдвое, а не почти полностью, как можно подумать при изолированном сравнении ставок ввода с попаданием и промахом кэша. На выходные токены скидка за кэширование ввода не распространяется.
Сохраняйте префикс неизменным
Сначала размещайте постоянные инструкции и повторяющиеся справочные материалы. Изменяющийся запрос пользователя добавляйте после стабильного префикса, не перестраивая каждый раз порядок промпта.
Проверяйте поля использования
Отслеживайте
prompt_cache_hit_tokensиprompt_cache_miss_tokensв ответах API. Прогнозируемая доля попаданий станет фактом для расчёта расходов, только когда её подтвердят эти поля.Считайте стоимость по фактической структуре
Разделите измеренный ввод на токены с попаданием и промахом кэша, добавьте выходные токены и рассчитайте стоимость принятого результата. Пересчитывайте её при изменении структуры промптов или ритма трафика.
DeepSeek дешевле других API из короткого списка — до поправки на качество
По стоимости токенов DeepSeek опережает конкурентов с большим отрывом. Но это не гарантирует лучший результат для бизнеса: модели различаются возможностями, инструментами, задержкой и частотой ошибок.
Чтобы сравнить заявленные цены, возьмём одну нормализованную нагрузку: всего 1M входных токенов плюс 250K выходных, без скидки за кэширование. Такая нагрузка стоит $0.21 на V4 Flash и $0.6525, то есть $0.65 после округления, на V4 Pro.
OpenAI GPT-5.6 Sol стоит $5 за миллион входных и $30 за миллион выходных токенов. Нормализованная нагрузка обойдётся в $12.50, если каждый запрос остаётся ниже порога длинного контекста OpenAI; ценовой коэффициент к V4 Pro — 19.16x. Для промптов объёмом более 272K входных токенов ко всему запросу применяются ставки 2x за ввод и 1.5x за вывод, а запись кэша стоит 1.25x от ввода без кэша.
Claude Sonnet 5 стоит $2 за миллион входных и $10 за миллион выходных токенов. Та же нагрузка обойдётся в $4.50, а ценовой коэффициент к V4 Pro составит 6.90x. Anthropic включает контекстное окно 1M в стандартную цену и предлагает скидку 50% в Batch, поэтому для задач, допускающих задержку, разрыв можно сократить.
Gemini 3.1 Pro Preview стоит $2 за миллион входных и $12 за миллион выходных токенов, если промпт не превышает 200K. Нормализованная совокупная нагрузка обойдётся в $5.00, если каждый запрос остаётся в этих границах; ценовой коэффициент к V4 Pro — 7.66x. Если поместить всю нагрузку в один запрос размером более 200K, ставки Google вырастут до $4 за ввод и $18 за вывод, а счёт составит $8.50 с коэффициентом 13.03x к V4 Pro.

Разница в коэффициентах велика, но абсолютная разница в долларах выглядит скромнее. Переход с V4 Pro на GPT-5.6 Sol добавляет к нормализованной нагрузке $11.8475. Одна ручная правка может свести эту экономию на нет, тогда как на надёжном маршруте с большим объёмом она способна накапливаться.
Обратитесь к сравнению DeepSeek и ChatGPT, если качество моделей, функции продуктов и работа с данными важнее таблицы цен на токены. Изучите список самых дешёвых ИИ API, если задаче подходят небольшие бюджетные модели и шлюзы. Страница с ценами позволяет нормализовать ставки; нормализовать результаты способна только ваша собственная оценка.
Главный риск для бюджета — изменение цен, а не годовой контракт
На актуальной странице DeepSeek сказано, что в ближайшем будущем планируется общее повышение цен API и что оно будет значительным. Ни величина, ни дата не опубликованы. Сегодняшние ставки — проверенные факты; любой будущий коэффициент остаётся предположением.
Это предупреждение меняет подход к закупке. Не обещайте клиенту, совету директоров или финансовой команде, что августовская ставка сохранится на год. Указывайте дату проверки страницы цен рядом с каждой бюджетной моделью, храните ставку как редактируемый параметр и заранее определите изменение цены, при котором трафик будет перенаправлен.
Месячной или годовой ловушки в API нет
DeepSeek списывает плату за токены и не предлагает самостоятельный месячный тариф за место или годовой контракт. Пополненный баланс не сгорает. Предоставленный баланс может иметь срок действия, который отображается на странице Billing. Если доступны оба вида баланса, API сначала расходует предоставленный.
Согласно официальному FAQ, неиспользованный баланс можно вернуть через Billing > Refunds. Поэтому умеренное пополнение несёт меньше риска, чем невозвратное годовое обязательство. Исключение — удаление аккаунта: FAQ предупреждает, что в этом случае оставшийся баланс Open Platform будет потерян.
DeepSeek также не создаёт неожиданной задолженности за превышение лимита. Если средств недостаточно, API возвращает HTTP 402 и предлагает пополнить баланс. Операционный риск здесь — остановка работы, а не счёт, незаметно вышедший за рамки тарифа. Настройте уведомление о балансе до того, как производственный трафик первым обнаружит эту границу.
Интеграция и параллельность могут стоить дороже токенов
Для Flash заявлены 2,500 одновременных запросов и текущая поддержка Responses API. Для Pro — 500 запросов и отсутствие текущей поддержки Responses API. Если спроектировать систему вокруг Pro, не проверив эти ограничения, можно понести затраты на очереди, резервную логику или интеграцию, даже когда счёт за модель остаётся ниже одного доллара за миллион токенов.
Самая дешёвая из безопасных архитектур позволяет легко менять маршрут. Используйте единый внутренний интерфейс, записывайте выбранную модель и расход токенов, а также сохраняйте проверенный резервный вариант. Предупреждение DeepSeek о повышении цен превращает обычную инженерную дисциплину в инструмент бюджетного контроля.
История цен DeepSeek: разделение Flash и Pro
С выходом V4 не каждая ставка снизилась одинаково. В нынешней системе тарифов цена Flash резко уменьшилась, тогда как для Pro сохранилась более высокая стоимость входа при промахе кэша.
В анонсе цен V3 компания DeepSeek указывала $0.07 за миллион входных токенов при попадании в кэш, $0.27 при промахе и $1.10 за миллион выходных токенов. По сравнению с этими ставками у V4 Flash ввод с попаданием в кэш дешевле на 96.00%, ввод с промахом — на 48.15%, а вывод — на 74.55%.
У V4 Pro динамика иная. Ввод с попаданием в кэш подешевел на 94.82%, а вывод — на 20.91%, но цена ввода с промахом $0.435 на 61.11% выше ставки V3 в $0.27.
Эта история объясняет нынешнее правило выбора. Flash — не просто модель с менее статусным названием, а тариф для массовой нагрузки. Pro должна оправдать более высокую ставку без кэша лучшими результатами. Предстоящее повышение может изменить ставки обеих моделей, поэтому дата проверки должна храниться рядом с расчётами.
Что сделать в понедельник: измерить один маршрут до переноса бюджета
В понедельник возьмите 100 обезличенных запросов из одного процесса с чёткими границами и проведите недельный тест маршрутизации. Не начинайте с миграции всей компании.
Сначала определите критерии приёмки
Выберите результат, который проверяющий сможет оценивать единообразно: корректная схема, верная классификация, пройденные тесты или одобренный черновик ответа службы поддержки. Удалите из набора для оценки клиентские, персональные и конфиденциальные данные.
Отправьте основную нагрузку в Flash
Проведите все 100 запросов через V4 Flash-0731. Для каждого запишите ввод, вывод, попадания и промахи кэша, повторные попытки, задержку и результат приёмки.
Передавайте выше только неудачные случаи
Отправьте в V4 Pro запросы с ошибками или неоднозначным результатом. Измерьте, достаточно ли Pro сокращает сложный хвост, чтобы окупить ставку модели 3.11x и возможное время ручной проверки.
Установите два бюджетных порога
Оставляйте Flash моделью по умолчанию, только пока она проходит минимальный порог качества. Оставляйте DeepSeek провайдером, только пока актуальная нормализованная стоимость остаётся ниже цены проверенного резервного решения после любого повышения.
Результатом теста станет один показатель, по которому можно принимать решение: стоимость принятого результата. Он превращает крошечные ставки DeepSeek за токены в бюджет процесса, который финансовая команда сможет пересматривать без повторного анализа с нуля.
Частые вопросы
DeepSeek платный или бесплатный?
Официальное пользовательское приложение DeepSeek бесплатно, в нём нет рекламы и встроенных покупок. Доступ к API оплачивается отдельно: тарифицируются входные токены с попаданием и промахом кэша, а также выходные токены.
Сколько стоит DeepSeek V4 Pro?
Для V4 Pro миллион входных токенов стоит $0.003625 при попадании в кэш и $0.435 при промахе, а миллион выходных токенов — $0.87. Контекстное окно модели составляет 1M, максимальный вывод — 384K, заявленный лимит одновременных запросов — 500.
Сколько стоит DeepSeek в месяц?
Пользовательский чат стоит $0 в месяц. У API нет фиксированной месячной цены: умножьте месячное число входных токенов с попаданием и промахом кэша, а также выходных токенов на соответствующие ставки за миллион.
Почему DeepSeek дешевле ChatGPT?
Если сравнивать только цены для нагрузки из 1M входных и 250K выходных токенов, DeepSeek V4 Pro стоит около $0.65, а OpenAI GPT-5.6 Sol — $12.50 ниже порога длинного контекста, то есть разница составляет 19.16x. Сравнивайте принятые результаты, а не только токены: качество моделей и поддержка инструментов различаются.
Есть ли у DeepSeek скидка для студентов?
На официальных страницах цен, FAQ и приложения, проверенных в августе 2026 года, DeepSeek не указывает отдельный студенческий тариф или скидку. Студенты уже платят $0 за пользовательский сайт или мобильное приложение.
Можно ли вернуть деньги из DeepSeek?
Да, неиспользованный баланс API можно вернуть через Billing > Refunds. Пополненный баланс не сгорает, а предоставленный может иметь срок действия. При удалении аккаунта оставшийся баланс Open Platform будет потерян.
Изменились ли цены DeepSeek в 2026 году?
Да. По сравнению с прежними ставками V3 у V4 Flash ввод с промахом кэша подешевел на 48.15%, а вывод — на 74.55%. Вывод V4 Pro подешевел на 20.91%, но ввод с промахом подорожал на 61.11%. Теперь DeepSeek предупреждает о ещё одном значительном повышении, не называя его величину или дату.
Что выбрать: V4 Flash или V4 Pro?
Используйте Flash для основной нагрузки с чёткими границами, а Pro — для неудачных случаев и задач с серьёзными последствиями. Чтобы сравняться по стоимости модели без кэша, Pro должна сократить число оплачиваемых попыток или токенов примерно на 67.82%, поскольку разница в ставках составляет 3.11x в пользу Flash.
Получите карту ИИ-инструментов для бизнеса
Карта ИИ-инструментов для бизнеса превращает цены моделей в практический набор решений с порогом качества, ролью в маршрутизации и ценовым условием для каждого инструмента. Подпишитесь и получите следующий выпуск бесплатно.
3 сент. 2026 г.







