DeepSeek 价格(2026):免费聊天,API 每百万 Token 不到 $1
详解 DeepSeek 价格:聊天服务是否免费,V4 Flash 与 V4 Pro 的 API 输入、输出及缓存费率。用真实用量示例比较月度账单、缓存节省、Flash 升级 Pro 的 3.11x 盈亏平衡点,以及与 OpenAI、Claude、Gemini 的成本差距,帮你按每个合格结果的成本选择模型,避开涨价风险。

DeepSeek 价格并不复杂:DeepSeek 聊天服务为 $0;API 按用量收费,V4 Flash 每百万 Token 的输入与输出价格分别为 $0.14 和 $0.28,V4 Pro 则为 $0.435 和 $0.87。选择逻辑也很清楚:个人聊天继续免费使用;生产任务默认交给 Flash;只有当 Pro 能显著减少重试、足以抵消 3.11x 的价差时,才值得为它付费。
DeepSeek 价格一览
DeepSeek 面向个人用户提供一款免费产品,同时提供两款收费 API 模型。其自助式 API 没有月付或年付订阅,系统会根据实际 Token 用量从账户余额中扣费。
以下数据已于 2026年八月12日对照 DeepSeek 实时 Models & Pricing 页面核实。

Token 是模型的计费单位,不等同于一次请求或一个单词。输入包括发送给模型的全部内容,如指令、历史记录、文档和工具上下文;输出则是模型返回的全部内容。如果 DeepSeek 能复用重复输入,就是按较低费率计价的缓存命中;必须完整处理输入时,则属于按全价计费的缓存未命中。
两款 API 模型都提供 1M Token 上下文窗口和 384K 最大输出,因此在 DeepSeek 内部通常无须为长上下文额外付费。两者的运行限制不同:V4 Flash 标注的并发请求数为 2,500,V4 Pro 则为 500。
DeepSeek 聊天免费,但 API 单独收费
DeepSeek 的消费者应用不收费。其官方应用公告明确表示应用 100% 免费、无广告、无应用内购买;当前官网首页仍将聊天服务描述为免费。
但聊天免费不代表 API 免费。消费者应用是供真人操作的界面,API 则是供软件调用、按量计费的产品。DeepSeek API 会从赠送余额或充值余额中扣除用量,因此,拥有免费聊天账户并不会让程序化调用也变成免费。
其他厂商也常采用这种产品拆分:应用订阅和 API 计费可以共用一个品牌,却仍是两项独立产品,Perplexity 价格解析便是如此。DeepSeek 的区分更直观,因为应用没有公布订阅价格,而 API 的每类 Token 都有明确价目。
哪些用户完全不必付费
如果只是通过官方网页或移动应用偶尔交互,而且功能已经够用,就完全无须付费。个人问答、临时写作、文档讨论,以及不需要把 DeepSeek 接入其他产品的学生,都属于这种情况。
在本次评测核实的价格页、FAQ 和应用页面中,DeepSeek 均未公布学生专属套餐或优惠。普通消费者本就可以 $0 使用,因此也不需要额外的学生方案。
真正的分界线是自动化。一旦 CRM、客服工作流、内部工具或面向客户的产品需要在无人打开应用的情况下调用 DeepSeek,就应为 API Token 编列预算。同时,不要把免费聊天当作生产基础设施:免费应用页面既未承诺无限容量,也没有公布服务等级。
V4 Flash 是生产默认选项,V4 Pro 负责升级处理
多数生产路由都应先把请求交给 DeepSeek V4 Flash-0731。它价格更低、标注的并发上限更高,而且当前支持的集成范围更广。
V4 Flash-0731
V4 Flash 每百万 Token 的缓存未命中输入价格为 $0.14,缓存命中输入为 $0.0028,输出为 $0.28。它支持思考与非思考模式、JSON 输出、工具调用、DeepSeek 的 Anthropic 兼容 API,以及 Responses API。实时页面标注其上下文窗口为 1M,最大输出为 384K,并发请求数为 2,500。
这组能力很适合分类、抽取、摘要、初稿生成、常规代码修改和边界明确的 Agent 步骤。这些任务都有清晰的验收标准,输出失败时可以被检测并升级处理,不必让廉价模型的一次错误直接触达客户。
如果失败代价高且难以发现,就不要把 Flash 作为唯一通道。法律、财务或可能影响客户的建议,不能只按 Token 价格选择模型。低价能为评测留出空间,却不能替代评测本身。
V4 Pro
V4 Pro 每百万 Token 的缓存未命中输入价格为 $0.435,缓存命中输入为 $0.003625,输出为 $0.87。它同样提供 1M 上下文窗口、384K 最大输出,并支持相同的思考模式、JSON 输出、工具调用和 Anthropic 兼容格式。页面标注的并发上限为 500。
Pro 适合处理高难度长尾:含义模糊的请求、复杂规划、棘手的编程任务,或 Flash 未通过确定性检查后的第二次尝试。不能只因为名称中有 Pro,就把它设为默认模型。
实时表格里还藏着一项集成限制。DeepSeek 目前只为 Flash 标注了 Responses API 支持,Pro 尚不支持。页面仍写着 Pro 计划在 2026年八月上旬获得支持,但截至八月12日,实时状态依然是不支持。如果应用依赖该端点,那么在集成可用之前,Pro 的 Token 价格没有实际意义。
- 消费者应用价格为 $0,无广告,也无应用内购买。
- 当前所有 API 费率都低于每百万 Token $1。
- 两款 API 模型都提供 1M 上下文窗口和 384K 最大输出。
- 自动上下文缓存可大幅降低重复前缀的成本。
- V4 Flash 同时具备最低费率、更广的端点支持和更高的并发上限。
- DeepSeek 预告 API 将大幅涨价,却没有公布幅度或日期。
- 缓存命中采用尽力而为机制,并不保证成功。
- V4 Pro 的缓存未命中输入与输出成本约为 Flash 的 3.11x。
- V4 Pro 标注的并发能力只有 Flash 的五分之一,目前也不支持 Responses API。
- 免费聊天没有公开承诺无限容量或服务等级。
DeepSeek API 费用很低,但最终要看每个合格结果的成本
API 的原始开销很小,一次本可避免的人工审核,成本就可能超过数千次模型调用。因此,真正有用的指标不是单次请求成本,而是每个合格结果的成本。
对于没有缓存命中的请求:
cost = input tokens / 1,000,000 × input rate + output tokens / 1,000,000 × output rate
以 1,000 Token 计算,V4 Flash 的缓存未命中输入成本为 $0.00014,输出成本为 $0.00028;V4 Pro 的缓存未命中输入成本为 $0.000435,输出成本为 $0.00087。
假设一个客服回复起草工作流,每条回复使用 2,000 输入 Token 和 500 输出 Token。处理 1,000 条回复且没有缓存命中时,Flash 成本为 $0.42,Pro 为 $1.305。每千条回复采用 Pro 的全部溢价仅为 $0.885。
再把人工加入计算。按示例时薪 $60 计算,审核五分钟就是 $5。一次额外审核的成本,就超过上述 Pro 溢价的五个完整批次。因此,正确的问题不是“哪款模型的价目更低?”,而是“哪条路由能以最低的模型支出加审核时间通过验收?”
DeepSeek 每月账单会是多少
DeepSeek 没有可与软件订阅比较的按席位月费。月度成本只取决于流量结构:输入多少上下文、输出多少文本、前缀多久命中一次缓存,以及每得到一个合格结果需要尝试多少次。
假设个人产品原型一个月使用 10M 缓存未命中输入 Token 和 2M 输出 Token,Flash 成本为 $1.96,Pro 为 $6.09。两者相差的 $4.13 不会决定产品能否存活;调试更少、能产出有效结果的模型才会。
对于一项客服业务,若起草 100,000 条回复,每条使用 2,000 输入 Token 和 500 输出 Token,未缓存账单为 Flash $42.00、Pro $130.50。若输入缓存命中率示例值为 80%,总额会降至 $20.048 和 $61.48。即使达到这一规模,按每小时 $60 的假设计算,一小时人工审核也可能超过 Flash 的整月账单。
对于 1,000 个文档分析任务,若每个任务使用 50,000 输入 Token 和 2,000 输出 Token,未缓存账单为 Flash $7.56、Pro $23.49。若 80% 的输入命中缓存,则分别降至 $2.072 和 $6.235。长输入不必然带来高额 DeepSeek 账单;长输入重复出现时,单位经济性反而可能低得出奇。
这些例子也说明,照搬另一家公司的固定月度估算毫无意义。与提示词相比,客服回复的输出占比更高;文档任务则偏重输入;Agent 还会通过重试和工具循环放大两者。应把 Token 结构与金额一起保存,这样财务团队才能判断变化来自流量、质量,还是供应商费率。
Flash 升级到 Pro 的盈亏平衡点
V4 Pro 的缓存未命中输入和输出费率都是 Flash 的 3.107143 倍,四舍五入为 3.11x。在 Token 结构相同的情况下,Pro 必须将计费尝试次数或 Token 用量减少 67.82%,才能仅从模型费用上实现盈亏平衡。
如果 Pro 一次就能完成任务,那么 Flash 平均最多可以尝试 3.11 次,之后其 Token 账单才会更高。Flash 若一两次便成功,Pro 在价格比较中就会落败;Flash 若反复需要四次尝试,Pro 即使不计人工审核也更划算。

这套路由规则还能避免一个常见的采购错误:团队看到费率低于一美元,便把全部任务都发给 Pro,再把总成本称为便宜。绝对账单或许仍不高,但在数百万次调用上支付未经衡量的溢价,并不算策略。Flash 应承担边界明确的基础负载,Pro 只负责能证明自身价值的失败任务。
只有前缀真正重复,上下文缓存才会改变账单
DeepSeek 的缓存命中费率很有价值,但不能在表格里默认它一定生效。上下文缓存指南说明,缓存默认开启,以完整的已持久化前缀单元工作,并采用尽力而为机制。
稳定的系统提示词后接稳定的参考文档,是很好的缓存候选。后续请求可以复用这段开头,再追加新问题。只是在另一条提示词的中段复用某个短语并不符合条件;完整前缀必须与 DeepSeek 已持久化的单元一致。
缓存还受时间影响。构建缓存需要数秒,未使用的条目通常会在数小时到数天内被清除。每周一次的报告可能无法命中缓存,而短时间涌入的大量近似请求则可能命中。DeepSeek 不保证 100% 的命中率。
按示例值 80% 的输入缓存命中率计算,每百万 Token 的混合输入成本会降至 Flash $0.03024、Pro $0.08990。在前述 1,000 条客服回复的示例中,总成本会从 Flash $0.42 降至 $0.20048,从 Pro $1.305 降至 $0.61480。
对于这种包含输出的工作负载,总账单大致减半,并非只比较缓存命中和未命中输入费率时看起来的近乎归零。输出 Token 不享受输入缓存优惠。
保持前缀稳定
把长期有效的指令和重复使用的参考资料放在最前面,再把不断变化的用户请求追加到稳定前缀之后,不要每次都换一种顺序重建提示词。
读取用量字段
跟踪 API 响应中的
prompt_cache_hit_tokens和prompt_cache_miss_tokens。只有这些字段显示了命中,预测命中率才算真正的计费事实。按实测结构计价
把实测输入拆分为命中与未命中 Token,再加上输出 Token,计算每个合格结果的成本。提示词结构或流量节奏变化时,重新定价。
调整质量前,DeepSeek 比 API 候选名单都便宜
只比较原始 Token 价格,DeepSeek 优势明显。但它未必自动赢得业务结果,因为这些模型在能力、工具、延迟和失败率上并不相同。
用一个标准化工作负载才能公平比较标价:总计 1M 输入 Token 加 250K 输出 Token,不计缓存优惠。这项负载在 V4 Flash 上花费 $0.21,在 V4 Pro 上花费 $0.6525,四舍五入为 $0.65。
OpenAI GPT-5.6 Sol每百万 Token 的输入和输出价格分别为 $5 和 $30。如果每次请求都低于 OpenAI 的长上下文阈值,标准化负载成本为 $12.50,是 V4 Pro 的 19.16x。输入超过 272K Token 的提示词,会让整条请求按 2x 输入和 1.5x 输出价格计费;缓存写入则按未缓存输入价格的 1.25x 收费。
Claude Sonnet 5每百万 Token 的输入和输出价格分别为 $2 和 $10。同一工作负载成本为 $4.50,是 V4 Pro 的 6.90x。Anthropic 以标准价格提供 1M 上下文窗口,并为 Batch 提供 50% 折扣,因此,对延迟不敏感的任务可以缩小差距。
Gemini 3.1 Pro Preview在单条提示词不超过 200K 时,每百万 Token 的输入和输出价格分别为 $2 和 $12。若每次请求都低于该边界,标准化总负载成本为 $5.00,是 V4 Pro 的 7.66x。若将同样的工作负载放进一条超过 200K 的请求,Google 费率会升至输入 $4、输出 $18,总账单为 $8.50,是 V4 Pro 的 13.03x。

价格倍数差距很大,但换算成美元后没有倍数听起来那么夸张。把标准化工作负载从 V4 Pro 换到 GPT-5.6 Sol,会多花 $11.8475。一次人工修正就可能抵消这笔节省,而稳定可靠的大规模路由则能让节省不断累积。
如果 Token 价格表之外,模型质量、产品功能和数据处理更重要,请参考 DeepSeek 与 ChatGPT 对比。如果任务能够接受小型低价模型和网关,请参考最便宜的 AI API 候选清单。价格页可以统一费率口径,只有自己的评测才能统一结果口径。
真正的预算隐患是重新定价,而非年约锁定
DeepSeek 实时页面表示,近期计划全面上调 API 价格,并称预期涨幅将非常显著,但没有公布涨幅或生效日期。当前费率是已经核实的事实,任何未来倍数都只是猜测。
这项预告会改变采购决策。不要向客户、董事会或财务团队承诺八月费率可以维持一年。每份预算模型都应同时保存价格页核实日期,把费率设置为可编辑输入项,并预先定义触发改换路由的涨价幅度。
没有月付或年付 API 陷阱
DeepSeek 采用按 Token 扣费,而非按月席位费或自助式年约。充值余额不会过期;赠送余额可能过期,具体日期会显示在 Billing 页面。两种余额同时存在时,API 会优先使用赠送余额。
根据 DeepSeek 官方 FAQ,未使用余额可以通过 Billing > Refunds 申请退款。因此,与不可退款的年度承诺相比,适度充值的风险更低。删除账户属于例外:FAQ 警告,删除账户会导致剩余 Open Platform 余额作废。
DeepSeek 也不会让超额费用在后付费模式下悄然累积。余额不足时,API 会返回 HTTP 402,并提示充值。这里的运营风险是服务中断,而不是账单无声突破套餐上限。应提前设置余额提醒,不要等生产流量替你撞上边界。
集成与并发的成本可能高于 Token
Flash 标注支持 2,500 个并发请求,并已支持 Responses API;Pro 标注为 500,当前不支持 Responses API。如果采购方没有先确认这些限制就围绕 Pro 设计系统,即使模型账单仍低于每百万 Token 一美元,也可能在排队、降级逻辑或集成开发上付出更多成本。
最便宜且安全的架构,应让路由随时可逆。通过统一的内部接口调用,记录所选模型与 Token 用量,并保留经过测试的备用方案。面对 DeepSeek 的涨价预告,这种常规工程纪律也成了预算控制手段。
DeepSeek 价格历史:V4 将 Flash 与 Pro 分层
V4 并没有让每个价目都统一变便宜。当前分层策略大幅压低了 Flash 的价格,同时让 Pro 的缓存未命中输入维持在更高水平。
DeepSeek 的 V3 价格公告列出的每百万 Token 费率是:缓存命中输入 $0.07、缓存未命中输入 $0.27、输出 $1.10。与这些费率相比,V4 Flash 的缓存命中输入便宜 96.00%,缓存未命中输入便宜 48.15%,输出便宜 74.55%。
V4 Pro 的变化方向不同:缓存命中输入比 V3 便宜 94.82%,输出便宜 20.91%,但其 $0.435 的缓存未命中输入价格,比 V3 的 $0.27 高 61.11%。
这段历史解释了当前的选择规则。Flash 不只是名称更小的版本,而是针对大用量的定价方案;Pro 则要求工作负载用更好的结果证明更高的未缓存费率值得支付。下一次已预告的涨价可能改变两者,因此,核实日期必须和计算结果放在一起。
周一就做:先测一条路由,再调整预算
周一,从一个边界明确的工作流中抽取 100 条已脱敏请求,开展为期一周的路由测试。不要一开始就做全企业迁移。
先定义验收标准
选择审核者能够一致评分的结果,例如有效 schema、分类正确、测试通过,或获批的客服回复草稿。从评测集中移除客户数据、个人数据和机密数据。
把基础负载交给 Flash
让全部 100 条请求先通过 V4 Flash-0731。逐条记录输入、输出、缓存命中、缓存未命中、重试、延迟和验收数据。
只升级失败任务
把失败或含义模糊的案例交给 V4 Pro。衡量 Pro 能否充分缩小失败长尾,抵消 3.11x 的模型费率以及任何人工审核时间。
设置两个预算触发条件
只有 Flash 达到质量底线时,才继续将其作为默认模型;只有在任何涨价发生后,DeepSeek 的实时标准化成本仍低于经过测试的备用方案时,才继续选择它作为供应商。
这项测试最终只需要产出一个可直接决策的数字:每个合格结果的成本。它把 DeepSeek 极低的 Token 费率转化为一份工作流预算,财务团队日后复盘时无须重做整套分析。
常见问题
DeepSeek 收费还是免费?
DeepSeek 官方消费者应用免费,无广告,也无应用内购买。API 服务单独计费,分别收取缓存命中输入、缓存未命中输入和输出 Token 的费用。
DeepSeek V4 Pro 价格是多少?
V4 Pro 每百万 Token 的缓存命中输入价格为 $0.003625,缓存未命中输入为 $0.435,输出为 $0.87。它提供 1M 上下文窗口、384K 最大输出,标注的并发上限为 500。
DeepSeek 每月多少钱?
消费者聊天每月价格为 $0。API 没有固定月费:用每月缓存命中输入、缓存未命中输入和输出 Token 总量,分别乘以对应的每百万 Token 费率即可。
为什么 DeepSeek 比 ChatGPT 便宜?
在仅比较价格的 1M 输入加 250K 输出 Token 工作负载上,DeepSeek V4 Pro 约为 $0.65;低于长上下文阈值时,OpenAI GPT-5.6 Sol 为 $12.50,相差 19.16x。模型质量与工具支持并不相同,因此应比较合格结果,而非只比 Token。
DeepSeek 有学生优惠吗?
在 2026年八月核实的官方价格页、FAQ 和应用页面中,DeepSeek 未列出学生专属套餐或优惠。学生通过消费者网页或移动应用使用时,本来就是 $0。
DeepSeek 可以退款吗?
可以。未使用的 API 余额可通过 Billing > Refunds 申请退款。充值余额不会过期,赠送余额则可能带有到期日。删除账户会导致剩余 Open Platform 余额作废。
DeepSeek 价格在 2026年变了吗?
变了。与此前的 V3 费率相比,V4 Flash 的缓存未命中输入便宜 48.15%,输出便宜 74.55%。V4 Pro 输出便宜 20.91%,但缓存未命中输入高出 61.11%。DeepSeek 目前还预告将再次大幅涨价,却未说明涨幅或日期。
应该选择 V4 Flash 还是 V4 Pro?
边界明确的基础负载选择 Flash,失败或后果严重的任务选择 Pro。按未缓存模型费用计算,Pro 必须减少约 67.82% 的计费尝试或 Token,才能抵消 Flash 低 3.11x 的费率。
获取 AI Tools Map for Business Owners
AI Tools Map for Business Owners 把模型价格转化为可执行的采用方案,列出每款工具的质量底线、路由角色和成本触发条件。免费订阅,获取下一期内容。
2026年9月3日







