Step 5 Preview 价格详解:API 与 Step Plan 怎么选

Step 5 Preview 价格怎么计算?本文拆解标准 API 的输入、缓存与输出费率,对比 Step Plan 四档订阅、Credits 有效期、Base URL 计费路径,以及 100 次调用的成本测算,帮你识别扣错账户的风险,并按真实工作负载在订阅与按量付费之间做出更稳妥的选择。

发布于

Step 5 Preview 价格详解:API 与 Step Plan 怎么选

Step 5 Preview 价格为:标准 API 每 100 万未缓存输入 token $1.00、每 100 万缓存输入 token $0.05、每 100 万输出 token $2.70。真正棘手的是计费路径:Step Plan Credits 与按量付费 token 是两套独立系统,即使请求成功,也可能扣错账户。

以下费率与套餐条款已于 2026 年 9 月 21 日(模型发布次日)根据 StepFun 实时定价文档核验。Step 5 Preview 目前已可通过 StepFun 产品和 API 使用;StepFun 表示开放权重将于 10 月 15 日发布,现阶段尚未开放。

StepFun 定价文档中的 Step 5 Preview token 费率
StepFun 定价与速率限制

Step 5 Preview 价格:先看结论

标准 API 的输入成本很低,但输出量对账单的影响要大得多。StepFun 的实时定价页面为 step-5-preview 列出了三档费率:

  • 未缓存输入: 每 1M token $1.00
  • 缓存输入: 每 1M token $0.05
  • 输出: 每 1M token $2.70

输出费用既包括模型内部推理,也包括最终答案。因此,即使用户看到的回答很短,只要模型在作答前进行了较长推理,输出账单仍可能明显增加。对 Agent 模型做预算时,这应是第一个持续监控的变量。

缓存折扣很可观,但在实际测量前,不能把它当作必然获得的优惠。对于长度超过 256 token 的输入,StepFun 会自动检查是否存在重复的提示词前缀。命中缓存时,每 100 万 token 按 $0.05 计费;未命中时(包括首次写入缓存)按 $1.00 计费。把稳定的系统指令、示例和对话历史放在提示词前部,有利于复用缓存;如果开头就是动态内容,缓存复用会被破坏。

第二个变量是支付通道。标准 API 请求从按量付费账户余额中扣款,Step Plan 请求则消耗订阅每月发放的 Credits。模型名称即便完全相同,费用也可能落到不同账户。

StepFun Step Plan 套餐一览

如果长期在受支持的编程工具或 Agent 平台中使用,并且能消耗完每月额度,Step Plan 的标价价值通常更高。所有档位都享有相同的高速模型性能;升级套餐增加的是 Credits 额度,而不是模型速度。

档位每月 Credits月付价格预付选项
Flash Mini400M$6.99$18.99 季付 / $69.99 年付
Flash Plus1,600M$9.99$26.99 季付 / $95.99 年付
Flash Pro8,000M$29$79 季付 / $289 年付
Flash Max40,000M$99$269 季付 / $989 年付

以上是截至 2026 年 9 月核验的 Step Plan 价格。季付与年付都要一次性付款,但 Credits 仍按月发放。购买年付套餐,并不会得到一整年可提前调用的额度池,因此无法把未来月份的额度挪到业务上线高峰期使用。

套餐越高,每月 1B Credits 的价格下降越明显:Mini 约为 $17.48,Plus 为 $6.24,Pro 为 $3.63,Max 为 $2.48。因此,Mini 更适合作为严格控制用量的入门档,而不是常规使用的默认选择。Plus 只贵 $3,却提供 4 倍额度。

最清晰的分界点就是各档额度:月用量不超过 400M Credits 才选 Mini;1.6B 以内选 Plus;8B 以内选 Pro;40B 以内选 Max。Booster 可以应对偶发峰值,但如果经常超额,就说明应由更高一档套餐承载基础用量。

Mini 尤其能说明问题。给 Mini 加购一个 400M Small booster,总成本为 $13.98,只得到 800M Credits;Plus 则只需 $9.99,却有 1.6B Credits。如果预计会超过 400M,一开始就买 Plus,比之后给 Mini 补额度更划算。

Step Plan Credits 不是 token,也不是现金

Credits 是 StepFun 订阅体系内部的计量单位。它既不是输入 token 或输出 token,也不是美元,更不是可以提现的账户余额。

StepFun 给出的近似换算关系是:价值 $1 的模型用量约等于 7M Credits。这有助于粗略评估套餐对应的使用价值,但不代表 1 Credit 就等于 1 token。不同模型可能以不同方式消耗 Credits,而推理量较大的回答,其可计费输出也可能远高于屏幕上显示的答案长度。

从量级看,400M Credits 除以 7M,约等于价值 $57.14 的名义模型用量;另一端,40B Credits 约对应 $5,714.29。这只是依据 StepFun 自身近似换算得出的示例,不是现金余额,也不是承诺可获得的 token 数量。

采购团队要求按 token 比价时,这一区别非常重要。Step Plan 用户不能简单地把 7M Credits 除以某个 token 费率,就认定结果是所有模型和工作负载都能保证获得的额度。套餐是在调用完成后,按实际用量折算为 Credits;标准 API 计费则直接列出 token 费率。

做粗略容量规划时使用换算关系;管理订阅时查看 Credits 账本;预测标准 API 成本时查看 prompt_tokens、cached_tokens 和输出用量。混用这三种口径,只会得到一份看似精确、实际错误的预算。

Step 5 API 价格取决于 Base URL

请求最终由哪套系统计费,取决于 Base URL。只有 API key,并不能自动选择 Step Plan。

StepFun 为订阅通道提供了以下端点:

  • Claude Code 或 Anthropic SDK: https://api.stepfun.ai/step_plan
  • OpenAI SDK Chat Completions: https://api.stepfun.ai/step_plan/v1

标准 API 使用标准地址和独立额度。StepFun 明确指出,在该通道请求成功,并不代表消耗了订阅 Credits;它只能证明标准通道接受了当前 key 和账户状态。

从 Base URL 分流至 Step Plan Credits 或标准 API token 计费的决策流程
模型运行前,Base URL 就已经决定了计费通道。

这会在编程工具中造成一种不易察觉的配置错误:开发者填入有效 key,却保留了客户端里旧的服务商 URL;请求顺利返回后,便以为刚购买的订阅已经承担费用。模型确实能运行,但被扣减的可能仍是另一个余额。

应从以下 4 处核对路径:

  1. 确认客户端配置中的 Base URL 完全正确。
  2. 确认所选模型是 step-5-preview,而不是旧别名或自动回退模型。
  3. 发送 1 个经过脱敏的小请求。
  4. 检查哪一本账发生了变化:Step Plan Credits,还是标准账户余额。

Step Plan 也不适用标准 API 的累计充值速率限制表。标准 V0 行显示:累计充值 $0 时,并发数为 5、每分钟 10 次请求、每分钟 5,000,000 token。这只是速率限制档位,不代表免费赠送 token;Step Plan 用量由其 Credits 额度管理。

Step 5 Preview 调用 100 次要多少钱

用一个明确的工作负载,可以直观看出缓存与输出量如何影响成本。假设共发起 100 次调用,每次包含 10,000 个输入 token 和 1,000 个总输出 token(包括推理)。整批请求合计 1,000,000 个输入 token 和 100,000 个输出 token。

完全未命中缓存时:

  • 输入:1M × $1.00 = $1.00
  • 输出:0.1M × $2.70 = $0.27
  • 合计:$1.27

实测输入缓存命中率为 90% 时:

  • 未缓存输入:0.1M × $1.00 = $0.10
  • 缓存输入:0.9M × $0.05 = $0.045
  • 输出:0.1M × $2.70 = $0.27
  • 合计:$0.415

缓存命中率 90% 时可节省 $0.855,即 67.32%。整张账单并不会节省 95%,因为输出费用没有变化。当输入成本被压低后,推理长度就会成为主要成本。

用黏土立柱对比 Step 5 Preview 在无缓存、百分之九十缓存命中率和 7 比 2 比 1 混合价格下的成本
在这个输入量较大的工作负载中,缓存可把成本从 $1.27 降至 $0.415,但输出费用保持不变。

这个示例来自计算,而非真实账单。核验时没有可获授权的 StepFun 账户,因此并未发送请求,也没有产生用量扣减。所有输入数据均直接取自 StepFun 当前费率表,计算过程可以复现。

计算还假设上述输出总量已经包含推理。如果模型的实际推理量超过这一假设,即便可见答案依旧很短,总输出量与最终账单也会同步上涨。

预测生产成本时,不要根据可见答案长度设定输出预算。应记录 API 响应中的总输出用量,区分通过验收的结果与重试请求,再计算每个合格结果的成本。重试次数更少的模型,可能比 token 单价更低的模型更省钱;过于冗长的模型,也可能抵消输入端的成本优势。

为什么 $0.51 混合价格不是你的实际账单

目前流传的 Step 5 Preview $0.51,是用于横向比较的标准化价格,并非 StepFun 的第四种费率。Artificial Analysis 按 7:2:1 的比例混合价格:缓存输入占 7 份,普通输入占 2 份,输出占 1 份。

将这个比例代入 StepFun 费率:

  • 0.7 × $0.05 缓存输入 = $0.035
  • 0.2 × $1.00 输入 = $0.20
  • 0.1 × $2.70 输出 = $0.27
  • 合计 = $0.505,四舍五入为每 1M 混合 token $0.51

这种混合方式适合在统一工作负载下给不同服务商排序;但如果 Agent 会生成很长的推理链、很少重复提示词前缀,或输入与输出比例不同,它就不适合直接拿来做预算。

决策规则很简单:用实测的缓存输入、未缓存输入和输出占比,替换 7:2:1。尚无日志时,先按完全不命中缓存的情况编制预算,把缓存带来的节省视为额外收益。

Step 5 Preview 价格与 API 对比

在同一个无缓存工作负载下——1M 输入 token 加 100K 输出 token——Step 5 Preview 明显低于 StepFun 发布对比中提到的另外两个前沿模型。

模型每 1M 输入每 1M 输出100 次调用成本
Step 5 Preview$1.00$2.70$1.27
Claude Opus 5$5.00$25.00$7.50
GPT-6 Astra$10.00$50.00$15.00

这张表只统一了 token 用量,并未统一任务完成质量。如果一次 $1.27 的运行无法通过验收,还要把工作转给人工或第二个模型处理,就不能算更便宜。反过来,即使结果质量很好,用一次 $15 的模型来完成低价值分类任务也不经济。

可以把 Step 5 Preview 当作成本导向的挑战者,在范围明确的生产样本上测试。以当前已经达到质量门槛的模型作为对照,然后比较每个合格结果的成本。若想更全面地查看费率,可参考最便宜的 AI API 对比;若想了解缓存行为如何改变低价模型的实际账单,可阅读 DeepSeek 价格。

免费使用方式与 10 月开放权重日期

当前官方文档中,没有任何有保证的免费 Step Plan 或 API 额度。Step Plan 只列出 4 个付费档位,没有试用套餐。标准 API 虽然列出了累计充值 $0 的 V0 速率限制档位,但模型调用仍按已公布的 token 价格计费。速率限制表里的零金额,不代表承诺免费用量。

不订阅的明确做法是等待。StepFun 表示开放权重计划于 2026 年 10 月 15 日发布。对自托管感兴趣、又不急于使用 API 的用户,可以等到那时再决定是否购买 Step Plan 或标准 API token。开放权重免去的是服务商的调用费,不是 GPU、推理服务、可观测性和工程成本。

谁可以完全不向 StepFun 付费?只想研究已发布权重、并且本身已有算力的研究人员,或许无需付费。现在就需要在线托管推理的开发者,则应为标准 token 账单或付费 Step Plan 档位编列预算。

不要把未来将发布的开放权重描述成当前可用的免费套餐。截至 9 月 21 日,托管模型已上线,但开放权重仍处于计划发布阶段。

隐性成本:到期、Booster 与年付锁定

Step Plan 最昂贵的错误通常不是超额,而是额度闲置。每月 Credits 会在月底清零,即便订阅费按季或按年预付,也不能结转至下个月。

这意味着,年付折扣只有在用得完额度时才成立。Flash Plus 年付 $95.99,而连续 12 个月月付合计 $119.88,标价上节省 $23.89;但只要有 1 个低用量月份,这部分价值就可能被闲置额度吃掉,因为 1.6B Credits 仍会按期失效。年付锁定了付款,却依然要面对 12 个彼此独立、当月不用就作废的额度周期。

Booster 可以应对临时高峰,而不改变续费日期:

  • Small: $6.99,可得 400M Credits
  • Large: $9.99,可得 1.6B Credits

只有有效 Step Plan 订阅才能购买 Booster,且每份 Booster 都有独立的 30 天有效期。如果月度 Credits 与 Booster Credits 同时存在,StepFun 会优先扣除更早到期的额度。这个规则有一定帮助,但不会把所有 Credits 合并成一个长期有效的余额池。

这里没有常规意义上的按 Credit 超额计费。额度耗尽后,只能购买 Booster、升级套餐,或等待下个月再次发放。应把 Booster 当作突发容量;如果连续 2 个周期都要购买,就该重新核算下一档套餐。

取消规则同样很严格。StepFun 表示可随时取消,但已支付费用不予退还,服务会持续到当前计费周期结束。因此,年付是在用折扣交换退款风险,同时还要承担 12 个独立的额度到期窗口。

老账户还要留意价格体系的历史变化。2026 年 7 月 24 日,StepFun 将按请求次数计费的 Coding Plan 升级为基于 Credits 的 Token Plan。现有 Coding Plan 订阅者在满足文档所列条件时,可以保留原通道;但一旦转到 Token Plan,就无法退回。旧截图里显示的提示词次数限制,不能代表当前公开套餐。

Step Plan 和标准 API 分别适合谁

如果工作负载位于受支持的编程或 Agent 工具内、整个月持续发生,并且能落在可预测的 Credits 区间,选择 Step Plan。按每美元对应的名义用量看,订阅远高于按量付费;但前提是集成确实使用订阅端点,而且 Credits 不会闲置到期。

如果要构建生产服务、需要透明的按 token 核算、希望用量随客户需求扩缩,或无法接受月度额度到期,选择标准 API。公开费率便于建立单位经济模型,响应中的用量字段也会给出输入、缓存和输出构成。

如果工作负载还没有验收标准,两者都先别选。低廉的模型账单可能掩盖昂贵的重试与人工审核。先定义一个审核者能够评分的结果,再与当前模型比较每个合格结果的成本。

对于每天使用 Claude Code 的个人技术开发者,只要确认 Base URL 无误,Flash Plus 是合理的首个订阅档位。对用自动化服务客户的融资创业者,标准 API 更容易按产品和客户归集成本。对中型企业 CTO 而言,Step Plan 应归入开发工具支出,生产推理则应使用独立计量的服务账户。

最终选择取决于可预测性:稳定的月度交互用量更适合 Step Plan;有波峰波谷、需要归因且可编程的流量更适合标准 API。团队可以同时使用两者,但 key、端点和账本应按通道清楚命名,避免把不同余额混为一谈。

周一就做:转移预算前先验证计费路径

周一先用 1 个脱敏请求验证 1 条计费路径,再购买更高档套餐或迁移生产流量。

  1. 明确通道

    先确定测试对象是 Step Plan 还是标准 API,并在测试用例旁记录预期发生变化的账本和准确的 Base URL。

  2. 发送一个边界明确的请求

    如果需要测试缓存,请使用长度超过 256 token 且不含敏感信息的提示词。记录模型 ID、提示词 token、缓存 token、总输出 token 和请求 ID。

  3. 核对扣减记录

    调用完成后打开对应控制台,确认订阅通道扣减了 Step Plan Credits,或标准通道改变了账户余额。

  4. 运行 100 次调用样本

    只有在通道得到验证后,才重放 100 个有代表性且经过脱敏的请求。把实测缓存构成、总输出量、重试次数和合格结果,与无缓存时 $1.27 的基准对比。

最终应得到一个可直接用于决策的单位:在预定计费通道上,每个合格结果需要多少美元或 Credits。有了它,就能选择套餐,而不用把基准测试的混合价格误当成真实账单。

常见问题

1000 个 token 要多少钱?

对于 Step 5 Preview,1,000 个 token 作为未缓存输入时价格为 $0.001,作为缓存输入时为 $0.00005,作为输出时为 $0.0027。推理 token 与最终答案 token 都按输出费率计费。

20,000 个 token 要多少钱?

按当前费率,20,000 个 token 作为未缓存输入时为 $0.02,作为缓存输入时为 $0.001,作为输出时为 $0.054。一次请求同时包含输入和输出时,应把对应费用相加。

1,000,000 个 token 有多少?

100 万 token 是 StepFun 的计费单位,也是 Step 5 Preview 标注的最大上下文窗口。它所代表的文本量会随语言、格式、图像和分词方式变化,因此用 API 实测比换算成固定页数更可靠。

$1 能买多少 token?

按 Step 5 Preview 标准费率,$1 可以购买 1M 个未缓存输入 token、20M 个缓存输入 token,或约 370,370 个输出 token。Step Plan 则不同:StepFun 表示价值 $1 的模型用量约对应 7M Credits,而 Credits 不是 token。

200,000 个 token 算多吗?

它相当于模型 1M-token 上下文窗口的 1/5。按当前费率,200,000 个 token 作为未缓存输入时为 $0.20,作为缓存输入时为 $0.01,作为输出时为 $0.54。

10 亿个 token 值多少钱?

按 Step 5 Preview 当前标准费率,1B 个 token 作为未缓存输入时为 $1,000,作为缓存输入时为 $50,作为输出时为 $2,700。混合工作负载的成本取决于实测的输入、缓存和输出占比,会落在这些数值之间。

Step 5 Preview 免费吗?

截至 2026 年 9 月核验的官方文档,没有列出免费的 Step Plan 档位或有保证的 API 额度。开放权重计划于 10 月 15 日发布,但自托管仍会产生基础设施成本。

StepFun 有学生优惠吗?

当前 Step Plan 概览和 API 定价页面均未列出学生专属价格。除非结账时账户显示单独促销,否则学生适用相同的公开套餐与 token 费率。

Step Plan 可以退款吗?

StepFun 表示已支付的费用不予退还。用户可以随时取消,服务会持续到当前计费周期结束。

Step Plan 在 2026 年调整过价格吗?

调整过。2026 年 7 月 24 日,StepFun 将 Step Plan 从按请求次数限制的 Coding Plan,改为按 Credits 额度计量的 Token Plan。当前体系按月发放 Credits、月底清零,并且从旧套餐升级到当前套餐后无法退回。

获取面向企业主的 AI 工具地图

在为功能重叠的工具付费前,先让每个模型对应一个可衡量的业务成果。获取面向企业主的 AI 工具地图,用其中的成本、质量和路由检查方法,辅助下一次采用决策。

发布日期
分类
AI
AI PPT 工具怎么选?2026 年 Gamma 替代方案对比

AI PPT 工具怎么选?2026 年 Gamma 替代方案对比

正在寻找 Gamma 替代品?本文按团队品牌统一、客户可编辑交付、融资路演和现场演示等需求,对比 Beautiful.ai、Plus AI、Prezi 等 AI PPT 工具,说明免费套餐、美元价格、AI 额度与导出限制。结合完整交付流程和团队成本,判断何时值得换工具,何时继续用 Gamma 更合适。2026年10月11日AI
Reflection AI Beam 值得换吗?编程模型选型与部署前要核实的事

Reflection AI Beam 值得换吗?编程模型选型与部署前要核实的事

Reflection AI Beam 是否值得成为你的下一个 AI 编程模型?本文梳理 10 月权重发布计划、Beta 申请与 API 试用流程,解读官方基准成绩和效率估算,并用存储计算与迁移预算说明自部署的判断依据,帮助开发者、运维负责人和 CTO 安排验收测试,在保持现有服务运行的同时,判断何时值得切换。2026年10月10日AI
Claude Google Workspace 使用指南:安装、审批与团队试点

Claude Google Workspace 使用指南:安装、审批与团队试点

Claude Google Workspace 公测版可在 Docs、Sheets 和 Slides 中改写文档、清洗数据和制作演示文稿。了解付费套餐要求、安装部署、编辑审批与独立连接器设置,通过三项带验收步骤的试点任务,核对数据、权限与返工耗时,并与现有 Gemini 能力比较,再决定是否扩大部署。2026年10月10日AI
Claude 仪表盘怎么用:Dashboards 测试版设置与销售数据核验

Claude 仪表盘怎么用:Dashboards 测试版设置与销售数据核验

Claude Dashboards 测试版如何接入公司数据、生成可核验的销售仪表盘?本文梳理套餐费用、连接器配置、SQL 检查与分享权限,并用按地区统计已赢单商机金额的示例,说明如何核对日期、币种、重复记录和刷新时间,判断何时适合试点,何时应继续使用现有 BI 工具,避免把销售金额误当作会计收入。2026年10月10日AI
Granola AI 评测:价格、用法与会议笔记的局限

Granola AI 评测:价格、用法与会议笔记的局限

Granola AI 适合商务会议吗?本文依据官方文档,梳理无须机器人入会的笔记流程、模板、Recipes、集成与各方案价格,说明桌面端和手机端的功能差异、录音限制、隐私与同意要求,并对比 Krisp、MeetGeek、Circleback 和 Claap,帮助创业者、销售人员与顾问判断是否值得付费。2026年10月10日AI
Fyxer 评测:AI 邮件助手值不值得买?价格、隐私与替代方案

Fyxer 评测:AI 邮件助手值不值得买?价格、隐私与替代方案

Fyxer 评测:从公开文档出发,解析这款 AI 邮件助手在 Gmail 和 Outlook 中的自动分类、回复草稿、会议纪要与日程安排。逐项梳理 Pro、Team 的美元价格、试用和积分限制,说明数据训练、删除政策与团队权限,再对照 SaneBox、Gemini 和 Copilot,判断哪些工作值得额外付费。2026年10月9日AI
GPT-6 全解析:模型怎么选、何时发布、在哪用、多少钱

GPT-6 全解析:模型怎么选、何时发布、在哪用、多少钱

GPT-6 家族的 Astra、Sol、6.1 Sol 和 Luna 有何区别?本文梳理各模型发布时间、ChatGPT 套餐对应的使用权限,以及 Work、Codex 和 API 的开放范围,列出美元计价的 API 费率,并用任务预算示例说明缓存、重试与模型升级如何影响总成本,帮助你按实际工作需求选择模型。2026年10月9日AI
ChatGPT Free 免费版能做什么?功能、额度与升级费用

ChatGPT Free 免费版能做什么?功能、额度与升级费用

ChatGPT Free 免费版能做什么,办公够不够用?本文梳理文字聊天、联网搜索、文件上传、图片生成、语音和深度研究的功能与额度,说明广告、免登录访问及 API 单独计费的区别,并对比美国市场每月 $8 的 Go 与 $20 的 Plus,帮你根据工作中遇到的限制,判断是否需要付费升级。2026年10月9日AI
订阅通讯

每周日,一封信。写运转中的系统,不写热评。

每周一期。无垃圾邮件。随时退订。