Step 5 Preview 价格详解:API 与 Step Plan 怎么选

Step 5 Preview 价格怎么计算?本文拆解标准 API 的输入、缓存与输出费率,对比 Step Plan 四档订阅、Credits 有效期、Base URL 计费路径,以及 100 次调用的成本测算,帮你识别扣错账户的风险,并按真实工作负载在订阅与按量付费之间做出更稳妥的选择。

Monday, September 21, 2026Omid Saffari
Step 5 Preview 价格详解:API 与 Step Plan 怎么选

Step 5 Preview 价格为:标准 API 每 100 万未缓存输入 token $1.00、每 100 万缓存输入 token $0.05、每 100 万输出 token $2.70。真正棘手的是计费路径:Step Plan Credits 与按量付费 token 是两套独立系统,即使请求成功,也可能扣错账户。

以下费率与套餐条款已于 2026 年 9 月 21 日(模型发布次日)根据 StepFun 实时定价文档核验。Step 5 Preview 目前已可通过 StepFun 产品和 API 使用;StepFun 表示开放权重将于 10 月 15 日发布,现阶段尚未开放。

StepFun 定价文档中的 Step 5 Preview token 费率
StepFun 定价与速率限制

Step 5 Preview 价格:先看结论

标准 API 的输入成本很低,但输出量对账单的影响要大得多。StepFun 的实时定价页面step-5-preview 列出了三档费率:

  • 未缓存输入: 每 1M token $1.00
  • 缓存输入: 每 1M token $0.05
  • 输出: 每 1M token $2.70

输出费用既包括模型内部推理,也包括最终答案。因此,即使用户看到的回答很短,只要模型在作答前进行了较长推理,输出账单仍可能明显增加。对 Agent 模型做预算时,这应是第一个持续监控的变量。

缓存折扣很可观,但在实际测量前,不能把它当作必然获得的优惠。对于长度超过 256 token 的输入,StepFun 会自动检查是否存在重复的提示词前缀。命中缓存时,每 100 万 token 按 $0.05 计费;未命中时(包括首次写入缓存)按 $1.00 计费。把稳定的系统指令、示例和对话历史放在提示词前部,有利于复用缓存;如果开头就是动态内容,缓存复用会被破坏。

第二个变量是支付通道。标准 API 请求从按量付费账户余额中扣款,Step Plan 请求则消耗订阅每月发放的 Credits。模型名称即便完全相同,费用也可能落到不同账户。

StepFun Step Plan 套餐一览

如果长期在受支持的编程工具或 Agent 平台中使用,并且能消耗完每月额度,Step Plan 的标价价值通常更高。所有档位都享有相同的高速模型性能;升级套餐增加的是 Credits 额度,而不是模型速度。

档位每月 Credits月付价格预付选项
Flash Mini400M$6.99$18.99 季付 / $69.99 年付
Flash Plus1,600M$9.99$26.99 季付 / $95.99 年付
Flash Pro8,000M$29$79 季付 / $289 年付
Flash Max40,000M$99$269 季付 / $989 年付

以上是截至 2026 年 9 月核验的 Step Plan 价格。季付与年付都要一次性付款,但 Credits 仍按月发放。购买年付套餐,并不会得到一整年可提前调用的额度池,因此无法把未来月份的额度挪到业务上线高峰期使用。

套餐越高,每月 1B Credits 的价格下降越明显:Mini 约为 $17.48,Plus 为 $6.24,Pro 为 $3.63,Max 为 $2.48。因此,Mini 更适合作为严格控制用量的入门档,而不是常规使用的默认选择。Plus 只贵 $3,却提供 4 倍额度。

最清晰的分界点就是各档额度:月用量不超过 400M Credits 才选 Mini;1.6B 以内选 Plus;8B 以内选 Pro;40B 以内选 Max。Booster 可以应对偶发峰值,但如果经常超额,就说明应由更高一档套餐承载基础用量。

Mini 尤其能说明问题。给 Mini 加购一个 400M Small booster,总成本为 $13.98,只得到 800M Credits;Plus 则只需 $9.99,却有 1.6B Credits。如果预计会超过 400M,一开始就买 Plus,比之后给 Mini 补额度更划算。

Step Plan Credits 不是 token,也不是现金

Credits 是 StepFun 订阅体系内部的计量单位。它既不是输入 token 或输出 token,也不是美元,更不是可以提现的账户余额。

StepFun 给出的近似换算关系是:价值 $1 的模型用量约等于 7M Credits。这有助于粗略评估套餐对应的使用价值,但不代表 1 Credit 就等于 1 token。不同模型可能以不同方式消耗 Credits,而推理量较大的回答,其可计费输出也可能远高于屏幕上显示的答案长度。

从量级看,400M Credits 除以 7M,约等于价值 $57.14 的名义模型用量;另一端,40B Credits 约对应 $5,714.29。这只是依据 StepFun 自身近似换算得出的示例,不是现金余额,也不是承诺可获得的 token 数量。

采购团队要求按 token 比价时,这一区别非常重要。Step Plan 用户不能简单地把 7M Credits 除以某个 token 费率,就认定结果是所有模型和工作负载都能保证获得的额度。套餐是在调用完成后,按实际用量折算为 Credits;标准 API 计费则直接列出 token 费率。

做粗略容量规划时使用换算关系;管理订阅时查看 Credits 账本;预测标准 API 成本时查看 prompt_tokenscached_tokens 和输出用量。混用这三种口径,只会得到一份看似精确、实际错误的预算。

Step 5 API 价格取决于 Base URL

请求最终由哪套系统计费,取决于 Base URL。只有 API key,并不能自动选择 Step Plan。

StepFun 为订阅通道提供了以下端点:

  • Claude Code 或 Anthropic SDK: https://api.stepfun.ai/step_plan
  • OpenAI SDK Chat Completions: https://api.stepfun.ai/step_plan/v1

标准 API 使用标准地址和独立额度。StepFun 明确指出,在该通道请求成功,并不代表消耗了订阅 Credits;它只能证明标准通道接受了当前 key 和账户状态。

从 Base URL 分流至 Step Plan Credits 或标准 API token 计费的决策流程
模型运行前,Base URL 就已经决定了计费通道。

这会在编程工具中造成一种不易察觉的配置错误:开发者填入有效 key,却保留了客户端里旧的服务商 URL;请求顺利返回后,便以为刚购买的订阅已经承担费用。模型确实能运行,但被扣减的可能仍是另一个余额。

应从以下 4 处核对路径:

  1. 确认客户端配置中的 Base URL 完全正确。
  2. 确认所选模型是 step-5-preview,而不是旧别名或自动回退模型。
  3. 发送 1 个经过脱敏的小请求。
  4. 检查哪一本账发生了变化:Step Plan Credits,还是标准账户余额。

Step Plan 也不适用标准 API 的累计充值速率限制表。标准 V0 行显示:累计充值 $0 时,并发数为 5、每分钟 10 次请求、每分钟 5,000,000 token。这只是速率限制档位,不代表免费赠送 token;Step Plan 用量由其 Credits 额度管理。

Step 5 Preview 调用 100 次要多少钱

用一个明确的工作负载,可以直观看出缓存与输出量如何影响成本。假设共发起 100 次调用,每次包含 10,000 个输入 token1,000 个总输出 token(包括推理)。整批请求合计 1,000,000 个输入 token 和 100,000 个输出 token。

完全未命中缓存时:

  • 输入:1M × $1.00 = $1.00
  • 输出:0.1M × $2.70 = $0.27
  • 合计:$1.27

实测输入缓存命中率为 90% 时:

  • 未缓存输入:0.1M × $1.00 = $0.10
  • 缓存输入:0.9M × $0.05 = $0.045
  • 输出:0.1M × $2.70 = $0.27
  • 合计:$0.415

缓存命中率 90% 时可节省 $0.855,即 67.32%。整张账单并不会节省 95%,因为输出费用没有变化。当输入成本被压低后,推理长度就会成为主要成本。

用黏土立柱对比 Step 5 Preview 在无缓存、百分之九十缓存命中率和 7 比 2 比 1 混合价格下的成本
在这个输入量较大的工作负载中,缓存可把成本从 $1.27 降至 $0.415,但输出费用保持不变。

这个示例来自计算,而非真实账单。核验时没有可获授权的 StepFun 账户,因此并未发送请求,也没有产生用量扣减。所有输入数据均直接取自 StepFun 当前费率表,计算过程可以复现。

计算还假设上述输出总量已经包含推理。如果模型的实际推理量超过这一假设,即便可见答案依旧很短,总输出量与最终账单也会同步上涨。

预测生产成本时,不要根据可见答案长度设定输出预算。应记录 API 响应中的总输出用量,区分通过验收的结果与重试请求,再计算每个合格结果的成本。重试次数更少的模型,可能比 token 单价更低的模型更省钱;过于冗长的模型,也可能抵消输入端的成本优势。

为什么 $0.51 混合价格不是你的实际账单

目前流传的 Step 5 Preview $0.51,是用于横向比较的标准化价格,并非 StepFun 的第四种费率。Artificial Analysis 按 7:2:1 的比例混合价格:缓存输入占 7 份,普通输入占 2 份,输出占 1 份。

将这个比例代入 StepFun 费率:

  • 0.7 × $0.05 缓存输入 = $0.035
  • 0.2 × $1.00 输入 = $0.20
  • 0.1 × $2.70 输出 = $0.27
  • 合计 = $0.505,四舍五入为每 1M 混合 token $0.51

这种混合方式适合在统一工作负载下给不同服务商排序;但如果 Agent 会生成很长的推理链、很少重复提示词前缀,或输入与输出比例不同,它就不适合直接拿来做预算。

决策规则很简单:用实测的缓存输入、未缓存输入和输出占比,替换 7:2:1。尚无日志时,先按完全不命中缓存的情况编制预算,把缓存带来的节省视为额外收益。

Step 5 Preview 价格与 API 对比

在同一个无缓存工作负载下——1M 输入 token 加 100K 输出 token——Step 5 Preview 明显低于 StepFun 发布对比中提到的另外两个前沿模型。

模型每 1M 输入每 1M 输出100 次调用成本
Step 5 Preview$1.00$2.70$1.27
Claude Opus 5$5.00$25.00$7.50
GPT-6 Astra$10.00$50.00$15.00

这张表只统一了 token 用量,并未统一任务完成质量。如果一次 $1.27 的运行无法通过验收,还要把工作转给人工或第二个模型处理,就不能算更便宜。反过来,即使结果质量很好,用一次 $15 的模型来完成低价值分类任务也不经济。

可以把 Step 5 Preview 当作成本导向的挑战者,在范围明确的生产样本上测试。以当前已经达到质量门槛的模型作为对照,然后比较每个合格结果的成本。若想更全面地查看费率,可参考最便宜的 AI API 对比;若想了解缓存行为如何改变低价模型的实际账单,可阅读 DeepSeek 价格

免费使用方式与 10 月开放权重日期

当前官方文档中,没有任何有保证的免费 Step Plan 或 API 额度。Step Plan 只列出 4 个付费档位,没有试用套餐。标准 API 虽然列出了累计充值 $0 的 V0 速率限制档位,但模型调用仍按已公布的 token 价格计费。速率限制表里的零金额,不代表承诺免费用量。

不订阅的明确做法是等待。StepFun 表示开放权重计划于 2026 年 10 月 15 日发布。对自托管感兴趣、又不急于使用 API 的用户,可以等到那时再决定是否购买 Step Plan 或标准 API token。开放权重免去的是服务商的调用费,不是 GPU、推理服务、可观测性和工程成本。

谁可以完全不向 StepFun 付费?只想研究已发布权重、并且本身已有算力的研究人员,或许无需付费。现在就需要在线托管推理的开发者,则应为标准 token 账单或付费 Step Plan 档位编列预算。

不要把未来将发布的开放权重描述成当前可用的免费套餐。截至 9 月 21 日,托管模型已上线,但开放权重仍处于计划发布阶段。

隐性成本:到期、Booster 与年付锁定

Step Plan 最昂贵的错误通常不是超额,而是额度闲置。每月 Credits 会在月底清零,即便订阅费按季或按年预付,也不能结转至下个月。

这意味着,年付折扣只有在用得完额度时才成立。Flash Plus 年付 $95.99,而连续 12 个月月付合计 $119.88,标价上节省 $23.89;但只要有 1 个低用量月份,这部分价值就可能被闲置额度吃掉,因为 1.6B Credits 仍会按期失效。年付锁定了付款,却依然要面对 12 个彼此独立、当月不用就作废的额度周期。

Booster 可以应对临时高峰,而不改变续费日期:

  • Small: $6.99,可得 400M Credits
  • Large: $9.99,可得 1.6B Credits

只有有效 Step Plan 订阅才能购买 Booster,且每份 Booster 都有独立的 30 天有效期。如果月度 Credits 与 Booster Credits 同时存在,StepFun 会优先扣除更早到期的额度。这个规则有一定帮助,但不会把所有 Credits 合并成一个长期有效的余额池。

这里没有常规意义上的按 Credit 超额计费。额度耗尽后,只能购买 Booster、升级套餐,或等待下个月再次发放。应把 Booster 当作突发容量;如果连续 2 个周期都要购买,就该重新核算下一档套餐。

取消规则同样很严格。StepFun 表示可随时取消,但已支付费用不予退还,服务会持续到当前计费周期结束。因此,年付是在用折扣交换退款风险,同时还要承担 12 个独立的额度到期窗口。

老账户还要留意价格体系的历史变化。2026 年 7 月 24 日,StepFun 将按请求次数计费的 Coding Plan 升级为基于 Credits 的 Token Plan。现有 Coding Plan 订阅者在满足文档所列条件时,可以保留原通道;但一旦转到 Token Plan,就无法退回。旧截图里显示的提示词次数限制,不能代表当前公开套餐。

Step Plan 和标准 API 分别适合谁

如果工作负载位于受支持的编程或 Agent 工具内、整个月持续发生,并且能落在可预测的 Credits 区间,选择 Step Plan。按每美元对应的名义用量看,订阅远高于按量付费;但前提是集成确实使用订阅端点,而且 Credits 不会闲置到期。

如果要构建生产服务、需要透明的按 token 核算、希望用量随客户需求扩缩,或无法接受月度额度到期,选择标准 API。公开费率便于建立单位经济模型,响应中的用量字段也会给出输入、缓存和输出构成。

如果工作负载还没有验收标准,两者都先别选。低廉的模型账单可能掩盖昂贵的重试与人工审核。先定义一个审核者能够评分的结果,再与当前模型比较每个合格结果的成本。

对于每天使用 Claude Code 的个人技术开发者,只要确认 Base URL 无误,Flash Plus 是合理的首个订阅档位。对用自动化服务客户的融资创业者,标准 API 更容易按产品和客户归集成本。对中型企业 CTO 而言,Step Plan 应归入开发工具支出,生产推理则应使用独立计量的服务账户。

最终选择取决于可预测性:稳定的月度交互用量更适合 Step Plan;有波峰波谷、需要归因且可编程的流量更适合标准 API。团队可以同时使用两者,但 key、端点和账本应按通道清楚命名,避免把不同余额混为一谈。

周一就做:转移预算前先验证计费路径

周一先用 1 个脱敏请求验证 1 条计费路径,再购买更高档套餐或迁移生产流量。

  1. 明确通道

    先确定测试对象是 Step Plan 还是标准 API,并在测试用例旁记录预期发生变化的账本和准确的 Base URL。

  2. 发送一个边界明确的请求

    如果需要测试缓存,请使用长度超过 256 token 且不含敏感信息的提示词。记录模型 ID、提示词 token、缓存 token、总输出 token 和请求 ID。

  3. 核对扣减记录

    调用完成后打开对应控制台,确认订阅通道扣减了 Step Plan Credits,或标准通道改变了账户余额。

  4. 运行 100 次调用样本

    只有在通道得到验证后,才重放 100 个有代表性且经过脱敏的请求。把实测缓存构成、总输出量、重试次数和合格结果,与无缓存时 $1.27 的基准对比。

最终应得到一个可直接用于决策的单位:在预定计费通道上,每个合格结果需要多少美元或 Credits。有了它,就能选择套餐,而不用把基准测试的混合价格误当成真实账单。

常见问题

1000 个 token 要多少钱?

对于 Step 5 Preview,1,000 个 token 作为未缓存输入时价格为 $0.001,作为缓存输入时为 $0.00005,作为输出时为 $0.0027。推理 token 与最终答案 token 都按输出费率计费。

20,000 个 token 要多少钱?

按当前费率,20,000 个 token 作为未缓存输入时为 $0.02,作为缓存输入时为 $0.001,作为输出时为 $0.054。一次请求同时包含输入和输出时,应把对应费用相加。

1,000,000 个 token 有多少?

100 万 token 是 StepFun 的计费单位,也是 Step 5 Preview 标注的最大上下文窗口。它所代表的文本量会随语言、格式、图像和分词方式变化,因此用 API 实测比换算成固定页数更可靠。

$1 能买多少 token?

按 Step 5 Preview 标准费率,$1 可以购买 1M 个未缓存输入 token、20M 个缓存输入 token,或约 370,370 个输出 token。Step Plan 则不同:StepFun 表示价值 $1 的模型用量约对应 7M Credits,而 Credits 不是 token。

200,000 个 token 算多吗?

它相当于模型 1M-token 上下文窗口的 1/5。按当前费率,200,000 个 token 作为未缓存输入时为 $0.20,作为缓存输入时为 $0.01,作为输出时为 $0.54。

10 亿个 token 值多少钱?

按 Step 5 Preview 当前标准费率,1B 个 token 作为未缓存输入时为 $1,000,作为缓存输入时为 $50,作为输出时为 $2,700。混合工作负载的成本取决于实测的输入、缓存和输出占比,会落在这些数值之间。

Step 5 Preview 免费吗?

截至 2026 年 9 月核验的官方文档,没有列出免费的 Step Plan 档位或有保证的 API 额度。开放权重计划于 10 月 15 日发布,但自托管仍会产生基础设施成本。

StepFun 有学生优惠吗?

当前 Step Plan 概览和 API 定价页面均未列出学生专属价格。除非结账时账户显示单独促销,否则学生适用相同的公开套餐与 token 费率。

Step Plan 可以退款吗?

StepFun 表示已支付的费用不予退还。用户可以随时取消,服务会持续到当前计费周期结束。

Step Plan 在 2026 年调整过价格吗?

调整过。2026 年 7 月 24 日,StepFun 将 Step Plan 从按请求次数限制的 Coding Plan,改为按 Credits 额度计量的 Token Plan。当前体系按月发放 Credits、月底清零,并且从旧套餐升级到当前套餐后无法退回。

获取面向企业主的 AI 工具地图

在为功能重叠的工具付费前,先让每个模型对应一个可衡量的业务成果。获取面向企业主的 AI 工具地图,用其中的成本、质量和路由检查方法,辅助下一次采用决策。

最近更新
2026年9月21日
分类
AI

在 Google 中优先显示本站

将 omidsaffari.com 添加为 Google 搜索的优先来源

把 omidsaffari.com 设为优先来源,Google 会在 Top Stories、AI Overviews 和 AI Mode 中为您优先展示。

Nouswise评测:引用可追溯,但还不该全面采用

Nouswise评测:引用可追溯,但还不该全面采用

这篇Nouswise评测拆解其引用溯源、项目工作流、API与MCP能力,并核对Starter、Essential和Pro定价。结论是:它适合进入重视证据链的团队候选名单,但公开价格互相冲突,核心准确性也缺少实测;采购前应先用包含版本冲突、图表和无答案问题的资料包验证,再决定是否升级。2026年9月10日AI
AI施工报审审核工具怎么选:5款产品深度对比

AI施工报审审核工具怎么选:5款产品深度对比

横向比较 BuildSync、Part3、Nomic、InspectMind 和 SpecLens 五款 AI施工报审审核工具,逐项分析规范与送审资料的双向引用、未知项处理、版本追踪、文件支持、系统回传和部署成本,并给出适合总包商、设计团队、大型 AEC 企业及按次试点的选型建议与验证清单。2026年9月9日AI
兽医AI病历工具对比:VetGeni 与 ScribbleVet 怎么选

兽医AI病历工具对比:VetGeni 与 ScribbleVet 怎么选

对比 VetGeni 与 ScribbleVet 的价格、SOAP额度、PIMS集成与协作。150条以内 ScribbleVet Essential 更便宜,超过后 VetGeni 的 $50 无限记录方案更划算;诊所还应核对员工席位、Cornerstone 或 Browser Companion 覆盖和数据导出。2026年9月8日AI
InspectMind AI评测:施工图审查能力、价格与适用场景

InspectMind AI评测:施工图审查能力、价格与适用场景

InspectMind AI评测:它能否真正提升施工图审查效率?本文拆解其证据引用能力、按次计费档位、复查成本、公开样例与数据留存限制,并与Ichi、Bluebeam Max和BuildCheck逐项对比,帮助建筑师、工程师、承包商和开发团队判断它适合做二次审图,还是会把验证负担和修订成本留给人工流程。2026年9月8日AI
BuildSync vs SpecLens:施工文件 AI 审查怎么选?

BuildSync vs SpecLens:施工文件 AI 审查怎么选?

BuildSync vs SpecLens 怎么选?两款工具都能用 AI 审查施工文件,但适用工作流完全不同。本文从施工送审、Procore 与 ACC 集成、规格对比、文件格式、证据引用、导出方式和公开定价逐项拆解,并给出一套受控样本测试方法,帮助总包商、项目工程师和采购团队判断哪款工具更适合实际流程。2026年9月8日AI
马科兽医 AI 病历工具怎么选:8 款产品排名与对比

马科兽医 AI 病历工具怎么选:8 款产品排名与对比

对比 8 款面向马科流动诊疗的兽医 AI 病历工具,逐项核查离线录音、多马匹分档、PIMS 导出方式、试用条件与每位兽医的成本。本文给出按网络状况和就诊规模筛选产品的方法,并提供一套标准化马场试点流程,帮助诊所判断 CoVet、VetRec、Talkatoo 等工具能否安全进入真实病历工作流。2026年9月7日AI
ChatGPT Plus 还是 Claude Pro?2026 年 Claude 与 ChatGPT 对比

ChatGPT Plus 还是 Claude Pro?2026 年 Claude 与 ChatGPT 对比

ChatGPT Plus 和 Claude Pro 都是每月 $20,但真正的差别不在跑分。本文以 Claude Opus 4.8 和 GPT-5.5 为准,逐项比较编程、写作、图像生成、上下文窗口、API 价格与订阅档位,帮你判断 2026 年该为哪一款工具付费、何时值得同时购买两者,避开仍在比较旧模型的过时结论。2026年9月6日AI
2026年9款最佳AI Agent平台:真实价格与避坑指南

2026年9款最佳AI Agent平台:真实价格与避坑指南

2026年该选哪款 AI Agent平台?本文按本周官网实时价格横评 n8n、Lindy、Claude Code 等 9 款工具,拆解固定席位与按量计费的真实成本、免费额度、核心优势和使用限制,并按技术团队、非技术用户、营销运营、人工审批与自主编程场景给出选择建议,同时点明容易让账单失控、预算难预测的产品与计费陷阱。2026年9月6日AI
订阅通讯

每周日,一封信。写运转中的系统,不写热评。

每周一期。无垃圾邮件。随时退订。