Step 5 Preview 价格详解:API 与 Step Plan 怎么选
Step 5 Preview 价格怎么计算?本文拆解标准 API 的输入、缓存与输出费率,对比 Step Plan 四档订阅、Credits 有效期、Base URL 计费路径,以及 100 次调用的成本测算,帮你识别扣错账户的风险,并按真实工作负载在订阅与按量付费之间做出更稳妥的选择。

Step 5 Preview 价格为:标准 API 每 100 万未缓存输入 token $1.00、每 100 万缓存输入 token $0.05、每 100 万输出 token $2.70。真正棘手的是计费路径:Step Plan Credits 与按量付费 token 是两套独立系统,即使请求成功,也可能扣错账户。
以下费率与套餐条款已于 2026 年 9 月 21 日(模型发布次日)根据 StepFun 实时定价文档核验。Step 5 Preview 目前已可通过 StepFun 产品和 API 使用;StepFun 表示开放权重将于 10 月 15 日发布,现阶段尚未开放。

Step 5 Preview 价格:先看结论
标准 API 的输入成本很低,但输出量对账单的影响要大得多。StepFun 的实时定价页面为 step-5-preview 列出了三档费率:
- 未缓存输入: 每 1M token $1.00
- 缓存输入: 每 1M token $0.05
- 输出: 每 1M token $2.70
输出费用既包括模型内部推理,也包括最终答案。因此,即使用户看到的回答很短,只要模型在作答前进行了较长推理,输出账单仍可能明显增加。对 Agent 模型做预算时,这应是第一个持续监控的变量。
缓存折扣很可观,但在实际测量前,不能把它当作必然获得的优惠。对于长度超过 256 token 的输入,StepFun 会自动检查是否存在重复的提示词前缀。命中缓存时,每 100 万 token 按 $0.05 计费;未命中时(包括首次写入缓存)按 $1.00 计费。把稳定的系统指令、示例和对话历史放在提示词前部,有利于复用缓存;如果开头就是动态内容,缓存复用会被破坏。
第二个变量是支付通道。标准 API 请求从按量付费账户余额中扣款,Step Plan 请求则消耗订阅每月发放的 Credits。模型名称即便完全相同,费用也可能落到不同账户。
StepFun Step Plan 套餐一览
如果长期在受支持的编程工具或 Agent 平台中使用,并且能消耗完每月额度,Step Plan 的标价价值通常更高。所有档位都享有相同的高速模型性能;升级套餐增加的是 Credits 额度,而不是模型速度。
以上是截至 2026 年 9 月核验的 Step Plan 价格。季付与年付都要一次性付款,但 Credits 仍按月发放。购买年付套餐,并不会得到一整年可提前调用的额度池,因此无法把未来月份的额度挪到业务上线高峰期使用。
套餐越高,每月 1B Credits 的价格下降越明显:Mini 约为 $17.48,Plus 为 $6.24,Pro 为 $3.63,Max 为 $2.48。因此,Mini 更适合作为严格控制用量的入门档,而不是常规使用的默认选择。Plus 只贵 $3,却提供 4 倍额度。
最清晰的分界点就是各档额度:月用量不超过 400M Credits 才选 Mini;1.6B 以内选 Plus;8B 以内选 Pro;40B 以内选 Max。Booster 可以应对偶发峰值,但如果经常超额,就说明应由更高一档套餐承载基础用量。
Mini 尤其能说明问题。给 Mini 加购一个 400M Small booster,总成本为 $13.98,只得到 800M Credits;Plus 则只需 $9.99,却有 1.6B Credits。如果预计会超过 400M,一开始就买 Plus,比之后给 Mini 补额度更划算。
Step Plan Credits 不是 token,也不是现金
Credits 是 StepFun 订阅体系内部的计量单位。它既不是输入 token 或输出 token,也不是美元,更不是可以提现的账户余额。
StepFun 给出的近似换算关系是:价值 $1 的模型用量约等于 7M Credits。这有助于粗略评估套餐对应的使用价值,但不代表 1 Credit 就等于 1 token。不同模型可能以不同方式消耗 Credits,而推理量较大的回答,其可计费输出也可能远高于屏幕上显示的答案长度。
从量级看,400M Credits 除以 7M,约等于价值 $57.14 的名义模型用量;另一端,40B Credits 约对应 $5,714.29。这只是依据 StepFun 自身近似换算得出的示例,不是现金余额,也不是承诺可获得的 token 数量。
采购团队要求按 token 比价时,这一区别非常重要。Step Plan 用户不能简单地把 7M Credits 除以某个 token 费率,就认定结果是所有模型和工作负载都能保证获得的额度。套餐是在调用完成后,按实际用量折算为 Credits;标准 API 计费则直接列出 token 费率。
做粗略容量规划时使用换算关系;管理订阅时查看 Credits 账本;预测标准 API 成本时查看 prompt_tokens、cached_tokens 和输出用量。混用这三种口径,只会得到一份看似精确、实际错误的预算。
Step 5 API 价格取决于 Base URL
请求最终由哪套系统计费,取决于 Base URL。只有 API key,并不能自动选择 Step Plan。
StepFun 为订阅通道提供了以下端点:
- Claude Code 或 Anthropic SDK:
https://api.stepfun.ai/step_plan - OpenAI SDK Chat Completions:
https://api.stepfun.ai/step_plan/v1
标准 API 使用标准地址和独立额度。StepFun 明确指出,在该通道请求成功,并不代表消耗了订阅 Credits;它只能证明标准通道接受了当前 key 和账户状态。

这会在编程工具中造成一种不易察觉的配置错误:开发者填入有效 key,却保留了客户端里旧的服务商 URL;请求顺利返回后,便以为刚购买的订阅已经承担费用。模型确实能运行,但被扣减的可能仍是另一个余额。
应从以下 4 处核对路径:
- 确认客户端配置中的 Base URL 完全正确。
- 确认所选模型是
step-5-preview,而不是旧别名或自动回退模型。 - 发送 1 个经过脱敏的小请求。
- 检查哪一本账发生了变化:Step Plan Credits,还是标准账户余额。
Step Plan 也不适用标准 API 的累计充值速率限制表。标准 V0 行显示:累计充值 $0 时,并发数为 5、每分钟 10 次请求、每分钟 5,000,000 token。这只是速率限制档位,不代表免费赠送 token;Step Plan 用量由其 Credits 额度管理。
Step 5 Preview 调用 100 次要多少钱
用一个明确的工作负载,可以直观看出缓存与输出量如何影响成本。假设共发起 100 次调用,每次包含 10,000 个输入 token 和 1,000 个总输出 token(包括推理)。整批请求合计 1,000,000 个输入 token 和 100,000 个输出 token。
完全未命中缓存时:
- 输入:1M × $1.00 = $1.00
- 输出:0.1M × $2.70 = $0.27
- 合计:$1.27
实测输入缓存命中率为 90% 时:
- 未缓存输入:0.1M × $1.00 = $0.10
- 缓存输入:0.9M × $0.05 = $0.045
- 输出:0.1M × $2.70 = $0.27
- 合计:$0.415
缓存命中率 90% 时可节省 $0.855,即 67.32%。整张账单并不会节省 95%,因为输出费用没有变化。当输入成本被压低后,推理长度就会成为主要成本。

这个示例来自计算,而非真实账单。核验时没有可获授权的 StepFun 账户,因此并未发送请求,也没有产生用量扣减。所有输入数据均直接取自 StepFun 当前费率表,计算过程可以复现。
计算还假设上述输出总量已经包含推理。如果模型的实际推理量超过这一假设,即便可见答案依旧很短,总输出量与最终账单也会同步上涨。
预测生产成本时,不要根据可见答案长度设定输出预算。应记录 API 响应中的总输出用量,区分通过验收的结果与重试请求,再计算每个合格结果的成本。重试次数更少的模型,可能比 token 单价更低的模型更省钱;过于冗长的模型,也可能抵消输入端的成本优势。
为什么 $0.51 混合价格不是你的实际账单
目前流传的 Step 5 Preview $0.51,是用于横向比较的标准化价格,并非 StepFun 的第四种费率。Artificial Analysis 按 7:2:1 的比例混合价格:缓存输入占 7 份,普通输入占 2 份,输出占 1 份。
将这个比例代入 StepFun 费率:
- 0.7 × $0.05 缓存输入 = $0.035
- 0.2 × $1.00 输入 = $0.20
- 0.1 × $2.70 输出 = $0.27
- 合计 = $0.505,四舍五入为每 1M 混合 token $0.51
这种混合方式适合在统一工作负载下给不同服务商排序;但如果 Agent 会生成很长的推理链、很少重复提示词前缀,或输入与输出比例不同,它就不适合直接拿来做预算。
决策规则很简单:用实测的缓存输入、未缓存输入和输出占比,替换 7:2:1。尚无日志时,先按完全不命中缓存的情况编制预算,把缓存带来的节省视为额外收益。
Step 5 Preview 价格与 API 对比
在同一个无缓存工作负载下——1M 输入 token 加 100K 输出 token——Step 5 Preview 明显低于 StepFun 发布对比中提到的另外两个前沿模型。
这张表只统一了 token 用量,并未统一任务完成质量。如果一次 $1.27 的运行无法通过验收,还要把工作转给人工或第二个模型处理,就不能算更便宜。反过来,即使结果质量很好,用一次 $15 的模型来完成低价值分类任务也不经济。
可以把 Step 5 Preview 当作成本导向的挑战者,在范围明确的生产样本上测试。以当前已经达到质量门槛的模型作为对照,然后比较每个合格结果的成本。若想更全面地查看费率,可参考最便宜的 AI API 对比;若想了解缓存行为如何改变低价模型的实际账单,可阅读 DeepSeek 价格。
免费使用方式与 10 月开放权重日期
当前官方文档中,没有任何有保证的免费 Step Plan 或 API 额度。Step Plan 只列出 4 个付费档位,没有试用套餐。标准 API 虽然列出了累计充值 $0 的 V0 速率限制档位,但模型调用仍按已公布的 token 价格计费。速率限制表里的零金额,不代表承诺免费用量。
不订阅的明确做法是等待。StepFun 表示开放权重计划于 2026 年 10 月 15 日发布。对自托管感兴趣、又不急于使用 API 的用户,可以等到那时再决定是否购买 Step Plan 或标准 API token。开放权重免去的是服务商的调用费,不是 GPU、推理服务、可观测性和工程成本。
谁可以完全不向 StepFun 付费?只想研究已发布权重、并且本身已有算力的研究人员,或许无需付费。现在就需要在线托管推理的开发者,则应为标准 token 账单或付费 Step Plan 档位编列预算。
不要把未来将发布的开放权重描述成当前可用的免费套餐。截至 9 月 21 日,托管模型已上线,但开放权重仍处于计划发布阶段。
隐性成本:到期、Booster 与年付锁定
Step Plan 最昂贵的错误通常不是超额,而是额度闲置。每月 Credits 会在月底清零,即便订阅费按季或按年预付,也不能结转至下个月。
这意味着,年付折扣只有在用得完额度时才成立。Flash Plus 年付 $95.99,而连续 12 个月月付合计 $119.88,标价上节省 $23.89;但只要有 1 个低用量月份,这部分价值就可能被闲置额度吃掉,因为 1.6B Credits 仍会按期失效。年付锁定了付款,却依然要面对 12 个彼此独立、当月不用就作废的额度周期。
Booster 可以应对临时高峰,而不改变续费日期:
- Small: $6.99,可得 400M Credits
- Large: $9.99,可得 1.6B Credits
只有有效 Step Plan 订阅才能购买 Booster,且每份 Booster 都有独立的 30 天有效期。如果月度 Credits 与 Booster Credits 同时存在,StepFun 会优先扣除更早到期的额度。这个规则有一定帮助,但不会把所有 Credits 合并成一个长期有效的余额池。
这里没有常规意义上的按 Credit 超额计费。额度耗尽后,只能购买 Booster、升级套餐,或等待下个月再次发放。应把 Booster 当作突发容量;如果连续 2 个周期都要购买,就该重新核算下一档套餐。
取消规则同样很严格。StepFun 表示可随时取消,但已支付费用不予退还,服务会持续到当前计费周期结束。因此,年付是在用折扣交换退款风险,同时还要承担 12 个独立的额度到期窗口。
老账户还要留意价格体系的历史变化。2026 年 7 月 24 日,StepFun 将按请求次数计费的 Coding Plan 升级为基于 Credits 的 Token Plan。现有 Coding Plan 订阅者在满足文档所列条件时,可以保留原通道;但一旦转到 Token Plan,就无法退回。旧截图里显示的提示词次数限制,不能代表当前公开套餐。
Step Plan 和标准 API 分别适合谁
如果工作负载位于受支持的编程或 Agent 工具内、整个月持续发生,并且能落在可预测的 Credits 区间,选择 Step Plan。按每美元对应的名义用量看,订阅远高于按量付费;但前提是集成确实使用订阅端点,而且 Credits 不会闲置到期。
如果要构建生产服务、需要透明的按 token 核算、希望用量随客户需求扩缩,或无法接受月度额度到期,选择标准 API。公开费率便于建立单位经济模型,响应中的用量字段也会给出输入、缓存和输出构成。
如果工作负载还没有验收标准,两者都先别选。低廉的模型账单可能掩盖昂贵的重试与人工审核。先定义一个审核者能够评分的结果,再与当前模型比较每个合格结果的成本。
对于每天使用 Claude Code 的个人技术开发者,只要确认 Base URL 无误,Flash Plus 是合理的首个订阅档位。对用自动化服务客户的融资创业者,标准 API 更容易按产品和客户归集成本。对中型企业 CTO 而言,Step Plan 应归入开发工具支出,生产推理则应使用独立计量的服务账户。
最终选择取决于可预测性:稳定的月度交互用量更适合 Step Plan;有波峰波谷、需要归因且可编程的流量更适合标准 API。团队可以同时使用两者,但 key、端点和账本应按通道清楚命名,避免把不同余额混为一谈。
周一就做:转移预算前先验证计费路径
周一先用 1 个脱敏请求验证 1 条计费路径,再购买更高档套餐或迁移生产流量。
明确通道
先确定测试对象是 Step Plan 还是标准 API,并在测试用例旁记录预期发生变化的账本和准确的 Base URL。
发送一个边界明确的请求
如果需要测试缓存,请使用长度超过 256 token 且不含敏感信息的提示词。记录模型 ID、提示词 token、缓存 token、总输出 token 和请求 ID。
核对扣减记录
调用完成后打开对应控制台,确认订阅通道扣减了 Step Plan Credits,或标准通道改变了账户余额。
运行 100 次调用样本
只有在通道得到验证后,才重放 100 个有代表性且经过脱敏的请求。把实测缓存构成、总输出量、重试次数和合格结果,与无缓存时 $1.27 的基准对比。
最终应得到一个可直接用于决策的单位:在预定计费通道上,每个合格结果需要多少美元或 Credits。有了它,就能选择套餐,而不用把基准测试的混合价格误当成真实账单。
常见问题
1000 个 token 要多少钱?
对于 Step 5 Preview,1,000 个 token 作为未缓存输入时价格为 $0.001,作为缓存输入时为 $0.00005,作为输出时为 $0.0027。推理 token 与最终答案 token 都按输出费率计费。
20,000 个 token 要多少钱?
按当前费率,20,000 个 token 作为未缓存输入时为 $0.02,作为缓存输入时为 $0.001,作为输出时为 $0.054。一次请求同时包含输入和输出时,应把对应费用相加。
1,000,000 个 token 有多少?
100 万 token 是 StepFun 的计费单位,也是 Step 5 Preview 标注的最大上下文窗口。它所代表的文本量会随语言、格式、图像和分词方式变化,因此用 API 实测比换算成固定页数更可靠。
$1 能买多少 token?
按 Step 5 Preview 标准费率,$1 可以购买 1M 个未缓存输入 token、20M 个缓存输入 token,或约 370,370 个输出 token。Step Plan 则不同:StepFun 表示价值 $1 的模型用量约对应 7M Credits,而 Credits 不是 token。
200,000 个 token 算多吗?
它相当于模型 1M-token 上下文窗口的 1/5。按当前费率,200,000 个 token 作为未缓存输入时为 $0.20,作为缓存输入时为 $0.01,作为输出时为 $0.54。
10 亿个 token 值多少钱?
按 Step 5 Preview 当前标准费率,1B 个 token 作为未缓存输入时为 $1,000,作为缓存输入时为 $50,作为输出时为 $2,700。混合工作负载的成本取决于实测的输入、缓存和输出占比,会落在这些数值之间。
Step 5 Preview 免费吗?
截至 2026 年 9 月核验的官方文档,没有列出免费的 Step Plan 档位或有保证的 API 额度。开放权重计划于 10 月 15 日发布,但自托管仍会产生基础设施成本。
StepFun 有学生优惠吗?
当前 Step Plan 概览和 API 定价页面均未列出学生专属价格。除非结账时账户显示单独促销,否则学生适用相同的公开套餐与 token 费率。
Step Plan 可以退款吗?
StepFun 表示已支付的费用不予退还。用户可以随时取消,服务会持续到当前计费周期结束。
Step Plan 在 2026 年调整过价格吗?
调整过。2026 年 7 月 24 日,StepFun 将 Step Plan 从按请求次数限制的 Coding Plan,改为按 Credits 额度计量的 Token Plan。当前体系按月发放 Credits、月底清零,并且从旧套餐升级到当前套餐后无法退回。
获取面向企业主的 AI 工具地图
在为功能重叠的工具付费前,先让每个模型对应一个可衡量的业务成果。获取面向企业主的 AI 工具地图,用其中的成本、质量和路由检查方法,辅助下一次采用决策。
- 最近更新
- 2026年9月21日
- 分类
- AI







