Claude Code 自动模式不再单收分类器费用,但有前提
Claude Code 2.1.278 可在符合条件的 API 与 Enterprise 会话中取消自动模式分类器的单独费用,但网关、区域或凭证仍可能触发计费回退。本文说明如何通过 /status 确认服务端路径、排查 safeguards 等透传字段,并在调整智能体预算前验证真实生产链路。

Claude Code 自动模式在 2.1.278 版本中可以为 API 与 Enterprise 会话省去一整类费用:符合条件时,分类器检查不再单独计费。但前提是检查必须由服务端执行;网关、区域或凭证只要有一环不匹配,旧的 token 账单就可能悄然回来。
Claude Code 自动模式,账单只改这一项
自动模式让 Claude Code 持续工作,无须每次执行高风险操作都等你批准。在 shell 命令、网络请求等操作运行前,一个更小的决策模型——分类器——会先完成检查。
在 2026 年 9 月 19 日版本发布前,API、Enterprise 以及受支持的云服务商会话可能会为这些检查单独发起模型请求。这些请求会消耗 token,也会产生费用。如果智能体频繁执行 shell 和网络操作,安全层就会在你真正交给 Claude 的任务之外,再添一笔用量。
2.1.278 提供了另一条路径。Claude Code 现在可以请求服务端在会话的常规模型请求中完成同一项安全判定。启用这条服务端路径后,Anthropic 不会对分类器检查收费。
这不是 Claude token 折扣,也不是 API 降价。它取消的是符合条件的会话中,分类器单独发起请求所产生的额外开销。
它也不会让所有 API 或 Enterprise 用户自动进入自动模式。变化只涉及会话已在使用自动模式后,检查由哪里执行。更完整的权限机制可参阅 Claude Code 自动模式。
现在有两条计费路径
理解这项变化最直接的方法,是把它看作一次决定账单结果的路由选择。
成本计算同样直观:
符合条件的会话成本 = 常规模型用量 + 任何单独计价的工具。
回退会话成本 = 常规模型用量 + 任何单独计价的工具 + 分类器请求的 token 用量。
省下的是最后一项,而不是整笔 Claude Code 账单。
Anthropic 没有公布每个会话能固定节省多少费用,任何通用百分比都是凭空捏造。客户端检查会发送部分对话记录和待执行操作。普通读取和工作目录内的编辑通常不会触发分类器,绝大多数额外开销来自 shell 命令和网络操作。因此,大量调用工具的无人值守任务可能比短暂的代码阅读会话省得更多,但准确数字只能从你自己的用量记录中得出。

是否符合条件,要看会话结果而不是账户承诺
在 Enterprise 方案、Claude API 账户、AWS 上的 Claude Platform、Amazon Bedrock、Google Cloud 的 Agent Platform、Microsoft Foundry 以及网关会话中,Claude Code 默认会请求服务端检查。这个范围看似很广,但不代表这些平台上的每个会话现在都符合条件。
平台上线进度、区域、凭证和流量路径都会影响结果。在 Bedrock、Agent Platform、Foundry 以及已登录 Claude apps 的网关中,自动模式还要求使用 Claude Sonnet 5、Claude Opus 4.7 或更高版本,或者 Fable 模型。
这正是 2.1.278 在 /status 中新增 Auto mode server 一行的原因:
Enabled表示会话中需要检查的操作由服务端给出判定,不再单收分类器费用。Disabled表示会话已经回退到 Claude Code 自己的分类器请求,仍按此前方式计费。
相比方案名称或上线公告,这一行更有用:它直接告诉你,当前会话实际走到了哪条计费路径。
Claude Code 网关最容易在这里失效
服务端路径需要少量控制数据完整走完往返链路。网关如果只转发自己认识的字段,就可能删掉这些数据,而普通 Claude 请求仍然看起来一切正常。
常见断点包括:请求头被改写、未知的请求体字段被丢弃、响应 ID 被修改,以及流式事件中的键消失。出现这些情况时,要么服务端根本收不到检查请求,要么 Claude Code 收不到判定结果。
兼容要求非常具体。网关必须原样透传请求头和正文中的字段,包括 safeguards 字段;返回响应与流式事件时,也不能删除 safeguard_results,或改写工具调用 ID。网关兼容指南要求把字段和请求头都视为开放列表,因为 Claude Code 未来的功能还可能加入新内容。
即使这套传输机制出错,自动模式也不会失败。Claude Code 会回退到自己的分类器,并显示计费提示。这样可以保证任务继续执行,却很容易在预算中被忽略:智能体仍在运行,但额外的用量项目也回来了。
四类团队需要调整工作方式
运行 LLM 网关的平台团队
选取一个有代表性的 Claude Code 会话进行兼容性测试。如果 /status 显示 Disabled,先检查网关对请求和流式响应的转换,再调整任何预算预测。
收益不只在今天的分类器费用。让未知字段原样通过、不做改写,也能降低下一项 Claude Code 功能在同一边界失效的概率。
预测智能体成本的 FinOps 负责人
把估算拆成常规模型支出与分类器开销。只有显示服务端路径已启用的会话,才应移除第二项预算。
这样可以避开两种错误预测:网关阻止了节省费用却提前把它算进去,或者服务端已经接管检查却仍为分类器预留预算。更完整的模型与方案价格仍应纳入主要的 Claude Code 计费模型。
跨区域部署的企业管理员
不要只认证一次功能,就默认每个办公室、服务商账户和凭证都会得到相同结果。开发者实际使用的每条路径都应执行同样的检查。
这样得到的是一张以真实会话为依据的简短资格矩阵,而不是对着平台标志做推断。即使没有任何配置错误,尚未上线服务端检查的区域仍可能继续走回退路径。
运行无人值守任务的 Agent SDK 团队
交互式终端可能停在提示处。非交互式 -p 运行会把提示写入 stderr,而 stream-json 会发出一条 system 警告,供 Agent SDK 应用读取。
应将这个信号收进日志或遥测数据。否则工作流会一直成功,计费回退却要等支出实际发生后才会显现。
调整预算前,先核验真实路径
确认客户端版本
运行
claude --version。本文所述的服务端默认行为要求 Claude Code 2.1.278 或更高版本。使用有代表性的路径
启动一个自动模式会话,使用与真实工作负载相同的凭证、区域、服务商和网关。绕过生产路由的直连测试,验证的是另一条路径。
检查当前会话
运行
/status,查看 Auto mode server 一行。把Enabled或Disabled与测试路径一起记录下来。追踪已回退的路径
如果显示
Disabled,先找到计费回退提示,再检查网关是否完整保留safeguards、safeguard_results、请求头、流式键以及工具调用 ID。若没有网关,则与管理员或服务商核对平台、区域和凭证的上线情况。在新会话中复测
修复网关后,启动新会话并再次检查
/status。只有承载生产工作负载的路径显示Enabled后,才能修改预算预测。
这项变化的真实边界
这次发布取消了一项浮动成本,却没有给出可以直接从智能体预算中扣除的固定百分比。基础模型仍会按常规费率读取上下文、推理、生成输出和使用工具;这些费用通常仍占会话支出的更大部分。
资格状态还可能在你无法控制的边界发生变化。某个云平台可能尚未完成特定区域或凭证的上线;网关服务商也可能需要更新透传行为。无论哪种情况,Claude Code 都会继续执行安全检查,并继续对回退请求收费。
如果团队已经确定网关不支持服务端路径,可以选择退出:
export CLAUDE_CODE_AUTO_MODE_SERVER=0该设置会阻止 Claude Code 请求服务端检查、移除回退提示,并刻意保留需要计费的客户端分类器路径。它用于减少提示干扰,而不是节省成本。Anthropic 也将其标记为临时设置,且通过 Anthropic API 直连时会忽略它。
下周一该做什么
如果你负责部署 API、Enterprise、服务商支持或网关支持的 Claude Code,本周就应行动。将一条真实路径升级到 2.1.278 或更高版本,运行自动模式会话,检查 /status,并在移除预算中的分类器开销前,确认网关如何处理请求和响应。
如果 /status 显示 Disabled,且没有可修复的网关,就等待相应平台、区域或凭证完成上线。在等待期间,预测中仍应保留分类器费用。
如果使用 Pro、Max 或 Team,这次发布不会改变分类器预算,因为这些方案的分类器开销原本就不收费。未使用自动模式的团队也不受影响。
如果想把下一次平台变化也转化为可执行的运营判断,欢迎订阅邮件通讯。
- 最近更新
- 2026年9月19日







