Claude Code 自动模式不再单收分类器费用,但有前提

Claude Code 2.1.278 可在符合条件的 API 与 Enterprise 会话中取消自动模式分类器的单独费用,但网关、区域或凭证仍可能触发计费回退。本文说明如何通过 /status 确认服务端路径、排查 safeguards 等透传字段,并在调整智能体预算前验证真实生产链路。

Saturday, September 19, 2026Omid Saffari
Claude Code 自动模式不再单收分类器费用,但有前提

Claude Code 自动模式在 2.1.278 版本中可以为 API 与 Enterprise 会话省去一整类费用:符合条件时,分类器检查不再单独计费。但前提是检查必须由服务端执行;网关、区域或凭证只要有一环不匹配,旧的 token 账单就可能悄然回来。

Claude Code 自动模式,账单只改这一项

自动模式让 Claude Code 持续工作,无须每次执行高风险操作都等你批准。在 shell 命令、网络请求等操作运行前,一个更小的决策模型——分类器——会先完成检查。

在 2026 年 9 月 19 日版本发布前,API、Enterprise 以及受支持的云服务商会话可能会为这些检查单独发起模型请求。这些请求会消耗 token,也会产生费用。如果智能体频繁执行 shell 和网络操作,安全层就会在你真正交给 Claude 的任务之外,再添一笔用量。

2.1.278 提供了另一条路径。Claude Code 现在可以请求服务端在会话的常规模型请求中完成同一项安全判定。启用这条服务端路径后,Anthropic 不会对分类器检查收费

这不是 Claude token 折扣,也不是 API 降价。它取消的是符合条件的会话中,分类器单独发起请求所产生的额外开销。

它也不会让所有 API 或 Enterprise 用户自动进入自动模式。变化只涉及会话已在使用自动模式后,检查由哪里执行。更完整的权限机制可参阅 Claude Code 自动模式

现在有两条计费路径

理解这项变化最直接的方法,是把它看作一次决定账单结果的路由选择。

会话路径检查在哪里执行需要支付什么
服务端路径服务端在会话的模型请求内完成判定常规模型与工具用量,不再单收分类器费用
回退路径Claude Code 自行发送分类器请求常规模型与工具用量,加上分类器请求的 token 费用
Pro、Max 或 Team分类器开销原本就不收费2.1.278 不会带来新的预算变化

成本计算同样直观:

符合条件的会话成本 = 常规模型用量 + 任何单独计价的工具。

回退会话成本 = 常规模型用量 + 任何单独计价的工具 + 分类器请求的 token 用量。

省下的是最后一项,而不是整笔 Claude Code 账单。

Anthropic 没有公布每个会话能固定节省多少费用,任何通用百分比都是凭空捏造。客户端检查会发送部分对话记录和待执行操作。普通读取和工作目录内的编辑通常不会触发分类器,绝大多数额外开销来自 shell 命令和网络操作。因此,大量调用工具的无人值守任务可能比短暂的代码阅读会话省得更多,但准确数字只能从你自己的用量记录中得出。

架构模型展示同一个 Claude Code 会话的两条路径:服务端路径不单收分类器费用,网关回退路径则对分类器请求计费
两条路径都会产生模型费用;只有服务端路径会取消分类器请求这一笔单独费用。

是否符合条件,要看会话结果而不是账户承诺

在 Enterprise 方案、Claude API 账户、AWS 上的 Claude Platform、Amazon Bedrock、Google Cloud 的 Agent Platform、Microsoft Foundry 以及网关会话中,Claude Code 默认会请求服务端检查。这个范围看似很广,但不代表这些平台上的每个会话现在都符合条件。

平台上线进度、区域、凭证和流量路径都会影响结果。在 Bedrock、Agent Platform、Foundry 以及已登录 Claude apps 的网关中,自动模式还要求使用 Claude Sonnet 5、Claude Opus 4.7 或更高版本,或者 Fable 模型。

这正是 2.1.278 在 /status 中新增 Auto mode server 一行的原因:

  • Enabled 表示会话中需要检查的操作由服务端给出判定,不再单收分类器费用。
  • Disabled 表示会话已经回退到 Claude Code 自己的分类器请求,仍按此前方式计费。

相比方案名称或上线公告,这一行更有用:它直接告诉你,当前会话实际走到了哪条计费路径。

Claude Code 网关最容易在这里失效

服务端路径需要少量控制数据完整走完往返链路。网关如果只转发自己认识的字段,就可能删掉这些数据,而普通 Claude 请求仍然看起来一切正常。

常见断点包括:请求头被改写、未知的请求体字段被丢弃、响应 ID 被修改,以及流式事件中的键消失。出现这些情况时,要么服务端根本收不到检查请求,要么 Claude Code 收不到判定结果。

兼容要求非常具体。网关必须原样透传请求头和正文中的字段,包括 safeguards 字段;返回响应与流式事件时,也不能删除 safeguard_results,或改写工具调用 ID。网关兼容指南要求把字段和请求头都视为开放列表,因为 Claude Code 未来的功能还可能加入新内容。

即使这套传输机制出错,自动模式也不会失败。Claude Code 会回退到自己的分类器,并显示计费提示。这样可以保证任务继续执行,却很容易在预算中被忽略:智能体仍在运行,但额外的用量项目也回来了。

四类团队需要调整工作方式

运行 LLM 网关的平台团队

选取一个有代表性的 Claude Code 会话进行兼容性测试。如果 /status 显示 Disabled,先检查网关对请求和流式响应的转换,再调整任何预算预测。

收益不只在今天的分类器费用。让未知字段原样通过、不做改写,也能降低下一项 Claude Code 功能在同一边界失效的概率。

预测智能体成本的 FinOps 负责人

把估算拆成常规模型支出与分类器开销。只有显示服务端路径已启用的会话,才应移除第二项预算。

这样可以避开两种错误预测:网关阻止了节省费用却提前把它算进去,或者服务端已经接管检查却仍为分类器预留预算。更完整的模型与方案价格仍应纳入主要的 Claude Code 计费模型

跨区域部署的企业管理员

不要只认证一次功能,就默认每个办公室、服务商账户和凭证都会得到相同结果。开发者实际使用的每条路径都应执行同样的检查。

这样得到的是一张以真实会话为依据的简短资格矩阵,而不是对着平台标志做推断。即使没有任何配置错误,尚未上线服务端检查的区域仍可能继续走回退路径。

运行无人值守任务的 Agent SDK 团队

交互式终端可能停在提示处。非交互式 -p 运行会把提示写入 stderr,而 stream-json 会发出一条 system 警告,供 Agent SDK 应用读取。

应将这个信号收进日志或遥测数据。否则工作流会一直成功,计费回退却要等支出实际发生后才会显现。

调整预算前,先核验真实路径

  1. 确认客户端版本

    运行 claude --version。本文所述的服务端默认行为要求 Claude Code 2.1.278 或更高版本。

  2. 使用有代表性的路径

    启动一个自动模式会话,使用与真实工作负载相同的凭证、区域、服务商和网关。绕过生产路由的直连测试,验证的是另一条路径。

  3. 检查当前会话

    运行 /status,查看 Auto mode server 一行。把 EnabledDisabled 与测试路径一起记录下来。

  4. 追踪已回退的路径

    如果显示 Disabled,先找到计费回退提示,再检查网关是否完整保留 safeguardssafeguard_results、请求头、流式键以及工具调用 ID。若没有网关,则与管理员或服务商核对平台、区域和凭证的上线情况。

  5. 在新会话中复测

    修复网关后,启动新会话并再次检查 /status。只有承载生产工作负载的路径显示 Enabled 后,才能修改预算预测。

这项变化的真实边界

这次发布取消了一项浮动成本,却没有给出可以直接从智能体预算中扣除的固定百分比。基础模型仍会按常规费率读取上下文、推理、生成输出和使用工具;这些费用通常仍占会话支出的更大部分。

资格状态还可能在你无法控制的边界发生变化。某个云平台可能尚未完成特定区域或凭证的上线;网关服务商也可能需要更新透传行为。无论哪种情况,Claude Code 都会继续执行安全检查,并继续对回退请求收费。

如果团队已经确定网关不支持服务端路径,可以选择退出:

Bash
export CLAUDE_CODE_AUTO_MODE_SERVER=0

该设置会阻止 Claude Code 请求服务端检查、移除回退提示,并刻意保留需要计费的客户端分类器路径。它用于减少提示干扰,而不是节省成本。Anthropic 也将其标记为临时设置,且通过 Anthropic API 直连时会忽略它。

下周一该做什么

如果你负责部署 API、Enterprise、服务商支持或网关支持的 Claude Code,本周就应行动。将一条真实路径升级到 2.1.278 或更高版本,运行自动模式会话,检查 /status,并在移除预算中的分类器开销前,确认网关如何处理请求和响应。

如果 /status 显示 Disabled,且没有可修复的网关,就等待相应平台、区域或凭证完成上线。在等待期间,预测中仍应保留分类器费用。

如果使用 Pro、Max 或 Team,这次发布不会改变分类器预算,因为这些方案的分类器开销原本就不收费。未使用自动模式的团队也不受影响。

如果想把下一次平台变化也转化为可执行的运营判断,欢迎订阅邮件通讯

最近更新
2026年9月19日
分类
Explained

在 Google 中优先显示本站

将 omidsaffari.com 添加为 Google 搜索的优先来源

把 omidsaffari.com 设为优先来源,Google 会在 Top Stories、AI Overviews 和 AI Mode 中为您优先展示。

Vercel 构建费用新机制:Turbo 可按单次部署启用

Vercel 构建费用新机制:Turbo 可按单次部署启用

Vercel 现在允许 Pro 和 Enterprise 项目仅为一次部署启用 Turbo,无需修改项目默认构建机器。本文拆解 GitHub、CLI 与 API 三种用法,并用同一组计费数据说明何时值得为紧急发布支付更高的 Vercel 构建费用,以及如何验证下一次部署已恢复原配置。2026年9月18日Explained
ChatGPT for Word 上线:写文档不再来回复制

ChatGPT for Word 上线:写文档不再来回复制

ChatGPT for Word 将起草、摘要、选中文本修改和基础排版直接带进 Word 侧边栏。本文详解插件的安装条件、Microsoft 与 ChatGPT 双重管理权限、共享用量和 token 费率、数据边界,以及一套可执行的文档编辑流程,帮助团队判断是否值得启用,并用真实文档衡量省下的搬运时间与新增的审核成本。2026年9月18日Explained
Antigravity 迁移指南:10 月 5 日前升级本地任务

Antigravity 迁移指南:10 月 5 日前升级本地任务

Google 将于 2026 年 10 月 5 日停用 5 月版 Antigravity 智能体。本指南拆解 Antigravity 迁移路径:仅消费最终输出的远程任务只需更换智能体 ID;使用本地工具或解析 function_call 的集成,还必须更新工具适配器、参数校验与测试流程,避免定时任务在截止日后悄然中断。2026年9月18日Explained
Cloudflare Workers RPC 链路追踪:慢请求卡在哪一跳,一眼看清

Cloudflare Workers RPC 链路追踪:慢请求卡在哪一跳,一眼看清

Cloudflare Workers 现已支持跨 JavaScript RPC 边界追踪请求,把调用方、下游 Worker、Durable Object、嵌套调用与回调串进同一条时间线。本文详解慢请求定位、span 读取、采样设置和按 span 计费逻辑,帮助团队在全面启用前测清事件量、保留期与配额影响。2026年9月17日Explained
Vercel 价格不只是月费:Hobby 旧预览可能撑不到 30 天

Vercel 价格不只是月费:Hobby 旧预览可能撑不到 30 天

Vercel Hobby 团队一旦超过 10GB Deployment Storage,未受保护的预览或生产部署可能在 30 天保留期结束前被删除。本文拆解仍受保护的部署、检查存储与回滚目标的方法,以及清理历史记录和升级 Pro 时应按完整 $20 月费而非单独存储单价做出的取舍。2026年9月17日Explained
Cloudflare AI Gateway:别让客户请求记到你的账上

Cloudflare AI Gateway:别让客户请求记到你的账上

Cloudflare AI Gateway 新增“要求提供商凭据”控制:缺少适用密钥的第三方请求会直接返回 HTTP 400,不再回退到 Unified Billing。本文拆解凭据优先级、5% 充值费、BYOK 别名限制、Workers AI 例外,以及从单一路由到全网关上线前必须完成的测试。2026年9月17日Explained
Cloudflare Hyperdrive 打通 Python Workers 与现有数据库

Cloudflare Hyperdrive 打通 Python Workers 与现有数据库

Cloudflare Hyperdrive 现已让 Python Workers 直接连接现有 PostgreSQL 和 MySQL 数据库。本文拆解何时可删除数据库桥接服务、Workers 与 Hyperdrive 的费用边界、驱动和 ORM 限制,并给出从 SELECT 1 到真实路由验证的安全迁移步骤。2026年9月16日Explained
Gemini 3.8 Live:后台查询时,AI 语音助手也能继续对话

Gemini 3.8 Live:后台查询时,AI 语音助手也能继续对话

Gemini 3.8 Live 支持异步函数调用,让 AI 语音助手在日历、订单或预订系统后台查询时继续与来电者沟通。本文拆解标准版与 Extended Thinking 的适用场景、完成信号、音频成本和生产风险,并给出用真实完成任务成本验证试点效果的方法,帮助团队避免误把中间播报当成任务完成。2026年9月16日Explained
订阅通讯

每周日,一封信。写运转中的系统,不写热评。

每周一期。无垃圾邮件。随时退订。