Vercel AI SDK 订阅计费拆解:Claude Code 与 Codex 到底由谁买单

Vercel AI SDK 可调用宿主机已登录的 Claude Code、Codex 等订阅额度。拆解 auto、direct 与 ai-gateway 的凭证优先级,说明模型费用会落到套餐、供应商 API 还是 AI Gateway,并算清单独支付的 Vercel Sandbox 成本,帮助个人与团队选对计费路径。

Tuesday, September 15, 2026Omid Saffari
Vercel AI SDK 订阅计费拆解:Claude Code 与 Codex 到底由谁买单

2026 年 9 月 14 日,Vercel 调整了 Vercel AI SDK 中嵌入式编程 Agent 的费用归属规则。AI SDK 现在可以调用宿主机上已登录且受支持的 Agent 订阅;在套餐额度用完前,下一次符合条件的模型运行不会产生额外费用,即增量成本为 $0。不过,Sandbox 计算资源仍会单独计费。

Vercel AI SDK 改变的是付款方,不是 Agent 本身

AI SDK 提供了一层统一接口,可通过 HarnessAgent 运行完整的编程 Agent。Vercel 将每个适配器称为 harness,是因为它封装的不只是一次模型调用:Agent 还带有自己的工具、工作区行为、会话状态、权限机制和上下文压缩能力。

这一区别很关键。此次更新不会让 Claude Code、Codex、Cursor 或其他 Agent 的编程能力变强;它只是为适配器增加了一种凭证来源——运行应用的机器上保存的原生订阅会话。

更新前,嵌入式运行必须显式提供模型供应商凭证或 AI Gateway 凭证。现在,符合条件的适配器可以回退到宿主机上已完成认证的订阅。整个发现过程无需修改应用代码,也不用新增设置。

更新公告 列出了 9 个适配器:Claude Code、Cline、Codex、Cursor、fx、GitHub Copilot、Grok Build、OpenCode 和 Pi。但这并不代表所有账户都能使用。底层 Agent 仍须支持订阅登录,登录后可以消耗多少额度,也仍由相应套餐规则决定。

对业务而言,最实用的结论很简单:同一个 agent.generate() 调用,可能因运行环境中的凭证不同而落到 3 个不同的预算科目。

凭证优先级决定由谁买单

认证模式共有 3 种,默认模式是 auto。对于 Claude Code、Codex 这类直连适配器,实际优先顺序如下:

模式凭证顺序模型费用计入哪里
autoAI Gateway 优先,其次是供应商凭证,最后是原生订阅若存在 VERCEL_OIDC_TOKENAI_GATEWAY_API_KEY,则扣除 Gateway 余额或计入账单;否则计入供应商 API 账户;若前两者都没有,再消耗套餐额度
direct供应商凭证优先,其次是原生订阅若存在供应商 API Key,则计入供应商 API 账户;否则消耗套餐额度
ai-gateway仅使用 AI Gateway扣除 Gateway 余额或计入 Vercel 账单;绝不会读取原生订阅

一个不起眼的环境变量,就可能改变整笔费用的归属。Claude Code 在 direct 模式下会先使用 ANTHROPIC_API_KEYANTHROPIC_AUTH_TOKEN,然后才轮到 Claude 订阅。Codex 则会先使用 OPENAI_API_KEYCODEX_API_KEY,再考虑 ChatGPT 权益。

auto 还会在上述顺序前增加一层:一旦检测到 Gateway 凭证,AI Gateway 会优先于供应商 Key 和订阅。

对某些适配器来说,网络路由与计费来源并不是一回事。fx 在 directai-gateway 模式下仍会通过 AI Gateway 发送模型请求;但如果没有设置适用的环境凭证,且未选择 ai-gateway,它现在也能识别并使用受支持的原生订阅。在把这张表当成通用的传输路径图之前,请先查看对应适配器页面。

架构路由图:Auto、Direct 和 Gateway 三个入口分别通往订阅额度、供应商 API 或 AI Gateway 计费
认证模式决定路径,而路径中的凭证仍会决定最终由哪个账户付款。

这种安全边界比把原始 OAuth Token 复制进隔离环境更可靠。Vercel 在宿主机上解析凭证并刷新 OAuth。当 Sandbox 支持请求转换时,Agent 看到的只是占位符;只有匹配的出站请求发出时,宿主机才会注入真实凭证。

这能避免密钥暴露给 Sandbox,却不会把个人订阅变成整个公司的共享算力池。

Vercel AI SDK 订阅计费怎么算

模型费用可以转移到订阅额度,运行时费用不会随之转移。

订阅额度

以 Claude Code 为例最容易看清这套逻辑。Claude Pro 按月付费为 $20,按年付费为 $200;Claude Max 每月为 $100 或 $200,分别提供 Pro 用量的 5x 或 20x。如果已经订阅其中一种套餐,通过原生认证发起的合格运行在共享额度耗尽前,不会再产生单独的模型费用。

这里真正重要的是“共享”。Anthropic 目前说明,Claude Agent SDK、claude -p 和第三方 Agent SDK 应用仍会消耗订阅限额;claude.ai、Claude Code 和 Claude Desktop 也共用同一用量限制。Vercel 的 Claude Code 适配器使用 Anthropic 的 Agent SDK,因此在实际使用中,嵌入式任务会与订阅者的其他 Claude 工作争抢同一份额度。

OpenAI 的预算结构相同,但计量方式不同。ChatGPT Plus 每月 $20,ChatGPT 各套餐均包含 Codex,具体限额因套餐而异。在相关产品可用的地区,Codex 与 ChatGPT Work、ChatGPT for Excel 及 Workspace Agents 共用一份 Agent 用量额度。符合条件的 Plus 和 Pro 用户可在套餐内用量耗尽后购买点数,但这些点数并不是 API 余额。

所以,订阅路径并不等于免费推理,而是有浮动上限的预付费容量。把后台任务交给适配器,今天也许能省下 API 费用,却可能压缩同一个人明天交互式使用的时长。

供应商直连 API

如果供应商 Key 被优先采用,费用就会计入供应商的按量计费账户。Claude Sonnet 4.6 当前标准 API 价格为:每百万输入 Token $3,每百万输出 Token $15。OpenAI 的 GPT-5.6 Luna 每百万输入 Token 为 $0.20,每百万缓存输入 Token 为 $0.02,每百万输出 Token 为 $1.20。

API 路径因此更容易归因,但编程 Agent 任务仍很难预估成本。仓库大小、对话历史、推理强度、重试次数和工具循环都会改变 Token 用量。应衡量已完成的任务,而不是 Prompt 数量。

AI Gateway

如果 Gateway 凭证优先,相关用量就会进入 AI Gateway。Vercel 按上游公开价格收费,不额外加收 Token 差价或平台费。通常会先扣除预付的 Gateway 余额,Enterprise 客户也可以合并计入 Vercel 账单。

这条路径让团队拥有统一的支出入口,也能使用 Gateway 预算控制。如果某次运行绕过 Gateway、改用原生订阅,这些控制不会随之生效。因此,团队应有意识地权衡边际成本节省与集中式预算治理。

Sandbox 计算资源

每个 AI SDK Agent 运行时仍在 Sandbox 中执行。在 Vercel 默认的 iad1 区域,Sandbox 价格 为每个 Active CPU 小时 $0.128,以及每个预配 GB 小时 $0.0212。进程等待模型响应或网络 I/O 时,CPU 计费会暂停,但内存会按整个实际运行时间持续计费。

Vercel 自己的 AI 代码验证示例运行 5 分钟,使用 2 个 vCPU 和 4 GB 内存。在 CPU 使用率为 100% 时,费用约为 $0.03。假设全部 $20 Pro 赠金只用于这一种完全相同的工作负载,粗略计算可在 Sandbox 进入付费阶段前运行 666 次。实际容量会有所不同,因为其他 Vercel 服务也可能消耗赠金,任务使用的资源各不相同,数据传输或存储也可能增加成本。

完整预算可以归纳为:

  • 订阅路径: 已有套餐价格、共享额度,再加 Sandbox。
  • 供应商路径: 按量计费的供应商 Token,再加 Sandbox。
  • Gateway 路径: 按供应商公开价从 Gateway 余额扣除或计入账单,再加 Sandbox。

不同场景该选哪条路径

独立创始人运行内部仓库助手

已经订阅 Claude Pro 或 ChatGPT Plus 的创始人,可以把低频的测试修复或仓库摘要工具接入 HarnessAgent,选择 direct,并让原生套餐覆盖符合条件的模型工作。试点阶段的直接收益,是无需再维护一份模型余额。

适用范围应限定在内部任务,并持续查看供应商的用量页面。创始人的终端和应用操作也在消耗同一订阅,因此后台任务可能提前用掉当天晚些时候工作所需的容量。

规范内部任务的服务机构技术负责人

服务机构可以为每位实名操作人员分配一个边界清晰的仓库任务,并在宿主机上使用该人员符合条件的订阅。真正重要的控制点不是选择哪个适配器,而是在运行开始前确认环境里没有供应商 API 变量。

这样,财务团队就能采用一条清晰规则:有限的内部任务先用套餐额度,只有在明确挂载 Key 时才使用供应商 API;同时也避免让整家公司共用某一个人的登录状态。

运行共享自动化的开发者平台团队

对于无人值守或多人共享的任务,平台团队通常应固定使用 ai-gateway。这样会放弃订阅带来的 $0 增量成本窗口,但团队能获得统一的计费负责人、统一的余额池或账单,以及与服务而非个人相匹配的支出控制。

此前对 fx 适配器的解读 有一个关键细节仍然成立:fx 的两种模式都会通过 AI Gateway 发送模型请求。2026 年 9 月 14 日改变的是凭证回退逻辑。如果没有优先级更高的凭证接管,其配置和成本分析现在必须把受支持的原生订阅纳入考虑。

向客户销售 Agent 能力的 SaaS 创始人

面向客户的编程功能,不应把某位员工的订阅当作容量方案。客户流量由多人共享、波动明显,而且服务还应在人员变动后继续运行。应使用 AI Gateway 或有明确负责人的供应商 API 账户,并把 Sandbox 纳入单位经济模型。

独立的“使用已有订阅运行 Agent”工具盘点 解决的是:单个开发者应该用哪个本地或开源客户端来调用自己已经购买的套餐。此次更新解决的是:如何在 AI SDK 应用中嵌入受支持的运行时。两者的登录方式可能相似,运营模型却完全不同。

用套餐额度运行一次 Claude Code 任务

这条路径适合边界清晰的内部任务,前提是指定用户已经在宿主机登录 Claude Code。它会通过文档规定的 Claude Code 适配器设置明确选择 direct,因此 Vercel OIDC Token 可以继续认证 Sandbox,同时不会把模型请求路由到 Gateway。

  1. 安装文档指定的依赖包

    在现有 Node 项目中添加核心 Agent 包、Claude Code 适配器和 Vercel Sandbox 适配器。

    Bash
    pnpm add @ai-sdk/harness @ai-sdk/harness-claude-code @ai-sdk/sandbox-vercel
  2. 在宿主机登录

    在同一台宿主机上启动 Claude Code,并选择拥有符合条件订阅的 Claude 账户。

    Bash
    claude

    保留 VERCEL_OIDC_TOKEN 供 Sandbox 使用。如果希望由订阅付款,请检查进程环境,并从本次运行中移除 ANTHROPIC_API_KEYANTHROPIC_AUTH_TOKEN;这两个供应商变量的优先级都高于原生登录。

  3. 强制使用直连路径

    将以下内容保存为 agent.mjs。代码采用文档规定的 direct 选择器、当前的 node24 Sandbox 运行时,以及桥接所需的公开端口 4000

    JavaScript
    import { HarnessAgent } from '@ai-sdk/harness/agent';
    import { createClaudeCode } from '@ai-sdk/harness-claude-code';
    import { createVercelSandbox } from '@ai-sdk/sandbox-vercel';
    
    const agent = new HarnessAgent({
      harness: createClaudeCode({ auth: 'direct' }),
      model: 'claude-sonnet-4-6',
      sandbox: createVercelSandbox({
        runtime: 'node24',
        ports: [4000],
      }),
    });
    
    const session = await agent.createSession();
    
    let exitCode = 0;
    try {
      const result = await agent.generate({
        session,
        prompt: 'Create a short TODO.md for this repository.',
      });
    
      console.log(result.text);
    } catch (err) {
      exitCode = 1;
      console.error(err);
    } finally {
      await session.destroy();
      process.exit(exitCode);
    }
  4. 核对两份账单记录

    先运行一个无害的小任务。确认供应商用量页面显示套餐额度发生变化,且没有新增 API 费用;再到 Vercel Usage 查看 Sandbox 项目。

    如果 AI Gateway 记录了模型请求,说明 Gateway 凭证优先。如果供应商 API 控制台出现费用,则说明供应商凭证优先。修正环境之前,不要扩大试点规模。

必须正视的限制

原生登录绑定宿主机。它不是一个可以直接提供给应用中所有客户的 OAuth 流程,也不能把多名成员的个人额度合并成团队额度。

套餐容量也并非固定不变。OpenAI 表示,Codex 限额会随套餐和任务而变化;Anthropic 表示,Claude 用量取决于模型、任务复杂度、上下文和推理强度。两家公司都没有为这条 Vercel 路径承诺固定的生产任务数量。

AI SDK Agent 相关包仍处于实验阶段,版本升级可能带来破坏性变更。这适合可评估、受控的内部试点;但在把它纳入面向客户的承诺前,应锁定依赖版本、测试凭证选择逻辑,并准备好 Gateway 或供应商路径作为后备方案。

本周一就能执行的动作

选择 1 个内部仓库任务和 1 名符合条件的用户。把适配器设为 direct,盘点该宿主机上的供应商变量,运行 1 次任务,并记录哪个计费控制台发生了变化、订阅额度是否改变、Sandbox 费用是多少,以及任务是否完成。

如果已经拥有受支持的套餐,并且手头有一个边界清晰的内部工作流,本周就可以行动。如果底层 Agent 不支持订阅登录,或者依赖包的实验状态不符合团队的依赖政策,则应等待。如果集中预算和共享生产责任比模型费用的边际节省更重要,就继续使用 ai-gateway。如果只是调用普通的 AI SDK 模型供应商,从未使用 HarnessAgent,则此次变化与你无关。

如果想持续获取关于 AI 工具如何改变真实预算与工作流的实操解读,欢迎订阅邮件通讯

最近更新
2026年9月15日
分类
Explained

在 Google 中优先显示本站

将 omidsaffari.com 添加为 Google 搜索的优先来源

把 omidsaffari.com 设为优先来源,Google 会在 Top Stories、AI Overviews 和 AI Mode 中为您优先展示。

Cloudflare Browser Run 实测:无头浏览器如何锁定域名并开放只读审阅

Cloudflare Browser Run 实测:无头浏览器如何锁定域名并开放只读审阅

Cloudflare Browser Run 新增会话域名白名单和只读 Live View。本文拆解两道边界的适用范围、配置步骤、常见失效点与 Browser Sessions 计费变化,并给出面向客户交付的验证流程和成本公式,帮助你判断这套无头浏览器控制是否值得用于真实客户项目。2026年9月14日Explained
AI电话机器人价格怎么算?GPT-Live-1 通话成本拆解

AI电话机器人价格怎么算?GPT-Live-1 通话成本拆解

GPT-Live-1 的语音会话按每分钟 $0.05 计费,但这不是一通电话的全部成本。本文拆解语音时长、后端模型与工具、运营商传输三笔账,并用 90 秒预约电话算清每次成功解决任务的真实支出,同时说明 SIP 接入、插话处理与人工转接为何会改变最终预算,帮助团队设计可衡量的入站电话试点。2026年9月14日Explained
ChatGPT Windows Appshots:少复制上下文,多检查结果

ChatGPT Windows Appshots:少复制上下文,多检查结果

ChatGPT Windows 桌面版新增 Appshots,可用双 Alt 键把前台窗口的截图和应用可提供的文本带入对话。本文拆解 Appshot 的数据边界、发送目标与隐私风险,并结合客户邮件、报错窗口和设置页面等工作场景,说明如何衡量它是否真的减少上下文复制、准备和返工时间,以及哪些情况下应该暂缓使用。2026年9月14日Explained
Vercel CDN 直送 FastAPI 静态文件:Function 用量怎么降

Vercel CDN 直送 FastAPI 静态文件:Function 用量怎么降

Vercel CDN 现在可直接分发符合条件的 FastAPI 前端与静态文件,避免触发 Function 调用和相关计算用量。本文拆解路由顺序、中间件与依赖项形成的安全边界,说明 Pro、Hobby 账单中哪些指标会下降、哪些 CDN 成本仍然存在,并给出上线后的部署核验清单。2026年9月13日Explained
OpenAI API 密钥轮换:别等过期才救火

OpenAI API 密钥轮换:别等过期才救火

OpenAI 已支持为项目 API 密钥设置到期日,并可在组织或项目层级限制最长有效期。本文拆解一套可执行的 OpenAI API 密钥轮换流程:明确负责人和维护预算,提前创建替代密钥,经密钥库部署并验证真实任务,最后再撤销旧密钥,避免定时 Agent、批处理任务与客户自动化因凭证失效而中断。2026年9月13日Explained
Vercel 连接器权限:共享凭据如何指定负责人

Vercel 连接器权限:共享凭据如何指定负责人

Vercel 为 Pro 和 Enterprise 团队推出连接器权限,让 Owner 将共享连接器交给指定的 Connector Manager 管理。本文梳理 Member 默认权限、提供商 scope、运行时令牌与业务审批的边界,并用可验证的交接流程说明如何缩小共享凭据的变更范围。2026年9月13日Explained
Cloudflare AI Search 接入 R2:AI 搜索不再要求文件扩展名

Cloudflare AI Search 接入 R2:AI 搜索不再要求文件扩展名

Cloudflare AI Search 现可依据 HTTP Content-Type 索引无扩展名的 R2 对象,无需改动稳定键。本文说明支持范围、4 MB 限制、R2 元数据修复成本、同步节奏与验证流程,并给出可直接落地的 Worker 上传示例,帮助团队判断该更新能否简化现有 AI 搜索管线。2026年9月12日Explained
Vercel Sandbox 扩容至 64 GB:大型 Agent 任务如何改单机运行

Vercel Sandbox 扩容至 64 GB:大型 Agent 任务如何改单机运行

Vercel Sandbox 将默认工作存储从 32 GB 提升至 64 GB。本文拆解这次扩容对大型代码仓库、AI Agent 修复、构建与落盘型数据任务的实际影响,并给出一套完整的峰值空间测量方法、持久化与 Drive 成本边界,以及判断是否可以安全取消清理或拆分流程的验证步骤。2026年9月12日Explained
订阅通讯

每周日,一封信。写运转中的系统,不写热评。

每周一期。无垃圾邮件。随时退订。