OpenAI Codex 免费两个月,我为何算完 60 天损益后仍留在 Claude Max

OpenAI Codex 提供两个月免费迁移,但对已有六套生产流程的独立开发者,真正成本并不在订阅费。本文用 60 天损益表拆解 Claude Max 的成本、工程重写、提示缓存调优和机会成本,解释为何 $400 的名义优惠最终对应 -$4,550 的净损益,并给出评估免费 AI 编程工具优惠是否值得接受的四问框架。

Saturday, September 5, 2026Omid Saffari
OpenAI Codex 免费两个月,我为何算完 60 天损益后仍留在 Claude Max

5月13日,OpenAI 用两个月免费的 OpenAI Codex 邀请我从 Claude Code 迁过去。我算完一笔 60 天损益账,最后决定留下。所谓“免费”,只是省下我本来就不会支付的 $387,却要换来我实际会承担的 $3,700 迁移成本。

OpenAI Codex 免费优惠,放进损益表究竟值多少

Sam Altman 在 5月13日公布了 Codex 迁移优惠:团队只要在 30 天窗口期内完成迁移,就能免费使用两个月。按我实际需要的档位——六个并发 agent session,以及足以支撑日常发布流程的每周额度——对照最接近的 Codex SKU,价值约为 $200/月。两个月 × $200 = $400,这就是摆在桌面上的名义价值。

同一天,Anthropic 宣布在 7月13日前,将 Pro、Max、Team 和 Enterprise 用户的 Claude Code 每周额度提高 +50%。这显然不是巧合。两边动作如此对称,本身就是信号。

当两家厂商在同一个周二同时出手——一家用免费月份拉人迁入,另一家悄悄放宽额度留住用户——这意味着获取一个迁移用户的隐含成本已经升到数百美元的低位区间。更重要的是,这个数字也说明:操作者一侧的切换成本同样不再微不足道。否则,厂商不会愿意付出这么多。

凡是“免费 N 个月”的优惠,我都会把它当作采购决策,而不是一杯顺手拿走的咖啡。正确的分析单位不是“试用是否免费开始”,而是“往返迁移要花多少工程工时,以及我最终走一遍回头路的概率有多大”。营销话术叫它试用,会计视角看到的却是附带切换税的资本性支出

换成这个角度,$400 的标价就不再是标题,而只是整张损益表里的一行。

我在 Claude Max + AI Gateway 上的 60 天成本基线

要判断这份优惠值不值得,先得算清它要替换掉的现状。下面是逐项基线。

这套发布系统使用 $200/月的 Claude Max,前面接入支持 BYOK 透传的 AI Gateway,承载六个每日例行任务;底层运行在 Cloudflare Workers 上,用 D1 存储,并由 Vectorize 完成每份内容简报发布前的相似度检查。过去 60 天的全部运营成本,包括 embeddings、DataForSEO 和封面图生成,合计为 $387/月。我在解析 Workday-Anthropic 资助的文章里详细拆过这笔账——同一套技术栈,同一组数字。

六个每日发布任务通过 cron 触发:publish-news、publish-dev、publish-design、publish-marketing、publish-founders、publish-business。每个任务会运行 4–8 分钟的 Claude Max,生成内容简报,交给 PublishWorkflow,再把结果写入 D1。整个工作流分成六个独立步骤——validate、ground、generate、clean、persist、index——每一步都会用结构化 prompt 调用 Anthropic,并依赖一个明确的成本杠杆:prompt caching。

缓存结构决定了这套系统的单位经济性。每次例行调用都会带上一段 markdown contract(~3,500 tokens)和一段 voice block(~1,500 tokens);两者都使用 cache_control ephemeral,TTL 为 1 小时,随后才是特定格式的 prompt 和本次简报。一个小时内的首次调用按 1.25× 输入费率写入缓存,之后每次调用只按 0.1× 费率读取。以我的用量——六个任务及其子步骤每天大约调用 Anthropic 40–50 次——约 85% 的输入 tokens 能命中缓存,月度账单因此维持在 $387 左右,而不是 $900。

Anthropic 刚刚增加的 +50% 每周额度,意味着触及上限前,我现在还能再加第七个任务。免费,不用迁移。这才是 Codex 优惠必须击败的基准。

切换到 Codex 的真实成本:逐项算账

SERP 上看不到这一节,因为没有其他人一边用同一套技术栈跑着六个生产任务,一边公开完整账目。

重写例行任务。 六个任务各自包含 600 到 900 行 skill markdown 和工具调用定义,都是针对 Claude 特有的工具使用语法与 prompt-cache 原语调校的。Codex 的工具调用语义、缓存控制和 prompt 结构差异很大,绝不是查找替换就能完成。每个任务都要重新编写,还要留出实际测试的尾部工作。保守估算:每个任务 2–3 小时 × 6 个任务 = 14 小时专注开发时间

这些工时的机会成本。 我为 DVNC.dev 客户工作的综合计费标准是 $250/小时。14 小时 × $250 = $3,500 机会成本。迁移期间,这就是我原本可以赚到、却无法赚到的真金白银。

测试期间重新调优 prompt cache。 换到新供应商后,要把缓存命中率重新拉回 80%+,必须经历反复迭代:重写工具定义、调整 prompt 结构顺序,并在每个调用点重新决定 ephemeral 还是 persistent。根据我此前调优 Anthropic 侧的经验,这一阶段临时增加的 API 支出约为 ~$200 现金成本

重写发布工作流。 六步工作流依赖 Anthropic 特有的功能——cache_control: { type: "ephemeral", ttl: "1h" }、能在跨步骤调用中最大化缓存命中率的 prompt 形态,以及工作流所依赖的 streaming protocol。改写为适配 Codex prompt API 和 tool-loop 语义,还需 4–6 小时;按同一机会成本费率计算,就是 $1,250。

把它们放进一张账表:

项目成本
重写例行任务(机会成本)$3,500
重写工作流(机会成本)$1,250
重新调优 prompt cache(现金)$200
“免费”的名义价值+$400
净损益-$4,550

如果拒绝给自己的时间定价——而每一句“既然免费,为什么不试试”背后默认的正是这一点——只看现金的账面大致能打平:$400 的价值,对应 $200 的缓存调优 API 支出,外加我再也拿不回来的两周周末。

真正的陷阱是机会成本。创始人如果不给自己的工时计价,就会用错误的货币支付这笔账,最后还以为自己省了 $400。

每逢“免费 N 个月”,我都用这套四问框架

做过足够多次类似决策后,我把判断方法归纳成四个问题。任何需要我先做些事情才能兑现的厂商优惠,都要过这一关。

  1. 切换要投入多少工程工时,而不只是净现金? “免费”说的永远是净现金,真正的账单则是时间。
  2. 把时间投入次优选择时,每小时机会成本是多少? 对我而言,做客户项目可赚 $250/小时。对还处于更早阶段的人来说,答案可能是 $0——那样一来,计算结果会改变,优惠也可能确实划算。
  3. 续费概率有多高? 到第 3 个月,我会不会切回原平台,再交一次迁移税?如果会,优惠比看上去更差;如果不会,那它就是在有意锁定我,而这才是厂商的真正目标。
  4. 平台锁定是否具有不对称性? 新工具会不会让“离开”比“进入”更难?如果会——而且几乎总会——这份优惠的真实成本就在不对称的退出,而不是看似对称的进入。

对 Codex 来说,续费概率很高。我的六个任务都写进了供应商特有的语法;如果第 3 个月回到 Anthropic,就意味着工程成本要付两次,迁出一次、迁回一次。不对称退出确实存在。

“免费试用”的说法正是在这里误导了人。如果退出成本很低,试用可以零成本开始,只有上行空间;迁移却要先投入数天工作,回来时还要再投入数天——这不是试用,而是披着试用外衣的采购决策。我在拆解 Cloudflare 的 100x engineer 叙事中从另一个角度分析过同一种锁定逻辑:每当平台厂商想要接管你的任务,这套结构都会重现。

这套框架并不总会给出“不换”的答案。去年从 Vercel 迁到 Cloudflare 时,我接受了 $5K 额度。但那是一次主动的平台整合——把 D1 + Workers + Vectorize 收到同一处——不是免费试用。四个问题都顺利通过;迁移本身就是策略,额度只是额外奖励。

Codex 优惠没能通过这套框架。GCP credits、面向 AI 初创公司的 Linear 免费一年,以及此刻还躺在我收件箱里的 Notion AI 六个月优惠,同样没有通过。它们的结构完全一致:为了兑现优惠,先支付一笔平台专属的工作税;一旦付完,第二个账单周期就更难离开。

操作者应当记住一条通用原则:厂商花钱不是请你评估产品,而是请你完成切换。 每一份优惠都该按采购来核算。

我本周把时间花在了哪里

原本用于评估 Codex 的工时,有价值更高的去处。只有把替代用途明确写出来,才算诚实地评估这项决定。

publish-design-deep 会在本周上线。它沿用现有六个任务的工作流脚手架,但简报目标更长,voice block 也不同。开发成本:3 小时。边际运营成本:$8/月,完全落在 +50% 额度带来的余量内。

prompt cache 审计不够耀眼,却会持续产生复利。每个任务都有 2–4 个调用点可以进一步收紧缓存结构——通常是重排 prompt,让易变内容靠后,或把接近静态的部分提升到缓存区块。按我的用量,这次审计不到三周就能通过运营成本节省收回投入。

调整 publish-marketing 的运行频率,是个乏味但正确的决定。这个任务的主要成本来自 DataForSEO 查询,而不是 Anthropic tokens;况且营销类别原本每天发布就已供给过量。改为周二/周四后,发布节奏不变,数据成本却只剩 40%。

少花一小时评估觊觎我现有任务的厂商,就多一小时可以真正交付——无论是为客户,还是为这套内容发布系统。这是机会成本原则的反向应用,也是任何定价页面都不会写出来的操作者选择。

什么情况下,我会做出不同选择

如果时间倒回这套发布系统生命周期的六个月前——当时只有一两个任务,没有生产流量,prompt-cache 结构也尚未调好——计算结果会反过来。

锁定程度低时,切换成本虽存在,却不高。60 天免费期确实可以让你在同一工作负载上对两家供应商做 A/B 测试,这时 Codex 优惠才真正成为营销所说的那种试用,并能产生有效信号。对任务数 ≤2、机会成本更接近 $0/小时的人,接受优惠是理性选择。换作我也会接受。

大致到了第三个任务,决策节点就出现了。prompt-cache 结构开始稳定,工具语法调校到位,工作流脚手架不再每周变化。从这里往后,切换成本超过机会成本,框架便会对那些三个月前还能通过的优惠说“不”。

通用结论是:锁定并不总是坏事。有时,它恰恰是你用六个周末调优整套技术栈后买到的东西。造成锁定的投入,也正是把成本从 $900/月压到 $387/月的那笔投入。两者无法只取其一。

我仍愿意在一个全新的单一任务上测试 Codex——用 2 小时构建,获得真实信号,而且不碰任何已经依赖的工作负载。但这和迁移正在运行的发布系统是两回事。前者是侦察,后者则是一场净成本 $4,550、又没有战略理由去承担的采购事件。

Claude Code 每周 +50% 额度会永久保留吗?

不会。根据 Anthropic 在 5月13日的公告,这一政策持续到 7月13日。7月后的额度尚未公布。我假设届时会恢复原状,因此按提升前的上限规划新增任务数量,只把额外额度视为接下来八周的缓冲空间。

与 Claude Max 对等的 Codex 档位究竟多少钱?

OpenAI 尚未发布完全对齐的 SKU。我的估算是,最接近的对等方案约为 ~$200/月——支持多个并发 agent session、充足的每周额度和相近的模型访问权限。如果实际对等档位更贵,“免费”的名义价值也会更高,现金层面的计算会更接近中性;但机会成本这一行不会改变。

不同任务能否并行使用 Codex 和 Claude Code?

技术上可以,运营上却会让 prompt-cache 投入翻倍,并把工具语法维护面拆成两套。对独立操作者而言,除非两类任务的需求确实不同——而我的并非如此——否则维护两套并行 agent 技术栈的持续成本很少值得承担。

机会成本采用了什么费率?

$250/小时的综合费率,大致处于资深 AI 系统承包开发者的市场中段。代入自己的费率,再算一次。如果费率是 $0——尚未产生收入,或只在周末开发——就该看纯现金账,优惠会显得更划算。如果费率是 $500/小时,结果会比我的情况更差。

最初调优 prompt cache 花了多久?

为了把缓存命中率推到 80% 以上,我在两周内陆续投入了约 9–12 小时;随着任务趋于稳定,又迭代了 4–6 小时。这正是迁往 Codex 后需要重做的工作,也是日后切回来时还要再做一遍的工作。不对称退出成本确实存在。

最近更新

2026年9月5日

分类Growth

在 Google 中优先显示本站

将 omidsaffari.com 添加为 Google 搜索的优先来源

把 omidsaffari.com 设为优先来源,Google 会在 Top Stories、AI Overviews 和 AI Mode 中为您优先展示。

更多 Growth 文章

查看全部 Growth 文章
订阅通讯

每周日,一封信。 写运转中的系统,不写热评。

来自一组 AI 项目组合运营的构建日志、生产系统与一线笔记。

每周一期。无垃圾邮件。随时退订。