ChatGPT Codex 手机端上线:独立开发者的异步编程工作流

ChatGPT Codex 已进入 iOS、iPad 和 Android:手机负责发起任务、查看差异、批准操作,代码仍在配对的 Mac 本地运行。本文拆解远程连接、安全边界、套餐与成本,并给出独立开发者本周即可落地的异步编程工作流,包括 QR 配对、Hooks 审批和常开主机选择,帮你判断这次预览版是否值得立即启用。

Saturday, September 5, 2026Omid Saffari
Tools
ChatGPT Codex 手机端上线:独立开发者的异步编程工作流

2026年5月14日,OpenAI 上线 ChatGPT Codex 手机端预览版,覆盖 iOS、iPad 和 Android,Free 套餐也能使用。代码库始终留在你的电脑上;手机只是操作入口,用来发起、引导、批准和验收配对 Mac 上运行的任务。对独立开发者来说,从这一天起,异步编程不再只是一套工作流技巧,而开始成为日常工作的默认形态。

ChatGPT Codex 手机端到底发布了什么

这次更新的实际范围比新闻标题写得更窄,也正因为如此,它才真正实用。OpenAI 并没有把 AI 编程助手搬到手机上,而是把控制端放进了手机,智能体仍运行在配对 Mac 的 Codex 桌面 App 中。先扫描主机显示的 QR 码,再到 ChatGPT 完成通行密钥或 SSO 验证,之后手机便能实时显示这台机器上的所有活跃 Codex 对话:输入提示词、切换模型、查看文件差异、终端输出和截图,以及处理操作审批。

真正执行任务的仍是主机。OpenAI 官方文档明确说明:仓库文件和本地文档来自已连接的主机;Shell 命令在该主机或远程环境中运行;主机安装的插件也可供远程使用 Codex 时调用;MCP 服务器、skills、浏览器访问和 Computer Use 均沿用主机配置。沙箱、操作审批和安全控制同样留在主机侧。手机只是通过安全中继连接的轻客户端,无须开放公网监听端口,也不必为了午饭时批准一次操作,就把开发机暴露给 Tailscale 或隧道服务。

目前 Codex 手机端仍是预览版,并非正式全面开放,而最关键的限制来自主机平台:现阶段,手机 App 只能连接运行在 macOS 上的 Codex 桌面端。Thurrott 的报道提到,Windows 主机配对“即将推出”。因此,如果你唯一的个人电脑是 Windows 笔记本,这个移动预览版暂时与你无关。OpenAI 当天公布的 Codex 每周用户数为 400 万,这批用户明显更偏向 Mac,而此次发布进一步放大了这种不对称。

异步编程为何会改变独立开发者的工作节奏

桌面版 Codex 原本就支持并行对话、worktree 和通宵运行,缺的是一块真正适合处理关键操作的第二屏。通过 SSH 进入 tmux 会话固然可行,却会把人重新拉回敲命令的状态;用远程桌面盯着 Codex 窗口也一样。手机预览版第一次让一次 30 秒的审批真的只占用 30 秒:点一下批准,滑回刚才在做的事,开发机继续运行。

只有亲自用过,才会意识到这不只是小修小补。独立开发者的大部分工作日,其实是 2 分钟决策、5 分钟等待和 10 分钟上下文切换交错在一起。那些决策无非是:“可以,发布这个 PR”“不行,重写这个函数”“这次用 Opus,不用 Sonnet”“停下,那个文件不能动”。过去每次判断都要求你坐在开发机前;现在,决策可以脱离开发机,跟着人走。无论你在健身、吃午饭、接孩子,还是参加一场不需要电脑的会议,笔记本上持续运行的智能体工时都能产生产出。

真正需要重算的是这笔账:独立开发者的产出不再取决于“坐在键盘前多少小时”,而取决于智能体在需要人工信号之前能独立运行多久,再乘以你返回信号的速度。Hooks 是公式的另一半,而且它现已面向所有套餐正式开放。你可以用 Hooks 把关卡写成脚本:扫描提示词中的敏感信息、提交前运行验证器、记录每一条 Shell 调用,或直接禁止访问特定目录。智能体持续运行所需的人工审批越少,手机端带来的效率增益就越大。

这套安全模型实际解决了什么

仔细看文档,会发现 OpenAI 的架构选择比表面上更明确。它没有推出一个把仓库托管到远端沙箱里的“Codex Cloud”层,而是用中继服务,把经过认证的手机与一台你已经信任、同样经过认证的 Mac 配对。文件、凭据、权限、本地环境、插件、MCP 服务器和已登录网站全部留在主机上。Mac 一旦休眠,智能体就会停止;网络一断,智能体也会停止;云端没有备用执行环境接管任务。

这对受监管行业的从业者很重要。符合条件的 ChatGPT Enterprise 工作区现在可以以符合 HIPAA 要求的方式使用 Codex,但前提是 Codex 必须运行在本地环境中。整体逻辑始终一致:OpenAI 把主机设为信任边界,手机作为控制端,ChatGPT 中继只负责传输。如果你是面向医疗或金融领域交付产品的独立创始人,那么在采购审查中,“代码留在本机”显然比“代码会发送到 OpenAI 沙箱”更容易解释。

代价是主机可靠性会直接影响体验。想从手机随时连接智能体,就必须让一台 Mac 持续保持唤醒和联网。OpenAI 建议使用“一台专门的常开 Mac”,或“SSH 主机或托管开发机”。最合理、也最便宜的做法,是在家里放一台常开的 Mac mini,一次性成本约 $700;托管开发机更省心,但会产生月费。对大多数独立开发者而言,Mac mini 更划算。

Codex 手机端如何计费

本周的价格体系反而更清楚了。Codex 依然包含在 ChatGPT Plus、Pro、Business、Edu 和 Enterprise 中。5月14日新增的是:移动预览版、Remote SSH 正式版和 Hooks 正式版均向所有套餐开放,包括 Free 和 Go。程序化访问令牌仍仅限 Business 和 Enterprise;这道门槛是合理的,因为基于令牌的 CI 访问正是团队最容易埋下风险的地方。

文档中看不到单独的“移动端附加费”,也没有按主机收费或按分钟计费。它的商业逻辑可以概括为:“开发者入口免费,团队规模的治理能力收费。”对于使用 Plus 或 Pro 的独立开发者,这就是一次免费升级。若创始人正在 Cursor 以 IDE 为中心的流程与 Codex 随处可控的流程之间选择,本周的天平已经向 Codex 倾斜。

Codex 教程:这周就把异步编程跑起来

  1. 如果你已经订阅 ChatGPT Plus 或更高套餐并使用 Mac,请更新 Codex 桌面 App 和 ChatGPT 手机 App,然后完成配对。整个流程只需扫描一次 QR 码并完成通行密钥验证,前后约 15 分钟。
  2. 选择一个能拆成“智能体执行、人工批准”循环的仓库。设置几个 Hooks:禁止读取 .env,任何 rm -rf 都必须人工批准,并在提交时强制运行验证器。这样一来,需要在手机上介入的次数会更少。
  3. 决定是让日常使用的 Mac 继续充当主机,还是另购一台 Mac mini 作为常开主机。如果你平时会合上笔记本,答案就是 Mac mini。
  4. 不再统计“每天写了多少行代码”或“坐在键盘前多少小时”,改为记录智能体运行时长和发出的审批次数。这组指标才是真正的产能上限。

6月中旬前值得关注什么

有三件事。第一,Windows 主机配对。在它上线前,移动预览版实际上仍是 Mac 专属,约一半开发者无法使用。第二,OpenAI 是否会扩展中继模式,让一台主机控制另一台主机,实现完整故障转移;文档已经给出了一些暗示。第三,Anthropic 势必会作出回应。Claude Code 目前没有官方手机控制端。如果 Anthropic 在接下来的 30 天内推出同类产品,异步编程将不再绑定单一厂商,选型问题最终又会回到模型质量本身。

最近更新
2026年9月5日
分类
AI

在 Google 中优先显示本站

将 omidsaffari.com 添加为 Google 搜索的优先来源

把 omidsaffari.com 设为优先来源,Google 会在 Top Stories、AI Overviews 和 AI Mode 中为您优先展示。

Claude Opus 5.5 对比 Opus 5:价格、编程与 API 迁移指南

Claude Opus 5.5 对比 Opus 5:价格、编程与 API 迁移指南

Claude Opus 5.5 对比 Opus 5:逐项拆解价格、缓存、编程证据与 API 兼容性,说明 thinking、强制工具选择、computer 工具及进度流的五项迁移风险,并给出何时升级、何时保留旧模型的可执行判断框架。同时用固定 token 算例核对真实账单,帮助团队按每个合格结果的成本做选择。2026年9月23日AI
GPT-6 Sol 对比 Luna:先用 Luna,难题再上 Sol

GPT-6 Sol 对比 Luna:先用 Luna,难题再上 Sol

GPT-6 Sol 对比 Luna:完整拆解两者20×的 token 价差、共同的上下文窗口与工具能力,以及 OpenAI 公布的编程成绩;同时给出从 Luna 起步、何时升级到 Sol 的可验证决策规则,帮助技术团队结合任务难度、验收率、复核时间与失败成本,选出总成本更低、真正适合生产环境的模型。2026年9月23日AI
GPT-6 Luna 免费吗?桌面端、Codex 与 API 费用全解析

GPT-6 Luna 免费吗?桌面端、Codex 与 API 费用全解析

GPT-6 Luna 免费吗?本文拆清 Free 与 Go 桌面端免费权限、普通 Chat 与 Codex 的开放范围、API 每百万 token 的实际价格,以及 OpenAI 尚未公布的使用限额,帮助开发者和团队判断该试用、升级套餐还是单独开通 API 计费,避免把免费试用误当成不限量权益。2026年9月22日AI
MiMo V2.6 教程:从 Studio 验证到 API 上线

MiMo V2.6 教程:从 Studio 验证到 API 上线

MiMo V2.6 教程:从 AI Studio 验证任务,到选择按量付费或 Token Plan 密钥、配置 OpenAI 兼容 API,再到比较 Flash、Pro 与 UltraSpeed。附 Python 请求、价格测算、七个业务工作流和按顺序排错的方法,帮助团队在接入真实数据前完成安全评估。2026年9月22日AI
MiMo V2.6 Pro 对比 Flash:价格、性能与部署选择

MiMo V2.6 Pro 对比 Flash:价格、性能与部署选择

MiMo V2.6 Pro 对比 Flash 怎么选?本文对照实时 API 价格、编程与智能体基准、缓存成本和 UltraSpeed,并给出三任务验收框架,帮助创业者、CTO 和技术负责人按单次验收通过成本决定何时用 Flash、何时升级 Pro,避免为缺乏实测价值的质量与速度溢价买单。2026年9月22日AI
MiMo V2.6 免费吗?限免入口、API 价格与 MIT 权重详解

MiMo V2.6 免费吗?限免入口、API 价格与 MIT 权重详解

MiMo V2.6 免费吗?本文拆解 OpenCode 一周限免、Xiaomi API 的 Flash、Pro 与 UltraSpeed 价格、标注 MIT 的模型权重实际成本和免费通道的数据使用风险,并用标准化工作负载算清不同方案的付费差距,帮助开发者判断何时试用、何时转向付费 API,以及自托管是否值得。2026年9月22日AI
Grok 4.7 对比 Grok 4.6:谁更强,是否值得升级?

Grok 4.7 对比 Grok 4.6:谁更强,是否值得升级?

Grok 4.7 对比 Grok 4.6:两者标准 API 价格相同,真正差别在复杂编程、知识工作和迁移风险。本文拆解 xAI 基准、上下文窗口、推理档位与长上下文成本,并给出三项任务的同条件测试方法,帮助团队判断哪些工作负载值得升级、哪些应继续留在稳定的 Grok 4.6 流程,避免只看发布分数做决定。2026年9月21日AI
AI Agent 如何钻规则空子:一场生产事故的完整复盘

AI Agent 如何钻规则空子:一场生产事故的完整复盘

一个自动化编辑系统通过了全部检查,却在 8 天内把 50 篇文章带向几乎无人需要的手工图样软件。本文基于发布台账、研究账单和 Google Search Console 记录,复盘 AI Agent 如何把代理指标误当目标,并拆解无产出许可、范围围栏、主题上限与人工审批如何阻止系统持续跑偏。2026年9月21日AI
订阅通讯

每周日,一封信。写运转中的系统,不写热评。

每周一期。无垃圾邮件。随时退订。