Gemini 3.5 Pro 发布时间仍未公布:为什么现在不该再等

Gemini 3.5 Pro 已错过 Google 的 2026 年 6 月发布窗口,至今没有日期、API 模型 ID、价格或基准测试。本文梳理延期原因和官方信息,比较 Gemini 3.5 Flash 与 Gemini 3.1 Pro Preview 的成本及用途,帮助团队决定现在用什么、何时再评估 3.5 Pro。

Thursday, September 3, 2026Omid Saffari
Gemini 3.5 Pro 发布时间仍未公布:为什么现在不该再等

Gemini 3.5 Pro 发布时间仍未公布。Google 曾表示该模型会在 6 月上线;但 Reuters 于 7 月 16 日报道称,由于编程表现未达预期,发布时间已经推迟数月。现阶段,不要围绕它规划产品、迁移方案或采购决策。

Gemini 3.5 Pro 发布时间:目前没有日期

Gemini 3.5 Pro 仍在测试中。此前承诺的 6 月窗口已经错过,Google 也尚未公布新的日期。目前,Google 的在线模型目录只列出了 Gemini 3.5 Flash 和 Gemini 3.1 Pro Preview;定价页面则没有任何 3.5 Pro 条目,也没有 API 模型 ID、价格、免费层条款、上下文限制或基准测试表。

因此,所谓 7 月 17 日发布的传言对规划毫无价值。只有当 Google 正式公布模型、访问方式和商业条款时,日期才足够可信;匿名消息源或倒计时页面的反复转述不算依据。

Google 官方 Gemini 3.5 公告页面
Gemini 3.5

目前可以确认的时间线并不长:

日期发生了什么这意味着什么
2026 年 5 月 19 日Google 发布 Gemini 3.5,同步推出 3.5 Flash,并表示 3.5 Pro 将在“下个月”上线对外公布的窗口是 2026 年 6 月
2026 年 6 月既定窗口结束,3.5 Pro 仍未公开上线进度已经延期
2026 年 6 月下旬据报道,Google 更新了 Gemini 的训练数据以改善编程能力,但结果仍未达标报道指向的是模型质量问题,而非产品包装
2026 年 7 月 16 日Reuters 报道,3.5 Pro 的进度已经落后数月不能再把近期发布当作稳妥假设
2026 年 7 月 17 日Google 的公开模型目录和定价页面仍未列出 3.5 Pro没有可供采购、集成或测试的具体产品

Google 的表态很克制。其发言人称,公司正与合作伙伴共同测试 3.5 Pro、升级版 Flash 模型以及其他模型。这只能确认研发仍在推进,并不能确认具体发布周、功能配置或价格。

从 5 月公告、错过 6 月窗口到 7 月延期报道的时间线
官方承诺的 6 月窗口已经过去,新的发布日期仍未公布。

旗舰模型为何会卡在编程能力上

编程能力足以拖住一款旗舰模型,因为真正困难的任务早已不是生成一个工整的函数,而是让 agent 在读取代码仓库、选择工具、修改多个文件、运行测试、发现故障并恢复的整个过程中始终保持正确,还不能把代码库越改越糟。

这就是智能体编程:跨越多个步骤、工具和决策,持续完成软件工作。模型在单轮提示的演示中可能表现惊艳,但如果第 20 个动作依赖前 19 个动作全部正确,它仍可能失败。一次薄弱的规划或一个凭空捏造的依赖项,就足以抹掉此前积累的所有速度优势。

Google 自家产品线已经把新 Pro 模型的门槛抬得很高。Google 将现有的 Gemini 3.5 Flash 定位为旗下最强的智能体与编程模型,并公布了以下成绩:

基准测试考察内容Gemini 3.5 Flash
Terminal-Bench 2.1在终端中完成实际任务76.2%
GDPval-AA具有经济价值的专家任务1656 Elo
MCP Atlas使用互联工具执行多步骤工作流83.6%
CharXiv Reasoning理解复杂的视觉与技术材料84.2%

Google 还表示,3.5 Flash 生成输出 token 的速度是其他前沿模型的四倍。这些都是厂商公布的数据,并非独立验证,却清楚揭示了内部的产品难题:名为 Pro 的旗舰模型不能只是体量更大。它必须在客户愿意交给旗舰模型的高成本任务上击败这款高速模型,同时还要足够可靠,能够支撑长时间运行的 agent。

Reuters 援引 Bloomberg 报道称,Google 在 6 月下旬更新了训练数据以改善编程能力,但结果未达到预期。这并不能证明模型经历了全面重做、采用了新架构,也无法证实任何传闻中的上下文窗口大小。它只说明,报道所称的质量门槛没有在原定进度内达到。

对中型企业 CTO 而言,这一区别甚至比延期本身更重要。模型晚发布只是麻烦;如果模型在长时间编程任务中的行为不稳定,就会带来额外审查、安全风险和回滚工作,其成本可能远高于 API 账单。

现在该用什么替代 Gemini 3.5 Pro

需要交付产品、编程或反复运行 agent 时,用 Gemini 3.5 Flash;当更深入的推理值得付出更高延迟和 token 成本时,用 Gemini 3.1 Pro Preview。默认等待 3.5 Pro 并不明智,因为这两个现有选项都已经有公开访问方式和可计算的成本。

Gemini 3 整体产品线变化很快,但今天的选择很简单:

决策维度Gemini 3.5 FlashGemini 3.1 Pro PreviewGemini 3.5 Pro
公开状态正式可用预览版未公开列入目录
当前最适合的用途编程、agent、高吞吐任务、低延迟场景高难度推理与复杂问题求解暂时没有可规划的用途
API 模型 IDgemini-3.5-flashgemini-3.1-pro-preview尚未公布
Standard 输入价格每 1 million token $1.50200,000 token 及以下为 $2.00;超过后为 $4.00尚未公布
Standard 输出价格每 1 million token $9.00200,000 token 及以下为 $12.00;超过后为 $18.00尚未公布
免费 API 层尚未公布
主要限制速度快不等于绝不出错仍是预览版,成本也更高没有日期、条款或实证

按照 Google 当前 API 费率计算,在典型的 agent 工作负载中,价格差距已经很明显。按 Standard 费率,1 million 个输入 token 加 200,000 个输出 token,在 3.5 Flash 上的成本是 $3.30。如果每个提示均不超过 200,000 token,同样的总工作量在 3.1 Pro Preview 上需要 $4.40。在这个例子中,Flash 便宜 25%,而这还没有计入它的延迟优势。

Google 现有的技术栈已经能够承担大量后台工作。Gemini Managed Agents可以在远程环境中运行多步骤任务,因此团队没必要为了等待未来的旗舰模型而搁置 agent 试点。

将高速与 agent 工作分配给 Gemini 3.5 Flash、将深度推理分配给 Gemini 3.1 Pro 的决策图
用与任务匹配的模型推进交付;在正式发布前,先把 3.5 Pro 留在评估门外。
  1. 先用 3.5 Flash 建立基线

    在已正式可用的模型上测量任务成功率、审查时间、延迟和成本。发布公告无法取代团队自己的验收标准。

  2. 建立一条 Pro 升级路径

    只把因推理深度不足而失败的任务交给 3.1 Pro Preview,其余任务继续使用 Flash。这样才能看清额外投入是否真的换来了更好的结果。

  3. 让模型 ID 保持可配置

    把模型名称保存在配置中,不要在应用各处硬编码。等 3.5 Pro 发布后,评估就能成为一次受控测试,而不是一次重写。

  4. 发布后再重启决策

    只有当 Google 公布访问方式、定价、限制和基准成绩后,才用同一套任务集对比 3.5 Pro。是否采用取决于实测提升,而不是 Pro 这个标签。

采用 3.5 Pro 前必须通过的五道验证门

只有当五项公开信息同时齐备时,Gemini 3.5 Pro 才值得进入评估。仅有一篇发布公告远远不够。

  1. 官方 API 模型 ID。 它能证明开发者可通过有文档的接口调用真实模型,而不是只能使用合作伙伴私测版或第三方封装。
  2. 完整价格表。 输入、输出、缓存、批处理、grounding 和长提示费率,共同决定基准优势能否经得起生产环境损益核算。
  3. 公开的运行限制。 上下文大小、输出限制、支持的输入类型、地区、配额和数据处理条款,决定模型能否适配周边系统。
  4. 可比的基准测试。 真正有用的问题不是 3.5 Pro 分数高不高,而是它能否在最耗费团队时间的具体失败类型上击败 3.5 Flash 和 3.1 Pro。
  5. 稳定的可用状态标签。 有回退方案的实验可以使用预览版;面向客户的依赖项,更适合以正式可用为基线。

这五道门可以避免两种代价高昂的错误:其一,为一项经济性未知的未来能力暂停正在创造价值的工作;其二,在发布当天仓促迁移,随后才发现新旗舰更慢、更贵,或在实际负载上只好了一点点。

哪些团队该等,哪些团队现在就该行动

大多数团队都应该现在行动,但架构必须与具体模型解耦。

读者当前最佳选择原因
正在交付 agent 产品、已获融资的创始人基于 3.5 Flash 开发,并加入可配置的模型层上市速度至关重要,而正式可用的模型已经面向智能体工作
正在统一内部 AI 标准的中型企业 CTO用 Flash 承担高吞吐任务,用 3.1 Pro Preview 试点高难度例外在 3.5 Pro 到来前,就能形成真实的路由策略和成本基线
正在自动化研究或报告工作的资深运营负责人使用能够通过人工审查验收测试的现有模型一次进度延期不该阻断可逆的工作流
独立技术开发者先在 3.5 Flash 免费层制作原型,再估算付费路径最便宜且有用的实证,也比等待一个未知价格更有价值
当前模型都无法可靠完成其任务的团队可以等,但只暂停这一项实验尚无证据表明 3.5 Pro 能解决这个具体问题

以编程为重点的采购者也应该跳出 Gemini 产品线横向比较。当代码仓库级工作比留在 Google 技术栈内更重要时,当前编程模型排名才是更合适的参考框架。

等待的合理理由只有一个,而且必须足够具体:项目有一项已记录的要求,Flash 与 3.1 Pro 都无法满足;同时,推迟项目的成本又低于改用其他供应商。即便如此,也只能把 3.5 Pro 当作未来候选之一,不能预设它就是答案。

Gemini 3.5 Pro 延期了吗?

是。Google 在 5 月 19 日表示,预计会在次月推出 3.5 Pro。Reuters 于 7 月 16 日报道称,该模型已经落后进度数月,原因是编程表现未达到内部预期。

Gemini 3.5 现在发布了吗?

Gemini 3.5 Flash 已通过 Gemini API 和 Google 产品正式提供。Gemini 3.5 Pro 尚未出现在 Google 的公开模型目录或定价页面中。

Gemini 3.5 Flash 比 3.1 Pro 更好吗?

在速度、成本、编程和反复运行的 agent 任务上,Flash 是更合适的默认选择。Google 公布的 3.5 Flash Terminal-Bench 2.1 成绩为 76.2%,而其 3.1 Pro 基准测试表给出的 Terminal-Bench 2.0 成绩为 68.5%,两者并不是同一版本基准下的直接对比。只有当更深的推理能改善实际任务结果时,才选择 3.1 Pro Preview,而不是因为 Pro 听起来更强。

Gemini 3.5 Pro 免费吗?

3.5 Pro 尚无公开价格或免费层条款。所谓免费访问,并不等同于 Google 的官方定价。Gemini 3.5 Flash 目前提供免费 API 层;Gemini 3.1 Pro Preview 则没有。

事实变化时,第一时间获取下一份模型决策简报。

最近更新

2026年9月3日

分类AI

在 Google 中优先显示本站

将 omidsaffari.com 添加为 Google 搜索的优先来源

把 omidsaffari.com 设为优先来源,Google 会在 Top Stories、AI Overviews 和 AI Mode 中为您优先展示。

更多 AI 文章

查看全部 AI 文章
订阅通讯

每周日,一封信。 写运转中的系统,不写热评。

来自一组 AI 项目组合运营的构建日志、生产系统与一线笔记。

每周一期。无垃圾邮件。随时退订。