
Gemini 智能体中的 Claude 模型:泄露内容透露了什么,以及谷歌早已写下了什么
- openai新OpenAI: GPT-6.1 Sol2026-09-2952智能
- anthropic新Anthropic: Claude Sonnet 5.52026-09-2856智能
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百万 tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238智能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248智能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258智能
- xAIGrok 4.72026-09-2146智能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 每百万 tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77代码
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百万 tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
2026 年 10 月 8 日发布的一则爆料称,Gemini Argon 4、Gemini Flash 3.8、Claude Opus 5和Claude Sonnet 5.5都将可在 Google 同日为 Gemini Business 发布的 Gemini 智能体中使用。这四个名称里有三个是错的,而更正后的结果比爆料本身更有意思。帖子所称的“Gemini Argon 4”其实是Gemini 4 Argon——Google 自家的前沿模型,由 Koray Kavukcuoglu 于 2026 年 9 月 30 日发布,至今仍没有可调用的模型 ID。它称为“Gemini Flash 3.8”的那个是Gemini 3.8 Flash,自 2026 年 9 月 2 日起就已存在于 Gemini API 中。而那两款 Anthropic 模型也并非当前一代:爆料列出的是 Claude Opus 5(2026 年 7 月 24 日发布)和 Claude Sonnet 5.5(2026 年 9 月 28 日发布),而 Google 自家的智能体文档早已指向 Claude Opus 5.5 和 Claude Sonnet 5.5。经核实后留下来的,不是那份模型清单,而是 Google 自己发布的那句话。
因为,泄密可能掩盖的正是这一点:Google 关于 Gemini 智能体的公告已经表明 Anthropic 参与其中。它这么说,却没有给出版本号,没有给出模型 ID,也对 Gemini Business 只字未提。下文将 Google 正式记录在案的内容与某个 X 账号据此推断出的内容区分开来,因为二者并非同一份文件,说的也不是同一回事。
泄露内容实际上说了什么,以及它来自哪里
这一信号来自 X 上账号 @testingcatalog 的一条帖子,日期为 2026-10-08,其全文内容为:“Gemini Argon 4、Gemini Flash 3.8、Claude Opus 5 和 Claude Sonnet 5.5 将在近期宣布的适用于 Gemini Business 的 Gemini Agent 中提供。这是 Claude 模型首次出现在 Gemini 上,与 Google 自家的模型一同提供。”该帖子没有附带截图,没有 Google 内部信源,没有文件,也没有给出所称可用性的日期。
那是一个关于某个产品界面的单一信源说法,而截至今天,该界面尚未发布。它值得追踪,恰恰是因为上一次 Claude 对 Google 的发布看起来也是如此,后来却被证明是真的——但对当前局面的如实描述是,一位第三方观察者读了 Google 自己的公告,并从中推断出了一条产品线。验证一则泄露,不在于泄密者是否可信,而在于底层文件是否真的说了那件事。
谷歌在 2026-10-08 已经确认的内容,用谷歌自己的话说
Google Cloud 于 2026-10-08 发布了《欢迎来到 Gemini at Work 2026:推出 Gemini agent》,该文改编自 Thomas Kurian 在 Gemini at Work 2026 活动上的主旨演讲,并彻底解决了 Anthropic 问题。该帖中关于模型编排的部分原文如下:
它会在最适合的模型上运行每项任务——目前跨我们的 Gemini 系列模型和来自 Anthropic 的 Claude 模型进行编排,未来还会跨其他领先的私有和开放模型进行编排——从而交付最优质量并降低您的成本。
所以,关于 Claude 即将进入 Google 智能体的说法并不是泄密。这是已发布的第一方声明,而泄密者将其包装成新闻,已经晚了一天。Google 没有做的是指明版本。整篇文章中,那句话的任何地方都没有附上 Claude Opus 编号、Claude Sonnet 编号、模型 ID、费率表、配额或可用日期。Google 点名了 Anthropic,也点名了自家产品线——Argon面向前沿推理,Flash面向速度与吞吐量,Omni面向生成式媒体,Gemma面向轻量级开放权重边缘工作负载——然后就到此为止。
Google 为这种架构给出的推理才是值得保留的部分,因为它是一个路由论证,而这也正是本博客关于不要硬编码单一模型所提出的同一个论证:
• “最适合任务的模型并不总是最大的那一个。”
• “领先模型每隔几个月就会更替,所以让这个选择保持开放,意味着当它真的变化时,你的上下文、技能和数据都能留在原处。”
Google 为此所声明的机制,是一套它描述为多模型编排、Smart Routing 以及可在 Cloud Billing 控制台中强制执行的实时支出上限的功能——智能体在触及上限时暂停、一键即可恢复,并按项目跟踪以用于费用分摊。如果你曾经事后核算过一个月的智能体流量成本,那么这正是此次公告中改变你所能做决策的部分。

Gemini Business 产品线是此次泄露中最薄弱的部分
在整篇帖子的所有内容中,"for Gemini Business" 是背后最缺乏依据的一处,它值得被直白地讲明,而不是被顺手传下去。
Kurian 的帖子从未使用 Gemini Business 这一名称。它提到的层级是 Gemini Enterprise——按照 Google 自己的说法,已由“近 90% 的《财富》100 强企业”部署——外加 Gemini for Education,而行业版则打造了 Gemini for Financial Services 和 Gemini for Legal,Government、Healthcare 和 Retail 均标记为即将推出。Google Workspace 中的 Gemini 则单独描述,内嵌于 Gmail、Drive、Docs、Slides、Sheets、Chat 和 Calendar。在整个公告中,“Business”一词并未作为产品层级出现。
business.gemini.google 上确实存在一个真实入口,而它恰恰就是会制造出这种混淆的东西:该 URL 会重定向到一个 Google Workforce Identity Federation 登录端点,也就是说,它是为 Google Workspace 托管的 Gemini 部署设置的 SSO 门户,而不是一个有页面、有定价的具名 SKU。那是一种托管安排,不是一次发布公告。如果泄露消息属实、Claude 确实首先落地在 Gemini Business,那么证据并不在 Google 的那篇帖子里;而如果消息有误,这个错误也不过是常见的那一种:把登录域名当成了产品名称。
Anthropic 的模型已在哪些 Google 产品中占有一席之地
泄密内容中“Claude 模型将首次出现在 Gemini 上”的说法也需要更正,因为 Claude 早已可以在某款 Google 产品中选择使用,而且已经持续一周了。
Google 的 Antigravity 文档将第三方推理模型与 Google 自家的模型并列列出,而截至本周,各行内容如下:
• Claude Sonnet 5.5(思考)— Google AI Pro(仅限非试用订阅)和 Google AI Ultra
• Claude Opus 5.5(思考)— 仅限 Google AI Pro(非试用订阅)和 Google AI Ultra
• Claude Sonnet 4.6 (thinking) 和 Claude Opus 4.6 (thinking) — 免费,Google AI Plus 和 Google AI Pro,计划于 2026-11-02 移除
• GPT-OSS-120b — 免费,Google AI Plus、Google AI Pro 和 Ultra,列明将于 2026-11-02 移除
• Gemini 3.8 Flash、Gemini 3.7 Flash、Gemini 3.6 Flash 和 Gemini 3.1 Pro——所有层级均保持不变
注意该列表中缺少的内容:泄露信息所点名的两个模型 Claude Opus 5 和 Claude Sonnet 5。Google 现有的 Claude 入口运行的是 5.5 代,仅限付费层级,而较旧的 4.6 条目则有一个已记录的退役日期。一份为新 Google 入口点名上一代 Opus 的泄露信息,要么是在描述一种成本优化层级,要么就是单纯过时了——而无论哪种情况都没有文档佐证。把 X 帖子中的模型列表视为其中可靠性最低的一条。
你今天能调用这四个模型中的任何一个吗?
这是泄露无法回答、而 Google 的文档却能回答的问题——至少就 Gemini 这一方而言。
• Gemini 4 Argon —— 不。Google 于 2026-09-30 宣布了它,初始定价为每百万输入 token 2 美元、每百万输出 token 10 美元,分阶段推出,仅第一阶段有日期(通过 Fairwind Program 面向网络防御者),且没有模型 ID。截至 2026-10-09,Gemini API 的模型列表中没有 Argon 条目,也没有 gemini-4 标识符;最新的条目是 3.8 系列。Artificial Analysis 在其 v4.3.2 修订版中测得 Argon 的 Intelligence Index 为 52.56,而读者仍然无法把这个模型放进请求里。
• Gemini 3.8 Flash —— 是的,它自 2026-09-02 起即可调用,因此已经可以在 Gemini API、AI Studio 以及我们的路由中以 google/gemini-3.8-flash 的形式使用。Google 自家的定价页面显示,截至 2026-12-31,它的价格为每百万输入 0.75 美元、每百万输出 3.75 美元,从 2027-01-01 起将上涨至 1.50 / 7.50 美元。在同一次索引修订中,它的得分为 40.9 —— 比 Argon 低约十二分,而这一差距正是 Google 希望把两条产品线放进同一个智能体的全部理由。
• Claude Opus 5 ——是的。Anthropic 于 2026-07-24 推出该模型,价格为每百万 token 5 美元 / 25 美元,上下文窗口达 100 万 token;Artificial Analysis 在 Intelligence Index v4.3 上给它的评分为 51,在约 200 个被测模型中排名第七。
• Claude Sonnet 5.5 — 是的。Anthropic 于 2026-09-28 发布,价格为每百万 token 2 美元 / 10 美元,并且在同一个修订版上得分 56,比旗舰版 Claude Opus 5.5 的 58 分低两分。
那么就是四款模型,而其中只有一款是 Gemini 智能体专属。Argon 才是这次泄露真正涉及的对象,因为它是读者唯一还无法接触到的模型。

为什么Google需要这件事成功:一个数字说明
多供应商智能体背后的算术是一道价差,而这道价差很大。在 Artificial Analysis 的 v4.3.2 修订版中,同样的六分区间从 58 的 Claude Opus 5.5 一路向下,经过 56 的 Claude Sonnet 5.5、53 的 Claude Fable 5.1 和 GPT-6 Astra,再到 51 的 Claude Opus 5——而 Gemini 3.8 Flash 以 40.9 处在 $0.75 / $3.75。Google 的卖点在于,智能体会按任务逐项挑选:在 Argon 上为工作流中最难的那 5% 做前沿推理,用 Flash 应对大批量。如果 Claude Opus 5.5 和 Claude Sonnet 5.5 也在可选之列,那么同一套“选对模型”的逻辑就会跨供应商延伸,而 Google 卖的就是路由,而不是模型。
这是一个很好的论点,而且你可以立即付诸行动,无需等待Google推出相应版本。企业在采用新的编排层时常犯的错误是,想当然地认为路由是免费的,因为它是捆绑提供的。事实并非如此:每个界面都有自己的配额池、自己的管理控制台、自己的支出上限语义,以及自己对提供商降级时会发生什么的定义。Google自己的Antigravity文档就是一个现成的例子——Claude和GPT的配额与Gemini模型位于不同的池中,遵循各自五小时和每周的限制,而且为它们提供服务的套餐不支持BYOK。
你针对某一家供应商的智能体构建的任何东西,也都是针对它的模型列表构建的,而这份列表恰恰就是这次泄露搞错的那份。一个 API 覆盖 200+ 模型,按供应商标价 0% 加价是测试同一路由思路的低承诺方式:从同一个端点对 Gemini 3.8 Flash 和 Claude Sonnet 5.5 运行任务,根据你自己的流量而不是厂商表格来比较每项任务成本,并让跨供应商的自动故障转移覆盖你选中的模型正好处于糟糕时段的情况。供应商价格变动当天就会传导,这一点很重要,因为 Google 已经告诉你 Gemini 3.8 Flash 将在 2027-01-01 翻倍。
什么会让这件事从泄密变成新闻?
三份文件就能解决问题,而如今它们一份也不存在。
第一个是 Gemini 智能体模型选择页面,其中列出了各版本——相当于 Antigravity 的模型表,该表按名称和方案列出了 Claude Sonnet 5.5 和 Claude Opus 5.5。Google 的智能体公告没有这样的表格,而关于 Anthropic 的那句话只是文字上的承诺,而非规格说明。在表格出现之前,所有流传的版本号都只是某人的推测。
第二个是 Gemini Business 产品页。目前,这个名称的唯一证据是一个 SSO 重定向和一条 X 帖子。如果 Google 正在消费级 Gemini 应用与 Gemini Enterprise 之间创建一个层级,那么它就会出现在 Cloud 或 Workspace 博客中,并带有价格和套餐门槛,而且会像 Antigravity 的文档那样命名这些模型。
第三个是 Argon 模型 ID。Argon 是整个安排的全部商业要点——它是 Google 的前沿产品线,定价为 2 美元 / 10 美元的入门价,而且目前尚不可调用。当 gemini-4 或某个 Argon 标识符出现在 Gemini API 的模型列表中时,这个多模型智能体就有了一些可以路由到、且尚未在市场上出现的东西。在那之前,对“Gemini Argon 4”的诚实总结是:它是一个已宣布的模型,有测得的指数分数、有价格,但没有端点——这对读者来说是一个可以据此规划的真实处境,却是一个糟糕的构建基础。

如果你这周正在选择模型,这个该怎么办
泄露出来的东西丝毫不会改变你今天该跑什么。Gemini 3.8 Flash、Claude Opus 5、Claude Opus 5.5、Claude Sonnet 5.5 以及这一领域的其余模型,现在都可按各自公布的价格调用,而无论 Google 是否推出 agent,模型选型这项工作都是同一项工作。
这则公告唯一真正能说明的决定是架构层面的:如果你正在统一采用单一供应商的编排层,你也就接受了该供应商的模型列表、该供应商的配额池,以及该供应商的变化节奏。如果你正在统一采用一个对接多家供应商的 API,你就保留了选择权——而这正是 Google 为其自家产品提出的论点,一字不差:它写道,领先模型每隔几个月就会变化,而保持选择开放意味着当它变化时,你的上下文、技能和数据仍留在原处。区别只在于谁掌控路由。
值得关注的范围很窄,而且有时效性:Gemini API 的模型列表中的一个 Argon ID,以及一张列出 Anthropic 版本的 Gemini 模型表。二者中任何一个都会让这件事从泄露变成一份规格说明。在这两者都落地之前,对 Google 立场的准确描述,就是 Google 所发布的那份——Claude 在该智能体中,版本未说明,而 Gemini Business 仍然只是一个登录页面和一则传闻。
本文中的对比4
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
