一张生成的标题卡,上面写着“OpenAI 的 o 智能体:DevDay 泄露,已标注”,并配有状态行“据报道,这是面向 ChatGPT Pro 各档位的常驻智能体——没有产品页面,没有价格,没有模型 ID,没有 OpenAI 的声明”。三张卡片分别写着:“线索——据一篇报道,它被发现于一个显示名称和一个邮件后缀”;“时间窗口——2026 年 DevDay,9 月 29 日,Fort Mason Center”;“空白——任务、权限、记忆、调度和可用性均未见报道”。页脚一行写着“单一来源的泄露消息。这里没有任何内容属于 OpenAI 的公告。”OrcaRouter 标志位于右下角。
Guides & Insights

OpenAI的“o”Agent:DevDay 2026泄漏内容实际上说了什么,又没说什么

作者

Alistair Wren

发布日期

最新模型 · 20查看全部模型 →
基准测试:Artificial Analysis · 每日更新
返回全部文章

被曝出来的名字,是这件事里最没意思的部分。这则爆料称,该公司那款常驻在线的智能体将被命名为“o”,会进入每一个 ChatGPT Pro 层级,并附带一个运行在 Cerebras 芯片上的 Fast Mode(快速模式)。真正值得停下来细想的细节,比这更小、也更古怪:据报道,这一提法是在100 美元 Pro 套餐,而不是 200 美元的那个套餐,而且就发生在公司彻底停售 200 美元套餐的同一个月份。那里没有产品页面,没有价格,没有模型标识符,也没有任何一份公司声明把这个字母当作产品名来用。这篇文章背后的帖子,只是一个账号对它所声称见到之物的总结,而它挂靠的那场会议却是真的:DevDay 2026 将于 9 月 29 日在旧金山的 Fort Mason Center 举行。它要与之竞争的智能体也是真的——Grok Bot,这是 SpaceXAI 于 8 月 11 日投入早期测试版的数字同事产品。这款智能体大概会运行其上的模型也真实存在、且有明确日期:GPT-6 Astra,自 9 月 3 日起全面可用。而这则说法里,几乎再没有别的东西是真的。

泄露的实际内容,按权重排序

有三件事正在被报道,它们不应被当作同一个主张来解读。

截图中的引用是最有力的部分。9月26日发布的报道称,对“O”的引用出现在 ChatGPT 自身的配置中——作为显示名称,以及作为写作“-o”的邮件后缀——并且同一字符串最近被列为 $100 ChatGPT Pro 套餐升级页面上的一项权益。这些是部署形态的产物,而非凭空捏造:配置界面正是公司在正式宣布产品之前对其进行预置的地方,就像功能标志一样。它们也是现有最弱的一类产物,因为预置的字符串可以被重命名、改作他用或弃用,而且它不附带任何行为。报道明确指出了这一空白:该智能体做什么、可以访问什么、是否会安排任何事项、记忆能保留多久,以及谁能获得它,均未说明。

这个名字是二阶主张。X 上一个被暂停的 @o 账号被引用为一种可能的预留。被暂停的用户名只是关于某一时刻意图的数据点,而不是关于这个产品本身是什么,而且同一个字母已经走过一次 OpenAI 命名部门的流程——下文还会详细说明。

第三层来自本周的信号,而非来自报道:即“o”出现在所有 Pro 层级中、Fast Mode 已确认、据推测它被打包进了 500 美元的订阅层级,以及 Cerebras 芯片正是让这样的速度成为可能的原因。在这句话里,“据推测”明显在发挥作用。雷达抓取到的信号帖本身是截断的——它的第五条以 "shared m…" 开头便戛然而止——所以要把这份清单当作不完整的来看,而不是五个已确定的要点。

无人核查过的命名问题

OpenAI 已经用过这个字母。其推理模型以o1、o3、o3-mini和o4-mini 这些名称于 2024 年和 2025 年间发布,而这条产品线已被收缩而非扩展:o4-mini 于 2026 年 2 月从 ChatGPT 中下架,GPT-4.5 于 6 月退出,o3 则被安排了 90 天退役期,这一安排在 5 月 28 日的模型发布说明中宣布——本博客当时报道了这次退役,因为用户报告称,在截止日期前回复就已开始消失。

所以,一个光秃秃的“o”作为消费级智能体的名字,会与公司自己最近的历史撞车,并且会在唯一一个歧义代价高昂的地方——模型选择器——产生歧义。这并不能证明泄密是错的——厂商会重复使用字母,内部代号也常常在命名评审时被弃用——但这确实有理由把这个名字视为整个消息中最可舍弃的部分。如果“o”以其他名称发布,下文每一个带日期的事实仍然成立。

为什么即使产品不可信,时机却仍然可信

DevDay 上智能体发布的最有力证据,并不是那则泄密。而是 OpenAI 在此前四周里已经铺好的局。

• 9月3日 — GPT-6 Astra作为 OpenAI 的前沿模型正式全面可用:上下文为 105 万 token,最大输出 128K,标价为每百万输入 token 10.00 美元、每百万输出 50.00 美元,缓存输入为 1.00 美元,缓存写入为 12.50 美元。我们自己的目录以 2026-09-04 的收录日期列出同一模型;Artificial Analysis 将该模型的发布日期定为 9 月 3 日。

• 9月10日——OpenAI 以公开测试版的形式开放了 Agents API,向开发者售卖托管式 Codex harness:OpenAI 负责运行编排、上下文压缩与恢复,开发者只需提供任务、模型、工具和环境。这套常驻运行智能体的基础设施,正作为一款开发者产品被出售。

• 9月10日——同一天,200 美元 ChatGPT Pro 套餐的新注册与升级被暂停,官方给出的理由是对 GPT-6 Astra 的需求。100 美元档位,以及 Plus、Go、Business、Enterprise 和 API 均保持开放。

• 9月22日 —— GPT-6 Sol和GPT-6 Luna以每百万 token 2.00 美元 / 10.00 美元和 0.10 美元 / 0.50 美元的价格发布,OpenAI 称其为永久定价而非促销定价,延续了该系列中价格低廉的一端,供智能体处理日常工作时取用。

• 9 月 26 日——Ultrafast 服务层级的文档有所扩充:在 Responses API Playground 中发现了一个提供 Standard、Fast 和 Ultrafast 的速度选择器,但尚未发布;相关报道则指向 DevDay 前后更广泛的推出。

• 9 月 29 日——DevDay 2026,主题演讲线上直播,由萨姆·奥尔特曼开场。就在智能体报告出炉的同一个周末,OpenAI 的开发者账号发帖称"距离 OpenAI DevDay 还有 72 小时"。

Screenshot of the OrcaRouter model page for OpenAI GPT-6 Astra, showing a 1.05M-token context window, input pricing of $10.00 and output pricing of $50.00 per million tokens with $1.00 cached input and $12.50 cache writes, and a second pricing row above 272,000 input tokens at double the input and cache rates and 1.5x the output rate, plus capability tags for Vision, Tools, JSON and Reasoning.

把这六行放在一起读,故事的轮廓是连贯的:OpenAI 把智能体工具链产品化,卖给了开发者,对承载其最佳模型的消费者席位实行限量供应,而四天后就有一场主题演讲。同一套工具链面向消费者的版本——以订阅而非按 token 计费的端点形式出售——是显而易见的下一步。这一切都不能证明那个名称、那个层级或与 Cerebras 的关联已获证实。它只能说明时机上是合理的,而这是一个不同且更弱的论断。

快速模式、超快速与 Cerebras 的声明

该信号称 Fast Mode 已“确认”,还说 Cerebras 芯片“已经生效”。这两点需要彼此区分开,因为其中一个是有文档记载的平台底层机制,而另一个则是对哪款芯片服务于哪个产品的推断。

快速模式是 OpenAI API 为 GPT-6 系列提供的一个真实存在、明码标价的档位:它按标准费率的两倍计费,换来约 2.5 倍的输出速度;它也正是在 2026 年 7 月 30 日由 Priority processing(优先处理)更名而来的同一档位——API 可接受以下任意一种写法:service_tier: "fast" 或 service_tier: "priority"。在该系列的至少一款模型上,若开启欧盟数据驻留,此模式便不可用。在 ChatGPT 订阅体系内,关于订阅额度结构的报道显示,快速模式的额度倍率是 2.5 倍,而非 API 的 2 倍,这就使这一最快档位在 ChatGPT 内部反而比在外部略不划算——在你认定某项快速模式权益真如听上去那般划算之前,这个细节值得了解。

Ultrafast 是 Cerebras 层级,它完全是另一种存在。OpenAI 于 2026 年 8 月 13 日将其公布,作为其与 Cerebras 算力合作的首个产品——据报道,该交易规模约为三年 100 亿美元——它在 GPT-5.6 Sol 上可提供最高 14 倍的标准吞吐量,以及最高每秒 750 个输出 token,而目前它也仅限于该模型。它采用访问控制,没有公布价格,而且截至本周,它仍是一个候补名单层级,而非通用层级。Responses API 参考文档将 ultrafast 列为 service_tier 参数的一个取值,并注明它“目前适用于 gpt-5.6-sol”。

这正是为什么泄密中关于Cerebras的那句话应当被视为一个有合理依据的猜测,而非确证。一个持续运行的消费者智能体,其表现将主要受制于延迟和每任务成本,而Cerebras级别的速度确实能解决前一半问题。但目前还没有任何GPT-6模型拥有有据可查的Ultrafast路径,没有相应的价目表,OpenAI也没有任何内容将消费者智能体与那款芯片挂钩。这一推断的方向是合理的,但措辞中的确定性并无依据。

“在所有 Pro 版本中可用”会让你付出什么代价

这是读者实际能够评估的那部分主张,因为其背后的层级结构是公开的。

• 月度价格——100 美元和 200 美元的 ChatGPT Pro 套餐均促销至 9 月;自 9 月 10 日起,200 美元套餐的新用户注册已暂停,而 OpenAI 未公布任何恢复开放的门槛。

• 同一能力的按量计费版本——GPT-6 Pro 在 200 美元套餐下每周上限为 200 条消息,在 100 美元套餐下为每周 50 条,后者取自与 GPT-5.6 Sol Pro 共享的额度。企业版套餐的额度更低。这些都是 OpenAI 公布的数字,而它们才是对"升级页面上的一项权益"究竟值多少的真正限制。

• 底层模型的 token 账 — 按每百万 $10.00 / $50.00 计算,$500 的 GPT-6 Astra API 大约相当于 50M 输入 token 或 10M 输出 token;而一旦超过 272K 输入阈值,整个请求会重新按 $20.00 / $2.00 / $75.00 计价,有效工作量也随之再减半。

• 产品线中较便宜的那一半——同样的 500 美元大约能买到 2.5 亿个输入 token 或 5000 万个输出 token,对应 GPT-6 Sol 的 $2.00 / $10.00,而同样的钱能买到十倍于此的数量,对应 GPT-6 Luna 的 $0.10 / $0.50。

如果该智能体出现在现有订阅之内,比较就不再围绕标价,而是变成围绕你已经在为哪个席位付费。如果它作为单独列项出现,OpenAI就必须在一个竞争对手已经推出了六周的产品类别中为其辩护。无论哪种方式,一个全天候运行的智能体都会改变账单的形态:一个在你睡觉时仍持续工作的助手会在没有人类参与循环的情况下消耗token,而这正是按量计费层级会惩罚、而席位会吸收的工作负载。这也是缓存输入以新鲜输入十分之一的价格决定总量的工作负载——一个持久化的智能体每一轮都会重新发送几乎未变的上下文,而这恰恰正是缓存折扣所针对的模式。

这正是 OrcaRouter 所处的层面,而它不覆盖什么,也值得直说。我们按 token 路由 OpenAI 的模型,提供商列表价以 0% 加价透传,因此供应商费率一变,这里当天就会生效,并具备 跨提供商自动故障转移以及用于组合调用的路由 DSL。GPT-6 Astra、GPT-5.6 Sol、GPT-6 Sol 和 GPT-6 Luna 都在同一个密钥上。我们无法向你出售的是 ChatGPT 订阅,或者一个尚不存在的智能体——在 OpenAI 推出之前,没有东西可路由。

智能体必须跨越的门槛比看上去要低。

Grok Bot 正是这份泄密材料自己拿来作比较的对象,而对它最诚实的解读是:SpaceXAI 把门槛设得很低。它于 8 月 11 日进入早期测试阶段,入门配置为每个席位 120 美元,捆绑在 Cursor Premium Teams 中;个人版套餐为每月 200 美元和 300 美元,超出包含额度的用量按 token 成本计费。每个 bot 都拥有自己的云虚拟机,配有浏览器、文件系统和终端;它能登录那些没有 API 的应用;它把演示过的工作流程保存为例程,并且在笔记本电脑合上之后仍继续运行。

尚未公布的,正是能一锤定音的部分。SpaceXAI 没有为此发布任何独立基准测试或可靠性数据,其背后的模型路由器是自动运行的,用户无法固定某个模型,早期测试者公开表示不买账,评测者还指出其缺少企业控制层——没有范围权限、升级规则或审计追踪。Meta 的 Muse 于 9 月 8 日跟进,进入了一个如今已容纳三款产品的品类。

A two-column scoreboard titled 'o vs Grok Bot - the scoreboard'. The left column, 'o (reported)', reads: Status reported for DevDay, Sept 29; Evidence a display name and a mail suffix, per one report; Tiers reported as all Pro tiers, unconfirmed; Speed mode reported Fast Mode on Cerebras, unconfirmed; Behaviour unreported; Benchmarks none. The right column, 'Grok Bot (shipped)', reads: Status early beta since Aug 11, 2026; Evidence vendor product page; Tiers from $120 per seat per month, bundled with Cursor Premium Teams; Speed mode vendor-managed, model not pinnable; Behaviour cloud VM with browser, filesystem and terminal; Benchmarks none published. A footer line reads 'o column is single-source reporting; Grok Bot figures per SpaceXAI. Neither side has published independent reliability data.'

最后一行才是整个对比的关键。对于“该智能体是否在没有造成灾难性后果的情况下完成了任务”,并不存在 Artificial Analysis 指数,因此,人们购买持久型智能体所依据的证据,与 2023 年购买聊天机器人所依据的证据如出一辙:演示和感觉。这个故事里没人提到的那个带日期的约束,是 OpenAI 自身的安全态势。GPT-6 Astra 达到了公司的 Critical 网络安全能力阈值,而 OpenAI 已警告称,监控可能会减缓、暂停或停止合法任务——明确包括长时间运行的任务。一个始终在线的智能体,按定义就是一项长时间运行的任务,而且是在这个已经表示可能会中断此类任务的平台里。

什么能让这一点变得可核查,以及何时

距离产品发布还有四天,传闻不可信,而核查是具体的。

• 一个将 OpenAI 这个名称用作产品名称的 OpenAI 页面、发布说明或帮助中心条目。目前还没有出现任何此类内容,而这个字母在 OpenAI 内部的历史,使这成为失败空间最大的一项测试。

• 一个能在刷新后依然存续的配置界面——真正可购买的套餐、已列明的额度、一个设置页面——而不是构建中预设的显示字符串。

• 任何行为规范:它可以被授予什么、它调度什么、它记忆多久、它在生产环境中是否有自己的邮件身份,还是仅存在于配置文件中。

• 价格。{{1}}“在所有 Pro 层级中”{{/1}}并不是价格,而某个 500 美元的层级也不会因为另一份报告在别处发现了 500 美元订阅字符串,就成了事实。

• Cerebras 链接要么出现在 OpenAI 自己针对该层级的服务文档中,就像 Ultrafast 对 GPT-5.6 Sol 的限制那样,要么根本不出现。

A two-column card titled 'The o agent - verified vs claimed'. The left column, 'Verified and dated', reads: DevDay 2026 on September 29 at Fort Mason Center; GPT-6 Astra generally available September 3 at $10 / $50 per million; Agents API public beta September 10; ChatGPT Pro $200 sign-ups paused September 10; GPT-6 Sol and GPT-6 Luna shipped September 22 at $2 / $10 and $0.10 / $0.50; Ultrafast documented as access-controlled on GPT-5.6 Sol; Grok Bot in early beta since August 11. The right column, 'Claimed and unverified', reads: the product name 'o'; an announcement at DevDay; availability in all Pro tiers; Fast Mode bundled into a $500 tier; Cerebras serving the agent; tasks, permissions, memory and scheduling; any published price. A footer line reads 'Left column per OpenAI, SpaceXAI and Artificial Analysis; right column single-source reporting.'

这件事留给读者的决定,比这次泄露所暗示的要小,而且这个决定与那封信无关。如果你正在为工作评估一个常驻智能体,那么今天已经存在的产品是 Gro​k Bot,明智的做法是针对自己的工作流做一次短期试用,而不是承诺购买席位——其 $120 的入门档是下限而非上限,超出包含额度的使用量将按 token 成本计费。如果你正在构建,Agents API 自 9 月 10 日起一直处于公开测试阶段,也是这篇报道中你今天真正可以测试的部分,其测试框架、沙箱和计费都有文档记录。

如果你在估算这其中任何一项的运行成本,那就基于模型来算,而不是基于传闻。GPT-6 Astra 每百万 tokens 为 $10.00 / $50.00,已在 OrcaRouter 上线,采用 OpenAI 自己的标价,未加任何加价;GPT-6 Sol 和 GPT-6 Luna 也在那里,价格分别为 $2.00 / $10.00 和 $0.10 / $0.50;而缓存读取费率——Astra 为 $1.00,而标准价为 $10.00——才是决定持续工作负载实际成本的关键指标。OpenAI 尚未宣布的智能体无法被基准测试、路由或购买。但它底层的 tokens 今天就可以,而你针对它们构建的计量表仍会是正确的计量表,即便盒子上的名字最终不是单个字母。

本文中的对比2

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新