主标题卡片显示“Claude Marshmallow & Melon — 泄露报告”,带有“未验证 — 尚未发布”徽章,副标题为“已发现两个新的 Claude 模型标识符——目前我们所知的情况”,标签显示“来源:@kimmonismus”、“2026年8月24日”和“claude-marshmallow-eap · claude-melon-eap”,左侧卡片显示“说法:Opus 级别的更新,可能还有新的 Haiku”,右侧卡片显示“未确认发布:Anthropic 尚未宣布任何消息”,右下角合成有 OrcaRouter 标志。
Guides & Insights

Claude Marshmallow & Melon 泄露:Opus 5.1 是 Opus 5 批评者的答案吗?

作者

Magnus Corvin

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

Claude Opus 5 正式发布正好满一个月,Anthro​pic 自家团队就已经承认该模型“确实很不稳定”。这一承认成为 8 月 24 日泄密事件的背景:标识符 claude-marshmallow-eap 和 claude-melon-eap 出现在第三方开发者应用和 Discord 中,社区将其解读为 Claude Opus 5.1 以及可能是新款 Claude Haiku。这一切都尚未官宣——没有模型卡,没有发布日期,也没有 Anthro​pic 的任何评论。这是一篇关于这起泄密事件的“目前已知信息”报道,这起泄密看起来像是厂商在回应批评者,而其中除历史记录以外的所有内容均未经证实。

后缀就是线索。“-eap” 是 Anthropic 的早期访问预览标记,上一次类似标识符出现在公众视野中时,几周之内就有真正的模型问世。7 月初,Claude Honeycomb EAP 出现在 Cursor 的模型选择器中,几小时内就被撤下;十六天后,Claude Opus 5 正式上线。如果 Claude Marshmallow 和 Claude Melon 走的是同一条路,它们就不是雾件——它们是 Claude 家族接下来的两个成员,比官方公告早了几拍就被发现。

究竟泄露了什么?

根据8月24日流传的报道,原材料颇为单薄,大多只有名字:

• 两个新标识符 — claude-marshmallow-eap 和 claude-melon-eap — 已出现在 Anthro​pic 的 API 接口和 Discord 中。有一个账户把第一个拼写成了 "claude-mashmallow-eap",这个单字母拼写错误读起来像是从某处转录下来的真实字符串,而不是一份凭空捏造的清单。

• @kimmonismus 发现了这两个模型,认为它们“可能是 Opus 的更新,甚至可能是新的 Haiku。”

• 来自账户 J A Z I I 的第二份报告将这些模型描述为“不是寓言级模型,但还不错,所以大多是 Opus 或 Sonnet 模型”——在 Opus 上意见一致,但对于两个中较小的那个,给出的解读是 Sonnet 而非 Haiku。

• 此次发布被描述为“可能即将到来”,但没有附上具体日期。

这几乎就是全部的事实信息。Anthro​pic 的文档、新闻中心和价格表都没有提到这两个名字。Marshmallow 和 Melon 是工作代号——值得注意的是,它们打破了 Anthro​pic 内部构建通常遵循的动物命名方案(Fennec、Numbat)。至于改用食物名称是否意味着新的内部分支,目前只是猜测。

上一次"-eap"标识符泄露时,随之而来的是一款真实模型。

在 X 上流传的泄露模型名称并不值钱。以 "-eap" 结尾的标识符是另一类信号,因为它意味着真实构建已经存在并正在为发布做准备。Honeycomb 事件是关于 Anthro​pic 泄露实际行为最接近受控研究的例子:

• 2026年7月8日至9日 — Claude Honeycomb EAP 出现在 Cursor 的模型选择器中,带有 1M token 上下文窗口、一种“extra high”(超高)努力模式,以及一段大意如下的描述:“Anthro​pic 研究模型,具有逐轮控制和安全回退功能。早期访问预览。”它在数小时内被撤下。

• 7月24日 — 字符串 claude-opus-5 出现在 Cursor 错误对话框中,且 Claude Opus 5 于同一天正式发布。

因此,从“正式发布产品中可见的 EAP 标识符”到“GA 发布”,Opus 5 大约历时两周半。如果 claude-marshmallow-eap 和 claude-melon-eap 也是从同样的暂存阶段浮出水面,那么预期八月末或九月初发布是合理的。但这种节奏只是一个数据点,并非规律——未发布的 Numbat 代号曾沉寂数月,提醒人们标识符也可能出现后又不了了之。

信号背后的信号:Anthro​pic正在回应其批评者

使这次泄露不仅仅是一次目录曝光的,是社区早已在告诉Anthropic关于Claude Opus 5的事情。@kimmonismus直率提出的、并在时间线上引起共鸣的反复抱怨是,Opus 5“懒惰、马虎且冗长”——其个性和投入程度因设置而异,而不是Claude用户所习惯的“一致而温暖”的模型。Kim将其表述为一条不言自明的真理:“Opus 5并不好,他们心知肚明。”

Anthro​pic 的回应异常公开。Claude 团队的 Thariq 在回复中同意“Opus 5 确实是一个尖峰型模型”,表示公司希望模型“保持一致、温暖,感觉像 Claude”,并将改进列为最高优先级。另一位 Anthro​pic 方面的人士 Boris 认为,人们“忽略了用 Opus 做爬山式优化”——Kim 觉得这种说法是在回避问题,那种“你用法不对”的论调本身就是问题的一部分。

这个泄露事件与那条讨论直接相关。同一周,关于新模型的报告声称它们“即便在 Medium 推理设置下也展现出相当不错的结果”,并推测其身份很可能是“(Opus 5.1?)”——评论者将这一时间点解读为“Thariq 和 Boris 昨天重申,他们已经把批评记在了心上”的证据。如果 EAP 版本正是团队在批评声达到顶峰时所打磨的东西,那么“即便在 Medium 推理下也表现良好”这一观察恰恰是那种标志着修复效果已落实的细节:即模型的质量不会在你把推理投入从最高档调低时断崖式下跌。这仍然是泄露消息中的说法,不是基准测试结果——但它是对这一具体批评的一种合理回应。

棉花糖和甜瓜大概是什么

要权衡这两种解读,请列出当前的 Claude 系列以及每个层级的上次变动位置:

Claude Fable 5 — 每1M token 输入 $10 / 输出 $50,1M 上下文,最大输出 128K。GA 2026年6月9日。旗舰型号,也是最贵的。

• Claude Opus 5 — 每 1M tokens 收费 $5 / $25,1M 上下文,128K 最大输出。2026 年 7 月 24 日全面上市。默认开启思考模式,并提供多个努力级别。

Claude Sonnet 5 — 每100万tokens $3 / $15(8月31日前特价$2 / $10),1M上下文。2026年6月30日GA。编程和智能体工作质量接近Opus,价格约为其60%。

• Claude Haiku 4.5 — 每100万Token $1/$5,200K上下文。2025年10月15日GA(正式发布)——是该产品线中历史最悠久的模型,比其它模型早约十个月。

A screenshot of the Artificial Analysis Intelligence Index leaderboard (captured August 24, 2026) showing Claude Opus 5 (max) and Claude Opus 5 (xhigh) leading the intelligence ranking, followed by Claude Fable 5 (with fallback) and Claude Opus 5 (high), each row carrying context-window, cost-per-task, and latency figures.

在这种背景下,将 Marshmallow 解读为“Opus 更新”是容易让人信服的。Anthropic 在 2026 年的 Opus 发布节奏异常之快——Opus 4.6、4.7 和 4.8 在上半年相继推出,而 Opus 5 仅比 Opus 4.8 晚了八周。以同样的 $5 / $25 价格推出一个修补版本,解决行为方面的抱怨,而不是提升原始能力,这完全符合惯例;而 EAP 暂存构建正是这种更新会采用的形态。

Melon 正是两个消息源分歧之所在,也是更有意思的问题。单看年头,新一代 Haiku 早该推出了:Claude Haiku 4.5 作为主力层级已经服役十个月,而它之上的所有型号都已更新了两轮。一款 $1/$5 的 Haiku 级继任者——或一次首发降价——将对大流量调用、分类、摘要以及任何 token 成本构成硬约束的场景产生重大影响。另一种解读是 Sonnet 级,那将是周期中段的刷新,而非新层级:是当前 Claude Sonnet 5 之下的一个增量步骤,精神上更接近当年 4.6 的定位。实事求是的判断是,这一对模型最有可能意味着“一款 Opus 家族模型加一款较小的模型”,而较小模型的层级尚未确认。

A two-column infographic titled 'Claude Marshmallow & Melon — what we know / what we don't'. Left column 'What we know': the August 24, 2026 sighting of identifiers claude-marshmallow-eap and claude-melon-eap, EAP as an early-access-preview marker per Anthropic convention, the July precedent where an EAP surfaced and Opus 5 shipped 16 days later, and sources reading the pair as an Opus update possibly plus a new Haiku. Right column 'What we don't': the official names (Marshmallow and Melon are working codenames), the release date, whether Melon is Haiku- or Sonnet-class, and pricing. Footer: 'All leak claims unverified; Anthropic has not commented.'

为什么发布在现在到来——以及为什么它让人感觉仓促

时机报告强调了一个词:紧迫。这被描述为比Anthro​pic通常的节奏更快的周转,大约在Fable 5发布两个月后到来——而匆忙背后有商业原因。Claude Fable 5上市头两个月颇为艰难:它带着静默护栏出货,悄悄降低了前沿话题的回复质量(此举旨在阻止蒸馏),还有强制性的30天数据保留政策,使企业采用变得复杂;据媒体报道,企业采用率仅占Anthro​pic支出份额的约11%,而Ope​nAI的GPT-5.6 Sol约为23–25%。与此同时,据同一报道,开源模型的token份额在四个月内从约11%增长到62%,给每个专有价格点都带来了压力。

Claude Opus 5 是答案的第一步——比旗舰产品更便宜,且在成本调整后的编码工作上与之竞争(在 CursorBench 上,Opus 5 得分 70%,每项任务约 8.23 美元,而 Fable 5 得分 70.5%,每项任务约 17.32 美元)。Marshmallow 和 Melon 看起来是后续步骤:一个修复后更流畅的 Opus,价格不变,外加一个更便宜的小模型,以守住开源正在进攻的大批量层级。这是一个连贯的产品策略,但泄露信息显示“可能即将发布”,表明这些模型是为了赶上竞争窗口而仓促推出,而非经过从容的开发周期——这对买家来说利弊参半。首发第一周恰恰是点版本可能表现不稳定的时期。

等待时可以做什么

先给出无聊的答案:Claude Marshmallow 和 Claude Melon 目前都不存在可调用的模型。没有 API ID,没有供应商目录条目,也没有任何可构建的东西——你现在能付费的任何“提前体验”列表都不是这次泄露所描述的。你已经在调用的 claude-opus-5 和 claude-haiku-4-5 标识符没有变化,在 Anthro​pic 宣布新的之前,继续调用你正在调用的即可。

真正有用的工作,是让新版本在落地时能被低成本采用。新的 Claude 模型通常会在公告发布后数小时到数天内出现在供应商目录中,这正是路由层的价值所在:在 OrcaRouter 上,一个 API 即可覆盖 {{2}}200+{{/2}} 款模型,供应商目录价原样透传、零加价——所以当新的 {{3}}Opus 或 Haiku{{/3}} 真正出现在目录中时,就可以通过同一个密钥和端点、以厂商自定的价格当天上线调用,无需第二份合同,也不用重新谈判。尚未经过验证的首周新模型,也正是自动故障转移的教科书式场景:将新模型固定为主用、回退到 {{1}}Claude Opus 5{{/1}},或者给它分配一部分影子流量;这样,一次半成品的发布就变成了一条路由规则,而不是一起事故。这种姿态今天不花任何成本,而当公告正式落地时,它能把一次泄露变成先发优势。

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5, captured August 24, 2026) showing the model ID, Vision/Tools/JSON/Reasoning capability chips, a 1M-token context window, a 128K max output, $5.00 per 1M input tokens and $25.00 per 1M output tokens, and a p50 time-to-first-token of 4.94 seconds.

我们正在观看的内容

• Anthropic是否会发布这些模型。Honeycomb的先例表明,EAP亮相可能比GA早两周半——或者这些标识符可能悄无声息地搁置数月,正如未发布的Numbat代号那样。

• 正式发布名称。Marshmallow 和 Melon 是工作代号;正式公布的名称才是战略信号——Opus 5.1、Opus 5.5 与 Opus 6 对 Anthropic 的发布节奏传达着不同的信息。

• API 模型 ID。真正的新版本会以新 ID 发布;提供商目录中出现的精确字符串是最值得关注的具体事项。

• 定价。无论 Marshmallow 是否延续 Claude Opus 5 的 $5 / $25 价位,以及新款 Haiku 是否保持 $1 / $5——Haiku 的价格才是更关键的信号,因为它揭示了 Anthropic 是否有意捍卫预算档位以抵御开源模型。

• Haiku 与 Sonnet 之问。两种泄露解读对较小模型的看法不一致;Melon 实际填补的层级不同,会改变这次发布对高容量工作负载的意义。

常见问题

Claude Marshmallow 发布了吗?

不。标识符 claude-marshmallow-eap 和 claude-melon-eap 已被发现,但没有任何官方公告,Anthro​pic 也未置评。在出现官方模型卡或目录条目之前,请将所有细节——包括“Opus 5.1”的解读——视为未经证实。

型号标识符中的“-eap”是什么意思?

它代表早期访问预览(early access preview),这也是Claude Opus 5发布前所使用的同一个后缀:Claude Honeycomb EAP构建于7月初出现在Cursor中,16天后Claude Opus 5发布。EAP标识意味着存在一个真实的暂存构建,这比单纯的传闻更有说服力——但并不能保证。

Anthro​pic 什么时候发布新的 Claude 模型?

日期尚未确认。泄露消息称发布“可能迫在眉睫”,Honeycomb 的先例表明,EAP 现身时间可能比 GA 早大约两周,但这一节奏只是单一数据点——未发布的 Numbat 代号则表明,标识符也可能数月无动静。要留意 Anthro​pic 的官方公告,而不是泄露帖。

Claude Opus 5.1 是真的吗?

未经证实。社区将 Claude Marshmallow 视为 Opus 级别的更新——即内部代号“Opus 5.1”——早期测试者的报告称其对话表现比 Claude Opus 5 更流畅。这些均未得到确认,最终发布名称也可能与代号不同,因此请将“Opus 5.1”视为一种假设,而非正式产品。

新模型会通过OrcaRouter提供吗?

如果 Claude Marshmallow 和 Claude Melon 作为已发布模型出现在供应商目录中,我们路由的其他所有模型也适用同样的规则:一个 API、供应商标价零加价直传、自动故障转移、无需第二份合同。在那之前,没有什么可调用的——这些模型还没有作为端点存在。

这是一篇泄露报道,所以诚实的总结是一个问题。两个早期访问标识符已经浮出水面,看起来分别是下一个 Opus 系列模型和下一个小型模型;它们恰好出现在 Anthro​pic 对 Claude Opus 5 的行为进行最公开反思之际。而上一次 EAP 标识符以这种方式出现时,几周内便迎来了真正的发布。在 Anthro​pic 正式表态之前,一切都未得到证实;值得关注的事情很具体:官方公告、正式名称、模型 ID,以及——如果新款 Haiku 真的会来——价格。如果你今天正在调用 Claude Opus 5 或 Claude Haiku 4.5,请继续使用,并保持绕过传闻路由的选项开放——这正是故障转移规则的用途。

本文中的对比2

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

providers@orcarouter.ai

加入我们的社区

Discordsupport@orcarouter.aiXGitHubYouTube