
Claude Marshmallow & Melon 泄露:Opus 5.1 是 Opus 5 批评者的答案吗?
- DeepSeek新DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百万 tokens
- z-ai新Z.ai: GLM 5.32026-08-1860智能75代码
- obsidian新Qwen3.8 27B2026-08-1552智能68代码
- qwen新Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69代码
- grok新SpaceXAI: Grok 4.62026-08-1261智能77代码
- metaMeta: Muse Spark 1.22026-08-0557智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- metaMeta: Muse Spark 1.12026-07-1653智能71代码
- kimiMoonshotAI: Kimi K32026-07-1560智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77代码
Claude Opus 5 正式发布正好满一个月,Anthropic 自家团队就已经承认该模型“确实很不稳定”。这一承认成为 8 月 24 日泄密事件的背景:标识符 claude-marshmallow-eap 和 claude-melon-eap 出现在第三方开发者应用和 Discord 中,社区将其解读为 Claude Opus 5.1 以及可能是新款 Claude Haiku。这一切都尚未官宣——没有模型卡,没有发布日期,也没有 Anthropic 的任何评论。这是一篇关于这起泄密事件的“目前已知信息”报道,这起泄密看起来像是厂商在回应批评者,而其中除历史记录以外的所有内容均未经证实。
后缀就是线索。“-eap” 是 Anthropic 的早期访问预览标记,上一次类似标识符出现在公众视野中时,几周之内就有真正的模型问世。7 月初,Claude Honeycomb EAP 出现在 Cursor 的模型选择器中,几小时内就被撤下;十六天后,Claude Opus 5 正式上线。如果 Claude Marshmallow 和 Claude Melon 走的是同一条路,它们就不是雾件——它们是 Claude 家族接下来的两个成员,比官方公告早了几拍就被发现。
究竟泄露了什么?
根据8月24日流传的报道,原材料颇为单薄,大多只有名字:
• 两个新标识符 — claude-marshmallow-eap 和 claude-melon-eap — 已出现在 Anthropic 的 API 接口和 Discord 中。有一个账户把第一个拼写成了 "claude-mashmallow-eap",这个单字母拼写错误读起来像是从某处转录下来的真实字符串,而不是一份凭空捏造的清单。
• @kimmonismus 发现了这两个模型,认为它们“可能是 Opus 的更新,甚至可能是新的 Haiku。”
• 来自账户 J A Z I I 的第二份报告将这些模型描述为“不是寓言级模型,但还不错,所以大多是 Opus 或 Sonnet 模型”——在 Opus 上意见一致,但对于两个中较小的那个,给出的解读是 Sonnet 而非 Haiku。
• 此次发布被描述为“可能即将到来”,但没有附上具体日期。
这几乎就是全部的事实信息。Anthropic 的文档、新闻中心和价格表都没有提到这两个名字。Marshmallow 和 Melon 是工作代号——值得注意的是,它们打破了 Anthropic 内部构建通常遵循的动物命名方案(Fennec、Numbat)。至于改用食物名称是否意味着新的内部分支,目前只是猜测。
上一次"-eap"标识符泄露时,随之而来的是一款真实模型。
在 X 上流传的泄露模型名称并不值钱。以 "-eap" 结尾的标识符是另一类信号,因为它意味着真实构建已经存在并正在为发布做准备。Honeycomb 事件是关于 Anthropic 泄露实际行为最接近受控研究的例子:
• 2026年7月8日至9日 — Claude Honeycomb EAP 出现在 Cursor 的模型选择器中,带有 1M token 上下文窗口、一种“extra high”(超高)努力模式,以及一段大意如下的描述:“Anthropic 研究模型,具有逐轮控制和安全回退功能。早期访问预览。”它在数小时内被撤下。
• 7月24日 — 字符串 claude-opus-5 出现在 Cursor 错误对话框中,且 Claude Opus 5 于同一天正式发布。
因此,从“正式发布产品中可见的 EAP 标识符”到“GA 发布”,Opus 5 大约历时两周半。如果 claude-marshmallow-eap 和 claude-melon-eap 也是从同样的暂存阶段浮出水面,那么预期八月末或九月初发布是合理的。但这种节奏只是一个数据点,并非规律——未发布的 Numbat 代号曾沉寂数月,提醒人们标识符也可能出现后又不了了之。
信号背后的信号:Anthropic正在回应其批评者
使这次泄露不仅仅是一次目录曝光的,是社区早已在告诉Anthropic关于Claude Opus 5的事情。@kimmonismus直率提出的、并在时间线上引起共鸣的反复抱怨是,Opus 5“懒惰、马虎且冗长”——其个性和投入程度因设置而异,而不是Claude用户所习惯的“一致而温暖”的模型。Kim将其表述为一条不言自明的真理:“Opus 5并不好,他们心知肚明。”
Anthropic 的回应异常公开。Claude 团队的 Thariq 在回复中同意“Opus 5 确实是一个尖峰型模型”,表示公司希望模型“保持一致、温暖,感觉像 Claude”,并将改进列为最高优先级。另一位 Anthropic 方面的人士 Boris 认为,人们“忽略了用 Opus 做爬山式优化”——Kim 觉得这种说法是在回避问题,那种“你用法不对”的论调本身就是问题的一部分。
这个泄露事件与那条讨论直接相关。同一周,关于新模型的报告声称它们“即便在 Medium 推理设置下也展现出相当不错的结果”,并推测其身份很可能是“(Opus 5.1?)”——评论者将这一时间点解读为“Thariq 和 Boris 昨天重申,他们已经把批评记在了心上”的证据。如果 EAP 版本正是团队在批评声达到顶峰时所打磨的东西,那么“即便在 Medium 推理下也表现良好”这一观察恰恰是那种标志着修复效果已落实的细节:即模型的质量不会在你把推理投入从最高档调低时断崖式下跌。这仍然是泄露消息中的说法,不是基准测试结果——但它是对这一具体批评的一种合理回应。
棉花糖和甜瓜大概是什么
要权衡这两种解读,请列出当前的 Claude 系列以及每个层级的上次变动位置:
• Claude Fable 5 — 每1M token 输入 $10 / 输出 $50,1M 上下文,最大输出 128K。GA 2026年6月9日。旗舰型号,也是最贵的。
• Claude Opus 5 — 每 1M tokens 收费 $5 / $25,1M 上下文,128K 最大输出。2026 年 7 月 24 日全面上市。默认开启思考模式,并提供多个努力级别。
• Claude Sonnet 5 — 每100万tokens $3 / $15(8月31日前特价$2 / $10),1M上下文。2026年6月30日GA。编程和智能体工作质量接近Opus,价格约为其60%。
• Claude Haiku 4.5 — 每100万Token $1/$5,200K上下文。2025年10月15日GA(正式发布)——是该产品线中历史最悠久的模型,比其它模型早约十个月。

在这种背景下,将 Marshmallow 解读为“Opus 更新”是容易让人信服的。Anthropic 在 2026 年的 Opus 发布节奏异常之快——Opus 4.6、4.7 和 4.8 在上半年相继推出,而 Opus 5 仅比 Opus 4.8 晚了八周。以同样的 $5 / $25 价格推出一个修补版本,解决行为方面的抱怨,而不是提升原始能力,这完全符合惯例;而 EAP 暂存构建正是这种更新会采用的形态。
Melon 正是两个消息源分歧之所在,也是更有意思的问题。单看年头,新一代 Haiku 早该推出了:Claude Haiku 4.5 作为主力层级已经服役十个月,而它之上的所有型号都已更新了两轮。一款 $1/$5 的 Haiku 级继任者——或一次首发降价——将对大流量调用、分类、摘要以及任何 token 成本构成硬约束的场景产生重大影响。另一种解读是 Sonnet 级,那将是周期中段的刷新,而非新层级:是当前 Claude Sonnet 5 之下的一个增量步骤,精神上更接近当年 4.6 的定位。实事求是的判断是,这一对模型最有可能意味着“一款 Opus 家族模型加一款较小的模型”,而较小模型的层级尚未确认。

为什么发布在现在到来——以及为什么它让人感觉仓促
时机报告强调了一个词:紧迫。这被描述为比Anthropic通常的节奏更快的周转,大约在Fable 5发布两个月后到来——而匆忙背后有商业原因。Claude Fable 5上市头两个月颇为艰难:它带着静默护栏出货,悄悄降低了前沿话题的回复质量(此举旨在阻止蒸馏),还有强制性的30天数据保留政策,使企业采用变得复杂;据媒体报道,企业采用率仅占Anthropic支出份额的约11%,而OpenAI的GPT-5.6 Sol约为23–25%。与此同时,据同一报道,开源模型的token份额在四个月内从约11%增长到62%,给每个专有价格点都带来了压力。
Claude Opus 5 是答案的第一步——比旗舰产品更便宜,且在成本调整后的编码工作上与之竞争(在 CursorBench 上,Opus 5 得分 70%,每项任务约 8.23 美元,而 Fable 5 得分 70.5%,每项任务约 17.32 美元)。Marshmallow 和 Melon 看起来是后续步骤:一个修复后更流畅的 Opus,价格不变,外加一个更便宜的小模型,以守住开源正在进攻的大批量层级。这是一个连贯的产品策略,但泄露信息显示“可能即将发布”,表明这些模型是为了赶上竞争窗口而仓促推出,而非经过从容的开发周期——这对买家来说利弊参半。首发第一周恰恰是点版本可能表现不稳定的时期。
等待时可以做什么
先给出无聊的答案:Claude Marshmallow 和 Claude Melon 目前都不存在可调用的模型。没有 API ID,没有供应商目录条目,也没有任何可构建的东西——你现在能付费的任何“提前体验”列表都不是这次泄露所描述的。你已经在调用的 claude-opus-5 和 claude-haiku-4-5 标识符没有变化,在 Anthropic 宣布新的之前,继续调用你正在调用的即可。
真正有用的工作,是让新版本在落地时能被低成本采用。新的 Claude 模型通常会在公告发布后数小时到数天内出现在供应商目录中,这正是路由层的价值所在:在 OrcaRouter 上,一个 API 即可覆盖 {{2}}200+{{/2}} 款模型,供应商目录价原样透传、零加价——所以当新的 {{3}}Opus 或 Haiku{{/3}} 真正出现在目录中时,就可以通过同一个密钥和端点、以厂商自定的价格当天上线调用,无需第二份合同,也不用重新谈判。尚未经过验证的首周新模型,也正是自动故障转移的教科书式场景:将新模型固定为主用、回退到 {{1}}Claude Opus 5{{/1}},或者给它分配一部分影子流量;这样,一次半成品的发布就变成了一条路由规则,而不是一起事故。这种姿态今天不花任何成本,而当公告正式落地时,它能把一次泄露变成先发优势。

我们正在观看的内容
• Anthropic是否会发布这些模型。Honeycomb的先例表明,EAP亮相可能比GA早两周半——或者这些标识符可能悄无声息地搁置数月,正如未发布的Numbat代号那样。
• 正式发布名称。Marshmallow 和 Melon 是工作代号;正式公布的名称才是战略信号——Opus 5.1、Opus 5.5 与 Opus 6 对 Anthropic 的发布节奏传达着不同的信息。
• API 模型 ID。真正的新版本会以新 ID 发布;提供商目录中出现的精确字符串是最值得关注的具体事项。
• 定价。无论 Marshmallow 是否延续 Claude Opus 5 的 $5 / $25 价位,以及新款 Haiku 是否保持 $1 / $5——Haiku 的价格才是更关键的信号,因为它揭示了 Anthropic 是否有意捍卫预算档位以抵御开源模型。
• Haiku 与 Sonnet 之问。两种泄露解读对较小模型的看法不一致;Melon 实际填补的层级不同,会改变这次发布对高容量工作负载的意义。
常见问题
Claude Marshmallow 发布了吗?
不。标识符 claude-marshmallow-eap 和 claude-melon-eap 已被发现,但没有任何官方公告,Anthropic 也未置评。在出现官方模型卡或目录条目之前,请将所有细节——包括“Opus 5.1”的解读——视为未经证实。
型号标识符中的“-eap”是什么意思?
它代表早期访问预览(early access preview),这也是Claude Opus 5发布前所使用的同一个后缀:Claude Honeycomb EAP构建于7月初出现在Cursor中,16天后Claude Opus 5发布。EAP标识意味着存在一个真实的暂存构建,这比单纯的传闻更有说服力——但并不能保证。
Anthropic 什么时候发布新的 Claude 模型?
日期尚未确认。泄露消息称发布“可能迫在眉睫”,Honeycomb 的先例表明,EAP 现身时间可能比 GA 早大约两周,但这一节奏只是单一数据点——未发布的 Numbat 代号则表明,标识符也可能数月无动静。要留意 Anthropic 的官方公告,而不是泄露帖。
Claude Opus 5.1 是真的吗?
未经证实。社区将 Claude Marshmallow 视为 Opus 级别的更新——即内部代号“Opus 5.1”——早期测试者的报告称其对话表现比 Claude Opus 5 更流畅。这些均未得到确认,最终发布名称也可能与代号不同,因此请将“Opus 5.1”视为一种假设,而非正式产品。
新模型会通过OrcaRouter提供吗?
如果 Claude Marshmallow 和 Claude Melon 作为已发布模型出现在供应商目录中,我们路由的其他所有模型也适用同样的规则:一个 API、供应商标价零加价直传、自动故障转移、无需第二份合同。在那之前,没有什么可调用的——这些模型还没有作为端点存在。
这是一篇泄露报道,所以诚实的总结是一个问题。两个早期访问标识符已经浮出水面,看起来分别是下一个 Opus 系列模型和下一个小型模型;它们恰好出现在 Anthropic 对 Claude Opus 5 的行为进行最公开反思之际。而上一次 EAP 标识符以这种方式出现时,几周内便迎来了真正的发布。在 Anthropic 正式表态之前,一切都未得到证实;值得关注的事情很具体:官方公告、正式名称、模型 ID,以及——如果新款 Haiku 真的会来——价格。如果你今天正在调用 Claude Opus 5 或 Claude Haiku 4.5,请继续使用,并保持绕过传闻路由的选项开放——这正是故障转移规则的用途。
本文中的对比2
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
