
Claude 棉花糖與蜜瓜洩漏:Opus 5.1 是 Opus 5 批評者的答案嗎?
- DeepSeek新DeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百萬 tokens
- z-ai新Z.ai: GLM 5.32026-08-1860智能75程式
- obsidian新Qwen3.8 27B2026-08-1552智能68程式
- qwen新Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69程式
- grok新SpaceXAI: Grok 4.62026-08-1261智能77程式
- metaMeta: Muse Spark 1.22026-08-0557智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77程式
Claude Opus 5 上市正好滿一個月,Anthropic 自家團隊就已經承認該模型「確實很『尖刺』(spiky)」。這項承認正是 8 月 24 日那起洩漏消息的背景:claude-marshmallow-eap 與 claude-melon-eap 這兩個識別碼出現在第三方開發者應用程式及 Discord 中,社群將它們解讀為 Claude Opus 5.1,以及可能是新款 Claude Haiku。這些消息都尚未正式公布——沒有模型卡、沒有發布日期,Anthropic 也未作回應。這是一篇關於這起洩漏的「目前已知資訊」報導,而這起洩漏看起來像是供應商在回應批評者;除了既有紀錄之外,文中的所有內容均未經證實。
後綴就是關鍵線索。「-eap」是 Anthropic 的早期搶先預覽標記,而上一次類似的識別碼出現在公開場合時,真正的模型在幾週內就跟著出現。七月初,Claude Honeycomb EAP 出現在 Cursor 的模型選擇器中,並在數小時內被下架;十六天後 Claude Opus 5 正式上線。如果 Claude Marshmallow 和 Claude Melon 走在同樣的道路上,它們就不是空中樓閣——而是在正式發布前數拍就被發現的 Claude 家族下兩個成員。
到底洩漏了什麼
根據8月24日流傳的報告,原材料稀少,且大多只是名義上的:
• 兩個新的識別碼——claude-marshmallow-eap 和 claude-melon-eap——已在 Anthropic 的 API 介面和 Discord 中被發現。有一個帳號把第一個拼成「claude-mashmallow-eap」,這個一字之差的筆誤讀起來像是從某處轉錄的真實字串,而非憑空捏造的清單。
• 揭露這對模型的 @kimmonismus 認為它們「很可能是 Opus 的更新,甚至可能是新的 Haiku。」
• 第二份報告來自帳號 J A Z I I,將這些模型描述為「不是『fable』級別的模型,但還算可以,所以大多是 Opus 或 Sonnet 模型」——同意 Opus,但對於兩者中較小的模型,則提出 Sonnet 而非 Haiku 的解讀。
這次發布被形容為「可能即將發生」,但未附帶具體日期。
這幾乎就是全部的事實內容。Anthropic 的文件、新聞室和價格表都沒有提到這兩個名稱。Marshmallow 和 Melon 是工作代號——值得注意的是,它們打破了 Anthropic 內部版本通常遵循的動物命名規則(Fennec、Numbat)。改用食物名稱是否代表新的內部分支,目前只是推測。
上次有「-eap」識別碼外流時,隨後出現了一款真實模型。
在 X 上流傳的洩漏模型名稱沒什麼價值。以 "-eap" 結尾的識別碼則屬於另一種信號,因為它暗示確實存在一個真實的建置版本,且正在為釋出做準備。Honeycomb 事件是最接近針對 Anthropic 洩漏實際行為的對照研究:
• 2026年7月8日至9日 — Claude Honeycomb EAP 出現在 Cursor 的模型選擇器中,具有 100萬 token 的上下文視窗、一個“極高”努力模式,以及一段大致為“Anthropic 研究模型,具有每次回合控制與安全後備機制。早期存取預覽。”的描述。它在數小時內被下架。
• 7月24日 — 字串 claude-opus-5 出現在 Cursor 的錯誤對話框中,而 Claude Opus 5 也在同一天正式發布。
因此,從「在出貨產品中可見的 EAP 識別碼」到「GA 發布」,對 Opus 5 來說大約是兩週半。如果 claude-marshmallow-eap 和 claude-melon-eap 從同類型的預備階段浮現,那麼預期在八月底或九月初發布是合理的。但這種節奏只是一個數據點,並非定律——未發布的 Numbat 代號沉寂了數個月,提醒我們識別碼也可能浮現後便無疾而終。
訊號背後的訊號:Anthropic 正在回應它的批評者
讓這起洩漏不只是目錄曝光的,是社群早已向 Anthropic 反映的 Claude Opus 5 問題。@kimmonismus 直言不諱、並在時間軸上獲得廣大迴響的常見抱怨是:Opus 5「懶散、草率又囉嗦」——個性與投入程度會因設定而異,而非 Claude 使用者習慣的那個「一致且溫暖」的模型。Kim 以一句不言自明的事實總結:「Opus 5 不夠好,而他們心知肚明。」
Anthropic 這次的回應異常公開。Claude 團隊的 Thariq 在回覆中同意「Opus 5 真的是個很尖銳的模型」,也表示公司希望模型「一致、溫暖、並讓人覺得像 Claude」,並稱改進是最高優先事項。另一位 Anthropic 的發聲者 Boris 暗示,人們「忽略了用 Opus 來做 hill climb 最佳化」——Kim 認為這種說法避重就輕,而那種「你用錯了」的框架本身就是問題的一部分。
這起洩漏與那條討論串直接相關。同一週,關於新模型的報導聲稱它們「{{2}}表現相當出色,即使在 Medium reasoning 下也是如此,{{/2}}」並以「{{3}}(Opus 5.1?){{/3}}」作為可能的身分被提出——而評論者將時間點解讀為證據:「{{1}}Thariq 和 Boris 昨天重申,他們已將批評銘記在心。{{/1}}」如果 EAP 版本正是團隊在批評聲浪達到高峰時所打磨的內容,那麼「{{4}}即使在 Medium reasoning 下也表現出色{{/4}}」這個觀察正是標誌著修復的關鍵細節:一個即使你將推理強度從最大值調低,品質也不會急遽下滑的模型。這仍是洩漏說法,而非基準測試結果——但這確實是針對那項具體批評的合理回應。
棉花糖和甜瓜可能是什麼
要衡量這兩種解讀,不妨將目前的 Claude 系列與各等級上次變動的位置並列比對:
• Claude Fable 5 — 每 1M tokens 輸入 $10 / 輸出 $50,1M 上下文,128K 最大輸出。GA 2026年6月9日。旗艦產品,也是最昂貴的。
• Claude Opus 5 — 每100萬個Token $5 / $25,100萬上下文長度,128K最大輸出。2026年7月24日正式發布(GA)。預設開啟思考功能,提供多種思考強度等級。
• Claude Sonnet 5 — 每 1M 個 token 收費 $3 / $15(促銷價 $2 / $10 至 8 月 31 日止),1M 上下文。GA 日期為 2026 年 6 月 30 日。在程式碼與代理(agentic)工作上接近 Opus 品質,價格約為其 60%。
• Claude Haiku 4.5 — 每 1M tokens 收費 $1 / $5,200K 上下文。2025 年 10 月 15 日正式發布(GA)— 是該系列中歷史最悠久的模型,比其他模型早約十個月推出。

對照那個背景,「Opus 更新」解讀 Marshmallow 便不難採信。Anthropic 在 2026 年的 Opus 發布節奏異常迅速——Opus 4.6、4.7 和 4.8 在上半年相繼推出,而 Opus 5 僅在 Opus 4.8 之後八週就跟進。以同樣的 $5 / $25 價格推出的小版本更新,重點在修正行為方面的抱怨而非推升原始能力,完全符合既有模式,而 EAP 暫存建置正是此類更新會呈現的形式。
Melon 正是兩個消息來源分歧之處,也是更有趣的問題。單就推出時程而言,新款 Haiku 早已姍姍來遲:Claude Haiku 4.5 作為主力等級已有十個月,而它之上的所有等級都已迭代了兩次。一款定價 $1 / $5 的 Haiku 等級後繼產品——或是以首發降價切入——對高流量、分類、摘要,以及任何以 token 成本為硬性限制的應用來說,都意義重大。另一種解讀是 Sonnet 等級,那會是週期中段的更新,而非全新等級:是在現行 Claude Sonnet 5 之下的漸進一步,精神上更接近過去的 4.6。最誠實的說法是,這組配對最可能意味著「一款 Opus 家族模型與一款較小型模型」,而較小型模型的等級尚未證實。

為什麼現在發布——以及為什麼感覺倉促
時程報告強調一個詞:緊急。據描述,這次的推出時程比Anthropic慣常的節奏更快,大約在Fable 5發布兩個月後便問世——而這份倉促有其商業原因。Claude Fable 5上市頭兩個月處境艱難:它以隱藏式護欄出貨,悄悄降低了尖端主題的回應品質(此舉旨在遏止蒸餾),加上強制性30天資料保留政策使企業採用變得複雜,而據媒體報導,其企業採用率僅約佔Anthropic支出份額的11%,相比之下OpenAI的GPT-5.6 Sol約為23–25%。與此同時,根據同一份報導,開源模型的token份額在四個月內從約11%攀升至62%,對所有專有模型的定價都構成壓力。
{{1}}Claude Opus 5 是這套應對方案的第一步——比旗艦款便宜,且在經成本調整的編碼工作上與其不相上下(在 CursorBench 上,Opus 5 得分 70%,每項任務約 8.23 美元,而 Fable 5 得分 70.5%,每項約 17.32 美元)。{{/1}} {{2}}Marshmallow 和 Melon 看來是後續佈局:一個經過修正、更流暢的 Opus,維持相同價格,外加一個更便宜的小型模型,以防守開源模型正在進攻的高用量市場。{{/2}} {{3}}這是邏輯連貫的產品策略,但洩漏消息稱其「可能即將推出」,顯示這些模型是為了趕上競爭窗口而倉促推出,而非經過從容的開發週期——這對買家來說是一體兩面。{{/3}} {{4}}首週發布正是小版本更新可能表現不穩的時候。{{/4}}
等待時可以做什麼
無聊的答案先來:無論是 Claude Marshmallow 還是 Claude Melon,今天都不存在可呼叫的模型。沒有 API ID、沒有供應商目錄條目,也沒有任何可據以開發的東西——你現在可以付費取得的任何「搶先體驗」清單,都不是這份洩漏所描述的內容。你已經在呼叫的 claude-opus-5 和 claude-haiku-4-5 識別碼保持不變,而且在 Anthropic 宣布新的識別碼之前,請繼續呼叫你正在呼叫的內容。
{{1}}真正有用的工作,是讓這次發布在正式落地時能被低成本採用。{{/1}}新的 Claude 模型通常在發布公告後的數小時或數天內,就會出現在供應商目錄中,而這正是路由層的價值所在:在 OrcaRouter 上,一個 API 就能涵蓋 200+ 個模型,供應商的列表價格直接傳遞、零加成——所以當新的 Opus 或 Haiku 真的出現在目錄中時,你就能用同一把 API 金鑰和同一個端點,以廠商自己的價格呼叫它,當天上線,無需第二份合約,也無需重新議價。{{2}}一個剛推出第一週、尚未驗證的模型,正是自動容錯移轉的教科書案例:鎖定新模型,並以 Claude Opus 5 作為後備,或者讓它承接一部分影子流量;這樣一來,一次不成熟的發布就變成了一條路由規則,而不是一場事故。{{/2}}這種姿態如今不需要任何成本,而當公告正式落地時,它能把消息走漏變成領先優勢。

我們正在觀看的內容
• Anthropic是否宣佈這些模型。Honeycomb的先例表明,EAP的現身可能比GA早兩個半星期——或者這些識別碼可能靜置數月,就像尚未發佈的Numbat代號一樣。
• 正式發布名稱。Marshmallow 與 Melon 是工作代號;公布的版本名稱才是策略信號——Opus 5.1 對比 Opus 5.5 對比 Opus 6,傳達出 Anthropic 不同的發布節奏。
• API 模型 ID。真正的新版本會以新的 ID 發布;供應商目錄中出現的確切字串,是最具體的觀察重點。
• 定價。Marshmallow 是否維持 Claude Opus 5 的 $5 / $25,以及新的 Haiku 是否維持 $1 / $5 — Haiku 的價格是更明顯的跡象,因為它揭示了 Anthropic 是否打算堅守預算級別以抵禦開源。
• Haiku 與 Sonnet 之爭。兩份洩漏資訊對較小模型的看法分歧;Melon 實際填補的層級,將決定這次發布對高容量工作負載的意義。
常見問題
Claude Marshmallow 推出了嗎?
不。雖然有人發現了 claude-marshmallow-eap 和 claude-melon-eap 這兩個識別碼,但官方尚未發布任何消息,Anthropic 也未發表評論。在官方模型卡或目錄條目出現之前,所有細節——包括「Opus 5.1」的判讀——都應視為未經證實。
型號識別碼上的「-eap」是什麼意思?
它代表早期存取預覽(Early Access Preview),與 Claude Opus 5 推出前所用的後綴相同:Claude Honeycomb EAP 版本於 7 月初出現在 Cursor 中,而 Claude Opus 5 在十六天後發布。EAP 標識意味著確實存在一個真實的暫存(staging)版本,這比單純的傳聞更具說服力——但並非絕對保證。
Anthropic 何時會發布新的 Claude 模型?
尚未確認任何日期。爆料稱發布「可能迫在眉睫」,而 Honeycomb 的先例顯示,EAP 出現的時間可能比 GA 提早約兩週,但這種節奏只是單一數據點——未發布的 Numbat 代號表明,識別碼也可能閒置數月。請留意 Anthropic 的官方公告,而不是爆料討論串。
Claude Opus 5.1 是真的嗎?
未經證實。社群將 Claude Marshmallow 解讀為 Opus 級別的更新——內部工作標籤為「Opus 5.1」——早期測試者的報告聲稱其對話表現比 Claude Opus 5 更流暢。這些說法均未獲確認,且正式出貨名稱可能與代號不同,因此請將「Opus 5.1」視為一種假設,而非產品。
新的模型會透過 OrcaRouter 提供嗎?
當且僅當 Claude Marshmallow 和 Claude Melon 以正式供應型號出現在供應商目錄中時,與我們路由的其他所有模型相同的規則即適用:單一 API、供應商列表價格零加價原價轉傳、自動故障轉移,且無需第二份合約。在此之前,沒有什麼可以呼叫的——這些模型尚未以端點形式存在。
這是一篇爆料文章,所以誠實的總結就是一個問號。兩個早期存取識別碼浮出檯面,看起來分別是下一個 Opus 系列模型和下一個小型模型;它們正好出現在 Anthropic 最公開地面對 Claude Opus 5 行為爭議的時刻,而上一次 EAP 識別碼以這種方式出現時,幾週內就有正式發布隨之而來。除非 Anthropic 出面證實,否則一切都未經確認。值得關注的具體事項包括:官方公告、正式名稱、模型 ID,以及——如果新的 Haiku 真的會推出——價格。如果你今天正在呼叫 Claude Opus 5 或 Claude Haiku 4.5,請繼續呼叫,同時保持因應謠言調整路由的彈性,這正是故障轉移規則的用途。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
