標題為「Claude Opus 5.5:一則外洩,附上標籤」的 Claude Opus 5.5 外洩主視覺卡片,內文寫著「據稱該檢查點名為 claude-wafer-eap — 尚未發布、未經證實、單一消息來源」,以及三張附標籤的卡片:聲稱 — 版本 5.5,最早可能於 9 月 22 日(週二)發布;已證實 — Opus 5.2 曾以 Opus 5 標籤提供,9 月 14 日至 17 日;未經證實 — 代號與爆料者帳號:沒有第二個消息來源
Guides & Insights

Claude Opus 5.5 外洩:一個名為「claude-wafer-eap」的檢查點與傳聞中的週二發布

作者

Alistair Wren

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

這個週末流傳的說法具體到足以查證,卻也單薄到禁不起查證:據稱下一版 Opus 更新的新檢查點——如今標示為Claude Opus 5.5——已經到手,內部代號為「claude-wafer-eap」,而且可能最早在 9 月 22 日星期二發布。消息來源是 X 帳號 @kimmonismus 轉述一位名叫 Lyra 的爆料者。沒有模型卡、沒有 API 識別碼、沒有價目表、沒有基準測試,也沒有第二家媒體報導相同的檢查點字串。在這個說法底下,確實有一件真實且紀錄詳盡的事:Claude Opus 5.2,這是尚未發布的 Opus 組建,在九月中旬之前以不變的「Opus 5」標籤提供給一部分流量,而廠商在 9 月 17 日夜晚短暫將其切斷。這一點獲得多家媒體的佐證。除此之外的一切都只是單一帳號的說法。還有第三件值得注意的事,也就是這則爆料對版本號本身造成的影響:Claude Opus 5於 7 月 24 日推出,每百萬個 token 要價 5.00/25.00 美元,至今仍是廠商一般可取得的最頂級 Opus;Claude Fable 5.1則在 9 月 1 日登場。如果下一款 Opus 真的是 5.5,那麼命名就跳過了 5.3 和 5.4——而在這個故事裡,這個數字發揮的作用比任何基準測試都大。

外洩的內容實際上聲稱了什麼

剝開包裝後,有四項斷言。第一,存在一個檢查點——一個已經訓練完成、已儲存,且正被安排在某一處的模型。第二,其版本號是 5.5,不是 5.2 或 5.3。第三,它帶有一個代號 "claude-wafer-eap",其中 "eap" 按廠商慣用縮寫解讀為 early-access program。第四,發布在即,可能在週二。

上述每一項都是不同類型的主張,而且它們並未獲得同等支持。第四項才是背後有外部證據的那一項,而那個證據指向的是一個日期,不是一個代號。關於下一次 Claude Opus 發布的預測市場在9月16日開盤,並將其隱含機率的大部分集中在9月21日至24日,同時仍有相當可觀的交易量佔比押注「9月30日前不會發布」。該市場的結算規則很嚴格:模型必須可公開取用,而且必須明確命名為 Opus。Fable、Mythos、Sonnet 和 Haiku 的發布不算數。「Claude Opus 5.5」出現在該市場自己的合格名稱清單上——這最有可能就是這個字串開始流傳的地方,而這份清單是一份可能性的清單,不是一則現蹤報告。

代號是最弱的一環。「claude-wafer-eap」出現在訊號文本中,而就我們所能確認,它沒有出現在其他任何地方:沒有儲存庫引用、沒有 API slug、沒有設定外洩、也沒有可佐證的帳號。代號正是那種因為聽起來可驗證而會散播的細節。在第二個獨立來源產出相同字串之前,請把這個代號視為未經證實。同樣的情況也適用於「Lyra」這個歸屬——一個我們無法查核其過往紀錄的爆料者化名。

什麼是實際上經過驗證的

經查證的基準是 Claude Opus 5,而它的文件記錄異常完整,這正是它適合作為衡量標準的原因。Anthropic 在 2026 年 7 月 24 日推出它——中間沒有 5.1 版本——具備 100 萬 token 的情境視窗、最高 128K 輸出 token(在 Batch API 上透過 beta 標頭可達 300K)、預設開啟自適應思考,以及從 low 到 max 的五個推理努力等級。價格在各種提示長度下都是固定的:每百萬輸入 token 5.00 美元、每百萬輸出 token 25.00 美元,與之前的 Opus 4.8 相同,而 Batch API 則是半價。Artificial Analysis 將其排在 Intelligence Index 首位,確切分數取決於你看的是哪個 effort 變體——這個細節值得記住,因為除非 effort 設定相符,否則「5.5」的計分板無法與「5」的計分板相比。

Artificial Analysis model page for Claude Opus 5 (Adaptive Reasoning, Max Effort), showing 7th of 200 on the Intelligence Index, released July 2026, $5.00 input and $25.00 output per million tokens with a 90% cache discount, and a 1M token context window

在此之上,還有一起已獲證實的九月事件。大約在九月十四日至十五日期間,開發者回報,一小部分名義上指向 Opus 5 的請求,實際上是由另一個後端模型回答,而請求中繼資料則指向一個尚未發布的claude-opus-5.2——這個版本號完全跳過了 5.1。回報的行為包括更簡潔的輸出,以及未經提示的自我迭代:撰寫程式碼、執行測試、修正錯誤,重複進行直到測試通過,而非半途停下。同時流傳的偵測手法——在停用搜尋與記憶的情況下,向模型詢問一個它理應不認識的人的特定問題——是判斷哪個後端在回答的方法。九月十七日當晚,Anthropic 無預警切斷了這個通道,開發者社群將這起事件稱為「午夜震盪」;該通道約一天後恢復,而根據這些回報,它的範圍從 Claude Code 擴大到聊天與協作介面。這一切自始至終都沒有伴隨任何模型卡、價格表、API 識別碼或官方聲明。

版本號說明一切

這就是那份洩漏在結構上說對的部分,即使每一個具體細節都是錯的。Anthropic 今年已經兩度證明,它會在沒有發表活動的情況下迭代 Opus 層級——5 月底的 4.8、7 月 24 日的 5(跳過 5.1),接著是一個存在於生產環境、卻未公開存在的 5.2。一家透過後端路由出貨並掌控推送比例的廠商,也能在最後一刻決定盒子上要印什麼數字。如果下一款 Opus 以 5.5 而非 5.2 的名義發表,那是技術工作完成之後所做的行銷決定,而這正是洩密者會晚一步、且不精確地聽到的決定。

對任何讀到這裡的人來說,這都是一體兩面。外洩的版本號是關於能力的薄弱證據,卻是關於定位的有力證據。如果這個數字真的是 5.5,那代表的是比 5.2 更大的躍進——也代表 Anthropic 希望在該公司據報導已把 IPO 時程推向 11 月之前,市場會這樣解讀。路透社 9 月 18 日引述三名消息人士報導,Anthropic 正在權衡是否專門推出一款新模型,以回應 GPT-6 Astra 在企業市場的動能,同時其執行長公開呼籲業界放慢腳步。在同一個檢查點上,更大的數字不花任何成本,卻能換來一個頭條。這不是不相信這項外洩消息的理由;而是不該把這個數字計入決策的理由。

到了星期二,必須有什麼情況成立?

九月二十二日的發布,大約五分鐘內就能查核;而現在值得先把查核項目一一講明,這樣一來,那則公告——如果真的出現——才能被細讀,而不只是被動吸收。

• 可用性——公開的模型卡、可回傳補完結果的 API 模型識別碼,或開放且持續受理的候補名單。封閉測試不符合資格,預測市場通常會結算為不符合。這正是區分「已推出」與「僅在部分帳號測試過」的界線。

• 定價 —— 新款 Opus 是維持 $5.00/$25.00 這個價位、調整它,還是以促銷價登場。Opus 5 完全沿用了 Opus 4.8 的價格,這正是可預期的模式,也因此是該查核的重點。

• 上下文與輸出上限——Opus 5 的 1M 上下文與 128K 輸出(Batch 上為 300K)是目前的下限。新一代 Opus 若推出時規格更低,那只是包裝成新品發表的降級。

• 獨立評分——這是一筆在指定投入程度下的 Artificial Analysis 條目,而非廠商圖表。外洩內容中的每一項能力聲稱目前均未獲重現,而單靠模型卡並不會改變這一點。

• 路由行為——灰度測試報告中所述的那種簡短、自我迭代的行為,是否仍存在於公開版本中,抑或那只是測試假象。那項行為變化是開發者實際觀察到最具體的事情,也是最有可能在發布前被悄悄調整掉的東西。

A two-column scoreboard for the Claude Opus 5.5 leak: left column 'Claude Opus 5.5 (reported)' lists status unreleased single source, codename claude-wafer-eap unconfirmed, version number reportedly 5.5, reported release as early as Tue Sep 22, no published pricing, and no independent benchmarks; right column 'Claude Opus 5 (verified)' lists generally available since Jul 24, codename n/a, version number 5, shipped Jul 24 2026, $5.00 / $25.00 per million, and top of the Artificial Analysis Index

試用未經實證的 Claude,而不把正式環境的路徑押在它身上

像這樣的一週裡,最尷尬的落差在於:大家都想評估的那個模型,正是沒有人能呼叫得到的那一個。今天你能呼叫的是 Claude Opus 5——而如果 5.5 真的出現,實際的問題就變成:該如何在不重寫既有整合的前提下,把一部分真實流量導向它,同時又不把關鍵路徑押在一個沒有獨立基準測試的模型上。

這正是路由存在的理由。OrcaRouter 將目前的 Claude 系列整合在單一 API 金鑰之後,以供應商定價提供,0% 加價——Claude Opus 5 採用 Anthropic 自家的 $5.00/$25.00,與廠商公布的數字完全相同,因此廠商調價當天我們這邊就會同步生效,而不必等到同步作業之後。當新的 Opus 真的推出時,它只是多一條路由,而不是多一份合約:你可以把一定比例的流量導向它,讓自動容錯移轉持續指向你已經充分掌握特性的模型,並用你自己的提示詞比較輸出,而不是依賴外洩的評測基準。跨多個模型組合一次呼叫——由一個模型起草、另一個模型負責驗證——只是路由 DSL 的一行程式碼,而不是一項新服務。

OrcaRouter model page for anthropic/claude-opus-5, showing Claude Opus 5 by Anthropic dated 2026-07-24 with a 1M token context window, 128K max output, input $5.00 and output $25.00 per million tokens, p50 time to first token 9.49 seconds, and 975.4M tokens of traffic in seven days

說清楚一點,我們並不是在說:OrcaRouter 上沒有 Claude Opus 5.5,因為根本沒有 Claude Opus 5.5 可供路由。在 Anthropic 推出之前,我們不會有;本文也不是產品頁面的預覽。這篇文章中關於 5.5 的一切,都只是報導的報導。

該注意什麼,以及該忽略什麼

留意模型識別碼。一個可用的 API slug 是正式發布與傳聞之間的差別,而這是外洩消息無法長久偽造的唯一產物。留意定價表,因為 Anthropic 正是在那裡告訴你,它認為這款模型屬於哪個層級。留意灰度測試路由是否在公告前恢復——重新擴大的通道是比一則推文強得多的訊號,而 9 月 17 日的切斷與恢復已經展示了那條通道從外部看起來是什麼樣子。

先暫時忽略那個代號。「claude-wafer-eap」是單一來源的字串,沒有其他佐證,它背後那個「Lyra」的歸屬也一樣。版本號只能當作定位的依據,除此之外別把它當成任何事的證據。還有,前 48 小時內出現的任何排行榜也一概忽略——那些拿公開的 Opus 5 去比一個沒人獨立跑過的 5.5 的榜,包括我們自己做的,如果我們真做了一個的話——除非比較的兩邊都拿得出真東西。

如果星期二過去了卻沒有發布,這並不因此證明那項外洩消息為假;九月 Opus 5.2 事件本身就是一個例子:模型早已在正式環境中運行數日,卻沒有人能叫出它的名字。在那之前,誠實的立場就是證據所支持的那一個:一週前,確實有一個尚未發布的 Opus 版本被悄悄地提供服務;本週的市場價格也已反映了一個真實的發布窗口;而有一個帳號為它附上了一個數字、一個代號和一個日期,但沒有其他人證實。

本文中的比較1

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新