主視覺標題卡,用於一篇以「Claude Next」為標題的外洩追蹤報導,附有「外洩通報 — 未經查證」徽章,副標為「一則 X 貼文指出,一款尚未發布的 Anthropic 模型已在 Claude Code 內運行」,三個標籤分別寫著「無模型識別碼」、「無費率表」與「無文件列」,頁尾則寫著「該說法於 2026 年 10 月 11 日發布於 X」。
Guides & Insights

Claude Next 外洩:據報導,Anthropic 尚未發布的模型正在 Claude Code 中運行

作者

Elias Hawthorne

發佈日期

最新模型 · 20查看全部模型 →
基準測試:Artificial Analysis · 每日更新
返回全部文章

2026年10月11日,一個在 X 上以 @chetaslua 名義發文的帳號聲稱,一個名為Claude Next的模型正在 Claude Code 內部測試,並且它讓Claude Opus 5.5「看起來很原始。」同一則貼文表示,它將「在一個月內讓圖像和影片生成模型過時」,聲稱該模型是「SOTA」,並承諾之後會進行更多測試。這就是截至本文撰寫時的全部公開記錄。沒有模型 ID、沒有費率卡、沒有文件列、沒有模型卡、沒有競技場列表,也沒有 Anthropic 的聲明。Anthropic 在這則貼文發布當天已發布的產品陣容仍然正好是四個模型——Claude Fable 5.1、Claude Opus 5.5、Claude Sonnet 5.5和Claude Haiku 5.5——而Claude Next不在其中。

所以,這不是一篇發布報導,而是一篇關於某項說法的「目前已知」文章;這個說法異常容易拆成幾個部分,因為其中一部分是 Anthropic 確實會做的事,另一部分則與 Anthropic 自家文件所稱其模型能做的事相牴觸,而這個名稱本身也不符合該廠商的命名語法。這三項觀察今天就能在你自己的機器上查證,不必等正式發布。

這則貼文實際主張了什麼——以及它沒有主張什麼

撇開熱情不談,這則貼文主張了四件截然不同的事,而它們的證據份量相差極大:

• 有一個名為 Claude Next 的模型存在。未經證實。Anthropic 的公開資訊中,沒有任何地方出現過這個字串。

• 目前正在 Claude Code 內部進行測試。 尚未經過驗證,但結構上合理——請參閱下一節。

• 它大幅勝過 Claude Opus 5.5,讓後者顯得原始落後。 未經證實,而且目前無法否證,因為沒有附上任何數字、任務、評測框架或輸出。

• 這對圖像與影片生成模型構成威脅。未經證實,且與 Anthropic 迄今推出的每一款 Claude 模型皆相互矛盾。

請注意哪些事情沒有被宣稱。貼文並未表示該模型已發布,未給出日期,未提及版本號,也未提供模型識別碼。作者明確表示還會有更多測試。若按字面解讀,這是一篇關於早期取用的報導,而非關於發布的報導——而這正是爆料文章應該處理、發布文章不該處理的那種主張。

消息來源只是一個 X 帳號,沒有第二位測試者的貼文可佐證,沒有模型選擇器的截圖,也沒有任何可供查證的產物。Anthropic 尚未置評。請將上述每一個效能字眼都視為報導內容,絕非實測。

A single-column status board headed 'Claude Next — what is established', listing six rows: 'Model ID: none published', 'Rate card: none published', 'Docs row: not in the models table', 'Arena listing: none', 'Vendor statement: none', 'Under test with selected users: plausible, per Claude Mythos Preview precedent', with a footer reading 'All Claude Next rows unverified; comparison against the four shipped Claude models.'

該主張中不荒謬的部分

Anthropic 確實會與特定使用者一起運行尚未發布的前沿模型。這是有文件記載的,並非傳聞,而這也讓「某個新模型正在某處測試」這種說法,遠比它聽起來的要薄弱得多。

最清楚的先例是Claude Mythos Preview,Anthropic 自家的 Project Glasswing 頁面將其描述為「一個通用型、尚未發布的前沿模型」,並由為數有限的合作夥伴進行測試。同一頁面也明白寫著:「我們不打算讓 Claude Mythos Preview 全面開放使用。」一個模型可以同時是真實存在的、能力出眾的、被少數幾個人積極使用的,卻永遠不以那個名稱正式推出——這些全都成立。

還有第二個、更晚近的先例。Anthropic 於 2026 年 10 月 6 日宣布擴大其 Cyber Verification Program,其中描述的使用權限層級涵蓋「Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1,以及未來推出的新模型」。最後那一句是供應商的承諾,表明未來的模型——包括目前尚未公開發表的模型——將被納入有限取用的計畫,而非一次開放給所有人。

而該說法中提到的具體場域,Claude Code,最可能是內部別名外洩的地方。Claude Code 的模型選擇並不是寫死在二進位檔裡的固定清單。它會讀取別名、環境變數,以及閘道本身的模型清單——這讓一個名稱在正式公告之前,有很多可能曝光的表面。

為什麼名字本身是最薄弱的部分

Anthropic 的模型名稱來自一組規模不大、封閉且富於意象的詞彙:Mythos、Fable、Opus、Sonnet、Haiku。版本號則遵循一套有明文記載的命名規則:claude-{name}-{major}[-{minor}]——claude-opus-5-5、claude-sonnet-5-5、claude-fable-5-1。「Next」不符合該模式的任何一半。它既不是命名詞集中的詞,也不帶任何版本區段,因此沒有可供其遞增的基準。

在任何人開始興奮之前,也有一個平淡無奇的解釋值得記住。Claude Code 在 npm 上以兩個 dist-tags 發布,stable 與 next;next 是預發行通道。任何查看 Claude Code 自身工具中繼資料的人,都會看到「next」這個詞被附加在 Anthropic 正在測試、準備晉升至 stable 的某個東西上——而在那裡接受測試的對象是 用戶端,而不是模型。這並不代表該說法為假。這確實意味著「next」是一個早已存在於這個生態系中的詞,而這正是那種會被拿來當作產品名稱並反覆使用的詞。

內部開發代號則是另一回事——Claude Marshmallow與Claude Melon於 2026 年 8 月以 EAP 識別名稱的形式浮現,顯然是內部名稱,而非正式發表的名稱。若「Claude Next」真有什麼名堂,它更可能是那類佔位名稱,而不是一項產品。但誠實的立場是,目前 Anthropic 以外的任何人都無法分辨那究竟是佔位名稱、誤讀,還是憑空捏造,因為唯一的證據就只有一句熱情洋溢的話。

「讓圖像與影片生成變得過時」碰壁之處

這是這篇貼文中最可能誤導讀者的部分,值得直接回答。

Anthropic 目前推出的每一款 Claude 模型——Claude Fable 5.1、Claude Opus 5.5、Claude Sonnet 5.5、Claude Haiku 5.5——都會將文字和圖像作為 輸入,並將文字產生為 輸出。產品陣容中沒有圖像生成功能。產品陣容中沒有影片生成功能。Claude Opus 5.5 支援視覺、工具使用、JSON 輸出、推理,以及 1M token 的上下文視窗,輸出最多可達 128K token;它將圖表算繪為像素,僅在於它能撰寫繪製圖表的程式碼這個意義上。

那使得該主張以一種值得指明的方式變得模稜兩可:

• 如果這則貼文的意思是 Claude 模型現在原生生成圖像和影片,那對 Anthropic 來說會是全新的能力類別,而且會是遠比「更好的程式編寫模型」大得多的宣稱,幾乎肯定會以獨立公告、搭配專屬定價的形式推出,而不是在 Claude Code 討論串裡悄悄流傳。

• 如果這意味著模型能寫出足以產生優良圖像和影片、進而減少對專用生成器需求的程式碼,那這就是一項關於編排品質的宣稱——一件真實且可衡量的事,而且已有數款已推出的模型在此一較高下。這不是同一項宣稱,也不是「過時」所暗示的內容。

這篇文章並未區分這兩者。在它這麼做之前,誠實的解讀是:一個沒有人做過基準測試的模型,其被報導的質性印象,正被用來做出類別層級的預測。

今天下午如何自行檢查

這是有用的部分。這個主張所依賴的一切都可以在你自己的機器上測試,而且沒有一項需要你去相信任何人。

1. 查看模型選擇器。 在 Claude Code 中,執行 /model,不要加任何參數。這會開啟選擇器,並反映你的帳戶實際上能觸及哪些模型。如果某個模型確實正在你有權存取的通道上提供給測試人員,就會出現在這裡。在不同日子各執行一次——選擇器會以非同步方式更新。

2. 試著以名稱稱呼它。Claude Code 會從四個地方接受模型字串,並依下列優先順序採用:/model(工作階段進行中)、--model 旗標(啟動時)、ANTHROPIC_MODEL 環境變數,以及model 欄位(位於設定檔中)。將 ANTHROPIC_MODEL 設為你的供應商並未提供的字串,會在第一個請求時產生錯誤——而重要的細節是:當字串來自旗標、環境變數或設定檔時,Claude Code 並不會事先驗證它。它會照樣送出,讓請求失敗。這正是洩漏的名稱在名稱真實、存取權卻不屬於你時會有的表現:它看起來會像是打錯字,而不是權限遭到拒絕。

3. 在選擇器中新增自訂項目。 ANTHROPIC_CUSTOM_MODEL_OPTION 會在不干擾內建別名的情況下,將一個額外模型插入選擇器中,並可選擇使用 ANTHROPIC_CUSTOM_MODEL_OPTION_NAME 和 ANTHROPIC_CUSTOM_MODEL_OPTION_DESCRIPTION 作為標籤。Anthropic 的文件明確指出,Claude Code 會跳過對該 ID 的驗證。如果你的帳戶被賦予了一個名稱,但你並未取得對應的清單,這就是你讓用戶端指向它的方式。

4. 向端點詢問有哪些項目存在。這是決定性的檢查,因為模型清單是伺服器端的事實。Anthropic 的 Models API 會回傳你的金鑰可用的每個模型,以及 max_input_tokens、max_tokens、一個 capabilities 物件,和一個 line 欄位,用來命名該模型所屬的系列。如果某個模型可由你呼叫,它就會出現在該回應中。如果它不在該回應中,也不在文件的比較表裡,那麼任何應用程式碼都無法觸及它——無論某篇文章對它的品質怎麼說。

5. 留意真實的 Anthropic 模型一定會伴隨出現的兩項產物。每個已發布的 Claude 模型,在模型總覽表中都有一列,並在加入該模型的版本所對應的 Claude Code 更新日誌中有一筆記錄——Claude Opus 5.5 是在 2.1.280 版加入,Claude Haiku 5.5 則是在 2.1.293 版,兩者都在更新日誌的那一行中載明了模型 ID 與價格。這就是兩個該留意的所在。目前這兩處都沒有任何名為「Claude Next」的內容。

什麼會讓這件事從謠言變成事實?

Screenshot of Anthropic's Claude models overview documentation, showing the compare-models table with four columns — Claude Fable 5.1 at $10/$50 per million tokens, Claude Opus 5.5 at $4/$20, Claude Sonnet 5.5 at $2/$10 and Claude Haiku 5.5 from $0.10/$0.50 — each with its Claude API ID, a 1M-token context window, 128K max output, and an adaptive-thinking row, with no additional model column.

五件文物就能定案,而它們出現的順序相當可預測:

• 一個模型 ID。某個 claude-{name}-{major} 形式的東西,或是在 Anthropic API 上可解析的變體。沒有它就沒有東西可以呼叫。

• 模型總覽表格中的一列。 Anthropic 自家的比較表格目前有四欄。第五欄則是廠商親自確認其存在。

• 一份價目表。每百萬個 token 的價格、快取讀取費率、任何長上下文的分級定價。Anthropic 的價格是與模型一同公布的,而不是在模型之後才公布。

• 模型卡或系統卡。這是界定能力主張的地方——包括是否真的有圖像或影片輸出。

• Claude Code 裡的一行變更日誌。用戶端在新增模型的那筆條目中說明了 ID 與價格,這使得它成為任何可從程式設計工作階段觸及之物最可靠的早期確認管道。

在這些之外,若能有一筆 LMArena 或 Artificial Analysis 的紀錄,會是很有用的獨立訊號——而且更重要的是,那會是與固定測試框架的比較,而不是測試者的主觀印象。請注意,在撰寫本文時,這兩個競技場都還沒有以這個名稱列出的 Anthropic 項目——文字排行榜上的 23 筆 Anthropic 項目最高只到claude-opus-5.5-high,排名第 2,且其中沒有任何一筆被標示為初步結果。

在此期間該怎麼辦?

沒什麼,如果目標是本週就要推出東西的話。對於一個未經基準測試的模型,正確的姿態就是你對待任何其他未經驗證的依賴項時會採取的姿態:不要把它放在關鍵路徑上,也不要根據一句話來建立路線圖。

如果這樣的模型真的出現,實際問題會迅速改變樣貌,而它們正是每一次新的 Claude 發布都會引發的那三個相同問題:每百萬詞元的成本是多少、它在哪些方面不如它所取代的模型,以及當供應商服務降級時,你的請求會發生什麼事。Claude Opus 5.5 是目前的基本基準,每百萬輸入詞元 4 美元、每百萬輸出詞元 20 美元,快取讀取為每百萬 0.20 美元;Claude Fable 5.1 位於其上,為要求嚴苛的推理與長時程代理式工作提供 10/50 美元的價位,快取讀取為輸入價格的 2.5%。無論是哪一個的後繼者,都會以這些數字來評估,而不是憑感覺。

另一件在早期、在任何基準測試出現之前就很重要的事,就是不要把你的一條正式環境路徑押在一個沒人量測過的模型上。把新模型放在路由器後面跑,讓你得以把一部分真實流量導給它,並讓自動容錯移轉在它出錯、卡住或被限流時退回 Claude Opus 5.5 或 Claude Fable 5.1——這樣這個實驗只會耗掉你一小部分的請求,而不是全部。在 OrcaRouter 上,那就是一個位於 200 多個模型之前的 OpenAI 相容端點,不需要第二份合約,容錯移轉路徑上也不需要改任何程式碼,而且供應商的定價表原樣透傳,所以廠商降價在我們這邊當天就生效。我們不提供 Claude Next——沒有人提供,因為就任何公開資訊來看,它並不是一個已推出的模型。Claude Opus 5.5 以及目前 Claude 系列的其他型號今天都能呼叫,並依定價表計價。

img src="4.png" alt="OrcaRouter 模型頁面(anthropic/claude-opus-5.5)的螢幕截圖,標題為「Claude Opus 5.5」,位於 Home > Models > Anthropic 的麵包屑導覽下方,識別碼為 anthropic/claude-opus-5.5,「by Anthropic — 2026-09-22」,支援文字、圖片與檔案輸入並具備視覺、工具、JSON 與推理功能,最大輸出 128K,上下文視窗達 100 萬個 token,每百萬 token 輸入 $4.00、輸出 $20.00,首個 token 的 p50 時間為 3.88 秒,流量為 126.3M 個 token,並附有兩個 SDK 使用相同基礎 URL 的並列程式碼範例。" />

Screenshot of the OrcaRouter model page for anthropic/claude-opus-5.5, headed 'Claude Opus 5.5' under a Home > Models > Anthropic breadcrumb, with the identifier anthropic/claude-opus-5.5, 'by Anthropic — 2026-09-22', text, image and file input with vision, tools, JSON and reasoning, 128K max output, a 1M-token context window, $4.00 input and $20.00 output per million tokens, a p50 time to first token of 3.88 seconds, 126.3M tokens of traffic, and side-by-side code samples for the OpenAI SDK and the Anthropic SDK against the same base URL.

未解決的問題

最可能的結果,依序是:這則貼文描述的是一個內部或僅限 EAP 的組建,永遠不會以那個名稱發布,如此一來,沒有任何讀者能驗證它,整件事也就煙消雲散;或者某個 Anthropic 模型以正式名稱與 ID 登場,並附上慣常的配套產物,屆時這項說法就會變成一個註腳,講的是某次方向對了、名字卻錯了的洩密。

無論如何,測試都一樣,而且用你自己的金鑰大概十分鐘就能完成:打開選擇器、查詢 Models API,然後看看供應商自己的表格裡是否出現了第五欄。直到這三者之一有所改變之前,「Claude Next」都只是某篇貼文裡的名字——而 Anthropic 實際推出的四款模型,才是值得你投入工程時間的對象。

本文中的比較2

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新