
Claude 5.5:一個兩字標籤、一則引用推文,以及藏在其下 Sonnet 5.5 的防護機制
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 348 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 105 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 987 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- xAISpaceXAI: Grok 4.62026-08-1244智能77程式
2026 年 9 月 30 日 03:33 UTC,一個名為 @teortaxesTex 的帳號發布了兩個詞和兩張圖片:「Claude 5.5:」。沒有Claude 5.5 的模型卡,claude-5-5 這個識別碼也不在 Anthropic 的價目表上,API 模型總覽裡沒有它的條目,OrcaRouter 的目錄中也沒有它的那一列。標籤底下所承載的是真實存在的東西,而且那不是一個新模型:第二張附圖是一張 Claude 介面的截圖,產品本身在裡面寫著「Sonnet 5.5 的防護機制已標記此訊息」以及「已切換至 Sonnet 5」——這正是Claude Sonnet 5.5自 2026 年 9 月 28 日起全面可用後的實際行為:把請求退回至Claude Sonnet 5。第一張圖則是一張關於 DeepSeek 核心的硬體使用率圖,與任何 Claude 的發布完全無關。
這就是訊號的全部,而值得精確辨明的是:其中哪一半是宣稱,哪一半是截圖。一個兩字標籤並不能作為某個模型的證據。防護機制彈出視窗的截圖是防護機制存在的證據,而該防護機制早已推出。
實際上發布了什麼
這則貼文是一則引用推文,而它引用的文字比它附加的文字更重要。@teortaxesTex 寫了兩個字。它引用的貼文出自 @xlr8harder,日期為 2026 年 9 月 22 日,全文如下:
是啊,所以一個快速測試顯示,Anthropic 正用他們的分類器針對中國硬體。有更多時間的人應該對分類器做一些探測,但看來 Dario 與中國的恩怨對決仍在繼續。
引用的貼文中並未出現 Claude 5.5。其中完全沒有出現任何模型名稱。這個兩字標籤是引用者自行添加的,被附加在一則關於分類器與中國的論點上,而該論點在發文時早已存在六天之久。被引用的貼文是來自個人帳號的說法,依據的是作者並未描述的測試;引用該貼文的貼文則加上了標籤與兩張圖片。
第二張圖片才是承載資訊的那一張
Claude 介面截圖由上至下依序為:一則使用者訊息寫著「笑死,去你的,Dario」;一段關於 DeepSeek Ascend 核心的冗長助理回覆;一個橫幅寫著「已切換至 Sonnet 5 — 請用 Sonnet 5 編輯並重試」;一層覆蓋視窗寫著「Sonnet 5.5 的安全機制標記了這則訊息。這種情況有時會發生在安全、正常的對話中。」並附有「傳送意見回饋或進一步瞭解」連結,以及一行細節寫著「詳細資料:[frontier_lim]」;一則使用者回覆寫著「我的重點是這個彈出視窗。你已經被降級成更笨的模型,因為 Anthropic 怕死了有人會用你來為中國生態系開發出任何有用的東西。誇張到連一般討論都開始被這些篩選器擋。」;以及一行頁尾標明所用模型為「Sonnet 5 Medium」。
仔細讀那段,因為其中沒有任何一處寫著 Claude 5.5。橫幅寫的是 Sonnet 5。彈出視窗寫的是 Sonnet 5.5。頁尾寫的是 Sonnet 5 Medium。推文裡的標籤是這兩張圖片中唯一出現「Claude 5.5」這個字串的地方。
這個彈出視窗所描述的行為,Anthropic 已經記錄為已推出,而我們在 Sonnet 5.5 推出時就把它寫了下來。從那次推出以及 Anthropic 自家的資料中,有三點是有紀錄的:
• 分類器層——Claude Sonnet 5.5 是首款內建安全分類器的 Sonnet 等級模型,旨在防止推理擷取,這項能力先前屬於 Opus 層級。
• 網路安全回退機制——Sonnet 5.5 也是首個具備網路安全防護措施的 Sonnet,會將風險較高的請求退回給 Claude Sonnet 5,而不是直接回答,而這正是這張截圖中「Switched to Sonnet 5」橫幅所顯示的情況。
• 頁腳——標示運行中模型「Sonnet 5」的介面,與我們已發布的防護措施截圖中出現的頁腳相同,因此這張圖片讀起來像是九月底行為的重新流傳,而非任何新事物的首次出現。
所以,對第二張圖的誠實解讀並不是「Claude 5.5 存在」。而是「Claude Sonnet 5.5 的防護機制觸發了,產品會告知你這件事,並把你重新導向 Claude Sonnet 5」。那是 2026 年 9 月 28 日已出貨的產品行為——而這正是發文者真正憤怒的點。
第一張圖片屬於另一個論點
其他附件是一張深色背景的效率圖:密集的測量點散佈圖、一個標示「硬體極限」的圖例,以及一條帶有紅色註釋標記的醒目軌跡。它是螢幕截圖中助理文字背後的產物,該文字詳細討論了 DeepSeek 的 Ascend 工作。助理以其模稜兩可的措辭轉述的主張是:
• 一項效能數據 —「GEMM 達到硬體極限的 99.8%,而 DeepGEMM-Ascend 的 MegaMoE 達到 98%」,歸因於一則推文,助理表示該推文來自「Zhean Xu,根據其陳述推測可能是 DeepSeek 研究員,但我尚未證實」。
• 一種儲存庫慣例 —— DeepGEMM 與 DeepGEMM-Ascend 作為兩個不同的儲存庫,DeepEP 與 DeepEP-Ascend 作為兩個不同的儲存庫,各自擁有自己的 stars、forks 與 issue 數量,而助理會將其解讀為平行對應的元件,而非單一雙後端儲存庫。
• 規模對比——DeepGEMM-Ascend「近期建立(63 顆星 | 複刻,0 個問題)」對比 DeepGEMM 的 7.9k 顆星,外加提及一個「DeepJIT」,其被描述為用於「XPU 核心」的 JIT 編譯器。
這張截圖本身的框架才是正確的,而且值得照樣重述,而非加以改良:該數字是在社群媒體上自行回報的,既沒有基準測試方法論、沒有硬體配置,也沒有比較基準,而回報者的身分則是助理明確拒絕查證的一項推論。這些全都不是 Claude 的說法,也全都不是 "Claude 5.5" 這個字串應該存在的理由。
為什麼這個標籤作為模型名稱站不住腳
這一代的每一次 Claude 發布,都在數小時內留下書面紀錄:一個 API 識別碼、一列價格、一個上下文視窗、其前代的棄用日期,以及模型總覽中的一列。若一個名稱缺少上述任何一項,它就不是正在測試的模型,而只是有人隨手輸入的名字。這些檢查成本很低,而且全都查無結果:
• API 識別碼 —— claude-5-5並不是有效的模型字串,而任何低於 Sonnet 層級、我們能解析的 5.5 世代識別碼也都不是。
• 目錄 — OrcaRouter 公開 API 對每一種 Claude 5.5 slug 拼法都回傳 not-found。實際能解析的 Anthropic 資料列是 anthropic/claude-sonnet-5 和 anthropic/claude-opus-5.5。
• 標籤本身——一個赤裸的等級數字,與前一世代之間沒有任何系列名稱(「5.5」未附帶 Sonnet、Opus 或 Haiku)——並不是 Anthropic 命名任何事物的方式。每一款已出貨的 Claude 都會在其產品字串與識別碼中帶有其所屬系列。
• 另一種解讀——如果「Claude 5.5」是 Claude Sonnet 5.5 的簡稱,那麼這裡根本沒有任何外洩,只是一個在 9 月 28 日推出的模型之兩字縮寫,而該模型的重點正是發文者所抱怨的那項防護措施。
第二種解讀才是證據所支持的那一種。截圖在三處不同地方提到 Sonnet 5 和 Sonnet 5.5,彈出視窗描述的是我們早已記錄為已上線的機制,而發文者真正的論點——在他們自己後續那則輸入介面的訊息裡——說的是被過濾器降級,不是新模型到來。
標籤下方的分類器引數
把標籤撕掉,這一組裡確實有個真正的問題,而這個問題值得與包裹著它的模型名稱分開來陳述。被引用的貼文聲稱 Anthropic 的分類器「針對中國硬體」。截圖顯示分類器觸發,以及一個請求被重新路由。這兩件事被呈現為因果關係,但它們並不是同一類主張:
• 這張螢幕截圖顯示的是——某項安全防護機制在一段關於 DeepSeek 的 Ascend 核心的對話中觸發,而產品將該請求回退至 Claude Sonnet 5。這是 Sonnet 5.5 獲允許且有文件記載的行為,而且任何擁有帳號的人都能重現。
• 這張截圖沒有顯示的是——該防護機制是否因為國籍、硬體目標,或特別是因為中文內容而觸發。彈出視窗的文字本身反倒說明了相反的情況:「這種情況有時會發生在安全、正常的對話中。」誤判率不是針對性政策,而單一被標記的對話也不是一份調查。
• 什麼能讓這件事塵埃落定——也就是被引用的貼文本身所要求的那件事:「某個有多一點時間的人應該做一些分類器探測。」這個討論串裡沒有人做過那件事。證據只有一張彈出視窗的截圖,以及一項關於 DeepSeek 核心的量化主張,而這兩者都沒有量測分類器。
你今天實際可以撥打的電話
如果真正有用的問題是:這串討論裡的哪些模型是你現在就能路由的,那麼答案會比標籤所暗示的更狹窄,而且並不包含 Claude 5.5。Claude Sonnet 5.5 不在 OrcaRouter 的型錄中:公開的模型 API 對 anthropic/claude-sonnet-5.5 會回傳找不到,因此截圖中的備援目標並非我們所提供的服務,而本文中的任何內容都不應被解讀為我們願意執行它。
可路由的,以 Anthropic 自家的標價轉嫁,正是這張截圖實際記錄其行為的兩個模型:
• Claude Sonnet 5 — 自 2026 年 6 月 30 日起收錄於目錄中,每百萬輸入 token 為 2 美元、每百萬輸出 token 為 10 美元,並具備 100 萬 token 的上下文視窗。這是防護機制所回退採用的模型,也是螢幕截圖中橫幅所標示的模型。
• Claude Opus 5.5 — 自 2026 年 9 月 22 日起列於目錄中,每百萬輸入 token 收費 4 美元、每百萬輸出 token 收費 20 美元,同樣具備 100 萬 token 的上下文視窗。Sonnet 5.5 推出時所承襲的,正是這個層級的防護機制行為。
兩者都位於同一個 OpenAI 相容端點與同一個路由層之後,而這正是為何一套防護機制敘事值得關注的實際理由:當供應商重新路由一筆請求時,你拿回來的可能是與你要求的不同模型,而一個會回報是哪個模型作答的路由器,正是讓你不必去讀截圖頁尾就能得知答案的方法。


實際上確立了什麼,以及什麼尚未確立
這個訊號所確立的事情並不多,而讓它維持在少數是值得的,因為推文頂端的標籤會誘使人做出遠大於其下方證據所能支持的解讀。
• 已確認 —— 一個個人帳號於 2026 年 9 月 30 日發布了「Claude 5.5」這兩個詞的字串,並引述了 9 月 22 日一則關於 Anthropic 分類器的貼文。
• 已確認 — 附加的介面截圖顯示 Sonnet 5.5 的防護機制標記了一則訊息,且產品切換至 Sonnet 5,執行中的模型顯示為 Sonnet 5 Medium。
• 已確立——所附圖表與助理文字所述,是一項自我呈報的 DeepSeek Ascend kernel 數字,其作者身分助理本身無法核實。
• 未經證實——名為 Claude 5.5 的模型存在、正在測試中、是個代號,或已發布並更名。沒有識別碼,沒有價格,沒有上下文視窗,沒有廠商聲明,沒有第二個觀察者。
• 尚未確立——任何分類器以中國硬體為目標這一點。該說法源自引述貼文中一項未加說明的測試,而截圖並未對其進行測試。

改看什麼
這裡值得注意的不是某個模型名稱。而是有沒有人真的去做那則被引用貼文所要求的探查。一項分類器宣稱,要誠實檢驗起來異常容易,要糟糕地檢驗也異常容易:誠實的版本是一組固定提示詞,反覆執行,涵蓋與中國毫不相關的主題,並且報告偽陽性率,而不是一張截圖。糟糕的版本就是這個討論串裡的內容——一段被標記的對話、一則憤怒訊息,還有一個兩個字的標題,貼在兩者之上。
如果 Claude 5.5 真的出現,它會像其他每個 Claude 一樣自我宣告:一個能解析的識別碼、一列價格、一個上下文視窗,以及一個標有日期的模型頁面。在這些東西有任何一項存在之前,這個字串只是引用推文上的一個標籤,而讀者能在它底下驗證的唯一一件事,就是 Sonnet 5.5 的防護機制正在做 Anthropic 兩天前推出它時所說它會做的事。
結論是:這張截圖是真的,當中的模型是 Claude Sonnet 5.5,於 2026 年 9 月 28 日發布,並會回退到 Claude Sonnet 5;這篇文章標題所根據的「Claude 5.5」並不是任何人已發布的模型。請把這項安全防護行為視為已推出且可測試,把針對中國的宣稱視為未經實測的假設,並把這個名稱視為一個原作者已無法掌控的縮寫。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
