
Union Alpha:我們對這個擁有 256K 視窗的未經證實匿蹤模型所知的一切
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openai新OpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0345智能76程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451智能78程式
Union Alpha自稱是前沿模型。卻沒有人認領它。這個名稱於今天,2026年9月16日 14:42 UTC,以匿名 stealth 上架資訊的形式出現——262,144 詞元的上下文視窗、圖像輸入、工具呼叫,價格正好是零——供應商欄位只寫著「Stealth」,沒有實驗室、沒有模型卡,也沒有附上任何權重。如果過去一年的模式成立,那份沉默會在一週內得到解答:Ox Alpha在8月20日跑了同一套劇本,並在六天後被揭露為 Zhipu 的GLM-5.3-Flash。這是一篇「目前我們所知」的報導。以下所有專屬於 Union Alpha 的具體資訊,都來自該上架資訊自身的元資料,由一名拒絕具名的營運方發布——同一份元資料描述了「在廣泛的通用任務上達到前沿水準的效能」,這是營運方對自身所作的宣稱,而該上架資訊之外沒有任何東西能重現這一點。
所以,老實說版本很短:現在有個看起來很能打的模型可以免費呼叫,但它不屬於任何願意出面承認的人,而唯一公布出來的數字,還是它自家營運者寫的。這並非毫無意義——匿名預覽後來變成真正、便宜、開放權重模型的紀錄很強——但這只是一條線索,不是結果。
這份刊登資訊究竟說了什麼,以及它審慎地避而不談什麼
對一個隱匿項目而言,這份中繼資料異常具體,讓其中的缺漏更容易判讀。以下是它的全貌:
• 上下文視窗 — 262,144 個詞元,最大輸出為 131,072 個詞元
• 輸入 — 文字與圖片。輸出僅限文字。沒有視訊輸入
• 價格 — 預覽期間每百萬輸入權杖 $0,每百萬輸出權杖 $0
• API 介面 — tools、tool_choice、response_format、temperature、top_p 與 max_tokens 皆可接受
• 推理控制項 — 無。完全未暴露任何推理參數
• 權重 — 未連結 Hugging Face 儲存庫,沒有授權條款,沒有參數數量,沒有架構說明
• 知識截止日期 — 未註明。此欄位為空
• 來源 — 單一端點,供應商名稱為「Stealth」,其後沒有容錯移轉供應商
注意規格表缺少了什麼,而不是它包含了什麼。它沒有參數量,因此無法分辨它是稠密模型還是混合專家模型,也無法推測其營運方提供服務的成本。分詞器被歸類為「其他」,這是最沒用的可能值,也排除了社群最常見的一項鑑識方法——也就是在八月正確辨識出 Ox Alpha 實驗室的分詞器指紋分析。而描述中最主要的宣稱「前沿級效能」,是由營運方自行報告且未經重現:沒有基準測試,沒有排行榜紀錄,在撰寫本文時也沒有任何第三方公布過這個模型的數據。

那些缺席才是有趣的部分。
對照 Ox Alpha 來看,Union Alpha 的外型明顯較小——而且並非那種會讓人覺得旗艦機被壓抑的縮小。
Ox Alpha 推出了 1,048,576 個 token 的視窗,並且除了圖像之外還能處理影片。Union Alpha 提供的上下文只有其四分之一,且僅支援到圖像。Ox Alpha 將推理功能公開為強制控制項,提供低、高與最高三種投入程度,預設為最高,而且無法關閉思考功能。Union Alpha 則完全沒有公開任何推理控制項——要不是該模型不以那種明確的方式進行推理,就是營運方選擇在預覽期間隱藏這個開關。Ox Alpha 還有一個真正與眾不同的特徵:它會在供應商端保留提示與補全內容,這是一則資料政策說明,明確告訴你為了免費使用所交換的是什麼。
一個 256K 視窗、文字與圖像輸入,而且沒有推理標籤,這正是快速層級或同系列變體的特徵側寫,而非前沿旗艦——這與 GLM-5.3-Flash 相對於其家族其他成員的關係如出一轍。這是一種解讀,不是事實。值得直白說明,因為另一種解讀同樣成立:營運方精簡對外公布的規格表面,好讓預覽版不被指紋辨識。
每個匿蹤模型,終究都是屬於某個人的。
「隱蔽預覽」這種形式如今已老套到,其揭曉更像是排定的活動,而非驚喜。以下是點名名單,根據的是報導,而非各實驗室自身的證實:
• Quasar Alpha 和 Optimus Alpha — 結果是 2025 年的 OpenAI GPT-4.1 預覽版
• Sonoma Sky 與 Dusk Alpha — xAI 的 Grok 4 Fast
• Pony Alpha — 智譜的 GLM-5,2026 年 2 月
• Hunter Alpha — 小米的 MiMo-V2-Pro
• Owl Alpha — 美團的 LongCat-2.0
• Ox Alpha — Zhipu 的 GLM-5.3-Flash,於其現身六天後揭曉
Ox Alpha 這個案例值得研究,因為它既顯示了群眾表現得多好,也顯示了他們在哪裡失手。社群測試者正確辨識出實驗室——在一連串提示詞中,分詞器計數與 GLM-5.3 相符,影片編碼器與 GLM-5V 一致,API 錯誤格式也是 GLM 的。有幾個人把自己的信心水準設在接近 99%。他們仍然弄錯了模型,以為那是 GLM-5.3 的未發布多模態變體,而非獨立的「Flash」版本;而帶動第一波報導、被廣泛引用的「DeepSWE 上 80%、擊敗 GPT-5.6 Sol」數字,其實來自一名開發者在某個子集上通過十項任務中的八項——那不是該基準測試,也無法與它旁邊印出的完整執行分數相提並論。
當 8 月 26 日正式揭曉時,真實的數字沒那麼戲劇化,卻更實用:一個 320B 參數的稀疏混合專家模型,每個 token 約有 18B 活躍參數,同日就在 Hugging Face 上以 MIT 授權釋出權重,定價為每百萬 token 0.15 美元/0.50 美元,並提供至 9 月 9 日止的 50% 上市折扣,而在 Artificial Analysis Intelligence Index 上拿下 57 分——這是一項獨立評分,而這正是隱身預覽在仍處於隱身狀態時永遠不會有的東西。

Union Alpha 可能是誰——以及為何這個名字幫不上忙
代號命名慣例一直是個微弱但真實的訊號。Pony、Ox、Owl、Hunter、Elephant:清一色是動物名稱,而這波近期熱潮背後的中國實驗室使用它們的方式,就像製片廠使用工作片名一樣。「Union」打破了這個模式,也不符合任何已知實驗室的命名體系。它引人解讀為這是聯合或聯盟發布,而這正是代號被選來誘導的那種解讀,卻毫無證據支持。
目前尚未有人發表 Union Alpha 的指紋分析,本文也不嘗試這麼做——八月帶來的真正有用教訓之一是,自信滿滿的鑑識可以指出正確的實驗室,卻指錯模型。第一批測試者會尋找什麼,是可以預期的:相對於已知分詞器的 token 計數偏移、錯誤字串格式、拒答模式、emoji 出現率,以及餵入影片時是否會有視訊編碼器回應。在那類結果出現並禁得起第二次檢視之前,任何關於誰打造了 Union Alpha 的說法,都只是披著信賴區間外衣的猜測。
那個應該決定你是否碰觸它的部分
免費使用匿名端點與其說是撿到便宜,不如說是一筆未標價的交易,而真正該仔細閱讀的是條款。你正把提示與補全內容傳送給一個沒有名字的營運者,這意味著沒有資料處理協議、沒有明訂的保留期限、沒有管轄權,也沒有任何人可以讓你向上呈報。這裡沒有服務層級協議,沒有第二家供應商可供容錯移轉,也沒有通知期——隱匿端點可以在其擁有者決定發聲的那一刻被撤下,而這正是 Ox Alpha 免費層級在揭露日當天發生的事。任何直接建立在該端點上的東西,都因為別人的一篇新聞稿而故障。
OrcaRouter 並不會繞送 Union Alpha,若暗示它能做到,那就是錯誤的——一個沒有具名供應商在背後、匿名的端點,不該被放進正式環境的請求路徑中。路由層的用途,是在那之後的下一步。單一 API 橫跨整個型錄——撰寫本文時有來自 15 家供應商的 198 個模型,以供應商定價提供、零加成——意思是當像這樣的模型有了正式名稱與正式價格——就像 GLM-5.3-Flash 在 8 月 26 日那樣——它就成了一項你能與既有呼叫的所有其他項目相互比較的費用細目,用同一把金鑰、在同一天,不必再簽一份合約或改一次程式碼。自動容錯移轉與路由 DSL 讓你將未經實證的模型放在自己掌控的開關之後,因此評估它永遠不必拿正式環境的請求路徑來下注。

該關注什麼,以及那個關鍵日期
如果近期的模式持續成立,接下來五到七天會是值得關注的窗口期。有四件事能讓 Union Alpha 從一筆清單資料變成確鑿事實:名稱出現在供應商欄位、權重以載明授權條款的形式存入某個儲存庫、公布價格,或在排行榜上出現不採信營運商說法的獨立評分。這每一項都會改變你能拿它做什麼。價格告訴你它是便宜,還是只是免費。權重告訴你,你究竟能不能自己執行它。獨立基準測試告訴你,「前沿級」是一項描述,還是一個希望。
那四個中的兩個也會讓它變成可路由,而這裡的關鍵在於價格傳遞:當供應商設定定價時,我們會不加價地將該價格直接傳遞出去,因此上市折扣或降價在宣布當天就會在我們這邊生效,而不是等到計費週期結束。這就是把評估流量留在路由器上的全部理由——你不是在綁定某個模型,而是在綁定一個 socket,而模型可以透過一行設定就換掉。
目前,對「Union Alpha 到底有多好」這個問題,準確的答案是:除了那位匿名營運者之外,沒有人知道。上下文視窗是真的,價格是真的,工具呼叫也是真的。效能宣稱只是那位營運者自己寫下、關於自己的一句話。這值得花一個週末,在你不介意弄丟的程式碼上做沙盒測試;但在有人具名為它背書之前,它不值得超過這些。
