
BAAI 昨晚將 AREX-2 放上 Hugging Face,而該儲存庫幾乎是空的
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 397 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 195 tok/s
- Orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1141 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- xAISpaceXAI: Grok 4.62026-08-1244智能77程式
2026 年 9 月 29 日 UTC 17:56,北京智源人工智能研究院在 Hugging Face 建立了一個名為 AREX-2 的儲存庫。截至本文撰寫時,該儲存庫只包含一個檔案——一個 .gitattributes——而且它儲存的模型資料為零位元組。沒有模型卡、沒有參數數量、沒有架構說明、沒有基準測試、沒有授權條款、BAAI 自家網站上沒有公告,實驗室裡也沒有任何人發表社群貼文。Hugging Face 的 API 回報零次下載與零個讚。沒有任何推論供應商為它提供服務。BAAI 對它隻字未提。這不是一則發布報導。這是一則關於一個名稱被某個實驗室保留的故事,而該實驗室不會隨便保留名稱;之所以刊載於此,是因為唯一可知的是——誰把這個儲存庫放上去,以及該組織 2026 年的紀錄看起來如何——就足以對可能即將到來的事情說出一些有用的話,並且精確區分那與「知道」之間的差別。
這個區別在這裡比平常更重要。在寫下這句話的幾小時前才建立的儲存庫,確實是最近才出現的,而一篇關於它的「目前已知」文章可以是準確的。但它做不到的是描述一個模型。所以以下一切清楚切分:本次工作階段直接從 Hugging Face 讀取到的事實,以及衍生自已發布的 AREX 系列的預期。如果你是為了 AREX-2 的規格而來,誠實的答案是 AREX-2 目前還沒有任何規格,而一段聽起來合理的數字會比這一段更糟。
儲存庫裡實際上有什麼?
關於 AREX-2,所有公開可知的事都能用一份簡短清單概括;而這份清單值得完整列出,這樣後文才不會有任何內容被誤認為是它。
• 此儲存庫存在 — huggingface.co/BAAI/AREX-2,建立於 2026-09-29T17:56:21Z,最後修改於同一瞬間。整個 git 歷史僅有建立時的一次提交。
• 這並非毫無意圖——它所指向的同系列名稱並非隨機字串。BAAI 的 AREX 系列已存在於同一個組織:AREX-Base 與 AREX-Turbo,兩者皆於 2026 年 7 月 23 日建立,皆為 Apache 2.0 授權下的完整權重釋出。
• 它除此之外空無一物 — 沒有權重、沒有設定、沒有分詞器、沒有 README 說明文字、沒有授權標籤、沒有下載次數、沒有按讚數、沒有供應商部署。
• 這是全新的,並非重新啟用——該儲存庫只有一個建立時間戳記。在 BAAI 之下,這個名稱沒有更早的前身,也沒有以搜尋時出現的變體拼寫重新上傳。
下方這張截圖就是它全部的公開樣貌。這是這篇文章其餘部分必須忠實以對的事實:BAAI 已經佔下了一個名字,卻還沒有在它背後放上任何東西。

「AREX-2」最有可能延續的是什麼
一個幾近空無一物的 repo 之所以值得寫上一千八百字,是因為它很可能是那個東西的第二版,而它的文檔記錄異常完備。
AREX-Base 於七月推出,是一個擁有 1220 億參數的混合專家模型,其中活躍參數為 100 億,以 Qwen3.5-122B-A10B 為基礎建構,並依 Apache 2.0 授權釋出。它並非一款恰好擅長搜尋的聊天模型,而是一個採用雙迴路設計的深度研究代理。內迴路負責蒐集證據、拼組出候選答案,並為其附加一份信心分數。外迴路則依據原始限制條件檢核該答案,並可選擇接受、精煉,或捨棄整條軌跡重新開始。在兩個迴路之間,它維護一個脈絡區塊,存放已驗證的發現、待定的候選項、未解決的限制條件與下一步計畫,並將搜尋與瀏覽作為工具來驅動。
根據 BAAI 自行公布的數據——由廠商自行提報,未經獨立複現——該代理在 BrowseComp 上得分 82.5、在 GAIA 上得分 85.4、在 xbench-2510 上得分 71.0、在 DeepSearch QA 上得分 89.9,並在 WideSearch-en 上得分 82.0。其 4B 同系列產品 AREX-Turbo 以 Qwen3.5-4B 為基礎打造,在同一組測試中得分 70.7、81.6、57.0、78.5 與 68.5。對第一代代理而言,這些都是強勁的數字,而 122B 與 4B 之間的差距正是這個系列有趣之處:BAAI 在同一次發布中同時打造了品質等級與服務成本等級。
這一切都不會自動轉移到 AREX-2 上。模型名稱裡的「2」只是一種命名慣例,不是什麼承諾。它可能代表第二代架構、更大的 Base、更小的蒸餾版本、保留雙迴路框架但換掉主幹網路的重新訓練代理,或是這個家族名稱根本無法預測的東西。它確實暗示的——而這點是明白標示為推論的——是 BAAI 正在延續一條代理產品線,而不是開闢一條新的,因為一個想推出全新模型的實驗室,不會把自己家族的名號花在它身上。
BAAI 2026 年其餘紀錄的定位
今天關於 AREX-2 最有力的一點,是關於其組織,而非模型。BAAI 在 2026 年的 Hugging Face 歷程,是一條穩定發布真實權重的軌跡:Orca-4B 於 7 月 12 日,AREX-Base 與 AREX-Turbo 這對組合於 7 月 23 日,接著是 Recon2Reason-Reasoning-4B、ConsiSpace、AIDD 與 Brainmu-Spike 一路到 9 月,再加上橫跨 RoboBrain、URSA、Emu3.5 與 OpenSeek 等產品線的更長尾。它們並非全都知名,也不是全都經過基準測試,但它們全都是依開放授權發布的成品。
這種模式正是這個儲存庫值得寫一篇文章的原因,而來自匿名帳號的搶註名稱則不值得。這也是必須謹慎的原因:同一個組織在過去四週內,放上了空置超過一天的儲存庫。保留名稱是關於意圖的訊號,而意圖不等於發布。如果你正在圍繞 AREX-2 規劃容量,你並沒有日期,也不應該自行編造一個。


必須發生什麼,才能讓這個變成可呼叫的?
從「repo 存在」到「你可以將它部署到正式環境」之間有四個檢查點,而且它們可能以任何順序出現。
第一個是權重:檔案樹中實際的 safetensors 檔案,這正是模型變得可供任何人檢視與量化的關鍵所在。第二個是一張模型卡:參數量、基礎模型、上下文視窗,以及告訴你正在下載什麼的評估表。第三個是授權條款,這個系列一向採用 Apache 2.0——一個寬鬆的預設授權,若這一點持續成立,就完全消除了設有營收上限的授權問題。
第四個是一條路由,而這正是本部落格大多數讀者真正在意的一點。AREX-Base 目前並不在 OrcaRouter 的目錄上,而 AREX-2 顯然也不在。當這樣的模型真的以開放權重問世時,路由層的實用之處在於,要用上它並不需要再簽一份合約或另建一個用戶端——用一組 API 串接 200 多個模型,供應商的定價表原價直通、不外加任何加價,因此供應商在公布當下的自家價格,就是你看到的價格;再加上自動容錯移轉,讓單一供應商的一個糟糕午後,不至於變成你的代理的糟糕午後。對於一個每次查詢都會展開數十次工具呼叫的研究型代理來說,最後這項特性比聽起來更有價值:深度研究迴圈的失效模式,多半都源自某一個不穩定的供應商。
當 AREX-2 有了還沒有任何主機在提供服務的權重時,我們也會說同樣的話:容錯移轉(failover)就是讓你在側路上測試未經驗證的模型,而不必把主要路徑押在它上面的做法。
當 repo 填入內容後,這個頁面會是什麼樣子
可能出現三種結果,而且它們可從外部加以區分。
如果這個檔案樹在接下來幾天內多了 safetensors,這就會變成一個真正的靜默發布故事,並會以真實的參數數量和直接從模型卡讀出的授權條款重寫。這是這個組織常見的形態,也是那個時間戳所指向的結果。
如果儲存庫空置數週,而論文搶先問世——AREX 家族的第一代與 arXiv 2607.21461 同步發布——那麼誠實的標題應是:第二代仍在研究中,而該儲存庫只是為它預留的佔位符。
如果什麼事都沒有發生,那就是什麼都沒發生,而正確該發布的內容就是什麼都不發布。一個永遠不會填入的保留名稱並不是一則故事,也不該被粉飾成一則故事。
兩個事實就足以讓你自己查證,不必依賴任何人的摘要。該儲存庫的檔案樹——裡面有或沒有權重——以及該儲存庫的建立日期,而這不會改變。關於 AREX-2 的其他一切——它的規模、它的基準測試、它推出時是否甚至會叫 AREX-2——目前都未知,而本文不會假裝不是如此。
