
Dots vs GLM-5.2:代理供應鏈的兩端
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 349 tok/s
- OpenAI新OpenAI: GPT-6 Luna2026-09-2237智能
- OpenAI新OpenAI: GPT-6 Sol2026-09-2248智能
- Anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- xAI新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 210 tok/s
- Orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453智能77程式
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- AnthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- xAISpaceXAI: Grok 4.62026-08-1244智能77程式
Dots and GLM-5.2 sit at opposite ends of the same supply chain, and neither one is the other's rival. Dots is the agent surface the company announced at DevDay on September 29, 2026 — an always-on worker with its own cloud computer and browser, connections to more than 4,000 apps, reachable in ChatGPT, Slack and Teams, powered by GPT-6 Astra and included with Pro and Business Premium at no extra cost. GLM-5.2 is Z.ai's open-weight flagship text model, released June 16, 2026, with a one-million-token context window, up to 128,000 tokens of output and a published rate of $1.40 per million input tokens and $4.40 per million output tokens. One is the layer you rent and cannot see inside; the other is the layer you can download, inspect and price to the token. If you are deciding how to run agents this quarter, that is the pair of decisions in front of you.
一次看懂每一個是什麼
• 它是什麼 — 一個本身沒有模型識別碼的託管常駐代理(Dots),相對於一個可下載、權重已公開的文字模型(GLM-5.2)
• 由誰開發 — OpenAI,於 2026-09-29 在 DevDay 宣布,對上 Z.ai(智譜 AI),於 2026-06-16 發布
• 執行位置——OpenAI 的雲端電腦與瀏覽器,除非你將它們連結,否則會與你的機器隔離;相對於你部署它的任何地方:你自己的硬體、你選擇的雲端,或我們的端點
• 底層模型——GPT-6 Astra,由 OpenAI 在其發佈資料中命名(廠商所述),對上 GLM-5.2 本身,這是一款 Z.ai 以開放權重釋出的混合專家模型
• 模態 — 一端是訊息、應用程式資料與瀏覽器,另一端則僅限文字輸入與文字輸出,不具備影像或音訊輸入
• 容量 — 對一個點而言,未記載的回應限制,相較於 1,000,000 個詞元的上下文與 128,000 個詞元的最大輸出
• 價格 — 首個 dot 隨 Pro 或 Business Premium 提供,額度未公佈,相較於我們目錄所列的每百萬輸入 $1.40 與每百萬輸出 $4.40
• 證據 — 廠商示範、dots 並無獨立基準測試,對比 Artificial Analysis Intelligence Index 的 33.7,以及廠商回報在 τ²-Bench 上的 99.1,兩者皆連同其來源收錄於我們的目錄中
開放權重的那一半,以及第一天就出現的陷阱
GLM-5.2 的賣點是我們熟悉的那種開放權重主張,而這次它比平常更有力,因為無論以什麼標準衡量,這款模型都很便宜,而權重意味著部署決策操之在你。Z.ai 自己公布的成果以代理式工具使用為首——τ²-Bench 上 99.1、MCP-Atlas 上 76.8、FrontierSWE 上 74.4——而這些是廠商數據,值得直說,因為正是這些數字讓這款模型看起來像是撿到便宜。獨立評測則較為克制:Artificial Analysis 智慧指數 33.7 讓它在該排行榜上位居中游,τ-banking 分項 34.6 表現平平,長脈絡回憶 78.3 則落後於當前領先者。我們的目錄在過去七天內,這款模型承載了 1.232 億個 token 的流量,這是目前可得最清楚的跡象,顯示人們真的在運行它。
這裡有個關鍵點,也正是這篇文章存在、而非單純規格比較的原因。Artificial Analysis 將 GLM-5.2 標記為已淘汰,轉而支持較新的版本 GLM-5.3,而其即時頁面頂端也如此註明:該模型仍可路由、也仍普遍可用,但供應商的路線圖已經往前推進,附加在 GLM-5.2 上的指數數字是某個時間點的快照,而非持續性的量測。它的其他獨立數字也基於同樣理由維持不變——AA 的說明解釋,在淘汰之後,它只會繼續對該模型的預設工作負載進行基準測試,其餘一切的結果都會變成歷史資料。

由此可得兩項教訓,而兩者都遠不只適用於這個模型。第一,價格與授權條款是開放權重發布的長期不變事實;排行榜名次則是會變動的,而一個模型可能既便宜、可下載,卻仍已被取代。第二,後繼者已經出現:Z.ai 已推出 GLM-5.3 作為其當前旗艦,定價低於 GLM-5.2,每百萬 token 輸入 $1.26、輸出 $3.96,且其獨立 Intelligence Index 為 44.8,相較 GLM-5.2 的 33.7。現在著手打造的人應先以較新的模型來計算成本,並把 GLM-5.2 視為其下方更便宜的最低選項,而不是該系列的前沿。
一個點的成本,以及為什麼你們兩人都無法為它編列預算
OpenAI 已公布 dots 的一項價格——第一個 dot 隨 Pro 與 Business Premium 提供,首個月享有延伸限制,且其對話不會佔用 ChatGPT 使用額度。沒有公布額度數字,沒有第二個 dot 的價格,沒有額外速度或容量的費率,沒有每項完成任務的成本,也沒有針對目前內部測試中的專業化 dots 的企業價格。CNBC 的主題演講報導中,財務長 Sarah Friar 將新的 500 美元 Pro 500 方案定價為使用額度加上 Ultrafast 模式,而非按每個 dot 計費;OpenAI 價目表上最昂貴的方案,也無法換算成每單位代理工作的成本。
GLM-5.2 有相反的問題,而這是比較好的問題:數字太多,而且全都可以查核。費率表是每百萬 token 1.40 美元與 4.40 美元,快取讀取為 0.26 美元,而且這個模型可供下載,所以你自行執行的請求,其邊際成本是硬體和電力,而不是供應商的帳單。這就是這個取捨,一句話講完。一個 dot 給你一個工人,卻沒有計量表;GLM-5.2 給你一個計量表,卻沒有工人。

將按用量計費的模型置於你租用的代理之下
同時運用兩者的實用方式,是讓各自負責它擅長的那一半工作。一個 dot 負責協調:盯緊專案、追蹤相關的人員與系統、帶著完成的成果回來。GLM-5.2——或是你曾拿來與之比較價格的後繼版本——則負責你必須親自掌握的推理工作:對百萬 token 檔案庫進行萃取處理、長時間生成、分類佇列,以及那些答錯的代價高於省下 token 的環節。
這種拆分需要推理的那一半具備可攜性,而這是路由問題,不是模型問題。OrcaRouter 以 z-ai/glm-5.2 的形式供應 GLM-5.2,以供應商定價原價轉嫁、0% 加價——不額外加收任何費用,所以 Z.ai 一降價,當天就反映到你的帳戶——在單一金鑰背後提供兩百多個模型的目錄,並具備 容錯移轉與路由工具,讓工作不必改動程式碼就能轉移到更新或更便宜的模型。它不提供的是一個「點」:沒有 dots 端點、沒有可供代理使用的模型識別碼,也沒有辦法替換在其中運作的智慧核心。這道界線真實存在,若假裝不是,就會是這份比較中唯一不誠實的一頁。
該建議,僅此一次
如果你希望工作在不需要你親自推動的情況下發生,就買下 dot——除了你可能已經持有的訂閱之外,它不花任何額外費用,而它的限制在於,你目前還無法證明它替你省下了什麼。如果你想知道自己的推理要花多少成本,並且日後能夠把它搬遷,就把 GLM-5.2 或其後繼版本放在你自己的端點後面,並對它進行計量。在 2026 年底把這件事做對的團隊,兩者都會做;而讓這套做法行得通的紀律,就是拒絕讓租來的那一層擁有任何他們無法替換的東西。

本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
