標題卡寫著「Grok 4.7 vs GLM-5.2」,副標為「授權比模型更長壽」,另有兩張——更正,三張卡片:AA 指數 v4.3.2 46 對 34、授權 閉源 對 MIT,以及每百萬價格 $2/$6 對 $1.40/$4.40。
Guides & Insights

Grok 4.7 vs GLM-5.2:授權條款比模型更長壽

作者

Elias Hawthorne

發佈日期

最新模型 · 20查看全部模型
基準測試:Artificial Analysis · 每日更新
返回全部文章

GLM-5.2 最有價值的地方不在於它的基準測試分數,而是 MIT 這四個字母。Z.ai 於 2026 年 6 月 16 日以標準 MIT 授權釋出 GLM-5.2,沒有地區限制、沒有營收門檻,除了保留著作權聲明之外,也沒有任何商業使用條件——而當 Z.ai 在兩個月後推出 GLM-5.3 時,就沒有再這麼做了。接棒者採用一份自訂的「GLM-5.3 License」,其中新增了一項除外條款:任何在連續十二個月內營收超過 100 億美元的模型即服務(model-as-a-service)營運商,都必須通過安全審查,而該審查的範圍「由 Z.AI 合理決定」。GLM-5.2 是 Z.ai 最後一款在沒有附帶這項條件的情況下釋出的文字旗艦模型。對上 Grok 4.7——由廠商於 2026 年 9 月 21 日釋出、封閉權重,且才問世一天——這使得這場比較成了榜上最強模型與最自由模型之間的對決。

你可以完全擁有其中一個。

GLM-5.2 是一款擁有 7,530 億參數的混合專家模型,每個 token 約啟用 400 億參數,以 BF16 與 FP8 格式在 Hugging Face 上由 zai-org 組織發布。它具備 100 萬 token 的上下文視窗,最大輸出為 128K。它採文字輸入、文字輸出——沒有原生視覺能力——支援函式呼叫、MCP 整合、結構化 JSON 輸出與上下文快取,並具備預設開啟的思考模式,附有推理投入程度(reasoning effort)設定。Z.ai 的第一方 API 標價為每百萬輸入 token 1.40 美元、快取輸入 0.26 美元,以及每百萬輸出 token 4.40 美元。

Grok 4.7 是閉源的。它擁有 50 萬個 token 的上下文,可輸入文字與圖像,在提示 token 低於 20 萬時,定價為每百萬 token 輸入 $2.00、輸出 $6.00,超過這條線則調升為 $4.00 與 $12.00,快取讀取為 $0.50 與 $1.00。它沒有權重可供下載,沒有自行託管的路徑,而且如果 xAI 改變心意,就沒有辦法繼續呼叫它——這與每一個閉源旗艦模型所處的結構位置完全相同。這兩個模型都很有能力;但只有其中一個是你可以放進磁碟裡的資產。

索引顯示的內容,以及這裡「deprecated」的意思

Artificial Analysis 在 Intelligence Index v4.3.2(2026 年 9 月 19 日發布的修訂版)上給 GLM-5.2 打了 34 分,並在同一修訂版上給 Grok 4.7 打了 46 分。那 12 分的差距是真的,而差距的形態比幅度更重要。GLM-5.2 在其 Artificial Analysis 頁面上也帶有「已棄用」標籤,並附註說明已有較新的模型,且只有預設的 10k token 工作負載仍持續接受基準測試。那個標籤談的是世代交替,而非停止服務:Z.ai 至今仍提供 glm-5.2,也仍將其列在定價表中。

綜合 — Grok 4.7 (xhigh):在 Artificial Analysis Intelligence Index v4.3.2 上獲得 46 分。GLM-5.2 (max):在同一版本上獲得 34 分。

代理式終端 — Grok 4.7:Terminal-Bench 4.0 為 26。GLM-5.2:1。這是這批比較中最極端的一個單一數字,而且必須附帶相應的但書。Z.ai 自家的模型卡指出 GLM-5.2 在 Terminal-Bench 2.1 上為 81.0,最佳測試框架為 82.7。這兩個數字都是誠實的;它們屬於不同的基準版本,而 v4.3.2 指數已讓 2.1 退役,改用 4.0。廠商在已退役基準上的分數,說明的是模型面對舊測試時能做到什麼,而不是它現在的表現。

工作流程自動化 — Grok 4.7:AutomationBench-AA 66%。GLM-5.2:28%。兩者都是在 v4.3.2 上測得的,所以這一項不需要版本但書。

知識誠實度—— Grok 4.7:AA-Omniscience 32。GLM-5.2:4。兩邊又是相同的版本。

推理與長上下文 — Grok 4.7:HLE 43、CritPt 18、AA-LCR v1.1 77%、視窗 500k。GLM-5.2:HLE 41、CritPt 21、AA-LCR v1.1 78%、視窗 1M。GLM-5.2 在這四項中拿下兩項,上下文視窗更是兩倍。

速度 — Grok 4.7:Artificial Analysis 尚未進行測量。GLM-5.2:透過 Z.ai 的 API,每秒可處理 73 個 token,首個 token 的回應時間為 5.98 秒,被形容為比開放權重的同類模型平均更慢。

價格 — Grok 4.7:每 1M 為 $2.00 / $6.00,當提示詞達 200k 個 token 時價格加倍。GLM-5.2:每 1M 為 $1.40 / $4.40,快取讀取為 $0.26,自推出以來維持不變。

OrcaRouter model page for GLM-5.2 showing the z-ai/glm-5.2 identifier, a 1M-token context window, a 128K maximum output, text-only input and output, list rates of $1.40 per 1M input and $4.40 per 1M output, and 24.7M tokens of traffic over seven days.

自架的經濟效益才是真正的論點

以每個詞元計算,在短提示下,GLM-5.2 的輸入成本比 Grok 4.7 便宜約百分之三十,輸出成本便宜百分之二十七——這種幅度的折扣本身不足以決定任何事。它之所以重要,在於每詞元價格是可選的。GLM-5.2 的權重可依授權條款下載,該授權允許商業使用、修改、再散布與再授權,這意味著真正相關的比較不是 $1.40 對上 $2.00,而是 $1.40 對上你自己的 GPU 每百萬詞元的成本。一個 753B 模型、40B 活躍參數並不是筆電級的工作負載;它是正經的推論部署,而 FP8 檢查點正是為此而存在。但這是一種你可以運行、設上限並稽核的部署——而對於受監管的工作負載或氣隙環境而言,這根本不是成本問題。

制衡因素是另一個方向的接班風險。GLM-5.2 落後兩個版本:GLM-5.3 於 8 月 18 日推出,GLM-5.3-Flash 則於 8 月 26 日推出,而較新的旗艦模型得分更高——GLM-5.3 在 v4.3.2 上拿下 45 分,比 Grok 4.7 低一分。所以,誠實的說法是:GLM-5.2 是免費的那一個,不是最強的那一個,而 Z.ai 自家較新的模型不僅更強,授權也更具限制性。如果你需要的是寬鬆授權,GLM-5.2 就是要凍結的終點;如果你需要的是開放權重集上的原始能力,那麼該評估的是它的後繼者,並以律師的眼光緊盯其中的營收除外條款。

Two-column scoreboard titled “Grok 4.7 vs GLM-5.2 - the scoreboard”: AA Index 46 vs 34, Terminal-Bench 4.0 26 vs 1, context 500k vs 1M, price per 1M $2/$6 vs $1.40/$4.40, and licence “closed” vs “MIT”.

在不必運行兩套堆疊的情況下同時運行兩者

OrcaRouter 提供 GLM-5.2,並在其專屬模型頁面上列出,輸入每百萬詞元 $1.40、輸出 $4.40,具備 1M 上下文視窗與 128K 最大輸出,因為我們以 0% 加成直接傳遞供應商的定價。對於開放權重模型,這種直接傳遞還有第二個用途:託管價格與自架選項都是即時可用的選擇,而路由器讓你按每次請求、而非按合約在兩者之間調度流量。Z.ai 自六月以來一直維持 GLM-5.2 的定價不變,而第三方託管商則不時調整,因此當日直接傳遞就是報出今日費率與報出你上個月抄來的費率之間的差別。自動容錯移轉可涵蓋自架部署飽和、必須由託管端點吸收溢流的情況——路由 DSL 會將兩者組合成單一呼叫。截至本文撰寫時,Grok 4.7 尚未列入 OrcaRouter 的目錄;要呼叫它,就必須透過 xAI 自家的 API 以及提供它的第三方平台。

從這一切得出的決策規則異常清晰。如果你需要擁有模型——地端部署、可稽核、無需營收審查即可授權——GLM-5.2 是這兩者中唯一提供這種選項的,而十二點的指數差距就是這種自由的代價。如果你需要能把代理式工作做完的模型,差距則朝反方向發展,而且毫不含糊:在工作流程自動化上是 66% 對 28%,在終端代理上是 26 對 1,在知識誠實度上是 32 對 4。授權問題中的任何內容都改變不了這些數字。

那通電話

Grok 4.7 在能力比較中勝出,而且是在那些能預測代理是否完成任務的評估上勝出。GLM-5.2 則在兩件沒有基準測試能衡量的事情上勝出:它更便宜,而且它是你的。讓這件事值得寫下來的細節是,第二項優勢正在失效——Z.ai 較新的旗艦模型放棄了不受限制的 MIT 授權條款,因此一個在 2026 年 6 月以對你毫無要求的條款發布的模型,如今已是歷史產物,而非一項政策。如果寬鬆的開放權重對你的產品至關重要,那就是一個理由,讓你在 GLM-5.2 仍是便宜的託管選項且仍可下載時,標準化採用它。如果不是,那就買下那 12 分。

Artificial Analysis page for Grok 4.7 at xhigh reasoning effort: an Artificial Analysis Intelligence Index score of 46, ranked #16 of 655; Speed and Cost both reported as N/A; 240M output tokens from the Intelligence Index run, ranked #140 of 655; a 500k-token context window with text and image input and text output; and comparison charts for intelligence, speed and cost per task.

本文中的比較1

根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新