
Grok 4.7 vs GLM-5.2: Giấy phép sống lâu hơn mô hình
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Điều quý giá nhất ở GLM-5.2 không phải là điểm benchmark của nó. Mà là bốn chữ cái MIT. Z.ai phát hành GLM-5.2 vào ngày 16 tháng 6 năm 2026 theo giấy phép MIT tiêu chuẩn, không giới hạn khu vực, không ngưỡng doanh thu và không có điều kiện sử dụng thương mại nào ngoài việc giữ lại thông báo bản quyền — và khi Z.ai phát hành GLM-5.3 hai tháng sau, họ đã không lặp lại điều đó. Bản kế nhiệm mang một "Giấy phép GLM-5.3" tùy chỉnh, bổ sung một ngoại lệ: đơn vị vận hành model-as-a-service có doanh thu hơn 10 tỷ USD trong bất kỳ mười hai tháng liên tiếp nào phải trải qua một cuộc đánh giá an ninh, với phạm vi của cuộc đánh giá đó "do Z.AI xác định một cách hợp lý". GLM-5.2 là mô hình chủ lực văn bản cuối cùng mà Z.ai phát hành mà không gắn kèm điều khoản đó. So với Grok 4.7 — được nhà cung cấp phát hành vào ngày 21 tháng 9 năm 2026, đóng trọng số và mới chỉ một ngày tuổi — điều đó khiến đây trở thành so sánh giữa mô hình mạnh nhất trên bảng xếp hạng và mô hình tự do nhất.
Một trong những thứ này bạn có thể sở hữu hoàn toàn
GLM-5.2 là một mô hình mixture-of-experts 753 tỷ tham số với khoảng 40B tham số hoạt động cho mỗi token, được công bố ở định dạng BF16 và FP8 trên Hugging Face thuộc tổ chức zai-org. Mô hình có cửa sổ ngữ cảnh 1M token và đầu ra tối đa 128K. Đây là đầu vào văn bản, đầu ra văn bản — không có thị giác gốc — với gọi hàm, tích hợp MCP, đầu ra JSON có cấu trúc và bộ nhớ đệm ngữ cảnh, cùng chế độ suy nghĩ được bật mặc định với thiết lập mức độ nỗ lực suy luận. API chính chủ của Z.ai niêm yết mô hình này ở mức $1,40 cho mỗi triệu token đầu vào, $0,26 cho đầu vào được lưu đệm và $4,40 cho mỗi triệu token đầu ra.
Grok 4.7 là mô hình đóng. Nó có ngữ cảnh 500k token, nhận đầu vào là văn bản và hình ảnh, và niêm yết ở mức 2,00 USD cho đầu vào và 6,00 USD cho đầu ra mỗi triệu token khi dưới 200k token prompt, tăng lên 4,00 USD và 12,00 USD khi vượt ngưỡng đó, với các lượt đọc từ bộ đệm ở mức 0,50 USD và 1,00 USD. Không có tải trọng số xuống, không có cách tự lưu trữ, và không có cách nào để tiếp tục gọi nó nếu xAI đổi ý — cùng vị thế cấu trúc như mọi mô hình chủ lực đóng. Cả hai mô hình đều có năng lực; chỉ một trong số chúng là tài sản mà bạn có thể đặt trên đĩa.
Chỉ mục nói gì, và "deprecated" nghĩa là gì ở đây
Artificial Analysis chấm GLM-5.2 34 điểm trên Intelligence Index v4.3.2 — bản sửa đổi được công bố ngày 19 tháng 9 năm 2026 — và Grok 4.7 đạt 46 điểm trên cùng bản sửa đổi đó. Khoảng cách mười hai điểm ấy là có thật, và hình dạng của nó quan trọng hơn con số. GLM-5.2 cũng mang nhãn "deprecated" trên trang Artificial Analysis của mình, kèm ghi chú rằng đã có một mô hình mới hơn và chỉ khối lượng công việc mặc định 10k token tiếp tục được đánh giá chuẩn. Nhãn đó nói về sự kế nhiệm, chứ không phải việc ngừng hoạt động: Z.ai vẫn phục vụ glm-5.2 cho đến nay và vẫn liệt kê nó trong bảng giá của mình.
• Tổng hợp — Grok 4.7 (xhigh): 46 trên Chỉ số Trí tuệ Artificial Analysis v4.3.2. GLM-5.2 (max): 34 trên cùng phiên bản.
• Terminal tác tử — Grok 4.7: Terminal-Bench 4.0 26. GLM-5.2: 1. Đây là con số đơn lẻ cực đoan nhất trong loạt so sánh này, và nó cần đi kèm lưu ý tương ứng. Thẻ mô hình của chính Z.ai báo cáo GLM-5.2 đạt 81.0 trên Terminal-Bench 2.1, harness tốt nhất là 82.7. Cả hai con số đều trung thực; chúng nằm trên các phiên bản benchmark khác nhau, và chỉ mục v4.3.2 đã loại bỏ 2.1 để thay bằng 4.0. Điểm số của nhà cung cấp trên một benchmark đã bị loại bỏ chỉ cho bạn biết mô hình có thể làm được gì với bài kiểm tra cũ, chứ không phải những gì nó làm được ở thời điểm hiện tại.
• Tự động hóa quy trình làm việc — Grok 4.7: AutomationBench-AA 66%. GLM-5.2: 28%. Cả hai đều được đo trên v4.3.2, nên mục này không cần lưu ý về phiên bản.
• Sự trung thực về kiến thức — Grok 4.7: AA-Omniscience 32. GLM-5.2: 4. Một lần nữa, cùng một phiên bản ở cả hai phía.
• Suy luận và ngữ cảnh dài — Grok 4.7: HLE 43, CritPt 18, AA-LCR v1.1 77%, cửa sổ 500k. GLM-5.2: HLE 41, CritPt 21, AA-LCR v1.1 78%, cửa sổ 1M. GLM-5.2 thắng hai trong bốn chỉ số này, và thắng về cửa sổ ngữ cảnh với hệ số hai.
• Tốc độ — Grok 4.7: chưa được Artificial Analysis đo lường. GLM-5.2: 73 token mỗi giây với thời gian đến token đầu tiên là 5,98 giây thông qua API của Z.ai, được nhận xét là chậm hơn mức trung bình so với các mô hình trọng số mở cùng phân khúc.
• Giá — Grok 4.7: $2.00 / $6.00 mỗi 1M, tăng gấp đôi ở 200k token prompt. GLM-5.2: $1.40 / $4.40 mỗi 1M với $0.26 cho lượt đọc từ bộ nhớ đệm, không đổi kể từ khi ra mắt.

Kinh tế của việc tự host mới là lập luận thực sự.
Tính theo token, GLM-5.2 rẻ hơn khoảng ba mươi phần trăm ở đầu vào và hai mươi bảy phần trăm ở đầu ra so với Grok 4.7 với các prompt ngắn — một mức chiết khấu khiêm tốn, tự nó sẽ không quyết định được điều gì. Lý do nó quan trọng là giá theo token chỉ là tùy chọn. Trọng số của GLM-5.2 có thể tải xuống theo một giấy phép cho phép sử dụng thương mại, chỉnh sửa, phân phối lại và cấp phép lại, nghĩa là phép so sánh thích hợp không phải là 1,40 đô-la so với 2,00 đô-la, mà là 1,40 đô-la so với chi phí GPU của chính bạn cho mỗi triệu token. Một mô hình 753B với 40B tham số hoạt động không phải là khối lượng công việc chạy trên laptop; đó là một triển khai suy luận nghiêm túc, và checkpoint FP8 tồn tại chính là vì điều đó. Nhưng đó là một triển khai mà bạn có thể vận hành, giới hạn và kiểm toán — và đối với một khối lượng công việc chịu quản lý theo quy định hay một khối lượng công việc trong môi trường cách ly mạng, đó hoàn toàn không phải là câu hỏi về chi phí.
Đối trọng là rủi ro kế nhiệm theo hướng ngược lại. GLM-5.2 chậm hai bản phát hành: GLM-5.3 ra mắt ngày 18 tháng 8 và GLM-5.3-Flash vào ngày 26 tháng 8, và các mẫu flagship mới hơn đạt điểm cao hơn — GLM-5.3 đạt 45 trên v4.3.2, thấp hơn Grok 4.7 một điểm. Vậy nên cách diễn đạt trung thực là GLM-5.2 là bản miễn phí, không phải bản tốt nhất, và rằng các mô hình mới hơn của chính Z.ai vừa mạnh hơn vừa được cấp phép hạn chế hơn. Nếu giấy phép thông thoáng là thứ bạn cần, GLM-5.2 là điểm dừng để cố định; nếu năng lực thuần túy trên một bộ trọng số mở là thứ bạn cần, mô hình kế nhiệm mới là bản để đánh giá, với con mắt luật sư nhìn vào phần ngoại lệ doanh thu.

Chạy cả hai mà không cần chạy hai stack
OrcaRouter cung cấp GLM-5.2, được niêm yết trên trang mô hình riêng của nó ở mức $1,40 đầu vào và $4,40 đầu ra với cửa sổ ngữ cảnh 1M và đầu ra tối đa 128K, vì chúng tôi chuyển nguyên giá niêm yết của nhà cung cấp với 0% markup. Với một mô hình trọng số mở, việc chuyển tiếp nguyên giá đó có công dụng thứ hai: giá hosted và phương án self-hosted đều là những lựa chọn sẵn dùng, và một router cho phép bạn chuyển lưu lượng giữa chúng theo từng yêu cầu thay vì theo hợp đồng. Z.ai đã giữ giá niêm yết của GLM-5.2 không đổi kể từ tháng Sáu trong khi các host bên thứ ba đã thay đổi giá của họ, nên việc chuyển tiếp giá trong cùng ngày là khác biệt giữa báo giá theo mức hôm nay và báo giá theo mức bạn đã sao chép tháng trước. Chuyển đổi dự phòng tự động bao quát trường hợp một triển khai self-hosted bị bão hòa và endpoint hosted phải hấp thụ phần tràn — DSL định tuyến kết hợp cả hai thành một lệnh gọi. Grok 4.7 không có trong danh mục OrcaRouter tại thời điểm viết bài; muốn gọi nó thì phải đi qua API riêng của xAI và các nền tảng bên thứ ba có cung cấp nó.
Quy tắc quyết định rút ra từ tất cả những điều này rõ ràng đến bất ngờ. Nếu bạn cần sở hữu mô hình — triển khai tại chỗ, được kiểm toán, có thể cấp phép mà không cần xét duyệt doanh thu — GLM-5.2 là mô hình duy nhất trong hai mô hình này đáp ứng được điều đó, và khoảng cách chỉ số mười hai điểm chính là cái giá của sự tự do ấy. Nếu bạn cần mô hình hoàn thành được công việc agentic, khoảng cách lại nghiêng theo hướng ngược lại và không hề nhỏ: 66% so với 28% ở tự động hóa quy trình làm việc, 26 so với 1 ở tác tử trên terminal, 32 so với 4 ở tính trung thực tri thức. Không có gì trong câu hỏi về giấy phép thay đổi được những con số đó.
Cuộc gọi
Grok 4.7 thắng trong cuộc so sánh năng lực, và nó thắng ở đúng những bài đánh giá dự đoán liệu một agent có hoàn thành nhiệm vụ hay không. GLM-5.2 thắng ở hai thứ mà không benchmark nào đo được: nó rẻ hơn, và nó thuộc về bạn. Chi tiết khiến điều này đáng để ghi lại là lợi thế thứ hai đang hết hạn — những mẫu flagship mới hơn của Z.ai đã từ bỏ giấy phép MIT không hạn chế, nên một mô hình phát hành vào tháng 6 năm 2026 theo các điều khoản không đòi hỏi gì ở bạn giờ đã là một hiện vật lịch sử chứ không còn là một chính sách. Nếu trọng số mở theo kiểu cấp phép thoáng là thứ chống đỡ cho sản phẩm của bạn, thì đó là lý do để chuẩn hoá trên GLM-5.2 khi nó vẫn còn là lựa chọn host giá rẻ và vẫn còn tải về được. Nếu không, hãy mua mười hai điểm đó.

So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
