
Đánh giá GLM-5.2: Mã hóa gần mức tiên tiến với giá mở trọng lượng?
- anthropicMỚIAnthropic: Claude Opus 52026-07-2461Trí tuệ78Lập trình
- googleMỚIGoogle: Gemini 3.6 Flash2026-07-2150Trí tuệ69Lập trình
- googleMỚIGoogle: Gemini 3.5 Flash-Lite2026-07-2137Trí tuệ49Lập trình
- metaMỚIMeta: Muse Spark 1.12026-07-1651Trí tuệ71Lập trình
- kimiMỚIMoonshotAI: Kimi K32026-07-1557Trí tuệ76Lập trình
- openaiOpenAI: GPT-5.6 Luna2026-07-0951Trí tuệ71Lập trình
- openaiOpenAI: GPT-5.6 Terra2026-07-0955Trí tuệ77Lập trình
- openaiOpenAI: GPT-5.6 Sol2026-07-0959Trí tuệ77Lập trình
- grokxAI: Grok 4.52026-07-0854Trí tuệ72Lập trình
- tencentTencent: Hy32026-07-0641Trí tuệ59Lập trình
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Trí tuệ42Lập trình
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Trí tuệ39Lập trình
- anthropicAnthropic: Claude Sonnet 52026-06-3053Trí tuệ72Lập trình
- klingKling: Kling 3.0 Turbo2026-06-1757Trí tuệ52Lập trình57Toán
- z-aiZ.ai: GLM 5.22026-06-1651Trí tuệ69Lập trình60Toán
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242Trí tuệ61Lập trình61Toán
- anthropicAnthropic: Claude Fable 52026-06-0960Trí tuệ77Lập trình
- qwenQwen: Qwen3.7 Plus2026-06-0139Trí tuệ56Lập trình59Toán
- minimaxMiniMax: MiniMax M32026-05-3144Trí tuệ59Lập trình59Toán
- AnthropicAnthropic: Claude Opus 4.82026-05-2856Trí tuệ74Lập trình68Toán
Z.ai đã phát hành GLM-5.2 vào ngày 16 tháng 6 năm 2026, và gọi nó là mô hình hàng đầu được xây dựng cho các tác vụ dài hạn. Lần này, danh hiệu đó thực sự xứng đáng. GLM-5.2 kết hợp cửa sổ ngữ cảnh 1 triệu token vốn được huấn luyện thực tế cho các phiên làm việc của agent mã hóa dài với điểm số lập trình mạnh nhất mà bất kỳ mô hình trọng số mở nào từng công bố cho đến nay — và nó được phát hành đồng loạt ở mọi nơi: API Z.ai, Gói Lập Trình GLM, và toàn bộ trọng số theo giấy phép MIT trên Hugging Face, không có hạn chế khu vực.
Bài đánh giá này trả lời câu hỏi mà hầu hết các nhóm đang thực sự đặt ra: liệu một mô hình trọng số mở cuối cùng đã đủ tốt để trở thành mô hình viết mã mặc định của bạn chưa, và những mô hình hàng đầu đóng vẫn xứng đáng với mức giá cao của chúng ở đâu? Chúng tôi sẽ đề cập đến những gì thực sự mới, chi phí thực tế của GLM-5.2 là bao nhiêu (bao gồm cả chiết khấu đầu vào đã lưu trong bộ nhớ đệm mà hầu hết các bài viết bỏ qua), cách nó so sánh với GLM-5.1 và các mô hình hàng đầu đóng, và ai nên chuyển đổi ngay hôm nay.
Nhận xét nhanh
Cân nhắc GLM-5.2 nếu bạn…
- Chạy khối lượng lớn các tác vụ coding hoặc agent và muốn chất lượng gần như tiên tiến với giá $1.40 / $4.40 cho mỗi triệu token — chỉ một phần nhỏ so với giá flagship
- Xây dựng các tác nhân mã hóa chạy lâu dài — trên kết quả FrontierSWE được công bố của Z.ai, GLM-5.2 nằm trong khoảng một điểm của Claude Opus 4.8 và vượt lên trước GPT-5.5
- Cần một cửa sổ ngữ cảnh 1 triệu token với tối đa 128K token đầu ra, được huấn luyện đặc biệt cho các quỹ đạo tác nhân dài và lộn xộn, chứ không chỉ được quảng cáo trên bảng thông số kỹ thuật
- Muốn trọng số mở: giấy phép MIT, tự lưu trữ, tinh chỉnh và không bị khóa nhà cung cấp.
Hãy trì hoãn (hoặc ở lại trên một flagship đã ngừng sản xuất) nếu bạn…
Cần trần tuyệt đối cho công việc đại lý khó nhất — Claude Opus 4.8 vẫn dẫn đầu rõ ràng về điều phối công cụ và các tác vụ tự động dài như chạy marathon.
- Cần đầu vào là hình ảnh hoặc tệp: GLM-5.2 chỉ hỗ trợ văn bản; tính năng thị giác nằm ở dòng GLM-V riêng của Z.ai.
- Bị ràng buộc độ trễ nghiêm ngặt — GLM-5.2 là mô hình ưu tiên suy luận, và thống kê cổng công cộng cho thấy thời gian trung bình đến token đầu tiên trong khoảng vài giây
GLM-5.2 là gì?
GLM-5.2 là mẫu flagship mới nhất trong dòng GLM từ Z.ai (trước đây là Zhipu AI), một trong số ít phòng thí nghiệm phát hành các mô hình trọng số mở ở quy mô tiên phong. Tài liệu mô hình công khai ước tính nó có tổng cộng khoảng 750 tỷ tham số trong thiết kế Mixture-of-Experts, với khoảng 40 tỷ tham số hoạt động cho mỗi token. ID của mô hình là `glm-5.2`, và nó hiện có sẵn rộng rãi: bạn có thể trò chuyện với nó trên Z.ai, gọi nó qua API của Z.ai, sử dụng nó trong gói đăng ký GLM Coding Plan (nơi nó xuất hiện vài ngày trước khi ra mắt công khai), hoặc tải trọng số từ Hugging Face và tự chạy nó.
Điều đáng chú ý ở thế hệ này là định vị. Z.ai không bán GLM-5.2 như một sản phẩm rẻ hơn; họ đang quảng bá nó như mô hình mã nguồn mở mạnh nhất, với các số liệu công bố cho thấy nó chỉ kém vài điểm so với các mô hình closed frontier trên chính xác các khối lượng công việc — lập trình dài hạn và tác nhân — nơi mà hầu hết chi tiêu của nhà phát triển hiện nay đổ vào.
Có gì mới trong GLM-5.2?

Một bước nhảy vọt về lập trình dài hạn, không phải là một bản phát hành nhỏ.Thay đổi chính. Trên bảng điểm chuẩn được công bố của Z.ai, GLM-5.2 đạt 81.0 trên Terminal-Bench 2.1 so với 63.5 của GLM-5.1, và 62.1 so với 58.4 trên SWE-bench Pro. Con số ấn tượng nhất là FrontierSWE, đo lường các dự án kỹ thuật mở kéo dài hàng giờ đến hàng chục giờ: 74.4 so với 30.5 của GLM-5.1.
Một ngữ cảnh 1M-token ổn định. GLM-5.2 là mô hình GLM đầu tiên kết hợp cửa sổ một triệu token (gấp năm lần mức 200K của GLM-5.1) với chương trình huấn luyện nhắm trực tiếp vào đó: Z.ai cho biết đã mở rộng đáng kể quá trình huấn luyện ngữ cảnh 1M trên các tình huống tác tử lập trình — triển khai quy mô lớn, nghiên cứu tự động, tối ưu hóa hiệu suất, gỡ lỗi phức tạp. Đầu ra đạt tối đa 128K token cho mỗi phản hồi.
Kiểm soát mức độ nỗ lực.Mới trong thế hệ này: bạn có thể chủ động đánh đổi khả năng với tốc độ thực thi và chi phí tính toán bằng cách thiết lập một mức độ nỗ lực suy nghĩ, thay vì nhận được một độ sâu suy luận cố định cho mọi yêu cầu.
Một kiến trúc rẻ hơn bên dưới.Kỹ thuật IndexShare mới của Z.ai tái sử dụng cùng một bộ lập chỉ mục trên mỗi bốn lớp chú ý thưa, giảm khối lượng tính toán trên mỗi token xuống 2,9 lần ở độ dài ngữ cảnh tối đa 1M, và một lớp MTP cải tiến tăng tốc độ giải mã suy luận bằng cách tăng độ dài chấp nhận lên tới 20%.
Mã nguồn mở hoàn toàn. Các trọng số được phân phối theo giấy phép MIT, theo lời của Z.ai, không có giới hạn khu vực — sử dụng thương mại, tinh chỉnh và lưu trữ riêng đều được phép.

Định giá: chi phí thực tế

bên thứ nhấtAPI GLM 5.2có giá 1,40 đô la mỗi triệu token đầu vào và 4,40 đô la mỗi triệu token đầu ra — cùng mức giá niêm yết với GLM-5.1, vì vậy bước nhảy về năng lực được miễn phí nếu bạn đã sử dụng API GLM. Đầu vào được lưu trong bộ nhớ đệm giảm xuống còn 0,26 đô la mỗi triệu, và Z.ai hiện đang miễn phí lưu trữ bộ nhớ đệm trong thời gian có hạn, điều này rất quan trọng đối với các vòng lặp tác nhân đọc lại cùng một ngữ cảnh dự án hàng trăm lần.
Về mặt quy mô: Claude Opus 4.8 được niêm yết ở mức $5 / $25 cho mỗi triệu token. Nếu bảng điểm chuẩn của Z.ai đúng ngay cả theo hướng, GLM-5.2 mang lại hầu hết khả năng lập trình tầm xa của frontier với giá dưới 1/5 giá đầu ra của flagship. Hai lưu ý: mức nỗ lực quyết định chi phí thực tế (nỗ lực cao hơn đồng nghĩa với nhiều token suy nghĩ hơn), và các bên thứ ba có bảng giá riêng — một số rẻ hơn bên thứ nhất — vì vậy hãy kiểm tra số liệu hiện tại trước khi lập ngân sách.
Điểm đánh giá
Các điểm số dưới đây là đánh giá biên tập của chúng tôi dựa trên các điểm chuẩn đã công bố của Z.ai và tài liệu mô hình — bảng điểm chuẩn là của chính nhà cung cấp. Chúng tôi sẽ xem xét lại khi có kết quả độc lập.

- Lập trình: 9/10
- Sử dụng tác nhân / công cụ: 8/10 — gần mức tiên tiến trên MCP-Atlas, nhưng Opus 4.8 vẫn dẫn đầu rõ rệt về điều phối công cụ
- Lý luận: 8/10 — toán học ưu tú (AIME 2026: 99.2, điểm cao nhất trong bảng của Z.ai), nhưng các bài kiểm tra lý luận rộng nhất vẫn ưu ái cho ranh giới đóng
- Hiệu quả chi phí: 10/10
- Ngữ cảnh và tài liệu dài: 9/10
- Tốc độ và độ trễ: 7/10 — mô hình ưu tiên suy luận; sử dụng mức độ nỗ lực thấp hơn cho các tác vụ nhanh
Tổng thể: ~8.5/10 — mô hình open-weight đầu tiên đủ gần với ranh giới để trở thành mặc định, không phải là sự thỏa hiệp.
Ưu điểm
- Mã hóa tầm xa gần tiên tiến với giá $1.40 / $4.40 trên một triệu token — cùng mức giá với GLM-5.1, thấp hơn nhiều so với các flagship đóng
- Ngữ cảnh vững chắc 1M token với đầu ra 128K, được huấn luyện trên các quỹ đạo tác nhân mã hóa thực tế
- Kiểm soát mức độ nỗ lực để điều chỉnh sự cân bằng giữa chi phí / độ trễ / chất lượng cho mỗi yêu cầu
- MIT mở trọng số: tự lưu trữ, tinh chỉnh, hoặc giữ dự phòng riêng — không khóa, không giới hạn khu vực
- Đầu vào được lưu trong bộ nhớ đệm với giá $0,26 mỗi triệu, hiện tại lưu trữ bộ nhớ đệm miễn phí — lớn cho các vòng lặp agent
Nhược điểm
- Claude Opus 4.8 vẫn dẫn đầu các benchmark tác nhân khó nhất — điều phối công cụ và các tác vụ kéo dài vẫn chưa phải là vương miện của GLM-5.2
- Chỉ văn bản: không có đầu vào hình ảnh, vì vậy các quy trình làm việc dựa trên ảnh chụp màn hình hoặc thị giác tài liệu cần một mô hình khác.
- Thiết kế ưu tiên suy nghĩ có nghĩa là {{1}}thời gian đến token đầu tiên đáng chú ý{{/1}}; UX quan trọng về độ trễ cần {{2}}cài đặt nỗ lực thấp hơn hoặc phương án dự phòng nhanh hơn{{/2}}.
- Tự lưu trữ là một dự án trung tâm dữ liệu, không phải dự án cuối tuần — điểm kiểm tra đầy đủ được báo cáo cần bộ nhớ GPU quy mô cụm.
- Câu chuyện điểm chuẩn hiện chỉ dựa trên bảng của riêng Z.ai; việc sao chép độc lập vẫn đang đến.
GLM-5.2 so sánh như thế nào

so với GLM-5.1. Cùng một mức giá $1.40 / $4.40, cửa sổ ngữ cảnh lớn gấp năm lần, và một bước nhảy tầm xa có vẻ như là một bước nhảy thế hệ: FrontierSWE 74.4 so với 30.5, Terminal-Bench 2.1 81.0 so với 63.5, SWE-Marathon 13.0 so với 1.0. Nếu bạn đang dùng GLM-5.1, đây là lời kêu gọi nâng cấp dễ dàng nhất trong năm — Z.ai thậm chí còn công bố một hướng dẫn di chuyển chuyên dụng.
so với biên giới đóng (Claude Opus 4.8, GPT-5.5).Trên bảng của Z.ai, GLM-5.2 đạt cách Opus 4.8 bốn điểm trên Terminal-Bench 2.1 (81.0 so với 85.0), trong vòng một điểm trên FrontierSWE (74.4 so với 75.1), và thực tế đánh bại GPT-5.5 trên SWE-bench Pro (62.1 so với 58.6) và FrontierSWE (74.4 so với 72.6). Biên giới giữ được lợi thế của nó ở những nhiệm vụ dài nhất và nặng về công cụ nhất: Opus 4.8 gấp đôi GLM-5.2 trên SWE-Marathon (26.0 so với 13.0) và dẫn đầu Tool-Decathlon với khoảng cách rộng. Quy tắc thực tế: GLM-5.2 cho khối lượng, một soái hạm cho đỉnh cao.
so với các mô hình open-weight khác. Đối đầu với Qwen3.7-Max, MiniMax M3 và DeepSeek-V4-Pro, GLM-5.2 đứng đầu mọi hàng lập trình trong bảng được công bố. Tính đến hôm nay, vương miện lập trình open-weight thuộc về Z.ai.
Ai nên sử dụng GLM-5.2?
- Các nhóm vận hành các tác nhân lập trình ở quy mô lớn — bot CI, tái cấu trúc tự động, đánh giá mã — nơi chi phí mỗi tác vụ quyết định điều gì là khả thi về mặt kinh tế
- Các nhà xây dựng công cụ phát triển muốn chất lượng cận tiên phong mà không phải trả hóa đơn tiên phong
- Khối lượng công việc ngữ cảnh dài: phân tích monorepo, đặc tả kỹ thuật đa tài liệu, các phiên tác nhân kéo dài hàng giờ thực sự lấp đầy 1 triệu token
- Các tổ chức cần trọng số mở — để tuân thủ, triển khai cách ly mạng, tinh chỉnh, hoặc đơn giản là đòn bẩy đàm phán với các nhà cung cấp API
Ai nên gắn bó với flagship đóng?
- Các đội có nhiệm vụ khó nhất là các lần chạy tự động dài như marathon hoặc phối hợp công cụ nặng — các điểm chuẩn nói rằng mức phí biên giới vẫn còn thực sự ở đó
- Các quy trình làm việc phụ thuộc vào thị giác: GLM-5.2 không nhận hình ảnh
- Các sản phẩm mà mỗi giây của độ trễ token đầu tiên đều khiến người dùng trả giá
GLM-5.2 có đáng giá không?
Đối với hầu hết các khối lượng công việc lập trình và tác nhân, câu trả lời là có — một cách dứt khoát. Cách nhìn nhận trung thực: GLM-5.2 mang lại cho bạn khoảng 90-95% khả năng lập trình tầm xa của các mô hình tiên phong với mức giá dưới một phần năm, đi kèm trọng số mở như một sự đảm bảo. Các flagship đóng vẫn thắng 5% nhiệm vụ khó nhất. Đó không phải là lý do để bỏ qua GLM-5.2; mà là lý do để phân luồng: gửi khối lượng công việc thông thường cho GLM-5.2 và chuyển các vấn đề đỉnh cao lên một flagship.
Phán quyết cuối cùng
GLM-5.2 là mô hình mã nguồn mở mạnh nhất về lập trình mà bạn có thể sử dụng hiện nay, và là mô hình đầu tiên được xem như lựa chọn mặc định thay vì một sự thỏa hiệp về ngân sách — điểm số của chúng tôi: ~8.5/10. Nó không phế truất Claude Opus 4.8 ở đỉnh cao của độ khó, nhưng nó biến sản phẩm hàng đầu thành một công cụ chuyên biệt thay vì câu trả lời hiển nhiên hàng ngày. Nếu bạn đang sử dụng GLM-5.1, hãy nâng cấp ngay. Nếu bạn đang trả giá cao cho các tác vụ tác tử thông thường, đây là tín hiệu để bạn đo lường lại.
Sử dụng GLM-5.2 qua OrcaRouter
Bởi vì chiến lược thông minh là "GLM-5.2 cho khối lượng, một flagship cho các tác vụ khó nhất," bạn có thể sẽ muốn có nhiều hơn một mô hình trong sản xuất — từ nhiều hơn một nhà cung cấp. Đó là trở ngại mà OrcaRouter loại bỏ.

OrcaRouter đã phục vụ GLM-5.2 (ID mô hình `z-ai/glm-5.2`) thông qua một điểm cuối tương thích với OpenAI, với mức giá riêng của Z.ai là $1.40 / $4.40 và không có phụ phí token. Định tuyến lưu lượng mã hóa và tác nhân khối lượng lớn đến GLM-5.2, chuyển các bài toán suy luận khó nhất lên Claude Opus 4.8 hoặc một flagship khác, và duy trì chuyển đổi dự phòng tự động sẵn sàng cho các đợt tăng dung lượng trong cửa sổ ra mắt — tất cả mà không cần viết lại tích hợp của bạn mỗi khi bạn thay đổi mô hình.

Câu hỏi thường gặp
GLM-5.2 hiện có sẵn chưa?
Vâng. Nó được ra mắt vào ngày 16 tháng 6 năm 2026 và hiện có sẵn rộng rãi: trên chat và API của Z.ai (ID mô hình glm-5.2), trong Gói lập trình GLM, thông qua các cổng như OrcaRouter, và dưới dạng trọng số mở được cấp phép MIT trên Hugging Face.
GLM-5.2 có giá bao nhiêu?
Giá API bên thứ nhất là 1.40 đô la cho mỗi triệu token đầu vào và 4.40 đô la cho mỗi triệu token đầu ra — không thay đổi so với GLM-5.1. Đầu vào được lưu trong bộ nhớ đệm là 0.26 đô la mỗi triệu, và lưu trữ bộ nhớ đệm miễn phí trong thời gian giới hạn.
GLM-5.2 có tốt hơn GLM-5.1 không?
Với khoảng cách lớn trong công việc dài hạn: 81.0 so với 63.5 trên Terminal-Bench 2.1, 74.4 so với 30.5 trên FrontierSWE, và ngữ cảnh 1M so với 200K — với cùng mức giá.
GLM-5.2 so với Claude Opus 4.8 — tôi nên dùng cái nào?
Mặc định sử dụng GLM-5.2 cho công việc viết mã và tác nhân khối lượng lớn; chuyển các tác vụ tự động dài như marathon và điều phối công cụ nặng cho Opus 4.8, vốn vẫn dẫn đầu trong các lĩnh vực đó. Định tuyến giữa chúng tốt hơn là chọn một.
Cửa sổ ngữ cảnh là gì?
1M token, với tối đa 128K token đầu ra cho mỗi phản hồi — và Z.ai cho biết cửa sổ dài này được huấn luyện đặc biệt trên các kịch bản tác nhân mã hóa, không chỉ đơn thuần là mở rộng.
GLM-5.2 có thực sự là mã nguồn mở không?
Có — các trọng số được công bố theo giấy phép MIT không có giới hạn khu vực, miễn phí sử dụng thương mại và tinh chỉnh. Tuy nhiên, hãy ngân sách thực tế cho tự lưu trữ: một điểm kiểm tra MoE ~750B tham số cần bộ nhớ GPU quy mô cụm.
GLM-5.2 có hỗ trợ đầu vào hình ảnh không?
Không. GLM-5.2 là dạng văn bản đầu vào, văn bản đầu ra. Đối với các tác vụ thị giác, Z.ai duy trì một dòng mô hình GLM-V riêng, hoặc bạn có thể định tuyến các yêu cầu hình ảnh tới một mô hình đa phương thức.
Tôi có thể sử dụng GLM-5.2 qua OrcaRouter không?
Có — GLM-5.2 đã hoạt động trên OrcaRouter với tên z-ai/glm-5.2 với giá first-party, không tính phí chênh lệch, bên cạnh Claude, GPT, Gemini và các mô hình khác thông qua một endpoint tương thích với OpenAI.
Sẵn sàng đưa GLM-5.2 vào sản xuất? Khởi chạy trong vài phút — tạo tài khoản OrcaRouter của bạn và gọi GLM-5.2, Claude Opus 4.8, cùng mọi mô hình hàng đầu khác thông qua một endpoint tương thích OpenAI. Mã hóa đẳng cấp tiên phong giờ đây rẻ hơn nhiều; một lớp định tuyến là cách bạn thu về khoản tiết kiệm.
