
Claude Fable 5.1 vs GLM-5.2: Thuê đỉnh bảng xếp hạng, hay sở hữu flagship mở cuối cùng
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiMỚIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleMỚIGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenMỚIQwen: Qwen3.8 Max (0902)2026-09-0240Trí tuệ72Lập trình
- anthropicMỚIAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0340Trí tuệ72Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2134Trí tuệ69Lập trình
Câu hỏi đằng sau mọi so sánh giữa mô hình đóng và mô hình mở không thực sự là "mô hình nào đạt điểm cao hơn" — mà là ai kiểm soát nền tảng bạn đang xây dựng trên đó. Claude Fable 5.1, mô hình chủ lực của Anthropic phát hành ngày 1 tháng 9 năm 2026, hiện đang đứng đầu Chỉ số Trí tuệ Artificial Analysis với 66 điểm, và bạn chỉ có thể thuê nó: trọng số đóng, API đóng, an toàn và giá cả đều do Anthropic kiểm soát. GLM-5.2, mô hình chủ lực trọng số mở của Zhipu phát hành ngày 16 tháng 6 năm 2026 với trọng số được cấp phép MIT trên Hugging Face, là mô hình mạnh nhất mà bạn thực sự có thể sở hữu — tải file về, chạy trên GPU của chính bạn, tinh chỉnh nó, đặt nó sau tường lửa, và không bao giờ phải nghĩ về biểu giá nhà cung cấp nữa. Mọi thứ khác trong so sánh này — khoảng cách trần mười lăm điểm, chênh lệch giá gấp bảy lần, chênh lệch đa phương thức — đều chỉ là chi tiết dưới một sự thật hợp đồng duy nhất đó.
Giấy phép chính là đặc tả
Hãy bắt đầu với những gì mỗi mô hình cho phép bạn làm, vì điều đó chi phối mọi con số khác. Trọng số của GLM-5.2 được cấp phép MIT, đây là mức cho phép rộng rãi nhất trong phổ trọng số mở: không hạn chế sử dụng thương mại, không hạn chế sửa đổi, không bắt buộc phải chia sẻ các thay đổi của bạn. Đây là mô hình hỗn hợp chuyên gia với khoảng 753 tỷ tham số, trong đó có khoảng 40 tỷ tham số hoạt động, điều này trên thực tế có nghĩa là một cam kết hạ tầng nghiêm túc nhưng có giới hạn — khoảng 1,5TB ở định dạng BF16, có thể chạy trên một nút đa GPU. Bạn cũng có thể chỉ cần sử dụng nó dưới dạng dịch vụ lưu trữ, trên API của chính Zhipu và trên OrcaRouter, và bỏ qua hoàn toàn phần cứng.
Claude Fable 5.1 không mang lại bất kỳ điều nào trong số đó. Đây là một dịch vụ có lớp bảo vệ an toàn — Anthropic phân phối nó như diện mạo phổ biến rộng rãi của các trọng số lớp Mythos, cùng mô hình nền tảng hỗ trợ Claude Mythos 5.1 có kiểm soát dành cho các tổ chức an ninh mạng và khoa học sự sống đã được thẩm định. Bạn có được năng lực, các biện pháp bảo vệ và những cải tiến liên tục, và bạn từ bỏ tệp tin. Đối với một startup muốn tiến nhanh, sự đánh đổi đó là chấp nhận được. Đối với một ngân hàng, một nhà thầu quốc phòng, hoặc bất kỳ ai có dữ liệu không thể rời khỏi VPC riêng của họ, phương án đóng có thể bị loại ngay từ trước khi các điểm chuẩn được thảo luận.
Khoảng cách năng lực, được đo lường
Trên chỉ số độc lập, khoảng cách là không thể bàn cãi. Claude Fable 5.1 dẫn đầu ở mức 66 (max effort) — điểm số cao nhất mà Artificial Analysis từng ghi nhận — trong khi GLM-5.2 đạt 51, con số giúp nó trở thành mô hình trọng số mở dẫn đầu tại thời điểm ra mắt. Khoảng cách thu hẹp lại trong các cấu hình mặc định của AA, nơi cài đặt dự phòng mặc định của Claude Fable 5.1 ghi 53 so với 51 của GLM-5.2, vì vậy cách đọc trung thực là khoảng cách trần rộng và khoảng cách phục vụ hẹp. Trên các benchmark tác nhân do Anthropic công bố, chênh lệch mở rộng sang một đẳng cấp khác hẳn: 52,6% trên Terminal-Bench-Science 0.1 và 55,8% trên Terminal-Bench 4.0 là những con số mà hiện chưa mô hình trọng số mở nào tiến gần tới.
Điểm mạnh thực sự của GLM-5.2 hẹp hơn nhưng rất thực chất. Đây là mô hình open-weights đầu tiên vươn lên dẫn đầu một đấu trường thiết kế và frontend lớn, xếp hạng #1 trên Design Arena với Elo 1.360, vượt qua Claude Fable 5 — một kết quả từ đấu trường của nhà cung cấp, nhưng là kết quả cụ thể trong một lĩnh vực mà các mô hình mở hiếm khi dẫn đầu. Zhipu báo cáo 62.1 trên SWE-bench Pro — con số tốt nhất cho các mô hình open-weights tại thời điểm phát hành — và GLM-5.2 tự xử lý tốt các tác vụ lập trình thông thường cũng như sinh dữ liệu có cấu trúc. Tóm lại một cách trung thực: GLM-5.2 là mô hình open-weights rất mạnh về lập trình và sinh dữ liệu, đã thu hẹp gần hết khoảng cách so với thế hệ Claude trước đó, còn Claude Fable 5.1 lại ở một đẳng cấp cao hơn hẳn ở các bài toán suy luận khó nhất và các tác vụ tác tử (agentic) dài hơi.
Bảng thông số kỹ thuật, đặt cạnh nhau
• Giá — Claude Fable 5.1 $10.00 / $50.00 mỗi 1M so với GLM-5.2 $1.40 / $4.40 mỗi 1M trên Z.AI (cache read $0.26). Rẻ hơn khoảng 7 lần ở đầu vào và 11 lần ở đầu ra.
• Giấy phép — Claude Fable 5.1 đóng, chỉ dùng qua API so với GLM-5.2 trọng số mở theo MIT trên Hugging Face, có thể tự lưu trữ.
• Quy mô — Trọng số của Claude Fable 5.1 không được tiết lộ so với GLM-5.2 tổng 753B / ~40B MoE hoạt động, ~1.5TB ở định dạng BF16.
• Ngữ cảnh / đầu ra tối đa — cả hai đều có ngữ cảnh 1M token và đầu ra tối đa ~128K.
• Đầu vào — Claude Fable 5.1 nhận văn bản và hình ảnh; GLM-5.2 chỉ nhận văn bản.
Điểm số độc lập — Claude Fable 5.1 đạt 66 trên AA Intelligence Index (tối đa) so với GLM-5.2 đạt 51, điểm số cao nhất trong nhóm open-weights tại thời điểm phát hành.


Cái giá thực sự của mỗi lựa chọn
Ví dụ về hóa đơn hàng tháng làm rõ sự đánh đổi giữa thuê và sở hữu. Lấy 100 triệu token đầu vào và 20 triệu token đầu ra trong một tháng — một khối lượng công việc lập trình bận rộn, không có gì đặc biệt. Với giá niêm yết của Claude Fable 5.1, đó là 1.000 đô la cho đầu vào và 1.000 đô la cho đầu ra: 2.000 đô la. Với mức giá lưu trữ của GLM-5.2, đó là 140 đô la cho đầu vào và 88 đô la cho đầu ra: khoảng 228 đô la — chênh lệch gần gấp chín lần trên cùng khối lượng token, trước khi áp dụng chiết khấu bộ nhớ cache ở cả hai bên. Nhân với một năm, khoảng cách này đủ để tài trợ cho rất nhiều cơ sở hạ tầng.
Việc sở hữu mô hình thay đổi những chi phí bạn nhìn thấy nhưng không xóa bỏ chúng. Một GLM-5.2 tự lưu trữ thay thế hóa đơn tính theo token bằng GPU, điện năng và một đội ngũ suy luận, và với một mô hình có quy mô này, khoản mục phần cứng là có thực — nhưng đó là chi phí cố định được khấu hao, không tăng tuyến tính theo mức sử dụng của bạn, và đi kèm với khả năng kiểm soát dữ liệu mà không API nào có thể sánh được. Hai lựa chọn này không phải là "Anthropic đắt đỏ so với Zhipu rẻ tiền"; chúng là một quyết định chi phí vận hành và một quyết định chi phí vốn mang trên mình những tấm thẻ giá.
Khi lựa chọn mở thực sự chiến thắng
Chọn GLM-5.2 khi khối lượng công việc cao và tác vụ đã được hiểu rõ — hỗ trợ viết mã quy mô lớn, trích xuất có cấu trúc, các pipeline tạo sinh nơi mô hình đóng vai trò là cỗ máy làm việc hơn là người suy nghĩ. Chọn nó khi quy định về chủ quyền dữ liệu loại trừ hoàn toàn API, khi bạn cần tinh chỉnh trên mã nguồn độc quyền, hoặc khi bạn muốn một mô hình mà không nhà cung cấp nào có thể thu hồi trọng số. Kết quả design-arena là lời nhắc rằng trong các lĩnh vực cụ thể, được xác định phạm vi rõ ràng, một mô hình mở có thể dẫn đầu hoàn toàn, và giấy phép MIT có nghĩa là bất kỳ lợi thế nào bạn tìm thấy đều là của bạn để giữ.
Khi nó không
Hãy chọn Claude Fable 5.1 khi tác vụ nằm ở trần suy luận — nghiên cứu tự động, các agent tầm xa, những công việc mà một mô hình bỏ cuộc sớm sẽ làm hỏng toàn bộ quá trình — hoặc khi bạn cần đầu vào hình ảnh, điều mà GLM-5.2 không hỗ trợ. Hãy chọn nó khi bạn muốn có vùng an toàn và nhịp độ nâng cấp của một nhà cung cấp đang tích cực cải thiện sản phẩm chủ lực của họ, và khi bạn thà trả tiền theo token còn hơn tự vận hành GPU. Và nếu bạn chưa chắc chắn, cơ chế định tuyến sẽ giải quyết điều đó mà không cần lựa chọn vĩnh viễn: GLM-5.2 và Claude Fable 5.1 đều có trên OrcaRouter với giá niêm yết của nhà cung cấp không cộng thêm phụ phí, vì vậy bạn có thể gửi khối lượng công việc lớn cho GLM-5.2, chuyển các tác vụ khó lên Claude Fable 5.1, và điều chỉnh tỷ lệ phân chia khi kết quả đánh giá của bạn quay về — đồng thời vẫn giữ tùy chọn tự lưu trữ GLM-5.2 sau này nếu khối lượng công việc đến mức đáng để đầu tư phần cứng.

So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
