Thẻ tiêu đề chính cho 'Claude Fable 5.1 vs GLM-5.2', phụ đề 'Thuê đỉnh bảng xếp hạng, hoặc sở hữu flagship mở', với hai thẻ bo tròn — bên trái 'Claude Fable 5.1' (API đóng, $10.00 / $50.00 mỗi 1M, chỉ số AA 66) và bên phải 'GLM-5.2' (trọng số mở MIT, $1.40 / $4.40 mỗi 1M, tự lưu trữ) — một bong bóng VS giữa chúng, và logo OrcaRouter ở góc dưới bên phải.
Guides & Insights

Claude Fable 5.1 vs GLM-5.2: Thuê đỉnh bảng xếp hạng, hay sở hữu flagship mở cuối cùng

Tác giả

Gideon Frost

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Câu hỏi đằng sau mọi so sánh giữa mô hình đóng và mô hình mở không thực sự là "mô hình nào đạt điểm cao hơn" — mà là ai kiểm soát nền tảng bạn đang xây dựng trên đó. Claude Fable 5.1, mô hình chủ lực của Anthropic phát hành ngày 1 tháng 9 năm 2026, hiện đang đứng đầu Chỉ số Trí tuệ Artificial Analysis với 66 điểm, và bạn chỉ có thể thuê nó: trọng số đóng, API đóng, an toàn và giá cả đều do Anthropic kiểm soát. GLM-5.2, mô hình chủ lực trọng số mở của Zhipu phát hành ngày 16 tháng 6 năm 2026 với trọng số được cấp phép MIT trên Hugging Face, là mô hình mạnh nhất mà bạn thực sự có thể sở hữu — tải file về, chạy trên GPU của chính bạn, tinh chỉnh nó, đặt nó sau tường lửa, và không bao giờ phải nghĩ về biểu giá nhà cung cấp nữa. Mọi thứ khác trong so sánh này — khoảng cách trần mười lăm điểm, chênh lệch giá gấp bảy lần, chênh lệch đa phương thức — đều chỉ là chi tiết dưới một sự thật hợp đồng duy nhất đó.

Giấy phép chính là đặc tả

Hãy bắt đầu với những gì mỗi mô hình cho phép bạn làm, vì điều đó chi phối mọi con số khác. Trọng số của GLM-5.2 được cấp phép MIT, đây là mức cho phép rộng rãi nhất trong phổ trọng số mở: không hạn chế sử dụng thương mại, không hạn chế sửa đổi, không bắt buộc phải chia sẻ các thay đổi của bạn. Đây là mô hình hỗn hợp chuyên gia với khoảng 753 tỷ tham số, trong đó có khoảng 40 tỷ tham số hoạt động, điều này trên thực tế có nghĩa là một cam kết hạ tầng nghiêm túc nhưng có giới hạn — khoảng 1,5TB ở định dạng BF16, có thể chạy trên một nút đa GPU. Bạn cũng có thể chỉ cần sử dụng nó dưới dạng dịch vụ lưu trữ, trên API của chính Zhipu và trên OrcaRouter, và bỏ qua hoàn toàn phần cứng.

Claude Fable 5.1 không mang lại bất kỳ điều nào trong số đó. Đây là một dịch vụ có lớp bảo vệ an toàn — Anthropic phân phối nó như diện mạo phổ biến rộng rãi của các trọng số lớp Mythos, cùng mô hình nền tảng hỗ trợ Claude Mythos 5.1 có kiểm soát dành cho các tổ chức an ninh mạng và khoa học sự sống đã được thẩm định. Bạn có được năng lực, các biện pháp bảo vệ và những cải tiến liên tục, và bạn từ bỏ tệp tin. Đối với một startup muốn tiến nhanh, sự đánh đổi đó là chấp nhận được. Đối với một ngân hàng, một nhà thầu quốc phòng, hoặc bất kỳ ai có dữ liệu không thể rời khỏi VPC riêng của họ, phương án đóng có thể bị loại ngay từ trước khi các điểm chuẩn được thảo luận.

Khoảng cách năng lực, được đo lường

Trên chỉ số độc lập, khoảng cách là không thể bàn cãi. Claude Fable 5.1 dẫn đầu ở mức 66 (max effort) — điểm số cao nhất mà Artificial Analysis từng ghi nhận — trong khi GLM-5.2 đạt 51, con số giúp nó trở thành mô hình trọng số mở dẫn đầu tại thời điểm ra mắt. Khoảng cách thu hẹp lại trong các cấu hình mặc định của AA, nơi cài đặt dự phòng mặc định của Claude Fable 5.1 ghi 53 so với 51 của GLM-5.2, vì vậy cách đọc trung thực là khoảng cách trần rộng và khoảng cách phục vụ hẹp. Trên các benchmark tác nhân do Anthropic công bố, chênh lệch mở rộng sang một đẳng cấp khác hẳn: 52,6% trên Terminal-Bench-Science 0.1 và 55,8% trên Terminal-Bench 4.0 là những con số mà hiện chưa mô hình trọng số mở nào tiến gần tới.

Điểm mạnh thực sự của GLM-5.2 hẹp hơn nhưng rất thực chất. Đây là mô hình open-weights đầu tiên vươn lên dẫn đầu một đấu trường thiết kế và frontend lớn, xếp hạng #1 trên Design Arena với Elo 1.360, vượt qua Claude Fable 5 — một kết quả từ đấu trường của nhà cung cấp, nhưng là kết quả cụ thể trong một lĩnh vực mà các mô hình mở hiếm khi dẫn đầu. Zhipu báo cáo 62.1 trên SWE-bench Pro — con số tốt nhất cho các mô hình open-weights tại thời điểm phát hành — và GLM-5.2 tự xử lý tốt các tác vụ lập trình thông thường cũng như sinh dữ liệu có cấu trúc. Tóm lại một cách trung thực: GLM-5.2 là mô hình open-weights rất mạnh về lập trình và sinh dữ liệu, đã thu hẹp gần hết khoảng cách so với thế hệ Claude trước đó, còn Claude Fable 5.1 lại ở một đẳng cấp cao hơn hẳn ở các bài toán suy luận khó nhất và các tác vụ tác tử (agentic) dài hơi.

Bảng thông số kỹ thuật, đặt cạnh nhau

• Giá — Claude Fable 5.1 $10.00 / $50.00 mỗi 1M so với GLM-5.2 $1.40 / $4.40 mỗi 1M trên Z.AI (cache read $0.26). Rẻ hơn khoảng 7 lần ở đầu vào và 11 lần ở đầu ra.

• Giấy phép — Claude Fable 5.1 đóng, chỉ dùng qua API so với GLM-5.2 trọng số mở theo MIT trên Hugging Face, có thể tự lưu trữ.

• Quy mô — Trọng số của Claude Fable 5.1 không được tiết lộ so với GLM-5.2 tổng 753B / ~40B MoE hoạt động, ~1.5TB ở định dạng BF16.

• Ngữ cảnh / đầu ra tối đa — cả hai đều có ngữ cảnh 1M token và đầu ra tối đa ~128K.

• Đầu vào — Claude Fable 5.1 nhận văn bản và hình ảnh; GLM-5.2 chỉ nhận văn bản.

Điểm số độc lập — Claude Fable 5.1 đạt 66 trên AA Intelligence Index (tối đa) so với GLM-5.2 đạt 51, điểm số cao nhất trong nhóm open-weights tại thời điểm phát hành.

A two-column scoreboard titled 'Claude Fable 5.1 vs GLM-5.2 — the scoreboard'. Left column 'Claude Fable 5.1': 'Price $10.00 / $50.00 per 1M', 'License closed, API only', 'AA Intelligence Index 66 (max)', 'Inputs text + image', 'Agentic science 52.6% (vendor)', 'Released Sep 1, 2026'. Right column 'GLM-5.2': 'Price $1.40 / $4.40 per 1M', 'License MIT, weights on Hugging Face', 'AA Intelligence Index 51', 'Inputs text only', 'SWE-bench Pro 62.1 (vendor, top open)', 'Released Jun 16, 2026'. Footer: 'AA per Artificial Analysis; component benchmarks vendor-reported, unreproduced.'Screenshot of the Artificial Analysis model page for Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback), captured September 10, 2026, showing a #1-of-201 ranking, an Intelligence Index of 53 for the default-fallback configuration, pricing of $10.00 per 1M input and $50.00 per 1M output with a 98% cache discount, a cost of $7.63 per Intelligence Index task, and 190M output tokens against a 92M median.

Cái giá thực sự của mỗi lựa chọn

Ví dụ về hóa đơn hàng tháng làm rõ sự đánh đổi giữa thuê và sở hữu. Lấy 100 triệu token đầu vào và 20 triệu token đầu ra trong một tháng — một khối lượng công việc lập trình bận rộn, không có gì đặc biệt. Với giá niêm yết của Claude Fable 5.1, đó là 1.000 đô la cho đầu vào và 1.000 đô la cho đầu ra: 2.000 đô la. Với mức giá lưu trữ của GLM-5.2, đó là 140 đô la cho đầu vào và 88 đô la cho đầu ra: khoảng 228 đô la — chênh lệch gần gấp chín lần trên cùng khối lượng token, trước khi áp dụng chiết khấu bộ nhớ cache ở cả hai bên. Nhân với một năm, khoảng cách này đủ để tài trợ cho rất nhiều cơ sở hạ tầng.

Việc sở hữu mô hình thay đổi những chi phí bạn nhìn thấy nhưng không xóa bỏ chúng. Một GLM-5.2 tự lưu trữ thay thế hóa đơn tính theo token bằng GPU, điện năng và một đội ngũ suy luận, và với một mô hình có quy mô này, khoản mục phần cứng là có thực — nhưng đó là chi phí cố định được khấu hao, không tăng tuyến tính theo mức sử dụng của bạn, và đi kèm với khả năng kiểm soát dữ liệu mà không API nào có thể sánh được. Hai lựa chọn này không phải là "Anthropic đắt đỏ so với Zhipu rẻ tiền"; chúng là một quyết định chi phí vận hành và một quyết định chi phí vốn mang trên mình những tấm thẻ giá.

Khi lựa chọn mở thực sự chiến thắng

Chọn GLM-5.2 khi khối lượng công việc cao và tác vụ đã được hiểu rõ — hỗ trợ viết mã quy mô lớn, trích xuất có cấu trúc, các pipeline tạo sinh nơi mô hình đóng vai trò là cỗ máy làm việc hơn là người suy nghĩ. Chọn nó khi quy định về chủ quyền dữ liệu loại trừ hoàn toàn API, khi bạn cần tinh chỉnh trên mã nguồn độc quyền, hoặc khi bạn muốn một mô hình mà không nhà cung cấp nào có thể thu hồi trọng số. Kết quả design-arena là lời nhắc rằng trong các lĩnh vực cụ thể, được xác định phạm vi rõ ràng, một mô hình mở có thể dẫn đầu hoàn toàn, và giấy phép MIT có nghĩa là bất kỳ lợi thế nào bạn tìm thấy đều là của bạn để giữ.

Khi nó không

Hãy chọn Claude Fable 5.1 khi tác vụ nằm ở trần suy luận — nghiên cứu tự động, các agent tầm xa, những công việc mà một mô hình bỏ cuộc sớm sẽ làm hỏng toàn bộ quá trình — hoặc khi bạn cần đầu vào hình ảnh, điều mà GLM-5.2 không hỗ trợ. Hãy chọn nó khi bạn muốn có vùng an toàn và nhịp độ nâng cấp của một nhà cung cấp đang tích cực cải thiện sản phẩm chủ lực của họ, và khi bạn thà trả tiền theo token còn hơn tự vận hành GPU. Và nếu bạn chưa chắc chắn, cơ chế định tuyến sẽ giải quyết điều đó mà không cần lựa chọn vĩnh viễn: GLM-5.2 và Claude Fable 5.1 đều có trên OrcaRouter với giá niêm yết của nhà cung cấp không cộng thêm phụ phí, vì vậy bạn có thể gửi khối lượng công việc lớn cho GLM-5.2, chuyển các tác vụ khó lên Claude Fable 5.1, và điều chỉnh tỷ lệ phân chia khi kết quả đánh giá của bạn quay về — đồng thời vẫn giữ tùy chọn tự lưu trữ GLM-5.2 sau này nếu khối lượng công việc đến mức đáng để đầu tư phần cứng.

Screenshot of the OrcaRouter model page for GLM-5.2 (z-ai/glm-5.2), showing $1.40 per 1M input and $4.40 per 1M output, the 1M-token context window with 128K max output, text-only I/O, and Tools/JSON/Reasoning capability chips.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày