
Claude Fable 5.1 so với Gemini 3.1 Pro: Flagship mới chín ngày so với bản xem trước bảy tháng
- openaiMỚIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleMỚIGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenMỚIQwen: Qwen3.8 Max (0902)2026-09-0240Trí tuệ72Lập trình
- anthropicMỚIAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0340Trí tuệ72Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2134Trí tuệ69Lập trình
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2123Trí tuệ49Lập trình
Hỏi sai câu hỏi về Claude Fable 5.1 và Gemini 3.1 Pro Preview, bạn sẽ nhận được một câu trả lời nhàm chán: mẫu flagship mới của Anthropic mạnh hơn, mẫu của Google rẻ hơn, chốt vấn đề. Câu hỏi thực sự quyết định cuộc đối đầu này là câu hỏi về độ mới. Claude Fable 5.1 được phát hành vào ngày 1 tháng 9 năm 2026, nghĩa là tính đến thời điểm bài viết này, nó mới chín ngày tuổi. Gemini 3.1 Pro Preview được phát hành vào ngày 19 tháng 2 năm 2026 và Google vẫn gắn nhãn preview — điều này khiến nó trở thành một mẫu mô hình đứng yên không đổi trong gần bảy tháng trong khi hàng loạt bản phát hành Gemini mới hơn (các tầng Flash 3.5, 3.6 và 3.7, cùng Gemini 3.8 Flash ra mắt ngày 2 tháng 9) lần lượt được phát hành, chấm điểm và vượt qua nó. So sánh hai mô hình này không giống một bài kiểm tra benchmark mà giống một ván cược vào hai triết lý phát hành rất khác nhau, và khoảng cách về độ mới chính là thứ mà mọi bảng thông số kỹ thuật đều lờ đi.
Bảy tháng xem trước, chín ngày flagship
Gemini 3.1 Pro là mô hình lý luận tiên phong của Google vào tháng 2 — "tiên phong" vào thời điểm đó, với những tuyên bố mạnh mẽ về kỹ thuật phần mềm và khả năng tác nhân, cùng nền tảng đa phương thức gốc vẫn tạo nên sự khác biệt. Google đã không phát hành chính thức (GA) nó kể từ đó. Trong bảy tháng nó nằm ở chế độ xem trước, Anthropic đã tung ra hai thế hệ chủ lực: Claude Opus 5 vào ngày 24 tháng 7, và giờ là Claude Fable 5.1, mà Anthropic định vị ở cấp độ Mythos, trên cả cấp Opus, và đã giành vị trí đầu bảng trong Chỉ số Trí tuệ Artificial Analysis với 66 điểm. Khi bạn chọn Gemini 3.1 Pro, bạn đang mua một mô hình mà Google đã thực sự đưa ra quyết định kế nhiệm ở những nơi khác trong dòng sản phẩm của mình; còn khi bạn chọn Claude Fable 5.1, bạn đang mua mô hình mà Anthropic đang tiếp tục cải tiến.
Sự bất đối xứng đó thể hiện rõ trong phần chữ in nhỏ. Một bản xem trước bị đóng băng mang rủi ro rằng tính năng bạn chuẩn hóa sẽ không bao giờ nhận được sự hoàn thiện GA, sự điều chỉnh lại giá, hay các bản phát hành điểm tiếp theo. Một bản flagship mới ra mắt chín ngày mang rủi ro ngược lại — rằng bản 5.2 hoặc một bản phát hành điểm sẽ ra mắt vào tháng tới và làm thay đổi mục tiêu. Không rủi ro nào có thể tránh được; vấn đề là chúng chỉ theo hai hướng ngược nhau, và rủi ro nào bạn có thể chấp nhận được là một yếu tố đầu vào thực sự cho quyết định này.
Bảng thông số kỹ thuật, đặt cạnh nhau
• Giá — Claude Fable 5.1 $10.00 / $50.00 per 1M so với Gemini 3.1 Pro $2.00 / $12.00 per 1M lên đến 200K token đầu vào, sau đó $4.00 / $18.00 cho trên 200K. Rẻ hơn khoảng 5 lần ở đầu vào và 4 lần ở đầu ra ở mức giá cơ bản.
• Ngữ cảnh / đầu ra tối đa — cả hai đều có ngữ cảnh 1M token; Claude Fable 5.1 xuất ra tối đa 128K so với trần ~65K của Gemini 3.1 Pro.
• Đầu vào — Claude Fable 5.1 hỗ trợ văn bản và hình ảnh. Gemini 3.1 Pro hỗ trợ văn bản, hình ảnh, âm thanh, video và PDF, với khả năng grounding Google Search nguyên bản.
• Điểm số độc lập — Claude Fable 5.1 đạt 66 trên Artificial Analysis Intelligence Index (nỗ lực tối đa) so với Gemini 3.1 Pro ở mức trên 40 (nó ra mắt ở mức 57 và đã giảm dần khi AA chạy lại các bài đánh giá).
• Tốc độ — Gemini 3.1 Pro truyền khoảng 540 token/giây theo dữ liệu đo lường của chính OrcaRouter, so với 67,2 token/giây mà Artificial Analysis đo được cho Claude Fable 5.1 — một khoảng cách thông lượng lớn theo hướng ngược lại.
• Trạng thái — Claude Fable 5.1 ổn định, GA, phát hành 2026-09-01; Gemini 3.1 Pro Preview, phát hành 2026-02-19, chưa được GA tính đến giữa tháng 9 năm 2026.

Bức tranh điểm chuẩn, được gán nhãn một cách trung thực.
Về năng lực thô, hai mô hình không cùng đẳng cấp, và chỉ số độc lập thể hiện điều đó rõ ràng hơn bất kỳ slide nào của hãng. Claude Fable 5.1 đạt 66 trên Artificial Analysis Intelligence Index (nỗ lực tối đa) — mức điểm cao nhất mà AA từng ghi nhận — dù trang mô hình của AA cho cấu hình dự phòng mặc định do Anthropic cung cấp liệt kê 53, vẫn đứng đầu trong 201 mô hình — trong khi Gemini 3.1 Pro nằm ở mức 46–49. Ở các bài benchmark thành phần do Anthropic báo cáo, Fable 5.1 đạt 55,8% trên Terminal-Bench 4.0 và 52,6% trên Terminal-Bench-Science 0.1 — số điểm chưa ai quy cho Gemini 3.1 Pro trong bất kỳ bài kiểm tra độc lập nào. Ở các dòng kết quả kiểu SWE-bench được xác nhận rộng rãi, những tuyên bố hồi tháng 2 của Gemini 3.1 Pro (khoảng 75% trên SWE-bench Verified theo các công cụ theo dõi bên thứ ba) kém xa thế hệ Claude hiện tại.
Lời cảnh báo trung thực lại đi theo chiều ngược lại khi nói đến mọi thứ đa phương thức. Gemini 3.1 Pro đọc được âm thanh gốc, video gốc và PDF, đồng thời có Google Search tích hợp sẵn trong mô hình — những khả năng mà Claude Fable 5.1 hoàn toàn không có, vì mô hình chủ lực của Anthropic chỉ tiếp nhận văn bản và hình ảnh. Trong các tác vụ liên quan đến tài liệu dài, video dài hoặc công việc dựa trên tìm kiếm, Gemini 3.1 Pro không chỉ rẻ hơn; nó còn là mô hình duy nhất trong hai mô hình có thể hoàn thành nhiệm vụ chỉ trong một lần gọi. Đó là một lợi thế thực sự, và thật dễ đánh giá thấp lợi thế này khi mọi điểm chuẩn bạn nhìn vào đều chỉ xoay quanh văn bản và mã nguồn.

Vách đá giá cả che giấu câu chuyện chi phí thực sự.
Giá quảng cáo $2 / $12 của Gemini 3.1 Pro chỉ áp dụng dưới 200K token đầu vào mỗi yêu cầu. Trên mức đó, toàn bộ yêu cầu được định giá lại ở mức $4.00 đầu vào và $18.00 đầu ra — gấp đôi đầu vào, khiến các cuộc gọi Gemini ngữ cảnh dài trở nên kém rẻ hơn nhiều so với con số tiếp thị ngụ ý. Mức $10 / $50 của Claude Fable 5.1 là cố định ở mọi độ dài, với lượt đọc bộ nhớ đệm ở mức $0.25, trở nên rẻ hơn so với giá niêm yết của chính nó khi phiên làm việc càng đọc lại ngữ cảnh. Điểm giao nhau tùy thuộc vào khối lượng công việc: các cuộc gọi đa phương thức ngắn, khối lượng lớn nghiêng hẳn về Gemini 3.1 Pro; các phiên tác tử dài lặp đi lặp lại việc đọc lại một ngữ cảnh lớn lại nghiêng về kinh tế bộ nhớ đệm của Claude Fable 5.1, ngay cả trước khi năng lực được đưa vào tranh luận.
Ai nên chọn cái nào
Chọn Gemini 3.1 Pro khi khối lượng công việc thực sự là đa phương thức hoặc dựa trên tìm kiếm, khi thông lượng ở mức giá thấp quan trọng hơn đỉnh của đường cong suy luận, và khi bạn thoải mái với việc chuẩn hóa dựa trên một mô hình mà Google đã để ở trạng thái preview suốt bảy tháng — lý tưởng là có lộ trình di chuyển đến bất cứ thứ gì Google phát hành GA tiếp theo. Chọn Claude Fable 5.1 khi bạn cần mức trần suy luận hiện tại, khi bạn đang xây dựng các agent dài hạn mà ở đó trần đầu ra 128K và phí đọc cache $0.25 đóng vai trò quan trọng, và khi bạn thà đặt cược vào một mô hình mà nhà cung cấp của nó đang tích cực cải thiện. Cả hai đều có trên OrcaRouter với giá niêm yết của nhà cung cấp, không phụ phí, nên phiên bản routing-DSL của quyết định này rất rẻ để thay đổi sau này: gửi lưu lượng đa phương thức và lưu lượng lớn đến Gemini 3.1 Pro, chuyển lưu lượng suy luận khó và agent lên Claude Fable 5.1, và tinh chỉnh lại tỷ lệ phân chia vào ngày Google cuối cùng cũng phát hành GA tầng Pro — hoặc ngày Anthropic ra mắt bất cứ thứ gì sau Fable 5.1.

So sánh trong bài viết này3
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
