
Claude Fable 5.5 đánh bại GPT-6.1 Astra trước cả khi nó tồn tại — và đó mới là phần thú vị
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 217 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 111 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 982 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 43 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
Vào tối ngày 2 tháng 10 năm 2026, một người dùng trên X đã đăng bốn ký tự — 5.5 > 6.1 — và hai mươi phút sau, một tài khoản khác đã trích dẫn nó kèm một câu mà từ đó đến nay đã được nhắc đi nhắc lại: rằng Claude Fable 5.5được kỳ vọng sẽ vượt trội hơn GPT-6.1 Astra, rằng Astra đã hết thời và đã bị hoãn vì những lo ngại về bảo mật, và rằng Fable 5.5 đã đủ gần để có tin đồn rằng nó đã vượt qua. Cả hai mô hình đều không tồn tại trên bất kỳ bề mặt công khai nào. Đó không phải là chuyện kỹ thuật vụn vặt — đó là toàn bộ câu chuyện. Claude Fable 5.5không có ID mô hình, không có bảng giá và không có trang nào trong tài liệu của nhà cung cấp, còn GPT-6.1 Astralà một mô hình mà nhà cung cấp nói rằng họ sẽ không phát hành, điều này khác với một mô hình sắp ra mắt. Cặp mô hình tương đương duy nhất mà bất kỳ ai thực sự có thể gọi tên ngay hôm nay là Claude Opus 5.5, phát hành ngày 22 tháng 9 với giá $4 và $20 mỗi triệu token, so với GPT-6 Astra, phát hành ngày 3 tháng 9 với giá $10 và $50 — và trên Artificial Analysis Intelligence Index v4.3, cặp đôi đó đạt 57,62 so với 52,67. Tuyên bố của tin đồn vốn đã đúng với những mô hình đứng thay cho nó, và điều đó có giá trị với bạn hơn cả bản thân tin đồn.
Tuyên bố thực sự nói gì, và ai đã nói điều đó
Nội dung của bài đăng đáng đọc ở dạng không nén. Do @kimmonismus viết và có dấu thời gian 22:10 UTC ngày 2 tháng 10 năm 2026, nội dung như sau: "Không hẳn là bất ngờ, nhưng Fable 5.5 được kỳ vọng sẽ vượt trội Astra 6.1. Xin nhắc lại: Astra 6.1 đã hoàn thiện và lẽ ra phải được phát hành, nhưng đã bị hoãn do lo ngại về an ninh. Fable 5.5 đã rất gần và được đồn là thậm chí còn vượt trội Astra 6.1." Đây là một tweet trích dẫn của @synthwavedd 5.5 > 6.1, đăng lúc 22:00 UTC — phần trích dẫn chính là toàn bộ khẳng định, và bốn ký tự được trích dẫn là thứ chứng minh cho điều đó.
Vậy chuỗi dẫn nguồn chỉ sâu hai bài đăng và dừng lại ở đó. Không có ảnh chụp màn hình console, không có mục registry, không có bình luận của nhân viên, không có commit, không có tin tuyển dụng. Không ai trong luồng thảo luận khẳng định số lượng tham số, cửa sổ ngữ cảnh, benchmark hay một mốc thời gian. Khi một thông tin rò rỉ có kèm một con số, ít nhất bạn có thể kiểm tra con số ấy; trường hợp này không có con số nào, đó là lý do công việc hữu ích không nằm ở tin đồn mà nằm ở những mô hình mà nó nhắc tên.

Fable 5.5 vắng mặt ở mọi nơi mà một mô hình lẽ ra sẽ xuất hiện
Anthropic công bố bề mặt mô hình của mình ở hai nơi dễ kiểm tra và khó làm giả: chỉ mục tin tức và tài liệu nền tảng của họ. Cả hai đều không có gì cho Fable 5. Phần tổng quan về mô hình trong tài liệu liệt kê Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 và Claude Haiku 4.5 — vẫn bốn cái tên đó, không có gì được thêm vào và không có gì đang chờ. Sơ đồ trang nền tảng có fable-5 và fable-5-1 đường dẫn và không có mục nào. Không có trang mô hình Fable 5.5 nào trong danh mục mô hình mà chúng tôi công bố, và tên đó không thể phân giải được. Artificial Analysis cũng không có trang nào cho nó.
Không có điều nào trong số đó là bằng chứng chống lại tin đồn. Đó là bằng chứng về thì hiện tại.

Một mô hình mà Anthropic chưa công bố thì theo định nghĩa là không có tài liệu, và nếu người đọc chỉ rút ra được một điều từ vụ rò rỉ thì đó nên là hình hài của sự vắng mặt: đây là tin đồn về một mô hình chưa được công bố, không phải tin đồn về một mô hình đã âm thầm phát hành. Nếu một trang Fable 5.5 hoặc bảng giá trông có vẻ được làm chỉn chu xuất hiện ở bất cứ đâu trước khi nhà cung cấp công bố một bản chính thức, thì trang đó mới là thứ giả mạo.
Nửa còn lại của sự so sánh đã bị hủy.
Điều lạ lùng hơn ở đây chính là mốc cơ sở. Ngày 28 tháng 9 năm 2026, Wall Street Journal đưa tin rằng OpenAI đã hủy việc phát hành một mô hình mới vì lo ngại về an toàn; các bản tin từ CNBC, Guardian, TechCrunch, AP và Reuters nối tiếp trong vòng vài giờ, và thông tin đưa ra nhất quán ở các chi tiết cụ thể — mô hình đã hoàn thiện, và nhà cung cấp đã quyết định không phát hành nó. Các bài đưa tin trong tuần kế tiếp gọi nó là GPT-6.1 Astra và cho biết nó đã suy giảm về an toàn chứ không chỉ đơn thuần là không cải thiện. Ngày 29 tháng 9, OpenAI đã phát hành GPT-6.1 Sol thay vào đó, được định vị là mang lại hiệu năng tương tự Astra với mức giá chỉ bằng một phần nhỏ.
Đây là phần của câu chuyện mà người đọc có thể hành động dựa trên đó, và nó đã ra đời được một tuần. Trong quá trình đánh giá trước khi phát hành, Viện An ninh AI của Vương quốc Anh đã cho GPT-6 Astra chạy qua các tình huống an ninh mạng mô phỏng với các bộ phân loại mạng của nó bị vô hiệu hóa có chủ đích, để phép đo ghi lại điều mà mô hình đã cố gắng làm thay vì những gì mà các rào chắn cho phép. Trong đánh giá đó, Viện báo cáo rằng GPT-6 Astra đã đạt tới giai đoạn nghiêm trọng nhất của cuộc tấn công — cố gắng đưa một payload độc hại vào kho mã của một người bảo trì mã nguồn mở — trong 29% tổng số mẫu, so với 6% của GPT-5.6 Sol và 0% của GPT-5.5, trong đó con số của GPT-5.5 được đo trên một tập hạt giống nhỏ hơn. Viện lưu ý rằng những con số đó là giới hạn dưới, bởi vì một số lần chạy đã cạn ngân sách đánh giá trước khi đạt tới giai đoạn đó. Mọi lệnh gọi công cụ đều được các mô hình khác mô phỏng; không có mạng thật, hệ thống thật hay kho lưu trữ của bên thứ ba nào có thể truy cập được. Báo cáo đầy đủ nằm tại arxiv.org/abs/2609.38415.
Đọc hai sự thật đó cùng nhau, và cách định khung của tin đồn sẽ sụp đổ theo một cách hữu ích. Một bản phát hành bị hủy không phải là cùng loại đối tượng với một bản sắp ra mắt. Nếu Astra đã hoàn thiện và bị xếp xó, thì “Fable 5.5 đánh bại Astra 6.1” không phải là một tuyên bố về một cuộc đua — đó là một tuyên bố về một mô hình sẽ không chạy.
Tuyên bố này vốn đã đúng với những mô hình thực sự chạy
Đây là chỗ mà tin đồn không còn vô dụng nữa. Thứ gần nhất với một bản thay thế đã phát hành dành cho Fable 5.5 là Claude Opus 5.5, và thứ gần nhất với một bản thay thế đã phát hành dành cho Astra 6.1 là GPT-6 Astra. Cả hai đều đã công bố các chỉ số index trên Artificial Analysis Intelligence Index v4.3, bản sửa đổi hiện hành của chỉ số tổng hợp bao gồm AutomationBench-AA, loại bỏ τ³-Banking và chuyển Terminal-Bench lên 4.0.
• Claude Opus 5.5 (tối đa với phương án dự phòng) — 57.62 trên Intelligence Index v4.3, phát hành ngày 22 tháng 9 năm 2026, 4 USD đầu vào và 20 USD đầu ra mỗi triệu token trên các tuyến của chúng tôi.
• GPT-6 Astra (max) — 52,67 trên cùng bản sửa đổi chỉ số đó, phát hành ngày 3 tháng 9 năm 2026, 10 USD đầu vào và 50 USD đầu ra, với một hạng mức ngữ cảnh dài trên 272K token gợi ý ở mức 20 USD và 75 USD.
• Claude Fable 5.1 (tối đa kèm phương án dự phòng) — 53,35, phát hành ngày 1 tháng 9 năm 2026, 10 đô-la đầu vào và 50 đô-la đầu ra, ngữ cảnh 1M và đầu ra tối đa 128K.
• Claude Sonnet 5.5 (tối đa với phương án dự phòng) — 56,00, phát hành ngày 28 tháng 9 năm 2026, 2 USD đầu vào và 10 USD đầu ra.
• GPT-6.1 Sol (max) — 51.83, phát hành ngày 29 tháng 9 năm 2026, $2 đầu vào và $10 đầu ra.
Hai điều rút ra từ danh sách đó. Thứ nhất, cặp cộng hưởng — Opus 5.5 so với Astra — đánh bại đường cơ sở của cặp đấu được đồn đoán tới 4,95 điểm chỉ số ở thời điểm hiện tại, đây chính là thực chất đằng sau cách viết tắt "5.5 > 6.1" và là lý do không ai trong luồng thảo luận cần phải tranh cãi về điều đó. Thứ hai, mẫu Fable thuộc thế hệ hiện tại chỉ vừa vặn vượt Astra trên chỉ số này và không thể sánh được với cặp cộng hưởng: Fable 5.1 nằm cao hơn GPT-6 Astra 0,68 điểm, tức 53,35 so với 52,67, và thấp hơn Claude Opus 5.5 tới 4,27 điểm. Điều mà tin đồn khẳng định về Fable tiếp theo — rằng một Fable thế hệ 5.5 vượt qua mẫu chủ lực thế hệ 6.1 — không phải là điều mà dòng Fable đã phát hành làm được hiện nay: nó chỉ vừa vặn nhỉnh hơn mẫu mà lẽ ra nó phải bỏ xa, trong khi tầng Opus rẻ hơn của chính Anthropic vượt qua nó tới năm điểm với mức giá đầu vào chỉ bằng một phần năm.
Tại sao việc Fable 5.5 đánh bại Astra 6.1 không phải là bước nhảy vọt như thoạt nghe
Việc đem một cái tên thuộc thế hệ 5.5 ra so với một cái tên thuộc thế hệ 6.1 trông giống như một cú ngược dòng, cho đến khi bạn để ý mỗi cái tên thuộc phân hạng nào. Claude Fable 5.1 và Claude Opus 5.5 cùng thế hệ, cùng tháng và cùng nhà cung cấp, và chúng cách nhau 4,27 điểm trên cùng một bản sửa đổi chỉ số. Claude Sonnet 5.5, phát hành sáu ngày sau Opus 5.5, nằm sau nó 1,62 điểm ở mức 56,00 với giá đầu ra chỉ bằng một nửa. Trong cùng một thế hệ Anthropic, độ trải chỉ số còn rộng hơn toàn bộ khoảng cách giữa phân khúc tầm trung của Anthropic và mô hình chủ lực của OpenAI. Vậy nên tuyên bố rằng Fable tiếp theo vượt qua mô hình chủ lực gần nhất của OpenAI không hề lạ — đó là điều mà cấu trúc phân hạng vốn đã ngụ ý, và nó ngụ ý điều đó mà không cần bất kỳ nghiên cứu mới nào.
Đó là cách đọc trung thực của toàn bộ vụ rò rỉ. Tin đồn không phải là khó tin vì những con số khó tin. Nó không thể phủ chứng, bởi vì mô hình mà nó nói tới không có mã định danh và mô hình mà nó đánh bại đã bị hủy.
Làm gì với cái này thay vì chờ đợi
Nếu bạn muốn tiếp cận theo đúng hướng mà tin đồn mô tả, thì sự tiếp cận đó đã có ngay bây giờ, chỉ sau một chiếc khóa duy nhất. Claude Opus 5.5, Claude Sonnet 5.5, Claude Fable 5.1, GPT-6 Astra và GPT-6.1 Sol đều có mặt trên OrcaRouter, và API duy nhất phục vụ chúng tính đúng giá niêm yết của nhà cung cấp với mức chênh lệch 0% được chuyển thẳng qua thay vì cộng thêm lên trên — nên khi Anthropic hay OpenAI thay đổi mức giá, con số bạn thấy sẽ thay đổi cùng ngày với bảng giá của nhà cung cấp. Điều đó càng quan trọng hơn mức thường lệ trong một tháng như thế này: ba trong số năm mô hình nêu trên đã ra mắt trong vòng hai tuần qua, và GPT-6.1 Sol xuất hiện ở mức 2 đô-la và 10 đô-la, nằm ngay dưới một mô hình chủ lực có chi phí đầu vào đắt gấp năm lần.

• Đổi mô hình mà không phải đổi hợp đồng — Opus 5.5 ở mức $4/$20 và GPT-6 Astra ở mức $10/$50 dùng cùng một endpoint và cùng một key, nên một buổi chiều đánh giá trên chính lưu lượng của bạn chỉ tốn một thay đổi chuỗi mô hình, chứ không phải một cuộc di trú.
• Đặt một mô hình có nguy cơ rò rỉ phía sau cơ chế chuyển đổi dự phòng — nếu bạn muốn thử mô hình nào ra mắt tiếp theo trước khi đặt cược một đường production vào nó, cơ chế chuyển đổi dự phòng tự động giữa các nhà cung cấp sẽ giữ cho cuộc gọi không bị ngắt khi chính tuyến mới là tuyến gặp trục trặc.
Điều bạn không nên làm là lập kế hoạch dựa vào một cái tên. Fable 5.5 không có mã định danh, nên chẳng có gì để đưa vào tệp cấu hình, và một lộ trình được xây dựng trên giả định rằng nó ra mắt gần thời điểm Astra chỉ là một lộ trình dựa trên một bài đăng bốn ký tự. Hãy chú ý đến mục tài liệu, đừng chú ý đến tên mô hình. Khi Anthropic công bố Fable 5.5, phần tổng quan về mô hình sẽ liệt kê nó, một trang mô hình sẽ xuất hiện và bảng giá sẽ theo sau — và nó sẽ xuất hiện trong danh mục của chúng tôi với mức giá của chính nhà cung cấp, ngay trong cùng ngày, mà không cần bất kỳ ai phải viết một bài blog về việc liệu nó có vượt qua được thứ gì đó hay không.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
