Thẻ tiêu đề được tạo hiển thị "GPT-6 vs Claude Fable 5.1", kèm một chip ghi "Cả hai: $10.00 vào / $50.00 ra mỗi triệu" và một chip ghi "AA Coding: Fable 5.1 81.6 vs GPT-6 Astra 76.9", cùng phần chân trang ghi "Chỉ số theo Artificial Analysis; bảng giá lấy từ trang của từng nhà cung cấp." Logo OrcaRouter được ghép vào góc dưới bên phải.
Guides & Insights

GPT-6 vs Claude Fable 5.1: Bảng giá thì khớp, còn bảng xếp hạng lập trình thì không

Tác giả

Alistair Wren

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

GPT-6 và Claude Fable 5.1 có mức giá niêm yết giống hệt nhau: 10,00 USD cho mỗi triệu token đầu vào và 50,00 USD cho mỗi triệu token đầu ra. Đó là toàn bộ phần dễ dàng. Hai cái tên này không cùng loại — GPT-6 là một họ gồm ba mô hình mà không có endpoint gpt-6 nào đứng sau nó, còn Claude Fable 5.1 là một mô hình có thể cân đo được với một bảng giá duy nhất — nên việc giá khớp nhau chẳng cho bạn biết được gì nhiều cho đến khi bạn xác định thành viên nào của họ GPT-6 đang đưa ra câu trả lời. Trên bảng xếp hạng quan trọng nhất đối với hạng đấu này, Fable 5.1 đứng đầu và không có mô hình GPT-6 nào.

GPT-6 nào xuất hiện trong so sánh này

Bắt đầu với cách đặt tên, vì nó quyết định câu trả lời. OpenAI phát hành thế hệ GPT-6 dưới dạng ba model id riêng biệt: GPT-6 Astra ở vị trí cao nhất, GPT-6 Sol ở giữa và GPT-6 Luna ở vị trí thấp nhất. Không có model nào tên là GPT-6 mà bạn có thể gọi. Hãy yêu cầu openai/gpt-6 trên bất kỳ gateway nào và bạn sẽ nhận được 404, không phải một completion.

Chỉ một trong ba sản phẩm có bảng giá $10.00 / $50.00 khớp với Claude Fable 5.1, và đó là Astra. Sol có giá bằng một phần năm, ở mức $2.00 / $10.00, còn Luna bằng một phần trăm mức đó, ở mức $0.10 / $0.50. Vậy nên "GPT-6 vs Claude Fable 5.1" thực ra là "GPT-6 Astra vs Claude Fable 5.1" nếu bạn cứ khăng khăng so sánh các bảng giá tương đương — và cặp đối đầu cụ thể đó không còn là cặp đáng chú ý nữa, vì một lý do chỉ xuất hiện vào cuối tháng Chín.

Phía Anthropic không có sự mơ hồ như vậy. Claude Fable 5.1 là một mô hình duy nhất, ra mắt ngày 1 tháng 9 năm 2026, với cửa sổ ngữ cảnh 1.000.000 token, giới hạn đầu ra 128.000 token, và đầu vào dạng văn bản, hình ảnh cùng tệp. Nó được cung cấp dưới model id anthropic/claude-fable-5.1. Việc báo giá cho "Fable 5.1" là rõ ràng theo một cách mà việc báo giá cho "GPT-6" không bao giờ có được.

Fable 5.1 thực sự dẫn trước ở đâu, và dẫn trước bao nhiêu

Khoảng cách quyết định sự so sánh này không phải là chỉ số tổng quát. Mà là bảng lập trình. Đọc từ Artificial Analysis và được ghi trong danh mục Orca cho từng mô hình vào ngày 8 tháng 10 năm 2026:

• AA Coding Index — Claude Fable 5.1 81,6, xếp thứ 1 trong số các mô hình trên bảng xếp hạng đó; GPT-6 Astra 76,9, xếp thứ 4
• AA Intelligence Index — Claude Fable 5.1 53,4, hạng 8; GPT-6 Astra 52,7, hạng 9
• GPQA Diamond — Claude Fable 5.1 93,7 so với GPT-6 Astra 96,1
• Humanity's Last Exam — Claude Fable 5.1 59,1 so với GPT-6 Astra 54,7
• SciCode — Claude Fable 5.1 63,1 so với GPT-6 Astra 56,5
• Terminal-Bench v2.1 — Claude Fable 5.1 91,4 so với GPT-6 Astra 88,4
• Terminal-Bench v4.0 — Claude Fable 5.1 52,0 so với GPT-6 Astra 59,1
• Khả năng ghi nhớ ngữ cảnh dài — Claude Fable 5.1 85,3 so với GPT-6 Astra 80,7
• Ngữ cảnh và đầu ra — đầu vào 1.000.000 token đối với Fable 5.1 so với 1.050.000 đối với Astra; đầu ra 128.000 token ở cả hai

Quy luật không phải là “một mô hình thì tốt hơn”. Fable 5.1 thắng hai bảng tương ứng với viết lách và công việc phần mềm dài hạn — SciCode và Terminal-Bench 2.1 — còn Astra thắng Terminal-Bench 4.0 và GPQA Diamond. Fable 5.1 có mức dẫn trước 4,4 điểm trên Humanity's Last Exam và 4,6 điểm trên khả năng ghi nhớ ngữ cảnh dài. Trên chỉ số tổng quát, hai mô hình cách nhau 0,7 điểm, nằm trong ngưỡng nhiễu mà bạn có thể mong đợi từ một lần làm mới benchmark.

Một lưu ý áp dụng cho mọi con số so sánh giữa các mô hình trong bài viết này, và đáng để nói thẳng ra hơn là chôn vùi nó: Artificial Analysis không đảm bảo rằng hai trang mô hình được hiển thị dựa trên cùng một bản sửa đổi chỉ số trong cùng một ngày, và hiện nó tách các nhóm ngang hàng — mô hình trọng số mở được xếp hạng với mô hình trọng số mở cùng lớp kích thước, còn mô hình độc quyền với một dải giá độc quyền. Điểm số đọc từ trang này và điểm số đọc từ trang khác chỉ mang tính chỉ báo, không phải phép đo có kiểm soát. Cả hai con số ở trên đều đến từ cùng một đơn vị đánh giá, nhưng hãy coi những khác biệt dưới một điểm là hướng đi thay vì độ chính xác.

Biến chứng đã đến vào ngày 29 tháng 9.

Nếu bạn định giá so sánh này cách đây một tháng, bạn hẳn đã chọn Astra, chấp nhận mức thua kém 4.7 về lập trình và trả $10.00 / $50.00 cho nó. Đó không còn là lựa chọn hiển nhiên nữa, bởi vì GPT-6 Sol đã xuất hiện — ra mắt ngày 29 tháng 9 năm 2026, ba tuần sau Astra và một tuần sau phần còn lại của dòng sản phẩm.

GPT-6.1 Sol đạt 51.8 trên cùng Artificial Analysis Intelligence Index, so với 52.7 của Astra, và nó được niêm yết ở mức $2.00 / $10.00 — một phần năm biểu giá của Astra. Nó cũng không phải là người dẫn đầu bảng xếp hạng lập trình; nó thừa hưởng cùng dáng vẻ kém Astra một điểm thay vì thu hẹp khoảng cách với Fable 5.1. Nhưng nó thay đổi bài toán kinh tế của quyết định. Nếu lý do bạn tìm đến một mô hình có đầu ra $50 là "Tôi cần suy luận tiên tiến cho một nhiệm vụ khó", thì GPT-6.1 Sol giờ đây trả lời phần lớn điều đó với một phần mười chi phí đầu ra. Nếu lý do cụ thể là "Tôi cần chỉ số lập trình tốt nhất trong phòng", thì không mô hình GPT-6 nào trả lời được điều đó, và lời khuyên trung thực là hãy giữ Fable 5.1.

Điều đáng xác định rõ ràng: OpenAI chưa từng công bố kết quả đối đầu giữa GPT-6 Astra và Claude Fable 5.1, và Anthropic cũng chưa công bố so sánh Fable-5.1 với GPT-6. Mọi con số đối chiếu giữa các nhà cung cấp trong bài này hoặc là số liệu của một đơn vị đánh giá độc lập, hoặc là kết quả benchmark do chính nhà cung cấp thực hiện trên mô hình của mình. Không có nội dung nào ở đây là một cuộc chạy đối đầu trực tiếp do một trong hai bên thực hiện.

Hóa đơn, chứ không phải nhãn dán.

Những bảng giá giống hệt nhau không tạo ra những hóa đơn giống hệt nhau, bởi vì các đồng hồ đo bên dưới chúng khác nhau.

• Đầu vào được lưu trong bộ nhớ đệm, Fable 5.1 — 0,25 đô la mỗi triệu đơn vị trên bảng niêm yết OrcaRouter, mức giảm giá 97,5% so với giá đầu vào
• Đầu vào được lưu trong bộ nhớ đệm, GPT-6 Astra — 1,00 đô la mỗi triệu đơn vị, mức giảm giá 90%
• Ghi bộ nhớ đệm — Fable 5.1 12,50 đô la mỗi triệu đơn vị, GPT-6 Astra 12,50 đô la mỗi triệu đơn vị, hoàn toàn ngang bằng
• Trên 272.000 token đầu vào — Astra tính lại toàn bộ yêu cầu thành 20,00 đô la vào / 75,00 đô la ra; Fable 5.1 không có bước tương đương trên con số mà danh mục cung cấp
• Lưu lượng, 7 ngày qua — Fable 5.1 1,73 triệu token; GPT-6 Astra 76,2 triệu token
• Thời gian trung vị đến token đầu tiên — Fable 5.1 4.055 ms; GPT-6 Astra 3.500 ms
• Tốc độ đầu ra trung vị — Fable 5.1 90,1 token/giây; GPT-6 Astra 70,4 token/giây

Dòng cache là yếu tố quyết định chi phí trên một khối lượng công việc có dạng Fable 5.1. Một lần chạy agent dài gửi lại cùng một ngữ cảnh repository 200.000 token hai mươi lần sẽ trả $0.25 mỗi triệu token cho phần được cache thay vì $10.00 — rẻ hơn một bậc so với mức đọc cache $1.00 của Astra. Với dạng yêu cầu đó, tấm thẻ giá niêm yết tưởng như giống hệt nhau lại không hề giống nhau chút nào, và lợi thế lập trình của Fable 5.1 đi kèm với một cách sử dụng nó rẻ hơn.

Mốc 272K lại gây tác động ngược lại đối với Astra. Mọi yêu cầu vượt qua mốc này sẽ được tính lại giá từ token đầu tiên, vì vậy một prompt 300.000 token trên Astra sẽ được tính phí ở mức $20,00 / $75,00 cho toàn bộ, chứ không chỉ cho 28.000 token vượt mốc. Trên một mô hình tiết kiệm, mốc đó chỉ là một sai số làm tròn; nhưng ở mức đầu vào $10,00, nó chính là sự khác biệt giữa một yêu cầu $3,00 và một yêu cầu $6,00.

Chạy cả hai mà không chọn trước người thắng cuộc

Phiên bản thực tế của so sánh này là bạn có thể sẽ muốn cả hai, và bạn muốn có thể chuyển đổi giữa chúng theo từng yêu cầu thay vì theo từng quý. Cả Claude Fable 5.1 và mọi mô hình GPT-6 đang hoạt động đều nằm trong cùng một danh mục OrcaRouter — một API đứng trước hơn 200 mô hình, giá niêm yết của nhà cung cấp được chuyển nguyên với mức markup 0%, nên khi nhà cung cấp thay đổi giá thì ở đây có hiệu lực ngay trong cùng ngày thay vì vào hóa đơn tiếp theo của bạn — và DSL định tuyến cho phép bạn chia lưu lượng theo kích thước yêu cầu hoặc theo tỷ lệ. Cách bố trí phù hợp với cặp này là tách theo kích thước: gửi các yêu cầu ngắn, dạng lập trình đến Claude Fable 5.1 và định tuyến công việc ngữ cảnh dài, thứ sẽ kích hoạt bậc 272K của Astra, đến một mô hình mà bảng giá không có bậc nào, rồi mở rộng phần nào mà đánh giá của chính bạn ưu tiên.

Chuyển đổi dự phòng tự động giữa các nhà cung cấp là nửa còn lại của câu chuyện đó. Không mô hình nào trong số này miễn nhiễm với một buổi chiều tồi tệ, và một tuyến đường bị suy giảm giữa chừng không phải là điều bạn muốn phát hiện ra từ lời phàn nàn của khách hàng.

A generated two-column comparison scoreboard titled "GPT-6 Astra vs Claude Fable 5.1 — the scoreboard". The left column, GPT-6 Astra, reads Input $10.00, Output $50.00, AA Intelligence 52.7, AA Coding 76.9, Context 1,050,000, Cached input $1.00. The right column, Claude Fable 5.1, reads Input $10.00, Output $50.00, AA Intelligence 53.4, AA Coding 81.6, Context 1,000,000, Cached input $0.25. A footer line reads "Index figures per Artificial Analysis; rate cards per each vendor page, read 8 Oct 2026." The OrcaRouter logo is composited in the bottom-right corner.

Mỗi bên dùng để làm gì, mỗi bên một dòng

Claude Fable 5.1 là mô hình lập trình tốt nhất trên bảng xếp hạng độc lập và được định giá ở phân khúc cao cấp, với mức đọc từ bộ nhớ đệm rẻ nhất trong số mọi mô hình thuộc phân khúc này. Dòng GPT-6 không có thành viên nào vượt qua nó về lập trình, và thành viên dùng chung bảng giá với nó — Astra — lại là lựa chọn mà hiện giờ bạn ít có khả năng chọn nhất, vì GPT-6.1 Sol đạt chỉ trong vòng một điểm so với chỉ số của Astra với chi phí bằng một phần năm.

Vậy nên câu trả lời cho "GPT-6 vs Claude Fable 5.1" hoàn toàn phụ thuộc vào việc bạn đang nói đến GPT-6 nào. Nếu ý bạn là mẫu chủ lực của dòng này, Fable 5.1 thắng trên bảng xếp hạng lập trình nhưng thua về giá trên mỗi câu trả lời so với một mô hình thấp hơn một bậc. Nếu ý bạn là cả dòng nói chung, thì lựa chọn đáng giá nhất hiện tại ở phía OpenAI trong cặp so sánh này là GPT-6.1 Sol với mức $2.00 / $10.00 — và nó vẫn không phải là mô hình dẫn đầu về lập trình. Các bảng giá thì khớp nhau. Còn các bảng xếp hạng thì không.

Screenshot of the OrcaRouter model page for anthropic/claude-fable-5.1, showing the Anthropic vendor label, a 2026-09-01 catalogue release date, a 1,000,000-token context window, a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, and a rate strip reading $10.00 per million input, $50.00 per million output, a 4.05 s median time to first token, a 10.00 s p95, and 1.7M tokens routed in seven days.Screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the OpenAI vendor label, a 2026-09-04 catalogue release date, a 1,050,000-token context window (shown as ctx 1M tokens), a 128K maximum output, text, image and file input with Vision, Tools, JSON and Reasoning badges, a 'Best for reasoning, coding, agentic' tag row, and a rate strip reading $10.00 per million input, $50.00 per million output, a 3.50 s median time to first token, a 10.00 s p95, and 76.2M tokens routed in seven days.

So sánh trong bài viết này2

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày