
Claude Sonnet 5.5 vs Claude Fable 5.1: Mẫu rẻ hơn dẫn trước ba điểm
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 983 tok/s
- openaiMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- openaiMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- anthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- grokMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 196 tok/s
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
Claude Sonnet 5.5 ra mắt vào ngày 28 tháng 9 năm 2026 với mức giá 2,00 USD cho mỗi triệu token đầu vào và 10,00 USD cho mỗi triệu token đầu ra. Claude Fable 5.1, mô hình thuộc lớp Mythos mà nhà cung cấp đã phát hành vào ngày 1 tháng 9, có mức giá 10,00 USD và 50,00 USD ở cùng hai dòng đó. Cách tóm tắt hấp dẫn là Fable 5.1 là mô hình đắt tiền hơn và do đó tốt hơn, còn trên Artificial Analysis Intelligence Index thì thứ tự lại ngược lại: Claude Sonnet 5.5 đạt 56 điểm và Claude Fable 5.1 đạt 53 điểm. Đó không phải là sai số do làm tròn, và cũng không phải là toàn bộ câu chuyện, bởi cùng một đơn vị đánh giá xếp hai mô hình cách nhau trong vòng ba xu mỗi tác vụ trên cùng một bộ đánh giá — 7,60 USD so với 7,63 USD. Mức chênh lệch gấp năm lần trên bảng giá gần như biến mất khi một tác vụ hoàn thành. Điều còn lại là một tập hợp những khác biệt về hình dạng thay vì về điểm số, và việc chọn giữa hai mô hình này chủ yếu là câu hỏi về việc khối lượng công việc của bạn có hình dạng nào.
Hai bảng giá, và dòng duy nhất nơi khoảng cách không phải là gấp năm lần
So sánh theo từng token thật rõ ràng và không cần diễn giải.
• Đầu vào — Claude Sonnet 5.5 ở mức 2,00 đô la mỗi triệu token so với Claude Fable 5.1 ở mức 10,00 đô la, chênh lệch gấp năm lần
• Đầu ra — $10.00 so với $50.00 mỗi triệu, một lần nữa đúng gấp năm lần
• Đọc bộ nhớ đệm — $0.20 so với $0.25 mỗi triệu. Đây là hạng mục gánh vác những lượt chạy agent dài, và mức chiết khấu sụp từ 5× xuống 20%
• Ghi bộ đệm — $2,50 so với $12,50 mỗi triệu cho cửa sổ năm phút tiêu chuẩn, khoảng chênh lệch đơn lẻ lớn nhất trên cả hai thẻ
• Batch — chế độ batch của Anthropic không áp dụng cho cả hai thẻ này theo cách nó áp dụng cho Fable 5.1: Fable 5.1 ra mắt với giá batch giảm một nửa, còn 5,00 USD cho đầu vào và 25,00 USD cho đầu ra. Hãy đọc dòng batch trên chính trang giá của Anthropic trước khi bạn cho rằng nó áp dụng cho cả dòng sản phẩm
• Ngữ cảnh và giới hạn tối đa — 1.000.000 token ngữ cảnh và 128.000 token đầu ra tối đa ở cả hai. Trên Message Batches API, Claude Sonnet 5.5 hỗ trợ tối đa 300.000 token đầu ra khi bật beta header output-300k-2026-03-24, đây là khác biệt thực sự về giới hạn tối đa đối với việc tạo hàng loạt chứ không phải chiêu tiếp thị.
Có một điểm cộng khiêm tốn cho Claude Sonnet 5.5 mà bảng giá đánh giá thấp. Anthropic báo cáo rằng mô hình này thường cần ít token hơn nhiều để làm cùng một công việc so với phiên bản tiền nhiệm, và theo hãng, điều đó đồng nghĩa với việc giảm tới 30% chi phí cho mỗi tác vụ. Đó là tuyên bố của nhà cung cấp về một phép so sánh khác — Sonnet 5.5 với Sonnet 5 — và không phải là bằng chứng về cặp so sánh này. Tuy nhiên, đó lại chính là cơ chế giải thích điều mà phép đo độc lập đã phát hiện.
Chênh lệch giá gấp năm lần đi đâu?
Artificial Analysis đã chạy cả hai mô hình vào ngày 2026-09-29 trong cùng một harness và một nhãn cấu hình, “Adaptive Reasoning, Max Effort, Default Fallback”, trên Intelligence Index v4.3. Hai con số nổi bật là 56 đối với Claude Sonnet 5.5 và 53 đối với Claude Fable 5.1 — mô hình rẻ hơn dẫn trước khoảng ba điểm trên một thang điểm mà cùng đơn vị đánh giá đó xếp mô hình trung vị ở mức 26. Cả hai đều được dán nhãn là mô hình mang tên nhà cung cấp trên cùng một trang, vì vậy đây là một công cụ đo và một ảnh chụp nhanh, không phải hai.
Tiếp theo là cột chi phí, và lý do việc ghép cặp này thú vị chứ không hiển nhiên. Trong cùng một lượt chạy chỉ mục, Claude Sonnet 5.5 tốn $7.602633 mỗi tác vụ và Claude Fable 5.1 tốn $7.629706. Chênh nhau hai mươi bảy phần nghìn đô la. Phần phân tách mới là chỗ kỳ lạ: riêng phần đầu vào của Claude Fable 5.1 là $3.73 mỗi tác vụ, so với thành phần đầu vào nhỏ hơn đáng kể của Sonnet 5.5, và riêng token suy luận của nó tốn $2.36 mỗi tác vụ. Mô hình rẻ hơn năm lần trên mỗi token lại không hề rẻ hơn trên mỗi tác vụ hoàn thành.
Nguyên nhân là khối lượng, và hai mô hình thất bại theo hai hướng ngược nhau.
• Token đầu ra trên toàn bộ bộ index suite — Claude Sonnet 5.5 tạo ra 410.577.501 so với 188.465.663 của Claude Fable 5.1, trong một bộ mà mức trung vị được theo dõi là 88 triệu. Cả hai đều cao hơn hẳn mức trung vị; Sonnet 5.5 cao hơn gấp đôi Fable 5.1 và gần gấp năm lần mức trung vị
• Token đầu ra mỗi tác vụ — 192.838 đối với Sonnet 5.5 so với 78.111 đối với Fable 5.1, với phần suy luận là 142.386 so với 47.240. Sonnet 5.5 suy nghĩ lâu khoảng ba lần mỗi tác vụ
• Token đầu vào trong toàn bộ bộ chỉ mục — 18,5 tỷ cho Sonnet 5.5 so với 5,6 tỷ cho Fable 5.1. Sonnet 5.5 đã đọc lượng nhiều gấp ba lần, đây là con số lặng lẽ hơn trong cặp và cũng chính là con số ngốn mức giá đầu vào rẻ hơn.
• Giá hỗn hợp theo tỷ lệ pha trộn 7:2:1 giữa đầu vào, đọc cache và đầu ra — $1.54 cho Sonnet 5.5 so với $7.17 cho Fable 5.1. Đây là dòng khớp với bảng giá, và là dòng mô tả khối lượng công việc có đầu ra ngắn, được giới hạn rõ ràng.
Ghép những điều đó lại và phát biểu trung thực là thế này: khoảng cách giá tổng hợp là có thật còn khoảng cách theo từng tác vụ thì không. Con số nào trong hai con số mô tả hóa đơn của bạn phụ thuộc hoàn toàn vào việc các tác vụ của bạn kết thúc hay lan man, và bộ chỉ số được xây dựng để cho phép chúng lan man.
Thang nỗ lực mới là quyết định thực sự.
Cả hai mô hình đều có một tham số effort — low, medium, high, xhigh, max — và cả hai đều được đo ở mọi nấc vào ngày 2026-09-29. Đây là phần của so sánh mà không biểu giá nào có thể diễn đạt được, bởi vì mô hình rẻ ở một nấc thấp hơn đánh bại mô hình đắt ở một nấc thấp hơn với biên độ lớn, và mô hình đắt chỉ tách biệt ở gần mức cao nhất.
• Nỗ lực thấp — Claude Sonnet 5.5 đạt 35.84 với $0.41 mỗi tác vụ; Claude Fable 5.1 đạt 46.82 với $2.37. Ở bậc thấp nhất, mô hình đắt đỏ dẫn trước mười một điểm, với chi phí gần gấp sáu lần
• Mức nỗ lực trung bình — 40.74 ở mức $0.59 so với 48.92 ở mức $2.98. Fable 5.1 giữ lợi thế dẫn trước tám điểm với chi phí gấp năm lần
• Nỗ lực cao — 46,74 ở mức $1,08 so với 51,15 ở mức $3,91. Khoảng cách thu hẹp xuống còn bốn điểm rưỡi; tỷ lệ chi phí giữ ở mức khoảng 3,6×
• Nỗ lực Xhigh — 51.85 ở mức $2.74 so với 53.20 ở mức $5.98. Cách nhau 1,33 điểm, chỉ bằng 46% mức giá.
• Nỗ lực tối đa — 55,98 ở mức 7,60 USD so với 53,35 ở mức 7,63 USD. Thứ tự bị đảo ngược và chi phí hội tụ trong khoảng nửa phần trăm.
Đọc hàng thứ tư và thứ năm cùng nhau thì dáng dấp của màn đối đầu này hiện ra. Claude Sonnet 5.5 ở xhigh đạt 51,85 — chỉ cách điểm cao nhất của Claude Fable 5.1 ở bất kỳ mức nỗ lực nào trong vòng một điểm rưỡi chỉ số — với chi phí 2,74 đô la một tác vụ so với 7,63 đô la. Nếu công việc của bạn cần ở gần đường biên chứ không phải ngay tại đó, hàng đó chính là toàn bộ câu trả lời, và nó tiết kiệm 64% cho mỗi tác vụ hoàn thành. Đẩy Sonnet 5.5 lên mức tối đa và bạn mua thêm ba điểm với số tiền gấp 2,8 lần, điều này đưa bạn đến cùng hóa đơn như mức tối đa của Fable 5.1 với điểm số tốt hơn một chút và một hồ sơ suy luận rất khác.
Câu cuối cùng đó đáng để xác định thật rõ, vì nó đủ phản trực giác để cần kiểm tra hai lần. Ở cùng mức nỗ lực tối đa, mô hình có bảng giá rẻ hơn năm lần lại tốn cùng chi phí cho mỗi tác vụ như mô hình có bảng giá đắt. Nó đạt được điều đó bằng cách phát ra số token đầu ra nhiều gấp 2,5 lần, trong đó tỷ trọng suy luận lớn gấp ba lần. Tài liệu của chính Anthropic giải thích một phần cơ chế này: tokenizer đã thay đổi, và cùng một đoạn văn bản tạo ra khoảng 30% token nhiều hơn trên Claude Sonnet 5.5 so với các mô hình trước đó. Đó là một trong nhiều yếu tố góp phần, và đây là lời nhắc hữu ích rằng số lượng token đầu ra không thể so sánh giữa các phiên bản tokenizer khác nhau nếu không nói rõ điều đó.
Độ trễ là điểm mà hai thứ đó không còn giống nhau nữa
Sự hội tụ về điểm số không mở rộng sang thời gian. Trên cùng một ảnh chụp ngày 29-09-2026, Artificial Analysis báo cáo thời gian đến token đầu tiên là 254,41 giây đối với Claude Fable 5.1 và 2,80 giây đối với Claude Sonnet 5.5 trên phân đoạn prompt dài, với tốc độ đầu ra trung vị lần lượt là 67,9 và 49,4 token mỗi giây. Đó là mức chênh lệch hai bậc độ lớn về khoảng thời gian bên gọi phải chờ trước khi nhận được bất cứ thứ gì, và đây chính là con số có ý nghĩa vận hành lớn nhất trong phép so sánh này.
Cả hai con số đều cần được nêu rõ các yếu tố định lượng đi kèm. TTFT của Fable 5.1 được đo trên loại prompt dài; lát cắt prompt trung bình của bên đánh giá dành cho cùng mô hình trong cùng ngày là 117,60 giây, nên con số 254 giây là giá trị đuôi chứ không phải một hằng số. 2,80 giây của Sonnet 5.5 là trung vị tổng thể của nó, với dải biến thiên của chính bên đánh giá chạy từ 1,91 giây ở bách phân vị thứ năm đến 4,23 ở bách phân vị thứ chín mươi lăm. Tài liệu nền tảng của Anthropic mô tả độ trễ so sánh của Fable 5.1 là chậm hơn và của Sonnet 5.5 là nhanh, điều này nhất quán về xu hướng nhưng không phải là một phép đo.
Cơ sở hạ tầng của chính chúng tôi mang lại cách đọc thứ ba, vì chúng tôi định tuyến Claude Fable 5.1 và đo lường những gì chúng tôi phục vụ. Trong bảy ngày tính đến ngày 28 tháng 9, trên lưu lượng của chính OrcaRouter, Claude Fable 5.1 đạt token đầu tiên trung vị ở mức 6.973 mili giây với bách phân vị thứ 95 ở mức 10,0 giây, tốc độ đầu ra 65,8 token mỗi giây và tỷ lệ lỗi 0,349%. Mức p50 đó nhanh hơn hơn một trăm lần so với con số prompt dài của đơn vị đánh giá, điều này không hẳn là mâu thuẫn mà đúng hơn là một định nghĩa về các thuật ngữ: token đầu tiên hướng tới nhà phát triển trên một prompt ngắn và token đầu tiên của một benchmark trên một prompt dài là những phép đo về những thứ khác nhau. Bất kỳ ai đang lập kế hoạch dựa trên con số trên bảng xếp hạng nên biết mình đang mua cái nào.

Sự trung thực trong tìm nguồn, việc giữ chân, và cuộc di cư mà không ai nhắc đến
Bảng điểm chuẩn của nhà cung cấp và các đánh giá độc lập là những công cụ đo lường khác nhau và không bao giờ nên lấy cái này trừ đi cái kia. Bảng công bố ra mắt của chính Anthropic cho Claude Sonnet 5.5 báo cáo Terminal-Bench 4.0 đạt 70,6%. Artificial Analysis, khi chạy bộ khung đánh giá riêng của mình, báo cáo 63,6% cho cùng mô hình trên một đánh giá cùng tên. Với Claude Fable 5.1, chênh lệch lại theo hướng ngược lại: Anthropic báo cáo 55,8% khi ra mắt và bộ khung độc lập cho kết quả 52,0%. Không cặp số nào là bản đính chính cho cặp kia. Hãy đánh giá từng cái theo tiêu chí riêng của nó, và ưu tiên cái độc lập khi bạn đang quyết định nơi gửi lưu lượng production.
Lập trường về lưu trữ cũng khác, và đây là kiểu khác biệt chỉ xuất hiện trong một cuộc rà soát mua sắm. Anthropic tuyên bố rằng Claude Sonnet 5.5 hiện có sẵn với chế độ không lưu trữ dữ liệu, cùng lập trường mà hãng đã áp dụng với Opus 5.5 và Sonnet 5. Tài liệu ra mắt của Claude Fable 5.1 mô tả một chính sách sử dụng dữ liệu gia tăng song hành cùng nó và một triển khai riêng thuộc Project Glasswing mang cửa sổ lưu trữ mặc định 30 ngày để giám sát an toàn, trong đó cơ chế không lưu trữ được mô tả là trạng thái tạm thời. Nếu nhóm của bạn phải giải trình trước một cuộc rà soát xử lý dữ liệu, sự khác biệt đó là một khoản mục thực sự chứ không phải chú thích, và đáng để đọc trang chính sách hiện hành của Anthropic thay vì bất kỳ bản tóm tắt nào về nó, kể cả bản này.
Chi phí migration bất đối xứng theo một cách hiếm khi xuất hiện trong các bài đưa tin về ra mắt. Chuyển sang Claude Sonnet 5.5 không phải là thay đổi chuỗi model. Hướng dẫn migration của Anthropic nêu rằng các giá trị temperature, top_p và top_k không mặc định giờ trả về lỗi 400, rằng tool_choice là any hoặc một công cụ có tên bị từ chối thẳng, và rằng thinking: {"type": "disabled"} phải trở thành between_tools nếu bạn đang chạy với tính năng thinking từ đầu bị tắt. Kiểu between_tools được chấp nhận ở mức effort low, medium và high và trả về lỗi 400 ở xhigh hoặc max. Trên Claude API và Google Cloud, computer use chỉ được hỗ trợ thông qua toolset computer_toolset_20260801; công cụ cũ hơn computer_20251124 bị từ chối. Không điều nào trong số đó áp dụng khi chuyển sang Claude Fable 5.1, một bản nâng cấp cùng dòng từ Fable 5 với ba thay đổi phá vỡ tương thích của riêng nó. Nếu bạn đang cân nhắc cả hai như những mục tiêu migration song song, thì mô hình rẻ hơn lại là mô hình tốn kém hơn để chuyển sang.

Cái nào đặt ở đâu
Quyết định rút ra từ những con số là quyết định về việc bao nhiêu phần lưu lượng truy cập của bạn được xác định phạm vi rõ ràng.
• Công việc có phạm vi giới hạn, khối lượng lớn, do công cụ dẫn dắt — Claude Sonnet 5.5, ở mức effort xhigh nếu bạn cần tiệm cận giới hạn tiên phong. Nó kém 1,5 điểm chỉ số so với mức tốt nhất của Fable 5.1, đổi lại chi phí thấp hơn 64% cho mỗi tác vụ hoàn thành, trả về token đầu tiên trong khoảng ba giây, và dòng cache-write rẻ hơn của nó giúp cho việc xây dựng lại tiền tố ngữ cảnh trở nên khả thi về chi phí
• Công việc dài hạn, mở và không có đáp án cố định, nơi một câu trả lời sai sẽ rất tốn kém — Claude Fable 5.1. Nó đạt điểm tối đa của Sonnet 5.5 với cùng chi phí cho mỗi tác vụ, nhưng chỉ cần một phần ba token suy luận và một phần tư lượng đầu vào để làm được điều đó, điều này có ý nghĩa khi tác vụ thực sự mở và hình dạng của bộ đánh giá giống với bài toán của bạn
• Các bề mặt tương tác bị ràng buộc bởi độ trễ — Claude Sonnet 5.5, và đây không phải là cuộc so kè sít sao. Trên chính ảnh chụp nhanh của bên đánh giá, khoảng cách token đầu tiên là hai bậc độ lớn ở loại prompt dài, và kết quả đo với prompt trung bình chỉ thu hẹp nó xuống còn khoảng 118 giây. Không thể xây dựng một bề mặt chat dựa trên con số của Fable 5.1 mà không xử lý theo lô hoặc truyền phát để vòng qua nó.
• Tạo hàng loạt với đầu ra dài — Claude Sonnet 5.5, vì mức trần đầu ra 300.000 token có sẵn trên Message Batches API nằm sau header output-300k-2026-03-24, so với mức trần 128.000 token ở mọi nơi khác. Hãy xác nhận giá theo lô của bạn trước khi cam kết; mức giá theo lô không giống nhau giữa hai thẻ
• Công việc phải trải rộng nhiều tài khoản hoặc chuyển giao suy luận giữa các hệ thống — hãy đọc tài liệu về preserved thinking của Anthropic trước khi làm bất kỳ điều nào trong hai việc đó. Các khối thinking bị ràng buộc với model và tài khoản đã tạo ra chúng, và Sonnet 5.5 là Sonnet đầu tiên được trang bị các bộ phân loại ngăn chặn việc trích xuất suy luận. Đó vừa là một tính năng tuân thủ, vừa là một ràng buộc.
• Khối lượng công việc chịu quy định hoặc nhạy cảm về lưu trữ — hãy kiểm tra chính sách hiện hành thay vì thông tin công bố khi ra mắt. Claude Sonnet 5.5 ra mắt với khả năng không lưu trữ dữ liệu; tài liệu của Fable 5.1 mô tả một chính sách tăng dần với cửa sổ mặc định 30 ngày trên một triển khai và không lưu trữ như một trạng thái tạm thời

Trên OrcaRouter, Claude Fable 5.1 và Claude Sonnet 5 đều nằm sau một thông tin xác thực duy nhất ở mức giá niêm yết của nhà cung cấp với 0% phụ phí, vì vậy dòng cache-read và thay đổi tokenizer là những thứ duy nhất tác động đến hóa đơn của bạn khi bạn chuyển đổi giữa hai mô hình. Claude Sonnet 5.5 vẫn chưa phải là một tuyến trên nền tảng của chúng tôi — mô hình mới chỉ ra đời được một ngày — nên cách nói trung thực là hôm nay bạn truy cập nó thông qua API riêng của Anthropic. Bất kỳ ai đang chạy Fable 5.1 qua chúng tôi đều có thể tính toán chi phí chuyển đổi vào đúng ngày nó xuất hiện mà không cần thay đổi bất cứ điều gì khác trong tích hợp của họ, và trong lúc đó chuyển đổi dự phòng tự động giữa các nhà cung cấp chính là điều khiến việc thử một mô hình mới đến vậy trên một đường dẫn phải luôn hoạt động trở nên an toàn.
Kết luận không rộng như khoảng cách giá hàm ý. Claude Sonnet 5.5 là mặc định tốt hơn cho gần như mọi việc có giới hạn — nó đạt điểm cao hơn ba điểm trên chỉ số độc lập, trả lời trong vài giây, và ở xhigh, nó chỉ còn cách trần của Fable 5.1 một điểm rưỡi với chi phí mỗi tác vụ thấp hơn một nửa đáng kể. Claude Fable 5.1 giữ lại một lập luận thực sự, và đó là lập luận mà chính bảng so sánh của Anthropic đưa ra: khi công việc mang tính mở và chi phí của việc sai vượt quá chi phí của việc suy nghĩ lâu hơn, mức giá đầu vào gấp năm lần sẽ mua được một mô hình đạt cùng điểm số mà không phải tiêu tốn gấp ba lượng token suy luận để đạt tới đó. Hãy chọn dựa trên hình dạng của tác vụ, không phải quy mô của bảng giá, vì ở đỉnh của thang nỗ lực, hai mô hình đó tính phí bạn như nhau.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
