
Giới hạn sử dụng Claude Code giảm 17% vào ngày 14/9: Bên trong cuộc chiến reset GPT-6 Astra
- openaiMỚIOpenAI: GPT-6 Astra2026-09-0455Trí tuệ77Lập trình
- googleMỚIGoogle: Gemini 3.8 Flash2026-09-0247Trí tuệ76Lập trình
- qwenMỚIQwen: Qwen3.8 Max (0902)2026-09-0247Trí tuệ72Lập trình
- anthropicMỚIAnthropic: Claude Fable 5.12026-09-0157Trí tuệ82Lập trình
- AlibabaMỚIQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiMỚIZ.ai: GLM 5.3 Flash2026-08-2646Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1849Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1541Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1251Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0547Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0347Trí tuệ72Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2140Trí tuệ69Lập trình
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Trí tuệ49Lập trình
Gói đăng ký Claude Code của Anthropic sẽ trở nên kém hào phóng hơn đáng kể vào ngày 14 tháng 9, khi mức tăng tạm thời +50% hạn mức sử dụng hằng tuần vốn được áp dụng từ tháng 5 được thay thế bằng mức tăng vĩnh viễn +25% — nếu so với những gì người đăng ký đang nhận được hiện nay, đây thực chất là mức cắt giảm khoảng 17%. Động thái này là một hiệp trong cuộc cạnh tranh kỳ lạ nhất của ngành AI hiện nay: cuộc chiến đặt lại hạn mức giữa Anthropic, hãng có hạn mức thuê bao dùng chung cho Claude Code và Claude chat dựa trên mô hình chủ lực Claude Fable 5.1, và OpenAI, hãng có sản phẩm Codex được xây dựng quanh GPT-6 Astra. Đó là cuộc chiến được tiến hành bằng các đợt đặt lại hạn mức sử dụng cùng những màn kịch kiểu quản lý sản phẩm, và giờ đây nó đang khiến giá trị thực sự của một gói đăng ký trả phí thay đổi theo từng tuần.
Vào ngày 5 tháng 9, nhà bình luận về giới phát triển kimmonismus đã đăng một bài tổng kết được chia sẻ rộng rãi về thế đối đầu: "đây là sự cạnh tranh ở dạng đẹp nhất… việc ra mắt Tibo đã khiến Anthropic cuối cùng cũng phải reset mức giá, điều mà họ sẽ không bao giờ làm nếu không có điều đó. Cùng lúc đó, Anthropic đã buộc OpenAI phải tập trung lại vào điều cốt yếu: năng lực của mô hình." "Tibo" là Thibault Sottiaux, trưởng nhóm sản phẩm Codex và ChatGPT của OpenAI, người đã dành cả mùa hè để reset hạn mức của người dùng trả phí thường xuyên đến mức cộng đồng đặt cho anh biệt danh "vị thần reset". Câu đùa trong bài — meme "I smell fear" — là của chính Tibo, từ một đêm tháng 7 khi anh reset giới hạn Codex chỉ vài phút sau khi Anthropic reset giới hạn của Claude. Phần tiếp theo không nói về điểm benchmark. Nó nói về nửa còn lại của nền kinh tế mô hình: khoản phí cố định hằng tháng thực sự mua được bao nhiêu công sức, và ai là người quyết định khi con số đó thay đổi.
Điều gì thực sự thay đổi vào ngày 14 tháng 9
Thay đổi của Claude là có thật và có thể xác định ngày. Vào ngày 29 tháng 8, tài khoản ClaudeDevs của Anthropic đã thông báo rằng từ ngày 14 tháng 9, giới hạn Claude Code tiêu chuẩn hàng tuần sẽ được tăng vĩnh viễn thêm 25% cho các gói Pro, Max, Team và Enterprise tính theo số ghế. Điều mà thông báo không đặt lên hàng đầu là các thuê bao hiện đang được hưởng mức tăng tạm thời +50% hàng tuần đã có hiệu lực từ ngày 13 tháng 5 và kéo dài đến ngày 13 tháng 9. Việc thay thế phần thưởng +50% bằng phần thưởng +25% là một bước lùi, và phép toán rất đơn giản dựa trên đường cơ sở của chính Anthropic:
• Hôm nay: mức cơ bản 100 + tăng 50% = 150 đơn vị chỉ tiêu tuần.
• Ngày 14 tháng 9: mức cơ sở 100 + tăng vĩnh viễn 25% = 125 đơn vị.
• Thay đổi ròng cho người dùng hiện tại: khoảng −17% (từ 150 xuống 125).
Anthropic sau đó đã trực tiếp thừa nhận phép tính — "so với hiện tại, con số này tương đương mức giảm 17%" — sau khi sự chênh lệch này vấp phải ghi chú từ cộng đồng và chỉ trích từ các nhà phát triển. Công ty mô tả thay đổi này là việc chấm dứt một đợt mở rộng tạm thời trong khi biến một phần của nó thành vĩnh viễn, nhấn mạnh đến tính bền vững lâu dài, đồng thời cho biết họ đang triển khai "những thay đổi thú vị" để mang lại cho người dùng khả năng hiển thị và kiểm soát tốt hơn đối với việc sử dụng. Công ty không công bố thời điểm cụ thể cho các tính năng này.
Hai sự thật mang tính cấu trúc khiến đợt cắt giảm này khó bị phớt lờ hơn. Thứ nhất, trên các gói Pro và Max, Claude Code dùng chung một hạn mức sử dụng với Claude chat và Cowork, nên cùng một mức trợ cấp hàng tuần được chi dùng cho cả ba sản phẩm. Thứ hai, hạn mức không được biểu thị bằng token: Anthropic mô tả chúng như các hệ số nhân thay vì ngân sách, nên người dùng chỉ biết mình đã chạm trần khi họ chạm trần. Một sự hạ bậc được công bố như một sự tăng sẽ được đón nhận theo cách khác khi bạn không thể thấy con số bên dưới.
Mặt khác của cuộc chiến: OpenAI liên tục phát các bản reset
OpenAI đã dành cả cùng mùa hè đó để đi theo hướng ngược lại, và làm điều đó một cách ầm ĩ. Sottiaux đã phân phát hơn 40 phiếu đặt lại Codex cho tất cả người dùng kể từ mùa xuân — cộng đồng theo dõi chúng tại codex-reset.com — hầu hết có hiệu lực trong 30 ngày. Một "banked reset" là một lần làm mới được lưu trữ duy nhất cho cả cửa sổ sử dụng 5 giờ và hàng tuần mà người dùng chọn thời điểm để sử dụng; nó không thể được mua, rút tiền mặt, hay chuyển nhượng, và nó sẽ hết hạn. Về mặt đô la, các lần đặt lại này rất có ý nghĩa: người dùng trả phí đã thử nghiệm chúng tương đương với khoảng $5–8 mức sử dụng trên Plus và $50–80 trên Pro, trong khi theo dõi cộng đồng (NerfTrack) ước tính hạn mức hàng tuần của Plus trị giá khoảng $80–160 mức sử dụng GPT-5.6 Sol — và người dùng nặng nhận được nhiều hơn mức trung bình rất nhiều. Một người dùng Pro đã được theo dõi tiêu thụ 2,5 tỷ token trong 23 giờ, khoảng 80% hạn mức hàng tuần.
Ngày 30/8, Tibo thông báo khôi phục toàn bộ hạn mức cho tất cả người dùng trả phí của Codex và ChatGPT Work — và điều bất thường là, anh giải thích vì sao hạn mức của họ cứ hao hụt. Tibo cho biết nhóm đã sửa một loạt lỗi âm thầm ngốn hạn mức sử dụng: nén và cô đọng hình ảnh, các worker bộ nhớ chạy nền, thử lại lệnh /goal, các sub-agent, chi phí phụ phát sinh từ lịch sử máy tính và các tác vụ nền liên quan đến MCP. Tùy theo cách sử dụng, cùng một hạn mức giờ có thể kéo dài lâu hơn từ 10% đến 50%. Cách công bố chi tiết theo từng đầu mục như vậy là điều Anthropic chưa làm được: một danh sách cho biết số token thực sự được dùng vào đâu.
Lần reset mới nhất diễn ra trong tuần này. Sau khi GPT-6 Astra hoàn tất triển khai cho các gói ChatGPT trả phí — một đợt triển khai ban đầu gặp trục trặc khiến ChatGPT và Codex ngừng hoạt động vào ngày 3 tháng 9, và mô hình này ban đầu không thể truy cập ngay cả với một số người đăng ký gói Pro 200 đô la/tháng — Sottiaux đã công bố reset toàn bộ mức sử dụng cho mọi gói đăng ký ChatGPT trả phí, được ấn định vào khoảng 6 giờ chiều ngày 7 tháng 9 theo giờ Thái Bình Dương (tức sáng ngày 8 tháng 9 tại Bắc Kinh). Bản thân thông báo này cũng là một trò đùa: một bài đăng Rickroll mà phần lời được nhấn mạnh đánh vần thành chữ RESET. Lý do được nêu là để cho những người dùng đã dùng hết hạn mức trong đợt cao điểm Astra có một khung thời gian sạch trước khi bước vào tuần làm việc mới.

Tại sao hai công ty hiện đang tranh giành hạn ngạch?
Không có gì ở đây giống cuộc chiến benchmark của một năm trước, vì các mô hình đã hội tụ về giá. {{1}}Claude Fable 5.1{{/1}} — do Anthropic phát hành ngày {{2}}1 tháng 9{{/2}} như phiên bản công khai đã được triển khai của hạng {{3}}Mythos-class{{/3}}, với giá {{4}}$10 cho mỗi triệu token đầu vào{{/4}} và {{5}}$50 cho mỗi triệu token đầu ra{{/5}} — và {{6}}GPT-6 Astra{{/6}}, mô hình chủ lực của OpenAI ra mắt ngày {{7}}3 tháng 9{{/7}} cùng mức giá niêm yết $10/$50, đều có năng lực đủ gần nhau đến mức các bảng xếp hạng không còn phân định được cuộc tranh luận. Claude Fable 5.1 dẫn đầu chỉ số Artificial Analysis Intelligence Index độc lập với {{8}}66{{/8}} điểm, còn GPT-6 Astra ở mức {{9}}61{{/9}}; đợt ra mắt của Anthropic cũng cắt giảm {{10}}75%{{/10}} giá đọc cache xuống còn {{11}}$0.25 cho mỗi triệu token{{/11}}, qua đó tự định vị là lựa chọn rẻ hơn cho các agent AI chạy lâu dài.
{{1}}Khi các mô hình ngang giá nhau, cuộc chiến chuyển sang số ghế. Cả hai công ty giờ đây đều bán cùng một thứ cho những người dùng nhiều: một gói đăng ký lập trình tác tử (agentic coding) với hạn mức sử dụng mà không bên nào chịu công bố bằng token. {{2}}Đòn bẩy của OpenAI là sự hào phóng trong các đợt reset hạn mức; còn của Anthropic, cho đến tháng này, là năng lực hạ tầng — những đợt tăng hạn mức tạm thời bắt nguồn từ việc mở rộng trung tâm dữ liệu của Anthropic hồi tháng 5.{{/2}} Đó là lý do vì sao việc reset hạn mức giờ bị hiểu là một sự kiện cạnh tranh, còn việc hạ hạn mức bị hiểu là sự rút lui, và vì sao hai trưởng nhóm sản phẩm diễn cho nhau xem. Lời đáp "I smell fear" của Tibo hồi tháng 7 — sau khi GPT-5.6 Sol ra mắt buộc Anthropic phải reset hạn mức Claude ngay trong ngày — đã tạo ra cục diện ấy, và phía Claude giờ cũng có nhân vật đầu tàu ham reset của riêng mình: các báo cáo tuần này mô tả Anthropic âm thầm đặt lại giới hạn hằng tuần của Claude một lần nữa dưới sức ép của GPT-6 Astra, với Lydia Hallie vào vai người đối trọng mà cộng đồng đã quen gọi là bà đỡ đầu không gian mạng. {{3}}Bài đăng của kimmonismus nói đúng rằng người dùng được lợi — cuộc khẩu chiến đã tạo ra hàng chục đợt reset hạn mức miễn phí — {{/3}}nhưng nó cũng biến các điều khoản đăng ký thành một công cụ tiếp thị, và đó chính là lúc các điều khoản không còn có thể đoán trước được nữa.{{/1}}
Điều mà API tính phí theo mức sử dụng làm được mà gói đăng ký không thể
Câu hỏi thực tế cho bất kỳ ai đang trả phí một trong những gói đăng ký này là liệu những toan tính cạnh tranh đó có nên thay đổi thứ bạn chạy và nơi bạn chạy nó hay không. Một hạn mức hằng tuần âm thầm giảm 17%, hoặc tự đặt lại theo lịch của đối thủ cạnh tranh, là một bài toán khó cho việc lập kế hoạch: bạn chỉ khám phá ra trần giới hạn của mình khi chạm vào nó, và chẳng công ty nào công bố ngân sách token. Sự bất định đó chính là lý lẽ mạnh nhất để giữ một phương án tính phí theo mức sử dụng thực tế trong stack của bạn. Gói đăng ký là một canh bạc về việc khoản phí cố định mua được bao nhiêu khối lượng công việc; API là mức giá cho từng token thực sự tiêu thụ. Trên OrcaRouter, cả hai mô hình đang nằm ở trung tâm cuộc chiến này đều có sẵn đúng theo giá niêm yết của nhà cung cấp, không đội giá — Claude Fable 5.1 ở mức $10/$50 mỗi triệu token với giá đọc cache $0.25, và GPT-6 Astra ở mức $10/$50 với bậc giá ngữ cảnh dài $20/$75 cho đầu vào trên 272K token. Vì nền tảng chuyển thẳng giá niêm yết của nhà cung cấp mà không thêm phụ phí, việc hạ giá đọc cache của Anthropic đã có hiệu lực ở phía chúng tôi ngay trong ngày được công bố — không cần thương lượng lại, cũng không cần hợp đồng thứ hai khi một nhà cung cấp nhượng bộ trước.
Định tuyến cũng thay đổi cách tính toán rủi ro của cuộc chiến này. Khi Codex gặp sự cố vào ngày 3 tháng 9, một workload được định tuyến với quy tắc failover vẫn không dừng lại; yêu cầu được tự động chuyển sang một mô hình thay thế. Khi bạn muốn biết liệu những lợi ích về năng lực tác nhân của Claude Fable 5.1 có xứng đáng với mức giá của nó cho codebase cụ thể của bạn hay không, bạn có thể gửi một phần lưu lượng đến nó và phần còn lại đến GPT-6 Astra qua một khóa API duy nhất, rồi so sánh chi phí cho mỗi tác vụ hoàn thành — không cần mua hay hủy gói đăng ký nào, cũng không có hạn mức tích lũy bị reset theo chu kỳ. Cuộc chiến hạn mức vốn là đặc trưng của các gói đăng ký; trên một API tính phí theo mức sử dụng, chính sách reset của một nhà cung cấp không ảnh hưởng gì đến quyền truy cập của bạn.

Xem gì từ bây giờ đến ngày 14 tháng 9
• Ngày 14 tháng 9. Dù Anthropic giữ vững việc giảm mức hay lại gia hạn mức tăng +50% dưới áp lực — họ đã gia hạn mức tăng này nhiều lần trong mùa hè, và các báo cáo trong tuần này cho biết Claude đã bắt đầu đặt lại giới hạn hàng tuần một lần nữa.
• Liệu các lần reset của OpenAI có dừng lại khi đợt triển khai kết thúc hay không. Tibo đã nói rằng anh ấy sẽ tiếp tục reset cho đến khi GPT-6 Astra thực sự khả dụng trên tất cả các gói ChatGPT; khi Astra đã chính thức hoạt động ở mọi nơi, van áp lực sẽ đóng lại và các lần reset có thể sẽ bớt kịch tính hơn.
• Khả năng hiển thị mức sử dụng mà Anthropic đã hứa. Công ty cho biết họ đang nghiên cứu để mang lại cho người dùng nhiều quyền kiểm soát và khả năng hiển thị hơn về mức sử dụng; nếu họ ra mắt một bảng đọc token hoặc đô la thực tế, thì đây sẽ là công ty đầu tiên trong số hai công ty ngừng che giấu ngân sách.
• Một thông báo sửa lỗi hao phí từ Anthropic. OpenAI đã liệt kê chi tiết những gì đang ngốn hạn mức Codex; người dùng Claude vẫn đang phỏng đoán xem bộ nhớ nền và quá trình nén dữ liệu tiêu tốn của họ là bao nhiêu.
{{1}}Mặt trận mô hình, nơi cuộc chiến có thể leo thang bất kể thế nào.{{/1}} {{2}}Một rò rỉ chưa được xác minh ngày 5/9 cho rằng Anthropic đang chuẩn bị phiên bản kế nhiệm trong dòng Claude Fable 5.2 như câu trả lời cho GPT-6 Astra — áp lực cạnh tranh tương tự đã tạo ra những toan tính hạn ngạch tuần này, giờ nhắm thẳng vào chính các mô hình.{{/2}}

Cuộc chiến reset đã có lợi cho người dùng trong ngắn hạn — chỉ riêng tuần qua đã mang đến một đợt reset Codex toàn cầu và các đợt reset Claude được nối lại, và hai công ty giờ đây đang công khai tranh giành người dùng nặng ký theo cách mang lại lợi ích cho mọi người trả phí. Nhưng sự hào phóng mà một quản lý sản phẩm có thể tắt đi không phải là một mô hình định giá, và một mức giảm −17% được ngụy trang thành mức tăng +25% là lời nhắc nhở rõ ràng nhất rằng hạn mức đăng ký là một công cụ tiếp thị, không phải một hợp đồng. Các mô hình bên dưới — Claude Fable 5.1 và GPT-6 Astra — đều xuất sắc, ngang tài ngang sức và có giá giống hệt nhau; các điều khoản xung quanh chúng mới là phần liên tục thay đổi. Hãy đo đếm những gì bạn có thể, theo dõi ngày 14 tháng 9, và đừng để lịch trình reset quyết định kiến trúc của bạn.
So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
