Thẻ tiêu đề được tạo cho bài viết 'Claude Opus 5.5 vs GPT-6.1 Sol: Khoảng cách giá trị gói đăng ký gấp 5 lần, được đo lường', với tiêu đề 'Claude Opus 5.5 vs GPT-6.1 Sol: khoảng cách giá trị gói đăng ký' và phụ đề 'Cùng $200 một tháng. Cùng khối lượng công việc tác tử. Giá trị tương đương API gấp 5,6 lần trên gói của Anthropic.' và ba thẻ ghi '$200/tháng Claude Max 20x - Opus 5.5 / $11.726 tương đương API', '$200/tháng ChatGPT Pro 200 - GPT-6.1 Sol / $2.084 tương đương API' và 'Khoảng cách / 5,6x'. Phần chân trang ghi 'Khối lượng công việc tác tử, 96,6% đầu vào được lưu đệm. Số liệu giá trị: SemiAnalysis, ngày 5 tháng 10 năm 2026 - mô hình của một ấn phẩm về giới hạn gói đăng ký của nhà cung cấp. Giá gói là giá niêm yết của nhà cung cấp.'
Guides & Insights

Claude Opus 5.5 vs GPT-6.1 Sol: Khoảng cách giá trị gói đăng ký gấp 5 lần, được đo lường

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Hai trăm đô la một tháng mua được một suất Claude Max 20x hoặc một suất ChatGPT Pro 200. Trên cùng một khối lượng công việc tác tử, một trong hai trả về 11.726 đô la một tháng bằng token tương đương API bên thứ nhất, còn cái kia trả về 2.084 đô la — khoảng cách 5,6 lần giữa Claude Opus 5.5 và GPT-6.1 Sol. Không mô hình nào trong hai mô hình đó làm nên tin này, và cả hai đều không mới: Claude Opus 5.5 ra mắt ngày 22 tháng 9 năm 2026 và GPT-6.1 Sol ngày 29 tháng 9 năm 2026, nên bản thân các mô hình lần lượt mới hai tuần và một tuần tuổi. Điều mới là kinh tế thuê bao của việc chạy chúng giờ đây đã có một con số đo được, được SemiAnalysis công bố ngày 5 tháng 10 năm 2026 — một ngày trước bài viết này — sau khi hãng này xây dựng một phương pháp định giá các giới hạn mà nhà cung cấp không công bố.

Con số gây chú ý đã lan truyền trên X kể từ tối ngày 5 tháng 10, thường bị tách rời khỏi những lưu ý kèm theo. Vậy nên những lưu ý ấy được đặt lên trước, bởi con số này chẳng có giá trị gì nếu thiếu chúng. Mọi giá trị trong biểu đồ dưới đây đều là mô hình của một ấn phẩm nghiên cứu về các phép đo riêng tư của một bên khác, được đo trên một dạng khối lượng công việc xác định và báo cáo dưới dạng một khoảng, chứ không phải một phép đối sánh đã được kiểm toán. Giá của các gói dịch vụ là giá niêm yết do chính các nhà cung cấp công bố. Các điểm số năng lực được nhắc tới ở phần sau là của Artificial Analysis, trong những cấu hình được nêu tên. Và toàn bộ so sánh này là về thuê bao — một phương thức tính phí với những quy tắc riêng — chứ không phải về chi phí trên mỗi token của mỗi mô hình, vốn là một câu hỏi khác với một câu trả lời khác.

Làm thế nào bạn định giá một kế hoạch mà bạn không thể nhìn thấy bên trong

Anthropic và OpenAI đều hiển thị mức sử dụng gói đăng ký dưới dạng đồng hồ phần trăm, không phải giá. Có một cửa sổ 5 giờ và giới hạn hàng tuần, và không có hóa đơn cho mỗi yêu cầu. Các nhà cung cấp phân biệt các gói bằng hệ số nhân so với các gói khác của chính họ — Max 5x và Max 20x của Claude được đặt tên theo đúng vị trí của chúng so với Pro, và các gói của ChatGPT cũng được quảng cáo theo cách tương tự, cho đến khi OpenAI loại bỏ ngôn ngữ sử dụng tương đối khỏi trang định giá của mình.

Do đó, cùng một gói sẽ có giá trị khác nhau tùy vào việc bạn dùng nó cho mô hình nào, vì một tín dụng bị tiêu thụ bởi token đầu vào được cache và một tín dụng bị tiêu thụ bởi token đầu ra không được định giá theo cùng tỷ lệ mà các nhà cung cấp tính tại API. Đó chính là toàn bộ luận điểm của bài tập này: bạn không thể nói một gói đáng giá X đô-la nếu chỉ xét riêng nó. Bạn cần xét gói, mô hình và khối lượng công việc cùng với nhau.

Phương pháp của SemiAnalysis đáng được mô tả vì nó quyết định trọng lượng mà các con số có thể mang. Công ty thực hiện các cuộc gọi lặp lại được thiết kế để cô lập một loại token tại một thời điểm — một phần của Chiến tranh và Hòa bình với một thẻ ngẫu nhiên cho mỗi cuộc gọi đối với đầu vào chưa được lưu vào bộ đệm, cùng một lời nhắc được đánh dấu để lưu vào bộ đệm cho các lần ghi bộ đệm, một thẻ cố định cho các lần đọc bộ đệm, một bài luận kỹ thuật dài để buộc đầu ra. Mỗi cuộc gọi ghi lại số token được nhà cung cấp tính phí và vị trí của đồng hồ đo mức sử dụng. Vì một yêu cầu đơn lẻ hiếm khi làm đồng hồ đo dịch chuyển, họ đo theo từng bước: tổng số token giữa hai lần dịch chuyển đồng hồ đo cho biết chi phí của một đơn vị đồng hồ, các bước một phần ở mỗi đầu bị loại bỏ, và các bước tích lũy cho đến khi phạm vi nằm trong khoảng ±5%. Các lần đọc bộ đệm không làm đồng hồ đo dịch chuyển sau 500 triệu token được coi là miễn phí. Sau đó, hỗn hợp khối lượng công việc đến từ tỷ lệ sử dụng tháng 9 của chính công ty, và giá trị là dung lượng token thu được nhân với giá API công bố của nhà cung cấp cho mỗi loại token.

Phát hiện thú vị nhất trong phần phương pháp luận không phải về lòng hào phóng của một trong hai phòng thí nghiệm. Trong quá trình xác thực, SemiAnalysis phát hiện rằng một trong ba tài khoản mà nó thử nghiệm trên cùng một gói có giới hạn thấp hơn khoảng 20% so với hai tài khoản còn lại — một tài khoản cũ hơn. Nhà cung cấp xác nhận đó là một thử nghiệm A/B "cực kỳ nhỏ" về giới hạn và nhấn mạnh rằng họ không cắt giảm giới hạn một cách ồ ạt. Cả hai vế của điều đó đều quan trọng: nó chứng minh rằng giới hạn đăng ký có thể bị thay đổi âm thầm vào bất kỳ lúc nào, và nó chứng minh rằng phương pháp này đủ nhạy để phát hiện một thay đổi 20% khi điều đó xảy ra.

Mỗi gói mang lại những gì, ở mức $200, $100 và $20

Ba hạng, cả hai lab, khối lượng công việc agentic, giá trị tương đương API mỗi tháng theo mức giá niêm yết chính hãng:

• $200 một tháng — Claude Opus 5.5 trên Max 20x mang lại $11,726 — gấp 58,6 lần phí tính theo token tương đương API; GPT-6.1 Sol trên ChatGPT Pro 200 mang lại $2,084 — gấp 10,4 lần phí. Tỷ lệ: 5,6 lần.

• $100 một tháng — Claude Opus 5.5 trên Max 5x mang lại $5.725 (gấp 57,3 lần mức phí); GPT-6.1 Sol trên ChatGPT Pro 100 mang lại $1.055 (gấp 10,6 lần mức phí). Tỷ lệ: 5,4 lần.

• $20 một tháng — Claude Opus 5.5 trên Claude Pro mang lại $1.178 (gấp 58,9 lần phí); GPT-6.1 Sol trên ChatGPT Plus mang lại $211 (gấp 10,6 lần phí). Tỷ lệ: 5,6x.

Việc cả ba hạng đều rơi vào khoảng từ 5,4 lần đến 5,6 lần mới là phát hiện, chứ không phải từng con số đô-la riêng lẻ. Phép so sánh được thực hiện trên hạng trung trong danh mục của mỗi phòng thí nghiệm — mẫu mô hình mà cả hai nhà cung cấp đều định vị là lựa chọn dùng hằng ngày thay vì mẫu chủ lực — và được chạy xuyên suốt toàn bộ thang giá, nên một độc giả dùng gói 20 đô-la nhận được câu trả lời giống như một độc giả dùng gói 200 đô-la. Bản tóm tắt của chính SemiAnalysis thì thẳng thừng: ở hạng này, Anthropic là "một lựa chọn tốt hơn hẳn, mang lại giá trị tương đương API gấp ~5 lần trên mọi phương diện."

Hình dạng khối lượng công việc đằng sau cả ba hàng đều đã được dán nhãn, và đáng để đọc hai lần: dạng tác tử, 0,4% đầu vào không lưu đệm, 96,6% đầu vào lưu đệm, 2,6% ghi bộ nhớ đệm, 0,3% đầu ra. Đó chính là dáng vẻ của một vòng lặp tác tử — một lượng nhỏ chỉ thị mới, một lượng khổng lồ ngữ cảnh được đọc lại, và một mẩu nhỏ văn bản được tạo ra. Và đó cũng là, như phần tiếp theo cho thấy, tổ hợp có lợi nhất cho Anthropic.

A generated two-column scoreboard titled 'Claude Opus 5.5 vs GPT-6.1 Sol - the scoreboard'. Left column 'Claude Opus 5.5': Input $4.00 per Mtok, Output $20.00 per Mtok, Cache read $0.20 per Mtok, Released Sept 22 2026, AA Intelligence Index 58 (max effort), API value on the $200 plan $11,726. Right column 'GPT-6.1 Sol': Input $2.00 per Mtok, Output $10.00 per Mtok, Cache read $0.10 per Mtok, Released Sept 29 2026, AA Intelligence Index 51.8 (max effort), API value on the $200 plan $2,084. The footer reads 'Prices: vendor rate cards. Index: Artificial Analysis v4.3.2, max effort. $200-plan value: SemiAnalysis, Oct 5, 2026 - model estimate, not audited.'

Opus 5.5 có giá cao gấp đôi trên mỗi token, và vẫn thắng gấp 5,6 lần

Đây là điều mà phiên bản đang lan truyền của biểu đồ bỏ sót. Claude Opus 5.5 không phải là mô hình rẻ hơn. Nó là mô hình đắt hơn, gấp đôi.

Cả hai bảng giá đều được công bố công khai. Claude Opus 5.5 niêm yết ở mức 4,00 USD mỗi triệu token đầu vào, 0,20 USD mỗi triệu lượt đọc bộ nhớ đệm, 5,00 USD mỗi triệu lượt ghi bộ nhớ đệm và 20,00 USD mỗi triệu token đầu ra. GPT-6.1 Sol niêm yết ở mức 2,00, 0,10, 2,50 và 10,00 USD cho cùng bốn hạng mục. Cân theo tỷ lệ tác nhân ở trên, mức giá hỗn hợp cho ra khoảng 0,399 USD mỗi triệu token đối với Claude Opus 5.5, so với 0,200 USD đối với GPT-6.1 Sol — tỷ lệ 2,00 lần. Phép tính đó là của chúng tôi, dựa trên bảng giá đã công bố của hai nhà cung cấp, nhưng nó không gây tranh cãi: nó suy ra trực tiếp từ các mức giá đã công bố và tỷ lệ hỗn hợp đã được ghi nhãn.

Lấy khoảng cách giá trị 5,6x chia cho khoảng cách giá 2,0x, bạn sẽ nhận được lượng token trên mỗi đô-la của gói ở phía Claude nhiều hơn khoảng 2,8 lần. Phép chia tương tự ở bậc $20 cho ra 2,79x — khoảng cách đó là do một thước đo đang hào phóng hơn hẳn, gần như chính xác là đồng đều trên toàn thang bậc, chứ không phải do một mô hình rẻ hơn khi vận hành. Điều đó có nghĩa là con số 5x trên tiêu đề là một phát biểu về giá tín dụng của Anthropic, và nó chỉ đúng với những khối lượng công việc giống với trường hợp được đo.

Thay đổi tỷ lệ cấu thành và con số sẽ thay đổi. Tỷ lệ ở đây là 96,6% lượt đọc từ bộ nhớ đệm, trong đó Opus 5.5 tính 0,20 USD so với 0,10 USD của Sol. Một khối lượng công việc ít dùng bộ nhớ đệm — tài liệu dài mới toanh, ít tái sử dụng — dựa vào dòng chi phí đầu vào và mức 2x tương tự cũng xuất hiện ở đó. Công việc nặng về đầu ra, chẳng hạn tạo sinh dài thay vì các phiên agent chạy dài, chạm đến dòng chi phí mà Opus là 20,00 USD so với 10,00 USD. Và SemiAnalysis nói rõ rằng chỉ số ưa thích của chính họ có một chế độ thất bại: giá trị tương đương API "tất nhiên sẽ gây hiểu nhầm" nếu một mô hình có mức giá đặc biệt hời hoặc đặc biệt tệ ở mức giá API, và đây chính xác là tình huống hiện tại — mô hình đắt hơn trên mỗi token lại là mô hình có gói đăng ký tốt hơn. Công ty này cũng từ chối dựa vào các biểu đồ hiệu quả token, nói rằng họ không tin các tác vụ đánh giá agentic điển hình đại diện cho công việc thực tế, và rằng ngành thiếu dữ liệu hiệu quả đáng tin cậy. Hãy coi mức 5x là một phát biểu có đong đếm về một dạng khối lượng công việc từ một ấn phẩm, chứ không phải là thuộc tính vĩnh viễn của bất kỳ mô hình nào.

Điều khiến khoảng cách này trở thành một vấn đề thực sự thay vì một sự đánh đổi trung tính là bên đăng ký và rẻ hơn cũng là bên mạnh hơn trên bảng xếp hạng độc lập. Artificial Analysis xếp Claude Opus 5.5 ở mức 58 trên Intelligence Index của mình trong cấu hình mà trang mô hình của nó gọi là "max with fallback", được liệt kê trong bộ chọn biến thể là "Claude Opus 5.5 (Max, Default Fallback)" — mức cao nhất mà nó đã đo được, cao hơn vài điểm. GPT-6.1 Sol đạt 51.8 ở mức nỗ lực tối đa trên cùng chỉ số, phiên bản chỉ số v4.3.2, với GPT-6 Astra ở 52,7. Vậy nên một người mua đang cân nhắc hai gói $200 đang được yêu cầu trả nhiều hơn 5,6 lần cho mỗi đô la dung lượng khả dụng cho mô hình có điểm thấp hơn. Các điểm số là của bên thứ ba và độc lập; các số liệu giá trị thuộc mô hình của SemiAnalysis. Cả hai đều được dán nhãn, và không cái nào là số liệu của nhà cung cấp.

A screenshot of the OrcaRouter model page for Claude Opus 5.5 (anthropic/claude-opus-5.5), captured 6 October 2026, showing the model name and id, 1M-token context, Max output 128K, input text + image + file, Vision, Tools, JSON and Reasoning tags, the $4.00 input and $20.00 output pricing tiles, p50 TTFT 3.81 s, p95 TTFT 10.00 s, 48.5M tokens of 7-day traffic, the benchmark provenance line 'Public benchmarks by Anthropic - 2026-09-22', an OpenAI-compatible code sample using base_url https://api.orcarouter.ai/v1, and the buttons 'Get the Claude Opus 5.5 API' and 'Try in playground'.

OpenAI đã thay đổi gì vào ngày 29 tháng 9

Không có gì trong số này là tĩnh tại. Lý do khoảng cách này được bàn đến trong tuần này thay vì tuần trước là việc OpenAI đã thay đổi thước đo của chính mình tám ngày trước khi phép đo được công bố.

Vào ngày 29 tháng 9 năm 2026, OpenAI đã mở lại gói đăng ký Pro $200 cho người đăng ký mới và thay đổi cách tính mức sử dụng cùng với việc mở lại. Theo cách diễn đạt của chính họ vào ngày hôm đó, thay đổi này sẽ "quy về mức bằng một nửa số đô-la chi cho API so với gói Pro $200 cũ", và một bài đăng thứ hai cùng ngày mô tả việc giảm một nửa giá trị tương đương API của gói. Đó là một tuyên bố của nhà cung cấp về gói của chính họ, có ghi ngày tháng, và đó là sự kiện khiến cho một phép đo giá trị gói đăng ký trở nên đáng để công bố.

Ba hệ quả, như SemiAnalysis đã đo lường:

• Số token mỗi bậc đã bị cắt giảm một nửa, và giá trị của dòng Sol còn giảm sâu hơn thế. OpenAI đồng thời cắt giảm giá đầu vào được lưu đệm cho GPT-6.1 Sol — xuống còn 0,10 USD mỗi triệu, mức mà tài khoản nhà phát triển của OpenAI mô tả vào ngày 29 tháng 9 là thấp hơn 95% so với giá đầu vào tiêu chuẩn và thấp hơn 50% so với mức giá lưu đệm của GPT-6 Sol — vì vậy giá trị tương đương API đo lường được của các mô hình lớp Sol trên gói đã giảm hơn 50%, thay vì mức 50% mà chỉ riêng việc cắt giảm token hàm ý.

• Gói 500 USD đã xuất hiện, và nó không khôi phục lại giá trị. Gói Pro 500 mới cung cấp lượng GPT-6 Astra nhiều hơn 21% so với gói 200 USD cũ; do việc cắt giảm giá Sol, giá trị tương đương API ở hạng Sol trên gói 500 USD thực tế lại giảm. Chế độ Ultrafast — hạng dịch vụ 300 token mỗi giây — mới là bổ sung thực sự ở đó, và SemiAnalysis cho biết các giới hạn của nó vẫn đang được thử nghiệm.

• Các thuê bao hiện hữu được giữ nguyên theo chính sách cũ đến ngày 29 tháng 10 năm 2026. Gói 200 đô được đăng ký trước thời điểm cắt giảm vẫn giữ hạn mức cũ, lớn hơn cho đến ngày đó, sau đó chuyển sang hạn mức thấp hơn với mức giá không đổi. Đối với bất kỳ ai đã mua trước ngày 29 tháng 9, phần so sánh trong bài viết này sẽ áp dụng cho tài khoản của họ kể từ cuối tháng, chứ không phải hôm nay.

Việc tái cân bằng mới là phần tinh tế. Trước đợt cắt giảm, giá trị trên mỗi đô-la của OpenAI vốn thiên lệch có lợi cho chính họ ở các bậc cao nhất: Pro 200 mang lại giá trị trên mỗi đô-la gần gấp đôi Pro 100 trên Astra, mà bản thân Pro 100 lại gần gấp đôi Plus. Sau đợt cắt giảm, Pro 100, Pro 200 và Pro 500 đều cho cùng số token trên mỗi đô-la ở mọi mô hình, và Plus thì tương đương trên Sol dù vẫn tương đối kém hơn trên Astra. OpenAI đã làm cho thang bậc của mình công bằng trong nội bộ bằng cách giảm một nửa mọi thứ xuống ngang bậc thấp nhất. Ngược lại, Anthropic vốn đã mang lại cùng giá trị trên mỗi đô-la ở mọi bậc — đó là lý do mức 5,6x y hệt xuất hiện dù bạn nhìn vào gói $20 hay gói $200. Nếu bạn đang dùng Plus và trông cậy vào quyền truy cập Astra, đợt cắt giảm đã lấy đi giá trị từng khiến bậc cao nhất của OpenAI đáng để vươn tới.

OpenAI vẫn giữ được một lợi thế cấu trúc thực sự, và SemiAnalysis thừa nhận điều đó: không có gói Pro nào có cửa sổ năm giờ, giúp việc tiêu thụ một phần lớn hạn mức hàng tháng trong một phiên dài duy nhất trở nên dễ dàng hơn. Đánh giá của công ty này là nó không bù đắp được khoảng cách khoảng 4x đến 5x về giá trị tương đương API.

Hai nền kinh tế, một tên mô hình

Có một cái bẫy khi đọc bất kỳ điều nào trong số này như một phát biểu về các mô hình. Nếu bạn trả tiền theo token — một API key, một ngăn xếp tự vận hành, một nền tảng agent do bạn xây dựng — thì 5.6x không phải là con số của bạn, và chưa bao giờ là. Con số của bạn là mức pha trộn 2.00x, và trên cơ sở đó GPT-6.1 Sol là mô hình rẻ hơn cho cùng một vòng lặp agentic. So sánh thuê bao trả lời câu hỏi "tôi nên mua chỗ ngồi nào". So sánh API trả lời câu hỏi "tôi nên gọi mô hình nào". Chúng chỉ về hai hướng ngược nhau đối với hai mô hình này, và việc đánh đồng chúng là lỗi phổ biến nhất trong các bình luận xoay quanh biểu đồ.

Đợt giảm giá đã góp phần tạo nên phép đo gói đăng ký đã có sẵn trong bảng giá API. Anthropic đã giảm 20% giá đầu vào và đầu ra của Opus 5.5 so với Opus 5 và giảm 60% giá đọc bộ nhớ đệm khi mô hình ra mắt, vào ngày 25 tháng 9. OpenAI đã giảm một nửa giá đầu vào được lưu bộ nhớ đệm của GPT-6.1 Sol khi ra mắt vào ngày 29 tháng 9. Đó là hai bảng giá niêm yết được sử dụng xuyên suốt bài viết này, và chúng áp dụng cho dù bạn mua theo ghế hay theo token. Cả hai mô hình đều nằm trong danh mục OrcaRouter ở mức giá niêm yết của nhà cung cấp — Claude Opus 5.5 ở mức giá niêm yết của nhà cung cấp với 0% markup, và GPT-6.1 Sol trên cùng một khóa đằng sau một endpoint — vì vậy mức giảm của nhà cung cấp có hiệu lực ngay khi được công bố thay vì phải chờ làm mới bảng định tuyến.

Một điều đáng để nói thẳng: OrcaRouter không bán gói đăng ký, nên phép đo này không thay đổi số tiền mà người dùng OrcaRouter phải trả. Nó thay đổi việc họ nên trả tiền cho mô hình nào, và nó định giá phương án thay thế. Khía cạnh gói đăng ký trong so sánh này là một bức tường mà bạn không kiểm soát — hai phòng thí nghiệm, cả hai đều đã chứng minh rằng họ sẽ thay đổi giới hạn, một cách âm thầm và với thông báo trước rất ngắn, ngay trong cùng tuần họ cắt giảm giá. Tương đương API của rủi ro đó chính là khả năng gửi cùng một yêu cầu đến nơi khác mà không cần hợp đồng mới, và đó là mục đích của cơ chế chuyển đổi dự phòng tự động giữa các nhà cung cấp. Nếu bạn đang chạy một vòng lặp agent với 96,6% lượt đọc từ bộ nhớ đệm, thứ bạn thực sự muốn là tuyến rẻ nhất chấp nhận yêu cầu đó, cùng với khả năng đổi ý khi một nhà cung cấp đổi ý.

Ai nên di chuyển, và ai không nên

Nếu bạn đang trả tiền cho gói đăng ký Claude và chạy lập trình dạng tác tử hoặc các vòng lặp công cụ dài, thì lý do để ở lại giờ đây được đo lường chứ không còn là giai thoại: 58,6 lần khoản phí của bạn quay trở lại dưới dạng dung lượng tương đương API ở gói $200, so với 10,4 lần ở gói ChatGPT tương đương, và con số này giữ nguyên ở mọi mức giá. Nếu bạn đang dùng gói ChatGPT Pro 200 mua trước ngày 29 tháng 9, bạn có hạn mức cũ cho đến ngày 29 tháng 10 năm 2026 và hạn mức thấp hơn sau đó — hãy kiểm tra ngày trước khi quyết định bất cứ điều gì, vì trong ba tuần tới bạn đang so sánh với một gói không còn tồn tại đối với người mua mới.

Nếu bạn là người xây dựng API, hãy bỏ qua mức 5,6x. Định tuyến theo mức giá hỗn hợp 2,00x, định giá theo từng tác vụ thay vì theo token, và kiểm tra lại sau mỗi lần nhà cung cấp thay đổi giá, vì quý này đã tạo ra bốn lần như vậy — GPT-6 Sol, Fable 5.1, Opus 5.5 và GPT-6.1 Sol trong chỉ hơn một tháng. Phép đo quan trọng đối với một gói đăng ký là một chiếc đồng hồ đo mà không ai bên ngoài phòng thí nghiệm có thể thấy. Phép đo quan trọng đối với một API là một bảng giá, và cái đó thì công khai.

Điều cần theo dõi tiếp theo: liệu các giới hạn Opus của Anthropic có duy trì được suốt quý hay không, khi mà đối thủ của chính hãng đã dành cả tuần qua để cắt giảm và cả hai phòng thí nghiệm vẫn giữ khả năng âm thầm điều chỉnh đồng hồ đo; liệu OpenAI có khôi phục giá trị đẳng cấp Sol trên gói 500 đô la bằng cách nâng giới hạn thay vì lại giảm giá hay không; và liệu việc giữ nguyên quyền lợi của gói 200 đô la có thực sự kết thúc vào ngày 29 tháng 10 như đã công bố hay không. SemiAnalysis duy trì các số liệu cơ sở dưới dạng bảng điều khiển trực tiếp thay vì một nghiên cứu cố định, vì vậy các số liệu được trích dẫn ở đây là trạng thái ngày 5 tháng 10 năm 2026 của một tập dữ liệu được thiết kế để thay đổi.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol (openai/gpt-6.1-sol), captured 6 October 2026, showing the model name and id, 1M-token context, Max output 128K, input text + image + file, Vision, Tools, JSON and Reasoning tags, the reasoning / coding / agentic capability tags, the $2.00 input and $10.00 output pricing tiles, 10.60 s p50 TTFT, 10.00 s p95 TTFT and 248.5M tokens of 7-day traffic, the benchmark provenance line 'Public benchmarks by OpenAI - 2026-09-29', and the buttons 'Get the GPT-6.1 Sol API' and 'Try in playground'.

So sánh trong bài viết này2

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày