Thẻ tiêu đề hero được tạo cho 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed' với dòng chữ phía trên 'Hai bậc tốc độ. Một mức giá còn thiếu.' và hai thẻ: bên trái 'GPT-5.6 Sol Ultrafast' liệt kê Trọng số: giống Sol, Tuyên bố tốc độ: lên đến 14x, Giá: chưa công bố; bên phải 'MiMo v2.6 Pro Ultraspeed' liệt kê Trọng số: giống Pro, Tuyên bố tốc độ: 10x đến 20x, Giá: $4.35 / $8.70; chân trang 'Cả hai đều chưa được đo lường độc lập.' Logo OrcaRouter ở góc dưới bên phải.
Guides & Insights

GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: Hai bậc tốc độ, một mức giá còn thiếu

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Hai nhà cung cấp đã tung ra cùng một ý tưởng sản phẩm cách nhau ba tuần, và sự khác biệt giữa họ chính là cách tốt nhất để thấy mỗi bên thực sự đang bán điều gì. Phía Xiaomi ra mắt ngày 22 tháng 9 năm 2026: Xiaomi MiMo v2.6 Pro Ultraspeed là cùng một checkpoint 1,02 nghìn tỷ tham số như MiMo-V2.6-Pro, được phục vụ nhanh hơn, với giá 4,35 USD cho mỗi triệu token đầu vào và 8,70 USD cho mỗi triệu token đầu ra, so với mức 0,44 USD và 0,87 USD của làn Pro tiêu chuẩn. GPT-5.6 Sol Ultrafast của nhà cung cấp này là cùng một nước đi được áp dụng cho GPT-5.6 Sol: trọng số y hệt, tối đa 750 token đầu ra mỗi giây, gấp tối đa 14 lần hạng tiêu chuẩn, chạy trên phần cứng quy mô wafer của Cerebras — và hoàn toàn không có giá niêm yết, sáu tuần sau khi chế độ này được công bố vào ngày 13 tháng 8.

Đặt hai thứ cạnh nhau và sự bất thường hiện ra ngay lập tức. Xiaomi đã công bố bảng giá trước khi công bố phần lớn các benchmark. OpenAI đã công bố các benchmark, đối tác phần cứng và tên khách hàng — và vẫn chưa công bố một con số nào mà bạn có thể lập ngân sách dựa vào. Một trong những hạng này có thể được mua ngay hôm nay. Cái còn lại là một giá trị trong schema API. Vì vậy, so sánh chúng không hẳn là về cái nào nhanh hơn, mà là về việc một hạng tốc độ đáng giá bao nhiêu khi một nhà cung cấp đã cho bạn biết giá còn nhà kia thì chưa.

Thực tế mỗi thứ là gì

Cả hai đều không phải là một mô hình mới. Đó là tiền đề chung và đáng được nói thẳng, bởi vì cả hai lần ra mắt đều thu hút những bài đưa tin coi một thay đổi trong khâu phục vụ là một bản phát hành năng lực.

MiMo v2.6 Pro Ultraspeed là một cấu hình phục vụ của mẫu flagship nhà Xiaomi: vẫn checkpoint mixture-of-experts thưa 1,02T tham số với 42B được kích hoạt mỗi token, vẫn ngữ cảnh 1M token, vẫn tính đa phương thức gốc xuyên văn bản, hình ảnh, video và âm thanh, vẫn trọng số theo giấy phép MIT trên các kho công khai. Tài liệu của chính Xiaomi tuyên bố tốc độ đầu ra nhanh gấp tới 20 lần so với dịch vụ Pro tiêu chuẩn ở cùng chất lượng; các danh mục niêm yết của bên thứ ba mô tả cùng mô hình trong cùng ngày lại nói khoảng 10 lần. Chưa ai công bố phép đo nào dung hòa được hai con số này.

GPT-5.6 Sol Ultrafast là một cấu hình phục vụ của sản phẩm chủ lực OpenAI: cùng checkpoint, cùng hành vi suy luận, cùng cửa sổ ngữ cảnh 1.050.000 token, cùng đầu ra tối đa 128K, cùng câu trả lời. Sự tăng tốc đến từ phần cứng chứ không phải lập lịch — trọng số của mô hình nằm trong SRAM trên chip trên silicon quy mô wafer của Cerebras thay vì được luân chuyển giữa bộ nhớ GPU và phần tính toán — và đây là sản phẩm đầu tiên của quan hệ đối tác tính toán OpenAI–Cerebras tháng 1 năm 2026, được báo cáo trị giá khoảng 10 tỷ USD trong ba năm.

Vậy trục so sánh trung thực không phải là trí thông minh. Mà là nhà cung cấp đã chọn thay đổi điều gì, họ tính phí bao nhiêu cho thay đổi đó, và họ cho bạn xác minh được bao nhiêu phần của thay đổi ấy.

A screenshot of the Hugging Face model card for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the TextGeneration / Transformers / Safetensors / English / Chinese / mimo_v2 / multimodal / conversational / custom_code / 3-bit precision fp8 tags, a License: mit badge, 53 likes, and the card opening 'MiMo-V2.6-Pro-RL — Scaling Reinforcement Learning Toward Self-Improvement' with the Technical Report link and the introduction describing native omnimodal input and a 1M-token context window.

Các bảng giá, bao gồm cả bảng để trống.

• MiMo v2.6 Pro Ultraspeed — 4,35 USD đầu vào / 8,70 USD đầu ra trên mỗi triệu token, được công bố bởi Xiaomi.

• MiMo-V2.6-Pro tiêu chuẩn — $0.44 / $0.87, được công bố trong danh mục thương mại của Xiaomi. Khoảng 9,9× ở đầu vào và đúng 10× ở đầu ra.

• GPT-5.6 Sol Ultrafast — không có bảng giá công bố nào tính đến ngày 27 tháng 9 năm 2026. Trang định giá của OpenAI vẫn có bốn tab — Standard, Batch, Flex, Fast — và hạng này không nằm trong số đó.

• GPT-5.6 Sol standard — $4.00 / $20.00 mỗi triệu token, mức giá khuyến mãi hiện tại của OpenAI, với đầu vào được lưu đệm ở mức $0.40 và bậc giá cho ngữ cảnh dài tăng lên $8.00 / $30.00 khi vượt quá khoảng 272K token đầu vào.

• Mức giá cao cấp tương đương duy nhất mà OpenAI từng niêm yết — chế độ Fast, ở mức $8.00 / $40.00, đúng gấp đôi mức giá tiêu chuẩn để đạt tốc độ đầu ra nhanh hơn tới khoảng 2,5 lần.

Hàng cuối cùng đó chính là toàn bộ lý do khiến chỗ trống trở nên quan trọng. Gói tốc độ của Xiaomi có giá gấp mười lần gói tiêu chuẩn và tuyên bố tốc độ gấp mười đến hai mươi lần, ít nhất là nhất quán về mặt nội tại như một sự đánh đổi: bạn trả nhiều hơn tương ứng để chờ ít hơn tương ứng, và cược rằng thời gian thực tế chính là sản phẩm. Gói tốc độ của OpenAI đòi hỏi nhiều hơn đối với nguồn silicon khan hiếm hơn so với Fast mode, nên dù cuối cùng nó có giá bao nhiêu, tiền lệ cho thấy sẽ là phụ phí chứ không phải giảm giá. Nhưng "tiền lệ cho thấy sẽ là phụ phí" không phải là một con số, và cho đến khi có một con số, gói này hoàn toàn không thể so sánh với UltraSpeed về giá — chỉ có thể dựa trên việc Xiaomi sẵn sàng nói ra con số của mình còn OpenAI thì không.

Những con số này đến từ đâu

Hai tầng này có những vấn đề chứng cứ trái ngược nhau, và đáng để gọi tên cả hai thay vì chọn phương án trung dung.

Tuyên bố về tốc độ của Xiaomi thì mơ hồ về độ lớn nhưng lại neo vào một mức giá đã công bố. Con số 20× là mức trần của nhà cung cấp trong những điều kiện mà Xiaomi chưa nêu rõ, 10× là mức mà một danh mục niêm yết sẵn sàng khẳng định là điển hình, còn hệ số thực nằm đâu đó trong một dải rộng mà chưa ai đo công khai ở một mức độ tương tranh được nêu rõ. Đối chiếu lại, mức giá thì chính xác, trọng số có thể tải xuống theo MIT, và báo cáo kỹ thuật cùng môi trường huấn luyện học tăng cường đều công khai — bạn có thể kiểm tra những gì Xiaomi đã làm, chỉ là bạn chưa thể xác minh nó chạy nhanh đến mức nào.

Tuyên bố về tốc độ của OpenAI rất cụ thể về độ lớn nhưng không gắn với bất kỳ thứ gì có thể mua được. Tối đa 750 token đầu ra mỗi giây, tối đa gấp 14× mức chuẩn, được nêu thẳng thắn. Đây cũng là một con số thông lượng cho token đầu ra, không phải hệ số nhân đầu-cuối đồng nhất: việc xử lý đầu vào và suy luận của chính mô hình không được nén theo tỷ lệ đó, đó là lý do công ty gắn nhãn đây là mức tối đa. Các benchmark hỗ trợ là do nhà cung cấp báo cáo và trong một trường hợp là so sánh chéo nhà cung cấp — một lượt chạy Humanity's Last Exam gồm 2.500 câu hỏi được báo cáo hoàn thành trong 11 giờ 11 phút so với 78 giờ 27 phút của Claude Fable 5, với độ chính xác tương đương. Các bài đưa tin độc lập về màn ra mắt đã dẫn một so sánh tốc độ sinh hẹp hơn, khoảng 11×, trên cùng lượt chạy, trong khi các số liệu của chính Cerebras hàm ý khoảng 7× cho tổng thời gian kiểm thử. Ba bên, ba phân số của một khối lượng công việc, không có bên thứ ba nào tái lập bất kỳ con số nào trong số đó. Cerebras riêng rẽ báo cáo 5,6× đầu-cuối trên GDP-Val mà không có tổn thất chất lượng đo được, cũng chưa được tái lập.

Cả hai bộ số đều do nhà cung cấp tự công bố. Khác biệt là ở chỗ sự mơ hồ của Xiaomi nằm ở tốc độ, còn của OpenAI nằm ở chi phí, và với bất cứ ai đang lập ngân sách, chi phí là thứ khó đoán hơn.

A generated two-column scoreboard titled 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed — the scoreboard'. Left column 'GPT-5.6 Sol Ultrafast': Checkpoint same as Sol, Speed claim up to 14x, Output speed up to 750 tok/s, Price not published, Context 1.05M tokens, Access waitlisted preview. Right column 'MiMo v2.6 Pro Ultraspeed': Checkpoint same as Pro, Speed claim 10x to 20x, Output speed not published, Price $4.35 / $8.70, Context 1M tokens, Access purchasable today. Footer sourcing line noting neither speed claim is independently measured; OrcaRouter logo bottom-right.

Điều gì đã xảy ra trong tuần này, và tại sao nó không thu hẹp khoảng cách

Lý do khiến so sánh này thực sự có móc tin tức là một commit chứ không phải một thông báo. Giá trị ultrafast đã có trong schema openai-openapi công khai của OpenAI kể từ ngày 13 tháng 8 năm 2026 — cùng ngày chế độ này được công bố — với mô tả giới hạn nó cho gpt-5.6-sol và gọi nó là được kiểm soát truy cập. Commit được thực hiện trong tuần này muộn hơn và nhỏ hơn: vào ngày 25 tháng 9 năm 2026, fe4f7a1 đã thêm ultrafast vào hai phép liệt kê nữa, tham số service-tier ở cấp yêu cầu và trường chính sách service-tier của agent. Trước commit đó, hai danh sách đó gồm auto, default, flex, priority, fast. Sau đó, có một mục được mô tả là "Sử dụng tier dịch vụ ultrafast."ultrafast vào service_tier enum trong openai-openapi specification công khai của nó — trường mà schema mô tả là "tier dịch vụ được dùng cho các yêu cầu mô hình," và trường chính sách gắn với agent. Trước thay đổi đó, danh sách đó gồm default, flex, priority, fast. Sau đó, có một mục được mô tả là "Sử dụng tier dịch vụ ultrafast."

Sự khác biệt này quan trọng với bất kỳ ai đọc bài đưa tin. Đây không phải là bậc đang được tạo ra; mà là bậc đang được nối vào trường mà một agent được cấu hình cùng, nghĩa là cuối cùng có thể viết một client dựa trên nó mà không cần bất kỳ endpoint mới nào. Bản tin ngày hôm sau mô tả một bộ chọn Fast / Standard / Ultrafast sắp ra mắt trên Responses API Playground, với quyền truy cập rộng hơn dự kiến sau hội nghị DevDay của OpenAI. Chúng tôi chưa thấy bộ chọn đó và OpenAI chưa công bố ghi chú triển khai, nên phần đó chỉ có một nguồn. Điều có thể kiểm chứng là các mục schema được thêm vào và việc vẫn thiếu bảng giá sáu tuần sau thông báo.

Trong khi đó, gói của Xiaomi đã có thể mua được trong năm ngày và vẫn là gói duy nhất trong hai gói mà bạn có thể đưa vào hóa đơn. Câu hỏi mở của riêng nó thì khác: liệu mức cao cấp gấp 10 lần có giữ được không, hay liệu nó có hành xử như hầu hết giá ra mắt của một gói cao cấp mới và trôi dần về làn tiêu chuẩn sau khi đợt đưa tin ra mắt kết thúc. Standard Pro ở mức $0.44 / $0.87 là mốc neo, và một gói mở màn ở mức gấp mười lần mốc neo của nó hiếm khi kết thúc ở đó.

Chọn giữa chúng, khi mà bạn có lẽ không thể

Sự thật thực tế khó chịu là với phần lớn độc giả, đây là sự so sánh giữa một hạng bạn không thể mua và một hạng mà bạn có lẽ không nên mua ở giá niêm yết. GPT-5.6 Sol Ultrafast là bản xem trước có danh sách chờ dành cho một số khách hàng được chọn, sẽ mở rộng khi công suất tăng, không có ngày phát hành đại chúng và không có giá; MiMo v2.6 Pro Ultraspeed thì đã có sẵn, đắt đỏ và được thiết kế cho một kiểu người mua cụ thể.

Bài kiểm tra khối lượng công việc là như nhau cho cả hai, và nó nói về hình dạng của đồ thị yêu cầu của bạn hơn là kích thước prompt của bạn. Một lượt sinh dài duy nhất nhận được ít hơn nhiều so với hệ số được quảng cáo, vì xử lý đầu vào và suy luận không tăng tốc theo cùng một tỷ lệ. Một vòng lặp agent bốn mươi bước đằng sau một hành động mà người dùng nhìn thấy sẽ đạt được mức gần với con số đầy đủ hơn nhiều, vì mỗi lượt khứ hồi là độ trễ mà một người đang phải ngồi chờ. Nếu lưu lượng truy cập của bạn trông giống dạng thứ hai, cả hai hạng đều nhắm đến bạn; nếu nó trông giống dạng thứ nhất, làn tiêu chuẩn trên một trong hai mô hình luôn là lựa chọn đúng và làn MiMo-V2.6-Pro tiêu chuẩn ở mức $0.44 / $0.87 là một trong những cách rẻ nhất để gọi một mô hình cấp nghìn tỷ tham số ở bất cứ đâu.

Điều mà cả hai hạng đều không thay đổi là bạn đang mua độ trễ, chứ không phải chất lượng. Nếu bạn đo điểm chuẩn UltraSpeed hoặc Ultrafast so với làn tiêu chuẩn của chính nó trên cùng những lời nhắc giống hệt nhau và nhận được câu trả lời khác nhau, thì đó là một phát hiện đáng để báo cáo, chứ không phải một tính năng — không có gì trong phần mô tả của cả hai nhà cung cấp khẳng định rằng các trọng số đã thay đổi.

Đây cũng là trường hợp mà một router khẳng định được vị trí của mình, và cụ thể là với hạng bạn không thể có được. GPT-5.6 Sol đang hoạt động trên OrcaRouter với tên openai/gpt-5.6-sol ở mức giá của chính nhà cung cấp với không tính thêm phí trên token qua endpoint tương thích OpenAI tại api.orcarouter.ai/v1, vậy là làn chuẩn mà bạn sẽ quay về chỉ cách một lần đổi base URL, và cùng một key mang hơn 200 mô hình. Điều đó quan trọng vì câu trả lời trung thực cho "tôi có nên dùng Ultrafast không" hôm nay là "bạn không thể, nên hãy quyết định cái gì sẽ gánh lưu lượng tương tác trong lúc chờ" — và cách để mua độ trễ mà không phải chờ trong danh sách là định tuyến các cuộc gọi tương tác đến bất kỳ mô hình nào trong danh mục đáp ứng được chuẩn chất lượng của bạn với thời gian thực tế thấp nhất, và để công việc qua đêm trên làn rẻ nhất đạt yêu cầu. Khi hạng đó mở, đó chính là công tắc bạn gạt. Cũng cần nói rõ điều chúng tôi không host: không có mô hình Xiaomi nào trên OrcaRouter, nên MiMo v2.6 Pro Ultraspeed đến từ API riêng của Xiaomi và một số nền tảng bên thứ ba, và trang này không phải là đường dẫn đến nó.

A screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, labelled 'Openweights model, Released September 2026', showing the Intelligence, Performance & Price Analysis headings with an Intelligence Index figure, a Speed figure, a Cost figure of In $0.435 / Out $0.87 with a 99% cache discount, a $0.13 blended figure, a Verbosity rank of 20/115, and a Comparison Summary describing the model as among the leading open-weight models in intelligence and notably fast but somewhat verbose, with text, image, speech and video input and a 1M-token context window.

Điều gì sẽ giải quyết được nó?

Ba phép đo, và chưa có phép đo nào trong số đó tồn tại. Một bảng giá Ultrafast được công bố sẽ khiến đây trở thành phép so sánh mà nó xứng đáng có, thay vì một phép so sánh còn lỗ hổng. Một phân bố độ trễ độc lập ở mức đồng thời được nêu rõ sẽ cho bạn biết hệ số nhân thực tế của Xiaomi nằm gần 10× hay 20× hơn, và liệu nó có trụ được dưới tải hay không, thay vì chỉ trong một minh họa đơn luồng. Và một bản tái tạo độc lập bộ benchmark của một trong hai nhà cung cấp sẽ đưa cả hai bộ số liệu ra khỏi cột tuyên bố.

Cho đến lúc đó, cách diễn giải có thể đứng vững được vẫn hẹp. Xiaomi tung ra một hạng tốc độ có giá nhưng tốc độ mơ hồ; OpenAI tung ra một hạng tốc độ có tốc độ cụ thể nhưng không có giá; cả hai đều cùng mô hình với thứ mà chúng được đặt giá để so sánh, và không cái nào đã được đo lường độc lập. Nếu bạn cần độ trễ đó ngay bây giờ và khối lượng công việc mang tính tương tác, UltraSpeed là có thật, có thể mua được, và được định giá đúng cho kiểu người mua mà nó nhắm tới. Nếu bạn cần nó ngay bây giờ còn khối lượng công việc thì không mang tính tương tác, các làn tiêu chuẩn trên cả hai mô hình rẻ hơn, đã được kiểm chứng, và có sẵn ngay hôm nay — và hạng mà mọi người đang tranh cãi sẽ vẫn ở đó khi ai đó công bố một con số.