Thẻ tiêu đề cho Mistral Large 4 so với GPT-6 Sol, hiển thị Mistral Large 4 ở mức $0,68 và $2,09 mỗi triệu token trong bản xem trước công khai từ ngày 6 tháng 10 năm 2026, và GPT-6 Sol ở mức $2,00 và $10,00 sau khi ra mắt ngày 22 tháng 9 năm 2026.
Guides & Insights

Mistral Large 4 so với GPT-6 Sol: Giá xem trước đối đầu với mặc định đã phát hành

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Trên lý thuyết, đây không phải một cuộc so tài sát nút. Mistral Large 4, mẫu flagship trọng số mở 1,05 nghìn tỷ tham số của Mistral, có giá 0,68 USD cho mỗi triệu token đầu vào và 2,09 USD cho mỗi triệu token đầu ra. GPT-6 Sol, phân khúc cao cấp tối ưu chi phí, có giá 2,00 và 10,00 USD — cao hơn khoảng ba lần ở đầu vào và gần năm lần ở đầu ra, và sẽ đổi giá thành 4,00 và 15,00 USD một khi yêu cầu vượt mốc 272.000 token. Một tháng dùng 100 triệu token với tỷ lệ chia đầu vào/đầu ra là 4:1 tốn khoảng 140 USD với Mistral Large 4 và khoảng 480 USD với GPT-6 Sol. Đó là toàn bộ lập luận, và nó rất mạnh, cho đến khi bạn đọc dòng thứ hai trong tài liệu của chính Mistral: Mistral Large 4 đang ở giai đoạn public preview, và nó là mẫu duy nhất trong hai mẫu này vẫn còn đang thay đổi.

Sự khác biệt đó chính là toàn bộ phép so sánh. GPT-6 Sol ra mắt ngày 22 tháng 9 năm 2026 và đã ổn định; hành vi, bảng giá và các điểm số độc lập của nó đều đã ngã ngũ. Mistral Large 4 xuất hiện ngày 6 tháng 10 năm 2026 với một API dạng xem trước, lời hứa phát hành trọng số "trước cuối tháng", và một lượt chạy học tăng cường mà Mistral nói vẫn đang trong quá trình thực hiện. Phiên bản bạn gọi hôm nay không phải là phiên bản bạn sẽ có vào tháng 11. Vậy nên câu hỏi đáng quan tâm không phải là "cái nào tốt hơn" — xét về trí tuệ đo lường được, chúng vẫn chưa cùng một đẳng cấp — mà là "cái nào thuộc về stack của bạn, và trong những điều kiện nào".

Những gì mỗi nhà cung cấp thực sự đã phát hành

Mistral Large 4 là một mô hình hỗn hợp chuyên gia (mixture-of-experts) chi tiết, với 49 tỷ tham số hoạt động trên tổng số 1,05 nghìn tỷ, cộng thêm một bộ mã hóa thị giác 1,6 tỷ tham số. Mô hình này tiếp nhận văn bản và hình ảnh, phục vụ cửa sổ ngữ cảnh khoảng một triệu token, và được huấn luyện từ đầu trên 3.800 GPU NVIDIA Grace Blackwell trong các trung tâm dữ liệu châu Âu của chính Mistral. Mistral mô tả đây là mô hình lớn nhất và có năng lực mạnh nhất của hãng cho đến nay, đồng thời cho biết các trọng số — được phát hành theo giấy phép mở — sẽ có trước cuối tháng 10 năm 2026, tùy thuộc vào một giai đoạn red-teaming được tiến hành với các đối tác an ninh mạng và cơ quan nhà nước. Cho đến lúc đó, cách duy nhất để truy cập là API xem trước.

GPT-6 Sol là tầng giữa của dòng GPT-6 thuộc OpenAI, dưới mẫu chủ lực GPT-6 Astra và trên GPT-6 Luna nhanh. Nó chấp nhận văn bản, hình ảnh và tệp, có cửa sổ ngữ cảnh chỉ hơn một triệu token với tối đa 128.000 token đầu ra, đồng thời cung cấp mức độ suy luận có thể cấu hình, gọi hàm, đầu ra có cấu trúc và lấy mẫu có hạt giống. Đây là một API đóng, có kiểm duyệt — trái ngược với lời chào mời của Mistral, rằng một tổ chức cuối cùng có thể tự vận hành ML4 trên phần cứng của riêng mình theo các chính sách của chính mình.

• Tổng số tham số — Mistral Large 4 1.05T (49B hoạt động) so với GPT-6 Sol không được tiết lộ

• Cửa sổ ngữ cảnh — khoảng 1M token mỗi loại, Mistral Large được quảng cáo ở mức 1M, GPT-6 Sol ở khoảng ~1.05M

• Đầu ra tối đa — GPT-6 Sol 128K token so với Mistral Large 4 chưa có tài liệu

• Phương thức đầu vào — Mistral Large 4 văn bản và hình ảnh so với GPT-6 Sol văn bản, hình ảnh và tệp

• Giá đầu vào — Mistral Large 4 $0,68 mỗi 1 triệu so với GPT-6 Sol $2,00, tăng lên $4,00 khi vượt quá 272K token

• Giá đầu ra — Mistral Large 4 2,09 USD mỗi 1M so với GPT-6 Sol 10,00 USD, tăng lên 15,00 USD khi vượt cùng ngưỡng

• Đầu vào đã lưu trong bộ nhớ đệm — Mistral Large 4 $0.07 mỗi 1M so với GPT-6 Sol $0.20, tăng lên $0.40

• Trọng số — Mistral Large 4 giấy phép mở, được hứa hẹn vào cuối tháng 10 năm 2026 so với GPT-6 Sol đóng

• Trạng thái phát hành — Mistral Large 4 bản xem trước công khai, ngày 6 tháng 10 năm 2026 so với GPT-6 Sol có sẵn rộng rãi, ngày 22 tháng 9 năm 2026

A two-column scoreboard comparing Mistral Large 4 and GPT-6 Sol across input price, output price, cached input, context window, Artificial Analysis Index score and weight availability.

Nơi GPT-6 Sol đơn giản là dẫn đầu

Bài đăng ra mắt của Mistral nói thẳng về điều này một cách bất thường, giúp mọi người khỏi phải đoán. Trên Artificial Analysis Intelligence Index — bản sửa đổi v4.3.2, gồm mười bài đánh giá từ AA-Briefcase đến CritPt — GPT-6 Sol đạt 47.6 điểm và nằm khoảng vị trí thứ 14 trong số 147 mô hình trên bảng đó. Mistral Large 4 hoàn toàn không có điểm Chỉ số nào được công bố. Thứ hiện có là một hàng thông tin chưa đầy đủ trên Artificial Analysis, nơi liệt kê mô hình là “Mistral Large 4 Preview” và báo cáo vị trí của nó là không được công bố công khai. Ở các bài đánh giá riêng lẻ có thể thấy, GPT-6 Sol dẫn đầu rõ rệt: 47.9 so với ngưỡng Humanity's Last Exam mà nó vượt qua trong khi ML4 không xuất hiện, 83.7 so với 80.3 trên AA-LCR long-context recall, 43.9 so với 28.3 trên Terminal-Bench 4.0.

Những số liệu Terminal-Bench đó xứng đáng có một lưu ý đi theo hướng ngược lại. Con số 28,3% của Mistral và 59,4% trên SWE-Atlas-QnA đến từ dữ liệu mà Artificial Analysis đã đánh giá riêng trước khi ra mắt bộ khung đánh giá, và Mistral nói rõ rằng chúng sẽ xuất hiện trên Artificial Analysis Coding Agent Index khi bộ khung đó được phát hành. Chúng không phải do nhà cung cấp tự bịa ra, nhưng bạn cũng không thể tái tạo chúng ngay hôm nay. Hãy coi chúng là đầy hứa hẹn nhưng chưa được xác minh.

Ở những nơi Mistral có công bố số liệu, một số con số đáng để đọc kỹ, vì đó là kiểu tuyên bố mà một nhà cung cấp đưa ra khi họ tự tin. Mistral báo cáo rằng trong một bài kiểm tra của Artificial Analysis Cyber Index — tái tạo một lỗ hổng thực tế trong phần mềm mã nguồn mở, rồi vá nó — ML4 đạt 82%, cao nhất trong số mọi mô hình, và rằng nó giải được 93% trong 40 thách thức của Cybench. Nó cũng báo cáo rằng các mô hình đóng hàng đầu, bao gồm Claude Opus 5.5 và GPT-6 Astra, đạt gần như bằng không trong cùng bài kiểm tra tính tái lập đó vì chúng từ chối nhiệm vụ. Đó là những số liệu do nhà cung cấp báo cáo và chưa được tái tạo độc lập, nhưng cơ chế cốt lõi không hề kỳ lạ: một mô hình từ chối nhiều hơn thì thực tế hoàn thành ít hơn, và Mistral đã tiếp thị lập luận đó kể từ bước chuyển hướng sang trọng số mở của mình.

Về năng lực tổng quát, đánh giá trung thực là GPT-6 Sol hiện nay là mô hình tốt hơn còn Mistral Large 4 là mô hình rẻ hơn. Nếu khối lượng công việc của bạn chỉ là hỏi đáp hoặc tác vụ lập trình đơn thuần và bạn không ưu tiên tự vận hành, thì khoản thêm năm đô la cho mỗi triệu token đầu ra của GPT-6 Sol sẽ mang lại cho bạn một mô hình mà hành vi sẽ không thay đổi khi bạn đang dùng.

Lập luận cho bản xem trước, vốn không chỉ là giá cả

Ba điều khiến Mistral Large 4 không chỉ là một lựa chọn giá rẻ, và không điều nào trong số đó là cái giá.

Điều đầu tiên là chủ quyền theo đúng nghĩa đen. ML4 được huấn luyện trong các trung tâm dữ liệu châu Âu trên phần cứng châu Âu và sẽ có thể được phục vụ trong một khu vực châu Âu mà Mistral vận hành khép kín từ đầu đến cuối. Đối với một bên mua chịu sự quản lý, đó không phải là một câu khẩu hiệu tiếp thị; đó là một yêu cầu mua sắm mà GPT-6 Sol hiện không thể đáp ứng ở bất kỳ mức giá nào. Mistral đã huy động 3 tỷ euro trong vòng Series D dành riêng để tài trợ cho việc này, vòng gọi vốn cổ phần lớn nhất mà một công ty công nghệ châu Âu từng huy động, và mô hình này là cột mốc đầu tiên hướng tới mục tiêu đó.

Điều thứ hai là trọng số. Khi chúng được phát hành, một tổ chức sở hữu GPU có thể chạy ML4 tại chỗ mà không cần nhà cung cấp nào can thiệp, điều này thay đổi cả hành vi từ chối lẫn câu chuyện về lưu trú dữ liệu. Khi điều đó xảy ra, GPT-6 Sol vẫn sẽ chỉ là một lệnh gọi API. Nếu lộ trình của bạn có một giai đoạn tại chỗ, ML4 là cái duy nhất trong hai cái có giai đoạn đó.

Điều thứ ba là nhịp độ. Mistral nói rằng lần chạy RL đằng sau bản xem trước này chưa bão hòa và rằng họ kỳ vọng “những cải thiện lớn và nhanh chóng trong những tuần và tháng sắp tới”. Khi một nhà cung cấp phát hành bản xem trước và tuyên bố rằng đường cong vẫn đang đi lên, mức giá bạn được báo hôm nay gắn với phiên bản tệ nhất của mô hình mà bạn sẽ phải trả tiền. Giá của GPT-6 Sol gắn với một năng lực cố định.

Chạy cả hai mà không đặt cược vào bên nào

A screenshot of the OrcaRouter model page for GPT-6 Sol, showing the openai/gpt-6-sol route, its text, image and file input, and the $2.00 input and $10.00 output price per million tokens.

Điều khó xử của bản xem trước là bạn không thể ghim nó. Nếu sản phẩm của bạn phụ thuộc vào hành vi hiện tại của ML4, một bản cập nhật vào tuần sau sẽ là một sự cố production. Nếu nó phụ thuộc vào GPT-6 Sol, bạn đang trả một khoản phụ phí cố định để đổi lấy sự ổn định. Cấu trúc hợp lý thường là cả hai, nằm sau một endpoint duy nhất, vì vậy quyết định chỉ là một quy tắc định tuyến chứ không phải là một kiến trúc.

Đó chính là mục đích của OrcaRouter. Cả hai mô hình đều nằm sau một API duy nhất tương thích OpenAI với mức chênh 0%, và điều này ở đây quan trọng hơn mức thông thường: giá xem trước của Mistral là mức giá ra mắt và sẽ thay đổi — tăng lên khi giai đoạn xem trước kết thúc, có thể giảm xuống khi trọng số được phát hành và sự cạnh tranh trên mô hình mở trở nên gay gắt — và vì giá niêm yết của nhà cung cấp được chuyển thẳng qua, nên việc nhà cung cấp giảm giá sẽ có hiệu lực ngay bên phía chúng tôi trong cùng ngày, thay vì phải chờ ai đó cập nhật một bảng mã cứng. DSL định tuyến cho phép bạn gửi các tác vụ tài liệu ngữ cảnh dài đến mô hình rẻ nhất cho dạng đó, và giữ GPT-6 Sol làm phương án dự phòng cho bất cứ thứ gì cần sự ổn định. Chuyển đổi dự phòng tự động xử lý đúng tình huống mà một API dạng xem trước dễ gặp nhất: điểm cuối bận hoặc tạm thời không khả dụng, điều hoàn toàn bình thường với bất kỳ mô hình nào trong tháng đầu tiên.

A decision card headed When each one wins, matching GPT-6 Sol to production work, published scores and a 128K output ceiling, and Mistral Large 4 to European deployment, open weights by 31 October and security research.

Chọn cái nào?

Chọn GPT-6 Sol nếu khối lượng công việc thuộc môi trường sản xuất, hành vi quan trọng hơn đơn giá và bạn không có yêu cầu tự chạy mô hình. Điểm 47,6 trên Intelligence Index, giới hạn đầu ra 128K và mức đọc bộ nhớ đệm $0,20 khiến nó trở thành lựa chọn mặc định an toàn hơn, và việc định giá lại cho ngữ cảnh dài tại 272.000 token rất dễ lên kế hoạch vì ngưỡng đã được công bố.

Chọn Mistral Large 4 nếu bạn đang xây dựng một thứ mà một trong ba điều sau là đúng: bạn cần một mô hình được triển khai ở châu Âu, bạn cần trọng số mở vào một lúc nào đó, hoặc bạn đang ở trong lĩnh vực xuất khẩu an ninh, nơi một lời từ chối là một thất bại — 82% trên bài kiểm tra tái tạo-và-vá lỗi so với gần bằng không ở các lựa chọn thay thế đóng là một khoảng cách năng lực thực sự, dù được nhà cung cấp báo cáo hay không. Và hãy chấp nhận rằng bạn đang mua một mô hình đang trong quá trình phát triển. Hãy dự trù ngân sách cho việc bề mặt API sẽ thay đổi, và đừng mã hóa cứng mức giá xem trước vào dự báo cho quý tới.

Điều cần theo dõi trước khi đưa ra quyết định theo bất kỳ hướng nào: đợt phát hành trọng số thực tế vào cuối tháng Mười, thời điểm mà tuyên bố về open-weights không còn chỉ là lời hứa; điểm số Artificial Analysis Intelligence Index đầu tiên được công bố cho ML4, sẽ định đoạt liệu khoảng cách giá là một món hời hay một sự giảm giá để đổi lấy ít hơn; và Coding Agent Index, nơi những con số Terminal-Bench riêng tư của Mistral hoặc sẽ được xác nhận, hoặc sẽ âm thầm không được xác nhận.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày