Một thẻ tiêu đề hero cho một bài viết so sánh GPT-6 Sol với Kimi K3, mang dòng chữ 'GPT-6 Sol vs Kimi K3' cùng phụ đề 'Ba giả định về trọng số mở, được kiểm chứng với một hóa đơn', cho thấy GPT-6 Sol ở dạng đóng với mức $2.00/$10.00 và Chỉ số 48, còn Kimi K3 ở dạng trọng số mở với mức $3.00/$15.00 và Chỉ số 44.
Guides & Insights

GPT-6 Sol vs Kimi K3: Ba giả định về trọng số mở, được kiểm chứng bằng một hóa đơn

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Mua trọng số mở thường là đặt cược vào ba điều: rằng chúng sẽ rẻ hơn, rằng chúng cho bạn quyền kiểm soát, và rằng chúng là tấm bảo hiểm phòng khi nhà cung cấp đổi ý. Kimi K3, mô hình 2,8 nghìn tỷ tham số mà Moonshot AI phát hành dưới dạng trọng số mở vào ngày 27 tháng 7 năm 2026, và GPT-6 Sol, mô hình đóng ra mắt ngày 22 tháng 9 năm 2026, là một phép thử rõ ràng cho cả ba điều đó, bởi vì hai mô hình này đủ sát nhau trên bảng trung lập đến mức các giả định buộc phải tự mình gánh vác lập luận.

Đây là cách chúng thể hiện. K3 không rẻ hơn trên mỗi tác vụ — nó đắt hơn khoảng gấp đôi, ở mức $3.00 và $15.00 mỗi triệu token, so với $2.00 và $10.00 của Sol. Khả năng kiểm soát là có thật, nhưng có một ngưỡng phần cứng tối thiểu mà hầu hết các nhóm sẽ không vượt qua. Và bảo hiểm là giả định duy nhất đứng vững hoàn toàn, khiến nó trở thành thứ duy nhất đáng để trả tiền. Phần tiếp theo là phép tính đằng sau mỗi điều đó.

Hai mô hình, một cách ngắn gọn

Kimi K3 là một mô hình mixture-of-experts thưa với tổng cộng 2,8 nghìn tỷ tham số và khoảng 104 tỷ — tương đương khoảng 3,7% — tham số được kích hoạt trên mỗi token, được công bố theo giấy phép MIT đã sửa đổi với cửa sổ ngữ cảnh 1.048.576 token. Các tuyên bố về kiến trúc của Moonshot rất cụ thể: Kimi Delta Attention, một sơ đồ attention tuyến tính lai mà công ty cho biết nhanh hơn tới 6,3 lần khi giải mã ngữ cảnh dài, cùng với Attention Residuals và khung Stable LatentMoE. Mô hình này nhận đầu vào là văn bản và hình ảnh, rồi trả về văn bản. Phiên bản chưa chưng cất có kích thước vượt quá 1 TB và một triển khai production được mô tả với mức tối thiểu 64 bộ tăng tốc.

GPT-6 Sol là mô hình đóng, chỉ dùng một định danh duy nhất, có mức giá cố định là 2,00 USD và 10,00 USD, cùng 0,20 USD cho mỗi lần đọc từ bộ nhớ đệm và 2,50 USD cho mỗi lần ghi vào bộ nhớ đệm; toàn bộ yêu cầu vượt quá 272.000 token đầu vào sẽ được tính lại giá thành 4,00 USD và 15,00 USD. Đầu vào là văn bản và hình ảnh, đầu ra là văn bản, với cửa sổ 1.050.000 token, mức đầu vào tối đa 922.000 token, giới hạn đầu ra 128.000 token và mốc kiến thức đến ngày 20 tháng 4 năm 2026.

Các cửa sổ ngữ cảnh, xét về mặt thực tiễn, là cùng một con số — chênh lệch 0,1%. Điều đó loại bỏ lý do phổ biến nhất để ưu tiên một cái hơn cái kia, và có nghĩa là quyết định hoàn toàn dựa trên ba giả định.

Giả định một: trọng số mở rẻ hơn. Không phải vậy.

• Đầu vào — GPT-6 Sol $2.00 mỗi triệu token so với Kimi K3 $3.00 mỗi triệu token

• Đầu ra — GPT-6 Sol $10,00 mỗi triệu token so với Kimi K3 $15,00 mỗi triệu token

• Đầu vào đã cache — GPT-6 Sol $0,20 mỗi triệu token so với Kimi K3 $0,30 mỗi triệu token; cả hai đều bằng một phần mười mức giá đầu vào chưa cache

• Intelligence Index, độc lập — GPT-6 Sol 48 ở mức nỗ lực tối đa so với Kimi K3 44 ở mức nỗ lực tối đa

• Chi phí cho mỗi tác vụ Index, độc lập — GPT-6 Sol $1.06 so với Kimi K3 $2.00

• Token đầu ra cho lần chạy chỉ mục — GPT-6 Sol 77M so với Kimi K3 160M

• Cửa sổ ngữ cảnh — GPT-6 Sol 1.050.000 token so với Kimi K3 1.048.576 token

• Trọng số — GPT-6 Sol đóng so với Kimi K3 mở, có thể tải xuống và tự lưu trữ

• Giấy phép — GPT-6 Sol không áp dụng so với Kimi K3 Modified MIT

• Tổng số tham số — GPT-6 Sol không được tiết lộ so với Kimi K3 2.800 tỷ, trong đó 104 tỷ hoạt động trên mỗi token

Sol rẻ hơn ở mọi dòng trong bảng giá, và khoảng cách rộng nhất đúng ở nơi các khối lượng công việc agentic chi tiền. Hội đồng độc lập đồng tình về hướng và đại khái về quy mô: Sol tốn khoảng một nửa chi phí cho mỗi tác vụ hoàn thành, trong khi cao hơn bốn điểm chỉ số. K3 tạo ra lượng token đầu ra nhiều hơn gấp đôi một chút để chạy cùng chỉ số.

Một chi tiết tinh tế khiến đây chưa phải là một cuộc áp đảo. Moonshot tuyên bố K3 phát ra ít hơn 21% token đầu ra so với thế hệ tiền nhiệm, và phần việc kiến trúc — sơ đồ attention, thiết kế residual — nhắm thẳng vào chi phí giải mã ngữ cảnh dài. Trên một khối lượng công việc chủ yếu gồm các đầu vào rất dài, các tính năng hiệu quả của K3 có thể thu hẹp một phần khoảng cách mà lần chạy chỉ số cho thấy. Chưa ai công bố phép đo đó trên một bộ khung đánh giá tương đương, nên hãy coi đây là tuyên bố của nhà cung cấp với một cơ chế hợp lý, chứ không phải là kết quả.

A six-row scoreboard card titled 'GPT-6 Sol vs Kimi K3 - the scoreboard', comparing the two models on input price, output price, Intelligence Index, cost per task, weight availability and context window. The left column lists GPT-6 Sol at $2.00 input and $10.00 output, an Index of 48, $1.06 per task, closed weights and a 1,050,000-token context; the right column lists Kimi K3 at $3.00 and $15.00, an Index of 44, $2.00 per task, open weights under Modified MIT and a 1,048,576-token context. A footer reads 'Vendor list prices; Index per Artificial Analysis.'Screenshot of the Artificial Analysis model page for Kimi K3 (max), captured 23 September 2026, showing an Intelligence Index score of 44 in the open-weights class, list pricing of $3.00 per million input tokens and $15.00 per million output tokens, a cost of $2.00 per Intelligence Index task, 160 million output tokens generated during the index run, a 1M-token context window, 2.8 trillion total parameters with 104 billion active, and open model weights under the Kimi K3 license.

Giả định thứ hai: trọng số mở cho bạn quyền kiểm soát. Cho tới ngưỡng phần cứng.

Khả năng kiểm soát đó là có thật và đáng được nói rõ, bởi vì "open weights" thường được dùng một cách lỏng lẻo. Giấy phép Modified MIT trên một checkpoint có thể tải xuống nghĩa là bạn có thể chạy mô hình trên phần cứng của riêng mình, tinh chỉnh nó, ghim một bản sửa đổi cụ thể, và giữ suy luận trong một ranh giới do bạn kiểm soát. Không điều nào trong số đó có được với GPT-6 Sol dù ở bất kỳ mức giá nào.

Điều đó không có nghĩa là tự vận hành là một sự thay thế cho API về chi phí. Các con số đã công bố đặt checkpoint độ chính xác đầy đủ ở khoảng 4,9 TB, hoặc khoảng 397 GB khi lượng tử hóa 1-bit, với mức sàn triển khai trong khoảng 410 GB bộ nhớ kết hợp và các triển khai thực tế được mô tả theo 64 bộ tăng tốc. Một nhóm đã vận hành cụm thuộc hạng đó thì có một lựa chọn thực sự ở đây. Một nhóm không làm vậy đang so sánh hóa đơn API với một khoản mua sắm vốn, và hóa đơn API thắng áp đảo.

Phiên bản trung thực của lập luận về kiểm soát hẹp hơn so với cách nó thường được trình bày: trọng số mở cho bạn khả năng rời đi, chứ không phải khả năng chạy với chi phí rẻ. Đó là những thứ khác nhau, và chỉ một trong số đó là có sẵn cho hầu hết các nhóm.

Giả định thứ ba: trọng số mở là một sự bảo hiểm. Điều này đúng.

Giả định thứ ba vẫn đứng vững trước mọi con số ở trên, và đó chính là lý do vì sao K3 lại có thị trường. Moonshot có thể bị mua lại, có thể thay đổi giấy phép cho các phiên bản tương lai, có thể ngừng hỗ trợ K3, có thể tăng giá, có thể tạm ngừng các gói đăng ký — và họ đã tạm ngừng đăng ký mới trong vòng 48 giờ sau khi phát hành để bảo vệ chất lượng dịch vụ cho những khách hàng trả phí hiện hữu, điều này là minh chứng sống động rằng quyền truy cập API là một quyết định chính sách chứ không phải một thuộc tính.

Nếu K3 bị ngừng hỗ trợ, trọng số bạn đã tải về vẫn chạy được. Nếu Moonshot tăng giá API lên gấp ba, triển khai tự vận hành của bạn vẫn không hề bị ảnh hưởng. Nếu bạn cần chứng minh với kiểm toán viên rằng ngăn xếp suy luận của mình đang đóng băng ở một phiên bản đã biết, thì một checkpoint cho bạn điều đó, còn API thì không. Không điều nào trong số này hiện ra trên bảng chi phí mỗi tác vụ, và tất cả chúng đều là thật.

Câu hỏi là nó đáng giá bao nhiêu. Dựa trên những con số ở trên, bạn đang trả gần như gấp đôi cho mỗi tác vụ hoàn thành để có khoản bảo hiểm đó, cộng thêm bốn điểm chỉ số về năng lực. Với một khối lượng công việc mà việc API bị ngừng hỗ trợ đồng nghĩa với gián đoạn kinh doanh, thì mức đó là rẻ. Với một khối lượng công việc mà bạn chỉ cần chuyển sang mô hình khác, thì đó là khoản phí bảo hiểm cho một biện pháp phòng ngừa rủi ro mà bạn sẽ không bao giờ dùng tới.

Cả hai đều nằm trên cùng một phím nếu bạn muốn chúng như vậy.

Screenshot of OrcaRouter's model page for Kimi K3, captured 23 September 2026, showing the model id kimi/kimi-k3 from provider MoonshotAI, a 1,048,576-token context window, text and image input with text output, vision, tool, JSON and reasoning support, list pricing of $3.00 per million input tokens and $15.00 per million output tokens, a p50 time to first token of 8.11 seconds and an OpenAI-compatible API served over both /v1/chat/completions and /v1/responses.

Kimi K3 có trong danh mục của OrcaRouter ở mức giá niêm yết của Moonshot, theo mô hình chuyển tiếp mà đưa thay đổi giá của Moonshot có hiệu lực ở phía chúng tôi ngay trong cùng ngày thay vì sau khi một nhà bán lại đàm phán lại. GPT-6 Sol hiện không có trong danh mục của chúng tôi tại thời điểm viết bài và có thể truy cập qua API riêng của OpenAI.

Sự kết hợp đó đáng giá hơn vẻ ngoài của nó đối với quyết định cụ thể này, bởi vì hai mô hình thuộc những chế độ lỗi khác nhau. Lý do để chạy K3 không phải vì nó rẻ hơn — nó không rẻ hơn — mà vì nó là một biện pháp phòng ngừa rủi ro, và một biện pháp phòng ngừa mà bạn không thể chuyển sang nhanh thì cũng chẳng phòng ngừa được bao nhiêu. Đặt K3 phía sau cùng endpoint với mọi thứ khác, với chuyển đổi dự phòng tự động và một quy tắc định tuyến có thể thay đổi trong cấu hình, chính là điều biến "chúng ta có một phương án dự phòng open-weight" từ một slide trong bài trình bày thành thứ hoạt động được lúc 3 giờ sáng.

Mỗi loại thực sự dùng để làm gì

• Nếu bạn muốn chi phí thấp nhất cho mỗi tác vụ hoàn thành trong công việc tổng quát — GPT-6 Sol, và mức chênh lệch khoảng 2×.

• Nếu bạn muốn khả năng cao nhất trên bảng trung lập của cả hai — GPT-6 Sol hơn bốn điểm.

• Nếu bạn đã vận hành một cụm trong lớp bộ nhớ từ 400 GB trở lên và cần suy luận bên trong ranh giới của chính mình — K3, thì cách tính toán sẽ thay đổi hoàn toàn, bởi vì chi phí biên của các trọng số không giống với chi phí của phần cứng.

• Nếu yêu cầu thực sự của bạn là mô hình của bạn không thể bị lấy đi khỏi bạn — K3, và đây là lập luận duy nhất trong so sánh mà Sol không thể trả lời.

• Nếu bạn đang chọn theo giá trên mỗi token vì K3 trông giống mô hình Trung Quốc rẻ hơn — hãy kiểm tra số lượng token trước. Với 160 triệu token đầu ra cho lần chạy chỉ mục so với 77 triệu của Sol, mức giá rẻ hơn đang mua nhiều token hơn, chứ không phải hóa đơn nhỏ hơn.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày