Một thẻ hero được tạo tự động so sánh Intern-S2 và GPT-5.6 Sol, hiển thị một trang hình khoa học và dạng sóng tín hiệu đưa vào một mô hình trọng số mở ở bên trái, cùng một điểm cuối API tiên tiến đóng với đồng hồ đo tốc độ ở bên phải, được dán nhãn Apache-2.0 miễn phí tải về và tự lưu trữ trên GPU của riêng bạn, đối chiếu với $5.00 / $30.00 mỗi 1M token và ngữ cảnh 1.05M / đầu ra 128K, với logo OrcaRouter ở góc dưới bên phải.
Guides & Insights

Intern-S2 vs GPT-5.6 Sol: Checkpoint miễn phí và chiếc flagship 30 đô

Tác giả

Alistair Wren

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Đường giá trong cuộc so tài này thoạt nhìn có vẻ vô lý. Intern-S2, một mô hình đa phương thức 397 tỷ tham số mà InternLM phát hành theo Apache-2.0 hôm nay, không tốn gì để tải về và không tốn gì cho mỗi truy vấn một khi bạn đã sở hữu phần cứng để chạy nó. GPT-5.6 Sol, hạng suy luận hàng đầu của Open​AI, niêm yết ở mức 5,00 USD cho mỗi triệu token đầu vào và 30,00 USD cho mỗi triệu token đầu ra trên gói cơ bản của Open​AI — mặc dù mức khuyến mãi mà Open​AI đã áp dụng từ cuối tháng Bảy, hiện được trang mô hình của chúng tôi hiển thị, là 4,00 USD đầu vào và 20,00 USD đầu ra. Đó là một khoảng cách thật sự và là điều đầu tiên ai cũng nhận ra — đồng thời cũng là dữ kiện ít hữu ích nhất trong phép so sánh, bởi mô hình 30 USD và mô hình miễn phí không cạnh tranh cho cùng một loại công việc. GPT-5.6 Sol là hạng mà Open​AI chỉ đến khi phép suy luận khó nhất mà ứng dụng của bạn từng thử phải trả về kết quả đúng. Intern-S2 là một công cụ khoa học với nhánh thị giác được huấn luyện trên các trang tài liệu thô và một đầu dự báo cho tín hiệu chuỗi thời gian. Câu hỏi không phải là cái nào rẻ hơn. Mà là khối lượng công việc của bạn thực sự cần cái nào, và liệu cái "miễn phí" kia có thật miễn phí không.

Những gì bảng nhà cung cấp cho bạn biết và không cho bạn biết

InternLM đã benchmark Intern-S2 so với GPT-5.5, không phải GPT-5.6 Sol. Điều đó đáng được nêu ra trước tiên, bởi vì mọi tuyên bố "Intern-S2 đánh bại GPT" đang lưu hành đều là so sánh với thế hệ OpenAI trước đó, và bất kỳ trang nào trình bày nó như một kết quả Sol đều đang ngoại suy. Gia đình GPT-5.6 cũng trải dài ba tầng — Sol cho công việc khó nhất, Terra cho sản xuất cân bằng, Luna cho khối lượng lớn — và OpenAI đã và đang tích cực điều chỉnh giá chúng, nên một con số Sol được trích dẫn từ một bài viết tháng Chín có thể đã lỗi thời.

Điều mà phần so sánh của nhà cung cấp thực sự xác lập được, với lưu ý thường trực rằng mọi số liệu của Intern-S2 đều là của riêng InternLM và chưa được tái lập:

• Suy luận cấu trúc phân tử — Intern-S2 đạt 62,35 trên MolecularIQ so với 76,41 của GPT-5.5. Intern-S2 thua.

• Sử dụng công cụ khoa học — Intern-S2 66,76 trên TOMG-Bench so với 69,89 của GPT-5.5. Một thất bại sát nút.

• Hướng dẫn phân tử sinh học — Intern-S2 53.95 so với 40.49. Một chiến thắng rõ ràng của Intern-S2.

• Toán trung học phổ thông — Intern-S2 đạt 93,56 trên HMMT-2026 so với 97,06 của GPT-5.5. Intern-S2 thua.

• Kiến thức tổng quát — Intern-S2 đạt 89,77 trên MMLU Pro so với 88,20. Một chiến thắng sát nút của Intern-S2.

• Kiến thức đa phương thức — đạt mức 81,68 trên MMMU Pro.

• Thành thạo terminal — GPT-5.5 đạt 79.40 trên TerminalBench 2.1 so với 64.04 của Intern-S2. Kém 15 điểm.

Ngay cả khi đối đầu với một mô hình Open​AI cũ hơn một thế hệ, Intern-S2 vẫn thua nhiều dòng tổng quát hơn số dòng nó thắng và thắng ở các dòng khoa học. Đối đầu với Sol — một hạng được định vị rõ ràng trên GPT-5.5 cho những suy luận khó nhất — khoảng cách tổng quát gần như chắc chắn sẽ nới rộng. Không có gì trong bằng chứng ủng hộ ý tưởng rằng checkpoint miễn phí có thể cạnh tranh với flagship trả phí về năng lực tổng quát, và cách diễn đạt trung thực là Intern-S2 là một mô hình chuyên biệt, đáng nể về tổng quát và xuất sắc trong sở trường của nó.

“Miễn phí” là một khoản chi tiêu vốn, không phải là một khoản chiết khấu.

Chi phí giấy phép bằng không của Intern-S2 là có thật, nhưng nó không đồng nghĩa với suy luận miễn phí, và đây là lúc so sánh trở nên thực tế. Một checkpoint 403 tỷ tham số cần một node đa GPU đủ mạnh để phục vụ. Nếu bạn đã sở hữu năng lực đó và nó chưa được tận dụng hết, chi phí biên cho truy vấn khoa học tiếp theo gần như chỉ còn là tiền điện — một vị thế kinh tế thực sự mạnh mẽ, và là lý do trọng số mở tồn tại. Nếu bạn không sở hữu năng lực đó, "miễn phí" nghĩa là phải mua hoặc thuê phần cứng, và phép tính thay đổi hoàn toàn.

Bài toán kinh tế của GPT-5.6 Sol thì ngược lại. Không có phần cứng nào phải mua và không có model nào phải vận hành. Bạn trả theo mức giá đo lường — $5.00 cho mỗi triệu token đầu vào và $30.00 cho mỗi triệu token đầu ra ở gói cơ bản, hoặc mức giá khuyến mại $4.00/$20.00 hiện đang áp dụng trên trang model của chúng tôi — và model đi kèm với cửa sổ ngữ cảnh 1.05M token, giới hạn đầu ra 128K, khả năng thị giác, công cụ, cùng độ tin cậy tích lũy của một mẫu flagship đã nằm trong sản xuất kể từ khi API của nó ra mắt vào ngày 9 tháng 7 năm 2026. Bản xem trước Ultrafast, vốn chạy Sol trên phần cứng quy mô tấm wafer với tốc độ lên tới 750 token đầu ra mỗi giây, đẩy cùng model đó hướng tới những công việc đòi hỏi độ trễ nghiêm ngặt, dù nó chỉ giới hạn cho một nhóm nhỏ khách hàng và chưa có giá công bố. Thứ bạn mua bằng $30 không chỉ là năng lực — mà là việc không cần đến một đội vận hành.

• Trọng số — Intern-S2 Apache-2.0, có thể tải xuống, so với GPT-5.6 Sol đóng kín, chỉ dùng qua API.

• Cấu trúc chi phí — chi phí vốn Intern-S2 cho một checkpoint 403B, hay API Intern chính thức tính theo mức sử dụng so với GPT-5.6 Sol $5.00 / $30.00 mỗi triệu theo giá niêm yết, $4.00 / $20.00 giá khuyến mại.

• Ngữ cảnh / đầu ra — Intern-S2 được đánh giá ở mức tối đa 256K văn bản, 64K đa phương thức; đầu ra chưa được công bố so với GPT-5.6 Sol ~1.05M ngữ cảnh, 128K đầu ra.

• Đầu vào — văn bản, hình ảnh, chuỗi thời gian của Intern-S2 so với văn bản và hình ảnh của GPT-5.6 Sol.

• Điểm số độc lập — Intern-S2 chưa có, so với GPT-5.6 Sol, mẫu flagship hàng đầu với lịch sử đánh giá công khai lâu dài.

• Mức tốc độ — Intern-S2 giới hạn bởi phần cứng so với GPT-5.6 Sol Ultrafast preview ở tốc độ lên tới 750 token đầu ra mỗi giây, theo công bố của nhà cung cấp.

A generated two-column scoreboard titled 'Intern-S2 vs GPT-5.6 Sol — the scoreboard.' Left column Intern-S2-397B lists Weights Apache-2.0, Cost self-host capex or Intern API, Context 256K text / 64K multimodal, Inputs text image time series, Independent score none yet, TerminalBench 2.1 64.04. Right column GPT-5.6 Sol lists Weights closed API only, Cost $5.00 / $30.00 list and $4.00 / $20.00 promo, Context 1.05M in / 128K out, Inputs text and image, Independent score flagship tier widely tested, TerminalBench 2.1 79.40. Footer reads 'Intern-S2 figures are InternLM's own and were measured against GPT-5.5, unreproduced; the TerminalBench row uses GPT-5.5 as the OpenAI reference. GPT-5.6 Sol pricing per OpenAI.'

Nơi checkpoint miễn phí thực sự chiếm ưu thế

Có ba tình huống mà Intern-S2 đánh bại Sol mà không cần đến bất kỳ benchmark nào.

Đầu tiên là vấn đề lưu trú dữ liệu. GPT-5.6 Sol là một API đóng — mọi yêu cầu đều rời khỏi hạ tầng của bạn và đi qua hệ thống của Open​AI theo chính sách nội dung của Open​AI. Intern-S2 theo giấy phép Apache-2.0 có thể chạy air-gapped bên trong một môi trường được quản lý chặt chẽ, trên dữ liệu mà về mặt pháp lý không thể gửi đến điểm cuối của bên thứ ba. Đối với một phòng thí nghiệm dược phẩm, một hệ thống bệnh viện, hay một nhà thầu quốc phòng, đặc tính đó không phải là một tính năng; đó là toàn bộ quyết định mua sắm, và không có lượng khả năng nào của Sol có thể thay thế được điều đó.

Thứ hai là tính phương thức. Intern-S2 tiếp nhận đầu vào chuỗi thời gian và tạo ra dự báo; nó cũng đọc trực tiếp các trang tài liệu khoa học thô dưới dạng biểu diễn thị giác nguyên bản thay vì văn bản được trích xuất. Sol thì xử lý văn bản và hình ảnh. Nếu dữ liệu của bạn là một vết ghi địa chấn, một đường cong phụ tải, hay một bài báo quét dày đặc hình vẽ, Intern-S2 có một con đường mà Sol không có, và dòng Biology-Instructions của nhà cung cấp (55,71 so với 10,52 của GPT-5.5) chính là con số phản ánh điều đó.

Thứ ba là tinh chỉnh. Bạn có thể lấy trọng số của Intern-S2 và huấn luyện trên dữ liệu thử nghiệm độc quyền của riêng mình, rồi giữ mô hình đó mãi mãi. Bạn không thể làm điều đó với Sol dù trả bất kỳ giá nào. Đối với một đội mà lợi thế cạnh tranh nằm ở một bộ dữ liệu chuyên biệt, một checkpoint mở có khả năng thích ứng có thể đáng giá hơn một mô hình đóng băng mạnh hơn.

A screenshot of the Hugging Face model card for internlm/Intern-S2, captured September 13, 2026, showing the Apache-2.0 licence badge, the tags image-text-to-text and qwen3_5_moe, the model size of 403B parameters in BF16/F32, the Intern-S2-397B heading, an inference providers panel reading 'This model isn't deployed by any Inference Provider,' and the collection listing nine items.

Chạy cả hai mà không chọn

Những đội ngũ khai thác được nhiều nhất từ sự kết hợp này không coi đó là một sự rẽ nhánh. Họ định tuyến các tác vụ suy luận tổng quát, nhạy cảm với độ trễ và có tính rủi ro cao sang GPT-5.6 Sol — vốn nằm trên OrcaRouter ở đúng mức giá niêm yết của OpenAI với 0% phụ thu, dùng chung một khóa với hơn 200 mô hình khác, nên khi giá Sol thay đổi thì được cập nhật ngay trong cùng ngày, và một giờ nhà cung cấp gặp trục trặc sẽ được xử lý nhờ cơ chế chuyển đổi dự phòng tự động — còn công việc theo lô mang tính khoa học thì họ giữ trên Intern-S2, bất kể chạy ở đâu. DSL định tuyến làm cho ranh giới đó trở nên tường minh: suy luận tổng quát khó đi theo một hướng, phân tích tài liệu và tín hiệu đi theo hướng khác, và sự phân tách này là một cấu hình chứ không phải một tích hợp thứ hai.

Intern-S2 không có trên OrcaRouter; nó là một checkpoint Apache-2.0 cùng ngày, và đường đến nó của bạn là API riêng của nhà cung cấp hoặc một deployment tự host. Sol thì có trên key. Giữa hai lựa chọn đó, kiến trúc thực tế cho một ứng dụng nặng về khoa học là một endpoint cho các lệnh gọi frontier và một deployment cho chuyên gia — với tùy chọn chuyển một trong hai bên về sau.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol at orcarouter.ai/models/openai/gpt-5.6-sol, captured September 13, 2026, showing the model tagged FEATURED by OpenAI dated 2026-07-09 with Vision, Tools, JSON and Reasoning tags, a 1M-token context window and 128K max output, and pricing tiles reading input $4.00 and output $20.00 per 1M tokens with 202.3 million tokens of traffic in seven days.

Bản án

Nếu bạn cần suy luận khó nhất mà ứng dụng của bạn sẽ thử thực hiện, muốn có nó trong một lệnh gọi API, và sẵn sàng trả mức giá flagship tính theo lượng sử dụng cho nó, thì GPT-5.6 Sol là câu trả lời, và một checkpoint mở cùng ngày không thay đổi điều đó. Không có gì trong bảng của chính InternLM cho thấy Intern-S2 sánh ngang với một flagship OpenAI hiện tại về năng lực tổng quát; so sánh đó được thực hiện với thế hệ trước và mô hình mở vẫn thua phần lớn các dòng tổng quát.

Nếu khối lượng công việc của bạn mang tính khoa học, dữ liệu của bạn không thể rời khỏi hạ tầng của bạn, hoặc bạn cần tinh chỉnh trên các kết quả thí nghiệm độc quyền, thì Intern-S2 là mô hình có thể làm được những việc đó — và giấy phép Apache-2.0 của nó nghĩa là phiên bản bạn kiểm chứng chính là phiên bản bạn giữ lại. Hãy dự trù ngân sách cho phần cứng, hãy chuẩn bị tự chạy đánh giá của riêng bạn, và hãy coi mọi con số được công bố về nó như một tuyên bố cho đến khi có ai đó ngoài InternLM tái tạo được một con số như vậy.

Đối với các lệnh gọi mô hình tiên phong song song với bất cứ thứ gì bạn tự vận hành: hơn 200 mô hình khác giữ mô hình chủ lực đóng trên một khóa duy nhất ở mức giá niêm yết của nhà cung cấp, nhờ đó có thể hoán đổi giữa triển khai chuyên dụng và mô hình tính phí theo quy tắc định tuyến.