
Intern-S2 vs GPT-5.6 Sol: เช็คพอยต์ฟรีและเรือธงราคา $30
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
ราคาที่แสดงในคู่เปรียบเทียบนี้ดูไร้สาระเมื่อมองแวบแรก Intern-S2 โมเดลมัลติโมดัลขนาด 397 พันล้านพารามิเตอร์ที่ InternLM เปิดตัวภายใต้ Apache-2.0 วันนี้ ไม่มีค่าใช้จ่ายในการดาวน์โหลด และไม่มีค่าใช้จ่ายต่อคิวรี เมื่อคุณมีฮาร์ดแวร์สำหรับรันมันแล้ว GPT-5.6 Sol ระดับการให้เหตุผลระดับเรือธงของ OpenAI ตั้งราคาไว้ที่ 5.00 ดอลลาร์ต่ออินพุต 1 ล้านโทเค็น และ 30.00 ดอลลาร์ต่อเอาต์พุต 1 ล้านโทเค็น ในระดับพื้นฐานของ OpenAI — แม้ว่าอัตราโปรโมชันที่ OpenAI ใช้มาตั้งแต่ปลายเดือนกรกฎาคม ซึ่งหน้าโมเดลของเราเองในขณะนี้แสดงอยู่ จะเป็น 4.00 ดอลลาร์สำหรับอินพุต และ 20.00 ดอลลาร์สำหรับเอาต์พุต นั่นคือช่องว่างที่แท้จริง และเป็นสิ่งแรกที่ทุกคนสังเกตเห็น — และยังเป็นข้อเท็จจริงที่มีประโยชน์น้อยที่สุดในการเปรียบเทียบนี้ด้วย เพราะโมเดลราคา 30 ดอลลาร์กับโมเดลฟรีไม่ได้แข่งขันกันสำหรับงานเดียวกัน GPT-5.6 Sol คือระดับที่ OpenAI ชี้ไปเมื่อการให้เหตุผลที่ยากที่สุดที่แอปพลิเคชันของคุณจะลองทำต้องได้ผลลัพธ์ที่ถูกต้อง Intern-S2 เป็นเครื่องมือทางวิทยาศาสตร์ที่มีเส้นทางด้านภาพซึ่งฝึกบนหน้าวรรณกรรมดิบ และมีส่วนหัวพยากรณ์สำหรับสัญญาณอนุกรมเวลา คำถามไม่ใช่ว่าอันไหนถูกกว่า แต่คืออันไหนที่เวิร์กโหลดของคุณต้องการจริง ๆ และตัวที่ "ฟรี" นั้นฟรีจริงหรือไม่
สิ่งที่ตารางผู้ขายบอกและไม่บอกคุณ
InternLM ได้ทดสอบวัดประสิทธิภาพ Intern-S2 เทียบกับ GPT-5.5 ไม่ใช่ GPT-5.6 Sol เรื่องนี้ควรพูดไว้ก่อนเป็นอันดับแรก เพราะทุกข้ออ้างที่ว่า "Intern-S2 เอาชนะ GPT" ที่หมุนเวียนอยู่ในตอนนี้ ล้วนเป็นการเปรียบเทียบกับรุ่นก่อนของ OpenAI และหน้าใดก็ตามที่นำเสนอผลนี้อาว่ามันเป็นผลของ Sol กำลังคาดการณ์เกินข้อมูลที่มีอยู่ ตระกูล GPT-5.6 ยังครอบคลุมสามระดับ ได้แก่ Sol สำหรับงานที่ยากที่สุด Terra สำหรับงานโปรดักชันที่สมดุล และ Luna สำหรับงานปริมาณสูง และ OpenAI ได้ปรับราคาโมเดลเหล่านี้อย่างต่อเนื่อง ดังนั้นตัวเลขของ Sol ที่ยกมาจากบทความเมื่อเดือนกันยายนอาจล้าสมัยไปแล้ว
สิ่งที่การเปรียบเทียบของผู้จำหน่ายestablishได้นั้น โดยมีข้อแม้ถาวรว่าตัวเลขทุกตัวของ Intern-S2 เป็นของ InternLM เองและยังไม่มีการทำซ้ำ:
• การให้เหตุผลเชิงโครงสร้างโมเลกุล — Intern-S2 ได้ 62.35 บน MolecularIQ เทียบกับ 76.41 ของ GPT-5.5 Intern-S2 แพ้
• การใช้เครื่องมือทางวิทยาศาสตร์ — Intern-S2 66.76 บน TOMG-Bench เทียบกับ 69.89 ของ GPT-5.5 เป็นการแพ้เพียงเล็กน้อย
• คำสั่งทางชีวโมเลกุล — Intern-S2 53.95 เทียบกับ 40.49 เป็นชัยชนะที่ชัดเจนของ Intern-S2
• คณิตศาสตร์ระดับมัธยมปลาย — Intern-S2 93.56 บน HMMT-2026 เทียบกับ GPT-5.5 ที่ 97.06 Intern-S2 แพ้
• ความรู้ทั่วไป — Intern-S2 89.77 บน MMLU Pro เทียบกับ 88.20 ถือเป็นชัยชนะแบบเฉียดฉิวของ Intern-S2
• ความรู้แบบมัลติโมดัล — ระดับ 81.68 บน MMMU Pro
• ความเชี่ยวชาญด้านเทอร์มินัล — GPT-5.5 ได้ 79.40 บน TerminalBench 2.1 เทียบกับ Intern-S2 64.04 ถือเป็นส่วนต่างสิบห้าคะแนน
แม้เมื่อเทียบกับโมเดล OpenAI ที่เก่ากว่าหนึ่งรุ่น Intern-S2 ก็แพ้ในแถวทั่วไปมากกว่าชนะ และชนะในแถวด้านวิทยาศาสตร์ เมื่อเทียบกับ Sol — ระดับที่ถูกวางตำแหน่งไว้เหนือ GPT-5.5 อย่างชัดเจนสำหรับการให้เหตุผลที่ยากที่สุด — ช่องว่างด้านความสามารถทั่วไปแทบจะแน่นอนว่ากว้างขึ้น ไม่มีหลักฐานใดสนับสนุนแนวคิดที่ว่าเช็กพอยต์ฟรีนี้เทียบเคียงได้กับเรือธงแบบเสียค่าใช้จ่ายในด้านความสามารถทั่วไป และกรอบที่ตรงไปตรงมาคือ Intern-S2 เป็นผู้เชี่ยวชาญเฉพาะทางที่น่านับถือในภาพรวมและยอดเยี่ยมในสายของตัวเอง
"ฟรี" คือรายจ่ายฝ่ายทุน ไม่ใช่ส่วนลด
การที่ค่าลิขสิทธิ์ของ Intern-S2 เป็นศูนย์นั้นเป็นเรื่องจริง แต่มันไม่เหมือนกับการอินเฟอเรนซ์ฟรี และนี่คือจุดที่การเปรียบเทียบเริ่มใช้ได้จริงในทางปฏิบัติ เช็กพอยต์ขนาด 403 พันล้านพารามิเตอร์ต้องใช้โหนดหลาย GPU ที่จริงจังเพื่อให้บริการ หากคุณมีกำลังความสามารถนั้นอยู่แล้วและยังใช้งานไม่เต็มที่ ต้นทุนส่วนเพิ่มของคำค้นทางวิทยาศาสตร์ครั้งถัดไปก็ใกล้เคียงกับค่าไฟฟ้า — ซึ่งถือเป็นสถานะทางเศรษฐกิจที่ทรงพลังอย่างแท้จริง และเป็นเหตุผลที่น้ำหนักแบบเปิดมีอยู่ หากคุณไม่มีกำลังความสามารถนั้น "ฟรี" ก็หมายถึงการซื้อหรือเช่าฮาร์ดแวร์ และการคำนวณก็เปลี่ยนไปโดยสิ้นเชิง
เศรษฐศาสตร์ของ GPT-5.6 Sol นั้นตรงกันข้าม ไม่มีฮาร์ดแวร์ให้ซื้อ และไม่มีโมเดลให้ดำเนินการ คุณจ่ายตามอัตราที่คิดตามการใช้งานจริง — $5.00 ต่ออินพุต 1 ล้านโทเคน และ $30.00 ต่อเอาต์พุต 1 ล้านโทเคนในระดับพื้นฐาน หรืออัตราโปรโมชัน $4.00/$20.00 ที่เปิดใช้อยู่ในหน้าของโมเดลเรา — และโมเดลมาพร้อมหน้าต่างบริบท 1.05 ล้านโทเคน เพดานเอาต์พุต 128K ความสามารถด้านภาพ เครื่องมือ และความน่าเชื่อถือที่สั่งสมมาแบบเรือธงที่อยู่ในโปรดักชันตั้งแต่ API เปิดตัวเมื่อวันที่ 9 กรกฎาคม 2026 พรีวิว Ultrafast ซึ่งรัน Sol บนฮาร์ดแวร์ระดับเวเฟอร์สเกลที่ความเร็วสูงสุด 750 โทเคนเอาต์พุตต่อวินาที ผลักดันโมเดลเดียวกันไปสู่งานที่ความหน่วงเป็นหัวใจสำคัญ แม้จะจำกัดเฉพาะลูกค้ากลุ่มเล็กและไม่มีราคาเผยแพร่ สิ่งที่คุณซื้อด้วย $30 ไม่ใช่แค่ความสามารถ — แต่คือการไม่ต้องมีทีมปฏิบัติการ
• น้ำหนักโมเดล — Intern-S2 Apache-2.0 ดาวน์โหลดได้ เทียบกับ GPT-5.6 Sol แบบปิด ใช้งานผ่าน API เท่านั้น
• โครงสร้างต้นทุน — ค่าใช้จ่ายฝ่ายทุนของ Intern-S2 บนเช็กพอยต์ 403B หรือการคิดค่าบริการตามปริมาณการใช้งานผ่าน Intern API อย่างเป็นทางการ เทียบกับ GPT-5.6 Sol $5.00 / $30.00 ต่อล้านตามราคาป้าย, $4.00 / $20.00 ตามโปรโมชัน
• บริบท / เอาต์พุต — Intern-S2 รองรับข้อความสูงสุด 256K, มัลติโมดัล 64K ที่ประเมินแล้ว; เอาต์พุตยังไม่เปิดเผย เทียบกับ GPT-5.6 Sol บริบท ~1.05M, เอาต์พุต 128K
• อินพุต — Intern-S2 ข้อความ รูปภาพ และอนุกรมเวลา เทียบกับ GPT-5.6 Sol ข้อความและรูปภาพ
• คะแนนอิสระ — Intern-S2 ยังไม่มี เทียบกับ GPT-5.6 Sol เรือธงระดับท็อปที่มีประวัติการประเมินสาธารณะมายาวนาน
• ระดับความเร็ว — Intern-S2 จำกัดด้วยฮาร์ดแวร์ เทียบกับ GPT-5.6 Sol Ultrafast preview ที่ความเร็วสูงสุด 750 โทเคนเอาต์พุตต่อวินาที ตามที่ผู้ขายระบุ

จุดที่เช็คพอยต์ฟรีชนะอย่างแท้จริง
มีสามสถานการณ์ที่ Intern-S2 เอาชนะ Sol ได้โดยไม่ต้องมี benchmark เข้ามาเกี่ยวข้อง
ประการแรกคือที่ตั้งของข้อมูล GPT-5.6 Sol เป็น API แบบปิด — ทุกคำขอออกจากโครงสร้างพื้นฐานของคุณและเดินทางผ่านระบบของ OpenAI ภายใต้นโยบายเนื้อหาของ OpenAI ส่วน Intern-S2 ภายใต้ Apache-2.0 สามารถทำงานแบบ air-gapped ภายในสภาพแวดล้อมที่มีการกำกับดูแล บนข้อมูลที่ไม่สามารถส่งไปยังปลายทางของบุคคลที่สามได้ตามกฎหมาย สำหรับห้องปฏิบัติการเภสัชกรรม ระบบโรงพยาบาล หรือผู้รับเหมาด้านกลาโหม คุณสมบัติดังกล่าวไม่ใช่แค่ฟีเจอร์ แต่เป็นปัจจัยทั้งหมดของการตัดสินใจจัดซื้อ และความสามารถของ Sol ไม่ว่าจะมากเพียงใดก็ทดแทนสิ่งนี้ไม่ได้
ประการที่สองคือโมดาลิตี Intern-S2 รับอินพุตแบบอนุกรมเวลาและสร้างผลการพยากรณ์ อีกทั้งยังอ่านหน้าวรรณกรรมทางวิทยาศาสตร์ดิบ ๆ ในฐานะการนำเสนอเชิงภาพโดยตรง แทนที่จะเป็นข้อความที่สกัดออกมา ส่วน Sol รับข้อความและรูปภาพ หากข้อมูลของคุณเป็นเส้นกราฟเครื่องวัดแผ่นดินไหว เส้นโค้งโหลด หรือบทความที่สแกนซึ่งมีรูปภาพหนาแน่น Intern-S2 มีเส้นทางที่ Sol ไม่มี และแถว Biology-Instructions ของผู้จำหน่าย (55.71 เทียบกับ 10.52 ของ GPT-5.5) คือตัวเลขที่สะท้อนสิ่งนั้น
ข้อที่สามคือการปรับละเอียด (fine-tuning) คุณสามารถนำน้ำหนักของ Intern-S2 ไปเทรนบนข้อมูลทดลองเฉพาะของคุณเอง แล้วเก็บโมเดลนั้นไว้ได้ตลอดไป คุณไม่สามารถทำแบบนั้นกับ Sol ได้ไม่ว่าจะราคาเท่าใด สำหรับทีมที่มีความได้เปรียบในการแข่งขันจากชุดข้อมูลเฉพาะทาง เช็คพอยต์แบบเปิดที่ปรับได้อาจมีค่ามากกว่าโมเดลแบบ frozen ที่แข็งแกร่งกว่า

เรียกใช้ทั้งสองโดยไม่เลือก
ทีมที่ได้ประโยชน์สูงสุดจากการจับคู่นี้ไม่ได้มองมันเป็นการเลือกใช้อย่างใดอย่างหนึ่ง พวกเขาส่งงานการให้เหตุผลทั่วไปที่ไวต่อความหน่วงและมีความเสี่ยงสูงไปที่ GPT-5.6 Sol — ซึ่งตั้งอยู่บน OrcaRouter ในราคาตามรายการของ OpenAI โดยบวกเพิ่ม 0% ใช้คีย์เดียวกับโมเดลอื่นอีกกว่า 200 ตัว ดังนั้นเมื่อราคาของ Sol เปลี่ยนแปลงก็จะมีผลในวันเดียวกัน และชั่วโมงที่ผู้ให้บริการมีปัญหา ก็ได้รับการชดเชยด้วยการสลับไปใช้ระบบสำรองอัตโนมัติ — และพวกเขายังคงงานประมวลผลแบบเป็นชุดสำหรับงานวิทยาศาสตร์ไว้บน Intern-S2 ไม่ว่าพวกเขาจะรันมันที่ไหน DSL สำหรับการจัดเส้นทางทำให้ขอบเขตนี้ชัดเจน คือ การให้เหตุผลทั่วไปที่ยากไปทางหนึ่ง การวิเคราะห์เอกสารและสัญญาณไปอีกทางหนึ่ง และการแบ่งแบบนี้เป็นการตั้งค่า ไม่ใช่การเชื่อมต่อระบบครั้งที่สอง
Intern-S2 ไม่ได้อยู่บน OrcaRouter; มันเป็นเช็กพอยต์ Apache-2.0 ที่ออกในวันเดียวกัน และเส้นทางของคุณไปยังมันคือ API ของผู้จำหน่ายเองหรือดีพลอยเมนต์แบบโฮสต์เอง Sol อยู่บนคีย์ ระหว่างสองตัวเลือกนี้ สถาปัตยกรรมที่ใช้ได้จริงสำหรับแอปพลิเคชันที่เน้นวิทยาศาสตร์คือหนึ่งเอนด์พอยต์สำหรับการเรียกใช้ระดับแนวหน้า และหนึ่งดีพลอยเมนต์สำหรับผู้เชี่ยวชาญ — โดยมีตัวเลือกในการย้ายฝั่งใดฝั่งหนึ่งในภายหลัง

คำตัดสิน
หากคุณต้องการการให้เหตุผลที่ยากที่สุดที่แอปพลิเคชันของคุณจะลองทำ ต้องการให้ได้ใน API call เดียว และยินดีจ่ายในอัตราแบบคิดตามการใช้งานระดับเรือธง GPT-5.6 Sol คือคำตอบ และเช็กพอยต์แบบเปิดที่ออกในวันเดียวกันก็ไม่เปลี่ยนสิ่งนั้น ไม่มีอะไรในตารางของ InternLM เองที่แสดงว่า Intern-S2 เทียบเท่าเรือธงรุ่นปัจจุบันของ OpenAI ในด้านความสามารถทั่วไป การเปรียบเทียบนั้นทำกับรุ่นก่อนหน้า และโมเดลแบบเปิดก็ยังแพ้ในแถวความสามารถทั่วไปส่วนใหญ่
หากงานของคุณเป็นงานวิทยาศาสตร์ ข้อมูลของคุณไม่สามารถออกจากโครงสร้างพื้นฐานของคุณ หรือคุณจำเป็นต้องปรับแต่งโมเดลด้วยผลการทดลองที่เป็นกรรมสิทธิ์ Intern-S2 คือโมเดลที่สามารถทำสิ่งเหล่านั้นได้เลย — และสัญญาอนุญาต Apache-2.0 ของมันหมายความว่าเวอร์ชันที่คุณตรวจสอบคือเวอร์ชันที่คุณเก็บไว้ จัดงบสำหรับฮาร์ดแวร์ เตรียมรันการประเมินของคุณเอง และมองทุกตัวเลขที่เผยแพร่เกี่ยวกับมันเป็นเพียงข้อกล่าวอ้าง จนกว่าจะมีคนนอก InternLM ทำซ้ำได้สักหนึ่งตัว
สำหรับการเรียกใช้งานโมเดลระดับแนวหน้า ควบคู่ไปกับสิ่งที่คุณโฮสต์เอง: โมเดลอื่นอีกกว่า 200 รายการ ทำให้โมเดลเรือธงแบบปิดนั้นอยู่บนคีย์เดียวในราคาตามรายการของผู้ให้บริการ ดังนั้นการติดตั้งแบบเฉพาะทางและโมเดลแบบคิดค่าตามการใช้งานจึงสลับกันได้ด้วยกฎการกำหนดเส้นทาง
