
Intern-S2-397B vs Qwen3.8-Max: เรือธงจีนสองลำ เดิมพันเศรษฐกิจที่ตรงกันข้าม
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
Intern-S2-397B และ Qwen3.8-Max คือการเปิดตัวเรือธงจากจีนที่มีนัยสำคัญที่สุดสองรายการในต้นเดือนกันยายน 2026 และทั้งคู่ได้วางเดิมพันทางเศรษฐกิจที่ตรงข้ามกัน Intern-S2-397B โมเดลมัลติโมดัลเชิงวิทยาศาสตร์ขนาด 403 พันล้านพารามิเตอร์ที่ทีม InternLM ของ Shanghai AI Laboratory เปิดตัวภายใต้ Apache-2.0 เมื่อวันที่ 13 กันยายน เดิมพันว่า น้ำหนักแบบเปิดคือหนทางสู่ชัยชนะสำหรับเวิร์กโหลดด้านวิทยาศาสตร์และงานเอเจนต์: ไม่มีราคาต่อโทเค็น น้ำหนักโมเดลอยู่บน Hugging Face และฮาร์ดแวร์ของคุณเองเป็นตัววัด Qwen3.8-Max เรือธงขนาด 2.4 ล้านล้านพารามิเตอร์ของ Alibaba ซึ่งเปิดให้บริการทั่วไป (GA) เมื่อวันที่ 3 สิงหาคม และได้รับการรีเฟรชเมื่อวันที่ 2 กันยายน เดิมพันกับ API แบบคิดราคาที่ 2.00 ดอลลาร์ต่อโทเค็นอินพุต 1 ล้านโทเค็น และ 6.00 ดอลลาร์ต่อโทเค็นเอาต์พุต 1 ล้านโทเค็น ภายในบริบท 1 ล้านโทเค็น โดยน้ำหนักแบบเปิดจะตามมาหนึ่งสัปดาห์หลัง GA และคะแนนจาก Artificial Analysis ที่เป็นอิสระก็อยู่บนกระดานแล้ว การเปรียบเทียบระหว่างทั้งสองไม่ใช่เรื่องของว่าใครชนะในเบนช์มาร์กเท่าไร แต่เป็นเรื่องของว่าเดิมพันใด — ความเป็นเจ้าของหรือเอนด์พอยต์แบบคิดตามปริมาณการใช้งาน — ที่เข้ากับรูปแบบเวิร์กโหลดของคุณ
สองเรือธง สองเดิมพัน
Qwen3.8-Max เป็นระดับความสามารถสูงสุดของ Alibaba ในสาย Qwen เป็นโมเดลแบบ sparse mixture-of-experts ที่มีพารามิเตอร์รวม 2.4 ล้านล้านตัว และเปิดใช้งานประมาณ 9.5 หมื่นล้านตัวต่อโทเคน กระจายอยู่ในผู้เชี่ยวชาญ 512 ตัว โดยเปิดใช้งาน 10 ตัว บวกอีก 1 ตัวที่ใช้ร่วมกัน มันมีหน้าต่างบริบท 1 ล้านโทเคน (983,616 โทเคนเมื่อเปิดโหมด thinking ใน hosted API) เพดานเอาต์พุต 131,072 โทเคน รองรับอินพุตข้อความ รูปภาพ และวิดีโอ และให้บริการผ่านเอนด์พอยต์ที่เข้ากันได้กับ OpenAI จุดเด่นด้านราคาที่นิยามมันคืออัตราคงที่: ราคาเดียวกันที่ $2.00 / $6.00 ไม่ว่าพรอมป์ของคุณจะเป็น 5,000 โทเคนหรือ 900,000 โทเคน โดยอินพุตที่แคชมีราคาต่ำกว่า — ไม่มีค่าธรรมเนียมเพิ่มสำหรับบริบทยาว ซึ่งเป็นกลไกที่คู่แข่งส่วนใหญ่ยังคงเรียกเก็บ Alibaba วางตำแหน่งมันแข่งโดยตรงกับ GPT-5.5, Claude Opus 4.7 และ Gemini 3.1 Pro ในคู่มือการย้ายของตัวเอง
Intern-S2-397B เป็นเรือธงในรูปแบบที่แตกต่างออกไป เป็นโมเดล mixture-of-experts ที่มี 60 เลเยอร์และผู้เชี่ยวชาญ 512 ตัว (ทำงาน 10 ตัวต่อโทเคน) มีบริบทการให้เหตุผลด้านข้อความ 256K และมัลติโมดัล 64K มีพื้นผิวอินพุตเป็นข้อความ รูปภาพ และอนุกรมเวลา และมีกระบวนทัศน์การฝึกก่อนล่วงหน้าที่อ่านหน้าดิบของวรรณกรรมวิทยาศาสตร์ — รูปภาพ เลย์เอาต์ สัญกรณ์เชิงสัญลักษณ์ และร้อยแก้ว — แทนที่จะแยกวิเคราะห์ข้อความออกมาก่อน การเรียนรู้แบบเสริมกำลังของมันครอบคลุมโดเมนวิทยาศาสตร์มากกว่ายี่สิบโดเมน และมันถูกฝึกสำหรับงานเอเจนต์ระยะยาวในสภาพแวดล้อมแบบแซนด์บ็อกซ์ การกำหนดราคาของมันไม่ใช่ตารางอัตราค่าบริการ แต่คือการไม่มีตารางดังกล่าว: โฮสต์เองน้ำหนัก Apache-2.0 หรือขอสิทธิ์เข้าถึง Intern API อย่างเป็นทางการ
ราคา — Intern-S2-397B: ไม่มีตารางราคา; โฮสต์เองหรือใช้ Intern API เทียบกับ Qwen3.8-Max: $2.00 / $6.00 ต่อ 1M แบบคงที่, อินพุตที่แคชไว้มีราคาต่ำกว่า
• ขนาด — Intern-S2-397B: รวม 403B, ผู้เชี่ยวชาญ 512 / ทำงาน 10 เทียบกับ Qwen3.8-Max: รวม 2.4T, ทำงาน 95B, ผู้เชี่ยวชาญ 512 / 10 + 1 ที่ใช้ร่วมกัน
• บริบท — Intern-S2-397B: ข้อความ 256K / มัลติโมดัล 64K เทียบกับ Qwen3.8-Max: 1M โทเค็น อัตราคงที่
• อินพุต — Intern-S2-397B: ข้อความ, รูปภาพ, อนุกรมเวลา เทียบกับ Qwen3.8-Max: ข้อความ, รูปภาพ, วิดีโอ
• น้ำหนักโมเดล — Intern-S2-397B: Apache-2.0 เปิดให้ใช้ในวันเปิดตัว เทียบกับ Qwen3.8-Max: ใบอนุญาต Qwen3.8-Max แบบกำหนดเอง เปิดให้ใช้เมื่อวันที่ 12 สิงหาคม หลัง GA
• คะแนนอิสระ — Intern-S2-397B: ยังไม่มี เทียบกับ Qwen3.8-Max: AA Intelligence Index 40, GPQA Diamond 92.7
ทั้งสองตารางเป็นตารางของผู้ขาย และมีเพียงตารางเดียวเท่านั้นที่มีผู้ตัดสิน
ทั้งสองโมเดลเปิดตัวพร้อมตารางเปรียบเทียบที่ผู้ขายจัดทำเอง ซึ่งทำให้วินัยด้านการอ้างอิงแหล่งที่มาเหมือนกัน แต่ผลงานที่ผ่านมาต่างกัน ตัวเลขอิสระของ Qwen3.8-Max ได้สะสมเพิ่มขึ้นตั้งแต่นั้นมา: Artificial Analysis จัดให้อยู่ที่ 40 บน Intelligence Index ปัจจุบัน โดยมี GPQA Diamond ที่ 92.7, HLE ที่ 43.0 และคะแนนเขียนโค้ดอิสระที่ 71.8 ด้วยค่าใช้จ่ายประมาณ $2.67 ต่องานดัชนีหนึ่งงานตามสเกลปัจจุบัน นี่คือตัวเลขที่วัดได้จากตัวติดตามของบุคคลที่สาม — ผู้ตัดสินตัวจริงรายแรกที่เรือธงสองรุ่นนี้เคยมี
หลักฐานของ Intern-S2-397B คือการ์ดของมันเอง ซึ่งรันผ่าน OpenCompass, VLMEvalKit และ AgentCompass เผยแพร่พร้อมกับเวท: MMLU Pro 89.77, MMMU Pro 81.68, HMMT-2026 93.56, SWE-bench-Pro 68.54 และ TerminalBench 2.1 ที่ 64.04 ซึ่งการ์ดเองแสดงว่าตัวเลขนี้แพ้ให้กับรุ่นปิดที่เก่ากว่า ผลการทดสอบทางวิทยาศาสตร์ของมันคือเหตุผลที่กรณีโมเดลเฉพาะทางมีอยู่: Biology-Instructions 55.71, SciReasoner 1.5 63.28, Mol-Instructions 53.95, MolecularIQ 62.35 ทุกตัวเป็นของ InternLM เอง และยังไม่มีการทำซ้ำ เมื่อวางเคียงข้างกัน ฐานหลักฐานทั้งสองเล่าเรื่องเดียวกันจากทิศทางตรงกันข้าม: โมเดลหนึ่งเป็นโมเดลเฉพาะทางที่มีผลการทดสอบทั่วไปที่น่าพอใจและไม่มีการวัดจากภายนอก ส่วนอีกโมเดลหนึ่งเป็นโมเดลเอนกประสงค์ที่มีคะแนนอิสระและไม่มีการปรับแต่งทางวิทยาศาสตร์

สิ่งที่รูปทรงของเงินซื้อได้จริง
มาตรวัดราคาแบบคงที่ $2 / $6 เป็นหมัดเด็ดเฉพาะตัวของ Qwen3.8-Max และคุ้มค่าที่จะอธิบายให้ชัดว่าสิ่งนี้ให้อะไรบ้าง เอเจนต์วิเคราะห์ repo ที่ส่งบริบทโค้ดขนาด 200,000 โทเคนอินพุตผ่านเข้าไปในครั้งเดียว จะจ่ายอัตราต่อโทเคนเท่ากับแชตสั้น ๆ — ไม่มีค่าธรรมเนียมเพิ่มสำหรับพรอมป์ยาว — และเมื่อใช้แคช บริบทโค้ดที่ไม่เปลี่ยนแปลงจะทำให้ราคาอินพุตที่แท้จริงลดลงอย่างมากในทราฟฟิกที่เกิดซ้ำ โมเดลนี้ยังเรียกใช้งานได้ในรูปแบบน้ำหนักเปิดภายใต้สัญญาอนุญาตแบบกำหนดเองของ Alibaba ซึ่งอนุญาตให้ใช้เชิงพาณิชย์โดยต้องระบุที่มา บวกกับเงื่อนไขเกตตามขนาดเมื่อมี MAU เกิน 100 ล้าน หรือรายได้ต่อเดือน $20 ล้าน และต้องมีข้อตกลงแยกต่างหากสำหรับธุรกิจให้บริการโมเดลขนาดใหญ่ (model-as-a-service)
เศรษฐศาสตร์ของ Intern-S2-397B เป็นสิ่งที่ตรงกันข้าม: ไม่มีมาตรวัดค่าใช้จ่ายเลย แต่เป็นรายจ่ายฝ่ายทุน น้ำหนักของโมเดลอยู่ที่ประมาณ 807 GB ในรูปแบบ BF16 กระจายอยู่บน 188 shard — ซึ่งเป็นโหนดหลาย GPU ที่จริงจัง — โดยบิลด์ FP8 ช่วยลดขนาดลงได้ประมาณครึ่งหนึ่ง หากคุณมีขีดความสามารถนั้นอยู่แล้ว ต้นทุนส่วนเพิ่มของคำถามทางวิทยาศาสตร์ครั้งถัดไปจะเข้าใกล้ค่ากระแสไฟฟ้า และนั่นคือเดิมพัน: การเป็นเจ้าของทำให้โมเดลเฉพาะทางมีต้นทุนต่ำในระดับส่วนเพิ่ม หากคุณไม่ได้เป็นเจ้าของฮาร์ดแวร์ โมเดล “ฟรี” ก็เป็นเพียงโครงการนำร่อง และ API Intern อย่างเป็นทางการคือทางเลือกเดียวที่คิดค่าบริการตามการใช้งาน
เรือธงทั้งสองรุ่นสามารถใช้จุดเชื่อมเดียวร่วมกันได้หากคุณจัดเส้นทาง Qwen3.8-Max อยู่บน OrcaRouter ในราคาตั้งต้นของ Alibaba ที่ส่งผ่านโดยไม่มีมาร์กอัป 0% ดังนั้นอัตราคงที่ $2 / $6 และการลดราคาใด ๆ ในอนาคตจะมาถึงที่นี่ในวันเดียวกัน Intern-S2-397B ไม่ได้ถูกจัดเส้นทาง — มันเป็นเช็กพอยต์ใหม่เอี่ยม และเส้นทางของคุณไปยังมันคือ API ของผู้จำหน่ายเองหรือการติดตั้งแบบโฮสต์เอง ส่งทราฟฟิกทั่วไป ทราฟฟิกที่รองรับวิดีโอ และทราฟฟิกที่มีบริบทขนาดยาวไปยังโมเดลแบบคิดตามการใช้งานบนคีย์ที่คุณมีอยู่แล้ว; เก็บงานแบตช์เชิงวิทยาศาสตร์ไว้บนโมเดลที่คุณรัน; ให้ระบบสลับสำรองอัตโนมัติคอยคุ้มครองคุณเมื่อปลายทางของฝ่ายใดฝ่ายหนึ่งไม่พร้อมใช้งาน เส้นแบ่งนี้เป็นกฎการจัดเส้นทางมากกว่าจะเป็นการผสานรวมครั้งที่สอง

คำตัดสิน
เลือก Qwen3.8-Max สำหรับงานให้เหตุผลทั่วไปและงานโปรดักชันที่รองรับวิดีโอ ซึ่งอัตราคงที่ต่อหนึ่งล้านโทเคนเหนือกว่าสิ่งที่คู่แข่งรายใดเรียกเก็บ และซึ่งกระดานคะแนนอิสระช่วยลดความเสี่ยงในการสร้างทับบนโมเดลนี้ น้ำหนักของมันเปิดกว้างพอที่จะมีความสำคัญภายใต้สัญญาอนุญาตที่ทีมส่วนใหญ่เข้าเกณฑ์อยู่แล้ว และมิเตอร์ $2 / $6 ของมันเป็นราคาที่ดุดันที่สุดบนกระดานในบรรดาเรือธงระดับแนวหน้า
เลือก Intern-S2-397B สำหรับงานวิทยาศาสตร์เชิงคำนวณ — บทความที่เต็มไปด้วยรูปภาพ แผนภาพโมเลกุล สัญญาณอนุกรมเวลา — โดยที่อินพุตเป็นมัลติโหมดในแบบที่โมเดลอเนกประสงค์ทั่วไปไม่เคยถูกปรับแต่งมาเพื่อสิ่งนั้น และโดยที่ข้อกำหนดเรื่องที่ตั้งของข้อมูลหรือการปรับละเอียดบนผลลัพธ์ที่เป็นกรรมสิทธิ์ทำให้ Apache-2.0 เป็นคุณสมบัติชี้ขาด ตั้งงบสำหรับฮาร์ดแวร์ ทำการประเมินของคุณเอง และมองตัวเลขของมันเป็นเพียงคำกล่าวอ้างจนกว่าจะมีผู้ตรวจสอบอิสระปรากฏขึ้น
สรุปตามจริงคือเรือธงสองตัวนี้ไม่ได้ทดแทนกันจริง ๆ ตัวหนึ่งเป็นเครื่องมือวิทยาศาสตร์ที่เป็นของตัวเองและมีความสามารถทั่วไปที่น่านับถือ ส่วนอีกตัวเป็นโมเดลเอนกประสงค์ที่เช่าใช้และถูกให้คะแนนอย่างอิสระ ด้วยอัตราคงที่และมีความสนใจด้านวิทยาศาสตร์เพียงผิวเผิน ทีมที่ต้องการทั้งสองอย่างควรถือว่าเส้นแบ่งนี้เป็นการตัดสินใจด้านการจัดเส้นทาง และควรรัน eval ของตนเองบน Intern-S2-397B ซ้ำ ก่อนจะเชื่อตัวเลขใด ๆ บนสไลด์ของผู้ขายรายใดก็ตาม

