
Atria Dawn Preview: InternLM เปิดตัวโมเดลเอเจนต์ขนาด 744B พารามิเตอร์อย่างเงียบ ๆ — สิ่งที่ repo ระบุจริง ๆ
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
องค์กร InternLM ของ Shanghai AI Laboratory ได้เผยแพร่ Atria Dawn Preview อย่างเงียบ ๆ บน Hugging Face ในสัปดาห์นี้ — เป็นพรีวิวของโมเดลเอเจนต์แบบ MoE ขนาด 744B พารามิเตอร์ ที่มาพร้อมน้ำหนักโมเดลภายใต้สัญญาอนุญาต MIT หน้าต่างบริบท 1 ล้านโทเคน และตารางเบนช์มาร์กที่วัดเทียบกับ DeepSeek V4 Pro, Kimi K3, Qwen3.8-Max, GLM-5.3, GPT-5.6 Sol และ Claude Opus 5 รีโพซิทอรีเปิดใช้งานเมื่อวันที่ 11 กันยายน 2026 — สามวันก่อนบทความนี้ — โดยมีเช็กพอยต์ FP8 ที่มาคู่กันตามมาในวันที่ 12 กันยายน และผู้พัฒนายังไม่ได้ประกาศโมเดลนี้ที่ใดเลย: ไม่มีบล็อกโพสต์ ไม่มีงานวิจัย ไม่มีราคา ไม่มี API สิ่งที่มีอยู่ในวันนี้คือการ์ดโมเดลที่กรอกข้อมูลครบถ้วนและน้ำหนักโมเดลเปิดประมาณ 1.5TB สิ่งนี้ทำให้ Atria Dawn Preview เป็นการเปิดตัวแบบเงียบ ๆ และคำถามที่น่าสนใจคือการ์ดนี้ให้คุณตรวจสอบอะไรได้บ้าง ขอให้คุณเชื่อสิ่งใดโดยไม่มีหลักฐาน และนี่คือก้าวแรกสู่ตระกูล Atria ที่ใหญ่ขึ้นหรือไม่ จากแล็บที่ใช้เวลาทั้งปีในการเปิดตัวซีรีส์ Intern-S2 และ InternLumina
การ์ดคือประกาศ
เนื่องจากไม่มีการประกาศใด ๆ การ์ด Hugging Face จึงเป็นผู้พูดแทนทั้งหมด มันอธิบาย Atria Dawn Preview ว่าเป็น "เวอร์ชันพรีวิวของโมเดลเอเจนต์รุ่นใหม่" ที่พัฒนาโดย Shanghai AI Laboratory ฝึกบนโมเดลพื้นฐาน MoE ขนาด 744B พารามิเตอร์ และมุ่งเป้าไปที่ "สถานการณ์ด้านการวิจัยและวิศวกรรมที่ต้องการความเข้าใจสภาพแวดล้อมอย่างต่อเนื่อง การใช้เครื่องมือ และการทำงานหลายขั้นตอนให้สำเร็จ" สโลแกน — "From Research Questions To Verifiable Results" — เกี่ยวกับการขับเคลื่อนปัญหาปลายเปิดไปสู่ผลลัพธ์ที่นำไปปฏิบัติได้ ตรวจสอบได้ และทำซ้ำได้ โดยโมเดลผสานวัตถุประสงค์ของงานและผลตอบรับจากสภาพแวดล้อมตลอดการวิเคราะห์ปัญหา การออกแบบแนวทางแก้ไข การใช้เครื่องมือ การนำโค้ดไปใช้ การรันการทดลอง การวิเคราะห์ผลลัพธ์ และการกู้คืนจากความล้มเหลว
การ์ดนี้จัดระเบียบขอบเขตแบบเอเจนติกนั้นออกเป็นสี่พื้นที่ความสามารถ โดยแต่ละพื้นที่มุ่งเน้นการส่งมอบแบบครบวงจรแทนที่จะเป็นการแชต:
• การค้นพบ — การสืบค้นและจัดระเบียบหลักฐาน การวิจัยเชิงลึก และการเปลี่ยนคำถามงานวิจัยให้เป็นแผนการทดลองที่นำไปปฏิบัติได้
• การสร้างสรรค์ — การพัฒนาซอฟต์แวร์ แอปพลิเคชันแบบอินเทอร์แอกทีฟ เกม การแสดงข้อมูลด้วยภาพ และระบบการเรียนรู้ของเครื่อง
• การส่งมอบ — การแปลงเอกสาร ข้อมูล และข้อกำหนดด้านการออกแบบให้เป็นรายงาน งานนำเสนอ และผลลัพธ์เชิงโครงสร้างอื่น ๆ
• ความปลอดภัยทางไซเบอร์ — การวิเคราะห์ปัญหาด้านความปลอดภัย การตรวจสอบยืนยันช่องโหว่ การนำการแก้ไขไปใช้ และการตรวจสอบยืนยันซ้ำในสภาพแวดล้อมที่ได้รับอนุญาต
นอกจากนี้ บนการ์ดยังมีสิ่งที่ไม่ได้รับการอธิบายไว้ด้วย: เว็บไซต์ (atria-asi.com), องค์กร GitHub (atria-asi) ที่มิเรอร์ README, และบัญชี X (@AtriaASI) คำต่อท้าย "ASI" เป็นรายละเอียดเดียวที่แปลกจริง ๆ — ไม่มีอะไรบนการ์ดบอกว่าแบรนด์นี้ตั้งใจจะสื่อถึงอะไร และเราจะไม่ตีความให้มากไปกว่าที่ตัวรีโปเองทำ สิ่งที่พอจะรู้ได้คือ นี่เป็นโค้ดเนมของไลน์ผลิตภัณฑ์ที่แยกต่างหาก จากชื่อ Intern-S2 และ InternLumina ที่ห้องแล็บใช้มาตลอดทั้งปี

สิ่งที่คอนฟิกระบุไว้จริง ๆ
น้ำหนักและคอนฟิกูเรชันสามารถดาวน์โหลดได้แล้วในวันนี้ ซึ่งเป็นจุดที่การเปิดตัวแบบเงียบ ๆ ยุติการเป็นเพียงข่าวลือ สตริงสถาปัตยกรรมคือ GlmMoeDsaForCausalLM — ตระกูล MoE แบบเบาบางสไตล์ DSA เดียวกับที่ไลน์ GLM ใช้ โดยคอนฟิกูเรชันกำหนดเส้นทางไปยังผู้เชี่ยวชาญแบบ routed 8 จาก 256 รายต่อโทเคน กระจาย across 78 เลเยอร์ (จำนวนพารามิเตอร์ที่ใช้งานไม่ได้ระบุไว้บนการ์ดโมเดล สำหรับ MoE ขนาด 744B ที่มีรูปร่างแบบนี้ ตัวเลขจะอยู่ที่หลักหมื่นล้าน) หน้าต่างบริบทถูกตั้งไว้ที่ 1,048,576 โทเคน — เต็ม 1M ตรงกับคลาสบริบทยาวที่แล็บผลักดันในรุ่นอื่น ๆ ที่เพิ่งเปิดตัวเร็ว ๆ นี้ โทเคไนเซอร์มีมาร์กเกอร์สำหรับภาพ วิดีโอ เสียง และการถอดความ แม้ว่าเทมเพลตแชตจะบอกโมเดลอย่างชัดเจนว่าไม่มีความสามารถรับอินพุตแบบมัลติโมดัล และให้บอกเช่นนั้นหากมีคนส่งสื่อเข้ามา — ฉะนั้นให้มองแท็กโมดัลลิตีเหล่านี้เป็นระบบพื้นฐานที่สืบทอดมา ไม่ใช่การอ้างว่ามีอินพุตภาพหรือเสียง
ค่าน้ำหนักบอกเรื่องราวในทางปฏิบัติ:
• เช็กพอยต์ — สองรายการ: โมเดล instruct แบบ BF16/F32 และ Atria-Dawn-Preview-FP8 ซึ่งเป็นโมเดล instruct ที่ควอนไทซ์แบบ FP8
• ขนาด — รุ่น BF16 มีขนาดประมาณ 1.5TB กระจายอยู่บน 353 shards ของ safetensors; รุ่น FP8 มีขนาดประมาณ 756GB
• สัญญาอนุญาต — MIT ทั้งสำหรับโค้ดและเวต โดยไม่มีข้อกำหนดจำกัดใด ๆ บนการ์ด — ผ่อนปรนอย่างผิดปกติสำหรับการเปิดตัวจากแล็บในระดับนี้
• การเผยแพร่ — Hugging Face และ ModelScope, README ภาษาอังกฤษและภาษาจีน, เทมเพลตแชทและคอนฟิกการสร้างในรีโป
• โฮสติ้ง — ไม่มีการระบุผู้ให้บริการ inference ไว้บนการ์ด และไม่มีการกล่าวถึง API ที่ใดเลย
บรรทัดสุดท้ายนั้นสำคัญต่อการวางกรอบเรื่องนี้: นี่คือการเปิดตัวเวตโมเดล ไม่ใช่การเปิดตัวบริการ ใครก็ตามที่ต้องการรัน Atria Dawn Preview ในวันนี้ต้องดาวน์โหลดประมาณ 756GB (FP8) หรือ 1.5TB (BF16) และให้บริการด้วยตนเอง — ไม่มีเอนด์พอยต์ของผู้ให้บริการ ไม่มีราคา ไม่มีหน้าโควตา
ตารางเกณฑ์มาตรฐาน อ่านอย่างละเอียด
การ์ดนี้มีตารางเบนช์มาร์ก 16 แถวที่เปรียบเทียบ Atria Dawn Preview กับ DeepSeek V4 Pro, Kimi K3, Qwen3.8-Max, GLM-5.3, GPT-5.6 Sol และ Claude Opus 5 ในด้านการทำงานแบบเอเจนต์ การใช้เครื่องมือ การเขียนโค้ด และการวิจัย ตัวเลขทุกตัวในตารางเป็นข้อมูลที่ผู้ขายรายงานเอง — แล็บเป็นผู้รันหรือจ้างให้ประเมิน และยังไม่มีตัวเลขใดถูกทำซ้ำโดยอิสระ เนื่องจากยังไม่มีการประเมิน Atria Dawn Preview โดยอิสระ ณ วันนี้ Artificial Analysis ไม่มีหน้าเพจสำหรับโมเดลนี้ ดังนั้นวิธีอ่านที่ถูกต้องคือ “นี่คือสิ่งที่ผู้ขายบอกว่าเปรียบเทียบได้อย่างไร” ไม่ใช่ “นี่คือสิ่งที่เปรียบเทียบได้จริง”

เมื่อปักหมุดข้อควรระวังนั้นไว้อย่างชัดเจนแล้ว จุดเด่นต่าง ๆ ก็น่าสนใจอย่างแท้จริง Atria Dawn Preview ครองอันดับหนึ่งในกลุ่มที่ระบุบน BrowseComp ด้วยคะแนน 92.5 (เทียบกับ 92.2 ของ GPT-5.6 Sol และ 90.8 ของ Claude Opus 5) บน CyberGym ด้วย 86.5 (นำหน้า 83.3 ของ DeepSeek V4 Pro, 84.5 ของ GLM-5.3 และ 83.6 ของ GPT-5.6 Sol) และบน DeepSearchQA ด้วย 96.0 อีกทั้งยังทำคะแนน BFCL v4 ได้แข็งแกร่งถึง 77.0 เมื่อเทียบกับ 71.4 ของ DeepSeek V4 Pro และ 69.1 ของ Kimi K3 จุดอ่อนก็ให้ข้อมูลไม่แพ้กัน:
• Terminal-Bench 2.1 — 78.3 ตามหลัง 89.3 ของ Qwen3.8-Max และ 90.2 ของ Claude Opus 5 อยู่พอสมควร ซึ่งบ่งชี้ว่าความสามารถด้าน coding agent ยังไม่ถึงระดับเรือธง
• SWE-bench Pro — 59.6 นำหน้า DeepSeek V4 Pro (58.3) แต่ยังห่างไกลจาก Claude Opus 5 ที่ได้ 74.7
• MLE-bench Lite — 86.2 ซึ่งตามหลัง GPT-5.6 Sol (88.9) และ Claude Opus 5 (88.0) แม้จะมีจุดขายเรื่อง Discovery
• JobBench — 50.3 ต่ำที่สุดในบรรดาโมเดลที่การ์ดนี้ระบุไว้ และเป็นหนึ่งในหลายแถวที่ตัวอย่างตัวอย่างเปิด 744B ให้ผลลัพธ์ด้อยกว่าโมเดลระดับเรือธงแบบปิดที่ถูกพิมพ์ไว้ข้างๆ
สรุปตามจริง: การ์ดนี้อ้างถึงจุดแข็งที่มีอยู่จริงในด้านการสืบค้นงานวิจัย งานที่อิงกับเบราว์เซอร์ และการตรวจสอบความปลอดภัย ขณะที่แถวของการเขียนโค้ดแบบคลาสสิกและงานองค์ความรู้อยู่ในระดับกลางๆ ของกลุ่ม การพรีวิวที่ไม่เลือกหยิบเฉพาะผลที่ดีที่สุดน่าเชื่อถือมากกว่าการพรีวิวที่ชนะทุกอย่าง — แต่ทั้งหมดนั้นยังไม่ได้รับการยืนยัน และโมเดลขนาดนี้ที่มีพื้นที่การประเมินมากขนาดนี้ควรได้รับการตรวจสอบจากอิสระก่อนที่ใครจะเดิมพันไปป์ไลน์กับมัน
ตำแหน่งของมันในไลน์อัป InternLM
Atria Dawn Preview เปิดตัวในช่วงที่ห้องแล็บกำลังยุ่งผิดปกติ โดยเรือธงด้านวิชันและวิทยาศาสตร์อย่าง Intern-S2-397B ปรากฏขึ้นเมื่อวันที่ 13 กันยายน ซึ่งเป็นตระกูลเดียวกับรุ่นน้องที่เล็กกว่า (Intern-S2, Intern-S2 Mobius) ที่เปิดตัวมาตั้งแต่กลางปี และ InternLumina-U2 ที่เน้นด้านวิชันก็เปิดตัวเมื่อต้นเดือนกันยายน Atria เป็นโค้ดเนมแยกต่างหากที่มุ่งเป้าไปที่งานแบบ agentic ทั่วไป มากกว่าความเชี่ยวชาญเฉพาะทางด้านวิทยาศาสตร์หรือมัลติโมดัล และต่างจาก Intern-S2-397B ซึ่งมีสัญญาอนุญาต Apache-2.0 และระบบนิเวศการประกาศของตัวเอง Atria Dawn Preview มาถึงอย่างไร้พิธีการภายใต้ MIT ยังไม่ยืนยันว่า Atria เป็นพรีวิวครั้งเดียวหรือสมาชิกคนแรกของซีรีส์ใหม่ คำต่อท้าย "Preview" และ repo เปล่า ๆ ที่ไม่มีข้อความ roadmap ที่ไหนเลย ชี้ไปทางการตีความแบบระมัดระวัง
สิ่งที่ยังไม่เป็นที่รู้จัก
นิสัยที่เป็นประโยชน์เมื่อมีการเปิดตัวแบบเงียบ คือการทำรายการสิ่งที่ยังเปิดค้างอยู่ บน Atria Dawn Preview รายการนั้นยาว:
• ประกาศ — ณ วันที่ 14 กันยายน ไม่มีอะไรจากทางแล็บ เว็บไซต์ หรือบัญชี X; รีโปปรากฏขึ้นก่อน ซึ่งเป็นรูปแบบที่การเปิดตัวหลายครั้งของแล็บจีนในช่วงหลังเป็นเช่นนี้ แต่ "วิธีที่พวกเขามักทำกัน" ไม่ใช่การยืนยัน
• บทความวิชาการหรือรายงานทางเทคนิค — ไม่มีลิงก์ใด ๆ ทั้งข้อมูลการฝึก ไปป์ไลน์ RL และจำนวนพารามิเตอร์ที่ใช้งาน ล้วนยังไม่ได้รับการเผยแพร่
• แบรนด์ "Atria ASI" — โดเมนและแฮนเดิลมีอยู่จริง และการ์ดก็เชื่อมโยงทั้งสองเข้าด้วยกัน แต่ไม่ได้ระบุว่าหน่วยงานใดอยู่เบื้องหลัง และอักษรย่อเหล่านี้มีความหมายว่าอะไร
• คะแนนจากแหล่งอิสระ — ไม่มี; ไม่มีรายการใน Artificial Analysis ไม่มีการปรากฏใน arena ไม่มีสิ่งใดให้ใช้เทียบกับตารางของการ์ด
• ความพร้อมใช้งานแบบโฮสต์ — ยังไม่มี API จากผู้จำหน่าย และยังไม่มีเกตเวย์อินเฟอเรนซ์รายใหญ่เจ้าใดให้บริการมันในตอนนี้ วิธีเดียวที่จะรันมันได้คือคุณต้องจัดเตรียมเวทประมาณ 756GB ถึง 1.5TB ด้วยตัวเอง
• การรองรับการให้บริการ — สถาปัตยกรรมนี้เป็นสายตระกูล DSA-MoE ที่เป็นที่รู้จัก ซึ่งเป็นสิ่งที่มักได้รับการรองรับระดับรันไทม์อย่างรวดเร็ว แต่ยังไม่มีการประกาศการรองรับระดับเฟรมเวิร์กสำหรับเช็กพอยต์เฉพาะนี้
สิ่งที่คุณทำได้จริงๆ กับมัน
พูดให้ชัดเจน วันนี้มีสามสิ่งที่เป็นจริง ข้อแรก คุณดาวน์โหลด Atria Dawn Preview ได้ — สัญญาอนุญาต MIT ครอบคลุมทั้งสองเช็กพอยต์ และการเปิดตัวเวอร์ชัน FP8 ทำให้คณิตศาสตร์ด้านการจัดเก็บและการให้บริการง่ายขึ้นอย่างมีนัยสำคัญเมื่อเทียบกับต้นฉบับ BF16 แม้ว่าทั้งสองแบบจะเป็นเรื่องที่ต้องใช้ GPU หลายตัวก็ตาม ข้อสอง คุณเรียกใช้มันจากที่ไหนก็ไม่ได้ เพราะไม่มีปลายทางแบบโฮสต์ให้ใช้ และนั่นคือสถานการณ์ที่แพลตฟอร์มจัดเส้นทางจะคุ้มค่ากับการมีอยู่จริง ๆ เรายังไม่จัดเส้นทางให้ Atria Dawn Preview — มันยังไม่อยู่บน OrcaRouter และหน้านี้ก็ไม่ได้แสร้งทำเป็นว่าเป็นเช่นนั้น — แต่ คีย์เดียวกันที่วันนี้ยังไม่มี Atria เข้าถึงโมเดลอื่นอีก 196 โมเดลผ่าน API เดียว โดยราคาตามรายการของผู้ให้บริการถูกส่งผ่านโดยไม่บวกเพิ่ม 0% และมีการสลับไปใช้ผู้ให้บริการรายอื่นโดยอัตโนมัติเมื่อเกิดปัญหา เมื่อ Atria Dawn Preview มาถึงผู้ให้บริการที่อยู่ในระบบจัดเส้นทาง มันจะปรากฏในราคาตามรายการในวันเดียวกับที่ตัวเลขของผู้ขายได้รับการอัปเดต ซึ่งนั่นคือความหมายของราคาแบบส่งผ่านในทางปฏิบัติ จนกว่าจะถึงตอนนั้น โมเดลนี้เป็นโปรเจกต์แบบดาวน์โหลดแล้วรันเอง และวิธีที่ปลอดภัยที่สุดในการประเมินมันคือบนฮาร์ดแวร์ที่คุณควบคุมเอง ด้วยการทดสอบมาตรฐานอิสระของคุณเอง — ไม่ใช่เชื่อตามคำโฆษณาบนการ์ด

สิ่งที่ควรดูต่อไป
สัญญาณสี่อย่างจะตัดสินว่าการเปิดตัวแบบเงียบ ๆ ครั้งนี้จะกลายเป็นเรื่องที่คุณลงมือทำหรือไม่ สัญญาณแรกคือประกาศ: โพสต์เปิดตัวหรือเปเปอร์ที่จริงจังจะตอบเรื่องสถาปัตยกรรม สูตรการฝึก และว่า "Preview" เป็นพรีวิวของอะไร สัญญาณที่สองคือการประเมินที่เป็นอิสระ — โมเดลขนาดนี้ที่มีการ์ดมั่นใจขนาดนี้ จำเป็นต้องมีคนตรวจสอบข้ออ้างเรื่อง BrowseComp และ CyberGym เทียบกับฮาร์เนสที่เป็นกลาง และการที่ไม่มีรายการใน Artificial Analysis เลยคือช่องว่างที่สะดุดตาที่สุดเพียงหนึ่งเดียว สัญญาณที่สามคือความพร้อมให้บริการบนโฮสต์: โมเดล MoE เปิดขนาด 744B ที่มีเวตภายใต้สัญญาอนุญาต MIT และหน้าต่างบริบท 1M ตรงกับโปรไฟล์ที่มักโผล่บนผู้ให้บริการ inference ภายในไม่กี่สัปดาห์ และเจ้าแรกที่ให้บริการมันจะกำหนดราคาใช้งานจริงของการใช้มัน สัญญาณที่สี่คือคำถามเรื่องตระกูลโมเดล — ว่า Atria เป็นของครั้งเดียวหรือเป็นซีรีส์ และการใช้แบรนด์ "ASI" บ่งชี้ว่าแล็บตั้งใจจะพาสายนี้ไปทางไหนต่อ ไม่มีสิ่งใดในนั้นที่รู้ได้จากรีโป และนั่นแหละคือประเด็น: รีโปให้โมเดลกับเรา และสองสัปดาห์ข้างหน้าควรให้ส่วนที่เหลือกับเรา
การเปรียบเทียบในบทความนี้3
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
