อินโฟกราฟิกแบบฮีโร่สำหรับ Atria Dawn Preview ที่แสดงพื้นที่ขีดความสามารถแบบเอเจนต์ทั้ง 4 ด้าน (Discovery, Creation, Delivery, Cybersecurity) และแถบ 1M context · MIT license · open weights
Engineering & Research

Atria Dawn Preview: InternLM เปิดตัวโมเดลเอเจนต์ขนาด 744B พารามิเตอร์อย่างเงียบ ๆ — สิ่งที่ repo ระบุจริง ๆ

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

องค์กร InternLM ของ Shanghai AI Laboratory ได้เผยแพร่ Atria Dawn Preview อย่างเงียบ ๆ บน Hugging Face ในสัปดาห์นี้ — เป็นพรีวิวของโมเดลเอเจนต์แบบ MoE ขนาด 744B พารามิเตอร์ ที่มาพร้อมน้ำหนักโมเดลภายใต้สัญญาอนุญาต MIT หน้าต่างบริบท 1 ล้านโทเคน และตารางเบนช์มาร์กที่วัดเทียบกับ DeepSeek V4 Pro, Kimi K3, Qwen3.8-Max, GLM-5.3, GPT-5.6 Sol และ Claude Opus 5 รีโพซิทอรีเปิดใช้งานเมื่อวันที่ 11 กันยายน 2026 — สามวันก่อนบทความนี้ — โดยมีเช็กพอยต์ FP8 ที่มาคู่กันตามมาในวันที่ 12 กันยายน และผู้พัฒนายังไม่ได้ประกาศโมเดลนี้ที่ใดเลย: ไม่มีบล็อกโพสต์ ไม่มีงานวิจัย ไม่มีราคา ไม่มี API สิ่งที่มีอยู่ในวันนี้คือการ์ดโมเดลที่กรอกข้อมูลครบถ้วนและน้ำหนักโมเดลเปิดประมาณ 1.5TB สิ่งนี้ทำให้ Atria Dawn Preview เป็นการเปิดตัวแบบเงียบ ๆ และคำถามที่น่าสนใจคือการ์ดนี้ให้คุณตรวจสอบอะไรได้บ้าง ขอให้คุณเชื่อสิ่งใดโดยไม่มีหลักฐาน และนี่คือก้าวแรกสู่ตระกูล Atria ที่ใหญ่ขึ้นหรือไม่ จากแล็บที่ใช้เวลาทั้งปีในการเปิดตัวซีรีส์ Intern-S2 และ InternLumina

การ์ดคือประกาศ

เนื่องจากไม่มีการประกาศใด ๆ การ์ด Hugging Face จึงเป็นผู้พูดแทนทั้งหมด มันอธิบาย Atria Dawn Preview ว่าเป็น "เวอร์ชันพรีวิวของโมเดลเอเจนต์รุ่นใหม่" ที่พัฒนาโดย Shanghai AI Laboratory ฝึกบนโมเดลพื้นฐาน MoE ขนาด 744B พารามิเตอร์ และมุ่งเป้าไปที่ "สถานการณ์ด้านการวิจัยและวิศวกรรมที่ต้องการความเข้าใจสภาพแวดล้อมอย่างต่อเนื่อง การใช้เครื่องมือ และการทำงานหลายขั้นตอนให้สำเร็จ" สโลแกน — "From Research Questions To Verifiable Results" — เกี่ยวกับการขับเคลื่อนปัญหาปลายเปิดไปสู่ผลลัพธ์ที่นำไปปฏิบัติได้ ตรวจสอบได้ และทำซ้ำได้ โดยโมเดลผสานวัตถุประสงค์ของงานและผลตอบรับจากสภาพแวดล้อมตลอดการวิเคราะห์ปัญหา การออกแบบแนวทางแก้ไข การใช้เครื่องมือ การนำโค้ดไปใช้ การรันการทดลอง การวิเคราะห์ผลลัพธ์ และการกู้คืนจากความล้มเหลว

การ์ดนี้จัดระเบียบขอบเขตแบบเอเจนติกนั้นออกเป็นสี่พื้นที่ความสามารถ โดยแต่ละพื้นที่มุ่งเน้นการส่งมอบแบบครบวงจรแทนที่จะเป็นการแชต:

การค้นพบ — การสืบค้นและจัดระเบียบหลักฐาน การวิจัยเชิงลึก และการเปลี่ยนคำถามงานวิจัยให้เป็นแผนการทดลองที่นำไปปฏิบัติได้

การสร้างสรรค์ — การพัฒนาซอฟต์แวร์ แอปพลิเคชันแบบอินเทอร์แอกทีฟ เกม การแสดงข้อมูลด้วยภาพ และระบบการเรียนรู้ของเครื่อง

การส่งมอบ — การแปลงเอกสาร ข้อมูล และข้อกำหนดด้านการออกแบบให้เป็นรายงาน งานนำเสนอ และผลลัพธ์เชิงโครงสร้างอื่น ๆ

ความปลอดภัยทางไซเบอร์ — การวิเคราะห์ปัญหาด้านความปลอดภัย การตรวจสอบยืนยันช่องโหว่ การนำการแก้ไขไปใช้ และการตรวจสอบยืนยันซ้ำในสภาพแวดล้อมที่ได้รับอนุญาต

นอกจากนี้ บนการ์ดยังมีสิ่งที่ไม่ได้รับการอธิบายไว้ด้วย: เว็บไซต์ (atria-asi.com), องค์กร GitHub (atria-asi) ที่มิเรอร์ README, และบัญชี X (@AtriaASI) คำต่อท้าย "ASI" เป็นรายละเอียดเดียวที่แปลกจริง ๆ — ไม่มีอะไรบนการ์ดบอกว่าแบรนด์นี้ตั้งใจจะสื่อถึงอะไร และเราจะไม่ตีความให้มากไปกว่าที่ตัวรีโปเองทำ สิ่งที่พอจะรู้ได้คือ นี่เป็นโค้ดเนมของไลน์ผลิตภัณฑ์ที่แยกต่างหาก จากชื่อ Intern-S2 และ InternLumina ที่ห้องแล็บใช้มาตลอดทั้งปี

Screenshot of the Hugging Face model card for internlm/Atria-Dawn-Preview showing the title, the Atria Dawn Preview branding, the architecture tag glm_moe_dsa, the MIT license, and the 'From Research Questions To Verifiable Results' description.

สิ่งที่คอนฟิกระบุไว้จริง ๆ

น้ำหนักและคอนฟิกูเรชันสามารถดาวน์โหลดได้แล้วในวันนี้ ซึ่งเป็นจุดที่การเปิดตัวแบบเงียบ ๆ ยุติการเป็นเพียงข่าวลือ สตริงสถาปัตยกรรมคือ GlmMoeDsaForCausalLM — ตระกูล MoE แบบเบาบางสไตล์ DSA เดียวกับที่ไลน์ GLM ใช้ โดยคอนฟิกูเรชันกำหนดเส้นทางไปยังผู้เชี่ยวชาญแบบ routed 8 จาก 256 รายต่อโทเคน กระจาย across 78 เลเยอร์ (จำนวนพารามิเตอร์ที่ใช้งานไม่ได้ระบุไว้บนการ์ดโมเดล สำหรับ MoE ขนาด 744B ที่มีรูปร่างแบบนี้ ตัวเลขจะอยู่ที่หลักหมื่นล้าน) หน้าต่างบริบทถูกตั้งไว้ที่ 1,048,576 โทเคน — เต็ม 1M ตรงกับคลาสบริบทยาวที่แล็บผลักดันในรุ่นอื่น ๆ ที่เพิ่งเปิดตัวเร็ว ๆ นี้ โทเคไนเซอร์มีมาร์กเกอร์สำหรับภาพ วิดีโอ เสียง และการถอดความ แม้ว่าเทมเพลตแชตจะบอกโมเดลอย่างชัดเจนว่าไม่มีความสามารถรับอินพุตแบบมัลติโมดัล และให้บอกเช่นนั้นหากมีคนส่งสื่อเข้ามา — ฉะนั้นให้มองแท็กโมดัลลิตีเหล่านี้เป็นระบบพื้นฐานที่สืบทอดมา ไม่ใช่การอ้างว่ามีอินพุตภาพหรือเสียง

ค่าน้ำหนักบอกเรื่องราวในทางปฏิบัติ:

เช็กพอยต์ — สองรายการ: โมเดล instruct แบบ BF16/F32 และ Atria-Dawn-Preview-FP8 ซึ่งเป็นโมเดล instruct ที่ควอนไทซ์แบบ FP8

ขนาด — รุ่น BF16 มีขนาดประมาณ 1.5TB กระจายอยู่บน 353 shards ของ safetensors; รุ่น FP8 มีขนาดประมาณ 756GB

สัญญาอนุญาต — MIT ทั้งสำหรับโค้ดและเวต โดยไม่มีข้อกำหนดจำกัดใด ๆ บนการ์ด — ผ่อนปรนอย่างผิดปกติสำหรับการเปิดตัวจากแล็บในระดับนี้

การเผยแพร่ — Hugging Face และ ModelScope, README ภาษาอังกฤษและภาษาจีน, เทมเพลตแชทและคอนฟิกการสร้างในรีโป

โฮสติ้ง — ไม่มีการระบุผู้ให้บริการ inference ไว้บนการ์ด และไม่มีการกล่าวถึง API ที่ใดเลย

บรรทัดสุดท้ายนั้นสำคัญต่อการวางกรอบเรื่องนี้: นี่คือการเปิดตัวเวตโมเดล ไม่ใช่การเปิดตัวบริการ ใครก็ตามที่ต้องการรัน Atria Dawn Preview ในวันนี้ต้องดาวน์โหลดประมาณ 756GB (FP8) หรือ 1.5TB (BF16) และให้บริการด้วยตนเอง — ไม่มีเอนด์พอยต์ของผู้ให้บริการ ไม่มีราคา ไม่มีหน้าโควตา

ตารางเกณฑ์มาตรฐาน อ่านอย่างละเอียด

การ์ดนี้มีตารางเบนช์มาร์ก 16 แถวที่เปรียบเทียบ Atria Dawn Preview กับ DeepSeek V4 Pro, Kimi K3, Qwen3.8-Max, GLM-5.3, GPT-5.6 Sol และ Claude Opus 5 ในด้านการทำงานแบบเอเจนต์ การใช้เครื่องมือ การเขียนโค้ด และการวิจัย ตัวเลขทุกตัวในตารางเป็นข้อมูลที่ผู้ขายรายงานเอง — แล็บเป็นผู้รันหรือจ้างให้ประเมิน และยังไม่มีตัวเลขใดถูกทำซ้ำโดยอิสระ เนื่องจากยังไม่มีการประเมิน Atria Dawn Preview โดยอิสระ ณ วันนี้ Artificial Analysis ไม่มีหน้าเพจสำหรับโมเดลนี้ ดังนั้นวิธีอ่านที่ถูกต้องคือ “นี่คือสิ่งที่ผู้ขายบอกว่าเปรียบเทียบได้อย่างไร” ไม่ใช่ “นี่คือสิ่งที่เปรียบเทียบได้จริง”

A scoreboard infographic for Atria Dawn Preview listing the vendor-reported benchmark highlights: BrowseComp 92.5, CyberGym 86.5, DeepSearchQA 96.0, BFCL v4 77.0, SWE-bench Pro 59.6, JobBench 50.3, with a footer noting all figures are vendor-reported on the model card with no independent scores yet.

เมื่อปักหมุดข้อควรระวังนั้นไว้อย่างชัดเจนแล้ว จุดเด่นต่าง ๆ ก็น่าสนใจอย่างแท้จริง Atria Dawn Preview ครองอันดับหนึ่งในกลุ่มที่ระบุบน BrowseComp ด้วยคะแนน 92.5 (เทียบกับ 92.2 ของ GPT-5.6 Sol และ 90.8 ของ Claude Opus 5) บน CyberGym ด้วย 86.5 (นำหน้า 83.3 ของ DeepSeek V4 Pro, 84.5 ของ GLM-5.3 และ 83.6 ของ GPT-5.6 Sol) และบน DeepSearchQA ด้วย 96.0 อีกทั้งยังทำคะแนน BFCL v4 ได้แข็งแกร่งถึง 77.0 เมื่อเทียบกับ 71.4 ของ DeepSeek V4 Pro และ 69.1 ของ Kimi K3 จุดอ่อนก็ให้ข้อมูลไม่แพ้กัน:

Terminal-Bench 2.1 — 78.3 ตามหลัง 89.3 ของ Qwen3.8-Max และ 90.2 ของ Claude Opus 5 อยู่พอสมควร ซึ่งบ่งชี้ว่าความสามารถด้าน coding agent ยังไม่ถึงระดับเรือธง

SWE-bench Pro — 59.6 นำหน้า DeepSeek V4 Pro (58.3) แต่ยังห่างไกลจาก Claude Opus 5 ที่ได้ 74.7

MLE-bench Lite — 86.2 ซึ่งตามหลัง GPT-5.6 Sol (88.9) และ Claude Opus 5 (88.0) แม้จะมีจุดขายเรื่อง Discovery

JobBench — 50.3 ต่ำที่สุดในบรรดาโมเดลที่การ์ดนี้ระบุไว้ และเป็นหนึ่งในหลายแถวที่ตัวอย่างตัวอย่างเปิด 744B ให้ผลลัพธ์ด้อยกว่าโมเดลระดับเรือธงแบบปิดที่ถูกพิมพ์ไว้ข้างๆ

สรุปตามจริง: การ์ดนี้อ้างถึงจุดแข็งที่มีอยู่จริงในด้านการสืบค้นงานวิจัย งานที่อิงกับเบราว์เซอร์ และการตรวจสอบความปลอดภัย ขณะที่แถวของการเขียนโค้ดแบบคลาสสิกและงานองค์ความรู้อยู่ในระดับกลางๆ ของกลุ่ม การพรีวิวที่ไม่เลือกหยิบเฉพาะผลที่ดีที่สุดน่าเชื่อถือมากกว่าการพรีวิวที่ชนะทุกอย่าง — แต่ทั้งหมดนั้นยังไม่ได้รับการยืนยัน และโมเดลขนาดนี้ที่มีพื้นที่การประเมินมากขนาดนี้ควรได้รับการตรวจสอบจากอิสระก่อนที่ใครจะเดิมพันไปป์ไลน์กับมัน

ตำแหน่งของมันในไลน์อัป InternLM

Atria Dawn Preview เปิดตัวในช่วงที่ห้องแล็บกำลังยุ่งผิดปกติ โดยเรือธงด้านวิชันและวิทยาศาสตร์อย่าง Intern-S2-397B ปรากฏขึ้นเมื่อวันที่ 13 กันยายน ซึ่งเป็นตระกูลเดียวกับรุ่นน้องที่เล็กกว่า (Intern-S2, Intern-S2 Mobius) ที่เปิดตัวมาตั้งแต่กลางปี และ InternLumina-U2 ที่เน้นด้านวิชันก็เปิดตัวเมื่อต้นเดือนกันยายน Atria เป็นโค้ดเนมแยกต่างหากที่มุ่งเป้าไปที่งานแบบ agentic ทั่วไป มากกว่าความเชี่ยวชาญเฉพาะทางด้านวิทยาศาสตร์หรือมัลติโมดัล และต่างจาก Intern-S2-397B ซึ่งมีสัญญาอนุญาต Apache-2.0 และระบบนิเวศการประกาศของตัวเอง Atria Dawn Preview มาถึงอย่างไร้พิธีการภายใต้ MIT ยังไม่ยืนยันว่า Atria เป็นพรีวิวครั้งเดียวหรือสมาชิกคนแรกของซีรีส์ใหม่ คำต่อท้าย "Preview" และ repo เปล่า ๆ ที่ไม่มีข้อความ roadmap ที่ไหนเลย ชี้ไปทางการตีความแบบระมัดระวัง

สิ่งที่ยังไม่เป็นที่รู้จัก

นิสัยที่เป็นประโยชน์เมื่อมีการเปิดตัวแบบเงียบ คือการทำรายการสิ่งที่ยังเปิดค้างอยู่ บน Atria Dawn Preview รายการนั้นยาว:

ประกาศ — ณ วันที่ 14 กันยายน ไม่มีอะไรจากทางแล็บ เว็บไซต์ หรือบัญชี X; รีโปปรากฏขึ้นก่อน ซึ่งเป็นรูปแบบที่การเปิดตัวหลายครั้งของแล็บจีนในช่วงหลังเป็นเช่นนี้ แต่ "วิธีที่พวกเขามักทำกัน" ไม่ใช่การยืนยัน

บทความวิชาการหรือรายงานทางเทคนิค — ไม่มีลิงก์ใด ๆ ทั้งข้อมูลการฝึก ไปป์ไลน์ RL และจำนวนพารามิเตอร์ที่ใช้งาน ล้วนยังไม่ได้รับการเผยแพร่

แบรนด์ "Atria ASI" — โดเมนและแฮนเดิลมีอยู่จริง และการ์ดก็เชื่อมโยงทั้งสองเข้าด้วยกัน แต่ไม่ได้ระบุว่าหน่วยงานใดอยู่เบื้องหลัง และอักษรย่อเหล่านี้มีความหมายว่าอะไร

คะแนนจากแหล่งอิสระ — ไม่มี; ไม่มีรายการใน Artificial Analysis ไม่มีการปรากฏใน arena ไม่มีสิ่งใดให้ใช้เทียบกับตารางของการ์ด

ความพร้อมใช้งานแบบโฮสต์ — ยังไม่มี API จากผู้จำหน่าย และยังไม่มีเกตเวย์อินเฟอเรนซ์รายใหญ่เจ้าใดให้บริการมันในตอนนี้ วิธีเดียวที่จะรันมันได้คือคุณต้องจัดเตรียมเวทประมาณ 756GB ถึง 1.5TB ด้วยตัวเอง

การรองรับการให้บริการ — สถาปัตยกรรมนี้เป็นสายตระกูล DSA-MoE ที่เป็นที่รู้จัก ซึ่งเป็นสิ่งที่มักได้รับการรองรับระดับรันไทม์อย่างรวดเร็ว แต่ยังไม่มีการประกาศการรองรับระดับเฟรมเวิร์กสำหรับเช็กพอยต์เฉพาะนี้

สิ่งที่คุณทำได้จริงๆ กับมัน

พูดให้ชัดเจน วันนี้มีสามสิ่งที่เป็นจริง ข้อแรก คุณดาวน์โหลด Atria Dawn Preview ได้ — สัญญาอนุญาต MIT ครอบคลุมทั้งสองเช็กพอยต์ และการเปิดตัวเวอร์ชัน FP8 ทำให้คณิตศาสตร์ด้านการจัดเก็บและการให้บริการง่ายขึ้นอย่างมีนัยสำคัญเมื่อเทียบกับต้นฉบับ BF16 แม้ว่าทั้งสองแบบจะเป็นเรื่องที่ต้องใช้ GPU หลายตัวก็ตาม ข้อสอง คุณเรียกใช้มันจากที่ไหนก็ไม่ได้ เพราะไม่มีปลายทางแบบโฮสต์ให้ใช้ และนั่นคือสถานการณ์ที่แพลตฟอร์มจัดเส้นทางจะคุ้มค่ากับการมีอยู่จริง ๆ เรายังไม่จัดเส้นทางให้ Atria Dawn Preview — มันยังไม่อยู่บน OrcaRouter และหน้านี้ก็ไม่ได้แสร้งทำเป็นว่าเป็นเช่นนั้น — แต่ คีย์เดียวกันที่วันนี้ยังไม่มี Atria เข้าถึงโมเดลอื่นอีก 196 โมเดลผ่าน API เดียว โดยราคาตามรายการของผู้ให้บริการถูกส่งผ่านโดยไม่บวกเพิ่ม 0% และมีการสลับไปใช้ผู้ให้บริการรายอื่นโดยอัตโนมัติเมื่อเกิดปัญหา เมื่อ Atria Dawn Preview มาถึงผู้ให้บริการที่อยู่ในระบบจัดเส้นทาง มันจะปรากฏในราคาตามรายการในวันเดียวกับที่ตัวเลขของผู้ขายได้รับการอัปเดต ซึ่งนั่นคือความหมายของราคาแบบส่งผ่านในทางปฏิบัติ จนกว่าจะถึงตอนนั้น โมเดลนี้เป็นโปรเจกต์แบบดาวน์โหลดแล้วรันเอง และวิธีที่ปลอดภัยที่สุดในการประเมินมันคือบนฮาร์ดแวร์ที่คุณควบคุมเอง ด้วยการทดสอบมาตรฐานอิสระของคุณเอง — ไม่ใช่เชื่อตามคำโฆษณาบนการ์ด

Screenshot of the OrcaRouter models page showing the model catalogue with 196 models across 15 providers, one API key and one bill, with input price, context length and provider filters.

สิ่งที่ควรดูต่อไป

สัญญาณสี่อย่างจะตัดสินว่าการเปิดตัวแบบเงียบ ๆ ครั้งนี้จะกลายเป็นเรื่องที่คุณลงมือทำหรือไม่ สัญญาณแรกคือประกาศ: โพสต์เปิดตัวหรือเปเปอร์ที่จริงจังจะตอบเรื่องสถาปัตยกรรม สูตรการฝึก และว่า "Preview" เป็นพรีวิวของอะไร สัญญาณที่สองคือการประเมินที่เป็นอิสระ — โมเดลขนาดนี้ที่มีการ์ดมั่นใจขนาดนี้ จำเป็นต้องมีคนตรวจสอบข้ออ้างเรื่อง BrowseComp และ CyberGym เทียบกับฮาร์เนสที่เป็นกลาง และการที่ไม่มีรายการใน Artificial Analysis เลยคือช่องว่างที่สะดุดตาที่สุดเพียงหนึ่งเดียว สัญญาณที่สามคือความพร้อมให้บริการบนโฮสต์: โมเดล MoE เปิดขนาด 744B ที่มีเวตภายใต้สัญญาอนุญาต MIT และหน้าต่างบริบท 1M ตรงกับโปรไฟล์ที่มักโผล่บนผู้ให้บริการ inference ภายในไม่กี่สัปดาห์ และเจ้าแรกที่ให้บริการมันจะกำหนดราคาใช้งานจริงของการใช้มัน สัญญาณที่สี่คือคำถามเรื่องตระกูลโมเดล — ว่า Atria เป็นของครั้งเดียวหรือเป็นซีรีส์ และการใช้แบรนด์ "ASI" บ่งชี้ว่าแล็บตั้งใจจะพาสายนี้ไปทางไหนต่อ ไม่มีสิ่งใดในนั้นที่รู้ได้จากรีโป และนั่นแหละคือประเด็น: รีโปให้โมเดลกับเรา และสองสัปดาห์ข้างหน้าควรให้ส่วนที่เหลือกับเรา

การเปรียบเทียบในบทความนี้3

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube