การ์ดฮีโร่เชิงบรรณาธิการที่สร้างขึ้น ในหัวข้อ "Ling-3.1-flash: ประกาศแล้ว แต่ยังไม่เปิด" พร้อมคำโปรย "~560B พารามิเตอร์ทั้งหมด · ~25B ที่ใช้งานต่อโทเคน · คอนเท็กซ์สูงสุด 1M" การ์ดที่มีป้ายกำกับสามใบระบุว่า "น้ำหนักโมเดล: ยังไม่เผยแพร่" "เบนช์มาร์ก: รายงานโดยผู้พัฒนาเท่านั้น" และ "ไม่มีสัญญาอนุญาต · ไม่มีการ์ดโมเดล · ไม่มีให้ดาวน์โหลด"
Guides & Insights

Ling-3.1-flash ประกาศแล้ว แต่ไม่โอเพน: พารามิเตอร์ ~560B คอนเท็กซ์ 1M โทเคน และกราฟที่มีเพียง Ant เท่านั้นที่รัน

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

ทีม Ling ของ Ant Group เปิดเผยตัวเลขของโมเดลระดับเร็วรุ่นถัดไปเมื่อวันที่ 30 กันยายน 2026 และในประโยคเดียวกันก็บอกว่าคุณยังไม่สามารถมีมันได้ตอนนี้ Ling-3.1-flash เป็นโมเดลแบบ mixture-of-experts ขนาดประมาณ 560,000 ล้านพารามิเตอร์ ซึ่งเปิดใช้งานพารามิเตอร์ราว 25,000 ล้านตัวต่อโทเคน และรองรับหน้าต่างบริบทสูงสุด 1 ล้านโทเคน ตามประกาศโมเดลที่ Ant Group เผยแพร่จากบัญชี @AntLingAGI ของตนเอง ประโยคที่นิยามการเปิดตัวครั้งนี้คือประโยคที่ตามหลังสเปก: “เราวางแผนจะเปิดโอเพนซอร์สโมเดลนี้ในเร็ว ๆ นี้” ณ วันนี้ ยังไม่มีที่เก็บของ Ling-3.1-flash บน Hugging Face ไม่มีสัญญาอนุญาต ไม่มีไฟล์เวตที่ดาวน์โหลดได้ และไม่มีการประเมินจากผู้ใดนอก Ant Group สิ่งที่มีอยู่คือแผนภูมิ benchmark พื้นผิวผลิตภัณฑ์ที่ใช้งานได้จริง และคำสัญญา

ความแตกต่างนั้นคือเรื่องทั้งหมด และคุ้มค่าที่จะพูดกันตรง ๆ เพราะกรอบความเข้าใจที่คนส่วนใหญ่ได้เห็นก่อน — การเปิดตัวแบบเปิดน้ำหนักระดับ 500B จากจีนที่เข้าใกล้ระดับแนวหน้า — อธิบายถึงสิ่งที่ยังไม่เกิดขึ้น Ling-3.1-flash ไม่ใช่รุ่นที่เปิดให้ใช้แล้ว แต่เป็นรุ่นที่เพิ่งประกาศ สองสิ่งนี้ไม่ได้ใกล้กันเลย และช่องว่างระหว่างสองสิ่งนี้คือจุดที่ผู้อ่านอาจถูกเผาได้พอดี: หากคุณวางแผนกำลังความจุ ตั้งงบสำหรับโครงการนำร่อง หรือเขียนบันทึกจัดซื้อโดยอิงกับน้ำหนักแบบเปิดที่ยังไม่มีอยู่ คุณกำลังวางแผนบนข่าวประชาสัมพันธ์

เนื้อหาจริง ๆ ของประกาศ

โพสต์นี้สั้นและตัวเลขในนั้นก็เฉพาะเจาะจง Ant ระบุจำนวนพารามิเตอร์ทั้งหมดประมาณ 560 พันล้าน เทียบกับประมาณ 25 พันล้านที่ทำงานต่อโทเคน อัตราส่วนใกล้ 1 ต่อ 22 หนาแน่นกว่าเล็กน้อยเมื่อเทียบกับรุ่น Ling-3.0-flash ที่มันสืบทอดมา — โมเดลนั้นมีขนาดรวม 124B เทียบกับ 5.1B ที่ทำงาน ประมาณ 1 ต่อ 24 บนขนาดตัวที่เล็กกว่าหนึ่งในสี่ คอนเท็กซ์ถูกอ้างว่าอยู่ที่ "สูงสุด 1M โทเคน" ซึ่งเป็นสี่เท่าของหน้าต่าง 262 โทเคนที่ตระกูล Ling-3.0-flash รองรับในปัจจุบัน มีคะแนนหลักสามรายการแนบมาด้วย: 1,673 Elo บน GDPVal-AA v2.1, 75.16 บน HealthBench Professional และ 65.35 บน HealthBench Professional

ตัวเลขทุกตัวเหล่านั้นเป็นข้อมูลที่ผู้พัฒนารายงานเอง เป็นข้อมูลจากฝ่ายแรก และไม่ได้เผยแพร่ในรูปแบบใดที่บุคคลที่สามสามารถรันซ้ำได้เลย ไม่มีชุดเครื่องมือประเมิน ไม่มีชุดพรอมป์ต์ ไม่มีการตั้งค่าการรัน และไม่มีซีด — และที่สำคัญกว่านั้นในระดับพื้นฐาน คือไม่มีเวตโมเดลให้รันสิ่งเหล่านั้นด้วย หากตัวเลขของ Ant ถูกต้อง โมเดลนี้ก็จัดอยู่ในระดับแนวหน้าสุดของโมเดลเปิดที่เปิดตัวจากจีน แต่ในตอนนี้ไม่มีทางรู้ได้เลยว่าตัวเลขเหล่านั้นถูกต้องหรือไม่

แผนภูมิ และข้อควรระวังที่แฝงอยู่ภายในนั้น

Ant Group's own Ling-3.1-flash benchmark card, published from the @AntLingAGI account on 30 September 2026. Multi-panel bar charts compare Ling-3.1-flash against GPT-5.6 Sol, Claude Opus 5, Kimi K3, GLM 5.3 and GLM 5.3 Flash, and DeepSeek-V4.1-Flash across GDPval-AA v2.1 (1,673 Elo), tau-Banking, SkillsBench, Automationbench, Terminal-Bench 4.0, CyberGym, FrontierSWE (75.16), SWE Atlas Codebase QnA, Finance Agent v2, HealthBench Professional (65.35), DRACO and MultiChallenge. A footnote states that HealthBench Professional was evaluated in the AQ environment.

Ant เปิดตัว Ling-3.1-flash พร้อมการ์ดเปรียบเทียบแบบหลายพาเนลที่จัดวางโมเดลนี้ไว้ในกลุ่มของโมเดลระดับแนวหน้าและใกล้แนวหน้า: GPT-5.6 Sol, Claude Opus 5, Kimi K3, สองรายการจากตระกูล GLM และ DeepSeek-V4.1-Flash ในทุกพาเนล แท่งของ Ling อยู่ที่หรือใกล้จุดสูงสุดในตัวชี้วัดด้านเอเจนต์และการเขียนโค้ด และอยู่กลางกลุ่มในด้านการสนทนาหลายรอบและงานเฉพาะโดเมน อ่านมันตามที่มันเป็น — การเลือกงานโดยผู้ขายเอง ซึ่งดึงมาจากชุดที่ครอบคลุมงานเอเจนต์เอนกประสงค์ การเขียนโค้ด งานด้านธนาคาร และการดูแลสุขภาพ — และมันก็เป็นแผ่นการ์ดที่ดูน่าเชื่อถือ

แต่ลองดูว่าใครอยู่บนนั้น แล้วจะมีสิ่งหนึ่งที่เด่นชัด โมเดลระดับแนวหน้าที่ Ant เลือกมาเปรียบเทียบคือ GPT-5.6 Sol กับ Claude Opus 5 ตอนนี้ทั้งสองโมเดลนั้นล้าหลังไปหนึ่งเจเนอเรชันแล้ว Opus 5.5 กับ GPT-6 Sol เปิดใช้งานทั้งคู่ในวันที่ 22 กันยายน 2026 วันเดียวกัน และทั้งคู่ก็พร้อมให้เรียกใช้งานได้ในวันนี้ โมเดลใหม่ล่าสุดที่ Ant ไม่ได้ใส่ไว้ใน card กลับเป็นรุ่นที่ผู้อ่านอยากให้ใช้วัดเทียบเสียด้วยซ้ำ ซึ่งเป็นข้อติติงแบบเดียวกับที่ผุดขึ้นในกระแสความเห็นรอบแรกเกี่ยวกับการเปิดตัวครั้งนี้ คือความอยากให้โมเดลที่มาถึงในเดือนตุลาคมได้ถูกวัดประสิทธิภาพเทียบกับแนวหน้าของเดือนตุลาคมมากกว่าแนวหน้าของเดือนกรกฎาคม นั่นไม่ใช่การตำหนิตัวโมเดล ซึ่งอาจจะยืนหยัดได้ดีทีเดียวก็ได้ แต่เป็นเหตุผลที่ควรถือว่า card นี้เป็นข้ออ้างเชิงทิศทางมากกว่าจะเป็นคำตัดสิน และควรสังเกตว่าการเปรียบเทียบที่ Ant เลือกไม่ได้ช่วยยกผลลัพธ์ให้ดูดีเท่าไร แต่กลับทำให้ดูเชยเสียมากกว่า

ที่ที่คุณสามารถสัมผัสมันได้ และเชิงอรรถที่ไม่ได้อธิบายไว้หนึ่งแห่ง

ปัจจุบันมีเพียงที่เดียวที่ผู้ใช้สามารถรัน Ling-3.1-flash ได้: ผลิตภัณฑ์ของ Ant เอง อินเทอร์เฟซ Ling Studio ที่ ling.tbox.cn มี Ling-3.1-flash อยู่ในตัวเลือกโมเดล และคำอธิบายโมเดลของแอปเองก็กว้างกว่าการ์ดเบนช์มาร์ก — โดยวางตำแหน่งไว้ที่ "เอเจนต์เพื่อการใช้งานทั่วไป การค้นหา งานสำนักงานประจำวัน และการพัฒนาซอฟต์แวร์/โค้ด" ซึ่งเป็นตำแหน่งแบบที่คุ้นเคยสำหรับระดับนี้: ไม่ใช่ตัวให้เหตุผลที่ลึกที่สุดในตระกูล แต่เป็นตัวที่ตั้งใจไว้ให้ถูกเรียกใช้บ่อย ๆ และในราคาถูก

ส่วนที่เปิดเผยนั้นยังพารายละเอียดที่น่าอึดอัดใจที่สุดของการเปิดตัวครั้งนี้มาด้วย เชิงอรรถของการ์ดเบนช์มาร์กเองระบุว่า HealthBench Professional — ตัวเลข 65.35 ซึ่งเป็นหนึ่งในสามตัวเลขในข้อความประกาศ — ถูก “ประเมินในสภาพแวดล้อม AQ” และเสริมว่าความสามารถด้านสุขภาพของ Ling-3.1-flash “ปัจจุบันสามารถสัมผัสได้เฉพาะใน AQ” ไม่มีสิ่งใดบนการ์ดที่อธิบายว่า AQ คืออะไร และไม่มีเอกสารสาธารณะใดที่เราค้นหาได้ให้คำนิยามมันไว้ คะแนนพาดหัวที่แนบตัวระบุสภาพแวดล้อมไว้ โดยที่สภาพแวดล้อมนั้นไม่มีการระบุชื่อ ไม่ใช่ผลลัพธ์ที่ทำซ้ำได้ หากแต่เป็นเดโมผลิตภัณฑ์ที่มีตัวเลขอยู่ข้าง ๆ

อะไรคือสิ่งที่สามารถรู้ได้ และอะไรคือสิ่งที่ไม่อาจรู้ได้

การจัดข่าวประชาสัมพันธ์นี้ลงในสองกลุ่มนั้นเป็นสิ่งที่มีประโยชน์ที่สุดที่ผู้อ่านจะทำกับมันได้ในวันนี้

สิ่งที่ทราบได้ในตอนนี้: พารามิเตอร์ จำนวนที่ใช้งานจริง และหน้าต่างบริบทตามที่ผู้ขายระบุ; เกณฑ์มาตรฐานจากผู้ขายทั้งสามราย; การมีอยู่ของโมเดลในผลิตภัณฑ์ของ Ant เอง; ชุดเปรียบเทียบที่ Ant เลือก; ข้อเท็จจริงที่ว่าไม่มีการเผยแพร่ค่าน้ำหนัก สัญญาอนุญาต หรือการ์ดโมเดล; และข้อเท็จจริงที่ว่า Artificial Analysis ซึ่งให้คะแนนรุ่นก่อนหน้าอย่างอิสระ ไม่มีหน้า Ling-3.1-flash ณ เวลาที่เขียนนี้ กระบวนการให้คะแนนอิสระที่ทำให้ตัวเลขดัชนี Intelligence Index 20 จุดของ Ling-3.0-flash อ่านเข้าใจได้ ยังไม่ได้เผยแพร่สิ่งใดเกี่ยวกับ 3.1 เลย

ยังไม่อาจรู้ได้ในตอนนี้: น้ำหนักโมเดลจะเปิดจริงหรือไม่ และภายใต้สัญญาอนุญาตแบบใด; สถาปัตยกรรมเป็นเวอร์ชันที่ขยายขนาดขึ้นของสแต็กไฮบริด Ling-3.0 หรือเป็นสิ่งใหม่; โมเดลมีค่าใช้จ่ายเท่าใดเมื่อใช้ผ่าน API ของ Ant หากมีราคาผ่าน API อยู่จริง; มันทำงานอย่างไรภายใต้บริบทยาวในทางปฏิบัติ ต่างจากวิธีที่หน้าต่างถูกระบุไว้; และช่องว่างของเบนช์มาร์กจะยังคงอยู่หรือไม่เมื่อมีคนที่ไม่ใช่ Ant รันงานเดียวกัน แต่ละข้อเหล่านี้เป็นคำถามที่โมเดลที่เปิดตัวแล้วตอบได้ในวันแรก และโมเดลที่ประกาศไว้จะตอบในวันหลังจากนั้นซึ่งยังไม่ได้กำหนดตารางไว้

Generated two-column information card. Left column headed "Knowable today" lists five cards: "~560B total / ~25B active (vendor)", "up to 1M-token context (vendor)", "1,673 Elo GDPval-AA v2.1 (vendor)", "available in Ant's Ling Studio only" and "no independent score exists". Right column headed "Not knowable" lists five cards: "whether the weights will open", "the licence terms", "API price per million tokens", "long-context behaviour in practice" and "whether the benchmark gaps hold".

วิธีอ่านวันแบบนี้

รูปแบบนี้พบเห็นได้บ่อยพอที่จะตั้งชื่อได้แล้ว แล็บจีนที่มีผลงานโดดเด่นเปิดตัวการ์ดโมเดลและแผนภูมิเบนช์มาร์ก ตัวเลขออกมาใกล้ระดับแนวหน้า ชุมชนตอบสนองต่อตัวเลขเหล่านั้น และน้ำหนักโมเดลก็มาถึง — หรือไม่มา — ในอีกหลายสัปดาห์ถัดมา Ling-3.0-flash เล่นบทนี้เป๊ะ ๆ ในช่วงซัมเมอร์นี้ และน่าจดจำว่ามันจบลงอย่างไร: Ant ประกาศเปิดตัวเมื่อวันที่ 24 กรกฎาคม 2026 ในฐานะโมเดลแบบ API-only ที่ไม่มีข้อความเกี่ยวกับสัญญาอนุญาตและไม่มีเบนช์มาร์กอิสระ และน้ำหนักโมเดลภายใต้ MIT ก็ไม่ปรากฏบน Hugging Face จนถึงวันที่ 7 สิงหาคม สองสัปดาห์หลังการประกาศ Ling-3.1-flash อยู่ในจุดที่เทียบเท่ากันในเส้นเรื่องนั้นตั้งแต่วันแรก โดยมีความแตกต่างเพิ่มเติมว่า ครั้งนี้คำสัญญาว่าจะเปิดซอร์สนั้นชัดเจนอยู่ในประกาศ แทนที่จะเป็นการอนุมานเอา

ไม่มีโมเดลใดที่ Ant เลือกมาเป็นจุดเปรียบเทียบที่อยู่ในแคตตาล็อกของเราในฐานะเนื้อหาหลักของชิ้นงานเลย — Ling-3.1-flash, Ling-3.0-flash และ Ling-3.0-flash-VL ต่างก็คืนค่า not-found บนแคตตาล็อก OrcaRouter วันนี้ และเราจะไม่เสแสร้งว่าเป็นอย่างอื่น แต่คู่เทียบสามตัวบนแผนภูมินั้นสามารถเราเตอร์ได้ในตอนนี้: Claude Opus 5, GPT-5.6 Sol และ DeepSeek-V4.1-Flash ล้วนอยู่เบื้องหลังคีย์เดียว ในราคาตามที่ผู้ให้บริการประกาศโดยไม่มีค่าธรรมเนียมบวกเพิ่ม พร้อมการสลับไปใช้ตัวสำรองอัตโนมัติระหว่างกัน สิ่งนี้สำคัญกว่าที่ฟังดูในสัปดาห์แบบนี้ เพราะวิธีที่ซื่อสัตย์ในการประเมินโมเดลที่เพิ่งประกาศออกมาคือการรันการเปรียบเทียบที่ Ant ชวนให้ทำ — กับโมเดลที่คุณเรียกใช้ได้จริง — ในขณะที่เนื้อหาของการเปรียบเทียบยังเป็นเพียงแผนภูมิ

เมื่อน้ำหนักโมเดลออกมา คำถามที่มีประโยชน์จะไม่ใช่เรื่องที่ว่า Ling-3.1-flash เอาชนะ Opus 5 ได้ในคะแนน Elo รายการเดียวหรือไม่ แต่จะเป็นเรื่องที่ว่า MoE ขนาด ~560B ที่มีพารามิเตอร์ทำงาน ~25B สามารถรองรับคอนเท็กซ์ 1M โทเคนในราคาที่ทำให้ความเบาบางคุ้มค่าได้หรือไม่ และใบอนุญาตเปิดกว้างพอให้โฮสต์เองได้หรือไม่ นี่คือสองคำถามที่ประกาศไม่ได้ตอบ และเป็นคำถามเดียวที่จะตัดสินว่าสิ่งนี้จะกลายเป็นโมเดลที่ผู้คนสร้างต่อยอด หรือเป็นสไลด์ในเด็คครั้งต่อไปของใครบางคน สำหรับตอนนี้: ชื่อมีอยู่จริง ตัวเลขเป็นของ Ant เท่านั้น และน้ำหนักโมเดลยังเป็นเพียงประโยคเดียว

Generated horizontal timeline with four milestone nodes. "Jul 24, 2026 — Ling-3.0-flash announced, API-only, no weights, no licence"; "Aug 7, 2026 — MIT weights land on Hugging Face, 14 days later"; "Sep 30, 2026 — Ling-3.1-flash announced: ~560B, ~25B active, 1M context"; and a dashed open node reading "Weights: not yet — 'we plan to open-source soon'", captioned "the same point in the same arc, on day one".
© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube