
Ling-3.1-flash ประกาศแล้ว แต่ไม่โอเพน: พารามิเตอร์ ~560B คอนเท็กซ์ 1M โทเคน และกราฟที่มีเพียง Ant เท่านั้นที่รัน
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 262 tok/s
- OpenAIใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- OpenAIใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- Anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- xAISpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
ทีม Ling ของ Ant Group เปิดเผยตัวเลขของโมเดลระดับเร็วรุ่นถัดไปเมื่อวันที่ 30 กันยายน 2026 และในประโยคเดียวกันก็บอกว่าคุณยังไม่สามารถมีมันได้ตอนนี้ Ling-3.1-flash เป็นโมเดลแบบ mixture-of-experts ขนาดประมาณ 560,000 ล้านพารามิเตอร์ ซึ่งเปิดใช้งานพารามิเตอร์ราว 25,000 ล้านตัวต่อโทเคน และรองรับหน้าต่างบริบทสูงสุด 1 ล้านโทเคน ตามประกาศโมเดลที่ Ant Group เผยแพร่จากบัญชี @AntLingAGI ของตนเอง ประโยคที่นิยามการเปิดตัวครั้งนี้คือประโยคที่ตามหลังสเปก: “เราวางแผนจะเปิดโอเพนซอร์สโมเดลนี้ในเร็ว ๆ นี้” ณ วันนี้ ยังไม่มีที่เก็บของ Ling-3.1-flash บน Hugging Face ไม่มีสัญญาอนุญาต ไม่มีไฟล์เวตที่ดาวน์โหลดได้ และไม่มีการประเมินจากผู้ใดนอก Ant Group สิ่งที่มีอยู่คือแผนภูมิ benchmark พื้นผิวผลิตภัณฑ์ที่ใช้งานได้จริง และคำสัญญา
ความแตกต่างนั้นคือเรื่องทั้งหมด และคุ้มค่าที่จะพูดกันตรง ๆ เพราะกรอบความเข้าใจที่คนส่วนใหญ่ได้เห็นก่อน — การเปิดตัวแบบเปิดน้ำหนักระดับ 500B จากจีนที่เข้าใกล้ระดับแนวหน้า — อธิบายถึงสิ่งที่ยังไม่เกิดขึ้น Ling-3.1-flash ไม่ใช่รุ่นที่เปิดให้ใช้แล้ว แต่เป็นรุ่นที่เพิ่งประกาศ สองสิ่งนี้ไม่ได้ใกล้กันเลย และช่องว่างระหว่างสองสิ่งนี้คือจุดที่ผู้อ่านอาจถูกเผาได้พอดี: หากคุณวางแผนกำลังความจุ ตั้งงบสำหรับโครงการนำร่อง หรือเขียนบันทึกจัดซื้อโดยอิงกับน้ำหนักแบบเปิดที่ยังไม่มีอยู่ คุณกำลังวางแผนบนข่าวประชาสัมพันธ์
เนื้อหาจริง ๆ ของประกาศ
โพสต์นี้สั้นและตัวเลขในนั้นก็เฉพาะเจาะจง Ant ระบุจำนวนพารามิเตอร์ทั้งหมดประมาณ 560 พันล้าน เทียบกับประมาณ 25 พันล้านที่ทำงานต่อโทเคน อัตราส่วนใกล้ 1 ต่อ 22 หนาแน่นกว่าเล็กน้อยเมื่อเทียบกับรุ่น Ling-3.0-flash ที่มันสืบทอดมา — โมเดลนั้นมีขนาดรวม 124B เทียบกับ 5.1B ที่ทำงาน ประมาณ 1 ต่อ 24 บนขนาดตัวที่เล็กกว่าหนึ่งในสี่ คอนเท็กซ์ถูกอ้างว่าอยู่ที่ "สูงสุด 1M โทเคน" ซึ่งเป็นสี่เท่าของหน้าต่าง 262 โทเคนที่ตระกูล Ling-3.0-flash รองรับในปัจจุบัน มีคะแนนหลักสามรายการแนบมาด้วย: 1,673 Elo บน GDPVal-AA v2.1, 75.16 บน HealthBench Professional และ 65.35 บน HealthBench Professional
ตัวเลขทุกตัวเหล่านั้นเป็นข้อมูลที่ผู้พัฒนารายงานเอง เป็นข้อมูลจากฝ่ายแรก และไม่ได้เผยแพร่ในรูปแบบใดที่บุคคลที่สามสามารถรันซ้ำได้เลย ไม่มีชุดเครื่องมือประเมิน ไม่มีชุดพรอมป์ต์ ไม่มีการตั้งค่าการรัน และไม่มีซีด — และที่สำคัญกว่านั้นในระดับพื้นฐาน คือไม่มีเวตโมเดลให้รันสิ่งเหล่านั้นด้วย หากตัวเลขของ Ant ถูกต้อง โมเดลนี้ก็จัดอยู่ในระดับแนวหน้าสุดของโมเดลเปิดที่เปิดตัวจากจีน แต่ในตอนนี้ไม่มีทางรู้ได้เลยว่าตัวเลขเหล่านั้นถูกต้องหรือไม่
แผนภูมิ และข้อควรระวังที่แฝงอยู่ภายในนั้น

Ant เปิดตัว Ling-3.1-flash พร้อมการ์ดเปรียบเทียบแบบหลายพาเนลที่จัดวางโมเดลนี้ไว้ในกลุ่มของโมเดลระดับแนวหน้าและใกล้แนวหน้า: GPT-5.6 Sol, Claude Opus 5, Kimi K3, สองรายการจากตระกูล GLM และ DeepSeek-V4.1-Flash ในทุกพาเนล แท่งของ Ling อยู่ที่หรือใกล้จุดสูงสุดในตัวชี้วัดด้านเอเจนต์และการเขียนโค้ด และอยู่กลางกลุ่มในด้านการสนทนาหลายรอบและงานเฉพาะโดเมน อ่านมันตามที่มันเป็น — การเลือกงานโดยผู้ขายเอง ซึ่งดึงมาจากชุดที่ครอบคลุมงานเอเจนต์เอนกประสงค์ การเขียนโค้ด งานด้านธนาคาร และการดูแลสุขภาพ — และมันก็เป็นแผ่นการ์ดที่ดูน่าเชื่อถือ
แต่ลองดูว่าใครอยู่บนนั้น แล้วจะมีสิ่งหนึ่งที่เด่นชัด โมเดลระดับแนวหน้าที่ Ant เลือกมาเปรียบเทียบคือ GPT-5.6 Sol กับ Claude Opus 5 ตอนนี้ทั้งสองโมเดลนั้นล้าหลังไปหนึ่งเจเนอเรชันแล้ว Opus 5.5 กับ GPT-6 Sol เปิดใช้งานทั้งคู่ในวันที่ 22 กันยายน 2026 วันเดียวกัน และทั้งคู่ก็พร้อมให้เรียกใช้งานได้ในวันนี้ โมเดลใหม่ล่าสุดที่ Ant ไม่ได้ใส่ไว้ใน card กลับเป็นรุ่นที่ผู้อ่านอยากให้ใช้วัดเทียบเสียด้วยซ้ำ ซึ่งเป็นข้อติติงแบบเดียวกับที่ผุดขึ้นในกระแสความเห็นรอบแรกเกี่ยวกับการเปิดตัวครั้งนี้ คือความอยากให้โมเดลที่มาถึงในเดือนตุลาคมได้ถูกวัดประสิทธิภาพเทียบกับแนวหน้าของเดือนตุลาคมมากกว่าแนวหน้าของเดือนกรกฎาคม นั่นไม่ใช่การตำหนิตัวโมเดล ซึ่งอาจจะยืนหยัดได้ดีทีเดียวก็ได้ แต่เป็นเหตุผลที่ควรถือว่า card นี้เป็นข้ออ้างเชิงทิศทางมากกว่าจะเป็นคำตัดสิน และควรสังเกตว่าการเปรียบเทียบที่ Ant เลือกไม่ได้ช่วยยกผลลัพธ์ให้ดูดีเท่าไร แต่กลับทำให้ดูเชยเสียมากกว่า
ที่ที่คุณสามารถสัมผัสมันได้ และเชิงอรรถที่ไม่ได้อธิบายไว้หนึ่งแห่ง
ปัจจุบันมีเพียงที่เดียวที่ผู้ใช้สามารถรัน Ling-3.1-flash ได้: ผลิตภัณฑ์ของ Ant เอง อินเทอร์เฟซ Ling Studio ที่ ling.tbox.cn มี Ling-3.1-flash อยู่ในตัวเลือกโมเดล และคำอธิบายโมเดลของแอปเองก็กว้างกว่าการ์ดเบนช์มาร์ก — โดยวางตำแหน่งไว้ที่ "เอเจนต์เพื่อการใช้งานทั่วไป การค้นหา งานสำนักงานประจำวัน และการพัฒนาซอฟต์แวร์/โค้ด" ซึ่งเป็นตำแหน่งแบบที่คุ้นเคยสำหรับระดับนี้: ไม่ใช่ตัวให้เหตุผลที่ลึกที่สุดในตระกูล แต่เป็นตัวที่ตั้งใจไว้ให้ถูกเรียกใช้บ่อย ๆ และในราคาถูก
ส่วนที่เปิดเผยนั้นยังพารายละเอียดที่น่าอึดอัดใจที่สุดของการเปิดตัวครั้งนี้มาด้วย เชิงอรรถของการ์ดเบนช์มาร์กเองระบุว่า HealthBench Professional — ตัวเลข 65.35 ซึ่งเป็นหนึ่งในสามตัวเลขในข้อความประกาศ — ถูก “ประเมินในสภาพแวดล้อม AQ” และเสริมว่าความสามารถด้านสุขภาพของ Ling-3.1-flash “ปัจจุบันสามารถสัมผัสได้เฉพาะใน AQ” ไม่มีสิ่งใดบนการ์ดที่อธิบายว่า AQ คืออะไร และไม่มีเอกสารสาธารณะใดที่เราค้นหาได้ให้คำนิยามมันไว้ คะแนนพาดหัวที่แนบตัวระบุสภาพแวดล้อมไว้ โดยที่สภาพแวดล้อมนั้นไม่มีการระบุชื่อ ไม่ใช่ผลลัพธ์ที่ทำซ้ำได้ หากแต่เป็นเดโมผลิตภัณฑ์ที่มีตัวเลขอยู่ข้าง ๆ
อะไรคือสิ่งที่สามารถรู้ได้ และอะไรคือสิ่งที่ไม่อาจรู้ได้
การจัดข่าวประชาสัมพันธ์นี้ลงในสองกลุ่มนั้นเป็นสิ่งที่มีประโยชน์ที่สุดที่ผู้อ่านจะทำกับมันได้ในวันนี้
สิ่งที่ทราบได้ในตอนนี้: พารามิเตอร์ จำนวนที่ใช้งานจริง และหน้าต่างบริบทตามที่ผู้ขายระบุ; เกณฑ์มาตรฐานจากผู้ขายทั้งสามราย; การมีอยู่ของโมเดลในผลิตภัณฑ์ของ Ant เอง; ชุดเปรียบเทียบที่ Ant เลือก; ข้อเท็จจริงที่ว่าไม่มีการเผยแพร่ค่าน้ำหนัก สัญญาอนุญาต หรือการ์ดโมเดล; และข้อเท็จจริงที่ว่า Artificial Analysis ซึ่งให้คะแนนรุ่นก่อนหน้าอย่างอิสระ ไม่มีหน้า Ling-3.1-flash ณ เวลาที่เขียนนี้ กระบวนการให้คะแนนอิสระที่ทำให้ตัวเลขดัชนี Intelligence Index 20 จุดของ Ling-3.0-flash อ่านเข้าใจได้ ยังไม่ได้เผยแพร่สิ่งใดเกี่ยวกับ 3.1 เลย
ยังไม่อาจรู้ได้ในตอนนี้: น้ำหนักโมเดลจะเปิดจริงหรือไม่ และภายใต้สัญญาอนุญาตแบบใด; สถาปัตยกรรมเป็นเวอร์ชันที่ขยายขนาดขึ้นของสแต็กไฮบริด Ling-3.0 หรือเป็นสิ่งใหม่; โมเดลมีค่าใช้จ่ายเท่าใดเมื่อใช้ผ่าน API ของ Ant หากมีราคาผ่าน API อยู่จริง; มันทำงานอย่างไรภายใต้บริบทยาวในทางปฏิบัติ ต่างจากวิธีที่หน้าต่างถูกระบุไว้; และช่องว่างของเบนช์มาร์กจะยังคงอยู่หรือไม่เมื่อมีคนที่ไม่ใช่ Ant รันงานเดียวกัน แต่ละข้อเหล่านี้เป็นคำถามที่โมเดลที่เปิดตัวแล้วตอบได้ในวันแรก และโมเดลที่ประกาศไว้จะตอบในวันหลังจากนั้นซึ่งยังไม่ได้กำหนดตารางไว้

วิธีอ่านวันแบบนี้
รูปแบบนี้พบเห็นได้บ่อยพอที่จะตั้งชื่อได้แล้ว แล็บจีนที่มีผลงานโดดเด่นเปิดตัวการ์ดโมเดลและแผนภูมิเบนช์มาร์ก ตัวเลขออกมาใกล้ระดับแนวหน้า ชุมชนตอบสนองต่อตัวเลขเหล่านั้น และน้ำหนักโมเดลก็มาถึง — หรือไม่มา — ในอีกหลายสัปดาห์ถัดมา Ling-3.0-flash เล่นบทนี้เป๊ะ ๆ ในช่วงซัมเมอร์นี้ และน่าจดจำว่ามันจบลงอย่างไร: Ant ประกาศเปิดตัวเมื่อวันที่ 24 กรกฎาคม 2026 ในฐานะโมเดลแบบ API-only ที่ไม่มีข้อความเกี่ยวกับสัญญาอนุญาตและไม่มีเบนช์มาร์กอิสระ และน้ำหนักโมเดลภายใต้ MIT ก็ไม่ปรากฏบน Hugging Face จนถึงวันที่ 7 สิงหาคม สองสัปดาห์หลังการประกาศ Ling-3.1-flash อยู่ในจุดที่เทียบเท่ากันในเส้นเรื่องนั้นตั้งแต่วันแรก โดยมีความแตกต่างเพิ่มเติมว่า ครั้งนี้คำสัญญาว่าจะเปิดซอร์สนั้นชัดเจนอยู่ในประกาศ แทนที่จะเป็นการอนุมานเอา
ไม่มีโมเดลใดที่ Ant เลือกมาเป็นจุดเปรียบเทียบที่อยู่ในแคตตาล็อกของเราในฐานะเนื้อหาหลักของชิ้นงานเลย — Ling-3.1-flash, Ling-3.0-flash และ Ling-3.0-flash-VL ต่างก็คืนค่า not-found บนแคตตาล็อก OrcaRouter วันนี้ และเราจะไม่เสแสร้งว่าเป็นอย่างอื่น แต่คู่เทียบสามตัวบนแผนภูมินั้นสามารถเราเตอร์ได้ในตอนนี้: Claude Opus 5, GPT-5.6 Sol และ DeepSeek-V4.1-Flash ล้วนอยู่เบื้องหลังคีย์เดียว ในราคาตามที่ผู้ให้บริการประกาศโดยไม่มีค่าธรรมเนียมบวกเพิ่ม พร้อมการสลับไปใช้ตัวสำรองอัตโนมัติระหว่างกัน สิ่งนี้สำคัญกว่าที่ฟังดูในสัปดาห์แบบนี้ เพราะวิธีที่ซื่อสัตย์ในการประเมินโมเดลที่เพิ่งประกาศออกมาคือการรันการเปรียบเทียบที่ Ant ชวนให้ทำ — กับโมเดลที่คุณเรียกใช้ได้จริง — ในขณะที่เนื้อหาของการเปรียบเทียบยังเป็นเพียงแผนภูมิ
เมื่อน้ำหนักโมเดลออกมา คำถามที่มีประโยชน์จะไม่ใช่เรื่องที่ว่า Ling-3.1-flash เอาชนะ Opus 5 ได้ในคะแนน Elo รายการเดียวหรือไม่ แต่จะเป็นเรื่องที่ว่า MoE ขนาด ~560B ที่มีพารามิเตอร์ทำงาน ~25B สามารถรองรับคอนเท็กซ์ 1M โทเคนในราคาที่ทำให้ความเบาบางคุ้มค่าได้หรือไม่ และใบอนุญาตเปิดกว้างพอให้โฮสต์เองได้หรือไม่ นี่คือสองคำถามที่ประกาศไม่ได้ตอบ และเป็นคำถามเดียวที่จะตัดสินว่าสิ่งนี้จะกลายเป็นโมเดลที่ผู้คนสร้างต่อยอด หรือเป็นสไลด์ในเด็คครั้งต่อไปของใครบางคน สำหรับตอนนี้: ชื่อมีอยู่จริง ตัวเลขเป็นของ Ant เท่านั้น และน้ำหนักโมเดลยังเป็นเพียงประโยคเดียว

