การ์ดชื่อเรื่องที่สร้างขึ้นชื่อ "Union Alpha vs Qwen3.8 Flash" พร้อมคำบรรยายใต้ชื่อ "ห่างกันเพียงหนึ่งคะแนนบนการทดสอบเดียวที่รันทั้งสองตัว" เหนือการ์ดมุมโค้งสามใบที่ระบุว่า "Official A: 136/157 vs 137/157", "บริบท: 262,144 vs 1,000,000 โทเค็น" และ "เวลาถึงโทเค็นแรก: 10.00 s vs 6.62 s" ส่วนท้ายระบุว่า Official A ตาม SMF Clearinghouse โดยค่าความหน่วงตาม OrcaRouter ในช่วง 7 วันที่ผ่านมา
Guides & Insights

Union Alpha กับ Qwen3.8 Flash: คะแนนเพียงหนึ่งแต้มก็บอกเรื่องราวทั้งหมด

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Union Alpha กับ Qwen3.8 Flash ห่างกันเพียงหนึ่งคะแนนในการทดสอบเดียวที่วัดทั้งสองตัว ในชุดทดสอบ SMF Clearinghouse Official A — 157 การทดสอบ ปิดโหมด reasoning — Union Alpha ได้ 136 คะแนน และการรัน Qwen3.8-Flash-Next ในเครื่องท้องถิ่นได้ 137 คะแนน นั่นเป็นผลการดวลกันโดยตรงที่ใกล้ที่สุดที่โมเดลใดโมเดลหนึ่งเคยมี และยังเป็นตัวเลขที่ทำให้เข้าใจผิดที่สุดในการเปรียบเทียบนี้ เพราะทั้งสองรายการไม่ได้รันภายใต้เงื่อนไขเดียวกัน และมีเพียงหนึ่งในนั้นที่เป็นโมเดลที่คุณเช่าใช้งานได้จริงในตอนนี้

สิ่งที่ช่องว่างหนึ่งคะแนนบอกคุณได้ และบอกคุณไม่ได้

เริ่มจากสิ่งที่มันยืนยันให้เห็นก่อน Union Alpha ไม่ใช่การโม้ในความหมายผิวเผิน — ชุดทดสอบกว้าง ๆ 157 รายการที่ไม่มีข้อผิดพลาดเลย การใช้เหตุผลสมบูรณ์แบบ (30/30) และการใช้เครื่องมือสมบูรณ์แบบ (2/2) ไม่ใช่ผลลัพธ์ที่เอนด์พอยต์กลวง ๆ จะผลิตออกมาได้ ผลลัพธ์ด้านการเขียนโค้ด 26/30 และคณิตศาสตร์ 24/30 ของมันทำให้มันอยู่ในอาณาเขตที่น่าเชื่อถือ และคะแนนการเขียน 2/5 ของมันทำให้มันอยู่ไกลจากงานร้อยเรียงสำหรับวัตถุประสงค์ทั่วไปมาก

ทีนี้ก็มาถึงข้อควรระวัง ซึ่งเป็นส่วนที่รับน้ำหนักเอาไว้

รายการ Qwen3.8 Flash เป็นการรัน Qwen3.8-Flash-Next ในเครื่อง — ซึ่งเป็นเช็คพอยต์แบบเปิดน้ำหนัก — ไม่ใช่ Qwen3.8 Flash API ที่โฮสต์ไว้ การให้บริการในเครื่องหมายถึงการควอนไทซ์ของคุณเอง สแตกการอนุมานของคุณเอง ตัวแยกวิเคราะห์การเรียกเครื่องมือของคุณเอง ไม่มีสิ่งใดรับประกันว่าจะตรงกับสิ่งที่ปลายทางที่โฮสต์ส่งคืน และผู้ที่รันการทดสอบได้ตั้งข้อสังเกตว่าการเปรียบเทียบนี้ยังไม่เป็นข้อยุติด้วยเหตุผลนั้นเอง

ชุดทดสอบชุดเดียวไม่ใช่โปรไฟล์ Official A ครอบคลุมกว้างแต่ตื้นเมื่อดูรายหมวด: หมวดเครื่องมือมี 2 การทดสอบ หมวดเครื่องมือที่มีการทดสอบเพียงสองรายการและได้คะแนน 2/2 เป็นสัญญาณที่ดี ไม่ใช่หลักฐานของความน่าเชื่อถือแบบเอเจนต์ และ Union Alpha ถูกวางตำแหน่งอย่างชัดเจนในฐานะโมเดลแบบเอเจนต์และโมเดลเขียนโค้ด เครื่องมือวัดนี้กำลังวัดสิ่งที่อยู่ใกล้เคียงกับข้อกล่าวอ้าง

และจุดเดียวนั้นเองก็อยู่ภายในความผันผวนของชุดทดสอบ 157 รายการ ให้มองว่า 136 และ 137 อยู่ใน "ช่วงเดียวกัน" ไม่ใช่เป็นการจัดอันดับ

เคียงข้างกัน

• หน้าต่างบริบท — Union Alpha 262,144 โทเคน เทียบกับ Qwen3.8 Flash 1,000,000 โทเคนที่ให้บริการ (262,144 แบบเนทีฟ ขยายผ่าน YaRN)

• เอาต์พุตสูงสุด — Union Alpha 131,072 โทเคน เทียบกับ Qwen3.8 Flash 131,000 โทเคน ถือว่าอยู่ในระดับเดียวกัน

• อินพุต — ข้อความและรูปภาพบน {{1}}Union Alpha{{/1}} เทียบกับข้อความ รูปภาพ และวิดีโอบน {{2}}Qwen3.8 Flash{{/2}}

• ราคา — $0 ในช่วงพรีวิวของ Union Alpha เทียบกับ Qwen3.8 Flash ที่ $0.150/M สำหรับอินพุต, $0.470/M สำหรับเอาต์พุต, $0.018/M สำหรับการอ่านแคช, $0.230/M สำหรับการเขียนแคช

• การควบคุมการให้เหตุผล — ไม่มีบน Union Alpha เทียบกับโหมดคิดบน Qwen3.8 Flash ที่เปิดเป็นค่าเริ่มต้นและสามารถปิดได้

• เวลาถึงโทเคนแรก — Union Alpha 10.00 วินาที p50 เทียบกับ Qwen3.8 Flash 6.62 วินาที p50 ทั้งคู่วัดจากเอนด์พอยต์ของเราในช่วงเวลาเจ็ดวันเดียวกัน ความเร็วในการถอดรหัสแบบดิบนั้นใกล้เคียงกันมากกว่าที่ชื่อเสียงบ่งชี้: 170 โทเคนต่อวินาที เทียบกับ 103

• ที่มา — ผู้ดำเนินการไม่ระบุชื่อ ไม่มีน้ำหนักโมเดล ต่างจาก Alibaba/Qwen ที่มีน้ำหนักของ Qwen3.8-Flash-Next เปิดซอร์สบน Hugging Face และ ModelScope

Generated two-column comparison scoreboard for Union Alpha and Qwen3.8 Flash. Union Alpha column: context window 262,144 tokens, max output 131,072 tokens, text and image input, $0 preview price, no published weights, 10.00 s p50 time to first token. Qwen3.8 Flash column: context window 1,000,000 tokens served, max output 131,000 tokens, text, image and video input, $0.150 input and $0.470 output per 1M tokens, Qwen3.8-Flash-Next weights open-sourced, 6.62 s p50 time to first token. Footer reads Official A per SMF Clearinghouse with latency and errors per OrcaRouter over the last 7 days.

Qwen3.8 Flash: เดิมพันด้านประสิทธิภาพด้วยพารามิเตอร์ที่เปิดใช้งาน 6B

Qwen3.8 Flash เปิดตัวเมื่อวันที่ 26 สิงหาคม 2026 ในฐานะเวอร์ชัน managed สำหรับ production ของเช็กพอยต์ Qwen3.8-Flash-Next แบบเปิดน้ำหนัก ซึ่ง Alibaba เปิดตัวพร้อมกันในเวลาเดียวกัน เป็นโมเดลแบบ mixture-of-experts ขนาด 125B พารามิเตอร์ ที่เปิดใช้งานพารามิเตอร์ประมาณ 6B ตัวต่อโทเคน บวกกับพารามิเตอร์ embedding แบบ N-gram อีก 51B สร้างขึ้นบนกลไกแอตเทนชันแบบไฮบริดที่ผสาน Gated DeltaNet เข้ากับตัวจัดทำดัชนีแบบ sparse attention

การวางกรอบของผู้ขายเกี่ยวกับเศรษฐศาสตร์การเทรน: Alibaba รายงานว่าค่าใช้จ่ายในการรันอยู่ที่ประมาณหนึ่งในเก้าของ Qwen3.7-Plus โดยอ้างว่า prefill เร็วขึ้นสูงสุด 7.6 เท่า และ decode เร็วขึ้นสูงสุด 4.9 เท่า สำหรับงานที่มีขนาด 1M โทเคนที่มีแคชฮิตสูง ตัวเลขเหล่านี้เป็นตัวเลขของผู้ขายและยังไม่ได้รับการทำซ้ำโดยอิสระ

ตาราง benchmark ของมันยังเป็นข้อมูลที่ผู้ขายรายงานเองและไม่มีการทำซ้ำ: SWE-bench Pro 62.5, DeepSWE v1.1 58.7, SWE-bench Multilingual 81.0, NL2Repo 48.1, CoWorkBench 73.9, JobBench 55.7, RealWorldQA 88.5, LVBench 76.6, AndroidWorld 84.5 ตัวเลขที่ควรยกกลับไปพูดกับฝ่ายการตลาดคือ Humanity's Last Exam ที่ 35.9 ซึ่งต่ำกว่า 40.0 ของ Claude Opus 4.6 ในการเปรียบเทียบเดียวกัน

บนหน้าโมเดลของเราเอง ส่วน benchmark สาธารณะยังคงขึ้นว่า "pending" — ยังไม่มีบุคคลที่สามให้คะแนนเลย สิ่งที่เรามีคือทราฟฟิกของเราเอง: ค่ามัธยฐานเวลาถึงโทเคนแรก 6.62 วินาที อัตราเอาต์พุต 103 โทเคนต่อวินาที และอัตราความผิดพลาด 4.5% อัตราความผิดพลาดนั้นสูงพอที่จะต้องจับตามอง และมันเป็นตัวเลขแบบที่ปรากฏให้เห็นเฉพาะเมื่อคุณวัด endpoint ที่ใช้งานจริง ไม่ใช่จากโพสต์เปิดตัว

The OrcaRouter model page for Qwen3.8 Flash, showing a 1M-token context window, 131K max output, text plus image and video input, $0.15 per million input tokens and $0.47 per million output tokens, a p50 time to first token of 6.62 s, and 2,322.0M tokens of traffic over seven days.

Union Alpha: โมเดลที่ไม่มีเจ้าของ

Union Alpha ปรากฏบนแค็ตตาล็อกของบุคคลที่สามเมื่อวันที่ 16 กันยายน 2026 และให้บริการบนระดับฟรีของ OrcaRouter ซึ่งไม่มีแล็บที่ระบุชื่อ ไม่มีเวท ไม่มีสัญญาอนุญาต ไม่มีจำนวนพารามิเตอร์ และไม่มีบันทึกสถาปัตยกรรม ฟิลด์ผู้ให้บริการของมันระบุว่า "Stealth"

อย่างน้อยเอนด์พอยต์ของมันก็อ่านออก: คอนเท็กซ์ 262,144 โทเคน เอาต์พุตสูงสุด 131,072 โทเคน อินพุตข้อความและรูปภาพพร้อมเอาต์พุตข้อความเท่านั้น การเรียกใช้เครื่องมือ เอาต์พุต JSON, temperature, top_p และ max_tokens และไม่มีตัวควบคุมการให้เหตุผลใด ๆ เลย การเลือกเครื่องมือในทางปฏิบัติรองรับเฉพาะ "auto" เท่านั้น ช่วงฟรีของมันถูกอธิบายว่าประมาณหนึ่งสัปดาห์ ถูกจำกัดอัตราการใช้งาน โดยยังไม่มีการประกาศราคาหลังช่วงพรีวิว

ข้อกล่าวอ้างที่ระบุไว้ — "ประสิทธิภาพระดับแนวหน้าข้ามงานทั่วไปหลากหลายประเภท" — เป็นข้อมูลที่ผู้ให้บริการรายงานเองและยังไม่ผ่านการตรวจสอบ ผลลัพธ์ 136/157 ของ Official A เป็นการวัดอิสระเพียงรายการเดียวที่มีอยู่

The OrcaRouter model page for Union Alpha (Free), listed under the stealth vendor, showing a FREE badge, a 262K-token context window, 131K max output, text and image input with text output, and pricing shown as Free and rate-limited with model usage at $0.

ความเร็วคือจุดที่พวกเขาไม่ดูเหมือนกันอีกต่อไป

ตัวเลข throughput ที่เป็นจุดขายไม่ได้แยกความแตกต่างระหว่างทั้งสองอย่างที่คุณคาดไว้ และเหตุผลก็คุ้มค่าที่จะทำความเข้าใจ

จากเทเลเมทรีการกำหนดเส้นทางของเราเองในช่วงเจ็ดวันที่ผ่านมา Qwen3.8 Flash สตรีมที่ 103 โทเค็นเอาต์พุตต่อวินาที โดยมีค่า p50 ของเวลาถึงโทเค็นแรก 6.62 วินาที และอัตราข้อผิดพลาด 4.5% Union Alpha ซึ่งวัดด้วยวิธีเดียวกัน สตรีมที่ 170 โทเค็นต่อวินาที เมื่อดูที่ความเร็วการถอดรหัสดิบ โมเดลนิรนามเป็นตัวที่เร็วกว่าในสองตัวนี้

สิ่งที่มันไม่ทำก็คือเริ่มทำงาน p50 และ p95 ของเวลาถึงโทเคนแรกของ Union Alpha ต่างก็ถูกตรึงไว้ที่ 10.00 วินาที ซึ่งหมายความว่าอย่างน้อยครึ่งหนึ่งของคำขอทั้งหมดต้องรอสิบวินาทีหรือมากกว่านั้นก่อนที่โทเคนแรกจะปรากฏ และอัตราข้อผิดพลาดในช่วงเวลาเดียวกันอยู่ที่ 7.7% — ประมาณ 1.7 เท่าของ Qwen การรัน Official A จำนวน 157 การทดสอบที่ส่วนก่อนหน้านี้อ้างอิงถึงใช้เวลา 4.6 ชั่วโมงตามเวลาจริง โดยมีค่ามัธยฐานของความหน่วง 91.9 วินาที และค่าเฉลี่ย 104.8 วินาทีต่อการทดสอบ และสี่การทดสอบชนขีดจำกัดการหมดเวลา 300 วินาทีของฮาร์เนส ผู้ทดสอบอิสระที่รันมันในวันเปิดตัวรายงานอัตราการประมวลผลที่ต่ำกว่าที่ endpoint ของเราแสดงไว้มาก ซึ่งเป็นสิ่งที่คุณคาดว่าจะพบได้จากบริการที่ยังคงรองรับโหลดมหาศาลในวันแรก

ดังนั้น ความแตกต่างในทางปฏิบัติจึงไม่ใช่ความเร็วในการถอดรหัส แต่เป็นเวลาถึงโทเคนแรกและความน่าเชื่อถือ Union Alpha ใช้ไม่ได้กับงานที่ต้องโต้ตอบใด ๆ — ไม่มีการเติมข้อความอัตโนมัติ ไม่มีความช่วยเหลือแบบอินไลน์ ไม่มีลูปเอเจนต์ที่รัดกุม — เพราะความเงียบสิบนับแยกไม่ออกจากอาการค้าง มันเหมาะกับงานแบบอะซิงโครนัส: งานแบตช์ข้ามคืน การประมวลผลเอกสารยาว ๆ การรันประเมินผลแบบออฟไลน์ ซึ่งไม่มีอะไรกำลังรอโทเคนแรก และอัตราความล้มเหลว 7.7% จะถูกกลืนหายไปด้วยการลองใหม่

Qwen3.8 Flash ที่ 103 โทเคนต่อวินาที โดยมีค่ามัธยฐานเวลาไปยังโทเคนแรก 6.62 วินาที ก็ไม่ถือว่าเร็วเช่นกัน การวางกรอบอย่างตรงไปตรงมาคือทั้งคู่ช้า และมีเพียงตัวเดียวเท่านั้นที่ล้มเหลวประมาณหนึ่งคำขอในสิบสาม

ข้อโต้แย้งเรื่องประสิทธิภาพ และใครกันที่ได้เป็นคนกล่าวข้อโต้แย้งนั้น

Alibaba ตั้งข้อโต้แย้งด้านต้นทุนการฝึก: ต้นทุนการฝึกเป็นหนึ่งในเก้าของ Qwen3.7-Plus โดยมีพารามิเตอร์ที่ใช้งานอยู่หกพันล้านตัวต่อโทเคน จึงให้บริการได้ในต้นทุนต่ำ นั่นเป็นคำกล่าวอ้างเกี่ยวกับโมเดลที่น้ำหนักของมันมีอยู่จริงและมีเอกสารระบุสายที่มา

เรื่องราวด้านประสิทธิภาพของ Union Alpha เป็นสิ่งที่บอกเป็นนัยมากกว่าจะกล่าวออกมาตรง ๆ — โมเดลนิรนามขนาด 256K ที่เรียกใช้ได้ฟรี การฟรีไม่เหมือนกับการถูก มีใครบางคนกำลังจ่ายเงินสำหรับ GPU เหล่านั้น พรีวิวมีกำหนดสิ้นสุดที่ระบุไว้ และการที่ผู้ให้บริการยอมรับเองว่าพวกเขากำลังปรับแต่งเพื่อความเร็ว ชี้ให้เห็นว่าเศรษฐศาสตร์ของการให้บริการยังไม่ลงตัว โมเดลที่ฟรีหนึ่งสัปดาห์และไม่สามารถกำหนดราคาได้หลังจากนั้น มีข้อโต้แย้งด้านประสิทธิภาพที่หมดอายุไปพร้อมกับช่วงเวลานั้น

ลองสิ่งที่ไม่รู้โดยไม่เดิมพันกับมัน

เหตุผลที่การจับคู่เฉพาะคู่นี้ควรค่าแก่การเก็บไว้ในหัวก็คือ มันเป็นการทดสอบที่ถูกที่สุดเท่าที่จะเป็นไปได้สำหรับโมเดลที่ยังไม่ถูกพิสูจน์ Qwen3.8 Flash เป็นตัวแปรที่รู้จักดี: ผู้ขายที่มีชื่อระบุได้ น้ำหนักโมเดลแบบเปิด แบรนช์มาร์กที่เผยแพร่แล้ว (ถึงแม้จะมีแนวโน้มเข้าข้างผู้ขาย) ราคาต่อโทเคนจริงที่ $0.150/$0.470 ส่วน Union Alpha เป็นตัวแปรที่ไม่รู้จัก ซึ่งตั้งราคาไว้ที่ศูนย์ และข้ออ้างในการแข่งขันทั้งหมดของมันตั้งอยู่บนผลการทดสอบเพียงชุดเดียวที่มี 157 รายการ

แทนที่จะเลือก ให้วางสิ่งที่ยังไม่รู้ไว้หลังกฎการสลับสำรอง OrcaRouter ส่งผ่านราคาตามรายการของผู้ให้บริการโดยคิดส่วนเพิ่ม 0% และรองรับการสลับสำรองอัตโนมัติข้ามผู้ให้บริการ ดังนั้น endpoint Union Alpha ที่ติดลิมิตอัตราหรือหายไปจะตกต่อไปยังโมเดลที่ยังตอบอยู่ แทนที่จะปรากฏเป็นงานที่ล้มเหลวตอนตีสาม โมเดลทั้งสองอยู่บนคีย์เดียวกัน ดังนั้นการทดลองนี้จึงมีค่าใช้จ่ายเป็นแค่การเปลี่ยนคอนฟิก ไม่ใช่การผสานรวมครั้งที่สอง — และไม่มีโมเดลใดต้องกลายเป็นการตัดสินใจที่คุณต้องออกมาปกป้อง เพราะคุณสลับเส้นทางได้เมื่อหน้าต่างฟรีปิดลง

คำตัดสิน

Qwen3.8 Flash เป็นโมเดลที่ควรใช้ต่อยอด พารามิเตอร์ที่ใช้งานจริง 6 พันล้านตัว เวตของโมเดลพี่น้องที่เปิดซอร์ส หน้าต่างบริบท 1 ล้านโทเคน อินพุตวิดีโอ ความเร็วใช้งานจริง 103 โทเคนต่อวินาที และราคาที่ประกาศไว้ซึ่งคุณคาดการณ์ได้ ผลทดสอบมาตรฐานของมันถูกรายงานโดยผู้ขาย และอัตราความผิดพลาดของมันน่าจับตา แต่มันเป็นของใครสักราย และรายนั้นกำลังส่งมอบของจริง

Union Alpha คือโมเดลที่ต้องใช้เป็นมาตรวัด ช่องว่าง 1 จุดบน Official A นั้นน่าสนใจจริง ๆ — มันบอกว่าสิ่งนี้ไม่ว่าคืออะไร มันไม่ใช่ของเล่น — และที่ราคา $0 พร้อมเพดานเอาต์พุต 131K และอินพุตภาพ มันคุ้มค่าที่จะให้ความสนใจสักหนึ่งสัปดาห์ แต่ช่องว่าง 1 จุดบนชุดทดสอบเดียว ซึ่งเกิดจากผู้ดำเนินการนิรนามที่มีอัตราความผิดพลาด 7.7% เป็นเหตุผลให้ตรวจสอบ ไม่ใช่เหตุผลให้เปลี่ยนไปใช้

สิ่งที่ต้องจับตาคือสิ่งเดียวกับที่ตัดสินเรื่องนี้มาตลอด นั่นก็คือชื่อ Ox Alpha ผลงานก่อนหน้าในซีรีส์นี้ถูกเปิดเผยหกวันหลังจากที่ปรากฏตัวในชื่อ GLM-5.3-Flash ของ Zhipu หาก Union Alpha ได้ชื่อมา การเปรียบเทียบก็จะไม่ใช่เรื่องของคะแนนอีกต่อไป แต่จะกลายเป็นเรื่องของราคา

สิ่งที่ทราบแน่ชัดนั้นมีราคาและเอกสารระบุไว้แล้ว: หน้าโมเดล Qwen3.8 Flashแสดงอัตราค่าบริการ $0.150/$0.470 คอนเท็กซ์ที่ให้บริการ 1M โทเคน และเพดานเอาต์พุต 131K โดยยังคงรอผลการทดสอบมาตรฐานสาธารณะ

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube