Qwen 3.8 เทียบกับ Claude Fable 5: บิลด์ 0902 เป็นผู้นำด้านการเขียนโค้ด
Guides & Insights

Qwen 3.8 เทียบกับ Claude Fable 5: บิลด์ 0902 เป็นผู้นำด้านการเขียนโค้ด

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

เมื่อ Alibaba เปิดตัว Qwen3.8-Max ในเซี่ยงไฮ้เมื่อวันที่ 19 กรกฎาคม 2026 มันกล่าวอ้างที่ดังที่สุดข้อหนึ่งว่า: โมเดลที่มีพารามิเตอร์ 2.4 ล้านล้านตัวนี้ใกล้เคียงกับระดับ frontier และ เป็นรองเพียง Claude Fable 5. ในเวลานั้นมันเป็นไปไม่ได้ที่จะประเมิน ไม่มีตารางราคา ไม่มีตาราง benchmark และไม่มีใบอนุญาต — เป็นเพียงข้อความกำหนดตำแหน่ง.

เมื่อวันที่ 3 สิงหาคม 2026 Qwen3.8-Max เปิดให้ใช้งานทั่วไปแบบเต็มรูปแบบ — มีอัตราค่าบริการจริงที่ $2 / $6 ต่อล้านโทเคน มีตาราง Benchmark พร้อมตัวเลขกำกับ และมี endpoint ที่รองรับทั้ง OpenAI และ DashScope ในวันที่ 2 กันยายน Alibaba ปล่อยขั้นตอนถัดไปโดยไม่เปลี่ยนเลขเวอร์ชัน: Qwen3.8-Max-0902 ซึ่งเป็นการปรับแต่งหลังการฝึกที่เน้นงานเขียนโค้ดและงานแบบเอเจนต์ เปิดตัวที่อันดับ 1 บนลีดเดอร์บอร์ด Code Arena: WebDev ด้วยคะแนน 1,691 Elo ส่วน Claude Fable 5 โมเดลที่ Alibaba ใช้เวลาทั้งเดือนกรกฎาคมปูตำแหน่งให้ตัวเองอยู่ด้านหลังโดยตรง อยู่ที่ 1,628 บนบอร์ดเดียวกัน คำถามจากเดือนกรกฎาคมยิ่งคมชัดขึ้น: Qwen 3.8 ยังเป็น “รองเพียง Fable 5” หรือแกนด้านการเขียนโค้ดพลิกแล้ว?

หมายเหตุสำหรับนักพัฒนา — วิธีที่เร็วที่สุดในการตัดสินข้อกล่าวหาแบบนี้คือการรันทั้งสองโมเดลบนพรอมปต์ของคุณเอง OrcaRouter รองรับโมเดลมากกว่า 200 รายการผ่านเอนด์พอยต์ที่เข้ากันได้กับ OpenAI เพียงจุดเดียว ดังนั้นคุณจึงสามารถเปรียบเทียบ Qwen 3.8 Max กับ Fable 5 ในงานเดียวกันได้โดยไม่ต้องเชื่อมต่อ SDK สองตัว

คำตัดสิน TL;DR. Qwen3.8-Max-0902 คือเวอร์ชันที่แข็งแกร่งที่สุดของเรือธง 2.4T ของ Alibaba เท่าที่เคยมีมา และข้ออ้างใหม่ในครั้งนี้ไม่ใช่ตัวเลขที่ทางผู้ผลิตรายงานเองอีกต่อไป: มันเปิดตัวที่ #1 บนกระดานอิสระ Code Arena: WebDev ที่ 1,691 Elo เหนือ Claude Fable 5 (1,628, #8) บนกระดานนั้น ราคายังไม่เปลี่ยนแปลงและยังคงชี้ขาด — ในอัตราคงที่ $2 / $6 ต่อ 1M tokens Qwen ถูกกว่า $10 / $50 ของ Fable 5 ราว 5 เท่าใน input และ 8 เท่าใน output ส่วนช่องว่างด้านความสามารถทั่วไปยังไม่ถูกปิด: Artificial Analysis ให้คะแนน Qwen3.8-Max ที่ 56 บน Intelligence Index เทียบกับ Claude Fable 5 ที่ได้ 62 และบนกระดาน Arena ทั่วไปในสัปดาห์ที่เผยแพร่ล่าสุด (24–30 ส.ค.) Fable 5 ครอง #1 (1,508 Elo) ขณะที่ Qwen3.8-Max อยู่ที่ #20 (1,479) ดังนั้นจึงมีคำตัดสินสองข้อ: ในด้านการเขียนโค้ด เวอร์ชันอัปเดต 0902 ของ Qwen ตอนนี้มีทั้งผู้ตัดสินอิสระและชัยชนะ; ในด้านการใช้เหตุผลที่ครอบคลุมและผ่านการตรวจสอบแล้ว Claude Fable 5 — และ Claude Fable 5.1 ที่ใหม่กว่าของ Anthropic ซึ่งนำดัชนี AA ด้วยคะแนน 66 — ยังคงยึดพื้นที่ไว้ได้

ประเด็นสำคัญ

Qwen3.8-Max เข้าสู่สถานะ GA เมื่อวันที่ 3 สิงหาคม 2026 และรุ่นรีเฟรช 0902 ตามมาในวันที่ 2 กันยายน — ไม่มีการเปลี่ยนเลขเวอร์ชัน เรตเท่าเดิมที่ $2 / $6 และคอนเทกซ์เท่าเดิมที่ 1M โทเค็น

ส่วนต่างของราคานั้นมหาศาล: Qwen ที่ $2 / $6 ต่อ 1M เทียบกับ Fable 5 ที่ $10 / $50 ซึ่งคือ ~5× สำหรับอินพุต และ ~8× สำหรับเอาต์พุต และอัตราของ Qwen คงที่ตลอดทั้งบริบท 1M โทเคน โดยไม่มีค่าธรรมเนียมเพิ่มสำหรับพรอมป์ยาว.

ทั้งสองฝ่ายตอนนี้ต่างมีคะแนนอิสระเป็นของตัวเอง — และคะแนนเหล่านี้ชี้ไปคนละทิศทาง Qwen3.8-Max ได้ 56 คะแนนบนดัชนี Artificial Analysis Intelligence Index (Claude Fable 5: 62) และบิลด์ 0902 ของมันครองอันดับหนึ่งใน Code Arena: WebDev ด้วยค่า Elo 1,691 เทียบกับ 1,628 ของ Fable 5

ตาราง benchmark ของ Qwen เองยังคงแข็งแกร่งและยังคงจัดทำโดยผู้ผลิตเอง GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6, OSWorld-Verified 86.1 — แต่การอัปเดตวันที่ 2 กันยายนนี้เป็นผลลัพธ์ของ Qwen ครั้งแรกที่เวทีอิสระจัดอันดับให้เป็น #1.

ช่องว่างด้านสถาปัตยกรรมในสเปกชีตถูกปิดแล้ว Qwen3.8-2.4T-A95B มีพารามิเตอร์แอ็กทีฟ ~95B จากทั้งหมด 2.4T ในผู้เชี่ยวชาญ 512 ตัว — เปิดเผยพร้อมการปล่อยน้ำหนักแบบเปิดเมื่อวันที่ 12 สิงหาคม ส่วนสถาปัตยกรรมของ Fable 5 ยังไม่เปิดเผย

โอเพนเวตออกมาแล้ว ไม่ใช่แค่คำสัญญา Qwen3.8-2.4T-A95B (BF16 และ FP8) ถูกปล่อยบน Hugging Face และ ModelScope เมื่อวันที่ 12 สิงหาคม ภายใต้ไลเซนส์ Qwen3.8-Max แบบกำหนดเอง โดยมี Qwen3.8-27B ตามมาในวันที่ 14 สิงหาคม ภายใต้ Apache 2.0 ส่วน Fable 5 ยังคงปิดและจำกัดเฉพาะการเข้าถึงผ่าน API อย่างถาวร

หมายเหตุด้านความแม่นยำ: ตัวเลขจากตาราง benchmark ของ Alibaba เองยังคงเป็นข้อมูลที่ผู้ผลิตเป็นผู้รายงานและไม่มีการตรวจสอบซ้ำโดยอิสระ ตัวเลขจากแหล่งอิสระที่แสดงในที่นี่มีการประทับเวลาและมาจากบุคคลที่สาม ได้แก่ Artificial Analysis Intelligence Index (Qwen3.8-Max ได้ 56, Claude Fable 5 ได้ 62, Claude Fable 5.1 ได้ 66), การจัดอันดับ Code Arena: WebDev Elo และกระดานจัดอันดับรายสัปดาห์ทั่วไปของ Arena — คะแนน Arena มีการเปลี่ยนแปลงตลอดเมื่อคะแนนโหวตสะสมเพิ่มขึ้น และการครองอันดับ #1 ของ build 0902 เป็นไปตามประกาศของ Alibaba เกี่ยวกับการจัดอันดับ ณ จุดเวลานั้น ส่วน SWE-bench Verified 95.0% ของ Fable 5 เป็นข้อมูลที่รายงานโดย Anthropic ขณะที่ราคาของ Qwen อ้างอิงจากเรตการ์ด GA (General Availability) ของ Alibaba Model Studio

สเปกและราคา เปรียบเทียบเคียงข้างกัน

นี่คือข้อมูลที่แท้จริง ซึ่งแต่ละตัวเลขมีการอ้างอิงแหล่งที่มา

• ผู้ผลิต / สถานะ — Qwen3.8-Max: Alibaba; GA 3 สิงหาคม 2026; รีเฟรช 0902 วันที่ 2 กันยายน 2026. Claude Fable 5: Anthropic; เรือธง GA

• สถาปัตยกรรม — Qwen3.8-Max: รวม 2.4T / แอ็กทีฟ ~95B, sparse MoE, 512 ผู้เชี่ยวชาญ (เปิดเผยเมื่อ 12 ส.ค.); Fable 5: ไม่เปิดเผย

• หน้าต่างบริบท — Qwen3.8-Max: 1M โทเคน (983,616 พร้อมการคิด; เอาต์พุตสูงสุด 131,072); Fable 5: เรือธงบริบทระยะยาว

• AA Intelligence Index — Qwen3.8-Max: 56; Claude Fable 5: 62; Claude Fable 5.1 (1 ก.ย.): 66, นำ

• SWE-bench Verified — Qwen3.8-Max: ไม่มีการรายงาน (Alibaba รายงาน FrontierSWE 73.5 แทน); Fable 5: 95.0% (Anthropic / buildfastwithai)

• จุดแข็งที่รายงานโดยอิสระและโดยผู้จำหน่าย — Qwen3.8-Max: Code Arena WebDev #1 ที่ 1,691 (0902, อิสระ); ตารางผู้จำหน่าย: GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6. Claude Fable 5: AA 62; SWE-bench Verified 95.0%

• ราคา (อินพุต / เอาต์พุต) — Qwen3.8-Max: $2.00 / $6.00 ต่อ 1M, อัตราคงที่ตลอดบริบท 1M; อินพุตแคช $0.25; Fable 5: $10 / $50 ต่อ 1M

• โอเพนเวต — Qwen3.8-Max: เปิดตัว 12 ส.ค. 2026 (สัญญาอนุญาตแบบกำหนดเอง ไม่ใช่ Apache); Qwen3.8-27B ใช้ Apache 2.0 วันที่ 14 ส.ค. Fable 5: ไม่มี — ปิด / ผ่าน API เท่านั้น

• มัลติโมดัลลิตี้ — Qwen3.8-Max: รับข้อความ รูปภาพ วิดีโอเข้า → ส่งออกเป็นข้อความ; Fable 5: เรือธงมัลติโมดัล

มีสองสิ่งที่วางกรอบการเปรียบเทียบทั้งหมด อย่างแรกเปลี่ยนไปเมื่อวันที่ 3 สิงหาคมและยังคงเป็นเช่นนั้น อย่างที่สองเปลี่ยนอีกครั้งในวันที่ 2 กันยายน

ประการแรก คอลัมน์ราคากลายเป็นสิ่งที่โดดเด่นที่สุดบนหน้าเพจในตอนนี้ ในเดือนกรกฎาคม ความได้เปรียบด้านต้นทุนของ Qwen คือคูปองส่วนลด — เครดิตส่วนลด 90% ชั่วคราว และไม่มีอัตราต่อโทเคนให้วางแผนกับ ตอนนี้มันคือตารางอัตราค่าบริการ และช่องว่างดังกล่าวเป็นเชิงโครงสร้าง ไม่ใช่เชิงส่งเสริมการขาย ที่ราคา output $6 เทียบกับ $50 ของ Fable คุณสามารถเรียกใช้ Qwen ได้ประมาณแปดครั้งในราคาของการเรียก Fable หนึ่งครั้ง สำหรับเวิร์กโหลดใดๆ ที่คุณจ่ายตามปริมาณ ไม่ใช่เพื่อคำตอบที่ยากที่สุดเพียงคำตอบเดียว อัตราส่วนนั้นเปลี่ยนแปลงสถาปัตยกรรมของสิ่งที่คุณสร้าง

ประการที่สอง คอลัมน์ผล benchmark ไม่ได้เอนเอียงข้างเดียวอีกต่อไป เกือบทั้งเดือนสิงหาคม สิ่งที่ประเมินอย่างตรงไปตรงมานั้นมีอยู่อย่างจำกัด กล่าวคือ Alibaba รายงานคะแนน FrontierSWE 73.5 พร้อมตารางตัวเลขที่ทดสอบเอง ส่วน Anthropic รายงานผล SWE-bench Verified 95.0% ที่ตรวจสอบโดยบุคคลที่สาม และไม่มีผู้ประเมินอิสระรายใดให้คะแนน Qwen เลย บิลด์ 0902 ทำให้เรื่องนั้นจบลง Code Arena: WebDev เป็นสนามแข่งที่ให้มนุษย์โหวตตัดสินโดยเทียบกันเป็นคู่โดยไม่รู้ว่าใครเป็นผู้สร้าง โปรเจกต์ที่เคยรู้จักในชื่อ WebDev Arena และไม่มีใครใน Alibaba เป็นผู้ดำเนินการ และ Qwen3.8-Max-0902 เข้าสู่สนามนี้ด้วยอันดับ #1 และ Elo 1,691 สูงกว่า Claude Opus 5 (1,688), Kimi K3 (1,674) และ Claude Fable 5 (1,628, #8) ข้อแม้สองข้อทำให้การสรุปนี้ยังคงตรงไปตรงมา หนึ่งคือ มันคือกระดานเพียงกระดานเดียว ซึ่งวัดการพัฒนา front-end แบบ agentic ไม่ใช่สมรรถนะทั่วไป สองคือ การ “เปิดตัวที่ #1” คือการประกาศการจัดอันดับ ณ จุดเวลาใดจุดเวลาหนึ่งของ Alibaba แต่ข้ออ้างที่ว่า Qwen ไม่มีผู้ตัดสินใด ๆ เลยไม่เป็นความจริงอีกต่อไป และนั่นเปลี่ยนแปลงการเปรียบเทียบมากกว่าตัวเลขเพียงตัวใดตัวหนึ่งบนกระดานนั้น

แท้จริงแล้ว ช่องว่างของราคาทำให้คุณได้อะไร

การกล่าวถึงกรณีเชิงนามธรรมหลายกรณีมีประโยชน์น้อยกว่าตัวอย่างที่ลงมือทำจริง ดังนั้นขอยกตัวอย่างมาหนึ่งตัวอย่าง สมมติว่าเอเจนต์ตรวจสอบโค้ดส่งบริบทจาก repository จำนวน 150,000 โทเคน และสร้างบทวิจารณ์จำนวน 6,000 โทเคนต่อการเรียกใช้หนึ่งครั้ง

Qwen3.8-Max: 0.15M × $2 = $0.30, บวก 0.006M × $6 = $0.036. ≈ $0.34 ต่อครั้ง.

Claude Fable 5: 0.15M × $10 = $1.50 บวก 0.006M × $50 = $0.30 ≈ $1.80 ต่อครั้ง

• ที่ 2,000 ครั้ง/วัน: Qwen ≈ $672/วัน; Fable ≈ $3,600/วัน. ภายในหนึ่งเดือน นั่นคือประมาณ $20,000 เทียบกับ $108,000.

• ด้วยการแคชพรอมต์บนบริบทของ repo ที่เสถียร อินพุตที่ถูกแคชของ Qwen ที่ $0.25/1M ช่วยลดต้นทุนด้านอินพุตจาก $0.30 เหลือต่ำกว่า $0.04 ทำให้การเรียกแต่ละครั้งอยู่ที่ ≈ $0.08 — ถูกกว่า Fable ต่อการเรียกประมาณ 22 เท่า

นั่นไม่ใช่การประหยัดเล็กน้อย แต่เป็นความแตกต่างระหว่างการให้ผู้ตรวจสอบตรวจทุกคำขอ pull request กับการให้ตรวจเฉพาะรายการที่มีความเสี่ยง และอัตราคงที่ของบริบทของ Qwen ทำให้ผลกระทบยิ่งแข็งแกร่งขึ้นเมื่อพรอมป์มีขนาดใหญ่ขึ้น เนื่องจาก Alibaba ไม่คิดค่าใช้จ่ายเพิ่มสำหรับพรอมป์ยาว การส่งบริบท 900,000 โทเคนผ่านไปจึงมีต้นทุนต่อโทเคนเท่ากับบริบท 5,000 โทเคน

สิ่งควรชั่งน้ำหนักอย่างตรงไปตรงมาก็คือ ราคาต่อโทเคนไม่ใช่ราคาต่องานที่แก้สำเร็จ. หาก Fable 5 แก้ปัญหาได้ในรอบเดียว ในขณะที่โมเดลที่ถูกกว่าต้องลองหลายครั้งและยังต้องให้มนุษย์ช่วยแก้ไข โมเดลที่ถูกกว่านั้นอาจมีต้นทุนรวมสูงกว่า และในงานใช้เหตุผลที่ยากที่สุด การจัดอันดับ #1 ที่ผ่านการตรวจสอบของ Fable คือหลักฐานที่ดีที่สุดที่มีอยู่ว่ามันแก้ได้มากกว่าในรอบเดียวจริง ข้อโต้แย้งเรื่องต้นทุนของ Qwen แข็งแกร่งที่สุดในงานปริมาณมากที่ยอมรับความคลาดเคลื่อนได้ และอ่อนแอที่สุดในงานปริมาณน้อยแต่เดิมพันสูง

การตั้งชื่อ 0902: ความสามารถเพิ่มขึ้นแบบก้าวกระโดด แต่เลขเวอร์ชันไม่เพิ่มตาม

สิ่งที่น่าสนใจของวันที่ 2 กันยายนคือสิ่งที่ Alibaba ไม่ได้ทำ นั่นคือการปล่อยโมเดล Qwen 3.9 การปรับปรุงนี้ถูกปล่อยออกมาเป็น checkpoint ที่ระบุวันเดือนปีภายใต้ชื่อโมเดลเดิม — Qwen3.8-Max-0902 — และ API ก็ให้บริการด้วยชื่อเดิมและราคาเดิม นี่คือทิศทางที่อุตสาหกรรมกำลังมุ่งไป เมื่อการก้าวกระโดดของความสามารถไม่ได้รับประกันเลขเวอร์ชันใหม่อีกต่อไป คำถามที่ว่า “ควรใช้โมเดลไหน” จึงกลายเป็นเรื่องของ build และวันที่ ไม่ใช่เพียงชื่อตระกูลอีกต่อไป

นอกจากนี้ยังหมายความว่าคะแนน benchmark ที่ติดอยู่กับ “Qwen3.8-Max” นั้นมีอายุการใช้งาน: คะแนนที่วัดจากบิลด์เดือนกรกฎาคมหรือสิงหาคมอาจไม่บ่งบอกถึงโมเดลที่ API ส่งกลับในวันนี้ ตรวจสอบตัวระบุบิลด์บน endpoint ที่คุณเรียกใช้จริง — หมายเลข 0902 คือความแตกต่างระหว่างโมเดลที่ตามหลัง Claude Fable 5 กับโมเดลที่นำอยู่ใน Code Arena: WebDev

หลักฐาน และเหตุผลว่าทำไมมันจึงยังคงตัดสินผลการแข่งขันนี้

หลักฐานเชิงปฏิบัติที่ถูกอ้างอิงมากที่สุดสำหรับ Qwen3.8-Max มาจากรีวิวช่วงพรีวิว (thomas-wiegold.com) ซึ่งนำโมเดลไปทดสอบผ่านการสร้างจริงสี่รายการ ผลลัพธ์น่าประทับใจจริงๆ: Qwen ทำการจำลองโป๊กเกอร์ Go ได้ในครั้งเดียว — ซึ่งเป็นโมเดลที่สามเท่านั้นที่เคยผ่านโจทย์นั้นได้ในรอบเดียว โดยมี Fable 5 และ Grok 4.5 — และในโจทย์เว็บไซต์เครื่องคั่วกาแฟ มันสร้างผลลัพธ์ที่ดีที่สุดที่ผู้รีวิวเคยเห็นจากการทดสอบนั้น โดยเพิ่มตะกร้าสินค้า ส่วนขายส่ง และการผสานกับ Instagram โดยไม่มีการร้องขอ ด้วยความละเอียดรอบคอบอย่างยิ่ง

ปัญหาคือความเร็ว: 30+ นาทีบนเว็บไซต์ และ 1 ชั่วโมง 20 นาทีบนการจำลองโป๊กเกอร์ ทำให้เป็นโมเดลที่ช้าที่สุดเท่าที่ผู้รีวิวคนนั้นเคยใช้ ผลการค้นพบนี้จำเป็นต้องมีข้อแม้เพิ่มเติม ซึ่งไม่จำเป็นต้องมีในเดือนกรกฎาคมการวัดนี้เกิดขึ้นบนโครงสร้างพื้นฐานแบบพรีวิวโดยผู้รีวิวหนึ่งคน ในการรันแบบ agentic ที่ยาวผิดปกติ การให้บริการแบบ GA เป็นระบบที่แตกต่างกัน อย่างไรก็ตาม telemetry 7 วันของ OrcaRouter เองในตอนนี้แสดงค่า p50 time-to-first-token ที่ 1.64 วินาทีสำหรับ Qwen3.8-Max — ซึ่งเป็นการวัดจากฝ่ายผู้พัฒนาเอง แม้ว่า TTFT และปริมาณงานแบบ end-to-end ในงาน build ที่กินเวลาหนึ่งชั่วโมงจะเป็นปริมาณที่แตกต่างกัน จุดยืนที่ตรงไปตรงมาคือ ผลการค้นพบเรื่องความช้าในเวอร์ชันพรีวิวควรถูกทดสอบซ้ำ แทนที่จะถูกอ้างซ้ำว่าเป็นข้อเท็จจริงในปัจจุบัน

สิ่งที่ยังคงอยู่หลังการอัปเดต 0902 ก็คือ หลักฐานที่แข็งแกร่งที่สุดของแต่ละฝ่ายยังคงมาจากแหล่งที่ต่างกัน อันดับ #1 ของ Qwen3.8-Max-0902 บน Code Arena: WebDev เป็นผลการลงคะแนนแบบ blind vote ที่เป็นอิสระ แต่มันวัดเพียงกระดานเดียว และตาราง benchmark ของ Alibaba เองก็ยังคงเป็นสิ่งประดิษฐ์จากผู้จำหน่าย (vendor artifact) — บริษัทต่าง ๆ เป็นผู้เลือกว่าจะรายงาน benchmark ใด และตัวเลขที่อ่อนแอที่สุดที่ Alibaba รายงาน (IFBench 82.8 ด้านการทำตามคำสั่ง) ยังคงตรงกับข้อร้องเรียนในรอบพรีวิวที่ว่าโมเดลทำงานเกินขอบเขตที่กำหนดและไม่สนใจสโคป (scope) หลักฐานของ Claude Fable 5 กว้างกว่าและส่วนใหญ่มาจากบุคคลที่สาม: ได้ 62 คะแนนบน AA Intelligence Index, #1 บนกระดาน Arena ทั่วไป, 95.0% บน SWE-bench Verified — และ Claude Fable 5.1 ตัวใหม่ของ Anthropic เองก็นำดัชนี AA อยู่ที่ 66 ตั้งแต่วันที่ 1 กันยายน ส่วนคำถามที่ว่า “โมเดลใดจะจัดการงานที่ฉันพลาดไม่ได้” คำตอบสำหรับงานทั่วไปยังไม่เปลี่ยนแปลง ส่วนคำถามที่ว่า “โมเดลใดส่งมอบ front-end ที่ดีที่สุดในราคาหนึ่งในสิบ” คำตอบได้พลิกกลับในวันที่ 2 กันยายน

ความเปิดกว้าง: แกนที่ Qwen ชนะไปแล้ว

Fable 5 จะไม่มีทางโฮสต์ได้เอง Qwen3.8-Max โฮสต์ได้เองแล้ว: เมื่อวันที่ 12 สิงหาคม weights ของ Qwen3.8-2.4T-A95B — ทั้งแบบ BF16 และ FP8 เวอร์ชันทางการ — ถูกปล่อยบน Hugging Face และ ModelScope ทำให้นี่คือ Qwen ระดับ Max รุ่นแรกที่ทุกคนสามารถดาวน์โหลดได้ ข้อควรระวังสองข้อควรให้ความสำคัญอย่างเท่าเทียมกัน

ข้อแรกนั้นถูกกฎหมาย เวอร์ชันเผยแพร่นี้ใช้สัญญาอนุญาตแบบกำหนดเอง “Qwen3.8-Max” ไม่ใช่ Apache 2.0: ผู้ให้บริการที่ดำเนินธุรกิจ model-as-a-service หรือธุรกิจผู้ช่วยทำงานด้วย AI (AI work-assistant) ซึ่งมีรายได้ 12 เดือนย้อนหลังเกิน 50 ล้านดอลลาร์สหรัฐ ต้องเจรจาสัญญาอนุญาตแยกต่างหากกับ Qwen และผลิตภัณฑ์เชิงพาณิชย์ที่มีผู้ใช้งานต่อเดือนเกิน 100 ล้านราย หรือมีรายได้ต่อเดือนเกิน 20 ล้านดอลลาร์สหรัฐ ต้องแสดงชื่อของโมเดลดังกล่าว สำหรับการใช้งานภายในองค์กรและสตาร์ตอัป เกณฑ์เหล่านี้แทบไม่มีผลผูกมัด — แต่ก็ไม่ใช่การใช้งานได้อย่างเสรีโดยปราศจากข้อจำกัด

ประการที่สองคือในเชิงกายภาพ โมเดล MoE ที่มีพารามิเตอร์รวม 2.4T ใช้พื้นที่จัดเก็บราว 4.9TB ในรูปแบบ BF16 (ประมาณครึ่งหนึ่งใน checkpoint แบบ FP8 อย่างเป็นทางการ) ขณะที่หน่วยความจำต่อ H200 หนึ่งตัวมีเพียงราว 141GB ดังนั้นการโฮสต์โมเดลเรือธงด้วยตัวเองจึงต้องใช้แร็กแอกเซเลอเรเตอร์ทั้งชุดก่อนที่จะเสิร์ฟโทเคนแรกได้ การเปิดเผยพารามิเตอร์ที่ทำงานพร้อมกันราว ~95B อย่างน้อยก็ช่วยให้คุณประเมินได้ว่าแร็กชุดนั้นจะซื้อความสามารถมาได้เท่าใด สำหรับแทบทุกทีมแล้ว การใช้ API แบบโฮสต์ที่ราคา $2 / $6 คือเส้นทางที่ปฏิบัติได้จริง

ซึ่งเป็นเหตุผลว่าทำไม Qwen3.8-27B ที่มีน้ำหนักโมเดลภายใต้ Apache-2.0 ออกตามมาเมื่อวันที่ 14 สิงหาคม และรายงานว่าทำงานใน VRAM ประมาณ 17GB จึงยังคงเป็นเวอร์ชัน self-host ที่สำคัญในทางปฏิบัติ หากเหตุผลที่คุณเลือก Qwen มากกว่า Fable 5 คือเรื่องการจัดเก็บข้อมูลในประเทศหรือการควบคุมแบบ on-premise มากกว่าความสามารถดิบ โมเดล 27B คือตัวที่ให้สิ่งนั้นจริง ๆ — และในทั้งสองด้าน การเปรียบเทียบเรื่องความเปิดเผยก็ไม่ใช่เพียงแค่ทฤษฎีอีกต่อไป

คำถามที่พบบ่อย

Qwen 3.8 ดีกว่า Claude Fable 5 หรือ?

ตอนนี้มันขึ้นอยู่กับแกน ซึ่งเป็นการเปลี่ยนแปลงที่แท้จริงจากเดือนสิงหาคม ด้านการเขียนโค้ด Qwen3.8-Max-0902 เป็นผู้นำ: อันดับ 1 บน Code Arena: WebDev ด้วย Elo 1,691 เทียบกับ 1,628 ของ Claude Fable 5 ในราคา $2 / $6 เทียบกับ $10 / $50 ของ Fable 5 ด้านคุณภาพที่ตรวจสอบอย่างกว้างขวาง Fable 5 ยังคงนำ: 62 บน AA Intelligence Index เทียบกับ 56 ของ Qwen, 95.0% SWE-bench Verified และอันดับ 1 บนกระดานรวม Arena สำหรับงานที่คำตอบผิดมีค่าใช้จ่ายสูง Fable 5 เป็นตัวเลือกที่มีเอกสารดีกว่า สำหรับงานเขียนโค้ดปริมาณมากและงานเว็บแบบเอเจนต์ Qwen รุ่นใหม่ล่าสุดทั้งถูกกว่าและมีอันดับ Arena สูงกว่า

คำกล่าวที่ว่า "ตามหลังแค่ Fable 5" เป็นจริงหรือไม่?

การวางตำแหน่งของ Alibaba ถูกสร้างขึ้นโดยไม่มีตัวเลขจากภายนอก และบิลด์ 0902 ก็เปลี่ยนรูปร่างไปตั้งแต่นั้น Qwen3.8-Max-0902 มีอันดับเหนือกว่า Claude Fable 5 ใน Code Arena: WebDev (1,691 ต่อ 1,628) แต่ตามหลังใน AA Intelligence Index (56 ต่อ 62) และบนกระดาน Arena ทั่วไป (Qwen #20 ที่ Elo 1,479; Fable 5 #1 ที่ 1,508) ดังนั้น “เป็นรองเพียง Fable 5” จึงกลายเป็น “นำหน้า Fable 5 บนกระดานเขียนโค้ดที่รีเฟรชครั้งนี้มุ่งเป้า แต่ตามหลังบนกระดานเอนกประสงค์กว้างๆ”

Qwen 3.8 ถูกกว่า Fable 5 เท่าไหร่?

อย่างมีนัยสำคัญ และตอนนี้เป็นอัตราจริง ไม่ใช่ส่วนลด Qwen3.8-Max อยู่ที่ $2 / $6 ต่อ 1M tokens เทียบกับ Fable 5 ที่ $10 / $50 — ถูกกว่าประมาณ 5 เท่าในส่วน input และ 8 เท่าในส่วน output อัตราของ Qwen ยังคงที่ตลอด context ขนาด 1M เต็ม และ cached input ที่ $0.25/1M ทำให้งานที่ใช้ context ซ้ำๆ ถูกลงไปอีก

Qwen 3.8 Max ออกจากช่วงพรีวิวแล้วหรือยัง?

ใช่ มันเปิดให้บริการทั่วไปเมื่อวันที่ 3 สิงหาคม 2026 พร้อมด้วยอัตราค่าบริการที่เผยแพร่และจุดเชื่อมต่อที่เข้ากันได้กับ OpenAI และ DashScope แคมเปญเครดิต Qoder และกรอบการแสดงตัวอย่างส่วนลด 90% ที่เผยแพร่ในเดือนกรกฎาคมไม่ได้อธิบายวิธีการขายโมเดลนี้อีกต่อไป

Qwen 3.8 ยังเป็นโมเดลที่ช้าที่สุดเหมือนที่รีวิวในช่วงแรกกล่าวไว้หรือไม่

ข้อค้นพบดังกล่าวมาจากผู้ตรวจสอบหนึ่งรายบนโครงสร้างพื้นฐานแบบพรีวิวที่รันบิลด์แบบเอเจนต์เป็นเวลาหนึ่งชั่วโมง และควรนำไปทดสอบซ้ำกับการให้บริการ GA มากกว่าที่จะถือเป็นข้อเท็จจริงในปัจจุบัน เทเลเมทรี 7 วันของ OrcaRouter แสดงค่า p50 ของเวลาจนถึงโทเค็นแรกที่ 1.64 วินาที แม้ว่านั่นจะวัดความหน่วงของโทเค็นแรกมากกว่าปริมาณงานบนบิลด์ที่ยาวมากก็ตาม

ฉันสามารถโฮสต์ Qwen 3.8 ด้วยตัวเองแทนที่จะจ่ายค่า Fable 5 ได้ไหม?

ใช่สำหรับ Qwen แต่มีข้อแม้ Qwen3.8-2.4T-A95B เปิดให้ดาวน์โหลดตั้งแต่วันที่ 12 สิงหาคมภายใต้ไลเซนส์แบบกำหนดเอง (ไม่ใช่ Apache 2.0) และ Qwen3.8-27B อยู่ภายใต้ Apache 2.0 ตั้งแต่วันที่ 14 สิงหาคม อุปสรรคในทางปฏิบัติคือฮาร์ดแวร์: MoE ที่มีพารามิเตอร์รวม 2.4T ต้องใช้พื้นที่ราว 4.9TB ในรูปแบบ BF16 — ซึ่งเทียบได้กับแร็คหนึ่งของตัวเร่งประมวลผล — ดังนั้นทีมส่วนใหญ่จึงยังคงเลือกเรียกใช้ API ที่โฮสต์ไว้ในราคา $2 / $6 แทนที่จะให้บริการโมเดลเรือธงด้วยตนเอง ส่วน Fable 5 ปิดตัวอย่างถาวร

วันนี้ควรใช้อันไหนดี

สำหรับงานทั่วไปที่คำตอบที่ผิดมีต้นทุนสูง — การใช้เหตุผลเชิงลึก เส้นทางการผลิตที่มีความเสี่ยงสูง — Claude Fable 5 ยังคงเป็นตัวเลือกที่มีเอกสารประกอบดีกว่า และ Claude Fable 5.1 ของ Anthropic ก็ยิ่งต่อยอดความได้เปรียบนั้น สำหรับการเขียนโค้ดปริมาณมากและการพัฒนาเว็บแบบเอเจนต์ ตอนนี้ Qwen3.8-Max-0902 ครองความได้เปรียบในเวทีวัดผลอิสระ พร้อมราคาเอาต์พุตที่ต่ำกว่าประมาณ 8 เท่า: การตรวจสอบโค้ดปริมาณมาก การสร้าง front-end การวิเคราะห์เอกสารระยะยาว หลายทีมควรใช้งานทั้งคู่และจัดเส้นทางตามประเภทงาน

บรรทัดล่าง

Qwen 3.8 เทียบกับ Claude Fable 5 เป็นการเปรียบเทียบที่ต่างไปจากเมื่อเดือนที่แล้ว และต่างออกไปอีกจากเมื่อสัปดาห์ก่อน Qwen3.8-Max เป็นโมเดลที่เปิดให้ใช้งานทั่วไป โดยมีอัตราค่าบริการที่ถูกกว่า Fable 5 ถึง 5 เท่าสำหรับ input และ 8 เท่าสำหรับ output ในราคาคงที่ตลอดล้านโทเคน — และตั้งแต่ 2 กันยายนเป็นต้นไป ชื่อเดียวกันนี้รองรับบิลด์ 0902 ซึ่งตอนนี้ arena อิสระจัดอันดับให้เป็น #1 ด้านการพัฒนาเว็บแบบ agentic เหนือกว่า Fable 5 ในกระดานนั้น

ตอนนี้ไม่มีโมเดลใดครองการเปรียบเทียบทั้งหมดแล้ว Claude Fable 5 — และ Claude Fable 5.1 ของ Anthropic ซึ่งนำดัชนี AA Intelligence Index ที่ 66 ตั้งแต่วันที่ 1 กันยายน — ยังครองพื้นที่การใช้งานทั่วไปที่กว้าง ผ่านการตรวจสอบ และครอบคลุม ส่วนตารางเกณฑ์มาตรฐานของ Alibaba เองก็ยังคงเป็นเพียงสิ่งที่ผู้จำหน่ายสร้างขึ้น แต่เหตุผลที่การแข่งขันครั้งนี้ไม่สูสีในเดือนกรกฎาคม — เพราะ Qwen ไม่มีผู้ตัดสินอิสระเลย — สิ้นสุดลงเมื่อวันที่ 2 กันยายน: Qwen3.8-Max-0902 เป็นโมเดลอันดับ 1 บน Code Arena: WebDev คำตอบที่สมเหตุสมผลยังคงเป็นการแบ่งตามความเสี่ยงและประเภทงาน — Fable 5 สำหรับงานให้เหตุผลทั่วไปที่การผิดพลาดมีค่าใช้จ่ายสูง ส่วน Qwen3.8-Max สำหรับงานเขียนโค้ดปริมาณมาก ซึ่งช่องว่างด้านราคาและความได้เปรียบในอารีน่าต่างเอื้อประโยชน์ให้ — และทดสอบทั้งสองกับพรอมปต์ของคุณเอง

การเปรียบเทียบในบทความนี้3

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube