
Qwen 4 Max vs Gemini 3.1 Pro: เรือธงที่ยังไม่ประกาศกับพรีวิวที่ไม่มีวันสิ้นสุด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
การเปรียบเทียบส่วนใหญ่มักจับผลิตภัณฑ์ที่วางจำหน่ายแล้วมาเทียบกับผลิตภัณฑ์ที่วางจำหน่ายแล้ว ครั้งนี้นั้นผิดปกติ: Qwen 4 Max ถูกเปิดตัวในรูปแบบพรีวิวที่งานประชุม Yunqi ในหังโจวเมื่อวันที่ 22 กันยายน 2026 โดยไม่มีกำหนดวางจำหน่าย ไม่มีราคา และไม่มีค่าน้ำหนักโมเดล ส่วน Gemini 3.1 Pro อยู่ในสถานะพรีวิวตั้งแต่ 19 กุมภาพันธ์ 2026 และยังคงอยู่ในสถานะพรีวิว — เจ็ดเดือนต่อมา โดยยังไม่ประกาศวันเปิดให้ใช้งานทั่วไป และไม่มีวันปิดบริการในตารางการเลิกใช้งานของมัน ไม่มีโมเดลใดในคู่นี้ที่เป็นผลิตภัณฑ์ที่ลงตัวแล้ว นั่นไม่ใช่เหตุผลที่จะข้ามการเปรียบเทียบนี้ มันคือการเปรียบเทียบนี้เอง และเป็นสิ่งเดียวเกี่ยวกับการเปรียบเทียบนี้ที่ให้ข้อมูลอย่างแท้จริง
เจ็ดเดือนของการพรีวิว
ป้ายกำกับตัวอย่างควรเป็นสถานะชั่วคราว ตอนนี้ Gemini 3.1 Pro ถือสถานะนี้มาตลอดการเปิดตัว Flash สามครั้งจากห้องแล็บเดียวกัน รวมถึง Gemini 3.8 Flash เมื่อวันที่ 2 กันยายน 2026 ซึ่ง Google อธิบายว่าเป็นโมเดล Flash ที่ฉลาดที่สุดของตน บนคอมโพสิตอิสระ โมเดลนั้นมีคะแนนเหนือกว่า 3.1 Pro แล้ว สาย Pro ของ Google ไม่มีสมาชิกรุ่นใหม่กว่า: ไม่มี Gemini 3.8 Pro และรุ่น 3.5 Pro ถูกเลื่อนออกไปและถูกรายงานว่าถูกพักไว้ ผลในทางปฏิบัติคือโมเดลที่ใช้ชื่อ Pro ไม่ใช่โมเดลที่ได้คะแนนสูงสุดจากผู้ผลิตของตัวเองอีกต่อไป
ข้อความว่าด้วยข้อจำกัดของ Google เองบนรายการในแค็ตตาล็อกแนะนำให้วางแผนรับมือกับการเลิกใช้เวอร์ชันพรีวิว ซึ่งเป็นวิธีอ่านสถานะอย่างตรงไปตรงมา พรีวิวที่ไม่มีวัน GA และไม่มีวันปิดให้บริการ คือโมเดลที่คุณสร้างต่อยอดได้ แต่ไม่อาจวางแผนกำหนดการโดยอิงกับมันได้
ฝั่ง Qwen เป็นภาพสะท้อนกลับด้านที่พลิกเครื่องหมาย Qwen 4 Max ไม่ได้อยู่ในการพรีวิวระยะยาว แต่เป็นสถานะก่อนพรีวิว โดยยังไม่มีการเผยแพร่ใด ๆ ทั้งสิ้น รูปแบบความล้มเหลวทั้งสองตรงกันข้าม: Gemini 3.1 Pro เป็นปลายทางจริงที่ไม่ได้ระบุการดำรงอยู่ระยะยาว ส่วน Qwen 4 Max เป็นรายการในแผนงานที่ระบุไว้ชัดเจนแต่ไม่มีปลายทาง

การเปรียบเทียบ และตัวเลขบริบทแบบยาวที่ตัดสินมัน
สเปกของ Gemini 3.1 Pro นั้นเปิดเผยต่อสาธารณะและเจาะจง ส่วนของ Qwen 4 Max นั้นว่างเปล่า สิ่งที่ควรค่าแก่การขบคิดก็คือแถวหนึ่งในคอลัมน์ของ Gemini เพราะมันเป็นตัวเลขแบบที่มักถูกหยิบมาอ้างอิง และไม่ควรถูกอ้างอิง:
• สถานะ — Gemini 3.1 Pro อยู่ในพรีวิวตั้งแต่ 19 กุมภาพันธ์ 2026 เทียบกับ Qwen 4 Max ที่ประกาศเมื่อ 22 กันยายน 2026 โดยไม่มีวันที่
• ราคาอินพุต — Gemini 3.1 Pro $2.00 ต่อ 1M โทเค็น สำหรับพรอมต์ไม่เกิน 200K และ $4.00 เมื่อเกินนั้น เทียบกับ Qwen 4 Max ที่ไม่เปิดเผย
• ราคา Output — Gemini 3.1 Pro $12.00 ต่อ 1M สูงสุด 200K และ $18.00 เมื่อเกิน 200K เทียบกับ Qwen 4 Max ที่ยังไม่เปิดเผย
• อินพุตแคช — Gemini 3.1 Pro $0.20 ต่อ 1M เมื่ออ่านจากแคช เทียบกับ Qwen 4 Max ที่ยังไม่เปิดเผย
• บริบท — Gemini 3.1 Pro 1,048,576 โทเค็น เทียบกับ Qwen 4 Max ที่ไม่ได้เปิดเผย
• เพดานเอาต์พุต — Gemini 3.1 Pro 65,536 โทเค็น เทียบกับ Qwen 4 Max ที่ไม่เปิดเผย
• รูปแบบข้อมูล — Gemini 3.1 Pro รองรับอินพุตข้อความ รูปภาพ วิดีโอ เสียง และ PDF โดยให้เอาต์พุตเป็นข้อความ เทียบกับ Qwen 4 Max ที่ยังไม่เผยแพร่
• การควบคุมการให้เหตุผล — ระดับการคิดต่ำ กลาง และสูงของ Gemini 3.1 Pro เทียบกับ Qwen 4 Max ที่ไม่ได้เผยแพร่
• การดึงข้อมูลบริบทยาว — Gemini 3.1 Pro: MRCR v2 ที่ผู้ขายรายงานอยู่ที่ 84.9 เปอร์เซ็นต์ โดยเฉลี่ยจาก 8 needles ที่ 128K แต่ 26.3 เปอร์เซ็นต์ที่การตั้งค่า pointwise หนึ่งล้านโทเคน เทียบกับ Qwen 4 Max ที่ไม่มีรายงาน
• คะแนนที่ผู้ขายรายงาน — Gemini 3.1 Pro SWE-bench Verified 80.6 เปอร์เซ็นต์, GPQA Diamond 94.3 เปอร์เซ็นต์, ARC-AGI-2 77.1 เปอร์เซ็นต์, Humanity's Last Exam 44.4 เปอร์เซ็นต์โดยไม่ใช้เครื่องมือ เมื่อเทียบกับ Qwen 4 Max ที่ไม่มีรายงาน
• คะแนนอิสระ — Gemini 3.1 Pro 30 บน Artificial Analysis Intelligence Index v4.3.2 เทียบกับ Qwen 4 Max ไม่มีการประเมินอิสระ
แถวบริบทแบบยาวแถวนั้นคือแถวที่ควรจดจำไป หน้าต่างบริบทขนาด 1,048,576 โทเค็นเป็นตัวเลขทางการตลาด ส่วนการดึงข้อมูลคืนได้ 26.3 เปอร์เซ็นต์ ในการตั้งค่าที่หนึ่งล้านโทเค็น คือสิ่งที่ผู้ขายรายเดียวกันรายงานเมื่อวัดที่ปลายสุดของหน้าต่างนั้น ตัวเลขทั้งสองมาจาก Google ซึ่งทำให้ช่องว่างนี้เป็นข้อบ่งชี้เกี่ยวกับโมเดลมากกว่าจะเกี่ยวกับผู้ประเมิน หากภาระงานของคุณขึ้นอยู่กับการค้นหาข้อเท็จจริงที่ฝังอยู่ใกล้ปลายของพรอมป์ต์ขนาดหนึ่งล้านโทเค็น ตัวเลขบริบทที่พาดหัวไว้ไม่ได้บอกอะไรที่เป็นประโยชน์กับคุณเลย และแถวนี้บอกคุณเกือบทุกอย่าง
ดัชนีขยับ แต่โมเดลไม่ขยับ
Gemini 3.1 Pro เปิดตัวเมื่อวันที่ 19 กุมภาพันธ์ 2026 ด้วยคะแนน 57 ใน Artificial Analysis Intelligence Index เป็นอันดับหนึ่งในวงการ ภายใต้การปรับปรุงดัชนีเวอร์ชัน v4.3.2 ซึ่งเผยแพร่เมื่อวันที่ 19 กันยายน 2026 มันแสดงค่าเป็น 30 ไม่มีอะไรเกี่ยวกับโมเดลนี้เปลี่ยนแปลงไประหว่างสองวันนั้น ไม้บรรทัดถูกสร้างขึ้นใหม่ และมันถูกสร้างขึ้นใหม่สี่วันก่อนการประกาศ Qwen 4 ของ Alibaba
ความบังเอิญนั้นมีค่ามากกว่าตัวเลขเหล่านั้นเอง สามในสี่ของโมเดลในชุดการเปรียบเทียบนี้ — Gemini 3.1 Pro, Claude Opus 5 และเรือธง Qwen 3.8 — ต่างมีคะแนนอิสระที่ขยับภายใต้การแก้ไขเดียวกัน และในแต่ละกรณี การขยับนั้นมากพอที่จะพลิกอันดับ การเปรียบเทียบใด ๆ ที่เขียนขึ้นในเดือนนี้ซึ่งอ้างค่าดัชนีเพียงตัวเดียวโดยไม่ระบุการแก้ไข กำลังเปรียบเทียบคะแนนที่วัดด้วยไม้บรรทัดคนละอัน และผู้อ่านจะมองไม่เห็นข้อผิดพลาดนั้น
สำหรับ Qwen 4 Max ผลที่ตามมาคือเป้าหมายยังคงเคลื่อนไปเรื่อย ๆ เมื่อ Alibaba เปิดตัวในที่สุด คะแนนที่ต้องเอาชนะบนดัชนีนี้จะเป็นค่าที่ฉบับแก้ไขปัจจุบันระบุในวันนั้น และฉบับแก้ไขได้เปลี่ยนแปลงอย่างน้อยหนึ่งครั้งในสัปดาห์ที่ผ่านมา

สิ่งที่ตัวเลขปฏิบัติการบอก รวมถึงตัวเลขที่ชวนอึดอัดด้วย
Gemini 3.1 Pro สามารถจัดเส้นทางบน OrcaRouter ได้ในชื่อ google/gemini-3.1-pro-previewโดยติดป้าย Flagship และ Featured และไม่มีแบนเนอร์ก่อนเปิดตัว ในราคาตามรายการของ Google ที่ $2.00 และ $12.00 ต่อล้านโทเคน โดยบวกเพิ่ม 0% การจัดเส้นทางนั้นซื่อตรง — อัตราที่แสดงบนหน้าคืออัตราที่ Google ประกาศ ตัวเลขการดำเนินงานในช่วงเจ็ดวันถึงวันที่ 22 กันยายนก็ควรค่าแก่การพิมพ์ไว้มากกว่าที่จะข้ามไป: ค่า p50 ของเวลาถึงโทเคนแรก (time-to-first-token) ที่ 10.00 วินาที ความเร็วเอาต์พุตประมาณ 632 โทเคนต่อวินาที และอัตราข้อผิดพลาด 77.5 เปอร์เซ็นต์ตลอดช่วงเวลาดังกล่าว อัตราข้อผิดพลาดนั้นไม่ใช่เชิงอรรถ สำหรับโมเดลระดับพรีวิวที่ยังไม่มีกำหนด GA มันเป็นตัวเลขเดียวที่มีความสำคัญต่อการตัดสินใจมากที่สุดบนหน้านี้ และการเปรียบเทียบที่อ้างราคาโดยไม่มีมันคือการขายมากกว่าให้ข้อมูล
แค็ตตาล็อกเดียวกันนี้บรรจุโมเดลเกือบ 200 รุ่นไว้บนปลายทางที่เข้ากันได้กับ OpenAI เพียงจุดเดียว พร้อมการสลับไปใช้ตัวสำรองอัตโนมัติเมื่อเกิดข้อขัดข้อง และ DSL สำหรับการกำหนดเส้นทาง ซึ่งเป็นกลไกที่ทำให้อัตราความผิดพลาดระดับนั้นพอจะรับมือได้แทนที่จะเป็นเรื่องถึงตาย: เส้นทางของผู้ให้บริการที่เสื่อมประสิทธิภาพสามารถสลับไปใช้ตัวสำรองได้แทนที่จะถูกปิดไปเลย ตระกูล Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash และ Qwen3.8-27B — อยู่บนปลายทางเดียวกับ Gemini 3.1 Pro Preview ดังนั้นการแทนที่ที่บทความนี้พูดถึงจริง ๆ ซึ่งคุณทำได้ตั้งแต่วันนี้ คือการเปลี่ยนนโยบายการกำหนดเส้นทาง มากกว่าเป็นโครงการย้ายระบบ Qwen 4 Max ไม่ได้อยู่ในแค็ตตาล็อกนี้ และไม่มีรุ่นใดของ Qwen 4 อยู่เลย เมื่อมีรุ่นออกมา นั่นคือจุดที่มันจะปรากฏ
การตัดสินใจ ถ้าเรียกอย่างนั้นได้ก็แล้วแต่
ทั้งสองโมเดลนี้ไม่ใช่ผลิตภัณฑ์ที่คุณสามารถตัดสินใจใช้งานระยะยาวได้ และคำแนะนำที่ตรงไปตรงมาคือให้ปฏิบัติต่อทั้งคู่ในลักษณะนั้น Gemini 3.1 Pro เรียกใช้งานได้ในวันนี้ในราคาที่เปิดเผย พร้อมหน้าต่างบริบทที่เปิดเผย และมีหลักฐานการประเมินที่สาธารณะ รวมถึงจุดอ่อนด้านการดึงข้อมูลที่ปลายสุดของหน้าต่างนั้น นอกจากนี้ยังเป็นพรีวิวที่ผู้จำหน่ายแนะนำให้คุณวางแผนรับมือการเลิกใช้ โดยมีอัตราความผิดพลาดที่ยอมรับไม่ได้หากต้องเป็น dependency ในงานโปรดักชัน Qwen 4 Max ไม่มีปัญหาเหล่านั้นเลย เพราะมันไม่มีคุณสมบัติเหล่านั้นตั้งแต่แรก
ถ้าคุณต้องการโมเดลตอนนี้ ทางเลือกไม่ได้อยู่ระหว่างสองตัวนี้ แต่อยู่ระหว่าง Gemini 3.1 Pro กับ Qwen เรือธงที่วางจำหน่ายแล้ว และจากหลักฐานที่มีอยู่ นั่นเป็นการตัดสินใจเกี่ยวกับคุณภาพการดึงข้อมูลบริบทยาว เทียบกับอัตราอินพุต 2.00 ดอลลาร์พร้อมน้ำหนักที่เผยแพร่สาธารณะ ถ้าคุณรอได้ ให้จับตาสองสิ่งแทนที่จะเป็นหนึ่ง: การ์ดโมเดล Qwen 4 Max และวันเปิดให้ใช้ทั่วไปของ Gemini 3.1 Pro อันไหนมาถึงก่อนจะบอกคุณว่า Alibaba และ Google กำลังให้ความสำคัญกับแผนงานใดในสองแผนนี้จริง ๆ

การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
