การ์ดหัวเรื่องหลักสำหรับ "Qwen 4 Max vs Gemini 3.1 Pro" พร้อมคำโปรย "เรือธงที่ยังไม่ประกาศตัว เทียบกับพรีวิวที่ไม่มีวันจบ" ป้ายแคปซูลสามป้ายข้อความว่า "พรีวิวตั้งแต่ 19 ก.พ. 2026", "บริบท 1,048,576 โทเคน" และ "การค้นคืน 26.3% ที่ 1M" บรรทัดท้ายระบุว่า "Alibaba ประกาศเมื่อ 22 กันยายน 2026; Google เปิดพรีวิวเมื่อ 19 กุมภาพันธ์ 2026" และโลโก้ OrcaRouter ที่มุมล่างขวา
Engineering & Research

Qwen 4 Max vs Gemini 3.1 Pro: เรือธงที่ยังไม่ประกาศกับพรีวิวที่ไม่มีวันสิ้นสุด

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

การเปรียบเทียบส่วนใหญ่มักจับผลิตภัณฑ์ที่วางจำหน่ายแล้วมาเทียบกับผลิตภัณฑ์ที่วางจำหน่ายแล้ว ครั้งนี้นั้นผิดปกติ: Qwen 4 Max ถูกเปิดตัวในรูปแบบพรีวิวที่งานประชุม Yunqi ในหังโจวเมื่อวันที่ 22 กันยายน 2026 โดยไม่มีกำหนดวางจำหน่าย ไม่มีราคา และไม่มีค่าน้ำหนักโมเดล ส่วน Gemini 3.1 Pro อยู่ในสถานะพรีวิวตั้งแต่ 19 กุมภาพันธ์ 2026 และยังคงอยู่ในสถานะพรีวิว — เจ็ดเดือนต่อมา โดยยังไม่ประกาศวันเปิดให้ใช้งานทั่วไป และไม่มีวันปิดบริการในตารางการเลิกใช้งานของมัน ไม่มีโมเดลใดในคู่นี้ที่เป็นผลิตภัณฑ์ที่ลงตัวแล้ว นั่นไม่ใช่เหตุผลที่จะข้ามการเปรียบเทียบนี้ มันคือการเปรียบเทียบนี้เอง และเป็นสิ่งเดียวเกี่ยวกับการเปรียบเทียบนี้ที่ให้ข้อมูลอย่างแท้จริง

เจ็ดเดือนของการพรีวิว

ป้ายกำกับตัวอย่างควรเป็นสถานะชั่วคราว ตอนนี้ Gemini 3.1 Pro ถือสถานะนี้มาตลอดการเปิดตัว Flash สามครั้งจากห้องแล็บเดียวกัน รวมถึง Gemini 3.8 Flash เมื่อวันที่ 2 กันยายน 2026 ซึ่ง Google อธิบายว่าเป็นโมเดล Flash ที่ฉลาดที่สุดของตน บนคอมโพสิตอิสระ โมเดลนั้นมีคะแนนเหนือกว่า 3.1 Pro แล้ว สาย Pro ของ Google ไม่มีสมาชิกรุ่นใหม่กว่า: ไม่มี Gemini 3.8 Pro และรุ่น 3.5 Pro ถูกเลื่อนออกไปและถูกรายงานว่าถูกพักไว้ ผลในทางปฏิบัติคือโมเดลที่ใช้ชื่อ Pro ไม่ใช่โมเดลที่ได้คะแนนสูงสุดจากผู้ผลิตของตัวเองอีกต่อไป

ข้อความว่าด้วยข้อจำกัดของ Google เองบนรายการในแค็ตตาล็อกแนะนำให้วางแผนรับมือกับการเลิกใช้เวอร์ชันพรีวิว ซึ่งเป็นวิธีอ่านสถานะอย่างตรงไปตรงมา พรีวิวที่ไม่มีวัน GA และไม่มีวันปิดให้บริการ คือโมเดลที่คุณสร้างต่อยอดได้ แต่ไม่อาจวางแผนกำหนดการโดยอิงกับมันได้

ฝั่ง Qwen เป็นภาพสะท้อนกลับด้านที่พลิกเครื่องหมาย Qwen 4 Max ไม่ได้อยู่ในการพรีวิวระยะยาว แต่เป็นสถานะก่อนพรีวิว โดยยังไม่มีการเผยแพร่ใด ๆ ทั้งสิ้น รูปแบบความล้มเหลวทั้งสองตรงกันข้าม: Gemini 3.1 Pro เป็นปลายทางจริงที่ไม่ได้ระบุการดำรงอยู่ระยะยาว ส่วน Qwen 4 Max เป็นรายการในแผนงานที่ระบุไว้ชัดเจนแต่ไม่มีปลายทาง

A two-column scoreboard titled "Qwen 4 Max vs Gemini 3.1 Pro - the scoreboard". Left column Qwen 4 Max: Status announced, no date; Input price not published; Output price not published; Context window not published; Long-context retrieval not published; Independent score none exists. Right column Gemini 3.1 Pro: Status preview since Feb 19 2026; Input price $2.00 per 1M tokens; Output price $12.00 per 1M tokens; Context window 1,048,576 tokens; Long-context retrieval 26.3% at 1M tokens; Independent score 30 on index v4.3.2. Footer reads "Gemini 3.1 Pro pricing and vendor-reported retrieval from Google; index v4.3.2 published September 19 2026.", with the OrcaRouter logo bottom-right.

การเปรียบเทียบ และตัวเลขบริบทแบบยาวที่ตัดสินมัน

สเปกของ Gemini 3.1 Pro นั้นเปิดเผยต่อสาธารณะและเจาะจง ส่วนของ Qwen 4 Max นั้นว่างเปล่า สิ่งที่ควรค่าแก่การขบคิดก็คือแถวหนึ่งในคอลัมน์ของ Gemini เพราะมันเป็นตัวเลขแบบที่มักถูกหยิบมาอ้างอิง และไม่ควรถูกอ้างอิง:

• สถานะ — Gemini 3.1 Pro อยู่ในพรีวิวตั้งแต่ 19 กุมภาพันธ์ 2026 เทียบกับ Qwen 4 Max ที่ประกาศเมื่อ 22 กันยายน 2026 โดยไม่มีวันที่

• ราคาอินพุต — Gemini 3.1 Pro $2.00 ต่อ 1M โทเค็น สำหรับพรอมต์ไม่เกิน 200K และ $4.00 เมื่อเกินนั้น เทียบกับ Qwen 4 Max ที่ไม่เปิดเผย

• ราคา Output — Gemini 3.1 Pro $12.00 ต่อ 1M สูงสุด 200K และ $18.00 เมื่อเกิน 200K เทียบกับ Qwen 4 Max ที่ยังไม่เปิดเผย

• อินพุตแคช — Gemini 3.1 Pro $0.20 ต่อ 1M เมื่ออ่านจากแคช เทียบกับ Qwen 4 Max ที่ยังไม่เปิดเผย

• บริบท — Gemini 3.1 Pro 1,048,576 โทเค็น เทียบกับ Qwen 4 Max ที่ไม่ได้เปิดเผย

• เพดานเอาต์พุต — Gemini 3.1 Pro 65,536 โทเค็น เทียบกับ Qwen 4 Max ที่ไม่เปิดเผย

• รูปแบบข้อมูล — Gemini 3.1 Pro รองรับอินพุตข้อความ รูปภาพ วิดีโอ เสียง และ PDF โดยให้เอาต์พุตเป็นข้อความ เทียบกับ Qwen 4 Max ที่ยังไม่เผยแพร่

• การควบคุมการให้เหตุผล — ระดับการคิดต่ำ กลาง และสูงของ Gemini 3.1 Pro เทียบกับ Qwen 4 Max ที่ไม่ได้เผยแพร่

• การดึงข้อมูลบริบทยาว — Gemini 3.1 Pro: MRCR v2 ที่ผู้ขายรายงานอยู่ที่ 84.9 เปอร์เซ็นต์ โดยเฉลี่ยจาก 8 needles ที่ 128K แต่ 26.3 เปอร์เซ็นต์ที่การตั้งค่า pointwise หนึ่งล้านโทเคน เทียบกับ Qwen 4 Max ที่ไม่มีรายงาน

• คะแนนที่ผู้ขายรายงาน — Gemini 3.1 Pro SWE-bench Verified 80.6 เปอร์เซ็นต์, GPQA Diamond 94.3 เปอร์เซ็นต์, ARC-AGI-2 77.1 เปอร์เซ็นต์, Humanity's Last Exam 44.4 เปอร์เซ็นต์โดยไม่ใช้เครื่องมือ เมื่อเทียบกับ Qwen 4 Max ที่ไม่มีรายงาน

• คะแนนอิสระ — Gemini 3.1 Pro 30 บน Artificial Analysis Intelligence Index v4.3.2 เทียบกับ Qwen 4 Max ไม่มีการประเมินอิสระ

แถวบริบทแบบยาวแถวนั้นคือแถวที่ควรจดจำไป หน้าต่างบริบทขนาด 1,048,576 โทเค็นเป็นตัวเลขทางการตลาด ส่วนการดึงข้อมูลคืนได้ 26.3 เปอร์เซ็นต์ ในการตั้งค่าที่หนึ่งล้านโทเค็น คือสิ่งที่ผู้ขายรายเดียวกันรายงานเมื่อวัดที่ปลายสุดของหน้าต่างนั้น ตัวเลขทั้งสองมาจาก Google ซึ่งทำให้ช่องว่างนี้เป็นข้อบ่งชี้เกี่ยวกับโมเดลมากกว่าจะเกี่ยวกับผู้ประเมิน หากภาระงานของคุณขึ้นอยู่กับการค้นหาข้อเท็จจริงที่ฝังอยู่ใกล้ปลายของพรอมป์ต์ขนาดหนึ่งล้านโทเค็น ตัวเลขบริบทที่พาดหัวไว้ไม่ได้บอกอะไรที่เป็นประโยชน์กับคุณเลย และแถวนี้บอกคุณเกือบทุกอย่าง

ดัชนีขยับ แต่โมเดลไม่ขยับ

Gemini 3.1 Pro เปิดตัวเมื่อวันที่ 19 กุมภาพันธ์ 2026 ด้วยคะแนน 57 ใน Artificial Analysis Intelligence Index เป็นอันดับหนึ่งในวงการ ภายใต้การปรับปรุงดัชนีเวอร์ชัน v4.3.2 ซึ่งเผยแพร่เมื่อวันที่ 19 กันยายน 2026 มันแสดงค่าเป็น 30 ไม่มีอะไรเกี่ยวกับโมเดลนี้เปลี่ยนแปลงไประหว่างสองวันนั้น ไม้บรรทัดถูกสร้างขึ้นใหม่ และมันถูกสร้างขึ้นใหม่สี่วันก่อนการประกาศ Qwen 4 ของ Alibaba

ความบังเอิญนั้นมีค่ามากกว่าตัวเลขเหล่านั้นเอง สามในสี่ของโมเดลในชุดการเปรียบเทียบนี้ — Gemini 3.1 Pro, Claude Opus 5 และเรือธง Qwen 3.8 — ต่างมีคะแนนอิสระที่ขยับภายใต้การแก้ไขเดียวกัน และในแต่ละกรณี การขยับนั้นมากพอที่จะพลิกอันดับ การเปรียบเทียบใด ๆ ที่เขียนขึ้นในเดือนนี้ซึ่งอ้างค่าดัชนีเพียงตัวเดียวโดยไม่ระบุการแก้ไข กำลังเปรียบเทียบคะแนนที่วัดด้วยไม้บรรทัดคนละอัน และผู้อ่านจะมองไม่เห็นข้อผิดพลาดนั้น

สำหรับ Qwen 4 Max ผลที่ตามมาคือเป้าหมายยังคงเคลื่อนไปเรื่อย ๆ เมื่อ Alibaba เปิดตัวในที่สุด คะแนนที่ต้องเอาชนะบนดัชนีนี้จะเป็นค่าที่ฉบับแก้ไขปัจจุบันระบุในวันนั้น และฉบับแก้ไขได้เปลี่ยนแปลงอย่างน้อยหนึ่งครั้งในสัปดาห์ที่ผ่านมา

A screenshot of the OrcaRouter page for Gemini 3.1 Pro in its cost-estimator view (English UI), showing a monthly token volume of 10M against a sample summarisation prompt, an estimated $50.00 per month falling to $43.70 with prompt caching at list price, a cost per request of $0.006040, a note that the estimate uses base-tier rates and that actual token counts depend on the provider's tokenizer, and a PERFORMANCE panel for the last 7 days reading p50 time-to-first-token 10.00 s, output speed 632 tok/s and an error rate of 77.5%, above a 7-day latency trend chart running 09-16 to 09-22.

สิ่งที่ตัวเลขปฏิบัติการบอก รวมถึงตัวเลขที่ชวนอึดอัดด้วย

Gemini 3.1 Pro สามารถจัดเส้นทางบน OrcaRouter ได้ในชื่อ google/gemini-3.1-pro-previewโดยติดป้าย Flagship และ Featured และไม่มีแบนเนอร์ก่อนเปิดตัว ในราคาตามรายการของ Google ที่ $2.00 และ $12.00 ต่อล้านโทเคน โดยบวกเพิ่ม 0% การจัดเส้นทางนั้นซื่อตรง — อัตราที่แสดงบนหน้าคืออัตราที่ Google ประกาศ ตัวเลขการดำเนินงานในช่วงเจ็ดวันถึงวันที่ 22 กันยายนก็ควรค่าแก่การพิมพ์ไว้มากกว่าที่จะข้ามไป: ค่า p50 ของเวลาถึงโทเคนแรก (time-to-first-token) ที่ 10.00 วินาที ความเร็วเอาต์พุตประมาณ 632 โทเคนต่อวินาที และอัตราข้อผิดพลาด 77.5 เปอร์เซ็นต์ตลอดช่วงเวลาดังกล่าว อัตราข้อผิดพลาดนั้นไม่ใช่เชิงอรรถ สำหรับโมเดลระดับพรีวิวที่ยังไม่มีกำหนด GA มันเป็นตัวเลขเดียวที่มีความสำคัญต่อการตัดสินใจมากที่สุดบนหน้านี้ และการเปรียบเทียบที่อ้างราคาโดยไม่มีมันคือการขายมากกว่าให้ข้อมูล

แค็ตตาล็อกเดียวกันนี้บรรจุโมเดลเกือบ 200 รุ่นไว้บนปลายทางที่เข้ากันได้กับ OpenAI เพียงจุดเดียว พร้อมการสลับไปใช้ตัวสำรองอัตโนมัติเมื่อเกิดข้อขัดข้อง และ DSL สำหรับการกำหนดเส้นทาง ซึ่งเป็นกลไกที่ทำให้อัตราความผิดพลาดระดับนั้นพอจะรับมือได้แทนที่จะเป็นเรื่องถึงตาย: เส้นทางของผู้ให้บริการที่เสื่อมประสิทธิภาพสามารถสลับไปใช้ตัวสำรองได้แทนที่จะถูกปิดไปเลย ตระกูล Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash และ Qwen3.8-27B — อยู่บนปลายทางเดียวกับ Gemini 3.1 Pro Preview ดังนั้นการแทนที่ที่บทความนี้พูดถึงจริง ๆ ซึ่งคุณทำได้ตั้งแต่วันนี้ คือการเปลี่ยนนโยบายการกำหนดเส้นทาง มากกว่าเป็นโครงการย้ายระบบ Qwen 4 Max ไม่ได้อยู่ในแค็ตตาล็อกนี้ และไม่มีรุ่นใดของ Qwen 4 อยู่เลย เมื่อมีรุ่นออกมา นั่นคือจุดที่มันจะปรากฏ

การตัดสินใจ ถ้าเรียกอย่างนั้นได้ก็แล้วแต่

ทั้งสองโมเดลนี้ไม่ใช่ผลิตภัณฑ์ที่คุณสามารถตัดสินใจใช้งานระยะยาวได้ และคำแนะนำที่ตรงไปตรงมาคือให้ปฏิบัติต่อทั้งคู่ในลักษณะนั้น Gemini 3.1 Pro เรียกใช้งานได้ในวันนี้ในราคาที่เปิดเผย พร้อมหน้าต่างบริบทที่เปิดเผย และมีหลักฐานการประเมินที่สาธารณะ รวมถึงจุดอ่อนด้านการดึงข้อมูลที่ปลายสุดของหน้าต่างนั้น นอกจากนี้ยังเป็นพรีวิวที่ผู้จำหน่ายแนะนำให้คุณวางแผนรับมือการเลิกใช้ โดยมีอัตราความผิดพลาดที่ยอมรับไม่ได้หากต้องเป็น dependency ในงานโปรดักชัน Qwen 4 Max ไม่มีปัญหาเหล่านั้นเลย เพราะมันไม่มีคุณสมบัติเหล่านั้นตั้งแต่แรก

ถ้าคุณต้องการโมเดลตอนนี้ ทางเลือกไม่ได้อยู่ระหว่างสองตัวนี้ แต่อยู่ระหว่าง Gemini 3.1 Pro กับ Qwen เรือธงที่วางจำหน่ายแล้ว และจากหลักฐานที่มีอยู่ นั่นเป็นการตัดสินใจเกี่ยวกับคุณภาพการดึงข้อมูลบริบทยาว เทียบกับอัตราอินพุต 2.00 ดอลลาร์พร้อมน้ำหนักที่เผยแพร่สาธารณะ ถ้าคุณรอได้ ให้จับตาสองสิ่งแทนที่จะเป็นหนึ่ง: การ์ดโมเดล Qwen 4 Max และวันเปิดให้ใช้ทั่วไปของ Gemini 3.1 Pro อันไหนมาถึงก่อนจะบอกคุณว่า Alibaba และ Google กำลังให้ความสำคัญกับแผนงานใดในสองแผนนี้จริง ๆ

A screenshot of the OrcaRouter model catalogue at www.orcarouter.ai/models (English UI), showing the header reading "199 models, 15 providers, one API key, one bill", the sort and filter rail with Newest selected alongside controls for input modalities and context length, the "How to call any model" panel showing a POST to api.orcarouter.ai/v1/chat/completions with a model and messages JSON body, and the first catalogue cards including openai/gpt-5-mini with a 200 Status badge.

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube