การ์ด hero ที่สร้างขึ้นสำหรับ GPT-6.1 Sol vs Gemini 3.1 Pro พร้อมหัวข้อ 'เจ็ดเดือนของการพรีวิว แปดวันของการส่งมอบ' มีการ์ดข้อมูลสองใบระบุว่า 'Gemini 3.1 Pro: ประกาศเมื่อ 19 กุมภาพันธ์ 2026 ยังคงเป็นพรีวิวเอนด์พอยต์ Intelligence Index 29.7' และ 'GPT-6.1 Sol: เปิดตัวเมื่อ 29 กันยายน 2026 เป็นผลิตภัณฑ์ที่ส่งมอบแล้ว Intelligence Index 51.8' ส่วนท้ายระบุว่า 'ตัวเลขดัชนีอ้างอิงจาก Artificial Analysis, Intelligence Index v4.3.2; ราคาอ้างอิงจาก Google และ OpenAI' และโลโก้ OrcaRouter ที่มุมขวาล่าง
Guides & Insights

GPT-6.1 Sol กับ Gemini 3.1 Pro: เจ็ดเดือนแห่งการพรีวิว เทียบกับแปดวันแห่งการเปิดให้ใช้งานจริง

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

Gemini 3.1 Proอยู่ในรายการราคาของผู้ให้บริการมาแล้วเจ็ดเดือนครึ่ง และไม่เคยหลุดออกจากสถานะพรีวิวเลย ประกาศเปิดตัวเมื่อวันที่ 19 กุมภาพันธ์ 2026 มีเอกสารประกอบในวันนี้ที่เอนด์พอยต์ซึ่งลงท้ายด้วย -preview โดยไม่มีการรับปากว่าจะเปิดให้ใช้งานทั่วไป และ — ที่บอกอะไรได้มากกว่า — ก็ไม่มีกำหนดวันปิดบริการเช่นกัน GPT-6.1 Solมีอายุแปดวัน เปิดตัวเมื่อวันที่ 29 กันยายน 2026 ในราคา 2.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน และ 10.00 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน เมื่อวางสองตัวเทียบกันบน Artificial Analysis Intelligence Index พรีวิวอายุเจ็ดเดือนตัวนี้ไม่ใช่แค่สูสี แต่ยังห่างจากโมเดลที่ใหม่กว่าเพียง 22 คะแนนบนการปรับปรุงดัชนีครั้งล่าสุด — 29.7 เทียบกับ 51.8 บน v4.3.2 — ขณะที่มีต้นทุนต่อหนึ่งงานตามดัชนีแพงกว่า 1.8 เท่า คือ 1.30 ดอลลาร์ เทียบกับ 0.72 ดอลลาร์ การผสมกันแบบนี้เองคือเหตุผลที่การเปรียบเทียบนี้มีความน่าสนใจและไม่ใช่แค่พิธีการ: บนกระดานนี้ โมเดลที่เก่ากว่าทั้งตามหลังในด้านความสามารถและนำหน้าในด้านต้นทุน ซึ่งเป็นทิศทางที่ผิดสำหรับพรีวิวที่ควรจะได้เลื่อนขั้น แต่ข้อควรระวังเรื่องการปรับปรุงดัชนีนั้นสำคัญตรงนี้มากกว่าที่อื่นใดในชุดนี้ เพราะทั้ง 29.7 และ 53 ต่างก็ถูกอ้างอิงบนเว็บไซต์เดียวกัน และมันไม่ใช่การวัดเดียวกัน

ทั้งสองเป็นโมเดลมัลติโมดัลขนาดใหญ่ที่มีหน้าต่างบริบทระดับ 1M ทั้งคู่ Gemini 3.1 Pro รับข้อความ รูปภาพ วิดีโอ เสียง และไฟล์ PDF โดยมีเพดานเอาต์พุตที่ 65,536 โทเคน และมีระดับราคาที่ 200,000 โทเคน ซึ่งหากเกินกว่านั้นอัตราจะเพิ่มเป็นสองเท่า ส่วน GPT-6.1 Sol รับข้อความ รูปภาพ และไฟล์ โดยมีหน้าต่างบริบท 1,050,000 โทเคน เพดานเอาต์พุต 128,000 โทเคน ระดับความเข้มข้นในการให้เหตุผลห้าระดับ และมีระดับบริบทยาวสำหรับพรอมป์ที่เกิน 272,000 โทเคน ตัวหนึ่งเป็นผลิตภัณฑ์ที่วางจำหน่ายจริงพร้อมคำมั่นด้านการสนับสนุน ส่วนอีกตัวเป็นพรีวิวที่มีวงจรชีวิตแบบเปิดกว้าง และความแตกต่างนั้นกลับมีค่ามากกว่าช่องว่างของดัชนีเสียอีก

หมายเลขดัชนีจำเป็นต้องมีเลขที่แก้ไขกำกับไว้ด้วย

Artificial Analysis จะรันชุดการทดสอบของตนใหม่และเผยแพร่คะแนนอีกครั้งภายใต้การแก้ไขดัชนีฉบับปัจจุบัน ซึ่งหมายความว่าโมเดลเดียวกันอาจมีตัวเลขที่แตกต่างกันสองค่า ขึ้นอยู่กับเวลาที่คุณอ่าน สำหรับ Gemini 3.1 Pro ช่องว่างนั้นกว้างเป็นพิเศษ: การรายงานของสำนักข่าวแห่งนี้ก่อนหน้านี้เกี่ยวกับโมเดลนี้รายงานไว้ 57 บนฉบับแก้ไขเก่า ขณะที่หน้าซึ่งเป็นอยู่ในปัจจุบันรายงาน 29.7 บน v4.3.2 ซึ่งเป็นเวอร์ชันที่มีการประเมินสิบครั้ง และยังมีคะแนน 51.8 ของ GPT-6.1 Sol ด้วย ตัวเลขทั้งสองเป็นของจริง และทั้งคู่ปรากฏอยู่บนเว็บไซต์เดียวกัน

ความหมายของสิ่งนี้ต่อการเปรียบเทียบนั้นจำเพาะและสำคัญ เฉพาะตัวเลขจากรีวิชันเดียวกันเท่านั้นที่นำมาลบกันได้ ค่า 29.7 กับ 51.8 จาก v4.3.2 ให้ช่องว่าง 22 จุด ส่วนค่า 57 กับ 51.8 ให้ช่องว่าง 5 จุดในทิศทางตรงกันข้าม ตัวเลข 22 จุดคือตัวที่ควรใช้ที่นี่ เพราะเป็นตัวที่โมเดลทั้งสองถูกวัดด้วยชุดทดสอบเดียวกันบนมาตราเดียวกัน — และเพราะตัวเลขต้นทุนต่องานที่ $1.30 เทียบกับ $0.72 มาจากการรันเดียวกันนั้น

• ดัชนีสติปัญญา, v4.3.2 — GPT-6.1 Sol 51.8 เทียบกับ Gemini 3.1 Pro 29.7

• ค่าใช้จ่ายต่องาน index — GPT-6.1 Sol $0.72 vs Gemini 3.1 Pro $1.30

• ค่าใช้จ่ายในการรันชุดทดสอบทั้งหมด — GPT-6.1 Sol $1,082 เทียบกับ Gemini 3.1 Pro $1,935

• หน้าต่างบริบท — GPT-6.1 Sol 1,050,000 โทเค็น เทียบกับ Gemini 3.1 Pro 1,000,000 โทเค็น

• เอาต์พุตสูงสุด — GPT-6.1 Sol 128,000 โทเค็น เทียบกับ Gemini 3.1 Pro 65,536 โทเค็น

• รูปแบบอินพุต — ข้อความ รูปภาพ และไฟล์บนทั้งคู่ รวมถึงวิดีโอ เสียง และ PDF บน Gemini 3.1 Pro

สองข้อในบรรดาข้อเหล่านั้นสนับสนุนพรีวิว และสมควรกล่าวไว้อย่างตรงไปตรงมา Gemini 3.1 Pro รองรับวิดีโอและเสียง ซึ่ง GPT-6.1 Sol ไม่รองรับ หากไปป์ไลน์ของคุณนำเข้าบันทึกหน้าจอหรือสายสนทนา นั่นคือช่องว่างด้านความสามารถที่ไม่มีคะแนนใดปิดได้ และเพดานเอาต์พุต 65,536 โทเคนของมันคิดเป็นครึ่งหนึ่งของ GPT-6.1 Sol ซึ่งสำคัญต่อการสร้างเนื้อหารูปแบบยาว แต่แทบไม่เป็นข้อจำกัดในงานแบบเอเจนต์ ที่ผลลัพธ์สั้นและมีหลายรอบ

ทำไมตัวเลขที่ใหม่กว่าจึงเป็นตัวที่ควรมีผลต่อการตัดสินใจของคุณ

คำถามเรื่องราคาน่าสนใจกว่าคำถามเรื่องดัชนี

ตารางราคาของ Gemini 3.1 Pro อยู่ที่ $2.00 สำหรับอินพุต และ $12.00 สำหรับเอาต์พุตต่อล้านโทเคน โดยอินพุตที่แคชไว้อยู่ที่ $0.20 และการเขียนแคชอยู่ที่ $0.375 พร้อมจุดแบ่งระดับที่ 200,000 โทเคนพรอมป์ต์ ซึ่งเมื่อเกินกว่านั้นอัตราจะกลายเป็น $4.00 และ $18.00 GPT-6.1 Sol อยู่ที่ $2.00 สำหรับอินพุต และ $10.00 สำหรับเอาต์พุต โดยอินพุตที่แคชไว้อยู่ที่ $0.10 การเขียนแคชอยู่ที่ $2.50 และมีจุดแบ่งที่ 272,000 โทเคน ซึ่งเมื่อเกินกว่านั้นอัตราจะกลายเป็น $4.00 และ $15.00 ราคาอินพุตที่ประกาศไว้เท่ากัน ราคาเอาต์พุตต่ำกว่า 20% สำหรับ GPT-6.1 Sol และขั้นบริบทขนาดยาวต่ำกว่าทั้งสองแกน จุดที่ตารางราคาทั้งสองแตกต่างกันคือแคชชิง: $0.10 เทียบกับ $0.20 ต่อล้านโทเคนอินพุตที่แคชไว้ โดยโมเดลพรีวิวเขียนแคชได้ถูกกว่า ที่ $0.375 เทียบกับ $2.50

A screenshot of the OrcaRouter model page for google/gemini-3.1-pro-preview, credited to Google and dated 2026-02-19, showing the -preview model identifier, text, image, video, audio and file input with text output, a 1M-token context window with a 65K maximum output, and a rate row reading $2.00 input and $12.00 output per million tokens alongside a 10.60-second median time to first token and an 11.3M seven-day traffic figure.

คู่นั้นกลับทิศทางการอ่านแบบผิวเผิน หากปริมาณงานของคุณใช้แคชหนัก — ไม่ว่าจะเป็น system prompt แบบคงที่ยาว ๆ ที่ส่งซ้ำทุกเทิร์น หรือเอกสารที่ถูกอ่านซ้ำตลอดเซสชัน — บรรทัดค่าเขียนแคชของ Gemini 3.1 Pro ถูกกว่าอย่างมาก และบรรทัดค่าอ่านแคชของมันเป็นสองเท่า โมเดลไหนจะชนะนั้นขึ้นอยู่กับว่าคุณอ่านสิ่งที่เขียนไว้ซ้ำกี่ครั้ง และนั่นคือตัวเลขที่บันทึกของคุณเองมีอยู่ แต่ไม่มีเบนช์มาร์กใดเผยแพร่ สิ่งที่ไม่คลุมเครือคือต้นทุนดัชนี: เมื่องานประเมินเหมือนกัน โมเดลอายุแปดวันทำเสร็จถูกกว่า 33% และพรีวิวอายุเจ็ดเดือนทำเสร็จแพงกว่าโมเดลใหม่กว่าโดยรวม 79%

ป้าย Preview คือข้อเท็จจริงเชิงปฏิบัติการ

นี่คือส่วนของการเปรียบเทียบที่ตารางคะแนนไม่อาจบอกเล่าได้ และสำหรับการนำไปใช้งานจริงในสภาพแวดล้อมโปรดักชันแล้ว มันสำคัญยิ่งกว่าทุกสิ่งที่กล่าวมาข้างต้น

Gemini 3.1 Pro อยู่ในสถานะพรีวิวตั้งแต่เดือนกุมภาพันธ์ โดยไม่มีการประกาศเปิดให้ใช้ทั่วไปและไม่มีวันปิดให้บริการ การขาดหายไปทั้งสองอย่างนี้มีความสำคัญ และมันส่งผลในทิศทางที่ตรงกันข้ามกัน การไม่มี GA หมายถึงไม่มีความผูกพันด้านวงจรชีวิต: ปลายทางพรีวิวไม่ได้อยู่ภายใต้ข้อกำหนดการแจ้งเตือนการเลิกใช้เช่นเดียวกับปลายทางที่เปิดให้ใช้ทั่วไป และสามารถถูกแก้ไขภายใต้ผู้เรียกโดยไม่ต้องเพิ่มเวอร์ชัน ซึ่งเป็นเหตุผลมาตรฐานที่ต้องปักหมุดตัวระบุโมเดลที่แน่นอนในโปรดักชันแทนที่จะใช้นามแฝง การไม่มีวันปิดให้บริการหมายความว่าคุณไม่สามารถวางแผนช่วงเวลาการย้ายระบบได้เช่นกัน — โมเดลนี้อยู่มานานกว่าไตรมาสที่ทุกคนคาดว่าจะได้พ้นช่วงพรีวิว และตระกูลนี้เคยปิดโมเดล Pro มาก่อน

ตำแหน่งของ GPT-6.1 Sol เป็นภาพสะท้อนตรงกันข้าม มันมีอายุแปดวัน ซึ่งหมายความว่าบันทึกการประเมินอิสระของมันครอบคลุมเพียงการกำหนดค่าเดียว และโหมดความล้มเหลวของมันไม่มีการบันทึกไว้ ไม่มีคลังข้อมูลของผู้ปฏิบัติงานให้ปรึกษาเมื่อมันทำงานผิดพลาด การเปิดตัวของมันเองคือข่าว และมันถูกส่งมอบภายใต้โครงสร้างการสนับสนุนที่ตัวพรีวิวไม่มี

นั่นคือความเสี่ยงคนละแบบ ไม่ใช่ปริมาณความเสี่ยงที่ต่างกัน หากคุณเลือกพรีวิว คุณกำลังเดิมพันว่าผู้ให้บริการจะยังคงให้บริการเอนด์พอยต์ต่อไปโดยไม่มีข้อผูกมัดตามสัญญาว่าต้องทำเช่นนั้น หากคุณเลือกโมเดลอายุแปดวัน คุณกำลังเดิมพันว่าการรัน benchmark หนึ่งครั้งและความพร้อมใช้งานแปดวันเป็นหลักฐานที่เพียงพอสำหรับเวิร์กโหลดของคุณ ดัชนีจะไม่ช่วยเรื่องใดในสองเรื่องนี้เลย

สิ่งเดียวที่จะทำให้เรื่องนี้ง่าย

การประกาศความพร้อมใช้งานทั่วไปสำหรับ Gemini 3.1 Pro โดยมีตัวระบุโมเดลที่อยู่นอก-previewเนมสเปซ และคำมั่นเกี่ยวกับวงจรชีวิตที่ประกาศไว้ จะช่วยแก้ปัญหาเหล่านี้ได้เป็นส่วนใหญ่ มันจะไม่ปิดช่องว่างดัชนี 22 จุด หรือช่องว่างต้นทุนต่องาน 1.8 เท่า แต่จะขจัดความเสี่ยงจากการเลิกใช้งานที่ทำให้การเปรียบเทียบไม่สมดุลในปัจจุบัน และจะทำให้ทีมนำโมเดลไปใช้ได้โดยไม่ต้องตรึงตัวระบุ preview ไว้แล้วหวัง

การไม่มีการประกาศนั้น เมื่อผ่านไปเจ็ดเดือนครึ่ง ก็เป็นข้อมูลในตัวเอง พรีวิวที่ตั้งใจไว้เพื่อตรวจสอบความถูกต้องของการอัปเดตก่อนเปิดให้ใช้ทั่วไป (GA) “เร็ว ๆ นี้” ตามถ้อยคำของผู้ขายในเดือนกุมภาพันธ์ มีเวลาถึงสองไตรมาสเต็มในการทำเช่นนั้น อย่างใดอย่างหนึ่ง: การตรวจสอบยังดำเนินอยู่ หรือพรีวิวก็คือตัวผลิตภัณฑ์ และผู้เรียกใช้ไม่อาจบอกได้จากภายนอกว่าคืออย่างไหน สิ่งที่ผู้เรียกใช้ทำได้คือประเมินความไม่แน่นอนเป็นต้นทุน และกำหนดเส้นทางตามนั้น

ทั้งคู่อยู่บนคีย์เดียวกัน ดังนั้นคำตอบจึงสามารถแยกตามเวิร์กโหลดได้

A screenshot of OpenAI's developer model page for GPT-6.1 Sol, headed 'GPT-6.1 Sol' with the tagline 'Near-Astra performance for complex work at a lower cost', showing a 1,050,000-token context window with 128,000 max output tokens and an Apr 30, 2026 knowledge cutoff, a price row reading $2 input and $10 output per million tokens, and the note that reasoning.effort supports low, medium (default), high, xhigh and max while none and minimal are not supported.

Gemini 3.1 Pro อยู่บน OrcaRouter ในอัตราที่ประกาศไว้ของตัวเอง — $2.00 / $12.00 ปรับขึ้นเป็น $4.00 / $18.00 เมื่อเกิน 200,000 โทเค็นพรอมป์ต์ โดยการอ่านจากแคชอยู่ที่ $0.20 GPT-6.1 Sol อยู่บน OrcaRouter ที่ $2.00 / $10.00 ปรับขึ้นเป็น $4.00 / $15.00 เมื่อเกิน 272,000 โทเค็นพรอมป์ต์ โดยการอ่านจากแคชอยู่ที่ $0.10 ราคาตามที่ผู้ให้บริการประกาศไว้สำหรับทั้งสองราย ไม่มีบวกเพิ่มใด ๆ คีย์เดียว บิลเดียว

นั่นทำให้ส่วนที่ยุ่งยากของการเปรียบเทียบนี้แก้ไขได้ด้วยต้นทุนต่ำ การนำเข้าวิดีโอและเสียงยังคงอยู่บน preview เพราะไม่มีอย่างอื่นในคู่นี้ที่รับมันได้ งานข้อความและงานเขียนโค้ดที่มีปริมาณสูงจะไปที่โมเดลที่ใหม่กว่า ซึ่งถูกกว่าต่องาน และถูกกว่า 33% เมื่องานประเมินเหมือนกัน หากเอนด์พอยต์ preview ถูกแก้ไขหรือถอนออก การ failover อัตโนมัติจะย้ายการเรียกเหล่านั้นไปยังเส้นทางอื่นแทนที่จะปล่อยให้ล้มเหลว — ซึ่งเป็นมาตรการป้องกันความเสี่ยงเฉพาะที่ความเสี่ยงด้านวงจรชีวิตของ preview ต้องการ และเนื่องจากทั้งสองอยู่เบื้องหลังเอนด์พอยต์เดียวที่เข้ากันได้กับ OpenAI การเปรียบเทียบราคาที่สำคัญจริง ๆ จึงสามารถรันบนทราฟฟิกของคุณเองได้ภายในบ่ายเดียว แทนที่จะต้องมาโต้เถียงกันจากตารางราคา

A generated scoreboard titled 'GPT-6.1 Sol vs Gemini 3.1 Pro — the scoreboard' showing two columns on six shared rows: Intelligence Index 51.8 against 29.7 on v4.3.2; cost per index task $0.72 against $1.30; input price $2.00 against $2.00; output price $10.00 against $12.00; maximum output 128,000 against 65,536 tokens; lifecycle released September 29, 2026 against a preview running since February 19, 2026. A footer reads 'Index and cost figures per Artificial Analysis v4.3.2; prices per OpenAI and Google as listed on OrcaRouter.'

การตีความที่สมเหตุสมผลจึงไม่ใช่ว่าโมเดลไหนดีกว่า แต่คือสองตัวนี้ตั้งราคาไว้ใกล้เคียงกัน ทั้งที่ห่างกันเจ็ดเดือนในแง่วุฒิภาวะของวงจรชีวิต และห่างกัน 22 คะแนนบนบอร์ดจัดอันดับอิสระในปัจจุบัน และข้อได้เปรียบที่แท้จริงของโมเดลพรีวิว — อินพุตวิดีโอและเสียง, การเขียนแคชราคาถูก — นั้นแคบและเฉพาะเจาะจง หากเวิร์กโหลดของคุณต้องการมอดาลิตี้เหล่านั้น Gemini 3.1 Pro คือตัวเลือกเดียวจากทั้งสอง และช่องว่างของดัชนีคือค่าผ่านประตู หากไม่ต้องการ คุณกำลังถูกเสนอเอนด์พอยต์พรีวิวที่มีอนาคตแบบเปิดกว้าง ด้วยต้นทุนต่องานที่สูงกว่าโมเดลที่วางจำหน่ายเมื่อสัปดาห์ที่แล้ว 80% และภาระการพิสูจน์ก็กลับทิศทาง

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube