การ์ดฮีโร่ที่สร้างขึ้นสำหรับ GPT-6.1 Sol เทียบกับ Gemini 4 Argon มีหัวข้อว่า 'ห่างกันเพียงครึ่งคะแนน และมีเพียงหนึ่งเดียวเท่านั้นที่วางขาย' พร้อมการ์ดข้อมูลสองใบที่ระบุว่า 'GPT-6.1 Sol: Intelligence Index 51.8, $0.72 ต่องานดัชนี, พร้อมใช้งานแล้ว' และ 'Gemini 4 Argon: Intelligence Index 52.6, $1.99 ต่องานดัชนี, เฉพาะ Fairwind Program, ไม่มี endpoint' ส่วนท้ายระบุว่า 'ตัวเลข Intelligence Index และค่าใช้จ่ายต่องานอ้างอิงตาม Artificial Analysis, Intelligence Index v4.3.2; Gemini 4 Argon ถูกประกาศแล้วแต่ยังไม่พร้อมให้บริการทั่วไป' และโลโก้ OrcaRouter ที่มุมขวาล่าง
Guides & Insights

GPT-6.1 Sol vs Gemini 4 Argon: ห่างกันเพียงครึ่งคะแนน และมีเพียงตัวเดียวเท่านั้นที่วางจำหน่าย

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

ทุกสิ่งที่คุณเปรียบเทียบได้ระหว่าง GPT-6.1 Solกับ Gemini 4 Argon ล้วนวัดค่าได้ และไม่มีสักอย่างที่นำไปใช้ได้จริง เพราะมีเพียงหนึ่งในสองโมเดลนี้เท่านั้นที่ซื้อได้ Gemini 4 Argon ถูกประกาศเมื่อวันที่ 30 กันยายน 2026 ในโพสต์ของ DeepMind ที่ระบุชื่อ Koray Kavukcuoglu เป็นผู้เขียน โดยตั้งราคาเปิดตัวไว้ที่ 2.00 ดอลลาร์ต่อล้านโทเคนอินพุต และ 10.00 ดอลลาร์ต่อล้านโทเคนเอาต์พุต และจะเริ่มทยอยเปิดให้กลุ่มผู้ปกป้องไซเบอร์ที่ระบุชื่อเป็นกลุ่มแรกผ่าน Fairwind Program มันไม่มีตัวระบุโมเดล ไม่มี API endpoint ไม่มีอัตราค่าบริการต่อโทเคนที่เผยแพร่ซึ่งคุณจะถูกเรียกเก็บเงินได้ และไม่มีหน้าสำหรับลูกค้าอย่างคุณให้เข้าถึง GPT-6.1 Sol เปิดตัวเมื่อวันที่ 29 กันยายน 2026 ในราคา 2.00 และ 10.00 ดอลลาร์ และพร้อมใช้งานแล้วตอนนี้ บน Artificial Analysis Intelligence Index ทั้งสองห่างกัน 0.8 คะแนน — Argon 52.6, Sol 51.8 — ซึ่งทำให้คู่นี้เป็นคู่ที่ใกล้กันที่สุดในกลุ่มนี้ และหากดูจากดัชนีเพียงอย่างเดียว ถือว่าเสมอกันสนิท แต่บนมาตรวัดที่ชี้ขาดการนำไปใช้งานจริง หนึ่งในโมเดลเหล่านี้ไม่ได้เป็นตัวเลือกเลยด้วยซ้ำ

ความไม่สมมาตรนั้นไม่ใช่ข้อปลีกย่อยทางเทคนิค และไม่ใช่สัญญาณ มันคือข้อเท็จจริงที่ควรกำหนดว่าการเปรียบเทียบนี้ควรถูกตีความอย่างไร: ตัวเลขของ Argon บรรยายถึงโมเดลที่อยู่ในการทยอยเปิดให้ใช้งานแบบควบคุมกับกลุ่มผู้ใช้เพียงกลุ่มเดียว ขณะที่ตัวเลขของ GPT-6.1 Sol บรรยายถึงผลิตภัณฑ์ที่อยู่ในรายการราคา การเปรียบเทียบทั้งสองก็ยังคุ้มค่าที่จะทำ — Argon คือสิ่งที่ผู้ขายใช้เป็นจุดขายหลักอยู่ในตอนนี้ และผลการวัดของมันบอกสิ่งที่เป็นจริงเกี่ยวกับว่าจุดสูงสุดของสายผลิตภัณฑ์ Gemini อยู่ตรงไหน — แต่ทุกข้อสรุปต้องมีวลี “หากมันซื้อได้” และไม่มีข้อสรุปใดมีวลี “คุณควรเปลี่ยนไปใช้หรือไม่”

ดัชนีอนุญาตให้เปรียบเทียบได้เพียงครั้งเดียวเท่านั้น และมันเป็นการเกือบพลาด

A screenshot of the OrcaRouter model page for openai/gpt-6.1-sol, credited to OpenAI and dated 2026-09-29, showing the model identifier, text, image and file input with text output, a 1,050,000-token context window with a 128K maximum output, and a rate row reading $2.00 input and $10.00 output per million tokens alongside a 4.54-second median time to first token and a 284.2M seven-day traffic figure.

โมเดลทั้งสองปรากฏอยู่บน Artificial Analysis และทั้งคู่มีทั้งคะแนนและบัญชีแจกแจงว่าการสร้างคะแนนนั้นมีต้นทุนเท่าใด

• ดัชนีสติปัญญา v4.3.2 — Gemini 4 Argon 52.6 เทียบกับ GPT-6.1 Sol 51.8 ต่างกัน 0.8 คะแนน

• ค่าใช้จ่ายต่องานจัดทำดัชนี — Gemini 4 Argon $1.99 เทียบกับ GPT-6.1 Sol $0.72 ส่วนต่าง 2.8 เท่าสำหรับ 0.8 คะแนนนั้น

• ค่าใช้จ่ายในการรันชุดทดสอบทั้งหมด — Gemini 4 Argon $2,407 เทียบกับ GPT-6.1 Sol $1,082

• จำนวนโทเค็นเอาต์พุตที่ปล่อยออกมาในชุดทดสอบนั้น — Gemini 4 Argon 110M เทียบกับ GPT-6.1 Sol 67M ความต่างของความเยิ่นเย้อ 1.6 เท่า

• ราคาเปิดตัวที่ระบุไว้ — $2.00 ขาเข้า และ $10.00 ขาออก ต่อล้านโทเค็นสำหรับทั้งสองรุ่น โดยอินพุตที่แคชไว้ลด 95% บน Argon

• หน้าต่างบริบท — GPT-6.1 Sol 1,050,000 โทเค็น; Argon ยังไม่เปิดเผย

บรรทัดที่สี่อธิบายบรรทัดที่สอง ความแตกต่างของต้นทุนต่องาน 2.8 เท่า ณ อัตราที่ประกาศไว้ใกล้เคียงกันมากนั้น มาจากการเขียนโทเค็นมากกว่า 1.6 เท่า ในราคาเอาต์พุตที่เทียบเคียงได้ บวกกับต้นทุนของปริมาณการให้เหตุผลที่อยู่เบื้องหลังไม่ว่าจะมากแค่ไหน Argon ไม่ใช่โมเดลที่แพงเมื่อดูจากการ์ดของมัน แต่มันเป็นโมเดลที่ช่างพูดในการประเมิน และยอดบัญชีก็จบลงที่เอาต์พุต

การกำหนดค่าแตกต่างกัน และทิศทางของความแตกต่างนั้นทำให้โมเดลที่ถูกกว่าดูดีขึ้น แผนภูมิของ Artificial Analysis วัด Gemini 4 Argon ที่การตั้งค่าระดับความพยายามสูง และ GPT-6.1 Sol ที่ระดับสูงสุด — ดังนั้น Sol จึงถูกวัดที่การตั้งค่าที่แพงที่สุด ส่วน Argon ถูกวัดที่ระดับต่ำกว่าขีดสูงสุดของมัน ช่องว่าง 0.8 จุดจึงเป็นการเปรียบเทียบในเวอร์ชันที่เอื้อต่อ Sol อย่างมาก: หากให้ Argon ใช้การตั้งค่าสูงสุดของมัน ช่องว่างน่าจะกว้างขึ้น และหากให้ Sol ใช้การตั้งค่าที่ต่ำลง ต้นทุนของมันก็จะลดลงอีก ไม่ว่าทางใดก็ไม่เปลี่ยนเส้นความพร้อมใช้งาน ซึ่งเป็นเส้นเดียวที่ยุติการตัดสินใจดีพลอย

การอ่านส่วนต่าง 0.8 จุดเลย

ผลต่างต่ำกว่าหนึ่งคะแนนบนคะแนนรวมจากการประเมินสิบรายการไม่ใช่การจัดอันดับ แต่มันคือสองโมเดลที่อยู่ในระดับเดียวกัน

สิ่งที่ดัชนีไม่ได้เผยแพร่สำหรับ Argon คือรายละเอียดองค์ประกอบที่จะทำให้ช่วงคะแนนนั้นอ่านเข้าใจได้ — ว่ามันชนะการประเมินใด จุดใดที่อ่อนแอ และมันมีพฤติกรรมอย่างไรในคะแนนย่อยแต่ละตัวที่ประกอบกันเป็นคะแนนรวม หน้าเพจของ GPT-6.1 Sol มีแถวข้อมูลเหล่านั้น ส่วนของ Argon มีเพียงพาดหัวและค่าใช้จ่าย การเปรียบเทียบที่สร้างจากพาดหัวเพียงอย่างเดียวบอกได้แค่ว่าทั้งสองอยู่ในระดับเดียวกันและไม่มีอะไรอื่น และมันควรพูดเช่นนั้นตรง ๆ แทนที่จะสร้างผู้ชนะขึ้นมาจากส่วนต่าง 0.8 คะแนน

มีข้อมูลภายนอกจุดหนึ่งที่ควรเพิ่มเข้าไป และมันชี้ไปในทิศทางตรงกันข้าม ในการประเมินการเขียนโค้ดโดยบุคคลที่สามซึ่งเผยแพร่หลังการประกาศ Argon อยู่อันดับสามรองจาก GPT-6 Astra และ Claude Opus 5.5 ซึ่งเป็นผลลัพธ์ที่แข็งแกร่งสำหรับโมเดลที่อยู่ระหว่างการทยอยเปิดใช้แบบควบคุม และสอดคล้องกับคะแนน 52.6 ในคะแนนรวม มันยังเป็นเพียงข้อสังเกตเดียวจากการประเมินครั้งเดียว ที่เผยแพร่ในวันแรก ๆ ของการประกาศ ซึ่งทำให้มันเป็นหลักฐานมากกว่าจะเป็นประวัติผลงานที่ผ่านมา ติดป้ายกำกับมันแล้วไปต่อ

การ์ดราคาสองใบนี้มีไว้เพื่ออะไรกันแน่

อัตราที่ระบุไว้สำหรับ Argon ควรได้รับการพิจารณาอย่างรอบคอบมากกว่าแถวดัชนี เพราะในนั้นมีตัวเลขอยู่สองตัว

ราคาช่วงแนะนำคือ $2.00 ต่ออินพุต และ $10.00 ต่อเอาต์พุต โดยอินพุตที่แคชไว้มีส่วนลด 95% ซึ่งบนการ์ดจะทำให้ Argon มีราคาที่เทียบกันได้แบบตรงประเภทกับ GPT-6.1 Sol เชิงอรรถของผู้ขายเองระบุว่า หลังจากช่วงแนะนำที่ไม่ได้นิยามไว้ อัตราจะกลายเป็น $4.00 ต่อโทเค็นอินพุตหนึ่งล้าน และ $20.00 ต่อโทเค็นเอาต์พุตหนึ่งล้าน ราคาคู่ที่สองไม่ใช่สมมติ — มันคือตัวเลขที่ประกาศไว้ซึ่งคาดว่าโมเดลจะลงเอยที่ — และมันไปตกอยู่ที่ราคาตั้งรายการระดับแนวหน้าปัจจุบันพอดี ไม่ใช่ต่ำกว่านั้น การเปรียบเทียบที่อ้างเพียงคู่ราคาช่วงแนะนำกำลังอ้างตัวเลขโปรโมชันสำหรับโมเดลที่ยังไม่เปิดให้ใช้ทั่วไป ซึ่งเป็นความชั่วคราวสองชั้นในบรรทัดเดียว

การ์ดของ GPT-6.1 Sol เป็นวัตถุอีกประเภทหนึ่งที่ตรงกันข้ามโดยสิ้นเชิง $2.00 และ $10.00 เป็นอัตราปกติ ไม่ใช่โปรโมชัน; การปรับขึ้นเป็นอัตราสำหรับบริบทแบบยาวที่ $4.00 / $15.00 เมื่อเกิน 272,000 พรอมป์ต์โทเคนนั้นเผยแพร่แล้วและใช้กับขอบเขตที่กำหนดไว้; อินพุตที่แคชไว้ในราคา $0.10 เปิดใช้งานจริงในวันนี้และคิดค่าบริการได้ ไม่มีสิ่งใดในนั้นที่ต้องมีเชิงอรรถเกี่ยวกับระยะเวลาที่ผู้ให้บริการปฏิเสธที่จะกำหนด

นั่นคือแก่นแท้ที่อยู่เบื้องหลังบรรทัดว่าด้วยความพร้อมใช้งาน ไม่ใช่ว่า Argon เป็นโมเดลที่แย่กว่า — ดัชนีบอกว่าทั้งสองอยู่ในระดับเดียวกัน — แต่เป็นว่าในการ์ดสองใบนี้ ใบหนึ่งคือความมุ่งมั่นผูกพัน ส่วนอีกใบคือความตั้งใจ

การทยอยเปิดตัวนั้นเองคือการเปรียบเทียบ

A screenshot of the Gemini model family page on Google DeepMind's own site, headed 'Our next era of frontier intelligence' with a Gemini 4 Argon card and a Read blog link, captured October 7, 2026. The page carries no model identifier, no endpoint and no per-token price for Argon.

Fairwind Program เป็นส่วนหนึ่งของประกาศของ Argon ที่การเปรียบเทียบทางเทคนิคมักมองข้ามไป และเป็นส่วนที่สำคัญที่สุดในบริบทนี้

ผู้ขายกำลังมอบโมเดลให้กับกลุ่มนักป้องกันไซเบอร์ที่ระบุชื่อเป็นกลุ่มแรกก่อนใครอื่น โดยไม่มีวันที่ประกาศสำหรับการเปิดให้ใช้ทั่วไป ไม่มีรายการรอสำหรับนักพัฒนา และไม่มีตัวระบุที่เผยแพร่ซึ่งลูกค้าสามารถปักหมุดได้ นั่นเป็นวิธีที่ชอบด้วยในการเปิดตัวโมเดลระดับแนวหน้า และไม่ใช่เรื่องแปลกสำหรับความสามารถระดับนี้ นอกจากนี้ยังหมายความว่าทุกข้อกล่าวอ้างเกี่ยวกับต้นทุน ความหน่วง ปริมาณงาน และความน่าเชื่อถือของ Argon บนทราฟฟิกจริงในปัจจุบันยังไม่ได้รับการวัด: ไม่มีทราฟฟิกการผลิตให้วัด การรันเบนช์มาร์กของผู้ขายเองมีอยู่ และคอมโพสิตของ Artificial Analysis ก็มีอยู่ และระหว่างทั้งสองสิ่งนั้นก็คือการประเมินของห้องแล็บหนึ่งแห่งและชุดทดสอบของผู้ประเมินหนึ่งราย นั่นคือบันทึกทั้งหมด

สถิติของ GPT-6.1 Sol เพิ่งมีอายุแปดวันและยังเบาบางในแบบที่ต่างออกไป: การกำหนดค่าอิสระหนึ่งชุด ไม่มีคลังข้อมูลจากผู้ปฏิบัติงาน และผลิตภัณฑ์ที่วางจำหน่ายแล้วซึ่งโหมดความล้มเหลวของมันยังไม่ถูกบันทึกไว้ที่ไหนเลย ไม่มีโมเดลไหนมีหลักฐานรองรับเพียงพอ อย่างไรก็ตาม หนึ่งในนั้นมีใบแจ้งหนี้

แล้วการเปรียบเทียบนี้มีไว้เพื่ออะไร

สามการใช้งาน และไม่มีสักอย่างที่เป็นการตัดสินใจซื้อ

ก่อนอื่น การปรับเทียบ หากคุณกำลังติดตามว่า Argon อยู่ตรงไหนเมื่อเทียบกับ GPT-6.1 Sol นั้น 52.6 เทียบกับ 51.8 ที่ส่วนต่างต้นทุนต่องาน 2.8 เท่า คือคำตอบปัจจุบัน และมันบอกว่าสาย Gemini 4 แข่งขันได้ในด้านความสามารถ ขณะที่ยังกำลังสรุปเงื่อนไขทางการค้าอยู่ จับตาดูว่าอัตราเปิดตัวจะถูกแทนที่ด้วยคู่ราคา $4.00 / $20.00 ซึ่งจะเปลี่ยนการจับคู่ราคาให้กลายเป็นราคาพรีเมียมที่ความสามารถไม่เปลี่ยนแปลง

ประการที่สอง ตำแหน่งแบบตั้งรับ โมเดลที่ถูกประกาศออกมา มีการวัดผล และไม่สามารถกำหนดเส้นทางไปถึงได้ ถือเป็นกรณีที่ชัดเจนที่สุดสำหรับการเก็บชั้นนามธรรมไว้ระหว่างแอปพลิเคชันของคุณกับตัวเลือกโมเดลของคุณ โมเดลทั้งสองตัวในบทความนี้เข้าถึงได้ด้วยวิธีเดียวกันจากฝั่งของเรา: GPT-6.1 Sol อยู่บน OrcaRouter ในราคา $2.00 / $10.00 ของตัวเอง โดยมีอินพุตแบบแคชที่ $0.10 และไม่มีอะไรบวกเพิ่ม ดังนั้นจึงสามารถสร้างเวิร์กโหลดให้ทำงานกับมันได้ตั้งแต่วันนี้ในราคาตามรายการของผู้ให้บริการ หากและเมื่อ Argon ได้รับตัวระบุและตารางราคา การประเมินมันควรเป็นการเปลี่ยนแปลงการตั้งค่ามากกว่าการเขียนใหม่ — และจนกว่าจะถึงตอนนั้น ปริมาณงานวิศวกรรมที่เหมาะสมที่จะลงกับ Argon ก็คือปริมาณที่ทำให้ข้อนั้นยังคงเป็นจริง

ประการที่สาม รายการเฝ้าติดตามที่สามารถพิสูจน์หักล้างได้ สิ่งใดสิ่งหนึ่งต่อไปนี้จะเปลี่ยนบทความนี้จากชิ้นงานแบบ "สิ่งที่เรารู้จนถึงตอนนี้" ให้กลายเป็นการเปรียบเทียบที่นำไปใช้เลือกซื้อได้จริง: ตัวระบุโมเดลในเอกสารสำหรับนักพัฒนา รายการในดัชนีการ์ดโมเดลของมัน โพสต์ประกาศเปิดให้ใช้ทั่วไปพร้อมอัตราต่อโทเคนที่เผยแพร่ หรือการที่ Artificial Analysis เผยแพร่การตั้งค่าที่สองในระดับความพยายามที่แตกต่างกัน จนกว่าหนึ่งในนั้นจะเกิดขึ้นจริง บทความที่อ้างว่า Argon ถูกกว่า เร็วกว่า หรือดีกว่า GPT-6.1 Sol ในการใช้งานจริง ก็กำลังบรรยายโมเดลที่ไม่มีใครนอกกลุ่มใดกลุ่มหนึ่งเคยรัน

A generated scoreboard titled 'GPT-6.1 Sol vs Gemini 4 Argon — the scoreboard' showing two columns on six shared rows: Intelligence Index 51.8 against 52.6 on v4.3.2; cost per index task $0.72 against $1.99; suite cost $1,082 against $2,407; output tokens on the suite 67M against 110M; index effort setting max against high; availability purchasable now against a controlled rollout with no endpoint or identifier. A footer reads 'Index and cost figures per Artificial Analysis v4.3.2; GPT-6.1 Sol pricing per OpenAI; Gemini 4 Argon figures describe an announced model that is not yet generally available.'

บทสรุปที่ซื่อตรงคือประโยคเดียว และมันเกี่ยวกับรูปร่างของคำถามมากกว่าคะแนน Gemini 4 Argon กับ GPT-6.1 Sol ใกล้กันพอบนบอร์ดอิสระเพียงแห่งเดียวที่ทั้งคู่ปรากฏอยู่ จนดัชนีไม่อาจเลือกได้ว่าตัวไหนเหนือกว่า สิ่งที่เลือกแทนได้คือ อันหนึ่งพร้อมใช้จริง อีกอันเป็นเพียงคำสัญญา และคำสัญญาไม่ใช่สิ่งที่คุณจะนำทราฟฟิกโปรดักชันไปชี้ใส่ ติดตาม Argon ไว้ นำ Sol มาใช้ถ้าราคาและโมดัลลิตี้เข้ากับงานของคุณ และรักษาชั้นนามธรรมให้บางพอที่วันที่ Argon กลายเป็นของจริง มันจะเป็นการตั้งค่าบรรทัดเดียว ไม่ใช่โปรเจกต์

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube