การ์ดฮีโร่ที่สร้างขึ้นมีชื่อว่า 'GPT-6.1 Sol กับ GPT-6 generation' มีหัวข้อว่า 'หนึ่งรุ่น ราคา 48 เท่า' แสดงสี่ระดับที่ซ้อนกันโดยมีป้ายกำกับว่า GPT-6 Astra (Index 52.7, $3.26 ต่องาน), GPT-6.1 Sol (Index 51.8, $0.72 ต่องาน), GPT-6 Sol (Index 47.6, $1.05 ต่องาน) และ GPT-6 Luna (Index 38.1, $0.07 ต่องาน) โดยมีส่วนท้ายที่ระบุว่า 'Figures: Artificial Analysis v4.3.2.' และโลโก้ OrcaRouter ที่มุมขวาล่าง
Engineering & Research

GPT-6.1 Sol เทียบกับเจเนอเรชัน GPT-6: หนึ่งเดียวในเจเนอเรชัน

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

ผู้ขายได้เพิ่มชื่อที่สี่เข้าสู่สายผลิตภัณฑ์โมเดลของตนเมื่อวันที่ 29 กันยายน 2026 และเรียกมันว่าหนึ่งเจเนอเรชัน และสิ่งที่่น่าสนใจที่สุดเกี่ยวกับเรื่องนี้คือเลขคณิตของไลน์อัป: GPT-6.1 Sol คือเจเนอเรชันทั้งหมด GPT-6 Luna และ GPT-6 Sol ซึ่งเปิดตัวทั้งคู่เมื่อวันที่ 22 กันยายน 2026 ยังคงไม่เปลี่ยนแปลง; GPT-6 Astra ซึ่งเปิดตัวมาตั้งแต่วันที่ 4 กันยายน 2026 ยังคงไม่เปลี่ยนแปลง; การรีเฟรช 6.1 แตะเพียงหนึ่งระดับเท่านั้น ขณะเดียวกัน GPT-6.1 Sol ในราคา $2.00 ต่ออินพุต และ $10.00 ต่อเอาต์พุตต่อล้านโทเค็น ทำคะแนนได้ 51.83 บน Artificial Analysis Intelligence Index ด้วยต้นทุน $0.724 ต่องาน — ห่างจาก GPT-6 Astra เพียง 0.84 คะแนน ซึ่งมีต้นทุน $3.2575 ต่องานที่ราคา $10.00/$50.00 เจเนอเรชันเดียวกันบนฉลาก แต่ภายใต้มีเศรษฐศาสตร์ที่แตกต่างกันถึงสี่แบบ

การนั้นทำให้ "ฉันควรใช้เจเนอเรชัน GPT-6 หรือไม่" กลายเป็นคำถามที่ผิด ไลน์อัปนี้ครอบคลุมช่วง 48 เท่าในด้านต้นทุนต่องาน และช่วง 14.6 คะแนนในด้านความฉลาดที่วัดได้ และคำตอบนั้นขึ้นอยู่กับว่าคุณหมายถึงระดับใดทั้งหมด นี่คือบันไดขั้นต่าง ๆ ที่วัดมาแล้ว

สี่ขั้น ตามที่วัดได้

A chart titled 'The GPT-6 ladder - measured', subtitle 'Artificial Analysis Intelligence Index, and the measured cost of one task', with four horizontal bars whose lengths are proportional to the Intelligence Index: GPT-6 Luna Index 38.1 / $0.068 per task, GPT-6 Sol Index 47.6 / $1.05 per task, GPT-6.1 Sol Index 51.8 / $0.72 per task, GPT-6 Astra Index 52.7 / $3.26 per task; footer 'Bar length is proportional to the Intelligence Index (0-60 scale). All figures: Artificial Analysis v4.3.2.' OrcaRouter logo bottom-right.

• GPT-6 Luna — ดัชนี 38.12, $0.10 / $0.50 ต่อ 1M, $0.01 ที่แคชไว้, $0.0678 ต่องาน, โทเคนเอาต์พุต 50,012, 100.1 วินาทีถึงโทเคนแรก
• GPT-6 Sol — ดัชนี 47.63, $2.00 / $10.00, $0.20 ที่แคชไว้, $1.045 ต่องาน, โทเคนเอาต์พุต 31,000, 124.3 วินาที
• GPT-6.1 Sol — ดัชนี 51.83, $2.00 / $10.00, $0.10 ที่แคชไว้, $0.724 ต่องาน, โทเคนเอาต์พุต 38,128, 332.0 วินาที
• GPT-6 Astra — ดัชนี 52.67, $10.00 / $50.00, $1.00 ที่แคชไว้, $3.2575 ต่องาน, โทเคนเอาต์พุต 27,206, 400.4 วินาที

ทุกตัวมีหน้าต่างบริบทขนาด 1,050,000 โทเคนเท่ากัน และมีเอาต์พุตสูงสุด 128,000 โทเคนเท่ากัน และทุกตัวรับอินพุตเป็นข้อความ รูปภาพ และไฟล์ ระดับต่าง ๆ ไม่ได้แตกต่างกันที่แฟล็กความสามารถ แต่แตกต่างกันที่ปริมาณความคิดที่คุณยอมจ่าย และปลายทั้งสองของบันไดนั้นห่างกัน 48 เท่าในแต่ละงาน

การรีเฟรช 6.1 เปลี่ยนอะไรไปจริง ๆ บ้าง

สามอย่าง และมีเพียงหนึ่งเดียวในนั้นที่เป็นคะแนน

คะแนนขยับจาก 47.63 เป็น 51.83 เพิ่มขึ้น 4.2 จุดในหนึ่งสัปดาห์ อัตราอินพุตที่แคชไว้ลดลงครึ่งหนึ่ง จาก $0.20 เป็น $0.10 ต่อล้าน ซึ่งเป็นเหตุให้ต้นทุนที่วัดได้ต่องานลดลงจาก $1.045 เป็น $0.724 แม้ว่าราคาตามรายการจะเท่าเดิม — ตารางอัตราเดียวกัน แต่บิลต่างกัน และจำนวนโทเค็นเอาต์พุตเพิ่มขึ้นจาก 31,000 เป็น 38,128 ขณะที่เวลาตามนาฬิกาจริงต่องานเพิ่มจาก 321 วินาทีเป็น 640 ซึ่งเป็นจุดเดียวที่การรีเฟรชถอยหลัง และเป็นสิ่งที่มองเห็นได้น้อยที่สุดในสเปกชีตใด ๆ

เมื่อเทียบกับ Astra การเปรียบเทียบนี้คือสิ่งที่ทำให้ผู้คนประหลาดใจ GPT-6.1 Sol มีดัชนีต่ำกว่าตัวเรือธง 0.84 คะแนน และถูกกว่าต่องาน 4.5 เท่า ข้อได้เปรียบที่เหลืออยู่ของ Astra ไม่ใช่คะแนนดัชนีของมัน แต่เป็นชุดการประเมินที่วัดเฉพาะมันเพียงผู้เดียว และความสามารถหนึ่งที่ OpenAI อธิบายว่าเป็นเอกลักษณ์เฉพาะของมัน — การค้นหาช่องโหว่ด้านความปลอดภัยรูปแบบใหม่ ๆ ซึ่งเป็นเหตุผลที่โมเดลนี้ถูกจัดอยู่ในระดับ "critical" ภายใต้ Preparedness Framework ของผู้จำหน่ายเอง และการตั้งค่าที่มีความสามารถสูงที่สุดของมันถูกจำกัดไว้สำหรับพันธมิตรที่ผ่านการตรวจสอบแล้ว

การ์ด OrcaRouter สำหรับ GPT-6 Astra คือปลายสุดระดับเรือธงของบันไดเดียวกัน: $10.00 / $50.00, ค่า p50 ถึงโทเคนแรก 1.64 วินาที, 40.7 ล้านโทเคนในเจ็ดวัน และหน้าต่างบริบท 1,050,000 โทเคนแบบเดียวกันที่ทุกระดับใช้ร่วมกัน

A screenshot of the OrcaRouter model page for openai/gpt-6-astra, showing the $10.00 input and $50.00 output per-million prices, a 1.64 s p50 time to first token, 40.7M tokens over seven days, a 1,050,000-token context window and 128K max output with text/image/file input, above the OpenAI-compatible code sample.

เมื่อเทียบกับ 6.0 Sol การรีเฟรชครั้งนี้แทบจะเป็นการปรับปรุงโดยตรง — ดัชนีมากขึ้น เงินน้อยลง — โดยมีข้อแม้ว่าโมเดล 6.1 เป็นโมเดลที่แตกต่างและไม่ใช่เช็กพอยต์ และมันส่งออกการให้เหตุผลของตัวเองอีกครั้งอย่างละเอียดเยิ่นเย้อกว่า เมื่อเทียบกับ Luna มันไม่ใช่การเปรียบเทียบเลยด้วยซ้ำ: ต้นทุน 10.7 เท่าสำหรับ 13.7 คะแนนดัชนี ซึ่งเป็นการแลกเปลี่ยนที่ดีสำหรับงานหนัก และเป็นการแลกเปลี่ยนที่แย่มากสำหรับงานปริมาณมาก

สิ่งที่ข้อมูลการกำหนดเส้นทางของเราเองบอกว่าตลาดตัดสินใจไปแล้ว

สิ่งหนึ่งที่การเปรียบเทียบนี้มีแต่เอกสารสเปกไม่มี คือมุมมองการใช้งานจริง ในช่วงเจ็ดวันที่สิ้นสุดวันที่ 7 ตุลาคม 2026 บนเลเยอร์การกำหนดเส้นทางของเราเอง GPT-6.1 Sol รับส่ง 284.2 ล้านโทเคน และ GPT-6 Sol ที่มันเข้ามาแทนที่รับส่ง 950 พัน — ความแตกต่าง 300 เท่าสำหรับสองโมเดลที่อายุห่างกันหนึ่งสัปดาห์ ซึ่งนี่คือสิ่งที่การแทนที่ระดับหนึ่งดูเหมือนเมื่อมองจากภายใน GPT-6 Luna ระดับราคาถูก รับส่ง 641.6 ล้าน มากกว่าทั้งสองโมเดล Sol รวมกัน GPT-6 Astra รับส่ง 40.7 ล้าน

ให้ตีความสิ่งนั้นเป็นสามพฤติกรรมที่แยกจากกัน งานปริมาณมากไปที่ระดับราคาถูกในปริมาณที่มากที่สุด งานที่จริงจังรวมศูนย์มาที่ Sol ใหม่ล่าสุดภายในหนึ่งสัปดาห์หลังการเปิดตัว โดยละทิ้งโมเดลที่มันมาแทนที่ และเรือธงยังคงเป็นกลุ่มเฉพาะ: ขั้นที่ความสามารถสูงสุด ถูกใช้น้อยที่สุด โดยทีมที่มีปัญหาซึ่งมีเพียงมันเท่านั้นที่แก้ได้ ไลน์อัปไม่ใช่บันไดที่ผู้คนปีนขึ้นไป แต่มันคือชุดเครื่องมือที่ผู้คนเลือกใช้ และพวกเขาเลือกตามระดับมากกว่ารุ่น

นี่คือเหตุผลว่าทำไมระดับชั้นจึงควรอยู่ในคำขอ ไม่ใช่ในสถาปัตยกรรม

ปัญหาที่เกิดขึ้นจริงของการมีเจเนอเรชันแบบสี่ระดับคือ คำตอบที่ถูกต้องเปลี่ยนไปตามงานและแต่ละสัปดาห์ — ดังที่ตัวเลขทราฟฟิกด้านบนแสดงให้เห็น ตลาดตัดสินใจใหม่ภายในเจ็ดวัน การฮาร์ดโค้ดชื่อโมเดลหนึ่งลงในแอปพลิเคชันคือสิ่งที่เปลี่ยนไลน์อัปให้กลายเป็นพันธะผูกมัด

ทั้งสี่ระดับสามารถเข้าถึงได้ผ่านปลายทาง OrcaRouter เพียงจุดเดียว: API เดียวสำหรับโมเดลมากกว่า 200 รายการ โดยส่งราคาตามรายการของผู้ให้บริการต่อที่มาร์กอัป 0% ส่วนสุดท้ายนั้นมีความสำคัญโดยเฉพาะตรงนี้ เพราะสามในสี่ระดับใช้ราคาตามรายการร่วมกันหรือใช้อัตราแคชที่เคยเปลี่ยนแปลงไปแล้วครั้งหนึ่ง — อัตราแคชของ GPT-6.1 Sol ลดลงครึ่งหนึ่งภายในหนึ่งสัปดาห์หลังเปิดตัว และมิเตอร์แบบส่งผ่านคือสิ่งที่ทำให้สิ่งนั้นปรากฏบนใบแจ้งหนี้ของคุณโดยอัตโนมัติ

A screenshot of the OrcaRouter model page for openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128K max output, text/image/file input with text output, the $2.00 input and $10.00 output per-million prices, a 4.54 s p50 time to first token and 284.2M tokens routed over seven days, above the OpenAI-compatible code sample.

สองคุณสมบัติของ routing layer ควรค่าแก่การกล่าวถึงสำหรับไลน์อัปนี้โดยเฉพาะ routing DSL ทำให้ tier เป็นพารามิเตอร์ของคำขอแทนที่จะเป็นการดีพลอย — cheap tier สำหรับรอบการสกัด, 6.1 Sol สำหรับรอบการให้เหตุผล, Astra เฉพาะสำหรับการเรียกที่ต้องการสิ่งที่ Astra ทำได้เฉพาะตัว และ model fusion ทำให้คณะของโมเดลหลายตัวตอบคำถามหนึ่งข้อร่วมกัน ซึ่งเป็นวิธีที่ตรงไปตรงมาในการใช้โมเดลระดับเรือธงที่คุณไม่สามารถจ่ายเพื่อ route ทุกสิ่งไปที่โมเดลนั้นได้: มันกลายเป็นเสียงหนึ่งในคณะแทนที่จะเป็นค่าใช้จ่ายทั้งหมด

จะทำอย่างไรกับคนรุ่นหนึ่งที่มีเพียงคนเดียว

อย่าซื้อเจเนอเรชัน จงซื้อเพียงขั้นเดียว แล้วซื้อซ้ำเมื่อขั้นเหล่านั้นขยับ

สำหรับงานปริมาณสูงและที่ไวต่อความหน่วง GPT-6 Luna ที่ราคา $0.0678 ต่องาน และ 100 วินาทีถึงโทเคนแรก คือระดับที่รับปริมาณการใช้งานมากที่สุดอยู่แล้ว และราคาก็ต่ำกว่าสิ่งอื่นใดบนบันไดอยู่หนึ่งลำดับขนาด สำหรับการให้เหตุผลทั่วไปและการเขียนโค้ด GPT-6.1 Sol ตอนนี้คือค่าเริ่มต้นที่โมเดล 6.0 เคยเป็น — ราคาตามประกาศเท่าเดิม ดัชนีดีขึ้น ค่าแคชครึ่งหนึ่ง และเวลาในการทำงาน 640 วินาทีคือสิ่งหนึ่งที่ต้องทดสอบกับปริมาณงานของคุณเองก่อนจะถือว่าการอัปเกรดนี้ไม่มีค่าใช้จ่าย สำหรับงานที่ต้องใช้การวัดระดับแนวหน้า หรืองานด้านความปลอดภัยที่มีเพียงเรือธงเท่านั้นที่ทำได้ GPT-6 Astra ยังคงเป็นขั้นเดียวที่ทำสิ่งเหล่านั้นได้ ด้วยต้นทุน 4.5 เท่าของขั้นที่ต่ำลงมา

สิ่งที่ต้องจับตาคือว่า การรีเฟรช 6.1 จะครอบคลุมระดับอื่น ๆ ด้วยหรือไม่ ถ้า Luna หรือ Astra ได้รับการดูแลแบบเดียวกัน โครงขั้นบันไดก็จะเปลี่ยน และการคำนวณต่องานในบทความนี้ก็จะเปลี่ยนตามไปด้วย จนกว่าจะถึงตอนนั้น "GPT-6.1" คือชื่อของโมเดลเดียว และการมองมันเป็นเรือธงก็คือสาเหตุที่ทีมต่าง ๆ ลงเอยด้วยการจ่ายราคาระดับเรือธงเพื่องานสกัด

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube