
GPT-6 Sol Pro vs GPT-6 Astra: ตัวคูณราคาที่ทุกคนอ้างกันนั้นผิด
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
GPT-6 Sol Pro และ GPT-6 Astra เป็นระดับราคาถูกและเรือธงของเจ้าของเดียวกัน และตัวคูณที่สื่อส่วนใหญ่เชื่อมโยงกับช่องว่างนั้นคือ 2.5× มันไม่ใช่ 2.5× GPT-6 Sol — โมเดลของเจ้าของที่การกำหนดค่า gpt-6-sol-pro ใช้งาน โดยเปิดให้ใช้ทั่วไปตั้งแต่ 22 กันยายน 2026 ในราคา $2.00 ต่อล้านโทเค็นอินพุต และ $10.00 ต่อล้านโทเค็นเอาต์พุต — ถูกกำหนดราคาเทียบกับ GPT-6 Astra ซึ่งเป็นเรือธงที่เปิดให้ใช้ทั่วไปเมื่อ 3 กันยายน 2026 ในราคา $10.00 และ $50.00 นั่นคือห้าเท่าสำหรับอินพุตและห้าเท่าสำหรับเอาต์พุต ตัวเลข 2.5× นั้นเป็นของการเปรียบเทียบที่แตกต่างออกไป: Astra วัดเทียบกับ GPT-5.6 Sol ซึ่งเป็นรุ่นก่อนหน้า ซึ่งมีราคา $4.00 และ $20.00
ความสับสนนี้ควรได้รับการแก้ไขก่อนสิ่งอื่นใด เพราะมันเปลี่ยนการตัดสินใจ ส่วนเพิ่มราคา 2.5 เท่าสำหรับรุ่นเรือธงเป็นเพียงความคลาดเคลื่อนจากการปัดเศษในงบประมาณโครงการ แต่ส่วนเพิ่มราคา 5 เท่าเป็นรายการค่าใช้จ่ายรายการเดียวที่ใหญ่ที่สุดในแผนการอนุมานส่วนใหญ่ และเป็นตัวเลขที่กำหนดว่ารุ่นเรือธงจะเป็นค่าเริ่มต้นหรือข้อยกเว้น
ตัวคูณที่ผิดนั้นมาจากไหน
เมื่อ Astra เปิดตัวในวันที่ 3 กันยายน การเปรียบเทียบที่ OpenAI และสื่อส่วนใหญ่ยกมาอ้างอิงนั้นเป็นการเทียบกับ GPT-5.6 Sol ซึ่งเป็นรุ่นระดับกลางที่วางจำหน่ายอยู่ในขณะนั้น Astra มีราคาเป็น 2.5 เท่าของโมเดลนั้น สิบเก้าวันต่อมา OpenAI ก็เปิดตัว GPT-6 Sol และลดราคารุ่นระดับกลางลงครึ่งหนึ่ง จาก $4.00 และ $20.00 เหลือ $2.00 และ $10.00 พร้อมระบุว่าตัวเลขใหม่นี้เป็นราคาถาวร ไม่ใช่ราคาโปรโมชัน หน้าคอมพาเรตแบบ "vs" ทุกหน้าในผลการค้นหาอันดับต้นสำหรับการเทียบคู่นี้ ถูกเขียนขึ้นในช่วงสิบเก้าวันนั้น และเปรียบเทียบ Astra กับโมเดลที่ไม่ได้อยู่ในตำแหน่งนั้นอีกต่อไป
ไม่มีอะไรเกี่ยวกับ Astra เปลี่ยนแปลงไป ระดับที่ต่ำลงมาก็ขยับ และตัวคูณเพิ่มขึ้นเป็นสองเท่า
เรตการ์ดทั้งสองใบ ทีละบรรทัด
ทั้งคู่เป็นตัวเลขที่ OpenAI เผยแพร่เอง โดยถูกส่งผ่านไปโดยไม่มีการเปลี่ยนแปลงจากแพลตฟอร์มที่โฮสต์ตัวเลขเหล่านั้น
• อินพุต — GPT-6 Sol 2.00 ดอลลาร์ต่อล้านโทเค็น เทียบกับ GPT-6 Astra 10.00 ดอลลาร์ต่อล้านโทเค็น
• เอาต์พุต — GPT-6 Sol $10.00 ต่อล้านโทเค็น เทียบกับ GPT-6 Astra $50.00 ต่อล้านโทเค็น
• อินพุตที่แคชไว้ — GPT-6 Sol $0.20 ต่อล้านโทเค็น เทียบกับ GPT-6 Astra $1.00 ต่อล้านโทเค็น; ทั้งคู่คิดอัตราคงที่ 10% ของอัตราที่ไม่แคช
• การเขียนแคช — GPT-6 Sol $2.50 ต่อล้านโทเค็น เทียบกับ GPT-6 Astra $12.50 ต่อล้านโทเค็น ทั้งคู่คิดเป็น 1.25× ของอัตราอินพุตที่ไม่ได้แคช
• การจัดการบริบทแบบยาว — GPT-6 Sol จะคิดราคาคำขอใหม่เมื่ออินพุตเกินเกณฑ์ของตน โดยคิดเป็น 2 เท่าของอัตราอินพุตและแคช และ 1.5 เท่าของอัตราเอาต์พุต สำหรับคำขอทั้งคำขอ; GPT-6 Astra ก็ทำแบบเดียวกันเมื่ออินพุตเกิน 272,000 โทเค็น ในอัตรา $20.00, $2.00, $25.00 และ $75.00
• Batch — GPT-6 Sol ที่ครึ่งหนึ่งของอัตรามาตรฐาน เทียบกับ GPT-6 Astra ที่ครึ่งหนึ่งของอัตรามาตรฐาน, $5.00 และ $25.00 ซึ่งคงอัตราส่วน 5× ไว้อย่างแม่นยำ
• หน้าต่างบริบท — 1,050,000 โทเค็นสำหรับทั้งสอง
• เอาต์พุตสูงสุด — 128,000 โทเค็นสำหรับทั้งสอง
• รูปแบบอินพุต — ข้อความและรูปภาพสำหรับทั้งสอง โดย GPT-6 Astra ยังรองรับการป้อนข้อมูลเป็นไฟล์
• วันตัดขอบเขตความรู้ — GPT-6 Sol 20 เมษายน 2026 เทียบกับ GPT-6 Astra 30 เมษายน 2026 ห่างกันสิบวัน
การ์ดทั้งสองไม่ได้แค่มีโครงสร้างคล้ายกันเท่านั้น แต่เป็นโครงสร้างเดียวกันโดยมีตัวคูณห้าเท่าใช้กับทุกแถว รวมถึงระดับแบตช์และระดับบริบทยาว นั่นเป็นการออกแบบผลิตภัณฑ์โดยเจตนา และหมายความว่าการเลือกระหว่างทั้งสองเป็นการตัดสินใจเรื่องขีดความสามารถอย่างแท้จริง มากกว่าการตัดสินใจเรื่องกลยุทธ์การตั้งราคา ไม่มีการลดราคาใด ๆ ที่จะพบได้จากการเปลี่ยนรูปแบบคำขอของคุณ

มาตรวัดความพยายามคือความไม่สมมาตรที่ไม่มีใครเขียนถึง
โมเดลทั้งสองเปิดให้ใช้งานพารามิเตอร์ความพยายามในการให้เหตุผล บันไดทั้งสองไม่เหมือนกัน และความแตกต่างนี้ส่งผลต่อการย้ายระบบ
ชุดค่าที่มีเอกสารระบุของ GPT-6 Sol คือ none, low, medium, high, xhigh และ max โดยมี medium เป็นค่าเริ่มต้น ส่วนของ GPT-6 Astra คือ low, medium, high, xhigh และ max — ไม่มี none คุณไม่สามารถปิดการให้เหตุผลบนเรือธงได้ หากไปป์ไลน์ของคุณมีขั้นตอนการจำแนกประเภทที่ไวต่อความหน่วง ซึ่งปัจจุบันทำงานที่ effort none ขั้นตอนนั้นไม่สามารถพอร์ตไปยัง Astra โดยไม่แก้ไขได้ จำเป็นต้องปรับแต่งใหม่ ย้ายไปยังโมเดลอื่น หรือยอมรับที่ระดับความหน่วงขั้นต่ำที่สูงขึ้น
นี่เป็นเรื่องเล็ก ๆ ที่กินเวลาทำงานด้านวิศวกรรมจริง ๆ และมันหายไปจากหน้าสรุปเปรียบเทียบทุกหน้าในการเปรียบเทียบคู่นี้ เพราะหน้าเหล่านั้นเขียนขึ้นจากตารางราคา ไม่ใช่จากเอกสาร API
ตัวเลขที่เป็นอิสระ โดยแนบเวอร์ชันดัชนีมาด้วย
Artificial Analysis ได้ปรับ Intelligence Index ใหม่หลายครั้งในปี 2026 และการจับคู่นี้คือจุดที่เรื่องนี้สำคัญที่สุด เพราะคะแนน Astra ที่ถูกอ้างถึงซ้ำมากที่สุดได้ถูกยกเลิกใช้แล้ว
Astra ทำคะแนนได้ 61 บน index เวอร์ชัน v4.1.1 ตอนเปิดตัว — เสมอกับ GPT-5.6 Sol ซึ่งเป็นเหตุผลที่ข่าวเปิดตัวจำนวนมากบรรยายว่าเรือธงรุ่นนี้เป็นเพียงก้าวเล็ก ๆ คะแนน 61 นั้นเป็นของจริง และมันมาจาก index ที่ไม่มีอยู่อีกต่อไปแล้ว บนบอร์ดปัจจุบัน Astra ที่ max effort ทำคะแนนได้ 53 ที่ $3.26 ต่อ index task และที่ high effort ทำคะแนนได้ 51 ที่ $1.73 GPT-6 Sol ที่ max effort ทำคะแนนได้ 48 ที่ $1.06 ต่อ index task และ 43 ที่ high effort ในราคา $0.37
อ่านสี่บรรทัดนั้นพร้อมกัน แล้วรูปร่างของการตัดสินใจก็ปรากฏขึ้น
• ข้อได้เปรียบของ Astra เหนือ Sol ที่จุดสูงสุดของมาตรวัดทั้งสองคือห้าคะแนนดัชนี โดยมีต้นทุนต่อหนึ่งงานที่ทำสำเร็จสูงกว่าประมาณสามเท่า
• Astra ที่ระดับความพยายามสูงมีค่าใช้จ่าย $1.73 ต่องาน Sol ที่ระดับความพยายามสูงสุดมีค่าใช้จ่าย $1.06 รุ่นเรือธงที่รันด้วยการตั้งค่าความพยายามเริ่มต้นมีราคาแพงกว่ารุ่นระดับราคาถูกที่รันเต็มกำลัง และคะแนนดัชนีอยู่ที่ 51 และ 48
• ช่องว่างต้นทุนต่องาน — ประมาณ 3 เท่า — เล็กกว่าช่องว่างของอัตราที่ 5 เท่า เพราะ Sol เป็นตัวที่กินโทเคนมากกว่าของทั้งสองเมื่อคิดต่อหนึ่งงาน นั่นเป็นจุดที่ได้เปรียบ Astra จริง ๆ และเป็นส่วนเดียวของกรอบ "2.5 เท่า" ที่ยังคงทนเมื่อนำไปเทียบกับข้อมูล
มีข้อแม้ด้านความซื่อตรงสองข้อที่ควรแนบมาด้วย ผลเหล่านี้มาจากหน้าต่างๆ ในกลุ่มดัชนีเดียวกัน ไม่ใช่การรันเปรียบเทียบโดยตรงที่เผยแพร่เป็นชุดเดียว และตัวเลขความหน่วงของ Astra เองก็ขึ้นอยู่กับระดับความพยายามมากถึงขนาดที่ตัวเลขเพียงตัวเดียวทำให้เข้าใจผิดได้ — โมเดลเดียวกันรายงานเวลาถึงโทเคนแรกที่วัดได้เป็นหลายสิบวินาทีที่ระดับความพยายามหนึ่ง และหลายนาทีที่อีกระดับความพยายามหนึ่ง อย่าอ้างตัวเลขความหน่วงของ Astra โดยไม่ระบุการตั้งค่า
สิ่งที่เรือธงได้มาในราคา 5 เท่า
ความแตกต่างด้านความสามารถนั้นเป็นเรื่องจริง และมันกระจุกตัวอยู่ในงานด้านเอเจนติกและมัลติโมดัล มากกว่าในด้านการให้เหตุผลทั่วไป
• ดัชนีเอเจนต์เขียนโค้ด — GPT-6 Astra 62 ในฮาร์เนส Codex เทียบกับ GPT-6 Sol 57 โดยอยู่ที่ $7.09 และ $2.99 ต่องานตามลำดับ รุ่นเรือธงใช้โทเคนประมาณหนึ่งในสามต่องาน ซึ่งเป็นเหตุผลว่าทำไมช่องว่างต่องานจึงเล็กกว่าช่องว่างของอัตรา
• Terminal-Bench 4.0 — 59% สำหรับ Astra เทียบกับ 43% สำหรับ Sol บนบอร์ดอิสระเดียวกัน ซึ่งเป็นส่วนต่าง 16 จุดที่ถือเป็นช่องว่างความสามารถรายการเดียวที่ใหญ่ที่สุดระหว่างทั้งสอง
• แถวข้อมูลแบบเอเจนต์ที่ผู้ขายรายงานเอง — ตารางเปิดตัวของ OpenAI เองแสดงว่า Astra นำใน OSWorld 2.0, ScreenSpot-Pro, AutomationBench และ Agents' Last Exam ซึ่งทั้งหมดดำเนินการโดยผู้ขายและไม่มีรายการใดได้รับการทำซ้ำโดยอิสระ ตารางเดียวกันยังแสดงว่า Sol นำใน FrontierMath T1–3 และ BrowseComp ซึ่งน่าสังเกตสำหรับใครก็ตามที่โน้มเอียงจะอ่านตารางของผู้ขายว่าเป็นการกวาดชัยชนะแบบหมดจด
• ท่าทีด้านความปลอดภัย — Astra เป็นโมเดลแรกของ OpenAI ที่ถูกกำหนดให้อยู่ในระดับ Critical ด้านความปลอดภัยไซเบอร์ภายใต้ Preparedness Framework ของบริษัท และความสามารถด้านไซเบอร์เชิงรุกขั้นสูงของโมเดลนี้ถูกจำกัดการเข้าถึงไว้หลังโปรแกรมการเข้าถึงแยกต่างหาก การจำกัดการเข้าถึงนี้มีผลกระทบในสภาพแวดล้อมการผลิตนอกเหนือจากเรื่องสิทธิ์การเข้าถึง: ระบบเฝ้าระวังความไม่สอดคล้องจะทำงานกับคำขอที่ใช้เครื่องมือ และใน API งานที่ถูกตั้งธงจะหยุดลง แทนที่จะหยุดชั่วคราวเพื่อรอการตรวจสอบเหมือนที่ทำในไคลเอนต์สำหรับผู้บริโภค

เวอร์ชันสั้นคือ Astra เก่งกว่าในสิ่งที่ทดแทนได้ยาก — ลูปแบบเอเจนต์ที่ยาวนาน งานเทอร์มินัล การใช้คอมพิวเตอร์ — และอยู่ในระดับใกล้เคียงกับ Sol ในสิ่งที่ทดแทนได้ง่าย คะแนนดัชนี 5 คะแนนของการให้เหตุผลทั่วไปไม่คุ้มกับ 5 เท่า แต่ 16 คะแนนใน Terminal-Bench และช่องว่างของเอเจนต์เขียนโค้ด 5 คะแนน ในงานที่การรันที่ล้มเหลวหนึ่งครั้งทำให้มนุษย์ต้องใช้เวลาหนึ่งชั่วโมงในการเก็บกวาด บางครั้งก็คุ้ม
ที่ที่ชั้นการกำหนดเส้นทางเปลี่ยนการคำนวณ
GPT-6 Astra อยู่บนOrcaRouter ซึ่งมีแคตตาล็อกที่ราคาอินพุต $10.00 และเอาต์พุต $50.00 ต่อล้านโทเคนสำหรับอินพุตที่ต่ำกว่าเกณฑ์ 272,000 โทเคน โดยระดับบริบทยาวอยู่ที่ $20.00 และ $75.00 เมื่อเกินเกณฑ์ดังกล่าว มีหน้าต่างบริบท 1,050,000 โทเคน เพดานเอาต์พุต 128,000 โทเคน และค่า p50 ของเวลาถึงโทเคนแรก 7.82 วินาที ตามที่วัดบนหน้าของโมเดลของเรา ราคาตามรายการของผู้ให้บริการจะถูกส่งผ่านโดยไม่มีส่วนบวกเพิ่ม.
GPT-6 Sol ไม่ใช่หนึ่งในเส้นทางของเรา ดังนั้นไม่มีข้อความใดในที่นี้ที่เป็นการกล่าวอ้างเกี่ยวกับราคาของมันผ่านเรา

อัตราส่วนราคา 5 เท่าเป็นกรณีที่ชัดเจนที่สุดสำหรับการเลือกเส้นทางแทนการเลือกอย่างใดอย่างหนึ่ง คำตอบที่ถูกต้องสำหรับทีมส่วนใหญ่ไม่ใช่ "ตัวเรือธง" หรือ "ระดับราคาถูก" แต่เป็นทั้งสองอย่าง โดยตัดสินใจต่อคำขอ แทนที่จะเป็นต่อไตรมาส งานที่ต้องใช้ Astra สามารถระบุได้ที่จุดเรียกใช้งาน นั่นคือการรันแบบเอเจนต์ งานในเทอร์มินัล ขั้นตอนการใช้คอมพิวเตอร์ ส่วนงานที่ไม่ต้องใช้นั้นคือทุกอย่างที่เหลือ การวางทั้งสองไว้เบื้องหลังคีย์เดียวด้วยการสลับไปใช้งานสำรองอัตโนมัติ ทำให้สิ่งนี้กลายเป็นกฎการเลือกเส้นทางแทนที่จะเป็นการโยกย้าย และหมายความว่าโมเดลราคาแพงจะถูกเรียกใช้เฉพาะเมื่อมันเป็นสิ่งที่ต้องจ่ายเงินเท่านั้น
กฎการตัดสินใจ
• การสร้างข้อความปริมาณมาก การสกัดข้อมูล การจำแนกประเภท และการสรุปความ — GPT-6 Sol ถูกกว่าห้าเท่าในทุกแถว ตามหลังอยู่ 3 คะแนนดัชนีในด้านการให้เหตุผลทั่วไป และเป็นค่าเริ่มต้นที่ถูกต้อง
• การเขียนโค้ดแบบเอเจนต์ งานในเทอร์มินัล และการใช้คอมพิวเตอร์ — GPT-6 Astra สิบหกคะแนนบน Terminal-Bench และห้าคะแนนบนดัชนี coding-agent ในงานที่การรันที่ล้มเหลวแต่ละครั้งต้องวัดกันเป็นชั่วโมงของมนุษย์
• ไปป์ไลน์ที่ปัจจุบันรันขั้นตอนหนึ่งที่ reasoning effort เป็น none — ก็ไม่เช่นกัน หากไม่ปรับจูนใหม่ Astra ไม่มีการตั้งค่า none และขั้นตอนนั้นจะไม่พอร์ตโดยไม่เปลี่ยนแปลง
• งานที่ต้องป้อนไฟล์ควบคู่กับรูปภาพ — GPT-6 Astra ซึ่งเป็นตัวเดียวในสองตัวที่รับไฟล์ได้
• ใครก็ตามที่อ่านว่าเรือธงรุ่นนี้มีส่วนต่างราคา 2.5 เท่า — ลองคำนวณใหม่ที่ 5 เท่า มันยังเป็นรุ่นเดิมในราคาเดิม สิ่งที่ขยับคือระดับที่อยู่ต่ำลงมา และเมื่อใช้ตัวเลขที่แก้ไขแล้ว การตัดสินใจก็เปลี่ยนไป
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
