
Claude Opus 5.5 กับ GPT-6 Sol: ราคาแค่ครึ่งเดียว จนกว่าบริบทจะยาวขึ้น
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 177 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1323 tok/s
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0345ความฉลาด76การเขียนโค้ด
Anthropic และ OpenAI เปิดตัวเรือธงที่แข่งขันกันในบ่ายวันเดียวกัน Claude Opus 5.5เปิดตัวเมื่อวันที่ 22 กันยายน 2026 ในราคา 4 ดอลลาร์ต่ออินพุต 1 ล้านโทเคน และ 20 ดอลลาร์ต่อเอาต์พุต 1 ล้านโทเคน ซึ่งลดลง 20% ทั้งสองระดับจาก Claude Opus 5 GPT-6 Solออกในวันเดียวกันในราคา 2 ดอลลาร์สำหรับอินพุต และ 10 ดอลลาร์สำหรับเอาต์พุต ลดลงตรง ๆ 50% จาก GPT-5.6 Sol ซึ่ง OpenAI อธิบายว่าเป็นการลดแบบถาวร ไม่ใช่โปรโมชัน อ่านแค่สองประโยคนั้น การเปรียบเทียบก็ดูเหมือนจะจบตั้งแต่ยังไม่เริ่ม: โมเดลของ OpenAI ราคาถูกกว่าครึ่ง และครึ่งราคาก็คือครึ่งราคา แต่อ่านตารางราคาที่เหลือของทั้งสองเจ้า แล้วช่องว่างส่วนใหญ่ก็ปิดลง — ไม่ใช่เพราะผู้ให้บริการรายใดเปลี่ยนอะไร แต่เพราะทั้งสองโมเดลคิดค่าธรรมเนียมเพิ่มกับคำขอประเภทเดียวกัน และมันกัดกร่อนข้อได้เปรียบของ Sol ไปมากกว่าที่กัดกร่อนของ Anthropic
การ์ดอัตราค่าบริการสองใบ ทั้งคู่มีขั้นอยู่ในนั้น
เมื่อต่ำกว่า 272,000 โทเค็นอินพุต นี่คือการเปรียบเทียบที่ง่ายที่สุดในแนวหน้าปัจจุบัน:
• อินพุต — GPT-6 Sol $2.00 ต่อล้าน เทียบกับ Claude Opus 5.5 $4.00
• เอาต์พุต — GPT-6 Sol $10.00 ต่อล้าน เทียบกับ Claude Opus 5.5 $20.00
• อินพุตที่แคชไว้ — GPT-6 Sol ถูกลงประมาณ 90% สำหรับส่วนที่แคชไว้ เมื่อเทียบกับ Claude Opus 5.5 ที่ 0.20 ดอลลาร์ต่อล้าน ซึ่งคิดเป็นตัวคูณ 5% ของอินพุตฐาน
• บริบทและเอาต์พุต — GPT-6 Sol 872K ตามการวัดของ Artificial Analysis, 1M ที่อ้างไว้ที่อื่น, เอาต์พุตสูงสุด 128K เทียบกับ Claude Opus 5.5 1M และ 128K
• วันตัดข้อมูล — Claude Opus 5.5 มิถุนายน 2026 เทียบกับ GPT-6 Sol ไม่ได้ระบุไว้ในรูปแบบเดียวกัน
เมื่อเกิน 272,000 โทเค็นอินพุต การคำนวณจะเปลี่ยนไปทั้งสองฝั่ง และไม่เท่ากัน GPT-6 Sol กำหนดราคาใหม่สำหรับคำขอทั้งหมด — ไม่ใช่แค่ส่วนเกิน แต่เป็นทั้งการเรียก — ในอัตราประมาณสองเท่าของอัตราอินพุต และเพิ่มขึ้นอีกครึ่งหนึ่งของอัตราเอาต์พุต ซึ่งอยู่ที่ประมาณ $4.00 สำหรับอินพุต และ $15.00 สำหรับเอาต์พุต ตารางราคาของ Claude Opus 5.5 ไม่มีขั้นบันไดสำหรับบริบทแบบยาว: Anthropic คิดค่าบริการ $4.00 และ $20.00 ตลอดหน้าต่าง 1M โทเค็นเต็ม และระบุว่าคำขอ 900K โทเค็นมีค่าใช้จ่ายต่อโทเค็นเท่ากับคำขอ 9K โทเค็น
พอรวมสองอย่างนี้เข้าด้วยกัน การจัดอันดับก็พลิกกลับในจุดที่คาดไม่ถึง ในการเรียกใช้งานแบบบริบทยาว อัตราค่าอินพุตของทั้งสองโมเดลลู่เข้าหากันที่ประมาณ $4 ข้อได้เปรียบเรื่องราคาถูกครึ่งหนึ่งของ Sol ในส่วนอินพุตหายไปเลย ในขณะที่เอาต์พุตหดช่องว่างจาก 2 เท่าเหลือประมาณ $15 ต่อ $20 ซึ่งเป็นข้อได้เปรียบ 25% ไม่ใช่ 50% Sol ยังคงถูกกว่า มันไม่ถูกพอที่จะเป็นตัวเลขเดียวในการตัดสินใจอีกต่อไป และเหตุผลก็คือค่าธรรมเนียมเพิ่มเติมทั้งสองแบบมีรูปร่างที่ต่างกัน โมเดลของ Anthropic คิดในอัตราคงที่ซึ่งบังเอิญสูงกว่า ส่วนของ OpenAI คิดค่าปรับที่กระหน่ำหนักที่สุดพอดีกับงานแบบเอเจนต์ อ่านรีโพซิทอรี และชุดเอกสาร ซึ่งเป็นงานที่ทั้งสองบริษัทขายโมเดลเหล่านี้ให้

คะแนนอิสระ ซึ่งเป็นเพียงการเปรียบเทียบภายใต้เงื่อนไขเดียวกันเท่านั้น

ไม่มีตารางการเปิดตัวใดที่มีโมเดลใหม่ของอีกฝ่าย — ทั้งสองถูกเขียนขึ้นก่อนที่การเปิดตัวในวันเดียวกันจะเกิดขึ้น — ดังนั้นเอกสารของผู้ขายจึงไม่สามารถจัดอันดับสองตัวนี้ได้เลย Artificial Analysis ทำได้ เพราะมันรันทุกโมเดลในการกำหนดค่าที่เผยแพร่หนึ่งชุด:
• ดัชนีความฉลาด — Claude Opus 5.5 58 อันดับ #1 จาก 210 เทียบกับ GPT-6 Sol 48 อันดับ #18
• ป้ายกำกับการตั้งค่า — ทั้งคู่ได้รับการให้คะแนนที่ระดับความพยายามสูงสุด; Claude Opus 5.5 ยังได้รับป้ายกำกับเพิ่มเติมว่า "Default Fallback"
• ความเร็วเอาต์พุต — GPT-6 Sol 113.3 โทเคน/วินาที อยู่อันดับที่ 38 เมื่อเทียบกับ Claude Opus 5.5 ที่ยังไม่เผยแพร่
• เวลาถึงโทเคนแรก — GPT-6 Sol 142.74 วินาที เทียบกับค่ามัธยฐานของบอร์ดที่ 3.83 วินาที; Claude Opus 5.5 ยังไม่เผยแพร่
• ราคา — GPT-6 Sol $2.00 / $10.00 ต่อล้าน เทียบกับ Claude Opus 5.5 $4.00 / $20.00
สิบจุดดัชนีและสิบเจ็ดอันดับคือช่องว่างที่กว้างที่สุดในการจับคู่ Claude กับ OpenAI ใด ๆ ในปัจจุบัน และมันสวนทางกับโมเดลที่ถูกกว่าเป็นครั้งที่สองในเดือนนี้ — รูปแบบเดียวกันนี้ปรากฏขึ้นเมื่อ GPT-6 Sol เจอกับ Claude Opus 5 ในการเปรียบเทียบก่อนหน้านี้ และแพ้ไปสามจุดทั้งที่มีต้นทุนต่ำกว่า 60% แถวความเร็วให้ผลตรงกันข้าม และสำคัญกว่าที่เห็น: 113.3 โทเคนต่อวินาทีนั้นประมาณสองเท่าของที่ GPT-6 Astra รุ่นเรือธงทำได้ และเป็นตัวเลขที่เร็วที่สุดในกลุ่มนี้ เมื่อรวมกับโทเคนแรกที่ใช้เวลา 142 วินาที โปรไฟล์นี้คือโมเดลที่คิดนานแล้วเขียนเร็ว ซึ่งไม่เหมาะกับงานแบบโต้ตอบใด ๆ และเหมาะสมพอสมควรกับงานรันระยะยาวแบบไม่มีคนเฝ้า
ตัวเลขทั้งสองมีข้อแม้เดียวกันกับที่ตัวเลขของผู้จำหน่ายมี นั่นคือ ทั้งคู่เป็นค่าที่วัดที่ระดับความพยายามสูงสุด และค่าเริ่มต้นที่ใช้งานจริงของทั้งสองโมเดลก็ไม่ใช่ความพยายามสูงสุด Claude Opus 5.5 ตั้งค่าเริ่มต้นไว้ที่ mediumบนมาตรวัดความพยายามที่ไล่จากต่ำไปถึงสูงสุด ส่วน GPT-6 Sol มีมาตรวัดที่ไล่จาก none ไปถึงสูงสุด การใช้ดัชนีที่วัดที่ความพยายามสูงสุดเป็นวิธีที่ยุติธรรมในการเปรียบเทียบเพดานความสามารถ และเป็นวิธีที่ทำให้เข้าใจผิดในการคาดการณ์ค่าใช้จ่ายของคุณ
อะไรพังบ้างเมื่อคุณสลับในทั้งสองทิศทาง
แรงเสียดทานในการย้ายในจุดนี้ไม่สมมาตรกัน และเป็นเรื่องที่ควรรู้ก่อนการตัดสินใจเดินหน้าไม่ว่าทางใด
Claude Opus 5.5 ไม่ใช่รุ่นที่นำมาใช้แทน Claude Opus 5 ได้ทันที ไม่สามารถปิดการคิดวิเคราะห์ได้อีกต่อไป ดังนั้นโค้ดที่กำหนดเส้นทางแบบไม่คิดวิเคราะห์จะเกิดข้อผิดพลาดหรือเปลี่ยนพฤติกรรมไปโดยไม่แจ้งให้ทราบ การบังคับใช้เครื่องมือจะคืนค่าข้อผิดพลาด บล็อกการคิดวิเคราะห์ผูกติดอยู่กับโมเดลและบทสนทนาที่สร้างมันขึ้นมา จึงไม่สามารถนำมาเล่นซ้ำข้ามโมเดลได้ เครื่องมือ computer-use เวอร์ชันเก่า computer_20251124ไม่รองรับบน Claude API หรือ Google Cloud นอกจากนี้ ข้อความระหว่างการเรียกใช้เครื่องมือในตอนนี้จะถูกส่งกลับมาอยู่ในบล็อกการคิดวิเคราะห์ที่ว่างเปล่าเมื่อใช้ค่าการแสดงผลเริ่มต้น ดังนั้นแอปพลิเคชันที่สตรีมข้อความนั้นเป็นความคืบหน้าจะเงียบไปเฉย ๆ ระหว่างการเรียกใช้ โดยไม่เกิดข้อผิดพลาดใด ๆ
สเกลความพยายามของ GPT-6 Sol เป็นตัวที่ยืดหยุ่นกว่าจากทั้งสองแบบ สามารถเปลี่ยนได้กลางบทสนทนาโดยไม่ทำให้แคชพรอมป์ต์ใช้ไม่ได้ ซึ่งหมายความว่าการรันรอบแรกแบบต้นทุนต่ำและการลองใหม่แบบต้นทุนสูงบนบริบทเดิมเป็นรูปแบบที่รองรับได้ ไม่ใช่รูปแบบที่ทำให้แคชพัง นี่เป็นข้อได้เปรียบเชิงวิศวกรรมที่แท้จริงสำหรับใครก็ตามที่รันการให้เหตุผลแบบแบ่งระดับภายในเซสชันเดียว และเป็นข้อสนับสนุนที่แข็งแกร่งที่สุดสำหรับ Sol ที่ไม่ปรากฏในตารางราคาใด ๆ
รันทั้งคู่ และตัดสินใจด้วยตัวเลขของคุณเอง
จุดยืนที่ตรงไปตรงมาต่อการเปรียบเทียบนี้คือ ตารางของผู้ขายไม่อาจตัดสินมันได้ และดัชนีอิสระก็ตัดสินได้เพียงเพดานเท่านั้น สิ่งที่เหลืออยู่คือคำถามเรื่องภาระงาน — ว่าคอนเท็กซ์ของคุณรันนานแค่ไหนจริง ๆ และการพยายามที่ล้มเหลวหนึ่งครั้งมีต้นทุนเท่าไร — และนั่นเป็นสิ่งที่วัดได้จากทราฟฟิกของคุณเอง ไม่ใช่สิ่งที่เอามาเถียงกันจากข่าวประชาสัมพันธ์
ทั้งสองโมเดลสามารถกำหนดเส้นทางได้จาก OrcaRouter ในราคาตามรายการของผู้ให้บริการโดยบวกเพิ่ม 0%: GPT-6 Sol ในราคา $2.00 / $10.00 ของ OpenAI และ Claude Opus 5.5 ในราคา $4.00 / $20.00 ของ Anthropic เนื่องจากการส่งผ่านราคาเป็นไปอย่างแม่นยำตรงตัว และราคาจะเปลี่ยนในวันที่ผู้ให้บริการปรับเปลี่ยน อัตราส่วนที่คุณวัดได้ใน staging จึงเป็นอัตราส่วนที่คุณจ่ายจริงในโปรดักชัน โดยไม่มีชั้นการบวกราคาที่ต้องคำนวณย้อนกลับใหม่ คีย์เดียวใช้ได้กับทั้งสองโมเดล ดังนั้นกฎการกำหนดเส้นทางที่ส่งคำขอต่ำกว่า 272K ไปยัง Sol และส่งคำขอที่มีบริบทยาวไปยังโมเดลใดก็ตามที่ชนะในการประเมินของคุณ จึงเป็นเพียงการเปลี่ยนแปลงการตั้งค่าแทนที่จะเป็นการผสานรวมครั้งที่สอง — และ การสลับไปใช้ระบบสำรองอัตโนมัติหมายความว่าการเปิดตัวในวันเดียวกันของฝ่ายใดฝ่ายหนึ่งเป็นสิ่งที่คุณสามารถส่งทราฟฟิกส่วนหนึ่งไปทดลองได้ แทนที่จะเป็นการเดิมพันด้วยไปป์ไลน์ทั้งหมด

เวอร์ชันของสิ่งนี้ที่รอดจากการปะทะกับบิล
GPT-6 Sol เป็นโมเดลที่ถูกกว่าในทุกรายการ ทุกการกำหนดค่า และนั่นไม่เป็นข้อโต้แย้ง สิ่งที่ไม่คงอยู่คือสมมติฐานที่ว่า "ครึ่งราคา" คือตัวเลขที่ต้องใช้ในการวางแผน เพราะในการเรียกใช้แบบบริบทขนาดยาว อัตราอินพุตมาบรรจบกันที่ประมาณ $4 และช่องว่างเอาต์พุตแคบลงเหลือหนึ่งในสี่ ซึ่งเป็นการตัดสินใจที่ต่างจากที่หน้าเปิดตัวอธิบายไว้ เมื่อชั่งน้ำหนักกับช่องว่างดัชนี 10 จุด อันดับ 17 อันดับ และโทเคนแรกที่วัดได้ 142 วินาที การแบ่งสัดส่วนการใช้งานก็ชัดเจนในตัวเองสำหรับเวิร์กโหลดส่วนใหญ่ — Sol เป็นค่าเริ่มต้นสำหรับปริมาณงานสูงในบริบทสั้นและปานกลาง, Claude Opus 5.5 ในกรณีที่บริบทยาวหรืองานยากพอที่การลองใหม่มีค่าใช้จ่ายสูงกว่าส่วนต่างของโทเคน ข้อผิดพลาดที่ควรหลีกเลี่ยงคือการเลือกหนึ่งในสองนี้โดยดูแค่อัตราที่พาดหัว เพราะตัวเลขตัวที่สองบนตารางราคาของแต่ละโมเดลต่างหากที่ตัดสินกรณีการใช้งานที่ทั้งสองโมเดลถูกสร้างขึ้นมาเพื่อรองรับ
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
