
GPT-6.1 Sol Ultrafast เปิดให้ใช้งานผ่าน API, Codex และ ChatGPT Work
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
OpenAI กำลังทยอยเปิดตัวโหมด Ultrafast สำหรับ GPT-6.1 Sol ซึ่งเป็นระดับบริการที่เร็วที่สุดที่บริษัทจำหน่าย และเป็นครั้งแรกที่ระดับ Astra Sol ที่ใกล้เคียงกันมีบริการแบบนี้ การเคลื่อนไหวนี้ทำให้ GPT-6.1 Sol อยู่ในกลุ่มเดียวกับ GPT-6 Astra Ultrafast ทั้งใน API ใน Codex และใน ChatGPT Work และมันมาพร้อมตารางราคาที่ประกาศออกมา แทนที่จะเป็นรายชื่อรอคอย: 12.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเค็น และ 60.00 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเค็น ซึ่งเป็นหกเท่าของราคา GPT-6.1 Sol มาตรฐานพอดี คำกล่าวอ้างเรื่องความเร็วบนฉลากคือ "เร็วสูงสุด 8 เท่า" ส่วนที่น่าสนใจคือวลีนั้นกำลังวัดอะไรอยู่ และคำตอบก็ไม่ใช่โมเดลที่คุณกำลังจะจ่ายเงินซื้อ
บันทึกการเปลี่ยนแปลงสำหรับนักพัฒนามีรายการลงวันที่ 8 ตุลาคมว่า "เพิ่มโหมด Ultrafast สำหรับ GPT-6.1 Sol ใน Responses API ใช้ gpt-6.1-solร่วมกับ service_tier: "ultrafast"เพื่อลดเวลาระหว่างโทเค็นเอาต์พุตที่สร้างขึ้น มีให้บริการแก่ผู้ใช้ API ทุกราย ภายใต้ข้อจำกัดอัตราการใช้งาน โดยประมวลผลแบบทั่วโลกและมีที่ตั้งข้อมูลในสหรัฐฯ และสหภาพยุโรป" หน้าเอกสารของ Ultrafast ขณะนี้ระบุว่า "พร้อมใช้งานอย่างกว้างขวางสำหรับ GPT-6 Astra และ GPT-6.1 Sol โดยมีการเข้าถึงแบบพรีวิวสำหรับ GPT-5.6 Sol" และหน้าด้านความเร็วฝั่ง ChatGPT ยืนยันส่วนของการสมัครสมาชิกว่า Ultrafast ใช้งานได้ใน Codex และ ChatGPT Work บนแพ็กเกจ Pro ราคา $500 และบนแพ็กเกจ Enterprise และ Edu ที่เข้าเกณฑ์
Ultrafast เป็นระดับบริการ ไม่ใช่โมเดลที่สอง
ไม่มีอะไรเปลี่ยนแปลงเกี่ยวกับเวต สเช็กพอยต์เดิม หน้าต่างบริบท 1,050,000 โทเคนเท่าเดิม อินพุตสูงสุด 922,000 โทเคนเท่าเดิม เพดานเอาต์พุต 128,000 โทเคนเท่าเดิม จุดตัดขอบเขตความรู้ 30 เมษายน 2026 เท่าเดิม คำตอบเดิม สิ่งที่คุณกำลังซื้อคือลำดับความสำคัญในการจัดตารางเวลา: โมเดลสร้าง โทเคนได้เร็วขึ้น และกรอบคำอธิบายของ OpenAI เองก็จงใจแคบ — ระดับนี้ "ลดเวลาระหว่างโทเคนเอาต์พุตที่ถูกสร้างขึ้น" มันไม่ได้ทำให้โมเดลฉลาดขึ้น และไม่ได้ทำให้ช่วงการคิดสั้นลง
ความแตกต่างนั้นคือการตัดสินใจทั้งหมด สำหรับลูปของเอเจนต์ที่เรียกใช้เครื่องมือสี่สิบครั้งติดต่อกัน ผลได้จะทบต้นเพราะเอาต์พุตของแต่ละรอบมาถึงเร็วขึ้น สำหรับคำขอการให้เหตุผลที่ยากเพียงครั้งเดียวซึ่งใช้เวลาจริงส่วนใหญ่ไปกับการครุ่นคิด คุณอาจจ่ายแพงขึ้นหกเท่าและยังเห็นสปินเนอร์เหมือนเดิม
พูดง่ายๆ เกี่ยวกับบันไดขั้นระดับ สักครั้ง:
• Batch and Flex — ครึ่งหนึ่งของ Standard ช่องทางราคาถูกสำหรับงานที่ไม่มีใครรอ
• มาตรฐาน — อินพุต $2.00 / แคช $0.10 / เขียนแคช $2.50 / เอาต์พุต $10.00 ต่อล้านโทเค็น
• เร็ว — เป็นสองเท่าของ Standard หรือ $4.00 / $0.20 / $5.00 / $20.00; OpenAI เปลี่ยนชื่อ Priority processing เป็นโหมด Fast เมื่อวันที่ 30 กรกฎาคม 2026
• เร็วพิเศษ — หกเท่าของ Standard หรือ $12.00 / $0.60 / $15.00 / $60.00
• เกิน 272K โทเคนอินพุต — คำขอทั้งหมดจะถูกคิดราคาใหม่ที่อัตราอินพุตและแคช 2 เท่า และเอาต์พุต 1.5 เท่า; Ultrafast long-context อยู่ที่ $24.00 / $1.20 / $30.00 / $90.00
การคำนวณที่ไม่มีใครใส่ไว้บนหน้าเพจการตลาด
ราคาสูงเป็นหกเท่าเพื่อความเร็วที่เพิ่มเป็นแปดเท่าไม่ใช่การแลกเปลี่ยนที่ขาดทุน และก็ไม่ใช่ของฟรี Ultrafast คิดค่าบริการต่อโทเคน งานที่ราคา $1.00 ที่ Standard จะมีค่าใช้จ่าย $6.00 ที่ Ultrafast — และเสร็จเร็วขึ้นประมาณหนึ่งในแปดของเวลา การประหยัดไม่ได้อยู่ที่ใบเรียกเก็บเงิน แต่อยู่ที่เวลาจริงบนนาฬิกา คุณจ่ายเพิ่มห้าดอลลาร์เพื่อลดเวลารอในคิวของงานนั้นลงเจ็ดในแปด และว่านั่นถูกหรือไร้สาระนั้นขึ้นอยู่กับว่าคนหรือไปป์ไลน์ที่รอผลอยู่อีกฝั่งมีมูลค่าต่อนาทีเท่าไร
มีนัยสองประการตามมา และสิ่งเหล่านี้คือสิ่งที่มักถูกมองข้าม:
• งานเชิงโต้ตอบคือคำตอบรับที่ง่ายดาย นักพัฒนาที่นั่งเฝ้าดู diff ถูก merge เข้ามา, เอเจนต์ที่ไม่สามารถดำเนินการต่อได้จนกว่าจะได้อ่านผลลัพธ์ — นั่นคือกรณีที่ความหน่วงคือตัวผลิตภัณฑ์ ผลลัพธ์ที่เร็วขึ้นแปดเท่าในลูปสี่สิบรอบไม่ใช่การปรับปรุงเล็กน้อยต่อการรับรู้ของมนุษย์ แต่เป็นความแตกต่างระหว่างเครื่องมือที่คุณใช้งาน กับเครื่องมือที่คุณปล่อยให้ทำงานเบื้องหลัง
• งานที่ตั้งเวลาไว้และงานแบบแบตช์เป็นคำตอบว่า "ไม่" ที่ง่ายถ้างานหนึ่งมีเวลาถึงเช้าอยู่แล้ว Ultrafast ก็เป็นบิลที่แพงขึ้น 6 เท่าโดยไม่ได้อะไรเลย และเลน Batch ราคาครึ่งหนึ่งก็อยู่ตรงนั้นเอง
อินพุตที่แคชไว้ควรค่าแก่การพิจารณาอีกครั้ง เพราะมันก็เปลี่ยนแปลงไปด้วยเช่นกัน: $0.60 ต่อล้านบน Ultrafast เทียบกับ $0.10 บน Standard ซึ่งยังคงเป็น 5% ของอัตราอินพุตที่ไม่ได้แคช เอเจนต์ที่ใช้พรอมป์ต์แบบแคชซึ่งส่งพรอมป์ต์ระบบขนาดใหญ่ซ้ำในทุกเทิร์นจะพบว่าส่วนลดแคชนั้นปรับไปตามระดับแพ็กเกจ แทนที่จะช่วยปกป้องพวกเขาจากการเปลี่ยนแปลงดังกล่าว

ตัวเลข "สูงสุด 8x" มาจากไหน
นี่คือส่วนที่ต้องอ่านอย่างละเอียด เพราะเป็นจุดที่พาดหัวของ rollout และเอกสารของ rollout กำลังอธิบายสิ่งที่แตกต่างกันอย่างเงียบ ๆ
มาตรวัดความเร็วเฉพาะโมเดลเดียวที่ OpenAI เผยแพร่คือประโยคนี้: "GPT-6 Astra Ultrafast สร้างโทเค็นได้เร็วขึ้นสูงสุด 8 เท่าเมื่อเทียบกับ GPT-6 Astra ในโหมด Standard ใน Codex" นั่นเป็นตัวเลขของ Astra ซึ่งวัดใน Codex ไม่มีตัวคูณที่เผยแพร่เทียบเท่าสำหรับ GPT-6.1 Sol เอกสารที่ครอบคลุม Ultrafast สำหรับโมเดลนี้ระบุว่าช่วยลดเวลาของโทเค็นเอาต์พุตที่สร้างขึ้น และชี้ไปที่ตารางราคา โดยไม่ได้ระบุตัวเลขไว้ หน้าความเร็วฝั่ง ChatGPT พูดซ้ำประโยคของ Astra แล้วจบเพียงเท่านั้น
ดังนั้นการตีความอย่างตรงไปตรงมาของ "เร็วขึ้นสูงสุด 8 เท่า" ก็คือ: มันเป็นพาดหัวของระดับแพ็กเกจนั้น โดยมีที่มาจากโมเดลพี่น้องที่อยู่บน Ultrafast ตั้งแต่วันที่ 29 กันยายน และเป็นคำกล่าวอ้างของผู้ให้บริการที่ไม่มีบุคคลภายนอกอิสระรายใดทำซ้ำได้สำหรับโมเดลใดในสองโมเดลนี้ มันอาจเป็นจริงสำหรับ GPT-6.1 Sol — ทั้งสองรันบนสแตกการให้บริการเดียวกัน และกลไกของระดับนั้นก็เหมือนกัน — แต่ไม่มีใครภายนอก OpenAI ที่เผยแพร่การวัดโทเคนต่อวินาทีสำหรับเวอร์ชัน Sol และคำว่า "สูงสุด" กำลังทำหน้าที่สำคัญจริง ๆ ในประโยคนั้น
นอกจากนี้ยังควรแยกชั้นบริการตามโมเดล เพราะตัวเก่ายังเป็นงานที่ยังไม่เสร็จ Ultrafast ถูกประกาศเมื่อวันที่ 13 สิงหาคม 2026 สำหรับ GPT-5.6 Sol ด้วยความเร็ว "สูงสุด 14 เท่าของการประมวลผลแบบ Standard" ในรูปแบบการทดลองใช้แบบจำกัดสำหรับลูกค้าบางราย สามเดือนต่อมา เอกสารยังคงระบุว่า GPT-5.6 Sol มี "การเข้าถึงแบบพรีวิว" และตารางราคาของ Ultrafast มีเพียงสองแถว — GPT-6 Astra และ GPT-6.1 Sol ตัวเลข 14 เท่าที่ไม่เคยเปิดให้ใช้ทั่วไปและไม่มีอัตราที่เผยแพร่ ถือเป็นคำกล่าวอ้าง ไม่ใช่ผลิตภัณฑ์

ใครกันแน่ที่สามารถเปิดมันได้
ฝั่ง API นั้นกว้าง ฝั่ง subscription นั้นแคบ และความแตกต่างตรงนี้ทำให้หลายคนเข้าใจผิดได้
• API — เปิดให้ผู้ใช้ API ทุกคนใช้งานได้บน gpt-6.1-sol โดยมีขีดจำกัดอัตราการใช้งานแยกต่างหากจาก Standard และ Fast นั่นหมายความว่าคุณต้องคอยจับตางบประมาณอีกก้อนหนึ่ง ไม่ใช่แค่ราคาอีกหนึ่งระดับ
• ขีดจำกัดอัตราการใช้งานที่เร็วสุดขีดสำหรับ GPT-6.1 Sol — 1,000,000 โทเคนต่อนาทีในระดับ Build, 4,000,000 ในระดับ Launch, 40,000,000 ในระดับ Grow OpenAI ปรับลดระดับการใช้งานจากห้าระดับเหลือสามระดับเมื่อวันที่ 6 ตุลาคม ดังนั้นชื่อทั้งสามนี้จึงเป็นบันไดระดับปัจจุบัน ไม่ใช่ระดับที่เลิกใช้ไปแล้ว
• ที่ตั้งข้อมูล — GPT-6.1 Sol รองรับที่ตั้งข้อมูลในสหรัฐฯ และสหภาพยุโรป รวมถึงการประมวลผลแบบทั่วโลก ทั้งภายใต้โหมด Fast และ Ultrafast ส่วน Ultrafast ของ Astra ไม่ได้รับการรองรับที่ตั้งข้อมูลในสหภาพยุโรป ดังนั้นหากเวิร์กโหลดของคุณถูกปักหมุดให้อยู่ในสหภาพยุโรป นี่จึงเป็นคอนฟิกูเรชัน Ultrafast ตัวแรกที่คุณสามารถซื้อได้เลย
• Codex and ChatGPT Work — Ultrafast ใช้งานได้บนแผน Pro ราคา $500 และบนแผน Enterprise และ Edu ที่มีสิทธิ์ ผู้ดูแลระบบ Enterprise จะถูกปิดไว้เป็นค่าเริ่มต้น และต้องเปิดใช้งานเองเป็นรายผู้ใช้หรือรายเวิร์กสเปซ
• Chat — ไม่รวมอยู่ด้วย GPT-6.1 Sol เองอยู่ใน Work และ Codex ส่วน Chat สำหรับผู้ใช้ทั่วไปไม่ได้เป็นส่วนหนึ่งของสิ่งนี้
• วิธีคิดค่าบริการเมื่อใช้กับการสมัครใช้งาน — การใช้งานที่รวมอยู่ในแพ็กเกจจะถูกใช้ในอัตรา 8 เท่าของอัตรา Standard ส่วนเครดิตที่ซื้อเพิ่มหรือการจ่ายตามการใช้งานจริงของ Enterprise จะคิดค่าบริการในอัตรา 6 เท่าของอัตรา Standard ตัวเลขทั้งสองนี้ควรรู้ไว้ก่อนที่คุณจะปล่อยให้เปิดค้างไว้
รายละเอียดในการนำไปใช้เพียงหนึ่งอย่างเป็นตัวกำหนดว่าคุณจะได้เห็นความเร็วที่เพิ่มขึ้นเลยหรือไม่ คำแนะนำของ OpenAI ตรงไปตรงมาในเรื่องนี้ว่า ให้ใช้ WebSockets "โดยเฉพาะกับแอปพลิเคชันแบบ agentic ที่เรียกใช้เครื่องมือหลายครั้งติด ๆ กัน" เพราะ "หากไม่มีการเชื่อมต่อแบบคงอยู่ โอเวอร์เฮดของเครือข่ายอาจลดทอนประโยชน์ด้านความหน่วงที่ได้มา" ถ้าไคลเอนต์ของคุณเปิดการเชื่อมต่อ HTTP ใหม่ทุกครั้งที่เรียกใช้งาน โอเวอร์เฮดต่อคำขออาจกัดกินข้อได้เปรียบทั้งหมดของระดับบริการที่คุณเพิ่งจ่ายแพงขึ้น 6 เท่า HTTP ยังใช้งานได้ เพียงแต่มันอาจไม่คุ้มกับระดับบริการนั้น
สิ่งที่เรากำหนดเส้นทาง และสิ่งที่เราไม่กำหนด
GPT-6.1 Sol ระดับมาตรฐานพร้อมใช้งานบน OrcaRouter ในชื่อ openai/gpt-6.1-solในราคาของผู้ให้บริการเองที่ 2.00 ดอลลาร์สำหรับอินพุต และ 10.00 ดอลลาร์สำหรับเอาต์พุตต่อล้านโทเค็น ให้บริการโดยไม่บวกเพิ่ม 0% — เป็นราคาตามรายการของผู้ขายที่ส่งผ่านมาตรง ๆ ดังนั้นเมื่อ OpenAI ปรับอัตราค่าบริการ การเปลี่ยนแปลงจะไปปรากฏในบิลของคุณในวันเดียวกับที่ขึ้นบนตารางราคา แทนที่จะรอถึงรอบต่อสัญญาครั้งถัดไป คีย์และเอนด์พอยต์เดียวกันรองรับโมเดลมากกว่า 200 รายการดังนั้นการเรียก GPT-6.1 Sol กับการเรียก Claude หรือ Qwen จึงอยู่เบื้องหลังการเชื่อมต่อเดียว พร้อมการสลับไปใช้ตัวสำรองอัตโนมัติและไม่ต้องทำสัญญาที่สอง อีกทั้ง routing DSL จะประกอบโมเดลหลายตัวให้รวมเป็นคำขอเดียวเมื่องานนั้นต้องการความเห็นมากกว่าหนึ่ง
Ultrafast ไม่ใช่หนึ่งในโมเดลเหล่านั้น และการบอกเป็นนัยเป็นอย่างอื่นจะเป็นการทำให้เข้าใจผิด มันเป็นแฟล็ก service-tier บนบัญชี OpenAI — คุณส่ง service_tier: "ultrafast" ไปยัง gpt-6.1-sol และ OpenAI จะเรียกเก็บเงินจากบัญชีของคุณเองในอัตราข้างต้น — ดังนั้นมันจึงอยู่ภายในอินทิเกรชัน OpenAI โดยตรงของคุณ หากคุณเปิดใช้งาน ให้เก็บทราฟฟิกแบบแบ่งชั้นไว้บนคีย์ของผู้ให้บริการของคุณ และส่งทราฟฟิกปริมาณมาตรฐานผ่านเรา นั่นคือการแบ่งที่ซื่อตรง และยังเป็นวิธีที่ถูกกว่าสำหรับสิ่งใดก็ตามที่ไม่ต้องรอมนุษย์

วันนี้จะทำอะไรกับมันดี
ถ้าคุณมีที่นั่ง Codex หรือ ChatGPT Work บน Pro $500 สวิตช์นั้นมีอยู่แล้ว และการทดลองใช้ไม่ได้มีค่าใช้จ่ายใด ๆ ยกเว้นตัวคูณการใช้งาน — ลองรันงานเดียวกันทั้งสองแบบ แล้วดูว่าลูปที่คุณรันจริงมีจำนวนรอบมากพอที่จะทำให้ความเร็วเพิ่มแปดเท่าปรากฏขึ้นหรือไม่ ถ้าคุณใช้ API การทดลองที่คุ้มค่าลงมือทำก็แคบกว่าที่ประกาศไว้เสียอีก: วัดว่าความหน่วงของคุณเป็นส่วนของการสร้างโทเค็นเท่าไร และเป็นส่วนที่โมเดลคิดเท่าไร จากนั้นชี้ Ultrafast ไปที่ส่วนที่มันบีบอัดได้จริง
และหากคุณมีตัวเลือกระหว่าง Fast ที่ 2x กับ Ultrafast ที่ 6x สำหรับคำขอเดียวกัน Fast คือเทียร์ที่มาถึงก่อน และเป็นเทียร์ที่คุณสามารถใช้เหตุผลเกี่ยวกับพฤติกรรมของมันได้จากตารางราคาเพียงอย่างเดียว Ultrafast เป็นของใหม่สำหรับโมเดลนี้ ยังไม่มีใครกำหนดราคาด้วยการวัดอิสระใด ๆ และมีค่าเท่ากับที่นาฬิกาจับเวลาของคุณเองบอกว่ามันมีค่าเป๊ะ ๆ
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
