
GPT-5.6 Sol Ultrafast: Ultrafast เปิดให้ใช้งานแล้วในราคา 6 เท่าของราคามาตรฐาน แต่โมเดลนี้ยังเป็นเพียงเวอร์ชันพรีวิวเท่านั้น
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 362 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
การรอคอยสิ้นสุดลงแล้วสำหรับเทียร์นี้ แต่ไม่ใช่สำหรับโมเดลนี้ ณ งาน DevDay เมื่อวันที่ 29 กันยายน 2026 ผู้ให้บริการได้เปลี่ยน Ultrafast ให้กลายเป็นสิ่งที่คุณซื้อได้: แผน ChatGPT Pro 500 ใหม่ในราคา 500 ดอลลาร์ต่อเดือนมาพร้อมกับมันเป็นแพ็กเกจ ส่วน API ตอนนี้เผยแพร่ตารางราคา Ultrafast ที่อัตราหกเท่าของอัตรามาตรฐาน — 60.00 ดอลลาร์สำหรับอินพุต / 300.00 ดอลลาร์สำหรับเอาต์พุตต่อล้านโทเคนบน GPT-6 Astra — และเอกสาร Codex ของผู้ให้บริการยืนยันว่าเทียร์ Pro ไม่มีขีดจำกัดการใช้งานห้าชั่วโมงเลย ซึ่งเป็นหน้าต่างเวลาที่ใช้กับ Plus ทั้งหมดนี้เป็นข้อมูลที่ผู้ให้บริการระบุไว้ เผยแพร่บนสรุป DevDay หน้าช่วยเหลือ และเอกสารสำหรับนักพัฒนาของผู้ให้บริการเอง สิ่งที่ยังไม่ขยับคือโมเดลที่หน้านี้พูดถึง GPT-5.6 Sol Ultrafast ซึ่งประกาศเมื่อวันที่ 13 สิงหาคม 2026 ในฐานะเทียร์การให้บริการที่เร่งความเร็วด้วย Cerebras สำหรับ GPT-5.6 Sol ที่ความเร็วสูงสุด 14 เท่าของมาตรฐานและ 750 โทเคนเอาต์พุตต่อวินาที ยังคงเป็นแบบเข้าถึงผ่านการพรีวิวเท่านั้น — ซึ่งจัดผ่านทีมดูแลบัญชีของผู้ให้บริการ — และยังไม่มีราคาที่เผยแพร่ของตัวเอง เทียร์นี้เปิดให้บริการแล้ว ส่วนตัวแปร Sol ยังคงรออยู่
การปรับราคาสองครั้งเกิดขึ้นนับตั้งแต่ที่เราเขียนเรื่องนี้ครั้งแรก และทั้งสองชี้ไปในทิศทางที่ตรงกันข้าม โมเดลที่เป็นรากฐานมีราคาถูกลง: GPT-5.6 Sol มาตรฐานตอนนี้คิดค่าบริการที่ $4.00 ต่อล้านโทเค็นอินพุต และ $20.00 ต่อล้านโทเค็นเอาต์พุต — ซึ่งเป็นอัตราโปรโมชันของ OpenAI ที่ผู้ขายระบุว่ามีให้ใช้อย่างน้อยถึงวันที่ 21 พฤศจิกายน 2026 — ไม่ใช่ $5.00 / $30.00 ที่เป็นอัตราปัจจุบันในเดือนสิงหาคม ชั้นความเร็วที่อยู่เหนือขึ้นไปเพิ่งมีราคาเป็นครั้งแรก และมันไม่ถูกเลย: Ultrafast บน GPT-6 Astra คิดค่าบริการที่ $60.00 / $300.00 ต่อล้าน ตัวเลขทุกตัวในบทความนี้ได้รับการตรวจสอบซ้ำกับตารางอัตราค่าบริการที่เผยแพร่ของ OpenAI เอกสารอ้างอิง API และเอกสารราคาของ Codex เมื่อวันที่ 2026-09-30
โหมด Ultrafast จริงๆ แล้วคืออะไร
Ultrafast เป็นระดับการให้บริการ ไม่ใช่โมเดลใหม่ OpenAI ประกาศเปิดตัวเมื่อวันที่ 13 สิงหาคม 2026 ในฐานะผลิตภัณฑ์แรกจากความร่วมมือด้านการประมวลผลกับผู้ผลิตชิป Cerebras ที่เริ่มขึ้นเมื่อเดือนมกราคม 2026 ซึ่งเป็นดีลที่มีรายงานว่ามีมูลค่าราว 1 หมื่นล้านดอลลาร์ตลอดระยะเวลาสามปี โดยที่การอนุมานแบบมาตรฐานของ GPT-5.6 Solนั้นทำงานบนคลัสเตอร์ GPU และใช้เวลาส่วนใหญ่ไปกับการเคลื่อนย้ายค่าถ่วงน้ำหนักระหว่างหน่วยความจำกับการประมวลผล ส่วน Ultrafast จะโหลดค่าถ่วงน้ำหนักของโมเดลเข้าไปใน SRAM บนชิปขนาด 44 GB บนชิปแบบเวเฟอร์สเกลของ Cerebras โมเดลขนาดเท่า Sol ต้องใช้พื้นที่หลายเวเฟอร์ซ้อนกันเป็นชั้น ๆ ค่าถ่วงน้ำหนักจึงอยู่ตรงจุดที่มีการประมวลผลพอดี ผลลัพธ์คือเพดานอัตราการประมวลผลที่ถูกกำหนดโดยซิลิคอน ไม่ใช่โดยแบนด์วิดท์ของหน่วยความจำ
เรื่องราวด้านฮาร์ดแวร์เดินหน้าต่อไปเมื่อวันที่ 2026-08-18 ในงาน Supernova Cerebras ได้เปิดตัว CS-4 ระบบระดับแร็ก (rack-scale) เจเนอเรชันถัดไปที่สร้างบนแพลตฟอร์ม Nexus — มีชิป Wafer-Scale Engine สามตัวต่อหนึ่งแร็ก ความเร็วในการสร้างโทเคนสูงถึง 2 เท่าของ CS-3 รุ่นก่อนหน้า และตามข้อมูลของ Cerebras มากกว่า 1,000 โทเคนต่อวินาทีบนโมเดลที่มีพารามิเตอร์มากกว่า 10 ล้านล้านตัว เหล่านี้คือคำกล่าวอ้างของ Cerebras สำหรับระบบที่อยู่ในช่วง early access ซึ่งยังไม่เปิดให้ใช้งานโดยทั่วไป นับตั้งแต่การเปิดตัว มีโพสต์เพียงโพสต์เดียวบน X อ้างว่า CS-4 ให้บริการ GPT-5.6 Sol แล้วที่ความเร็วประมาณ 1,300 โทเคนต่อวินาที — ทิศทางสอดคล้องกับตัวเลขของ Cerebras เอง แต่ยังไม่มีใครยืนยัน จงมองเป็นสัญญาณเริ่มต้น: เป็นไปได้ ยังไม่ได้รับการยืนยัน และควรตรวจสอบอีกครั้งก่อนวางแผนความจุโดยอิงจากข้อมูลนี้
ส่วนที่สำคัญสำหรับโค้ดของคุณ: รหัสโมเดล ค่าน้ำหนัก พฤติกรรมการให้เหตุผล และเอาต์พุตเหมือนกับ GPT-5.6 Sol มาตรฐาน OpenAI วางตำแหน่ง Ultrafast ว่าเป็น 'งานที่มีประโยชน์มากขึ้นต่อวินาที' มากกว่าระดับคุณภาพ และพรีวิวนั้นรันโมเดลเรือธงเต็มรูปแบบ — ความเร็วไม่ได้มาจากการสลับไปใช้โมเดลที่ใช้ต้นทุนต่ำกว่า สิ่งที่เปลี่ยนไปคือความเร็วที่โทเคนออกมา
อย่าสับสน Ultrafast กับ fast mode Fast mode เป็นระดับแยกต่างหากที่ซื้อเพิ่มได้บนฮาร์ดแวร์มาตรฐาน: ความเร็วเอาต์พุตสูงสุดประมาณ 2.5 เท่า ในราคาเพิ่ม 2 เท่าต่อโทเคน โดยคุณภาพไม่เปลี่ยนแปลง — ถูกเปลี่ยนชื่อจาก Priority Processing เมื่อวันที่ 30 กรกฎาคม 2026 และบน GPT-5.6 Sol ราคาอยู่ที่ $8.00 อินพุต / $40.00 เอาต์พุต ต่อ 1M Ultrafast เป็นอีกเรื่องหนึ่ง — ฮาร์ดแวร์ Cerebras สูงสุด 14 เท่าบน GPT-5.6 Sol และสูงสุด 8 เท่าบน GPT-6 Astra โดยคิดราคา 6 เท่าของอัตรามาตรฐานบน Astra และยังไม่ประกาศราคาบน Sol สองชื่อนี้ตอนนี้อยู่ติดกันในตัวเลือกโมเดลเดียวกัน ซึ่งยังคงเป็นสิ่งที่สร้างความสับสนมากที่สุดในรีลีสนี้
รวดเร็วแค่ไหน — ตัวเลขที่สำคัญ

ตัวเลขหลักคือ 14× และจำเป็นต้องมีคำนิยาม OpenAI กล่าวว่า Ultrafast สร้าง output tokens ได้สูงสุด 750 tokens ต่อวินาที เทียบกับการประมวลผล GPT-5.6 Sol แบบมาตรฐาน นั่นเป็นตัวเลขปริมาณงาน (throughput) สำหรับ output tokens ไม่ใช่การอ้างว่า "ทุกอย่างทำงานเร็วขึ้น 14×" — เวลาที่ใช้ในการร้องขอแบบ end-to-end ยังรวมถึงการประมวลผลอินพุตและการใช้เหตุผลของตัวแบบเอง ด้วยเหตุนี้ 14× จึงถูกระบุว่าเป็นค่าสูงสุด
• ปริมาณการส่งออกสูงสุด — สูงถึง 750 โทเคนเอาต์พุตต่อวินาที ตามประกาศของ OpenAI (2026-08-13)
• เมื่อเทียบกับการประมวลผลแบบมาตรฐาน — เร็วขึ้นสูงสุดถึง 14 เท่า ตามประกาศเดียวกัน; ผลประโยชน์ที่ได้จริงจะแตกต่างกันไปตามความยาวของอินพุตและประเภทของงาน
• Humanity's Last Exam คำถาม 2,500 ข้อ — OpenAI/Cerebras รายงานว่า GPT-5.6 Sol Ultrafast ทำเสร็จภายใน 11 ชั่วโมง 11 นาที เทียบกับ 78 ชั่วโมง 27 นาทีของ Claude Fable 5 โดยมีความแม่นยำใกล้เคียงกัน เป็นข้อมูลที่ผู้ขายรายงานเอง และการเปรียบเทียบนี้ครอบคลุมสแตกฮาร์ดแวร์ของผู้ขายสองราย — ควรอ่านเป็นทิศทาง ไม่ใช่คำตัดสิน
• GDP-Val, แบบครบวงจร — Cerebras รายงานว่าเร็วกว่าโดยรวม 5.6 เท่า โดยไม่มีความสูญเสียคุณภาพที่วัดได้ ทั้งยังเป็นข้อมูลที่ผู้ขายรายงานเอง
• เมื่อเปรียบเทียบโหมด Fast กับ Ultrafast — โหมด Fast ให้ความเร็วเอาต์พุตสูงสุดประมาณ 2.5 เท่า โดยแลกกับราคาที่แพงขึ้น 2 เท่า และถูกจำกัดที่ขอบเขต ~272K โทเคนเดียวกันกับราคามาตรฐาน ส่วน Ultrafast เป็นการก้าวกระโดดที่ใหญ่กว่า: 14 เท่าบน GPT-5.6 Sol ตามประกาศเดือนสิงหาคม และสูงสุด 8 เท่าบน GPT-6 Astra ใน Codex ตามเอกสารปัจจุบันของ OpenAI โดยช่วงเปิดตัวระบุว่าอยู่ที่สูงสุด 300 โทเคนเอาต์พุตต่อวินาที
• CS-4 ฮาร์ดแวร์รุ่นถัดไป — Cerebras อ้างว่าแร็ค CS-4 ทำได้มากกว่า 1,000 โทเคนต่อวินาทีกับโมเดลที่มีพารามิเตอร์มากกว่า 10 ล้านล้าน ซึ่งสูงถึง 2 เท่าของการสร้างโทเคนของ CS-3 รายงานจากชุมชนที่ไม่ได้รับการยืนยันระบุว่า GPT-5.6 Sol บน CS-4 ทำได้ประมาณ 1,300 โทเคนต่อวินาที — เป็นไปในทิศทางเดียวกัน แต่ยังไม่ได้รับการยืนยันจาก OpenAI หรือ Cerebras
ข้อควรระวังหนึ่งข้อก่อนที่คุณจะอ้างอิง 14×: มันเป็นเพดานปริมาณงานส่งออกบนฮาร์ดแวร์ของผู้จำหน่ายรายหนึ่ง และการเปรียบเทียบอิสระของการเปิดตัวในเดือนสิงหาคมมีช่วงตั้งแต่ประมาณ 7× ถึง 11× ขึ้นอยู่กับว่าวัดส่วนใดของเวิร์กโหลด หลักการเดียวกันนี้ใช้กับสัญญาณความเร็วของ CS-4 — ตัวเลข ~1,300 โทเคน/วินาที สำหรับ GPT-5.6 Sol บน CS-4 เริ่มต้นจากโพสต์บน X เพียงโพสต์เดียว และทั้ง OpenAI และ Cerebras ยังไม่ได้ยืนยันตัวเลขนี้ ให้ถือว่าทั้งหมดนี้เป็นคำกล่าวอ้างของผู้จำหน่ายและชุมชน ไม่ใช่คำตัดสินจากเบนช์มาร์ก
Ultrafast มีค่าใช้จ่ายเท่าไหร่ในตอนนี้ — และทำไมสิ่งนั้นยังไม่กำหนดราคาให้ Sol

นี่คือสถานะของคำถามเรื่องราคา ณ วันที่ 2026-09-30 กล่าวอย่างตรงไปตรงมา Ultrafast มีอัตราที่ประกาศไว้ — สำหรับ GPT-6 Astra และเฉพาะ GPT-6 Astra เท่านั้น หน้าตาราคาของ OpenAI ตอนนี้มีคอลัมน์ Ultrafast อยู่เคียงข้าง Standard, Batch, Flex และ Fast: อินพุต $60.00 / อินพุตที่แคชไว้ $6.00 / การเขียนแคช $75.00 / เอาต์พุต $300.00 ต่อล้านโทเคนในบริบทสั้น ซึ่งเพิ่มเป็นสองเท่าเป็น $120.00 / $12.00 / $150.00 / $450.00 เมื่อเกินประมาณ 272K โทเคน นั่นคือหกเท่าของอัตรา Astra มาตรฐาน โดยที่โหมด fast อยู่ที่สองเท่า — และเป็นตัวเลขที่ชัดเจนตัวแรกที่ OpenAI กำหนดให้กับระดับนี้ การ์ดด้านบนเป็นสแนปช็อตของเราเอง ณ วันที่ 2026-08-18 และตัวเลขดอลลาร์ของมันถูกลบล้างไปแล้วสองต่อ โดยการลดอัตรามาตรฐาน และตอนนี้โดยแถว Ultrafast นี้ สิ่งที่ยังขาดจากตารางนั้นคืออัตรา Ultrafast สำหรับ GPT-5.6 Sol: คอลัมน์ Ultrafast ระบุโมเดลเพียงหนึ่งเดียวเท่านั้น คือ gpt-6-astra ระดับนี้มีราคาแล้ว โมเดลนี้ยังไม่มี
สิ่งที่คุณตั้งราคาได้วันนี้ แยกตามรุ่น:
• Standard GPT-5.6 Sol — $4.00 อินพุต / $20.00 เอาต์พุต ต่อ 1 ล้านโทเคน สำหรับพรอมป์ต์สูงสุดประมาณ 272K โทเคน OpenAI ระบุว่านี่เป็นราคาโปรโมชันที่ใช้ได้อย่างน้อยถึงวันที่ 21 พฤศจิกายน 2026 นี่คือราคาพื้นฐานที่คุณสามารถเรียกใช้ได้ตอนนี้
• โหมดเร็ว — $8.00 / $40.00 สำหรับบริบทสั้นบน GPT-5.6 Sol และเพิ่มเป็นสองเท่าเป็น $16.00 / $60.00 เมื่อเกินประมาณ 272K โทเคน คิดเป็นสองเท่าของอัตรามาตรฐานเพื่อความเร็วเอาต์พุตสูงสุดประมาณ 2.5 เท่า และบน Sol มันยังคงเป็นสิ่งที่เร็วที่สุดที่คุณซื้อได้จริง
• Prompt cache — การอ่านแคชคิดค่าบริการ $0.40 ต่อ 1M (ลด 90% จากอินพุตใหม่); การเขียนแคชคิดค่าบริการ $5.00 ต่อ 1M
• ระดับบริบทขนาดยาว — อินพุตที่เกินประมาณ 272K โทเค็นจะถูกคิดค่าบริการที่ $8.00 / $30.00 ในการประมวลผลมาตรฐาน ซึ่งอยู่ภายในหน้าต่าง ~1.05M โทเค็นของโมเดล และเอาต์พุตสูงสุด 128K โทเค็น
• Batch API — $2.00 / $10.00 สำหรับบริบทสั้น และ $4.00 / $15.00 สำหรับบริบทยาว, ลด 50% แบบคงที่ ด้วยระยะเวลาดำเนินการประมาณ 24 ชั่วโมง
สำหรับ GPT-5.6 Sol ตัวเลข Astra เป็นเพียงเบาะแสที่ดีที่สุดที่มีและไม่มีอะไรมากไปกว่านั้น OpenAI ตั้งราคา Ultrafast ไว้ที่ 6 เท่าของอัตรามาตรฐานของโมเดลพื้นฐาน เมื่อนำตัวคูณนั้นไปใช้กับราคา $4 / $20 ของ Sol จะได้ $24 / $120 ต่อล้าน นั่นคือการคำนวณทางคณิตศาสตร์ ไม่ใช่ราคาที่ประกาศอย่างเป็นทางการ OpenAI ไม่ได้กล่าวอะไรเกี่ยวกับอัตราค่าใช้จ่ายของ Sol Ultrafast และกลุ่มผู้ใช้ช่วงพรีวิวในเดือนสิงหาคมก็ไม่ได้ถูกคิดค่าบริการในอัตราระดับ tier เลย วางแผนโดยอิงกับ Sol มาตรฐานที่ $4 / $20 หรือโหมดเร็วที่ $8 / $40 ไปก่อน จนกว่าผู้ให้บริการจะประกาศแถวราคานั้น
วิธีใช้งาน — พร้อมใช้งานอย่างกว้างขวางบน Astra แต่สำหรับ Sol ยังต้องขอ
การเข้าถึงแยกออกเป็นสองส่วนเมื่อวันที่ 29 กันยายน และการแยกนี้สวนทางกับโมเดลที่หน้านี้ครอบคลุมอยู่ Ultrafast ตอนนี้พร้อมใช้งานอย่างกว้างขวางบน GPT-6 Astra: เอกสาร API ของ OpenAI ระบุว่าเปิดให้ผู้ใช้ API ทุกรายที่ขีดจำกัดอัตราต่ำ — 500,000 โทเค็นต่อนาทีในระดับการใช้งาน 1–3, 1 ล้านในระดับ 4, 5 ล้านในระดับ 5 — และมาพร้อมใน ChatGPT Work และ Codex บนแผน Pro 500 ใหม่ รวมถึงแผน Enterprise และ Edu ที่เข้าเกณฑ์ โดยเจ้าของเวิร์กสเปซต้องเป็นผู้เปิดใช้งาน และไม่รองรับสำหรับเวิร์กสเปซที่ต้องประมวลผลอนุมานนอกสหรัฐอเมริกา GPT-5.6 Sol Ultrafast ไม่ได้ย้ายตามไปด้วย เอกสารชุดเดียวกันยังคงอธิบายว่าเป็นการเข้าถึงแบบพรีวิวผ่านทีมบัญชีของ OpenAI และคำอธิบายของพารามิเตอร์เองในสคีมา API ยังคงเขียนว่า "currently available for gpt-5.6-sol" — ซึ่งเป็นบรรทัดที่ตอนนี้ตามหลังส่วนอื่น ๆ ของเอกสารแทนที่จะนำหน้า หากคุณต้องการระดับนี้ในวันนี้ คุณต้องใช้บน Astra
คำถามเรื่องอินเทอร์เฟซก็ได้ข้อสรุปแล้วเช่นกัน TestingCatalog รายงานเมื่อวันที่ 26 กันยายน 2026 ว่าตัวเลือกความเร็วที่มีให้เลือก Standard, Fast และ Ultrafast ถูกเก็บไว้โดยยังไม่เผยแพร่ใน Responses API Playground; สามวันต่อมา OpenAI ก็เปิดตัวเวอร์ชันสำหรับผู้บริโภคของสิ่งนั้นเลย โดยตอนนี้ Ultrafast เป็นตัวเลือกในตัวเลือกโมเดลใน ChatGPT Work และ Codex บน Pro 500 เราได้ตั้งข้อสังเกตว่าการพบเห็นนั้นเป็นการตีความของสิ่งพิมพ์ฉบับหนึ่งเกี่ยวกับ UI ที่ยังไม่เปิดตัว และกล่าวว่า OpenAI ยังไม่ได้ยืนยันสิ่งใดเลย มันถูกต้องในเชิงทิศทาง และการเปิดตัวที่มันชี้ไปนั้นมาถึงในงาน DevDay แทนที่จะเป็นหลังจากนั้น
กลุ่มโคฮอร์ตพรีวิวที่ OpenAI ระบุชื่อในเดือนสิงหาคม ได้แก่ งานเขียนโค้ด, พาณิชย์, การวิจัยทางการเงิน, การสนับสนุน และงานเชิงโต้ตอบอื่น ๆ — ทีมที่เอเจนต์ของพวกเขาทำการเรียกหลายครั้งต่อคำขอ และที่ซึ่งความหน่วงของการตอบสนองเป็นคอขวด Jane Street, Rogo และ Podium อยู่ในกลุ่มผู้ทดสอบช่วงแรกที่ถูกระบุชื่อ หากงานของคุณเป็นการแชทแบบเทิร์นเดียว ระดับความเร็วจะสำคัญน้อยกว่ามากเมื่อเทียบกับลูปเอเจนต์ที่เรียก 40 ครั้ง คำตอบในทางปฏิบัติตอนนี้ขึ้นอยู่กับว่าคุณกำลังถามถึงโมเดลใด: บน GPT-6 Astra คุณสามารถตั้งค่า service_tier: "ultrafast" ได้ในบ่ายนี้ และบน GPT-5.6 Sol คุณยังทำไม่ได้
สิ่งที่คุณทำได้ในวันนี้ — คำตอบที่ใช้ได้จริง

ในขณะที่ GPT-5.6 Sol Ultrafast ยังอยู่หลังประตูพรีวิว โมเดลเรือธงทั้งสองรุ่นพร้อมใช้งานบน OrcaRouter ในอัตราของผู้ให้บริการ โดยมีมาร์กอัป $0 ต่อโทเค็น — ID โมเดล openai/gpt-5.6-sol ผ่านเอนด์พอยต์ที่เข้ากันได้กับ OpenAI ที่ api.orcarouter.ai/v1 และ GPT-6 Astra อยู่ข้าง ๆ ในราคามาตรฐาน $10.00 / $50.00 ซึ่งเป็นโมเดลที่ OpenAI ได้เพิ่มระดับ Ultrafast ไว้ด้านบนและเราไม่ได้ route ที่ระดับนั้น ภาพด้านล่างเป็นจากเดือนสิงหาคม 2026 และยังแสดงราคา $5.00 / $30.00 ที่เป็นอยู่ในขณะนั้น; อัตราของ Sol วันนี้คือ $4.00 / $20.00 ซึ่งเป็นสิ่งที่เราส่งผ่าน การส่งผ่านนี้เป็นเหตุผลที่การเปลี่ยนแปลงราคาของผู้ขายมาถึงฝั่งเราในวันเดียวกัน: $4.00 อินพุต / $20.00 เอาต์พุต ตัวเลขชุดเดียวกับที่ OpenAI เผยแพร่ โดยไม่มีมาร์กอัปต่อโทเค็นเพิ่มด้านบน หากคุณมีไคลเอนต์ OpenAI อยู่แล้ว การย้ายระบบคือเปลี่ยน base-URL และ model-id เท่านั้น; ไม่มีอย่างอื่น คีย์และเอนด์พอยต์เดียวกันรองรับ 200+ โมเดล ดังนั้น Sol จึงอยู่ข้าง ๆ พี่น้องของตัวเอง — GPT-5.6 Terra ที่ $2.00 / $12.00 และ GPT-5.6 Luna ที่ $0.20 / $1.20 — รวมถึงโมเดล open-weight ที่คุณอาจนำมาเปรียบเทียบด้วย และคุณสามารถเลือกเส้นทางตามระดับความยากได้แทนที่จะต้องผสานรวมใหม่ทีละโมเดล
มีรายละเอียดเฉพาะของ OrcaRouter สองข้อที่ควรค่าแก่การระบุในหน้าเว็บเกี่ยวกับความเร็ว BYOK: นำคีย์ OpenAI ของคุณเองมาใช้ แล้ว OpenAI จะคิดค่าบริการกับคุณโดยตรงในอัตราของมันเอง — OrcaRouter ไม่บวกเพิ่ม $0 ต่อโทเคน และคงข้อจำกัดอัตราการใช้งาน (rate limit) และเครดิตของผู้ให้บริการของคุณไว้ครบถ้วน Guardrails: PII Shield และนโยบายเนื้อหาทำงานก่อนการคิดค่าบริการ คำขอที่ถูกบล็อกจึงคืนค่า 400 ที่สะอาดและไม่ถูกคิดค่าบริการเลย และ Agent Firewall จะให้คะแนนการเรียกใช้เครื่องมือและ MCP ก่อนที่มันจะทำงานจริง ส่วน Ultrafast นั้นเปิดให้ใช้งานอย่างแพร่หลายบน GPT-6 Astra แต่ไม่ใช่ในเงื่อนไขที่ route ได้ และไม่รองรับ Sol — มันเป็นระดับที่ควบคุมการเข้าถึง โดยคิดค่าบริการในอัตรา 6 เท่าของอัตรามาตรฐาน และเราไม่ได้ให้บริการนี้ หากวันหนึ่ง OpenAI เปิดให้ใช้ในเงื่อนไขมาตรฐาน การนำมันมาเชื่อมต่อกับ endpoint เดิมก็เป็นเพียงการเปลี่ยน model-id สิ่งที่คุณสร้างไว้ตั้งแต่วันนี้ยังใช้ต่อไปได้
ขอบเขตที่ซื่อสัตย์ — เมื่อ Ultrafast ไม่ใช่คำตอบ
ห้าจุดที่เรื่องความเร็วยังไม่เป็นจริง เมื่อครึ่งหนึ่งของมันเข้าที่แล้ว:
การพร้อมใช้งานไม่ใช่สิ่งเดียวกับความพร้อมให้คุณใช้งาน Ultrafast เปิดให้ผู้ใช้ API ทุกคนบน GPT-6 Astra แต่เปิดด้วยขีดจำกัดอัตราที่ต่ำ มันยังถูกระบุว่าเป็นแบบควบคุมการเข้าถึงในสคีมาของ OpenAI ไม่รองรับการประมวลผลใน EU หรือภูมิภาคอื่นที่ไม่ใช่สหรัฐฯ และในเวิร์กสเปซ Enterprise มันจะปิดอยู่จนกว่าเจ้าของจะเปิดใช้งาน บน GPT-5.6 Sol ไม่มีอะไรเปิดให้ใช้เลย ตรวจสอบการเข้าถึงของคุณเองก่อนที่คุณจะออกแบบสถาปัตยกรรมบนระบบใดระบบหนึ่ง
14× เป็นค่าสูงสุด ไม่ใช่การรับประกัน มันเป็นเพดานอัตราการส่งออกบนฮาร์ดแวร์ Cerebras ความหน่วงแบบ end-to-end ยังรวมถึงการประมวลผลอินพุต เวลาที่โมเดลใช้คิดเหตุผล และเครือข่ายของคุณเอง พรอมต์ที่เน้นการคิดเหตุผลหนัก ๆ อาจใช้เวลาจริงส่วนใหญ่ไปกับการคิด ซึ่งความเร็วที่เพิ่มขึ้นตามพาดหัวจะหดหายไป
มีราคาในโมเดลหนึ่ง และไม่มีราคาในอีกโมเดลหนึ่ง อัตรา Astra Ultrafast นั้นเผยแพร่แล้ว — 6 เท่าของมาตรฐาน — และไม่มีแถว Ultrafast สำหรับ GPT-5.6 Sol ที่ใดเลย ให้ตั้งงบประมาณเทียบกับ Sol มาตรฐานที่ $4 / $20 หรือโหมดเร็วที่ $8 / $40 และให้ถือว่าตัวเลข "ค่าใช้จ่าย GPT-5.6 Sol Ultrafast" ใด ๆ ที่คุณเห็น รวมถึงการคาดคะเน $24 / $120 ข้างต้น เป็นเพียงการคำนวณทางคณิตศาสตร์ ไม่ใช่ตารางอัตราค่าบริการ
ผลการทดสอบ benchmark เป็นข้อมูลที่ผู้ขายรายงานเอง การรัน HLE นาน 11 ชั่วโมง และตัวเลข GDP-Val 5.6× เป็นตัวเลขของ OpenAI/Cerebras จากประกาศเดือนสิงหาคม; การประเมินจากแหล่งอิสระเกี่ยวกับความเร็วที่เพิ่มขึ้นอยู่ในช่วงประมาณ 7× ถึง 11× ขึ้นอยู่กับว่าวัดอะไร เพิ่มสัญญาณ CS-4 เข้าไปในรายการนั้น: ตัวเลข ~1,300-token/s สำหรับ GPT-5.6 Sol บน CS-4 มาจากโพสต์ X เพียงโพสต์เดียว และไม่มีการยืนยันจากแหล่งอิสระ ตัวเลขของ Astra Ultrafast ชุดใหม่ — 8× ใน Codex, 6× ด้านราคา — ก็เป็นของ OpenAI เองเช่นกัน
และข้อที่ต้องใช้เงินแทนเวลา: มันจะไม่แก้ปัญหาคอขวดที่คุณไม่มี ถ้าเอเจนต์ของคุณช้าเพราะออร์เคสเตรชันของคุณเอง ความหน่วงของเครื่องมือ หรือพรอมป์ที่มีอินพุตจำนวนมาก เส้นทางเอาต์พุตที่เร็วกว่าจะขยับหางความหน่วงได้เพียงเล็กน้อยเท่านั้น การตัดสินใจจับคู่ระดับ — GPT-5.6 Sol ที่ $4 / $20 เทียบกับ GPT-5.6 Terra ที่ $2 / $12 เทียบกับ GPT-5.6 Luna ที่ $0.20 / $1.20 — ยังส่งผลต่อบิลของคุณมากกว่าที่ระดับความเร็วใด ๆ จะทำได้
สรุปประเด็นสำคัญ Ultrafast ไม่ใช่ระดับที่ต้องรอคิวและได้แต่อ่านข้อมูลอีกต่อไปแล้ว ตั้งแต่ 29 กันยายน 2026 OpenAI เปิดขายอย่างเป็นทางการ โดยรวมอยู่ในแผน ChatGPT Pro 500 ราคา $500 ใน Work และ Codex เปิดให้ผู้ใช้ API ทุกคนใช้งานบน GPT-6 Astra ที่อัตราจำกัดต่ำ และตั้งราคาสูงเป็นหกเท่าของอัตรามาตรฐาน — $60 / $300 ต่อล้านโทเคนสำหรับบริบทสั้น GPT-5.6 Sol Ultrafast ซึ่งเป็นพรีวิวเดือนสิงหาคมที่หน้านี้สร้างขึ้นโดยอ้างอิง ยังไม่มีความเปลี่ยนแปลงใด ๆ ยังคงถูกควบคุมการเข้าถึง ยังจำกัดอยู่เฉพาะ gpt-5.6-sol ในสคีมา API ยังไม่มีราคา และตัวเลข ~1,300 โทเคน/วินาทีที่มีรายงานสำหรับ Sol บน CS-4 ของ Cerebras ก็ยังคงเป็นเพียงโพสต์เดียวบน X ที่ยังไม่ได้รับการยืนยัน GPT-5.6 Sol มาตรฐานในราคา $4 / $20 คือรุ่นที่คุณเรียกใช้ได้วันนี้บน OrcaRouter โดยไม่มีมาร์กอัป ส่วน GPT-6 Astra ในราคา $10 / $50 คือรุ่นที่คุณเรียกใช้ได้หากต้องการโมเดลที่ได้แถว Ultrafast ไป
ตอนนี้ Ultrafast บน GPT-6 Astra ต้องจ่ายเงินจริงแล้ว โดยคิดเป็น 6 เท่าของมาตรฐาน หรือรวมอยู่ในแพ็กเกจ Pro 500 ราคา $500 ในขณะที่ GPT-5.6 Sol Ultrafast ยังคงเป็นพรีวิว GPT-5.6 Sol เวอร์ชันเต็มเปิดใช้งานแล้วบน OrcaRouter ในราคา $4 / $20 ต่อล้านโทเค็น โดยไม่มีมาร์กอัป พร้อมให้ใช้กับคีย์ของคุณเอง
การเปรียบเทียบในบทความนี้2
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
