การ์ดฮีโร่ที่สร้างขึ้น หัวข้อ 'ตอนนี้อยู่ในระดับที่เร็วที่สุด' พร้อมคำโปรย 'GPT-6.1 Sol Ultrafast เปิดให้ใช้งานบน API, Codex และ ChatGPT Work' และชิปสี่อันที่ระบุว่า '$12.00 / $60.00 ต่อ 1M โทเคน', '6 เท่าของ Standard', 'เร็วขึ้นสูงสุด 8 เท่า (การวัดของ Astra)' และ 'API, Codex และ ChatGPT Work' เหนือส่วนท้ายที่ระบุว่า 'ความพร้อมใช้งานและราคาตามเอกสารของ OpenAI, 8 ตุลาคม 2026'
Guides & Insights

GPT-6.1 Sol Ultrafast เปิดให้ใช้งานผ่าน API, Codex และ ChatGPT Work

ผู้เขียน

Elias Hawthorne

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด →
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

OpenAI กำลังทยอยเปิดตัวโหมด Ultrafast สำหรับ GPT-6.1 Sol ซึ่งเป็นระดับบริการที่เร็วที่สุดที่บริษัทจำหน่าย และเป็นครั้งแรกที่ระดับ Astra Sol ที่ใกล้เคียงกันมีบริการแบบนี้ การเคลื่อนไหวนี้ทำให้ GPT-6.1 Sol อยู่ในกลุ่มเดียวกับ GPT-6 Astra Ultrafast ทั้งใน API ใน Codex และใน ChatGPT Work และมันมาพร้อมตารางราคาที่ประกาศออกมา แทนที่จะเป็นรายชื่อรอคอย: 12.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเค็น และ 60.00 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเค็น ซึ่งเป็นหกเท่าของราคา GPT-6.1 Sol มาตรฐานพอดี คำกล่าวอ้างเรื่องความเร็วบนฉลากคือ "เร็วสูงสุด 8 เท่า" ส่วนที่น่าสนใจคือวลีนั้นกำลังวัดอะไรอยู่ และคำตอบก็ไม่ใช่โมเดลที่คุณกำลังจะจ่ายเงินซื้อ

บันทึกการเปลี่ยนแปลงสำหรับนักพัฒนามีรายการลงวันที่ 8 ตุลาคมว่า "เพิ่มโหมด Ultrafast สำหรับ GPT-6.1 Sol ใน Responses API ใช้ gpt-6.1-solร่วมกับ service_tier: "ultrafast"เพื่อลดเวลาระหว่างโทเค็นเอาต์พุตที่สร้างขึ้น มีให้บริการแก่ผู้ใช้ API ทุกราย ภายใต้ข้อจำกัดอัตราการใช้งาน โดยประมวลผลแบบทั่วโลกและมีที่ตั้งข้อมูลในสหรัฐฯ และสหภาพยุโรป" หน้าเอกสารของ Ultrafast ขณะนี้ระบุว่า "พร้อมใช้งานอย่างกว้างขวางสำหรับ GPT-6 Astra และ GPT-6.1 Sol โดยมีการเข้าถึงแบบพรีวิวสำหรับ GPT-5.6 Sol" และหน้าด้านความเร็วฝั่ง ChatGPT ยืนยันส่วนของการสมัครสมาชิกว่า Ultrafast ใช้งานได้ใน Codex และ ChatGPT Work บนแพ็กเกจ Pro ราคา $500 และบนแพ็กเกจ Enterprise และ Edu ที่เข้าเกณฑ์

Ultrafast เป็นระดับบริการ ไม่ใช่โมเดลที่สอง

ไม่มีอะไรเปลี่ยนแปลงเกี่ยวกับเวต สเช็กพอยต์เดิม หน้าต่างบริบท 1,050,000 โทเคนเท่าเดิม อินพุตสูงสุด 922,000 โทเคนเท่าเดิม เพดานเอาต์พุต 128,000 โทเคนเท่าเดิม จุดตัดขอบเขตความรู้ 30 เมษายน 2026 เท่าเดิม คำตอบเดิม สิ่งที่คุณกำลังซื้อคือลำดับความสำคัญในการจัดตารางเวลา: โมเดลสร้าง โทเคนได้เร็วขึ้น และกรอบคำอธิบายของ OpenAI เองก็จงใจแคบ — ระดับนี้ "ลดเวลาระหว่างโทเคนเอาต์พุตที่ถูกสร้างขึ้น" มันไม่ได้ทำให้โมเดลฉลาดขึ้น และไม่ได้ทำให้ช่วงการคิดสั้นลง

ความแตกต่างนั้นคือการตัดสินใจทั้งหมด สำหรับลูปของเอเจนต์ที่เรียกใช้เครื่องมือสี่สิบครั้งติดต่อกัน ผลได้จะทบต้นเพราะเอาต์พุตของแต่ละรอบมาถึงเร็วขึ้น สำหรับคำขอการให้เหตุผลที่ยากเพียงครั้งเดียวซึ่งใช้เวลาจริงส่วนใหญ่ไปกับการครุ่นคิด คุณอาจจ่ายแพงขึ้นหกเท่าและยังเห็นสปินเนอร์เหมือนเดิม

พูดง่ายๆ เกี่ยวกับบันไดขั้นระดับ สักครั้ง:

• Batch and Flex — ครึ่งหนึ่งของ Standard ช่องทางราคาถูกสำหรับงานที่ไม่มีใครรอ

• มาตรฐาน — อินพุต $2.00 / แคช $0.10 / เขียนแคช $2.50 / เอาต์พุต $10.00 ต่อล้านโทเค็น

• เร็ว — เป็นสองเท่าของ Standard หรือ $4.00 / $0.20 / $5.00 / $20.00; OpenAI เปลี่ยนชื่อ Priority processing เป็นโหมด Fast เมื่อวันที่ 30 กรกฎาคม 2026

• เร็วพิเศษ — หกเท่าของ Standard หรือ $12.00 / $0.60 / $15.00 / $60.00

• เกิน 272K โทเคนอินพุต — คำขอทั้งหมดจะถูกคิดราคาใหม่ที่อัตราอินพุตและแคช 2 เท่า และเอาต์พุต 1.5 เท่า; Ultrafast long-context อยู่ที่ $24.00 / $1.20 / $30.00 / $90.00

การคำนวณที่ไม่มีใครใส่ไว้บนหน้าเพจการตลาด

ราคาสูงเป็นหกเท่าเพื่อความเร็วที่เพิ่มเป็นแปดเท่าไม่ใช่การแลกเปลี่ยนที่ขาดทุน และก็ไม่ใช่ของฟรี Ultrafast คิดค่าบริการต่อโทเคน งานที่ราคา $1.00 ที่ Standard จะมีค่าใช้จ่าย $6.00 ที่ Ultrafast — และเสร็จเร็วขึ้นประมาณหนึ่งในแปดของเวลา การประหยัดไม่ได้อยู่ที่ใบเรียกเก็บเงิน แต่อยู่ที่เวลาจริงบนนาฬิกา คุณจ่ายเพิ่มห้าดอลลาร์เพื่อลดเวลารอในคิวของงานนั้นลงเจ็ดในแปด และว่านั่นถูกหรือไร้สาระนั้นขึ้นอยู่กับว่าคนหรือไปป์ไลน์ที่รอผลอยู่อีกฝั่งมีมูลค่าต่อนาทีเท่าไร

มีนัยสองประการตามมา และสิ่งเหล่านี้คือสิ่งที่มักถูกมองข้าม:

• งานเชิงโต้ตอบคือคำตอบรับที่ง่ายดาย นักพัฒนาที่นั่งเฝ้าดู diff ถูก merge เข้ามา, เอเจนต์ที่ไม่สามารถดำเนินการต่อได้จนกว่าจะได้อ่านผลลัพธ์ — นั่นคือกรณีที่ความหน่วงคือตัวผลิตภัณฑ์ ผลลัพธ์ที่เร็วขึ้นแปดเท่าในลูปสี่สิบรอบไม่ใช่การปรับปรุงเล็กน้อยต่อการรับรู้ของมนุษย์ แต่เป็นความแตกต่างระหว่างเครื่องมือที่คุณใช้งาน กับเครื่องมือที่คุณปล่อยให้ทำงานเบื้องหลัง

• งานที่ตั้งเวลาไว้และงานแบบแบตช์เป็นคำตอบว่า "ไม่" ที่ง่ายถ้างานหนึ่งมีเวลาถึงเช้าอยู่แล้ว Ultrafast ก็เป็นบิลที่แพงขึ้น 6 เท่าโดยไม่ได้อะไรเลย และเลน Batch ราคาครึ่งหนึ่งก็อยู่ตรงนั้นเอง

อินพุตที่แคชไว้ควรค่าแก่การพิจารณาอีกครั้ง เพราะมันก็เปลี่ยนแปลงไปด้วยเช่นกัน: $0.60 ต่อล้านบน Ultrafast เทียบกับ $0.10 บน Standard ซึ่งยังคงเป็น 5% ของอัตราอินพุตที่ไม่ได้แคช เอเจนต์ที่ใช้พรอมป์ต์แบบแคชซึ่งส่งพรอมป์ต์ระบบขนาดใหญ่ซ้ำในทุกเทิร์นจะพบว่าส่วนลดแคชนั้นปรับไปตามระดับแพ็กเกจ แทนที่จะช่วยปกป้องพวกเขาจากการเปลี่ยนแปลงดังกล่าว

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, alongside the page's notes that regional processing endpoints carry a 10% uplift, that FedRAMP endpoints carry a further 10%, that Priority processing was renamed Fast mode on July 30, 2026, and that GPT-5.6 Sol's promotional pricing is available at least through November 21, 2026.

ตัวเลข "สูงสุด 8x" มาจากไหน

นี่คือส่วนที่ต้องอ่านอย่างละเอียด เพราะเป็นจุดที่พาดหัวของ rollout และเอกสารของ rollout กำลังอธิบายสิ่งที่แตกต่างกันอย่างเงียบ ๆ

มาตรวัดความเร็วเฉพาะโมเดลเดียวที่ OpenAI เผยแพร่คือประโยคนี้: "GPT-6 Astra Ultrafast สร้างโทเค็นได้เร็วขึ้นสูงสุด 8 เท่าเมื่อเทียบกับ GPT-6 Astra ในโหมด Standard ใน Codex" นั่นเป็นตัวเลขของ Astra ซึ่งวัดใน Codex ไม่มีตัวคูณที่เผยแพร่เทียบเท่าสำหรับ GPT-6.1 Sol เอกสารที่ครอบคลุม Ultrafast สำหรับโมเดลนี้ระบุว่าช่วยลดเวลาของโทเค็นเอาต์พุตที่สร้างขึ้น และชี้ไปที่ตารางราคา โดยไม่ได้ระบุตัวเลขไว้ หน้าความเร็วฝั่ง ChatGPT พูดซ้ำประโยคของ Astra แล้วจบเพียงเท่านั้น

ดังนั้นการตีความอย่างตรงไปตรงมาของ "เร็วขึ้นสูงสุด 8 เท่า" ก็คือ: มันเป็นพาดหัวของระดับแพ็กเกจนั้น โดยมีที่มาจากโมเดลพี่น้องที่อยู่บน Ultrafast ตั้งแต่วันที่ 29 กันยายน และเป็นคำกล่าวอ้างของผู้ให้บริการที่ไม่มีบุคคลภายนอกอิสระรายใดทำซ้ำได้สำหรับโมเดลใดในสองโมเดลนี้ มันอาจเป็นจริงสำหรับ GPT-6.1 Sol — ทั้งสองรันบนสแตกการให้บริการเดียวกัน และกลไกของระดับนั้นก็เหมือนกัน — แต่ไม่มีใครภายนอก O​penAI ที่เผยแพร่การวัดโทเคนต่อวินาทีสำหรับเวอร์ชัน Sol และคำว่า "สูงสุด" กำลังทำหน้าที่สำคัญจริง ๆ ในประโยคนั้น

นอกจากนี้ยังควรแยกชั้นบริการตามโมเดล เพราะตัวเก่ายังเป็นงานที่ยังไม่เสร็จ Ultrafast ถูกประกาศเมื่อวันที่ 13 สิงหาคม 2026 สำหรับ GPT-5.6 Sol ด้วยความเร็ว "สูงสุด 14 เท่าของการประมวลผลแบบ Standard" ในรูปแบบการทดลองใช้แบบจำกัดสำหรับลูกค้าบางราย สามเดือนต่อมา เอกสารยังคงระบุว่า GPT-5.6 Sol มี "การเข้าถึงแบบพรีวิว" และตารางราคาของ Ultrafast มีเพียงสองแถว — GPT-6 Astra และ GPT-6.1 Sol ตัวเลข 14 เท่าที่ไม่เคยเปิดให้ใช้ทั่วไปและไม่มีอัตราที่เผยแพร่ ถือเป็นคำกล่าวอ้าง ไม่ใช่ผลิตภัณฑ์

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Ultrafast mode is the fastest service tier in the OpenAI API', the availability sentence naming broad availability for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol, the statement that Ultrafast mode for GPT-6 Astra and GPT-6.1 Sol is available to all API users, the recommendation to use WebSockets because network overhead without a persistent connection can reduce the latency gains, the note that Ultrafast has separate rate limits from Standard and Fast modes, the GPT-6.1 Sol rate-limit row reading 1,000,000 / 4,000,000 / 40,000,000 tokens per minute and 5,000 / 20,000 / 200,000 requests per minute, the line that GPT-6.1 Sol supports US and EU data residency and global processing, and a code sample setting service_tier to 'ultrafast' with model 'gpt-6.1-sol'.

ใครกันแน่ที่สามารถเปิดมันได้

ฝั่ง API นั้นกว้าง ฝั่ง subscription นั้นแคบ และความแตกต่างตรงนี้ทำให้หลายคนเข้าใจผิดได้

• API — เปิดให้ผู้ใช้ API ทุกคนใช้งานได้บน gpt-6.1-sol โดยมีขีดจำกัดอัตราการใช้งานแยกต่างหากจาก Standard และ Fast นั่นหมายความว่าคุณต้องคอยจับตางบประมาณอีกก้อนหนึ่ง ไม่ใช่แค่ราคาอีกหนึ่งระดับ

• ขีดจำกัดอัตราการใช้งานที่เร็วสุดขีดสำหรับ GPT-6.1 Sol — 1,000,000 โทเคนต่อนาทีในระดับ Build, 4,000,000 ในระดับ Launch, 40,000,000 ในระดับ Grow OpenAI ปรับลดระดับการใช้งานจากห้าระดับเหลือสามระดับเมื่อวันที่ 6 ตุลาคม ดังนั้นชื่อทั้งสามนี้จึงเป็นบันไดระดับปัจจุบัน ไม่ใช่ระดับที่เลิกใช้ไปแล้ว

• ที่ตั้งข้อมูล — GPT-6.1 Sol รองรับที่ตั้งข้อมูลในสหรัฐฯ และสหภาพยุโรป รวมถึงการประมวลผลแบบทั่วโลก ทั้งภายใต้โหมด Fast และ Ultrafast ส่วน Ultrafast ของ Astra ไม่ได้รับการรองรับที่ตั้งข้อมูลในสหภาพยุโรป ดังนั้นหากเวิร์กโหลดของคุณถูกปักหมุดให้อยู่ในสหภาพยุโรป นี่จึงเป็นคอนฟิกูเรชัน Ultrafast ตัวแรกที่คุณสามารถซื้อได้เลย

• Codex and ChatGPT Work — Ultrafast ใช้งานได้บนแผน Pro ราคา $500 และบนแผน Enterprise และ Edu ที่มีสิทธิ์ ผู้ดูแลระบบ Enterprise จะถูกปิดไว้เป็นค่าเริ่มต้น และต้องเปิดใช้งานเองเป็นรายผู้ใช้หรือรายเวิร์กสเปซ

• Chat — ไม่รวมอยู่ด้วย GPT-6.1 Sol เองอยู่ใน Work และ Codex ส่วน Chat สำหรับผู้ใช้ทั่วไปไม่ได้เป็นส่วนหนึ่งของสิ่งนี้

• วิธีคิดค่าบริการเมื่อใช้กับการสมัครใช้งาน — การใช้งานที่รวมอยู่ในแพ็กเกจจะถูกใช้ในอัตรา 8 เท่าของอัตรา Standard ส่วนเครดิตที่ซื้อเพิ่มหรือการจ่ายตามการใช้งานจริงของ Enterprise จะคิดค่าบริการในอัตรา 6 เท่าของอัตรา Standard ตัวเลขทั้งสองนี้ควรรู้ไว้ก่อนที่คุณจะปล่อยให้เปิดค้างไว้

รายละเอียดในการนำไปใช้เพียงหนึ่งอย่างเป็นตัวกำหนดว่าคุณจะได้เห็นความเร็วที่เพิ่มขึ้นเลยหรือไม่ คำแนะนำของ OpenAI ตรงไปตรงมาในเรื่องนี้ว่า ให้ใช้ WebSockets "โดยเฉพาะกับแอปพลิเคชันแบบ agentic ที่เรียกใช้เครื่องมือหลายครั้งติด ๆ กัน" เพราะ "หากไม่มีการเชื่อมต่อแบบคงอยู่ โอเวอร์เฮดของเครือข่ายอาจลดทอนประโยชน์ด้านความหน่วงที่ได้มา" ถ้าไคลเอนต์ของคุณเปิดการเชื่อมต่อ HTTP ใหม่ทุกครั้งที่เรียกใช้งาน โอเวอร์เฮดต่อคำขออาจกัดกินข้อได้เปรียบทั้งหมดของระดับบริการที่คุณเพิ่งจ่ายแพงขึ้น 6 เท่า HTTP ยังใช้งานได้ เพียงแต่มันอาจไม่คุ้มกับระดับบริการนั้น

สิ่งที่เรากำหนดเส้นทาง และสิ่งที่เราไม่กำหนด

GPT-6.1 Sol ระดับมาตรฐานพร้อมใช้งานบน OrcaRouter ในชื่อ openai/gpt-6.1-solในราคาของผู้ให้บริการเองที่ 2.00 ดอลลาร์สำหรับอินพุต และ 10.00 ดอลลาร์สำหรับเอาต์พุตต่อล้านโทเค็น ให้บริการโดยไม่บวกเพิ่ม 0% — เป็นราคาตามรายการของผู้ขายที่ส่งผ่านมาตรง ๆ ดังนั้นเมื่อ OpenAI ปรับอัตราค่าบริการ การเปลี่ยนแปลงจะไปปรากฏในบิลของคุณในวันเดียวกับที่ขึ้นบนตารางราคา แทนที่จะรอถึงรอบต่อสัญญาครั้งถัดไป คีย์และเอนด์พอยต์เดียวกันรองรับโมเดลมากกว่า 200 รายการดังนั้นการเรียก GPT-6.1 Sol กับการเรียก Claude หรือ Qwen จึงอยู่เบื้องหลังการเชื่อมต่อเดียว พร้อมการสลับไปใช้ตัวสำรองอัตโนมัติและไม่ต้องทำสัญญาที่สอง อีกทั้ง routing DSL จะประกอบโมเดลหลายตัวให้รวมเป็นคำขอเดียวเมื่องานนั้นต้องการความเห็นมากกว่าหนึ่ง

Ultrafast ไม่ใช่หนึ่งในโมเดลเหล่านั้น และการบอกเป็นนัยเป็นอย่างอื่นจะเป็นการทำให้เข้าใจผิด มันเป็นแฟล็ก service-tier บนบัญชี OpenAI — คุณส่ง service_tier: "ultrafast" ไปยัง gpt-6.1-sol และ OpenAI จะเรียกเก็บเงินจากบัญชีของคุณเองในอัตราข้างต้น — ดังนั้นมันจึงอยู่ภายในอินทิเกรชัน OpenAI โดยตรงของคุณ หากคุณเปิดใช้งาน ให้เก็บทราฟฟิกแบบแบ่งชั้นไว้บนคีย์ของผู้ให้บริการของคุณ และส่งทราฟฟิกปริมาณมาตรฐานผ่านเรา นั่นคือการแบ่งที่ซื่อตรง และยังเป็นวิธีที่ถูกกว่าสำหรับสิ่งใดก็ตามที่ไม่ต้องรอมนุษย์

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1M-token context window, 128K maximum output, text, image and file input with text output, vision, tools, JSON and reasoning capabilities, public benchmarks attributed to OpenAI dated 2026-09-29, input price $2.00 and output price $10.00 per 1M tokens, p50 time to first token 6.14 s, a 10.00 s figure, and 313.9M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

วันนี้จะทำอะไรกับมันดี

ถ้าคุณมีที่นั่ง Codex หรือ ChatGPT Work บน Pro $500 สวิตช์นั้นมีอยู่แล้ว และการทดลองใช้ไม่ได้มีค่าใช้จ่ายใด ๆ ยกเว้นตัวคูณการใช้งาน — ลองรันงานเดียวกันทั้งสองแบบ แล้วดูว่าลูปที่คุณรันจริงมีจำนวนรอบมากพอที่จะทำให้ความเร็วเพิ่มแปดเท่าปรากฏขึ้นหรือไม่ ถ้าคุณใช้ API การทดลองที่คุ้มค่าลงมือทำก็แคบกว่าที่ประกาศไว้เสียอีก: วัดว่าความหน่วงของคุณเป็นส่วนของการสร้างโทเค็นเท่าไร และเป็นส่วนที่โมเดลคิดเท่าไร จากนั้นชี้ Ultrafast ไปที่ส่วนที่มันบีบอัดได้จริง

และหากคุณมีตัวเลือกระหว่าง Fast ที่ 2x กับ Ultrafast ที่ 6x สำหรับคำขอเดียวกัน Fast คือเทียร์ที่มาถึงก่อน และเป็นเทียร์ที่คุณสามารถใช้เหตุผลเกี่ยวกับพฤติกรรมของมันได้จากตารางราคาเพียงอย่างเดียว Ultrafast เป็นของใหม่สำหรับโมเดลนี้ ยังไม่มีใครกำหนดราคาด้วยการวัดอิสระใด ๆ และมีค่าเท่ากับที่นาฬิกาจับเวลาของคุณเองบอกว่ามันมีค่าเป๊ะ ๆ

การเปรียบเทียบในบทความนี้2

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube