ภาพประกอบเวกเตอร์แบบแบนสไตล์บรรณาธิการสำหรับภาพหลักของบล็อกเทคโนโลยีเกี่ยวกับการอนุมาน AI ที่รวดเร็วเป็นพิเศษ: ชิปโมเดลทรงมนขนาดใหญ่สีน้ำเงินเข้มพร้อมแสงเรืองไซแอนนุ่มนวลบนพื้นหลังสีอ่อน; สายฟ้าแบบสไตล์ไลซ์และหน้าปัดความเร็วที่เข็มชี้ที่ระดับสูงสุดอยู่ข้างๆ; กระแสโทเคนที่แล่นเร็วไปตามเส้นความเร็วแนวนอนพร้อมเส้นการเคลื่อนไหว และนาฬิกาจับเวลาขนาดเล็ก; พื้นหลังสีขาวพร้อมจุดไล่เฉดสีน้ำเงินและไซแอนนุ่มนวลและไฮไลต์สีอบอุ่นที่ละเอียดอ่อนหนึ่งจุด; ไอคอนเส้นแบบมินิมอล; ตัวอักษรแบบซานเซอริฟเรขาคณิตที่ทันสมัยและสะอาดตา; ไม่มีข้อความที่อ่านได้ ไม่มีตัวอักษร ไม่มีคำ ไม่มีลายน้ำ ไม่มีโลโก้ของบุคคลที่สาม องค์ประกอบอัตราส่วน 16:9
Guides & Insights

GPT-5.6 Sol Ultrafast: ความเร็ว 14 เท่า, 750 Tok/s — CS-4 รายงานว่าอยู่ที่ประมาณ 1,300 ยังไม่มีการประกาศราคา

ผู้เขียน

Gideon Frost

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

GPT-5.6 Sol Ultrafast modeเป็นชั้นบริการที่เร่งด้วยฮาร์ดแวร์สำหรับรุ่นเรือธง — โมเดล GPT-5.6 Sol เต็มรูปแบบเดียวกันที่รันบนชิป wafer-scale ของ Cerebras แทนคลัสเตอร์ GPU ให้ความเร็วสูงถึง 14 เท่าของการประมวลผลมาตรฐาน และสูงถึง 750 โทเค็นเอาต์พุตต่อวินาทีในชั้นที่ OpenAI ประกาศเมื่อเดือนสิงหาคม เมื่อวันที่ 2026-08-18 Cerebras เปิดตัวระบบ CS-4 รุ่นถัดไปซึ่งชั้นนี้จะขยายไปสู่ และรายงานเบื้องต้นที่ยังไม่ได้รับการยืนยันอ้างว่า GPT-5.6 Sol บน CS-4 ให้บริการได้ประมาณ 1,300 โทเค็นต่อวินาทีแล้ว มันไม่ใช่โมเดลที่เล็กลงและไม่ใช่การกลั่นความรู้: มีเพียงฮาร์ดแวร์และการจัดตารางที่เปลี่ยนไป และความฉลาดของโมเดลยังคงเดิม สิ่งที่ยังไม่มีคือราคา — ณ วันที่ 2026-08-19 Ultrafast เป็นการพรีวิว API แบบจำกัดที่ยังไม่มีตารางราคาเผยแพร่ ดังนั้นตัวเลขที่คุณสามารถใช้ตั้งงบประมาณได้จริงในวันนี้คือชั้นมาตรฐานบนหน้าโมเดล GPT-5.6 Sol ที่ใช้งานจริง: $5 ต่อล้านโทเค็นอินพุต และ $30 ต่อล้านโทเค็นเอาต์พุต โดยส่งผ่านโดยไม่บวกมาร์กอัป บทความนี้ครอบคลุมว่าโหมดนี้คืออะไร ตัวเลขความเร็วจริง ๆ เป็นเท่าใด — รวมถึงฮาร์ดแวร์ CS-4 ใหม่และสิ่งที่ยังไม่ได้รับการยืนยัน — มีค่าใช้จ่ายเท่าใด (รวมถึงคำตอบตรงไปตรงมาว่า "ยังไม่มีราคา") และควรทำอย่างไรจนกว่าจะพร้อมใช้งานทั่วไป

โหมด Ultrafast จริงๆ แล้วคืออะไร

Ultrafast เป็นชั้นการให้บริการ (serving tier) ไม่ใช่โมเดลใหม่ OpenAI ประกาศเปิดตัวเมื่อวันที่ 13 สิงหาคม 2026 โดยเป็นผลิตภัณฑ์แรกจากความร่วมมือด้านการประมวลผลกับผู้ผลิตชิป Cerebras ตามข้อตกลงในเดือนมกราคม 2026 ซึ่งรายงานว่ามีมูลค่าประมาณ 1 หมื่นล้านดอลลาร์สหรัฐในระยะเวลาสามปี ในขณะที่การอนุมานมาตรฐานของ GPT-5.6 Sol ทำงานบนคลัสเตอร์ GPU และใช้เวลาส่วนใหญ่ไปกับการย้ายน้ำหนักระหว่างหน่วยความจำและหน่วยประมวลผล Ultrafast กลับโหลดน้ำหนักของโมเดลลงใน SRAM บนชิปความจุ 44 GB ที่อยู่บนชิป wafer-scale ของ Cerebras โมเดลที่มีขนาดเท่า Sol ครอบคลุมเวเฟอร์หลายแผ่นที่ซ้อนกันเป็นชั้น ๆ จึงทำให้น้ำหนักอยู่ในตำแหน่งเดียวกับหน่วยประมวลผล ผลลัพธ์คือเพดานปริมาณงานถูกกำหนดโดยตัวซิลิกอน ไม่ใช่โดยแบนด์วิดท์ของหน่วยความจำ

เรื่องราวด้านฮาร์ดแวร์เดินหน้าต่อไปเมื่อวันที่ 2026-08-18 ในงาน Supernova Cerebras ได้เปิดตัว CS-4 ระบบระดับแร็ก (rack-scale) เจเนอเรชันถัดไปที่สร้างบนแพลตฟอร์ม Nexus — มีชิป Wafer-Scale Engine สามตัวต่อหนึ่งแร็ก ความเร็วในการสร้างโทเคนสูงถึง 2 เท่าของ CS-3 รุ่นก่อนหน้า และตามข้อมูลของ Cerebras มากกว่า 1,000 โทเคนต่อวินาทีบนโมเดลที่มีพารามิเตอร์มากกว่า 10 ล้านล้านตัว เหล่านี้คือคำกล่าวอ้างของ Cerebras สำหรับระบบที่อยู่ในช่วง early access ซึ่งยังไม่เปิดให้ใช้งานโดยทั่วไป นับตั้งแต่การเปิดตัว มีโพสต์เพียงโพสต์เดียวบน X อ้างว่า CS-4 ให้บริการ GPT-5.6 Sol แล้วที่ความเร็วประมาณ 1,300 โทเคนต่อวินาที — ทิศทางสอดคล้องกับตัวเลขของ Cerebras เอง แต่ยังไม่มีใครยืนยัน จงมองเป็นสัญญาณเริ่มต้น: เป็นไปได้ ยังไม่ได้รับการยืนยัน และควรตรวจสอบอีกครั้งก่อนวางแผนความจุโดยอิงจากข้อมูลนี้

ส่วนที่สำคัญสำหรับโค้ดของคุณ: รหัสโมเดล ค่าน้ำหนัก พฤติกรรมการให้เหตุผล และเอาต์พุตเหมือนกับ GPT-5.6 Sol มาตรฐาน OpenAI วางตำแหน่ง Ultrafast ว่าเป็น 'งานที่มีประโยชน์มากขึ้นต่อวินาที' มากกว่าระดับคุณภาพ และพรีวิวนั้นรันโมเดลเรือธงเต็มรูปแบบ — ความเร็วไม่ได้มาจากการสลับไปใช้โมเดลที่ใช้ต้นทุนต่ำกว่า สิ่งที่เปลี่ยนไปคือความเร็วที่โทเคนออกมา

อย่าสับสน Ultrafast กับที่มีอยู่ fast mode. Fast mode เป็นระดับที่แยกต่างหากซึ่งซื้อได้บนฮาร์ดแวร์มาตรฐาน: ความเร็วเอาต์พุตสูงสุดประมาณ 2.5 เท่า โดยมีค่าพรีเมียม 2 เท่าต่อโทเคน ($10 อินพุต / $60 เอาต์พุตต่อ 1M) โดยไม่มีการเปลี่ยนแปลงคุณภาพ Ultrafast เป็นสิ่งที่แตกต่าง — ฮาร์ดแวร์ Cerebras สูงสุด 14 เท่า และตอนนี้ไม่มีค่าใช้จ่ายใดๆ ทั้งสิ้น

รวดเร็วแค่ไหน — ตัวเลขที่สำคัญ

Speed card titled 'GPT-5.6 Sol Ultrafast — how fast', sourced to the OpenAI announcement of 2026-08-13 with all speed figures vendor-reported. Three highlight cells read Up to 14x max speedup vs standard, 750 output tokens per second max, and 11h 11m for 2,500 HLE questions. Rows list standard GPT-5.6 Sol as the 1x baseline, fast mode up to ~2.5x at 2x price, Claude Fable 5 on the same HLE set at 78h 27m, GDP-Val end-to-end at 5.6x faster, and 'same model, same quality — hardware only'. Footer: 14x is a maximum, not a guarantee, and none of the speed figures are independently verified yet.

ตัวเลขหลักคือ 14× และจำเป็นต้องมีคำนิยาม OpenAI กล่าวว่า Ultrafast สร้าง output tokens ได้สูงสุด 750 tokens ต่อวินาที เทียบกับการประมวลผล GPT-5.6 Sol แบบมาตรฐาน นั่นเป็นตัวเลขปริมาณงาน (throughput) สำหรับ output tokens ไม่ใช่การอ้างว่า "ทุกอย่างทำงานเร็วขึ้น 14×" — เวลาที่ใช้ในการร้องขอแบบ end-to-end ยังรวมถึงการประมวลผลอินพุตและการใช้เหตุผลของตัวแบบเอง ด้วยเหตุนี้ 14× จึงถูกระบุว่าเป็นค่าสูงสุด

อัตราเอาต์พุตสูงสุด — สูงสุด 750 โทเค็นเอาต์พุตต่อวินาที ตามประกาศของ OpenAI (2026-08-13).

เทียบกับการประมวลผลมาตรฐาน — เร็วกว่าสูงสุด 14 เท่า ตามประกาศเดียวกัน ผลลัพธ์จริงอาจแตกต่างกันไปตามความยาวอินพุตและประเภทงาน

Humanity's Last Exam คำถาม 2,500 ข้อ — OpenAI/Cerebras รายงานว่า GPT-5.6 Sol Ultrafast เสร็จภายใน 11 ชั่วโมง 11 นาที เทียบกับ Claude Fable 5 ที่ใช้เวลา 78 ชั่วโมง 27 นาที โดยมีความแม่นยำใกล้เคียงกัน เป็นข้อมูลที่รายงานโดยผู้จำหน่ายเอง และการเปรียบเทียบนี้ครอบคลุมชุดฮาร์ดแวร์ของผู้จำหน่ายสองราย — ควรอ่านเป็นแนวโน้ม ไม่ใช่บทสรุป

GDP-Val แบบครบวงจร — Cerebras รายงานว่าเร็วขึ้นโดยรวม 5.6 เท่า โดยไม่มีการสูญเสียคุณภาพที่วัดได้ และเป็นการรายงานโดยผู้จำหน่ายเอง

โหมดเร็วพื้นฐาน — ระดับความเร็วที่ซื้อได้ในปัจจุบันให้ความเร็วเอาต์พุตสูงสุดประมาณ 2.5 เท่า โดยมีค่าใช้จ่ายเพิ่มขึ้น 2 เท่า

• CS-4 ฮาร์ดแวร์รุ่นถัดไป — Cerebras อ้างว่าแร็ค CS-4 ทำได้มากกว่า 1,000 โทเคนต่อวินาทีกับโมเดลที่มีพารามิเตอร์มากกว่า 10 ล้านล้าน ซึ่งสูงถึง 2 เท่าของการสร้างโทเคนของ CS-3 รายงานจากชุมชนที่ไม่ได้รับการยืนยันระบุว่า GPT-5.6 Sol บน CS-4 ทำได้ประมาณ 1,300 โทเคนต่อวินาที — เป็นไปในทิศทางเดียวกัน แต่ยังไม่ได้รับการยืนยันจาก OpenAI หรือ Cerebras

ข้อควรระวังอย่างหนึ่งก่อนที่คุณจะอ้างถึงตัวเลข 14×: การรายงานข่าวอิสระเกี่ยวกับการเปิดตัวอ้างถึงการเปรียบเทียบความเร็วในการสร้างที่ ~11× เมื่อเทียบกับ Claude Fable 5 ในขณะที่ตัวเลขของ Cerebras เองบ่งชี้ ~7× สำหรับเวลาทดสอบรวมในการรันเดียวกัน — ความแตกต่างอยู่ที่ว่าคุณวัดส่วนใดของปริมาณงาน วินัยเดียวกันนี้ใช้กับสัญญาณความเร็วของ CS-4: ตัวเลข ~1,300 โทเค็น/วินาที เริ่มต้นจากโพสต์บน X เพียงโพสต์เดียว และทั้ง OpenAI และ Cerebras ยังไม่ได้ยืนยัน ตัวเลขทั้งหมดนี้ถูกประกาศโดยผู้ให้บริการหรือชุมชนในสัปดาห์นี้ และยังไม่มีตัวเลขใดที่ได้รับการตรวจสอบอย่างอิสระ จงถือว่าสิ่งเหล่านี้เป็นเพียงข้อกล่าวอ้าง ไม่ใช่คำตัดสินจากการวัดประสิทธิภาพ

ค่าใช้จ่ายคืออะไร — และช่องว่างที่แท้จริง

Price card titled 'What GPT-5.6 Sol costs today — 2026-08-18', listing published input/output rates per 1M tokens. Three highlight cells read Standard $5.00 / $30.00, Fast mode $10.00 / $60.00, and Ultrafast price TBD in preview. Rows list prompt cache read $0.50, cache write $6.25, long-context over ~272K $10.00 / $45.00, batch API $2.50 / $15.00, and context window ~1.05M with 128K max output. Footer: Ultrafast has no published price as of 2026-08-18 — standard and fast mode are what you can buy today.

นี่คือสถานะของคำถามเรื่องราคา ณ วันที่ 2026-08-19 กล่าวอย่างตรงไปตรงมา: Ultrafast ยังไม่มีราคาที่เผยแพร่ OpenAI ยังไม่ได้ประกาศราคา และตัวอย่างพรีวิวก็ไม่ปรากฏในบัตรอัตราค่าบริการสาธารณะใดๆ รายงานที่ว่าช่องการเข้าถึงล่วงหน้าถูกรวมอยู่ในแพ็กเกจหรือให้ฟรีนั้นเป็นการคาดเดา ไม่ใช่นโยบาย — และจนกว่า OpenAI จะกำหนดราคาสำหรับระดับนี้ ตัวเลข "GPT-5.6 Sol Ultrafast cost" ที่คุณพบจากที่อื่นก็เป็นเพียงการคาดเดา

สิ่งที่คุณสามารถตั้งราคาได้ในวันนี้คือส่วนที่เหลือของไลน์ GPT-5.6 Sol ซึ่งตรวจสอบยืนยันกับอัตราที่ OpenAI เผยแพร่เมื่อวันที่ 2026-08-18:

Standard GPT-5.6 Sol — $5.00 อินพุต / $30.00 เอาต์พุต ต่อ 1M โทเคน รุ่นพื้นฐานที่คุณสามารถเรียกใช้ได้ทันที

โหมดเร็ว — $10.00 / $60.00 ส่วนเพิ่ม 2 เท่าสำหรับความเร็วเอาต์พุตที่เพิ่มขึ้นประมาณ 2.5 เท่า สิ่งที่ใกล้เคียงที่สุดกับระดับความเร็วที่คุณสามารถซื้อได้จริง

การอ่านพรอมพ์แคช — $0.50 ต่อ 1M (ลด 90% จากอินพุตใหม่); การเขียนแคชคิดค่าใช้จ่ายที่ $6.25 ต่อ 1M.

ระดับบริบทระยะยาว — อินพุตที่เกินประมาณ 272K โทเคนคิดที่ $10.00 / $45.00.

Batch API — $2.50 / $15.00 ลด 50% แบบคงที่ โดยใช้เวลาดำเนินการประมาณ 24 ชั่วโมง

เพื่อให้เห็นบริบทของพรีเมียมที่ควรคาดหวัง: โหมด fast กำหนดแบบอย่างไว้ที่ 2 เท่าของอัตรามาตรฐานสำหรับความเร็ว 2.5 เท่า หาก Ultrafast เป็นไปตามเส้นโค้งที่คล้ายกัน มันจะอยู่สูงกว่ามาตรฐาน $5 / $30 อย่างชัดเจน — และความเห็นรอบๆ พรีวิวก็คาดหวังไว้แบบนั้น เพราะกำลังการผลิตเวเฟอร์ของ Cerebras หายากและมีราคาแพง แต่พรีเมียมที่คาดว่าจะเกิดขึ้นไม่ใช่ราคาจริง วางแผนโดยเทียบกับมาตรฐาน Sol หรือโหมด fast จนกว่าจะมี rate card ออกมา

วิธีใช้งาน — ความเป็นจริงของตัวอย่าง

การเข้าถึงคือช่องว่างที่แท้จริงประการที่สอง Ultrafast มีให้ใช้งานผ่าน OpenAI API สำหรับลูกค้ากลุ่มที่ได้รับการคัดเลือกตามรายชื่อรอ ซึ่งประกาศเมื่อวันที่ 13 สิงหาคม 2026 โดย OpenAI กล่าวว่าการเข้าถึงจะขยายออกไป "เมื่อกำลังการผลิตเติบโตขึ้น" ยังไม่มีวันวางจำหน่ายทั่วไป กลุ่มตัวอย่างที่ประกาศสำหรับการแสดงตัวอย่างคือ การเขียนโค้ด พาณิชย์ การวิจัยทางการเงิน การสนับสนุน และงานเชิงโต้ตอบอื่นๆ — ทีมที่มีเอเจนต์เรียกใช้งานหลายครั้งต่อคำขอและความหน่วงของการตอบสนองเป็นคอขวด Jane Street, Rogo และ Podium เป็นหนึ่งในผู้ทดสอบช่วงแรกที่ถูกกล่าวถึง

รูปแบบการใช้งานที่ออกแบบมาเพื่อ: การรับมือเหตุการณ์ขัดข้อง (การอ่านล็อก เทรซ และดิฟฟ์ในขณะที่ระบบหยุดให้บริการ), การวิจัยทางการเงินและการตรวจจับการฉ้อโกงบนข้อมูลที่เคลื่อนไหว, การสนับสนุนลูกค้าแบบเรียลไทม์และเสียง (ซึ่งความเงียบเพียงครึ่งวินาทีฟังดูเหมือนระบบขัดข้อง), การชำระเงินในอีคอมเมิร์ซ และการบีบอัดชุดวิจัยข้ามคืนให้เป็นเซสชันแบบโต้ตอบ หากปริมาณงานของคุณคือการแชทแบบเทิร์นเดียว 14× จะมีความสำคัญน้อยกว่าการวนลูปเอเจนต์ 40 ครั้งมาก

สิ่งที่คุณทำได้ในวันนี้ — คำตอบที่ใช้ได้จริง

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

ในขณะที่ Ultrafast ยังอยู่ในช่วงพรีวิว GPT-5.6 Sol เวอร์ชันเต็มเปิดใช้งานแล้ว — และบน OrcaRouter ระดับมาตรฐานให้บริการในอัตราของผู้ให้บริการ โดยไม่มีค่าธรรมเนียมเพิ่มต่อโทเค็น ภายใต้รหัสโมเดล openai/gpt-5.6-sol ผ่านเอนด์พอยต์ที่เข้ากันได้กับ OpenAI ที่ api.orcarouter.ai/v1. หากคุณมีไคลเอนต์ OpenAI อยู่แล้ว การย้ายคือการเปลี่ยน base-URL และ model-id เท่านั้น ไม่มีอะไรอื่นอีก คีย์และเอนด์พอยต์เดียวกันรองรับโมเดล 200+ ตัว ดังนั้น Sol จึงอยู่เคียงข้าง GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5 และ open-weight models ที่คุณจะนำมาเปรียบเทียบ — และคุณสามารถกำหนดเส้นทางตามระดับความยาก แทนที่จะต้องบูรณาการแต่ละตัวใหม่

มีรายละเอียดเฉพาะของ OrcaRouter สองอย่างที่ควรกล่าวถึงในหน้าความเร็ว BYOK: นำคีย์ OpenAI ของคุณมาใช้เอง แล้ว OpenAI จะเรียกเก็บเงินจากคุณโดยตรงในอัตราของตัวเอง — OrcaRouter ไม่คิดเงินเพิ่มต่อโทเค็น และยังคงรักษา rate limits และเครดิตของผู้ให้บริการของคุณไว้ตามเดิม Guardrails: PII Shield และนโยบายเนื้อหาทำงานก่อนการเรียกเก็บเงิน ดังนั้นคำขอที่ถูกบล็อกจะส่งกลับรหัส 400 ตามปกติและไม่ถูกเรียกเก็บเงิน และ Agent Firewall จะประเมินการเรียกใช้เครื่องมือและการเรียก MCP ก่อนที่จะดำเนินการ เมื่อ — และหาก — Ultrafast เปิดให้ใช้งานทั่วไปในราคาที่สามารถกำหนดเส้นทางได้ การเชื่อมต่อกับ endpoint เดิมนั้นก็เป็นเพียงการเปลี่ยนรหัสโมเดล; การตั้งค่าที่คุณสร้างไว้ในวันนี้จะยังคงใช้ได้ต่อเนื่อง

ขอบเขตที่ซื่อสัตย์ — เมื่อ Ultrafast ไม่ใช่คำตอบ

สี่จุดที่เรื่อง 14× ไม่ยืน จึงไม่ควรออกแบบหรือวางงบประมาณโดยอ้างอิงตัวเลขที่ยังไม่แน่นอน:

14× เป็นค่าสูงสุด ไม่ใช่การรับประกัน มันคือเพดานอัตราการส่งออกบนฮาร์ดแวร์ Cerebras; เวลาแฝงแบบ end-to-end ยังคงรวมถึงการประมวลผลอินพุต เวลาที่โมเดลใช้คิด และเครือข่ายของคุณเอง พรอมต์ที่เน้นการให้เหตุผลอาจใช้เวลาส่วนใหญ่ไปกับการคิดตามเวลาจริง ซึ่งอัตราเร่งที่โฆษณาไว้จะลดลง

ไม่มีราคาและไม่มีวันที่ GA ณ วันที่ 2026-08-19 คุณไม่สามารถซื้อ Ultrafast ได้ — ทำได้เพียงขอสิทธิ์เข้าถึงตัวอย่าง และฮาร์ดแวร์ CS-4 ที่อยู่เบื้องหลังยังอยู่ในช่วง early access มากกว่าจะเปิดให้ใช้งานทั่วไป จัดงบประมาณโดยอ้างอิงจาก Sol มาตรฐาน ($5 / $30) หรือโหมดเร็ว ($10 / $60) และถือว่าราคา Ultrafast ใดๆ ที่เห็นทางออนไลน์ยังไม่ผ่านการยืนยัน

เกณฑ์วัดประสิทธิภาพเหล่านี้รายงานโดยผู้จำหน่าย ผลการรัน HLE 11 ชั่วโมงและตัวเลข GDP-Val 5.6 เท่าเป็นตัวเลขของ OpenAI/Cerebras จากการประกาศ โดยการประมาณการโดยอิสระอยู่ในช่วงประมาณ 7 ถึง 11 เท่า ขึ้นอยู่กับสิ่งที่ถูกวัด เพิ่มสัญญาณความเร็ว CS-4 ในรายการนั้น: ตัวเลขประมาณ 1,300 โทเคน/วินาที สำหรับ GPT-5.6 Sol บน CS-4 มาจากโพสต์ X เพียงโพสต์เดียวและไม่มีการยืนยันโดยอิสระ ยังไม่มีข้อมูลใดได้รับการยืนยันโดยอิสระ

มันจะไม่แก้ปัญหาคอขวดที่คุณไม่มีหากเอเจนต์ของคุณทำงานช้าเพราะออร์เคสตราของคุณเอง ความหน่วงของเครื่องมือ หรือพรอมพ์ที่มีอินพุตหนัก เส้นทางเอาต์พุตที่เร็วขึ้นจะขยับส่วนท้ายได้เพียงเล็กน้อยเท่านั้น การตัดสินใจจับคู่ระดับ — GPT-5.6 Sol ที่ $5 / $30 เทียบกับ GPT-5.6 Terra ที่ $2 / $12 เทียบกับ GPT-5.6 Luna ที่ $0.20 / $1.20 — ยังส่งผลต่อบิลของคุณมากกว่าระดับความเร็วใดๆ

สรุปคือ GPT-5.6 Sol Ultrafast เป็นระดับการให้บริการที่เร็วที่สุดที่ OpenAI เปิดตัวสำหรับโมเดลเรือธง — ใช้เวตเดียวกันบนฮาร์ดแวร์ Cerebras ทรูพุตสูงถึง 14 เท่า และ 750 โทเคนเอาต์พุตต่อวินาทีบนระดับที่ประกาศไว้ CS-4 ใหม่ของ Cerebras (เปิดตัว 2026-08-18) รายงานว่าทำให้ GPT-5.6 Sol ไปถึงประมาณ 1,300 โทเคนต่อวินาที แต่ตัวเลขนั้นเป็นเพียงโพสต์ X โพสต์เดียวที่ไม่ได้รับการยืนยัน ณ วันที่ 2026-08-19 Ultrafast ยังเป็นเวอร์ชันพรีวิวแบบรอคิวโดยไม่มีราคาสาธารณะ หากคุณกำลังมองหาตัวเลขเพื่อใช้ตั้งงบประมาณ คำตอบที่ตรงไปตรงมาคือยังไม่มีในตอนนี้ Standard GPT-5.6 Sol ที่ $5 / $30 คือสิ่งที่คุณใช้ได้ในวันนี้ โหมดเร็วที่ $10 / $60 คือระดับความเร็วที่ซื้อได้ และ OrcaRouter ส่งผ่านทั้งสองแบบโดยไม่บวกเพิ่ม $0 บนคีย์ของคุณเอง สร้างระบบ routing ได้เลยตอนนี้ — และเมื่อ Ultrafast มีราคาและวันวางจำหน่าย มันก็แค่เปลี่ยน model-id ครั้งเดียวเท่านั้น

จนกว่า Ultrafast จะกำหนดราคา GPT-5.6 Sol เต็มรูปแบบพร้อมใช้งานบน GPT-5.6 Sol on OrcaRouter ในราคา $5 / $30 ต่อล้านโทเคน ไม่มีส่วนเพิ่ม พร้อมใช้กับคีย์ของคุณเอง

การเปรียบเทียบในบทความนี้1

ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube