
GPT-5.6 Sol Ultrafast: ความเร็ว 14 เท่า, 750 Tok/s — CS-4 รายงานว่าอยู่ที่ประมาณ 1,300 ยังไม่มีการประกาศราคา
- z-aiใหม่Z.ai: GLM 5.32026-08-1860ความฉลาด75การเขียนโค้ด
- obsidianใหม่Qwen3.8 27B Uncensored (Aggressive)2026-08-1552ความฉลาด68การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 27B (free)2026-08-1341 tok/s
- deepseekใหม่DeepSeek: DeepSeek V4 Pro 08132026-08-1253ความฉลาด69การเขียนโค้ด
- grokใหม่SpaceXAI: Grok 4.62026-08-1261ความฉลาด77การเขียนโค้ด
- metaใหม่Meta: Muse Spark 1.22026-08-0557ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0358ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น · 237 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2152ความฉลาด69การเขียนโค้ด
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137ความฉลาด49การเขียนโค้ด
- metaMeta: Muse Spark 1.12026-07-1653ความฉลาด71การเขียนโค้ด
- kimiMoonshotAI: Kimi K32026-07-1560ความฉลาด76การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Luna2026-07-0952ความฉลาด71การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Terra2026-07-0957ความฉลาด77การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Sol2026-07-0961ความฉลาด77การเขียนโค้ด
- grokxAI: Grok 4.52026-07-0856ความฉลาด72การเขียนโค้ด
GPT-5.6 Sol Ultrafast modeเป็นชั้นบริการที่เร่งด้วยฮาร์ดแวร์สำหรับรุ่นเรือธง — โมเดล GPT-5.6 Sol เต็มรูปแบบเดียวกันที่รันบนชิป wafer-scale ของ Cerebras แทนคลัสเตอร์ GPU ให้ความเร็วสูงถึง 14 เท่าของการประมวลผลมาตรฐาน และสูงถึง 750 โทเค็นเอาต์พุตต่อวินาทีในชั้นที่ OpenAI ประกาศเมื่อเดือนสิงหาคม เมื่อวันที่ 2026-08-18 Cerebras เปิดตัวระบบ CS-4 รุ่นถัดไปซึ่งชั้นนี้จะขยายไปสู่ และรายงานเบื้องต้นที่ยังไม่ได้รับการยืนยันอ้างว่า GPT-5.6 Sol บน CS-4 ให้บริการได้ประมาณ 1,300 โทเค็นต่อวินาทีแล้ว มันไม่ใช่โมเดลที่เล็กลงและไม่ใช่การกลั่นความรู้: มีเพียงฮาร์ดแวร์และการจัดตารางที่เปลี่ยนไป และความฉลาดของโมเดลยังคงเดิม สิ่งที่ยังไม่มีคือราคา — ณ วันที่ 2026-08-19 Ultrafast เป็นการพรีวิว API แบบจำกัดที่ยังไม่มีตารางราคาเผยแพร่ ดังนั้นตัวเลขที่คุณสามารถใช้ตั้งงบประมาณได้จริงในวันนี้คือชั้นมาตรฐานบนหน้าโมเดล GPT-5.6 Sol ที่ใช้งานจริง: $5 ต่อล้านโทเค็นอินพุต และ $30 ต่อล้านโทเค็นเอาต์พุต โดยส่งผ่านโดยไม่บวกมาร์กอัป บทความนี้ครอบคลุมว่าโหมดนี้คืออะไร ตัวเลขความเร็วจริง ๆ เป็นเท่าใด — รวมถึงฮาร์ดแวร์ CS-4 ใหม่และสิ่งที่ยังไม่ได้รับการยืนยัน — มีค่าใช้จ่ายเท่าใด (รวมถึงคำตอบตรงไปตรงมาว่า "ยังไม่มีราคา") และควรทำอย่างไรจนกว่าจะพร้อมใช้งานทั่วไป
โหมด Ultrafast จริงๆ แล้วคืออะไร
Ultrafast เป็นชั้นการให้บริการ (serving tier) ไม่ใช่โมเดลใหม่ OpenAI ประกาศเปิดตัวเมื่อวันที่ 13 สิงหาคม 2026 โดยเป็นผลิตภัณฑ์แรกจากความร่วมมือด้านการประมวลผลกับผู้ผลิตชิป Cerebras ตามข้อตกลงในเดือนมกราคม 2026 ซึ่งรายงานว่ามีมูลค่าประมาณ 1 หมื่นล้านดอลลาร์สหรัฐในระยะเวลาสามปี ในขณะที่การอนุมานมาตรฐานของ GPT-5.6 Sol ทำงานบนคลัสเตอร์ GPU และใช้เวลาส่วนใหญ่ไปกับการย้ายน้ำหนักระหว่างหน่วยความจำและหน่วยประมวลผล Ultrafast กลับโหลดน้ำหนักของโมเดลลงใน SRAM บนชิปความจุ 44 GB ที่อยู่บนชิป wafer-scale ของ Cerebras โมเดลที่มีขนาดเท่า Sol ครอบคลุมเวเฟอร์หลายแผ่นที่ซ้อนกันเป็นชั้น ๆ จึงทำให้น้ำหนักอยู่ในตำแหน่งเดียวกับหน่วยประมวลผล ผลลัพธ์คือเพดานปริมาณงานถูกกำหนดโดยตัวซิลิกอน ไม่ใช่โดยแบนด์วิดท์ของหน่วยความจำ
เรื่องราวด้านฮาร์ดแวร์เดินหน้าต่อไปเมื่อวันที่ 2026-08-18 ในงาน Supernova Cerebras ได้เปิดตัว CS-4 ระบบระดับแร็ก (rack-scale) เจเนอเรชันถัดไปที่สร้างบนแพลตฟอร์ม Nexus — มีชิป Wafer-Scale Engine สามตัวต่อหนึ่งแร็ก ความเร็วในการสร้างโทเคนสูงถึง 2 เท่าของ CS-3 รุ่นก่อนหน้า และตามข้อมูลของ Cerebras มากกว่า 1,000 โทเคนต่อวินาทีบนโมเดลที่มีพารามิเตอร์มากกว่า 10 ล้านล้านตัว เหล่านี้คือคำกล่าวอ้างของ Cerebras สำหรับระบบที่อยู่ในช่วง early access ซึ่งยังไม่เปิดให้ใช้งานโดยทั่วไป นับตั้งแต่การเปิดตัว มีโพสต์เพียงโพสต์เดียวบน X อ้างว่า CS-4 ให้บริการ GPT-5.6 Sol แล้วที่ความเร็วประมาณ 1,300 โทเคนต่อวินาที — ทิศทางสอดคล้องกับตัวเลขของ Cerebras เอง แต่ยังไม่มีใครยืนยัน จงมองเป็นสัญญาณเริ่มต้น: เป็นไปได้ ยังไม่ได้รับการยืนยัน และควรตรวจสอบอีกครั้งก่อนวางแผนความจุโดยอิงจากข้อมูลนี้
ส่วนที่สำคัญสำหรับโค้ดของคุณ: รหัสโมเดล ค่าน้ำหนัก พฤติกรรมการให้เหตุผล และเอาต์พุตเหมือนกับ GPT-5.6 Sol มาตรฐาน OpenAI วางตำแหน่ง Ultrafast ว่าเป็น 'งานที่มีประโยชน์มากขึ้นต่อวินาที' มากกว่าระดับคุณภาพ และพรีวิวนั้นรันโมเดลเรือธงเต็มรูปแบบ — ความเร็วไม่ได้มาจากการสลับไปใช้โมเดลที่ใช้ต้นทุนต่ำกว่า สิ่งที่เปลี่ยนไปคือความเร็วที่โทเคนออกมา
อย่าสับสน Ultrafast กับที่มีอยู่ fast mode. Fast mode เป็นระดับที่แยกต่างหากซึ่งซื้อได้บนฮาร์ดแวร์มาตรฐาน: ความเร็วเอาต์พุตสูงสุดประมาณ 2.5 เท่า โดยมีค่าพรีเมียม 2 เท่าต่อโทเคน ($10 อินพุต / $60 เอาต์พุตต่อ 1M) โดยไม่มีการเปลี่ยนแปลงคุณภาพ Ultrafast เป็นสิ่งที่แตกต่าง — ฮาร์ดแวร์ Cerebras สูงสุด 14 เท่า และตอนนี้ไม่มีค่าใช้จ่ายใดๆ ทั้งสิ้น
รวดเร็วแค่ไหน — ตัวเลขที่สำคัญ

ตัวเลขหลักคือ 14× และจำเป็นต้องมีคำนิยาม OpenAI กล่าวว่า Ultrafast สร้าง output tokens ได้สูงสุด 750 tokens ต่อวินาที เทียบกับการประมวลผล GPT-5.6 Sol แบบมาตรฐาน นั่นเป็นตัวเลขปริมาณงาน (throughput) สำหรับ output tokens ไม่ใช่การอ้างว่า "ทุกอย่างทำงานเร็วขึ้น 14×" — เวลาที่ใช้ในการร้องขอแบบ end-to-end ยังรวมถึงการประมวลผลอินพุตและการใช้เหตุผลของตัวแบบเอง ด้วยเหตุนี้ 14× จึงถูกระบุว่าเป็นค่าสูงสุด
• อัตราเอาต์พุตสูงสุด — สูงสุด 750 โทเค็นเอาต์พุตต่อวินาที ตามประกาศของ OpenAI (2026-08-13).
• เทียบกับการประมวลผลมาตรฐาน — เร็วกว่าสูงสุด 14 เท่า ตามประกาศเดียวกัน ผลลัพธ์จริงอาจแตกต่างกันไปตามความยาวอินพุตและประเภทงาน
• Humanity's Last Exam คำถาม 2,500 ข้อ — OpenAI/Cerebras รายงานว่า GPT-5.6 Sol Ultrafast เสร็จภายใน 11 ชั่วโมง 11 นาที เทียบกับ Claude Fable 5 ที่ใช้เวลา 78 ชั่วโมง 27 นาที โดยมีความแม่นยำใกล้เคียงกัน เป็นข้อมูลที่รายงานโดยผู้จำหน่ายเอง และการเปรียบเทียบนี้ครอบคลุมชุดฮาร์ดแวร์ของผู้จำหน่ายสองราย — ควรอ่านเป็นแนวโน้ม ไม่ใช่บทสรุป
• GDP-Val แบบครบวงจร — Cerebras รายงานว่าเร็วขึ้นโดยรวม 5.6 เท่า โดยไม่มีการสูญเสียคุณภาพที่วัดได้ และเป็นการรายงานโดยผู้จำหน่ายเอง
• โหมดเร็วพื้นฐาน — ระดับความเร็วที่ซื้อได้ในปัจจุบันให้ความเร็วเอาต์พุตสูงสุดประมาณ 2.5 เท่า โดยมีค่าใช้จ่ายเพิ่มขึ้น 2 เท่า
• CS-4 ฮาร์ดแวร์รุ่นถัดไป — Cerebras อ้างว่าแร็ค CS-4 ทำได้มากกว่า 1,000 โทเคนต่อวินาทีกับโมเดลที่มีพารามิเตอร์มากกว่า 10 ล้านล้าน ซึ่งสูงถึง 2 เท่าของการสร้างโทเคนของ CS-3 รายงานจากชุมชนที่ไม่ได้รับการยืนยันระบุว่า GPT-5.6 Sol บน CS-4 ทำได้ประมาณ 1,300 โทเคนต่อวินาที — เป็นไปในทิศทางเดียวกัน แต่ยังไม่ได้รับการยืนยันจาก OpenAI หรือ Cerebras
ข้อควรระวังอย่างหนึ่งก่อนที่คุณจะอ้างถึงตัวเลข 14×: การรายงานข่าวอิสระเกี่ยวกับการเปิดตัวอ้างถึงการเปรียบเทียบความเร็วในการสร้างที่ ~11× เมื่อเทียบกับ Claude Fable 5 ในขณะที่ตัวเลขของ Cerebras เองบ่งชี้ ~7× สำหรับเวลาทดสอบรวมในการรันเดียวกัน — ความแตกต่างอยู่ที่ว่าคุณวัดส่วนใดของปริมาณงาน วินัยเดียวกันนี้ใช้กับสัญญาณความเร็วของ CS-4: ตัวเลข ~1,300 โทเค็น/วินาที เริ่มต้นจากโพสต์บน X เพียงโพสต์เดียว และทั้ง OpenAI และ Cerebras ยังไม่ได้ยืนยัน ตัวเลขทั้งหมดนี้ถูกประกาศโดยผู้ให้บริการหรือชุมชนในสัปดาห์นี้ และยังไม่มีตัวเลขใดที่ได้รับการตรวจสอบอย่างอิสระ จงถือว่าสิ่งเหล่านี้เป็นเพียงข้อกล่าวอ้าง ไม่ใช่คำตัดสินจากการวัดประสิทธิภาพ
ค่าใช้จ่ายคืออะไร — และช่องว่างที่แท้จริง

นี่คือสถานะของคำถามเรื่องราคา ณ วันที่ 2026-08-19 กล่าวอย่างตรงไปตรงมา: Ultrafast ยังไม่มีราคาที่เผยแพร่ OpenAI ยังไม่ได้ประกาศราคา และตัวอย่างพรีวิวก็ไม่ปรากฏในบัตรอัตราค่าบริการสาธารณะใดๆ รายงานที่ว่าช่องการเข้าถึงล่วงหน้าถูกรวมอยู่ในแพ็กเกจหรือให้ฟรีนั้นเป็นการคาดเดา ไม่ใช่นโยบาย — และจนกว่า OpenAI จะกำหนดราคาสำหรับระดับนี้ ตัวเลข "GPT-5.6 Sol Ultrafast cost" ที่คุณพบจากที่อื่นก็เป็นเพียงการคาดเดา
สิ่งที่คุณสามารถตั้งราคาได้ในวันนี้คือส่วนที่เหลือของไลน์ GPT-5.6 Sol ซึ่งตรวจสอบยืนยันกับอัตราที่ OpenAI เผยแพร่เมื่อวันที่ 2026-08-18:
• Standard GPT-5.6 Sol — $5.00 อินพุต / $30.00 เอาต์พุต ต่อ 1M โทเคน รุ่นพื้นฐานที่คุณสามารถเรียกใช้ได้ทันที
• โหมดเร็ว — $10.00 / $60.00 ส่วนเพิ่ม 2 เท่าสำหรับความเร็วเอาต์พุตที่เพิ่มขึ้นประมาณ 2.5 เท่า สิ่งที่ใกล้เคียงที่สุดกับระดับความเร็วที่คุณสามารถซื้อได้จริง
• การอ่านพรอมพ์แคช — $0.50 ต่อ 1M (ลด 90% จากอินพุตใหม่); การเขียนแคชคิดค่าใช้จ่ายที่ $6.25 ต่อ 1M.
• ระดับบริบทระยะยาว — อินพุตที่เกินประมาณ 272K โทเคนคิดที่ $10.00 / $45.00.
• Batch API — $2.50 / $15.00 ลด 50% แบบคงที่ โดยใช้เวลาดำเนินการประมาณ 24 ชั่วโมง
เพื่อให้เห็นบริบทของพรีเมียมที่ควรคาดหวัง: โหมด fast กำหนดแบบอย่างไว้ที่ 2 เท่าของอัตรามาตรฐานสำหรับความเร็ว 2.5 เท่า หาก Ultrafast เป็นไปตามเส้นโค้งที่คล้ายกัน มันจะอยู่สูงกว่ามาตรฐาน $5 / $30 อย่างชัดเจน — และความเห็นรอบๆ พรีวิวก็คาดหวังไว้แบบนั้น เพราะกำลังการผลิตเวเฟอร์ของ Cerebras หายากและมีราคาแพง แต่พรีเมียมที่คาดว่าจะเกิดขึ้นไม่ใช่ราคาจริง วางแผนโดยเทียบกับมาตรฐาน Sol หรือโหมด fast จนกว่าจะมี rate card ออกมา
วิธีใช้งาน — ความเป็นจริงของตัวอย่าง
การเข้าถึงคือช่องว่างที่แท้จริงประการที่สอง Ultrafast มีให้ใช้งานผ่าน OpenAI API สำหรับลูกค้ากลุ่มที่ได้รับการคัดเลือกตามรายชื่อรอ ซึ่งประกาศเมื่อวันที่ 13 สิงหาคม 2026 โดย OpenAI กล่าวว่าการเข้าถึงจะขยายออกไป "เมื่อกำลังการผลิตเติบโตขึ้น" ยังไม่มีวันวางจำหน่ายทั่วไป กลุ่มตัวอย่างที่ประกาศสำหรับการแสดงตัวอย่างคือ การเขียนโค้ด พาณิชย์ การวิจัยทางการเงิน การสนับสนุน และงานเชิงโต้ตอบอื่นๆ — ทีมที่มีเอเจนต์เรียกใช้งานหลายครั้งต่อคำขอและความหน่วงของการตอบสนองเป็นคอขวด Jane Street, Rogo และ Podium เป็นหนึ่งในผู้ทดสอบช่วงแรกที่ถูกกล่าวถึง
รูปแบบการใช้งานที่ออกแบบมาเพื่อ: การรับมือเหตุการณ์ขัดข้อง (การอ่านล็อก เทรซ และดิฟฟ์ในขณะที่ระบบหยุดให้บริการ), การวิจัยทางการเงินและการตรวจจับการฉ้อโกงบนข้อมูลที่เคลื่อนไหว, การสนับสนุนลูกค้าแบบเรียลไทม์และเสียง (ซึ่งความเงียบเพียงครึ่งวินาทีฟังดูเหมือนระบบขัดข้อง), การชำระเงินในอีคอมเมิร์ซ และการบีบอัดชุดวิจัยข้ามคืนให้เป็นเซสชันแบบโต้ตอบ หากปริมาณงานของคุณคือการแชทแบบเทิร์นเดียว 14× จะมีความสำคัญน้อยกว่าการวนลูปเอเจนต์ 40 ครั้งมาก
สิ่งที่คุณทำได้ในวันนี้ — คำตอบที่ใช้ได้จริง

ในขณะที่ Ultrafast ยังอยู่ในช่วงพรีวิว GPT-5.6 Sol เวอร์ชันเต็มเปิดใช้งานแล้ว — และบน OrcaRouter ระดับมาตรฐานให้บริการในอัตราของผู้ให้บริการ โดยไม่มีค่าธรรมเนียมเพิ่มต่อโทเค็น ภายใต้รหัสโมเดล openai/gpt-5.6-sol ผ่านเอนด์พอยต์ที่เข้ากันได้กับ OpenAI ที่ api.orcarouter.ai/v1. หากคุณมีไคลเอนต์ OpenAI อยู่แล้ว การย้ายคือการเปลี่ยน base-URL และ model-id เท่านั้น ไม่มีอะไรอื่นอีก คีย์และเอนด์พอยต์เดียวกันรองรับโมเดล 200+ ตัว ดังนั้น Sol จึงอยู่เคียงข้าง GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5 และ open-weight models ที่คุณจะนำมาเปรียบเทียบ — และคุณสามารถกำหนดเส้นทางตามระดับความยาก แทนที่จะต้องบูรณาการแต่ละตัวใหม่
มีรายละเอียดเฉพาะของ OrcaRouter สองอย่างที่ควรกล่าวถึงในหน้าความเร็ว BYOK: นำคีย์ OpenAI ของคุณมาใช้เอง แล้ว OpenAI จะเรียกเก็บเงินจากคุณโดยตรงในอัตราของตัวเอง — OrcaRouter ไม่คิดเงินเพิ่มต่อโทเค็น และยังคงรักษา rate limits และเครดิตของผู้ให้บริการของคุณไว้ตามเดิม Guardrails: PII Shield และนโยบายเนื้อหาทำงานก่อนการเรียกเก็บเงิน ดังนั้นคำขอที่ถูกบล็อกจะส่งกลับรหัส 400 ตามปกติและไม่ถูกเรียกเก็บเงิน และ Agent Firewall จะประเมินการเรียกใช้เครื่องมือและการเรียก MCP ก่อนที่จะดำเนินการ เมื่อ — และหาก — Ultrafast เปิดให้ใช้งานทั่วไปในราคาที่สามารถกำหนดเส้นทางได้ การเชื่อมต่อกับ endpoint เดิมนั้นก็เป็นเพียงการเปลี่ยนรหัสโมเดล; การตั้งค่าที่คุณสร้างไว้ในวันนี้จะยังคงใช้ได้ต่อเนื่อง
ขอบเขตที่ซื่อสัตย์ — เมื่อ Ultrafast ไม่ใช่คำตอบ
สี่จุดที่เรื่อง 14× ไม่ยืน จึงไม่ควรออกแบบหรือวางงบประมาณโดยอ้างอิงตัวเลขที่ยังไม่แน่นอน:
14× เป็นค่าสูงสุด ไม่ใช่การรับประกัน มันคือเพดานอัตราการส่งออกบนฮาร์ดแวร์ Cerebras; เวลาแฝงแบบ end-to-end ยังคงรวมถึงการประมวลผลอินพุต เวลาที่โมเดลใช้คิด และเครือข่ายของคุณเอง พรอมต์ที่เน้นการให้เหตุผลอาจใช้เวลาส่วนใหญ่ไปกับการคิดตามเวลาจริง ซึ่งอัตราเร่งที่โฆษณาไว้จะลดลง
ไม่มีราคาและไม่มีวันที่ GA ณ วันที่ 2026-08-19 คุณไม่สามารถซื้อ Ultrafast ได้ — ทำได้เพียงขอสิทธิ์เข้าถึงตัวอย่าง และฮาร์ดแวร์ CS-4 ที่อยู่เบื้องหลังยังอยู่ในช่วง early access มากกว่าจะเปิดให้ใช้งานทั่วไป จัดงบประมาณโดยอ้างอิงจาก Sol มาตรฐาน ($5 / $30) หรือโหมดเร็ว ($10 / $60) และถือว่าราคา Ultrafast ใดๆ ที่เห็นทางออนไลน์ยังไม่ผ่านการยืนยัน
เกณฑ์วัดประสิทธิภาพเหล่านี้รายงานโดยผู้จำหน่าย ผลการรัน HLE 11 ชั่วโมงและตัวเลข GDP-Val 5.6 เท่าเป็นตัวเลขของ OpenAI/Cerebras จากการประกาศ โดยการประมาณการโดยอิสระอยู่ในช่วงประมาณ 7 ถึง 11 เท่า ขึ้นอยู่กับสิ่งที่ถูกวัด เพิ่มสัญญาณความเร็ว CS-4 ในรายการนั้น: ตัวเลขประมาณ 1,300 โทเคน/วินาที สำหรับ GPT-5.6 Sol บน CS-4 มาจากโพสต์ X เพียงโพสต์เดียวและไม่มีการยืนยันโดยอิสระ ยังไม่มีข้อมูลใดได้รับการยืนยันโดยอิสระ
มันจะไม่แก้ปัญหาคอขวดที่คุณไม่มีหากเอเจนต์ของคุณทำงานช้าเพราะออร์เคสตราของคุณเอง ความหน่วงของเครื่องมือ หรือพรอมพ์ที่มีอินพุตหนัก เส้นทางเอาต์พุตที่เร็วขึ้นจะขยับส่วนท้ายได้เพียงเล็กน้อยเท่านั้น การตัดสินใจจับคู่ระดับ — GPT-5.6 Sol ที่ $5 / $30 เทียบกับ GPT-5.6 Terra ที่ $2 / $12 เทียบกับ GPT-5.6 Luna ที่ $0.20 / $1.20 — ยังส่งผลต่อบิลของคุณมากกว่าระดับความเร็วใดๆ
สรุปคือ GPT-5.6 Sol Ultrafast เป็นระดับการให้บริการที่เร็วที่สุดที่ OpenAI เปิดตัวสำหรับโมเดลเรือธง — ใช้เวตเดียวกันบนฮาร์ดแวร์ Cerebras ทรูพุตสูงถึง 14 เท่า และ 750 โทเคนเอาต์พุตต่อวินาทีบนระดับที่ประกาศไว้ CS-4 ใหม่ของ Cerebras (เปิดตัว 2026-08-18) รายงานว่าทำให้ GPT-5.6 Sol ไปถึงประมาณ 1,300 โทเคนต่อวินาที แต่ตัวเลขนั้นเป็นเพียงโพสต์ X โพสต์เดียวที่ไม่ได้รับการยืนยัน ณ วันที่ 2026-08-19 Ultrafast ยังเป็นเวอร์ชันพรีวิวแบบรอคิวโดยไม่มีราคาสาธารณะ หากคุณกำลังมองหาตัวเลขเพื่อใช้ตั้งงบประมาณ คำตอบที่ตรงไปตรงมาคือยังไม่มีในตอนนี้ Standard GPT-5.6 Sol ที่ $5 / $30 คือสิ่งที่คุณใช้ได้ในวันนี้ โหมดเร็วที่ $10 / $60 คือระดับความเร็วที่ซื้อได้ และ OrcaRouter ส่งผ่านทั้งสองแบบโดยไม่บวกเพิ่ม $0 บนคีย์ของคุณเอง สร้างระบบ routing ได้เลยตอนนี้ — และเมื่อ Ultrafast มีราคาและวันวางจำหน่าย มันก็แค่เปลี่ยน model-id ครั้งเดียวเท่านั้น
จนกว่า Ultrafast จะกำหนดราคา GPT-5.6 Sol เต็มรูปแบบพร้อมใช้งานบน GPT-5.6 Sol on OrcaRouter ในราคา $5 / $30 ต่อล้านโทเคน ไม่มีส่วนเพิ่ม พร้อมใช้กับคีย์ของคุณเอง
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
