การ์ดไตเติลฮีโร่สำหรับ GPT-6.7 เรือธงรุ่นถัดไปที่ยังไม่เผยแพร่ของ OpenAI ภายใต้ชื่อ 'GPT-6.7: คำถามเรื่องเคอร์เนล' แสดงไอคอนชิป GPU แบบแบนราบพร้อมเครื่องหมายคำถามตัวหนาอยู่ด้านบน หน้าปัดเกจที่มีเข็มสีแดงชี้ที่ป้าย '2x' ไอคอนเส้นขนาดเล็กของมาตรวัดความเร็ว/กุญแจ/เอกสารรั่วไหล และแถบด้านล่างที่อ่านว่า 'GPT-6.7 · ยังไม่เผยแพร่ · สิ่งที่เรารู้จนถึงตอนนี้' พร้อมโลโก้ OrcaRouter ที่มุมขวาล่าง
Guides & Insights

GPT-6.7 และคำถาม 'บ็อบ': โมเดลเรือธงที่ยังไม่เปิดตัวของ OpenAI จะทำงานช้าลง 2 เท่าจริงหรือ?

ผู้เขียน

Rowan Sterling

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

เมื่อวันที่ 15 สิงหาคม โพสต์จากบัญชี X ชื่อ @Yuchenj_UW ย่อข่าวลือให้เหลือเพียงหนึ่งประโยคว่า "Bob ราชาแห่ง GPU kernels ลาออกจากบริษัทหรือไม่? GPT-6.7 จะทำงานช้าลง 2 เท่า…." มีข้อกล่าวอ้างสองข้อผูกโยงอยู่กับเครื่องหมายคำถามนั้น — กล่าวคือ วิศวกรที่เก็บตัวที่สุดของบริษัทได้ลาออกไปแล้ว และการจากไปของเขาทำให้ความเร็วในการเสิร์ฟ GPT-6.7 ซึ่งเป็นเรือธงที่ยังไม่เปิดตัวของบริษัท (เปลี่ยนชื่อเป็น GPT-6-7 เมื่อเดือนตุลาคมปีที่แล้ว) ลดลงครึ่งหนึ่ง ไม่มีข้อกล่าวอ้างใดที่ได้รับการยืนยัน แต่โพสต์นี้มาในจังหวะที่โมเดลรุ่นถัดไปของบริษัทได้กลายเป็นคำถามว่า เมื่อไหร่ ไม่ใช่ว่าจะเกิดหรือไม่: ชื่อตระกูล Astra เปิดตัวเมื่อวันที่ 1 สิงหาคม การตรวจสอบความปลอดภัยได้ระงับไว้เมื่อวันที่ 7 สิงหาคม และ GPT-5.6 Sol — เรือธงปัจจุบันที่เปิดให้บริการอยู่บน OrcaRouter — เป็นจุดอ้างอิงที่เป็นรูปธรรมเพียงจุดเดียวสำหรับสิ่งที่รุ่นถัดไปต้องเอาชนะ นี่คือสิ่งที่สามารถรู้ได้จริง ณ วันนี้

สิ่งหนึ่งที่ต้องบอกไว้ก่อน: ไม่มีใครนอก OpenAI เคยรัน GPT-6.7 การอ้างใดๆ เกี่ยวกับความเร็วในการส่งโทเคนล้วนเป็นการคาดการณ์ — รวมถึงตัวเลข "ช้ากว่า 2 เท่า" ด้วย เนื้อหาต่อจากนี้แยกข้อเท็จจริงที่ได้รับการยืนยัน (การเปลี่ยนชื่อ, ไทม์ไลน์การเปิดตัว, การจากไปที่ปรากฏเป็นบันทึก) ออกจากตำนาน (Bob, เคอร์เนล, และตัวเลข) เนื้อหาที่เป็นข่าวลือทั้งหมดถูกระบุไว้เช่นนั้น

"Bob" คือใคร และเพราะเหตุใดวิศวกรคนเดียวจึงกลายเป็นตำนาน

"Bob" เป็นชื่อเล่นที่พนักงาน OpenAI ใช้เรียกวิศวกรคนหนึ่งซึ่งบริษัทไม่เคยยืนยันชื่อจริงของเขา รายงานข่าวจากเดือนกันยายน 2025 — รวมถึง QbitAI, The Paper และ itbear ซึ่งทั้งหมดอ้างอิงพนักงาน OpenAI ทั้งอดีตและปัจจุบัน — บรรยายถึงนักวิจัยผู้ลึกลับที่เขียน CUDA kernels ที่ใช้สำหรับการอนุมาน (inference) เพียงลำพัง ซึ่งเป็นโค้ด GPU ระดับต่ำที่แปลงคณิตศาสตร์ของ transformer ให้เป็น tokens attention kernel ของเขาที่ถูกเรียกว่า "Bob kernel" ภายใน OpenAI ถูกรายงานว่าถูกเรียกใช้หลายล้านล้านครั้งต่อวันบน GPU หลายแสนตัว ด้วยความแม่นยำที่คู่ควรกัน: บั๊กหนึ่งตัวจะบังคับให้ต้องย้อนกลับ checkpoints และรอบการฝึกใหม่

ตำนานนี้สอดคล้องกันในทุกบัญชี อดีตพนักงานกล่าวว่า Bob แก้ปัญหาด้านประสิทธิภาพที่เพื่อนร่วมงานต่อสู้มาเป็นเวลาหนึ่งสัปดาห์ได้ในเวลาไม่กี่นาที Slack ภายในของ OpenAI มีอีโมจิ 'Bob magic' การประมาณการของอุตสาหกรรมที่อ้างอิงในรายงานเดียวกันระบุว่าจำนวนคนที่ยังมีชีวิตอยู่ซึ่งสามารถเขียน CUDA kernels สำหรับการเทรนที่มีประสิทธิภาพสูงได้มีไม่ถึงร้อยคน — ซึ่งเป็นเหตุผลว่าทำไมการพึ่งพาบุคคลเพียงคนเดียวในลักษณะนี้จึงถูกมองว่าเป็นความเสี่ยงอย่างแท้จริง ไม่ใช่แค่สิ่งที่ควรมีก็ได้

ในเรื่องอัตลักษณ์ OpenAI ไม่เคยเปิดเผยว่า Bob คือใคร สมมติฐานหลักที่ถูกกล่าวซ้ำในรายงานข่าวชุดเดียวกันคือ Scott Gray — ผู้สำเร็จการศึกษาด้านฟิสิกส์และวิทยาการคอมพิวเตอร์ ซึ่งเข้าร่วม OpenAI ในปี 2016 เป็นผู้เขียนหลักในบล็อกโพสต์ของ OpenAI ปี 2017 เรื่อง "Block-sparse GPU kernels" และต่อมาเป็นผู้ร่วมเขียนรายงานทางเทคนิคของ GPT-4 และบทความเกี่ยวกับ scaling laws โดยมีบรรณานุกรม 51 บทความและถูกอ้างอิงมากกว่า 80,000 ครั้ง ความสอดคล้องนี้เป็นเพียงการคาดเดาจากบริบท แต่ถูกกล่าวซ้ำอย่างกว้างขวาง มันคือการอนุมาน ไม่ใช่การยืนยัน

บ็อบจากไปจริงๆ หรือ?

ทวีตนี้เป็นคำถาม ไม่ใช่ข้อกล่าวอ้าง แต่การจากไปที่ทวีตชี้ถึงนั้นมีหลักฐานเป็นเอกสาร รายงานสรุปการเปลี่ยนแปลงผู้บริหารซึ่งเผยแพร่เมื่อวันที่ 15 สิงหาคม 2026 ระบุชื่อสกอตต์ เกรย์ — ซึ่งถูกบรรยายว่าเป็น "วิศวกรระบบ GPU ที่ทำงานมานาน" ที่เข้าร่วมงานในปี 2016 และช่วยสร้างโครงสร้างพื้นฐานเบื้องหลัง sparse transformers, scaling laws และ GPT-3 — อยู่ในกลุ่มผู้บริหารอาวุโสอย่างน้อยสิบสองคนที่ลาออกจาก OpenAI ในปี 2026 รายชื่อเดียวกันนี้ระบุถึง Denise Dresser ประธานเจ้าหน้าที่ฝ่ายรายได้, Brad Lightcap อดีตประธานเจ้าหน้าที่ฝ่ายปฏิบัติการ, Fidji Simo ซีอีโอฝ่ายแอปพลิเคชัน, Bill Peebles หัวหน้า Sora และหัวหน้าฝ่ายความปลอดภัย จริยธรรม การตลาด และฮาร์ดแวร์ นั่นเป็นรายงานรอง ไม่ใช่การยืนยันอย่างเป็นทางการ และไม่ได้ระบุวันที่ลาออกของเกรย์

บริบทที่กว้างขึ้นทำให้ข่าวลือนี้ดูไม่น่าแปลกใจนัก รายงานข่าวในช่วงสัปดาห์เดียวกันนั้นมองว่าการเปลี่ยนแปลงบุคลากรครั้งนี้คือการเขย่าโครงสร้างก่อน IPO: เกร็ก บร็อกแมน ผู้ร่วมก่อตั้งกำลังรวบอำนาจการดำเนินงานเข้าหาตัวเองก่อนการจดทะเบียนในตลาดหลักทรัพย์ตามแผน และ CNBC รายงานการออกจากตำแหน่งของ CRO เมื่อวันที่ 13 สิงหาคม และ 'Bob' เป็นที่รู้จักในฐานะเป้าหมายการสรรหาบุคลากรมานานหนึ่งปีแล้ว — รายงานจากเดือนกันยายน 2025 ระบุว่า มาร์ก ซักเคอร์เบิร์ก ของ Meta ได้ตั้งคำถาม 'ใครคือ Bob?' เป็นวาระประจำในการประชุมสรรหาบุคลากร สงครามแย่งชิงบุคลากรที่มีทักษะเฉพาะด้านนี้เกิดขึ้นจริง ซึ่งเป็นส่วนหนึ่งที่ทำให้ข้อมูลรั่วไหลนี้ดูน่าเชื่อถือ

อย่างไรก็ตาม ห่วงโซ่การกล่าวอ้างมีจุดเชื่อมที่ยังไม่ได้รับการยืนยันสองจุด: ที่ว่า Scott Gray คือ Bob และที่ว่าการระบุในรายงานสรุปนั้นเป็นการออกจากงานเดียวกันกับที่ทวีตหมายถึง เป็นไปได้อย่างสิ้นเชิงที่ทวีตดังกล่าวกำลังแพร่ข่าวลือที่มีมาก่อนการออกจากงานจริงใดๆ ส่วนนี้คือบทสรุปอย่างตรงไปตรงมา: ตามบันทึก วิศวกร GPU อาวุโสชื่อ Scott Gray ปรากฏอยู่ในรายชื่อผู้ลาออกปี 2026; นอกบันทึก บุคคลนั้นอาจใช่หรือไม่ใช่ Bob ที่ทวีตหมายถึง

เหตุใด "ช้ากว่า 2 เท่า" จึงมีความสำคัญ — และเหตุใดมันอาจไม่ใช่เรื่องง่ายขนาดนั้น

เคอร์เนลเป็นตัวกำหนดตัวเลขสองตัวที่ชี้ขาดเศรษฐกิจของโมเดล นั่นคือโทเคนต่อวินาทีและต้นทุนต่อโทเคน หาก GPT-6.7 ถูกส่งมาพร้อมกับเคอร์เนลสำหรับเสิร์ฟที่มีประสิทธิภาพครึ่งหนึ่งของเวอร์ชัน "Bob-optimized" ที่สมมุติขึ้น ฮาร์ดแวร์ชุดเดียวกันจะเสิร์ฟโทเคนได้ครึ่งหนึ่ง และคำขอเดียวกันจะใช้เวลานานเป็นสองเท่า — ที่ต้นทุนส่วนเพิ่มประมาณสองเท่า สำหรับนักพัฒนาที่จัดเส้นทางทราฟฟิกในระบบโปรดักชัน นี่คือผลกระทบ 2 เท่าของดีเลย์และ 2 เท่าของต้นทุนบนโมเดลเรือธง ซึ่งเป็นตัวเลขแบบที่เปลี่ยนการเลือกโมเดลได้เลย นี่คือเหตุผลที่ข่าวลือนี้มีน้ำหนัก

ทีนี้ เหตุผลที่ควรเคลือบแคลงใจมัน:

ตัวเลข '2x' ไม่มีพื้นฐานที่ระบุไว้ มันเป็นเพียงตัวเลขในโพสต์ — เป็นการทดลองทางความคิด ไม่ใช่การวัด และภาพที่เชื่อมโยงก็ไม่ได้ระบุพื้นฐานใด ๆ เช่นกัน

• เคอร์เนลคือโค้ด และโค้ดมีอายุยืนกว่าผู้เขียน สแต็กการให้บริการที่ Bob (หรือใครก็ตาม) เขียนไว้สำหรับโมเดลรุ่นก่อนหน้านี้ไม่ได้หายไปเมื่อบุคคลนั้นจากไป โมเดลรุ่นถัดไปจะสืบทอดส่วนใหญ่ของมันมา

• องค์กรโครงสร้างพื้นฐานของ OpenAI มีขนาดใหญ่ และตำนานที่ว่า "คนคนเดียวเขียนทุกอย่าง" เกือบจะแน่นอนว่าเป็นการทำให้ง่ายเกินไป ความเสี่ยงจากบุคคลสำคัญนั้นมีจริง แต่แทบจะไม่เป็นแบบสองขั้ว

• แม้แต่การลดประสิทธิภาพอย่างแท้จริงก็จะไม่เปลี่ยนขีดความสามารถ มันเปลี่ยนต้นทุนและความหน่วง — เจ็บปวด แต่ผู้จำหน่ายสามารถดูดซับบางส่วนหรือตั้งราคาเพื่อชดเชยได้ และ OpenAI ได้เปิดตัวฟีเจอร์ความเร็ว (Ultrafast, เร็วขึ้นถึง 14 เท่าบนเรือธงปัจจุบัน) ที่มุ่งเป้าไปที่แรงกดดันด้านต้นทุนการให้บริการแบบนี้พอดี

ข้อกล่าวอ้างที่แข็งแกร่งที่สุดคือสถิติที่ว่าทีมมีคนน้อยกว่าร้อย หากผู้เขียนเคอร์เนลการให้บริการของเรือธงจากไปแล้ว การหาคนมาทดแทนไม่ใช่การจ้างพนักงานเพิ่มจำนวน — แต่เป็นการต้องใช้เวลาไล่ระดับหลายปี นั่นเป็นความเสี่ยงที่สมเหตุสมผลต่อเศรษฐศาสตร์การให้บริการของ OpenAI แต่มันเป็นความเสี่ยงเกี่ยวกับทีม ไม่ใช่ข้อเท็จจริงที่วัดได้เกี่ยวกับโมเดลที่ยังไม่ได้เปิดตัว

สิ่งที่เรารู้จริงๆ เกี่ยวกับ GPT-6.7

โมเดลที่ข่าวลือกล่าวถึงมีประวัติเปิดเผยยาวกว่าที่ทวีตระบุ และส่วนใหญ่เป็นข้อมูลล่าสุด:

• 31 ต.ค. 2025 — แซม ออลต์แมนประกาศบน X ว่า "GPT-6" จะถูกเปลี่ยนชื่อเป็น "GPT-6-7" ซึ่งถูกตีความอย่างกว้างขวางว่าเป็นการอ้างอิงถึงสแลงของเจนอัลฟา "6-7" ไม่มีการยืนยันอย่างเป็นทางการว่า "GPT-6.7" และ "GPT-6-7" เป็นสิ่งเดียวกันโดยเคร่งครัดหรือไม่ ทวีตดังกล่าวปฏิบัติต่อทั้งสองแบบราวกับใช้แทนกันได้ และสื่อส่วนใหญ่ก็ทำเช่นเดียวกัน

• เมษายน 2026 — มีรายงานว่าการฝึกฝน GPT-6 ล่วงหน้าเสร็จสมบูรณ์ โดยมีข่าวลือว่าจะเปิดตัวประมาณวันที่ 14 เมษายน แต่วันนั้นผ่านไปโดยไม่มีการเปิดตัว

• สิงหาคม 2026 — มีข่าวลือว่าการเปิดตัวถูกเลื่อนขึ้นมาเป็นต้นเดือนสิงหาคม โดย OpenAI ข้าม GPT-5.7 ถึง GPT-5.9 ยังไม่ได้รับการยืนยัน

• 1 ส.ค. 2026 — OpenAI ประกาศว่า "Astra" คือชื่อของตระกูลโมเดลรุ่นถัดไป ผ่านรายงานวิจัยที่อ้างว่าแก้โจทย์คณิตศาสตร์ปลายเปิดได้สิบข้อ ยังไม่มีการยืนยันว่า Astra จะเปิดตัวภายใต้ชื่อ GPT-6 หรือไม่

• 7 ส.ค. 2026 — OpenAI หยุดการพัฒนา Astra และเลื่อนการเปิดตัว หลังจากการตรวจสอบความปลอดภัยภายในระบุความเสี่ยงด้านความปลอดภัยทางไซเบอร์ระดับ "วิกฤต" ซึ่งเป็นโมเดลแรกที่ทำให้เกิดระดับดังกล่าว อัลท์แมนกล่าวว่าการเปิดตัวในวงกว้าง "ต้องใช้เวลาอีกสักหน่อย"

• ตลาดพยากรณ์ — ณ กลางเดือนสิงหาคม เทรดเดอร์ให้โอกาสที่ GPT-6 จะเปิดตัวภายในวันที่ 30 กันยายนไว้ที่ประมาณ 62% และภายในวันที่ 31 ธันวาคมที่ประมาณ 90%

• สเปกตามข่าวลือ — บริบทประมาณ 2 ล้านโทเคน ประสิทธิภาพดีขึ้นประมาณ 40% เมื่อเทียบกับรุ่นปัจจุบัน หน่วยความจำเฉพาะบุคคล และสถาปัตยกรรมมัลติโมดัลแบบเนทีฟ ภายใต้โค้ดเนม "Symphony" ทั้งหมดยังไม่ได้รับการยืนยัน

ดังนั้นโมเดลที่อยู่เบื้องหลัง "2x slower" ยังไม่ได้เปิดตัว ไม่มีกำหนดวันวางจำหน่ายที่ยืนยันแล้ว และกำลังอยู่ระหว่างการตรวจสอบด้านความปลอดภัย ตัวเลขความเร็วในการให้บริการที่ผูกกับโมเดลนี้จึงเป็นการคาดเดาถึงสองชั้น — ครั้งแรกสำหรับวันที่ ครั้งที่สองสำหรับความเร็ว

A timeline infographic titled 'GPT-6.7 — the trail so far' with five milestone cards: Oct 31 2025 (renamed GPT-6-7 by Altman), Apr 2026 (pre-training reported done), Aug 1 2026 (Astra family name announced), Aug 7 2026 (safety pause: critical cyber risk), Aug 15 2026 (Bob departure rumor circulates); footer reads 'Timeline per OpenAI announcements and press reports; model unreleased as of Aug 15 2026.' OrcaRouter logo in the bottom-right corner.

กระดานคะแนนเดียวที่ซื่อสัตย์ในวันนี้

{{1}}เนื่องจาก GPT-6.7 ยังไม่มีอยู่จริง{{/1}} {{2}}กระดานคะแนนจึงทำได้เพียงเปรียบเทียบข่าวลือกับสิ่งที่เปิดใช้งานจริงในตอนนี้เท่านั้น{{/2}}

• GPT-6.7 (ยังไม่เผยแพร่) — สถานะ: ยังไม่วางจำหน่าย; เปิดตัว: ตามข่าวลือในฤดูใบไม้ร่วง 2026; บริบท: ~2M โทเค็น (ตามข่าวลือ); ความเร็ว: "ช้ากว่า 2 เท่า?" ยังไม่ยืนยัน; ราคา: n/a; กำหนดเส้นทางได้: ยังไม่ได้

• GPT-5.6 Sol (live) — สถานะ: พร้อมใช้งาน; บริบท: 1.05M โทเค็น, สูงสุด 128K เอาต์พุต; ความเร็ว: ~290 tok/s ที่สังเกตได้จากสถิติ 7 วันของ OrcaRouter; ราคา: $5.00 ต่อล้านโทเค็นอินพุต / $30.00 ต่อล้านโทเค็นเอาต์พุต ในระดับอินพุตมาตรฐาน; สามารถกำหนดเส้นทางได้: ใช่ ในราคารายการของผู้ให้บริการ

ความแตกต่างที่น่าสนใจอยู่ที่คอลัมน์ราคา เรือธงปัจจุบันของ OpenAI คิดค่าบริการ $5/$30 ต่อล้านโทเคนผ่าน OrcaRouter และอัตราการส่งผ่านคือราคารายการของผู้ให้บริการเองโดยไม่มีการบวกเพิ่มใดๆ — ดังนั้นไม่ว่า OpenAI จะตั้งราคา GPT-6.7 ไว้ที่เท่าใด ตัวเลขฝั่งเราก็จะขยับตามในวันเดียวกับที่มันเปิดตัว โดยไม่ต้องเจรจาใหม่ นั่นคือส่วนที่มีประโยชน์ของกระดานคะแนนสำหรับผู้ที่วางแผนโดยอิงกับโมเดลถัดไป

A two-column scoreboard titled 'GPT-6.7 vs GPT-5.6 Sol — the scoreboard'. Left column GPT-6.7 (unreleased): Status not shipped, Release rumored autumn 2026, Context ~2M (rumored), Speed 2x slower? (unverified), Price n/a, On OrcaRouter not yet. Right column GPT-5.6 Sol (live): Status shipping, Release live now, Context 1.05M tokens, Speed ~290 tok/s, Price $5.00/$30.00 per M, On OrcaRouter yes at list price. Footer: 'GPT-6.7 figures rumored/unaudited; GPT-5.6 Sol per OrcaRouter model page.' OrcaRouter logo in the bottom-right corner.

วิธีจัดการกับการรั่วไหลแบบนี้

รูปแบบนี้เป็นสิ่งที่คุ้นเคย: โมเดลที่ยังไม่เปิดตัว ตัวเลขที่โดดเด่น บุคคลที่มีชื่อ แต่ละส่วนล้วนเป็นไปได้และไม่มีส่วนใดที่ได้รับการยืนยัน การตอบสนองที่ถูกต้องไม่ใช่การเพิกเฉยต่อข่าวลือหรือการเดิมพันกับมัน — แต่คือการจัดโครงสร้างการตัดสินใจเพื่อให้คุณไม่จำเป็นต้องเลือก

นั่นคือเหตุผลที่ต้องมี routing เมื่อ GPT-6.7 เปิดตัว วิธีประเมินข้อกล่าวอ้างที่ว่ามันช้ากว่า 2 เท่า โดยไม่ต้องเดิมพันกับเส้นทาง production คือการวางมันไว้หลัง endpoint เดียวกับที่คุณใช้อยู่แล้ว: ใช้คีย์ API ชุดเดียว, มีการ failover อัตโนมัติไปยัง GPT-5.6 Sol ทันทีที่โมเดลใหม่ทำงานได้ไม่ดี, และให้ทราฟฟิกจริงเป็นคนตัดสินว่าข่าวลือนั้นเป็นจริงหรือไม่ ข้อกล่าวอ้างจึงกลายเป็นข้อมูลวัดผลแทนที่จะเป็นทวีต ถ้ารายการราคาของ OpenAI เปลี่ยนไปพร้อมกับการเปิดตัวโมเดลใหม่ อัตรา pass-through จะอัปเดตในวันเดียวกัน — OrcaRouter ส่งผ่านราคารายการของผู้ให้บริการโดยไม่คิดมาร์กอัปเพิ่ม ดังนั้นการลดราคา (หรือขึ้นราคา) ของผู้ให้บริการจึงมีผลทันทีที่นี่ โดยไม่ต้องเจรจาใหม่

ในขณะเดียวกัน เรือธงปัจจุบันคือสิ่งที่เป็นรูปธรรม GPT-5.6 Sol เปิดให้บริการบน OrcaRouter ในวันนี้ที่ราคา $5/$30 ต่อล้านโทเคน พร้อมบริบท 1.05M โทเคน และอัตรา ~290 โทเคนต่อวินาทีตามที่กระดานคะแนนแสดง โหมด Ultrafast ที่ประกาศเมื่อวันที่ 13 สิงหาคม — เร็วขึ้นถึง 14 เท่า ประมาณ 750 โทเคนต่อวินาทีบนโครงสร้างพื้นฐานของ Cerebras — ใช้ได้กับโมเดลนั้น ไม่ใช่ GPT-6.7 และเป็นเครื่องเตือนใจว่า OpenAI สามารถโจมตีต้นทุนการให้บริการด้วยโครงสร้างพื้นฐานเช่นเดียวกับด้วยเคอร์เนล

Screen capture of the OrcaRouter model page for GPT-5.6 Sol, showing the OpenAI flagship's pricing ($5.00 in / $30.00 out per million tokens), a 1.05M-token context window, 128K max output, Vision/Tools/JSON/Reasoning capability tags, and a p50 time-to-first-token of 1.87 seconds.

สิ่งที่เรากำลังดูอยู่ตอนนี้

• ไม่ว่าการจากลาของ Bob จะได้รับการยืนยันหรือไม่ OpenAI ไม่ได้แสดงความเห็นว่า Bob คือใคร เหตุการณ์ที่ใกล้เคียงที่สุดที่มีการบันทึกไว้คือชื่อของ Scott Gray ในรายชื่อผู้จากลาในปี 2026 หาก OpenAI หรือ Gray ยืนยันเรื่องนี้ ห่วงแรกของโซ่ก็จะกลายเป็นข้อเท็จจริง

• ว่าเลข "ช้ากว่า 2 เท่า" จะมีหลักฐานรองรับหรือไม่ หาก GPT-6.7 เปิดตัวและมีการวัดความเร็วโดยอิสระ ตัวเลขดังกล่าวก็จะไม่เป็นเพียงข่าวลืออีกต่อไป — ไม่ถูกยืนยันก็ถูกปลดระวาง จนกว่าจะถึงตอนนั้น มันก็เป็นเพียงตัวเลขในโพสต์

• ไม่ว่าการหยุดชั่วคราวด้านความปลอดภัยของ Astra จะทำให้กำหนดการเลื่อนออกไปหรือไม่ ตลาดการคาดการณ์ได้ขยับ GPT-6 ออกจากเดือนสิงหาคมไปแล้ว การกำหนดระดับ "วิกฤต" และการทดสอบภาครัฐที่ OpenAI กล่าวว่าต้องการ ต่างก็เป็นปัจจัยธรรมชาติที่ก่อให้เกิดความล่าช้าเพิ่มเติม

• ไม่ว่าเคอร์เนลเบนช์จะทำการเรียงลำดับใหม่หรือไม่ หากทีมเซิร์ฟวิ่งของ OpenAI รับเอาความสูญเสียนั้นไว้ — หรือตำนานกล่าวเกินจริงถึงส่วนแบ่งของบุคคลคนหนึ่ง — ข่าวลือทั้งหมดก็ไร้ความหมาย และสัญญาณแรกก็คือประสิทธิภาพการให้บริการของโมเดลถัดไปเทียบกับรุ่นก่อนหน้า

การอ่านอย่างตรงไปตรงมา: "ช้าลง 2 เท่า" เป็นเรื่องราวที่น่าสนใจ และเท่าที่ผ่านมา ก็เป็นเพียงแค่นั้น การจากไปของอัจฉริยะเคอร์เนลคือจุดข้อมูลจริงที่มีหลักฐานเป็นเอกสารจริง ตัวเลขความเร็วเป็นแค่ตัวเลขในทวีต จนกว่า GPT-6.7 จะเปิดตัว จุดยืนที่ป้องกันได้คือการวางแผนสำหรับผลลัพธ์ทั้งสองแบบ — สมมติว่าข่าวลืออาจเป็นจริงบางส่วน และสร้างการกำหนดเส้นทางเพื่อให้เรือธงที่ช้ากว่าที่คาดไว้ไม่มีค่าใช้จ่ายใดๆ ในการทดสอบ นั่นคือประเด็นทั้งหมดของการกำหนดเส้นทางโมเดลที่คุณยังไม่เคยพบ

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

providers@orcarouter.ai

เข้าร่วมคอมมูนิตี้ของเรา

Discordsupport@orcarouter.aiXGitHubYouTube