
GPT-5.6 Luna: การลดราคา 80% ของ OpenAI เปลี่ยนอะไรไปจริง ๆ
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
GPT-5.6 Luna มีราคาถูกกว่าราคาเปิดตัวถึง 80% นับตั้งแต่ปลายเดือนกรกฎาคม และ OpenAI เริ่มมองเรื่องนี้เป็นข้อโต้แย้งมากกว่าจะเป็นส่วนลด โมเดลนี้ — รุ่นที่เร็วและต้นทุนต่ำในตระกูล GPT-5.6 — เปิดให้ใช้งานทั่วไปเมื่อวันที่ 9 กรกฎาคม 2026 ในราคา 1.00 ดอลลาร์ต่ออินพุตหนึ่งล้านโทเคน และ 6.00 ดอลลาร์ต่อเอาต์พุตหนึ่งล้านโทเคน ปัจจุบันคิดค่าบริการที่ 0.20 และ 1.20 ดอลลาร์ เมื่อวันที่ 9 กันยายน Sarah Friar ประธานเจ้าหน้าที่ฝ่ายการเงินของ OpenAI ได้กล่าวในงานประชุม Goldman Sachs Communacopia ว่า การลดราคาดังกล่าวทำให้การใช้งานเพิ่มขึ้นราวสิบเท่า และการนำ Luna ไปใช้งานนั้นถูกกว่าการรัน GLM 5.3 ของ Z.ai บนเลเยอร์คลาวด์
ข้อกล่าวอ้างสุดท้ายนั้นเป็นของ OpenAI เอง โดยผู้บริหารคนหนึ่งกล่าวในงานประชุมนักลงทุน และควรได้รับการปฏิบัติแบบเดียวกับตัวเลขจากผู้ขายรายอื่น ๆ ทุกประการ: มีค่าแก่การรายงาน มีค่าแก่การตรวจสอบ แต่ไม่ควรพูดซ้ำราวกับเป็นข้อเท็จจริงที่ยุติแล้ว ส่วนราคานั้นเป็นอีกเรื่องหนึ่ง ราคานี้เป็นข้อมูลสาธารณะ และยังไม่ปรับตัวกลับ
อะไรกันแน่ที่เปลี่ยนไป และเมื่อไหร่
ไม่มีอะไรเกี่ยวกับขีดความสามารถ หน้าต่างบริบท หรือความพร้อมใช้งานของ GPT-5.6 Luna ที่เปลี่ยนแปลงไปในเดือนกันยายน สิ่งที่เปลี่ยนไปคือวิธีที่ OpenAI ขายมัน และการเปลี่ยนแปลงนั้นมีวันที่ห้าวันอยู่เบื้องหลัง
• 26 มิถุนายน 2026 — OpenAI ประกาศเปิดตัวตระกูล GPT-5.6 (GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna) ในรูปแบบการทดลองใช้งานแบบจำกัดสำหรับกลุ่มพันธมิตรรายเล็ก ๆ ภายหลังการประสานงานกับหน่วยงานรัฐบาลสหรัฐฯ
• 9 กรกฎาคม 2026 — เปิดให้ใช้งานทั่วไป (general availability) Sol, Terra และ Luna เข้าสู่ API ในราคา $5/$30, $2.50/$15 และ $1/$6 ต่อ 1 ล้านโทเคนอินพุต/เอาต์พุต ตามลำดับ
• ปลายเดือนกรกฎาคม 2026 — การลดราคา 80% เฉพาะ Luna เท่านั้น เหลือ $0.20 ขาเข้า และ $1.20 ขาออก การอ่านอินพุตที่แคชไว้ได้รับส่วนลดประมาณ 90% เมื่อเกินเกณฑ์บริบทแบบยาว อัตราจะเพิ่มขึ้นราวสองเท่า เป็นประมาณ $0.40/$1.80
• 6–7 สิงหาคม 2026 — Luna เข้ามาแทนที่ GPT-5.5 Instant ในฐานะโมเดลเริ่มต้นสำหรับ ChatGPT Free และ Go โดยมีแชทข้อความแบบไม่จำกัด และปุ่ม "Think" สำหรับการให้เหตุผลเชิงลึกที่จะมาถึงในสัปดาห์ถัดไป การประเมินภายในของ OpenAI ระบุว่าอัตราการตอบกลับของ Luna ที่มีข้อผิดพลาดทางข้อเท็จจริงอย่างน้อยหนึ่งจุดนั้นต่ำกว่า GPT-5.5 Instant ประมาณ 62% ในพรอมป์ด้านการเงิน การแพทย์ และกฎหมาย — เป็นตัวเลขที่ผู้ขายรายงานเอง ไม่ใช่ข้อมูลจากแหล่งอิสระ
• 9 กันยายน 2026 — ความเห็นของ Friar ซึ่งเปิดเผยตัวเลขต่อสาธารณะเกี่ยวกับผลของการปรับลดดังกล่าวเป็นครั้งแรก: การใช้งานเพิ่มขึ้นราว 10 เท่า รายได้จากลูกค้าองค์กรเพิ่มขึ้น 32% จากเดือนมิถุนายนถึงกรกฎาคม เทียบกับการเติบโตแบบเทียบรายปีโดยรวมที่ 20% และ Codex มีผู้ใช้ 25 ล้านคน
เมื่ออ่านรวมกัน วันที่เหล่านั้นอธิบายถึงการเปลี่ยนผ่านในระยะสองเดือนของระดับราคาถูกให้กลายเป็นกลยุทธ์เชิงปริมาณ Luna เป็นระดับที่ถูกออกแบบมาเสมอเพื่อรองรับงานปริมาณสูงและความซับซ้อนต่ำ — การจำแนกประเภท การสกัดข้อมูล การจัดเส้นทาง และร่างฉบับแรก การลดราคาดังกล่าวทำให้เหตุผลเชิงตัวเลขที่รองรับการวางตำแหน่งนั้นยิ่งยากที่จะโต้แย้ง
ตัวเลขที่สำคัญยิ่งกว่าราคาโทเคน

ราคาที่ติดป้ายไว้คือจุดที่การเปรียบเทียบส่วนใหญ่หยุดลง และสำหรับ Luna แล้ว ราคานั้นยิ่งทำให้มันดูดีขึ้นไปอีก ที่ราคา $0.20/$1.20 มันถูกกว่า Claude Haiku 4.5 ของ Anthropic — สิ่งที่ใกล้เคียงที่สุดกับคู่แข่งโดยตรงของมัน — ราว 5 เท่าในส่วนอินพุต และ 4 เท่าในส่วนเอาต์พุต
Artificial Analysis วัดสิ่งที่สะดวกน้อยกว่า: ต้นทุนต่อหนึ่งงาน Intelligence Index ที่ทำเสร็จ ซึ่งนับรวมจำนวนโทเคนที่โมเดลใช้ไปจริงเพื่อทำงานเดียวกันให้เสร็จ บนดัชนีปัจจุบัน การกำหนดค่าการให้เหตุผลของ GPT-5.6 Luna อยู่ที่$0.18 ต่องาน. Claude Haiku 4.5 ในการกำหนดค่าการให้เหตุผลมาอยู่ที่$0.21.
นั่นเป็นช่องว่างประมาณ 14% ไม่ใช่ 5 เท่า เหตุผลคือความเยิ่นเย้อ การทำชุดประเมินนั้นให้เสร็จใช้โทเคนเอาต์พุตของ Luna ประมาณ 150M เทียบกับ 78M ของ Haiku Luna ให้เหตุผลอย่างยาว และโทเคนเอาต์พุตถูกคิดราคาเป็นหกเท่าของอัตราอินพุต
การตีความเชิงปฏิบัติแบ่งออกได้อย่างชัดเจน สำหรับงานที่ให้ผลลัพธ์สั้นและมีปริมาณมาก — การจำแนกประเภท การติดแท็ก การสกัดข้อมูล การจัดเส้นทางคำขอ ฉบับร่างรอบแรก — ส่วนลด 80% นั้นเป็นของจริง มีขนาดใหญ่ และปรากฏโดยตรงบนใบแจ้งหนี้ สำหรับงานที่โมเดลให้เหตุผลก่อนจะตอบ ส่วนสำคัญของส่วนลดถูกใช้ไปกับโทเคนเอาต์พุตที่เพิ่มขึ้น ทั้งสองข้อเป็นจริงพร้อมกัน และข้อที่สองคือส่วนที่ความครอบคลุมของส่วนลดนั้นมองข้ามไป
นอกจากนี้ยังควรทราบว่า ดัชนีนี้ระบุอะไรเกี่ยวกับขีดความสามารถ เพราะแต่ละระดับไม่ได้ใกล้กันเลย ปัจจุบัน Artificial Analysis ให้คะแนน GPT-5.6 Luna ที่ 38 อยู่อันดับสี่จาก 177 โมเดลในคลาสของมัน ส่วนการตั้งค่าการให้เหตุผลของ Claude Haiku 4.5 ได้คะแนน 18 อยู่อันดับ 138 จาก 200 มีข้อควรระวังสองประการเกี่ยวกับตัวเลขเหล่านั้น ประการแรก ดัชนีนี้ถูกให้คะแนนใหม่ในเดือนกันยายน 2026 ดังนั้นตัวเลข ณ เวลาที่เปิดตัว — รวมถึง 51 และ 52 ที่ยังคงถูกอ้างถึงสำหรับ Luna — จึงเป็นการอ้างอิงจากมาตรวัดที่เลิกใช้แล้ว ประการที่สอง Artificial Analysis ได้นำ GPT-5.6 Luna มาใช้เป็นผู้ให้คะแนนเพียงตัวเดียวสำหรับการประเมินหลายรายการของตนเอง ซึ่งเป็นสิ่งที่ควรสังเกตเมื่ออ่านคะแนนของมัน
ทำไม OpenAI จึงยกข้อโต้แย้งนี้ขึ้นมาตอนนี้
การตัดลด 80% ที่ประกาศเมื่อปลายเดือนกรกฎาคมไม่จำเป็นต้องมี CFO กลับมาโต้แย้งซ้ำในเดือนกันยายน การที่เธอทำเช่นนั้นบอกคุณได้ว่าการตัดครั้งนั้นมีไว้เพื่ออะไร
โมเดลจีนแบบเปิดน้ำหนักใช้ปี 2026 ไปกับการกดดันในแกนเดียวกับที่ Luna ยึดครองอยู่พอดี: คุณภาพที่เพียงพอในราคาที่ทำให้การคิดต้นทุนต่อโทเคนกลายเป็นปัจจัยชี้ขาด การตัดราคาในเรื่องนั้นบนการติดตั้งแบบคลาวด์เป็นข้อกล่าวอ้างที่ทำได้ยากกว่าการตัดราคาในเรื่องน้ำหนัก และนั่นคือข้อกล่าวอ้างที่ OpenAI เลือก — โดยระบุชื่อ GLM 5.3 อย่างเจาะจง แทนที่จะเอ่ยถึง "โมเดลเปิด" แบบกว้าง ๆ โดยทั่วไป
ตัวเลขระดับองค์กรที่ Friar จับคู่กับมันชี้ไปในทิศทางเดียวกัน รายได้ระดับองค์กรที่เติบโต 32% เมื่อเทียบเดือนต่อเดือน เทียบกับ 20% โดยรวม คือภาพของบริษัทที่ขายเข้าสู่วัฏจักรการจัดซื้อจัดจ้าง และวัฏจักรการจัดซื้อจัดจ้างคือจุดที่รายการค่าใช้จ่ายจะถูกตั้งคำถาม เธอยังยืนยันว่า OpenAI กำลังทดลองใช้การกำหนดราคาตามผลลัพธ์ โดยผูกค่าธรรมเนียมเข้ากับผลลัพธ์ทางธุรกิจแทนที่จะอิงกับการใช้โทเคน นั่นเป็นการยอมรับที่มีนัยสำคัญสำหรับบริษัทที่โมเดลรายได้ทั้งหมดเป็นแบบคิดต่อโทเคน: มันบ่งชี้ว่าในตลาดระดับราคาถูก ตัวเลขต่อโทเคนกำลังกลายเป็นเหตุผลในการขายที่อ่อนแอลง เมื่อเทียบกับสิ่งที่โมเดลทำสำเร็จ
ไม่มีสิ่งใดในนั้นทำให้การเปรียบเทียบ GLM ได้รับการยืนยัน ข้ออ้างของ Friar ตั้งอยู่บนการเปรียบเทียบการติดตั้งใช้งานบนคลาวด์ที่ OpenAI ไม่ได้เผยแพร่โดยละเอียด และ "ถูกกว่าการรัน X เองบนชั้นคลาวด์" ขึ้นอยู่ทั้งหมดกับว่าคลาวด์ใด อินสแตนซ์ใด และสมมติฐานการใช้งานเต็มความสามารถแบบใดที่คุณเลือก มองมันเป็นข้ออ้างที่มีจุดยืนจากฝ่ายที่มีส่วนได้ส่วนเสีย และตรวจสอบกับเวิร์กโหลดของคุณเองก่อนที่มันจะเปลี่ยนแปลงสิ่งที่คุณสร้าง
มันเปลี่ยนอะไรบ้างหากคุณกำหนดเส้นทางข้ามโมเดลอยู่แล้ว

มีสามสิ่งที่สำคัญตรงนี้มากกว่าราคาที่โฆษณาไว้
การลดราคามีผลในวันที่เกิดขึ้นจริง OrcaRouter ส่งต่อราคาตามรายการของผู้ให้บริการโดยบวกเพิ่ม 0% ดังนั้นเมื่อผู้ขายปรับอัตรา ราคาฝั่งเราก็เปลี่ยนตามไปด้วย — ไม่ต้องมีตั๋วซัพพอร์ต ไม่ต้องเจรจาสัญญาใหม่ ไม่ต้องมีความสัมพันธ์ด้านการเรียกเก็บเงินที่สอง นั่นคือเหตุผลทั้งหมดที่การลดราคาในเดือนกรกฎาคมคุ้มค่าที่จะเขียนถึงมากกว่าแค่กล่าวถึง: สำหรับใครก็ตามที่เรียกใช้ Luna ผ่าน API เดียวสำหรับ 200+ โมเดล ซึ่งเปิดใช้งานจริงในวันเดียวกัน
alias นี้เป็นกับดัก ที่ไม่มีคำต่อท้ายgpt-5.6 เป็นตัวระบุที่ชี้ไปยังระดับเรือธง Sol ไม่ใช่ Luna ดังนั้นการผสานรวมใด ๆ ที่ต้องการเศรษฐศาสตร์ของ Luna ต้องปักหมุด gpt-5.6-luna อย่างชัดเจน สิ่งนี้มีเอกสารระบุไว้ในคู่มือสำหรับนักพัฒนาของตระกูลนี้ และยังคงเป็นหนึ่งในวิธีที่พบบ่อยที่สุดที่การโยกย้ายไปยัง "ระดับราคาถูก" เรียกเก็บเงินในอัตราระดับเรือธงอย่างเงียบ ๆ
ระดับราคาถูกสลับระบบสำรองได้ดี โมเดลในระดับราคานี้มักทำงานที่การเจอ 503 ชั่วคราวมีต้นทุนสูง — การเรียกจัดประเภทหลายพันครั้ง ไม่ใช่การตอบกลับสำคัญเพียงครั้งเดียว การส่งคำขอเดิมไปยังผู้ให้บริการหลายรายของ GPT-5.6 Luna พร้อมการสลับระบบสำรองอัตโนมัติคือความแตกต่างระหว่างคิวลองใหม่กับระบบล่ม และเป็นฟีเจอร์ที่ทำให้ระดับราคาต่ำปลอดภัยพอจะวางไว้ในเส้นทางโปรดักชัน
คุณสามารถดูอัตราค่าบริการปัจจุบันและตัวเลข p50/p95 ของเวลาถึงโทเคนแรกได้ที่หน้า GPT-5.6 Luna บน OrcaRouter — น่าลองดู เพราะหน้าราคาของผู้ให้บริการมักอัปเดตช้ากว่าการลดราคา และตัวติดตามของบุคคลที่สามก็ยิ่งตามหลังทั้งสองอย่าง
สิ่งที่ควรดูต่อไป
มีสามสิ่งที่จะเปลี่ยนเรื่องนี้จากเรื่องราคาให้กลายเป็นอีกเรื่องหนึ่ง
การปรับลดอีกครั้ง การรายงานข่าวด้านการเงินภาษาจีนในช่วงต้นเดือนกันยายนได้นำเสนอ OpenAI ว่ากำลังเตรียมปรับราคาอีกครั้งเพื่อรับมือกับการแข่งขันจากโมเดลโอเพนเวท การรายงานนั้นเป็นการคาดการณ์ล่วงหน้าและยังไม่ได้รับการยืนยัน แต่ก็สอดคล้องกับบริษัทที่ได้ยอมรับการลดลง 80% สำหรับระดับปริมาณการใช้งานแล้ว และขณะนี้กำลังโต้เถียงต่อสาธารณะเกี่ยวกับต้นทุนต่อการปรับใช้
การกำหนดราคาตามผลลัพธ์กำลังกลายเป็นจริง หาก OpenAI เริ่มขาย Luna ตามผลลัพธ์ทางธุรกิจแทนที่จะขายตามโทเคน การเปรียบเทียบราคาต่อโทเคนที่ตลาดทั้งหมดนี้ดำเนินอยู่บนพื้นฐานดังกล่าวก็จะไม่ใช่กระดานคะแนนที่เกี่ยวข้องอีกต่อไป — และการประเมินต้นทุนต่องานทุกชิ้น รวมถึงตัวเลขข้างต้นด้วย จำเป็นต้องคำนวณใหม่ทั้งหมด
ผู้สืบทอดที่มีความสามารถในราคาเดียวกัน GPT-6 Astra มีอยู่แล้วเหนือสาย GPT-5.6 และตำแหน่งของ Luna เองก็ขึ้นอยู่กับว่า OpenAI จะปล่อยให้มันอยู่ตรงนั้นหรือไม่ ทันทีที่มีระดับเล็กรุ่นใหม่กว่าเปิดตัวในราคา $0.20/$1.20 คำถามที่น่าสนใจจะไม่ใช่เรื่องที่ว่า Luna ราคาถูกหรือไม่ อีกต่อไป แต่จะกลายเป็นเรื่องที่ว่ามันยังเป็นตัวเลือกที่ถูกที่สุดที่คุ้มค่าจะส่งคำขอไปให้หรือไม่

สำหรับตอนนี้ สถานการณ์เรียบง่ายอย่างผิดปกติ GPT-5.6 Luna เป็นโมเดลอายุสองเดือนที่ข่าวคือราคา ไม่ใช่ความสามารถ — และราคาต่อโทเคนเป็นวิธีมองที่ดูดีที่สุด ไม่ใช่วิธีที่แม่นยำที่สุด
