
OpenAI ปรับลดราคา GPT-5.6 API: อะไรที่เปลี่ยนไป เหตุใด และวิธีรับสิทธิ์ใช้งาน
- typesafeใหม่TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 984 tok/s
- openaiใหม่OpenAI: GPT-6 Luna2026-09-2237ความฉลาด
- openaiใหม่OpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- anthropicใหม่Anthropic: Claude Opus 5.52026-09-2258ความฉลาด
- grokใหม่Grok 4.72026-09-2146ความฉลาด
- Orcaใหม่Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 ต่อ 1 ล้านโทเค็น · 195 tok/s
- orcaใหม่Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- anthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
เมื่อวันที่ 30 กรกฎาคม 2026 OpenAI ได้ลดราคา API ของโมเดล GPT-5.6 ระดับล่างสองรุ่น — โดยลดระดับที่ถูกที่สุดลงอย่างมาก และปรับลดระดับกลางลงเล็กน้อย สามสัปดาห์ต่อมา ก็ถึงคิวของรุ่นเรือธง: เมื่อวันที่ 21 สิงหาคม 2026 OpenAI ประกาศว่า ราคา API ของ GPT-5.6 Sol จะลดลงมากกว่า 20% ในอีกสามเดือนข้างหน้า ขณะที่บริษัททำงานเพื่อทำให้โมเดลทำงานมีประสิทธิภาพมากขึ้น บทความนี้จะอธิบายว่ามีอะไรเปลี่ยนแปลงไปบ้างในทั้งสองรอบ วิศวกรรมเบื้องหลัง ราคาใหม่เทียบกับคู่แข่งเป็นอย่างไร ต้นทุนแฝงที่ต้องระวัง วิธีลดค่าใช้จ่ายเพิ่มเติม — และราคาที่ลดลงนี้ใช้งานได้แล้วบน OrcaRouter โดยคิดมาร์กอัป 0%
ตัวเลขทุกตัวด้านล่างระบุแหล่งที่มากำกับไว้ ราคาคิดต่อล้านโทเคน (อินพุต / เอาต์พุต) อัตราของ Luna และ Terra สะท้อนเรตการ์ดของ OpenAI ฉบับวันที่ 30 กรกฎาคม 2026 ตามรายงานของสื่อต่างๆ รวมถึง Unite.AI ส่วนการลดราคาของ Sol สะท้อนการประกาศของ OpenAI เมื่อวันที่ 21 สิงหาคม 2026 โดยราคาต่อโทเคนเป็นไปตามรายงานของสื่อต่างๆ รวมถึง Runtimewire และ Reuters หน้าโมเดลแบบส่งผ่านต้นทุน (pass-through) ของ OrcaRouter แสดงตัวเลขเดียวกัน ส่วนตัวเลขของคู่แข่งระบุแหล่งที่มาไว้แล้ว ราคามีการเปลี่ยนแปลง — ตรวจสอบก่อนนำไปสร้างระบบ
TL;DR. OpenAI ลดราคา GPT-5.6 Luna เหลือ $0.20 / $1.20 (จาก $1 / $6 ลดลง ~80%) และ GPT-5.6 Terra เหลือ $2 / $12 (จาก $2.50 / $15 ลดลง ~20%) ในวันที่ 30 กรกฎาคม. ในวันที่ 21 สิงหาคม บริษัทขยายส่วนลดไปยังรุ่นเรือธง: ราคา API ของ GPT-5.6 Sol ลดลงมากกว่า 20% ในอีกสามเดือนข้างหน้า — เหลือ $4 / $20 ต่อล้านโทเค็น จาก $5 / $30 ตามที่ OpenAI กล่าว — ในขณะที่เครดิตที่ใช้โทเค็นของ Codex และ ChatGPT Work ซื้อได้มากขึ้น และการใช้งานแบบสมัครสมาชิกยังคงไม่เปลี่ยนแปลง. ผลงานด้านประสิทธิภาพสองอย่างช่วยจ่ายสำหรับการลดราคาเดือนกรกฎาคม: เคอร์เนล GPU ที่เขียนใหม่ (ต้นทุนการให้บริการลดลงประมาณ 20%) และแบบจำลอง draft สำหรับ speculative decoding ที่ออกแบบใหม่ (สร้างโทเค็นได้เร็วขึ้น 15%+). หากคุณเชื่อมต่อผ่านเอนด์พอยต์ที่เป็นกลางต่อผู้ให้บริการและไม่มีมาร์กอัป 0% เช่น OrcaRouter อัตราใหม่ก็พร้อมใช้งานแล้ว — ราคาเดียวกัน, API ที่เข้ากันได้กับ OpenAI เพียงหนึ่งเดียว, พร้อมกับโมเดลคู่แข่งทุกรุ่นอยู่ใกล้ๆ เพื่อเปรียบเทียบและเลือกเส้นทางระหว่างกัน
ประเด็นสำคัญ
• GPT-5.6 Luna: ตอนนี้ $0.20 / $1.20 ต่อ 1M โทเคน ลดลงจาก $1 / $6 — ลดลงประมาณ 80%
• GPT-5.6 Terra: ตอนนี้ $2 / $12 ลดลงจาก $2.50 / $15 — ประมาณการลด 20%
• GPT-5.6 Sol (รุ่นเรือธง): ตอนนี้ $4 / $20 สำหรับสามเดือนถัดไป ลดลงจาก $5 / $30 — ลดมากกว่า 20% ประกาศเมื่อวันที่ 21 สิงหาคม 2026
• Codex และ ChatGPT Work เครดิตแบบอิงโทเคนซื้อได้มากขึ้น: อินพุต Sol ลดลงเหลือ 100 เครดิต และเอาต์พุตเหลือ 500 เครดิตต่อ 1M โทเคน (จาก 125 / 750)
แผนบริการไม่มีการเปลี่ยนแปลง: การใช้งานที่รวมอยู่ในแพ็กเกจ Plus, Pro และ Business, ขีดจำกัดห้าชั่วโมงต่อสัปดาห์ และอัตราเครดิตแบบดั้งเดิมยังคงไม่ได้รับผลกระทบ
• เหตุผล: OpenAI ระบุว่าทั้งสองรอบเป็นผลตอบแทนจากประสิทธิภาพ — เคอร์เนล GPU สำหรับการผลิตถูกเขียนใหม่ (ต้นทุนการให้บริการลดลง ~20%) รวมถึงการออกแบบโมเดลร่างแบบ speculative decoding ใหม่ (ประสิทธิภาพการสร้างโทเคนเพิ่มขึ้น 15%+) ตามโพสต์วิศวกรรมของ OpenAI เมื่อวันที่ 29 กรกฎาคม
วิธีรับ: อัตราค่าธรรมเนียมที่ลดลงได้สะท้อนอยู่ใน OrcaRouter แล้ว (มาร์กอัป 0%) — Luna ที่ $0.20 / $1.20, Sol ที่ $4 / $20 — ผ่านปลายทางที่เข้ากันได้กับ OpenAI เพียงหนึ่งเดียว
อะไรที่เปลี่ยนไปบ้างกันแน่
ตระกูล GPT-5.6 ของ OpenAI ทำงานเป็นแบบขั้นบันไดระดับ tiers: Luna (เร็วที่สุด ถูกที่สุด), Terra (ระดับกลาง) และ Sol (รุ่นเรือธง) การปรับลดเมื่อวันที่ 30 กรกฎาคมส่งผลกระทบต่อสองระดับที่ถูกกว่า ตามเรตการ์ดที่รายงาน GPT-5.6 Luna ลดลงจาก $1 / $6 เป็น $0.20 / $1.20 ต่อล้านโทเคนอินพุต/เอาต์พุต — คิดเป็นประมาณ 80% ทั้งอินพุตและเอาต์พุต — และ GPT-5.6 Terra ลดลงจาก $2.50 / $15 เป็น $2 / $12 ประมาณ 20% ส่วน GPT-5.6 Sol เรือธงที่สร้างมาเพื่อการให้เหตุผลขั้นสูงสุดและการเขียนโค้ดแบบ agentic ไม่ถูกแตะต้องในวันนั้น — แต่ในวันที่ 21 สิงหาคม 2026 OpenAI ประกาศลดราคาชั่วคราวสำหรับ Sol เช่นกัน: ราคา API ลดลงมากกว่า 20% เป็นเวลาสามเดือนถัดไป เหลือ $4 ต่อล้านโทเคนอินพุต และ $20 ต่อล้านโทเคนเอาต์พุต โดยราคา cached input ลดลงจาก $0.50 เป็น $0.40 ประกาศเดียวกันนี้ยังระบุว่าเครดิตที่คุณซื้อจะคุ้มค่าขึ้นใน Codex สำหรับแผนที่คิดตามโทเคน และการใช้งานที่รวมอยู่ในซับสคริปชันของคุณยังคงเท่าเดิม
อัตราต่อโทเคนพื้นฐานไม่ได้บอกเรื่องทั้งหมด ราคาของ GPT-5.6 ยังมีระดับตามความยาวอินพุต (บริบทที่ยาวมากจะเลื่อนไปอัตราที่สูงขึ้น) ส่วนลดการแคชพรอมพ์ (อินพุตที่ถูกแคชมีราคาถูกกว่าอินพุตใหม่มาก) และตัวเลือกแบบแบตช์ (งานแบบอะซิงโครนัสในราคาลด) ทั้งสามอย่างนี้ยังคงได้รับผลจากการลดราคา ดังนั้นราคาที่แท้จริงสำหรับงานที่ใช้แคชหรือแบตช์หนักอาจต่ำลงได้อีก ระวังระดับบริบทยาวในทิศทางตรงกันข้าม: การป้อนพรอมพ์ขนาดใหญ่อาจทำให้คุณเลื่อนขึ้นไปอีกระดับได้

การปรับแต่งสองอย่างที่อยู่เบื้องหลังการตัด
นี่ไม่ใช่{{1}}กลยุทธ์ขายขาดทุนเพื่อดึงดูดลูกค้า{{/1}} — OpenAI นำเสนอว่ามันคือ{{2}}ผลตอบแทนจากประสิทธิภาพ{{/2}} ในโพสต์ทางวิศวกรรมเมื่อวันที่ 29 กรกฎาคม 2026 ทีมเทคนิคของ OpenAI ได้อธิบายการปรับให้เหมาะสมในด้าน{{3}}การอนุมานผล{{/3}} และ{{4}}โครงสร้างควบคุมเอเจนต์{{/4}} ที่อยู่เบื้องหลัง Codex และ ChatGPT Work มีสองอย่างที่โดดเด่น ประการแรก {{5}}การเขียนเคอร์เนล GPU ใหม่{{/5}} ทั่วโครงสร้างพื้นฐานการผลิต — โดยใช้ {{6}}Sol{{/6}} ซึ่งทำงานภายใน {{7}}Codex{{/7}} เพื่อเขียนเคอร์เนลของบริษัทเองใหม่ — ซึ่ง OpenAI ระบุว่าช่วยลดต้นทุนการให้บริการแบบ end-to-end ลง{{8}}ประมาณ 20%{{/8}} ประการที่สอง {{9}}โมเดลร่างสำหรับการถอดรหัสเชิงคาดการณ์{{/9}} ที่ออกแบบใหม่ ซึ่งรายงานว่าช่วยปรับปรุงประสิทธิภาพการสร้างโทเคนขึ้น{{10}}มากกว่า 15%{{/10}} {{11}}ต้นทุนการให้บริการที่ลดลง ซึ่งส่งต่อถึงลูกค้าในรูปแบบราคาที่ถูกลงสำหรับแพ็กเกจปริมาณการใช้งานสูง{{/11}} คือประเด็นหลัก — และมันคือภาพสะท้อนของ{{12}}วงจรป้อนกลับ{{/12}} ที่ทั้งอุตสาหกรรมกำลังไล่ตาม นั่นคือการใช้โมเดลระดับแนวหน้าเพื่อเพิ่มประสิทธิภาพโครงสร้างพื้นฐานที่ให้บริการโมเดลเหล่านั้นเอง
การลดราคา Sol ที่ประกาศเมื่อวันที่ 21 สิงหาคมมีกรอบการนำเสนอแบบเดียวกัน ตามที่ OpenAI ระบุ การลดลงมากกว่า 20% ในช่วงสามเดือนข้างหน้านี้เกิดขึ้นในขณะที่บริษัททำให้โมเดลมีประสิทธิภาพในการใช้งานมากขึ้น และเป็นการลดชั่วคราวอย่างชัดเจน ไม่ใช่การปรับราคาถาวร
ราคาใหม่เปรียบเทียบกันอย่างไร
การลดราคาครั้งนี้มุ่งเป้าไปที่คู่แข่งโดยตรง ตามรายงานของ Unite.AI ราคาใหม่ของ Luna ที่ $0.20 / $1.20 ต่ำกว่า Haiku 4.5 ของ Anthropic ประมาณ 5 เท่าในส่วนอินพุต และประมาณ 4 เท่าในส่วนเอาต์พุต ส่วนราคาใหม่ของ Terra ที่ $2 / $12 ต่ำกว่าราคามาตรฐานของ Claude Sonnet 5 (ซึ่งรายงานไว้ที่ $3 / $15 และจะมีผลหลังวันที่ 31 สิงหาคม 2026) เมื่อเทียบกับกลุ่มโมเดลโอเพนเวต Luna อยู่ในระดับใกล้เคียงกับระดับราคาต่ำสุดสำหรับการอนุมานที่ DeepSeek รุ่น V4 และ GLM-5.2 ของ Zhipu กำหนดไว้ (ประมาณ $1.20 / $4.10) โดย Qwen ของ Alibaba และ Gemini Flash ของ Google อยู่ในระดับใกล้เคียงกัน การลดราคาชั่วคราวของ Sol เป็น $4 / $20 ยังคงทำให้รุ่นเรือธงอยู่เหนือระดับปริมาณการใช้งานของตัวเองอย่างชัดเจน แต่ลดความพรีเมียมลง และการลดลงหนึ่งในสามของโทเคนเอาต์พุตมีความสำคัญที่สุดสำหรับงานเอเจนต์ที่ใช้เอาต์พุตหนัก รายงานข่าวการเคลื่อนไหวครั้งนี้ระบุว่ามันเกิดขึ้นในขณะที่ OpenAI กำลังเผชิญการแข่งขันที่เพิ่มขึ้นจาก Anthropic และโมเดล AI ของจีน
การอนุมานมีราคาถูกลงเรื่อยๆ
หากมองในภาพกว้าง การปรับลดนี้สอดคล้องกับแนวโน้มระยะยาวหลายปี: ต้นทุนของความสามารถในระดับหนึ่งลดลงอย่างรวดเร็ว รุ่นแล้วรุ่นเล่า ขณะที่ห้องแล็บต่างบีบปริมาณงานจากฮาร์ดแวร์ชุดเดิมให้ได้มากขึ้น ระดับบริการรุ่นเก่าของ OpenAI เองก็สะท้อนแนวโน้มราคาที่ลดลงตามเวลา และความก้าวหน้าด้านประสิทธิภาพแต่ละครั้ง ไม่ว่าจะเป็นเคอร์เนลที่ดีขึ้น การถอดรหัสแบบคาดเดา หรือแอตเทนชันที่ถูกลง มักจะปรากฏเป็นการลดราคาภายในไม่กี่เดือน สำหรับผู้ซื้อ นัยเชิงปฏิบัติคือต้องออกแบบสถาปัตยกรรมให้รองรับโลกที่อินเฟอเรนซ์มีราคาถูกลงอย่างเป็นระบบ: อย่าผูกพันกับราคาของโมเดลใดโมเดลหนึ่งมากเกินไป และทำให้การเปลี่ยนโมเดลมีต้นทุนต่ำ
ต้นทุนแอบแฝงที่ต้องจับตามอง: โทเค็นสำหรับการคิด
โมเดล GPT-5.6 เป็นโมเดลแบบใช้เหตุผล (reasoning models) และสิ่งนั้นส่งผลต่อค่าใช้จ่ายในโลกจริง เมื่อเปิดใช้การให้เหตุผล โมเดลจะสร้างโทเคนภายในสำหรับการคิด ซึ่งถูกคิดค่าใช้จ่ายเป็น output ดังนั้นต้นทุน output ที่แท้จริงของคุณจึงสูงกว่าที่การประมาณแบบง่ายๆ อย่าง "จำนวนคำในคำตอบ" ชี้ให้เห็น โดยเฉพาะกับโจทย์ยากๆ ที่ต้องใช้ความพยายามในการให้เหตุผลสูง วิธีแก้คือปรับระดับความพยายามในการให้เหตุผลให้เหมาะกับงาน (ใช้ระดับต่ำหรือปิดสำหรับการเรียกใช้งานง่ายๆ) จำกัดจำนวน output เท่าที่ทำได้ และวัดการใช้งานโทเคนจริงแทนการคาดเดา อัตราราคาต่อโทเคนที่ถูกลงช่วยได้ แต่การควบคุมจำนวนโทเคนที่คุณสร้างขึ้นช่วยได้มากกว่า
มันหมายความว่าอย่างไรสำหรับนักพัฒนา
หากคุณใช้ {{1}}GPT-5.6 Luna หรือ Terra{{/1}} สำหรับงานปริมาณมาก — {{2}}การจัดหมวดหมู่ การแยกข้อมูล การจัดเส้นทาง เอเจนต์น้ำหนักเบา แชท{{/2}} — ค่าใช้จ่ายของคุณลดลงทันที ในบางกรณีลดลงเกือบทั้งหมด โดยไม่ต้องแก้ไขโค้ดแม้แต่บรรทัดเดียว ทำให้ระดับปริมาณการใช้งานน่าสนใจยิ่งขึ้น{{3}}สำหรับงานที่อ่อนไหวต่อต้นทุน{{/3}} และลดช่องว่างด้านราคากับโมเดลเปิดราคาถูกลง ตัวเลขค่าใช้จ่ายของรุ่นเรือธงก็เปลี่ยนไปเช่นกัน อย่างน้อยก็ในตอนนี้: {{4}}Sol ที่ $4 / $20{{/4}} {{5}}ในอีกสามเดือนข้างหน้า{{/5}} ช่วยลดต้นทุนของงานที่ต้องใช้การคิดเชิงลึกและงานแบบเอเจนต์ในระดับสูงสุด และ{{6}}เครดิต Codex และ ChatGPT Work แบบคิดตามโทเคน{{/6}}ใช้ได้ยาวขึ้น ยังคงเป็นตัวเลือกระดับพรีเมียม{{7}}สำหรับงานที่ยากที่สุด{{/7}} — แต่ราคาถูกลงกว่าเดิม รูปแบบที่ชนะยังคงเหมือนเดิม: {{8}}จัดเส้นทางตามความยาก{{/8}} — {{9}}ระดับราคาถูก (หรือโมเดลเปิดราคาถูก) สำหรับงานง่ายๆ 80%{{/9}}, {{10}}รุ่นเรือธงเฉพาะจุดที่คุ้มค่ากับต้นทุนเท่านั้น{{/10}}
วิธีลดบิลของคุณให้มากขึ้นอีก
การลดราคาคือฐานสำหรับต่อยอด ไม่ใช่เส้นชัย กลไกเสริมที่สำคัญที่สุด: การแคชพรอมป์ต์ (ใช้พรอมป์ต์ระบบคงที่หรือบริบทยาวซ้ำ แล้วจ่ายในอัตราอินพุตที่แคชแล้วซึ่งต่ำกว่ามาก); ตัวเลือกแบบแบตช์ (รันงานที่ไม่เร่งด่วนแบบอะซิงโครนัสพร้อมส่วนลด); การจัดเส้นทางตามระดับและโมเดล (ส่งแต่ละคำขอไปยังโมเดลที่ถูกที่สุดที่รองรับได้ รวมถึงโมเดลโอเพนซอร์ส); และ การควบคุมการใช้เหตุผล (อย่าจ่ายค่าการคิดเชิงลึกสำหรับงานเล็กน้อย) เมื่อประกอบเข้าด้วยกัน กลไกเหล่านี้มักลดค่าใช้จ่ายจริงได้มากกว่าการเปลี่ยนแปลงอัตราใด ๆ เพียงอย่างเดียวมาก เพื่อให้เห็นภาพชัดเจน: ที่ 10 ล้านโทเคนต่อเดือน โดยมีสัดส่วนอินพุต 70% อัตราใหม่ของ Luna คิดเป็นประมาณ $5 ต่อเดือน (ประมาณ $4.37 หากใช้การแคช); ปริมาณเดียวกันบน Sol อยู่ที่ประมาณ $125 ต่อเดือน — นี่คือเหตุผลที่ชัดเจนที่สุดสำหรับการจัดเส้นทางตามระดับความยาก
วิธีคว้าราคาที่ต่ำกว่าได้ทันที
นี่คือส่วนที่เชื่อมโยงทุกอย่างเข้าด้วยกัน OrcaRouter เรียกเก็บมาร์กอัป 0% และส่งต่อราคาจากผู้ให้บริการโดยตรง ดังนั้นการลดราคาของ OpenAI จึงมีผลบน OrcaRouter แล้ว: GPT-5.6 Luna แสดงราคา $0.20 / $1.20, Terra $2 / $12 และ GPT-5.6 Sol $4 / $20 บนหน้าโมเดลในตอนนี้ — อัตราเดียวกันกับรายการราคาของ OpenAI เอง ซึ่งเข้าถึงได้ผ่านเอนด์พอยต์ที่เข้ากันได้กับ OpenAI เพียงจุดเดียว พร้อมกับโมเดลอื่นอีก 185+ รายการ คุณจะได้รับการลดราคานี้โดยไม่ต้องย้ายระบบ และคุณสามารถเปรียบเทียบราคาของ Sol, Luna และ Terra กับ DeepSeek, GLM, Qwen, Gemini และ Claude ได้ในที่เดียว จากนั้นกำหนดเส้นทางแต่ละคำขอไปยังตัวเลือกที่ถูกที่สุดสำหรับงานนั้น นอกจากนี้ยังมีระดับฟรีและหน้า Offers สำหรับส่วนลดเพิ่มเติม

การลดราคาเปิดใช้งานบน OrcaRouter แล้ว: GPT-5.6 Luna ราคา $0.20 / $1.20 และ GPT-5.6 Sol ราคา $4 / $20 ต่อ 1 ล้านโทเค็น โดยส่งผ่านโดยไม่คิดมาร์กอัป (0%)
เลือกเส้นทางตามระดับความยากเพื่อประหยัดมากยิ่งขึ้น
ค่าใช้จ่ายที่ถูกที่สุดไม่ใช่โมเดลเดียว — แต่คือโมเดลที่เหมาะสมกับคำขอแต่ละครั้ง เนื่องจาก OrcaRouter เปิดเผยโมเดลทั้งหมดผ่านเอนด์พอยต์เดียว คุณจึงสามารถส่งคำของ่ายๆ ปริมาณมากไปยัง Luna หรือโมเดลโอเพนซอร์สราคาถูก และเก็บ Sol หรือโมเดลเรือธงอื่นไว้สำหรับคำขอยากๆ โดยสลับได้ด้วยการเปลี่ยนการตั้งค่าแทนที่จะบูรณาการใหม่ การลดราคา Luna ทำให้กลยุทธ์การเลือกใช้โมเดลตามความยากยิ่งถูกลงไปอีก และส่วนลดชั่วคราวของ Sol ก็ช่วยลดต้นทุนของคำขอยากๆ เช่นกัน — โดยไม่ต้องปรับระบบอะไรใหม่

คำถามที่พบบ่อย
OpenAI ลดราคา GPT-5.6 ลงเท่าไหร่?
GPT-5.6 Luna ลดลงจาก $1 / $6 เป็น $0.20 / $1.20 ต่อล้านโทเคน (ประมาณ 80%) และ GPT-5.6 Terra ลดลงจาก $2.50 / $15 เป็น $2 / $12 (ประมาณ 20%) เมื่อวันที่ 21 สิงหาคม 2026 OpenAI ยังได้ลดราคา GPT-5.6 Sol จาก $5 / $30 เป็น $4 / $20 เป็นเวลาสามเดือนถัดไปด้วย
การลดราคามีผลบังคับใช้เมื่อใด?
การปรับลด Luna และ Terra มีผลตั้งแต่วันที่ 30 กรกฎาคม 2026 ตามที่ปรากฏบนตารางอัตราค่าบริการที่เผยแพร่ OpenAI ประกาศการปรับลด Sol ชั่วคราวเมื่อวันที่ 21 สิงหาคม 2026 สำหรับระยะเวลาสามเดือนถัดไป
ทำไม OpenAI ถึงลดราคา
OpenAI ระบุว่าการลดราคาในเดือนกรกฎาคมเป็นผลจากการปรับแต่งด้านการอนุมาน — ได้แก่ การเขียนเคอร์เนล GPU สำหรับการผลิตใหม่ (ทำให้ต้นทุนการให้บริการลดลงประมาณ 20%) และการออกแบบโมเดล speculative-decoding draft ใหม่ (ประสิทธิภาพการสร้างโทเคนเพิ่มขึ้น 15%+) — ตามโพสต์ทางวิศวกรรมเมื่อวันที่ 29 กรกฎาคม 2026 โดยบริษัทได้อธิบายการลดราคา Sol ในลักษณะเดียวกัน ว่าเป็นขั้นตอนที่ดำเนินการในขณะที่ต้นทุนการรันโมเดลถูกลง ท่ามกลางการแข่งขันที่เพิ่มขึ้นในตลาด
เรือธง (Sol) ราคาถูกลงหรือเปล่า
ใช่ — เป็นการชั่วคราว การปรับลดเมื่อวันที่ 30 กรกฎาคมทำให้ GPT-5.6 Sol อยู่ที่ $5 / $30 แต่ในวันที่ 21 สิงหาคม 2026 OpenAI ประกาศลดราคามากกว่า 20% สำหรับสามเดือนถัดไป เหลือ $4 / $20 ต่อล้านโทเคน เครดิตตามจำนวนโทเคนของ Codex และ ChatGPT Work ก็ซื้อได้มากขึ้น ในขณะที่การใช้งานแบบสมัครสมาชิกยังคงไม่เปลี่ยนแปลง
ราคาใหม่เปรียบเทียบกับ Anthropic และโมเดลแบบเปิดอย่างไร?
ตามรายงาน Luna ตอนนี้มีราคาต่ำกว่า Haiku 4.5 ของ Anthropic อยู่ประมาณ 5 เท่าสำหรับอินพุต / 4 เท่าสำหรับเอาต์พุต และ Terra ต่ำกว่าราคามาตรฐานของ Claude Sonnet 5 ($3 / $15) นอกจากนี้ Luna ยังอยู่ใกล้ระดับราคาพื้นของโมเดลโอเพนซอร์สราคาถูกที่ DeepSeek และ GLM-5.2 กำหนดไว้
โทเคนการให้เหตุผลมีอะไรแอบแฝงหรือเปล่า
GPT-5.6 เป็นโมเดลแบบใช้เหตุผล; โทเค็นการให้เหตุผลภายในถูกคิดค่าใช้จ่ายเป็นเอาต์พุต ดังนั้นต้นทุนเอาต์พุตที่แท้จริงอาจสูงกว่าประมาณการแบบคร่าวๆ ปรับระดับความพยายามในการให้เหตุผลและจำกัดเอาต์พุตเพื่อควบคุมค่าใช้จ่าย
ฉันจะได้รับราคาที่ต่ำกว่าใหม่ได้อย่างไร
พวกมันเปิดใช้งานแล้วบน API ของ OpenAI และที่มาร์กอัป 0% บน OrcaRouter — โดยที่ GPT-5.6 Luna แสดง $0.20 / $1.20 และ GPT-5.6 Sol แสดง $4 / $20 — ผ่านเอนด์พอยต์ที่เข้ากันได้กับ OpenAI เพียงจุดเดียว ไม่จำเป็นต้องเปลี่ยนแปลงโค้ด
ประเด็นสำคัญ
OpenAI ลดราคาเมื่อวันที่ 30 กรกฎาคมทำให้ GPT-5.6 Luna และ Terra ถูกลงอย่างมากสำหรับงานปริมาณมาก และประกาศเมื่อวันที่ 21 สิงหาคมขยายเรื่องนี้ไปถึงโมเดลเรือธง: GPT-5.6 Sol ลดเหลือ $4 / $20 ในอีกสามเดือนข้างหน้า ขณะที่เครดิตโทเค็นของ Codex ซื้อได้มากขึ้นและการใช้งานแบบสมัครสมาชิกยังคงไม่เปลี่ยนแปลง การลดราคาทั้งสองรอบเป็นผลจากประสิทธิภาพ — การเขียนเคอร์เนลใหม่และการปรับปรุง speculative decoding ในด้านหนึ่ง การให้บริการที่ถูกลงในอีกด้านหนึ่ง — และเป็นการตอบสนองที่ชัดเจนต่อสงครามราคาจริง เลือกเส้นทางตามความยาก ใช้แคชและการจัดกลุ่มคำขอ และควบคุม reasoning tokens เพื่อประหยัดสูงสุด และเพราะ OrcaRouter ส่งต่อราคาจากผู้ให้บริการโดยไม่บวกเพิ่ม (0% markup) อัตราที่ต่ำกว่าจึงพร้อมใช้งานที่นั่นแล้ว — Luna ที่ $0.20 / $1.20, Sol ที่ $4 / $20 — ราคาเดียวกัน ปลายทางเดียวที่เข้ากับ OpenAI โมเดลทั้งหมดในที่เดียว รับส่วนลดโดยไม่ต้องแก้โค้ดแม้แต่บรรทัดเดียว และให้แต่ละคำขอเลือกโมเดลที่ถูกที่สุดที่ทำงานได้
