
OpenAI ปรับลดราคา GPT-5.6 API: อะไรที่เปลี่ยนไป เหตุใด และวิธีรับสิทธิ์ใช้งาน
- qwenใหม่Qwen: Qwen3.8 Max2026-08-03$2.00 / $6.00 ต่อ 1 ล้านโทเค็น · 55 tok/s
- deepseekใหม่DeepSeek: DeepSeek V4 Flash 07312026-07-3150ความฉลาด69การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น · 206 tok/s
- orcaใหม่OrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicใหม่Anthropic: Claude Opus 52026-07-2461ความฉลาด78การเขียนโค้ด
- googleใหม่Google: Gemini 3.6 Flash2026-07-2150ความฉลาด69การเขียนโค้ด
- googleใหม่Google: Gemini 3.5 Flash-Lite2026-07-2137ความฉลาด49การเขียนโค้ด
- metaMeta: Muse Spark 1.12026-07-1651ความฉลาด71การเขียนโค้ด
- kimiMoonshotAI: Kimi K32026-07-1557ความฉลาด76การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Luna2026-07-0951ความฉลาด71การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Terra2026-07-0955ความฉลาด77การเขียนโค้ด
- openaiOpenAI: GPT-5.6 Sol2026-07-0959ความฉลาด77การเขียนโค้ด
- grokxAI: Grok 4.52026-07-0854ความฉลาด72การเขียนโค้ด
- tencentTencent: Hy32026-07-0641ความฉลาด59การเขียนโค้ด
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232ความฉลาด42การเขียนโค้ด
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226ความฉลาด39การเขียนโค้ด
- anthropicAnthropic: Claude Sonnet 52026-06-3053ความฉลาด72การเขียนโค้ด
- klingKling: Kling 3.0 Turbo2026-06-1757ความฉลาด52การเขียนโค้ด57คณิตศาสตร์
- z-aiZ.ai: GLM 5.22026-06-1651ความฉลาด69การเขียนโค้ด60คณิตศาสตร์
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242ความฉลาด61การเขียนโค้ด61คณิตศาสตร์
เมื่อวันที่ 30 กรกฎาคม 2026 OpenAI ได้ปรับลดราคา API ของโมเดล GPT-5.6 ราคาประหยัดสองรุ่น — ลดระดับราคาถูกสุดลงอย่างมากและปรับลดระดับกลางลงเล็กน้อย ขณะที่ปล่อยรุ่นเรือธงไว้ไม่แตะต้อง นับเป็นการเคลื่อนไหวที่สำคัญในสงครามราคาที่ทวีความรุนแรงขึ้น และมีผลทันทีกับตารางอัตราค่าบริการที่เผยแพร่อยู่ บทความนี้จะอธิบายว่าอะไรเปลี่ยนแปลงไปบ้าง วิศวกรรมที่อยู่เบื้องหลัง ราคาใหม่เทียบกับคู่แข่งอย่างไร ค่าใช้จ่ายแอบแฝงที่ต้องระวัง วิธีลดบิลของคุณเพิ่มเติม — และราคาที่ลดลงนี้ใช้งานได้แล้วบน OrcaRouter ที่มาร์กอัป 0%
ตัวเลขทุกตัวด้านล่างระบุแหล่งที่มาไว้ ราคาคิดต่อล้านโทเคน (อินพุต / เอาต์พุต) และอ้างอิงจากเรตการ์ดของ OpenAI ณ วันที่ 30 กรกฎาคม 2026 ตามที่สื่อต่างๆ รวมถึง Unite.AI รายงาน รวมถึงหน้าต้นทุนส่งผ่านของ OrcaRouter ด้วย ส่วนตัวเลขของคู่แข่งจะระบุที่มาไว้ ราคาอาจมีการเปลี่ยนแปลง — โปรดตรวจสอบก่อนนำไปสร้าง/ใช้งาน
สรุปสั้น ๆ: OpenAI ลดราคา GPT-5.6 Luna เหลือ $0.20 / $1.20 (จากเดิม $1 / $6 ลด ~80%) และ GPT-5.6 Terra เหลือ $2 / $12 (จากเดิม $2.50 / $15 ลด ~20%) ขณะที่ GPT-5.6 Sol ยังคงอยู่ที่ $5 / $30 ประสิทธิภาพที่ดีขึ้นสองอย่างช่วยชดเชยต้นทุนได้แก่ การเขียน GPU kernels ใหม่ (ลดต้นทุนการให้บริการลงประมาณ 20%) และการออกแบบ speculative-decoding draft model ใหม่ (สร้าง token ได้เร็วขึ้น 15%+) การลดราคาครั้งนี้ทำให้ Luna ต่ำกว่า Haiku 4.5 ของ Anthropic และเข้าใกล้ระดับราคาพื้นของ open model ราคาถูกที่ DeepSeek และ GLM วางไว้ หากคุณใช้งานผ่าน endpoint ที่เป็นกลางกับผู้จำหน่าย ไม่คิดค่าครองบาป (0% markup) อย่าง OrcaRouter อัตราใหม่มีผลแล้ว — ราคาเดียวกัน ใช้ API ที่เข้ากันได้กับ OpenAI เพียงตัวเดียว พร้อมด้วยโมเดลคู่แข่งทุกรุ่นอยู่เคียงข้างให้เปรียบเทียบและเลือกใช้ระหว่างกัน
ประเด็นสำคัญ
• GPT-5.6 Luna: ตอนนี้ $0.20 / $1.20 ต่อ 1M โทเคน ลดลงจาก $1 / $6 — ลดลงประมาณ 80%
• GPT-5.6 Terra: ตอนนี้ $2 / $12 ลดลงจาก $2.50 / $15 — ประมาณการลด 20%
• GPT-5.6 Sol (เรือธง): ราคายังคงเท่าเดิมที่ $5 / $30
• ทำไม: เขียนเคอร์เนล GPU สำหรับโปรดักชันใหม่ (ต้นทุนการให้บริการลดลง ~20%) พร้อมกับการออกแบบดราฟต์โมเดลสำหรับ speculative decoding ใหม่ (ประสิทธิภาพการสร้างโทเค็นเพิ่มขึ้น 15%+) ตามโพสต์วิศวกรรมของ OpenAI เมื่อวันที่ 29 กรกฎาคม
• วิธีรับ: ส่วนลดนั้นได้รวมอยู่ใน OrcaRouter แล้ว (มาร์กอัป 0%) — Luna ที่ $0.20 / $1.20 — ผ่านเอนด์พอยต์เดียวที่เข้ากันได้กับ OpenAI
อะไรที่เปลี่ยนไปบ้างกันแน่
ตระกูล GPT-5.6 ของ OpenAI ทำงานเป็นลำดับขั้น: Luna (เร็ว ถูกสุด), Terra (กลาง) และ Sol (เรือธง) การปรับลดเมื่อวันที่ 30 กรกฎาคมกระทบสองระดับที่ถูกกว่า ตามตารางอัตราที่รายงาน GPT-5.6 Luna ลดลงจาก $1 / $6 เป็น $0.20 / $1.20 ต่อล้านโทเคนอินพุต/เอาต์พุต — คิดเป็นการลดลงประมาณ 80% ทั้งอินพุตและเอาต์พุต — และ GPT-5.6 Terra ลดลงจาก $2.50 / $15 เป็น $2 / $12 ประมาณ 20% ส่วน GPT-5.6 Sol เรือธงที่สร้างมาเพื่อการให้เหตุผลที่ยากที่สุดและการเขียนโค้ดแบบเอเจนต์ยังคงอยู่ที่ $5 / $30 ระดับปริมาณการใช้งานถูกลงอย่างมาก ขณะที่ระดับบนสุดไม่ขยับ
อัตราต่อโทเคนพื้นฐานไม่ได้บอกเรื่องทั้งหมด ราคาของ GPT-5.6 ยังมีระดับตามความยาวอินพุต (บริบทที่ยาวมากจะเลื่อนไปอัตราที่สูงขึ้น) ส่วนลดการแคชพรอมพ์ (อินพุตที่ถูกแคชมีราคาถูกกว่าอินพุตใหม่มาก) และตัวเลือกแบบแบตช์ (งานแบบอะซิงโครนัสในราคาลด) ทั้งสามอย่างนี้ยังคงได้รับผลจากการลดราคา ดังนั้นราคาที่แท้จริงสำหรับงานที่ใช้แคชหรือแบตช์หนักอาจต่ำลงได้อีก ระวังระดับบริบทยาวในทิศทางตรงกันข้าม: การป้อนพรอมพ์ขนาดใหญ่อาจทำให้คุณเลื่อนขึ้นไปอีกระดับได้

การปรับแต่งสองอย่างที่อยู่เบื้องหลังการตัด
นี่ไม่ใช่{{1}}กลยุทธ์ขายขาดทุนเพื่อดึงดูดลูกค้า{{/1}} — OpenAI นำเสนอว่ามันคือ{{2}}ผลตอบแทนจากประสิทธิภาพ{{/2}} ในโพสต์ทางวิศวกรรมเมื่อวันที่ 29 กรกฎาคม 2026 ทีมเทคนิคของ OpenAI ได้อธิบายการปรับให้เหมาะสมในด้าน{{3}}การอนุมานผล{{/3}} และ{{4}}โครงสร้างควบคุมเอเจนต์{{/4}} ที่อยู่เบื้องหลัง Codex และ ChatGPT Work มีสองอย่างที่โดดเด่น ประการแรก {{5}}การเขียนเคอร์เนล GPU ใหม่{{/5}} ทั่วโครงสร้างพื้นฐานการผลิต — โดยใช้ {{6}}Sol{{/6}} ซึ่งทำงานภายใน {{7}}Codex{{/7}} เพื่อเขียนเคอร์เนลของบริษัทเองใหม่ — ซึ่ง OpenAI ระบุว่าช่วยลดต้นทุนการให้บริการแบบ end-to-end ลง{{8}}ประมาณ 20%{{/8}} ประการที่สอง {{9}}โมเดลร่างสำหรับการถอดรหัสเชิงคาดการณ์{{/9}} ที่ออกแบบใหม่ ซึ่งรายงานว่าช่วยปรับปรุงประสิทธิภาพการสร้างโทเคนขึ้น{{10}}มากกว่า 15%{{/10}} {{11}}ต้นทุนการให้บริการที่ลดลง ซึ่งส่งต่อถึงลูกค้าในรูปแบบราคาที่ถูกลงสำหรับแพ็กเกจปริมาณการใช้งานสูง{{/11}} คือประเด็นหลัก — และมันคือภาพสะท้อนของ{{12}}วงจรป้อนกลับ{{/12}} ที่ทั้งอุตสาหกรรมกำลังไล่ตาม นั่นคือการใช้โมเดลระดับแนวหน้าเพื่อเพิ่มประสิทธิภาพโครงสร้างพื้นฐานที่ให้บริการโมเดลเหล่านั้นเอง
ราคาใหม่เปรียบเทียบกันอย่างไร
การลดราคาครั้งนี้มุ่งเป้าไปที่คู่แข่งโดยตรง ตามรายงานของ Unite.AI ราคาใหม่ของ Luna ที่ 0.20 ดอลลาร์ / 1.20 ดอลลาร์ ต่ำกว่า Haiku 4.5 ของ Anthropic ราว 5 เท่าในด้านอินพุต และประมาณ 4 เท่าในด้านเอาต์พุต ขณะที่ราคาใหม่ของ Terra ที่ 2 ดอลลาร์ / 12 ดอลลาร์ ต่ำกว่าราคามาตรฐานของ Claude Sonnet 5 (ซึ่งรายงานว่าอยู่ที่ 3 ดอลลาร์ / 15 ดอลลาร์ และมีผลหลังวันที่ 31 สิงหาคม 2026) เมื่อเทียบกับกลุ่มโมเดลโอเพนเวต Luna ตอนนี้อยู่ใกล้กับระดับราคาพื้นฐานสำหรับการอนุมานที่ถูก ซึ่งถูกกำหนดโดยตระกูล V4 ของ DeepSeek และ GLM-5.2 ของ Zhipu (ราว 1.20 ดอลลาร์ / 4.10 ดอลลาร์) โดย Qwen ของ Alibaba และ Gemini Flash ของ Google อยู่ในกลุ่มราคาใกล้เคียงกัน กล่าวคือ OpenAI ได้ขยับระดับราคาสำหรับโวลุ่มการใช้งานลงไปยังจุดที่โมเดลที่ถูกและมีความสามารถอยู่แล้ว — ทำให้ส่วนต่างราคาสำหรับการเลือกใช้โมเดลแบบปิดแทนโมเดลแบบเปิดแคบลง
การอนุมานมีราคาถูกลงเรื่อยๆ
หากมองในภาพกว้าง การปรับลดนี้สอดคล้องกับแนวโน้มระยะยาวหลายปี: ต้นทุนของความสามารถในระดับหนึ่งลดลงอย่างรวดเร็ว รุ่นแล้วรุ่นเล่า ขณะที่ห้องแล็บต่างบีบปริมาณงานจากฮาร์ดแวร์ชุดเดิมให้ได้มากขึ้น ระดับบริการรุ่นเก่าของ OpenAI เองก็สะท้อนแนวโน้มราคาที่ลดลงตามเวลา และความก้าวหน้าด้านประสิทธิภาพแต่ละครั้ง ไม่ว่าจะเป็นเคอร์เนลที่ดีขึ้น การถอดรหัสแบบคาดเดา หรือแอตเทนชันที่ถูกลง มักจะปรากฏเป็นการลดราคาภายในไม่กี่เดือน สำหรับผู้ซื้อ นัยเชิงปฏิบัติคือต้องออกแบบสถาปัตยกรรมให้รองรับโลกที่อินเฟอเรนซ์มีราคาถูกลงอย่างเป็นระบบ: อย่าผูกพันกับราคาของโมเดลใดโมเดลหนึ่งมากเกินไป และทำให้การเปลี่ยนโมเดลมีต้นทุนต่ำ
ต้นทุนแอบแฝงที่ต้องจับตามอง: โทเค็นสำหรับการคิด
โมเดล GPT-5.6 เป็นโมเดลแบบใช้เหตุผล (reasoning models) และสิ่งนั้นส่งผลต่อค่าใช้จ่ายในโลกจริง เมื่อเปิดใช้การให้เหตุผล โมเดลจะสร้างโทเคนภายในสำหรับการคิด ซึ่งถูกคิดค่าใช้จ่ายเป็น output ดังนั้นต้นทุน output ที่แท้จริงของคุณจึงสูงกว่าที่การประมาณแบบง่ายๆ อย่าง "จำนวนคำในคำตอบ" ชี้ให้เห็น โดยเฉพาะกับโจทย์ยากๆ ที่ต้องใช้ความพยายามในการให้เหตุผลสูง วิธีแก้คือปรับระดับความพยายามในการให้เหตุผลให้เหมาะกับงาน (ใช้ระดับต่ำหรือปิดสำหรับการเรียกใช้งานง่ายๆ) จำกัดจำนวน output เท่าที่ทำได้ และวัดการใช้งานโทเคนจริงแทนการคาดเดา อัตราราคาต่อโทเคนที่ถูกลงช่วยได้ แต่การควบคุมจำนวนโทเคนที่คุณสร้างขึ้นช่วยได้มากกว่า
มันหมายความว่าอย่างไรสำหรับนักพัฒนา
ถ้าคุณใช้ GPT-5.6 Luna หรือ Terra สำหรับงานปริมาณมาก — การจัดหมวดหมู่ การแยกข้อมูล การจัดเส้นทาง เอเจนต์น้ำหนักเบา แชท — ค่าใช้จ่ายของคุณลดลงทันที ในบางกรณีลดลงเกือบทั้งจำนวน โดยไม่ต้องแก้โค้ดเลย ทำให้ระดับปริมาณการใช้งานน่าสนใจยิ่งขึ้นสำหรับงานที่คำนึงถึงต้นทุน และลดช่องว่างราคากับโมเดลเปิดราคาถูก ตัวเลขของรุ่นเรือธงยังคงเดิม: Sol ที่ $5 / $30 ยังคงเป็นตัวเลือกระดับพรีเมียมสำหรับงานที่ยากที่สุด รูปแบบที่ชนะคือการจัดเส้นทางตามความยาก — เลือกระดับราคาถูก (หรือโมเดลเปิดราคาถูก) สำหรับงานง่ายๆ 80% และใช้รุ่นเรือธงเฉพาะที่มันคุ้มค่ากับต้นทุนเท่านั้น
วิธีลดบิลของคุณให้มากขึ้นอีก
การลดราคาคือฐานสำหรับต่อยอด ไม่ใช่เส้นชัย กลไกเสริมที่สำคัญที่สุด: การแคชพรอมป์ต์ (ใช้พรอมป์ต์ระบบคงที่หรือบริบทยาวซ้ำ แล้วจ่ายในอัตราอินพุตที่แคชแล้วซึ่งต่ำกว่ามาก); ตัวเลือกแบบแบตช์ (รันงานที่ไม่เร่งด่วนแบบอะซิงโครนัสพร้อมส่วนลด); การจัดเส้นทางตามระดับและโมเดล (ส่งแต่ละคำขอไปยังโมเดลที่ถูกที่สุดที่รองรับได้ รวมถึงโมเดลโอเพนซอร์ส); และ การควบคุมการใช้เหตุผล (อย่าจ่ายค่าการคิดเชิงลึกสำหรับงานเล็กน้อย) เมื่อประกอบเข้าด้วยกัน กลไกเหล่านี้มักลดค่าใช้จ่ายจริงได้มากกว่าการเปลี่ยนแปลงอัตราใด ๆ เพียงอย่างเดียวมาก เพื่อให้เห็นภาพชัดเจน: ที่ 10 ล้านโทเคนต่อเดือน โดยมีสัดส่วนอินพุต 70% อัตราใหม่ของ Luna คิดเป็นประมาณ $5 ต่อเดือน (ประมาณ $4.37 หากใช้การแคช); ปริมาณเดียวกันบน Sol อยู่ที่ประมาณ $125 ต่อเดือน — นี่คือเหตุผลที่ชัดเจนที่สุดสำหรับการจัดเส้นทางตามระดับความยาก
วิธีคว้าราคาที่ต่ำกว่าได้ทันที
นี่คือส่วนที่เชื่อมโยงทุกอย่างเข้าด้วยกัน a href="https://www.orcarouter.ai/">OrcaRouter/a> เรียกเก็บมาร์กอัป 0% และส่งต่อราคาจากผู้ให้บริการโดยตรง ดังนั้นอัตราของ OpenAI จึงแสดงบน OrcaRouter แล้ว: GPT-5.6 Luna แสดงราคา $0.20 / $1.20 และ Terra $2 / $12 บนหน้าโมเดลในขณะนี้ — อัตราเดียวกับตารางราคาของ OpenAI เอง ซึ่งเข้าถึงได้ผ่านปลายทางที่เข้ากันได้กับ OpenAI เพียงจุดเดียว พร้อมกับโมเดลอื่นๆ อีก 185+ รายการ คุณได้รับอัตรานี้โดยไม่ต้องย้ายระบบ และคุณสามารถเปรียบเทียบราคาของ Luna และ Terra กับ DeepSeek, GLM, Qwen, Gemini และ Claude ได้ในที่เดียว จากนั้นส่งแต่ละคำขอไปยังตัวเลือกที่ถูกที่สุดสำหรับงานนั้น นอกจากนี้ยังมีระดับฟรีและหน้า Offers เพื่อการประหยัดเพิ่มเติม

การลดราคาเปิดใช้งานบน OrcaRouter แล้ว: GPT-5.6 Luna ราคา $0.20 / $1.20 ต่อ 1M โทเคน ส่งผ่านโดยไม่มีมาร์กอัป (0%)
เลือกเส้นทางตามระดับความยากเพื่อประหยัดมากยิ่งขึ้น
บิลที่ถูกที่สุดไม่ใช่แค่โมเดลเดียว — แต่คือโมเดลที่เหมาะสมสำหรับแต่ละคำขอ เนื่องจาก OrcaRouter เผยโมเดลทั้งฟิลด์ผ่านเอนด์พอยต์เดียว คุณจึงสามารถส่งคำของ่ายๆ ที่มีปริมาณมากไปยัง Luna หรือโมเดลโอเพนซอร์สราคาถูก และเก็บ Sol หรือโมเดลเรือธงอื่นๆ ไว้สำหรับงานยากๆ โดยสลับผ่านการเปลี่ยนแปลงคอนฟิกแทนการบูรณาการใหม่ การลดราคา Luna ทำให้กลยุทธ์การเลือกเส้นทางตามความยากนั้นถูกลงไปอีก โดยที่คุณไม่ต้องปรับเปลี่ยนระบบใดๆ

คำถามที่พบบ่อย
OpenAI ลดราคา GPT-5.6 ลงเท่าไหร่?
GPT-5.6 Luna ลดลงจาก $1 / $6 เป็น $0.20 / $1.20 ต่อล้านโทเคน (ประมาณ 80%) และ GPT-5.6 Terra จาก $2.50 / $15 เป็น $2 / $12 (ประมาณ 20%) ส่วน GPT-5.6 Sol ยังคงอยู่ที่ $5 / $30
การลดราคามีผลบังคับใช้เมื่อใด?
30 กรกฎาคม 2026 บันทึกอยู่ใน changelog ของ OpenAI API และแสดงบนเรตการ์ดที่เผยแพร่แล้ว
ทำไม OpenAI ถึงลดราคา
OpenAI ระบุว่าเป็นผลมาจากการปรับปรุงการอนุมาน (inference optimizations) — การเขียนเคอร์เนล GPU สำหรับโปรดักชันใหม่ (ต้นทุนการให้บริการลดลงประมาณ 20%) และการออกแบบโมเดล draft สำหรับ speculative decoding ใหม่ (ประสิทธิภาพการสร้างโทเคนเพิ่มขึ้น 15%+) — ตามโพสต์วิศวกรรมเมื่อวันที่ 29 กรกฎาคม 2026
เรือธง (Sol) ราคาถูกลงหรือเปล่า
ไม่ใช่ GPT-5.6 Sol ยังคงอยู่ที่ $5 / $30 ต่อล้านโทเคน เฉพาะสองระดับที่ถูกกว่า คือ Luna และ Terra เท่านั้นที่ถูกลดราคา
ราคาใหม่เปรียบเทียบกับ Anthropic และโมเดลแบบเปิดอย่างไร?
ตามรายงาน Luna ตอนนี้มีราคาต่ำกว่า Haiku 4.5 ของ Anthropic อยู่ประมาณ 5 เท่าสำหรับอินพุต / 4 เท่าสำหรับเอาต์พุต และ Terra ต่ำกว่าราคามาตรฐานของ Claude Sonnet 5 ($3 / $15) นอกจากนี้ Luna ยังอยู่ใกล้ระดับราคาพื้นของโมเดลโอเพนซอร์สราคาถูกที่ DeepSeek และ GLM-5.2 กำหนดไว้
โทเคนการให้เหตุผลมีอะไรแอบแฝงหรือเปล่า
GPT-5.6 เป็นโมเดลแบบใช้เหตุผล; โทเค็นการให้เหตุผลภายในถูกคิดค่าใช้จ่ายเป็นเอาต์พุต ดังนั้นต้นทุนเอาต์พุตที่แท้จริงอาจสูงกว่าประมาณการแบบคร่าวๆ ปรับระดับความพยายามในการให้เหตุผลและจำกัดเอาต์พุตเพื่อควบคุมค่าใช้จ่าย
ฉันจะได้รับราคาที่ต่ำกว่าใหม่ได้อย่างไร
พวกมันเปิดใช้งานบน API ของ OpenAI แล้ว และที่มาร์กอัป 0% บน OrcaRouter — ที่ซึ่ง GPT-5.6 Luna แสดงราคา $0.20 / $1.20 — ผ่านเอนด์พอยต์เดียวที่เข้ากันได้กับ OpenAI โดยไม่ต้องเปลี่ยนโค้ด
บรรทัดล่าง
การปรับลดราคาเมื่อวันที่ 30 กรกฎาคมของ OpenAI ทำให้ GPT-5.6 Luna และ Terra ถูกกว่าอย่างมากสำหรับงานปริมาณมาก — เป็นผลตอบแทนด้านประสิทธิภาพจากการเขียนเคอร์เนลใหม่และความก้าวหน้าจาก speculative decoding และเป็นการตอบสนองที่ชัดเจนต่อสงครามราคาที่เกิดขึ้นจริง ซึ่งตอนนี้ต่ำกว่าระดับราคาถูกของ Anthropic และเข้าใกล้พื้นราคาของโมเดลโอเพน โมเดลเรือธง Sol ยังไม่มีการเปลี่ยนแปลง ดังนั้นควรจัดเส้นทางตามระดับความยากของงาน ใช้การแคชและการแบตช์ให้เป็นประโยชน์ และควบคุมโทเคนการให้เหตุผลเพื่อประหยัดสูงสุด และเนื่องจาก OrcaRouter ส่งต่อราคาจากผู้ให้บริการโดยมาร์กอัป 0% อัตราที่ลดลงจึงใช้งานได้แล้วที่นั่น — ราคาเดียวกัน เอนด์พอยต์เดียวที่เข้ากันได้กับ OpenAI โมเดลครบทุกตัวในที่เดียว คว้าส่วนลดนี้โดยไม่ต้องแก้โค้ดแม้แต่บรรทัดเดียว แล้วให้แต่ละคำขอเลือกโมเดลที่ถูกที่สุดที่ทำงานนั้นได้
