
GPT-5.6 API การกำหนดราคา: แผน Sol, Terra และ Luna, ต้นทุนจริง, และวิธีการเรียกใช้แต่ละแผน
- deepseekใหม่DeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- openaiใหม่OpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- googleใหม่Google: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- qwenใหม่Qwen: Qwen3.8 Max (0902)2026-09-0240ความฉลาด72การเขียนโค้ด
- anthropicใหม่Anthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
- obsidianQwen3.8 27B2026-08-1534ความฉลาด68การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236ความฉลาด69การเขียนโค้ด
- grokSpaceXAI: Grok 4.62026-08-1244ความฉลาด77การเขียนโค้ด
- metaMeta: Muse Spark 1.22026-08-0540ความฉลาด72การเขียนโค้ด
- qwenQwen: Qwen3.8 Max2026-08-0340ความฉลาด72การเขียนโค้ด
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135ความฉลาด69การเขียนโค้ด
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 ต่อ 1 ล้านโทเค็น
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451ความฉลาด78การเขียนโค้ด
- googleGoogle: Gemini 3.6 Flash2026-07-2134ความฉลาด69การเขียนโค้ด
GPT-5.6 คือกลุ่มผลิตภัณฑ์เรือธงของ OpenAI ในเดือนกรกฎาคม 2026 และสิ่งสำคัญสำหรับนักพัฒนาคือมันไม่ได้มีราคาเดียว มันมีให้เลือก 3 ระดับ ได้แก่ Sol, Terra และ Luna บน OpenAI API นั้น Sol มีราคา $5 ต่ออินพุต 1 ล้านโทเค็น และ $30 ต่อเอาต์พุต 1 ล้านโทเค็น Terra อยู่ที่ $2.50 และ $15 ส่วน Luna อยู่ที่ $1 และ $6 แต่ละระดับมีส่วนลดสำหรับอินพุตที่ถูกแคชไว้ ทั้งสามระดับรองรับอินพุตรูปภาพและข้อความ และหน้าต่างบริบทประมาณ 1.05 ล้านโทเค็น โดยเอาต์พุตสูงสุด 128K
ราคาที่ระบุไว้เป็นเพียงจุดเริ่มต้นของต้นทุนที่แท้จริงเท่านั้น ระดับที่คุณต้องการจริงๆ ปริมาณที่คุณแคช ปริมาณเอาต์พุตที่โมเดลสร้าง และกฎการกำหนดราคาสองสามข้อที่คู่มือส่วนใหญ่ข้ามไป—พรอมต์ที่มีโทเค็นเกิน 272K ค่าใช้จ่ายเพิ่มสำหรับการจัดเก็บข้อมูลในประเทศ และระดับบริการ—เป็นตัวกำหนดค่าใช้จ่ายมากกว่าอัตราหัวข้อข่าวมาก คู่มือนี้จะแจกแจงราคาของแต่ละระดับ ว่ามีไว้เพื่ออะไร การให้คะแนนเป็นอย่างไร วิธีการย้ายจาก GPT-5.5 วิธีการเรียกใช้ และเปรียบเทียบกับ Claude, GLM, Gemini, DeepSeek และ Grok อย่างไร
คำตอบด่วน: ภาพรวมราคา GPT-5.6
- สามระดับราคา (ต่อล้านโทเค็น, ราคาเข้า/ออก): Sol $5 / $30, Terra $2.50 / $15, Luna $1 / $6.
- ค่าใช้จ่ายสำหรับอินพุตที่แคช: $0.50 (Sol), $0.25 (Terra), $0.10 (Luna) ต่อล้านโทเคน; การเขียนแคชมีค่าใช้จ่าย 1.25 เท่าของอัตราอินพุตที่ไม่ได้แคช
การวางตำแหน่ง: Sol สำหรับงานที่ต้องใช้เหตุผลและงานอัตโนมัติที่ยากที่สุด, Terra เป็นค่าเริ่มต้นที่สมดุล, Luna สำหรับงานที่มีปริมาณสูงและอ่อนไหวต่อต้นทุน
- รูปแบบ: หลายรูปแบบ—GPT-5.6 รองรับอินพุตรูปภาพควบคู่ไปกับข้อความ บริบทประมาณ 1.05 ล้านโทเค็น สูงสุดเอาต์พุต 128K
- กฎการคิดราคาสองข้อที่ต้องวางแผน: พรอมต์ที่มีจำนวนโทเค็นอินพุตเกิน 272K จะถูกคิดค่าบริการเป็น 2 เท่าของอินพุตและ 1.5 เท่าของเอาต์พุตสำหรับทั้งคำขอ และปลายทางที่มีการจัดเก็บข้อมูลในประเทศจะเพิ่มอัตรา 10%
- วิธีจ่ายน้อยลง: Batch ลด 50% จากราคามาตรฐาน, การแคชลดอินพุตซ้ำเหลือหนึ่งในสิบ, และการกำหนดงานประจำไปยังระดับที่ต่ำกว่าหลีกเลี่ยงผลลัพธ์ $30 ของ Sol
- ปัญญาประดิษฐ์: Artificial Analysis วาง GPT-5.6 Sol ใกล้กับด้านบนของ Intelligence Index (คะแนน 59).
ราคา API ของ GPT-5.6 แยกตามระดับ

OpenAI คิดราคา GPT-5.6 ต่อหนึ่งล้านโทเค็น และผลลัพธ์มีราคาแพงกว่าอินพุตมากในทุกชั้น อัตราที่เผยแพร่ในปัจจุบันคือ:
- GPT-5.6 Sol: $5.00 อินพุต, $0.50 อินพุตแคช, $30.00 เอาต์พุต (การเขียนแคช $6.25)
- GPT-5.6 Terra: $2.50 อินพุต, $0.25 อินพุตที่แคช, $15.00 เอาท์พุต.
- GPT-5.6 Luna: $1.00 อินพุต, $0.10 อินพุตที่แคชไว้, $6.00 เอาต์พุต
สองรายละเอียดที่สำคัญก่อนวางแผนงบประมาณ ประการแรก อัตราเอาต์พุตเป็นปัจจัยหลักของค่าใช้จ่ายส่วนใหญ่ โดยเฉพาะงานที่ต้องใช้เหตุผลและงานของเอเจนต์ ซึ่งโมเดลจะสร้าง trace ยาว, การเรียกใช้เครื่องมือ, และการแก้ไขก่อนคำตอบสุดท้าย ประการที่สอง ไม่มีบรรทัดราคา "Sol Ultra" แยกต่างหากในหน้าราคา "Sol Ultra" คือการกำหนดค่าการใช้เหตุผลที่สูงกว่าของ Sol (การตั้งค่าแบบหลายเอเจนต์) ไม่ใช่ระดับบริการอิสระ—ควรวางงบประมาณรอบ ๆ Sol, Terra และ Luna
แต่ละระดับนั้นจริงๆ แล้วใช้ทำอะไร
Luna: ปริมาณสูงและไวต่อต้นทุน
Luna เป็นระดับประหยัดที่ราคา $1 สำหรับอินพุตและ $6 สำหรับเอาต์พุต เป็นค่าเริ่มต้นที่เหมาะสมสำหรับการจำแนกประเภท การสกัด การกำหนดเส้นทาง การสรุป การร่าง และงานประจำจำนวนมากที่ความแตกต่างด้านคุณภาพเพียงเล็กน้อยไม่เปลี่ยนแปลงผลลัพธ์ ที่ราคาหกดอลลาร์ต่อล้านโทเค็นเอาต์พุต มันถูกพอที่จะรันในขนาดใหญ่และสุ่มตัวอย่างซ้ำๆ
เทอร์ร่า: ค่าเริ่มต้นที่สมดุล
Terra อยู่ตรงกลางที่ราคา $2.50 และ $15 สำหรับงานแอปพลิเคชันและเขียนโค้ดส่วนใหญ่แล้ว นี่คือจุดเริ่มต้นที่สมเหตุสมผล: แข็งแกร่งกว่า Luna อย่างเห็นได้ชัดในงานที่ยากกว่า แต่มีราคาเอาต์พุตเพียงครึ่งเดียวของ Sol เริ่มต้นที่นี่ จากนั้นย้ายงานขึ้นไปยัง Sol เฉพาะเมื่อ Terra ล้มเหลวอย่างเห็นได้ชัดเท่านั้น
Sol: งานที่ยากที่สุดเกี่ยวกับการใช้เหตุผลและการทำงานแบบเอเจนต์
Sol เป็นเรือธงในราคา $5 และ $30 และ Artificial Analysis จัดอันดับให้อยู่ใกล้ด้านบนของ Intelligence Index ของมัน ควรสงวนไว้สำหรับสถาปัตยกรรมที่ยาก การดีบักที่ซับซ้อน เอเจนต์ระยะยาว และการวิเคราะห์ที่มีความเสี่ยงสูง ซึ่งการหลีกเลี่ยงความล้มเหลวเพียงครั้งเดียวก็คุ้มกับส่วนเพิ่ม การใช้ Sol สำหรับงานประจำเป็นวิธีที่พบได้บ่อยที่สุดในการใช้จ่ายเกินกับ GPT-5.6
มาจาก GPT-5.5 ใช่ไหม? ระดับใดประหยัดที่สุด
GPT-5.6 Sol ถูกตั้งราคาเท่ากับ GPT-5.5 ทุกประการ โดยคิด $5 ต่ออินพุตและ $30 ต่อเอาต์พุต ดังนั้นการย้ายเวิร์กโหลด GPT-5.5 ตรงไปยัง Sol จึงแทบไม่เปลี่ยนแปลงค่าใช้จ่ายมากนัก ส่วนการประหยัดเกิดขึ้นจากสองระดับราคาที่ต่ำกว่าใหม่ Terra มอบคุณภาพระดับเดียวกับ GPT-5.5 ในงานส่วนใหญ่ในราคาครึ่งเดียว ดังนั้นการย้ายที่ง่ายที่สุดคือส่งทราฟฟิก GPT-5.5 ที่มีอยู่ไปยัง Terra และเลื่อนเฉพาะงานที่ด้อยประสิทธิภาพกลับขึ้นไปที่ Sol เท่านั้น
แผนการย้ายระบบที่ปฏิบัติได้จริงมีสามขั้นตอน: เปลี่ยนเส้นทางการเรียก GPT-5.5 ไปยัง Terra, เรียกใช้ชุดประเมินของคุณ, และส่งต่อเฉพาะที่ล้มเหลวไปยัง Sol ขณะที่ผลักดันงานประจำที่ชัดเจนลงไปยัง Luna งานส่วนใหญ่ของ GPT-5.5 จะมีต้นทุนที่ถูกกว่าด้วยวิธีนี้โดยไม่สูญเสียคุณภาพที่คุณสามารถวัดได้
ระดับชั้นต่างๆ ให้คะแนนจริงๆ อย่างไร


ราคามีความสำคัญก็ต่อเมื่อเทียบกับความสามารถเท่านั้น จากตัวเลข Terminal-Bench 2.1 ของ OpenAI เอง ระดับชั้นต่างๆ แยกออกจากกันตามที่คุณคาดหวัง: Sol 88.8%, Sol Ultra 91.9%, Terra 87.4%, และ Luna 84.7% สำหรับบริบทในตารางเดียวกัน GPT-5.5 ได้คะแนน 85.6%, Claude Opus 4.8 คือ 78.9%, Claude Fable 5 คือ 83.1%, และ Gemini 3.1 Pro (preview) คือ 70.7% Artificial Analysis ให้ Sol มี Intelligence Index ที่ 59 ซึ่งใกล้กับอันดับสูงสุดของการจัดอันดับ.
จงอ่านสิ่งเหล่านี้ว่าเป็นรายงานจากผู้จำหน่ายและใช้เป็นแนวทางเท่านั้น OpenAI ได้เผยแพร่ชุดการประเมินผลสำหรับ GPT-5.6 ในขอบเขตที่จำกัด และ ณ เวลาที่เขียนนี้ ยังไม่ได้รวมถึงเกณฑ์มาตรฐานด้านการเขียนโค้ดและการให้เหตุผลแบบดั้งเดิม เช่น SWE-bench Verified หรือ GPQA ดังนั้นให้ใช้คะแนนเหล่านี้เพื่อตัดสินใจว่าจะทดสอบอะไรกับภาระงานของคุณเอง แทนที่จะใช้เป็นข้อสรุปสุดท้าย

อัตราการอ่านอินพุตที่แคชไว้ของแต่ละระดับคือหนึ่งในสิบของอัตราอินพุตสด: $0.50 บน Sol, $0.25 บน Terra, $0.10 บน Luna อย่างไรก็ตาม การเขียนไปยังแคชมีค่าใช้จ่าย 1.25 เท่าของอัตราอินพุตที่ไม่ได้แคช (ประมาณ $6.25 ต่อล้านบน Sol) ดังนั้นการแคชจะคุ้มค่าเมื่อมีการใช้คำนำหน้าที่เสถียรซ้ำหลายครั้งพอที่จะชดเชยค่าพรีเมียมในการเขียน—คำแนะนำของระบบ, เอกสารขนาดใหญ่, กฎของที่เก็บ, หรืออนุกรมวิธานสินค้า วางเนื้อหาที่เสถียรไว้ที่ด้านหน้าของพรอมต์และคำถามที่เปลี่ยนแปลงไปไว้ที่ท้าย และหลีกเลี่ยงการแทรกประทับเวลาหรือตัวระบุแบบสุ่มไว้ก่อนบริบทที่ใช้ซ้ำได้
แคชช่วยลดต้นทุนในการป้อนข้อมูลซ้ำ แต่ไม่มีผลต่อผลลัพธ์ เนื่องจากผลลัพธ์เป็นด้านที่มีค่าใช้จ่ายสูงในทุกชั้น คันโยกสองอันที่ส่งผลต่อค่าใช้จ่ายของ GPT-5.6 มากที่สุดคือการแคชคำนำหน้าที่คงที่และการควบคุมปริมาณที่โมเดลเขียน
คุณควรเลือก tier ไหน?

อย่าเลือกระดับตามชื่อเสียง ให้เลือกระดับตามการทดสอบ สร้างชุดงานตัวอย่างเล็กๆ ที่มีเกณฑ์การยอมรับที่ชัดเจน รันบน Luna ก่อน และเลื่อนเฉพาะงานที่ล้มเหลวไปยัง Terra จากนั้นไปยัง Sol วัดต้นทุนต่องานที่ยอมรับ ไม่ใช่ราคาเฉลี่ยต่อโทเค็น เพราะระดับที่ถูกกว่าซึ่งต้องลองสามครั้งอาจมีราคาแพงกว่าระดับที่แข็งแกร่งกว่าซึ่งสำเร็จในครั้งเดียว
นิสัยในการปฏิบัติงานอย่างหนึ่งช่วยประหยัดเงินจริง: ระบุรุ่นของ tier model ID ที่แน่นอนในแต่ละการเรียกใช้แทนที่จะพึ่งพา alias เปล่าๆ เพื่อให้คำขอทั่วไปไม่ทำงานบน tier ที่แพงที่สุดอย่างเงียบๆ งานแบบผสมมักจะใช้ Luna สำหรับการแปลงและร่างงานประจำ, Terra สำหรับการใช้งานและการวิเคราะห์ประจำวัน, และ Sol สงวนไว้สำหรับส่วนน้อยที่ยาก—คำขอส่วนใหญ่ไม่เคยต้องการรุ่นเรือธงเลย
GPT-5.6 เทียบกับคู่แข่งในเรื่องราคา
GPT-5.6 ไม่ได้มีอยู่โดยลำพัง อ่านเทียบกับตลาดปัจจุบัน (ต่อล้านโทเค็น, อินพุต/เอาต์พุต, กลางปี 2026): Claude Opus 4.8 ราคา $5 / $25, Claude Fable 5—โมเดลสาธารณะที่แข็งแกร่งที่สุดของ Anthropic—ราคา $10 / $50, GLM 5.2 ราคา $1.40 / $4.40 บน Z.AI (โฮสต์บุคคลที่สามอาจถูกกว่า), Grok 4.5 ราคา $2 / $6, ของ Google Gemini 3.5 Flash ราคาประมาณ $1.50 / $9, และ DeepSeek V4-Pro ราคาประมาณ $0.44 / $0.87 ยืนยันราคาแต่ละรายการในหน้าของผู้ให้บริการเอง เนื่องจากราคาเหล่านี้เปลี่ยนแปลง
ข้อสรุปที่ได้มีความเฉพาะเจาะจง GPT-5.6 Sol เทียบกับ Opus 4.8 ด้านอินพุตเท่ากัน แต่แพงกว่าในด้านเอาต์พุต ($30 เทียบกับ $25) ดังนั้นสำหรับงานที่เน้นเอาต์พุตหนักๆ อย่างงานแบบเอเจนต์ Opus จะถูกกว่าเล็กน้อยต่อโทเค็น ในขณะที่ Sol เป็นผู้นำดัชนีความฉลาด Terra ถูกกว่าทั้งสองรุ่นเรือธง และเป็นตัวเลือกที่คุ้มค่าภายในตระกูล OpenAI Luna แข่งขันด้านราคากับรุ่นที่ถูกกว่า แม้ว่า Grok 4.5, GLM 5.2 และโดยเฉพาะ DeepSeek จะถูกกว่าอีก ไม่มีระดับราคาหรือผู้ขายรายใดชนะไปทั้งหมด ซึ่งเป็นเหตุผลว่าทำไมการเลือกเส้นทางตามความยากจึงดีกว่าการผูกมัดกับรุ่นเดียว
ราคาตามรายการเหล่านั้นเป็นอัตราสำหรับบริบทสั้น และบริบทสั้นคือจุดที่การเปรียบเทียบสิ้นสุดลง OpenAI กำหนดราคาใหม่สำหรับคำขอ GPT-5.6 ทั้งหมด — ทุกโทเคนอินพุต เอาต์พุต และอินพุตที่แคชไว้ในนั้น — ที่อินพุต 2 เท่าและเอาต์พุต 1.5 เท่า เมื่อพรอมป์มีจำนวนอินพุตโทเคนเกิน 272K ดังนั้นอัตราที่เป็นจุดขายจึงครอบคลุมเพียงประมาณหนึ่งในสี่ของหน้าต่าง 1.05M ที่โฆษณาไว้ โมเดล Claude ปัจจุบันของ Anthropic คิดค่าบริการในทางตรงกันข้าม: อัตราต่อโทเคนแบบคงที่ไปจนถึงหน้าต่างบริบท 1M โทเคนของตน หน้าค่าบริการของ Anthropic ระบุไว้ตรง ๆ ว่า — คำขอ 900K โทเคนถูกคิดค่าบริการในอัตราต่อโทเคนเดียวกันกับคำขอ 9K โทเคน — ซึ่งเป็นเหตุผลที่ Claude อาจมีราคาถูกกว่า GPT-5.6 ได้พอดีในเวิร์กโหลดบริบทขนาดยาวจริง ๆ ที่ GPT-5.6 โฆษณาไว้ แม้ในกรณีที่ราคาอินพุตบริบทสั้นเท่ากัน
Epoch AI องค์กรไม่แสวงหากำไรด้านการวิจัยที่ติดตามแนวโน้ม AI ได้เน้นความแตกต่างนี้ และเชื่อมโยงกับความแตกต่างที่วัดได้เบื้องหลังการทำงาน การวัดเวลาถึงโทเคนแรกของบริษัทบนพรอมป์ต์ที่ยาวถึงประมาณ 900K โทเคน แสดงว่า GPT-5.6 Terra และ GPT-5.6 Sol ขยายตัวด้วยองค์ประกอบกำลังสองที่มีนัยสำคัญเมื่อบริบทเพิ่มขึ้น ขณะที่ Claude Sonnet 5 และ Claude Opus 5 ขยายตัวเกือบเป็นเส้นตรงโดยไม่มีความโค้งที่สังเกตได้ การตีความของ Epoch คือ โครงสร้างราคาสอดคล้องกับทางเลือกทางสถาปัตยกรรม: GPT-5.6 ดูเหมือนยอมรับการประมวลผลบริบทยาวแบบกำลังสองมากกว่า ขณะที่ Anthropic ลดส่วน贡献แบบกำลังสองลง — ประเภทของเลเยอร์แอตเทนชันแบบไฮบริด เชิงเส้น หรือสแปร์ส ที่ปรากฏในโมเดลบริบทยาวอื่น ๆ นี่เป็นงานวิจัยที่วัดโดย Epoch AI เอง ไม่ใช่คำกล่าวอ้างของผู้ขาย และ Epoch ระมัดระวังที่จะเรียกความแตกต่างนี้ว่าเป็นข้อแลกเปลี่ยนเชิงการออกแบบ มากกว่าคำตัดสินเรื่องคุณภาพ สำหรับผู้ซื้อ ผลที่ตามมาในทางปฏิบัติคือเรื่องราคา: เมื่อเกิน 272K โทเคน อัตราค่าอินพุตของ GPT-5.6 จะเพิ่มเป็นสองเท่า ขณะที่ของ Claude คงเดิม ดังนั้นเวิร์กโหลดบริบทยาวและ big-RAG ควรคิดราคาตามตารางราคาทั้งสองแบบก่อนที่คุณจะตัดสินใจเลือกฝ่ายใดฝ่ายหนึ่ง
ใบแจ้งหนี้รายเดือนที่ดำเนินการแล้ว

ใส่ตัวเลขลงไป สำหรับเดือนที่มีการใช้งานหนักปานกลาง โดยมีโทเคนอินพุต 50M และเอาต์พุต 10M ในราคาปกติก่อนการแคชและการใช้เครื่องมือ ค่าใช้จ่ายของโมเดลจะอยู่ที่ประมาณ:
- GPT-5.6 Luna: ประมาณ $110
GPT-5.6 Terra: ประมาณ $275
- GPT-5.6 Sol: ประมาณ $550
- สำหรับการเปรียบเทียบ: GLM 5.2 ประมาณ $114, Grok 4.5 ประมาณ $160, Claude Opus 4.8 ประมาณ $500, Claude Fable 5 ประมาณ $1,000.
งานเดียวกันที่ถูกจัดเส้นทางอย่างชาญฉลาด—Luna และ Terra สำหรับงานส่วนใหญ่, Sol สำหรับงานยากส่วนน้อย—มีมูลค่าใกล้เคียงกับช่วง $110–$275 มากกว่าที่จะเป็น $550 คงที่ของ Sol สำหรับทุกอย่าง ช่องว่างดังกล่าว เมื่อคูณตลอดทั้งปี คือข้อโต้แย้งทั้งหมดสำหรับการจัดเส้นทางแบบแบ่งชั้น
ค่าใช้จ่ายแอบแฝงที่ต้องวางแผน
กฎการกำหนดราคาหลายข้อไม่ปรากฏในอัตราหลักและทำให้ทีมประหลาดใจในภายหลัง:
- คำขอที่ยาว: คำขอที่มีโทเคนอินพุตมากกว่า 272K จะถูกคิดค่าใช้จ่ายเป็น 2 เท่าของอินพุตและ 1.5 เท่าของเอาต์พุตสำหรับทั้งคำขอ ดังนั้นการเรียกใช้บริบทขนาดใหญ่และการเรียก RAG ขนาดใหญ่สามารถมีค่าใช้จ่ายเพิ่มขึ้นมากกว่าสองเท่า
- ปริมาณเอาต์พุต: เอาต์พุตสูงถึงหกเท่าของอัตราการป้อนข้อมูล ดังนั้นเอาต์พุตที่ไม่มีขีดจำกัดหรือที่ใช้การคิดแบบสูงเป็นความเสี่ยงด้านการใช้จ่ายเกินที่สำคัญที่สุด
- ชั้นบริการ: การประมวลผลแบบ Priority มีอัตราประมาณสองเท่าของอัตรามาตรฐาน (ประมาณ $10 อินพุต / $60 เอาต์พุตบน Sol); Flex และ Batch ราคาถูกกว่า เลือกชั้นบริการอย่างตั้งใจด้วยการตั้งค่า service_tier
- การเก็บข้อมูลในภูมิภาค: จุดสิ้นสุดการประมวลผลในภูมิภาคเพิ่มการปรับขึ้น 10% สำหรับโมเดลที่เผยแพร่ในหรือหลังวันที่ 5 มีนาคม 2026 ซึ่งรวมถึง GPT-5.6
- การวนซ้ำของเอเจนต์และการลองใหม่: คำแนะนำ เครื่องมือ และประวัติจะถูกส่งซ้ำทุกเทิร์น และคำขอที่ยาวซึ่งล้มเหลวจะทำให้ข้อมูลที่คุณจ่ายไปแล้วสูญเปล่า
- การเลื่อนระดับชั้น: การทิ้งทุกอย่างไว้บน Sol "เพื่อความปลอดภัย" เป็นนิสัยที่แพงที่สุดเพียงอย่างเดียว
วิธีจ่ายน้อยลง
สามคันโยกช่วยลดค่าใช้จ่าย GPT-5.6 โดยไม่ต้องเปลี่ยนแปลงสิ่งที่คุณสร้าง Batch: คำขอแบบอะซิงโครนัสผ่าน Batch tier มีส่วนลด 50% จากราคามาตรฐาน เหมาะสำหรับงาน Luna ปริมาณสูงที่ไม่ไวต่อเวลาแฝง Caching: การใช้ prefix ที่เสถียรซ้ำหลายครั้งจนเอาชนะค่า write premium 1.25x และทำให้ input ที่ซ้ำลดลงเหลือหนึ่งในสิบ Routing: ส่งงานประจำไปยัง Luna หรือ Terra และยกระดับเฉพาะส่วนที่ยากส่วนน้อยไปยัง Sol และเก็บ prompt ให้ต่ำกว่าเกณฑ์ 272K เมื่อทำได้
วิธีการเรียก GPT-5.6
GPT-5.6 สามารถใช้งานผ่าน OpenAI API และผ่านเกตเวย์ที่เข้ากันได้กับ OpenAI ดังนั้นการผสานรวมจะคงที่ในขณะที่คุณเปลี่ยนโมเดลหรือระดับที่อยู่เบื้องหลัง รูปแบบต่อไปนี้เป็นรูปแบบมาตรฐานที่เข้ากันได้กับ OpenAI โปรดยืนยันรหัสโมเดลปัจจุบันก่อนใช้งานในโพรดักชัน และกำหนดระดับที่แน่นอนแทนที่จะใช้นามแฝงเปล่า
from openai import OpenAI
client = OpenAI(base_url="https://www.orcarouter.ai/v1", api_key="YOUR_API_KEY")
response = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "ปรับโครงสร้างโมดูลนี้และอธิบายความเสี่ยง"}],
)
print(response.choices[0].message.content)
การเปลี่ยนระดับชั้นเป็นการเปลี่ยนแปลงเพียงหนึ่งบรรทัดในฟิลด์โมเดล ซึ่งทำให้การกำหนดเส้นทางตามระดับความยากนั้นใช้ได้จริง: ส่งการเรียกทั่วไปไปยัง Luna หรือ Terra และเลื่อนระดับเฉพาะงานที่ยากไปยัง Sol
การทดสอบ GPT-5.6 ผ่าน OrcaRouter
เกตเวย์ทำให้ GPT-5.6 ถูกนำไปใช้ได้ง่ายขึ้นด้วยเหตุผลสองประการ ประการแรก ไคลเอ็นต์ที่เข้ากันได้กับ OpenAI เดียวกันสามารถเรียกใช้ทั้งสามระดับและโมเดลเปรียบเทียบ เช่น Claude Opus 4.8, GLM 5.2 และ Grok 4.5 ดังนั้นคุณจึงสามารถรันชุดการประเมินชุดเดียวข้ามทุกอย่างโดยไม่ต้องเขียนโค้ดการผสานรวมใหม่ และวัดต้นทุนจริงต่องานที่ยอมรับ — รวมถึงค่าธรรมเนียมเครื่องมือ การลองซ้ำ และค่าธรรมเนียมเพิ่มเติม 272K ประการที่สอง เกตเวย์สามารถทำแฟลโอเวอร์ระหว่างผู้ให้บริการและบังคับใช้ขีดจำกัดงบประมาณ ดังนั้นปัญหาความจุชั่วคราวหรือการเรียก Sol ที่ผิดพลาดจะไม่ทำให้เดือนพัง ยืนยันเส้นทาง GPT-5.6 ที่ใช้งานจริงและรหัสระดับปัจจุบันก่อนที่คุณจะสร้างงบประมาณจากสิ่งเหล่านั้น

ขั้นตอนต่อไป: ลงทะเบียนสำหรับ OrcaRouter และรันการเปรียบเทียบระดับ GPT-5.6 ของคุณเองผ่าน API endpoint เดียว
คำถามที่พบบ่อย
ความแตกต่างระหว่าง GPT-5.6 Sol, Terra, และ Luna คืออะไร?
นี่คือผลิตภัณฑ์สามระดับจากตระกูลเดียวกัน แต่มีราคาและความสามารถต่างกัน Sol คือรุ่นเรือธงสำหรับงานหนักที่สุด ($5/$30) Terra คือรุ่นเริ่มต้นที่สมดุล ($2.50/$15) และ Luna คือรุ่นประหยัดสำหรับงานปริมาณมาก ($1/$6) เลือกรุ่นที่ต่ำที่สุดที่ผ่านการทดสอบของคุณ
มีระดับราคาสำหรับ GPT-5.6 Sol Ultra หรือไม่?
ไม่ใช่ "Sol Ultra" คือการกำหนดค่าของ Sol ที่มีความสามารถในการใช้เหตุผลขั้นสูงและมีหลายเอเจนต์ ไม่ใช่รายการแยกต่างหากในหน้าราคา มันใช้โทเค็นมากกว่าและมีต้นทุนต่องานสูงกว่า แต่คุณจัดงบประมาณเป็น Sol ที่มีความพยายามสูงกว่า
ทำไมบิล GPT-5.6 ของฉันถึงเกินกว่าการประมาณการอย่างง่าย?
โดยปกติแล้ว tokens เอาต์พุต ค่าธรรมเนียมเพิ่มสำหรับ long-prompt 272K (input 2 เท่า, output 1.5 เท่า), ระดับบริการ Priority service tier, ค่าใช้จ่ายเพิ่มสำหรับ data-residency uplift, หรือ retries. บันทึกห่วงโซ่คำขอทั้งหมดและวัดต้นทุนต่องานที่ยอมรับแทนที่จะต่อ prompt
ฉันสามารถปรับแต่ง GPT-5.6 ได้หรือไม่ และมีระดับฟรีไหม?
ไม่ทั้งสองข้อ GPT-5.6 ไม่รองรับการปรับแต่ง (fine-tuning) และ API ไม่มีระดับฟรี—การเรียกเก็บเงินเริ่มตั้งแต่โทเคนแรก การเข้าถึงฟรีมีเฉพาะในแผน ChatGPT บางแผนเท่านั้น ซึ่งเป็นผลิตภัณฑ์ที่แยกจาก API
แผน ChatGPT ใดที่สามารถใช้ระดับใดได้บ้าง
มันแตกต่างไปตามผลิตภัณฑ์ ใน ChatGPT Work และ Codex ผู้ใช้ Free และ Go สามารถใช้ Terra ได้ ในขณะที่ผู้ใช้ Plus และสูงกว่าสามารถเลือกได้ระหว่าง Sol, Terra และ Luna; การตั้งค่าสุดยอด ultra ที่สูงที่สุดจำกัดเฉพาะ Pro และ Enterprise ให้ถือว่าแผน API และ ChatGPT แยกจากกัน—คีย์ API ไม่ได้รับสิทธิ์การเข้าถึงของการสมัครสมาชิก
สรุป
เรื่องราวราคาของ GPT-5.6 คือการแบ่งระดับ (tiering) Sol ที่ $5/$30 เป็นผู้นำด้านอันดับความฉลาด Terra ที่ $2.50/$15 เป็นค่าเริ่มต้นที่คุ้มค่าและเป็นบ้านตามธรรมชาติสำหรับทราฟฟิกเดิมของ GPT-5.5 และ Luna ที่ $1/$6 จัดการปริมาณข้อมูล การแคชช่วยลดอินพุตที่ซ้ำกันเหลือหนึ่งในสิบ (หลังจากค่าธรรมเนียมการเขียนพรีเมียม 1.25x) Batch มีราคาครึ่งหนึ่ง แต่เอาต์พุตเป็นด้านที่มีราคาแพงในทุกระดับ และพรอมต์ยาวเกิน 272K มีค่าธรรมเนียมเพิ่มเติม
มองว่าสามชั้นเป็นปัญหาการจัดเส้นทาง ไม่ใช่การซื้อครั้งเดียว: เริ่มต้นระดับต่ำ เพิ่มระดับเมื่อเกิดความล้มเหลว แคชบริบทที่เสถียร ใช้ Batch เมื่อเวลาแฝงเอื้ออำนวย และเก็บโมเดลเปรียบเทียบให้เข้าถึงได้ผ่านเอนด์พอยต์เดียวกัน วิธีนี้ทำให้ต้นทุนต่องานที่ยอมรับต่ำกว่าการจ่ายอัตราระดับเรือธงสำหรับงานประจำมาก
การเปรียบเทียบในบทความนี้1
ตรวจพบจากบทความนี้ · เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
