GPT-5.6 API การกำหนดราคา: แผน Sol, Terra และ Luna, ต้นทุนจริง, และวิธีการเรียกใช้แต่ละแผน
Guides & Insights

GPT-5.6 API การกำหนดราคา: แผน Sol, Terra และ Luna, ต้นทุนจริง, และวิธีการเรียกใช้แต่ละแผน

ผู้เขียน

Fengya Tian

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

GPT-5.6 คือกลุ่มผลิตภัณฑ์เรือธงของ OpenAI ในเดือนกรกฎาคม 2026 และสิ่งสำคัญสำหรับนักพัฒนาคือมันไม่ได้มีราคาเดียว มันมีให้เลือก 3 ระดับ ได้แก่ Sol, Terra และ Luna บน OpenAI API นั้น Sol มีราคา $5 ต่ออินพุต 1 ล้านโทเค็น และ $30 ต่อเอาต์พุต 1 ล้านโทเค็น Terra อยู่ที่ $2.50 และ $15 ส่วน Luna อยู่ที่ $1 และ $6 แต่ละระดับมีส่วนลดสำหรับอินพุตที่ถูกแคชไว้ ทั้งสามระดับรองรับอินพุตรูปภาพและข้อความ และหน้าต่างบริบทประมาณ 1.05 ล้านโทเค็น โดยเอาต์พุตสูงสุด 128K

ราคาที่ระบุไว้เป็นเพียงจุดเริ่มต้นของต้นทุนที่แท้จริงเท่านั้น ระดับที่คุณต้องการจริงๆ ปริมาณที่คุณแคช ปริมาณเอาต์พุตที่โมเดลสร้าง และกฎการกำหนดราคาสองสามข้อที่คู่มือส่วนใหญ่ข้ามไป—พรอมต์ที่มีโทเค็นเกิน 272K ค่าใช้จ่ายเพิ่มสำหรับการจัดเก็บข้อมูลในประเทศ และระดับบริการ—เป็นตัวกำหนดค่าใช้จ่ายมากกว่าอัตราหัวข้อข่าวมาก คู่มือนี้จะแจกแจงราคาของแต่ละระดับ ว่ามีไว้เพื่ออะไร การให้คะแนนเป็นอย่างไร วิธีการย้ายจาก GPT-5.5 วิธีการเรียกใช้ และเปรียบเทียบกับ Claude, GLM, Gemini, DeepSeek และ Grok อย่างไร

คำตอบด่วน: ภาพรวมราคา GPT-5.6

- สามระดับราคา (ต่อล้านโทเค็น, ราคาเข้า/ออก): Sol $5 / $30, Terra $2.50 / $15, Luna $1 / $6.

- ค่าใช้จ่ายสำหรับอินพุตที่แคช: $0.50 (Sol), $0.25 (Terra), $0.10 (Luna) ต่อล้านโทเคน; การเขียนแคชมีค่าใช้จ่าย 1.25 เท่าของอัตราอินพุตที่ไม่ได้แคช

การวางตำแหน่ง: Sol สำหรับงานที่ต้องใช้เหตุผลและงานอัตโนมัติที่ยากที่สุด, Terra เป็นค่าเริ่มต้นที่สมดุล, Luna สำหรับงานที่มีปริมาณสูงและอ่อนไหวต่อต้นทุน

- รูปแบบ: หลายรูปแบบ—GPT-5.6 รองรับอินพุตรูปภาพควบคู่ไปกับข้อความ บริบทประมาณ 1.05 ล้านโทเค็น สูงสุดเอาต์พุต 128K

- กฎการคิดราคาสองข้อที่ต้องวางแผน: พรอมต์ที่มีจำนวนโทเค็นอินพุตเกิน 272K จะถูกคิดค่าบริการเป็น 2 เท่าของอินพุตและ 1.5 เท่าของเอาต์พุตสำหรับทั้งคำขอ และปลายทางที่มีการจัดเก็บข้อมูลในประเทศจะเพิ่มอัตรา 10%

- วิธีจ่ายน้อยลง: Batch ลด 50% จากราคามาตรฐาน, การแคชลดอินพุตซ้ำเหลือหนึ่งในสิบ, และการกำหนดงานประจำไปยังระดับที่ต่ำกว่าหลีกเลี่ยงผลลัพธ์ $30 ของ Sol

- Intelligence: Artificial Analysis places GPT-5.6 Sol near the top of its Intelligence Index (score 59).

ราคา API ของ GPT-5.6 แยกตามระดับ

OpenAI คิดราคา GPT-5.6 ต่อหนึ่งล้านโทเค็น และผลลัพธ์มีราคาแพงกว่าอินพุตมากในทุกชั้น อัตราที่เผยแพร่ในปัจจุบันคือ:

- GPT-5.6 Sol: $5.00 อินพุต, $0.50 อินพุตแคช, $30.00 เอาต์พุต (การเขียนแคช $6.25)

- GPT-5.6 Terra: $2.50 อินพุต, $0.25 อินพุตที่แคช, $15.00 เอาท์พุต.

- GPT-5.6 Luna: $1.00 อินพุต, $0.10 อินพุตที่แคชไว้, $6.00 เอาต์พุต

สองรายละเอียดที่สำคัญก่อนวางแผนงบประมาณ ประการแรก อัตราเอาต์พุตเป็นปัจจัยหลักของค่าใช้จ่ายส่วนใหญ่ โดยเฉพาะงานที่ต้องใช้เหตุผลและงานของเอเจนต์ ซึ่งโมเดลจะสร้าง trace ยาว, การเรียกใช้เครื่องมือ, และการแก้ไขก่อนคำตอบสุดท้าย ประการที่สอง ไม่มีบรรทัดราคา "Sol Ultra" แยกต่างหากในหน้าราคา "Sol Ultra" คือการกำหนดค่าการใช้เหตุผลที่สูงกว่าของ Sol (การตั้งค่าแบบหลายเอเจนต์) ไม่ใช่ระดับบริการอิสระ—ควรวางงบประมาณรอบ ๆ Sol, Terra และ Luna

แต่ละระดับนั้นจริงๆ แล้วใช้ทำอะไร

Luna: ปริมาณสูงและไวต่อต้นทุน

Luna เป็นระดับประหยัดที่ราคา $1 สำหรับอินพุตและ $6 สำหรับเอาต์พุต เป็นค่าเริ่มต้นที่เหมาะสมสำหรับการจำแนกประเภท การสกัด การกำหนดเส้นทาง การสรุป การร่าง และงานประจำจำนวนมากที่ความแตกต่างด้านคุณภาพเพียงเล็กน้อยไม่เปลี่ยนแปลงผลลัพธ์ ที่ราคาหกดอลลาร์ต่อล้านโทเค็นเอาต์พุต มันถูกพอที่จะรันในขนาดใหญ่และสุ่มตัวอย่างซ้ำๆ

เทอร์ร่า: ค่าเริ่มต้นที่สมดุล

Terra อยู่ตรงกลางที่ราคา $2.50 และ $15 สำหรับงานแอปพลิเคชันและเขียนโค้ดส่วนใหญ่แล้ว นี่คือจุดเริ่มต้นที่สมเหตุสมผล: แข็งแกร่งกว่า Luna อย่างเห็นได้ชัดในงานที่ยากกว่า แต่มีราคาเอาต์พุตเพียงครึ่งเดียวของ Sol เริ่มต้นที่นี่ จากนั้นย้ายงานขึ้นไปยัง Sol เฉพาะเมื่อ Terra ล้มเหลวอย่างเห็นได้ชัดเท่านั้น

Sol: งานที่ยากที่สุดเกี่ยวกับการใช้เหตุผลและการทำงานแบบเอเจนต์

Sol เป็นเรือธงในราคา $5 และ $30 และ Artificial Analysis จัดอันดับให้อยู่ใกล้ด้านบนของ Intelligence Index ของมัน ควรสงวนไว้สำหรับสถาปัตยกรรมที่ยาก การดีบักที่ซับซ้อน เอเจนต์ระยะยาว และการวิเคราะห์ที่มีความเสี่ยงสูง ซึ่งการหลีกเลี่ยงความล้มเหลวเพียงครั้งเดียวก็คุ้มกับส่วนเพิ่ม การใช้ Sol สำหรับงานประจำเป็นวิธีที่พบได้บ่อยที่สุดในการใช้จ่ายเกินกับ GPT-5.6

มาจาก GPT-5.5 ใช่ไหม? ระดับใดประหยัดที่สุด

GPT-5.6 Sol ถูกตั้งราคาเท่ากับ GPT-5.5 ทุกประการ โดยคิด $5 ต่ออินพุตและ $30 ต่อเอาต์พุต ดังนั้นการย้ายเวิร์กโหลด GPT-5.5 ตรงไปยัง Sol จึงแทบไม่เปลี่ยนแปลงค่าใช้จ่ายมากนัก ส่วนการประหยัดเกิดขึ้นจากสองระดับราคาที่ต่ำกว่าใหม่ Terra มอบคุณภาพระดับเดียวกับ GPT-5.5 ในงานส่วนใหญ่ในราคาครึ่งเดียว ดังนั้นการย้ายที่ง่ายที่สุดคือส่งทราฟฟิก GPT-5.5 ที่มีอยู่ไปยัง Terra และเลื่อนเฉพาะงานที่ด้อยประสิทธิภาพกลับขึ้นไปที่ Sol เท่านั้น

แผนการย้ายระบบที่ปฏิบัติได้จริงมีสามขั้นตอน: เปลี่ยนเส้นทางการเรียก GPT-5.5 ไปยัง Terra, เรียกใช้ชุดประเมินของคุณ, และส่งต่อเฉพาะที่ล้มเหลวไปยัง Sol ขณะที่ผลักดันงานประจำที่ชัดเจนลงไปยัง Luna งานส่วนใหญ่ของ GPT-5.5 จะมีต้นทุนที่ถูกกว่าด้วยวิธีนี้โดยไม่สูญเสียคุณภาพที่คุณสามารถวัดได้

ระดับชั้นต่างๆ ให้คะแนนจริงๆ อย่างไร

Price only matters next to capability. On OpenAI’s own Terminal-Bench 2.1 numbers, the tiers separate about as you would expect: Sol 88.8%, Sol Ultra 91.9%, Terra 87.4%, and Luna 84.7%. For context in the same table, GPT-5.5 scores 85.6%, Claude Opus 4.8 is 78.9%, Claude Fable 5 is 83.1%, and Gemini 3.1 Pro (preview) is 70.7%. Artificial Analysis separately gives Sol an Intelligence Index of 59, near the top of its ranking.

จงอ่านสิ่งเหล่านี้ว่าเป็นรายงานจากผู้จำหน่ายและใช้เป็นแนวทางเท่านั้น OpenAI ได้เผยแพร่ชุดการประเมินผลสำหรับ GPT-5.6 ในขอบเขตที่จำกัด และ ณ เวลาที่เขียนนี้ ยังไม่ได้รวมถึงเกณฑ์มาตรฐานด้านการเขียนโค้ดและการให้เหตุผลแบบดั้งเดิม เช่น SWE-bench Verified หรือ GPQA ดังนั้นให้ใช้คะแนนเหล่านี้เพื่อตัดสินใจว่าจะทดสอบอะไรกับภาระงานของคุณเอง แทนที่จะใช้เป็นข้อสรุปสุดท้าย

อัตราการอ่านอินพุตที่แคชไว้ของแต่ละระดับคือหนึ่งในสิบของอัตราอินพุตสด: $0.50 บน Sol, $0.25 บน Terra, $0.10 บน Luna อย่างไรก็ตาม การเขียนไปยังแคชมีค่าใช้จ่าย 1.25 เท่าของอัตราอินพุตที่ไม่ได้แคช (ประมาณ $6.25 ต่อล้านบน Sol) ดังนั้นการแคชจะคุ้มค่าเมื่อมีการใช้คำนำหน้าที่เสถียรซ้ำหลายครั้งพอที่จะชดเชยค่าพรีเมียมในการเขียน—คำแนะนำของระบบ, เอกสารขนาดใหญ่, กฎของที่เก็บ, หรืออนุกรมวิธานสินค้า วางเนื้อหาที่เสถียรไว้ที่ด้านหน้าของพรอมต์และคำถามที่เปลี่ยนแปลงไปไว้ที่ท้าย และหลีกเลี่ยงการแทรกประทับเวลาหรือตัวระบุแบบสุ่มไว้ก่อนบริบทที่ใช้ซ้ำได้

แคชช่วยลดต้นทุนในการป้อนข้อมูลซ้ำ แต่ไม่มีผลต่อผลลัพธ์ เนื่องจากผลลัพธ์เป็นด้านที่มีค่าใช้จ่ายสูงในทุกชั้น คันโยกสองอันที่ส่งผลต่อค่าใช้จ่ายของ GPT-5.6 มากที่สุดคือการแคชคำนำหน้าที่คงที่และการควบคุมปริมาณที่โมเดลเขียน

คุณควรเลือก tier ไหน?

อย่าเลือกระดับตามชื่อเสียง ให้เลือกระดับตามการทดสอบ สร้างชุดงานตัวอย่างเล็กๆ ที่มีเกณฑ์การยอมรับที่ชัดเจน รันบน Luna ก่อน และเลื่อนเฉพาะงานที่ล้มเหลวไปยัง Terra จากนั้นไปยัง Sol วัดต้นทุนต่องานที่ยอมรับ ไม่ใช่ราคาเฉลี่ยต่อโทเค็น เพราะระดับที่ถูกกว่าซึ่งต้องลองสามครั้งอาจมีราคาแพงกว่าระดับที่แข็งแกร่งกว่าซึ่งสำเร็จในครั้งเดียว

นิสัยในการปฏิบัติงานอย่างหนึ่งช่วยประหยัดเงินจริง: ระบุรุ่นของ tier model ID ที่แน่นอนในแต่ละการเรียกใช้แทนที่จะพึ่งพา alias เปล่าๆ เพื่อให้คำขอทั่วไปไม่ทำงานบน tier ที่แพงที่สุดอย่างเงียบๆ งานแบบผสมมักจะใช้ Luna สำหรับการแปลงและร่างงานประจำ, Terra สำหรับการใช้งานและการวิเคราะห์ประจำวัน, และ Sol สงวนไว้สำหรับส่วนน้อยที่ยาก—คำขอส่วนใหญ่ไม่เคยต้องการรุ่นเรือธงเลย

GPT-5.6 เทียบกับคู่แข่งในเรื่องราคา

GPT-5.6 does not exist in isolation. Read against the current field (per million tokens, input / output, mid-2026): Claude Opus 4.8 is $5 / $25, Claude Fable 5—Anthropic’s strongest public model—is $10 / $50, GLM 5.2 is $1.40 / $4.40 on Z.AI (third-party hosts can be lower), Grok 4.5 is $2 / $6, Google’s Gemini 3.5 Flash is about $1.50 / $9, and DeepSeek V4-Pro is about $0.44 / $0.87. Confirm each on the vendor’s own page, as these move.

ข้อสรุปที่ได้มีความเฉพาะเจาะจง GPT-5.6 Sol เทียบกับ Opus 4.8 ด้านอินพุตเท่ากัน แต่แพงกว่าในด้านเอาต์พุต ($30 เทียบกับ $25) ดังนั้นสำหรับงานที่เน้นเอาต์พุตหนักๆ อย่างงานแบบเอเจนต์ Opus จะถูกกว่าเล็กน้อยต่อโทเค็น ในขณะที่ Sol เป็นผู้นำดัชนีความฉลาด Terra ถูกกว่าทั้งสองรุ่นเรือธง และเป็นตัวเลือกที่คุ้มค่าภายในตระกูล OpenAI Luna แข่งขันด้านราคากับรุ่นที่ถูกกว่า แม้ว่า Grok 4.5, GLM 5.2 และโดยเฉพาะ DeepSeek จะถูกกว่าอีก ไม่มีระดับราคาหรือผู้ขายรายใดชนะไปทั้งหมด ซึ่งเป็นเหตุผลว่าทำไมการเลือกเส้นทางตามความยากจึงดีกว่าการผูกมัดกับรุ่นเดียว

ใบแจ้งหนี้รายเดือนที่ดำเนินการแล้ว

ใส่ตัวเลขลงไป สำหรับเดือนที่มีการใช้งานหนักปานกลาง โดยมีโทเคนอินพุต 50M และเอาต์พุต 10M ในราคาปกติก่อนการแคชและการใช้เครื่องมือ ค่าใช้จ่ายของโมเดลจะอยู่ที่ประมาณ:

- GPT-5.6 Luna: ประมาณ $110

GPT-5.6 Terra: ประมาณ $275

- GPT-5.6 Sol: ประมาณ $550

- สำหรับการเปรียบเทียบ: GLM 5.2 ประมาณ $114, Grok 4.5 ประมาณ $160, Claude Opus 4.8 ประมาณ $500, Claude Fable 5 ประมาณ $1,000.

งานเดียวกันที่ถูกจัดเส้นทางอย่างชาญฉลาด—Luna และ Terra สำหรับงานส่วนใหญ่, Sol สำหรับงานยากส่วนน้อย—มีมูลค่าใกล้เคียงกับช่วง $110–$275 มากกว่าที่จะเป็น $550 คงที่ของ Sol สำหรับทุกอย่าง ช่องว่างดังกล่าว เมื่อคูณตลอดทั้งปี คือข้อโต้แย้งทั้งหมดสำหรับการจัดเส้นทางแบบแบ่งชั้น

ค่าใช้จ่ายแอบแฝงที่ต้องวางแผน

กฎการกำหนดราคาหลายข้อไม่ปรากฏในอัตราหลักและทำให้ทีมประหลาดใจในภายหลัง:

- คำขอที่ยาว: คำขอที่มีโทเคนอินพุตมากกว่า 272K จะถูกคิดค่าใช้จ่ายเป็น 2 เท่าของอินพุตและ 1.5 เท่าของเอาต์พุตสำหรับทั้งคำขอ ดังนั้นการเรียกใช้บริบทขนาดใหญ่และการเรียก RAG ขนาดใหญ่สามารถมีค่าใช้จ่ายเพิ่มขึ้นมากกว่าสองเท่า

- ปริมาณเอาต์พุต: เอาต์พุตสูงถึงหกเท่าของอัตราการป้อนข้อมูล ดังนั้นเอาต์พุตที่ไม่มีขีดจำกัดหรือที่ใช้การคิดแบบสูงเป็นความเสี่ยงด้านการใช้จ่ายเกินที่สำคัญที่สุด

- ชั้นบริการ: การประมวลผลแบบ Priority มีอัตราประมาณสองเท่าของอัตรามาตรฐาน (ประมาณ $10 อินพุต / $60 เอาต์พุตบน Sol); Flex และ Batch ราคาถูกกว่า เลือกชั้นบริการอย่างตั้งใจด้วยการตั้งค่า service_tier

- การเก็บข้อมูลในภูมิภาค: จุดสิ้นสุดการประมวลผลในภูมิภาคเพิ่มการปรับขึ้น 10% สำหรับโมเดลที่เผยแพร่ในหรือหลังวันที่ 5 มีนาคม 2026 ซึ่งรวมถึง GPT-5.6

- การวนซ้ำของเอเจนต์และการลองใหม่: คำแนะนำ เครื่องมือ และประวัติจะถูกส่งซ้ำทุกเทิร์น และคำขอที่ยาวซึ่งล้มเหลวจะทำให้ข้อมูลที่คุณจ่ายไปแล้วสูญเปล่า

- การเลื่อนระดับชั้น: การทิ้งทุกอย่างไว้บน Sol "เพื่อความปลอดภัย" เป็นนิสัยที่แพงที่สุดเพียงอย่างเดียว

วิธีจ่ายน้อยลง

สามคันโยกช่วยลดค่าใช้จ่าย GPT-5.6 โดยไม่ต้องเปลี่ยนแปลงสิ่งที่คุณสร้าง Batch: คำขอแบบอะซิงโครนัสผ่าน Batch tier มีส่วนลด 50% จากราคามาตรฐาน เหมาะสำหรับงาน Luna ปริมาณสูงที่ไม่ไวต่อเวลาแฝง Caching: การใช้ prefix ที่เสถียรซ้ำหลายครั้งจนเอาชนะค่า write premium 1.25x และทำให้ input ที่ซ้ำลดลงเหลือหนึ่งในสิบ Routing: ส่งงานประจำไปยัง Luna หรือ Terra และยกระดับเฉพาะส่วนที่ยากส่วนน้อยไปยัง Sol และเก็บ prompt ให้ต่ำกว่าเกณฑ์ 272K เมื่อทำได้

วิธีการเรียก GPT-5.6

GPT-5.6 สามารถใช้งานผ่าน OpenAI API และผ่านเกตเวย์ที่เข้ากันได้กับ OpenAI ดังนั้นการผสานรวมจะคงที่ในขณะที่คุณเปลี่ยนโมเดลหรือระดับที่อยู่เบื้องหลัง รูปแบบต่อไปนี้เป็นรูปแบบมาตรฐานที่เข้ากันได้กับ OpenAI โปรดยืนยันรหัสโมเดลปัจจุบันก่อนใช้งานในโพรดักชัน และกำหนดระดับที่แน่นอนแทนที่จะใช้นามแฝงเปล่า

from openai import OpenAI
client = OpenAI(base_url="https://www.orcarouter.ai/v1", api_key="YOUR_API_KEY")
response = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "ปรับโครงสร้างโมดูลนี้และอธิบายความเสี่ยง"}],
)
print(response.choices[0].message.content)

การเปลี่ยนระดับชั้นเป็นการเปลี่ยนแปลงเพียงหนึ่งบรรทัดในฟิลด์โมเดล ซึ่งทำให้การกำหนดเส้นทางตามระดับความยากนั้นใช้ได้จริง: ส่งการเรียกทั่วไปไปยัง Luna หรือ Terra และเลื่อนระดับเฉพาะงานที่ยากไปยัง Sol

การทดสอบ GPT-5.6 ผ่าน OrcaRouter

เกตเวย์ทำให้ GPT-5.6 ถูกนำไปใช้ได้ง่ายขึ้นด้วยเหตุผลสองประการ ประการแรก ไคลเอ็นต์ที่เข้ากันได้กับ OpenAI เดียวกันสามารถเรียกใช้ทั้งสามระดับและโมเดลเปรียบเทียบ เช่น Claude Opus 4.8, GLM 5.2 และ Grok 4.5 ดังนั้นคุณจึงสามารถรันชุดการประเมินชุดเดียวข้ามทุกอย่างโดยไม่ต้องเขียนโค้ดการผสานรวมใหม่ และวัดต้นทุนจริงต่องานที่ยอมรับ — รวมถึงค่าธรรมเนียมเครื่องมือ การลองซ้ำ และค่าธรรมเนียมเพิ่มเติม 272K ประการที่สอง เกตเวย์สามารถทำแฟลโอเวอร์ระหว่างผู้ให้บริการและบังคับใช้ขีดจำกัดงบประมาณ ดังนั้นปัญหาความจุชั่วคราวหรือการเรียก Sol ที่ผิดพลาดจะไม่ทำให้เดือนพัง ยืนยันเส้นทาง GPT-5.6 ที่ใช้งานจริงและรหัสระดับปัจจุบันก่อนที่คุณจะสร้างงบประมาณจากสิ่งเหล่านั้น

ขั้นตอนต่อไป: ลงทะเบียนสำหรับ OrcaRouter และรันการเปรียบเทียบระดับ GPT-5.6 ของคุณเองผ่าน API endpoint เดียว

คำถามที่พบบ่อย

ความแตกต่างระหว่าง GPT-5.6 Sol, Terra, และ Luna คืออะไร?

นี่คือผลิตภัณฑ์สามระดับจากตระกูลเดียวกัน แต่มีราคาและความสามารถต่างกัน Sol คือรุ่นเรือธงสำหรับงานหนักที่สุด ($5/$30) Terra คือรุ่นเริ่มต้นที่สมดุล ($2.50/$15) และ Luna คือรุ่นประหยัดสำหรับงานปริมาณมาก ($1/$6) เลือกรุ่นที่ต่ำที่สุดที่ผ่านการทดสอบของคุณ

มีระดับราคาสำหรับ GPT-5.6 Sol Ultra หรือไม่?

ไม่ใช่ "Sol Ultra" คือการกำหนดค่าของ Sol ที่มีความสามารถในการใช้เหตุผลขั้นสูงและมีหลายเอเจนต์ ไม่ใช่รายการแยกต่างหากในหน้าราคา มันใช้โทเค็นมากกว่าและมีต้นทุนต่องานสูงกว่า แต่คุณจัดงบประมาณเป็น Sol ที่มีความพยายามสูงกว่า

ทำไมบิล GPT-5.6 ของฉันถึงเกินกว่าการประมาณการอย่างง่าย?

โดยปกติแล้ว tokens เอาต์พุต ค่าธรรมเนียมเพิ่มสำหรับ long-prompt 272K (input 2 เท่า, output 1.5 เท่า), ระดับบริการ Priority service tier, ค่าใช้จ่ายเพิ่มสำหรับ data-residency uplift, หรือ retries. บันทึกห่วงโซ่คำขอทั้งหมดและวัดต้นทุนต่องานที่ยอมรับแทนที่จะต่อ prompt

ฉันสามารถปรับแต่ง GPT-5.6 ได้หรือไม่ และมีระดับฟรีไหม?

ไม่ทั้งสองข้อ GPT-5.6 ไม่รองรับการปรับแต่ง (fine-tuning) และ API ไม่มีระดับฟรี—การเรียกเก็บเงินเริ่มตั้งแต่โทเคนแรก การเข้าถึงฟรีมีเฉพาะในแผน ChatGPT บางแผนเท่านั้น ซึ่งเป็นผลิตภัณฑ์ที่แยกจาก API

แผน ChatGPT ใดที่สามารถใช้ระดับใดได้บ้าง

มันแตกต่างไปตามผลิตภัณฑ์ ใน ChatGPT Work และ Codex ผู้ใช้ Free และ Go สามารถใช้ Terra ได้ ในขณะที่ผู้ใช้ Plus และสูงกว่าสามารถเลือกได้ระหว่าง Sol, Terra และ Luna; การตั้งค่าสุดยอด ultra ที่สูงที่สุดจำกัดเฉพาะ Pro และ Enterprise ให้ถือว่าแผน API และ ChatGPT แยกจากกัน—คีย์ API ไม่ได้รับสิทธิ์การเข้าถึงของการสมัครสมาชิก

สรุป

เรื่องราวราคาของ GPT-5.6 คือการแบ่งระดับ (tiering) Sol ที่ $5/$30 เป็นผู้นำด้านอันดับความฉลาด Terra ที่ $2.50/$15 เป็นค่าเริ่มต้นที่คุ้มค่าและเป็นบ้านตามธรรมชาติสำหรับทราฟฟิกเดิมของ GPT-5.5 และ Luna ที่ $1/$6 จัดการปริมาณข้อมูล การแคชช่วยลดอินพุตที่ซ้ำกันเหลือหนึ่งในสิบ (หลังจากค่าธรรมเนียมการเขียนพรีเมียม 1.25x) Batch มีราคาครึ่งหนึ่ง แต่เอาต์พุตเป็นด้านที่มีราคาแพงในทุกระดับ และพรอมต์ยาวเกิน 272K มีค่าธรรมเนียมเพิ่มเติม

มองว่าสามชั้นเป็นปัญหาการจัดเส้นทาง ไม่ใช่การซื้อครั้งเดียว: เริ่มต้นระดับต่ำ เพิ่มระดับเมื่อเกิดความล้มเหลว แคชบริบทที่เสถียร ใช้ Batch เมื่อเวลาแฝงเอื้ออำนวย และเก็บโมเดลเปรียบเทียบให้เข้าถึงได้ผ่านเอนด์พอยต์เดียวกัน วิธีนี้ทำให้ต้นทุนต่องานที่ยอมรับต่ำกว่าการจ่ายอัตราระดับเรือธงสำหรับงานประจำมาก


© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

ติดต่อเรา

เข้าร่วมคอมมูนิตี้ของเรา

DiscordEmailXGitHubYouTube