การ์ดชื่อเรื่องสำหรับคู่มือ GPT-5.6 Sol API แสดงการ์ดเกตเวย์มุมโค้งที่มีชิปรหัสอ่านว่า model: gpt-5.6-sol ป้ายราคาอ่านว่า $5 / $30 ต่อ 1M tokens หน้าปัดที่ติดป้ายว่า Reasoning effort มีหกตำแหน่ง และชิปโมเดลสี่ชิปที่ติดป้ายว่า GPT, Claude, Gemini และ Qwen เชื่อมต่อด้วยเส้นบาง ๆ เข้าสู่เกตเวย์เดียว
Guides & Insights

GPT-5.6 Sol API: วิธีเรียกใช้ ราคา และเวลาที่ควรดาวน์เกรด

ผู้เขียน

Alistair Wren

วันที่เผยแพร่

โมเดลล่าสุด · 20ดูโมเดลทั้งหมด
เบนช์มาร์ก: Artificial Analysis · อัปเดตทุกวัน
กลับไปยังโพสต์ทั้งหมด

To call the GPT-5.6 Sol API you send model: "gpt-5.6-sol" to https://api.openai.com/v1/chat/completions — or to the Responses API, the recommended route for new builds — and you are billed $5 per million input tokens and $30 per million output. The same model id works through any OpenAI-compatible gateway: GPT-5.6 Sol on OrcaRouter passes that list price through with $0 per-token markup, and with bring-your-own-key the request bills your existing account directly. Sol is the flagship tier of the GPT-5.6 family, released July 9, 2026, with a ~1.05M-token context window. The decision that actually matters is not which dialect you call but whether the task earns the $30 output rate — this guide covers the exact request shapes, the reasoning dial that controls the real cost, and the honest case for routing volume elsewhere.

ภาษาถิ่นสองภาษาและรหัสโมเดลหนึ่งรหัส

บทช่วยสอน GPT-5.6 Sol ส่วนใหญ่แสดงภาษาถิ่นเพียงภาษาเดียวแล้วจบแค่นั้น จริงๆ แล้วมีอยู่สองแบบ และทั้งคู่ไปถึงค่าน้ำหนักเดียวกัน

Chat Completions — /v1/chat/completions. POST to https://api.openai.com/v1/chat/completions with an Authorization: Bearer header carrying your OpenAI key. The body takes model: "gpt-5.6-sol", a messages array, and your chosen reasoning effort. This is the dialect the standard OpenAI Python and TypeScript SDKs send by default.

Responses API — client.responses.create. รหัสโมเดลเดียวกันกับรูปแบบคำขอที่ใหม่กว่า: หนึ่ง input ฟิลด์ และ reasoning บล็อก ({"effort": "high"}) แทนที่อาร์เรย์ messages. OpenAI แนะนำให้ใช้สำหรับงานใหม่ เนื่องจากรับพารามิเตอร์ reasoning โดยตรง และส่งคืนโทเคน reasoning เป็นเอาต์พุตระดับหนึ่ง — และระดับความพยายามสูงสุดมีเฉพาะที่นี่เท่านั้น.

ล็อก tier นามแฝงล้วนๆ gpt-5.6 ในปัจจุบันชี้ไปที่ Sol แต่นามแฝงคือสิ่งที่ผู้ให้บริการจะเปลี่ยนเมื่อเรือธงรุ่นใหม่ออกสู่ตลาด การส่ง gpt-5.6-sol อย่างชัดเจนหมายความว่าทุกการเรียกใช้จะระบุว่ามันมีค่าใช้จ่ายเท่าไร และเป็น id ที่ทุกเกตเวย์คาดหวัง

สิ่งที่คุณได้รับ — และหน้าปัดที่กำหนดบิลของคุณ

GPT-5.6 Sol คือโมเดลเรือธงที่เน้นการให้เหตุผลของ OpenAI: หน้าต่างบริบทประมาณ 1.05 ล้านโทเคน เอาต์พุตสูงสุด 128K knowledge cutoff วันที่ 16 กุมภาพันธ์ 2026 และรองรับอินพุตทั้งข้อความ รูปภาพ และไฟล์ โดยให้เอาต์พุตเป็นข้อความ บนกระดานผู้นำ Artificial Analysis ซึ่งเป็นอิสระ มันได้AA Intelligence Index เท่ากับ 61และAA Coding Score เท่ากับ 77 โดยมีSWE-bench Pro Score เท่ากับ 64.6%ซึ่งถูกวัดอย่างเป็นอิสระโดย llm-stats — ตัวเลขการเขียนโค้ดคือตัวเลขที่กลุ่มคนที่ใช้เอเจนต์พูดถึงจริงๆ

A spec and benchmark scoreboard for GPT-5.6 Sol: model id gpt-5.6-sol, ~1.05M token context window, 128K max output, released July 9 2026, AA Intelligence Index 61 and AA Coding 77 per Artificial Analysis, SWE-bench Pro 64.6% independently measured by llm-stats, and six reasoning-effort levels from none to max.

การคิดถูกเปิดใช้งานโดยค่าเริ่มต้น และการใช้เหตุผลซึ่งเป็นพารามิเตอร์เป็นตัวแปรเดียวที่ส่งผลมากที่สุดต่อทั้งเวลาแฝงและต้นทุน:

หกระดับไม่มี, ต่ำ, กลาง, สูง, สูงพิเศษ, สูงสุด. ไม่มี จะปิดการให้เหตุผลสำหรับงานเชิงกล; สูงสุด ใช้สำหรับปัญหาที่มีต้นทุนความผิดพลาดสูง และใช้งานได้ผ่าน Responses API เท่านั้น.

เริ่มต้นที่ระดับปานกลางและเลื่อนขึ้นทีละระดับ คู่มือ apidog GPT-5.6 ระบุว่าเวิร์กโหลด GPT-5.5 จำนวนมากคงคุณภาพไว้ที่ระดับต่ำกว่าหนึ่งขั้นบนตระกูล 5.6 — วัดคุณภาพก่อนจ่ายเงินเพื่อการคิดเพิ่มเติม

Pro mode เป็นการตั้งค่า ไม่ใช่โมเดล ตั้งค่า reasoning.mode: "pro" และโมเดลจะให้ความสำคัญกับคุณภาพของคำตอบมากกว่าความเร็ว ราคาและ model id ไม่มีการเปลี่ยนแปลง

ระดับความละเอียดต่ำ, ปานกลาง (ค่าเริ่มต้น), สูง — ควบคุมความยาวของผลลัพธ์โดยอิสระจากการใช้เหตุผล.

โทเคนการให้เหตุผลคิดค่าบริการเป็น output ในอัตรา $30 ต่อล้านโทเคน สำหรับพรอมป์ต์ที่ยากระดับ xhigh หรือ max การให้เหตุผลภายในอาจครองสัดส่วนหลักของค่าใช้จ่าย — ซึ่งเป็นส่วนที่ซ่อนอยู่ของการกำหนดราคาโมเดล reasoning ที่ป้ายราคาไม่เคยแสดงให้เห็น

ต้นทุนที่แท้จริงของ Sol

ราคาฐานของ Sol ยังคงไม่เปลี่ยนแปลงหลังการปรับลดราคาของ OpenAI เมื่อวันที่ 30 กรกฎาคม 2026: $5 ต่อล้านอินพุต และ $30 ต่อล้านเอาต์พุต. การปรับลดราคาครั้งนี้ใช้กับสองระดับที่ถูกกว่า — GPT-5.6 Terra ลดลงเหลือ $2 / $12 และ GPT-5.6 Luna เหลือ $0.20 / $1.20 — ซึ่งสำคัญตรงนี้ เพราะมันคือการเปรียบเทียบที่แม่นยำที่บอกคุณว่าเมื่อใดที่ Sol เกินจำเป็น.

A price card for the GPT-5.6 Sol API: Sol at $5 input / $30 output per 1M with a $0.50 cache read and a $6.25 cache write, a long-context tier at $10 / $45, GPT-5.6 Terra at $2 / $12 and GPT-5.6 Luna at $0.20 / $1.20, and a worked example of 100K tokens in plus 20K out billing $1.10 uncached or about $0.65 with a cached input leg.

ตัวปรับแต่งสามตัวเปลี่ยนอัตราที่แท้จริง:

การแคชพรอมต์ อินพุตที่ถูกใช้ซ้ำคิดค่าใช้จ่ายประมาณ$0.50 ต่อล้าน ในการอ่านแคช — ลด 90% จากอินพุตใหม่ — และการเขียนแคชคิดค่าใช้จ่ายที่$6.25 ต่อล้าน (1.25 เท่าของอัตราอินพุตที่ไม่ได้แคช) การแคชเป็นแบบปริยายตามค่าเริ่มต้น และสามารถทำให้เป็นแบบชัดเจนได้ผ่านprompt_cache_options พร้อมกับttl; คำนำหน้าที่แคชต้องมีอย่างน้อย 1,024 โทเคนและคงความร้อนอยู่เป็นเวลาอย่างน้อย 30 นาที

ระดับราคาบริบทแบบยาว เมื่อขนาดอินพุตเกินเกณฑ์ที่กำหนด Sol จะขยับขึ้นเป็น $10 / $45 ต่อล้านโทเคน พรอมต์ที่ยาวมากเพียงไม่กี่รายการจะค่อยๆ ขยับราคาเฉลี่ยของคุณ

ทุกสิ่งที่โมเดลส่งออกมาคือเอาต์พุต ซึ่งรวมถึงโทเค็นการให้เหตุผลภายใน ดังนั้นในการเรียกที่ใช้การให้เหตุผลหนักๆ ค่าใช้จ่ายจะกระจุกอยู่ที่ฝั่งเอาต์พุต

ตัวอย่างใบแจ้งหนี้: คำขอขนาด 100K โทเค็นซึ่งสร้างเอาต์พุต 20K โทเค็น คิดเงิน $0.50 สำหรับอินพุต และ $0.60 สำหรับเอาต์พุต — $1.10 โดยไม่ใช้แคช ถ้าคำขอ 100K นั้นถูกเสิร์ฟจากแคชในการเรียกครั้งถัดไป ค่าอินพุตจะลดลงเหลือประมาณ $0.05 และค่าใช้จ่ายรวมจะอยู่ที่ประมาณ $0.65. ในการวนซ้ำของเอเจนต์ที่ยาวนานซึ่งใช้ระบบพรอมต์ตัวเดิมซ้ำทั้งวัน การแคชคือตัวกำหนดว่า Sol จะมีราคาที่จ่ายไหวหรือไม่

หนึ่งเอนด์พอยต์ รองรับ 200+ โมเดล

If you are reading a GPT-5.6 Sol API guide you already have an integration or are about to write one, and the real question is how many more you want to maintain. OrcaRouter puts 200+ models behind one OpenAI-compatible endpoint: the same base URL (https://api.orcarouter.ai/v1), the same client, and a different model id per model — openai/gpt-5.6-sol today, a cheaper tier or a different family when the workload stops earning Sol's rate, all without a code change.

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the 1.05M-token context window, 128K max output, the p50 TTFT of 4.59s, and the /v1/chat/completions and /v1/responses endpoints.

ส่วนที่เป็นเรื่องค่าใช้จ่ายคือส่วนที่ตรงไปตรงมา OrcaRouter เพิ่ม $0 ต่อโทเคน — $5 / $30 ในหน้าโมเดลคืออัตราของ OpenAI ที่ส่งผ่านมา และการเปลี่ยนแปลงราคาของผู้ให้บริการจะอัปเดตในฝั่งของเราในวันเดียวกับที่ประกาศการนำคีย์ของคุณมาเอง เป็นตัวเลือกอันดับแรก: มอบคีย์ OpenAI ที่คุณมีอยู่ให้เรา คงขีดจำกัดอัตราและเครดิตของคุณเอง และ OpenAI จะเรียกเก็บเงินจากคุณโดยตรง Guardrails — ทั้งโล่ป้องกัน PII และนโยบายเนื้อหา — จะถูกบังคับใช้ก่อนที่จะคิดเงินคำขอ ไม่ใช่หลังจากนั้น DSL การจัดเส้นทางสามารถสร้างการเฟลโอเวอร์ เพื่อให้โมเดลที่ถูกกว่าตอบเมื่อ Sol เกิดข้อผิดพลาด หรือเมื่อรูปแบบทราฟฟิกของคุณเอื้อให้ทำเช่นนั้น

เมื่อ Sol อยู่ในระดับที่ผิด

การเป็นเรือธงไม่เหมือนกับการเหมาะสมกับทุกกรณี และมีสามจุดที่อัตรา $5 / $30 เสียเปรียบ

การเรียกที่มีปริมาณสูงและความเสี่ยงต่ำ ไปป์ไลน์การจำแนกหรือการแยกข้อมูลที่ประมวลผลอินพุตโทเคน 10 ล้านโทเคนต่อเดือนมีค่าใช้จ่าย $50 บน Sol เทียบกับ $2 บน GPT-5.6 Luna — ปลายทางเดียวกัน คีย์เดียวกัน เปลี่ยนแค่ไอดี. Luna ที่ราคา $0.20 / $1.20 ตั้งราคามาสำหรับงานแบบนี้โดยเฉพาะ

การให้เหตุผลระดับกลางที่ไม่จำเป็นต้องใช้ความลึกระดับแนวหน้า GPT-5.6 Terra ที่ราคา $2 / $12 อยู่ระหว่างรุ่นปริมาณมากและรุ่นเรือธง คำแนะนำจากบทช่วยสอนของ apidog เป็นค่าเริ่มต้นที่สมเหตุสมผล: สร้างต้นแบบบน Terra ยกระดับไปที่ Sol เฉพาะเมื่อ Terra ล้มเหลวอย่างวัดผลได้ และย้ายเส้นทางที่มีปริมาณสูงและเสถียรลงไปที่ Luna

ขอบเขตของสิ่งที่เราสามารถรับประกันได้ OrcaRouter ทำหน้าที่จัดเส้นทางและเรียกเก็บเงิน ส่วน OpenAI เป็นผู้ประมวลผลโมเดล จุดเชื่อมต่อ การไม่มีมาร์กอัป ระบบ failover และมาตรการป้องกันเป็นของเรา แต่คุณภาพการอนุมานและพฤติกรรมด้านความปลอดภัยเป็นของ OpenAI และเมื่อใช้ BYOK เงินจะไปถึง OpenAI โดยตรง นี่คือข้อตกลงที่กล่าวอย่างตรงไปตรงมา: คุณจ่ายในอัตราของผู้ให้บริการไม่ว่าจะด้วยวิธีใดก็ตาม และคำถามคือจุดเชื่อมต่อเดียวสำหรับโมเดล 200+ รุ่นนั้นคุ้มค่าหรือไม่

บรรทัดล่าง

หากคุณมีไคลเอนต์ OpenAI อยู่แล้ว ให้เรียกใช้ GPT-5.6 Sol API ผ่าน Chat Completions และหากกำลังสร้างใหม่ให้ใช้ Responses API — model id gpt-5.6-sol, อัตรา $5 / $30 และเหตุผลเดียวกันไม่ว่าจะใช้วิธีใด. เป็นโมเดลที่เหมาะสมเมื่องานยาก บริบทยาว และผลลัพธ์คุ้มค่า $30 ต่อล้านโทเค็น — และเป็นโมเดลที่ไม่เหมาะสมเมื่องานเป็นกิจวัตร ซึ่ง Terra และ Luna มีต้นทุนเพียงเศษเสี้ยวของราคานี้. การตั้งค่าที่สะอาดที่สุดคือแบบที่ให้คุณเปลี่ยนใจได้: เอนด์พอยต์เดียว คีย์ของคุณเอง มาร์กอัป $0 และ model id ที่คุณสามารถสลับได้ในวันที่ภาระงานเปลี่ยน.

GPT-5.6 Sol เปิดให้บริการบน OrcaRouter ในราคารายการของ OpenAI ที่ $5 / $30 โดยมีมาร์กอัป $0 ต่อโทเค็น — นำคีย์ OpenAI ที่มีอยู่ของคุณมาใช้ แล้วผู้ให้บริการจะเรียกเก็บเงินจากคุณโดยตรง เริ่มต้นด้วย GPT-5.6 Sol บน OrcaRouter — เอ็นด์พอยต์เดียว ไม่ต้องมีการเชื่อมต่อเพิ่มเติม

© 2026 OrcaRouter

สำหรับผู้ให้บริการ

ให้บริการแพลตฟอร์มการอนุมานอยู่หรือไม่ นำโมเดลของคุณขึ้น OrcaRouter

ติดต่อเรา

เข้าร่วมคอมมูนิตี้ของเรา

DiscordEmailXGitHubYouTube