โมเดลเรือธงของ OpenAI พร้อมบริบท 400,000 โทเคน, อินพุตแบบหลายรูปแบบ, และเอาต์พุต 272,000 โทเคน, เข้าถึงผ่าน OrcaRouter ในอัตราของผู้ให้บริการ
โมเดลนี้เป็นสแนปชอตเฉพาะของ GPT‑5 Pro ของ OpenAI ซึ่งถูกปรับให้เหมาะสมสำหรับการให้เหตุผลที่ซับซ้อนและงานที่ต้องใช้บริบทยาว โดยรองรับอินพุตที่เป็นภาพ ข้อความ และไฟล์ ประมวลผลบริบทได้สูงสุด 400,000…
โมเดลยอมรับอินพุตสามประเภท: ข้อความ รูปภาพ และไฟล์ ข้อความสามารถเป็นสตริง UTF‑8 มาตรฐาน รูปภาพสามารถระบุเป็น URL หรือข้อมูลที่เข้ารหัสแบบ base64 และโมเดลสามารถวิเคราะห์เนื้อหาภาพ เช่น ภาพถ่าย แผนภาพ และภาพหน้าจอ อินพุตไฟล์ครอบคลุมรูปแบบต่างๆ (เช่น PDF, Word, Excel, ข้อความธรรมดา) ทำให้โมเดลสามารถอ่านและใช้เหตุผลกับเอกสารที่มีโครงสร้างหรือไม่มีโครงสร้าง โมดอลลิตี้ทั้งหมดสามารถรวมกันในพรอมต์เดียว ทำให้สามารถทำงานต่างๆ เช่น การดึงข้อมูลจากรูปภาพของแผนภูมิและเปรียบเทียบกับรายงานที่เป็นข้อความ
หน้าต่างบริบทขนาดใหญ่เหมาะสำหรับงานที่ต้องการคงความสอดคล้องกันในลำดับที่ยาวมาก ตัวอย่างเช่น การวิเคราะห์งานวิจัยหรือคำแถลงทางกฎหมายทั้งฉบับในครั้งเดียว การใช้เหตุผลหลายขั้นตอนกับประวัติการสนทนาที่ยาว หรือการประมวลผลฐานโค้ดทั้งหมดเพื่อเสนอแนะการปรับโครงสร้าง นอกจากนี้ยังรองรับกลยุทธ์การออกแบบพรอมต์ เช่น การใช้ชุดคำสั่งที่ยาวหรือตัวอย่างแบบไม่กี่ช็อตโดยไม่มีการตัดทอน สำหรับงานที่เหมาะกับบริบทที่สั้นกว่า โมเดลที่มีขนาดเล็กและราคาถูกกว่าอาจคุ้มค่ากว่า
แม้ว่า GPT‑5 Pro จะให้ความสามารถสูงที่สุด แต่ราคา ($15/$120 ต่อล้านโทเคน) สูงกว่าโมเดลอย่าง GPT‑4o mini หรือทางเลือกโอเพนซอร์สอย่างมาก หากงานของคุณอยู่ในช่วง 8k–32k โทเคนและไม่จำเป็นต้องรับข้อมูลหลายรูปแบบ (multimodal input) โมเดลขนาดเล็กกว่าก็สามารถให้ผลลัพธ์ที่ยอมรับได้ในราคาเพียงเศษเสี้ยว นอกจากนี้หากความยาวของผลลัพธ์มีขนาดเล็ก ต้นทุนต่อโทเคนก็จะมีบทบาทสูง ลองประเมินว่าบริบท 400k และผลลัพธ์ 272k จำเป็นจริงหรือไม่ มิฉะนั้น ให้พิจารณาทางเลือกที่ต้นทุนต่ำกว่าบน OrcaRouter
การประมวลผลอินพุตไฟล์เป็นไปตามกระบวนการจัดการไฟล์ของ OpenAI โมเดลสามารถอ่านข้อความจากรูปแบบไฟล์ที่รองรับและตีความรูปภาพหรือตารางที่ฝังอยู่ สำหรับไฟล์ที่มีขนาดใหญ่มาก จำนวนโทเค็นของเนื้อหาที่สกัดออกมาจะถูกนับรวมในหน้าต่างบริบท ขอแนะนำให้ประมวลผลไฟล์ล่วงหน้าเพื่อแยกเฉพาะส่วนที่เกี่ยวข้องหากการใช้โทเค็นเป็นข้อกังวล API ของ OrcaRouter รองรับไฟล์ผ่านโครงสร้างพารามิเตอร์เดียวกับ API ของ OpenAI ซึ่งโดยทั่วไปจะผ่าน URL ของไฟล์หรือการเข้ารหัส base64
ไม่มีตัวเลขการวัดประสิทธิภาพเฉพาะในรายการสำหรับ snapshot นี้ ในฐานะที่เป็นโมเดลเรือธงของ OpenAI คาดว่าจะได้ผลลัพธ์ที่ทันสมัยที่สุดในการวัดประสิทธิภาพ NLP การให้เหตุผล และมัลติโมดัลทั่วไป เมื่อเทียบกับโมเดล GPT รุ่นก่อนหน้า ผู้ใช้ควรประเมินในงานที่เป็นตัวแทนของตนเองเพื่อยืนยันความเหมาะสม หน้าต่างบริบทที่ใหญ่ไม่ทำให้ประสิทธิภาพในการรับข้อมูลสั้นลดลง โมเดลยังคงความแข็งแกร่งในการให้เหตุผลโดยไม่ขึ้นกับความยาวของบริบท
ความหน่วงโดยทั่วไปจะสูงกว่าโมเดลขนาดเล็ก เนื่องจากความจุของบริบทและผลลัพธ์ที่มาก เวลาก่อนถึงโทเคนแรกและความเร็วในการสร้างโดยรวมขึ้นอยู่กับความยาวของพรอมต์ ความยาวของผลลัพธ์ และโหลดเซิร์ฟเวอร์ OpenAI ในปัจจุบัน สำหรับงานที่ต้องการคำตอบสั้น ๆ เท่านั้น โมเดลที่เร็วกว่าเช่น GPT‑4o mini อาจตอบสนองได้ดีกว่า OrcaRouter ไม่เพิ่มความหน่วงที่สำคัญนอกเหนือจากเวลาตอบสนองของผู้ให้บริการ ไม่มีตัวเลขความหน่วงเฉพาะสำหรับสแนปชอตนี้
จุดแข็งของมันรวมถึงการให้เหตุผลหลายขั้นตอนเชิงลึก การจัดการบริบทที่ยาวมากโดยสูญเสียข้อมูลน้อยที่สุด ความเข้าใจหลายรูปแบบ (รวมข้อความ รูปภาพ ไฟล์) และการสร้างผลลัพธ์ที่มีโครงสร้างและสอดคล้องกันสูงถึง 272k โทเค็น มันยอดเยี่ยมในงานที่เกี่ยวข้องกับคำสั่งที่ซับซ้อน ชุดข้อมูลขนาดใหญ่ หรือต้องสังเคราะห์ข้อมูลจากหลายแหล่งภายในพรอมพ์เดียว ตัวอย่างเช่น มันสามารถวิเคราะห์เอกสาร 300 หน้าและสร้างสรุปที่ครอบคลุมพร้อมการอ้างอิง
แม้จะทรงพลัง แต่โมเดลนี้ก็ไม่ผิดพลาดเสมอไป มันอาจยังคงสร้างภาพหลอน โดยเฉพาะในหัวข้อที่คลุมเครือหรือเมื่อบริบทมีข้อมูลที่ขัดแย้งกัน หน้าต่างบริบทขนาดใหญ่ไม่ได้กำจัดข้อผิดพลาดในการใส่ใจ การป้อนข้อมูลที่ยาวนานในบางครั้งอาจทำให้โมเดลพลาดรายละเอียดปลีกย่อย นอกจากนี้ ขีดจำกัด token เอาต์พุตที่สูงอาจนำไปสู่คำตอบที่ยาวมากแต่อาจไม่ถูกต้องทั้งหมด ผู้ใช้ควรดำเนินการตรวจสอบความถูกต้องสำหรับผลลัพธ์ที่มีความสำคัญสูง ราคาเป็นข้อจำกัดสำหรับแอปพลิเคชันที่อ่อนไหวต่องบประมาณ
โทเค็นอินพุตถูกคิดค่าใช้จ่ายในอัตรา $15.00 ต่อ 1 ล้านโทเค็น และโทเค็นเอาต์พุตในอัตรา $120.00 ต่อ 1 ล้านโทเค็น นี่คืออัตราที่แน่นอนที่กำหนดโดย OpenAI; OrcaRouter ไม่ได้บวกกำไรเพิ่มเติม ตัวอย่างเช่น คำสั่งที่ใช้โทเค็นอินพุต 50,000 โทเค็นและสร้างโทเค็นเอาต์พุต 10,000 โทเค็น จะมีค่าใช้จ่าย $0.75 สำหรับอินพุตและ $1.20 สำหรับเอาต์พุต รวมเป็น $1.95 ไม่มีค่าธรรมเนียมเพิ่มเติมใดๆ นอกเหนือจากการบริโภคต่อโทเค็น
อัตราส่วน 8× ระหว่างราคาอินพุตและเอาต์พุตสะท้อนถึงต้นทุนการคำนวณที่สูงขึ้นในการสร้างโทเค็น การสร้างคำตอบที่ยาวและสอดคล้องกันต้องใช้การประมวลผลมากกว่าการเข้ารหัสอินพุต ราคาเอาต์พุตที่สูงยังช่วยกระตุ้นให้เกิดการสร้างพรอมต์ที่มีประสิทธิภาพ: สำหรับงานที่สามารถทำได้ด้วยคำตอบสั้นๆ การใช้โมเดลที่มีเอาต์พุตต่ำกว่าอาจประหยัดกว่า ด้วยนโยบายไม่มีกำไรส่วนเพิ่มของ OrcaRouter คุณจะจ่ายเฉพาะต้นทุนของผู้ให้บริการสำหรับแต่ละโทเค็น
OrcaRouter ไม่มีระบบแคชโทเค็นหรือโปรแกรมส่วนลดของตัวเองสำหรับโมเดลนี้ คุณจะถูกเรียกเก็บเงินตามจำนวนโทเค็นในอัตราของผู้ให้บริการ ผู้ให้บริการบางรายอาจเสนออัตราที่ต่ำกว่าสำหรับการประมวลผลแบบแบตช์หรือความจุที่สงวนไว้ แต่สแนปช็อตนี้สามารถใช้งานได้ผ่านการเรียก API แบบออนดีมานด์เท่านั้น หากคุณมีปริมาณการใช้งานสูงมาก โปรดติดต่อฝ่ายสนับสนุนของ OrcaRouter เพื่อหารือเกี่ยวกับการจัดเตรียมเฉพาะทางที่อาจเป็นไปได้ แม้ว่าจะไม่มีส่วนลดเฉพาะที่โฆษณาไว้ก็ตาม
ประเมินโดยการคำนวณจำนวนโทเค็นในพรอมป์เฉลี่ยของคุณและความยาวเอาต์พุตที่คาดไว้ ใช้ตัวนับโทเค็นของ OpenAI หรือจุดสิ้นสุดการนับโทเค็นของ OrcaRouter API ตัวอย่างเช่น พรอมป์ 100,000 โทเค็นพร้อมการตอบกลับ 50,000 โทเค็นมีค่าใช้จ่าย $1.50 สำหรับอินพุต + $6.00 สำหรับเอาต์พุต = $7.50 ต่อการเรียก หากแอปพลิเคชันของคุณเรียกหลายพันครั้ง ค่าใช้จ่ายอาจเพิ่มขึ้นอย่างรวดเร็ว ลองใช้โมเดลขนาดเล็กสำหรับงานที่ง่ายกว่า และสงวน GPT‑5 Pro สำหรับงานที่ต้องการประสิทธิภาพสูงสุด
ใช้ฐาน URL ของ OrcaRouter คือ https://api.orcarouter.ai/v1 พร้อมกับรุ่นโมเดล "openai/gpt-5-pro-2025-10-06" API นี้รองรับปลายทาง chat completions ของ OpenAI อย่างสมบูรณ์ คำขอทั่วไปประกอบด้วยคีย์ API ของคุณ, พารามิเตอร์ model, อาร์เรย์ messages, และพารามิเตอร์เสริม เช่น max_tokens, temperature, และ top_p สำหรับอินพุตแบบ multimodal ให้ใส่ฟิลด์ image_url หรือ file_url ในเนื้อหาของ message คำตอบจะถูกส่งกลับในรูปแบบเดียวกับ API ของ OpenAI
พารามิเตอร์ max_tokens สามารถตั้งค่าได้สูงสุดถึง 272,000 (ขึ้นอยู่กับข้อจำกัดของหน้าต่างบริบท) ช่วงอุณหภูมิคือ 0–2 โดยค่าที่ต่ำกว่าจะให้ผลลัพธ์ที่กำหนดได้แน่นอนมากขึ้น top_p (0–1) ควบคุมการสุ่มแบบ nucleus frequency_penalty และ presence_penalty มีช่วงตั้งแต่ –2 ถึง 2 สำหรับอินพุตแบบหลายรูปแบบ คุณต้องระบุประเภทเนื้อหา (text, image_url, file_url) พารามิเตอร์ stop รับลำดับได้สูงสุดสี่ลำดับ พารามิเตอร์อื่นๆ ทั้งหมดที่รองรับโดย OpenAI's chat completions ก็รองรับเช่นกัน
เปลี่ยน URL ฐานจาก https://api.openai.com/v1 เป็น https://api.orcarouter.ai/v1 และแทนที่คีย์ API ด้วยคีย์ API ของ OrcaRouter ของคุณ ใช้ชื่อโมเดล "openai/gpt-5-pro-2025-10-06" ให้ตรงตามนั้นทุกประการ โครงสร้างคำขอและการตอบกลับอื่นๆ ทั้งหมดยังคงเหมือนเดิม ไม่จำเป็นต้องฝึกใหม่หรือเปลี่ยนแปลงโค้ดที่นอกเหนือจากเอนด์พอยต์และคีย์ OrcaRouter รองรับโหมดสตรีมมิ่งและไม่สตรีมมิ่งแบบเดียวกัน ทดสอบด้วยคำสั่งที่มีต้นทุนต่ำก่อนเพื่อตรวจสอบการเรียกเก็บเงินและการทำงาน
การรับรองความถูกต้องใช้คีย์ API ที่ส่งในส่วนหัว Authorization (Bearer token) อัตราจำกัดของ OrcaRouter อาจแตกต่างจากอัตราจำกัดโดยตรงของ OpenAI โปรดตรวจสอบแดชบอร์ดบัญชี OrcaRouter ของคุณเพื่อดูรายละเอียด สำหรับการใช้งานปริมาณมาก ให้พิจารณาการร้องขอแบบแบตช์หรือติดต่อฝ่ายสนับสนุนเพื่อขอเพิ่มขีดจำกัด ตัวโมเดลเองจะสืบทอดอัตราจำกัดของ OpenAI ที่ฝั่งแบ็กเอนด์ ตรวจสอบให้แน่ใจว่าแอปพลิเคชันของคุณจัดการข้อผิดพลาดอัตราจำกัด (HTTP 429) ด้วยตรรกะการลองใหม่
GPT‑4 Turbo (โดยทั่วไปมีหน้าต่างบริบท 128k และเอาต์พุตสูงสุด 16k) มีราคาถูกกว่าและเร็วกว่าสำหรับงานมาตรฐาน GPT‑5 Pro มีบริบทมากกว่าสามเท่าและความยาวเอาต์พุต 17× ทำให้สามารถทำงานที่ GPT‑4 Turbo ไม่สามารถจัดการได้ในการเรียกครั้งเดียว อย่างไรก็ตาม ต้นทุนที่ต่ำกว่าของ GPT‑4 Turbo ($10/$30 ต่อ 1M tokens) ทำให้ประหยัดกว่าสำหรับข้อความแจ้งเตือนที่สั้นกว่า เลือก GPT‑5 Pro เมื่อคุณต้องการบริบทที่ขยายหรือความสามารถในการเอาต์พุต มิฉะนั้น GPT‑4 Turbo ก็มักจะเพียงพอ
GPT‑4o รองรับอินพุตแบบหลายรูปแบบ (ข้อความ, รูปภาพ) ด้วยบริบท 128k และเอาต์พุต 16k โดยทั่วไปแล้วเร็วกว่าและถูกกว่า ($5/$15 ต่อ 1M โทเค็น) เมื่อเทียบกับ GPT‑5 Pro ความจุบริบทและเอาต์พุตที่ใหญ่กว่าของ GPT‑5 Pro ทำให้เหมาะสำหรับการวิเคราะห์เชิงลึกของเอกสารที่ยาวมากหรือการสร้างเนื้อหาแบบยาว สำหรับงานหลายรูปแบบทั่วไปที่อยู่ภายในขีดจำกัดของ GPT‑4o นั้น GPT‑4o ให้อัตราส่วนราคาต่อประสิทธิภาพที่ดีกว่า ทั้งสองโมเดลสามารถใช้งานได้ผ่าน OrcaRouter
หากกรณีการใช้งานของคุณไม่จำเป็นต้องใช้ระบบนิเวศของ OpenAI หรือประสิทธิภาพเฉพาะของ GPT‑5 Pro โมเดลจาก Anthropic (Claude 3.5 Sonnet) หรือ Google (Gemini 1.5 Pro) อาจมีความสามารถที่เทียบเคียงได้ในราคาที่แตกต่างหรือนโยบายการจัดการข้อมูลที่แตกต่างกัน ตัวอย่างเช่น Claude 3.5 Sonnet มีบริบท 200k และต้นทุนการส่งออกที่ต่ำกว่า ประเมินตามความหน่วงเวลา ราคาต่อโทเค็น การจัดเก็บข้อมูล และเกณฑ์มาตรฐานเฉพาะที่เกี่ยวข้องกับงานของคุณ OrcaRouter ให้การเข้าถึงผู้ให้บริการหลายรายเพื่อการเปรียบเทียบที่ง่ายดาย
เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-5-pro-2025-10-06",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningmax_completion_tokensmax_tokensreasoningresponse_formatseedstreamstructured_outputstool_choicetools| อินพุต / 1M โทเค็น | $15.00 |
|---|---|
| เอาต์พุต / 1M โทเค็น | $120.00 |
| สกุลเงิน | USD |
ประมาณการจากราคาตั้ง
เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ
สิ่งที่นักพัฒนาพูดถึงในสัปดาห์นี้
GET /api/public/models/openai/gpt-5-pro-2025-10-06เปิด @misc{orcarouter_gpt_5_pro_2025_10_06,
title = {openai/gpt-5-pro-2025-10-06 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-5-pro-2025-10-06}
}openai. (n.d.). openai/gpt-5-pro-2025-10-06 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-5-pro-2025-10-06