GPT-4.1 เป็นโมเดลภาษาขนาดใหญ่ระดับเรือธงที่ถูกปรับให้เหมาะสมสำหรับการทำตามคำสั่งขั้นสูง วิศวกรรมซอฟต์แวร์ในโลกจริง และการให้เหตุผลในบริบทระยะยาว รองรับหน้าต่างบริบทขนาด 1 ล้านโทเค็น และมีประสิทธิภาพเหนือกว่า GPT-4o และ...
OpenAI GPT-4.1 เป็นโมเดลภาษาขนาดใหญ่จาก OpenAI ที่สามารถเข้าถึงได้บน OrcaRouter มันมีหน้าต่างบริบทขนาด 1,047,576 โทเค็น และเอาท์พุตสูงสุด 32,768 โทเค็น โมเดลนี้รับอินพุตในรูปแบบของรูปภาพ ข้อความ…
ด้วยบริบทโทเคน 1,047,576 ของมัน GPT-4.1 สามารถประมวลผลเอกสารที่ยาวมากได้ในคำขอเดียว มันสามารถสรุปหนังสือทั้งเล่ม ตอบคำถามเฉพาะเกี่ยวกับข้อความทางกฎหมายที่หนาแน่น ดึงข้อมูลสำคัญจากรายงานที่ยาว และวิเคราะห์งานวิจัยตั้งแต่ต้นจนจบ โมเดลยังคงรายละเอียดตลอดบริบททั้งหมด ทำให้สามารถให้เหตุผลที่สอดคล้องกันทั่วทั้งเอกสาร ความสามารถนี้มีประโยชน์สำหรับการตรวจสอบสถานะ การทบทวนวรรณกรรม และการวิเคราะห์เอกสารเก็บถาวร ซึ่งความสมบูรณ์เป็นสิ่งสำคัญ
รูปภาพสามารถรวมเป็นส่วนหนึ่งของอาร์เรย์ messages ในการเรียก API และโมเดลจะตีความว่าเป็นบริบทเพิ่มเติม ตัวอย่างเช่น คุณสามารถอัปโหลดแผนภูมิและขอสรุป หรือให้ภาพถ่ายและขอคำอธิบาย การป้อนไฟล์ช่วยขยายขีดความสามารถนี้โดยให้โมเดลโหลดข้อมูลจากไฟล์โดยตรง แม้ว่าประเภทไฟล์ที่แน่นอนจะไม่ได้ระบุไว้ โมเดลจะประมวลผลรูปแบบเหล่านี้ร่วมกัน ทำให้สามารถทำงานต่างๆ เช่น การตอบคำถามจากภาพและการสแกนเอกสาร
กรณีการใช้งานที่ดีที่สุด ได้แก่ การใช้เหตุผลแบบยาว เช่น การวิเคราะห์เอกสารทางกฎหมายหรือการเงินที่ซับซ้อน; การวิเคราะห์และการสร้างฐานรหัสในโครงการขนาดใหญ่; การสรุปผลการวิจัยทางวิชาการ; และงานที่รวมข้อความกับรูปภาพ เช่น การตีความแผนภาพหรือการดึงข้อมูลจากภาพหน้าจอ โมเดลนี้ยังเก่งในการแก้ปัญหาทางคณิตศาสตร์ ดังที่เห็นได้จากคะแนน MATH-500 ที่ 91.3 จุดแข็งเหล่านี้ทำให้เหมาะสมกับการใช้งานที่มีความเสี่ยงสูงซึ่งความแม่นยำและความลึกเป็นสิ่งสำคัญยิ่ง
หากงานของคุณเกี่ยวข้องกับอินพุตสั้นๆ การถามตอบแบบง่าย หรือไม่จำเป็นต้องรองรับระบบมัลติโหมด โมเดลที่เล็กกว่าและราคาถูกกว่าอาจคุ้มค่ากว่า ตัวอย่างเช่น GPT-4o mini มีราคาต่อโทเค็นที่ต่ำกว่าและมีบริบทเพียงพอสำหรับการใช้งานทั่วไปในชีวิตประจำวัน ในทำนองเดียวกัน หากคุณแทบไม่ได้ใช้บริบทความจุ 1 ล้านโทเค็นเต็ม คุณอาจจ่ายเงินเพื่อความสามารถที่คุณไม่จำเป็นต้องใช้ ประเมินการแลกเปลี่ยนระหว่างต้นทุนและความสามารถตามความซับซ้อนและความยาวของงานทั่วไปของคุณ
MATH-500 เป็นเกณฑ์มาตรฐานที่ประกอบด้วยโจทย์คณิตศาสตร์ที่ท้าทาย 500 ข้อ ครอบคลุมหัวข้อต่างๆ เช่น แคลคูลัส พีชคณิต เรขาคณิต และตรรกศาสตร์ คะแนน 91.3% หมายความว่า GPT-4.1 สามารถแก้โจทย์ได้ถูกต้อง 913 ข้อจากทุก 1,000 ข้อ ทำให้โมเดลนี้อยู่ในกลุ่มโมเดลวัตถุประสงค์ทั่วไปที่มีประสิทธิภาพสูงสุดในเกณฑ์วัดนี้ คะแนนดังกล่าวบ่งชี้ถึงทักษะการให้เหตุผลทางคณิตศาสตร์และการแก้ปัญหาที่แข็งแกร่ง ทำให้โมเดลนี้เหมาะสมกับงานที่ต้องการการจัดการสัญลักษณ์ การหาคำตอบแบบทีละขั้นตอน หรือการคำนวณเชิงตัวเลข
จุดแข็งหลักของ GPT-4.1 คือหน้าต่างบริบทที่กว้างมาก การรองรับอินพุตแบบหลายโมดัล และประสิทธิภาพสูงในการให้เหตุผลทางคณิตศาสตร์ บริบทที่กว้างช่วยให้ประมวลผลเอกสารยาวๆ ได้โดยไม่ต้องแบ่งเป็นส่วนย่อย ในขณะที่การรองรับหลายโมดัลทำให้เกิดการโต้ตอบที่สมบูรณ์ยิ่งขึ้น คะแนน MATH-500 ที่ 91.3 บ่งชี้ถึงความสามารถในการให้เหตุผลเชิงปริมาณที่แข็งแกร่ง นอกจากนี้ โมเดลยังได้รับประโยชน์จากการปรับแต่งอย่างต่อเนื่องของ OpenAI, การปรับให้สอดคล้องด้านความปลอดภัย และการอัปเดตเป็นประจำ ซึ่งมีส่วนช่วยให้มีความน่าเชื่อถือในงานที่หลากหลาย
เช่นเดียวกับโมเดลภาษาขนาดใหญ่ทั้งหมด GPT-4.1 สามารถสร้าง hallucinations —ข้อมูลที่ดูน่าเชื่อถือแต่ไม่ถูกต้อง— โดยเฉพาะในหัวข้อที่คลุมเครือหรือกำกวม นอกจากนี้ยังอาจแสดงอคติที่มีอยู่ในข้อมูลการฝึกอบรม โมเดลต้องการการออกแบบ prompt อย่างระมัดระวังเพื่อให้ได้ผลลัพธ์ที่เหมาะสมที่สุด และประสิทธิภาพในงานที่อยู่นอกการกระจายของข้อมูลการฝึกอบรมอาจลดลง ไม่มีเกณฑ์มาตรฐานความหน่วงที่ให้มา ดังนั้นเวลาตอบสนองอาจแตกต่างกันไป ผู้ใช้ควรตรวจสอบผลลัพธ์ที่สำคัญ โดยเฉพาะในแอปพลิเคชันที่มีความเสี่ยงสูง
รายละเอียดความหน่วงของ GPT-4.1 ยังไม่ได้เผยแพร่ ในทางปฏิบัติ การประมวลผลอินพุตที่ยาวมากหรือคำขอแบบมัลติโมดัลสามารถเพิ่มเวลาตอบสนองเมื่อเทียบกับข้อความแจ้งสั้น โครงสร้างพื้นฐานของ OpenAI และสภาพเครือข่ายที่อยู่เบื้องหลังก็ส่งผลต่อความหน่วงเช่นกัน OrcaRouter มีจุดสิ้นสุด API มาตรฐานพร้อมเวลาตอบสนองทั่วไปที่คาดหวังสำหรับโมเดล สำหรับแอปพลิเคชันที่ต้องการความหน่วงต่ำเป็นสิ่งสำคัญ ให้พิจารณาทดสอบด้วยอินพุตที่เป็นตัวแทนเพื่อวัดประสิทธิภาพ
บน OrcaRouter, GPT-4.1 มีราคาอยู่ที่ $2.00 ต่อ 1 ล้าน input tokens และ $8.00 ต่อ 1 ล้าน output tokens นี่คืออัตราของผู้ให้บริการโดยตรงโดยไม่มีค่าธรรมเนียมเพิ่ม (markup) คุณจ่ายเฉพาะ tokens ที่ใช้ไปจริงเท่านั้น ไม่มีค่าธรรมเนียมเพิ่มเติม ค่ารายเดือน หรือข้อผูกมัดขั้นต่ำ การกำหนดราคาโปร่งใสและอิงตามจำนวน tokens ที่กำหนดโดย tokenizer ของ OpenAI
ไม่ OrcaRouter ผ่านอัตราของผู้ให้บริการโดยตรง ราคาที่คุณเห็น — $2.00 ต่อ 1M input และ $8.00 ต่อ 1M output — คือสิ่งที่คุณจ่ายต่อ token ไม่มีค่าติดตั้ง ค่าสมัคร หรือค่าใช้จ่ายแอบแฝง โมเดลราคาที่ตรงไปตรงมานี้ช่วยให้คุณคาดการณ์ค่าใช้จ่ายได้อย่างแม่นยำตามปริมาณการใช้งานของคุณ
ข้อความแจ้งที่ยาวขึ้นจะเพิ่มจำนวนโทเค็นอินพุต ซึ่งทำให้ต้นทุนอินพุตสูงขึ้นโดยตรง สำหรับข้อความแจ้งที่ใช้บริบทเต็ม 1,047,576 โทเค็น ต้นทุนอินพุตเพียงอย่างเดียวจะอยู่ที่ประมาณ $2.10 (เนื่องจาก 1 ล้านโทเค็นมีค่าใช้จ่าย $2.00) โทเค็นเอาต์พุตจะถูกคิดค่าบริการแยกต่างหากในอัตรา $8.00 ต่อล้านโทเค็น เพื่อจัดการต้นทุน คุณสามารถจำกัดความยาวอินพุตเมื่อเป็นไปได้ ใช้บริบทที่สั้นลงสำหรับงานที่ง่ายกว่า หรือรวมคำขอหลายรายการเข้าด้วยกัน
ปัจจุบัน OrcaRouter ไม่ได้โฆษณาการแคชหรือส่วนลดตามปริมาณการใช้งานสำหรับ GPT-4.1 การกำหนดราคาทั้งหมดเป็นแบบต่อโทเค็นตามที่ระบุไว้ สำหรับการใช้งานที่มีปริมาณสูงมาก อาจเป็นไปได้ที่จะเจรจาข้อตกลงที่กำหนดเองโดยตรงกับ OrcaRouter ในระหว่างนี้ การกำหนดราคาแบบไม่มีมาร์กอัปหมายความว่าคุณจ่ายในอัตราเดียวกันกับที่คุณใช้ OpenAI โดยตรง โดยไม่มีค่าธรรมเนียมเพิ่มเติมจากคนกลาง
ใช้ base URL https://api.orcarouter.ai/v1 และระบุรหัสโมเดล "openai/gpt-4.1" API นี้เข้ากันได้อย่างสมบูรณ์กับ endpoint chat completions ของ OpenAI ตัวอย่างการเรียกใช้ curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_API_KEY" -d '{"model": "openai/gpt-4.1", "messages": [{"role": "user", "content": "Hello"}]}' คุณยังสามารถใช้ไลบรารีไคลเอนต์ของ OpenAI ได้ทุกตัวโดยเปลี่ยน base URL และชื่อโมเดล
รองรับพารามิเตอร์มาตรฐานของ OpenAI รวมถึง temperature (0-2), top_p, max_tokens (สูงสุดที่ 32,768), stop sequences, frequency_penalty, presence_penalty และ stream โมเดลใช้รูปแบบ chat completions สำหรับคำขอแบบ multimodal สามารถรวมรูปภาพในเนื้อหาข้อความโดยใช้รูปแบบที่รองรับ (URL หรือ base64) ยังยอมรับการป้อนไฟล์ด้วย แม้ว่าจะไม่ได้ระบุรายละเอียดเกี่ยวกับข้อจำกัดของรูปแบบไฟล์
การโยกย้ายนั้นตรงไปตรงมา เพียงเปลี่ยนรหัสโมเดลจาก เช่น "gpt-4" เป็น "openai/gpt-4.1" และอัปเดต URL ฐานจากค่าเริ่มต้นของ OpenAI เป็น https://api.orcarouter.ai/v1 โค้ดไคลเอ็นต์ที่มีอยู่ของคุณสำหรับการสนทนาแบบสมบูรณ์ (chat completions) จะทำงานได้โดยการเปลี่ยนแปลงทั้งสองนี้ ไม่จำเป็นต้องปรับเปลี่ยนอื่นใด ขอแนะนำให้ทดสอบคำขอสองสามครั้งเพื่อให้แน่ใจว่าพฤติกรรมของโมเดลตรงตามความคาดหวังของคุณก่อนที่จะเปลี่ยนเส้นทางการผลิต
ใช่. คุณต้องระบุคีย์ API ที่ถูกต้องจาก OrcaRouter ในส่วนหัว Authorization คีย์ได้รับการจัดการผ่านแดชบอร์ดบัญชี OrcaRouter ของคุณ หากไม่มีคีย์ที่ถูกต้อง API จะส่งคืนข้อผิดพลาด 401 Unauthorized การตรวจสอบสิทธิ์ของ OrcaRouter เป็นไปตามรูปแบบเดียวกับ API ของ OpenAI ทำให้ง่ายต่อการรวมเข้ากับขั้นตอนการทำงานที่มีอยู่ซึ่งใช้คีย์ API อยู่แล้ว
โมเดลที่มีขนาดเล็ก เช่น GPT-4o mini โดยทั่วไปจะมีหน้าต่างบริบทที่เล็กกว่า (มักจะมี 128K โทเค็นหรือน้อยกว่า) และอาจไม่รองรับอินพุตแบบมัลติโมดัล โมเดลเหล่านี้มีราคาถูกกว่าต่อโทเค็นอย่างมาก — มักต่ำกว่า 10-20 เท่า GPT-4.1 มีข้อได้เปรียบของหน้าต่างบริบทขนาด 1,047,576 โทเค็นและการรองรับอินพุตรูปภาพ ซึ่งจำเป็นสำหรับงานที่ต้องเข้าใจเนื้อหาที่ยาวมากหรือผสมสื่อหลายประเภทอย่างลึกซึ้ง สำหรับงานสั้น ๆ และเรียบง่าย โมเดลที่เล็กกว่าจะประหยัดกว่า
เมื่อเปรียบเทียบกับโมเดลบริบทแบบยาวอื่นๆ ที่มีใน OrcaRouter แล้ว GPT-4.1 มีขนาดหน้าต่างบริบทที่แข่งขันได้และประสิทธิภาพการให้เหตุผลทางคณิตศาสตร์ที่แข็งแกร่ง ดังที่เห็นได้จากคะแนน 91.3 MATH-500 แม้ว่าจะไม่มีการเปรียบเทียบเกณฑ์มาตรฐานโดยตรงกับโมเดลอย่าง Claude 3 Opus หรือ Gemini 1.5 Pro ในที่นี้ แต่คะแนน MATH-500 ก็เป็นตัวบ่งชี้ที่มีความหมายของความสามารถในการให้เหตุผลเชิงปริมาณ ตัวเลือกที่เหมาะสมที่สุดขึ้นอยู่กับข้อกำหนดของงานเฉพาะ ความอดทนต่อต้นทุน และความสำคัญของการรองรับอินพุตแบบหลายรูปแบบ
เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-4.1",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)frequency_penaltylogit_biaslogprobsmax_completion_tokensmax_tokensnparallel_tool_callspredictionpresence_penaltyresponse_formatseedservice_tierstopstreamstructured_outputstemperaturetool_choicetoolstop_logprobstop_pweb_search_options| อินพุต / 1M โทเค็น | $2.00 |
|---|---|
| เอาต์พุต / 1M โทเค็น | $8.00 |
| อ่านแคช / 1M | $0.500 |
| สกุลเงิน | USD |
ประมาณการจากราคาตั้ง
เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ
สิ่งที่นักพัฒนาพูดถึงในสัปดาห์นี้
GET /api/public/models/openai/gpt-4.1เปิด @misc{orcarouter_gpt_4_1,
title = {GPT-4.1 API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4.1}
}OpenAI. (2025). GPT-4.1 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4.1