ตัวอย่างรุ่น GPT-4o ที่เป็นข้อความเท่านั้น มีบริบท 128K, เอาต์พุต 16K, เข้าถึงผ่าน API ของ OrcaRouter ในราคา $2.50/$10 ต่อ M tokens
โมเดลนี้เป็นรุ่นตัวอย่าง (Preview) จาก OpenAI ซึ่งจำกัดเฉพาะอินพุตแบบข้อความเท่านั้น รุ่นนี้มีตัวระบุคือ openai/gpt-4o-search-preview-2025-03-11 เมื่อเข้าถึงผ่าน API ของ OrcaRouter…
ในฐานะที่เป็นตัวอย่างข้อความล้วนของ GPT-4o preview มันมีความโดดเด่นในการทำความเข้าใจและสร้างภาษาธรรมชาติในหลากหลายโดเมน สามารถทำงานสรุปเอกสาร ตอบคำถาม เขียนเชิงสร้างสรรค์ แปลภาษา และสร้างโค้ดได้ หน้าต่างบริบทขนาดใหญ่ช่วยให้มันคงความต่อเนื่องในข้อความที่ยาวมาก ทำให้เหมาะสมกับงานเช่นการวิเคราะห์หนังสือหรือการประมวลผลบันทึกข้อมูลที่ยาวนาน มันรองรับข้อความจากระบบ ผู้ใช้ และผู้ช่วยในรูปแบบคล้ายแชท ความสามารถในการให้เหตุผลแบบ zero-shot และ few-shot ของโมเดลนี้เป็นลักษณะทั่วไปของโมเดลในคลาส GPT-4 ซึ่งทำให้สามารถจัดการคำสั่งที่ซับซ้อนได้โดยไม่ต้องปรับแต่งอย่างละเอียด
หากงานของคุณไม่ต้องการพลังการประมวลผลเต็มของ GPT-4o ให้พิจารณาใช้โมเดลที่เล็กกว่าหรือราคาถูกกว่าจาก OrcaRouter เช่น openai/gpt-4o-mini หรือ gpt-3.5-turbo ตัวอย่างงานที่เหมาะกับโมเดลราคาถูกกว่า ได้แก่ การจำแนกประเภทแบบง่าย การสร้างเนื้อหาแบบสั้น หรือถาม-ตอบพื้นฐานที่มีบริบทจำกัด ค่าใช้จ่ายของโมเดลพรีวิวอาจไม่คุ้มค่าสำหรับคำขอที่มีปริมาณสูงแต่ความซับซ้อนต่ำ นอกจากนี้ หากต้องการอินพุตแบบหลายรูปแบบ โมเดลนี้ไม่สามารถรองรับรูปภาพหรือเสียงได้ จะต้องใช้โมเดลอื่น (เช่น GPT-4o หรือ GPT-4V มาตรฐาน) ควรประเมินการแลกเปลี่ยนระหว่างคุณภาพและต้นทุนต่อโทเคนเสมอ
โมเดลนี้ถูกระบุว่าเป็นรูปแบบ 'search-preview' แต่ไม่ได้ระบุรายละเอียดเกี่ยวกับความสามารถในการใช้เครื่องมือหรือค้นหาเว็บในข้อกำหนดที่เปิดเผยต่อสาธารณะ เป็นโมเดลข้อความเท่านั้นและทำงานเป็นโมเดลภาษาแบบมาตรฐาน ผู้ใช้ไม่ควรสันนิษฐานว่ามีฟังก์ชันค้นหาในตัวหรือดึงข้อมูล สำหรับการสร้างที่เพิ่มเติม (augmented generation) คุณสามารถใช้ไพพ์ไลน์ Retrieval-Augmented Generation (RAG) แยกต่างหาก โดยป้อนเอกสารที่ดึงมาเข้าไปในหน้าต่างบริบทของโมเดล OrcaRouter ไม่ได้เพิ่มมิดเดิลแวร์การใช้เครื่องมือใดๆ โมเดลตอบสนองตามการฝึกอบรมและพรอมต์ที่ให้เท่านั้น เวอร์ชันในอนาคตอาจเปลี่ยนแปลงพฤติกรรมนี้ แต่ในขณะที่เป็นตัวอย่างพรีวิว ยังไม่มีการบันทึกการรวมเครื่องมือใดๆ
ในฐานะรุ่นตัวอย่าง โมเดลนี้อาจแสดงพฤติกรรมที่ไม่คาดคิดหรือมีความน่าเชื่อถือต่ำกว่ารุ่นที่เสถียร โมเดลนี้รองรับเฉพาะข้อความเท่านั้น ดังนั้นคำขอแบบมัลติโมดัลจะถูกปฏิเสธ ผลลัพธ์สูงสุดที่ 16,384 โทเคนถือว่ามากแต่ก็อาจตัดทอนข้อความที่ยาวมากได้ ไม่มีการระบุจุดตัดความรู้และข้อมูลการฝึกของโมเดล โมเดลอาจไม่ทราบเหตุการณ์ล่าสุด ไม่แนะนำให้ใช้ในการผลิตเนื่องจากโมเดลอาจถูกอัปเดตหรือลบออก นอกจากนี้ เวลาแฝงอาจสูงกว่าโมเดลที่เสถียรเนื่องจากเป็นรุ่นตัวอย่าง ควรทดสอบอย่างละเอียดก่อนปรับใช้ในระดับใหญ่
ยังไม่มีคะแนน benchmark เฉพาะสำหรับรุ่นพรีวิวนี้ให้มา เนื่องจากเป็นตัวแปรของ GPT-4o คาดว่าจะทำงานได้คล้ายกับ GPT-4o มาตรฐานในงานภาษาทั่วไป แต่ไม่ได้เปิดเผยตัวเลขที่แน่นอน ผู้ใช้สามารถประเมินผลด้วยตนเองโดยใช้ชุดข้อมูลสาธารณะ หน้าต่างบริบทขนาดใหญ่ทำให้ได้เปรียบใน benchmark เอกสารยาว แต่เนื่องจากเป็นพรีวิว คะแนนอาจแตกต่างจากรุ่นที่ใช้งานจริง สำหรับตัวเลขที่เชื่อถือได้ โปรดดูรายงาน benchmark อย่างเป็นทางการของ OpenAI สำหรับ GPT-4o OrcaRouter ไม่ได้ปรับเปลี่ยนผลลัพธ์หรือประสิทธิภาพของโมเดล
ตัวเลข latency และ throughput สำหรับรุ่นพรีวิวนี้ยังไม่ได้เผยแพร่ เนื่องจากเป็นรุ่นพรีวิว อาจช้ากว่า GPT-4o ที่เสถียรกว่าเนื่องจากโครงสร้างพื้นฐานที่กำลังทดลองอยู่ เวลาตอบสนองขึ้นอยู่กับความยาวของอินพุต ความยาวของเอาต์พุต และความต้องการที่เกิดขึ้นพร้อมกัน OrcaRouter ไม่ได้เพิ่ม latency นอกเหนือจากการจัดเส้นทาง API ปกติ ในการประเมินความเร็ว นักพัฒนาสามารถรันตัวอย่างคำขอด้วย payload ทั่วไป สำหรับแอปพลิเคชันในระบบผลิตที่ต้องการประสิทธิภาพที่สม่ำเสมอ ควรพิจารณาใช้รุ่น gpt-4o ที่เสถียรแทน เว้นแต่จำเป็นต้องใช้คุณสมบัติเฉพาะของรุ่นพรีวิว
โมเดลคลาส GPT-4 เป็นที่รู้จักในด้านความสามารถในการให้เหตุผลที่แข็งแกร่งในหลายโดเมน เช่น คณิตศาสตร์ ตรรกศาสตร์ และการอนุมานเชิงสามัญสำนึก ตัวอย่างพรีวิวนี้น่าจะสืบทอดความสามารถเหล่านั้น บริบทขนาดใหญ่ช่วยให้สามารถคิดแบบ chain-of-thought ที่ซับซ้อนในหลายขั้นตอนโดยไม่สูญเสียการติดตามส่วนก่อนหน้า อย่างไรก็ตาม ไม่มีการกำหนดเกณฑ์มาตรฐานการให้เหตุผลเฉพาะสำหรับเวอร์ชันที่แน่นอนนี้ ผู้ใช้ควรตรวจสอบประสิทธิภาพด้วยงานเฉพาะโดเมนของตนเอง โมเดลอาจแสดงการปรับปรุงการทำตามคำสั่งที่ดีกว่าเมื่อเทียบกับ GPT เวอร์ชันก่อนหน้า แต่อีกครั้ง แนะนำให้ตรวจสอบโดยอิสระ
นอกเหนือจากการเป็น preview แล้ว โมเดลนี้ไม่รองรับ multimodal มันไม่สามารถประมวลผลภาพ เสียง หรือวิดีโอโดยตรงได้ วันที่ตัดความรู้ (knowledge cutoff) ของมันไม่เป็นที่ทราบ ดังนั้นมันอาจขาดข้อมูลเกี่ยวกับเหตุการณ์หลังการฝึก ข้อจำกัดเอาท์พุตที่ 16,384 โทเคน แม้จะมากมาย แต่ไม่สามารถสร้างข้อความที่ยาวมากในครั้งเดียวได้ สำหรับเอาท์พุตที่ยาวขึ้น จำเป็นต้องใช้ iterative prompting หรือการแบ่งส่วน preview อาจมีอัตราข้อผิดพลาดสูงขึ้นหรืออัตราการปฏิเสธที่สูงขึ้นสำหรับหัวข้อที่ละเอียดอ่อนบางเรื่อง ประสิทธิภาพในภาษาที่ไม่ใช่ภาษาอังกฤษอาจแตกต่างกันไป ควรทดสอบกับข้อมูลที่เป็นตัวแทนก่อนการปรับใช้เสมอ
โมเดลมีราคาอยู่ที่ $2.50 ต่อ 1 ล้านโทเค็นสำหรับอินพุต และ $10.00 ต่อ 1 ล้านโทเค็นสำหรับเอาต์พุต นี่คืออัตราของผู้ให้บริการ OpenAI; OrcaRouter ไม่ได้บวกเพิ่ม ตัวอย่างเช่น การประมวลผลพรอมต์จำนวน 10,000 โทเค็นและสร้าง 1,000 โทเค็น จะมีค่าใช้จ่ายประมาณ $0.025 สำหรับอินพุตและ $0.01 สำหรับเอาต์พุต รวมเป็น $0.035 ค่าใช้จ่ายจะเพิ่มขึ้นตามสัดส่วนเชิงเส้นกับการใช้งานโทเค็น ไม่มีค่าธรรมเนียมเพิ่มเติมสำหรับการใช้ OrcaRouter เป็นเกตเวย์ API โปรดตรวจสอบการใช้งานเพื่อหลีกเลี่ยงค่าใช้จ่ายที่ไม่คาดคิด เปรียบเทียบกับโมเดลที่ถูกกว่าหากงานของคุณไม่จำเป็นต้องใช้ความสามารถเต็มรูปแบบ
OrcaRouter ยังไม่มีส่วนลดตามปริมาณหรือการแคชโทเคนสำหรับโมเดลนี้ การเรียกเก็บเงินทั้งหมดเป็นแบบจ่ายตามการใช้งานจริงตามอัตราของผู้ให้บริการ OrcaRouter ไม่ได้ทำการแคชพร็อมพ์หรือการตอบสนอง แต่ละคำขอจะถูกประมวลผลอย่างอิสระ หากคุณมีปริมาณการประมวลผลสูงมาก โปรดติดต่อ OrcaRouter เพื่อขอจัดการเฉพาะด้าน สำหรับการเพิ่มประสิทธิภาพด้านต้นทุน ให้พิจารณาใช้พร็อมพ์ที่สั้นลง ใช้บริบทซ้ำอย่างมีประสิทธิภาพ หรือรวมคำขอเป็นชุด โมเดลนี้ไม่รองรับราคาลดลงสำหรับการเข้าถึงที่ถูกแคช เนื่องจากไม่มีกลไกการแคช
ในราคา $2.50/$10 ต่อล้านโทเค็น ระบบตัวอย่างนี้มีราคาใกล้เคียงกับ GPT-4o มาตรฐานแต่อาจแตกต่างเล็กน้อย ทางเลือกที่ถูกกว่าได้แก่ openai/gpt-4o-mini (ประมาณ $0.15/$0.60 ต่อล้านโทเค็น) หรือ gpt-3.5-turbo (ประมาณ $0.50/$1.50) สำหรับงานที่สามารถยอมรับคุณภาพที่ต่ำกว่าได้ โมเดลเหล่านั้นช่วยประหยัดค่าใช้จ่ายได้มาก ค่าใช้จ่ายของโมเดลตัวอย่างนี้อยู่ในระดับสูงของแคตตาล็อก OrcaRouter หากคุณใช้เพื่อการทดสอบเท่านั้น คุณอาจมีค่าใช้จ่ายปานกลางขึ้นอยู่กับปริมาณการร้องขอ ควรประเมินการใช้โทเค็นที่คาดหวังและเปรียบเทียบกับคุณภาพที่เพิ่มขึ้นจากการใช้โมเดลที่ใหญ่ขึ้นเสมอ
หากต้องการใช้โมเดลนี้ ให้ตั้งค่า base URL ของ API client ของคุณเป็น https://api.orcarouter.ai/v1 และระบุรหัสโมเดลเป็น openai/gpt-4o-search-preview-2025-03-11 คุณต้องใช้คีย์ API ที่ออกโดย OrcaRouter API นี้เข้ากันได้กับ OpenAI อย่างสมบูรณ์ ดังนั้นโค้ดที่มีอยู่เดิมที่เขียนขึ้นสำหรับ endpoint chat completions ของ OpenAI จะทำงานได้โดยมีการเปลี่ยนแปลงเพียงเล็กน้อย ตัวอย่างการเรียกใช้ด้วย curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_ORCAROUTER_KEY" -H "Content-Type: application/json" -d '{ "model": "openai/gpt-4o-search-preview-2025-03-11", "messages": [{"role": "user", "content": "Hello"}], "max_tokens": 100 }'
คุณสามารถใช้พารามิเตอร์การเติมข้อความแชทมาตรฐานทั้งหมดที่รองรับโดย OpenAI ได้: 'messages', 'max_tokens', 'temperature', 'top_p', 'frequency_penalty', 'presence_penalty', 'stop' และ 'n' โมเดลรองรับหน้าต่างบริบทขนาด 128,000 โทเค็น ดังนั้น 'max_tokens' สามารถตั้งค่าได้สูงสุดถึง 16,384 ค่า 'temperature' ควบคุมความสุ่ม โดยมีค่าตั้งแต่ 0 ถึง 2 รองรับ 'stream' สำหรับการตอบสนองแบบเรียลไทม์ OrcaRouter ไม่เพิ่มพารามิเตอร์เพิ่มเติม โปรดตรวจสอบให้แน่ใจว่าคำขอของคุณเป็นไปตามขีดจำกัดโทเค็น อินพุตที่ยาวเกินกว่าหน้าต่างบริบท (รวมถึงการตอบสนอง) จะถูกตัดทอนหรือส่งคืนข้อผิดพลาด
การย้ายระบบนั้นตรงไปตรงมา เพียงเปลี่ยน URL พื้นฐานของ OpenAI (https://api.openai.com/v1) เป็น URL พื้นฐานของ OrcaRouter (https://api.orcarouter.ai/v1) เปลี่ยนคีย์ API ของคุณเป็นคีย์ของ OrcaRouter อัปเดตฟิลด์ model เป็น openai/gpt-4o-search-preview-2025-03-11 ไม่จำเป็นต้องเปลี่ยนแปลงโค้ดอื่นๆ หากคุณเคยใช้โมเดล OpenAI อื่น คุณสามารถใช้โครงสร้างโค้ดเดิมต่อไปได้ OrcaRouter ส่งผ่านพารามิเตอร์มาตรฐานทั้งหมด หลังจากย้ายระบบแล้ว ให้ตรวจสอบว่าการตอบกลับสอดคล้องกัน โปรดทราบว่าการเรียกเก็บเงินจะจัดการโดย OrcaRouter และคุณจะต้องมีบัญชีที่นั่น
OrcaRouter ไม่ได้เปิดเผยข้อจำกัดอัตราเฉพาะสำหรับโมเดลตัวอย่างนี้ต่อสาธารณะ ความพร้อมใช้งานขึ้นอยู่กับโครงสร้างพื้นฐานของ OpenAI และความจุของเกตเวย์ของ OrcaRouter สำหรับแอปพลิเคชันที่ใช้งานจริง ให้พิจารณาสถานะตัวอย่างของโมเดลและความไม่เสถียรที่อาจเกิดขึ้น OrcaRouter อาจบังคับใช้ข้อจำกัดการใช้งานที่สมเหตุสมผลเพื่อป้องกันการใช้งานในทางที่ผิด คุณสามารถคาดหวังบริการแบบเต็มความสามารถ แต่ไม่มี SLA ให้ หากคุณต้องการปริมาณงานที่รับประกัน โปรดติดต่อ OrcaRouter สำหรับตัวเลือกเฉพาะ โมเดลอาจถูกลบหรือแทนที่โดยไม่แจ้งให้ทราบล่วงหน้า ดังนั้นควรวางแผนสำหรับโมเดลสำรอง
โมเดล GPT-4o มาตรฐาน (openai/gpt-4o) เป็นรุ่นที่รองรับหลายรูปแบบข้อมูล (multimodal) และเสถียร ในขณะที่รุ่นตัวอย่างนี้รองรับเฉพาะข้อความเท่านั้นและมีไว้สำหรับการทดสอบเบื้องต้น รุ่นตัวอย่างอาจรวมฟีเจอร์ที่กำลังจะมาซึ่งยังไม่มีในรุ่นมาตรฐาน แต่อาจเชื่อถือได้น้อยกว่า ราคาใกล้เคียงกัน รุ่นมาตรฐานรองรับอินพุตที่หลากหลายกว่า (รูปภาพ เสียง) หากคุณไม่ต้องการฟีเจอร์ของรุ่นตัวอย่าง GPT-4o มาตรฐานเป็นตัวเลือกที่ปลอดภัยกว่า ทั้งสองรุ่นมีให้ใช้งานบน OrcaRouter ด้วยอินเทอร์เฟซ API เดียวกัน ทำให้การสลับใช้งานง่าย
Gpt-4o-mini เป็นโมเดลที่เล็กกว่าและราคาถูกกว่า ซึ่งถูกปรับให้เหมาะสมสำหรับงานง่ายๆ โดยมีราคาประมาณ $0.15 ต่อล้าน input tokens และ $0.60 ต่อล้าน output tokens (โดยประมาณ) โมเดลพรีวิวนี้นั้นมีราคาแพงกว่าประมาณ 16 เท่าสำหรับ input และ 16 เท่าสำหรับ output โมเดลพรีวิวมีบริบทที่ใหญ่กว่า (128K เทียบกับ 128K? จริงๆ แล้ว gpt-4o-mini ก็มี 128K เช่นกัน แต่อาจแตกต่างกันไป เรารู้ว่าโมเดลนี้มี 128K บริบทของ Gpt-4o-mini ก็มี 128K ตามข้อมูลสาธารณะ แต่เราไม่สามารถสรุปได้ เราจะพูดว่า 'หน้าต่างบริบทที่เทียบเท่าได้' แต่โปรดสังเกตความแตกต่างของราคา) โมเดลนี้เหมาะสำหรับการให้เหตุผลที่ซับซ้อน ในขณะที่ gpt-4o-mini ก็เพียงพอสำหรับงานมาตรฐานหลายๆ อย่าง เลือกตามความต้องการด้านคุณภาพและงบประมาณ
โมเดล Claude (เช่น Claude 3.5 Sonnet) มีหน้าต่างบริบทขนาดใหญ่และความสามารถในการให้เหตุผลที่แข็งแกร่ง แต่ API ของโมเดลนั้นไม่เข้ากันโดยตรงกับ OpenAI OrcaRouter มอบอินเทอร์เฟซแบบรวมสำหรับผู้ให้บริการหลายราย แต่ตัวอย่างพรีวิวนี้นำเสนอจาก OpenAI เพียงเท่านั้น โมเดล Claude อาจมีราคาและจุดแข็งที่แตกต่างกันในด้านต่างๆ เช่น ความปลอดภัยและการสร้างข้อความแบบยาว สำหรับการเปรียบเทียบโดยตรง คุณจะต้องทดสอบในกรณีการใช้งานของคุณเอง OrcaRouter ช่วยให้คุณสลับระหว่างผู้ให้บริการได้ แต่โมเดลพรีวิวนี้มีให้ใช้งานผ่านเส้นทาง OpenAI เท่านั้น ไม่มีการเปรียบเทียบเกณฑ์มาตรฐานใดๆ
เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview-2025-03-11",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| อินพุต / 1M โทเค็น | $2.50 |
| เอาต์พุต / 1M โทเค็น | $10.00 |
| สกุลเงิน | USD |
ประมาณการจากราคาตั้ง
เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ
GET /api/public/models/openai/gpt-4o-search-preview-2025-03-11เปิด @misc{orcarouter_gpt_4o_search_preview_2025_03_11,
title = {openai/gpt-4o-search-preview-2025-03-11 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11}
}openai. (n.d.). openai/gpt-4o-search-preview-2025-03-11 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11