GPT-4o Search Preview เป็นโมเดลพิเศษสำหรับการค้นหาเว็บใน Chat Completions โดยถูกฝึกให้เข้าใจและดำเนินการค้นหาเว็บตามคำค้นหา
GPT-4o Search Preview เป็นโมเดลที่ใช้เฉพาะข้อความจาก OpenAI ซึ่งเป็นส่วนหนึ่งของตระกูล GPT-4o สามารถเข้าถึงได้ผ่าน API ของ OrcaRouter ที่ URL ฐาน https://api.orcarouter.ai/v1 ภายใต้ตัวระบุโมเดล…
โมเดลนี้เหมาะสำหรับงานที่ต้องใช้เหตุผลผ่านลำดับข้อความยาว เช่น การสรุป การตอบคำถามจากเอกสารขนาดใหญ่ และการสร้างคำตอบที่สอดคล้องในการสนทนาที่ยาว เนื่องจากมีป้ายแสดงตัวอย่างการค้นหา จึงน่าจะจัดการรวมผลการค้นหาและการดึงข้อมูลตามบริบทได้อย่างมีประสิทธิภาพ หน้าต่างบริบทที่ใหญ่ทำให้สามารถวิเคราะห์รายงาน หนังสือ หรือโค้ดเบสทั้งหมดในพรอมต์เดียว
ข้อจำกัดหลักคือการขาดการรองรับแบบ multimodal (หลายรูปแบบ) ไม่สามารถประมวลผลอินพุตที่เป็นรูปภาพ เสียง หรือวิดีโอ ซึ่งจำกัดการใช้งานในแอปพลิเคชัน เช่น การตอบคำถามจากภาพ หรือการถอดความจากเสียงพูด นอกจากนี้ ไม่มีคะแนนมาตรฐานอย่างเป็นทางการหรือค่าความหน่วง (latency) ให้เปรียบเทียบ ทำให้ยากต่อการเปรียบเทียบประสิทธิภาพในงานเฉพาะ โมเดลอาจไม่ถูกปรับให้เหมาะสมสำหรับงานที่อยู่นอกเหนือการใช้เหตุผลเชิงข้อความ
สำหรับงานที่ต้องการบริบทขนาดเล็ก (เช่น การจำแนกประเภทง่ายๆ การสร้างข้อความสั้น) โมเดลที่ถูกกว่าและเร็วกว่าอย่าง GPT-3.5 Turbo อาจคุ้มค่ามากกว่า หากจำเป็นต้องใช้ข้อมูลนำเข้าหลายรูปแบบ ให้พิจารณาใช้โมเดล GPT-4o มาตรฐาน สำหรับปริมาณงานข้อความล้วนที่สูงมาก ให้ประเมินว่าราคาแบบไม่มี markup บน OrcaRouter คุ้มค่ากับต้นทุนต่อ token เมื่อเทียบกับผู้ให้บริการรายอื่นหรือไม่
ไม่ GPT-4o Search Preview รองรับเฉพาะอินพุตที่เป็นข้อความเท่านั้น ไม่รองรับรูปภาพ เสียง หรือวิดีโอ นี่คือความแตกต่างที่สำคัญจากรุ่น GPT-4o มาตรฐานซึ่งเป็นมัลติโมดัล ผู้ใช้ที่ต้องการความเข้าใจทางภาพหรือเสียงควรเลือกรุ่นอื่น
OpenAI ยังไม่ได้เผยแพร่คะแนนการวัดประสิทธิภาพเฉพาะสำหรับรุ่น GPT-4o Search Preview เนื่องจากเป็นส่วนหนึ่งของตระกูล GPT-4o จึงอาจมีสมรรถนะที่คล้ายคลึงกับ GPT-4o ในงานด้านความเข้าใจภาษา แต่ไม่มีตัวเลขอย่างเป็นทางการให้ ผู้ใช้ควรทำการประเมินผลด้วยตนเองบนชุดข้อมูลที่เป็นตัวแทนเพื่อพิจารณาความเหมาะสม
ตัวเลขความหน่วงและปริมาณงานยังไม่ได้รับการเปิดเผยต่อสาธารณะสำหรับ GPT-4o Search Preview ในฐานะที่เป็นตัวแปรของ GPT-4o จึงมีแนวโน้มที่จะมีเวลาในการตอบสนองใกล้เคียงกับโมเดล GPT-4o มาตรฐาน แต่ประสิทธิภาพที่แท้จริงขึ้นอยู่กับปัจจัยต่างๆ เช่น การทำงานพร้อมกันของคำขอ จำนวนโทเค็น และโครงสร้างพื้นฐาน OrcaRouter ผู้ใช้ควรวัดประสิทธิภาพโดยใช้ปริมาณงานของตนเอง
นอกเหนือจากการขาดการรองรับหลายรูปแบบ (multimodal support) แล้ว โมเดลดังกล่าวไม่มีคะแนนมาตรฐาน (benchmark scores) และการรับประกันเวลาแฝง (latency guarantees) ที่เผยแพร่ การกำหนดให้เป็น "แสดงตัวอย่างการค้นหา" (search preview) หมายถึงการปรับให้เหมาะสมกับงานที่เกี่ยวข้องกับการค้นหา แต่ขอบเขตของการปรับแต่งนี้ไม่ได้ระบุไว้ชัดเจน ผู้ใช้ไม่ควรสันนิษฐานว่าโมเดลนี้จะมีประสิทธิภาพเหนือกว่า GPT-4o มาตรฐานในงานที่ไม่ใช่การค้นหา นอกจากนี้ ไม่มีการรับประกันว่าราคาจะต่ำกว่าหรือประสิทธิภาพจะดีกว่าเมื่อเทียบกับ GPT-4o รูปแบบอื่น
ราคาอยู่ที่ $2.50 ต่อ 1 ล้าน input tokens และ $10.00 ต่อ 1 ล้าน output tokens. OrcaRouter คิดค่าบริการตามอัตราของผู้ให้บริการโดยไม่มีส่วนเพิ่ม ไม่มีค่าธรรมเนียมเพิ่มเติม การใช้งาน tokens จะถูกเรียกเก็บแยกสำหรับ input และ output อัตราเหล่านี้สอดคล้องกับการกำหนดราคา GPT-4o มาตรฐานของ OpenAI บนแพลตฟอร์มของพวกเขา
เมื่อเทียบกับโมเดลอื่นๆ หลายตัว GPT-4o Search Preview ถูกวางตำแหน่งในราคาต่อโทเค็นที่พรีเมียม ซึ่งเป็นเรื่องปกติของโมเดลที่มีความสามารถสูง ตัวอย่างเช่น GPT-3.5 Turbo มีราคาถูกกว่าอย่างมาก นโยบายไม่บวกกำไรบน OrcaRouter ทำให้ผู้ใช้จ่ายในราคาเดียวกับการเรียกเก็บโดยตรงจาก OpenAI โดยไม่มีค่าใช้จ่ายเพิ่มเติมใดๆ ซึ่งอาจเป็นประโยชน์สำหรับแอปพลิเคชันที่คำนึงถึงต้นทุนและต้องใช้หน้าต่างบริบทที่ใหญ่
OrcaRouter ไม่ได้ประกาศโปรโมชั่นส่วนลดแคชหรือโปรแกรมประหยัดโทเค็นสำหรับ GPT-4o Search Preview อย่างเปิดเผย ผู้ใช้จะถูกเรียกเก็บเงินตามจำนวนโทเค็นอินพุตและเอาต์พุตทั้งหมดที่ใช้ไป เพื่อจัดการต้นทุน ควรพิจารณาปรับความยาวพรอมต์ให้เหมาะสมและจำกัดโทเค็นเอาต์พุต การประมวลผลแบบแบตช์อาจช่วยเพิ่มประสิทธิภาพ แต่ไม่ได้ระบุไว้ในเอกสารที่มีอยู่
โมเดลนี้เข้าถึงได้ผ่าน API ที่รองรับ OpenAI ของ OrcaRouter กำหนด base URL เป็น https://api.orcarouter.ai/v1 และรวมรหัสโมเดล "openai/gpt-4o-search-preview" ไว้ในคำขอของคุณ ใช้ไลบรารีไคลเอ็นต์ของ OpenAI มาตรฐาน (เช่น แพ็กเกจ openai สำหรับ Python) พร้อมรหัส API ของ OrcaRouter ตัวอย่าง: openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...])
เนื่องจาก API รองรับการใช้งานแบบ OpenAI-compatible จึงมีพารามิเตอร์มาตรฐานให้เลือกใช้: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, และอื่นๆ พารามิเตอร์ max_tokens ต้องไม่เกินขีดจำกัดเอาต์พุตที่ 16,384 โทเค็น โมเดลไม่รองรับอินพุตแบบ multimodal ดังนั้น messages ควรมีเฉพาะเนื้อหาที่เป็นข้อความ
หากต้องการเปลี่ยนจาก GPT-4o รูปแบบอื่น (เช่น "gpt-4o" หรือ "gpt-4o-mini") เพียงเปลี่ยน model ID ในการเรียก API ของคุณเป็น "openai/gpt-4o-search-preview" ตรวจสอบให้แน่ใจว่าคำขอของคุณมีเฉพาะเนื้อหาที่เป็นข้อความ เนื่องจากรูปแบบนี้ไม่รองรับรูปภาพหรือเสียง ปรับพารามิเตอร์ max_tokens หากจำเป็น ไม่จำเป็นต้องแก้ไขโค้ดส่วนอื่น
การตรวจสอบสิทธิ์ทำได้ผ่านคีย์ API คุณต้องมีคีย์ API ของ OrcaRouter ซึ่งจะถูกส่งในส่วนหัวของคำขอ (โดยทั่วไปคือ "Authorization: Bearer <your_key>") รับคีย์จากแพลตฟอร์ม OrcaRouter การตรวจสอบสิทธิ์แบบเดียวกันนี้ใช้สำหรับโมเดลทั้งหมดที่เข้าถึงได้ผ่านเกตเวย์
GPT-4o Search Preview เป็นแบบข้อความเท่านั้น ในขณะที่ GPT-4o มาตรฐานรองรับข้อความ รูปภาพ และเสียง ตัวแปรพรีวิวการค้นหาอาจมีการปรับแต่งพื้นฐานสำหรับคำค้นหาที่เกี่ยวข้อง แต่ไม่ได้เปิดเผยรายละเอียดต่อสาธารณะ ราคาเหมือนกัน: $2.50/M input และ $10/M output ทั้งสองใช้หน้าต่างบริบท 128k และผลลัพธ์สูงสุด 16k ข้อแลกเปลี่ยนหลักคือการรองรับรูปแบบสื่อเทียบกับประสิทธิภาพการค้นหาที่อาจเชี่ยวชาญกว่า
GPT-4 Turbo (128k context, text+image) เป็นรุ่นก่อนหน้าของ GPT-4o GPT-4o Search Preview เป็นรุ่นใหม่กว่าและอยู่ในตระกูล GPT-4o ซึ่งโดยทั่วไปแล้วให้การคิดวิเคราะห์และประสิทธิภาพที่ดีกว่า GPT-4 Turbo อย่างไรก็ตาม การรองรับมัลติโมดัลใน GPT-4 Turbo จำกัดอยู่ที่รูปภาพ ในขณะที่ GPT-4o รองรับมัลติโมดัลอย่างเต็มที่ Search Preview จะลบข้อได้เปรียบนั้นออกไป ราคาของ GPT-4 Turbo โดยทั่วไปอยู่ที่ $10/M สำหรับอินพุตและ $30/M สำหรับเอาต์พุต ทำให้ Search Preview ถูกกว่า (หากใช้อัตราที่กำหนด) โปรดทราบว่าราคาของ GPT-4 Turbo ไม่ได้ระบุไว้ที่นี่ นี่คือความรู้ทั่วไป
โมเดลที่เน้นการค้นหาอื่นๆ (เช่น ระบบสร้างข้อความแบบเสริมด้วยการดึงข้อมูลโดยเฉพาะ) อาจมีฟังก์ชันค้นหาเว็บหรือดึงไฟล์ในตัว GPT-4o Search Preview ไม่มีฟังก์ชันค้นหาในตัวของมันเอง มันเป็นโมเดลภาษาที่สามารถประมวลผลผลการค้นหาที่ให้มาในพรอมพ์ได้ หากคุณต้องการดึงข้อมูลจากภายนอก ให้รวมโมเดลนี้กับ API การค้นหา หน้าต่างบริบทที่ใหญ่ทำให้เหมาะสำหรับการรวบรวมผลการค้นหาจำนวนมากในคำขอเดียว
การแลกเปลี่ยนหลักคือระหว่างการรองรับรูปแบบสื่อและการปรับแต่งที่อาจเป็นไปได้สำหรับงานค้นหา คุณได้รับหน้าต่างบริบทขนาดใหญ่และราคาที่ไม่มีส่วนเพิ่ม แต่สูญเสียความสามารถในการประมวลผลภาพหรือเสียง ในการวัดประสิทธิภาพที่เป็นที่รู้จัก ประสิทธิภาพอาจเทียบเท่า GPT-4o แต่ไม่มีคะแนนที่ระบุเฉพาะ สำหรับงานที่ใช้ข้อความเพียงอย่างเดียวซึ่งได้รับประโยชน์จากบริบท 128k โมเดลนี้เป็นตัวเลือกที่คุ้มค่าภายในตระกูล GPT-4o
เข้ากันได้กับ OpenAI — ใช้ SDK เดิมของคุณได้เลย
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| อินพุต / 1M โทเค็น | $2.50 |
| เอาต์พุต / 1M โทเค็น | $10.00 |
| สกุลเงิน | USD |
ประมาณการจากราคาตั้ง
เป็นเพียงการประเมิน — จำนวน token จริงขึ้นอยู่กับ tokenizer ของผู้ให้บริการ
GET /api/public/models/openai/gpt-4o-search-previewเปิด @misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview