GPT-4o Search Preview là một mô hình chuyên biệt cho tìm kiếm web trong Chat Completions. Nó được huấn luyện để hiểu và thực thi các truy vấn tìm kiếm web.
GPT-4o Search Preview là mô hình chỉ hỗ trợ văn bản từ OpenAI, được cung cấp như một phần của dòng GPT-4o. Mô hình này có thể truy cập thông qua API của OrcaRouter tại URL gốc…
Mô hình này phù hợp với các tác vụ yêu cầu suy luận trên các chuỗi văn bản dài, chẳng hạn như tóm tắt, hỏi đáp từ các tài liệu lớn và tạo ra các phản hồi mạch lạc trong các cuộc hội thoại kéo dài. Với nhãn xem trước tìm kiếm (search preview label) của nó, mô hình có thể xử lý hiệu quả việc tổng hợp kết quả tìm kiếm và truy xuất theo ngữ cảnh. Cửa sổ ngữ cảnh lớn của nó cho phép phân tích toàn bộ báo cáo, sách hoặc mã nguồn trong một lời nhắc duy nhất.
Hạn chế chính là thiếu hỗ trợ đa phương thức. Mô hình không thể xử lý đầu vào hình ảnh, âm thanh hoặc video, điều này hạn chế việc sử dụng trong các ứng dụng như trả lời câu hỏi trực quan hoặc phiên âm giọng nói. Ngoài ra, không có điểm chuẩn chính thức hoặc số liệu về độ trễ, gây khó khăn trong việc so sánh hiệu suất trên các tác vụ cụ thể. Mô hình có thể không được tối ưu hóa cho các tác vụ ngoài suy luận dựa trên văn bản.
Đối với các tác vụ có yêu cầu ngữ cảnh nhỏ (ví dụ: phân loại đơn giản, tạo văn bản ngắn), một mô hình rẻ hơn và nhanh hơn như GPT-3.5 Turbo có thể tiết kiệm chi phí hơn. Nếu cần đầu vào đa phương thức, hãy cân nhắc mô hình GPT-4o tiêu chuẩn. Đối với khối lượng công việc chỉ văn bản cực kỳ lớn, hãy đánh giá xem mức giá không tăng thêm của OrcaRouter có biện minh cho chi phí mỗi token so với các nhà cung cấp khác hay không.
Không. GPT-4o Search Preview chỉ chấp nhận đầu vào văn bản. Nó không hỗ trợ hình ảnh, âm thanh hay video. Đây là điểm khác biệt chính so với mô hình GPT-4o tiêu chuẩn, vốn có khả năng đa phương thức. Người dùng cần hiểu biết về thị giác hoặc thính giác nên chọn một mô hình khác.
OpenAI chưa công bố bất kỳ điểm chuẩn cụ thể nào cho biến thể GPT-4o Search Preview. Vì là một phần của dòng GPT-4o, biến thể này có thể chia sẻ các đặc điểm hiệu suất với GPT-4o trong các tác vụ hiểu ngôn ngữ, nhưng không có số liệu chính thức nào được cung cấp. Người dùng được khuyên nên tự đánh giá trên các bộ dữ liệu đại diện để xác định tính phù hợp.
Các số liệu về độ trễ và thông lượng không được công bố công khai cho GPT-4o Search Preview. Là một biến thể của GPT-4o, nó có khả năng có thời gian phản hồi tương tự như mô hình GPT-4o tiêu chuẩn, nhưng hiệu suất thực tế phụ thuộc vào các yếu tố như số lượng yêu cầu đồng thời, số lượng token và cơ sở hạ tầng OrcaRouter. Người dùng nên tự đo điểm chuẩn dựa trên khối lượng công việc của mình.
Ngoài việc thiếu hỗ trợ đa phương thức, mô hình này còn không công bố điểm chuẩn và cam kết về độ trễ. Chỉ định "bản xem trước tìm kiếm" của nó ngụ ý rằng nó được tối ưu hóa cho các tác vụ liên quan đến tìm kiếm, nhưng mức độ tối ưu hóa này không được xác định rõ. Người dùng không nên cho rằng nó sẽ vượt trội hơn so với GPT-4o tiêu chuẩn trong các tác vụ không phải tìm kiếm. Ngoài ra, không có đảm bảo về giá thấp hơn hoặc hiệu quả cải thiện so với các biến thể khác của GPT-4o.
Giá là $2.50 cho mỗi 1 triệu token đầu vào và $10.00 cho mỗi 1 triệu token đầu ra. OrcaRouter tính phí chính xác theo giá của nhà cung cấp với mức markup bằng không. Không có khoản phí bổ sung nào được áp dụng. Việc sử dụng token được tính phí riêng biệt cho đầu vào và đầu ra. Các mức giá này phù hợp với định giá GPT-4o tiêu chuẩn của OpenAI trên nền tảng của họ.
So với nhiều mô hình khác, GPT-4o Search Preview được định giá ở mức phí mỗi token cao cấp, điển hình của các mô hình có khả năng cao. Ví dụ, GPT-3.5 Turbo rẻ hơn đáng kể. Chính sách không tính thêm phí trên OrcaRouter đảm bảo người dùng trả cùng mức giá như thanh toán trực tiếp cho OpenAI, nhưng không có bất kỳ chi phí phát sinh nào. Điều này có thể có lợi cho các ứng dụng nhạy cảm về chi phí yêu cầu cửa sổ ngữ cảnh lớn.
OrcaRouter không công khai quảng cáo bất kỳ chương trình giảm giá bộ nhớ đệm hay tiết kiệm token nào dành riêng cho GPT-4o Search Preview. Người dùng được tính phí dựa trên tổng số lượng token đầu vào và đầu ra đã sử dụng. Để quản lý chi phí, hãy cân nhắc tối ưu hóa độ dài prompt và giới hạn token đầu ra. Xử lý theo lô có thể cải thiện hiệu quả nhưng không được đề cập trong tài liệu hiện có.
Mô hình được truy cập thông qua API tương thích OpenAI của OrcaRouter. Đặt base URL thành https://api.orcarouter.ai/v1 và bao gồm model ID "openai/gpt-4o-search-preview" trong yêu cầu của bạn. Sử dụng các thư viện client tiêu chuẩn của OpenAI (ví dụ: gói openai Python) với khóa API OrcaRouter của bạn. Ví dụ: openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...]).
Vì API này tương thích với OpenAI, các tham số chuẩn có sẵn: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, và các tham số khác. Tham số max_tokens không được vượt quá giới hạn đầu ra là 16,384 token. Mô hình không hỗ trợ đầu vào đa phương thức, vì vậy các messages chỉ nên chứa nội dung văn bản.
Để chuyển từ một biến thể GPT-4o khác (ví dụ: "gpt-4o" hoặc "gpt-4o-mini"), chỉ cần thay đổi ID mô hình trong lệnh gọi API của bạn thành "openai/gpt-4o-search-preview". Đảm bảo các yêu cầu của bạn chỉ chứa nội dung văn bản, vì biến thể này không chấp nhận hình ảnh hoặc âm thanh. Điều chỉnh tham số max_tokens nếu cần. Không yêu cầu thay đổi mã nào khác.
Xác thực được thực hiện thông qua khóa API. Bạn cần khóa API OrcaRouter, được truyền trong header của yêu cầu (thường là "Authorization: Bearer <your_key>"). Nhận khóa từ nền tảng OrcaRouter. Cùng một phương thức xác thực được sử dụng cho tất cả các mô hình có thể truy cập qua gateway.
GPT-4o Search Preview chỉ hỗ trợ văn bản, trong khi GPT-4o tiêu chuẩn hỗ trợ văn bản, hình ảnh và âm thanh. Biến thể preview tìm kiếm có thể có các tối ưu hóa nền tảng cho các truy vấn liên quan đến tìm kiếm, nhưng những điều đó không được công bố công khai. Giá cả giống hệt nhau: $2.50/M đầu vào và $10/M đầu ra. Cả hai đều sử dụng cửa sổ ngữ cảnh 128k và đầu ra tối đa 16k. Sự đánh đổi chính là hỗ trợ phương thức so với hiệu suất tìm kiếm chuyên biệt tiềm năng.
GPT-4 Turbo (ngữ cảnh 128k, văn bản + hình ảnh) là phiên bản tiền nhiệm của GPT-4o. GPT-4o Search Preview mới hơn và thuộc dòng GPT-4o, thường mang lại khả năng suy luận và hiệu quả tốt hơn so với GPT-4 Turbo. Tuy nhiên, hỗ trợ đa phương thức trên GPT-4 Turbo chỉ giới hạn ở hình ảnh, trong khi GPT-4o là đa phương thức hoàn toàn. Search Preview loại bỏ lợi thế đó. Giá của GPT-4 Turbo thường là $10/M đầu vào và $30/M đầu ra, khiến Search Preview rẻ hơn (nếu sử dụng mức giá đã cho). Lưu ý rằng giá của GPT-4 Turbo không được cung cấp ở đây; đây là kiến thức chung.
Các mô hình tập trung vào tìm kiếm khác (ví dụ: các hệ thống tăng cường truy xuất chuyên dụng) có thể cung cấp tính năng tìm kiếm web hoặc truy xuất tệp tích hợp. GPT-4o Search Preview không bao gồm chức năng tìm kiếm riêng; nó là một mô hình ngôn ngữ có thể xử lý các kết quả tìm kiếm được cung cấp trong lời nhắc. Nếu bạn cần truy xuất bên ngoài, hãy kết hợp mô hình này với một API tìm kiếm. Cửa sổ ngữ cảnh lớn của nó làm cho nó phù hợp để tổng hợp nhiều kết quả tìm kiếm trong một yêu cầu duy nhất.
Sự cân bằng chính là giữa hỗ trợ đa phương thức và khả năng tối ưu hóa cho các tác vụ tìm kiếm. Bạn có được cửa sổ ngữ cảnh lớn và mức giá không bao gồm markup, nhưng mất khả năng xử lý hình ảnh hoặc âm thanh. Trên các benchmark đã biết, hiệu suất có thể tương đương với GPT-4o, nhưng không có điểm số cụ thể. Đối với các tác vụ chỉ dùng văn bản có lợi từ ngữ cảnh 128k, mô hình này là lựa chọn hiệu quả về chi phí trong dòng GPT-4o.
Tương thích OpenAI — giữ nguyên SDK bạn đang dùng
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| Đầu vào / 1M tokens | $2.50 |
| Đầu ra / 1M tokens | $10.00 |
| Tiền tệ | USD |
Ước tính theo giá niêm yết
Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.
GET /api/public/models/openai/gpt-4o-search-previewMở @misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview