GPT-4o-mini Search Preview

openai/gpt-4o-mini-search-preview
JSON
bởi OpenAI · 2025-03-12

GPT-4o mini Search Preview là một mô hình chuyên dụng cho tìm kiếm web trong Chat Completions. Nó được huấn luyện để hiểu và thực hiện các truy vấn tìm kiếm web.

Điểm cuối:/v1/chat/completions
ngữ cảnh128K token
Đầu ra tối đa16.4K
Đầu vàotext
Đầu ratext
ĐẦU VÀO$0.15/ 1M token
ĐẦU RA$0.60/ 1M token
TTFT p50Đang thu thập…
p95 TTFTĐang thu thập…
LƯU LƯỢNGĐang thu thập…

GPT-4o-mini Search Preview là một biến thể của mô hình GPT-4o-mini của OpenAI, tích hợp sẵn khả năng tìm kiếm trên web. Mô hình này được thiết kế để cung cấp câu trả lời kết hợp thông tin thời gian…

GPT-4o-mini Search Preview là gì?

Ai nên sử dụng mô hình này?

Thông số kỹ thuật chính

Tính năng xem trước tìm kiếm hoạt động như thế nào?

Mã ví dụ

Gọi từ bất kỳ SDK nào

Tương thích OpenAI — giữ nguyên SDK bạn đang dùng

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="openai/gpt-4o-mini-search-preview",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Tham số được hỗ trợ

  • max_tokens
  • response_format
  • stream
  • structured_outputs
  • web_search_options

Giá

Đầu vào / 1M tokens$0.150
Đầu ra / 1M tokens$0.600
Tiền tệUSD

Máy tính chi phí

Token / tháng10MM
Tỷ lệ đầu vào70%%
Ước tính / tháng $2.85

Ước tính theo giá niêm yết

Công cụ ước tính token & chi phí

Token đầu vào: 17Chi phí mỗi yêu cầu: $0.000303

Chỉ là ước tính — số token thực tế phụ thuộc vào bộ tách token của nhà cung cấp.

Hiệu suất

TTFT p50
Đang thu thập…
Tốc độ đầu ra
Đang thu thập…
p95 TTFT
Đang thu thập…
Tỷ lệ lỗi
Đang thu thập…

Benchmark công khai

So sánh

GPT-4o-mini Search PreviewGPT-5.2 ProGPT-5.4 ProGPT-5.5
Đầu vào $/M$0.15$21.00$60.00$5.00
Đầu ra $/M$0.60$168.00$270.00$30.00
Ngữ cảnh128K400K1.1M
Chất lượng2/1010/1010/1010/10
So sánh song songSo sánh song songSo sánh song songSo sánh song song

Câu hỏi thường gặp

Chi phí sử dụng GPT-4o-mini Search Preview trên OrcaRouter là bao nhiêu?
Giá là $0.15 cho mỗi triệu token đầu vào và $0.60 cho mỗi triệu token đầu ra, được tính theo tỷ lệ của nhà cung cấp không có phụ phí. Bạn trả chính xác những gì OpenAI tính phí, không có thêm bất kỳ khoản phí nào.
Cửa sổ ngữ cảnh và độ dài đầu ra tối đa là gì?
Cửa sổ ngữ cảnh là 128.000 token. Độ dài đầu ra tối đa là 16.384 token. Mô hình chỉ chấp nhận đầu vào dạng văn bản.
Các điểm mạnh chính của GPT-4o-mini Search Preview là gì?
Điểm mạnh của nó bao gồm tìm kiếm web tích hợp để lấy thông tin cập nhật, cửa sổ ngữ cảnh lớn, suy luận nhanh hơn so với GPT-4o và chi phí thấp. Nó lý tưởng cho các ứng dụng cần dữ liệu hiện tại mà không cần API tìm kiếm riêng.
So với phiên bản GPT-4o-mini cơ bản thì nó như thế nào?
Cả hai đều có giá và thông số kỹ thuật giống hệt nhau ngoại trừ biến thể Search Preview có thể thực hiện tìm kiếm trên web. Mô hình cơ bản chỉ dựa vào dữ liệu huấn luyện của nó. Chọn Search Preview nếu bạn cần thông tin trực tiếp; nếu không, mô hình cơ bản mang lại hiệu suất tương tự với cùng mức giá.
OrcaRouter có huấn luyện trên dữ liệu của tôi không?
OrcaRouter không sử dụng dữ liệu khách hàng để huấn luyện. Việc xử lý dữ liệu tuân theo chính sách của OpenAI và OrcaRouter. Thông thường, dữ liệu không được sử dụng để cải thiện mô hình trừ khi có sự đồng ý rõ ràng. Tham khảo chính sách bảo mật của OrcaRouter để biết chi tiết.
Làm thế nào để gọi mô hình qua API của OrcaRouter?
Sử dụng URL cơ sở https://api.orcarouter.ai/v1 với một client tương thích OpenAI. Đặt tham số model thành "openai/gpt-4o-mini-search-preview". Bao gồm khóa API OrcaRouter của bạn trong header Authorization. Tất cả các tham số hoàn tất hội thoại tiêu chuẩn đều được hỗ trợ.
Loại truy vấn nào kích hoạt bản xem trước tìm kiếm?
Mô hình tự động quyết định khi nào cần tìm kiếm trên web, thường là cho các câu hỏi về sự kiện gần đây, dữ liệu hiện tại, hoặc thông tin có khả năng đã thay đổi kể từ thời điểm huấn luyện của nó. Bạn cũng có thể yêu cầu nó tìm kiếm một cách rõ ràng cho các chủ đề cụ thể.
Có độ trễ bổ sung nào cho bản xem trước tìm kiếm không?
Có, việc truy xuất web gây thêm một chút độ trễ so với GPT-4o-mini cơ bản. Thời gian phản hồi điển hình là vài giây. Bạn có thể sử dụng streaming để hiển thị phản hồi từng phần.

Nhúng huy hiệu này

OpenAI: GPT-4o-mini Search Preview$0.15/M inqua OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview" target="_blank"> <img src="https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg" alt="OpenAI: GPT-4o-mini Search Preview trên OrcaRouter" /> </a>
Markdown [![OpenAI: GPT-4o-mini Search Preview](https://www.orcarouter.ai/embed/openai/gpt-4o-mini-search-preview.svg)](https://www.orcarouter.ai/models/openai/gpt-4o-mini-search-preview)

Thẻ mô hình dạng dữ liệu

GET /api/public/models/openai/gpt-4o-mini-search-previewMở
Máy đọc được:/llms.txt/llms-full.txt