GPT-4o Search Preview는 Chat Completions에서 웹 검색을 위한 특화된 모델입니다. 이 모델은 웹 검색 쿼리를 이해하고 실행하도록 학습되었습니다.
GPT-4o Search Preview는 OpenAI의 텍스트 전용 모델로, GPT-4o 제품군의 일부로 제공됩니다. 이 모델은 OrcaRouter의 API를 통해 기본 URL https://api.orcarouter.ai/v1에서 모델 식별자 "openai/gpt-4o-search-preview"로 접근할 수 있습니다. 이 모델은 128,000토큰…
이 모델은 요약, 대규모 문서에서의 질문 답변, 확장된 대화에서 일관된 응답 생성 등 긴 텍스트 시퀀스에 대한 추론이 필요한 작업에 적합합니다. 검색 미리보기 라벨을 고려할 때, 검색 결과 집계와 맥락적 검색을 효과적으로 처리할 가능성이 높습니다. 큰 컨텍스트 창을 통해 단일 프롬프트로 전체 보고서, 책, 또는 코드베이스를 분석할 수 있습니다.
주된 한계는 멀티모달 지원이 부족하다는 점입니다. 이미지, 오디오, 또는 비디오 입력을 처리할 수 없어 시각적 질문-응답이나 음성 전사와 같은 응용에서 사용이 제한됩니다. 또한, 공식적인 벤치마크 점수나 지연 시간 수치가 없어 특정 작업에서의 성능 비교가 어렵습니다. 이 모델은 텍스트 기반 추론 외의 작업에는 최적화되지 않았을 수 있습니다.
작은 컨텍스트 요구 사항이 있는 작업의 경우 (예: 단순 분류, 짧은 텍스트 생성), GPT-3.5 Turbo와 같은 더 저렴하고 빠른 모델이 더 비용 효율적일 수 있습니다. 멀티모달 입력이 필요한 경우 표준 GPT-4o 모델을 고려하세요. 매우 높은 볼륨의 텍스트 전용 워크로드의 경우, OrcaRouter의 제로 마크업 가격이 다른 제공업체와 비교하여 토큰당 비용을 정당화하는지 평가하세요.
아니요. GPT-4o Search Preview는 텍스트 입력만 허용합니다. 이미지, 오디오, 비디오는 지원하지 않습니다. 이는 멀티모달인 표준 GPT-4o 모델과의 주요 차이점입니다. 시각 또는 청각 이해가 필요한 사용자는 다른 모델을 선택해야 합니다.
OpenAI는 GPT-4o Search Preview 변형에 대해 특별히 발표된 벤치마크 점수가 없습니다. GPT-4o 제품군의 일부이므로 언어 이해 작업에서 GPT-4o와 성능 특성을 공유할 수 있지만, 공식 수치는 제공되지 않습니다. 사용자는 대표적인 데이터 세트에서 자체 평가를 수행하여 적합성을 판단하는 것이 좋습니다.
GPT-4o Search Preview의 지연 시간 및 처리량 수치는 공개적으로 문서화되어 있지 않습니다. GPT-4o의 변형 모델로서 표준 GPT-4o 모델과 유사한 응답 시간을 가질 가능성이 높지만, 실제 성능은 요청 동시성, 토큰 수, OrcaRouter 인프라와 같은 요소에 따라 달라집니다. 사용자는 자신의 워크로드를 사용하여 벤치마킹해야 합니다.
멀티모달 지원이 부족한 것 외에도, 이 모델은 공개된 벤치마크 점수와 지연 시간 보장이 없습니다. 검색 프리뷰 지정은 검색 관련 작업에 대한 최적화를 암시하지만, 이 최적화의 정도는 명시되지 않았습니다. 사용자는 비검색 작업에서 표준 GPT-4o보다 우수한 성능을 보일 것이라고 가정해서는 안 됩니다. 또한, 다른 GPT-4o 변종과 비교하여 더 낮은 가격이나 향상된 효율성에 대한 보장도 없습니다.
가격은 입력 토큰 100만 개당 $2.50이며 출력 토큰 100만 개당 $10.00입니다. OrcaRouter는 마크업 없이 정확히 제공업체 요율을 청구합니다. 추가 수수료는 없습니다. 토큰 사용량은 입력과 출력에 대해 별도로 청구됩니다. 이 요율은 OpenAI의 표준 GPT-4o 가격 정책과 일치합니다.
많은 다른 모델과 비교했을 때, GPT-4o Search Preview는 고성능 모델에서 일반적인 프리미엄 토큰당 요금으로 책정되어 있습니다. 예를 들어, GPT-3.5 Turbo는 상당히 저렴합니다. OrcaRouter의 제로 마크업 정책은 사용자가 직접 OpenAI 청구와 동일한 금액을 지불하도록 보장하며, 추가 오버헤드가 없습니다. 이는 큰 컨텍스트 창이 필요한 비용에 민감한 애플리케이션에 유리할 수 있습니다.
OrcaRouter는 GPT-4o Search Preview에 대해 캐싱 할인이나 토큰 절약 프로그램을 공개적으로 광고하지 않습니다. 사용자는 소비된 총 입력 및 출력 토큰 수에 따라 요금이 부과됩니다. 비용을 관리하려면 프롬프트 길이를 최적화하고 출력 토큰을 제한하는 것을 고려하십시오. 배치 처리는 효율성을 향상시킬 수 있지만, 제공된 문서에는 언급되어 있지 않습니다.
모델은 OrcaRouter의 OpenAI 호환 API를 통해 액세스됩니다. 기본 URL을 https://api.orcarouter.ai/v1로 설정하고 요청에 모델 ID "openai/gpt-4o-search-preview"를 포함하세요. 표준 OpenAI 클라이언트 라이브러리(예: Python openai 패키지)를 OrcaRouter API 키와 함께 사용하세요. 예시: openai.ChatCompletion.create(model="openai/gpt-4o-search-preview", messages=[...]).
API가 OpenAI와 호환되므로 표준 매개변수를 사용할 수 있습니다: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream 등. max_tokens 매개변수는 16,384 토큰 출력 제한을 초과할 수 없습니다. 이 모델은 멀티모달 입력을 지원하지 않으므로 messages에는 텍스트 콘텐츠만 포함되어야 합니다.
다른 GPT-4o 변형(예: "gpt-4o" 또는 "gpt-4o-mini")에서 전환하려면 API 호출에서 모델 ID를 "openai/gpt-4o-search-preview"로 변경하기만 하면 됩니다. 이 변형은 이미지나 오디오를 허용하지 않으므로 요청에 텍스트 콘텐츠만 포함되어 있는지 확인하세요. 필요한 경우 max_tokens 매개변수를 조정하세요. 다른 코드 변경은 필요하지 않습니다.
인증은 API 키를 통해 처리됩니다. OrcaRouter API 키가 필요하며, 이 키는 요청 헤더에 전달됩니다(일반적으로 "Authorization: Bearer <your_key>" 형식). OrcaRouter 플랫폼에서 키를 획득하세요. 동일한 인증이 게이트웨이를 통해 접근 가능한 모든 모델에 사용됩니다.
GPT-4o Search Preview는 텍스트 전용이며, 표준 GPT-4o는 텍스트, 이미지, 오디오를 지원합니다. Search Preview 변형은 검색 관련 쿼리에 대한 내부 최적화가 있을 수 있지만, 이는 공개적으로 상세히 알려지지 않았습니다. 가격은 동일합니다: 입력 $2.50/M, 출력 $10/M입니다. 두 모델 모두 128k 컨텍스트 윈도우와 최대 16k 출력을 사용합니다. 주요 차이점은 모달리티 지원 대 잠재적으로 특화된 검색 성능입니다.
GPT-4 Turbo(128k 컨텍스트, 텍스트+이미지)는 GPT-4o의 이전 모델입니다. GPT-4o Search Preview는 더 새로운 모델로 GPT-4o 제품군에 속하며, 일반적으로 GPT-4 Turbo보다 개선된 추론 능력과 효율성을 제공합니다. 그러나 GPT-4 Turbo의 멀티모달 지원은 이미지에 한정된 반면, GPT-4o는 완전한 멀티모달입니다. Search Preview는 이 장점을 제거합니다. GPT-4 Turbo의 가격은 일반적으로 입력 100만 토큰당 $10, 출력 100만 토큰당 $30이며, 주어진 요율을 적용하면 Search Preview가 더 저렴합니다. 참고로, 여기에는 GPT-4 Turbo의 가격 정보가 제공되지 않았으며 이는 일반적인 지식입니다.
다른 검색 중심 모델(예: 전용 검색 증강 생성 시스템)은 내장 웹 검색이나 파일 검색 기능을 제공할 수 있습니다. GPT-4o Search Preview는 자체 검색 기능을 포함하지 않으며, 프롬프트에 제공된 검색 결과를 처리할 수 있는 언어 모델입니다. 외부 검색이 필요하다면 이 모델을 검색 API와 결합하세요. 큰 컨텍스트 창 덕분에 단일 요청에서 많은 검색 결과를 집계하는 데 적합합니다.
주된 트레이드오프는 모달리티 지원과 잠재적 검색 작업 최적화 사이에 있습니다. 넓은 컨텍스트 윈도우와 제로 마크업 가격 책정의 이점을 얻는 대신, 이미지나 오디오를 처리하는 기능을 잃게 됩니다. 알려진 벤치마크에서는 GPT-4o와 동등한 성능을 보일 수 있지만, 구체적인 점수는 제공되지 않았습니다. 128k 컨텍스트의 이점을 활용할 수 있는 텍스트 전용 작업의 경우, 이 모델은 GPT-4o 제품군 내에서 비용 효율적인 선택입니다.
OpenAI 호환 — 쓰던 SDK 그대로
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| 입력 / 1M tokens | $2.50 |
| 출력 / 1M tokens | $10.00 |
| 통화 | USD |
정가 기준 추정치
추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.
@misc{orcarouter_gpt_4o_search_preview,
title = {GPT-4o Search Preview API},
author = {OpenAI},
year = {2025},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview}
}OpenAI. (2025). GPT-4o Search Preview API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview