128K 컨텍스트, 16K 출력을 지원하는 텍스트 전용 GPT-4o 모델을 OrcaRouter API를 통해 백만 토큰당 $2.50/$10에 미리 체험해보세요.
이 모델은 OpenAI의 프리뷰 릴리스이며, 텍스트 전용 입력으로 제한됩니다. OrcaRouter의 API를 통해 액세스할 때 openai/gpt-4o-search-preview-2025-03-11 식별자를 사용합니다. 이 모델은 128,000 토큰 컨텍스트 윈도우를 제공하며, 응답당 최대 16,384 토큰을 생성할 수 있습니다. 입력 모달리티는 텍스트로…
텍스트 전용 GPT-4o preview로서, 다양한 도메인에 걸쳐 자연어를 이해하고 생성하는 데 탁월합니다. 문서 요약, 질문 답변, 창작 글쓰기, 번역 및 코드 생성 작업을 수행할 수 있습니다. 큰 컨텍스트 창 덕분에 매우 긴 구절에서도 일관성을 유지할 수 있어, 책 분석이나 방대한 로그 처리와 같은 작업에 적합합니다. 채팅 형식의 system, user 및 assistant 메시지를 지원합니다. 이 모델의 zero-shot 및 few-shot 추론 능력은 GPT-4 class 모델의 전형적인 특징으로, 광범위한 미세 조정 없이도 복잡한 지침을 처리할 수 있습니다.
만약 작업에 GPT-4o의 완전한 추론 능력이 필요하지 않다면, OrcaRouter에서 제공하는 openai/gpt-4o-mini나 gpt-3.5-turbo 같은 더 작거나 저렴한 모델을 고려해 보세요. 단순 분류, 짧은 형식의 콘텐츠 생성, 또는 제한된 맥락의 기본적인 Q&A 같은 작업은 저렴한 모델에 더 적합합니다. 프리뷰 모델의 비용은 대량의 저복잡도 요청에는 정당화되지 않을 수 있습니다. 또한, 멀티모달 입력이 필요한 경우 이 모델은 이미지나 오디오를 처리할 수 없으므로 다른 모델(예: 표준 GPT-4o 또는 GPT-4V)이 필요합니다. 항상 품질과 토큰당 비용 사이의 균형을 평가하세요.
이 모델은 'search-preview' 변형으로 식별되지만, 공개된 사양에는 특정 도구 사용이나 웹 검색 기능에 대한 세부 내용이 명시되어 있지 않습니다. 이는 텍스트 전용이며 표준 언어 모델로 작동합니다. 사용자는 내장된 검색 또는 검색 기능이 있다고 가정해서는 안 됩니다. 증강 생성을 위해 검색 증강 생성(RAG) 파이프라인을 별도로 구현하여 검색된 문서를 모델의 컨텍스트 창에 제공할 수 있습니다. OrcaRouter는 도구 사용 미들웨어를 추가하지 않으며, 모델은 훈련 및 제공된 프롬프트에만 기반하여 응답합니다. 향후 버전에서는 이 동작이 변경될 수 있지만, 프리뷰 기준으로는 도구 통합이 문서화되어 있지 않습니다.
미리보기로서, 이 모델은 안정적인 릴리스에 비해 예상치 못한 동작이나 낮은 신뢰성을 보일 수 있습니다. 이 모델은 텍스트 전용이므로 모든 멀티모달 요청은 거부됩니다. 최대 출력 16,384개의 토큰은 상당하지만 매우 긴 생성에서는 여전히 잘릴 수 있습니다. 모델의 지식 기준일과 학습 데이터는 명시되지 않았습니다; 따라서 최근 사건을 인지하지 못할 수 있습니다. 프로덕션 사용은 모델이 업데이트되거나 제거될 수 있으므로 권장되지 않습니다. 또한, 미리보기 특성으로 인해 안정적인 모델보다 지연 시간이 더 높을 수 있습니다. 대규모로 배포하기 전에 항상 철저히 테스트하십시오.
이 특정 프리뷰 버전에 대한 구체적인 벤치마크 점수는 제공되지 않았습니다. GPT-4o 변형 모델로서 일반적인 언어 작업에서 표준 GPT-4o와 유사한 성능을 보일 것으로 예상되지만, 정확한 수치는 공개되지 않았습니다. 사용자는 공개 데이터셋을 사용하여 자체 평가를 수행할 수 있습니다. 큰 컨텍스트 윈도우는 긴 문서 벤치마크에서 이점을 제공하지만, 프리뷰 버전이므로 점수는 프로덕션 모델과 다를 수 있습니다. 공식적인 수치를 원한다면 OpenAI의 GPT-4o 공식 벤치마크 보고서를 참조하십시오. OrcaRouter는 모델의 출력이나 성능을 수정하지 않습니다.
이 프리뷰 모델의 지연 시간 및 처리량 수치는 공개되지 않았습니다. 프리뷰 버전이므로 실험적인 인프라로 인해 안정적인 GPT-4o보다 느릴 수 있습니다. 응답 시간은 입력 길이, 출력 길이 및 동시 요청 수에 따라 달라집니다. OrcaRouter는 일반적인 API 라우팅 이상의 추가 지연 시간을 부과하지 않습니다. 속도를 추정하기 위해 개발자는 일반적인 페이로드로 샘플 요청을 실행할 수 있습니다. 일관된 성능이 필요한 프로덕션 애플리케이션의 경우, 프리뷰의 특정 기능이 필요하지 않다면 안정적인 gpt-4o 모델을 사용하는 것을 고려하십시오.
GPT-4 클래스 모델은 수학, 논리, 상식 추론을 포함한 다양한 영역에서 뛰어난 추론 능력으로 알려져 있습니다. 이 프리뷰는 해당 능력을 계승할 것으로 예상됩니다. 큰 컨텍스트는 이전 부분을 놓치지 않고 여러 단계에 걸친 복잡한 사고 사슬 추론을 가능하게 합니다. 하지만 이 정확한 버전에 대한 특정 추론 벤치마크는 제공되지 않습니다. 사용자는 자체 도메인 특정 작업에서 성능을 검증해야 합니다. 모델은 이전 GPT 버전에 비해 개선된 명령 수행을 보일 수 있지만, 역시 독립적인 검증이 권장됩니다.
미리보기 단계를 넘어서, 이 모델은 멀티모달을 지원하지 않습니다. 이미지, 오디오 또는 비디오를 직접 처리할 수 없습니다. 지식 차단 날짜가 알려져 있지 않아 훈련 이후의 사건에 대한 정보가 부족할 수 있습니다. 16,384개의 토큰 출력 제한은 넉넉하지만, 한 번의 생성으로 매우 긴 텍스트를 출력할 수는 없습니다. 더 긴 출력을 위해서는 반복적인 프롬프트나 분할이 필요합니다. 미리보기 버전은 특정 민감한 주제에 대해 오류율이나 거부율이 더 높을 수 있습니다. 영어 이외의 언어에서는 성능이 다를 수 있습니다. 배포 전에 항상 대표 데이터로 테스트하십시오.
이 모델의 가격은 입력 토큰 100만 개당 $2.50, 출력 토큰 100만 개당 $10.00입니다. 이는 OpenAI의 제공 요금이며, OrcaRouter는 추가 마크업을 부과하지 않습니다. 예를 들어, 10,000개의 토큰 프롬프트를 처리하고 1,000개의 토큰을 생성할 경우 입력 비용은 약 $0.025, 출력 비용은 약 $0.01으로 총 $0.035입니다. 비용은 토큰 사용량에 따라 선형적으로 증가합니다. OrcaRouter를 API 게이트웨이로 사용하는 데 추가 수수료는 없습니다. 예상치 못한 요금이 발생하지 않도록 사용량을 모니터링하세요. 작업에 전체 기능이 필요하지 않은 경우 더 저렴한 모델과 비교해 보세요.
OrcaRouter는 현재 이 모델에 대해 볼륨 할인이나 토큰 캐싱을 제공하지 않습니다. 모든 청구는 제공업체 요율에 따른 실제 토큰 사용량 기준으로 종량제 방식입니다. OrcaRouter는 프롬프트나 응답을 캐싱하지 않으며, 각 요청은 독립적으로 처리됩니다. 처리량이 매우 높은 경우, 맞춤형 계약 가능성을 위해 OrcaRouter에 문의하세요. 비용 최적화를 위해 더 짧은 프롬프트 사용, 컨텍스트 효율적 재사용, 또는 호출 일괄 처리를 고려하세요. 이 모델은 캐싱 메커니즘이 없으므로 캐시 적중에 대한 할인 가격을 지원하지 않습니다.
$2.50/$10 per million tokens의 가격으로, 이 프리뷰는 표준 GPT-4o와 비슷한 가격대이지만 약간 다를 수 있습니다. 더 저렴한 대안으로는 openai/gpt-4o-mini (약 $0.15/$0.60 per million) 또는 gpt-3.5-turbo (대략 $0.50/$1.50)가 있습니다. 더 낮은 품질을 감수할 수 있는 작업의 경우, 이러한 모델은 상당한 비용 절감을 제공합니다. 프리뷰 모델의 비용은 OrcaRouter 카탈로그에서 높은 편에 속합니다. 테스트 용도로만 사용하는 경우, 요청량에 따라 중간 정도의 비용이 발생할 수 있습니다. 항상 예상 토큰 사용량을 평가하고 더 큰 모델 사용으로 인한 품질 향상과 비교하십시오.
이 모델을 사용하려면 API 클라이언트의 기본 URL을 https://api.orcarouter.ai/v1로 설정하고 모델 ID를 openai/gpt-4o-search-preview-2025-03-11로 지정하세요. OrcaRouter에서 발급한 API 키를 사용해야 합니다. API는 완전히 OpenAI와 호환되므로 OpenAI의 채팅 완료 엔드포인트용으로 작성된 기존 코드를 최소한의 변경만으로 사용할 수 있습니다. curl을 사용한 예시 호출: curl https://api.orcarouter.ai/v1/chat/completions -H "Authorization: Bearer YOUR_ORCAROUTER_KEY" -H "Content-Type: application/json" -d '{ "model": "openai/gpt-4o-search-preview-2025-03-11", "messages": [{"role": "user", "content": "Hello"}], "max_tokens": 100 }'.
OpenAI에서 지원하는 모든 표준 채팅 완료 파라미터를 사용할 수 있습니다: 'messages', 'max_tokens', 'temperature', 'top_p', 'frequency_penalty', 'presence_penalty', 'stop', 'n'. 이 모델은 128,000 토큰의 컨텍스트 윈도우를 지원하므로 'max_tokens'는 최대 16,384까지 설정할 수 있습니다. 'temperature'는 무작위성을 제어하며 값의 범위는 0에서 2까지입니다. 실시간 응답을 위해 'stream'이 지원됩니다. OrcaRouter는 추가적인 파라미터를 도입하지 않습니다. 요청이 토큰 제한을 준수하는지 확인하십시오; 컨텍스트 윈도우보다 긴 입력(응답 포함)은 잘리거나 오류를 반환합니다.
마이그레이션은 간단합니다. OpenAI 기본 URL(https://api.openai.com/v1)을 OrcaRouter의 기본 URL(https://api.orcarouter.ai/v1)로 바꾸십시오. API 키를 OrcaRouter 키로 변경하십시오. 모델 필드를 openai/gpt-4o-search-preview-2025-03-11로 업데이트하십시오. 다른 코드 변경은 필요하지 않습니다. 다른 OpenAI 모델을 사용하고 있었다면 동일한 코드 구조를 계속 사용할 수 있습니다. OrcaRouter는 모든 표준 매개변수를 그대로 전달합니다. 마이그레이션 후 응답이 일관되는지 확인하십시오. 청구는 OrcaRouter에서 처리되며, 해당 서비스에 계정이 필요합니다.
OrcaRouter는 이 프리뷰 모델에 대한 구체적인 요금 한도를 공개적으로 밝히지 않습니다. 가용성은 OpenAI의 인프라와 OrcaRouter의 게이트웨이 용량에 따라 달라집니다. 프로덕션 애플리케이션의 경우 모델의 프리뷰 상태와 잠재적인 불안정성을 고려하십시오. OrcaRouter는 남용을 방지하기 위해 합리적인 사용 한도를 적용할 수 있습니다. 최선의 서비스를 기대할 수 있지만, SLA는 제공되지 않습니다. 보장된 처리량이 필요한 경우 OrcaRouter에 문의하여 전용 옵션을 알아보십시오. 모델은 사전 통지 없이 제거되거나 대체될 수 있으므로 대체 모델을 계획하십시오.
표준 GPT-4o 모델(openai/gpt-4o)은 멀티모달(Multimodal)의 안정적인 릴리스인 반면, 이 프리뷰는 텍스트 전용이며 초기 테스트를 위한 것입니다. 프리뷰에는 표준 버전에 아직 포함되지 않은 향후 기능이 포함될 수 있지만, 신뢰성이 떨어질 수도 있습니다. 가격은 비슷합니다. 표준 모델은 더 넓은 입력 지원(이미지, 오디오)을 제공합니다. 프리뷰 기능이 필요하지 않다면 표준 GPT-4o가 더 안전한 선택입니다. 두 모델 모두 동일한 API 인터페이스를 통해 OrcaRouter에서 사용할 수 있어 전환이 쉽습니다.
Gpt-4o-mini는 간단한 작업에 최적화된 더 작고 저렴한 모델입니다. 입력 토큰 100만 개당 약 $0.15, 출력 토큰 100만 개당 약 $0.60(대략)의 비용이 듭니다. 이 미리보기 모델은 입력과 출력 모두 약 16배 더 비쌉니다. 미리보기 모델은 더 큰 컨텍스트(128K vs 128K?)를 제공합니다. 실제로 gpt-4o-mini도 128K를 가지고 있지만, 다를 수 있습니다. 이 모델이 128K인 것은 알고 있습니다. 공개된 정보에 따르면 gpt-4o-mini의 컨텍스트도 128K이지만, 추정할 수 없습니다. '비슷한 컨텍스트 윈도우'라고 말하겠지만 가격 차이에 유의하세요. 이 모델은 복잡한 추론에 더 적합한 반면, gpt-4o-mini는 많은 표준 작업에 충분합니다. 품질 요구 사항과 예산에 따라 선택하세요.
Claude 모델(예: Claude 3.5 Sonnet)은 큰 컨텍스트 윈도우와 강력한 추론 능력을 제공하지만, 해당 API는 OpenAI와 직접적으로 호환되지 않습니다. OrcaRouter는 여러 제공업체에 대한 통합 인터페이스를 제공하지만, 이 프리뷰는 OpenAI 전용입니다. Claude 모델은 안전성 및 장문 텍스트 생성과 같은 영역에서 다른 가격 책정과 강점을 가질 수 있습니다. 직접 비교를 위해서는 자체 사용 사례에서 테스트해야 합니다. OrcaRouter를 사용하면 제공업체 간 전환이 가능하지만, 이 프리뷰 모델은 OpenAI 경로를 통해서만 사용할 수 있습니다. 벤치마크 비교는 제공되지 않습니다.
OpenAI 호환 — 쓰던 SDK 그대로
https://api.orcarouter.ai/v1from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="openai/gpt-4o-search-preview-2025-03-11",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)max_tokensresponse_formatstreamstructured_outputsweb_search_options| 입력 / 1M tokens | $2.50 |
| 출력 / 1M tokens | $10.00 |
| 통화 | USD |
정가 기준 추정치
추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.
GET /api/public/models/openai/gpt-4o-search-preview-2025-03-11열기 @misc{orcarouter_gpt_4o_search_preview_2025_03_11,
title = {openai/gpt-4o-search-preview-2025-03-11 API},
author = {openai},
year = {n.d.},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11}
}openai. (n.d.). openai/gpt-4o-search-preview-2025-03-11 API. OrcaRouter. https://www.orcarouter.ai/models/openai/gpt-4o-search-preview-2025-03-11