
GPT-6 Sol Pro vs DeepSeek V4 Pro: 정액제 대 시간표
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237지능
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248지능
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- grokNEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0345지능76코딩
GPT-6 Sol Pro와 DeepSeek V4 Pro는 현재 API를 통해 본격적인 추론 워크로드를 실행할 수 있는 가장 저렴하고 신뢰할 만한 두 가지 방식이며, 완전히 다른 원칙에 따라 가격이 책정됩니다. GPT-6 Sol — gpt-6-sol-pro 구성이 실행하는 벤더의 모델로, 2026년 9월 22일부터 일반 제공된 — 은 입력 토큰 100만 개당 $2.00, 출력 토큰 100만 개당 $10.00이며, 이는 매일 모든 시간대에 동일합니다. DeepSeek V4 Pro — 0813 체크포인트가 2026년 8월 13일 일반 제공에 도달한 오픈 가중치 플래그십 — 은 주중 대부분 $0.66와 $1.98이고, 평일 아침의 두 좁은 시간대에는 정확히 그 두 배입니다. 단일 요율을 인용하는 모든 비교는 가격의 절반만 인용하는 것입니다.
일정이 핵심이다. 이 맞대결에 관한 다른 모든 것 — 지수 점수, 컨텍스트 윈도우, 라이선스 조건 — 은 이 두 공급업체 중 하나가 자사의 정가를 시간의 함수로 만들기로 결정했다는 사실의 결과일 뿐이다.
각 가격 라인이 실제로 무엇인지
GPT-6 Sol의 요금표는 단 한 행입니다. 백만 토큰당 입력 $2.00, 캐시된 입력 $0.20, 캐시 쓰기 $2.50, 출력 $10.00이며, 입력 임계값을 초과하면 전체 요청에 적용되는 장문맥 요금 재조정이 있습니다. 시간 차원도 없고 프로모션 기간도 없습니다. OpenAI는 9월 22일 이전 모델의 가격을 이 수치로 인하했으며 이를 영구적이라고 설명했습니다.
DeepSeek의 요금표는 표 형식입니다. 공급업체 자체 가격 페이지에 기재된 내용은 다음과 같습니다:
• 비피크 시간대 입력 — 백만 토큰당 $0.66, 캐시 미스; 백만 토큰당 $0.022, 캐시 적중
• 비피크 시간대 출력 — 백만 토큰당 $1.98
• 최대 입력 — 백만 토큰당 $1.32, 캐시 미스; 백만 토큰당 $0.044, 캐시 적중
• 최대 출력 — 백만 토큰당 $3.96
• 피크 시간대 — 01:00–04:00 및 06:00–10:00 UTC, 월요일~금요일, 중국 공휴일 제외
• 그 밖의 모든 것 — 비첨두시간, 주말 전체 포함, 2026년 8월 23일 베이징 시간 자정에 발효된 규칙
168시간짜리 한 주에서 7일 중 5일 동안 하루 7시간의 피크가 발생하면, 이는 더 높은 요율로는 달력의 약 21%, 더 낮은 요율로는 약 79%에 해당한다. 따라서 DeepSeek V4 Pro의 정직한 단일 숫자 요약은 $0.66도, $1.32도 아니다 — 그 사이 어딘가이며, 그 위치는 벤더의 관대함이 아니라 트래픽의 형태에 달려 있다.
이 표가 나온 리프라이싱
이 구조가 얼마나 최근에 생긴 것인지 알아 둘 가치가 있습니다. 거의 모든 비교 페이지가 여전히 그것이 대체한 숫자를 인용하고 있기 때문입니다. 2026년 5월 22일, DeepSeek는 V4 Pro의 한시적 할인을 영구 가격으로 전환했습니다 — 약 75% 인하로, 백만 토큰당 입력 약 $0.435, 출력 약 $0.87입니다.
2026년 8월 17일 베이징 시간 자정에, 그건 뒤집혔고 그 이상이었다. 피크/오프피크 시스템이 시행되었는데, 영향을 받은 행 전체의 평균 인상 폭은 약 3.5배, 최대 12배였다 — 12배는 정확히 캐시 적중 입력 요율에 해당했으며, 이는 피크 시간대 백만 토큰당 ¥0.025에서 ¥0.30으로 올랐다. 캐시 미스 입력은 약 200%, 출력은 약 350% 상승했다. 6일 후 주말 예외 조치가 추가되어, 배치 작업을 옮길 수 있는 사람이라면 누구나 그중 일부를 되돌려받을 수 있게 되었다.
두 가지 결과가 뒤따른다. 첫째, DeepSeek V4 Pro가 1달러 미만 모델이라고 말하는 페이지는 두 번이나 대체된 요금표를 인용하고 있는 것이다. 둘째, 인상의 양상은 DeepSeek가 무엇을 최적화하고 있는지에 대한 신호다. 비례적으로 가장 큰 상승은 캐시 적중 요율에서 나타나며, 이는 애초에 이 모델을 매력적으로 만든 바로 그 워크로드 — 안정적인 프리픽스를 계속 다시 보내는 긴 에이전트 루프 — 에 가장 중요한 요율이다.

모두가 인용하고 있는 그 지수 번호는 폐기되었다
Artificial Analysis는 이 비교를 위한 중립적인 하네스이며, 2026년까지 Intelligence Index의 버전을 여러 차례 갱신해 왔습니다. 현재 리더보드에서 GPT-6 Sol은 최대 노력 설정에서 48점을 기록하며 인덱스 작업당 $1.06입니다. DeepSeek V4 Pro는 0813 체크포인트에서 최대 노력 설정 기준 36점을 기록하며 인덱스 작업당 $0.67입니다.
DeepSeek에 대해 떠도는 수치는 53이다. 그 수치는 실제이며 공개된 적이 있다 — 대부분 모델의 점수를 바꾼 버전 재조정 이전, 인덱스의 이전 개정판에서. v4.3 이전 기사에서 가져온 53을 현재의 48과 비교하는 것은 폐기된 측정값을 현행 측정값과 비교하는 것이며, 이는 이 맞대결에서 가장 흔한 단일 오류를 낳는다: 두 모델이 1점 차이 안에 있다는 주장이다. 현재 인덱스에서 두 모델은 12점 차이가 나며, 완료된 작업당 가격 격차는 헤드라인 요율이 시사하는 3배가 아니라 1.6배에 더 가깝다. DeepSeek이 답에 도달하는 데 더 많은 토큰을 쓰기 때문이다.
그 옆에는 또 다른 두 개의 독립적인 데이터 포인트가 있으며, 둘 다 각각 무엇을 나타내는지 표시되어 있다. Vals AI는 격리된 하네스를 실행해 DeepSeek V4 Pro를 SWE-bench Verified에서 96.40%, 테스트당 $0.103으로 평가한다 — 해당 보드에서 Claude Opus 5의 97.00%에 이어 2위이며, 테스트당 비용은 큰 차이로 저렴하다. Artificial Analysis의 코딩 에이전트 보드는 Terminal-Bench 4.0에서 14%를 보여주며, 이는 GPT-6 Sol의 44%와 대비된다. 첫 번째 수치는 DeepSeek가 좁고 잘 정의된 하나의 코딩 작업에서는 경쟁력이 있다는 것을 말한다. 두 번째 수치는 에이전트형 터미널 작업에서는 경쟁력이 없다는 것을 말한다. 둘 다 사실이며, 서로 다른 것을 측정하고 있다.
두 모델이 단순히 가격만 다른 것이 아니라 구조적으로 다른 경우
• 라이선스 — GPT-6 Sol은 가중치가 없는 비공개 API입니다; DeepSeek V4 Pro는 MIT 라이선스이며 Hugging Face에 공개 체크포인트가 있고, 지속적 사전 학습을 위한 기본 변형도 포함합니다.
• 최대 출력 — GPT-6 Sol 128,000 토큰 vs DeepSeek V4 Pro 384,000 토큰, 상한선은 3배, 출력 속도는 5분의 1
• 컨텍스트 창 — GPT-6 Sol 1,050,000 토큰 vs DeepSeek V4 Pro 1,048,576 토큰, 사실상 동일
• 모달리티 — 텍스트 입력과 텍스트 출력 모두 지원; API에서는 둘 다 이미지를 지원하지 않습니다
• 장문 컨텍스트 가격 책정 — GPT-6 Sol은 입력 임계값을 초과하면 요청 전체의 가격을 다시 산정합니다. DeepSeek V4 Pro의 피크/오프피크 요금제는 이 모델이 가진 유일한 가격 체계입니다.
• 규모 — DeepSeek V4 Pro는 토큰당 490억 개의 활성 매개변수를 사용하는 1.6조 개 매개변수의 전문가 혼합(mixture-of-experts) 모델입니다; OpenAI는 GPT-6 Sol에 대해 비교 가능한 수치를 공개하지 않습니다.
매개변수 수에 관한 한 가지 주의사항이 있습니다. 이는 자주 혼란을 일으키는 원인이기 때문입니다. 일부 목록에 나타나는 1.7조라는 수치는 선택적 DSpark 추측 디코딩 모듈이 포함된 Hugging Face 패키지 크기이지, 더 큰 대상 모델이 아닙니다. 공개된 아키텍처는 총 1.6T입니다. 반올림된 배지 수치를 빼서 드래프트 모듈의 크기를 추론하는 것은 유효한 계산이 아니며, 더 큰 숫자를 모델이 커졌다는 증거로 해석하는 것도 마찬가지입니다.

오픈 웨이트를 지지하는 진짜 논거가 되는 철회
2026년 9월 9일, DeepSeek은 V4 Pro를 단계적으로 종료한다고 발표했으며, 9월 14일 04:00 UTC부터 deepseek-v4-pro 모델 문자열에 대한 모든 요청이 DeepSeek V4.1 Flash로 라우팅되고 Flash 요금으로 청구될 것이라고 밝혔다. 이는 V4.1 Pro 모델이 출시될 때까지 계속된다. 모델 문자열은 여전히 응답하겠지만, 그 뒤에 있는 모델은 누구도 벤치마크한 적 없는 모델이 될 것이다.
개발자들이 반발했고, 리디렉션은 철회되었습니다. 이제 DeepSeek의 변경 로그에는 V4 Pro API 서비스가 9월 14일 이후에도 계속되고 요금 청구는 변경되지 않는다고 나와 있으며, 가격표에는 여전히 deepseek-v4-pro가 자체 요율을 가진 활성 행으로 등록되어 있고 종료 태그도 없습니다. 이전 공지 페이지에는 여전히 라우팅 관련 문구가 남아 있어 두 문서가 서로 모순됩니다. 그리고 실제로 호출할 때 실제로 벌어지는 일을 설명하는 쪽은 라이브 가격 페이지입니다.
그 에피소드는 이번 전체 맞대결에서 가장 강력한 논거이며, 그것은 가격 논거가 아니다. 클로즈드 모델은 공급업체의 일정에 따라 가격이 재책정되거나, 라우팅이 변경되거나, 서비스가 종료될 수 있고, 유일한 대응책은 마이그레이션하는 것뿐이다. 공개 저장소에 MIT 가중치가 있는 모델은 자체 인프라에서 서빙할 수 있으며, 이는 평가한 체크포인트를 6주 뒤 공급업체의 로드맵이 무엇을 말하든 계속 서빙하게 된다는 뜻이다. DeepSeek는 같은 2주 안에 위험을 입증하고 완화책까지 제공했다.
솔직한 균형추는 1.6조 파라미터 모델을 자체 호스팅하는 것이 대부분의 팀이 가볍게 내리는 결정이 아니라는 점입니다. 그것은 실질적인 고정 비용이 따르는 진짜 선택지이지, 공짜 헤지가 아닙니다.
라우팅 계층이 계산 방식을 바꾸는 경우
DeepSeek V4 Pro가 OrcaRouter 카탈로그에 등록되어 있습니다. 현재 체크포인트와 기본 모델 문자열이 모두 해석됩니다 — deepseek/deepseek-v4-pro-0813 및 deepseek/deepseek-v4-pro — 동일한 UTC 일정에 따라 피크 배수가 적용되는 비피크 정가 요율, 1,048,576토큰 컨텍스트 윈도우, 384,000토큰 출력 상한, 그리고 자체 모델 페이지에서 측정한 첫 토큰까지의 p50 시간 3.56초를 제공합니다. 제공업체 정가가 추가 마크업 없이 그대로 전달되는데, 이 경우 피크/비피크 경계가 DeepSeek에 적용되는 바로 그 순간에 고객님의 청구서에도 적용된다는 의미입니다.
GPT-6 Sol은 우리의 경로 중 하나가 아니므로, 여기에는 우리를 통한 해당 가격에 대한 어떠한 주장도 없습니다.

여기서 단일 엔드포인트를 쓸 만하게 만드는 것은 바로 이 스케줄입니다. 이동할 수 있는 워크로드는 그렇지 않은 워크로드보다 두 배의 가치가 있으며, 그것을 옮기는 일은 라우팅 결정이지 마이그레이션이 아닙니다 — 같은 키, 같은 요청 형태, 다른 시간대 또는 그 뒤에 있는 다른 모델일 뿐입니다. DeepSeek V4 Pro를 DeepSeek V4.1 Flash와 하나의 엔드포인트에 짝지어 두는 것은 그보다 더 예리한 형태입니다. Flash 모델은 동일한 컨텍스트 윈도우와 동일한 피크 시간대에서 V4 Pro의 비피크 요금보다 입력이 4.4배, 출력이 3.3배 저렴하므로, 더 큰 모델이 전혀 필요 없는 트래픽이 자연스럽게 향할 목적지가 됩니다. 자동 페일오버는 언제나 그렇듯 같은 이유로 중요합니다 — 파이프라인이 기반으로 삼고 있는 저렴한 티어가 단일 장애점이 되어서는 안 됩니다.
의사결정 규칙
• 예약할 수 있는 배치 및 오프라인 작업 — DeepSeek V4 Pro, 그리고 예약하세요. $0.66와 $1.98로 캘린더의 95%를 제공하고 주말은 전부 오프피크인 이 요금은, 이 보드에서 입력 기준 3배, 출력 기준 5배 더 저렴한 가장 믿을 만한 최저 요금입니다.
• 피크 시간대에 걸리는 지연에 민감한 인터랙티브 트래픽 — GPT-6 Sol. 고정 $2.00 및 $10.00은 DeepSeek의 오프피크 요금보다 비싸고 아무것도 아닌 것보다 저렴하지만, 사전에 알 수 있으며, 하루 두 시간 동안은 출력 기준으로 둘 중 더 저렴하다.
• 크고 안정적인 프리픽스가 있는 에이전트 루프 — 선택하기 전에 캐시 적중 계산을 돌려 보라. DeepSeek의 캐시 적중 입력은 오프피크에 $0.022로, GPT-6 Sol의 $0.20의 9분의 1이지만, 피크 시간대에 DeepSeek가 12배로 인상한 항목이기도 하다. 이점은 실재하며 시간대에 좌우된다.
• 규제 대상인 모든 것, 또는 경로가 변경되는 것을 감수할 수 없는 모든 것 — MIT 체크포인트에서 자체 호스팅하는 DeepSeek V4 Pro. 9월의 철수가 그 사례 연구이며, 이는 어떤 토큰당 비교보다도 고정 비용을 받아들이는 더 나은 이유다.
• 에이전틱 범위의 최상단이 필요한 모든 작업 — GPT-6 Sol. 지수 12포인트와 Terminal-Bench 30포인트는 단순한 반올림 차이가 아니며, DeepSeek가 자체 보고한 수치로도 이 격차를 좁히지 못한다.
정액 요금제와 시간표는 둘 다 정직한 가격 설계입니다. 두 방식은 서로 다른 질문에 답할 뿐입니다. 하나는 토큰의 가격이 얼마인지 알려주고, 다른 하나는 필요할 때 토큰의 가격이 얼마인지 알려줍니다.
이 글에서 비교한 모델3
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
