
GPT-6 Sol vs Tencent HY4 Preview: 더 저렴한 모델이 600배의 트래픽을 감당하고 있다
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
프런티어 모델과 저렴한 모델의 비교는 대개 가격표에서 끝나지만, 이번 비교에는 더 나은 결말이 가능하다. Tencent HY4 Preview와 GPT-6 Sol은 둘 다 OrcaRouter에 의해 라우팅되며, 이는 동일한 텔레메트리가 둘 다를 포괄한다는 뜻이다. 그리고 동일한 7일 롤링 윈도에서 HY4 Preview 모델은 약 24억 토큰을 이동시킨 반면 GPT-6 Sol은 약 390만 토큰을 이동시켰다. 이것은 벤치마크가 아니고 판결도 아니다. 한 플랫폼 트래픽에 대한 롤링 윈도일 뿐이며, 다음 주에는 다르게 읽힐 것이다. 하지만 이는 강력한 오픈 웨이트 모델이 폐쇄형 모델 가격의 4분의 1일 때 무언가를 만드는 사람들이 실제로 무엇을 선택하는지에 대한 진짜 신호이며, 스펙 시트가 만들어낼 수 없는 종류의 숫자다.
이 두 모델은 또한 벤치마크가 무엇을 알려줄 수 있고 무엇을 알려줄 수 없는지를 보여주는 사례 연구이기도 하다. 2026년 9월 22일 OpenAI GPT-6 세대의 중간 티어로 출시된 GPT-6 Sol은 독립적인 Intelligence Index 점수를 보유하고 있다. 2026년 8월 28일 Tencent가 출시하고 오픈소스로 공개한 HY4 Preview는 Artificial Analysis 모델 페이지도, 제3자 지수도, 독립적인 작업별 비용 수치도 전혀 없다. 그것이 얼마나 잘 작동하는지에 관해 공개된 모든 내용은 Tencent 자체의 측정치다. 그 비대칭성이 HY4 Preview를 더 약한 모델로 만드는 것은 아니다. 그것은 HY4 Preview를 덜 검증된 모델로 만들 뿐이며, 이 둘은 서로 다른 주장이다.
대부분의 배포를 결정하는 두 가지를 포함한 사양
• 출력 가격 — GPT-6 Sol 백만 토큰당 $10.00 vs Tencent HY4 Preview 백만 토큰당 $2.50
• 입력 가격 — GPT-6 Sol 백만 토큰당 $2.00 vs Tencent HY4 Preview 백만 토큰당 $0.83
• 캐시된 입력 — GPT-6 Sol 백만 토큰당 $0.20 vs Tencent HY4 Preview 백만 토큰당 $0.04
• 가중치 — GPT-6 Sol 비공개, API 전용 vs HY4 Preview Apache 2.0으로 오픈소스 공개
• 입력 모달리티 — GPT-6 Sol 텍스트, 이미지 및 파일 vs HY4 Preview 텍스트 전용
• 컨텍스트 윈도 — GPT-6 Sol 1,050,000 토큰 vs HY4 Preview 1,048,576 토큰
• 최대 출력 — GPT-6 Sol 128,000 토큰 vs HY4 Preview 64,000 토큰
• 장기 요청 단계 — GPT-6 Sol 입력 토큰 272,000개 초과 시 전체 요청 가격을 $4.00 / $15.00로 재책정 vs HY4 Preview 카드에 단계 없음
• 아키텍처 — GPT-6 Sol 비공개 vs HY4 Preview 총 770B 파라미터, 활성 49B, 78개 레이어, 라우팅된 전문가 256개 + 공유 전문가 1개, 네이티브 다중 토큰 예측 레이어
• 독립 점수 — GPT-6 Sol Intelligence Index 47.6 vs HY4 Preview 게시된 점수 없음
• 측정된 출력 속도 — GPT-6 Sol 약 초당 244 토큰 vs HY4 Preview 약 초당 54, 둘 다 최근 7일 기준 수치
대부분의 실제 배포를 좌우하는 두 항목은 가장 아래쪽에 있습니다. 첫째는 HY4 Preview가 이미지나 파일 입력을 받지 않는다는 점으로, 이는 무언가를 봐야 하는 모든 파이프라인에서 이 모델을 제외시킵니다. 둘째는 출력 상한입니다. 64,000 토큰은 GPT-6 Sol의 128,000의 절반이며, 코딩 에이전트와 긴 도구 사용 체인을 위해 만들어졌다고 명시된 모델에서 팀이 가장 먼저 부딪히는 제약은 품질이 아니라, 생성된 파일이 더 이상 하나의 응답에 들어가지 않게 되는 지점입니다.
그에 비해, 출력 가격의 4분의 1과 캐시된 입력 가격의 5분의 1이면 재시도를 아주 많이 해볼 수 있다. 그리고 HY4 Preview의 아키텍처는 GPT-6 Sol의 아키텍처와 달리 문서화되어 있다: Tencent는 파라미터 수, 계층 수, 전문가 레이아웃, 추측 디코딩 계층을 공개했다. 이는 서빙 특성이 적어도 부분적으로는 API를 통해서만 관찰되는 것이 아니라 논문을 통해 예측 가능하다는 뜻이다.

HY4 Preview의 벤치마크 표가 실제로 무엇인지
Tencent가 공개한 수치는 강력하며, 모두 벤더가 직접 실행한 것이다. Terminal-Bench 2.1에서 이 모델은 85.4점을 기록하고, DeepSWE에서는 64.3점을 기록하며, 203개의 엔지니어링 과제에 걸친 내부 블라인드 평가에서는 GLM-5.3의 2.92와 Kimi K3의 2.94에 맞서 평균 2.99점을 기록했다 — Tencent가 설계한 연구에서 10점 척도상 0.07점 앞선 것이다. 또한 WebDev Arena 리더보드에 처음 등장했는데, Tencent는 이 모델이 전체 약 5위, 오픈웨이트 모델 중 3위에 올랐다고 보고한다. 아레나 결과는 벤더가 채점한 것이 아니라 대중 투표로 결정된 것이며, 이 세트에서 가장 독립적인 증거다. 나머지는 주장이며, 주장은 주장이라고 표시되어 있는 한 여전히 읽을 가치가 있다.
중요한 격차는 이 숫자들이 후하게 나왔을 수 있다는 점이 아니다. 벤더 하네스는 보통 양방향으로 그렇다. 중요한 것은 이 숫자들과 비교할 두 번째 측정값이 없다는 점이다. Artificial Analysis 페이지가 있는 모델은 확인할 수 있지만, 없는 모델은 확인할 수 없으며, 그 차이는 몇 달 뒤 누군가가 대표 수치가 다른 누구도 재현할 수 없는 하네스에서 측정되었다는 사실을 발견할 때 드러난다. 여기서 HY4 Preview에 그런 일이 벌어졌다고 시사하는 바는 없다. 다만 85.4에 기대는 도입 결정이 단일 출처에 기대고 있다는 뜻일 뿐이다.
실질적으로 말하자면, HY4 Preview는 표에서가 아니라 여러분의 자체 트래픽으로 평가해야 하며, 비용 구조상 그렇게 하는 것은 저렴합니다 — GPT-6 Sol의 출력 단가의 4분의 1이라면, 실제 프롬프트를 대상으로 일주일간 섀도 트래픽을 돌리는 비용이 API 등급 검토 한 번보다 적게 듭니다. 이것이 측정이 부족한 모델에 대한 올바른 실사 방식이며, 거의 아무도 실제로 하지 않는 방식이기도 합니다.
진짜 분수령인 오픈 웨이트 문제
HY4 Preview는 Apache 2.0에 따라 오픈소스로 공개되었으며, 기본 체크포인트와 함께 허용적 라이선스가 적용된 FP8 빌드도 제공됩니다. GPT-6 Sol은 폐쇄형이며 라이선스 파일이 없습니다. 라이선스를 부여할 대상 자체가 없기 때문입니다. 이 비교에서 다른 모든 항목은 트레이드오프이지만, 이 항목은 범주 차이입니다.
그것으로 얻는 것은 주로 더 저렴한 청구서가 아니다 — 출력 100만 개당 $2.50이라면 호스팅 API는 이미 대부분의 팀이 7,700억 개 매개변수 모델을 돌리는 데 드는 비용보다 낮고, 비용이 논거의 전부라면 관대한 라이선스는 요점에서 벗어난다. 그것으로 얻는 것은 누구의 엔드포인트에도 의존하지 않는 배포다: 속도 제한이 걸릴 수 없는 가중치, 보유한 하드웨어에 맞게 양자화할 수 있는 체크포인트, 파인튜닝할 수 있는 모델, 그리고 네트워크 경계 안에 머물 수 있는 트래픽. 이 네 가지 모두에 대한 GPT-6 Sol의 답은 그것들 중 어느 것도 필요하지 않아야 한다는 것이며, 이는 실제로 존재하는 일단의 팀들에게는 진짜 논거이고, 정말로 필요한 팀들에게는 무관한 논거다.
모달리티 구분과 라이선스 표기는 같은 방향을 가리키며, 이는 주목할 만하다. 텍스트만 읽고 Apache 2.0으로 배포되는 모델은 컴포넌트로 만들어졌다 — 당신이 통제하는 파이프라인 안에 넣고, 이미 정합성을 맞춘 텍스트를 공급하는 구성 요소 말이다. 텍스트, 이미지, 파일을 읽고 API로만 접근할 수 있는 모델은 진입점으로 만들어졌으며, 지저분한 입력을 직접 받는다. 이들은 서로 다른 일을 하며, 이들을 하나의 지표로 순위 매기는 비교는 어느 벤더도 묻지 않은 질문에 답하는 셈이다.

이들을 함께 제공하는 것, 그리고 트래픽 수치가 의미하는 바
두 모델 모두 200개가 넘는 다른 모델들과 함께 하나의 OrcaRouter 키 뒤에 있으며, 이 조합이 시사하는 라우팅 형태는 뻔한 것의 역방향입니다. HY4 Preview를 앞에 두세요 — 출력 기준으로 네 배 더 저렴한 모델이고, 아키텍처가 문서화된 모델이며, 우리 라우트에서는 부하를 담당하는 모델입니다 — 그리고 이미지 판독이 필요한 요청, 64,000개가 넘는 토큰을 출력해야 하는 요청, 또는 품질 검사를 통과하지 못한 요청을 위해 GPT-6 Sol을 그 뒤에 두세요. 이 구성은 애플리케이션 코드가 아니라 라우팅 DSL에 표현되므로, 둘 사이의 경계는 배포 없이 수정할 수 있는 규칙입니다.
속도 수치에는 단서가 하나 붙어야 하고, 그다음 결론이 나온다. HY4 Preview는 우리의 롤링 윈도우에서 대략 초당 54개의 출력 토큰으로 측정되는 반면 GPT-6 Sol은 대략 244개이며, 둘 다 통제된 벤치마크가 아니라 공유 인프라 관측치다 — 특히 텐센트 수치는 활성 파라미터 수가 매우 큰 모델을 반영하는데, 토큰당 활성 파라미터 490억 개는 출력 토큰당 상당한 연산량이다. 그래서 더 저렴한 모델이 훨씬 더 느리며, 이는 배치 파이프라인은 기꺼이 받아들이고 대화형 파이프라인은 그렇지 않은 바로 그 트레이드오프다. 텐센트의 호스팅 빌드는 2026년 9월 7일에 성능 최적화도 받았는데, 공급업체는 이것이 동일한 작업 품질에서 추론 턴과 작업당 토큰 소비를 줄인다고 말한다 — 또 하나의 공급업체 제시 수치지만, 더 빠른 스트림이 아니라 더 낮은 청구서를 예측하는 수치다.
페일오버는 어느 순서로든 페어링을 안전하게 만드는 요소입니다. 7700억 개 매개변수의 오픈 웨이트 모델은 둘 이상의 인프라 제공업체가 서비스하며, 폴백할 수 있는 경로는 성능이 저하된 호스트가 장애가 아니라 재시도 대상이 된다는 뜻입니다. 저희 카탈로그는 제공업체의 정가를 마크업 없이 그대로 전달하며, 이는 통화로 고시된 공급업체 요금을 기다릴 필요가 없다는 뜻이기도 합니다: Tencent는 HY4 Preview를 입력 100만 토큰당 6위안, 출력 100만 토큰당 18위안으로 책정하고 있으며, 저희 페이지에 표시되는 달러 수치는 재판매업체의 마진이 아니라 그 요금을 환산한 값입니다.

이 한 쌍이 실제로 무엇을 위한 것인지
대량 처리에는 Tencent HY4 Preview를 선택하세요. 직접 제어하는 텍스트 전용 파이프라인, 자체 하드웨어에서 실행해야 하는 모든 용도, 그리고 잘못된 답변을 잡아내고 재시도할 수 있는 모든 워크로드에 적합합니다 — 가격 덕분에 재시도는 여러분이 가진 가장 저렴한 품질 개선 수단이 됩니다. 입력이 이미지나 파일일 때, 하나의 응답이 64,000개가 넘는 토큰을 담아야 할 때, 또는 답변이 확인하지 않고 바로 행동에 옮기는 사람에게 전달될 때는 GPT-6 Sol을 선택하세요. 트래픽에 각 유형이 일부씩 포함되어 있다면 — 거의 확실히 그럴 테지만 — 둘 다 선택하세요.
마무리 점검 두 가지입니다. HY4 Preview는 여전히 프리뷰로 표기되어 있고 우리 카탈로그에서 가장 최신 Tencent 모델이므로, 이름이 낡은 것이 아니라 정확합니다. 다만 프리뷰는 예고 없이 바뀔 수 있고, 허용적 라이선스의 체크포인트는 경고도 없이 자체 최종 릴리스로 대체될 수 있습니다. 그리고 GPT-6 Sol은 이미 GPT-6.1 Sol로 대체되었습니다. 짧은 컨텍스트 요금은 동일하고 캐시 입력은 $0.20에서 $0.10으로 절반으로 줄었으며, OpenAI 자체 모델 페이지도 이제 독자들을 그쪽으로 안내합니다. Tencent 모델 대신 Sol을 저울질하는 이유가 통합된 지 8일밖에 되지 않았다는 점 때문이라면, 그 판단은 유효합니다. 이유가 역량 때문이라면, 가격을 따져야 할 대상은 후속 모델입니다.
이 글에서 비교한 모델2
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
