생성된 히어로 카드의 제목은 'GPT-6 Sol vs GPT-5.6 Sol', 헤드라인은 'Index 1포인트 차이, 절반 가격'이며, 두 모델의 카드에는 AA Index가 48 대 47, 가격이 $2.00/$10.00 대 $4.00/$20.00로 표시되어 있고, OrcaRouter 로고가 오른쪽 아래에 있습니다.
Guides & Insights

GPT-6 Sol vs GPT-5.6 Sol: 인덱스 포인트 하나, 절반의 가격, 그리고 아무도 발표하지 않은 회귀

작성자

Elias Hawthorne

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

그렇다, 업그레이드하라 — 하지만 그 전에 두 번째 문단을 읽어라. 2026년 9월 22일 출시된 GPT-6 Sol은 Artificial Analysis의 Intelligence Index에서 48점을 받는다. 2026년 7월 9일 출시된 GPT-5.6 Sol은 47점이다. 1점 차이다. 그것을 대체한 모델은 비용이 절반이다: 입력 100만 개당 $2.00, 출력 100만 개당 $10.00로, $4.00 및 $20.00에 맞선다. 표면적인 수치만 보면 이것은 현재 라인업에서 가장 쉬운 업그레이드 결정이며, 가격 인하는 실제이고 영구적이며, 공급업체가 플래그십에 단행한 최대 단일 인하이다.

Artificial Analysis의 GPT-6 Sol 자체 평가는 깔끔한 한 단계 상승이라기보다 개선과 퇴보가 뒤섞인 결과를 찾아냈습니다. GDPval-AA v2.1에서 퇴보가 있습니다. 또한 272,000 입력 토큰 초과 구간에는 장문맥 재가격 티어가 있어 입력 요율을 대략 두 배로 올리고 출력은 절반가량 인상합니다. 그리고 272K는 GPT-5.6 Sol이 공표된 강점을 지닌 바로 그 구간입니다. 청구서를 그대로 절반으로 줄이는 것처럼 보이는 마이그레이션도 장문맥 트래픽에서는 성능상 트레이드오프가 붙은 채 거의 본전에 가까운 결과가 될 수 있습니다.

1포인트 Index 상승이 실제로 의미하는 것

두 모델 모두 동일한 보드, 버전 4.3.2에서 측정되었으며, 이는 전체 GPT-6 Sol 시리즈에서 가장 깔끔한 비교입니다 — 하네스 차이도, 공급업체와 독립 평가 간 불일치도 없고, 한 연구소가 한 공급업체의 두 모델을 측정한 것입니다.

• AA Intelligence Index — GPT-6 Sol 48, 212개 중 18위 vs GPT-5.6 Sol 47, 212개 중 19위

• Index 작업당 비용 — GPT-6 Sol은 GPT-5.6 Sol의 약 절반

• 출력 속도 — GPT-6 Sol 초당 104.4 토큰 vs GPT-5.6 Sol 초당 72.6 토큰

• 첫 토큰까지 걸리는 시간 — GPT-6 Sol 107.18초 vs 더 빠른 GPT-5.6 Sol, 둘 모두 3.87초 보드 중앙값 대비

• 입력 가격 — GPT-6 Sol 1M당 $2.00 vs GPT-5.6 Sol 1M당 $4.00

• 출력 가격 — GPT-6 Sol 1M당 $10.00 vs GPT-5.6 Sol 1M당 $20.00

• 캐시된 입력 — GPT-6 Sol, GPT-5.6 Sol 대비 약 90% 할인, 100만 개당 $0.40

• 배치 요금 — GPT-6 Sol 미공개 vs GPT-5.6 Sol $2.50 / $15.00

• 롱 컨텍스트 등급 — GPT-6 Sol은 272K 입력 초과 시 가격이 재책정되지만, GPT-5.6 Sol에는 이에 상응하는 단계가 없음

• 컨텍스트 윈도우 — AA 기준 GPT-6 Sol 872K, 주장 1.05M vs GPT-5.6 Sol 대략 1.05M~1.1M

• 최대 출력 — 양쪽 모두 128K

• 출시됨 — GPT-6 Sol 2026-09-22 vs GPT-5.6 Sol 2026-07-09

A generated two-column scoreboard titled 'GPT-6 Sol vs GPT-5.6 Sol — the scoreboard'. Left column GPT-6 Sol: Input $2.00 per 1M, Output $10.00 per 1M, AA Index 48, Speed 104.4 tok/s, Long context 'reprices above 272K', Released 2026-09-22. Right column GPT-5.6 Sol: Input $4.00 per 1M, Output $20.00 per 1M, AA Index 47, Speed 72.6 tok/s, Long context 'no step', Released 2026-07-09. Footer: 'Both measured by Artificial Analysis, Index v4.3.2.'

두 개의 속도 선을 함께 보세요. GPT-6 Sol은 이전 모델보다 약 44% 더 빠르게 출력을 생성하지만, 첫 토큰을 생성하는 속도는 훨씬 느립니다 — 107.18초로, 보드 중앙값 3.87초와 대비됩니다. GPT-5.6 Sol도 보드 기준으로 빠른 모델은 아니지만, 그 정도 영역은 아닙니다. 대화형 제품을 위해 GPT-5.6 Sol로 마이그레이션했다면, GPT-6 Sol은 그대로 대체할 수 있는 모델이 아니며, 이는 어떤 벤치마크와도 무관한 기능적 퇴행입니다.

조용히 유리한 대목이 하나 있다: GPT-6 Sol의 표준 요금 $2/$10은 GPT-5.6 Sol의 배치 요금 $2.50/$15를 밑돈다. 구형 모델의 할인 티어조차 신형 모델의 정가보다 비싸다. 이는 이번 인하가 프로모션이 아니라 구조적이라는 가장 강력한 증거다.

흥미로운 부분은 회귀입니다.

Artificial Analysis는 GPT-6 Sol이 작업당 비용을 대략 절반으로 줄이는 동시에 개선과 퇴보가 뒤섞인 결과를 내놓았다고 밝혔다. GDPval-AA v2.1이 명시된 퇴보 사례다. 이와 별개로, OpenAI의 GPT-5.6 Luna도 Coding Agent Index에서 퇴보했다 — 이는 한 모델의 고립된 실수가 아니라 이 세대 전반의 패턴임을 시사한다.

이것은 독립적인 발견이라는 바로 그 점 때문에 진지하게 받아들일 가치가 있다. OpenAI의 출시 자료는 과제당 비용과 자사가 선별한 벤치마크 행들을 중심으로 구성되어 있다. Artificial Analysis는 판매할 제품이 없으며 자사 하네스가 산출한 결과를 보고한다. 종합 점수에서 더 저렴하고 대략 동등하지만 특정 하위 과제들에서는 측정 가능하게 더 나쁜 모델은 엄밀히 더 나은 모델이 아니다. 그것은 프런티어 위의 다른 지점이다.

그것의 실무적 해석은 이렇습니다: 당신의 워크로드가 GDPval-AA 형태에 크게 치우쳐 있다면 — 경제적으로 가치 있는 지식 노동, 그 벤치마크가 값을 매기도록 만들어진 종류의 과업 — 1점의 종합 점수 상승은 당신에게 충분하지 않으며, 중요한 숫자는 회귀입니다. 당신의 워크로드가 일반적이라면, 작업당 비용이 절반으로 줄어든 것이 중요한 숫자이고, 종합 점수는 당신이 측정 가능한 무엇도 포기하지 않았다고 말해줍니다.

GPT-5.6 Sol이 여전히 앞서는 분야

GPT-5.6 Sol에는 공개된 장문맥 검색 결과가 있는데, GPT-6 Sol은 이에 상응하는 어떤 결과로도 필적하지 못합니다: MRCR v2, 8-needle, 256K-to-512K 범위에서 91.5%. 이는 GPT-6 Sol의 요금표가 바뀌는 구간에 해당하는 검색 정확도 수치입니다.

두 사실을 나란히 놓고 보세요. 입력 토큰이 272,000개를 넘으면 GPT-6 Sol의 전체 요청은 입력 약 $4, 출력 약 $15로 다시 책정됩니다. 이는 입력에서는 GPT-5.6 Sol의 예전 요율과 거의 같고, 출력에서는 그 요율의 4분의 3에 해당합니다. 따라서 마이그레이션을 통해 얻으려던 50% 절감은 입력에서 약 0%, 출력에서 25%로 축소됩니다. 바로 GPT-5.6 Sol은 문서화된 강점을 갖고 GPT-6 Sol은 공개된 대응 강점이 없는 컨텍스트 범위에서 말입니다.

GPT-5.6 Sol의 다른 공개된 결과들은 여전히 상당한 수준이며, 일부 팀이 옮겨가지 않는 이유이기도 합니다:

• 에이전트의 마지막 시험 — GPT-5.6 Sol 53.6

• Terminal-Bench 2.1 — GPT-5.6 Sol 88.8 / 88.0

• SWE-Bench Pro — GPT-5.6 Sol 64.6

• OSWorld 2.0 — GPT-5.6 Sol 62.6

• BrowseComp — GPT-5.6 Sol 90.4

• GDPval-AA v2 — GPT-5.6 Sol 1747.8 Elo

• HLE — GPT-5.6 Sol 49.5

• MRCR v2, 8-needle — GPT-5.6 Sol은 256K~512K에서 91.5%

이것들은 OpenAI가 보고한 수치입니다. BrowseComp의 90.4와 MRCR 수치가 대체하기 가장 어려운 두 가지라는 점에 유의하세요. 웹 리서치 에이전트와 장문맥 검색은 공개된 수치가 있는 두 달 된 모델이 대응하는 측정치가 없는 새 모델보다 더 안전한 선택인 워크로드입니다.

GPT-6 Sol이 요율표에 없는 것을 제공하는 것

가격이 핵심이지만, 세 가지 다른 변화도 있었다.

먼저, 컨텍스트 상한이다. GPT-6 Sol은 Artificial Analysis에서 872,000토큰으로 기재되어 있는 반면, OpenAI 자료의 다른 곳에서는 1.05M을 주장하며, 최대 입력은 922K이다. GPT-5.6 Sol은 출처에 따라 약 1.05M에서 1.1M 사이에 있다. 문서상으로는 사용 가능한 윈도우가 약간 후퇴한 셈이다 — 단, 비용을 좌우하는 것은 상한이 아니라 272K 티어 경계라는 점을 전제로 한다.

둘째, 가용성입니다. GPT-6 Sol은 API와 Plus, Pro, Business, Enterprise, Edu의 ChatGPT Work 및 Codex에서 사용할 수 있으며, Enterprise 관리자는 사용자가 보기 전에 이를 활성화해야 합니다. ChatGPT Chat에는 없습니다. GPT-5.6 Sol은 더 광범위하게 출시되었습니다. 팀의 접근 경로가 Enterprise 관리자를 거친다면, 마이그레이션은 단순한 코드 변경이 아닙니다.

셋째, 새로운 플래그십이 출시되면 일반적으로 기존 플래그십은 은퇴하는 것이 아니라 더 저렴한 대체 모델이 됩니다. $4/$20의 GPT-5.6 Sol은 Index에서 47점을 기록한 여전히 뛰어난 모델이며, 장문 컨텍스트 검색 작업에서는 GPT-6 Sol에는 없는 공개된 수치를 보유하고 있습니다.

보기보다 비용이 적게 드는 마이그레이션

이번 특정 업그레이드가 쉬운 이유는 두 모델이 같은 벤더, 같은 API 형태를 사용하고 랭킹에서 인접해 있기 때문입니다. 즉, 마이그레이션이 재설계가 아니라 모델 문자열 변경에 불과하며, 폴백 경로는 이미 여러분의 코드에 들어 있습니다. GPT-5.6 Sol은 OpenAI의 정가로 OrcaRouter에서 제공되며, 리셀러가 재협상한 뒤가 아니라 같은 날 우리 쪽에서 OpenAI의 가격 변경이 실제 반영되게 하는 패스스루 모델을 따릅니다.

이 글을 쓰는 시점에 GPT-6 Sol은 우리 카탈로그에 없습니다 — OpenAI 자체 API를 통해 접근할 수 있습니다. 따라서 마이그레이션의 솔직한 형태는 동일한 키 뒤에 GPT-5.6 Sol을 둔 라우트: 새 트래픽을 GPT-6 Sol로 보내고, 이전 모델은 구성 변경 하나만 거리에 두며, 자동 페일오버가 새 플래그십의 가용성이 아직 안정화되는 기간을 커버하도록 하는 것입니다. 이틀 된 모델에, 앞에는 Enterprise 활성화 토글이 있고 272K 토큰 초과 시 경제성을 바꾸는 장문 컨텍스트 티어가 있는 상황에서, 이전 세대를 여전히 연결해 두는 것은 신중함이 아닙니다 — 그것은 나쁜 오후와 나쁜 한 주 사이의 차이입니다.

A screenshot of the Artificial Analysis page for GPT-6 Sol (max), showing an Intelligence rank of 18th of 212 models, a Cost rank of 49th and a Verbosity rank of 43rd, input pricing of $2.00 and output of $10.00 per 1M tokens with a 90% cache discount, a cost per Intelligence Index task of $1.06, an 872k-token context window, 77M tokens generated during the index run, and a total of $1,550.08 spent evaluating the model on the Intelligence Index.

마이그레이션 체크리스트

무엇보다도 먼저 실제 컨텍스트 분포를 측정하세요. 요청의 95번째 백분위수가 272,000 입력 토큰 미만이라면 마이그레이션하세요 — 절감액은 청구서 양쪽에서 진정한 50%이고, 작업당 비용은 절반으로 줄며, 종합 지수는 아무것도 포기하지 않았다고 말합니다. 트래픽의 상당한 비중이 그 선을 넘는다면 해당 티어를 신중하게 모델링하세요: 대략 $4/$15에서는 GPT-5.6 Sol의 $4/$20 대비 출력에서 25%의 이점이 있고 입력에서는 이점이 없으며, 문서화된 장문 컨텍스트 검색 결과를 잃는 대가로 그 비용을 지불하는 것입니다.

누군가 첫 토큰을 기다리고 있는지 확인하세요. 107초는 보드 중앙값의 약 28배이며, 프로덕션에서 가장 먼저 드러날 실패 모드입니다. 반대편에 사람이 있는 모든 것은 GPT-5.6 Sol에 그대로 두거나 다른 곳으로 라우팅해야 합니다.

그런 다음 활성화 경로를 확인하세요. 엔터프라이즈 요금제에서는 관리자가 GPT-6 Sol을 켜야 하며, ChatGPT Chat에는 아예 없습니다. 내부적으로 마이그레이션을 공지하기 전에 사용자들이 실제로 접근할 수 있는지 확인하세요.

마지막으로, 첫 달 동안 자체 평가에서 GDPval-AA v2.1을 주의 깊게 지켜보세요. 독립 연구소가 그 부분에서 성능 저하를 발견했으며, 종합 점수가 1점 상승했다고 해서 특정 작업 세트가 올라갔는지 내려갔는지는 알 수 없습니다. 전환한 후가 아니라 전환하기 전에 두 모델 모두에서 평가를 실행하세요.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol), showing the Vision, Tools, JSON and Reasoning badges, a 1.05M-token context with 128K maximum output and text + image + file input, list pricing of $4.00 input and $20.00 output per 1M tokens, and the description of GPT-5.6 Sol as the flagship of OpenAI's GPT-5.6 series, strong at command-line and multi-file coding tasks.

이 글에서 비교한 모델1

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트