
Claude Opus 5.5 vs GPT-6.1 Sol: 5배 구독 가치 격차, 측정 결과
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 150 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 127 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 202 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 229 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
월 200달러로 Claude Max 20x 시트 하나 또는 ChatGPT Pro 200 시트 하나를 구입할 수 있습니다. 동일한 에이전트 워크로드에서 둘 중 하나는 월 $11,726 상당의 자사 API 환산 토큰을 돌려주고 다른 하나는 $2,084를 돌려줍니다 — 5.6배 격차: Claude Opus 5.5와 GPT-6.1 Sol. 이 뉴스를 만드는 것은 그 모델들 중 어느 것도 아니고, 둘 다 새로운 것도 아닙니다: Claude Opus 5.5는 2026년 9월 22일에, GPT-6.1 Sol은 2026년 9월 29일에 출시되었으므로, 모델 자체는 각각 2주와 1주 된 것입니다. 새로운 것은 이들을 실행하는 구독 경제성에 이제 측정된 숫자가 붙는다는 점이며, SemiAnalysis가 2026년 10월 5일 — 이 글보다 하루 전 — 에 발표했습니다. 이 회사가 공급업체가 공개하지 않는 한도에 가격을 매기는 방법을 개발한 뒤였습니다.
이 헤드라인 수치는 10월 5일 저녁부터 X에서 회자되고 있는데, 대개 그 단서들은 빠진 채로 돌아다닌다. 그래서 단서들을 먼저 밝힌다. 그 숫자는 단서 없이는 무의미하기 때문이다. 아래 차트의 모든 값은 다른 누군가의 비공개 계측기를 한 연구 매체가 모델링한 결과로, 정의된 워크로드 형태에서 측정되어 범위로 보고된 것이지 감사를 거친 벤치마크가 아니다. 요금제 가격은 벤더가 자체적으로 공개한 정가다. 뒤에서 언급되는 성능 점수는 Artificial Analysis의 것으로, 명시된 구성에서 측정된 것이다. 그리고 이 전체 비교는 구독 — 나름의 규칙을 지닌 과금 방식 — 에 관한 것이지, 두 모델의 토큰당 비용에 관한 것이 아니다. 그건 답이 다른 별개의 질문이다.
내부를 볼 수 없는 플랜의 가격을 어떻게 책정할까
Anthropic과 OpenAI 모두 구독 사용량을 가격이 아니라 백분율 게이지로 표시한다. 5시간 창과 주간 한도가 있고, 요청별 청구서는 없다. 두 공급업체는 자사 다른 요금제 대비 배수로 등급을 구분한다 — Claude의 Max 5x와 Max 20x는 Pro 대비 위치를 그대로 따서 이름 붙여졌고, ChatGPT의 등급도 같은 방식으로 광고되었지만, OpenAI가 가격 페이지에서 상대적 사용량 문구를 삭제하기 전까지는 그랬다.
따라서 같은 플랜이라도 어느 모델에 사용하느냐에 따라 가치가 달라집니다. 캐시된 입력 토큰이 소비하는 크레딧과 출력 토큰이 소비하는 크레딧은 벤더가 API에서 청구하는 것과 같은 비율로 가격이 책정되지 않기 때문입니다. 이것이 이번 작업의 핵심 명제입니다. 플랜이 그 자체로 $X의 가치가 있다고 말할 수는 없습니다. 플랜과 모델, 워크로드를 함께 봐야 합니다.
SemiAnalysis의 방법은 설명할 가치가 있다. 그 방법이 숫자에 얼마나 무게를 실을 수 있는지를 결정하기 때문이다. 이 회사는 한 번에 한 가지 토큰 유형을 분리해내도록 설계된 반복 호출을 실행한다 — 전쟁과 평화의 일부(캐시되지 않은 입력의 경우 호출마다 임의 태그를 붙임), 캐시 쓰기의 경우 캐싱 대상으로 표시한 동일한 프롬프트, 캐시 읽기의 경우 고정 태그, 출력을 강제하기 위한 긴 기술 에세이를 사용한다. 각 호출은 공급업체가 청구한 토큰과 사용량 미터의 위치를 기록한다. 단일 요청은 미터를 거의 움직이지 않으므로, 이들은 단계 단위로 측정한다. 두 번의 미터 이동 사이의 토큰 합계가 미터 한 단위의 비용을 제공하고, 양 끝의 부분 단계는 버려지며, 범위가 ±5% 이내에 들 때까지 단계가 누적된다. 5억 토큰을 지나도 미터를 움직이지 않는 캐시 읽기는 무료로 간주된다. 그다음 워크로드 구성은 이 회사 자체의 9월 사용 비율에서 나오며, 값은 그렇게 산출된 토큰 용량에 각 토큰 유형별로 공급업체가 공개한 API 가격을 곱한 것이다.
방법론 섹션에서 가장 흥미로운 발견은 어느 한쪽 랩의 관대함에 관한 것이 아니다. 검증 과정에서 SemiAnalysis는 동일한 요금제로 테스트한 세 계정 중 하나가 다른 두 계정보다 한도가 약 20% 낮다는 사실을 발견했다 — 더 오래된 계정이었다. 제공업체는 한도에 대한 "극도로 작은" A/B 테스트였음을 확인했고, 한도를 전면적으로 삭감한 것은 아니라고 강조했다. 그 사실의 양쪽 모두가 중요하다: 이는 구독 한도가 언제든 조용히 변경될 수 있음을 증명하고, 그런 일이 일어날 때 20% 변동을 감지할 만큼 이 방법이 민감하다는 것을 증명한다.
$200, $100, $20에서 각 티어가 반환하는 것
세 가지 티어, 두 랩 모두, 에이전트 워크로드, 퍼스트파티 정가 기준 월별 API 환산 가치:
• 월 $200 — Max 20x에서 Claude Opus 5.5의 반환 금액은 $11,726 — API 환산 토큰 기준 요금의 58.6배; ChatGPT Pro 200에서 GPT-6.1 Sol의 반환 금액은 $2,084 — 요금의 10.4배. 비율: 5.6배.
• 월 $100 — Max 5x에서 Claude Opus 5.5는 $5,725를 반환합니다(수수료의 57.3배). ChatGPT Pro 100에서 GPT-6.1 Sol은 $1,055를 반환합니다(수수료의 10.6배). 비율: 5.4배.
• 월 $20 — Claude Pro에서 Claude Opus 5.5의 수익은 $1,178 (수수료의 58.9배); ChatGPT Plus에서 GPT-6.1 Sol의 수익은 $211 (수수료의 10.6배). 비율: 5.6배.
세 가지 등급이 5.4배에서 5.6배 사이에 들어온다는 점이 이번 발견이며, 개별 달러 금액이 아니다. 비교는 각 랩 카탈로그의 중간 등급 — 두 벤더 모두 플래그십이 아니라 일상적인 주력 모델로 위치시키는 모델 — 을 대상으로 수행되며, 전체 가격대에 걸쳐 이루어진다. 따라서 $20 요금제를 쓰는 독자도 $200 요금제를 쓰는 독자와 같은 답을 얻는다. SemiAnalysis 자체 요약은 직설적이다: 이 등급에서 Anthropic은 "전반적으로 약 5배의 API 환산 가치를 제공하는, 압도적으로 더 나은 거래"다.
세 행 모두 뒤에 있는 워크로드 형태에는 라벨이 붙어 있으며, 이는 두 번 읽어볼 가치가 있다: 에이전트형, 캐시되지 않은 입력 0.4%, 캐시된 입력 96.6%, 캐시 쓰기 2.6%, 출력 0.3%. 이것이 에이전트 루프의 모습이다 — 소량의 새로운 지시, 엄청난 양의 다시 읽는 컨텍스트, 그리고 아주 적은 양의 생성된 텍스트. 또한 다음 섹션에서 보여주듯, 이는 Anthropic에 가장 유리하게 작용하는 조합이다.

Opus 5.5는 토큰당 비용이 두 배인데도 여전히 5.6배나 앞선다
다음은 유포되고 있는 버전의 차트가 빼놓고 있는 점이다. Claude Opus 5.5는 더 저렴한 모델이 아니다. 그것은 두 배나 더 비싼 모델이다.
두 요금표는 모두 공개되어 있습니다. Claude Opus 5.5는 백만 입력 토큰당 $4.00, 백만 캐시 읽기당 $0.20, 백만 캐시 쓰기당 $5.00, 백만 출력 토큰당 $20.00로 책정되어 있습니다. GPT-6.1 Sol은 동일한 네 항목에 대해 $2.00, $0.10, $2.50, $10.00로 책정되어 있습니다. 이를 위의 에이전트 구성 비중으로 가중하면 혼합 요율은 대략 Claude Opus 5.5의 경우 백만 토큰당 $0.399, GPT-6.1 Sol의 경우 $0.200 — 2.00배의 비율입니다. 이 계산은 두 공급업체가 공개한 요금표를 바탕으로 우리가 산출한 것이지만, 논란이 될 만한 것은 아닙니다: 공개된 가격과 표시된 구성에서 직접 도출되기 때문입니다.
5.6배의 가치 격차를 2.0배의 가격 격차로 나누면 Claude 쪽에서 플랜 1달러당 토큰이 약 2.8배 더 나옵니다. $20 티어에서 같은 나눗셈을 하면 2.79배가 나옵니다 — 이 격차는 한쪽 미터가 훨씬 더 관대하다는 뜻이며, 요금 사다리 전체에 걸쳐 거의 정확히 균일하지, 한 모델이 실행 비용이 더 저렴하다는 것은 아닙니다. 즉 5배라는 헤드라인은 Anthropic의 크레딧 가격 책정에 관한 진술이고, 측정된 것과 같은 워크로드에만 적용됩니다.
믹스를 바꾸면 숫자도 달라진다. 이 믹스는 96.6%가 캐시된 읽기이며, 여기서 Opus 5.5는 Sol의 $0.10에 맞서 $0.20을 청구한다. 캐시가 적은 워크로드, 즉 길고 새로운 문서가 많고 재사용이 적은 경우에는 입력 라인에 의존하게 되는데, 거기서도 똑같은 2배가 나타난다. 출력이 많은 작업, 가령 긴 에이전트 실행이 아니라 긴 생성의 경우에는 Opus가 $20.00 대 $10.00인 라인에 걸린다. 그리고 SemiAnalysis는 자사가 선호하는 지표 자체에 실패 모드가 있다고 명시한다. API 환산 가치는 모델이 API 가격에서 유난히 좋은 거래이거나 나쁜 거래라면 "물론 오해를 불러일으킬 것"인데, 여기서 바로 그런 상황이 벌어지고 있다. 즉 토큰당 더 비싼 모델이 더 나은 구독을 제공하는 쪽이다. 이 회사는 토큰 효율성 차트에 기대는 것도 꺼리는데, 전형적인 에이전트 벤치마크 작업이 실제 업무를 대표한다고 보지 않으며, 업계에 신뢰할 만한 효율성 데이터가 부족하다고 말한다. 5배라는 수치는 한 출판물이 특정 워크로드 형태 하나에 대해 내놓은 신중한 진술로 받아들여야지, 두 모델 중 어느 쪽의 영구적인 속성으로 여겨서는 안 된다.
구독 쪽이면서 더 저렴한 쪽이 독립적 평가에서 더 강한 쪽이기도 하다는 사실이, 이 격차를 중립적인 맞교환이 아니라 실제 문제로 만드는 이유다. Artificial Analysis는 Claude Opus 5.5를, 자사 모델 페이지가 "max with fallback"이라 부르는 구성(변형 선택기에는 "Claude Opus 5.5 (Max, Default Fallback)"으로 표기)에서 Intelligence Index58점으로 측정했는데, 이는 그때까지 측정한 것 중 여러 점 앞선 최고치였다. GPT-6.1 Sol은 동일 지수, 지수 버전 v4.3.2에서 최대 노력 설정 기준51.8점을 기록했고, GPT-6 Astra는 52.7이다. 그렇다면 200달러 요금제 두 개를 저울질하는 구매자는, 더 낮은 점수를 받은 모델에 대해 실제 사용 가능한 용량 1달러당 5.6배를 더 지불하라는 요구를 받는 셈이다. 점수는 제3자 독립 자료이고, 가치 수치는 SemiAnalysis의 모델이다. 둘 다 출처가 표기되어 있으며, 어느 쪽도 벤더가 제공한 수치가 아니다.

OpenAI가 9월 29일에 무엇을 변경했나요?
이 중 어느 것도 고정되어 있지 않았다. 격차가 지난주가 아니라 이번 주에 논의되는 이유는, 측정치가 나오기 여드레 전에 OpenAI가 자체 기준을 움직였기 때문이다.
2026년 9월 29일, OpenAI는 신규 구독자에게 $200 Pro 구독을 다시 개방했고, 재개와 함께 사용량 계산 방식을 변경했습니다. 그날 OpenAI의 표현에 따르면, 이 변경은 "기존 Pro $200 플랜과 비교해 API 지출에서 달러 기준 절반으로 순효과가 나타난다"였으며, 같은 날 두 번째 게시물에서는 해당 요금제의 API 환산 가치가 절반으로 줄어든다고 설명했습니다. 이는 자사 요금제에 대한 공급업체의 발언으로, 날짜가 명시되어 있으며, 구독 가치 측정 결과를 게시할 가치가 있게 만든 사건입니다.
SemiAnalysis가 측정한 세 가지 결과:
• 티어당 토큰이 절반으로 줄었고, Sol급 가치는 그보다 더 떨어졌습니다. OpenAI는 동시에 GPT-6.1 Sol의 캐시 입력 가격을 백만 개당 $0.10로 인하했는데, OpenAI의 개발자 계정은 9월 29일 이를 표준 입력 가격보다 95% 낮고 GPT-6 Sol의 캐시 요율보다 50% 낮은 수준이라고 설명했습니다. 따라서 해당 플랜에서 Sol급 모델의 측정된 API 환산 가치는 토큰 삭감만으로 암시되는 50%가 아니라 50% 이상 하락했습니다.
• $500 등급이 등장했지만, 가치를 회복시키지는 못한다. 새로운 Pro 500 요금제는 예전 $200 요금제보다 GPT-6 Astra를 21% 더 제공한다. Sol 가격 인하 때문에 $500 등급의 Sol급 API 환산 가치는 오히려 줄었다. 울트라패스트 모드 — 초당 300토큰 서비스 등급 — 가 그 등급의 진짜 추가 요소이며, SemiAnalysis는 그 한도가 아직 테스트 중이라고 말한다.
• 기존 구독자는 2026년 10월 29일까지 기존 조건이 유지됩니다. 개편 전에 보유한 $200 요금제는 그날까지 예전의 더 많은 허용량을 유지하다가, 이후 가격은 그대로인 채 더 낮은 허용량으로 전환됩니다. 9월 29일 이전에 가입한 사람이라면, 이 글의 비교는 오늘이 아니라 이달 말부터 해당 계정에 적용됩니다.
재조정이 미묘한 부분이다. 삭감 전에는 OpenAI의 달러당 가치가 상위 요금제에서 자사에 유리하게 치우쳐 있었다. Pro 200은 Astra에서 Pro 100의 약 두 배의 달러당 가치를 제공했고, Pro 100은 다시 Plus의 약 두 배를 제공했다. 삭감 후에는 Pro 100, Pro 200, Pro 500이 모든 모델에서 달러당 동일한 토큰을 제공하며, Plus는 Sol에서는 비슷하지만 Astra에서는 여전히 상대적으로 더 나쁘다. OpenAI는 모든 것을 최하위 등급에 맞춰 절반으로 줄임으로써 자사의 사다리를 내부적으로 공정하게 만들었다. 이와 대조적으로 Anthropic은 이미 모든 등급에서 동일한 달러당 가치를 제공했다. 그래서 $20 요금제를 보든 $200 요금제를 보든 동일한 5.6배가 나타난다. Plus를 사용 중이고 Astra 접근을 기대하고 있었다면, 이번 삭감은 OpenAI의 최고 등급을 넘볼 만한 가치가 있게 만들던 가치를 없앴다.
OpenAI는 실제 구조적 이점 하나를 여전히 유지하고 있으며, SemiAnalysis도 이를 인정한다: 어떤 Pro 등급도 5시간 창을 두지 않기 때문에, 한 번의 긴 세션에서 월간 한도의 상당 부분을 소비하기가 더 쉽다. 이 회사의 판단은 그것이 API 환산 가치에서 대략 4배에서 5배에 달하는 격차를 상쇄하지는 못한다는 것이다.
두 경제, 하나의 모델명
이 모든 것을 모델에 관한 진술로 읽는 데에는 함정이 있다. 토큰당 비용을 지불한다면 — API 키든, 자체 호스팅 스택이든, 직접 구축한 에이전트 플랫폼이든 — 5.6x는 당신의 숫자가 아니며, 애초에 그런 적도 없었다. 당신의 숫자는 혼합된 2.00x이며, 그 기준에서 GPT-6.1 Sol은 동일한 에이전트 루프에 대해 더 저렴한 모델이다. 구독 비교는 "어느 자리를 사야 하는가"에 답한다. API 비교는 "어느 모델을 호출해야 하는가"에 답한다. 이 두 모델에 대해 이 둘은 서로 반대 방향을 가리키며, 이 둘을 혼동하는 것은 이 차트를 둘러싼 논평에서 가장 흔한 단일 오류다.
구독 측정에 반영된 가격 인하 라운드는 이미 API 요금표에 들어와 있습니다. Anthropic은 9월 25일 해당 모델을 출시하면서 Opus 5.5의 입력 및 출력 가격을 Opus 5 대비 20% 인하했고, 캐시 읽기는 60% 인하했습니다. OpenAI는 9월 29일 출시 당시 GPT-6.1 Sol의 캐시된 입력 가격을 절반으로 인하했습니다. 이것이 이 글 전체에서 사용된 두 가지 정가표이며, 좌석을 구매하든 토큰을 구매하든 모두 적용됩니다. 두 모델 모두 OrcaRouter 카탈로그에 공급업체 정가로 등록되어 있습니다 — Claude Opus 5.5는 제공업체 정가에 0% 마크업, 그리고 GPT-6.1 Sol은 동일한 키로 하나의 엔드포인트 뒤에 — 따라서 공급업체의 인하는 라우팅 테이블 갱신을 기다릴 필요 없이 발표되는 즉시 반영됩니다.
한 가지 분명히 해둘 점이 있습니다: OrcaRouter는 구독을 판매하지 않으므로, 이 측정은 OrcaRouter 사용자가 지불하는 금액을 바꾸지 않습니다. 그것은 그들이 어떤 모델에 비용을 지불해야 하는지를 바꾸고, 대안의 가격을 제시합니다. 비교의 플랜 쪽은 통제할 수 없는 벽입니다 — 두 연구소 모두 가격을 인하한 같은 주에 한도를 조용히, 짧은 통보로 바꿀 것임을 입증했습니다. 그 위험에 상응하는 API는 새 계약 없이 동일한 요청을 다른 곳으로 보낼 수 있는 능력이며, 그것이 바로 제공자 간 자동 장애 조치가 필요한 이유입니다. 96.6% 캐시 읽기로 에이전트 루프를 실행 중이라면, 실제로 원하는 것은 요청을 수락할 가장 저렴한 경로와, 공급업체가 마음을 바꿀 때 여러분이 마음을 바꿀 수 있는 능력입니다.
누가 이동해야 하고, 누가 이동하지 말아야 하는가
유료 Claude 구독을 결제하고 에이전트형 코딩이나 긴 도구 루프를 돌리고 있다면, 계속 남을 이유는 이제 일화가 아니라 측정 가능한 근거로 판단됩니다. $200 티어에서는 구독료의 58.6배가 API 환산 용량으로 돌아오며, 이는 비교 가능한 ChatGPT 요금제의 10.4배와 대비되고, 모든 가격대에서 유지됩니다. 9월 29일 이전에 구매한 ChatGPT Pro 200 요금제를 사용 중이라면, 2026년 10월 29일까지는 예전 한도가 적용되고 그 이후에는 더 낮은 한도가 적용됩니다. 무엇이든 결정하기 전에 날짜를 확인하세요. 앞으로 3주 동안은 신규 구매자에게 더 이상 존재하지 않는 요금제와 비교하게 되기 때문입니다.
API 빌더라면 5.6배는 무시하세요. 2.00배 혼합 요율로 라우팅하고, 토큰당이 아니라 작업당으로 가격을 책정하며, 벤더 가격이 바뀔 때마다 다시 확인하세요. 이번 분기에 한 달이 조금 넘는 기간 동안 그런 변화가 네 번이나 있었기 때문입니다 — GPT-6 Sol, Fable 5.1, Opus 5.5, GPT-6.1 Sol. 구독에서 중요한 측정치는 연구소 밖에서는 아무도 볼 수 없는 미터입니다. API에서 중요한 측정치는 요금표이고, 그건 공개되어 있습니다.
다음에 지켜볼 것: Anthropic의 Opus 한도가 이번 분기 내내 유지될지, 자사 경쟁사가 지난 한 주 동안 한도 삭감을 단행했고 두 연구소 모두 사용량 측정 기준을 조용히 바꿀 수 있는 능력을 여전히 보유한다는 점을 고려할 때; OpenAI가 다시 가격을 인하하는 대신 한도를 높여 500달러 등급에서 Sol급 가치를 회복할지; 그리고 200달러 등급의 그랜드파더링이 발표대로 10월 29일에 실제로 종료되는지. SemiAnalysis는 기반 수치를 고정된 연구가 아니라 라이브 대시보드로 유지하므로, 여기 인용된 수치는 변동하도록 설계된 데이터셋의 2026년 10월 5일 상태다.

이 글에서 비교한 모델2
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
