
GPT-6.1 Sol: OpenAI, 대체하는 모델의 가격으로 아스트라에 근접한 성능을 출시하다
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 934 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2237지능
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- xAINEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당 · 194 tok/s
- OrcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1167 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 56 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- xAISpaceXAI: Grok 4.62026-08-1244지능77코딩
OpenAI는 2026년 9월 29일 DevDay 2026 기조연설에서 GPT-6.1 Sol을 공개했다. 일주일 전에 출시된 고급형 GPT-6 Sol 등급을 새로 다듬은 것으로, 입력 100만 토큰당 정확히 2달러, 출력 100만 토큰당 10달러로 가격이 똑같으며, 벤더가 토큰당 비용 약 5분의 1 수준으로 근접한다고 포지셔닝한 대상은 GPT-6 Astra, 즉 10달러/50달러 플래그십이다. 이례적인 부분은 가격이 아니다. 같은 가격으로 일주일 만에 나온 리프레시가 성능의 단계적 도약을 주장하고 있다는 점, 그리고 이 글을 쓰는 시점까지 어떤 독립 평가자도 이 모델에 점수를 매기지 않았다는 점이다. 이 글에서 OpenAI가 제공한 모든 성능 수치는 그렇게 표시해 두었는데, 아직 그것을 대조해 확인할 다른 자료가 없기 때문이다.
실제로 출시된 것과 그 시기

이번 릴리스는 DevDay 발표치고는 이례적으로 문서화가 잘 되어 있는데, 이 점 자체가 주목할 만하다. 몇 시간 만에 모델 페이지, 가격표, 시스템 카드 부록, 그리고 벤더의 공개 API 스키마에 커밋된 항목이 등장했다. 9월 29일 17:16 UTC에 "Add gpt-6.1-sol model to model enums"라는 제목의 커밋이었고, 그 부모 리비전에는 해당 문자열이 한 번도 들어 있지 않았다. 그러나 벤더 자체의 체인지로그는 여전히 9월 22일 GPT-6 Sol 및 GPT-6 Luna 릴리스에서 끝나 있다. 6.1 Sol 항목은 아직 그곳에 작성되지 않았으므로, 모델 페이지와 발표 게시물이 기록이다.
그것의 구체적인 형태:
• 모델 ID: gpt-6.1-sol, 단일 스냅샷이며 날짜가 붙은 변형은 없습니다 — 항상 현재 빌드입니다.
• 가용성: 오늘부터 ChatGPT Work 및 Codex의 Plus, Pro, Business, Enterprise, Edu 사용자에게, 그리고 API를 통해 제공됩니다. 소비자용 Chat 제품에는 명시적으로 포함되지 않으며, OpenAI는 이를 추론에 맡기지 않고 직접 밝힙니다.
• 컨텍스트: 1,050,000 토큰, 최대 출력 128,000, 지식 컷오프 2026년 4월 30일.
• 추론 제어: low, medium(기본), high, xhigh, max — 6개가 아닌 5개 수준입니다. GPT-6.1 Sol과 GPT-6 Astra는 더 이상 none effort를 받지 않습니다. GPT-6 Sol과 GPT-6 Luna는 받습니다.
• 모달리티: 텍스트와 이미지 입력, 텍스트 출력. 오디오 및 비디오 입력은 지원되지 않습니다.
• 도구: 웹 검색, 파일 검색, 이미지 생성, 코드 인터프리터, 호스팅된 셸, 패치 적용, 스킬, 컴퓨터 사용, MCP 및 도구 검색 — 모두 Responses API를 통해 제공됩니다. Chat Completions는 도구 없이만 작동합니다.
• 지원되지 않음: 파인튜닝. 이 모델은 훈련하는 모델이 아니라 프롬프트하는 모델입니다.
• 발표되었지만 출시되지 않음: Ultrafast 등급. OpenAI는 "며칠 내로" Codex에서 최대 8배 빠른 토큰 생성이 가능한 GPT-6.1 Sol Ultrafast를 제공할 것이라고 밝혔지만, 가격과 날짜는 제시하지 않았습니다.
두 행은 한 번 더 읽어 볼 가치가 있습니다. 5단계 노력 사다리는 none을 값싼 도피 수단으로 사용한 프롬프트가 6.1 Sol에서 검증에 실패한다는 뜻이며, 벤더는 정확히 이 이동에 대한 마이그레이션 지침을 게시합니다. 이동 출처: gpt-6-sol. 그리고 Ultrafast 라인은 주의 깊게 읽을 가치가 있습니다: 동일한 티어는 이미 GPT-6 Astra에서 폭넓게 제공되고 GPT-5.6 Sol에서는 미리 보기로 제공되므로, 6.1 Sol은 다른 모델들을 위해 존재하는 티어에 대한 예정된 추가 사항으로 설명되고 있습니다 — 새로운 티어로서가 아니라.
가격, 그리고 실제로 부담이 되는 지점
대표 요금은 GPT-6 Sol과 동일하게 유지된다: 입력 토큰 100만 개당 $2.00, 출력 토큰 100만 개당 $10.00이며, 캐시 쓰기는 $2.50이다. 벤더가 발표문에서 내세운 프레임은 자사 플래그십과의 비교인데, 여기서 $2/$10은 GPT-6 Astra의 $10/$50의 5분의 1이다 — 이는 실질적인 격차이자 이 표에서 가장 흥미롭지 않은 숫자이기도 하다. GPT-6 Sol이 이미 $2/$10이었기 때문이다.
달라진 것은 캐시 입력 요금 항목이고, 예산을 좌우하는 것도 바로 그것이다. GPT-6.1 Sol은 백만 토큰당 $0.10에 캐시되는데, 이는 GPT-6 Sol의 $0.20에 맞서는 가격으로, 절반에 해당하며 캐시되지 않은 입력 요율의 5%다. 요청 전반에 걸쳐 긴 프리픽스를 재사용하는 모든 경우, 그 프리픽스의 실질 입력 비용은 모델이 더 좋아진 데 더해 방금 절반으로 줄었으며, 턴 사이에 컨텍스트를 유지하는 에이전트의 가격을 책정한다면 바로 이 숫자를 모델링해야 한다.
공급업체의 가격 책정 페이지에서 가져온 승수:
• 표준: 입력 $2.00 / 캐시 $0.10 / 캐시 쓰기 $2.50 / 출력 $10.00.
• 고속 모드: 표준의 정확히 2배 — $4.00 / $0.20 / $5.00 / $20.00. EU 데이터 레지던시에서는 사용할 수 없습니다.
• 배치 및 Flex: 표준의 50% — $1.00 / $0.05 / $1.25 / $5.00.
• 지역별 처리: 제공되는 경우 10% 할증; 이 모델에서는 미국 및 EU 레지던시를 모두 지원합니다.
• 긴 프롬프트: 입력 토큰이 272,000개를 초과하면 전체 요청에 대해 입력 및 캐시 요율 2배, 출력 1.5배로 재책정됩니다 — $4.00 / $0.20, 출력 $15.00. 출력 쪽이 2배가 아니라 1.5배 오르는 것이 이 제품군의 롱컨텍스트 단계에서 더 완만한 지점입니다.
롱 컨텍스트 행을 기준으로 설계해야 한다. 컨텍스트 윈도는 100만 토큰이지만 가격 분기점은 272,000에 있으므로, 단일 요청의 실질적 상한은 윈도가 아니라 예산으로 결정된다. 그리고 그 지점을 넘어서는 문서 파이프라인은 초과분이 아니라 요청 전체에 대해 두 배를 지불하게 된다.
OpenAI가 주장하는 것, 그리고 아직 아무도 측정하지 못한 것
지금까지 GPT-6.1 Sol에 대해 공개된 모든 성능 수치는 공급업체가 보고한 것이며 재현되지 않았습니다. OpenAI의 발표는 다섯 가지 평가에서의 향상을 설명합니다:
• DeepSWE v1.1 (실제 코드베이스에서의 복잡한 소프트웨어 엔지니어링) — 약 5분의 1 비용으로 GPT-6 Astra와 맞먹으며, 더 낮은 추론 강도로 GPT-6 Sol의 최고 점수를 6.4%포인트 앞섭니다.
• GDP.pdf (복잡한 PDF에 관한 전문가 질문) — 폴백을 사용한 Claude Opus 5.5보다 더 높은 점수를 기록하면서 작업당 비용은 절반 이하이며, 작업당 약 5분의 1 비용으로 Astra에 근접합니다.
• AutomationBench 1.0.6 (47개 도구, 다단계 비즈니스 워크플로) — 중간 강도에서 Claude Opus 5.5보다 2.2%포인트 높고 비용은 약 3분의 1이며, 같은 설정에서 GPT-6 Sol보다 4.8포인트 높습니다.
• OSWorld 2.0 오프라인 세트 (컴퓨터 사용) — 최대 강도에서 GPT-6 Sol보다 7포인트 높으면서 비용은 절반 이하이고, 작업당 약 7분의 1 비용으로 Astra와 2.1포인트 이내입니다.
• Terminal-Bench Science 0.1 (데이터 분석, 시뮬레이션, 정리 증명) — 최대 강도에서 GPT-6 Sol의 점수를 두 배 이상으로 높입니다. 작업당 평균 $5.47로 Opus 5.5의 $23.21, Astra의 $23.80과 대비됩니다. OpenAI는 Astra가 여전히 68.1%로 이 세트를 앞선다고 언급합니다.
여기서 능력 점수가 아닌 두 숫자가 더 흥미로운데, 이는 리더보드 주장이 아니라 실패율 주장이기 때문입니다. 사실성 측면에서 OpenAI는 낮은 추론 노력에서 적어도 하나의 사실 오류를 포함하는 응답 비율이 11.4%에서 7.7%로 떨어졌다고 보고합니다. 이는 약 32% 감소입니다. 그리고 테스트된 설정 전반에서 오류율이 Astra의 1.9포인트 이내로 유지된다고 말합니다. 도구 신뢰성 측면에서, 에이전트가 사용자에게 검색 도구가 고장 났다고 알리지 못하는 사례 비율은 2.1%로 떨어지며, 이는 GPT-6 Sol의 4.9%, GPT-6 Astra의 1.5%, GPT-6 Luna의 28.7%와 대비됩니다.
둘 다 해당 공급업체 나름의 주의사항을 달고 있으며, 그 주의사항들은 이례적으로 구체적이다. 사실성 데이터셋은 사용자들이 이전 모델의 오류를 신고했던 비식별화된 대화들이고, 도구 공개 과제는 실패를 유도하도록 선별된 것이다. 어느 것도 일반적인 사용에 관한 주장이 아니며, OpenAI도 그렇게 말한다. 이들을 측정된 사실로 보지 말고, 공급업체가 자사의 신뢰성 작업을 설명한 것으로 보라.
독립적인 평가는 플래그십에 준하는 출시치고는 예상보다 빈약합니다. Artificial Analysis — 이 제품군의 나머지 모델이 보통 그 Intelligence Index와 비교해 인용되는 평가 기관 — 에는 GPT-6.1 Sol 항목이 없습니다: 모델 URL은 404를 반환하고, 그 문자열은 리더보드 데이터 어디에도 나타나지 않습니다. 그 데이터에는 각자의 추론 구성 전반에 걸쳐 GPT-6 Sol, GPT-6 Astra, GPT-6 Luna가 들어 있기는 합니다. 가장 가까운 이용 가능한 기준점은 이 모델이 대체하는 모델입니다: Artificial Analysis는 GPT-6 Sol을 Intelligence Index에서 48점으로 평가합니다. max-effort 구성에서 작업당 평가 비용 $1.05, 실행 전체에서 7,700만 토큰을 생성하며, 초당 78토큰입니다. 6.1 Sol에 비교 가능한 행이 생기기 전까지, 능력 주장에 대한 정직한 요약은 OpenAI가 그것이 큰 도약이라고 말하지만 아직 이에 동의하거나 반대하는 숫자를 아무도 발표하지 않았다는 것입니다.
그 이름, 그리고 끝내 도착하지 않은 모델
GPT-6 라인은 세 계층으로 구성된다 — 최상위 Astra, 그 아래 Sol, 맨 아래 Luna — 여기에 유령 하나가 더해진다. 그 유령은 GPT-6.1 Astra다. 계획된 플래그십 리프레시였으나 월스트리트 저널이 9월 28일 보도한 대로 폐기되었고, 프런티어 학습도 중단되었다. 우리는 그 결정을 여기서 다시 논하기보다 별도의 글에서 다뤘다. 읽는 데 중요한 것은 이번 릴리스가 남기는 형태다: 중간 계층에 대한 0.1 버전 범프가 플래그십으로 갔을 개선 사항을 대신 안고 있으며, 모델 페이지 자체의 포지셔닝 문구가 그 의도를 분명히 밝힌다 — 더 낮은 비용으로 복잡한 작업에서 Astra에 가까운 성능. GPT-6.1 Sol은 지난주 Sol의 반복판이라기보다는 끝내 출시되지 못한 모델의 대체품이다.
이것이 놓이는 위치
OrcaRouter는 아직 GPT-6.1 Sol을 라우팅하지 않습니다. 공개 카탈로그에 해당 모델 항목이 없으며, 우리가 서비스할 수 없는 모델을 마치 서비스할 수 있는 것처럼 설명하지는 않겠습니다. 우리가 실제로 서비스하는 것은 그것이 대체하는 모델입니다: OrcaRouter의 GPT-6 Sol에는 입력 $2.00 / 출력 $10.00의 동일한 정가가 적용되며, 두 컨텍스트 티어 행이 모두 공개되어 있습니다. 그 위에는 GPT-6 Astra가, 아래에는 GPT-6 Luna가 있습니다.

가격 인하가 아니라 동일 가격 리프레시가 중요한 이유는 이것입니다: 우리는 제공업체의 정가를 마크업 없이 그대로 전달하므로, GPT-6.1 Sol이 카탈로그에 등록되는 날 그 비용은 OpenAI가 부과하는 가격과 같아지고, 우리 쪽의 재가격 책정 지연은 없습니다 — 그리고 하나의 API 키로 우리가 취급하는 모든 제공업체에 접근할 수 있기에, 워크로드를 그것으로 전환하는 일은 새 계약이 아니라 모델 ID 변경입니다. 기존 모델과 대체 모델의 비용이 정확히 같은 대체 상황에서, 이는 한 줄 수정과 마이그레이션 프로젝트의 차이입니다. 그때까지는 점수가 매겨지지 않은 모델에 대한 합리적인 조치는 이를 프로덕션 경로에서 제외하고, 주 모델에 오류가 발생하면 검증된 형제 모델로 페일오버하는 것입니다 — 이는 또한 벤더의 주장이 귀하의 워크로드에서 성립하는지 알아내는 가장 저렴한 방법이기도 합니다.
앞으로 2주간 주목할 것
이번 릴리스가 남긴 의문을 해소할 세 가지가 있는데, 아직 그중 어느 것도 갖춰지지 않았다. 첫째, 독립적인 점수다. GPT-6.1 Sol에 대한 Artificial Analysis의 단일 행은 발표에서 가장 큰 주장을 검증 가능한 것으로 바꿔 놓을 것이며, 조달 결정을 움직일 가능성이 가장 큰 숫자다. 둘째, Ultrafast 가격이다. OpenAI는 Codex용으로 최대 8배 생성 속도를 내는 이 티어를 "며칠 내로" 선보이겠다고 약속했지만, 숫자가 붙지 않은 채 발표된 서빙 티어는 제품이 아니라 약속일 뿐이며, Fast 모드의 표준 대비 2배 요금만이 비용을 가늠할 유일한 기준점이다. 셋째, 11.4%에서 7.7%로의 사실성 개선이 OpenAI의 것이 아닌 하네스와 맞닥뜨려도 살아남는지 여부다. 왜냐하면 그것과 검색 도구 공개율이야말로 리더보드 한 줄이 아니라 프로덕션 트래픽을 옮기는 일을 정당화할 두 가지 주장이기 때문이다.

솔직히 요약하자면, GPT-6.1 Sol은 실제 가격표와 문서화된 API 표면, 그리고 보통 0.1 버전 업그레이드가 담는 것보다 더 큰 벤더 수치들을 갖춘 실제 출시다. 가격 논거는 간단하다: 그것이 구식으로 만드는 모델과 비용이 같고, 캐시된 입력 비용은 절반이다. 역량 논거는 다른 누군가가 측정하기 전까지는 전적으로 OpenAI의 몫이다 — 그것이 바로 지금은 스펙 시트를, 일주일 뒤에는 벤치마크를 읽어야 하는 이유다.
GPT-6.1 Sol은 아직 저희 라우트에 없습니다. 추가되면 전체 모델 카탈로그에서 OpenAI의 자체 정가로, 아무런 마크업 없이, 이미 하나의 API 키로 이용할 수 있는 200개 이상의 모델 옆에 표시될 것입니다.
이 글에서 비교한 모델2
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
