GPT-6.1 Sol vs Gemini 3.1 Pro를 위한 생성된 히어로 카드로, 제목은 '7개월의 프리뷰, 8일의 출시'이며, 두 개의 정보 카드에는 각각 'Gemini 3.1 Pro: 2026년 2월 19일 발표, 여전히 프리뷰 엔드포인트, Intelligence Index 29.7'과 'GPT-6.1 Sol: 2026년 9월 29일 출시, 판매 중인 제품, Intelligence Index 51.8'이라고 적혀 있고, 하단에는 '지수 수치는 Artificial Analysis, Intelligence Index v4.3.2 기준; 가격은 Google 및 OpenAI 기준.'이라고 적혀 있으며, 오른쪽 아래 모서리에 OrcaRouter 로고가 있습니다.
Guides & Insights

GPT-6.1 Sol vs Gemini 3.1 Pro: 7개월의 프리뷰 vs 8일의 출시

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Gemini 3.1 Pro는 벤더의 가격표에 7개월 반째 올라 있으면서도 한 번도 프리뷰 단계를 벗어난 적이 없습니다. 2026년 2월 19일에 발표되었고, 오늘도 -preview로 끝나는 엔드포인트에 문서화되어 있으며, 일반 공급(GA)에 대한 약속도 없고 — 더 시사적인 점은 — 서비스 종료 날짜조차 없습니다. GPT-6.1 Sol은 출시된 지 8일 되었으며, 2026년 9월 29일에 백만 입력 토큰당 $2.00, 백만 출력 토큰당 $10.00에 출시되었습니다. Artificial Analysis Intelligence Index에서 두 모델을 나란히 놓고 보면, 7개월 된 프리뷰는 경쟁력이 있는 정도가 아니라 최신 인덱스 개정판에서 더 새로운 모델과 22점 차이 안에 들어옵니다 — v4.3.2에서 29.7 대 51.8 — 그러면서도 인덱스 작업당 비용은 1.8배 더 많이 듭니다, $1.30 대 $0.72. 이 조합이 바로 이 비교가 형식적인 절차가 아니라 흥미로운 이유입니다: 이 보드에서 더 오래된 모델은 성능에서는 뒤처지고 비용에서는 앞서는데, 이는 정식 출시로 졸업할 예정이었던 프리뷰로서는 거꾸로 된 모양새입니다. 하지만 인덱스 개정판이라는 단서는 이 세트의 어느 곳보다도 여기서 중요합니다. 같은 사이트에서 29.7과 53이 모두 인용되는데, 그 둘은 같은 측정값이 아니기 때문입니다.

둘 다 1M급 컨텍스트 창을 갖춘 대형 멀티모달 모델이다. Gemini 3.1 Pro는 텍스트, 이미지, 비디오, 오디오, PDF를 입력으로 받으며 출력 상한은 65,536토큰이고, 200,000토큰을 초과하는 가격 구간에서는 요율이 두 배가 된다. GPT-6.1 Sol은 텍스트, 이미지, 파일을 입력으로 받으며 1,050,000토큰 창, 128,000토큰 출력 상한, 다섯 가지 추론 노력 수준, 그리고 272,000 프롬프트 토큰을 초과하는 장문 컨텍스트 구간을 갖춘다. 하나는 지원 약속이 있는 출시 제품이다. 다른 하나는 수명 주기가 정해지지 않은 프리뷰이며, 그 차이는 인덱스 격차보다 더 가치가 있는 것으로 드러난다.

인덱스 번호에는 해당 리비전이 첨부되어야 합니다.

Artificial Analysis는 자사의 평가 제품군을 다시 실행하고 현재 인덱스 리비전에 따라 점수를 다시 게시하는데, 이는 같은 모델이 언제 읽느냐에 따라 서로 다른 두 숫자를 가질 수 있다는 뜻이다. Gemini 3.1 Pro의 경우 그 격차가 유난히 크다: 이 모델에 대한 이전 자체 보도에서는 더 오래된 리비전에서 57을 보고했지만, 오늘 현재 페이지는 v4.3.2에서 29.7을 보고하며, 이는 GPT-6.1 Sol의 51.8도 함께 담고 있는 10개 평가 버전이다. 두 수치 모두 실제이며 둘 다 같은 웹사이트에 있다.

이것이 비교에 대해 의미하는 바는 범위가 좁지만 중요하다. 같은 리비전의 수치만 서로 뺄 수 있다. v4.3.2의 29.7과 51.8은 22포인트 격차를 만들고, 57과 51.8은 반대 방향으로 5포인트 격차를 만든다. 여기서는 22포인트 수치를 사용해야 한다. 왜냐하면 그것은 두 모델 모두 동일한 스위트에서 동일한 척도로 측정된 수치이고, 작업당 비용 수치인 $1.30 대 $0.72도 바로 그 같은 실행에서 나왔기 때문이다.

• Intelligence Index, v4.3.2 — GPT-6.1 Sol 51.8 대 Gemini 3.1 Pro 29.7

• 인덱스 작업당 비용 — GPT-6.1 Sol $0.72 vs Gemini 3.1 Pro $1.30

• 전체 스위트 실행 비용 — GPT-6.1 Sol $1,082 vs Gemini 3.1 Pro $1,935

• 컨텍스트 윈도우 — GPT-6.1 Sol 1,050,000 토큰 vs Gemini 3.1 Pro 1,000,000 토큰

• 최대 출력 — GPT-6.1 Sol 128,000 토큰 vs Gemini 3.1 Pro 65,536 토큰

• 입력 모달리티 — 양쪽 모두 텍스트, 이미지, 파일을 지원하며, Gemini 3.1 Pro에서는 비디오, 오디오, PDF도 지원

그중 두 가지 항목은 프리뷰에 유리하며, 분명히 짚고 넘어갈 가치가 있습니다. Gemini 3.1 Pro는 비디오와 오디오를 입력받지만 GPT-6.1 Sol은 그렇지 않습니다. 파이프라인이 화면 녹화나 통화를 입력으로 받는다면, 이는 어떤 점수로도 메울 수 없는 기능 격차입니다. 그리고 65,536토큰의 출력 상한은 GPT-6.1 Sol의 절반으로, 장문 생성에는 중요하지만 출력은 짧고 턴은 많은 에이전트 작업에서는 좀처럼 제약이 되지 않습니다.

왜 더 새로운 숫자가 당신의 결정을 좌우해야 하는 것인가

가격 문제가 지수 문제보다 더 흥미롭다.

Gemini 3.1 Pro의 요금표는 백만 토큰당 입력 $2.00, 출력 $12.00이며, 캐시된 입력은 $0.20, 캐시 쓰기는 $0.375이고, 200,000 프롬프트 토큰에 등급 경계가 있어 이를 초과하면 요금이 $4.00 및 $18.00이 됩니다. GPT-6.1 Sol은 입력 $2.00, 출력 $10.00이며, 캐시된 입력은 $0.10, 캐시 쓰기는 $2.50이고, 272,000 토큰에 경계가 있어 이를 초과하면 요금이 $4.00 및 $15.00이 됩니다. 대표 입력 가격은 동일합니다. 출력 가격은 GPT-6.1 Sol이 20% 더 낮고, 장문 컨텍스트 단계는 두 축 모두에서 더 낮습니다. 두 요금표가 갈리는 지점은 캐싱입니다: 백만 캐시 입력 토큰당 $0.10 대 $0.20이며, 프리뷰 모델은 캐시 쓰기가 더 저렴해 $0.375 대 $2.50입니다.

A screenshot of the OrcaRouter model page for google/gemini-3.1-pro-preview, credited to Google and dated 2026-02-19, showing the -preview model identifier, text, image, video, audio and file input with text output, a 1M-token context window with a 65K maximum output, and a rate row reading $2.00 input and $12.00 output per million tokens alongside a 10.60-second median time to first token and an 11.3M seven-day traffic figure.

마지막 두 항목은 통상적인 해석을 뒤집습니다. 워크로드가 캐시를 많이 쓰는 경우 — 매 턴마다 다시 전송되는 긴 고정 시스템 프롬프트나 세션 내내 다시 읽는 문서 — Gemini 3.1 Pro의 캐시 쓰기 요금은 훨씬 저렴하고 캐시 읽기 요금은 두 배입니다. 어느 모델이 이기는지는 자신이 쓴 내용을 몇 번 다시 읽는지에 달려 있으며, 그것은 자체 로그가 담고 있는 숫자이고 어떤 벤치마크도 공개하지 않습니다. 모호하지 않은 것은 인덱스 비용입니다: 동일한 평가 작업에서 8일 된 모델은 33% 더 저렴하게 끝났고, 7개월 된 프리뷰는 전체적으로 더 새로운 모델보다 79% 더 비싸게 끝났습니다.

미리보기 배지가 운영상의 사실입니다

이것은 점수표가 담아낼 수 없는 비교의 부분이며, 프로덕션 배포에서는 위의 모든 것보다 더 중요합니다.

Gemini 3.1 Pro는 2월부터 프리뷰 상태로 있었으며 일반 제공(GA) 발표도, 종료 날짜도 없습니다. 두 가지 부재 모두 중요하며 서로 반대 방향으로 작용합니다. GA가 없다는 것은 수명 주기 약속이 없다는 뜻입니다: 프리뷰 엔드포인트는 일반 제공 엔드포인트와 동일한 지원 중단 공지 조건의 적용을 받지 않으며, 호출자 모르게 버전 범프 없이 개정될 수 있습니다. 이는 프로덕션에서 별칭 대신 정확한 모델 식별자를 고정하는 표준적인 이유입니다. 종료 날짜가 없다는 것은 마이그레이션 기간을 계획할 수도 없다는 뜻입니다 — 이 모델은 모두가 GA로 전환되리라 기대했던 분기를 이미 넘겼으며, 이 제품군은 이전에도 Pro 모델을 종료한 적이 있습니다.

GPT-6.1 Sol의 입장은 거울상이다. 출시된 지 8일밖에 되지 않았으며, 이는 독립 평가 기록이 구성 하나 분량에 불과하고 실패 모드가 문서화되지 않았음을 의미한다. 문제가 생겼을 때 참고할 실무자 코퍼스도 없다. 출시 자체가 뉴스였고, 프리뷰에는 없는 지원 체계 아래 출시된다.

그것들은 위험의 정도가 다른 게 아니라 서로 다른 위험입니다. 프리뷰를 선택한다면, 공급업체가 계약상 의무 없이도 엔드포인트를 계속 제공할 것이라는 데 걸고 있는 셈입니다. 8일 된 모델을 선택한다면, 벤치마크 한 번의 실행과 8일간의 가용성이 당신의 워크로드에 충분한 증거라고 걸고 있는 셈입니다. 인덱스는 어느 쪽에도 도움이 되지 않습니다.

이걸 쉽게 만들어 줄 단 한 가지

Gemini 3.1 Pro의 정식 출시(GA) 발표가, 모델 식별자가 -preview 네임스페이스에서 나온 것이고 공개된 수명 주기 약속도 갖춘다면, 이 문제의 대부분을 해결할 것입니다. 그것은 22포인트 지수 격차나 작업당 1.8배 비용 격차를 좁히지는 못하겠지만, 현재 비교를 한쪽으로 치우치게 만드는 지원 중단 위험을 제거하고, 팀이 프리뷰 식별자를 고정하고 기대하는 일 없이 모델을 도입할 수 있게 해 줄 것입니다.

7개월 반이 지난 시점에서 그 발표가 없다는 사실 자체가 정보입니다. 공급업체의 2월 표현으로는 ‘곧’ GA로 전환하기 전에 업데이트를 검증하기 위한 것이었던 프리뷰가, 그렇게 하기 위해 꼬박 두 분기의 시간을 가졌습니다. 검증이 진행 중이거나, 아니면 프리뷰 자체가 제품이거나 둘 중 하나이며, 호출자는 외부에서 어느 쪽인지 알 수 없습니다. 호출자가 할 수 있는 일은 불확실성을 가격에 반영하고 그에 따라 라우팅하는 것입니다.

둘 다 하나의 키에 있으므로 워크로드별로 답을 낼 수 있습니다

A screenshot of OpenAI's developer model page for GPT-6.1 Sol, headed 'GPT-6.1 Sol' with the tagline 'Near-Astra performance for complex work at a lower cost', showing a 1,050,000-token context window with 128,000 max output tokens and an Apr 30, 2026 knowledge cutoff, a price row reading $2 input and $10 output per million tokens, and the note that reasoning.effort supports low, medium (default), high, xhigh and max while none and minimal are not supported.

Gemini 3.1 Pro는 OrcaRouter에서 자체 공시 요금으로 제공됩니다 — $2.00 / $12.00, 200,000 프롬프트 토큰 초과 시 $4.00 / $18.00으로 인상되며, 캐시 읽기는 $0.20입니다. GPT-6.1 Sol은 OrcaRouter에서 $2.00 / $10.00, 272,000 프롬프트 토큰 초과 시 $4.00 / $15.00으로 인상되며, 캐시 읽기는 $0.10입니다. 두 모델 모두 제공업체 정가이며, 추가 비용 없이 하나의 키와 하나의 청구서로 이용할 수 있습니다.

그 덕분에 이 비교에서 골치 아픈 부분들을 저렴하게 해결할 수 있다. 비디오와 오디오 인제스트는 프리뷰에 남는데, 이 짝의 다른 쪽은 이를 받아들이지 않기 때문이다. 대량 텍스트와 코딩 작업은 더 새로운 모델로 간다. 이 모델은 작업당 더 저렴하고, 동일한 평가 작업에서는 33% 더 저렴하다. 프리뷰 엔드포인트가 개정되거나 철회되면 자동 페일오버가 해당 호출을 실패시키는 대신 다른 경로로 옮긴다. 이는 프리뷰의 수명 주기 위험이 요구하는 바로 그 대비책이다. 그리고 둘 다 하나의 OpenAI 호환 엔드포인트 뒤에 있으므로, 실제로 중요한 가격 비교는 요금표를 놓고 논쟁하는 대신 오후 한나절이면 자체 트래픽으로 실행할 수 있다.

A generated scoreboard titled 'GPT-6.1 Sol vs Gemini 3.1 Pro — the scoreboard' showing two columns on six shared rows: Intelligence Index 51.8 against 29.7 on v4.3.2; cost per index task $0.72 against $1.30; input price $2.00 against $2.00; output price $10.00 against $12.00; maximum output 128,000 against 65,536 tokens; lifecycle released September 29, 2026 against a preview running since February 19, 2026. A footer reads 'Index and cost figures per Artificial Analysis v4.3.2; prices per OpenAI and Google as listed on OrcaRouter.'

그렇다면 방어 가능한 해석은 어느 모델이 더 나은가가 아니다. 그것은 이 둘이 거의 동등한 가격으로 책정되어 있으면서, 수명 주기 성숙도에서는 7개월 차이가 나고 현재의 독립 리더보드에서는 22점 차이가 난다는 점이다. 그리고 프리뷰 모델의 진짜 장점인 비디오 및 오디오 입력, 저렴한 캐시 쓰기는 좁고 구체적이라는 점이다. 워크로드에 그러한 모달리티가 필요하다면 Gemini 3.1 Pro가 둘 중 유일한 선택지이며, 지수 격차는 입장료다. 그렇지 않다면, 당신은 지난주에 출시된 모델보다 작업당 비용이 80% 높은, 끝이 정해지지 않은 미래를 지닌 프리뷰 엔드포인트를 제안받는 것이며, 입증 책임은 반대쪽에 있다.