Gemini 3.1 Pro 해설 영상의 타이틀 카드로, 'Gemini 3.1 Pro'라는 제목과 '7개월이 지난 지금도 여전히 프리뷰'라는 부제가 표시되어 있으며, 그 아래에는 1M 토큰 입력, 65K 출력, 1M당 $2 / $12, 2026년 2월 19일 발표라고 적힌 네 개의 사양 필이 있다.
Guides & Insights

Gemini 3.1 Pro란 무엇인가? 구글의 Pro 등급은 7개월째 변화가 없다

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Gemini 3.1 Pro는 자사 제품군에서 유일하게 현역인 Pro 등급 모델입니다. 2026년 2월 19일에 발표되었고, 7개월이 지난 후에도 벤더 자체 모델 문서에서는 여전히 “Preview”로 분류하고 있으며 엔드포인트 gemini-3.1-pro-preview에서 — 정식 출시도, 종료 일정도, 출시된 후속 모델도 없습니다. 같은 7개월 동안 벤더는 Flash 릴리스 다섯 개를 출시했고, 그중 최신인 Gemini 3.8 Flash는 대부분의 사람들이 인용하는 독립 지수에서 이제 11점 더 높은 점수를 기록합니다. 이러한 격차 때문에 Gemini 3.1 Pro가 무엇인지 설명하는 페이지는 그것이 무엇이 아닌지부터 시작해야 합니다.

두 문장 버전만 원한다면: Gemini 3.1 Pro는 Google DeepMind가 만든 폐쇄형 가중치의 네이티브 멀티모달 추론 모델로, 텍스트, 이미지, 동영상, 오디오, PDF를 읽고 텍스트를 씁니다. Google 자체 API를 통하거나 이를 제공하는 라우터를 통해 호출할 수 있으며, 최대 1,048,576토큰의 입력을 받고, 200,000토큰 프롬프트 이하에서는 입력 토큰 백만 개당 $2.00, 출력 토큰 백만 개당 $12.00의 비용이 듭니다. 장문 컨텍스트 멀티모달 주력 모델로서 제 역할을 톡톡히 합니다. 더 이상 이용 가능한 가장 똑똑한 모델이기 때문에 선택하는 모델은 아닙니다.

자기 패밀리 내에서의 위치

이것은 대부분의 글이 건너뛰는 부분이며, 가장 중요한 부분이다. Gemini 3 패밀리는 정상에 Pro가 있는 하나의 사다리가 아니다. 그것은 더 이상 비교할 수 없게 된 두 개의 사다리다.

Flash 라인업이 바뀐 쪽이다. 2026년 9월 23일에 확인한 Google의 모델 문서에는 Gemini 3.8 Flash, Gemini 3.8 Live, Gemini 3.8 Live Extended Thinking이 새로운 안정 버전으로 나열되어 있으며, 그 뒤로 Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3.5 Flash-Lite가 여전히 안정 버전으로 남아 있다. Gemini 3.8 Flash는 2026년 9월 2일에 출시되었다 — 6주 만에 세 번째 Flash 릴리스다.

Pro 계열은 그러지 못했습니다. Google 문서에는 Gemini 3.5 Pro, 3.6 Pro, 3.7 Pro 또는 3.8 Pro가 없습니다. Gemini 3.1 Pro가 대체하기 위해 만들어진 모델인 Gemini 3 Pro는 종료된 것으로 표시되어 있습니다. Gemini 2.5 Pro는 살아남았지만, 접근은 기존 사용자로 제한됩니다. 그리하여 오늘 호출할 수 있는 유일한 Pro 등급 Gemini 3 엔드포인트는 Gemini 3.1 Pro로 남습니다 — 경주에서 이겼기 때문이 아니라, 아무도 출전하지 않았기 때문입니다.

구글이 2월에 밝힌 계획은, 이 모델이 “곧 일반 제공(generally available)”되기 전에 프리뷰가 “이러한 업데이트를 검증”하고 야심 찬 에이전트 워크플로 같은 분야를 발전시킬 수 있을 만큼 충분히 오래 지속된다는 것이었습니다. 이는 2월 발표에서 구글이 직접 한 말입니다. 7개월이 지난 지금, 그런 일은 일어나지 않았습니다. 그리고 지연을 둘러싼 보도는 사실이 아니라 보도로서 분명히 말할 가치가 있습니다: SemiAnalysis는 Gemini 3.5 Pro 작업이 조용히 취소되었다고 결론지었고, 월스트리트 저널은 2차 매체들이 인용한 바에 따르면 내부 3.5 Pro 후보가 Flash 시리즈를 능가하지 못했기 때문에 폐기되었다고 보도했습니다. 구글 측의 입장은 3.5 Pro가 확정된 월도 없이 제한된 파트너 테스트에 계속 머물러 있다는 것입니다. 우리는 취소를 확인하거나 부인하는 구글의 성명을 찾을 수 없었으며, 구글을 대신해 편을 들지는 않겠습니다.

실질적인 결과는 이름에 숨은 함정이다. “가장 최신 Gemini Pro”를 찾으려고 하면, 찾을 수 있는 가장 최신 Pro 등급 모델은 2월 버전인 반면, Flash 쪽의 버전 번호는 3.8까지 올라갔다. 여기서 버전 번호는 등급 간 성능 순위를 나타내지 않는다. 이들은 서로 별개의 릴리스 트레인이다.

중요한 사양

아래의 모든 수치는 별도로 표시되지 않은 한, 2026년 9월 23일자 Google 자체 Gemini API 문서에서 가져온 것입니다.

• 입력 컨텍스트 — 1,048,576 토큰, Google이 2.5 세대부터 제공해 온 것과 동일한 100만 토큰 창입니다. 출력은 별도로 65,536 토큰으로 제한되는데, 이는 대화가 아니라 답변에 적용되는 상한입니다.

• 입력 모달리티 — 텍스트, 이미지, 비디오, 오디오 및 PDF. 출력 모달리티 — 텍스트만. 오디오 생성 없음, 이미지 생성 없음, Live API 없음, 따라서 이는 실시간 음성 에이전트나 이미지 파이프라인을 위한 모델이 아닙니다. Google은 그러한 작업을 위해 별도의 Gemini 3.x Flash 변형을 제공합니다.

• 추론 — 지원됨, 사고 수준 제어 제공. 사고 토큰은 출력 요율로 청구되므로, 출력 가격이 청구서를 좌우하는 숫자인 이유입니다.

• 툴링 — 캐싱, 코드 실행, 함수 호출, 검색 그라운딩, 지도 그라운딩, 구조화된 출력, URL 컨텍스트, Batch API, flex 추론 및 우선순위 추론이 모두 지원되는 것으로 나열되어 있습니다. 파일 검색은 AI Studio에서만 지원되는 것으로 나열되어 있습니다.

• 라이선스 및 가중치 — 독점. 오픈 가중치도, 다운로드 가능한 체크포인트도, 자체 호스팅 경로도 없습니다. 이 모델에 접근하는 모든 경로는 호스팅 API입니다.

• 엔드포인트 — gemini-3.1-pro-preview가 모델 코드입니다. Google은 gemini-3.1-pro-preview-customtools 변형도 함께 명시합니다. 프리뷰 엔드포인트는 버전을 올리지 않고도 사용자 모르게 개정될 수 있으며, 이것이 프로덕션에서 별칭 대신 정확한 모델 ID를 고정하는 표준적인 이유입니다.

• 문서화된 업데이트 날짜 — 모델 페이지에는 “마지막 업데이트: 2026년 2월”이라고 나와 있습니다. Google 자체 모델 페이지에는 명시된 지식 컷오프 날짜를 찾을 수 없었습니다. 제3자 목록에는 2025년 1월이라고 되어 있지만, 이를 사실로 반복하기보다는 확인되지 않은 사항으로 표시하고 있습니다.

비용

Gemini 3.1 Pro에는 가격 절벽이 있는데, 이는 저렴해 보이는 견적을 두 배로 부풀린 청구서로 바꿔 놓는 종류의 세부 사항입니다. Google이 공개한 개발자 가격은 모델 버전이 아니라 프롬프트 크기를 기준으로 나뉩니다.

• 스탠다드 등급, 최대 200,000 토큰의 프롬프트 — 입력 토큰 백만 개당 $2.00, 출력 토큰 백만 개당 $12.00이며, 사고 토큰은 출력으로 계산됩니다.

• Standard 티어, 200,000토큰 초과 프롬프트 — 입력 $4.00, 출력 $18.00. 두 요금 모두 동일한 임계값에서 두 배가 됩니다. 이것이 함정입니다: 장문 컨텍스트 워크로드는 바로 그 모델을 구매한 목적인 기능을 사용하고 있기 때문에 공표 요금의 두 배를 지불합니다.

• 컨텍스트 캐싱 — 200,000 임계값을 기준으로 어느 쪽에 해당하는지에 따라 캐시된 토큰 100만 개당 $0.20 또는 $0.40이며, 여기에 캐시 저장소는 시간당 100만 토큰당 $4.50로 청구됩니다.

• 배치 및 플렉스 티어 — 200,000 토큰 미만은 입력 $1.00, 출력 $6.00이며, 그 이상은 $2.00와 $9.00입니다. 기다릴 수 있는 작업에는 약 절반 가격입니다.

• 우선순위 티어 — 임계값 미만에서는 입력 $3.60, 출력 $21.60이며, 임계값 초과 시에는 $7.20, $32.40입니다.

• 무료 티어 — 이 모델에서는 사용할 수 없습니다. 프로토타이핑에 사용할 무료 요청 한도가 없습니다.

그 숫자들이 얼마나 신뢰할 만한지에 관해 알아 둘 만한 두 가지가 있습니다. 여기서 권위 있는 출처는 Google 자체 가격 페이지이며 우리가 이를 직접 읽었으므로, 위 수치는 2026년 9월 23일 기준으로 최신입니다. 하지만 이 모델에 대한 제3자 목록은 정말 일관성이 없습니다. 한 추적기는 $2.50 / $15.00 요금을 기재하고, 다른 추적기는 $4.50의 혼합 요금을 기재하는데, 그 이유는 계층화에 있습니다. 어떤 페이지가 Gemini 3.1 Pro에 대해 어떤 프롬프트 크기 구간에 적용되는지 알려 주지 않은 채 단일 숫자만 제시한다면, 그 숫자는 실제 견적에 사용할 수 없습니다.

그것이 측정 가능하게 잘하는 것과, 측정 가능하게 그렇지 않은 것

Google이 주장하는 것부터 시작하되, 그것을 독립 평가자들이 측정한 것과는 분리해 두세요. 2월 이후로 이 둘은 크게 갈라졌기 때문입니다.

Google 자체 발표에는 벤치마크 수치가 정확히 하나만 실려 있다. ARC-AGI-2에서의 “검증된 점수 77.1%”인데, Google은 이를 Gemini 3 Pro의 추론 성능의 두 배 이상이라고 설명한다. 그것은 공급업체가 제시한 수치로, Google 자체 게시물에서 읽은 것이며, 그곳에서 우리가 확인할 수 있었던 유일한 수치다. 출시 당시 보도에서는 훨씬 더 많은 수치를 돌렸다 — GPQA Diamond, SWE-bench Verified, Terminal-Bench 2.0, LiveCodeBench, Humanity’s Last Exam — 그러나 그 수치들은 Google의 자체 발표에는 나오지 않으며, 2차 보도들은 우리가 확인한 것들에 대해 서로 엇갈린다 (GPQA Diamond는 누구의 글을 읽느냐에 따라 94.1과 94.3 모두로 나타난다). 우리는 이들을 확립된 결과로 싣지 않는다.

독립적인 그림이 이야기가 전환되는 지점이다. 2026년 9월 23일 기준으로 공개된 Artificial Analysis Intelligence Index 버전에서 Gemini 3.1 Pro Preview는 30점을 기록했고 해당 클래스의 212개 모델 중 81위를 차지했다. 해당 클래스의 중앙값 모델은 25점이므로, 이 모델은 평균보다 높은 위치에 있다 — 그리고 같은 차트의 선두 주자인, 최대 추론 설정의 Claude Opus 5는 58점을 기록한다. 지수 자체는 고정된 자가 아니라 버전이 매겨지는 자다: Artificial Analysis는 2월 출시 이후 이를 개정했고, 자체 개정 노트에는 새로운 평가들이 종합 지수에 합류했다고 기록되어 있다. Gemini 3.1 Pro는 2월 출시 당시의 지수에서 57점으로 단독 선두로 보도되었다. 그것은 30점과 같은 자가 아니며, 우리는 두 숫자를 마치 하락을 보여주는 것처럼 나란히 놓지 않을 것이다.

현재의 매핑이 실제로 보여주는 것은 진짜 프로필이며, 그것도 한쪽으로 치우친 프로필이다:

• 지능 — 지수 30, 212개 중 81위. 중앙값보다 높지만 최전선과는 거리가 멀다.

• 속도 — 초당 출력 토큰 116.5개, 212개 중 38위. 추론 모델치고 눈에 띄게 빠릅니다.

• 비용 — Intelligence Index 작업 하나를 실행하는 데 $0.67, 212개 중 31위. 이는 작업 단위당 저렴한 편인데, 모델이 사고 토큰을 아껴 쓰기 때문입니다.

• 장황함 — 인덱스를 완료하는 데 67M 출력 토큰이 들며, 이는 동급 중앙값 88M과 대비되는 수치다. 212개 중 39위이며, Artificial Analysis는 이를 “꽤 간결하다”고 평가한다. 비교하자면, 높은 추론 수준의 Gemini 3.8 Flash는 동일한 스위트에서 170M 토큰을 소모하고 작업당 $1.24가 드는데, 이는 토큰당 가격이 더 저렴함에도 Gemini 3.1 Pro보다 더 많은 비용이다.

따라서 정직한 해석은 "기존 모델이 모든 면에서 밀렸다"가 아니다. Gemini 3.1 Pro는 빠르고 토큰 효율이 좋으며, 작업당 비용 기준으로는 자사의 더 새로운 형제 모델을 앞선다. 이 모델이 잃는 것은 최상위 성능이며, 품질이 결정적 제약인 모든 워크로드에서는 그것이 유일하게 중요한 축이다.

Screenshot of the Artificial Analysis model page for Gemini 3.1 Pro Preview, showing the headline tiles Intelligence 30 (rank 81 out of 212 models), Speed 116.5 output tokens per second (rank 38 out of 212), Cost $0.67 to run one Intelligence Index task (rank 31 out of 212) and Verbosity 67M output tokens (rank 39 of 212), alongside a panel comparing Gemini 3.1 Pro Preview against Claude Opus 5 at maximum reasoning.

9월 가용성 질문

이 모델과 관련해 현재 진행 중인 동향이 하나 있는데, 이는 출시가 아니라 의문점입니다. 2026년 9월 18일 이후로 Google 자체 AI Studio 개발자 포럼의 사용자들은 Gemini 3.1 Pro가 AI Studio 모델 선택기에서 사라졌다고 보고하고 있으며 — 스레드 제목은 이 변경을 2026-09-18로 명시하고 있습니다 — 유료 사용자들은 Gemini 3.8 Flash로, 그다음에는 3.7 및 3.6 Flash로 이동되었다고 말하고 있습니다. 우리가 확인한 스레드에는 Google 직원이 답변하지 않았고, 지원 중단 공지도 없으며, 원인도 밝혀지지 않았습니다. 2026년 9월 23일 확인 당시 이 모델은 여전히 목록에 있었고 Gemini API와 자체 카탈로그를 통해 여전히 호출할 수 있었습니다.

우리는 이를 서비스 종료나 장애가 아니라 Google 자체 포럼의 미해결 사용자 제보로 표시하고 있습니다. 하지만 프로덕션 경로가 특히 이 모델에 의존한다면, 이는 프리뷰 엔드포인트가 고정된 것이라고 가정하기보다는 폴백을 구성해 둘 이유가 됩니다.

누가 그것을 선택해야 하며, 누가 선택해서는 안 됩니까?

문제가 길고 멀티모달하다면 Gemini 3.1 Pro를 고르세요. 네이티브 비디오, 오디오, PDF 입력을 지원하는 100만 토큰 창은 여전히 이 모델을 선택하는 이유이며, 모델의 연식이 그 사실을 바꾸지는 않습니다. 구체적으로 말하면, 저장소 전체 분석, 수 시간 분량의 회의 녹음이나 영상을 감사하는 일, 혼합 미디어 문서 세트에서 구조화된 데이터를 추출하는 일, 또는 하나의 프롬프트가 정당하게 200,000 토큰을 넘어가고 그 대안이 직접 구축하고 평가해야 하는 검색 계층인 모든 파이프라인에 해당합니다. 토큰 효율성도 실질적인 두 번째 근거입니다. Gemini 3.8 Flash가 1억 7천만 개를 쓰는 작업 스위트를 6천7백만 개의 출력 토큰으로 끝내므로, 토큰당 요율이 더 높아 보여도 작업당 청구 금액은 더 낮게 나올 수 있습니다.

세 가지 경우에는 다른 것을 고르세요. 어려운 추론이나 장기 호라이즌 코딩 질문에 대해 Google의 현재 최선의 답을 원한다면, Gemini 3.8 Flash는 현재 독립 지수에서 Gemini 3.1 Pro보다 더 높은 점수를 받고, 프리뷰가 아니라 일반 제공 상태이며, 2026년 12월 31일까지 입력 100만 토큰당 $0.75, 출력 100만 토큰당 $3.75의 비용이 들고, Gemini 3.1 Pro에는 없는 무료 티어도 있습니다. 거기에 도달하려면 더 많은 사고 토큰을 소모합니다. 그것이 트레이드오프이며, 실제로 존재하는 트레이드오프입니다. 완전한 최전선이 필요하다면, 지금 그것은 Google 모델이 아닙니다: 같은 지수 차트에서 최대 추론의 Claude Opus 5가 58로 선두이며, Gemini 3.1 Pro는 30입니다. 그리고 워크로드가 지연 시간이나 비용에 민감하고 얕다면 — 분류, 추출, 라우팅, 짧은 요약 — Flash-Lite 티어나 소형 오픈 웨이트 모델이 입력 100만 토큰당 $2.00의 몇 분의 일 비용으로 그 일을 해낼 것이며, 그런 작업에 Pro 요금을 지불하는 것은 그냥 낭비입니다.

우리가 하지 않을 일은 Gemini 3.1 Pro가 Google의 최신 Pro라는 이유로 그것을 고르는 것이다. 그것은 새로운 것이 아니며, 이번 달 현재 Google은 그것을 잇는 출시된 후속 제품이 없다.

프리뷰 엔드포인트에 스택을 걸지 않고 호출하기

7개월짜리 프리뷰의 곤란한 점은, 그 위에 구축할 만큼은 충분히 좋지만 당연시할 만큼 안정적이지는 않다는 것이다. 두 가지 완화책은 언급할 가치가 있다.

별칭 대신 정확한 모델 코드를 고정하세요. 프리뷰 엔드포인트는 제자리에서 개정될 수 있으므로, gemini-3.1-pro-preview를 구성 파일에 적어 두는 편이 떠다니는 “최신 Pro” 참조보다 안전하며, 조용한 변경이 diff에서 드러나게 해 줍니다.

라우팅은 모델 위에 두세요. OrcaRouter에서 Gemini 3.1 Pro는 google/gemini-3.1-pro-preview이며, 저희가 취급하는 다른 모든 모델과 동일한 키, 동일한 엔드포인트로 제공됩니다. Gemini SDK에 맞춰 작성된 코드를 위한 네이티브 /v1beta/models/{model}:generateContent 형태와 그 외 모든 것을 위한 OpenAI 호환 /v1/chat/completions까지 포함해서요. 가격이 0% 마크업의 패스스루이므로, Google 요율표의 $2.00 / $12.00이 여기서 지불하는 금액이며, 공급업체 가격 변경은 다음 청구 주기가 아니라 같은 날 바로 반영됩니다. 이것이 특히 프리뷰 모델에서 중요한 이유는 페일오버입니다. 폴백 체인을 설정해 두면 Gemini 3.1 Pro를 사용할 수 없는 날, 재시도가 사용자가 알아차린 뒤가 아니라 응답이 시작되기도 전에 체인의 다음 모델로 넘어갑니다. 이것이 실제로 출시에 쓸 수 있는 프리뷰와 데모만 할 수 있는 프리뷰의 차이입니다.

해당 모델에 대한 저희 자체 카탈로그 항목에는 우리가 제공하는 그대로의 사양이 실려 있습니다 — 100만 토큰 컨텍스트, 최대 출력 65,536토큰, 오디오/파일/이미지/텍스트/비디오 입력, 텍스트 출력, 그리고 지난 7일간 첫 토큰까지 걸리는 시간 중앙값 10.00초. 이는 이 모델을 채팅 지연 시간 모델이라고 가정하기 전에 알아 둘 만한 점입니다. 이 모델은 그렇지 않습니다.

Generated comparison scoreboard titled 'Gemini 3.1 Pro vs Gemini 3.8 Flash — the scoreboard'. Left column, Gemini 3.1 Pro: AA Index 30, cost per index task $0.67, tokens per index run 67M, output speed 116 tok/s, output price $12.00 / 1M, status Preview. Right column, Gemini 3.8 Flash: AA Index 41, cost per index task $1.24, tokens per index run 170M, output speed 287 tok/s, output price $3.75 / 1M, status Stable. Footer reads 'Index per Artificial Analysis v4.3.2; prices and status per Google docs, 23 Sep 2026.'

아직 열려 있는 것은 무엇인가요?

우리가 매듭짓지 못한 세 가지, 그리고 덮어두기보다 차라리 밝히고 싶은 것. 구글은 Gemini 3.1 Pro가 언젠가 일반 제공(general availability)에 도달할지 말하지 않았고, 어느 쪽이든 공개된 종료 날짜도 없다. AI Studio 관련 보고들은 5일이 지난 지금도 설명되지 않고 있으며, 우리가 찾을 수 있는 벤더 응답은 없었다. 그리고 후속 모델 질문은 부정형으로만 답할 수 있다: 구글의 Pro 페이지는 몇 달째 다가오는 Pro 출시를 광고해 왔고, 보도에 따르면 내부 후보는 Flash 라인을 앞지르지 못해 폐기되었으며, 2026년 9월 23일 현재 출시된 것은 아무것도 없다. Gemini 3.5 Pro나 Gemini 4 Pro가 등장한다면, 이 제품군에서 Gemini 3.1 Pro의 위치는 2월 이후 처음으로 바뀐다 — 그리고 주목할 만한 사건은 원래의 출시가 아니라 바로 그 변화다.

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview, showing the model identifier google/gemini-3.1-pro-preview, Flagship and Featured badges, the byline 'by Google · 2026-02-19', capability tags for Vision, Audio, Tools, JSON and Reasoning, a 1M-token context and 65K maximum output, input modalities listed as audio, file, image, text and video with text-only output, and pricing tiles reading $2.00 per 1M input tokens and $12.00 per 1M output tokens.

Gemini 3.1 Pro는 Google의 정가로 OrcaRouter에 있으며, 저희가 제공하는 다른 모든 모델과 동일한 키로 이용할 수 있습니다.Gemini 3.1 Pro 모델 페이지에서 실시간 가격, 컨텍스트 한도, 그리고 다음 프리뷰 개정판이 나오기 전에 구성할 수 있는 폴백 체인을 확인하세요.

이 글에서 비교한 모델3

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트