'Claude Fable 5.1 vs Gemini 3.1 Pro'를 위한 히어로 타이틀 카드, 부제 '9일 된 플래그십 vs 7개월 프리뷰', 두 개의 둥근 카드 — 왼쪽 'Claude Fable 5.1' (2026년 9월 1일 출시, 1M당 $10.00 / $50.00, AA Index 66), 오른쪽 'Gemini 3.1 Pro' (2026년 2월 19일부터 프리뷰, 1M당 $2.00 / $12.00, 멀티모달) — 그 사이에 VS 버블, 그리고 오른쪽 하단에 OrcaRouter 로고.
Guides & Insights

Claude Fable 5.1 vs Gemini 3.1 Pro: 9일 된 플래그십 vs 7개월 된 프리뷰

작성자

Alistair Wren

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Claude Fable 5.1Gemini 3.1 Pro Preview에 대해 잘못된 질문을 던지면 지루한 답을 얻게 될 것입니다. 새로운 Anthropic 플래그십이 더 뛰어나고 Google 모델이 더 저렴하다는 것, 그걸로 끝이죠. 실제로 이 대결의 승패를 가르는 질문은 바로 모델의 연식입니다. Claude Fable 5.1은 2026년 9월 1일에 출시되어, 이 글이 쓰이는 시점 기준으로 출시된 지 9일밖에 되지 않았습니다. Gemini 3.1 Pro Preview는 2026년 2월 19일에 출시되었고, Google은 여전히 이 모델을 프리뷰라고 표시합니다. 즉, 이 모델은 거의 7개월 동안 변경 없이 방치된 반면, 더 새로운 Gemini 릴리스들(3.5, 3.6, 3.7 Flash 등급, 그리고 9월 2일의 Gemini 3.8 Flash)은 속속 출시되어 평가를 받고 이 모델을 추월했습니다. 이 둘을 비교하는 것은 벤치마크 테스트라기보다는 서로 매우 다른 두 릴리스 철학에 대한 베팅에 가깝습니다. 그리고 신선도 격차야말로 모든 사양표가 빼먹는 부분입니다.

7개월간의 프리뷰, 9일간의 플래그십

Gemini 3.1 Pro는 2월 당시 Google의 프런티어 추론 모델이었습니다. 그 시점 기준으로는 "프런티어"였으며, 강력한 소프트웨어 엔지니어링 및 에이전트 기능과 여전히 차별화되는 네이티브 멀티모달 기반을 갖추고 있었습니다. Google은 이후 이 모델을 일반 공급(GA)하지 않았습니다. 프리뷰 상태로 7개월이 지나는 동안 Anthropic은 두 세대의 플래그십을 출시했습니다: 7월 24일의 Claude Opus 5, 그리고 현재의 Claude Fable 5.1입니다. Anthropic은 후자를 Opus 클래스 위의 Mythos급 계층으로 포지셔닝하며, Artificial Analysis Intelligence Index에서 66점으로 1위를 차지했습니다. Gemini 3.1 Pro를 선택하는 것은 Google이 이미 다른 라인업에서 후속 모델 결정을 사실상 내린 모델을 선택하는 것이며, Claude Fable 5.1을 선택하는 것은 Anthropic이 현재 개선하고 있는 모델을 선택하는 것입니다.

그 비대칭성은 세부 조항에서 드러납니다. 동결된 프리뷰는 표준으로 채택한 기능이 GA 다듬기, 가격 재조정, 후속 포인트 릴리스를 결코 받지 못할 위험을 수반합니다. 9일 된 플래그십은 정반대의 위험을 수반합니다. 즉, 다음 달에 5.2나 포인트 릴리스가 출시되어 기준을 바꿔버릴 수 있다는 것입니다. 어느 위험도 피할 수 없습니다. 핵심은 두 위험이 반대 방향을 가리키고 있고, 어느 쪽을 감수할 수 있는지가 이 결정에 실질적인 입력값이라는 점입니다.

나란히 보는 사양 시트

• 가격 — Claude Fable 5.1은 1M당 $10.00 / $50.00이고, Gemini 3.1 Pro는 200K 입력 토큰까지 1M당 $2.00 / $12.00, 200K 초과 시 $4.00 / $18.00입니다. 기본 티어에서 입력은 약 5배, 출력은 약 4배 저렴합니다.

• 컨텍스트 / 최대 출력 — 둘 다 1M 토큰 컨텍스트를 지원; Claude Fable 5.1은 최대 128K까지 출력하는 반면, Gemini 3.1 Pro는 약 65K 상한.

입력 — Claude Fable 5.1은 텍스트와 이미지를 지원합니다. Gemini 3.1 Pro는 텍스트, 이미지, 오디오, 비디오, PDF를 지원하며 네이티브 Google Search grounding을 포함합니다.

• 독립 점수 — Claude Fable 5.1은 Artificial Analysis Intelligence Index에서 66점(최대 노력)이고, Gemini 3.1 Pro는 40점대 후반입니다 (출시 당시 57점이었지만 AA가 평가를 다시 실행하면서 점차 하락했습니다).

• 속도 — Gemini 3.1 Pro는 OrcaRouter 자체 텔레메트리에 따르면 초당 약 540토큰을 스트리밍하는 반면, Artificial Analysis가 측정한 Claude Fable 5.1은 초당 67.2토큰입니다 — 즉 반대 방향으로 큰 처리량 격차가 있습니다.

• 상태 — Claude Fable 5.1 stable, GA, 2026-09-01 출시; Gemini 3.1 Pro Preview, 2026-02-19 출시, 2026년 9월 중순 기준 GA되지 않음.

A two-column scoreboard titled 'Claude Fable 5.1 vs Gemini 3.1 Pro — the scoreboard'. Left column 'Claude Fable 5.1': 'Price $10.00 / $50.00 per 1M', 'Released Sep 1, 2026 (GA)', 'AA Intelligence Index 66 (max)', 'Max output 128K', 'Inputs text + image', 'Cache read $0.25'. Right column 'Gemini 3.1 Pro': 'Price $2.00 / $12.00 per 1M (≤200K)', 'Released Feb 19, 2026 (Preview)', 'AA Intelligence Index upper 40s', 'Max output ~65K', 'Inputs text, image, audio, video, PDF', 'Cache read $0.20'. Footer: 'AA per Artificial Analysis; component benchmarks vendor-reported, unreproduced.'

정직하게 표시된 벤치마크 이미지

순수 역량 측면에서 두 모델은 같은 등급이 아니며, 독립 지표는 어떤 벤더 슬라이드보다 더 명확하게 이를 보여준다. Claude Fable 5.1의 Artificial Analysis Intelligence Index(최대 노력) 66점은 AA가 기록한 최고 점수이다. 다만 Anthropic이 기본 대체 구성으로 제공하는 모델의 AA 페이지에는 53점으로 여전히 201개 중 1위로 기재되어 있다. 반면 Gemini 3.1 Pro는 40점대 후반에 머문다. Anthropic이 보고한 구성 요소 벤치마크에서 Fable 5.1은 Terminal-Bench 4.0에서 55.8%, Terminal-Bench-Science 0.1에서 52.6%를 기록했는데, 이는 아직 어떤 독립 테스트에서도 Gemini 3.1 Pro에 귀속된 적 없는 점수이다. 널리 검증된 SWE-bench 스타일 지표에서 Gemini 3.1 Pro의 2월 시기 주장(제3자 트래커 기준 SWE-bench Verified 약 75%)은 현재 Claude 세대에 크게 뒤처진다.

솔직한 경고는 모든 멀티모달 측면에서는 반대 방향으로 작용합니다. Gemini 3.1 Pro는 네이티브 오디오, 네이티브 비디오, PDF를 읽을 수 있고, Google Search가 모델에 내장되어 있습니다. 이는 Claude Fable 5.1이 전혀 제공하지 않는 기능입니다. Anthropic의 플래그십 모델은 텍스트와 이미지만 처리하기 때문입니다. 긴 문서, 긴 비디오, 또는 검색 기반 작업에서 Gemini 3.1 Pro는 단순히 더 저렴할 뿐만 아니라, 두 모델 중 단일 호출로 해당 작업을 수행할 수 있는 유일한 모델입니다. 이것은 실제 우위이며, 당신이 보는 모든 벤치마크가 텍스트와 코드에 집중되어 있을 때 그 중요성을 과소평가하기 쉽습니다.

Screenshot of the Artificial Analysis model page for Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback), captured September 10, 2026, showing a #1-of-201 ranking, an Intelligence Index of 53 for the default-fallback configuration, pricing of $10.00 per 1M input and $50.00 per 1M output with a 98% cache discount, a cost of $7.63 per Intelligence Index task, and 190M output tokens against a 92M median.

가격 절벽은 실제 비용 이야기를 숨긴다.

Gemini 3.1 Pro의 홍보 요금인 $2/$12는 요청당 입력 200K 토큰 미만에만 적용됩니다. 이를 초과하면 전체 요청이 입력 $4.00, 출력 $18.00으로 재책정되는데, 입력 기준으로 두 배가 되는 셈이라 장문 컨텍스트 Gemini 호출은 마케팅 수치가 암시하는 것보다 훨씬 저렴하지 않습니다. Claude Fable 5.1의 $10/$50은 모든 길이에서 동일하며, 캐시 읽기는 $0.25로 세션이 컨텍스트를 재읽을수록 자체 정가 대비 상대적으로 더 저렴해집니다. 교차 지점은 워크로드 형태에 따라 달라집니다. 짧고 대용량의 멀티모달 호출은 Gemini 3.1 Pro를 압도적으로 유리하게 만들고, 큰 컨텍스트를 반복적으로 재읽는 긴 에이전트 세션은 성능 논쟁을 배제하더라도 Claude Fable 5.1의 캐시 경제성이 유리합니다.

누가 어떤 것을 골라야 하나요

워크로드가 진정한 멀티모달이거나 검색 기반일 때, 낮은 가격의 처리량이 추론 곡선의 최고점보다 더 중요할 때, 그리고 Google이 7개월 동안 프리뷰로 남겨둔 모델을 표준화하는 데 부담이 없을 때 — 가급적이면 Google이 다음에 GA로 출시할 모델로의 마이그레이션 경로와 함께 — Gemini 3.1 Pro를 선택하세요. 현재 추론 성능의 최고 수준이 필요할 때, 128K 출력 한도와 $0.25 캐시 읽기가 중요한 장기 에이전트를 구축할 때, 그리고 공급업체가 적극적으로 개선 중인 모델에 베팅하고 싶을 때는 Claude Fable 5.1을 선택하세요. 둘 다 OrcaRouter에서 공급업체의 정가로 제공됩니다. 마크업 없이 제공되므로, 이 결정의 라우팅 DSL 버전은 나중에 변경하기 쉽습니다: 멀티모달 및 대용량 트래픽을 Gemini 3.1 Pro로 보내고, 어려운 추론 및 에이전트 트래픽은 Claude Fable 5.1로 에스컬레이션하고, Google이 마침내 Pro 티어를 GA로 출시하는 날 — 또는 Anthropic이 Fable 5.1 이후의 무언가를 출시하는 날 — 분할을 다시 조정하세요.

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview), showing $2.00 per 1M input and $12.00 per 1M output, the 1M-token context window with 65K max output, and Vision/Audio/Tools/JSON/Reasoning capability chips.

이 글에서 비교한 모델3

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트

© 2026 OrcaRouter

제공업체용

추론 플랫폼을 운영하시나요? OrcaRouter에 모델을 등록하세요.

providers@orcarouter.ai

커뮤니티에 참여하세요

Discordsupport@orcarouter.aiXGitHubYouTube