Gemini 3.7 Flash와 Grok 4.6 비교를 위한 제목 카드로, Gemini 3.7 Flash 쪽에는 번개가 그려진 50% 할인 가격표가 있고, Grok 4.6 쪽에는 체크 표시가 있는 방패가 서로 마주보고 있는 모습을 보여줍니다.
Guides & Insights

Gemini 3.7 Flash vs Grok 4.6: Google의 가격 전쟁 vs SpaceXAI의 자체 검증 에이전트

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Gemini 3.6 Flash가 대체로 실패한 지 3주 후, Go​ogle은 가격을 절반으로 인하하고 Gemini 3.7 Flash를 출시했다. 대부분의 보도는 이번 조치를 Grok 4.6 — SpaceXAI가 전날 $2와 $6에 출시한 에이전트 특화 플래그십 모델 — 에 대한 직접적인 겨냥으로 읽었다. 타이밍이 핵심이다: 하루 차이로 출시된 프런티어급에 가까운 두 모델이 모두 같은 구매자 — 프런티어 가격을 지불하지 않고 에이전틱 코딩을 원하는 팀 — 를 겨냥했으며, 정반대의 가격 철학에 따라 책정되었다. Go​ogle은 5개월 프로모션으로 반응을 사고 있다. SpaceXAI는 작업당 고정 정가로 신뢰를 판매한다.

2026년 8월 12일에 출시된 Grok 4.6은 SpaceXAI가 1.5조 매개변수 규모의 Grok 4.5 기반 모델을 개선한 버전으로, 자신의 하위 작업 완료를 검증하는 장기 실행 에이전트를 위해 설계되었습니다. 500K 컨텍스트 창과 텍스트·이미지 입력을 지원하며, $2/$6 요금은 입력 토큰이 200K를 초과하면 두 배가 됩니다. 2026년 8월 13일에 출시된 Gemini 3.7 Flash는 Go​ogle이 Gemini 3.6 Flash를 알고리즘적으로 개선한 버전으로, 1M 컨텍스트와 비디오·오디오를 포함한 멀티모달 입력을 지원하며, 프로모션 요금 $0.75/$3.75는 2027년 1월 1일부터 $1.50/$7.50으로 두 배가 됩니다. 독립적인 Artificial Analysis Intelligence Index에서 Grok 4.6은 61점을 기록해, Gemini 3.7 Flash의 초기 측정값 약 56점보다 확실히 한 단계 위입니다.

가격 전쟁, 차원당 한 줄

1M 입력당 가격 — Gemini 3.7 Flash $0.75(도입) vs Grok 4.6 $2.00. Google은 60% 이상 저렴합니다.

1M 출력당 가격 — Gemini 3.7 Flash $3.75(도입) vs Grok 4.6 $6.00.

2027년 1월 1일 이후Gemini는 $1.50/$7.50로 두 배가 되는 반면, Grok은 $2/$6로 변함없습니다.

컨텍스트 창 — Gemini 3.7 Flash 1M vs Grok 4.6 500K.

긴 입력 과금 — Gemini는 전체 창에 걸쳐 균일 요금을 부과하지만, Grok은 입력이 200K 이상일 때 $4/$12로 두 배가 됩니다.

추론 토큰 — Gemini는 이를 출력으로 청구하는 반면, Grok의 비용은 독립적으로 측정된 태스크당 ~$0.84에 포함됩니다.

한 줄 요약: Gemini 3.7 Flash는 오늘 기준 모든 요금 항목에서 더 저렴하지만, 그 이점의 대부분은 1월 1일에 사라진다. Grok 4.6은 8월에 받을 가격과 3월에 받을 가격이 동일하다.

A comparison scoreboard for Gemini 3.7 Flash and Grok 4.6: Gemini at AA Index ~56, $0.75/$3.75 intro pricing, 1M context, Google-reported GDPVal-AA v2 of 1,525 and per-task cost not yet measured, versus Grok 4.6 at AA Index 61, $2/$6, 500K context, GDPVal-AA v2 of 1,753 and about $0.84 per task per Artificial Analysis, both proprietary.

Gemini 3.7 Flash의 돈은 어디로 갔는가

Google 자체 수치에 따르면 Gemini 3.7 Flash는 3.6 Flash 대비 큰 폭의 상승을 기록했습니다: DeepSWE v1.1에서 65.3%(기존 49.0%), FrontierCode 1.1 Main에서 43.6%(기존 34.4%), Terminal-bench 2.1에서 85.8%(기존 78.0%), 그리고 WebDev Arena Elo 1588(기존 1538)을 달성했습니다. 이는 벤더가 보고하고 재현되지 않은 수치입니다. 즉, 특정 벤더 간의 평가가 아니라 변화의 궤적을 측정하는 종류의 숫자입니다. 그러나 핵심은 바로 그 궤적에 있습니다: 리뷰어들이 대체로 평가절하했던 출시 3주 만에 수정 사항이 반영된 것은, Google이 플래그십이 아닌 Flash 등급을 전장으로 삼고 있다는 사실을 말해줍니다.

Google의 프로모션이 하는 또 다른 일은 구매 기간을 압축하는 것입니다. $0.75/$3.75에서는 이 모델이 대량 테스트하기에 충분히 저렴하고, $1.50/$7.50에서는 여전히 경쟁력이 있지만 더 이상 가격 전쟁 무기는 아닙니다. 도입 기간에 이를 채택한 모든 프로덕션 팀은 그 수치가 자신들과 함께 움직일 것이라고 가정하지 말고 12월에 그 경제성을 재평가해야 합니다.

Grok 4.6의 자금은 어디로 갔는가

Grok 4.6의 차별점은 다릅니다. 더 저렴한 토큰이 아니라 낭비되는 토큰이 더 적다는 것입니다. 이 모델은 스스로 검증하도록 훈련되었습니다. 즉, 다음 단계로 넘어가기 전에 하위 작업이 실제로 완료되었는지 확인하는 것입니다. 그리고 독립적인 측정이 그 효과를 뒷받침합니다. Artificial Analysis는 작업당 비용을 약 $0.84로 평가하며, GDPVal-AA v2는 1,753, Intelligence Index는 61입니다. 이는 제3자 수치이며, 이번 대결에서 가장 강력한 숫자입니다. 토큰당 가격이 놓치는 것을 포착하기 때문입니다. 즉, 작업을 완료하는 데 더 적은 턴이 필요한 모델은 토큰 가격이 더 높더라도 완료된 작업당 비용이 더 저렴합니다.

절충점은 더 저렴한 모델에 여지가 있는 부분입니다. Grok 4.6의 500K 컨텍스트는 Gemini 3.7 Flash의 1M의 절반이고, $2/$6 요금은 200K 입력을 초과하면 두 배가 됩니다. 따라서 긴 컨텍스트의 높은 입력 워크로드는 바로 Grok 4.6의 정가가 프로모션 Gemini 요금과 경쟁력을 잃는 지점입니다.

작업별 경제성

인트로 가격 기준으로 Gemini 3.7 Flash의 80/20 입력/출력 비율 혼합 요금은 대략 토큰 100만 개당 $1.35이고, 같은 비율에서 Grok 4.6의 표시 가격은 장기 입력 페널티 적용 전 토큰 100만 개당 $2.80입니다. 서류상으로는 Go​ogle 모델이 압도적인 볼륨 승자처럼 보입니다. 문제는 Gemini의 thinking 토큰이 출력으로 청구되고, 벤치마크 주장은 일주일 전 것이며, 작업별 효율성은 아직 독립적으로 측정된 적이 없다는 점입니다. 반면 Grok 4.6은 측정된 바 있습니다. 값싼 토큰에 낭비된 턴이 섞이면 작업을 끝내는 비싼 토큰보다 더 많은 비용이 들 수 있습니다. 그리고 이 매치업은 한쪽은 그 질문에 대한 데이터가 있고 다른 쪽은 없는 상황입니다.

파이프라인에 베팅하지 않고 새 모델에 베팅하기

Grok 4.6은 OrcaRouter에서 SpaceXAI의 $2/$6 정가에 0% 마크업으로 제공되며, 모델 페이지가 라우팅 레이어에서 실시간으로 가져오는 200K 초과 시의 2배 단계도 포함됩니다. Gemini 3.7 Flash는 하루 전에 출시되었고 Go​ogle 자체 API에서 제공됩니다. 그 전작인 Gemini 3.6 Flash는 OrcaRouter에서 Go​ogle의 정가로 제공됩니다.

The OrcaRouter model page for grok/grok-4.6, showing the New and Featured badges, the $2.00 per million input and $6.00 per million output pricing, a 500K-token context window, and the released August 12, 2026 label.The OrcaRouter model page for google/gemini-3.6-flash, showing the $1.50 per million input and $7.50 per million output pricing and the 1M-token context window.

이 비교가 실제로 묻는 질문이 "새 저렴한 모델에 내 에이전트 파이프라인을 걸어야 할까"라면, 라우팅 계층이 바로 그 헤지다: 오늘은 Grok 4.6에서 에이전트를 실행하고 Gemini 3.7 Flash가 출시되는 날 전환하는 장애 조치 규칙, 또는 두 모델이 모두 답하고 판정자가 이를 조정하는 퓨전 패널 — 라우팅 DSL이 존재하는 이유이자, 증거가 확보되기 전에 한쪽을 선택할 필요가 없는 설정이다.

솔직한 해석

오늘 가장 저렴한 토큰을 원하고 3주 처리 기간을 신뢰한다면, Gemini 3.7 Flash는 공격적인 선택입니다 — {{1}}가격 전쟁은 실제이며, 벤치마크 성과는 보고되었고, 출시 기간은 진짜 할인입니다{{/1}}. {{2}}에이전트 효율성이 독립적으로 측정되고, 1월에도 가격이 변하지 않으며, 장기 실행 작업을 위해 설계된 자체 검증 루프를 갖춘{{/2}} 모델을 원한다면, Grok 4.6은 보수적인 선택이고, AA 데이터는 완료된 작업당 비용에서 우위를 제공합니다. 한쪽은 카운트다운이 있는 세일이고, 다른 쪽은 실적이 있는 가격입니다. 둘 다 타당합니다 — {{3}}그래서 이번 비교는 형식이 아닌 진짜 비교입니다{{/3}}.

이 글에서 비교한 모델2

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트

© 2026 OrcaRouter

제공업체용

추론 플랫폼을 운영하시나요? OrcaRouter에 모델을 등록하세요.

providers@orcarouter.ai

커뮤니티에 참여하세요

Discordsupport@orcarouter.aiXGitHubYouTube