
Gemini 4 vs Gemini 4 Argon: 이 두 모델 중 하나는 존재하지 않습니다
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 221 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- xAINEWGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 110 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
Google은 2026년 9월 30일 프런티어 모델을 발표했다. 그것은 대부분의 사람들이 떠올리는 그 모델이 아니다. Gemini 4 Argon은 실제 발표, 실제 요금표, 공개된 벤치마크 세트에 붙은 실제 이름이다. Gemini 4는 그 이름이 속한 패밀리 접두사이며, 오늘날 확인 가능한 기록상 그것은 제품이 아니다. 여기에는 모델 ID도, 엔드포인트도, 모델 카드도, 백만 토큰당 가격도 없다. 따라서 이것은 두 시스템의 비교가 아니다. 이것은 하나의 발표된 모델을, 이 블로그를 포함한 많은 사람들이 몇 달 동안 모델로 취급해 온 하나의 이름과 비교하는 것이다.
그 구분에는 돈이 걸려 있습니다. Gemini 4 Argon은 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $10의 도입 요금을 적용하며, Google이 정의하지 않은 도입 기간이 끝나면 $4와 $20으로 인상됩니다. 이는 Google 자체 발표 게시물에 나온 공급업체 측 수치입니다. 2026년 프로 티어 마이그레이션 예산을 세우고 있다면 $2/$10이 계획의 기준으로 삼을 수 있는 숫자이며, "Gemini 4의 비용이 얼마든"은 숫자가 전혀 아닙니다 — 그것에 관해 발표된 것은 아무것도 없습니다. 아직 발표할 것이 없기 때문입니다.
기록상 'Gemini 4'란 실제로 무엇인가
Gemini 4 제품 페이지를 검색해 보면 단 하나의 문서를 찾게 됩니다: Google이 직접 올린, 제목이 Gemini 4 Argon: 우리의 차세대 프런티어 인텔리전스인 게시물이 2026년 9월 30일 20:00 UTC에 게시되었고 Koray Kavukcuoglu의 이름으로 올라와 있습니다. 자세히 읽어 보면 "Gemini 4"는 독립형 모델로 결코 등장하지 않습니다. 게시물에 있는 모든 능력 주장, 모든 가격, 모든 벤치마크는 전체 이름에 연결되어 있습니다. 축약형은 이름이 접두사로 사용될 때만 나타납니다 — "Gemini 4 Argon의 능력" — 이는 Gemini 3 Pro, Gemini 3.1 Pro 및 네 가지 Flash 변형이 각각 별개의 것이 되기 전에 Gemini 3가 차지했던 것과 동일한 문법적 자리입니다.
세대별 변천사는 그것을 그렇게 해석하는 쪽을 뒷받침한다. Alphabet의 7월 23일 실적 발표 콘퍼런스 콜은 이 구도를 공식 기록으로 남겼다. 순다르 피차이는 차세대 프런티어 모델이 "훨씬 더 큰 기본 모델이 필요하다"라고 말했고, 개선이 필요한 분야로 코딩과 에이전트형 코딩을 꼽았다. 9월 23일 The Information이 주최한 행사에서 카부크추오글루는 사전 학습이 끝났고 모델이 사후 학습 초기 단계에 있으며, 팀이 결과를 확인했고, 연말 훨씬 전에 초기 사후 학습 버전을 출시하기를 바란다고 말했다. Business Insider는 9월 30일 발표를 4 시리즈의 첫 모델이라고 묘사했다. 시리즈라는 점, 바로 그것이 단서다. 이 세 가지는 모두 제3자를 통해 전달된, 해당 업체 자신의 작업에 관한 업체 측 발언이다.
실질적으로 이것이 의미하는 바는: "Gemini 4"는 세대이고, 그 세대에는 이름이 붙은 구성원이 하나뿐이다. Google이 2년 동안 출시해 온 계층 구조 — 맨 위의 Pro, 그 아래의 Flash, 같은 프로그램에서 제한적으로 공개되는 Cyber 변형 — 는 아직 4세대용으로 채워지지 않았다. "Gemini 4 Pro"나 "Gemini 4 Ultra"는 Google 자체의 명명 패턴에서 나온 추론일 뿐, 유출도 로드맵 항목도 아니다. Gemini 4 Argon을 "Gemini 4"와 비교하는 어떤 글도, 한 모델을 자기 성씨와 비교하는 것으로 취급하라.
Gemini 4 Argon이 실제로 무엇인지
Gemini 4 Argon은 2026년 9월 30일 Google 블로그에서 발표되었고, Demis Hassabis는 그날 저녁 X에서 같은 모델을 자신의 말로 발표했다. 출시는 단계적으로 진행되며, 첫 번째 단계에만 날짜가 있다: Argon은 Fairwind Program을 통해 검증된 사이버 방어자들에게 먼저 제공되는데, 이 프로그램은 Google이 정부와 국가 사이버 당국, 핵심 인프라 운영자 및 핵심 기술 플랫폼을 위해 만든 신청 전용 계층이다. Hassabis 자신의 게시물은 회사가 "오늘 우리의 Fairwind Program을 통해 정부와 신뢰할 수 있는 사이버 방어자부터 시작하여" 출시하고 있다고 밝혔다. 그다음으로 Google의 표현은 유료 API 고객과 Google AI Ultra 구독자를 다음 순서로 두고, 그다음 개발자, 기업 및 소비자를 둔다. 그 이후 단계 중 어느 것에도 날짜는 없다.
그 목록에 없는 것이 바로 업무를 계획하는 누구에게나 중요한 부분이다: 일반 제공(GA) 일자, 모델 ID, 컨텍스트 윈도, 파라미터 수, 모델 카드 또는 시스템 카드. 구글이 공개한 것은 컨텍스트 윈도가 아니라 출력 한도다. 그것은 100만 토큰으로, 이전 Gemini 제품군이 사용하던 64K 상한에서 늘어난 것이며, 구글은 이를 업계 최고라고 부른다. 단일 호출이 반환할 수 있는 양이 10배로 늘어난 것은 긴 에이전트 궤적과 단일 샷 렌더링에 실질적인 변화이며, 이는 이번 발표에서 모호함이 전혀 없는 단 하나의 기술 수치다.

벤치마크 세트는 광범위하며 전혀 재현되지 않았습니다. Google은 DeepSWE v1.1에서 77.9%, AutomationBench에서 51.3%로 1위, LVBench에서 91.7%, CWE-bench v1에서 68%로 공동 1위, Vals Index, 자사의 Vals Finance Agent v2, Harvey의 Legal Agent Benchmark에서 선도적인 결과를, 그리고 Gray Swan의 Indirect Prompt Injection 벤치마크에서 가장 강력한 성적을 보고했습니다. 그 모든 수치는 벤더 자체의 수치이며, 벤더가 발표한 것이고, 어느 것도 독립적으로 재현되지 않았습니다. 9월에 유포된 별도의 수치 세트는 예측된 Gemini 4 벤치마크로 제시되었으며 AutomationBench 점수 48.7%를 포함했지만, 관련 없는 출시에서 재활용된 것으로 밝혀졌고 Google의 발표가 아닙니다. Google이 실제로 보고한 AutomationBench 수치는 51.3%이며, 이는 다른 출처에서 나온 다른 숫자입니다.
두 이름이 만들어내는 스코어보드
이 둘을 이 조합이 실제로 작동시키는 여섯 가지 차원에 나란히 놓고 보면, 문제의 윤곽은 명백하다:
• 이름이 지정된 제품으로 존재함 — Gemini 4: 아니요. Gemini 4 Argon: 예, 2026-09-30에 발표됨.
• 현재 호출 가능 — Gemini 4: 모델 ID나 엔드포인트가 존재하지 않습니다. Gemini 4 Argon: 모델 ID나 엔드포인트 역시 존재하지 않으며, 접근은 Fairwind를 통해서만 가능하고 신청 방식으로만 허용됩니다.
• 가격 — Gemini 4: 공개된 가격 없음. Gemini 4 Argon: 백만 토큰당 $2 / $10의 출시 기념 가격, 이후 $4 / $20. 공급업체 발표 기준.
• 최대 출력 — Gemini 4: 공개된 수치 없음. Gemini 4 Argon: 100만 토큰, 이전 세대의 64K 대비. 제조사 발표 기준.
• 지능 지수 — Gemini 4: 평가되지 않음. Gemini 4 Argon: 높은 추론 강도에서 Artificial Analysis의 Intelligence Index 53점, 지수 작업당 비용 $1.99. Artificial Analysis 기준.
• 독립 리더보드 순위 — Gemini 4: 순위 없음. Gemini 4 Argon: Vals Index에서 68.90%로 1위, 테스트당 비용 $15.68, 13.40B 입력 및 142.01M 출력 토큰에 걸쳐. Vals 기준.

마지막 두 행을 함께 읽으면 이 비교에서 유일하게 진짜 흥미로운 불일치가 드러난다. Artificial Analysis는 Gemini 4 Argon을 53에 배치하는데, 이는 Claude Fable 5.1 및 GPT-6 Astra와 같은 수준이며 58인 Claude Opus 5.5보다 5점 뒤처진다. Vals는 이를 단연 1위로 둔다. 둘 다 독립적이고, 둘 다 실재하는 무언가를 측정하고 있으며, 서로 다른 것을 측정한다. AA의 지수는 코딩, 추론, 지식 노동 전반에 걸친 고정된 10개 평가 세트에 가중치를 두는 반면, Vals Index는 미국 경제 부가가치에서 차지하는 비중에 따라 네 개 부문에 가중치를 둔다. 어느 쪽 보드도 틀리지 않고서도 한 모델이 한쪽에서는 앞서고 다른 쪽에서는 앞서지 못할 수 있다.
Vals 행에서 눈여겨볼 두 번째 사항이 있으며, 이는 엔터프라이즈 구매자가 주의해야 할 부분입니다. Vals는 Argon의 요율표를 $4/$20, 즉 도입 이후 가격으로 기록하고 있지만, Google의 자체 발표는 $2/$10이라고 말합니다. 테스트당 $15.68 비용이 $4/$20 기준으로 계산된 것이라면, 도입 요율을 적용받는 구매자는 동일한 작업에 대해 상당히 낮은 수치를 보게 될 것이고, 도입 기간을 놓친 구매자는 그렇지 않을 것입니다. Google은 그 기간이 얼마나 지속되는지 밝히지 않았습니다. 이 하나의 정의되지 않은 변수가 전체 출시에서 가장 의사결정에 중요한 수치를 좌우합니다.
오늘 전화할 수 있는 것
Gemini 4라는 이름 아래에는 아무것도 없으며, 여기에는 저희도 포함됩니다. 카탈로그를 확인했습니다: google/gemini-4, google/gemini-4-argon, google/gemini-4-pro, google/gemini-3.8-flash-cyber는 모두 "모델을 찾을 수 없음"을 반환하며, 다른 모든 라우팅 플랫폼도 마찬가지입니다. 그 어느 곳에도 라우팅할 모델 ID가 없기 때문입니다. Gemini API 자체의 모델 목록 — Gemini 3.8 Flash, Gemini 3.8 Live, Gemini 3.1 Pro, Gemini 3 Flash — 에는 그 어떤 종류의 Gemini 4 항목도 없습니다. Argon이 Fairwind 대기열을 통과해 식별자를 받기 전까지는 청구되는 가격도 없고, 어디에도 엔드포인트가 없습니다.
실제 서비스 중인 Google 프로 등급은 이야기가 다릅니다. Gemini 3.1 Pro Preview는 2026년 2월 19일부터 백만 토큰당 입력 $2.00, 출력 $12.00에 1,048,576토큰 컨텍스트 윈도우, 최대 출력 65,536토큰, 그리고 텍스트, 이미지, 오디오, 비디오, 파일 전반에 걸친 멀티모달 입력을 갖춘 채로 우리 카탈로그에 들어와 있습니다. 8개월이 지난 지금도 Gemini API 자체 모델 목록에서는 여전히 Preview로 표기되어 있는데, 이는 그 자체로 Argon이 존재하는 근거입니다. 입력 토큰이 200,000개를 넘어가면 요금은 두 배로 올라 $4와 $18이 됩니다.

이 비교에서 운영상의 답이 나오는 곳은 바로 여기입니다. Gemini 3.1 Pro Preview는 우리가 라우팅하는 다른 200개가 넘는 모델과 동일한 OpenAI 호환 엔드포인트 뒤에서, 제공사 정가 그대로, 마크업 없이 라이브로 제공됩니다. 그래서 Google이 언젠가 Gemini 4 Argon의 식별자와 청구 요율을 공개하고, 이어서 이름 짓기 패턴이 유지된다면 그 Pro 등급 형제 모델까지 공개하게 되면, 이 패스스루 덕분에 그 요율은 Google 쪽에 나타나는 그날 우리 쪽에도 나타납니다. 그때까지는, pro 등급에 대해 읽기만 하지 않고 직접 측정해 보고 싶다면, 측정할 모델은 바로 그것입니다. 아직 동작 특성이 규명되는 중인 모델을 시험해 보고 싶다면, 자동 장애 조치를 여러 제공사에 걸쳐 사용하는 것이, Google 스스로 단계적 도입이라고 설명하는 프리뷰에 프로덕션 경로를 걸지 않고 시도하는 방법입니다.
가격과 함께 짚고 넘어가야 할 한 가지 주의사항
블룸버그는 9월 30일, Argon에 직접 접근할 수 있는 일부 Google 직원들이 Argon이 실제 작업에서 벤치마크 점수가 시사하는 것보다 성능이 떨어진다고 말한다고 보도했으며, 특히 프런트엔드 디자인이 지목되었고 두 명의 직원이 "benchmaxxing"이라는 용어를 사용했습니다. Google은 이러한 평가에 이의를 제기합니다. 벤치마크 목록이 이 모델에 대한 전체 공개 증거 기반이기 때문에 바로 그 벤치마크 목록 옆에 이 보도를 놓고 볼 가치가 있습니다. 한 공급업체의 수치만 있고 이를 재현할 방법이 없을 때, 그 수치가 전부를 말해주지 않는다는 보도는 각주가 아닙니다. 그것은 증거의 절반입니다.
누가 무엇을 골라야 할까
만약 이 두 이름 중에서 고르고 있다면, 당신은 아직 실제로 아무것도 고르고 있는 것이 아니며, 솔직한 조언은 비교가 아니라 그 점을 기준으로 계획하라는 것입니다.
• 이번 분기에 프로덕션에서 Google 프로 등급 모델이 필요하다면, 답은 Gemini 3.1 Pro Preview입니다. 이 모델은 호출 가능하고, 가격도 책정되어 있으며, Argon이 대체하도록 포지셔닝되고 있는 등급입니다. Argon을 기다리는 것은 참여할 수 없는 대기열을 기다리는 것입니다.
• Argon이 접근을 제한하는 대상에 해당한다면 — 정부 사이버 당국, 핵심 인프라 운영자, 소프트웨어 유지관리자 — Fairwind 프로그램이 유일한 경로이며, 그 게이트가 이토록 구체적이라는 점은 마케팅이 아니라 모델의 역량에 관한 사실이다. Google은 취약점 발견 및 패치를 위해 이를 훈련했고 일반적으로 출시하지 않았다.
• 2026년 마이그레이션 예산을 책정하는 경우, 도입 기간에는 $2/$10을 사용하고, 그 이후의 모든 항목에는 $4/$20을 사용하세요. 단일 혼합 수치를 사용하지 말고, V의 $15.68 테스트당 비용을 사용하지 말고, 어떤 요율표에서 계산되었는지 확인하세요.
• "Gemini 4"를 기다리고 있다면, 모델 ID를 기다려라. 그 이름도 결국 ID를 갖게 될 것이다 — 3세대에 걸친 Google의 명명 패턴은 Pro 등급과 Flash 등급이 각자 고유 식별자를 받는다고 말해준다 — 하지만 그 패턴은 발표가 아니며, 아무 수식어도 없는 Gemini 4가 무엇일지, 비용이 얼마일지, 무엇을 할지에 관해서는 공개된 바가 없다.
더 넓은 요점은 이 블로그가 전에도 짚어야 했고 앞으로도 아마 다시 짚어야 할 것이다: 세대 이름은 모델이 아니다. Gemini 4 Argon은 Google이 이름과 가격, 벤치마크 세트, 접근 계획을 모두 내건 유일한 것이다. 나머지 제품군은 하나의 패턴이며, 패턴은 예측할 수는 있어도 이름을 붙여 부를 수는 없는 것이다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
