'Mercury 2.5 Preview vs Grok 4.6'에 대한 히어로 타이틀 카드로, 부제는 '1,107토큰/초 프리뷰가 가치 챔피언을 꺾을 수 있을까?'이며, '1,107 tok/s'라고 적힌 번개 모양 칩, '가격 vs 속도'라고 적힌 저울 칩, 'AA #3'라고 적힌 트로피 칩, 그리고 오른쪽 하단 모서리에 OrcaRouter 로고가 표시됩니다.
Guides & Insights

Mercury 2.5 Preview vs Grok 4.6: 초당 1,107토큰을 처리하는 프리뷰가 가성비 챔피언을 위협할 수 있을까?

작성자

Alistair Wren

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

한 문장으로 답하면 다음과 같습니다: Mercury 2.5 Preview는 오늘날 프로덕션에서 토큰 100만 개당 $0.04 / $0.15로 가장 저렴한 신뢰할 수 있는 추론 모델이고, Grok 4.6은 지능 최전선에서 토큰 100만 개당 $2.00 / $6.00로 가장 저렴한 모델이므로, 둘 사이의 실질적인 질문은 Inception이 단지 "GPT-5.6 Luna (Low) 및 Claude Haiku 4.5와 견줄 만하다"고만 주장하는 프리뷰 확산 모델이, 그렇지 않으면 최전선 등급에 비용을 지불해야 할 작업을 처리할 수 있느냐는 것이며, 2026년 8월 31일에 출시된 Mercury 2.5 Preview는 토큰을 병렬로 생성해 표준 GPU에서 초당 1,107개 토큰을 처리한다고 주장하고, 2026년 8월 12일에 출시된 최전선 플래그십 Grok 4.6은 Artificial Analysis Intelligence Index에서 61점을 기록해 전 세계 공동 3위에 올랐으며, 그런 성능을 최전선에서 본 적 없는 가격에 제공하므로, 가격 곡선의 최하단에서 가장 빠르다는 주장과 최상단에서 최고의 가치가 만나는 이 충돌이 바로 이 글의 주제입니다.

주요 시사점

• Grok 4.6은 AA Intelligence Index 61과 함께 $2.00 / $6.00에 제공되며, 프론티어 티어에서 가성비 챔피언입니다; Mercury 2.5 Preview는 $0.04 / $0.15로, 가격이 1/50에 불과하면서도 충분히 좋은 품질이 좀처럼 필요하지 않은 프론티어 품질을 이길 것이라는 베팅입니다.

Mercury 2.5 Preview의 속도 및 품질 주장은 전적으로 Inception의 것이며, 출시 첫날에는 독립적인 벤치마크 점수가 존재하지 않았습니다.

• Mercury 2.5 Preview의 출시 할인 80%는 2026년 9월 8일에 종료되며, 이후 정가는 $0.20 / $0.75입니다. 이는 입력 기준으로 여전히 Grok 4.6보다 10배 저렴하지만, 그 이야기는 덜 중요해집니다.

• Grok 4.6은 오늘 OrcaRouter에서 정가로 라우팅됩니다. Mercury 2.5 Preview는 아직 라우팅되지 않았으며, Inception의 자체 API와 여러 타사 플랫폼을 통해 제공됩니다.

점수판

A two-column scoreboard titled 'Mercury 2.5 Preview vs Grok 4.6 — the scoreboard': left column Mercury 2.5 Preview — Intelligence claimed cheap-tier parity, Price $0.04/$0.15 (80% off), Speed 1,107 tok/s (claimed), Context 260K, Agentic no public scores, Weights closed; right column Grok 4.6 — Intelligence AA Index 61 (#3), Price $2.00/$6.00, Speed not a headline spec, Context 500K, Agentic APEX-Agents 57.5, Weights closed; footer 'Mercury figures vendor-reported, unreproduced; Grok per xAI and Artificial Analysis'.

지능 — Mercury 2.5 Preview: 독립 지수 없음. Inception은 비용 최적화 등급과 동등한 성능을 주장함. Grok 4.6: AA Intelligence Index 61, 전 세계 공동 3위 (Artificial Analysis 기준, 연구소 자체 수치는 벤더 보고 수치임).

가격 — Mercury 2.5 미리보기: 1M당 $0.04 / $0.15 (2026년 9월 8일까지 $0.20 / $0.75에서 80% 할인). Grok 4.6: 1M당 $2.00 / $6.00, 200K 토큰 이상의 프롬프트는 $4.00 / $12.00으로 두 배가 됩니다.

속도 — Mercury 2.5 Preview: 공급업체 보고 기준 1,107 tokens/sec 주장. Grok 4.6: 속도는 핵심 사양이 아님; 이 모델은 빠른 스트리밍이 아닌 긴 에이전트 실행을 위해 설계됨.

컨텍스트 — Mercury 2.5 Preview: 260K. Grok 4.6: 500K.

에이전트 작업 — Mercury 2.5 Preview: 공개된 점수는 없지만, 병렬 도구 호출은 지원됩니다. Grok 4.6: APEX-Agents 57.5, DeepSWE v1.1 65.9, CursorBench v3.2 69.9(공급업체 보고 기준이며, 대부분 재현되지 않음).

가중치 — Mercury 2.5 Preview: 비공개, 독점. Grok 4.6: 비공개, 독점.

가치 챔피언과 가격 건너뛰기

Grok 4.6의 위치는 이례적입니다. Artificial Analysis 지수에서 지능 부문 3위 자리를 GPT-5.6 Sol Max와 함께 차지했으며, 그것과 10포인트 차이 이내에 있는 모든 모델보다 저렴합니다. 또한 출시 보도에서는 한 벤더 실행 평가에서 태스크당 평균 약 0.84달러로 완료되는 긴 에이전틱 실행이 강조되었습니다. 그것이 바로 가치 챔피언의 정의입니다. 스프레드시트에서 태스크당 비용을 확인할 수 있는 가격으로 프런티어에 근접한 성능을 제공하는 것입니다. Mercury 2.5 Preview는 그런 모델이 되려는 것이 아닙니다. Inception은 이를 GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite, Claude Haiku 4.5와 같은 모델, 즉 프런티어가 아닌 비용 최적화 계층에 대응시킵니다. Inception의 판단이 맞다면, Mercury 2.5 Preview는 성능 면에서는 Grok 4.6보다 한 단계 아래이고 가격 면에서는 여러 단계 아래이며, 이는 완전히 논리적인 제품입니다. 즉 프런티어 계층이 낭비인 워크로드를 위한 가격 건너뛰기입니다.

병렬 디코딩이 실제로 바꾸는 것

아키텍처가 바로 이해할 가치가 있는 부분입니다. 그 이유는 '빠름'의 의미를 바꾸기 때문입니다. 자기회귀 모델은 한 단계에 토큰 하나를 생성하므로 처리량이 순차 지연 시간에 의해 제한됩니다. 반면 Mercury 2.5 Preview와 같은 확산 LLM은 토큰 블록을 병렬로 생성하고 노이즈 제거 단계를 거쳐 정제하므로 처리량이 생성되는 토큰 수와 분리됩니다. 이것이 Inception이 표준 GPU에서 초당 1,107개의 토큰을 주장할 수 있는 이유입니다. 특별한 가속기나 배칭 트릭 없이 말이죠. 그리고 실제 제품 주장이 대화형 워크로드에서 첫 토큰까지 300밀리초 미만인 이유이기도 합니다. 음성 에이전트, 검색 파이프라인, 또는 매 턴마다 모델을 호출하는 코딩 하위 에이전트에게 그 지연 시간 차이는 곧 제품입니다. 실시간으로 느껴지는 음성 루프와 멈칫하는 음성 루프의 차이입니다. 문제는 확산 언어 모델이 아직 초기 연구 분야라는 점, 1,107이라는 수치가 Inception의 주장이라는 점, 그리고 어떤 독립 연구소도 이 속도를 재현하거나 병렬 생성이 길거나 적대적인 프롬프트에서 초래하는 품질 변화(있다면)를 측정하지 못했다는 점입니다.

Grok 4.6이 여전히 그 일을 해내는 곳

머큐리 2.5 프리뷰는 그록 4.6이 실제로 승리하고 있는 시장의 부분을 건드리지 않습니다. 그록 4.5 대비 그록의 성장은 에이전트 및 코딩 벤치마크에 집중되어 있습니다 — DeepSWE 11.9포인트, APEX-Agents 10.4, Terminal-Bench 10.3 상승 — 그리고 500K 컨텍스트 창은 전체 작업을 컨텍스트에 유지해야 하는 장기 실행 에이전트를 위한 것입니다. 머큐리 2.5 프리뷰는 병렬 도구 호출을 제공하지만, 독립적인 에이전트 점수가 없고 65,536토큰 출력 상한과 260K 컨텍스트를 가진 모델은 50단계 소프트웨어 엔지니어링 실행에 적합한 도구가 아닙니다. 두 모델은 용도가 거의 겹치지 않습니다: 그록 4.6은 실제로 완료되어야 하는 작업을 위한 엔진이고, 머큐리 2.5 프리뷰는 즉각적으로 느껴지고 호출당 비용이 거의 들지 않는 작업을 위한 엔진입니다.

80% 할인 기간

여기 가격 책정에는 만료일이 있으며, 이는 결정을 바꿉니다. Mercury 2.5 Preview의 $0.04 / $0.15 요금은 $0.20 / $0.75 정가에서 80% 할인된 가격이며, Inception은 프로모션이 2026년 9월 8일까지 진행된다고 밝혔습니다. Grok 4.6의 $2.00 / $6.00은 안정적인 정가에 깔끔한 구조를 갖추고 있습니다 — 캐시된 입력은 $0.50, 우선 순위 티어는 2배, 그리고 200K 토큰에서 긴 프롬프트 단계가 적용되어 전체 요청이 더 높은 요율로 청구됩니다. 오늘의 숫자로 비교한다면 Mercury는 입력에서 50배, 출력에서 40배 더 저렴해 보입니다. 할인이 예정대로 만료된다면 실제 장기적 격차는 입력 10배, 출력 5배입니다. 어느 쪽도 부정직한 표현은 아닙니다 — 단지 시간 지평이 다를 뿐이며, 재평가 시점 없이 할인가를 기준으로 가격이 책정된 파이프라인은 9월 9일에 뜻밖의 상황을 맞게 될 것입니다. Grok 4.6의 $2.00 / $6.00은 OrcaRouter에서 지불하는 바로 그 금액이며, 여기서 제공업체의 정가는 0% 마크업으로 그대로 전달됩니다 — 제공업체가 숫자를 변경하면 같은 날 같은 키에 반영되며, 한 제공업체 경로가 속도 제한에 걸리면 자동 장애 조치가 수행됩니다.

한 줄 평

작업을 반드시 끝내야 하고, 해당 티어에서 가장 좋은 가격으로 최첨단 성능을 원한다면 Grok 4.6을 구매하세요. 현재 OrcaRouter에서 $2.00 / $6.00에 제공되는, 검증된 가성비 챔피언입니다. 대량 처리에 적합하고 지연 시간에 민감한 텍스트 추론 작업, 즉 '충분히 좋은' 답변을 저렴하게 검증할 수 있는 작업이라면, $0.04 / $0.15의 Mercury 2.5 Preview는 할인 기간 안에 테스트해 볼 만한 가격 스킵(price-skip)입니다. 다만 명심하세요. 비교표에서 Mercury 쪽에 적힌 모든 주장은 Inception의 것이며, 그 증명은 아직 제시되지 않았다는 점을요.

A screenshot of the Inception documentation page 'Models, Endpoints, and Pricing' (captured September 1, 2026), showing the Mercury family pricing table — Mercury 2 and Mercury Edit 2 both at $0.25 input / $0.025 cached / $0.75 output per 1M tokens — and a cURL chat-completions API example.A screenshot of the OrcaRouter model page for Grok 4.6 (grok/grok-4.6), showing the model header, the '$2.00' price badge, and the model description noting the August 12, 2026 release.

OrcaRouter는 제공업체 목록 가격을 0% 마크업으로 전달하며 자동 장애 조치를 지원하므로, 공급업체의 가격 변경이 같은 날 같은 키에 적용됩니다.

© 2026 OrcaRouter

제공업체용

추론 플랫폼을 운영하시나요? OrcaRouter에 모델을 등록하세요.

providers@orcarouter.ai

커뮤니티에 참여하세요

Discordsupport@orcarouter.aiXGitHubYouTube