
Mercury 2.5 vs Mercury 2.5 Preview: 하나의 확산 모델, 두 개의 출시일
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240지능72코딩
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0340지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2134지능69코딩
두 제품이 동일한 모델 카드를 공유하는 맞대결입니다. 2026년 8월 31일에 출시된 Inception의 Mercury 2.5 Preview와 2026년 9월 8일에 출시된 Mercury 2.5는 8일 간격으로 공개된 동일한 확산 언어 모델입니다. Inception이 개발자에게 연 프리뷰 채널이자, 일주일 뒤 출시한 '엔터프라이즈 준비 완료' 프로덕션 버전입니다. Inception은 Mercury 2.5에 대해 다른 체크포인트, 다른 속도 수치, 다른 가격을 공개하지 않았습니다. 두 발표 사이에 실제로 바뀐 수치는 정리 작업처럼 보일 뿐, 새로운 모델이 아닙니다. 컨텍스트 수치는 프리뷰 페이지의 256K에서 출시 시점의 260K로 수정되었고, Mercury 2 대비 지능 향상은 '10포인트 이상'(프리뷰 자료)에서 '40%'(출시 자료)로 다시 표현되었습니다. 엔진, 초당 1,107토큰이라는 주장, 가격표는 모두 동일합니다. 따라서 이는 일반적인 사양표 대결이 아니며, 어느 한쪽을 부풀리는 것은 부정직합니다. 이 두 이름 사이에서 중요한 비교는 패키징과 타이밍입니다. 프로덕션 출시가 실제로 무엇을 바꿨는지, Preview 라벨이 실제로 무엇을 알려주고 있었는지, 지금 API 호출에 어떤 이름을 사용해야 하는지입니다.
모델이 자신과 비교되는 이유
공급업체들은 보통 모델을 미리 공개한 뒤 조용히 메인 이름에 통합한다. Preview 목록은 사라지고 누구도 그 비교를 쓰지 않는다. 그러나 Inception은 일주일 동안 두 이름을 나란히 운영했고, Preview 정체성은 이제서야 폐지되고 있다. 그래서 이 비교는 내용이 있는 것이다. Preview는 Inception이 확산 베팅을 개발자 앞에 내놓기 위해 사용한 빠른 경로였다. 그것은 8월 31일에 등장했으며, 그 사양표는 지금의 Mercury 2.5 사양표와 동일하다. 즉, 한 번에 하나의 토큰을 내보내는 대신 토큰 블록을 병렬로 생성하고 정제하는 확산 LLM(dLLM)이며, 표준 GPU에서 초당 1,107토큰을 주장하고, 첫 토큰까지 300ms 미만을 주장하며, 260K 토큰 컨텍스트 창과 65,536토큰 출력, 조절 가능한 추론 수준, 기본 도구 사용, 병렬 도구 호출, 구조화된 출력을 갖추고 있다. 그 수치들은 모두 Inception 자체의 것이며, Preview가 나왔을 때 어떤 독립 연구소도 이 모델을 측정하지 않았다.
9월 8일, Inception은 Mercury 2.5를 "diffusion LLM을 위한 차세대 지능"이자 프로덕션에서 가장 빠른 추론 모델로 출시했습니다. 이는 엔터프라이즈에 적합하며, 음성 에이전트, 코딩 서브에이전트, 엔터프라이즈 검색, 지원 워크로드를 대상으로 합니다. 동일한 사양, 동일한 포지셔닝, 동일한 가격표입니다. 이번 출시에서는 Inception이 나아갈 방향을 보여주는 두 가지 형제 모델도 미리 공개되었습니다: 음성 에이전트를 위해 170ms 미만의 첫 토큰에 맞춰 조정된 dLLM인 Mercury Voice와, 품질, 속도, 비용에 따라 모델 간에 프롬프트를 라우팅하는 Mercury Router입니다. Mercury 2.5는 프런티어 품질 계층보다는 지연 시간에 민감한 에이전트 워크로드를 위해 구축된 제품군의 플래그십입니다.
9월 8일 출시가 실제로 바꾼 것
두 이름을 줄 단위로 비교하라. 그 차이는 엔진이 아니라 — 엔진을 둘러싼 모든 것이다:
• 상태 — Mercury 2.5 Preview: 동작이나 가용성을 "변경할 수 있는" 비공개 미리보기입니다. Mercury 2.5: 엔터프라이즈 지원 약속, 판매 채널, 그리고 출시일이 명시된 프로덕션 목록과 함께 출시된 프로덕션 모델입니다.
• 정체성 — Inception의 모델 페이지에는 이제 Mercury 2.5, Mercury Voice, Mercury Router가 나열되며 Preview는 보이지 않습니다. 그리고 지원 각주에는 Mercury 1, Mercury 2, Mercury Edit 2가 "기존 고객에게 계속 지원되는" 모델로 명시되어 있습니다. Preview는 두 목록 모두에 나타나지 않습니다. 공급업체 입장에서 preview 라벨은 Mercury 2.5에 흡수되었습니다.
• 엔드포인트 — Inception의 개발자 플랫폼은 모델을 mercury-2.5로 제공하며, 9월 8일에 출시된 프로덕션 목록이 새 트래픽을 처리합니다. 8월 말에 처음 Preview를 게재했던 카탈로그에서 Preview 이름은 이제 실제 서빙 엔드포인트로 확인되지 않지만, 9월 8일에 추가된 Mercury 2.5 목록이 응답하고 있습니다. 이름으로 Preview를 대상으로 코드를 작성한 사람은 Mercury 2.5로 다시 지정하고 제공업체가 실제로 청구하는 항목을 확인해야 합니다 — 첫 주에 통합한 ID가 폐기되는 ID입니다.
• 가격 — 요금 목록과 할인 조건이 동일합니다. 둘 다 입력 100만 토큰당 $0.20, 출력 100만 토큰당 $0.75, 캐시된 입력은 $0.02이며, 둘 다 약 80% 할인된 가격으로 출시되었습니다: $0.04 / $0.15, 캐시 $0.004. Preview의 할인은 명시적으로 9월 8일까지로 한정되었습니다. Mercury 2.5는 동일한 80% 할인 조건으로 출시되었으며, 이 글을 작성하는 시점에도 프로덕션 목록에는 여전히 할인된 요금이 표시되어 있습니다. 이것이 바로 함정이며, 아래에서 자세히 설명합니다.
• 온보딩 — 프로덕션 출시로 신규 개발자 계정에 무료 토큰 허용량이 추가되었고 — 출시 자료에는 1억 개의 토큰이 언급되며 — 프리뷰에는 없던 엔터프라이즈 문의 경로도 개설되었습니다.
• 증거 — 변함없음. 어느 이름도 독립적인 벤치마크가 없으며, 벤더의 주장은 표현만 조금 다를 뿐 동일한 주장입니다: 미리보기 자료에서 머큐리 2 대비 "10포인트 이상"의 지능 향상은 출시 자료에서는 "40퍼센트" 증가로 바뀝니다. 또한 비용 최적화 프론티어 계층(GPT-5.6 Luna 저노력 모드, Gemini 3.5 Flash-Lite, Claude Haiku 4.5)과의 동일한 동급 주장도 함께 제시되며, GPQA Diamond에서 79%, IFBench에서 77%라는 동일한 벤더 보고 수치도 그대로입니다. 다시 진술된 주장은 검증된 주장이 아닙니다.

페어링의 핵심에 있는 가격 함정
두 이름이 동일한 정가와 동일한 80% 티저를 내세우기 때문에 항상 같은 비용이 들 것이라고 가정하기 쉽다. 하지만 꼭 그런 것은 아니다. Preview의 할인은 9월 8일에 확실히 종료되었지만, Mercury 2.5의 출시 할인은 새로운 카운트다운이 시작된 상태다. 일주일 동안은 Preview 호출에 $0.20/$0.75를 지불하면서도 동일한 엔진이 프로덕션 이름으로는 $0.04/$0.15에 응답하는 상황이 충분히 발생할 수 있었다. — 또는 더 현실적으로는, 청구서는 계속 도착하는데 조용히 서비스를 중단한 preview ID를 사용하고 있는 경우였다. 엔드포인트별로 만료되는 출시 할인은 바로 '동일 모델, 동일 가격'이라는 이야기를 실제 비용 차이로 만드는 세부 조항이다.
장기적으로 유효한 수치는 정가이고, 장기적으로 유효한 조언은 그 정가를 기준으로 예산을 잡으라는 것입니다: 백만 토큰당 $0.20 / $0.75, 캐시된 입력은 $0.02 — 260K 컨텍스트를 갖춘 추론 모델치고는 저렴하고, 플래그십 등급에 한참 못 미치는 가격이지만, 출시 배너가 광고하는 $0.04 / $0.15는 아닙니다. 할인된 요율은 유효기간이 있는 시승 가격으로 취급하고, 마케팅 페이지에 적힌 이름이 아니라 코드 속 정확한 모델 ID 기준으로 제공업체가 청구하는 요금을 확인하세요. Preview로 온보딩했다면, 만료 시점이나 서비스가 중단된 엔드포인트가 당신을 대신해 결정하기 전에 Mercury 2.5로 마이그레이션하세요.
이것은 또한 라우팅 계층이 제거하기 위해 존재하는 문제 유형입니다. 공급업체의 정가를 그대로 통과시키는 모델 라우터는0% 마크업으로 실제로 청구하는 가격을 보여주며, 출시 할인이 적용되거나 만료되는 당일에 업데이트되고, 백그라운드에서 엔드포인트가 폐기될 때 자동 장애 조치가 통화를 계속 연결해 줍니다. 이 글을 쓰는 시점에 Mercury 2.5는 OrcaRouter에 없습니다 — Inception이 자체 API와 여러 타사 플랫폼을 통해 이를 제공하고 있기 때문입니다 — 따라서 현재로서는 공급업체의 모델 페이지가 요율의 정확한 출처입니다. 공급업체가 이를 등록하는 순간, 그 패스스루 메커니즘이 하나의 키로 제공되며, 가격 인하나 할인 만료는 발표된 당일에 우리 쪽에도 나타납니다.
두 이름이 공유하는 증거 문제
이 페어링에 대한 정직한 성적표는 짧습니다. 두 열은 동일한 모델이며 증거가 없다는 점도 동일하기 때문입니다. Mercury 2.5도 Mercury 2.5 Preview도 2026년 9월 9일 기준으로 독립적인 지수 점수, 재현된 실행, 또는 아레나 순위가 없습니다. Inception 자체의 주장(Mercury 2 대비 지능 향상, Haiku 4.5 등급과의 동등성, 79% GPQA Diamond, 초당 1,107토큰)은 회사의 말일 뿐이며, 모델이 동일하므로 두 이름에 대해 동일합니다.
이 제품군에서 유일하게 독립적으로 확보된 증거는 속도 주장을 어떻게 해석해야 하는지를 보여준다. Artificial Analysis는 전작인 Mercury 2를 프로덕션 엔드포인트에서 초당 684토큰으로 측정했고, Intelligence Index에서 22점을 기록했다. 이는 확실히 빠른 속도이며 확산(diffusion) 기반 접근법이 허구가 아님을 입증하지만, Inception이 Blackwell 하드웨어에서 해당 모델에 대해 홍보하는 초당 약 1,000토큰에는 한참 못 미친다. Mercury 2.5의 1,107이라는 수치와 실제 부하에서 공유 멀티테넌트 엔드포인트가 제공하는 수치 사이에도 비슷한 격차가 있을 것으로 예상해야 한다. 품질에도 동일한 주의가 필요하다. 제조사가 단독으로 측정한 것뿐인 새로운 확산 모델이 Claude Haiku 4.5와 맞먹는다는 주장은 제3자가 실행해 보기 전까지는 그대로 믿어서는 안 된다.

{{1}}출시를 다루기 시작한 트래커들은 정확히 그 상태를 반영한다.{{/1}} {{2}}9월 8일에 게시된 Mercury 2.5의 BenchLM 기록은 모델에 공개 점수와 공개 순위를 부여하지 않는다. 이 기록에는 Inception의 79% GPQA Diamond 및 77% IFBench 수치가 공급자 보고로 명시되어 있으며, 독립적인 런타임 속도는 측정되지 않았다고 밝히고 있다.{{/2}} {{3}}최초의 Artificial Analysis 지수 등록, LMArena 배치, 또는 재현된 GPQA 실행은 Mercury 2.5를 주장에서 비교 가능한 대상으로 바꿔줄 것이다. 그리고 측정할 모델은 하나뿐이므로 이는 두 이름 모두에 동시에 적용될 것이다.{{/3}}

어떤 이름으로 불러야 할까요?
• 새로운 통합, 레거시 없음: Mercury 2.5를 호출하고 Preview는 무시하세요. 프로덕션 이름에는 동일한 엔진, 당분간 동일한 할인, 엔터프라이즈 조건, 그리고 벤더가 실제로 제공하는 ID라는 보장이 포함됩니다. Preview는 불안정성 위험만 추가할 뿐 그 외에는 아무것도 없습니다.
• 이미 Preview를 통합했다면: 오늘 제공자가 그 이름으로 무엇을 제공하는지, 그리고 그것에 대해 무엇을 청구하는지 확인하세요. 클라이언트를 Mercury 2.5 id로 다시 지정하고 요금을 확인하세요. 프로덕션 코드에서 Preview라는 이름을 유지하는 것은 이제 명시적으로 기간이 한정된 프리뷰 채널이 자신의 서비스 종료 이후에도 살아남을 것이라는 도박입니다.
• 엔터프라이즈 또는 프로덕션에 중요한 트래픽:Mercury 2.5는 Inception의 엔터프라이즈 경로를 통해 제공되며, 그 뒤에 약속이 없는 미리 보기 라벨이 아닙니다. 음성 및 라우팅 요구 사항은 각각 Mercury Voice와 Mercury Router를 가리키며, 이들은 여전히 미리 보기 상태입니다.
• 확산 계층을 평가하는 분이라면: 두 이름 모두 동일한 평가 대상이므로, Mercury 2.5에 대해 한 번 평가를 실행하고 그 결과가 모델 라인에 적용되는 것으로 간주하세요. 정가로 예산을 책정하고, 독립적인 점수가 나오기 전까지는 공급업체의 주장을 가설로 간주하세요.
볼 것
세 가지가 향후 몇 주 안에 이 페어링을 결정하게 될 것입니다. 첫째, 최초의 독립 벤치마크(지수 배치 또는 재현된 GPQA나 AIME 실행)는 상업적 베팅의 전부인 동등성 주장을 시험할 것입니다. 둘째, Inception 자체 모델 페이지가 이미 시사하듯이 Preview라는 정체성이 모델 생태계에서 완전히 사라지는지 여부입니다. 셋째, Preview가 고정되었던 9월 8일 기준점이 지난 지금 80% 출시 할인에 어떤 일이 일어나는지입니다. 연장되면 Mercury 2.5가 구조적으로 저렴해지고, $0.20/$0.75로 되돌아가면 단지 경쟁력만 갖추게 됩니다. 그때까지 "Mercury 2.5 또는 Mercury 2.5 Preview?"에 대한 올바른 답은 그것이 하나의 모델이며, 여전히 제품으로 남아 있는 쪽을 호출해야 한다는 것입니다.
