기사 'Xiaomi MiMo-V3-Flash'의 히어로 타이틀 카드로, 키커 'OrcaRouter · 모델 레이더 — 유출'이 상단에 있고, 타이틀은 'Xiaomi MiMo-V3-Flash', 부제는 '한 분석가는 OpenCode의 익명 모델 Omen Alpha가 샤오미의 미출시 고속 모델이라고 말한다. 샤오미 측에서는 아무도 이를 확인하지 않았다.'이다. 왼쪽 카드에는 '주장'이라는 제목과 함께 'teortaxesTex, 2026년 9월 4일 — 직접 진행한 Omen Alpha 속도 테스트를 인용해 게시함'이라는 설명, 그리고 'Omen Alpha는 Xiaomi MiMo-V3-Flash다.'라는 문구가 있다. 오른쪽 카드에는 '현황'이라는 제목과 함께 '샤오미는 아무것도 발표하지 않았다 — 가중치도, 모델 카드도, 가격 페이지도 없다'라는 설명, 그리고 '미확인 · 추론 전용'이라는 문구가 있다. 네 개의 칩에는 각각 '제조사: 미확인', 'CoT: DeepSeek V4 GA로 판독', 'Omen Alpha · OpenCode Go 전용', '높은 추론 성능 · 빠른 속도'라고 표시되어 있다. OrcaRouter 로고는 오른쪽 하단 모서리에 합성되어 있다.
Guides & Insights

Xiaomi MiMo-V3-Flash: 미출시 고속 모델이 OpenCode의 Omen Alpha 내부에서 실행 중인가?

작성자

Gideon Frost

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Xiaomi MiMo-V3-Flash는 Xiaomi가 발표한 바 없는 모델이다. 모델 카드도, Hugging Face 가중치도, 가격 페이지도, 출시 공지도 없다. 이 이름이 회자되는 이유는 단 하나다: 2026년 9월 4일, 저명한 독립 AI 분석가인 teortaxesTex가 공개적으로, OpenCode가 그날 아침 자사 Go 구독자들에게 제공하기 시작한 익명의 "스텔스 모델" Omen Alpha가 Xiaomi MiMo-V3-Flash라고 생각한다고 밝혔다. 그의 동일성 판단은 주로 Omen Alpha의 공개된 추론 과정에서 그가 DeepSeek V4 GA 시대 모델의 chain-of-thought로 읽어낸 내용에 근거한다. 이 판단이 사실이라면 Xiaomi MiMo-V3-Flash는 DeepSeek의 공개 V4 가중치 기반으로 훈련된, Xiaomi가 구축한 고속 티어가 된다는 뜻이다. 이 동일성 주장에 대해 확인된 것은 아무것도 없으며, 이 글은 이를 정확히 그 본질대로, 즉 한창 진행 중인 추측 게임 속 논거가 탄탄한 하나의 가설로 취급한다.

다음 내용에 적용되는 기본 원칙은 다음과 같습니다. Omen Alpha의 출시는 확인된 사실이며, 분석가의 주장은 명시적으로 라벨이 붙은 주장으로 취급됩니다. V3 세대의 존재는 컨퍼런스 프리뷰와 유출된 벤치마크를 통해 뒷받침되지만, 두 자료 모두 샤오미가 확인하지 않은 것으로 명확히 표시되어 있습니다. Xiaomi MiMo-V3-Flash라는 모델이 실제로 존재한다는 주장은 샤오미의 공식 발표가 아닌 동작에서 비롯된 추론이며, 샤오미는 이에 대해 어떤 공식 발표도 하지 않았으므로 여기서 그 어떤 것도 사실로 반복되지 않습니다.

그 주장과 그 뒤에 있는 네 가지 이유

방아쇠는 개발자 보고서였다. OpenCode에서 Omen Alpha를 테스트하던 빌더가 @SPAC89로 게시하면서, "Omen Alpha High" — 높은 추론 설정의 모델 — 가 10분 안에 상당한 코딩 작업을 끝냈고, 훨씬 더 긴 멀티아워 실행이 진행 중이라고 썼다. 그 보고서를 인용 게시한 teortaxesTex는 그 모델이 Xiaomi MiMo-V3-Flash라고 믿는다고 말하며 네 가지 이유를 제시했는데, 모두 문서적 근거가 아닌 행동적 근거였다:

• 추론 과정이 보입니다. 보이는 chain-of-thought는 DeepSeek V4 GA CoT 방식입니다 — 그의 특징은 "hmm," "fine," 그리고 ✓로 시작하는 체크리스트 항목들입니다. 그가 첨부한 스크린샷에는 "high" 설정으로 빌드 중인 Omen Alpha가 보이며, 해당 패턴과 일치하는 추적이 표시되어 있습니다.

속도입니다. 모델이 빠르다는 것 — 이것이 그가 응답하던 관찰입니다 — 그리고 샤오미의 고속 등급은 역사적으로 "Flash"라는 이름을 사용해 왔습니다.

• 운영자. DeepSeek는 은밀한 프로모션을 실행하지 않으므로, 추론이 DeepSeek V4 GA에서 비롯된 것이라 하더라도 Omen Alpha 뒤에 있는 누구든지 간에 DeepSeek 자체가 아니라 DeepSeek를 기반으로 구축한 제3자입니다.

• 클러스터링. 샤오미 MiMo 모델의 출력 텍스트는 DeepSeek의 출력 텍스트와 클러스터링된다 — 이는 텍스트 분포가 서로 가까운 두 세대를 가리키는 그의 약칭이며, DeepSeek로 훈련된 모델이 보일 법한 형태다. 그는 DeepSeek와 클러스터링되는 한 가지 대안으로 StepFun의 Step-4를 언급하고, StepFun의 현재 세대에 대해서는 확신하지 못한다고 말한다.

전령은 조항 하나를 할애할 만한 가치가 있다. 동일한 사실이 양방향으로 작용하기 때문이다. teortaxesTex는 스스로를 DeepSeek 추종자라고 밝히는 인물이다. 그의 X 프로필에는 2023년부터 DeepSeek 팬이라고 소개되어 있다. 그런 프로필은 DeepSeek V4 추론 스타일을 눈앞에서 바로 알아볼 수 있는 사람의 전형이면서, 동시에 그런 스타일을 보려는 경향이 있는 사람의 전형이기도 하다.

MiMo-V3-Flash가 Xiaomi 라인업에서 어디에 위치할지

샤오미가 오늘 공식적으로 확인한 MiMo 모델은 MiMo-V2.5와 MiMo-V2.5-Pro로, 둘 다 2026년 4월 말에 MIT 라이선스로 오픈소스화되었다. MiMo-V2.5-Pro는 1.02조 개의 파라미터를 가진 전문가 혼합(mixture-of-experts) 모델로, 활성 파라미터는 420억 개, 컨텍스트 창은 100만 토큰이다. MiMo-V2.5는 파라미터 3100억 개의 더 작은 범용 모델이다. 그 뒤로는 제품군에 MiMo-V2-Flash(2025년 12월, 3090억 개 파라미터의 오픈 MoE)와 MiMo-V2-Pro(2026년 3월)가 있으며, MiMo-V2-Pro가 이 이야기에서 중요한 이유는 샤오미가 공식적으로 인정하기 전에 처음으로 'Hunter Alpha'라는 익명 코드명으로 공개되었기 때문이다. 익명 필드 테스트는 샤오미에게 예외가 아니라, 샤오미가 제품을 출시하는 방식의 일부이다.

V3 세대는 그 기록이 출시된 제품에서 보고(report)로 넘어가는 단계다. 2026년 7월 ICML에서 MiMo 팀을 이끄는 연구원 뤄푸리(Luo Fuli)가 V3 아키텍처를 미리 공개했다. 핵심은 샤오미가 'High Sparse'라고 부르는 설계다. 소수의 풀 어텐션(Full Attention) 레이어가 '오라클(oracle)' 역할을 하여 주변의 스파스(sparse) 레이어들이 어텐션을 기울일 토큰을 선택하고, 그 스파스 레이어들은 자체 KV 캐시를 두지 않고 풀 어텐션 레이어의 KV 캐시를 공유한다. 샤오미는 이로써 KV 캐시 메모리가 약 10배 줄어들었다고 말하며, 800억 파라미터 규모 모델에서 11:1의 스파스-풀 비율을 검증했고 풀 어텐션 품질에 필적했다고 주장한다. 반면 같은 희소성에서 하이브리드 슬라이딩 윈도우 기준선은 MMLU 점수가 약 7점 하락했다. 이는 컨퍼런스 발표에서 나온 팀 자체 주장일 뿐 독립적인 결과가 아니다. 그 후 8월 21일, MiMo-V3-Pro의 벤치마크 스크린샷으로 추정되는 이미지가 Max For AI에 의해 공유되며 유포되기 시작했다. 내용은 SWE-Bench Pro 72.8로, GLM 5.3의 67.9, Kimi K3의 65.8, Claude Opus 5의 74.6, GPT-5.6 Sol Max의 75.4와 비교됐고, Terminal-Bench 2.0 70.6 및 τ3-bench 76.4도 포함됐다. 샤오미는 아무것도 확인하지 않았으며, V3의 존재와 출시 시기는 여전히 미공개 상태다. 이 기사에서 얻을 핵심은 더 좁다. V3 세대가 확실히 진행 중이지만 출시된 V3 모델은 없다는 것. 그렇기에 공식 발표되지 않은 샤오미 MiMo-V3-Flash가 스텔스(stealth) 상태로 등장하는 것은 일상적인 일이 아니라 뉴스가 될 것이다.

왜 Flash인가 — 그리고 왜 OpenCode Go인가 — 어울리는 이유

Flash 등급은 Xiaomi가 빠르고 저렴한 용량을 시장에 심는 방식입니다. Xiaomi는 12월에 MiMo-V2-Flash로 같은 일을 했습니다. 그리고 OpenCode Go는 이미 Xiaomi의 현재 오픈 모델을 실행하고 있기 때문에 그럴듯한 시험 무대입니다. 5시간당 11,600회 요청으로 Omen Alpha를 나열하는 동일한 Go 라인업에는 이 페이지에서 가장 후한 허용량 중 하나인 MiMo-V2.5가 30,100회로 나열되어 있습니다. Xiaomi 팀이 한 플랫폼에서 자체 MiMo-V2.5 옆에 V3-Flash를 현장 테스트한다면, 마케팅 비용 없이 이전 세대와 직접 비교를 얻을 수 있을 뿐 아니라, 그 플랫폼은 이번 달에 이미 익명 공개를 한 번 진행한 곳이기도 합니다. 이는 정체성에 대한 증거가 아니라 그럴듯함에 대한 논거입니다.

A screenshot of the official OpenCode Go page, showing a 'New' promo banner reading 'GLM-5.3-Flash gets 2x usage limits for a limited time', the heading 'Low cost coding models for everyone', a 'Subscribe to Go $10/month' button, and the model lineup of per-model request allowances per five hours, including 'Omen Alpha — 11,600' and 'MiMo-V2.5 — 30,100' together with GLM-5.3-Flash (1,580, under the 2x banner), DeepSeek V4 Flash, LongCat-2.0, Kimi K3 and Muse Spark 1.3 Contributor (45,300).

제품의 형태는 같은 방향을 가리킨다. Omen Alpha가 "높음" 추론 설정에서 10분 이내에 완료되는 것은 빠른 추론 등급에서 기대되는 동작과 일치하며, Omen Alpha에 대해 유통 중인 제3자 수치(공식 요금표가 아닌 언론 보도에 따른 수치로, 입력 토큰 100만 개당 약 0.20달러, 출력 토큰 100만 개당 약 0.66달러)는 이 모델을 DeepSeek V4 Flash와 함께 시장의 저가형 끝자락에 놓이게 한다. 빠르고 저렴한 DeepSeek 세대 추론 모델처럼 행동하는 모델이 바로 DeepSeek V4 기반 "Flash" 등급이 가질 모습이다. 이는 다시 말하지만, 확인된 것이 아니라 보도되고 추론된 사항이다.

DeepSeek 연관성이 핵심이자 가장 약한 증거다.

DeepSeek V4 GA가 도대체 왜 중요한가: DeepSeek의 V4 라인업은 2026년 8월 프리뷰에서 일반 공급(GA)으로 전환되었는데, DeepSeek V4 Pro는 8월 13일 GA 빌드 0813으로 MIT 라이선스의 오픈 가중치와 함께 출시되었고, 더 저렴한 형제 모델인 DeepSeek V4 Flash도 함께 출시되었습니다. MIT 라이선스의 오픈 가중치는 제3자가 법적으로 이를 기반으로 구축할 수 있음을 의미하며, 커뮤니티가 이러한 모델을 알아보는 일반적인 방법은 해당 모델이 계승한 추론 스타일입니다. DeepSeek의 GA 시대 사고 사슬(chain-of-thought)은 알아볼 수 있는 언어적 습관을 갖고 있는데, teortaxesTex가 Omen Alpha의 트레이스에서 보았다고 말하는 것이 바로 그 습관입니다. 만약 그가 그 트레이스가 DeepSeek V4 GA라고 판단한 것이 맞고, 운영 주체가 Xiaomi라고 판단한 것도 맞다면, Xiaomi MiMo-V3-Flash는 DeepSeek의 오픈 추론 가중치를 기반으로 구축된 Xiaomi의 고속 티어 모델이라는 뜻이 됩니다. 이는 합법적이면서도 전략적으로 주목할 만한 선택이며, 겉으로는 Xiaomi 모델인데 DeepSeek처럼 추론하는 이유를 깔끔하게 설명해 줍니다.

이제 어려운 부분입니다. 사고 사슬(chain-of-thought) 유사성은 모델 지문 중 가장 약한 부류입니다. 구조가 아니라 스타일이기 때문입니다. 이번 달 실제로 유지된 익명 모델 식별—Ox Alpha를 GLM-5.3-Flash로 본 것—은 훨씬 더 확실한 증거, 즉 토크나이저 일치와 비디오 인코딩 포렌식에 기반해 결론이 났습니다. Omen Alpha를 Xiaomi로 지목할 만한 비슷한 수준의 확실한 지문은 공개된 바 없습니다. 게다가 커뮤니티의 주도적 해석은 다른 곳을 가리킵니다. 개발자들은 Omen Alpha의 백엔드 요청이 "zhipu" 네임스페이스에서 해석된다고 보고하고, 일부 테스터들은 이 모델이 스스로 GLM 기반이라고 밝힌다고 설명하며, 언론의 출시 해석은 Omen Alpha가 GLM-5.3-Flash로 읽혔던 Ox Alpha 실행에 이어 Zhipu AI가 9일 만에 내놓은 두 번째 익명 릴리스라는 것입니다. 그 해석이 맞다면, DeepSeek 풍의 추론은 스타일상의 우연이거나 Zhipu 모델 자체가 DeepSeek의 흔적으로 훈련되었다는 신호일 뿐—Xiaomi 제품은 아닙니다. 두 진영이 모두 맞을 수는 없으며, 어느 진영도 자신이 지목한 연구소의 공식 입장을 확보하지 못했습니다.

A two-column infographic titled 'Is Omen Alpha Xiaomi MiMo-V3-Flash?' with the subtitle 'The evidence, as of September 4, 2026'. The left column, headed 'FOR — the analyst's case', reads 'CoT reads as DeepSeek V4 GA — "hmm", "fine", ✓ lists', 'Fast — a big coding task finished in under 10 minutes', 'DeepSeek itself doesn't run stealth promotions', 'MiMo output text clusters with DeepSeek', and 'Xiaomi already ran Hunter Alpha as MiMo-V2-Pro'. The right column, headed 'AGAINST — the community's leading read', reads 'CoT style is the weakest fingerprint class', 'No tokenizer or infra evidence points at Xiaomi', 'Backend "zhipu" namespace observed by developers', 'Model reportedly self-identifies as GLM-based', and 'Press reads Omen Alpha as Zhipu's 2nd anonymous model'. A footer reads 'No Xiaomi statement exists — both columns are inference, not fact.' The OrcaRouter logo is composited in the bottom-right corner.

무엇이 그것을 해결할까요?

• 샤오미의 공식 발표 — 또는 가중치. 샤오미는 MiMo-V2-Flash부터 MiMo 모델을 오픈소스로 공개해 왔으며, MiMo-V2.5와 MiMo-V2.5-Pro는 MIT 라이선스로 배포되었습니다. 실제 샤오미 MiMo-V3-Flash가 나온다면 GLM-5.3-Flash가 그랬던 것처럼 Hugging Face에 가중치와 모델 카드가 공개되는 방식으로 확인되는 것이 가장 타당할 것입니다.

• 확실한 지문. 토크나이저 일치가 Ox Alpha를 식별한 증거였다. Omen Alpha를 Xiaomi로 지목하는 토크나이저 테스트는 발표되지 않았다.

• 모델 자신의 진술. 일부 테스터들은 Omen Alpha가 스스로를 GLM 기반이라고 설명했다고 보고한다. 모델의 자기 보고는 데이터일 뿐, 출처(provenance)는 아니다.

• Omen Alpha의 독립적 벤치마크. 익명 모델에 대한 중립적 평가는 커뮤니티가 8월에 유출된 MiMo-V3-Pro 수치와 비교할 수 있게 해줄 것이다.

• {{1}}Go{{/1}} 기간 이후의 공개입니다. 과거 익명 모델들은 출시 후 며칠에서 몇 주가 지나서야 주장되었습니다. {{2}}Omen Alpha{{/2}}를 주장하는 사람은 모델 이름을 정확히 명명할 것입니다.

추측이 계속되는 동안 무엇을 해야 할까

현실적으로 중요한 것은 누가 맞는지가 아니다. Omen Alpha는 월 10달러 구독 뒤에 있는 익명 모델이고, Xiaomi MiMo-V3-Flash는 그 구독에 붙어 있는 확인되지 않은 이름이다. 둘 다 지금 프로덕션 파이프라인을 걸 만한 대상이 아니다. 제작자가 실제로 나서고 기반 모델이 일반 API에 도달했을 때, 바로 그 순간이 라우팅 계층이 제 값을 하는 때다. OrcaRouter는 제공업체의 공시 가격을 0% 마크업으로 그대로 전달하므로, 새로 공개된 요금은 해당 업체가 발표한 날짜에 곧바로 동일한 API에서 적용된다. 게다가 자동 페일오버 덕분에 아직 검증되지 않은 신참에게 실제 트래픽 일부를 보내면서도 이미 신뢰하는 모델로 폴백할 수 있다. 한편 지켜볼 것은 단순하다. 누군가 Omen Alpha가 자신의 것임을 공개적으로 밝히는가, 그리고 Xiaomi MiMo-V3-Flash가 모델 카드에 등장하는가. 그중 하나는 일어날 것이다.

A checklist infographic titled 'What would confirm the story' with four numbered rows reading '1. Xiaomi claims Omen Alpha — or ships MiMo-V3-Flash weights', '2. A tokenizer or infra fingerprint points at Xiaomi', '3. Neutral benchmarks of Omen Alpha appear', and '4. The reveal after the Go window names the maker'. A footer reads 'None has fired as of September 4, 2026.' The OrcaRouter logo is composited in the bottom-right corner.

2026년 9월 4일 현재, 샤오미 MiMo-V3-Flash는 이름이자 그럴듯한 제품 형태, 그리고 유력 분석가의 가설일 뿐 출시된 모델이 아닙니다. V3 세대는 7월에 프리뷰되고 8월에 유출될 만큼 실제로 존재합니다. 코드네임 Omen Alpha라는 이름으로 그 첫 공개가 지금 이루어지고 있는지 여부는 샤오미만이 답할 수 있는 질문이며, 샤오미는 아직 답하지 않았습니다.

이 글에서 비교한 모델2

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트

© 2026 OrcaRouter

제공업체용

추론 플랫폼을 운영하시나요? OrcaRouter에 모델을 등록하세요.

providers@orcarouter.ai

커뮤니티에 참여하세요

Discordsupport@orcarouter.aiXGitHubYouTube