
MiMo-V2.6-Flash vs MiMo-V2.6: 하나의 시리즈, 두 개의 체크포인트, 그리고 이중 역할을 하는 이름
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0345지능76코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
MiMo-V2.6이 무엇인지 두 사람에게 물어보면 서로 다른 두 모델이라는 답을 들을 수 있다. 샤오미가 2026년 9월에 내놓은 것은 공개된 두 개의 체크포인트를 가진 시리즈로 — MiMo-V2.6-Flash는 3,090억 개 매개변수, MiMo-V2.6-Pro는 1조 200억 개이며 — 그리고 MiMo-V2.6이라는 이름만은 제품군 전체를 가리키는 데도, 대부분의 보도에서는 이 세대의 최상위 등급을 가리키는 데도 쓰인다. 그래서 "MiMo-V2.6-Flash vs MiMo-V2.6"이라는 제목이 붙은 페이지는 사실 효율성 체크포인트와, 사람들이 플래그십을 뜻할 때 쓰는 이름을 견주는 셈이다. 두 체크포인트는 2026년 9월 21일 허깅페이스에 18초 차이로 공개되었고, 둘 다 MIT 라이선스를 따르며, 둘 다 다운로드가 먼저다 — 호출할 샤오미 엔드포인트는 없다. 그 외에는 거의 모든 것이 서로 다르다.
그 점은 보통의 이름 짓기 논쟁보다 더 중요하다. 왜냐하면 그 둘은 나중에 올라갈 수 있는 크기 사다리가 아니기 때문이다. 그것들은 별개의 훈련 실행이며, 별개의 벤치마크 표와 별개의 메모리 사용량을 갖고 있고 — 공개된 수치에서 보듯 — 더 작은 쪽이 완승을 거두는 몇몇 지점이 있다.
두 개의 체크포인트, 하나의 공개된 회의록
저장소는 15:39:51 UTC에 생성된 XiaomiMiMo/MiMo-V2.6-Flash-RL과 15:39:33 UTC에 생성된 XiaomiMiMo/MiMo-V2.6-Pro-RL입니다. 둘 다 게이트되지 않았습니다. 둘 모두 기술 보고서와 모델 카드를 첨부하며, Xiaomi는 둘 모두를 코딩, 범용 에이전트, 시각 및 사이버보안 작업을 도메인별 개별 실행이 아니라 하나의 학습 패스로 통합한 단일 혼합 강화 학습 실행의 산출물이라고 설명합니다.
• 파라미터 — MiMo-V2.6-Flash: 총 309B, 토큰당 15B 활성화. MiMo-V2.6-Pro: 총 1.02T, 42B 활성화. 둘 모두 희소 전문가 혼합(mixture-of-experts) 방식입니다.
• 백본 — Flash는 48개 레이어, 39개의 슬라이딩 윈도우와 9개의 전체 어텐션, 히든 크기 4096, 라우팅된 전문가 256개(8개 활성화), 128토큰 슬라이딩 윈도우를 갖추고 있으며 공유 전문가는 없습니다. Pro는 동일한 하이브리드 어텐션 방식을 훨씬 더 큰 너비로 실행합니다.
• 모달리티 — 둘 다 네이티브 옴니모달로, 텍스트, 이미지, 비디오, 오디오를 하나의 모델로 처리하며, 세 개의 파이프라인을 볼트로 조립한 방식이 아닙니다. Flash는 681M 파라미터 비전 트랜스포머, 308M 오디오 토크나이저, 127M 오디오 패치 인코더를 갖추고 있습니다.
• 컨텍스트 — 1M 토큰, 양쪽 모두에 대해 주장되며, 해당 구성은 1,048,576토큰 최대 위치 임베딩을 뒷받침합니다.
• 라이선스 — 양쪽 모두 MIT이며, 매출 기준도, 통상적인 범위를 넘어서는 허용 사용 제한도, 연구 조항도 없습니다. 상업적 배포, 수정, 재배포가 모두 허용됩니다.
• 가중치 파일 — Flash는 65개 샤드에 걸쳐 172.9GB의 FP8 가중치 데이터를 공개합니다. Pro는 파라미터 수가 약 세 배이므로, 직접 적용하는 양자화 이전에 다운로드 용량이 0.5테라바이트대에 이릅니다.
• 서빙되는 위치 — Hugging Face, Xiaomi 자체 API 플랫폼, AI Studio, MiMo Code 및 MiMo 데스크톱 앱. 카드에는 현재 Hub 자체에서 제3자 추론 제공업체가 두 체크포인트 중 어느 것도 배포하고 있지 않다고 나와 있습니다.
사람들의 하드웨어를 앗아가는 충돌
이 조합에서의 혼란은 사실 Flash와 Pro 사이에 있는 것이 아닙니다. 그것은 MiMo-V2.6-Flash와 그 이전에 나온 모델 사이에 있습니다.
MiMo-V2-Flash는 2025년 12월에 출시되었으며, 이를 발표한 Xiaomi 자체 블로그 게시물에서는 총 파라미터 3,090억 개, 활성 파라미터 150억 개, 슬라이딩 윈도와 전체 어텐션을 교차하는 하이브리드 어텐션 방식, 그리고 공격적인 128토큰 슬라이딩 윈도를 갖춘 전문가 혼합(MoE) 모델이라고 설명합니다. 이를 위의 글머리표 목록과 대조해 보세요. 2026 체크포인트와 2025 체크포인트는 같은 대표적 형태, 같은 슬라이딩 윈도 크기, 같은 활성화 예산을 가지고 있습니다 — 9개월 차이, 서로 다른 학습 실행, 서로 다른 능력, 서로 다른 벤치마크 표를 가진 채로.
그래서 "MiMo V2.6 Flash"를 검색하면 MiMo-V2-Flash에 관한 페이지가 아무렇지 않게 나오는데, 여기에는 256K 컨텍스트 수치와 이전 모델에 속하는 백만 입력 토큰당 0.1달러라는 가격까지 포함되어 있습니다. 노드 규모를 산정하는 중이라면, 이건 겉치레 오류가 아닙니다. 이전 체크포인트와 새 체크포인트는 서로 다른 다운로드이며 서로 다른 서빙 레시피를 가지고 있고, 새 체크포인트는 네 배의 컨텍스트를 주장합니다.
이름 짓기에는 두 번째, 더 조용한 함정이 있습니다. 두 저장소 모두 -RL로 끝나는데, 이는 다른 베이스 모델 위에 올려진 강화학습 어댑터처럼 읽힙니다. 그것들은 어댑터가 아닙니다. 이 접미사는 포스트트레이닝 계보를 표시합니다. 즉, 이것들은 스트리밍 RL 실행에서 나온 전체 체크포인트입니다. 가중치 인덱스가 이를 확인해 줍니다 — 전체 백본, 비전 인코더, 오디오 스택, 추측형 드래프터를 아우르는 수만 개의 텐서가 있습니다.
공급업체 자체 표가 말하는 것
이 섹션의 모든 수치는 Xiaomi의 두 모델 카드에 실린 Xiaomi의 평가 표에서 가져온 것입니다. Xiaomi는 자체 체크포인트에서 하네스를 실행했습니다. 그중 어느 것도 연구소 밖에서 재현된 적이 없고, 공개 리더보드에 나타난 적도 없으며, 비교 열은 다른 회사 모델들을 대상으로 동일한 하네스를 해당 공급업체가 직접 실행한 결과입니다. 순위는 참고용으로, 소수점 자릿수는 장식으로 취급하십시오.
• 코드 에이전트 — DeepSWE v1.1: Flash 67.9, Pro 71.9. Terminal Bench 2.1: Flash 87.6, Pro 89.9. ProgramBench: Flash 26.0. MiMo Code Bench: Flash 61.2.
• 범용 에이전트 — AutomationBench v1.0.6: Flash 52.3, Pro 53.1. Toolathlon-Verified: Flash 73.6, Pro 76.9. OSWorld-Verified: Flash 80.8, Pro 82.0. Agents' Last Exam: Flash 27.6. Terminal Bench 4.0: Flash 28.8.
• 사이버 보안 — 더 작은 모델이 앞서는 유일한 항목. CyberGym: Flash 95.1 대 Pro 94.0. MiMo Cyber Bench: Flash 77.2. 그러더니 바닥이 꺼진다: ExploitGym 6.0, ExploitBench 25.3, SEC Bench Pro 47.5.
• 비주얼 에이전트 — MiMo VisualCoding: Flash 71.5, Pro 72.3.
그 항목들을 쭉 읽어 보면, 솔직한 요약은 Pro가 거의 모든 곳에서 앞서 있고 그 차이는 작으며, 그 차이가 자체 실행한 하네스의 노이즈 범위 안에 들 만큼 작다는 것입니다. DeepSWE에서는 둘이 4점 차이인데, 그 척도에서 동일한 체크포인트가 Xiaomi 자체 평가 두 번 사이에서 2점 움직였습니다.
그 마지막 요점은 별도의 문단을 할애할 가치가 있습니다. 왜냐하면 그것이 두 카드 중 어느 쪽에서든 가장 유용한 정보이기 때문입니다. 샤오미의 공개 RL 대시보드는 9월까지 두 학습 실행을 모두 스트리밍했는데, Flash를 65.68로 게시했습니다. DeepSWE v1.1에서 mini-swe-agent 하네스로 3회 평균 기준입니다. 완성된 카드에는 릴리스된 가중치에 대해 67.9가 기재되어 있습니다. 한편 Pro의 대시보드 수치는 72.57이었고, 그 카드에는 71.9가 기재되어 있습니다 — 내려갔습니다. 같은 실행에서 나온 두 체크포인트를 두 번 평가했는데, 두 평가 사이의 격차는 두 모델 사이의 격차와 같은 크기입니다. 지난주부터 대시보드 수치를 인용해 오셨다면, 그 수치들은 학습 스냅샷을 설명하는 것이지 오늘 다운로드하게 될 아티팩트를 설명하는 것이 아닙니다.

어느 쪽도 라우터에 없습니다
바로 이 대목이 대부분의 실제 평가를 좌우한다. 샤오미는 어느 체크포인트도 판매하지 않는다. 자사 사이트에는 MiMo-V2.6 세대에 대해 공개된 토큰당 가격이 없고, 둘 중 어느 것에 대해서도 호출 가능한 모델 식별자를 발표하지 않았다. 대신 존재하는 것은 다운로드, 그리고 — Pro에 한해서만 — Artificial Analysis가 입력 토큰 100만 개당 $0.435, 출력 토큰 100만 개당 $0.87로 제공 중인 것으로 집계하는 단일 API 제공업체뿐이다. 이는 공급업체의 요금표라기보다 한 제공업체의 등록 정보이며, Flash에는 이에 필적할 만한 것이 전혀 없다. 제3자 카탈로그 페이지에 유통되는 수치도 같은 방식으로 읽어야 한다.
그래서 Flash와 Pro 사이의 선택은 서로 다른 미터를 가진 두 엔드포인트 사이의 선택이 아니다. 그것은 두 개의 GPU 청구서 사이의 선택이며, 더 작은 쪽은 더 큰 쪽의 약 3분의 1이다. 그것이 Flash를 위한 상업적 논거의 전부이며, 대부분의 사람들이 이 모델을 사는 이유인 작업들에서 두 모델이 서로 몇 점 차이 안에 불과하기 때문에, 그 논거는 벤치마크 표가 시사하는 것보다 더 강력하다.
그렇게 남는 것은 익숙한 삼자 분할이다. 프런티어를 임대하거나, 소형 모델을 보유하거나, 대형 모델을 보유하는 것이다. 프런티어 항목은 샤오미가 자체 표에서 벤치마크하는 대상이다 — Claude Opus 5, GPT-5.6 Sol, Claude Fable 5는 모두 벤더 자체 비교에서 DeepSWE 기준 Pro보다 몇 점 위에 있으며, 세 가지 모두 오늘날 다음을 통해 호출할 수 있다 OrcaRouter에서 하나의 API 키로, 제공사 정가에 0% 마진을 그대로 반영한 가격으로. 이는 여러분 앞에 놓인 구체적인 결정에 중요하다: 벤더 가격 변경이 다음 계약 갱신 시점이 아니라 같은 날 여러분 쪽에 반영되므로, 호스팅 가격이 움직여도 임대 대 보유 계산이 정직하게 유지된다. 자동 페일오버 덕분에 아직 평가 중인 모델이 프로덕션 경로에 홀로 놓여 있을 필요도 없다 결정을 내리는 동안에도.
오늘날 어떤 라우터에서도 — 저희 라우터를 포함해 — 할 수 없는 일은 MiMo-V2.6-Flash나 MiMo-V2.6-Pro를 호출하는 것입니다. 저희는 어떤 Xiaomi 모델도 라우팅하지 않으며, Xiaomi 자체 카드의 가용성 안내는 Xiaomi 자체 채널, 즉 MiMo API 플랫폼, AI Studio, MiMo Code 및 데스크톱 앱을 가리킵니다.
어느 체크포인트에서, 그리고 언제
MiMo-V2.6 세대를 원하고 하드웨어가 결정적 제약이라면 MiMo-V2.6-Flash를 선택하세요. 플래그십과 비교해 DeepSWE 점수 약 4점과 대부분의 에이전트 벤치마크에서 1~2점을 포기하게 됩니다. 대신 메모리는 약 3분의 1에 불과하고, 샤오미 자체 표에서 CyberGym 부문에서 Pro를 앞서며, 동일한 라이선스, 동일한 1M 토큰 컨텍스트 주장, 동일한 멀티모달리티를 공유하는 체크포인트를 얻습니다. 사이버보안 평가 작업을 하는 팀에게 그 CyberGym 열은 반올림 오차가 아닙니다.
워크로드가 코딩이나 장시간에 걸친 에이전트 작업이고 노드 비용을 이미 지불한 상태라면 MiMo-V2.6-Pro를 선택하세요. 거의 모든 항목에서 더 우수한 모델이며, Artificial Analysis가 실제로 측정한 바로 그 모델입니다 — 재보정된 v4.3 척도에서 Intelligence Index 46, 오픈 웨이트 부문 114개 모델 중 1위, 초당 출력 토큰 134.3개, 백만 입력 토큰당 $0.435 및 백만 출력 토큰당 $0.87로 책정 — 프로덕션을 계획할 때는 독립적인 측정이 공급업체가 제공한 표보다 더 가치가 있습니다.
요약이 아니라 설정 파일 자체를 읽기 전까지는 둘 중 어느 쪽도 선택하지 마라. Flash 카드는 한 번의 패스에서 7개 토큰을 예측하는 5계층 추측 드래프터를 설명하지만, 같은 저장소의 config.json은 num_nextn_predict_layers를 3으로 설정한다. 카드의 요약은 런타임이 읽는 내용이 아니다. 그리고 저장소 페이지의 Safetensors 블록은 Flash의 경우 159B 파라미터, Pro의 경우 524B를 보고하는데, 이는 어느 것도 어느 모델 카드의 총계나 활성 수와도 일치하지 않는다. Xiaomi는 이 불일치를 설명하지 않았다. 대신 공개된 가중치 데이터에서 크기를 산정하라, 파라미터가 어떻게 계산되든 VRAM에서 비용을 지불하는 숫자는 그것이기 때문이다.

무엇이 그것을 해결할까요?
세 가지를 대략 유용한 순서대로 말씀드리겠습니다. 동일한 하네스에서의 제3자 실행 — DeepSWE나 Terminal Bench에 자기 보고가 아니라 제출된 결과 — 은 Flash와 Pro 사이의 4점 차이가 실제 위치인지 유리한 구성인지 알려줄 것입니다. 공개된 가격표가 있으면 전체 비교가 하드웨어 프로젝트에서 호스팅된 프런티어 옆에 놓을 수 있는 항목으로 바뀔 것입니다. 그리고 Xiaomi가 오픈소스로 공개하겠다고 밝힌 RL 환경은 대부분의 팀이 실제로 원할 아티팩트입니다. 왜냐하면 그것이 바로 여러분의 자체 트레이스에서 루프를 재현하는 데 필요한 것이기 때문입니다.
그때까지는 실질적인 해석의 여지가 좁다. MiMo-V2.6은 하나가 아니라 두 개의 체크포인트이며, 이름만 쓰면 보통 더 비싼 쪽을 뜻한다. 오늘 이 시리즈 안에서 선택해야 한다면, 특별히 신경 쓰는 벤치마크 열이 달리 말하지 않는 한 정직한 기본값은 Flash다. 그리고 아직 노드를 살 준비가 되어 있지 않다면, 어느 쪽도 아직 정답은 아니다.

