Xiaomi MiMo-V2.6-Pro 대 MiniMax M3 비교를 위한 타이틀 카드로, 두 개의 마주 보는 스펙 카드를 보여줍니다: Xiaomi MiMo-V2.6-Pro는 Intelligence Index v4.3.2 46, 출력 속도 134.3 토큰/초, 블렌디드 $0.18/1M 및 API 제공업체 1개, MiniMax M3는 Index 29, 168.9 토큰/초, $0.22 및 API 제공업체 15개.
Guides & Insights

Xiaomi MiMo-V2.6-Pro vs MiniMax M3: 더 좋은 점수는 더 얇은 경로를 가진다

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Xiaomi MiMo-V2.6-Pro는 2026년 9월 22일 정식 출시되었고, Artificial Analysis Intelligence Index에서 v4.3.2 기준 46점으로 오픈 웨이트 1위를 차지했다. MiniMax M3는 2026년 5월 31일 출시된 이후 그 타이틀의 한 버전을 유지해 왔으며, 오늘 같은 지수에서 29점을 기록한다 — 17점 뒤처진 것이다. 점수는 이 둘에 관해 가장 흥미롭지 않은 부분이다. MiniMax M3는 초당 출력 토큰 168.9개 대 134.3개로 서비스되고, 응답 시간은 0.92초 대 2.15초이며, 입력 토큰당 더 저렴하고, Xiaomi의 1개 대비 15개 API 제공업체를 통해 접근할 수 있다. 더 새롭고 더 높은 점수를 받은 모델이 실제로 호출하기에는 더 어려운 모델이며, 이 비교가 다루는 것은 바로 그 역전이다.

둘 다 오픈 웨이트, 둘 다 멀티모달, 14주 차이

두 모델은 설계 의도에서 가까운 친척이다. 둘 다 중국 연구소에서 나온 희소 전문가 혼합(MoE) 모델이고, 둘 다 100만 토큰 컨텍스트 창을 갖추고 있으며, 둘 다 이미지와 비디오를 덧붙인 어댑터를 통해서가 아니라 네이티브로 받아들이고, 둘 다 가중치를 공개한다. 두 모델의 출시는 14주 차이가 나며, 두 모델 사이의 인덱스 격차는 그 기간 동안 오픈 웨이트 최전선이 이동한 거리다.

• 총 파라미터 — Xiaomi MiMo-V2.6-Pro 1.02T; MiniMax M3 약 427B, 둘 모두 희소 MoE

• 토큰당 활성 — Xiaomi MiMo-V2.6-Pro 42B; MiniMax M3 약 23–25B

• 컨텍스트 — 각각 1M 토큰, MiniMax M3는 최소 512K 보장

• 입력 모달리티 — 둘 모두 텍스트, 이미지, 비디오; Xiaomi는 오디오 입력 추가

• 가중치 — Xiaomi MiMo-V2.6-Pro는 MIT 라이선스; MiniMax M3는 MiniMax 커뮤니티 라이선스로 배포되며, 이는 허용적 라이선스가 아니어서 상업적 사용을 위해서는 별도의 계약이 필요합니다

• 출시 — Xiaomi MiMo-V2.6-Pro 2026년 9월 21–22일; MiniMax M3 2026년 5월 31일

• 접근성 — Artificial Analysis에서 Xiaomi MiMo-V2.6-Pro에 대해 집계된 API 제공업체는 1곳, MiniMax M3는 15곳

그 마지막 줄이 바로 계속 주시해야 할 부분이다. 시트의 다른 모든 항목은 더 새로운 모델에 유리하다. 그 줄은 그렇지 않으며, 바로 그 줄이 모델이 프로덕션 경로에 자리할 수 있는지를 결정한다.

지수가 무엇을 측정하는지, 그리고 누가 그것을 측정했는지

Artificial Analysis는 두 모델을 모두 v4.3.2에서 직접 실행했습니다. v4.3.2는 추론, 지식, 수학, 코딩을 아우르는 10개 평가로 구성된 종합 지표이며, 여기에는 AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience, AA-LCR v1.1이 포함됩니다. 46도 29도 벤더 수치가 아니며, 여기서 이 점이 중요한 이유는 두 연구소 모두 자체적으로 발표한 벤치마크 수치도 벤더 수치이고, 이 두 종류를 혼합해서는 안 되기 때문입니다.

46점은 Xiaomi MiMo-V2.6-Pro를 해당 합성 지표에서 오픈 웨이트 분야의 선두에 올린다. 하지만 지수 전체의 선두에 올리지는 않는다: Claude Fable 5.1GPT-6 Astra는 둘 다 53점에, Claude Opus 5는 51점에 있다. MiniMax M3의 29점은 측정된 114개 모델 중 16위에 놓이는데, 이는 동급 규모의 중앙값을 훨씬 웃돌지만 6월에 비교 대상이었던 최전선과는 거리가 멀다.

MiniMax M3는 샤오미가 갖지 못한 증거를 가지고 있다

이것은 비교에서 흔히 건너뛰는 부분이며, 구매자가 가장 비중 있게 따져야 할 부분입니다. MiniMax M3는 공개 DeepSWE v1.1 리더보드에 공식 항목으로 등재되어 있습니다: Pass@1 20.4%, Pass@4 48.7%로, MiniMax 추론 업그레이드가 비정상적인 토큰 생성 문제를 해결하고 장문 컨텍스트 캐시 동작을 개선한 후인 2026년 6월 8일에 공개되었습니다. 그 항목에는 효율성 산정이 함께 붙어 있었고, 그 산정은 호의적이지 않습니다: 에이전트 단계 중앙값 311회, 출력 토큰 약 91,000개, 작업당 약 $5.04입니다. 이 모델은 장기간에 걸친 엔지니어링 작업을 통과하며, 그것을 값비싸게 해냅니다.

Xiaomi의 새 모델에 대한 대표 벤치마크 수치는 DeepSWE v1.1에서 72.57로, 기준선 58.4에서 상승한 수치이며, Xiaomi 자체 하네스에서 mini-swe-agent로 3회 평균으로 측정한 값이다. 이는 리더보드 등재 항목이 아니며, 그렇게 제출된 적도 없다. 72.57을 MiniMax의 20.4 옆에 놓고 52점 차 승리로 읽어내는 것은 서로 다른 두 측정값을 가로지르는 산수다: 리더보드는 특정 구성에 대한 Pass@1을 신뢰구간 및 작업당 평균 비용과 함께 공개하며, 제3자가 이를 재실행할 수 있다. 반면 벤더 수치에는 그런 것이 전혀 붙어 있지 않다. 72.57은 충분히 정직할 수 있다. 그것은 다만 같은 종류의 대상이 아닐 뿐이다.

MiniMax도 자체 출시 수치를 공개했으며, 그 모든 수치에 같은 유의점이 적용됩니다. SWE-Bench Pro 59.0, BrowseComp 83.5, SVG-Bench 63.7, Terminal-Bench 2.1 66.0은 모두 MiniMax 자체 인프라와 자체 스캐폴딩에서 실행된 결과입니다. 이는 모델에 대한 주장으로 볼 것이며, 모델을 측정한 값으로 볼 것은 아닙니다.

속도, 지연 시간, 그리고 청구 금액을 결정하는 두 숫자

처리량 격차는 품질 격차와 반대 방향으로 나타나며, 문제가 될 만큼 충분히 크다. MiniMax M3는 초당 출력 토큰 168.9개를 생성하는 반면 Xiaomi MiMo-V2.6-Pro는 134.3개이며, 첫 토큰까지 걸리는 0.92초는 Xiaomi의 2.15초보다 약 2.5배 빠르다. 대화형 제품에서는 첫 토큰 지연 시간이 사용자가 체감하는 숫자이고, 배치 파이프라인에서는 처리량이 전체 소요 시간을 결정하는 숫자다.

비용 면에서 두 모델은 표면상 요금이 시사하는 것보다 더 가깝고, 어느 쪽이 유리한지는 트래픽에 따라 달라집니다. MiniMax M3는 입력 토큰 100만 개당 $0.30, 출력 100만 개당 $1.20로 책정되어 있고, Xiaomi MiMo-V2.6-Pro는 $0.43과 $0.87로 책정되어 있습니다. M3는 입력 비용이 더 저렴하고, Xiaomi는 생성 비용이 더 저렴합니다. 캐시 할인이 적용되면(M3는 80%, Xiaomi는 99%) 캐시 적중/입력/출력 비율이 7:2:1일 때 혼합 요율은 100만 개당 $0.22와 $0.18이 됩니다. Artificial Analysis는 또한 Xiaomi MiMo-V2.6-Pro의 Intelligence Index 작업당 비용을 $0.13으로 기록하는데, 이는 보드의 모든 모델에 대해 동일한 방식으로 측정된 것으로, 두 모델에 대해 구할 수 있는 가장 비교 가능한 단일 비용 수치입니다.

A two-column comparison scoreboard for Xiaomi MiMo-V2.6-Pro and MiniMax M3 covering Intelligence Index v4.3.2 (46 vs 29), output speed (134.3 vs 168.9 tokens/second), time to first token (2.15s vs 0.92s), blended rate ($0.18 vs $0.22 per 1M), API providers (1 vs 15) and long-horizon evidence (vendor harness only vs public Pass@1 entry).

열다섯 개의 경로 대 하나, 그리고 페일오버가 얼마나 가치 있는가

엔드포인트가 다운되어 있으면 17포인트의 지수 우위도 소용없다. Artificial Analysis는 이 글을 쓰는 시점에 Xiaomi MiMo-V2.6-Pro에 대해 단 하나의 API 제공업체만 집계했는데, 그 수치는 모델이 아니라 출시에 관한 사실이다. 3일 전에 공개된 체크포인트가 퍼져 나갈 시간은 없었기 때문이다. 출시된 지 네 달 된 MiniMax M3는 열다섯 곳에서 서비스된다.

그 차이를 위한 것이 바로 라우터이며, 두 모델이 상업적으로 갈라지는 지점이기도 합니다. MiniMax M3는 OrcaRouter에 minimax/minimax-m3라는 이름으로 올라와 있습니다: OpenAI 호환 엔드포인트 하나이며, 공급자 정가가 0% 마크업으로 그대로 전달됩니다따라서 위의 $0.30과 $1.20은 우리가 아니라 MiniMax 자체의 숫자이고, MiniMax의 가격이 바뀌면 같은 날 우리 쪽에도 반영됩니다. 열다섯 개의 업스트림이 있기에 자동 페일오버 체인이 의미를 갖습니다 — 한 공급자에서 멈춰 버린 요청은 응답이 시작되기 전에 다른 공급자로 재시도되며, 이는 갈 곳이 하나뿐인 모델과는 다른 보장입니다. Xiaomi MiMo-V2.6-Pro는 OrcaRouter에 없습니다. Xiaomi 모델은 어느 것도 없으며, 오늘 그것을 이용하려면 Xiaomi 자체 플랫폼과 이를 등재한 서드파티 카탈로그를 거쳐야 합니다.

둘 다 같은 애플리케이션에서 쓰고 싶다면, 실용적인 형태는 이미 결정해 둔 모델들을 담은 키 하나를 두고, 새로 온 모델은 사흘 된 점수만 믿고 채택하기보다 기존 모델들과 비교해 평가하는 것입니다. 이는 라우팅 결정이며, 유용한 속성은 폴백 레인이 당신을 구해 주는 날까지 아무 비용도 들지 않는다는 점입니다.

The OrcaRouter model page for minimax/minimax-m3, showing MiniMax as the vendor, the 2026-05-31 release date, Vision, Tools, JSON and Reasoning capability tags, a 1M-token context window, 512K maximum output, $0.30 per 1M input and $1.20 per 1M output, and a p50 time to first token of 8.49 seconds.

어느 걸 고를까?

이번 주에 프로덕션에서 오픈 웨이트, 멀티모달, 백만 토큰 모델이 필요하다면, 답은 MiniMax M3이며 다른 선택지는 근처에도 못 미친다 — 15개 제공업체, 1초 미만의 첫 토큰, 커뮤니티 라이선스를 읽은 경우에만 가능한 충분히 허용적인 상업적 경로, 그리고 직접 확인할 수 있는 공식 장기 호라이즌 벤치마크 항목까지. 효율성 경고는 사실이다: 토큰당 단가만이 아니라 작업당 91,000개의 출력 토큰까지 예산에 잡아야 한다.

다음 달에 시작할 작업에 쓸 모델을 고르는 중이라면, Xiaomi MiMo-V2.6-Pro는 측정상 큰 격차로 더 뛰어난 모델이며, 더 낮은 혼합 요금에 라이선스 논의를 완전히 없애주는 MIT 라이선스까지 갖추고 있습니다. 아직 없는 것은 두 번째 실행 환경입니다. 주목할 점은 제공자 수입니다. 그 수가 하나에서 벗어나면, 17포인트 격차는 더 이상 연구 결과가 아니라 배포 결정이 됩니다.

그때까지는, 솔직한 요약은 이렇다: 더 나은 모델은 당신이 그것으로부터 페일오버(failover)할 수 없는 모델이고, 더 약한 모델은 오늘 밤 당신이 고객 앞에 내놓을 수 있는 모델이다.

The Artificial Analysis model page showing the Intelligence Index v4.3.2 scores, output speed, latency and per-task cost that both models in this comparison are measured on.

이 글의 숫자들은 어디에서 나온 것인가

두 모델의 지수 점수, 처리량, 지연 시간, 캐시 할인 및 공급자 수는 2026년 9월 22일에 확인된 Intelligence Index v4.3.2에 대한 Artificial Analysis 측정치이며, MiniMax M3의 29는 Xiaomi MiMo-V2.6-Pro의 46과 동일한 버전의 복합 지수에 해당합니다. MiniMax M3의 DeepSWE v1.1 수치는 2026년 6월 8일의 공개 리더보드 항목에서 가져온 것입니다. 58.4에서 72.57로의 DeepSWE 변화, 30단계에 걸친 Pro 실행의 약 262만 달러 강화 학습 비용, 그리고 MiniMax M3의 SWE-Bench Pro, BrowseComp, SVG-Bench 및 Terminal-Bench 수치는 모두 각 연구소의 자체 하네스에서 공급업체가 보고한 것으로 독립적으로 재현되지 않았습니다. 토큰당 요금은 공급업체의 자체 정가입니다.