
MiniCPM-V 4.7 vs North Micro Vision Instruct: Cohere는 문서화된 2.4B 모델을 출시했고, OpenBMB는 70GB의 공백을 출시했다
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 150 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 98 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 52 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 248 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
MiniCPM-V 4.7과 North Micro Vision Instruct는 모두 같은 요구사항 — 직접 미세 조정하고 배포할 수 있는 소형 비전-언어 모델 — 에 대한 소규모 연구소의 답변이지만, 둘 중 하나만 완성된 상태입니다. Cohere의 North Micro Vision Instruct는 2026년 8월 10일, Apache-2.0 라이선스 아래 24억 개 매개변수의 네이티브 해상도 모델로 등장했으며, 아키텍처를 설명하는 기술 블로그 글과 용도를 나열한 모델 카드가 함께 제공되었습니다. MiniCPM-V 4.7은 2026년 10월 6일, 16개의 샤드로 구성된 352억 개 매개변수의 희소 전문가 혼합 체크포인트로 등장했지만 README도, 라이선스 필드도, 어떤 종류의 벤치마크도 없습니다. 흥미로운 비교는 "어느 쪽이 더 똑똑한가"가 아닙니다. 두 릴리스가 이를 사용해야 하는 커뮤니티를 향한 상반된 태도를 보여준다는 점입니다.
두 릴리스와 각 릴리스에 포함된 내용
North Micro Vision Instruct는 CohereLabs에서 Apache-2.0 라이선스로 공개한 2.4B 오픈 가중치 비전-언어 모델입니다. 이는 프로토타이핑, 작업별 미세 조정 및 특수 멀티모달 작업을 위한 컴팩트한 기반 모델로 명시적으로 포지셔닝되어 있습니다. 이 모델의 대표적인 특징은 고정 그리드로 리샘플링하는 대신 종횡비와 미세한 시각적 디테일을 유지하는 원본 해상도 이미지 처리이며, 모델 카드에서는 VQA, 캡셔닝, 그라운딩, OCR, 차트 및 문서 전반에 걸친 기능을 주장합니다. 대화당 여러 이미지와 11개 언어 — 영어, 독일어, 프랑스어, 스페인어, 이탈리아어, 포르투갈어, 힌디어, 일본어, 한국어, 중국어, 아랍어 — 를 지원합니다. 모델 가중치는 BF16으로 2,484,847,856개의 파라미터이며, 출시 이후 MLX 커뮤니티에서 4비트, 5비트, 6비트, 8비트, mxfp8, mxfp4, nvfp4 및 bf16 변환을 제작했는데, 이는 건강한 소형 모델 출시가 몇 달 후에 보이는 모습입니다. 약 166,500회의 다운로드와 150개의 좋아요를 기록했습니다.
MiniCPM-V 4.7은 openbmb/MiniCPM-V-4.7-35B-A3B입니다. BF16 기준 35,212,875,824개 파라미터, 16개의 safetensors 샤드에 걸쳐 70.4 GB, 클래스 MiniCPMV4_7ForConditionalGeneration, Transformers 5.2.0으로 저장되었고 2026년 10월 6일에 업로드되었습니다.

텍스트 백본은 Qwen3.5에서 파생된 희소 MoE로, 전문가 256개, 토큰당 8개 선택, 고정된 3-선형-대-1-풀 어텐션 패턴을 실행하는 40개 레이어, 256K 컨텍스트, 그리고 16× 다운샘플링을 수행하는 자체 개발 27층 비전 타워로 구성되어 있다. 모델 카드는 없다. 저장소에는 좋아요 3개가 있고 다운로드는 없다.
나란히, 중요한 여섯 가지에 대하여
• 파라미터 — North Micro Vision Instruct: 2.48B dense, 토큰마다 모든 파라미터가 활성화됩니다. MiniCPM-V 4.7: 총 35.2B, 256개 중 8개 sparse. 동일 기준으로 비교할 수 있는 숫자가 아닙니다.
• 라이선스 — North Micro Vision Instruct: Apache-2.0, 태그 및 명시됨. MiniCPM-V 4.7: 선언된 바 없음, 이는 기본적으로 모든 권리 보유로 간주됨.
• 파인튜닝 지원 범위 — North Micro Vision Instruct: 태스크별 파인튜닝을 위한 기반으로 명시적으로 설계되었으며, 커뮤니티 양자화가 이미 제공됩니다. MiniCPM-V 4.7: 70GB BF16 체크포인트로, 양자화 버전이 없고 공개된 학습 레시피도 없습니다.
• 해상도 처리 — North Micro Vision Instruct: 네이티브 해상도, 종횡비 유지. MiniCPM-V 4.7: downsample_mode: "16x", max_slice_nums: 9를 사용하는 슬라이서 기반 고해상도 경로.
• 언어 지원 범위 — North Micro Vision Instruct: 카드에 11개 언어가 나열되어 있음. MiniCPM-V 4.7: 어디에도 명시되지 않음.
• 컨텍스트 — North Micro Vision Instruct: 2.4B 배포 클래스에 맞게 크기가 조정되었습니다. MiniCPM-V 4.7: max_position_embeddings: 262144, 256K.
• 품질의 증거 — North Micro Vision Instruct: 공개된 카드, 기술 블로그 게시물, 커뮤니티 전환 및 활발한 도입. MiniCPM-V 4.7: 인용할 것 없음.

이 비교를 한쪽으로 치우치게 만드는 비대칭
여기에 쓰기 쉬운 특정한 종류의 비교 기사가 있다: OpenBMB의 GitHub에서 MiniCPM-V 4.6 수치를 가져와, 그것이 동급 소형 모델들을 능가한다고 언급하고, 4.7이 그 수치를 물려받는다고 암시하는 것이다. 그것은 부정직할 것이며, 그 이유는 정확히 밝힐 가치가 있다. MiniCPM-V 4.7은 4.6의 더 큰 버전이 아니다. 1.3B dense Qwen3.5-0.8B 백본을 35B sparse Qwen-MoE로 교체하고, 어텐션 패턴을 3:1 선형 대 전체로 변경하며, 비전 압축 기본값을 16x로 전환한다. 그 각각은 정확도를 결정하는 모델 부분에 대한 변경이다. 계보는 벤치마크가 아니다.
부정직함의 다른 방향은 미묘하다: 카드의 부재를 고장 난 것의 증거로 취급하는 것이다. 그렇지 않다. OpenBMB는 2024년 이후 아홉 세대의 MiniCPM-V를 출시했으며, 그중 몇몇은 크기에 비해 정말 뛰어나다. 저장소 생성과 마지막 커밋 사이의 12분 간격은 단계적으로 준비한 뒤 공개한 산출물의 모습이지, 고장 난 것의 모습이 아니다. MiniCPM-V 4.7을 올바르게 해석한 결과는 "알 수 없음"이며, 알 수 없음은 "나쁨"과는 별개의 것이다.
Cohere 측에는 자체적인 정직성 요건이 있습니다.

North Micro Vision 카드의 품질 주장은 Cohere 자체 측정치이며, 기술 심층 분석도 같은 팀이 작성했습니다. 커뮤니티가 며칠 만에 16개의 MLX 양자화를 만들었다는 것은 채택 증거이지 정확도 증거가 아닙니다 — 사람들은 변환하기 쉬운 모델을 변환하며, 깔끔한 2.4B Apache-2.0 릴리스는 변환하기 쉽습니다. 다운로드 수와 양자화 확산 정도 중 어느 것도 점수로 읽어서는 안 됩니다.
각각이 실제로 무엇을 위한 것인지
노스 마이크로 비전 인스트럭트는 파인튜닝 대상입니다. 그것이 카드 자체의 표현으로 밝힌 설계 개요 전체입니다. 프로토타이핑과 특화된 애플리케이션을 위한 콤팩트한 기반이라는 것이죠. 좁은 범위의 문서 파싱, 차트 추출 또는 다국어 캡셔닝 작업이 있고 수천 개의 레이블링된 예시가 있다면, 네이티브 해상도 입력과 8비트 이상 양자화를 지원하는 2.4B Apache-2.0 모델이 합리적인 출발점입니다. 그리고 작동하게 되면 엣지 디바이스나 중급 GPU 한 대로 옮길 수 있습니다.
MiniCPM-V 4.7은, 실제로 쓸 만한 것으로 드러난다 해도, 그와는 다르다. 70GB 비양자화 기준으로 그것은 서버 모델이며, 256K 창과 KV 캐시를 일정하게 유지하는 선형 어텐션이라는 두드러진 특징은 긴 문맥의 멀티모달 워크로드, 즉 한 시간짜리 비디오 전사, 대규모 문서 세트, 이력에 이미지가 포함된 장시간 다중 턴 분석을 겨냥한다. 이들은 실제 워크로드이고, 이 아키텍처는 그것들에 대한 합리적인 베팅이다. 다만 그 베팅은 아직 점수가 매겨지지 않았을 뿐이다.
두 압축 전략에 관해 붙잡아 둘 만한 뉘앙스가 있다. 네이티브 해상도와 16× 다운샘플링은 단순히 더 낫고 더 나쁜 관계가 아니다. 네이티브 해상도 인코더는 미세한 디테일을 보존하는 데 토큰을 쓰는데, 이는 OCR과 grounding이 필요로 하는 바로 그것이다. 16× 다운샘플은 더 적은 토큰을 쓰고 바로 그 디테일을 잃을 위험이 있다. 어느 쪽이 옳은지는 작업이 빽빽한 양식을 읽는 것인지 장면을 묘사하는 것인지에 달려 있으며, MiniCPM-V 4.6의 전환 가능한 4x/16x 모드는 답이 작업에 따라 달라지기 때문에 존재했다. 4.7이 그 전환 기능을 다시 유지했는지는 config가 말해주지 않는 것 중 하나다.
라우터가 적합한 경우와 그렇지 않은 경우
이 두 모델은 모두 직접 서빙하는 가중치입니다. North Micro Vision Instruct와 MiniCPM-V 4.7은 둘 다 OrcaRouter에서 호스팅되는 모델이 아니며, 여기 있는 어떤 내용도 그것이 그렇다는 주장으로 읽혀서는 안 됩니다. 라우팅 문제는 한 단계 뒤에 등장합니다. 작은 자체 호스팅 모델이 일상적인 작업을 처리하고, 더 큰 모델이 실패하는 사례를 처리해야 할 때입니다. 그 인계가 바로 단일 키 라우터의 용도입니다 — 여러 제공업체에 걸친 200개 이상의 모델, 각각 우리 쪽에서 추가 마크업 없이 정가로, 한 제공업체가 성능이 저하될 때 자동 장애 조치와 함께 — 그리고 필요하기 전에 인터페이스를 확정해 두는 것이 좋습니다. 왜냐하면 4.7 평가가 성공하는 날이 바로 두 번째 계약 없이 두 번째 엔드포인트를 원하게 되는 날이기 때문입니다.
평결, 그리고 그것을 바꿀 수 있는 것
Cohere는 모델을 공개했다. OpenBMB는 체크포인트를 공개했다. 독자가 실제로 행동에 옮길 수 있는 모든 축에서 — 라이선스, 라이선스 명확성, 문서화된 동작, 파인튜닝 준비성, 양자화, 언어 지원 범위 — North Micro Vision Instruct가 오늘의 답이며, 격차는 크다. 이는 성능에 관한 주장이 아니다. 가능한 성능 비교가 없기 때문이다. MiniCPM-V 4.7은 비교 대상 모델의 약 10배에 달하는 파라미터 수를 갖고 있으면서 그 규모를 정당화하거나 반박할 만한 것은 아무것도 공개하지 않았다. 정직한 태도는 이를 보류 중인 것으로 취급하는 것이다. 실제 실적을 가진 연구소에서 나온 진짜 산출물이지만, 저장소에 놓여 있으면서 모든 것을 바꿔 놓을 파일 하나, 즉 README가 빠져 있다.
