
GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: 두 갈래 빠른 길, 한쪽은 그 대가를 밝힌다
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952지능
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856지능
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238지능
- OpenAIOpenAI: GPT-6 Sol2026-09-2248지능
- AnthropicAnthropic: Claude Opus 5.52026-09-2258지능
- xAIGrok 4.72026-09-2146지능
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100만 토큰당 · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- OpenAIOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- AnthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100만 토큰당 · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 378 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
프런티어 모델을 구매하는 가장 빠른 두 가지 방법이 16일 간격으로 출시되었는데, 그중 하나만이 그 속도가 어떻게 만들어졌는지 알려주었다. GPT-6.1 Ultrafast — 위에 있는 서빙 티어 GPT-6.1 Sol, OpenAI가 2026년 9월 29일에 출시했고 2026년 10월 8일에 이 티어를 얻은 — API를 통해 접근하는 폐쇄형 플래그십으로, 스탠더드의 6배 가격이며 가중치와 요청 사이에 무슨 일이 일어나는지에 대한 공개된 설명이 없다. Xiaomi MiMo v2.6 Pro Ultraspeed, 2026년 9월 22일에 출시된, MiMo-V2.6-Pro 위에 있는 속도 티어로, Xiaomi가 강화 학습 환경도 공개한 MIT 라이선스 체크포인트이다. 둘 다 지연 시간을 배수로 판다. 오직 Xiaomi의 배수만이 고객이 검사할 수 있는 것 위에 놓여 있으며, 그 차이는 어느 속도 주장보다도 결정에 더 가치가 있다.
두 레인의 가격은 쉬운 부분이며 아래에서 다룹니다. 어려운 부분은 속도 등급이 서빙에 대한 약속이라는 점인데, 두 공급업체는 그 약속을 매우 다른 수준의 공개로 내놓았습니다. 한쪽은 대표 수치를 형제 모델에서 빌려왔고, 다른 쪽은 가격표와 함께 학습 레시피를 공개했습니다. 프로덕션 워크로드를 패스트 레인에 맡기려는 참이라면, 그 공개 격차가 바로 당신이 실제로 떠안는 위험입니다.
가격, 양쪽이 같은 줄에 있는
두 티어 모두 표준 레인의 배수로 판매되며, 그 배수들이 서로 충분히 비슷해서 가격이 이 둘을 구분하는 기준은 아니다.
• 표준 레인 — GPT-6.1 Sol은 백만 토큰당 입력 $2.00 / 출력 $10.00, 이에 맞서는 MiMo-V2.6-Pro는 $0.44 / $0.87.
• 패스트 레인 — GPT-6.1 Ultrafast는 $12.00 / $60.00인 반면, MiMo-V2.6-Pro-UltraSpeed는 $4.35 / $8.70입니다.
• 배수 — OpenAI 티어의 경우 모든 라인에서 정확히 6배, Xiaomi의 경우 입력에서 대략 9.9배, 출력에서 정확히 10배입니다.
• 캐시 입력 — GPT-6.1 Sol은 Standard에서 백만 개당 $0.10, Ultrafast에서 $0.60으로 책정됩니다. 우리가 확인할 수 있는 MiMo 요금표에는 두 레인 중 어느 쪽에도 별도의 캐시 입력 항목이 공개되어 있지 않습니다.
• 긴 컨텍스트 — GPT-6.1 Sol은 입력 토큰이 272,000개를 초과하면 전체 요청에 대해 입력 및 캐시 요율을 2배, 출력을 1.5배로 재산정하므로 Ultrafast는 $24.00 / $1.20 / $30.00 / $90.00이 됩니다. MiMo-V2.6-Pro는 1M 토큰 컨텍스트 창을 제공하며 이에 상응하는 공개된 가격 절벽은 없습니다.
• 절대 격차 — 두 고속 레인은 입력에서 2.8배, 출력에서 6.9배 차이가 나는데, 이는 최전선 폐쇄형 모델과 오픈 웨이트 모델 사이의 격차가 표준 요율이 아니라 속도 등급 안에서 나타나고 있음을 뜻한다.
그 블록의 한 줄 요약: Xiaomi는 훨씬 더 저렴한 모델에 더 큰 배수를 부과하고, OpenAI는 훨씬 더 비싼 모델에 더 작은 배수를 부과한다. 출력 토큰의 경우 OpenAI 레인에는 백만 개당 $60.00를, Xiaomi의 레인에는 $8.70를 지불한다. 어느 벤더도 속도에 대한 할인을 제공하지 않는다; 둘 다 속도를 별도의 제품으로 책정하고 있는데, 이는 두 경우 모두 표준 레인이 여전히 기본값이고 빠른 레인은 워크로드별로 정당화해야 하는 예외라는 첫 번째 신호다.
각 벤더가 속도에 관해 여러분에게 말할 내용
바로 이 지점에서 두 롤아웃은 더 이상 대칭적이지 않게 되며, 이것이 이 페이지에서 가장 유용한 부분이다.
Ultrafast에 관해 OpenAI가 공개한 수치는 GPT-6 Astra Ultrafast가 Codex에서 Standard 모드의 GPT-6 Astra보다 토큰을 최대 8배 더 빠르게 생성한다는 것입니다. 이는 다른 클라이언트에서의 다른 모델에 대한 측정치를 상한선으로 표현한 것입니다. GPT-6.1 Sol의 Ultrafast를 다루는 문서는 해당 티어가 생성된 출력 토큰 사이의 시간을 줄여 준다고 말하면서 요금표를 가리키지만, Sol 티어에는 숫자를 전혀 붙이지 않습니다. 그래서 이번 출시에 붙은 대표 숫자는 9월 29일부터 Ultrafast를 적용해 온 형제 모델에서 빌려온 것이며, 어느 쪽에 대해서도 독립적인 제3자가 초당 토큰 수 측정치를 공개한 적이 없습니다. 그 수치가 실제로 맞을 수도 있습니다 — 동일한 서빙 스택, 동일한 메커니즘이니까요 — 하지만 이는 OpenAI 자체가 이 모델에 대해 측정하지 않은 벤더 상한선입니다.
Xiaomi의 공개는 성격이 다르며, 그 차이는 그것이 더 정밀하기 때문이 아니다. 자사 자료는 UltraSpeed가 동일한 품질에서 표준 Pro 서비스의 출력 속도 최대 20배에 도달한다고 주장한다. 같은 날 같은 모델을 설명한 제3자 카탈로그 목록들은 대략 10배라고 말한다. 두 수치 모두 유통되고 있지만 서로 같은 수치가 아니며, 이 둘을 조화시키는 측정 결과를 공개한 사람은 아무도 없다. 이를 솔직하게 읽자면: "최대 20배"는 Xiaomi가 명시하지 않은 조건에서의 공급업체 상한이고, "대략 10배"는 카탈로그가 일반적인 수치라고 주장할 용의가 있었던 값이며, 명시된 동시성 수준에서 요청별 지연 분포를 누군가 공개하기 전까지 실제 배수는 넓은 범위 어딘가에 있다.
그래서 Xiaomi는 서로 맞지 않는 두 개의 숫자를 내놓고, OpenAI는 다른 모델에 속하는 숫자 하나를 내놓습니다. 어느 쪽도 예산을 세울 근거가 되는 사실이 아니며, 실질적인 결론은 둘 다 같습니다. 프로덕션 경로로 확정하기 전에 자체 프롬프트로 해당 티어를 측정하십시오.
정말로 중요한 비대칭성: 추가 자릿수가 무엇을 가져다주는가
속도 주장은 제쳐두고, 두 레인은 매우 다른 종류의 제품에 연결되어 있으며, 바로 이 지점에서 선택은 더 이상 가격 비교의 문제가 아니게 된다.
MiMo-V2.6-Pro는 Xiaomi가 공개적으로 설명한 희소 전문가 혼합(Mixture-of-Experts) 설계다: 총 1.02조 개의 매개변수와 토큰당 420억 개 활성화, 100만 토큰 컨텍스트 윈도우, 텍스트·이미지·비디오·오디오 전반에 걸친 네이티브 멀티모달리티, 그리고 공개된 체크포인트에 MIT 라이선스 태그가 있다. 릴리스 번들에는 기술 보고서와 배포 노트가 포함되며, Xiaomi는 포스트트레이닝을 검토하고 재현할 수 있도록 강화학습 훈련 환경과 그 코드를 오픈소스로 공개한다고 밝혔다. RL 실행도 문서화되어 있다 — 모델당 30단계와 약 750,000개의 궤적, 6일 이내, Pro 및 Flash 실행에 걸쳐 공개된 합산 지출 약 $3,474,715이다. DeepSWE v1.1에서 mini-swe-agent를 avg@3로 사용한 Xiaomi 자체 하네스 기준으로, 회사는 해당 실행에서 MiMo-V2.6-Flash가 48.8에서 65.68로, MiMo-V2.6-Pro가 58.4에서 72.57로 상승했다고 보고한다. 이는 벤더가 보고한 수치이며 재현되지 않았다; "Xiaomi의 하네스가 72.57이라고 말한다"와 "72.57이 점수다"의 구분은 주장과 사실의 차이다.
GPT-6.1 Sol은 그중 어느 것도 공개하지 않는다. 파라미터 수나 아키텍처 설명, 학습 비용 수치, 체크포인트, 읽어볼 수 있는 라이선스는 없다. 있는 것은 모델 카드, 컨텍스트 윈도우, 2026년 4월 30일이라는 지식 컷오프, 그리고 API뿐이다. 이는 최전선 연구소의 통상적인 방식이며 비판이 아니다. 하지만 출시 보도가 흔히 건너뛰는 구매 결정에 중요한 결과를 낳는다. 오픈 웨이트 노선에서는 실망스러운 고속 티어라도 되돌릴 수 있다. UltraSpeed가 트래픽의 10배 값을 하지 못하는 것으로 드러나도, 같은 체크포인트를 내려받아 직접 서빙하거나 다른 제공업체를 통해 서빙할 수 있으니, 마이그레이션 비용을 치르는 대신 손실의 상한이 정해진다. 폐쇄형 노선에서는 실망스러운 고속 티어란 다시 낮춰 조정하면 되는 청구서와 레이트 리밋 예산일 뿐이다. 가중치를 실행하는 방식으로 우회할 수는 없는데, 실행할 가중치 자체가 없기 때문이다.
그 MIT 태그에 관해서는 한 가지 주의할 점이 있습니다. 출시 보도에서는 이 구분이 뭉개지기 때문입니다. 라이선스는 Xiaomi가 공개한 체크포인트에 적용됩니다. UltraSpeed는 호스팅 서비스이며, 호스팅 서비스는 가중치 라이선스가 아니라 서비스 이용약관의 적용을 받습니다. 체크포인트를 자신의 하드웨어에서 실행할 권리를 보유하는 것과 그것의 가속 서빙을 누군가로부터 재판매할 권리를 보유하는 것은 서로 다른 두 가지 권리이며, 첫 번째 권리만 라이선스 파일에서 나옵니다.


두 식별자 중 하나를 복사하기 전에 알아야 할 두 가지 명명 함정
이 페이지 제목에 있는 어느 이름도 체크포인트가 아니며, 두 공급업체의 문서 때문에 이 실수를 반복하기 쉽습니다.
• GPT-6.1 Ultrafast — 모델이 아니다. 요청 내 식별자는 표준 모델과 동일하게 유지되고, 티어는 요청 필드로 설정되며, 결과는 같은 체크포인트를 다르게 스케줄링한 것뿐이다.
• MiMo v2.6 Pro Ultraspeed — 역시 별도의 가중치 집합이 아닙니다. 이는 더 빠른 경로로 제공되며 자체 항목으로 가격이 책정된 MiMo-V2.6-Pro 체크포인트입니다.
• 벤치마킹에서 이것이 의미하는 바 — 어느 모델이든 두 레인을 동일한 프롬프트에서 비교하면, 예상되는 결과는 동일한 답변이 서로 다른 속도로 나오는 것입니다. 동일한 입력에 대해 내용이 달라지는 것은 보고해야 할 결함이지, 구매한 역량이 아닙니다.
• 그것이 라이선스 확인에 대해 의미하는 바 — Xiaomi의 경우에는 모델 카드를 읽으세요. OpenAI의 경우에는 읽을 것이 없습니다. 가중치가 배포되지 않기 때문입니다.
각 티어가 판매되는 방식에서 드러나는 더 완만한 비대칭성도 있습니다. GPT-6.1 Sol은 미국 및 EU 데이터 레지던시와 글로벌 처리를 지원하며, Ultrafast 하에서도 마찬가지이므로 유럽 처리에 고정된 워크로드에는 문서화된 답이 있습니다. 우리가 확인할 수 있는 MiMo 요금표에는 레지던시가 전혀 명시되어 있지 않습니다 — Xiaomi는 컴플라이언스 태세가 아니라 모델과 서빙 경로를 판매하고 있는 것입니다. 규제 대상 구매자에게는 가격을 고려하기도 전에 그 한 줄이 비교를 좌우할 수 있습니다.
각 레인이 실제로 호출 가능한 곳
두 패스트 레인 모두 각 벤더 자체의 API를 통해 접근할 수 있으며, 둘 다 서드파티 플랫폼에도 나타납니다. 어느 쪽도 OrcaRouter에는 없으며, 비교 페이지가 그렇지 않은 듯한 인상을 주도록 내버려 두기보다는 이 점을 분명히 밝히는 것이 좋습니다.
OrcaRouter에 있는 것은 OpenAI 모델의 표준 레인입니다: openai/gpt-6.1-sol OpenAI 자체의 목록 요금인 입력 토큰 100만 개당 $2.00, 출력 토큰 100만 개당 $10.00이며, 마크업 0%에 제공업체 가격이 그대로 전달되므로 벤더의 가격 변경이 같은 날 우리 쪽에 반영됩니다. Ultrafast는 귀하의 OpenAI 계정에서 청구되는 서비스 계층 플래그이고, Xiaomi 모델은 여기 전혀 호스팅되지 않습니다. 키 하나로 얻을 수 있는 것은 하나의 OpenAI 호환 엔드포인트 뒤에서 200개 이상의 다른 모델과 나란히 제공되는 표준 레인이며, 제공업체 간 자동 장애 조치 — 이는 보호하려는 워크로드가 새벽 3시에 속도 제한 상한을 체감하게 될 바로 그 워크로드일 때 유용한 자세입니다.

테스트할 레인, 순서대로
워크로드가 인터랙티브하고 생성 시간이 사람의 시계에 달려 있다면, 두 티어 모두 시험해 볼 가치가 있으며 결정적 요인은 가격이 아니라 당신 신뢰의 만료일이 될 것이다. 오픈 웨이트 노선은 검증한 뒤 떠날 수 있게 해주고, 클로즈드 노선은 그것을 서빙할 수 있는 단 하나의 벤더와 함께 검증하고 남아 있기를 요구한다. 그 비대칭은 실재하지만 공짜도 아니다: MiMo-V2.6-Pro-UltraSpeed는 호스팅 서비스이므로, 이탈은 설정 변경이 아니라 마이그레이션이며, 마이그레이션하게 될 체크포인트는 해당 티어의 서빙 최적화와 맞지 않을 수 있다.
워크로드가 배치 또는 예약형이라면, 6배든 10배든 둘 다 잘못된 구매이며, 솔직한 선택은 표준 레인에서 실행하고 그 차액을 대신 평가에 쓰는 것입니다.
이 페이지를 바꿀 수 있는 것은 다음과 같다: 명시된 동시성 수준에서 두 티어 중 하나의 출력 속도에 대한 독립적 측정치, Xiaomi의 공개된 데이터 상주 선언, 또는 구매자가 요청하는 대신 기준으로 삼아 계획할 수 있는 Sol 티어에 대한 OpenAI의 속도 제한 수치. 그것들이 존재하기 전까지, 이 비교는 가격표 대 가격표에 불과하며, 두 공급업체 중 한 곳은 가격이 매겨지는 대상에 대해 상당히 더 많이 공개한 상태다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
