'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed'용으로 생성된 히어로 타이틀 카드로, 상단 문구는 '두 가지 속도 등급. 하나는 가격 미공개.'이며 카드 두 장이 있습니다. 왼쪽 'GPT-5.6 Sol Ultrafast'에는 가중치: Sol과 동일, 속도 주장: 최대 14배, 가격: 아직 공개되지 않음이 나열됩니다. 오른쪽 'MiMo v2.6 Pro Ultraspeed'에는 가중치: Pro와 동일, 속도 주장: 10배~20배, 가격: $4.35 / $8.70이 나열됩니다. 하단에는 '둘 다 독립적으로 측정된 적이 없습니다.'가 있습니다. 오른쪽 아래에 OrcaRouter 로고.
Guides & Insights

GPT-5.6 Sol Ultrafast 대 Xiaomi MiMo v2.6 Pro Ultraspeed: 두 가지 속도 등급, 하나의 빠진 가격

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

두 업체가 동일한 제품 아이디어를 3주 간격으로 출시했는데, 그 차이를 보면 각 업체가 실제로 무엇을 팔고 있는지 가장 잘 알 수 있다. Xiaomi 쪽은 2026년 9월 22일에 출시되었다: Xiaomi MiMo v2.6 Pro Ultraspeed는 MiMo-V2.6-Pro와 동일한 1.02조 매개변수 체크포인트로, 더 빠르게 제공되며, 백만 입력 토큰당 $4.35, 백만 출력 토큰당 $8.70으로, 표준 Pro 레인의 $0.44 및 $0.87과 대비된다. 해당 업체의 GPT-5.6 Sol Ultrafast는 GPT-5.6 Sol에 적용된 동일한 수법이다: 동일한 가중치, 초당 최대 750 출력 토큰, 표준 티어의 최대 14배, Cerebras 웨이퍼 스케일 하드웨어에서 실행 — 그리고 8월 13일에 모드가 발표된 후 6주가 지나도록 공개된 가격이 전혀 없다.

둘을 나란히 놓고 보면 이상하다는 점이 즉시 드러난다. 샤오미는 대부분의 벤치마크를 공개하기 전에 요금표를 공개했다. OpenAI는 벤치마크와 하드웨어 파트너, 고객사 이름을 공개했지만, 예산을 세울 근거가 되는 숫자는 아직 공개하지 않았다. 이 티어 중 하나는 오늘 구매할 수 있다. 다른 하나는 API 스키마 안의 값일 뿐이다. 따라서 이 둘을 비교하는 것은 어느 쪽이 더 빠른가보다는, 한쪽 공급업체는 가격을 알려줬고 다른 쪽은 알려주지 않았을 때 속도 티어가 어떤 가치를 지니는가에 관한 문제에 가깝다.

각각이 실제로 무엇인지

둘 다 새 모델이 아니다. 이것은 공통된 전제이며, 두 출시 모두 서빙 변경을 기능 출시로 다룬 보도를 끌어모았기에 이를 단호히 말해 둘 가치가 있다.

MiMo v2.6 Pro Ultraspeed는 Xiaomi 플래그십의 서빙 구성입니다. 토큰당 42B가 활성화되는 동일한 1.02T 파라미터 희소 전문가 혼합(MoE) 체크포인트, 동일한 1M 토큰 컨텍스트, 텍스트·이미지·비디오·오디오 전반에 걸친 동일한 네이티브 멀티모달리티, 공개 저장소의 동일한 MIT 라이선스 가중치를 갖습니다. Xiaomi 자체 자료는 같은 품질에서 표준 Pro 서비스 출력 속도의 최대 20배를 주장합니다. 같은 날 같은 모델을 설명한 타사 카탈로그 목록은 약 10배라고 말합니다. 이 둘을 조정하는 측정치는 아무도 공개하지 않았습니다.

GPT-5.6 Sol Ultrafast는 OpenAI 플래그십의 서빙 구성으로, 동일한 체크포인트, 동일한 추론 동작, 동일한 1,050,000토큰 컨텍스트 윈도우, 동일한 128K 최대 출력, 동일한 답변을 제공합니다. 가속은 스케줄링이 아닌 하드웨어에 기인합니다 — 모델의 가중치는 GPU 메모리와 연산 장치 사이를 오가는 대신 Cerebras 웨이퍼 스케일 실리콘의 온칩 SRAM에 위치합니다 — 그리고 이는 2026년 1월 OpenAI–Cerebras 컴퓨팅 파트너십의 첫 번째 제품으로, 3년간 약 100억 달러 규모로 보도되었습니다.

그러므로 정직한 비교의 축은 지능이 아니다. 그것은 공급업체가 무엇을 바꾸기로 선택했는지, 그 변경에 얼마를 청구했는지, 그리고 그 변경을 얼마나 검증할 수 있게 해 주었는지이다.

A screenshot of the Hugging Face model card for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the TextGeneration / Transformers / Safetensors / English / Chinese / mimo_v2 / multimodal / conversational / custom_code / 3-bit precision fp8 tags, a License: mit badge, 53 likes, and the card opening 'MiMo-V2.6-Pro-RL — Scaling Reinforcement Learning Toward Self-Improvement' with the Technical Report link and the introduction describing native omnimodal input and a 1M-token context window.

빈 카드를 포함한 요율 카드

• MiMo v2.6 Pro Ultraspeed — 백만 토큰당 입력 $4.35 / 출력 $8.70, Xiaomi 발표.

• MiMo-V2.6-Pro standard — $0.44 / $0.87, Xiaomi의 상용 카탈로그에 게시됨. 입력 기준 약 9.9배, 출력 기준 정확히 10배.

• GPT-5.6 Sol Ultrafast — 2026년 9월 27일 기준으로 공개된 요금표가 없습니다. OpenAI의 가격 페이지에는 여전히 Standard, Batch, Flex, Fast 네 개의 탭이 있으며, 이 등급은 그중에 포함되어 있지 않습니다.

• GPT-5.6 Sol 표준 — 백만 토큰당 $4.00 / $20.00, OpenAI의 현재 프로모션 요율이며, 캐시된 입력은 $0.40, 입력이 약 272K 토큰을 넘으면 장문 컨텍스트 단계에서 $8.00 / $30.00이 적용됩니다.

• OpenAI가 지금까지 책정한 이에 견줄 만한 유일한 프리미엄 — Fast 모드, $8.00 / $40.00, 표준 요금의 정확히 두 배로 최대 약 2.5배의 출력 속도.

그 마지막 행이 바로 그 빈칸이 중요한 이유의 전부다. Xiaomi의 속도 티어는 표준 레인보다 열 배 비용이 들고 열 배에서 스무 배의 속도를 주장하는데, 이는 적어도 거래로서 내적으로 일관된다: 비례적으로 더 지불하면 비례적으로 덜 기다리게 되며, 걸고 있는 것은 실제 경과 시간이 곧 상품이라는 점이다. OpenAI의 속도 티어는 Fast mode보다 더 희소한 실리콘에 대한 더 큰 요구다. 따라서 최종적으로 비용이 얼마가 되든, 선례는 할인이 아니라 프리미엄을 말한다. 하지만 "선례는 프리미엄을 말한다"는 숫자가 아니며, 그것이 존재하기 전까지 그 티어는 가격으로 UltraSpeed와 전혀 비교될 수 없다 — 오직 Xiaomi는 자기 숫자를 말하려 했고 OpenAI는 그렇지 않았다는 사실로만 비교될 수 있다.

숫자의 출처

두 계층은 상반된 증거상의 문제를 안고 있으며, 차이를 절충하기보다는 둘 모두를 짚어볼 가치가 있다.

Xiaomi의 속도 주장은 규모 면에서 모호하지만 공개된 가격에 고정되어 있다. 20×는 Xiaomi가 명시하지 않은 조건에서의 공급업체 상한이고, 10×는 카탈로그 목록이 일반적인 수치로 내세울 수 있었던 값이며, 실제 배수는 아무도 명시된 동시성 수준에서 공개적으로 측정하지 않은 넓은 범위 어딘가에 있다. 그에 반해 가격은 정확하고, 가중치는 MIT 라이선스로 다운로드할 수 있으며, 기술 보고서와 강화 학습 훈련 환경은 공개되어 있다. Xiaomi가 무엇을 했는지는 살펴볼 수 있지만, 그것이 얼마나 빠르게 실행되는지는 아직 검증할 수 없다.

OpenAI의 속도 주장은 규모 면에서는 구체적이지만, 구매할 수 있는 어떤 것에도 근거하지 않는다. 초당 최대 750 출력 토큰, 표준 대비 최대 14배라고 명확히 밝혀져 있다. 이는 또한 출력 토큰의 처리량 수치이지, 일률적인 엔드투엔드 배수가 아니다. 입력 처리와 모델 자체의 추론은 그 비율로 압축되지 않으며, 그래서 회사가 이를 최댓값이라고 표시한다. 이를 뒷받침하는 벤치마크는 공급업체가 보고한 것이며, 한 경우에는 공급업체 간 비교다. 2,500개 질문으로 구성된 Humanity's Last Exam 실행은 Claude Fable 5의 78시간 27분과 비교해 11시간 11분 만에 완료된 것으로 보고되었고, 정확도는 비슷했다. 이번 출시에 대한 독립 보도는 같은 실행에서 대략 11배라는 더 좁은 생성 속도 비교를 인용했으며, 반면 Cerebras 자체 수치는 총 테스트 시간 기준 약 7배를 시사한다. 세 당사자, 하나의 작업 부하에 대한 세 가지 비율, 그중 어느 것도 제3자 재현은 없다. Cerebras는 별도로 GDP-Val에서 측정 가능한 품질 손실 없이 엔드투엔드 5.6배를 보고했으며, 이 역시 재현되지 않았다.

두 수치 세트 모두 벤더가 밝힌 값이다. 차이는 샤오미의 모호함은 속도에 관한 것이고 OpenAI의 모호함은 비용에 관한 것이라는 점이며, 예산을 작성하는 사람이라면 누구에게나 비용이 추측하기 더 어려운 쪽이다.

A generated two-column scoreboard titled 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed — the scoreboard'. Left column 'GPT-5.6 Sol Ultrafast': Checkpoint same as Sol, Speed claim up to 14x, Output speed up to 750 tok/s, Price not published, Context 1.05M tokens, Access waitlisted preview. Right column 'MiMo v2.6 Pro Ultraspeed': Checkpoint same as Pro, Speed claim 10x to 20x, Output speed not published, Price $4.35 / $8.70, Context 1M tokens, Access purchasable today. Footer sourcing line noting neither speed claim is independently measured; OrcaRouter logo bottom-right.

이번 주에 무슨 일이 있었으며, 왜 그것이 격차를 좁히지 못하는가

이 비교에 뉴스 소재가 붙은 이유는 발표가 아니라 커밋 하나 때문이다. ultrafast 값은 2026년 8월 13일 — 해당 모드가 발표된 바로 그날 — 부터 OpenAI의 공개 openai-openapi 스키마에 있었고, 이를 gpt-5.6-sol로 한정하고 접근 제어된다고 설명하는 설명문을 함께 달고 있었다. 이번 주에 움직인 커밋은 그보다 나중이고 규모도 더 작다: 2026년 9월 25일, fe4f7a1이 ultrafast를 두 개의 추가 열거형, 즉 요청 수준의 서비스 등급 파라미터와 에이전트 서비스 등급 정책 필드에 추가했다. 그 커밋 이전에 이 두 목록은 auto, default, flex, priority, fast였다. 그 이후에는 "Uses the ultrafast service tier."라고 설명된 항목이 있다.ultrafast를 service_tier 열거형에 추가했다. 자사의 공개 openai-openapi 명세 — 스키마가 "모델 요청에 사용되는 서비스 등급"이라고 설명하는 필드이자, 에이전트에 연결된 정책 필드다. 그 변경 이전에 그 목록은 default, flex, priority, fast. 이후에는 "Uses the ultrafast service tier."라고 설명된 항목이 있다.

그 구분은 이 보도를 읽는 사람이라면 누구에게나 중요하다. 이것은 생성되는 티어가 아니라, 에이전트가 구성되는 필드에 연결되는 티어이며, 이는 결국 새로운 엔드포인트 없이도 그에 맞춰 클라이언트를 작성할 수 있다는 뜻이다. 다음 날 보도는 Responses API Playground에 제공될 Fast / Standard / Ultrafast 선택기를 설명하며, OpenAI의 DevDay 컨퍼런스 이후 더 폭넓은 접근이 예상된다고 전한다. 우리는 그 선택기를 보지 못했고 OpenAI도 롤아웃 노트를 공개하지 않았으므로, 그 부분은 단일 출처다. 확인 가능한 것은 추가된 스키마 항목들과 발표 후 6주가 지나도록 요금표가 계속 없다는 점이다.

한편 Xiaomi의 티어는 5일째 구매 가능하며, 두 제품 중 인보이스에 올릴 수 있는 유일한 제품입니다. 여기에는 다른 미해결 질문이 있습니다. 10배 프리미엄이 유지될지, 아니면 새로운 프리미엄 티어의 대부분 출시 가격처럼 출시 관련 커버리지가 끝나면 표준 라인으로 이동할지 여부입니다. Standard Pro의 $0.44 / $0.87이 기준점이며, 기준점의 10배로 시작하는 티어는 거의 그 가격에 머무르지 않습니다.

그것들 중에서 선택하는 것, 당신이 아마 그렇게 할 수 없을 것이라는 점을 고려하면

불편하지만 현실적인 사실은, 대부분의 독자에게 이는 살 수 없는 한 티어와 정가로는 사지 않는 게 좋을 한 티어 사이의 비교라는 점이다. GPT-5.6 Sol Ultrafast는 일부 선별 고객을 위한 대기자 명단 방식의 프리뷰로, 용량이 늘어나는 대로 확대되며 일반 출시일도 가격도 없다. MiMo v2.6 Pro Ultraspeed는 구매 가능하고 비싸며, 특정 유형의 구매자를 위해 만들어졌다.

워크로드 테스트는 두 모델 모두 동일하며, 이는 프롬프트의 크기가 아니라 요청 그래프의 형태에 관한 것입니다. 단일 장문 생성은 대표 배수보다 훨씬 적은 이득을 얻는데, 입력 처리와 추론이 같은 비율로 빨라지지는 않기 때문입니다. 사용자에게 보이는 하나의 동작 뒤에 있는 40단계 에이전트 루프는 전체 수치에 훨씬 가까운 이득을 얻는데, 모든 왕복이 사람이 앉아서 기다리는 지연이기 때문입니다. 트래픽이 두 번째 형태라면 두 티어 모두 당신을 겨냥한 것입니다. 첫 번째 형태라면 어느 모델이든 표준 레인이 항상 정답이었으며, $0.44 / $0.87의 표준 MiMo-V2.6-Pro 레인은 어디서든 1조 파라미터급 모델을 호출하는 가장 저렴한 방법 중 하나입니다.

어느 등급도 바꾸지 않는 사실은, 당신이 사는 것이 품질이 아니라 지연 시간이라는 점이다. 동일한 프롬프트에서 UltraSpeed나 Ultrafast를 자체 표준 레인과 비교해 벤치마크했는데 서로 다른 답변이 나온다면, 그것은 기능이 아니라 보고할 가치가 있는 발견이다 — 어느 벤더의 설명에도 가중치가 바뀌었다고 주장하지 않는다.

이것은 또한 라우터가 존재 가치를 입증하는 경우이기도 하며, 특히 당신이 이용할 수 없는 등급의 경우에는 더욱 그렇습니다. GPT-5.6 Sol은 OrcaRouter에 openai/gpt-5.6-sol라는 이름으로 제공되며, 공급자 자체 요율로 토큰 마크업 없이제공되는 OpenAI 호환 엔드포인트는 api.orcarouter.ai/v1이며, 당신이 폴백하게 될 표준 레인은 base URL 하나만 바꾸면 되고, 동일한 키가 200개 이상의 모델을 지원합니다. 이 점이 중요한 이유는, 오늘날 "Ultrafast를 써야 하나?"에 대한 정직한 답이 "쓸 수 없으니, 그동안 무엇이 대화형 트래픽을 담당할지 정하라"이기 때문입니다 — 그리고 대기 명단 없이 지연 시간을 확보하는 방법은 대화형 호출은 카탈로그에서 품질 기준을 통과하면서 실제 소요 시간이 가장 짧은 모델로 라우팅하고, 야간 작업은 기준을 통과하는 가장 저렴한 레인에 남겨 두는 것입니다. 그 등급이 열리면, 그때 전환할 스위치가 바로 이것입니다. 우리가 호스팅하지 않는 것을 분명히 밝혀 둡니다: OrcaRouter에는 Xiaomi 모델이 없으므로, MiMo v2.6 Pro Ultraspeed는 Xiaomi 자체 API와 여러 서드파티 플랫폼에서 제공되며, 이 페이지는 그것으로 가는 경로가 아닙니다.

A screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, labelled 'Openweights model, Released September 2026', showing the Intelligence, Performance & Price Analysis headings with an Intelligence Index figure, a Speed figure, a Cost figure of In $0.435 / Out $0.87 with a 99% cache discount, a $0.13 blended figure, a Verbosity rank of 20/115, and a Comparison Summary describing the model as among the leading open-weight models in intelligence and notably fast but somewhat verbose, with text, image, speech and video input and a 1M-token context window.

무엇이 그것을 해결할까요?

세 가지 측정값, 그중 아직 존재하는 것은 하나도 없습니다. 공개된 Ultrafast 요금표가 있다면 이 비교는 구멍 난 비교가 아니라 마땅히 되어야 할 비교가 될 것입니다. 명시된 동시성 수준에서의 독립적인 지연 시간 분포는 Xiaomi의 실제 배수가 10×에 더 가까운지 20×에 더 가까운지, 그리고 단일 스트림 시연이 아니라 부하 상태에서도 그것이 유지되는지를 알려줄 것입니다. 그리고 두 공급업체 중 어느 한쪽의 벤치마크 제품군을 독립적으로 재현한다면 두 수치 집합 모두 주장 칼럼에서 벗어나게 될 것입니다.

그때까지 방어 가능한 해석은 좁다. Xiaomi는 가격은 있지만 속도는 모호한 속도 티어를 출시했고, OpenAI는 구체적인 속도는 있지만 가격은 없는 속도 티어를 출시했다. 둘 다 각자가 가격을 매긴 대상과 동일한 모델이며, 어느 쪽도 독립적으로 측정된 적이 없다. 지금 지연 시간이 필요하고 워크로드가 대화형이라면, UltraSpeed는 실재하고 구매 가능하며, 원하는 바로 그 구매자를 정확히 겨냥해 가격이 책정되어 있다. 지금 필요하지만 워크로드가 대화형이 아니라면, 두 모델의 표준 레인은 더 저렴하고 검증되어 있으며 오늘 이용 가능하다 — 그리고 모두가 논쟁하고 있는 그 티어는 누군가 수치를 발표할 때도 여전히 남아 있을 것이다.