"Boreal vs Kimi K3"라는 제목과 "둘 다 당신의 하드웨어에서 실행되지 않습니다"라는 부제가 있는 생성된 타이틀 카드, 비디오 재생 프레임, 서버 블레이드 스택, 자물쇠의 플랫 라인 아이콘, 그리고 오른쪽 하단에 합성된 OrcaRouter 로고.
Guides & Insights

Boreal vs Kimi K3: 둘 다 당신의 하드웨어에서는 실행되지 않습니다

작성자

Magnus Corvin

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

96개의 Safetensors 샤드. 이것이 Kimi K3를 다운로드하면 얻게 되는 것입니다 — 토큰당 1,040억 개 매개변수가 활성화되는 2조 8,000억 매개변수 규모의 전문가 혼합(MoE) 모델로, 2026년 7월 27일 수정된 MIT 라이선스로 공개되었으며, Moonshot AI가 출시한 지 11일 후였습니다. Moonshot 자체의 서빙 지침에서는 최소 64개 가속기로 구성된 슈퍼노드 구성을 권장합니다. Boreal은 전혀 다운로드할 수 없습니다: 2026년 9월 15일 출시된 Creatify의 광고 영상 모델은 비공개이며 셀프서비스 방식이고, 완성된 720p급 영상 1초당 1센트로 가격이 책정되어 있습니다. 이 중 하나는 가중치와 하드웨어 비용 청구서를 여러분에게 쥐여줍니다. 다른 하나는 가중치를 보유한 채 초 단위로 요금을 부과합니다. 어느 쪽도 여러분의 하드웨어에서 실행되지 않으며, 그 이유는 정반대입니다 — 바로 이것이 이 비교를 할 가치가 있는 이유입니다.

"오픈 웨이트"가 실제로 당신에게 제공하는 것

오픈 웨이트라는 라벨은 이 비교에서 실질적인 역할을 하지만, 들리는 것보다 그 역할은 작다.

Kimi K3에서 진정으로 얻는 것은 지속성입니다. 가중치는 파일로 존재합니다. Moonshot AI가 가격을 바꾸거나, 해당 모델의 우선순위를 낮추거나, 사라지더라도 체크포인트는 여전히 남아 있을 것입니다. 그리고 이를 지원하는 서빙 스택도 마찬가지로 남아 있을 것입니다. vLLM, SGLang, TokenSpeed가 모두 지원 경로에 포함되어 있습니다. 이는 마케팅 주장이 아니라 아티팩트의 속성입니다. 공급업체 집중을 위험 등록부에 포함하는 조직에게 이는 이번 릴리스에서 가장 가치 있는 단 하나의 요소입니다.

당신이 얻지 못하는 것은 당신이 실행할 수 있는 배포입니다. 전문가 896개를 갖춘 2.8조 파라미터 희소 모델은 양자화하고 바로 돌리면 되는 일이 아닙니다. 64개 이상의 가속기를 권장한다는 공식 권고는 의지가 강한 팀이 크게 밑돌 수 있는 보수적인 기준이 아니라, 이 모델이 애초에 설계된 기계 등급을 설명하는 것입니다. Kimi K3를 프로덕션 규모에 가깝게라도 운영하는 팀은 사실상 슈퍼노드를 운영하는 누군가에게서 이를 임대하는 셈입니다. 이는 가중치가 공개되었다고 해서 실질적인 가용성 문제가 달라지지 않는다는 뜻입니다. 여전히 제3자에게서 추론을 사야 하고, 달라진 것은 라이선스뿐입니다.

주의 깊게 읽을 가치가 있는 라이선스 세부 사항이 하나 있습니다. 대부분의 요약이 건너뛰는 부분이기 때문입니다. 수정된 MIT 조건은 월간 활성 사용자 수 1억 명 또는 월 매출 2,000만 달러를 초과하는 경우 브랜딩 및 출처 표시 의무를 조건으로 걸며, 라이선시 및 계열사 매출이 연속된 12개월 동안 2,000만 달러를 초과하는 모델 서비스(MaaS) 사업자에게는 Moonshot과 별도 계약을 체결하도록 요구합니다. 내부 사용과 파인튜닝은 폭넓게 허용됩니다. 재판매에는 제한이 있습니다. 이는 프런티어 모델에 대해 합리적인 라이선스이며, MIT와는 실질적으로 다른 것입니다. 그 위에 제품을 구축할 계획인 스타트업에게 그 기준은 현재 누리는 권리가 아니라 미래에 협상할 사안입니다.

Boreal이 대신 보내주는 것

Boreal은 정반대의 거래를 하며, 그것은 보기보다 더 의도적이다.

Creatify는 자사가 가중치를 소유하고 직접 서빙한다고 밝히며, 자사가 추가 학습을 진행하는 출발점이 된 기본 모델은 오디오와 비디오를 함께 생성하는 오픈소스 모델이라고 말한다. 이 두 사실이 합쳐져 제품 전략의 전부다. 오픈소스 계보는 대략 어떤 부류의 모델이 호출되는지, 그리고 오디오가 나중에 덧붙여진 것이 아니라는 점을 알려준다. 소유권은 다른 누구도 이를 서빙할 수 없다는 것을 알려주며, 바로 그 점이 초당 가격을 애초에 가능하게 만든다.

얻는 것은 지속성이 아니라 처리량이다. Creatify는 렌더링 속도를 실시간 대비 대략 1:1로 제시한다. 즉, 완성된 영상 1초당 실제 시간 1초가 걸린다는 뜻이다. 그것은 모델 품질의 결과라기보다 추론 엔지니어링의 결과이며, 내일 가중치가 공개되더라도 살아남을 것은 바로 그것이다. 다음 주에 체크포인트가 Hugging Face에 나타난다 해도, 5초짜리 클립을 약 5초에 5센트로 렌더링하는 능력은 여전히 서빙 스택을 구축한 사람의 것이 될 것이다 — 그리고 64개 이상의 가속기에 해당하는 처리량이 이미 조정된 참조 구현은 여전히 Creatify의 것이 될 것이다.

그래서 정직한 대칭은 이렇습니다: Kimi K3는 당신이 서빙할 여력이 없는 체크포인트를 주고, Boreal은 당신이 벤더로부터 가져올 수 없는 서비스를 줍니다. 둘 다 셀프 호스팅이 불가능합니다. 그중 하나만이 벤더 리스크에 대한 헤지이며, 그것은 헤지 비용이 헤지 대상보다 더 많이 드는 쪽입니다.

A generated two-column scoreboard for Boreal vs Kimi K3 sharing six dimension labels. Boreal reads output rendered video, weights closed and vendor-served, self-hosting not possible, meter $0.01 per second, context not published, independent score none yet. Kimi K3 reads output text only, weights open with 96 shards, self-hosting 64+ accelerators, meter $3 / $15 per 1M, context 1M at a flat rate, independent score 1679 Elo front-end. Footer reads "Boreal figures vendor-run and unreproduced; Kimi K3 per our catalogue and third-party evaluators."

스펙 대비

• 출력 — Boreal: 렌더링된 영상, 720p급, 텍스트-투-비디오 및 이미지-투-비디오. Kimi K3: 텍스트 전용.

• 가중치 — Boreal: 독점적이며 Creatify가 소유하고 제공합니다. Kimi K3: 2026년 7월 27일 공개, 96개의 Safetensors 샤드, 수익 조건부 재판매 조항이 포함된 수정 MIT.

• 자체 호스팅 — Boreal: 불가능. Kimi K3: 원칙적으로 가능하며, Moonshot은 최소 64개의 가속기를 권장합니다.

• 가격 — Boreal: 완성된 동영상 1초당 $0.01. Kimi K3: 1M 입력당 $3.00 / 1M 출력당 $15.00, 캐시된 읽기는 1M당 $0.30이며 전체 컨텍스트 창에 걸쳐 정액 요금입니다.

• 컨텍스트 — Boreal: 미공개. Kimi K3: 1,048,576 토큰, 롱 컨텍스트 추가 요금 없음.

• 레이턴시 — Boreal: 실시간과 1:1로 제시됨. Kimi K3: 당사 보드에서 첫 토큰까지 걸리는 p50 시간이 10.00초 — 이는 계측기가 보고하는 상한치이므로, 정밀한 측정치라기보다 "느림"으로 읽어야 합니다.

• 근거 — Boreal: 벤더가 직접 실행한 것만. Kimi K3: 벤더가 제시한 항목에는 GPQA Diamond에서 93.5, Terminal-Bench 2.1에서 88.3, Frontend Code Arena에서 1679 Elo로 1위, 그리고 숨겨진 불변식이 있는 문제에서 36% 실패율을 포함한 독립적 조사 결과가 포함됩니다.

당신이 끌 수 없는 흔적

Kimi K3에는 추론 모델들 사이에서도 이례적인 과금 특성이 있는데, 이는 이번 비교에서 가장 구체적인 비용 차이입니다.

사고 모드는 비활성화할 수 없으며, 기본 추론 강도는 최대로 설정되어 있습니다. 모든 요청은 전체 추론 추적을 생성하고, 그 추적의 모든 토큰은 백만 출력당 $15.00로 청구됩니다. 답이 단어 하나뿐인 작업에서도 여전히 숙고 비용을 지불하게 됩니다. 백만당 $0.30의 캐시 읽기는 입력 측 비용을 상당히 완화해 주고, 전체 1M 컨텍스트에 걸친 균일 요금제는 경쟁사들이 사용하는 계층형 구조보다 확실히 더 친화적입니다 — 하지만 출력 측에는 저렴한 모드가 없습니다.

Boreal의 비용에는 잘못될 수 있는 이에 상응하는 레버가 없다. 5초짜리 클립은 모델이 열심히 작업했든 별것 아니게 작업했든 5센트다. 왜냐하면 아티팩트가 단위이고 아티팩트는 고정되어 있기 때문이다. 그게 명백히 더 나은 것은 아니다 — 그것은 그저 모델이 내부에서 무엇을 하든 영향을 받지 않을 뿐이다.

Kimi K3는 저희 카탈로그에 있으며, 우리 보드에서 압도적으로 가장 바쁜 모델입니다. 지난 7일 동안 3,150.6백만 토큰으로, Grok 4.6 트래픽의 17배 이상, GPT-5.6 Sol의 13배입니다. 이 정도 볼륨이야말로 오픈 웨이트 프런티어 모델이 프로덕션에서 보이는 모습입니다. 호출자가 많고, 가격에 민감하며, 가장 서비스가 나쁜 제공자를 우회할 의향이 있으니까요. 이 모델은 카탈로그의 나머지와 동일한 키 뒤에서 제공자 목록 요율, 0% 마크업으로 제공되며, 이는 폐쇄형 모델보다 오픈 웨이트 모델에서 더 중요합니다. 체크포인트가 공개되면 가격은 그것을 서비스하는 제공자가 정하게 되므로, 가격이 경쟁 변수가 되고 움직이기 때문입니다.

Boreal은 우리 카탈로그에 없습니다. OrcaRouter는 비디오 생성 모델을 제공하지 않으며, 광고 파이프라인의 텍스트 계층 — 즉 브리프, 훅 변형, 컴플라이언스 검토 — 이 바로 그것에 비추어 우리가 자리하는 지점입니다.

A screenshot of Creatify's own launch post for Boreal, dated September 15 2026 and headed "Introducing Boreal: frontier-quality AI video at a cent a second", showing the Boreal by Creatify Labs logo card and the opening paragraph stating that Boreal generates text-to-video and image-to-video at one cent per second, about $0.05 for a five-second clip, and renders in realtime.

어느 것, 그리고 무엇을 봐야 하는지

당신의 제약이 벤더 집중이고 제대로 된 컴퓨팅 자원에 접근할 수 있다면, 이 둘 중 실질적인 해답을 내놓는 것은 Kimi K3뿐이며, 숨겨진 불변량 문제에서의 36% 실패율이 바로 그 이점과 견줘 저울질해야 할 수치다. 이는 진정한 탈출구가 딸린 최전선급 모델이고, 그 탈출구는 대부분의 팀이 결코 사용하지 않을 만큼 비용이 많이 든다.

완성된 광고 소재당 비용이 제약 조건이라면, Boreal은 더 저렴하고 훨씬 예측 가능한 선택이며, 그 제약은 한 가지 특정 포맷의 품질입니다: 1인 토킹 클립은 공급업체 자체의 40개 사례 테스트에서 60%를 기록한 반면, 제품 및 크리에이터 장면에서는 83%와 85%를 기록했습니다. 캠페인에 그 포맷을 확정하기 전에 테스트해 보세요.

증거와 관련해 한 가지 유의할 점이 있는데, 이는 두 사례 모두에 적용됩니다. Kimi K3의 공개된 지능 수치는 적어도 한 번 이상 재조정되었으며, 57~60 범위의 오래된 수치는 동일 평가자의 현재 수치와 나란히 인용해서는 안 됩니다 — 이는 벤치마크 점수가 모델의 속성이 아니라 특정 시점의 관측치라는 점을 일깨워 줍니다. 그리고 Boreal에 붙은 모든 품질 수치는 Creatify 자체의 출시 게시물에서 나온 것입니다. Boreal에 대한 첫 독립 평가는 언제 나오든, 현재 그것에 관해 공개된 모든 것보다 더 가치 있을 것입니다.

A screenshot of the OrcaRouter model page for kimi/kimi-k3, showing Kimi K3 by MoonshotAI dated 2026-07-15 marked Featured, a 1M-token context, text + image input with text output, a p50 time to first token of 10.00 seconds, input $3.00 and output $15.00 per 1M tokens, and 3150.6M tokens of traffic in the last 7 days.