'Step 5 Preview vs GLM-5.5 — 하나는 출시되고, 하나는 그렇지 않습니다'라는 제목의 타이틀 카드를 생성했습니다. 두 개의 열로 구성됩니다. Step 5 Preview: AA Index 44, 총 600B / 활성 27B, 가격 $1.00 / $2.70, 출력 99.8 tokens/sec, 9월 20일부터 라이브 API. GLM-5.5: 모델 카드 없음, API 식별자 없음, 가격 없음, 확인된 이름 없음이라는 행들. 하단 문구는 'Step 5 Preview 수치는 Artificial Analysis 기준이며, GLM-5.5는 미발표·미출시 모델입니다.'입니다.
Guides & Insights

Step 5 Preview vs GLM-5.5: 한 모델은 오늘 출시되고, 다른 하나는 아직 예측에 불과하다

작성자

Gideon Frost

게시일

최신 모델 · 20모든 모델 보기
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Step 5 Preview는 2026년 9월 20일에 API를 공개했습니다. StepFun이 이를 발표한 바로 그날이며, 오늘 오후에는 단일 엔드포인트에서 백만 입력 토큰당 $1.00, 백만 출력 토큰당 $2.70에 호출할 수 있습니다. GLM-5.5는 존재하지 않습니다. 모델 카드도, API 식별자도, 가격도, 체크포인트도, 라이선스 파일도 없고, 그 이름을 사용하는 Z.ai 페이지도 어디에도 없습니다. GLM-5.5는 회사가 한 번도 채택한 적 없는 커뮤니티 약칭이기 때문입니다. 그 비대칭성이 바로 이 글의 주제입니다. 다음 내용은 StepFun이 실제로 출시한 것, Z.ai의 차기 플래그십에 대해 확실히 밝혀진 것, 그리고 제목에 있는 비교 대신 오늘 바로 돌려볼 수 있는 정면 비교입니다.

GLM-5.5가 무엇인지, 그리고 무엇이 아닌지

그 이름은 2026년 중반에 하나의 출시 시점과 함께 회자되기 시작했으며, 그 시점에는 추적 가능한 근원이 있다. 2026년 6월 25일에 전해진 애널리스트 예측이 Z.ai의 차기 플래그십을 8월로 잡았던 것이다. 그것은 지켜보는 기간이었을 뿐, 공급사의 확약이 아니었고, 8월은 그것 없이 끝났다. 대신 Z.ai가 내놓은 것은 GLM-5.3으로, 8월 14일에 발표되었고 API는 8월 18일경 공개되었으며 오픈 웨이트는 8월 28일에 공개되었고, 뒤이어 8월 26일에 GLM-5.3-Flash가 나왔다. 공급사 자체의 Hugging Face 조직에는 GLM-5.5 체크포인트가 전혀 나타나지 않았으며, 그곳의 가장 최신 리포지토리들도 여전히 GLM-5.3 시리즈가 최고다.

명칭도 아직 정리되지 않았다. GLM-5.3, GLM-5.4, GLM-5.5, GLM-6이 모두 같은 시기에 거론되었고, Z.ai는 그중 어느 것도 확인해주지 않았다. 회사 측의 유일한 신호는 공동 창업자가 ‘epic plus’ 공개에 대해 언급한 것뿐인데, 이는 사양이라기보다 분위기에 가깝다. 업체의 주기 — 대략 54~70일마다 플래그십 하나 — 를 읽는 분석가들은 이제 다음 모델이 2026년 10월 8일부터 11월 9일까지의 출시 구간에 들어올 것으로 예상하며, GLM-5.5가 아니라 GLM-5.4로 번호가 붙을 것으로 본다.

세 가지 주장이 확정된 것처럼 돌고 있는데, 세 가지 모두에 대해 정확히 짚고 넘어갈 가치가 있다. 파라미터 수 주장이 가장 취약하다: "1조 개 이상"이라는 수치를 뒷받침하는 공식 자료는 없고, 이후 이를 3조 개 넘게 부풀린 소셜 게시물들은 아무런 출처도 제시하지 않는다. 100만 토큰 컨텍스트가 가장 안전한 가정인데, GLM-5.2와 GLM-5.3 모두 이를 갖추고 있기 때문이다. 오픈 웨이트는 약속이라기보다 기대에 가깝다 — Z.ai는 최근 여러 플래그십의 웨이트를 공개해 왔는데, 이는 패턴일 뿐 약속은 아니다.

Step 5 Preview가 실제로 제공하는 것

StepFun의 모델은 이 비교의 구체적인 한 축이며, 그 사양은 이례적입니다. 이는 총 600B 매개변수를 가진 희소 전문가 혼합(mixture-of-experts) 모델로, 토큰당 약 27B가 활성화됩니다. 즉 활성화 비율이 약 4.5%에 달하며, 희소 그룹 쿼리 어텐션(sparse grouped-query attention)과 블록 단위 토큰 병합(block-wise token merging)을 사용하는 92층의 좁고 깊은 트랜스포머 위에 구축되었습니다. 컨텍스트 창은 1M 토큰이고, 입력은 텍스트와 이미지, 출력은 텍스트이며, 확장 사고(extended thinking)로 추론합니다. StepFun은 여기에 도달하기 위해 Step 4.x 계열 전체를 건너뛰고, Step-3.7-Flash에서 곧바로 Step 5로 갔습니다.

• 인텔리전스 지수 — Artificial Analysis에서 44점, 평가된 200개 모델 중 24위, 중앙값 24 대비

• 출력 속도 — 초당 99.8토큰, 200개 중 45위

• 첫 토큰까지 걸리는 시간 — 동일한 독립 실행에서 2.96초

• 가격 — 100만 입력 토큰당 $1.00, 100만 출력 토큰당 $2.70, 95% 캐시 할인 적용

• Intelligence Index 작업당 비용 — $0.71, 200개 중 27위

• 가중치 — 오늘은 없음; BF16 체크포인트는 2026년 10월 15일에 예정되어 있습니다

• 라이선스 — 공개된 바 없음. 이 모델은 독점 모델이며, 상업적 사용 허가, 재배포 권리 또는 파인튜닝 허가가 명시되어 있지 않습니다.

가격은 눈에 띄는 항목이고, StepFun에게 처음 보이는 것보다 덜 유리하게 작용하는 항목도 마찬가지입니다: Intelligence Index에서 출력 토큰 160M으로 중앙값 92M에 비해, 그 지표에서 200개 중 64위입니다. 이 모델은 장황하고, 장황함은 바로 이 모델이 판매되는 에이전트형 워크로드에서 비용을 증폭시키는 요인입니다. $0.71의 작업당 비용 수치는 이미 이를 반영하고 있으며, 그래서 정가보다 이 수치를 인용하는 것이 더 정직한 숫자입니다.

StepFun의 자체 평가는 재현되지 않았으므로, 누군가 독립적으로 실행하기 전까지는 벤더 자료로 읽어야 한다. 이들은 해당 모델을 ALE-CLI에서 29.5, FrontierFinance에서 66.4, DRACO에서 83.3, ProgramBench에서 80.5, DeepSWE v1.1에서 67.7, StepCodeBench에서 49.0으로 평가했으며, Terminal-Bench 4.0에서는 33.3%, GDPval-AA v2에서는 1571을 기록했다. StepFun은 또한 24시간 GPU 커널 최적화 작업에서 508 TFLOPS MLA 피크를 보고했는데, 이는 Claude Opus 5의 493과 대비된다. 이것들은 StepFun이 공개하지 않은 모델에 관한 StepFun의 수치다.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator with a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second at rank 45 of 200, cost per Intelligence Index task $0.71 at rank 27 of 200, verbosity 160M output tokens against a 92M median, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning support, text and image input, and a 1M-token context window.

이것 대신에 진행할 수 있는 맞대결

제목이 약속하는 비교를 원한다면, 정직한 대안은 GLM-5.3에 맞선 Step 5 Preview입니다 — Z.ai가 실제로 출시한 모델이자 여전히 현재의 오픈 플래그십이며, GLM-5.5가 등장한다면 대체하게 될 바로 그 모델입니다. 독립 리더보드에서는 두 모델이 1점 차이입니다. 그 외 거의 모든 면에서는 그렇지 않습니다.

• 지능 지수 — Step 5 Preview 44 vs GLM-5.3 45

• 파라미터 — 전체 600B / 활성 27B vs 전체 753B / 활성 40B

• 출력 속도 — 99.8 토큰/초 vs 72.1 토큰/초

• 첫 토큰까지 걸리는 시간 — 2.96초 vs 2.99초

• 100만 토큰당 가격 — 입력 $1.00 / 출력 $2.70 vs 입력 $1.40 / 출력 $4.40

• 캐시 할인 — 95% vs 81%

• Intelligence Index 작업당 비용 — $0.71 vs $2.01

• 입력 모달리티 — 텍스트와 이미지 vs 텍스트만

• 라이선스 — 공개된 것 없음 대 MIT가 아닌 맞춤형 Z.ai 라이선스

이번 양상은 Step 5 Preview 출시 당시 점수가 매겨진 모든 상용 모델을 상대로 확립한 것과 같습니다. 결정적인 효율 우위와 능력 면에서의 통계적 동률입니다. 토큰을 약 38% 더 빠르게 생성하고, 양방향 모두 백만 토큰당 비용이 대략 절반이며, GLM-5.3 대비 인덱스 작업당 2.8배 더 저렴합니다 — 다만 점수는 1점 더 낮습니다. 리더보드에서 그 44점은 Kimi K3와도 동일한 위치에 놓이게 하는데, 이는 둘 중 어느 하나를 선두 주자로 대하기 전에 알아 둘 가치가 있습니다.

Step 5 Preview가 명백히 뒤처지는 단 하나의 항목은 벤치마크할 수 없는 항목이다. GLM-5.3에는 라이선스 파일과 다운로드 가능한 가중치가 있고, Step 5 Preview에는 단 하나의 .gitattributes만 들어 있는 Hugging Face 저장소와 BF16 체크포인트에 대해 명시된 10월 15일 날짜가 있다. Z.ai의 차기 플래그십이 올해 내내 사용해 온 동일한 맞춤 약관 아래 오픈 가중치로 등장한다면, 그것은 Step 5 Preview가 현재 답이 없는 유일한 범주에 들어간다 — 이것이 GLM-5.5 비교를 실행하기보다 기다릴 가치가 있는 진짜 이유다.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GLM-5.5 — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71, and API live since September 20. The right column gives GLM-5.5 the rows AA Index no model to score, parameters more than 1T rumored and unconfirmed, price none, cache discount none, cost per index task none, and availability not released. A footer reads 'Step 5 Preview figures per Artificial Analysis Intelligence Index; GLM-5.5 is an unannounced, unreleased model with no vendor or independent figures.'

GLM-5.5를 기다리는 것이 비용이 많이 드는 선택인 이유

두 달 동안 ‘두 달 뒤’에 머물러 있는 모델의 실질적인 문제는, 당신의 평가 작업이 그 모델과 함께 기다려 줄 수 없다는 점이다. GLM-5.5에는 엔드포인트가 없어서 벤치마크하거나, 가격을 비교하거나, 부하 테스트를 하거나, 폴백 규칙 뒤에 둘 수 없다. 그 모델을 중심으로 계획을 세우며 보내는 매주는 예측을 믿고 결정을 미루는 한 주이며, 그 예측이 가리킨 시점은 이미 한 번 지나갔다.

이와 대조적으로 GLM-5.3은 OrcaRouter에서 서비스 중이며이라는 이름 아래에,z-ai/glm-5.3 입력 $1.26, 출력 $3.96이며, 자체 페이지에 있는 Z.ai의 $1.40 및 $4.40 목록가와 대비됩니다. 이는 제로 마크업으로 그대로 전달되므로, 보이는 숫자는 저희가 설정한 요율이 아니라 공급자의 현재 요율이며, 공급업체 가격 변경은 다음 청구 주기가 아니라 같은 날 저희 쪽에 반영됩니다.

Step 5 Preview는 우리 카탈로그에 없고, 우리가 라우팅하지도 않습니다. 이 모델은 StepFun 자체 API와 Studio에서 실행되며, 10월 15일 체크포인트가 도착하기 전까지는 그곳이 유일한 실행 환경입니다. 그동안 OrcaRouter가 제공하는 것은 그 비교의 반대편에 있는 모든 것입니다200개 이상의 모델을 하나의 API 뒤에 두고: 위와 같은 요금의 GLM-5.3, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 등이 있으며, 프리뷰의 용량 곡선이 아직 알려지지 않은 상황에서도 프로바이더 전반에 걸친 자동 페일오버가 프로덕션 경로를 안정적으로 유지하고, 라우팅 DSL이 여러 모델을 두 번째 통합 없이 단일 호출로 구성합니다. 동일한 키로 프리뷰를 프로덕션 모델과 벤치마크해 보세요; 프로덕션 경로는 그대로 두면 됩니다.

Screenshot of the OrcaRouter model page for GLM-5.3 at www.orcarouter.ai/models/z-ai/glm-5.3, showing the model id z-ai/glm-5.3, a 1M-token context and 131.1K max output, input pricing of $1.26 and output pricing of $3.96 per million tokens against the crossed-out list rates of $1.40 and $4.40, a seven-day median time to first token of 3.68 seconds and a 95th percentile of 10.00 seconds, seven-day traffic of 2296.2M tokens, and the endpoints and SDK snippets behind the OrcaRouter API.

답을 바꾸는 것은 무엇인가?

이 문제를 결정하는 것은 두 날짜입니다. 10월 15일은 StepFun이 Step 5 Preview의 BF16 체크포인트가 공개된다고 밝힌 날이고, 그와 함께 제공되는 라이선스는 이 비교에서 가장 중대한 단일 미지수입니다. 허용적 라이선스라면 작업당 비용에서 2.8배의 우위를 빌리는 것이 아니라 소유하는 것이 되게 하고, GLM-5.3이 분명히 앞서 있는 유일한 축을 지워버릴 것입니다. 제한적 라이선스라면 GLM-5.3만이 이 둘 중 제품을 만들 수 있는 유일한 모델로 남고, 어차피 서로 다르게 사용하게 될 두 모델에 관한 사소한 이야깃거리로 1점 격차를 바꿔놓습니다.

두 번째는 Z.ai의 차기 플래그십을 두고 10월 8일부터 11월 9일까지 이어지는 분석가 관측 기간으로, 이것이 GLM-5.5라고 불릴지, 그리고 그 소문과 비슷할지는 알 수 없다. 그것이 정말로 등장한다면, 라이선스와 체크포인트를 갖춘 모델로 등장할 것이며 — 이는 Step 5 Preview에 빠져 있는 두 가지다 — 그때 비교는 진짜 비교가 된다.

둘 다 해결되기 전까지는, 유용한 질문은 둘 중 어느 쪽이 더 나은가가 아니다. 둘 중 하나는 실행할 수 없기 때문이다. 그보다는 지금 존재하는 모델 중 어느 것을 기반으로 구축해야 하는가, 그리고 다음 체크포인트가 나타날 때 그 답이 바뀌는가이다. 그 질문에는 이번 주에 검증 가능한 답이 있으며, 이름이 모델이 되기를 기다릴 필요도 없다.

이 글에서 비교한 모델3

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트