
Qwen 4 Max vs GLM-5.3: 오픈 웨이트, 맞춤형 라이선스, 그리고 실제로 출시되는 티어
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0345지능76코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen 4 Max는 2026년 9월 22일 항저우에서 열린 Yunqi 컨퍼런스에서 Qwen 4 Flash, Qwen 4 Plus, 오픈 웨이트 Qwen 4 27B 등급을 함께 포함하는 4개 모델 라인의 플래그십으로 프리뷰 공개되었다. Z.ai의 GLM-5.3은 2026년 8월 18일부터 텍스트 전용으로 등록되어 있으며, 100만 토큰 컨텍스트 윈도와 128,000 토큰 출력 상한을 갖추고, 우리 카탈로그 기준으로 백만 입력 토큰당 $1.26, 백만 출력 토큰당 $3.96에 제공되는데, 이는 Z.ai가 공표한 정가 $1.40 및 $4.40과 대비된다. 두 연구소 모두 오픈 웨이트 전통에서 나왔고, 이제 둘 다 호스팅 API를 통해 프런티어 등급 모델을 판매하므로, 일반적인 폐쇄형 대 오픈형 구도는 여기에 적용되지 않는다. 실제로 적용되는 축은 아무도 비교표에 넣지 않는 축이다: 라이선스가 실제로 허용하는 것, 그리고 각 패밀리에서 어느 등급이 있어야 흥미로운 일을 마음껏 할 수 있도록 허용되는 등급인지.
두 연구소, 같은 질문에 대한 두 가지 답
Alibaba와 Z.ai는 프런티어에 인접한 연구소들 중에서 가장 일관되게 오픈 웨이트를 공개해 온 두 곳이며, 그 개방성이 플래그십 등급까지 얼마나 유지되는지에 관해서는 서로 다른 태도를 취하게 되었다.
알리바바의 Qwen 3.8 세대는 자사의 가장 큰 모델인 Qwen3.8-2.4T-A95B의 가중치를 BF16과 FP8로 2026년 8월 12일에 공개했다. 이는 Apache 2.0이 아니라 알리바바가 자체 제정한 Qwen 라이선스로 공개되었다. 바로 그 차이가 핵심이다. 가중치가 존재한다는 것은 폐쇄형 모델에서는 결코 불가능한 방식으로 파인튜닝, 양자화, 자체 호스팅이 가능하다는 뜻이지만, 조건은 알리바바 자체의 것이며 "오픈 웨이트"라는 표현이 흔히 암시하는 관대한 기본값은 아니다.
Z.ai의 GLM 라인은 오픈 웨이트 계보를 가진 연구소에서 나왔으며, 이제 플래그십도 그 예외가 아니다. GLM-5.3의 자체 가중치는 2026년 8월 28일에 공개되었다 — 7,430억 매개변수 플래그십이 141개의 safetensors 샤드로 — MIT가 아니라 Z.ai가 이를 위해 작성한 맞춤 라이선스에 따라서다. 그 조건은 대략 MIT 라이선스 부여에, 대규모 매출 임계값을 넘는 모델-서비스(MaaS) 사업자를 위한 보안 검토 조건이 붙은 형태다. 이것이 제품군에 무엇을 의미하는지 주목하라: GLM-5.2와 GLM-5.3-Flash는 MIT를 적용하지만, 플래그십은 그렇지 않다.
나열된 바와 같이, GLM-5.3은 공개된 컨텍스트 윈도우와 공개된 출력 상한, 그리고 문서화된 도구 사용, JSON 모드 및 추론 기능을 갖춘 텍스트 전용 모델입니다.
둘을 나란히 놓고 보면 실질적인 대비는 이렇습니다:
• 플래그십 가중치 — 커스텀 Qwen 라이선스로 공개된 Qwen 3.8 플래그십 대 2026년 8월 28일 커스텀 Z.ai 라이선스로 공개된 GLM-5.3 가중치
• 입력 가격 — Qwen3.8-Max는 100만 토큰당 $2.00인 반면, GLM-5.3은 당사 카탈로그에서 100만 토큰당 $1.26, Z.ai 자체 목록에서는 $1.40
• 출력 가격 — Qwen3.8-Max는 100만 토큰당 $6.00, GLM-5.3은 저희 카탈로그 기준 100만 토큰당 $3.96, Z.ai 자체 목록에서는 $4.40
• 컨텍스트 — Qwen3.8-Max 1M 토큰 대 GLM-5.3 1M 토큰
• 출력 상한 — Qwen3.8-Max 128K 토큰 대 GLM-5.3 128K 토큰
• 모달리티 — Qwen3.8-Max는 텍스트, 이미지, 동영상 입력을 지원하는 반면 GLM-5.3은 텍스트 전용이며, 이는 문서에 그대로 명시되어 있음
• 기능 태그 — Qwen3.8-Max 비전, 도구, JSON 및 추론 대 GLM-5.3 도구, JSON 및 추론
• Qwen 4 Max — 2026년 9월 22일 발표, 가격 없음, 컨텍스트 없음, 가중치 없음, 날짜 없음 vs GLM-5.3은 출시되어 트래픽을 서비스 중
가격 격차를 지불하는 쪽은 멀티모달 행이다. Qwen의 플래그십은 이미지와 비디오 입력을 받으며 입력 $2.00, 출력 $6.00을 청구하고, GLM-5.3은 텍스트를 받으며 $1.26과 $3.96을 청구한다. 워크로드가 텍스트라면, 당신은 한 번도 사용하지 않는 비전 인코더 프리미엄을 지불하고 있는 것이며, 그것이 텍스트 작업 비용에서 텍스트 전용 전문 모델이 멀티모달 플래그십을 앞서는 가장 구체적인 이유다.

이것을 결정하는 건 27B 티어다.
Qwen 4 Max는 헤드라인이고, 27B 티어가 진짜 이야기다. 모든 Qwen 세대는 사람들이 여러 가지를 할 수 있게 하는 조건으로 소형 오픈 티어를 출시해 왔으며, 그 후속 증거는 명백하다: Qwen 3.8 27B 가중치가 공개된 지 며칠 만에 생태계는 MLX 변환, NVFP4 양자화, 무검열 파인튜닝을 만들어냈고, 그중 어느 것도 누구의 허가를 필요로 하지 않았다. 그것이 관대한 소형 모델 공개가 얻는 것이며, 호스팅 API로는 따라올 수 없는 유통 방식이다.
플래그십 등급은 다른 문제다. 맞춤형 라이선스로 공개된 2.4조 매개변수 모델은 바이트를 다운로드할 수 있다는 의미에서 오픈이고, 그 바이트로 무엇을 할 수 있는지가 배포자에 의해 정의된다는 의미에서 클로즈드다. 두 가지는 동시에 사실이며, Qwen 4 발표는 어느 쪽도 바꾸지 않았다. Qwen 4 27B 등급이 전작들의 패턴을 따른다면, 그것은 가장 많은 사람에게 중요한 릴리스가 될 것이며, 로드맵에서 완성하기 가장 쉬운 것이 작은 오픈 등급이기 때문에 출시일이 가장 예측 가능한 릴리스이기도 하다.
이는 비교를 다시 쓸모 있는 것으로 되돌려 놓는다. GLM-5.3은 공개된 가격에 문서화된 기능 세트를 갖춘 호스팅 모델이며, 지금 이용할 수 있다. Qwen 4 Max는 등급 이름이다. 개방성 주장을 철학적이 아니라 구체적으로 만들고 싶다면, 기다려야 할 모델은 Max가 아니라 27B다.
라우팅 계층은 라이선스 문제가 더 이상 중요하지 않게 되는 곳이다
이 결정에는 라이선스 문제를 완전히 피해 가는 버전이 있으며, 그것이 타협안이 아니라 실제로 유효한 선택지라는 점을 솔직히 인정할 가치가 있다. 당신의 요구사항이 모델을 소유하는 것이 아니라 호출하는 것이라면, 가중치에 적용되는 라이선스는 무관하며, 중요한 조건은 가격, 지연 시간, 그리고 실패 동작이다.
OrcaRouter는 GLM-5.3을 z-ai/glm-5.3으로 제공합니다 백만 토큰당 입력 $1.26, 출력 $3.96으로 — Z.ai가 공개한 $1.40 및 $4.40보다 낮으며, 모델 페이지에는 우리가 청구하는 요율 옆에 해당 정가 요율이 나란히 표시되고, 우리가 제공업체에 지불하는 금액 위에 어떤 마크업도 추가되지 않습니다. 동일한 OpenAI 호환 엔드포인트는 Qwen 3.8 패밀리, Qwen3.8-Max, Qwen3.8-Flash 및 Qwen3.8-27B를 약 200개의 다른 모델과 함께 제공하며, 제공업체 경로가 저하될 때의 자동 장애 조치와 라우팅 DSL을 갖추고 있어 애플리케이션 코드에서 모델 문자열을 편집하는 대신 대체 정책을 명시적으로 표현할 수 있습니다. 벤더가 요율을 변경하면 그 변경은 같은 날 귀하의 키에 반영됩니다. 마진 계층이 없어 변경이 그 뒤에 걸려 멈출 일이 없기 때문입니다.
OrcaRouter가 제공하지 않는 것은 Qwen 4 Max 또는 어떤 Qwen 4 등급입니다. 카탈로그에는 해당 패밀리에 대한 항목이 없으며, 이는 무대에서 발표되었지만 아직 출시되지 않은 모델에 대한 올바른 상태입니다. Qwen 4 Max는, 만약 접근 가능하게 된다면, 벤더 자체 API와 여러 타사 플랫폼을 통해 접근할 수 있을 것입니다. 그때까지, 이 비교에서 실제로 호출할 수 있는 Qwen 모델은 Qwen3.8-Max이며, 이는 GLM-5.3과 동일한 카탈로그에 있습니다 — 이로 인해 이 대결의 라이브 버전은 조달 결정이 아니라 라우팅 정책 결정이 됩니다.

라이선스 문제가 실제로 결정하는 것
GLM-5.3은 두 축 모두에서 더 저렴하고, 컨텍스트 윈도와 출력 상한은 Qwen 플래그십과 맞먹으며, 모달리티 제한은 추론에 맡기지 않고 문서화되어 있고, 오늘날 실제 트래픽을 처리하고 있다. Qwen 4 Max는 컨퍼런스 슬롯과 티어 이름만 갖고 있으며, Qwen 4 로드맵에서 출시 시점을 예측할 수 있는 부분은 27B 티어뿐이다.
출시 이후에도 남는 결정은 어느 모델이 더 나은가가 아니다. 그것은 그 모델을 직접 소유해야 하는지의 문제다. 셀프 호스팅하거나 파인튜닝하거나 수정해야 한다면, 어느 연구소의 플래그십 가중치든 그 위에 사업을 세우기 전에 읽어야 할 약관이 따라오며, 작은 오픈 티어는 관대한 옵션들이 역사적으로 존재해 온 곳이다. 모델을 호출하기만 하면 된다면, 텍스트 작업에서는 GLM-5.3이 오늘날 더 저렴한 답이고, 이미지나 비디오 입력이 필요하다면 Qwen3.8-Max가 답이며, 둘 다 엔드포인트 하나와 청구서 하나만 있으면 된다. Alibaba가 모델 카드를 공개하면 플래그십 질문을 다시 꺼내고, 벤치마크 표보다 라이선스를 먼저 읽어라.

이 글에서 비교한 모델2
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
