'Qwen3.8-27B Release Date' 기사의 타이틀 카드: 약속된 출시 시점으로 2026년 8월 10일 주를 표시한 달력, '상태: 대기 중' 배지, 2026년 8월 3일 발표를 알리는 부제, 그리고 층층이 쌓인 모델 레이어 그래픽.
Guides & Insights

Qwen3.8-27B 출시일: 8월 14일 모델 가중치 공개

작성자

Rowan Sterling

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

알리바바는 2026년 8월 14일 저녁, Qwen3.8-27B의 오픈 가중치를 배포했다. 이로써 해당 모델 저장소는 Apache 2.0 라이선스 하에 Hugging Face와 ModelScope에 게시되었다. 이는 8월 3일 발표 이후 이 게시물이 추적해 온 출시일 관련 의문을 해소하며, 최초의 API 제공 데이터 포인트를 제공한다: 모델은 같은 날 상용 API 마켓플레이스에 등록되었다. Qwen3.8-27B는 Qwen3.8 세대의 밀집형(dense) 자체 호스팅 가능 모델로, 알리바바가 2.4조 파라미터의 Qwen3.8-Max 플래그십과 대비하여 내세운 형제 모델이자, 널리 사용되는 Qwen3.6-27B의 후속 모델이다.

8월 14일 드롭이 확인한 것

Qwen3.8 세대는 2026년 8월 3일에 발표되었습니다. 그날 mixture-of-experts 플래그십인 Qwen3.8-Max가 유료 API로 출시되었고, 알리바바는 Max와 더 작은 Qwen3.8-27B 모두의 오픈 가중치를 "약 일주일 이내에" 공개하겠다고 약속했습니다. 그 기간은 늘어졌다가, ModelScope 티저가 8월 15일 자정(00:00 JST)까지의 카운트다운을 실행하면서 구체적인 목표가 생겼습니다. 공개는 그 일정대로 이루어졌습니다: 베이징 시간 8월 14일 저녁, Hugging Face와 ModelScope 양쪽에서 말입니다.

확정된 사양 세트: Qwen3.8-27B는 270억 개의 파라미터를 가진 dense 모델로, 기본적으로 멀티모달(텍스트, 이미지, 비디오, 다이어그램, 문서)을 지원하며, 기본 262,000토큰 컨텍스트 창은 YaRN을 통해 100만 토큰까지 확장됩니다. 또한 reasoning_effort 모드를 구성할 수 있어 추론 깊이를 조절해 컴퓨팅을 절약합니다. 이는 릴리스 자료에 명시된 공급업체 제공 사양으로, 이제 맹신하는 대신 공개된 가중치에서 직접 확인할 수 있습니다.

알리바바 자체 평가에서 27B는 이전 모델을 능가할 뿐만 아니라 더 큰 Qwen3.7-Plus도 능가합니다: SWE-bench Pro 61.7(Qwen3.6-27B의 53.5 대비), 에이전트 터미널 코딩 73.0(63.4 대비), JobBench 33.4(21.8 대비). 이는 벤더가 보고한 수치로, 아직 독립적인 벤치마크가 27B에 대한 점수를 발표하지 않았으므로 커뮤니티가 이제 재현하려고 시도할 주장으로 간주해야 합니다.

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

릴리스의 어떤 레이어가 반영되었나요?

오픈 가중치 모델의 경우 '출시'에는 여러 단계가 있으며, 각 단계는 며칠씩 차이를 두고 이루어집니다. 원시 가중치는 1단계로, 8월 14일에 공개되었습니다. 추론 프레임워크 지원은 2단계입니다. vLLM과 SGLang은 일반적으로 가중치 공개 후 며칠 내에 지원을 추가하며, 이것이 모델이 단순히 다운로드만 가능한 상태가 아니라 서빙할 준비가 되었다는 신호입니다. 커뮤니티 양자화는 3단계로, GGUF 및 AWQ 빌드와 함께 Ollama, LM Studio, llama.cpp 원커맨드 경로가 제공되며, 보통 1~2주 후에 이루어집니다.

그래서 "언제 가중치를 가져올 수 있냐"에 대한 답은 지금입니다. "언제 한 번의 명령으로 실행할 수 있냐"에 대한 답은 프레임워크와 양자화 계층이 주는데, 이들은 아직 배포 중입니다.

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

라이선스 문제는 해결되었다.

라이선스는 날짜보다 더 중요했던 핵심 쟁점이었고, 이번 출시로 그 문제가 결정되었습니다. Qwen3.8-27B는 Apache 2.0으로 배포됩니다. 이는 사용자 수 제한이 없고 상업적 협의를 유발하지 않는 허용적 라이선스입니다. 앞서 Qwen의 오픈 릴리스가 1억 MAU 조항이 있는 Tongyi Qianwen 라이선스로 제공될 것이라는 우려가 있었지만, 27B에서는 현실화되지 않았습니다. 이로써 모델을 출시 첫날부터 제품과 에이전트에 통합하는 데 있어 주요 법적 장애물이 제거되었습니다.

첫 번째 API 가용성 데이터 포인트

이번 릴리스는 또한 27B에 대한 최초의 API 가용성 데이터 포인트를 제공했습니다. 가중치 공개 후 몇 시간 만에 모델이 상업용 API 마켓플레이스에 라이브 서빙 엔드포인트로 등장했습니다. 이 등재는 제3자 카탈로그 항목으로서 벤더의 주장이 아닌 독립적으로 검증 가능하며, 모델이 단순히 다운로드만 가능한 것이 아니라 관리형 API를 통해 배포 가능함을 보여주는 첫 번째 증거입니다.

그것이 바로 비용 계산에 OrcaRouter가 들어맞는 이유입니다. 현재 세대에서 라우팅 가능한 모델은 Qwen3.8-Max로, OrcaRouter에서 공급업체 정가(입력 토큰 100만 개당 $2.00, 출력 토큰 100만 개당 $6.00)로 제공되며 마크업이 전혀 없으므로 공급업체의 가격이 곧 지불하는 가격입니다. 하나의 API 키로 이 모델과 카탈로그의 200개 이상 모델을 이용할 수 있고 자동 장애 조치도 지원됩니다. Qwen3.8-27B가 라우터에 포함될 자격을 얻으면 동일한 키가 해당 모델로 라우팅됩니다. 그때까지는 Apache 2.0 가중치를 자체 호스팅하여 무료로 평가할 수 있습니다.

다음에 확인할 사항

이번 드롭은 날짜에 대한 답을 제시하지만, 품질에 대한 답은 아직 제시하지 않습니다. 앞으로 몇 주 동안 주목할 만한 세 가지 사항이 있습니다:

• 추론 프레임워크 지원 — vLLM과 SGLang의 풀 리퀘스트가 Qwen3.8-27B를 명명한 것은 모델이 단순히 저장소에서 실행되는 수준이 아니라 대규모 서빙이 가능한 상태가 되었음을 알리는 신호입니다.

• 실제 VRAM 측정치가 포함된 커뮤니티 양자화 — Unsloth와 다른 팀들은 보통 며칠 내로 GGUF 빌드와 측정 메모리를 게시하여, 출시 전 예상치를 실제 배포에 사용할 수 있는 수치로 전환합니다.

• 독립적인 벤치마크 — 27B에 대한 Artificial Analysis 및 LMArena 점수는 공개되었을 때 프로덕션 결정을 좌우해야 하며, 알리바바 자체 평가가 아니라야 합니다.

오늘 사용할 수 있는 것

Qwen3.8-27B를 지금 다운로드할 수 있습니다 — 이것이 Apache 2.0 배포의 핵심입니다. 오늘 관리형 API에서 이번 세대를 기반으로 구축하려는 팀을 위해, Qwen3.8-Max가 OrcaRouter에서 공급업체 고시 가격(입력 토큰 100만 개당 $2.00, 출력 토큰 100만 개당 $6.00, 마크업 없음)으로 제공되며, 자동 장애 조치와 카탈로그 전체에서 사용되는 단일 키를 지원합니다. 독립적인 벤치마크가 공급업체의 점수를 확인할 때까지는, 평가를 위해 27B 가중치를 자체 호스팅하는 것이 위험 부담이 적은 진입 방법입니다.

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

출시일 질문은 종결되었습니다: Qwen3.8-27B는 2026년 8월 14일에 Apache 2.0 하에 출시되었으며, 기본 262K 컨텍스트 창과 당일의 API 가용성 데이터 포인트를 갖추고 있습니다. 남은 질문들은 측정 가능한 것들입니다 — 서빙 성능, 양자화 성능, 그리고 독립적인 평가가 알리바바의 점수를 재현하는지 여부입니다. LICENSE를 읽고, 가중치를 내려받고, 프로덕션 경로에 투자하기 전에 프레임워크 지원과 커뮤니티 빌드를 기다리세요.