
Qwen3.8-27B 오픈 가중치: Max는 출시됐지만 27B는 아니었다 — 지금까지 알려진 내용
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100만 토큰당 · 36 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237지능
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248지능
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258지능
- grokNEWGrok 4.72026-09-2146지능
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100만 토큰당 · 181 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100만 토큰당 · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040지능
- openaiOpenAI: GPT-6 Astra2026-09-0453지능77코딩
- googleGoogle: Gemini 3.8 Flash2026-09-0241지능76코딩
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245지능76코딩
- anthropicAnthropic: Claude Fable 5.12026-09-0153지능82코딩
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당 · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100만 토큰당 · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845지능75코딩
- obsidianQwen3.8 27B2026-08-1534지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1244지능77코딩
- metaMeta: Muse Spark 1.22026-08-0540지능72코딩
2026년 8월 13일, 알리바바가 Qwen3.8 세대를 위해 약속한 오픈 가중치 주간은 둘로 나뉘었다. Max급 플래그십의 가중치 — Qwen3.8-2.4T-A95B(2.4조 파라미터의 희소 혼합 전문가(sparse mixture-of-experts) 모델이자 다운로드 가능하게 공개된 최초의 Max급 Qwen 릴리스)는 실제로 출시되어 Hugging Face와 ModelScope에 공개되었으며, 전날 밤 늦게 ModelScope 커뮤니티를 통해 발표되었다. 이 페이지가 다루는 더 작은 모델인 Qwen3.8-27B는 그렇지 않았다. 같은 8월 10일 주에 출시하기로 약속되었지만, 아직 공식 저장소, 모델 카드, 라이선스 파일, 자체 벤치마크가 없으며, 제3자 추적 도구들은 이제 그 출시가 연기되었고 새 날짜가 주어지지 않았다고 설명한다. 이 "지금까지 알려진 사실(what-we-know-so-far)" 페이지가 답하기 위해 만들어진 질문인 "27B는 실제로 언제 출시되는가?"는 이제 두 가지가 되었다: 왜 Max의 가중치가 먼저 출시되었는가, 그리고 27B에는 무슨 일이 일어났는가?
이 글은 현재까지 알려진 내용을 정리한 것으로, 리뷰가 아닙니다. Qwen3.8-Max는 API 플래그십 모델로, 8월 3일부터 토큰 100만 개당 $2/$6 가격으로 서비스되고 있습니다. 그 기반이 되는 오픈 가중치(open-weights) 모델인 Qwen3.8-2.4T-A95B는 8월 13일부터 다운로드할 수 있게 되었으며, Qwen3.8-27B 가중치는 아직 공개되지 않았습니다. 아래의 모든 주장은 각각 '확인됨', '공급업체 보고', '커뮤니티 추정'으로 표시되어 있습니다.
신호, 그리고 그 주가 실제로 전달한 것
초기 신호는 @kimmonismus가 X에 올린 게시글이었다. 그는 "다음 주"를 주목해야 할 주로 지목하며 "Qwen-3.8 27b - Grok 4.6,"이라고 적었고, Astra가 목록에서 눈에 띄게 빠져 있었다. 그 주의 Grok 절반은 8월 12일에 출시되었다. Qwen 절반은 둘로 나뉘었다. 그 게시글이 포착한 것은 모델 출시를 업으로 지켜보는 사람들의 분위기였다. Qwen3.8 오픈 가중치 공개가 달력의 주요 일정이었고, 세부 사항이 아직 확정되지 않은 채 그 주가 시작됐다. 일주일 후, 세부 사항은 일부 해결되었다. 약속된 두 오픈 가중치 공개 중 하나가 도착했는데, 그것은 게시글이 지목한 것이 아니었다.
무엇이 확인되었나요?
• 이 패밀리는 실제이며 공식적으로 발표되었습니다. 알리바바는 7월 중순의 프리뷰 버전을 거쳐 2026년 8월 3일에 Qwen3.8 베이스 모델 패밀리를 공개했습니다.
• Qwen3.8-Max는 같은 날 출시되었습니다. API 플래그십 — 약 95B 활성 파라미터를 가진 2.4조 파라미터 전문가 혼합(mixture-of-experts) 모델로, 1M 토큰 컨텍스트 창과 텍스트·이미지·비디오 입력을 지원하며 — Qwen API에서 토큰 100만 개당 $2/$6에 공개되었습니다. 또한 OrcaRouter를 통해 동일한 공식 가격으로 이용할 수 있으며, 0% 마크업으로 전달됩니다.
• Max의 오픈 웨이트가 8월 13일에 출시되었습니다. Qwen3.8-2.4T-A95B — Qwen3.8-Max API의 기반이 되는 베이스 모델 — FP8 양자화 버전과 함께 Hugging Face와 ModelScope에서 다운로드할 수 있게 되었습니다. 이는 사상 최초의 Max급 Qwen 오픈 웨이트 배포입니다. 다운로드 가능한 모델은 텍스트 전용이며 thinking 모드가 강제로 활성화되어 있고, 기본 256K 토큰 컨텍스트를 지원하며 약 1M까지 확장할 수 있으며, SGLang, vLLM 및 TokenSpeed에 배포할 수 있습니다.
• Qwen3.8-27B는 이 제품군의 더 작은 오픈 웨이트 모델로, 아직 출시되지 않았습니다. 알리바바는 이 모델을 로컬 및 온프레미스 배포의 현실적인 경로로 자리매김했으며, Max 모델과 함께 그 가중치를 Hugging Face와 ModelScope에 공개하겠다고 약속했습니다. 8월 13일 현재 공식 Qwen3.8-27B 저장소는 아직 없습니다. 약속은 진짜였지만, 제공은 아직 이루어지지 않았습니다.
• 이번 세대의 첫 번째 독립 평가 점수가 나왔습니다. Artificial Analysis는 Qwen3.8-Max의 Intelligence Index를 태스크당 약 $1.14에 56으로 평가합니다. — 출시된 지 며칠 안 된 플래그십이 지니는 한계점을 감안하더라도 정말 좋은 수치입니다.
우리가 27B에 대해 실제로 아는 것
솔직한 요약은 "Qwen3.8-27B"가 여전히 대부분 이름과 파라미터 수에 불과하다는 것입니다. 확인된 사실은 약 270억 개의 파라미터를 가진 모델이며, Qwen3.8 세대의 오픈 웨이트(open-weights) 모델이고, 수백 개 GPU 클러스터보다는 단일 GPU 및 온프레미스 작업에 적합한 크기라는 점입니다. Unsloth의 Daniel Han은 출시 시 약 17GB의 VRAM, 즉 프로슈머용 그래픽 카드 한 장에 들어갈 것이라고 보고했습니다.
그 밖의 모든 것은 확인되지 않았다. Alibaba는 27B가 밀집(dense) 모델인지 혼합 전문가(mixture-of-experts) 모델인지, 컨텍스트 창이 얼마인지, 어떤 모달리티를 지원하는지, 자체 벤치마크 점수도 공개하지 않았다. 이번 주에 바뀐 것은 시기다. Max와 27B는 같은 주에 출시될 예정이었지만 Max만 도착했다. 서드파티 추적 도구들은 이제 27B가 새 날짜 없이 지연된 것으로 보고한다. 이는 커뮤니티의 해석이지 Alibaba의 공식 발표가 아니며, 약속된 주가 끝나기 전에 저장소가 공개될 가능성도 있다. 하지만 이 글을 쓰는 시점 기준으로 Hugging Face의 공식 Qwen 조직에는 Qwen3.8-27B가 등재되어 있지 않으며, 검색에 나타나는 몇 안 되는 "Qwen3.8-27B-FP8", "-GGUF", "-MLX" 저장소들은 공식 릴리스가 아니라 한 자릿수 다운로드 수를 가진 커뮤니티 플레이스홀더 카드다.
여전히 유용한 기준점은 이전 세대의 27B, 즉 32K 컨텍스트 창을 갖춘 오픈 가중치 덴스 모델인 {{1}}Qwen3.5-27B{{/1}}입니다. 이는 {{2}}Qwen3.8-27B{{/2}}가 넘어서야 할 합리적인 하한선이며, Qwen 27B급 모델이 역사적으로 개발자가 실제로 소유한 하드웨어에서 실행되도록 만들어져 왔음을 상기시켜 줍니다.
Max는 27B가 물려받을 수 있는 것의 기준점입니다.

{{1}}27B는 Max의 성능 상한에는 미치지 못하겠지만, 이제 실제 모델 카드에 공개된 Max의 수치는 이번 세대의 개선이 어떤 모습인지에 대한 기대치를 설정해 줍니다.{{/1}} {{2}}알리바바가 자체 평가한 오픈 가중치 모델에서 Qwen3.8-2.4T-A95B는 PaperBench 93.0, OSworld-Verified 86.1, 파라메트릭 CAD 91.5, SWE-bench Pro 67.7, Terminal-Bench 2.1에서 86.6을 기록했으며, 벤더는 Claude Opus 4.8, Claude Fable 5, GPT-5.6 Sol, Gemini 3.1 Pro와 동등한 성능이라고 주장합니다.{{/2}} {{3}}이 수치는 벤더가 보고한 것으로, 릴리스 자료에 게재되었으며 아직 독립 연구소에서 재현되지 않았습니다.{{/3}} {{4}}API 출시가 주장한 에이전틱 성능 향상 — FrontierSWE가 한 세대 만에 40.7에서 73.5로 상승 — 은 동일한 릴리스 자료에 그대로 포함되어 있습니다.{{/4}} {{5}}그 개선의 일부라도 27B에 흘러내린다면, 해당 클래스에서 '좋은 로컬 코딩 모델'이 무엇을 의미하는지 재정의될 것입니다.{{/5}}
기억해야 할 한 가지 미묘한 점: 다운로드 가능한 Max는 API Max와 동일하지 않습니다. Qwen3.8-2.4T-A95B는 텍스트 전용이며 생각 모드가 강제로 활성화되어 있는 반면, Qwen3.8-Max API는 비전 입력, 비생각 모드, 기본 1M-토큰 컨텍스트를 추가합니다. 그 차이는 바로 27B가 물려받을 가능성이 높은 종류의 것이며, 어떤 변형을 설명하는지 확인하지 않고 "Qwen3.8" 벤치마크 헤드라인을 읽을 때 기억할 가치가 있습니다.
가격은 Max가 가장 방어력이 높은 부분입니다: API에서 전체 1M 토큰 컨텍스트에 걸쳐 백만 토큰당 $2/$6이며, 긴 프롬프트 추가 요금이 없습니다. 이는 최첨단 API로서는 공격적인 가격이며, 라우팅 계산에 중요합니다 — 그 가격대에서는 3.8 세대가 더 비싼 플래그십으로 기본 설정되던 워크로드의 옵션이 됩니다.
무엇이 실제로 그것을 실행할 수 있나?

{{1}}27B{{/1}}의 경우, Alibaba는 아직 하드웨어 요구 사항을 발표하지 않았으므로, 현재 알려진 수치는 {{2}}Qwen 3.6-27B{{/2}} 양자화 테이블을 기반으로 한 커뮤니티 추정치입니다. 추정치일 뿐, 공식 사양이 아닙니다. 대부분의 사람들이 계획하고 있는 작동 범위는 변경되지 않았습니다:
• Q4_K_M 양자화, ~16GB VRAM — RTX 4090 또는 동급 GPU로, 대부분의 로컬 개발자들이 목표로 삼는 최적의 선택입니다.
• Q3_K_M 양자화, ~13GB VRAM — RTX 3060과 같은 12GB 카드에 품질 저하로 맞습니다.
• Q6_K 양자화, ~21GB VRAM — 24GB 카드에서 거의 무손실.
• FP8 서빙, ~27GB VRAM — 앞선 예상대로 프로덕션급 추론을 위한 단일 L40S.
• 풀 정밀도, H100 80GB — 벤치마크 품질의 경로이며, 대부분의 팀이 실행할 일은 없습니다.
새로운 변화는 '이제 Qwen3.8 세대를 자체 호스팅할 수 있다'는 말이 사실이지만, 사람들이 계획하던 모델에 대해서는 그렇지 않다는 점입니다. Max의 오픈 가중치는 전혀 다른 하드웨어 등급입니다. 전체 정밀도 BF16 모델은 약 4.9TB이고, Unsloth의 1비트 계층적 선택적 양자화로 약 397GB까지 줄어듭니다. 실행 가능하지만 RAM과 VRAM을 합쳐 410GB 이상이 필요합니다. 이는 프로슈머용 카드가 아니라 진지한 인프라입니다. 바로 그 격차를 메우기 위해 27B가 설계된 것이며, 27B가 계속 부재한 탓에 이 세대의 단일 GPU 로컬 경로는 아직 존재하지 않는 것입니다.
라이선스 문제: Max가 방금 선례를 세웠습니다.
27B의 라이선스 문제는 아직 답이 나오지 않았지만, "어떻게 생겼을지"는 더 이상 추측이 아니다. Max의 오픈 가중치는 Apache 2.0이 아닌 "qwen3.8-max"라는 라벨이 붙은 맞춤 라이선스로 배포되었다. 모델 카드에서 보고된 바에 따르면, 일반적으로 상업적 사용과 호스팅에는 무료이지만, 규모가 커지면 추가 요구사항이 발생한다: 월간 활성 사용자가 1억 명 이상 또는 월 매출이 2천만 달러를 초과하는 제품은 모델 이름을 표시해야 하며, 연간 매출이 5천만 달러를 초과하는 회사가 model-as-a-service 또는 AI 업무 보조 서비스를 제공할 경우 별도의 라이선스가 필요하다. 이 라이선스가 미국, EU, 영국, 한국에서의 사용을 금지한다는 유포된 주장은 사실이 아니다 — 라이선스에는 영토 제한이 없다.
특히 27B의 경우, 아직 라이선스가 명명되지 않았습니다. 하지만 Max는 Apache 2.0이 아닌 맞춤형 Qwen 라이선스로 배포되었으므로, 형제 모델에도 Apache 2.0을 가정하는 것은 적절하지 않습니다. 기존 Tongyi Qianwen 라이선스(1억 MAU 조항 포함)는 Max에 적용된 것이 아닙니다. Max에는 새로운 규모 등급 라이선스가 적용되었습니다. 계획을 세우기 전에 실제 저장소의 LICENSE 파일을 읽고, 27B의 라이선스는 해당 저장소가 출시될 때에만 결정될 것으로 예상하세요.
툴체인 타이밍: 출시 당일 지원이 방금 입증되었습니다
서빙 엔진들은 출시된 모델에 대해 예상대로 빠르게 움직였습니다. Qwen3.8-2.4T-A95B는 SGLang, vLLM, TokenSpeed에서 즉시 지원되는 상태로 출시되었으며, 이는 대규모 오픈 가중치 릴리스에서 "거의 즉시 API 서빙 가능"이 어떤 모습인지를 보여줍니다. 27B의 경우, 저장소가 공개되는 시점에 동일한 엔진들이 가장 먼저 지원할 가능성이 높으며, Max의 출시 당일 지원 덕분에 27B도 그 지원을 이어받을 것이라고 기대하는 것이 합리적입니다. 커뮤니티의 GGUF 및 AWQ 양자화는 보통 1~2주 정도 늦게 제공되므로, Ollama 스타일의 "pull and run" 경험은 27B 출시일에 여전히 존재하지 않을 가능성이 높습니다. 처음에는 vLLM이나 llama.cpp를 수동으로 설정하는 것이 로컬 실행을 위한 유력한 경로가 될 것입니다.
아직 알려지지 않은 것
정직한 유출 기사는 실제로 공개된 부분까지만 다룬다. 그 경계는 일주일 전에 비해 한 방향으로는 더 넓어졌고, 다른 방향으로는 더 좁아졌다. 즉, Max의 질문들은 답변을 받았지만, 27B의 질문들은 그렇지 않았다.
• 새로운 출시 날짜."8월 10일 주"가 약속이었다; 그 주가 거의 끝나 가는데도 리포지토리가 나타나지 않았다. 서드파티 추적기들이 새 날짜 없이 지연을 보고했지만, 알리바바는 공식 성명을 내지 않았다.
• 아키텍처. 27B에 대해 Dense 또는 MoE, 그리고 MoE라면 활성 파라미터 수.
• 스펙 시트. 컨텍스트 창, 모달리티, 출력 제한, 추론 모드.
• 벤치마크.27B는 공식 점수가 없으며 독립적인 평가도 받지 못했다.
• 라이선스. 27B의 리포지토리가 공개될 때까지 미정이며, Max의 맞춤형 라이선스가 참고할 전례입니다.
• 미러 위험.플레이스홀더 문제가 이제 실제로 드러나고 있습니다. 커뮤니티의 "Qwen3.8-27B-FP8", "-GGUF", "-MLX" 카드는 공식 파일이 하나도 없이 존재합니다. 공식 Qwen 조직이 저장소를 게시할 때까지 공식 조직 페이지에서만 다운로드하세요.
빌더에게 의미하는 바
Qwen3.8 세대의 실질적인 분할은 이제 두 가지가 아닌 세 가지입니다. 오늘 최첨단 API를 원한다면, Qwen3.8-Max가 OrcaRouter를 통해 제공업체의 $2/$6 정가로, 0% 마크업으로 그대로 전달되어 운영 중입니다. 즉, 보이는 가격이 Alibaba가 책정한 가격입니다. Max급 모델을 자체 호스팅하려면, 오픈 가중치는 지금 다운로드할 수 있지만, 대략 4.9TB의 전체 정밀도 모델 또는 대략 397GB의 양자화 모델을 구동할 수 있는 하드웨어가 필요합니다. 그리고 이번 세대가 제공할 것으로 예상되었던 단일 GPU 로컬 배포를 원한다면, 아직 출시되지 않은 Qwen3.8-27B를 기다리는 중입니다. 오늘날 하나의 OpenAI 호환 키가 API 측면을 담당하며, 27B의 호스팅이 자리 잡으면 같은 키로 그쪽에 연결할 수 있습니다.

마지막 부분이 더 일반적인 요점이며, 검증되지 않고 지연된 오픈웨이트(open-weight) 릴리스가 바로 그 시험 사례입니다. 아직 출시도 되지 않은 모델은 실적도, 독립적인 벤치마크 세트도, 사고 이력도 없습니다. 그리고 실제로 출시되면 완전히 새로운 모델일 것입니다. 라우팅은 고객 대면 경로에 베팅하지 않고 모델을 시험해 보는 방법입니다. 예상 밖의 결과를 견딜 수 있는 트래픽을 보내고, 문제가 발생하면 검증된 모델로 자동 장애 조치하며, 신뢰를 얻으면 전체 워크로드를 전환합니다. 라우팅 계층은 또한 가격 계산을 정직하게 만듭니다. 하나의 엔드포인트를 통해 호출하는 모델의 가격을 Alibaba가 인하하면, 목록 가격이 그대로 전달되므로 변경 사항이 당일 바로 적용됩니다.
볼 만한 것
• 27B의 저장소가 전혀 나타나는지 여부. Hugging Face 또는 ModelScope의 공식 Qwen 조직 아래에 목록이 등재되는 것이 지연을 끝내는 계기가 되며, 8월 10일 주는 거의 끝나가는데 아직 그러한 등재가 없습니다.
• 27B의 라이선스 파일입니다.Max는 Apache 2.0이 아닌 맞춤형 규모별 계층형 라이선스를 적용해 출시되었습니다. 27B가 그 선례를 따를지 여부가 향후 발표에서 가장 중요한 한 줄이 될 것입니다.
• 아키텍처와 컨텍스트 길이. Dense-vs-MoE와 컨텍스트 윈도우가 27B의 용도를 결정한다.
• 최초의 독립 벤치마크입니다. Max가 Artificial Analysis Intelligence Index에서 기록한 56점은 기준을 세웠습니다. 27B의 첫 번째 외부 평가는 이번 세대의 발전이 소비자용 크기에서 얼마나 유지되는지 알려줄 것입니다.
• 툴체인 지원. 27B가 Max가 출시 첫날부터 제공한 SGLang/vLLM/TokenSpeed 지원을 이어받는지, 그리고 커뮤니티 양자화가 얼마나 빨리 뒤따르는지.
자주 묻는 질문
Qwen3.8-27B가 아직 출시되었나요?
아니요. 알리바바는 2026년 8월 3일에 이를 발표했고, 8월 10일 주에 가중치를 Hugging Face와 ModelScope에 공개하겠다고 약속했지만, 8월 13일 현재 공식 Qwen3.8-27B 저장소, 모델 카드, 라이선스는 없습니다. Max-class 오픈 가중치인 Qwen3.8-2.4T-A95B는 8월 13일에 출시되었지만 27B는 출시되지 않았으며, 서드파티 추적자들은 새 날짜 없이 지연된 것으로 보고하고 있습니다.
Qwen3.8-27B를 실행하려면 어떤 하드웨어가 필요한가요?
확인되지는 않았지만, Qwen 3.6-27B 양자화 테이블을 기반으로 한 커뮤니티 추정에 따르면 Q4_K_M 양자화는 약 16GB VRAM(RTX 4090), Q3_K_M 양자화는 약 13GB(12GB 카드), Q6_K 양자화는 약 21GB(24GB 카드), FP8 서빙은 약 27GB(L40S 1개)가 필요합니다. Unsloth의 Daniel Han은 출시 시 약 17GB를 보고했습니다. 공식 모델 카드가 하드웨어 가이드를 게시할 때까지 이는 추정치로 간주하세요.
Qwen3.8-27B가 OrcaRouter를 통해 사용할 수 있나요?
아직 아닙니다. Qwen3.8-27B는 오픈 웨이트(open-weight) 자체 호스팅 모델이며, 현재 플랫폼에 등록되어 있지 않습니다. 같은 제품군의 플래그십 모델인 Qwen3.8-Max는 현재 OrcaRouter를 통해 공급업체의 토큰 100만 개당 $2/$6 공시 가격에 0% 마크업으로 이용할 수 있으며, 27B의 호스팅이 안정되면 동일한 OpenAI 호환 키에 추가할 수 있습니다.
Qwen3.8-27B를 기다려야 할까요, 아니면 오늘 Qwen3.8-Max를 사용해야 할까요?
워크로드가 실행되는 위치에 따라 다릅니다. 지금 최첨단 API가 필요하다면 Qwen3.8-Max가 출시되어 있으며 백만 토큰당 $2/$6라는 공격적인 가격으로 제공됩니다. 오늘 Max급을 자체 호스팅하려면 Qwen3.8-2.4T-A95B를 지금 다운로드할 수 있지만, 상당한 하드웨어가 필요합니다. 대략 4.9TB 전체 정밀도 모델 또는 약 397GB 양자화 버전이며, 총 410GB 이상의 RAM과 VRAM이 필요합니다. 단일 소비자용 그래픽 카드에서 로컬 또는 온프레미스 모델이 필요하다면 Qwen3.8-27B가 여전히 기다릴 만한 모델입니다. 이 세대에서 현실적인 자체 호스팅 경로이며, 그 출시일이 고정된 날짜가 아닌 미정의 문제가 되었습니다.
약속된 주간이 거의 끝나가는데, 그중 절반은 도착하지 않았습니다. Qwen3.8-2.4T-A95B는 다운로드 가능하고, 라이선스가 부여됐으며, 서빙할 수 있습니다. Qwen3.8-27B는 존재가 확인됐고, 여전히 오픈 가중치를 고수하고 있지만, 여전히 저장소도, 라이선스도, 벤치마크도, 새로운 일정도 없습니다. 약속된 주간이 완전히 끝나기 전에 27B의 저장소가 올라오는지, Max 옆에 있는 그 라이선스 파일에 무엇이 적혀 있는지, 그리고 최초의 독립 평가가 어떻게 점수를 매기는지 지켜보십시오. 그 세 가지 신호가 이것이 더 작은 모델이 아직 출시되지 않은 일상적인 2단계 오픈 가중치 릴리스인지, 아니면 계획에 반영해야 할 지연인지를 알려줄 것입니다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
