'Dots vs Qwen 3.8 Max'라는 제목의 생성된 히어로 카드로, 부제는 '차이는 그것을 어디에서 움직일 수 있느냐에 있습니다'. 세로 구분선이 카드를 나눕니다. 'Dots'라고 표시된 왼쪽 패널에는 '실행할 수 있는 한 곳'이라고 적혀 있고, 'Qwen 3.8 Max'라고 표시된 오른쪽에는 '세 가지 와이어 형식 - 다섯 개 리전 - $2.00 / $6.00'이라고 적혀 있습니다. OrcaRouter 로고는 오른쪽 아래 모서리에 합성되어 있습니다.
Guides & Insights

Dots vs Qwen 3.8 Max: 차이는 어디로 옮길 수 있느냐에 있다

작성자

Elias Hawthorne

게시일

최신 모델 · 20모든 모델 보기 →
벤치마크: Artificial Analysis · 매일 업데이트
모든 게시물로 돌아가기

Qwen 3.8 Max는 2026년 8월 3일에 공개되었으며, Aliba​ba의 현재까지 최고 성능 등급입니다: 네이티브 멀티모달로 텍스트, 이미지, 영상을 입력받아 텍스트를 반환하고, 1,000,000토큰 컨텍스트 창을 지원하며, 세 가지 전송 형식 — Open​AI 호환, Anthro​pic 호환, 네이티브 DashScope — 을 통해 베이징, 싱가포르, 도쿄, 프랑크푸르트, 버지니아에서 제공됩니다. 가격은 입력 토큰 백만 개당 $2.00, 출력 토큰 백만 개당 $6.00이며 캐시 읽기는 $0.25입니다. Dots는 2026년 9월 29일 DevDay에서 발표된 이 회사의 상시 작동 에이전트입니다: 자체 클라우드 컴퓨터와 브라우저를 갖추고, 4,000개 이상의 앱에 접근하며, GPT-6 Astra에서 실행되고, Pro 및 Business Premium에 포함됩니다. 나란히 놓고 보면, 흥미로운 질문은 어느 쪽이 더 뛰어난가가 아닙니다. 각각이 얼마나 많은 곳에 존재하도록 허용되는지, 그리고 누가 결정하는지입니다.

그것은 추상적인 구분이 아닙니다. 그것은 어떤 도구가 귀하의 시장에서 아예 이용 가능한지, 귀하의 컴플라이언스 팀이 감사할 수 있는지, 그리고 그 위에 구축한 작업물이 약관 변경에도 살아남는지를 결정하는 바로 그 구분입니다. 기능은 이 비교에서 쉬운 부분입니다. 이식성은 늦게, 그리고 값비싼 대가를 치르고서야 정해지는 부분입니다.

하나의 모델을 호출하는 세 가지 방법

와이어 형식은 작은 엔지니어링 세부 사항처럼 들리지만, 애플리케이션을 벤더 간에 옮겨야 할 때까지는 그렇습니다. OpenAI 호환 인터페이스는 기존 클라이언트 라이브러리가 변환 계층 없이 작동한다는 뜻입니다. Anthropic 호환 인터페이스는 다른 벤더의 메시지 형태에 맞춰 작성된 코드베이스를 다시 작성할 필요가 없다는 뜻입니다. 네이티브 DashScope 인터페이스는 thinking 토글을 포함한 전체 기능 세트를 노출합니다. 하나의 모델을 위한 세 가지 인터페이스는 전환 비용이 리팩터링이 아니라 베이스 URL과 키라는 뜻입니다.

그것은 없을 때 가장 중요합니다. dot에는 형식도, URL도, 키도 제공되지 않습니다. 왜냐하면 dot은 호출하는 대상이 아니라, 다른 사람의 인터페이스 안에서 대화를 나누는 대상이기 때문입니다. 에이전트 로직을 다른 곳으로 옮긴다는 것은 그것을 다시 구축하고, 그것이 의존하던 4천 개의 커넥터를 다시 연결한 다음, 그중 어떤 것들이 당신이 적어 두지 않은 방식으로 동작했는지 알아내는 것을 의미합니다.

• 구매하시는 것 — ChatGPT, Slack, Teams 내부의 호스팅 워커(Dots) 대 어디서나 호출할 수 있는 모델 엔드포인트(Qwen 3.8 Max)

• 인터페이스 — {{1}}dot{{/1}}의 경우 공개된 것이 없으며, OpenAI 호환, Anthropic 호환 및 네이티브 DashScope 표면(Qwen 3.8 Max)에 대응합니다.

• 실행 위치 — 자체 브라우저를 갖춘 OpenAI의 클라우드 컴퓨터(Dots)가 아시아, 유럽, 북미 전역의 5개 서비스 지역(Qwen 3.8 Max)을 상대로

• 추론 제어 — 점 하나도 노출되지 않으며, 반면 enable_thinking 토글, 또는 reasoning.effortResponses API(Qwen 3.8 Max)의

• 단위당 비용 — 첫 번째 닷은 Pro 또는 Business Premium에 포함되며, 허용량은 미공개 (Dots) 대비 백만 입력당 $2.00, 백만 출력당 $6.00, 캐시 읽기 $0.25 (Qwen 3.8 Max)

• 독립적 증거 — 벤더 데모와 역량 설명뿐, 점 하나에 대한 벤치마크도 없음. 측정된 145개 모델 중 15위인 Artificial Analysis Intelligence Index 45.4와 GPQA Diamond 92.8과는 대조적임 (Qwen 3.8 Max)

모델이 어디에 위치하는지, 직접 확인할 수 있는 숫자로

Qwen 3.8 Max의 공개된 프로필은 중간 프런티어급이며, 인상 위주로 판단하기보다 정밀하게 읽을 가치가 있다. AA Intelligence Index 45.4는 측정된 145개 모델 중 15위에 해당하며, 이는 상위 10퍼센트 안에 들게 하지만 최상위에는 올려놓지 않는다. AA Coding Index 76.2는 138개 중 9위로 더 강력하고, Terminal-Bench 2.1에서의 88.8은 진정으로 높은 에이전트 실행 수치다 — 같은 보드에서 GPT-5.6 Sol의 88.0보다 높다. 상대적으로 더 약한 부분은 80.3의 장문맥 회상으로, 이는 비슷한 컨텍스트 창 크기에도 불구하고 Kimi K3의 88.7과 MiniMax M3의 83 아래에 있으며, SciCode는 52.1이다.

알리바바의 배포판은 마이그레이션 가이드에서 이 모델을 GPT-5.5, Opus 4.7, 3.1과 맞세우는데, 숫자를 솔직하게 읽어 보면 이 모델은 지능 순위에서 1위를 차지하는 것보다 강력한 에이전트 및 멀티모달 역량이 더 중요할 때 선택하는 모델이다. 이 모든 수치는 회사 자체 데이터가 아니라 출처와 함께 우리 [???]에 포함된 제3자 측정치이며, 그렇기 때문에 출시 발표 자료보다 더 가치가 있다.

한 가지 수치가 빠져 있는데, 이는 채워 넣는 대신 소리 내어 말해야 합니다. 우리 카탈로그에는 이 모델의 최대 출력 길이가 기재되어 있지 않습니다. 백만 토큰 컨텍스트는 문서화되어 있지만, 응답당 출력 상한은 그렇지 않습니다.

A screenshot of the OrcaRouter model page for Qwen3.8 Max, showing the identifier 'qwen/qwen3.8-max' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-08-03, a description of it as Alibaba's newest flagship with a 1M-token context window served through OpenAI-compatible, Anthropic-compatible and native DashScope interfaces across multiple regions, a side panel reading 1M tokens of context over text, image and video input, and a price strip reading $2.00 and $6.00 with a p50 time to first token of 2.44 seconds.

Dots가 당신에게 말해주지 않는 것, 그리고 그것이 디자인 선택인 이유

OpenAI는 dot의 비용에 관해 한 문장을 공개했는데, 그 안에는 숫자가 없다: 첫 번째 dot은 Pro 및 Business Premium에 포함되며, 첫 달에는 확장된 한도가 적용되고 그것과의 대화에는 ChatGPT 사용 한도가 차감되지 않는다. 그 외에는 허용량 수치도, 두 번째 dot의 가격도, 추가 용량에 대한 요금도, 작업당 비용도 없다. $500/월 Pro 500 등급은 dot당 요금이 아니라 사용 허용량에 Ultrafast 모드가 더해진 것이므로, 가장 비싼 요금제조차 에이전트 작업 단위당 비용으로 환산되지 않는다.

그것을 문서의 공백으로 읽고 싶어지지만, 범주 문제로 읽는 것이 더 정확하다: 시트당 가격이 책정된 제품은 단위당 가격을 가질 수 없는데, 시트의 핵심은 그것을 사용할 때 드는 한계 비용이 보이지 않는다는 데 있기 때문이다. 이는 탐색적 작업에는 정말 편리하고, 프로젝트나 고객, 예산 항목에 귀속시켜야 하는 모든 것에는 정말 불편하다.

두 제품이 무엇에 최적화되어 있는지 주목하세요. Qwen 3.8 Max는 어디서든, 무엇에 의해서든, 호출자가 이미 말하는 형식이 무엇이든 호출되는 데 최적화되어 있습니다. 점 하나는 한곳에서, 하나의 인터페이스로, 내부 배관을 숨긴 채 사용되는 데 최적화되어 있습니다. 둘 다 일관된 설계입니다. 단지 서로 다른 질문에 답할 뿐이며, 그중 하나는 "나중에 이걸 옮길 수 있나요?"라는 질문에 '아니요'라고 답합니다.

A generated scoreboard titled 'Dots vs Qwen 3.8 Max - reach and reversibility', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; interfaces none published; regions OpenAI's cloud computer; connectors 4,000+ apps; independent benchmark none. The right column, 'Qwen 3.8 Max', lists: context 1,000,000 tokens; input text, image, video; interfaces OpenAI-compatible, Anthropic-compatible, DashScope; regions five; price $2.00 in / $6.00 out per 1M; AA Intelligence Index 45.4, 15th of 145. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; Qwen 3.8 Max figures from independent listings as carried in the OrcaRouter catalogue.'

"이 벤더가 바뀌면 어떡하지"에 대한 두 가지 답변

이식성 문제는 공급업체가 가격을 변경하거나 식별자를 지원 중단하거나 구독에 포함되는 내용을 바꾸는 순간 구체화된다. 세 가지 와이어 포맷을 가진 종량제 모델이라면 대응은 기계적이다. 클라이언트가 다른 기본 URL을 가리키게 하거나 모델 문자열 하나를 바꾸면 애플리케이션은 계속 작동한다. 모델은 애초에 호출 외에는 아무것도 아니었기에 이식할 다른 것은 없다.

dot의 경우, 약관 변경에 대한 대응은 중단하는 것입니다. 컴퓨터, 브라우저, 커넥터, 허용량은 모두 OpenAI에 속하며, 그중 어느 것도 내보낼 수 없습니다. 그것은 제품에 대한 비판이 아니라, 임차에 대한 솔직한 설명입니다. 하지만 그것은 당신이 전적으로 dot 안에서 구축한 작업이 재작성을 거치는 마이그레이션 경로를 갖는다는 뜻이며, 그것은 당신이 1년 동안 의존할 무언가를 만들기 전에 비용으로 계산해 둘 가치가 있는 사실입니다.

OrcaRouter는 첫 번째 경우를 위해 만들어졌습니다. Qwen 3.8 Max는 qwen/qwen3.8-max(으)로 라우팅되며, 알리바바의 제공사 정가에 0% 마크업만 붙여 그대로 전달되고, 200개 이상의 다른 모델과 동일한 카탈로그 안에서 하나의 키 뒤에 위치합니다. 여기에는 업스트림 제공사 간 자동 페일오버와 여러 모델을 하나의 요청으로 구성하기 위한 라우팅 DSL이 포함됩니다. 바로 이 점 덕분에 3개 리전에 관한 질문은 벤더 쪽이 아니라 여러분 쪽에서 답할 수 있습니다. 동일한 식별자가 모델이 서비스되는 어디서든 그 모델에 도달하며, 알리바바의 요금 변경은 다음 갱신 때가 아니라 같은 날 여러분의 청구서에 반영됩니다. 다만 도달하지 못하는 것은 점(dot) 안에 있는 그 무엇입니다. 그것을 위한 엔드포인트도, 식별자도, 대신 투입할 대체 지능도 없습니다.

결정을 내리기 전에 물어야 할 질문

공급업체가 당신이 통제할 수 없는 무언가를 바꾸는 날, 당신의 작업이 어떻게 되는지 물어보라. 답이 “문자열 하나 바꾸고 넘어간다”라면 당신은 모델을 사는 것이고, 종량제로 쓰는 쪽이 더 나은 구매다. 답이 “다시 만들어야 한다”라면 당신은 제품을 사는 것이며, 신중하게 사야 한다 — 당신이 지불하는 편의가 되돌릴 수 있는 능력을 대가로 지불된다는 것을 알고.

어느 답도 틀리지 않다. 결코 쓰지 않을 휴대성을 사는 것은, 벗어나야만 할 편의성을 사는 것만큼이나 낭비다. 실수는 자신이 어느 쪽을 샀는지 모르는 데 있다.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with a grid of model cards and credit top-up offers visible beneath.

이 글에서 비교한 모델1

이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트