Qwen3.8 Max

qwen/qwen3.8-max
신규추천
비전도구JSON추론
제공 Qwen · 2026-08-03

Qwen3.8-Max는 Alibaba의 Qwen 라인에서 가장 최신 플래그십 모델이자 현재까지 최고 성능 계층입니다. Alibaba는 자체 마이그레이션 가이드에서 이를 GPT-5.5, Claude Opus 4.7, Gemini 3.1 Pro와 직접 비교하며, 복잡한 다단계 분석, 심층 논리 추론, 까다로운 에이전트 작업 등 가장 강력한 추론이 필요한 작업에 이를 권장합니다. 기본적으로 멀티모달이며, Alibaba에 의해 텍스트 생성과 이미지/비디오 이해 모두에 등재되어 있습니다. 텍스트, 이미지, 비디오를 입력받아 텍스트를 출력하며, 1M 토큰 컨텍스트 창을 제공합니다. 공식 기능 매트릭스는 생각 모드, 함수 호출, 내장 도구, 구조화된 출력을 완전히 지원함을 확인해 주므로, 에이전트 프레임워크와 도구 호출 파이프라인에 완벽하게 그대로 사용할 수 있습니다. Qwen3.8-Max는 베이징, 싱가포르, 도쿄, 프랑크푸르트, 버지니아 전역에서 OpenAI 호환, Anthropic 호환, 기본 DashScope의 세 가지 와이어 형식으로 제공됩니다. 생각 모드는 enable_thinking 매개변수(또는 Responses API의 reasoning.effort)로 전환합니다. 이는 제품군 중 프리미엄 계층입니다. 어려운 문제에 대한 정확성이 비용보다 중요할 때 사용하고, 일상적인 볼륨에는 Qwen3.7-Plus 또는 Qwen3.7-Flash로 전환하세요.

컨텍스트1M 토큰
입력text + image + video
출력text
p50 TTFT5.03 s
입력$2.00/ 100만 토큰
출력$6.00/ 100만 토큰
p50 TTFT5.03 s7일
p95 TTFT10.00 s7일
트래픽52.8M토큰 / 7일

Qwen3.8 Max는 Qwen 계열의 멀티모달 대규모 언어 모델로, 모델 ID 'qwen/qwen3.8-max'로 OrcaRouter를 통해 사용할 수 있습니다. 제공자는 qwen입니다. 컨텍스트 창은 1,000,000 토큰이므로 단일 요청에 텍스트, 이미지 또는 비디오 입력을 최대 백만 토큰까지 포함할 수 있습니다. 또한 텍스트, 이미지, 비디오…

Qwen3.8 Max란 무엇인가요?

Qwen3.8 Max는 누구를 위해 설계되었나요?

Qwen3.8 Max는 어떤 입력 모달리티를 지원하나요?

1,000,000-토큰 컨텍스트 윈도우는 무엇을 의미하나요?

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

가격

입력 / 1M tokens$2.00
출력 / 1M tokens$6.00
캐시 읽기 / 1M$0.250
캐시 쓰기 / 1M$2.50
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $32.00 · 프롬프트 캐싱 사용 시 $25.88

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.003018

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
5.03 s
출력 속도
53.7 tok/s
p95 TTFT
10.00 s
오류율
0.17%

공개 벤치마크

소스: Design Arena

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News4 회 언급 · 7일지난주 대비 4 증가

비교

Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
입력 $/100만$2.00$0.86$0.17$0.12
출력 $/100만$6.00$3.44$1.03$0.69
컨텍스트1.0M262K33K1.0M
품질9/108/108/108/10
나란히 비교나란히 비교나란히 비교나란히 비교

FAQ

Qwen3.8 Max 비용은 얼마인가요?
입력 토큰 100만 개당 $2.00, 출력 토큰 100만 개당 $6.00이며, OrcaRouter에서 마크업 없이 qwen 제공업체 요율로 청구됩니다.
Qwen3.8 Max의 컨텍스트 윈도우는 무엇입니까?
1,000,000 토큰. 입력에는 텍스트, 이미지, 비디오 콘텐츠가 해당 토큰 한도까지 포함될 수 있습니다.
Qwen3.8 Max의 장점은 무엇인가요?
주요 강점은 1,000,000-토큰 컨텍스트와 텍스트, 이미지, 비디오 입력 지원입니다. 벤치마크 점수는 나열되어 있지 않으므로, 자체 작업에서 품질을 검증하세요.
Qwen3.8 Max는 다른 모델들과 비교했을 때 어떤가요?
이 모델은 많은 소형 모델이나 텍스트 전용 모델에 비해 더 큰 컨텍스트 창과 멀티모달 입력을 제공하지만, 토큰 가격이 더 높습니다. 벤치마크 점수가 없다면 OrcaRouter에서 테스트하여 비교하세요.
OrcaRouter는 Qwen3.8 Max로 전송된 데이터를 어떻게 처리합니까?
카탈로그 항목은 데이터 처리 방식을 설명하지 않습니다. 민감한 데이터를 전송하기 전에 OrcaRouter의 개인정보 처리방침과 qwen 제공업체의 약관을 검토하십시오.
OpenAI 호환 API를 통해 Qwen3.8 Max를 어떻게 호출하나요?
기본 URL을 https://api.orcarouter.ai/v1로, 모델 ID를 'qwen/qwen3.8-max'로 설정한 다음, OrcaRouter API 키로 chat completions 요청을 보내세요.
Qwen3.8 Max는 영상을 처리할 수 있나요?
네, 비디오는 텍스트 및 이미지와 함께 입력 모달리티로 나열되어 있습니다. 비디오의 정확한 스키마는 카탈로그 항목에 명시되어 있지 않으므로 OrcaRouter로 테스트하십시오.
Qwen3.8 Max에 입력 캐싱을 사용할 수 있나요?
이 모델에는 캐싱이 명시되어 있지 않습니다. 입력 토큰은 1M 토큰당 $2.00로 청구된다고 가정합니다. 제공자가 지원하는 경우 API 사용 메타데이터에서 캐시된 토큰을 확인하세요.

이 배지 임베드

Qwen: Qwen3.8 Max$2.00/M in5029ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg" alt="OrcaRouter 의 Qwen: Qwen3.8 Max" /> </a>
Markdown [![Qwen: Qwen3.8 Max](https://www.orcarouter.ai/embed/qwen/qwen3.8-max.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max)

모델 카드를 데이터로

GET /api/public/models/qwen/qwen3.8-max열기
기계 판독 가능:/llms.txt/llms-full.txt