Qwen3.8 Max (0902)

qwen/qwen3.8-max-0902
신규
비전도구JSON추론
제공 Qwen · 2026-09-02

2026년 9월 2일자 Qwen3.8 Max의 스냅샷 — 알리바바의 대표 멀티모달 추론 모델: 텍스트 + 이미지 + 비디오 입력, 텍스트 출력, 1M 토큰 컨텍스트. 기본 모델과 동일한 기능과 가격을 제공하며, 재현 가능한 동작을 위해 버전을 고정(pin)하세요.

엔드포인트:/v1/chat/completions
컨텍스트1M 토큰
최대 출력131K
입력text + image + video
출력text
p50 TTFT1.80 s
입력$2.00/ 100만 토큰
출력$6.00/ 100만 토큰
p50 TTFT1.80 s7일
p95 TTFT2.80 s7일
트래픽9.7K토큰 / 7일

Qwen3.8 Max (0902)는 공급업체 qwen의 OrcaRouter에 등록된 모델 항목으로, 모델 ID qwen/qwen3.8-max-0902로 게시되어 있습니다. 0902 표기는 목록에 표시되어 있지만, 제공된 정보에는 이것이 릴리스 날짜, 체크포인트 또는 개정 라벨을 나타내는지에 대한 설명이 없습니다. 이것은 긴 컨텍스트를 지원하는 멀티모달…

Qwen3.8 Max (0902)는 무엇인가요?

이 모델은 누구를 대상으로 합니까?

이 모델은 어떤 입력 유형을 지원하나요?

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-max-0902",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • enable_thinking
  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • reasoning_effort
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

가격

입력 / 1M tokens$2.00
출력 / 1M tokens$6.00
캐시 읽기 / 1M$0.250
캐시 쓰기 / 1M$2.50
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $32.00 · 프롬프트 캐싱 사용 시 $25.88

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.003018

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
1.80 s
출력 속도
89.0 tok/s
p95 TTFT
2.80 s
오류율
11.1%

공개 벤치마크

소스: Design Arena

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News3 회 언급 · 7일지난주 대비 3 증가

비교

Qwen3.8 Max (0902)Qwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
입력 $/100만$2.00$2.00$0.86$0.17
출력 $/100만$6.00$6.00$3.44$1.03
컨텍스트1.0M1.0M262K33K
품질9/109/108/108/10
나란히 비교나란히 비교나란히 비교나란히 비교

FAQ

OrcaRouter에서 Qwen3.8 Max 비용은 얼마인가요?
표시된 가격은 입력 토큰 1,000,000개당 $2.00, 출력 토큰 1,000,000개당 $6.00이며, 공급업체 요율로 청구되고 마크업이 전혀 없습니다.
모델이 지원하는 컨텍스트 창과 최대 출력은 무엇인가요?
이 모델은 1,000,000-토큰 컨텍스트 창과 최대 131,072개의 토큰 출력을 지원합니다. 텍스트, 이미지, 비디오의 모든 입력 토큰은 컨텍스트 창에 포함됩니다.
이 모델이 작은 텍스트 전용 모델에 비해 가지는 주요 강점은 무엇인가요?
나열된 강점으로는 1,000,000-토큰 컨텍스트, 131,072-토큰 출력 제한, 그리고 텍스트, 이미지, 비디오 입력 양식이 있습니다. 벤치마크나 정확도 수치는 제공되지 않습니다.
이 모델은 OrcaRouter에서 다른 모델들과 어떻게 비교되나요?
제공된 사실에는 모델 간 비교가 포함되어 있지 않습니다. 컨텍스트 창, 최대 출력, 입력 모달리티, 가격을 기준으로 비교하십시오. 이 목록은 입력 토큰 1,000,000개당 $2.00, 출력 토큰 1,000,000개당 $6.00이라고 명시합니다.
이 모델을 호출할 때 OrcaRouter는 데이터를 어떻게 처리하나요?
모델 정보에는 데이터 보존 또는 데이터 처리 약관이 명시되어 있지 않습니다. 민감한 데이터를 전송하기 전에 OrcaRouter의 이용약관 및 개인정보 보호정책과 제공업체의 사용 약관을 확인하십시오.
OpenAI 호환 API를 통해 이 모델을 어떻게 호출하나요?
기본 URL https://api.orcarouter.ai/v1 및 모델 ID qwen/qwen3.8-max-0902를 사용하세요. 전체 프롬프트를 1,000,000 토큰 미만으로 유지하고 출력 제한을 131,072 토큰 이하로 설정하세요.
이 모델은 이미지나 비디오를 생성하나요?
팩트에는 출력 모달리티가 나열되어 있지 않습니다. 입력 모달리티는 텍스트, 이미지, 비디오입니다. 출력에 대한 설명은 OpenAI 호환 chat completion 내 최대 출력 토큰 제한뿐입니다.
캐시 가격이나 대량 가격이 있나요?
모델 정보에는 언급된 것이 없습니다. 목록에는 입력 토큰 1,000,000개당 $2.00, 출력 토큰 1,000,000개당 $6.00만 명시되어 있으며, 공급업체 요율로 청구되며 마크업은 없습니다.

이 배지 임베드

Qwen: Qwen3.8 Max (0902)$2.00/M in1800ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-max-0902.svg" alt="OrcaRouter 의 Qwen: Qwen3.8 Max (0902)" /> </a>
Markdown [![Qwen: Qwen3.8 Max (0902)](https://www.orcarouter.ai/embed/qwen/qwen3.8-max-0902.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-max-0902)

모델 카드를 데이터로

GET /api/public/models/qwen/qwen3.8-max-0902열기
기계 판독 가능:/llms.txt/llms-full.txt