Qwen3.8 Flash

qwen/qwen3.8-flash
신규추천
비전도구JSON추론
제공 Qwen · 2026-08-26

Qwen3.8 Flash는 Alibaba의 멀티모달 추론 모델입니다. 코딩 지원, 에이전트 워크플로우, 시각적 이해, 문서 및 코드베이스 분석, 데스크톱 상호작용, 차트 분석, 장시간 비디오 분석에 적합합니다.

엔드포인트:/v1/chat/completions
컨텍스트1M 토큰
최대 출력131K
입력text + image + video
출력text
p50 TTFT4.25 s
입력$0.15/ 100만 토큰
출력$0.47/ 100만 토큰
p50 TTFT4.25 s7일
p95 TTFT10.00 s7일
트래픽1.0M토큰 / 7일

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • enable_thinking
  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

가격

입력 / 1M tokens$0.150
출력 / 1M tokens$0.470
캐시 읽기 / 1M$0.018
캐시 쓰기 / 1M$0.230
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $2.46 · 프롬프트 캐싱 사용 시 $2.00

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.000236

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
4.25 s
출력 속도
119 tok/s
p95 TTFT
10.00 s
오류율
0%

공개 벤치마크

소스: Design Arena

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News9 회 언급 · 7일지난주 대비 9 증가

비교

Qwen3.8 FlashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
입력 $/100만$0.15$2.00$0.86$0.17
출력 $/100만$0.47$6.00$3.44$1.03
컨텍스트1.0M1.0M262K33K
품질7/109/108/108/10
나란히 비교나란히 비교나란히 비교나란히 비교

FAQ

OrcaRouter에서 Qwen: Qwen3.8 Flash 비용은 얼마인가요?
Qwen: Qwen3.8 Flash는 OrcaRouter를 통해 1M 입력 토큰당 $0.15, 1M 출력 토큰당 $0.47에 가격이 책정되어 있습니다. 가격은 라우팅 레이어에서 실시간으로 가져옵니다.
Qwen: Qwen3.8 Flash의 컨텍스트 윈도우는 얼마인가요?
Qwen: Qwen3.8 Flash는 1M 토큰의 컨텍스트 윈도우를 지원합니다. 해당 제한까지 롱 컨텍스트 기능(RAG, 요약)을 사용하세요.
OpenAI SDK를 통해 Qwen: Qwen3.8 Flash를 호출하려면 어떻게 하나요?
OpenAI base_url을 https://api.orcarouter.ai/v1로 설정하고, OrcaRouter API 키를 제공한 후, chat.completions.create 호출에서 model="qwen/qwen3.8-flash"를 전달하세요.
OrcaRouter가 Qwen: Qwen3.8 Flash를 속도 제한합니까?
모델별 속도 제한은 OrcaRouter 플랜을 따릅니다. 무료 티어는 보수적인 한도로 제공되며, 유료 티어는 한도를 높입니다. 현재 할당량은 /pricing에서 확인하세요.

이 배지 임베드

Qwen: Qwen3.8 Flash$0.15/M in4250ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg" alt="OrcaRouter 의 Qwen: Qwen3.8 Flash" /> </a>
Markdown [![Qwen: Qwen3.8 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.8-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-flash)

모델 카드를 데이터로

GET /api/public/models/qwen/qwen3.8-flash열기
기계 판독 가능:/llms.txt/llms-full.txt