Qwen3.8 Flash는 Alibaba의 멀티모달 추론 모델입니다. 코딩 지원, 에이전트 워크플로우, 시각적 이해, 문서 및 코드베이스 분석, 데스크톱 상호작용, 차트 분석, 장시간 비디오 분석에 적합합니다.
OpenAI 호환 — 쓰던 SDK 그대로
https://api.orcarouter.ai/v1import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key=os.environ["ORCAROUTER_API_KEY"],
)
response = client.chat.completions.create(
model="qwen/qwen3.8-flash",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)enable_thinkingfrequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_logprobstop_p| 입력 / 1M tokens | $0.150 |
| 출력 / 1M tokens | $0.470 |
| 캐시 읽기 / 1M | $0.018 |
| 캐시 쓰기 / 1M | $0.230 |
| 통화 | USD |
정가 기준 추정치
추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.
이번 주 개발자들의 이야기
@misc{orcarouter_qwen3_8_flash,
title = {Qwen3.8 Flash API},
author = {Qwen},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/qwen/qwen3.8-flash}
}Qwen. (2026). Qwen3.8 Flash API. OrcaRouter. https://www.orcarouter.ai/models/qwen/qwen3.8-flash