Qwen3.8 27B

qwen/qwen3.8-27b
신규추천
비전도구JSON추론
제공 Qwen · 2026-08-13

Qwen3.8-27B는 Alibaba의 오픈 가중치(open-weight) 27B 밀집 멀티모달 모델로, Apache-2.0 라이선스로 공개되었으며 OrcaRouter 자체 인프라에서 셀프 호스팅됩니다. 텍스트, 이미지, 비디오를 입력받아 텍스트를 출력하며, Qwen3.5 아키텍처 기반의 256K 토큰 컨텍스트 창(262,144개 위치)을 갖추고 있습니다. 64개 레이어, 5120 히든 크기, 전용 비전 타워로 구성됩니다. 27B 크기임에도 불구하고 Qwen 자체 모델 카드에서 이례적으로 강력한 에이전트 및 코딩 결과를 보여줍니다. LiveCodeBench v6에서 90.3, GPQA Diamond에서 89.2, OSWorld-Verified에서 84.3, QwenSWEBench에서 79.0을 기록하며, 여러 측면에서 훨씬 더 큰 폐쇄형 모델과 경쟁력을 갖추고 있습니다. 네이티브 도구 호출, 구조화된 출력, 추론 모드, 전체 샘플링 표면을 지원합니다. 가중치가 공개되어 있고 자체적으로 실행하기 때문에 전가할 토큰별 벤더 비용이 없습니다. 이로 인해 Qwen3.8-27B는 대용량 멀티모달 작업(문서 및 스크린샷 이해, 비디오 프레임, 코딩 에이전트, 컴퓨터 사용 방식 자동화)에 강력한 기본 선택이 됩니다.

컨텍스트262K 토큰
입력text + image + video
출력text
p50 TTFT225 ms
입력$0.33/ 100만 토큰
출력$2.40/ 100만 토큰
p50 TTFT225 ms7일
p95 TTFT800 ms7일
트래픽2.3K토큰 / 7일

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.8-27b",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • frequency_penalty
  • include_reasoning
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_p

가격

입력 / 1M tokens$0.330
출력 / 1M tokens$2.40
통화USD

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $9.51

정가 기준 추정치

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.001203

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
225 ms
출력 속도
224 tok/s
p95 TTFT
800 ms
오류율
33.3%

공개 벤치마크

AndroidWorld
81.9
CharXiv (RQ)
78.8
CoWorkBench
70.7
DeepSWE 1.1
42.2
ERQA
65.5
GPQA Diamond
89.2
HLE
30.8
IFBench
79.5
JobBench
33.4
LiveCodeBench v6
90.3
NL2Repo-Bench
42.3
OmniDocBench 1.5
91.1
OSWorld-Verified
84.3
QwenSWEBench
79.0
RealWorldQA
85.9
RecreationBench
47.1
SWE-bench Pro
61.7
SWE-MM
38.6
Terminal Bench 2.1 (Terminus)
73.0
Vision2Web
62.9
WebArena-Verified
64.8
소스: huggingface.co/Qwen

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News11 회 언급 · 7일지난주 대비 10 증가

비교

Qwen3.8 27BQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
입력 $/100만$0.33$2.00$0.86$0.17
출력 $/100만$2.40$6.00$3.44$1.03
컨텍스트262K1.0M262K33K
품질4/109/108/108/10
나란히 비교나란히 비교나란히 비교나란히 비교

FAQ

OrcaRouter에서 Qwen: Qwen3.8 27B 비용은 얼마인가요?
Qwen: Qwen3.8 27B는 OrcaRouter를 통해 1M 입력 토큰당 $0.33, 1M 출력 토큰당 $2.40에 가격이 책정되어 있습니다. 가격은 라우팅 레이어에서 실시간으로 가져옵니다.
Qwen: Qwen3.8 27B의 컨텍스트 윈도우는 얼마인가요?
Qwen: Qwen3.8 27B는 262K 토큰의 컨텍스트 윈도우를 지원합니다. 해당 제한까지 롱 컨텍스트 기능(RAG, 요약)을 사용하세요.
OpenAI SDK를 통해 Qwen: Qwen3.8 27B를 호출하려면 어떻게 하나요?
OpenAI base_url을 https://api.orcarouter.ai/v1로 설정하고, OrcaRouter API 키를 제공한 후, chat.completions.create 호출에서 model="qwen/qwen3.8-27b"를 전달하세요.
OrcaRouter가 Qwen: Qwen3.8 27B를 속도 제한합니까?
모델별 속도 제한은 OrcaRouter 플랜을 따릅니다. 무료 티어는 보수적인 한도로 제공되며, 유료 티어는 한도를 높입니다. 현재 할당량은 /pricing에서 확인하세요.

이 배지 임베드

Qwen: Qwen3.8 27B$0.33/M in225ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.8-27b" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.8-27b.svg" alt="OrcaRouter 의 Qwen: Qwen3.8 27B" /> </a>
Markdown [![Qwen: Qwen3.8 27B](https://www.orcarouter.ai/embed/qwen/qwen3.8-27b.svg)](https://www.orcarouter.ai/models/qwen/qwen3.8-27b)

모델 카드를 데이터로

GET /api/public/models/qwen/qwen3.8-27b열기
기계 판독 가능:/llms.txt/llms-full.txt