Qwen3.7 Plus

qwen/qwen3.7-plus
추천
비전도구JSON추론
제공 Qwen · 2026-06-01

Qwen3.7-Plus는 알리바바의 가장 강력한 멀티모달 에이전트 모델로, 비전과 언어를 하나의 다재다능한 에이전트 기반으로 통합합니다. Qwen3.7 텍스트 백본을 기반으로 구축되어 비전-언어 이해에서 포괄적인 업그레이드를 제공하면서도 코딩, 도구 사용 및 생산성 워크플로우에서 완전한 에이전트 능력을 유지합니다. 텍스트, 이미지, 비디오 입력을 받아 텍스트를 출력하며, 최대 65K 출력 토큰과 함께 1M-토큰 컨텍스트 윈도우를 제공하므로 긴 문서, 대규모 코드베이스, 화면 녹화 및 다중 턴 에이전트 세션을 자르지 않고 일관성 있게 유지할 수 있습니다. 차별점은 멀티모달 대화형 하이브리드 에이전트로 작동할 수 있다는 점입니다. 즉, 실제 장면을 인식하고, 화면을 읽고 GUI를 조작하며, 시각적 참조로부터 코드를 작성하고, 모바일 앱을 처음부터 끝까지 탐색하며, 웹 지식을 바탕으로 시각적 질문에 답변합니다. 단일 에이전트 루프 내에서 GUI와 CLI 상호작용을 혼합합니다. 에이전트 스캐폴드 전반에 걸쳐 일반화되어 Claude Code, OpenClaw, Qwen Code 또는 기타 프레임워크를 통해 구동될 때 일관된 성능을 발휘하며, 기본 함수 호출, 구조화된 출력 및 제어 가능한 추론 깊이를 제공합니다. 이는 AI 코딩 어시스턴트, 컴퓨터 사용 및 브라우저 에이전트, 시각적 QA 파이프라인, 그리고 지각, 추론 및 실행이 정렬되어야 하는 장기 실행 자동화를 위한 신뢰할 수 있는 기본 모델이 됩니다.

엔드포인트:/v1/chat/completions
컨텍스트1M 토큰
최대 출력65.5K
입력text + image + video
출력text
p50 TTFT5.97 s
입력$0.35/ 100만 토큰
출력$1.42/ 100만 토큰
p50 TTFT5.97 s7일
p95 TTFT10.00 s7일
트래픽2.4M토큰 / 7일

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-plus",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • include_reasoning
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_p

가격

등급입력 / 1M tokens출력 / 1M tokens캐시 읽기 / 1M
256K$0.350$1.42$0.071
$1.06$4.25$0.210
등급은 요청별 입력 토큰 수에 따라 결정됩니다

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $6.71 · 프롬프트 캐싱 사용 시 $5.73

정가 기준 추정치

구간별 요금제 — 이 추정치는 기본 구간 요율을 사용합니다.

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.000713

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
5.97 s
출력 속도
74.9 tok/s
p95 TTFT
10.00 s
오류율
0%

공개 벤치마크

55.9
AA Coding
비교된 모델 중 70%보다 우수
120개 중 36위
39.0
AA Intelligence
비교된 모델 중 63%보다 우수
122개 중 45위
58.7
AA Math
비교된 모델 중 40%보다 우수
81개 중 49위
AndroidWorld
81.0
BFCL-V4
72.9
Deep-Planning
62.3
GPQA Diamond
90.0
HLE
34.7
HMMT 2026 Feb
92.9
Humanity's Last Exam
33.4
IFBench
78.0
IFEval
94.6
IMOAnswerBench
86.0
LiveCodeBench
89.6
Long-Context Recall
65.0
MathVision
90.3
MCP-Atlas
73.2
MLVU (M-Avg)
87.4
MMLU-Pro
65.7 index
MMMU-Pro
79.0
MRCR-v2 128k
91.7
OCR-Bench-V2(EN)
70.7
OSWorld-Verified
73.3
RealWorldQA
86.9
SciCode
45.5
ScreenSpot Pro
79.0
SpreadSheetBench-v1
86.3
SWE-Pro
57.6
SWE-Verified
77.7
tau_banking
17.9
Terminal Bench 2.0-Terminus
70.3
TerminalBench Hard
47.0
terminalbench_v2_1
61.0
VideoMME (w/ sub.)
88.0
τ²-Bench
93.0
소스: artificialanalysis.ai, qwen.ai

비교

Qwen3.7 Plusqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
입력 $/100만$0.35$0.86$0.17$0.12
출력 $/100만$1.42$3.44$1.03$0.69
컨텍스트1.0M262K33K1.0M
품질8/108/108/108/10
나란히 비교나란히 비교나란히 비교나란히 비교

FAQ

OrcaRouter에서 Qwen: Qwen3.7 Plus 비용은 얼마인가요?
Qwen: Qwen3.7 Plus는 OrcaRouter를 통해 1M 입력 토큰당 $0.35, 1M 출력 토큰당 $1.42에 가격이 책정되어 있습니다. 가격은 라우팅 레이어에서 실시간으로 가져옵니다.
Qwen: Qwen3.7 Plus의 컨텍스트 윈도우는 얼마인가요?
Qwen: Qwen3.7 Plus는 1M 토큰의 컨텍스트 윈도우를 지원합니다. 해당 제한까지 롱 컨텍스트 기능(RAG, 요약)을 사용하세요.
OpenAI SDK를 통해 Qwen: Qwen3.7 Plus를 호출하려면 어떻게 하나요?
OpenAI base_url을 https://api.orcarouter.ai/v1로 설정하고, OrcaRouter API 키를 제공한 후, chat.completions.create 호출에서 model="qwen/qwen3.7-plus"를 전달하세요.
OrcaRouter가 Qwen: Qwen3.7 Plus를 속도 제한합니까?
모델별 속도 제한은 OrcaRouter 플랜을 따릅니다. 무료 티어는 보수적인 한도로 제공되며, 유료 티어는 한도를 높입니다. 현재 할당량은 /pricing에서 확인하세요.

이 배지 임베드

Qwen: Qwen3.7 Plus$0.35/M in5967ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-plus" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-plus.svg" alt="OrcaRouter 의 Qwen: Qwen3.7 Plus" /> </a>
Markdown [![Qwen: Qwen3.7 Plus](https://www.orcarouter.ai/embed/qwen/qwen3.7-plus.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-plus)

모델 카드를 데이터로

GET /api/public/models/qwen/qwen3.7-plus열기
기계 판독 가능:/llms.txt/llms-full.txt