Qwen3.7 Flash

qwen/qwen3.7-flash
신규추천
비전도구JSON추론
제공 Qwen · 2026-07-27

Qwen3.7 Flash는 Alibaba의 빠르고 매우 비용 효율적인 모델로, Qwen3.7 제품군에서 Qwen3.7-Plus와 Qwen3.7-Max 아래에 위치한 고처리량 계층입니다. 입력 측에서 기본적으로 멀티모달(텍스트, 이미지, 비디오 입력 및 텍스트 출력 지원)이며, 1M 토큰 컨텍스트 윈도우와 최대 64K 출력 토큰을 제공하여 Flash 계층 가격에서도 긴 문서, 스크린샷, 비디오 프레임을 처리할 수 있습니다. 기본 계층에서 약 백만 입력 토큰당 $0.03으로 사용 가능한 가장 저렴한 1M 컨텍스트 멀티모달 모델 중 하나이며, 분류, 추출, 라우팅, 요약, 경량 에이전트 및 매우 높은 볼륨으로 실행되는 모든 파이프라인에 적합합니다. 추론 모드, 네이티브 도구 호출, response_format을 통한 구조화된 출력, 일반적인 샘플링 제어(temperature / top_p / seed / logprobs)를 지원합니다. 가격은 프롬프트 길이에 따라 계층화되어 있습니다. 32K를 초과하고 다시 256K 입력 토큰을 초과하면 비용이 증가하므로 짧은 요청을 배치 처리하는 것이 긴 요청을 패딩하는 것보다 훨씬 저렴합니다. Flash를 볼륨 작업용으로 사용하고 작업에 실제로 더 많은 기능이 필요할 때 Qwen3.7-Plus 또는 Max로 업그레이드하십시오.

컨텍스트1M 토큰
최대 출력65K
입력text + image + video
출력text
p50 TTFT2.83 s
입력$0.03/ 100만 토큰
출력$0.13/ 100만 토큰
p50 TTFT2.83 s7일
p95 TTFT9.64 s7일
트래픽13.5M토큰 / 7일

Qwen3.7 Flash는 Qwen 팀이 개발하고 OrcaRouter를 통해 제공되는 멀티모달 대규모 언어 모델입니다. 텍스트, 이미지, 비디오 입력을 처리하며 1,000,000개의 토큰 컨텍스트 창을 지원하고 최대 65,536개의 토큰을 출력할 수 있습니다. "Flash"라는 명칭은 Qwen 제품군의 더 큰 모델에 비해 지연 시간이 낮고 처리량이 높도록…

Qwen3.7 Flash란 무엇이며, 누가 사용해야 할까요?

Qwen3.7 Flash는 어떤 입력 모드를 지원하나요?

Qwen3.7 Flash의 컨텍스트 윈도우 크기는 얼마인가요?

Qwen3.7 Flash가 OrcaRouter를 통해 어떻게 접근되나요?

코드 샘플

어떤 SDK에서도 호출

OpenAI 호환 — 쓰던 SDK 그대로

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

지원되는 매개변수

  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

가격

등급입력 / 1M tokens출력 / 1M tokens캐시 읽기 / 1M캐시 쓰기 / 1M
32K$0.030$0.130$0.0060$0.038
256K$0.100$0.400$0.020$0.125
$0.200$0.800$0.040$0.250
등급은 요청별 입력 토큰 수에 따라 결정됩니다

비용 계산기

월 토큰 수10MM
입력 비율70%%
월 예상 $0.600 · 프롬프트 캐싱 사용 시 $0.516

정가 기준 추정치

구간별 요금제 — 이 추정치는 기본 구간 요율을 사용합니다.

토큰 및 비용 추정기

입력 토큰: 9요청당 비용: $0.000065

추정치일 뿐입니다 — 실제 토큰 수는 제공자의 토크나이저에 따라 달라집니다.

성능

p50 TTFT
2.83 s
출력 속도
333 tok/s
p95 TTFT
9.64 s
오류율
0%

공개 벤치마크

소스: Design Arena

커뮤니티 화제

이번 주 개발자들의 이야기

Hacker News0 회 언급 · 7일

비교

Qwen3.7 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
입력 $/100만$0.03$0.86$0.17$0.12
출력 $/100만$0.13$3.44$1.03$0.69
컨텍스트1.0M262K33K1.0M
품질7/108/108/108/10
나란히 비교나란히 비교나란히 비교나란히 비교

FAQ

OrcaRouter에서 Qwen3.7 Flash 비용은 얼마인가요?
이용 가능한 정보에는 Qwen3.7 Flash에 대한 구체적인 가격이 제공되지 않습니다. OrcaRouter는 일반적으로 입력 및 출력 토큰당 요금을 부과합니다. Flash 모델로서 플래그십 모델보다 가격이 낮을 가능성이 높습니다. 현재 요금을 확인하려면 OrcaRouter의 가격 페이지를 방문하거나 지원팀에 문의하십시오.
Qwen3.7 Flash의 컨텍스트 윈도우 크기는 얼마인가요?
컨텍스트 창은 1,000,000개의 토큰입니다. 이를 통해 모델은 매우 긴 문서, 확장된 대화, 또는 많은 양의 이미지/비디오를 단일 프롬프트에서 처리할 수 있습니다.
Qwen3.7 Flash의 장점은 무엇인가요?
그 강점으로는 1M-토큰 컨텍스트, 멀티모달 입력 지원(텍스트, 이미지, 비디오), 최대 65k 출력 토큰, 속도와 비용의 균형을 맞춘 최적화된 'Flash' 아키텍처가 포함됩니다. 장문 문서 분석 및 멀티모달 이해에 적합합니다.
Qwen3.7 Flash는 GPT-4o-mini와 어떻게 비교됩니까?
Qwen3.7 Flash는 상당히 더 큰 컨텍스트 윈도우(1M 대 128k)와 더 높은 최대 출력(65k 대 16k)을 제공합니다. GPT-4o-mini는 더 넓은 생태계 지원을 가질 수 있습니다. 가격이나 벤치마크 모두 직접 비교를 위해 제공되지 않습니다.
OrcaRouter는 비용 절감을 위해 프롬프트를 캐시하나요?
OrcaRouter는 프롬프트 캐싱을 제공할 수 있지만, Qwen3.7 Flash에 대한 구체적인 정책은 사실에 명시되어 있지 않습니다. 캐시 적중 표시기와 할인 정보는 OrcaRouter의 문서를 확인하세요.
Qwen3.7 Flash를 OpenAI 호환 API를 사용하여 어떻게 호출하나요?
기본 URL을 https://api.orcarouter.ai/v1로 설정하고 모델 ID "qwen/qwen3.7-flash"를 사용하세요. OrcaRouter API 키를 포함하세요. 채팅 완료 엔드포인트는 표준 OpenAI 매개변수와 함께 작동합니다. 멀티모달 입력의 경우 메시지 내용 배열에 이미지 또는 비디오 객체를 추가하세요.
Qwen3.7 Flash는 어떤 입력 모드를 지원하나요?
텍스트, 이미지 및 비디오 입력을 지원합니다. 이를 통해 이미지와 텍스트를 함께 분석하거나, 비디오를 요약하고, 단일 프롬프트에서 여러 미디어 유형을 결합하는 등의 작업이 가능합니다.
내 데이터로 Qwen3.7 Flash를 파인튜닝할 수 있나요?
사용 가능한 사실들은 파인튜닝 기능에 대해 언급하지 않습니다. OrcaRouter를 통해 API로 접근하는 모델로서 파인튜닝은 지원되지 않을 가능성이 높습니다. 맞춤형 파인튜닝을 위해서는 오픈소스 대안을 고려하세요.
Qwen3.7 Flash의 최대 출력 길이는 얼마인가요?
최대 출력은 65,536토큰입니다. 이를 통해 단일 API 호출에서 매우 긴 응답, 보고서 또는 코드를 생성할 수 있습니다.
Qwen3.7 Flash로 비디오 입력을 어떻게 처리하나요?
구체적인 비디오 처리 세부 정보는 제공되지 않습니다. 일반적으로 비디오 입력은 프레임 시퀀스로 처리됩니다. 비디오를 일련의 이미지로 전처리한 후 이미지 URL 또는 base64 데이터로 전달해야 할 수도 있습니다. 정확한 형식은 OrcaRouter의 문서를 참조하십시오.

이 배지 임베드

Qwen: Qwen3.7 Flash$0.03/M in2828ms p50OrcaRouter를 통해
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg" alt="OrcaRouter 의 Qwen: Qwen3.7 Flash" /> </a>
Markdown [![Qwen: Qwen3.7 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-flash)

모델 카드를 데이터로

GET /api/public/models/qwen/qwen3.7-flash열기
기계 판독 가능:/llms.txt/llms-full.txt