Qwen3.7 Flash

qwen/qwen3.7-flash
НовинкаРекомендуем
ЗрениеИнструментыJSONРассуждение
от Qwen · 2026-07-27

Qwen3.7 Flash — это быстрая и чрезвычайно экономичная модель от Alibaba из семейства Qwen3.7, которая находится ниже Qwen3.7-Plus и Qwen3.7-Max как уровень с высокой пропускной способностью. Она изначально мультимодальна на стороне входа — принимает текст, изображения и видео с текстовым выводом — и обслуживает контекстное окно в 1M токенов с возможностью генерации до 64K выходных токенов, так что длинные документы, скриншоты и видеокадры остаются доступными даже по цене уровня Flash. При цене примерно $0.03 за миллион входных токенов на базовом тарифе это одна из самых дешёвых мультимодальных моделей с контекстом в 1M, что делает её естественным выбором для классификации, извлечения, маршрутизации, суммаризации, лёгких агентов и любых пайплайнов с очень высоким объёмом. Она поддерживает режим рассуждений, встроенный вызов инструментов, структурированные выходные данные через response_format и обычные параметры сэмплирования (temperature / top_p / seed / logprobs). Обратите внимание, что цены различаются в зависимости от длины запроса: стоимость возрастает при длине свыше 32K и ещё раз свыше 256K входных токенов, поэтому пакетная обработка коротких запросов значительно дешевле, чем дополнение длинных. Используйте Flash как рабочую лошадку для больших объёмов и переходите на Qwen3.7-Plus или Max, когда задача действительно требует больших возможностей.

конт.1M токенов
Макс. вывод65K
Вводtext + image + video
Выводtext
p50 TTFT2.83 s
ВХОД$0.03/ 1M токенов
ВЫХОД$0.13/ 1M токенов
p50 TTFT2.83 s7 д
p95 TTFT9.64 s7 д
ТРАФИК13.5Mтокенов / 7 д

Qwen3.7 Flash — это мультимодальная большая языковая модель, созданная командой Qwen и доступная через OrcaRouter. Она обрабатывает текстовые, графические и видеовходные данные, поддерживает…

Что такое Qwen3.7 Flash и кому следует его использовать?

Какие входные модальности поддерживает Qwen3.7 Flash?

Какой размер контекстного окна у Qwen3.7 Flash?

Как осуществляется доступ к Qwen3.7 Flash через OrcaRouter?

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Поддерживаемые параметры

  • include_reasoning
  • logprobs
  • max_tokens
  • presence_penalty
  • reasoning
  • response_format
  • seed
  • temperature
  • tool_choice
  • tools
  • top_logprobs
  • top_p

Цены

УровеньВвод / 1M токеновВывод / 1M токеновЧтение кэша / 1MЗапись кэша / 1M
32K$0.030$0.130$0.0060$0.038
256K$0.100$0.400$0.020$0.125
$0.200$0.800$0.040$0.250
Уровень выбирается по количеству входных токенов запроса

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $0.600 · С кэшем промптов $0.516

Оценка по прайс-листу

Многоуровневые цены — оценка использует базовый уровень.

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.000066

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
2.83 s
Скорость вывода
333 tok/s
p95 TTFT
9.64 s
Частота ошибок
0%

Публичные тесты

Источник: Design Arena

Обсуждения в сообществе

О чём говорят разработчики на этой неделе

Hacker News0 упоминаний · 7 дн

Сравнение

Qwen3.7 Flashqwen/qwen3-max-previewQwen3.5 397B A17Bqwen/qwen3.5-plus
Ввод $/млн$0.03$0.86$0.17$0.12
Вывод $/млн$0.13$3.44$1.03$0.69
Контекст1.0M262K33K1.0M
Качество7/108/108/108/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от Qwen

FAQ

Сколько стоит Qwen3.7 Flash на OrcaRouter?
Конкретные цены на Qwen3.7 Flash не указаны в доступных фактах. OrcaRouter обычно взимает плату за токен на ввод и вывод. Будучи Flash-моделью, она, вероятно, стоит дешевле, чем флагманские модели. Посетите страницу цен OrcaRouter или обратитесь в службу поддержки, чтобы узнать текущие тарифы.
Какой размер контекстного окна у Qwen3.7 Flash?
Контекстное окно составляет 1,000,000 токенов. Это позволяет модели обрабатывать очень длинные документы, продолжительные беседы или большие наборы изображений/видео в одном запросе.
Каковы сильные стороны Qwen3.7 Flash?
К его сильным сторонам относятся контекст в 1 млн токенов, поддержка мультимодального ввода (текст, изображение, видео), до 65 тыс. выходных токенов и оптимизированная архитектура «Flash», обеспечивающая баланс скорости и стоимости. Он хорошо подходит для анализа длинных документов и мультимодального понимания.
Как Qwen3.7 Flash сравнивается с GPT-4o-mini?
Qwen3.7 Flash предлагает значительно больший контекстный окно (1M против 128k) и более высокий максимальный вывод (65k против 16k). GPT-4o-mini может иметь более широкую поддержку экосистемы. Ни цены, ни бенчмарки не предоставлены для прямого сравнения.
Кеширует ли OrcaRouter промпты для снижения затрат?
OrcaRouter может предлагать кэширование промптов, но его конкретная политика для Qwen3.7 Flash не описана в фактах. Проверьте документацию OrcaRouter на предмет индикаторов попадания в кэш и информации о скидках.
Как вызвать Qwen3.7 Flash через API, совместимый с OpenAI?
Установите базовый URL на https://api.orcarouter.ai/v1 и используйте идентификатор модели "qwen/qwen3.7-flash". Включите ваш API-ключ OrcaRouter. Конечная точка чат-завершений работает со стандартными параметрами OpenAI. Для мультимодального ввода добавьте объекты изображений или видео в массив содержимого сообщения.
Какие входные модальности поддерживает Qwen3.7 Flash?
Он поддерживает ввод текста, изображений и видео. Это позволяет выполнять такие задачи, как анализ изображений вместе с текстом, создание сводок видео и объединение нескольких типов медиа в одном запросе.
Могу ли я дообучить Qwen3.7 Flash на своих собственных данных?
Доступные факты не упоминают возможности тонкой настройки. Как модель, доступная через API с помощью OrcaRouter, тонкая настройка, вероятно, не поддерживается. Для индивидуальной тонкой настройки рассмотрите альтернативы с открытым исходным кодом.
Какая максимальная длина вывода у Qwen3.7 Flash?
Максимальный вывод составляет 65,536 токенов. Это позволяет генерировать очень длинные ответы, отчеты или код в одном вызове API.
Как обрабатывать видеовходы с Qwen3.7 Flash?
Конкретные детали обработки видео не предоставлены. Обычно видеофайлы обрабатываются как последовательности кадров. Возможно, потребуется предварительно преобразовать видео в серию изображений и передать их в виде URL-адресов изображений или данных в формате base64. Обратитесь к документации OrcaRouter за точными указаниями по форматированию.

Встроить значок

Qwen: Qwen3.7 Flash$0.03/M in2828ms p50через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.7-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg" alt="Qwen: Qwen3.7 Flash в OrcaRouter" /> </a>
Markdown [![Qwen: Qwen3.7 Flash](https://www.orcarouter.ai/embed/qwen/qwen3.7-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.7-flash)

Карточка модели в виде данных

GET /api/public/models/qwen/qwen3.7-flashОткрыть
Машиночитаемо:/llms.txt/llms-full.txt