qwen/qwen3.5-flash

qwen/qwen3.5-flash
ЗрениеИнструментыJSONРассуждение
от qwen

Qwen3.5 Flash — мультимодальный чат (текст/изображение/видео), оптимизированный по стоимости, контекст 1M.

Эндпоинты:/v1/chat/completions
конт.1M токенов
Макс. вывод65K
Вводtext + image + video
Выводtext
p50 TTFT2.71 s
ВХОД$0.10/ 1M токенов
ВЫХОД$0.40/ 1M токенов
p50 TTFT2.71 s7 д
p95 TTFT10.00 s7 д
ТРАФИК1.3Mтокенов / 7 д

Qwen3.5 Flash — это мультимодальная языковая модель из семейства Qwen, предназначенная для быстрого вывода и низкой стоимости. Она принимает текстовые, графические и видео входные данные и генерирует…

Что такое Qwen3.5 Flash?

Для кого эта модель?

Ключевые характеристики с первого взгляда

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="qwen/qwen3.5-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Поддерживаемые параметры

  • enable_search
  • enable_thinking
  • include_reasoning
  • logprobs
  • max_tokens
  • n
  • parallel_tool_calls
  • presence_penalty
  • reasoning
  • repetition_penalty
  • response_format
  • seed
  • stop
  • stream
  • stream_options
  • temperature
  • thinking_budget
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Цены

Ввод / 1M токенов$0.100
Вывод / 1M токенов$0.400
ВалютаUSD

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $1.90

Оценка по прайс-листу

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.000202

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
2.71 s
Скорость вывода
206 tok/s
p95 TTFT
10.00 s
Частота ошибок
7.3%

Публичные тесты

Источник: Design Arena

Обсуждения в сообществе

О чём говорят разработчики на этой неделе

Hacker News0 упоминаний · 7 дн

Сравнение

qwen/qwen3.5-flashQwen3.8 Maxqwen/qwen3-max-previewQwen3.5 397B A17B
Ввод $/млн$0.10$2.00$0.86$0.17
Вывод $/млн$0.40$6.00$3.44$1.03
Контекст1.0M1.0M262K33K
Качество6/109/108/108/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от qwen

FAQ

Какова стоимость использования Qwen3.5 Flash на OrcaRouter?
Стоимость составляет $0,10 за 1 миллион входных токенов и $0,40 за 1 миллион выходных токенов. Это тариф провайдера с нулевой наценкой OrcaRouter. Вы платите ровно то, что взимает провайдер, без дополнительных сборов.
Какой размер контекстного окна?
Окно контекста составляет 1,048,576 токенов (примерно 1 миллион токенов). Это включает как входные, так и выходные токены за всю историю разговора. Максимальный вывод за одну генерацию составляет 65,536 токенов.
Каковы сильные стороны Qwen3.5 Flash?
Преимущества включают мультимодальный ввод (текст, изображение, видео), очень большое контекстное окно в 1M, длинный вывод в 65K токенов, низкую стоимость за токен и быстрый инференс по сравнению с более крупными моделями Qwen. Она идеально подходит для высоконагруженных или мультимодальных задач в реальном времени.
Как это соотносится с более крупными моделями Qwen?
Более крупные модели Qwen, такие как Qwen3.5-72B, обеспечивают более высокую точность при сложных рассуждениях, но работают медленнее и стоят дороже. Qwen3.5 Flash жертвует некоторой точностью ради скорости и экономической эффективности, сохраняя при те же мультимодальные возможности и способность обрабатывать длинные контексты.
Начисляет ли OrcaRouter наценку на цены провайдера?
Нет. Ценообразование осуществляется по тарифу провайдера без наценки. Вы платите ровно $0.10 за 1 млн входных токенов и $0.40 за 1 млн выходных токенов для Qwen3.5 Flash через OrcaRouter.
Могу ли я вызвать Qwen3.5 Flash с помощью API, совместимого с OpenAI?
Да. OrcaRouter предоставляет endpoint, совместимый с OpenAI, по адресу https://api.orcarouter.ai/v1. Используйте идентификатор модели "qwen/qwen3.5-flash" с вашим ключом API OrcaRouter. Форматы запроса и ответа соответствуют API чат-завершений OpenAI.
Как работает обработка данных в OrcaRouter?
Политики обработки данных определяются OrcaRouter и Qwen. Запись в каталоге не предоставляет конкретных деталей. Пользователи должны ознакомиться с политикой конфиденциальности OrcaRouter и условиями использования данных Qwen перед отправкой конфиденциальных данных.
Какие модальности поддерживает модель?
Он поддерживает ввод текста, изображений и видео. Изображения могут быть предоставлены в виде URL-адресов или данных в формате base64 в сообщении пользователя. Видеовход обычно отправляется в виде последовательности кадров (изображений). Модель генерирует только текстовый вывод.
Требуется ли минимальное или максимальное количество токенов?
Минимальное количество токенов отсутствует. Максимальное количество входных токенов (включая историю беседы) составляет 1 048 576 токенов. Максимальное количество выходных токенов на один ответ составляет 65 536. Используйте параметр max_tokens для управления длиной выходного текста.
Как начать вызывать эту модель через OrcaRouter?
Зарегистрируйтесь в OrcaRouter, чтобы получить ключ API. Установите базовый URL https://api.orcarouter.ai/v1 в своём коде. Используйте идентификатор модели "qwen/qwen3.5-flash" и отправьте стандартный запрос завершения чата с вашим мультимодальным контентом. Обратитесь к документации OrcaRouter за примерами.

Встроить значок

qwen/qwen3.5-flash$0.10/M in2705ms p50через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/qwen/qwen3.5-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg" alt="qwen/qwen3.5-flash в OrcaRouter" /> </a>
Markdown [![qwen/qwen3.5-flash](https://www.orcarouter.ai/embed/qwen/qwen3.5-flash.svg)](https://www.orcarouter.ai/models/qwen/qwen3.5-flash)

Карточка модели в виде данных

GET /api/public/models/qwen/qwen3.5-flashОткрыть
Машиночитаемо:/llms.txt/llms-full.txt