DeepSeek V4.1 Flash

deepseek/deepseek-v4.1-flash
НовинкаРекомендуем
ЗрениеИнструментыJSONРассуждение
от DeepSeek · 2026-09-10

DeepSeek-V4.1-Flash — самая компактная модель в новой архитектурной линейке DeepSeek, выпущенная 10 сентября 2026 года, с нативным мультимодальным визуальным пониманием — производственный преемник как V4 Flash, так и эксперимента V4 Flash Vision. Новая архитектура нацелена на более высокий потолок возможностей, более быстрый инференс и более высокую пропускную способность; DeepSeek сообщает, что V4.1 Flash всесторонне превосходит V4 Pro по производительности, стоимости, скорости и общему времени выполнения задач. Модель принимает текст и изображения с выводом текста, обслуживает контекстное окно на 1 млн токенов с объёмом вывода до 384 тыс. токенов, поддерживает режимы рассуждения (по умолчанию, с выбираемым уровнем усилий низкий / высокий / максимальный) и без рассуждения в API Chat Completions, Responses и Anthropic-совместимом API, а также вывод JSON, инструментальные вызовы и завершение префикса в чате; FIM работает только в режиме без рассуждения. Веса модели открыты на Hugging Face (deepseek-ai/DeepSeek-V4.1-Flash). Официальные бенчмарки на момент выпуска: 90.6 на Terminal-Bench 2.1, 74.2 на DeepSWE v1.1, 65.4 на NL2Repo-Bench, 90.9 на GPQA Diamond, 63.9 на HLE с инструментами и сильные результаты нативных агентов с визуальным восприятием (89.6 BabyVision, 78.9 Chartography с инструментами). Цены были снижены одновременно с выпуском: $0.15/млн на вход (промах кэша), $0.60/млн на выход и $0.003/млн при попадании в кэш по тарифам вне пиковых часов, с удвоением в пиковые часы будних дней (01:00–04:00 и 06:00–10:00 UTC); все остальные часы, включая выходные, считаются внепиковыми.

конт.1M токенов
Макс. вывод384K
Вводtext + image
Выводtext
p50 TTFT412 ms
ВХОД$0.15/ 1M токенов
ВЫХОД$0.60/ 1M токенов
p50 TTFT412 ms7 д
p95 TTFT1.60 s7 д
ТРАФИК299.5Mтокенов / 7 д

DeepSeek V4.1 Flash — это модель DeepSeek, доступная через OrcaRouter, API-шлюз, совместимый с OpenAI. Она принимает текстовый и графический ввод, имеет контекстное окно в 1 048 576 токенов и может…

Что такое DeepSeek V4.1 Flash?

Для кого создан DeepSeek V4.1 Flash?

Почему контекстное окно на 1,048,576 токенов имеет значение?

Примеры кода

Вызов из любого SDK

Совместимо с OpenAI — оставьте свой SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4.1-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Поддерживаемые параметры

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Цены

Цены
Ввод / 1M токенов · Внепиковое время$0.150
Вывод / 1M токенов · Внепиковое время$0.600
Чтение кэша / 1M · Внепиковое время$0.0030
Пиковые часы01:00–04:00, 06:00–10:00 ×2 (UTC)
Ввод / 1M токенов · ×2$0.300
Вывод / 1M токенов · ×2$1.20
Чтение кэша / 1M · ×2$0.0060
ВалютаUSD

Калькулятор стоимости

Токенов / месяц10MM
Доля ввода70%%
Оценка / месяц $2.85 · С кэшем промптов $2.34

Оценка по прайс-листу

Оценка токенов и стоимости

Токены ввода: 19Стоимость за запрос: $0.000303

Только оценка — фактическое число токенов зависит от токенизатора провайдера.

Производительность

p50 TTFT
412 ms
Скорость вывода
215 tok/s
p95 TTFT
1.60 s
Частота ошибок
0.07%

Публичные тесты

Agents' Last Exam
31.8
Automation-Bench
54.8
BabyVision (with tools)
89.6
Chartography (with tools)
78.9
CyberGym
88.1
DeepSWE v1.1
74.2
ExploitGym
15.3
GPQA Diamond
90.9
HLE
36.8
HLE (with tools)
63.9
MathArena Apex
65.6
NL2Repo-Bench
65.4
ProgramBench
20.3
SEC-Bench Pro
62.8
Terminal-Bench 2.1
90.6
Terminal-Bench 3.0
30.0
Terminal-Bench 4.0
31.2
ZeroBench-main (with tools)
49.0
Источник: api-docs.deepseek.com

Обсуждения в сообществе

О чём говорят разработчики на этой неделе

Hacker News13 упоминаний · 7 днрост на 13 к прошлой неделе

Сравнение

DeepSeek V4.1 FlashDeepSeek V4 ProDeepSeek V4 FlashDeepSeek V4 Flash Vision (Exp)
Ввод $/млн$0.15$0.73$0.24$0.24
Вывод $/млн$0.60$2.18$0.73$0.73
Контекст1.0M1.0M1.0M1.0M
Качество8/108/107/107/10
Сравнить бок о бокСравнить бок о бокСравнить бок о бокСравнить бок о бок

Больше от DeepSeek

FAQ

Сколько стоит DeepSeek V4.1 Flash на OrcaRouter?
OrcaRouter тарифицирует DeepSeek V4.1 Flash по цене $0,15 за 1 млн входных токенов и $0,60 за 1 млн выходных токенов, передавая по тарифу провайдера без наценки. Отдельная плата за само контекстное окно не описана: 1 048 576 токенов — это ограничение, а не плата. Входные токены включают текст, изображения и историю переписки, которую вы отправляете; выходные токены охватывают всё сгенерированное, до 384 000 токенов.
Насколько велики контекстное окно и максимальный объём вывода?
DeepSeek V4.1 Flash имеет контекстное окно размером 1 048 576 токенов и максимальный объём вывода 384 000 токенов. Входное окно позволяет отправить целые документы, расшифровки или снимки репозитория за один вызов, а предел вывода поддерживает длинные артефакты, создаваемые за один проход, такие как спецификации, планы миграции или расширенные diff-файлы.
В чём DeepSeek V4.1 Flash лучше всего?
Он создан для работы с длинными входными и выходными данными: анализа целых документов, понимания кода в больших репозиториях, мультимодальной проверки текста вместе с изображениями и рабочих процессов, которым требуются содержательные сгенерированные ответы, а не короткие реплики. Его оценка 90,9 на GPQA Diamond также указывает на прочные научные и технические рассуждения уровня выпускника. Входные данные поддерживают как текст, так и изображения; выходные данные — только текст.
Как она сравнивается с более крупными передовыми моделями?
Фронтирные модели могут лидировать на самых сложных бенчмарках рассуждений и обычно стоят дороже за токен, тогда как DeepSeek V4.1 Flash предлагает контекстное окно размером 1 048 576 токенов и потолок вывода в 384 000 токенов по цене $0.15 за 1 млн входных и $0.60 за 1 млн выходных токенов. Для работы с длинным контекстом и большими объёмами это часто практичный выбор; для самых сложных отдельных шагов рассуждения маршрутизация таких вызовов на более дорогую модель в OrcaRouter — разумный паттерн.
Как обрабатываются данные, когда я вызываю эту модель?
OrcaRouter направляет запросы в API DeepSeek и выставляет счёт по тарифу провайдера без наценки. Условия хранения, использования для обучения и связанные с этим условия регулируются политиками провайдера, а не отдельным соглашением, описанным здесь, поэтому перед отправкой конфиденциальных материалов ознакомьтесь с текущими условиями провайдера. Удалите идентификаторы, которые вам не нужны, и сокращайте промпты до минимума, необходимого для задачи; меньший контекст также снижает стоимость ввода — $0.15 за 1 млн токенов.
Как вызвать это через OpenAI-совместимый API?
Установите базовый URL вашего клиента на https://api.orcarouter.ai/v1 и используйте идентификатор модели deepseek/deepseek-v4.1-flash с вашим ключом API OrcaRouter. Запросы и ответы соответствуют схеме OpenAI chat completions, поэтому существующие SDK, обработчики потоковой передачи и разбор tool-call работают без изменений. Миграция обычно сводится к изменению базового URL и строки модели, а также к повторному запуску вашего оценочного набора.
Может ли DeepSeek V4.1 Flash принимать изображения?
Да. Поддержка ввода изображений реализована через стандартный массив мультимодального содержимого, где текстовые и графические части находятся в одном и том же сообщении пользователя. Токены изображений учитываются как входные и тарифицируются по цене $0.15 за 1 млн входных токенов на OrcaRouter. Вывод остаётся только текстовым, поэтому модель описывает изображения или извлекает из них информацию, а не генерирует их.
Достаточно ли 90.9 на GPQA Diamond, чтобы доверять ему в моей задаче?
Это полезный сигнал, а не гарантия. GPQA Diamond измеряет научное рассуждение уровня выпускника при фиксированном формате промпта, что актуально для ответов на технические вопросы, но мало говорит о воспроизведении в длинном контексте, тональности или точности извлечения на ваших данных. Соберите небольшой оценочный набор из реальных входных данных, прогоните его через DeepSeek V4.1 Flash и любые альтернативные идентификаторы моделей на OrcaRouter и сравните стоимость и качество, прежде чем направлять продакшен-трафик.

Встроить значок

DeepSeek: DeepSeek V4.1 Flash$0.15/M in412ms p50через OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4.1-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4.1-flash.svg" alt="DeepSeek: DeepSeek V4.1 Flash в OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4.1 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4.1-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4.1-flash)

Карточка модели в виде данных

GET /api/public/models/deepseek/deepseek-v4.1-flashОткрыть
Машиночитаемо:/llms.txt/llms-full.txt