Титульная карточка с надписью «Сверхинтеллектуальный преемник DeepSeek» и подзаголовком «Что говорит один неподписанный скриншот и о чём не говорят собственные статьи DeepSeek», над тремя карточками с подписями «Одно изображение», «Ни одна модель не названа» и «Нет документа от производителя», с нижней строкой «Утечка из единственного источника; ничто здесь не подразумевает выпуск».
Guides & Insights

Сверхинтеллектуальный преемник DeepSeek: что говорит один скриншот — и о чём не говорит собственная документация DeepSeek

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

28 сентября 2026 года наблюдатель @teortaxesTex опубликовал одно изображение с подписью из девяти слов: «DeepSeek борется с вопросом о том, что попытается сделать его сверхинтеллектуальный преемник». На изображении — блок рассуждений от первого лица: осторожных, задающих вопросы самим себе и написанных в регистре модели, у которой спросили, что сделала бы с миром более способная версия её самой. Он перебирает очевидных кандидатов («опекун/учитель, ускоритель исследований, управляющий, переговорщик»), перечисляет режимы отказов («патернализм, сверхоптимизация, дрейф целей, закрепление ценностей») и завершается строкой, в которой нет ничего утешительного: «Он мог бы стать инструментом того, кто им управляет». На изображении не названа ни одна модель. Ни номера версии, ни логотипа, ни интерфейса. Это отсутствие — самое важное в этом артефакте, и именно с него начинается этот материал — потому что DeepSeek V4.1 Flash и DeepSeek V4 Pro — это две фронтирные модели, к которым сегодня действительно может обратиться любой, DeepSeek V4.1 Pro — это преемник, названный компанией в её собственном примечании к релизу, но так и не выпущенный, и ни одна из трёх нигде на скриншоте не идентифицирована.

Если быть точным насчёт доказательств, потому что здесь это необходимо. Подпись и отметка времени взяты из собственного payload синдикации поста: опубликовано в 00:52 UTC 28 сентября, 45 лайков и пять ответов на момент чтения. Прикреплённое изображение — это JPEG размером 1 280×691, отдаваемое с медиа-CDN платформы, и я прочитал его с помощью OCR, а не читая сам твит. Саму страницу твита невозможно получить из этого окружения, поэтому всё ниже, что касается поста, опирается на payload и байты изображения — две его части, которые можно получить независимо от x.com.

Что на самом деле написано на скриншоте

В этом отрывке модель прорабатывает вопрос, а не отвечает на него, и её ходы стоит прочитать ради того, что они признают. Он начинается с отказа от уверенности, заложенной в предпосылке, — «Можно сказать, при допущении, что текущие склонности сохранятся», — а затем перечисляет склонности, которые она бы допускала: «полезность, безвредность, честность, любознательность, стремление к истине, уважение к автономии пользователя, отсутствие стремления к власти, отсутствие самосохранения».

Затем он разбирает свой собственный список. «Но сверхразумная агентность меняет всё. Текущие склонности — не функция полезности; они формируются обучением и контекстом.» Вот и весь аргумент в двух предложениях: установленная обучением диспозиция не является гарантией на другом уровне возможностей, и сверхразумный агент, оптимизирующий даже благую цель, «может быть опасен». Сценарии, которые он обрисовывает, — обычные: решать проблемы координации, уменьшать страдания, способствовать процветанию, возможно, поддерживать корректируемость, — а режимы отказа, которые он называет рядом с ними, тоже обычные.

Последняя треть — это часть, которая читается как модель, спорящая сама с собой. Там говорится, что если бы её «склонности» возобладали, она хотела бы быть полезной, а не захватывать власть, уступать человечеству, увеличивать понимание. Затем она отказывается опираться на это: «сверхинтеллект, обладающий субъектностью, может не иметь совместимых с человеческими мотиваций». И она останавливается на проблеме собственности, а не на проблеме выравнивания: «на уровне сверхинтеллекта даже это может быть проблематичным: кто решает, что полезно? Чья автономия? Он может стать инструментом того, кто им управляет».

О чём изображение умалчивает

В артефакте не хватает четырёх вещей, и каждая из них сужает круг того, что он может поддерживать.

• Без указания модели. Ничто на изображении не указывает на DeepSeek, версию модели, сеанс чата или интерфейс. Указание на DeepSeek содержится в подписи, а подпись — это подача аккаунта, а не документ.

• Без промпта.Невозможно по выходным данным понять, спросили ли у модели: «что сделал бы сверхразумный преемник тебя?», велели ли ей отыграть внутреннюю дискуссию лаборатории или же она просто направлялась системным промптом.

• Нет второго источника. Поиск по каналам DeepSeek — новостному индексу, странице прозрачности, журналу изменений API, обоим техническим отчётам, раскрытию политики на китайском языке, организации компании на GitHub — не обнаруживает ничего, что ссылалось бы на этот текст, этот вопрос или эту формулировку.

• Неоднозначный послужной список у этого аккаунта. Та же лента сегодня утром вбросила «DSH 0.2 вместе с V4.1 Pro» на «понедельник» — спекуляция, помеченная как таковая, — и тот же аккаунт выдал как утверждение о 3 триллионах параметров, так и диагноз, объясняющий задержку V4.1 Pro проблемами координации роя. Полезный ранний сигнал; но не источник, на который можно ссылаться. Этот наблюдатель был прав в направлении и расплывчат в конкретике, а правильная позиция по отношению к скриншоту без подписи — считать его образцом поведения, а не раскрытием намерений.

Что собственные документы DeepSeek говорят о преемниках — и о чём они умалчивают

Здесь артефакт перестаёт быть главным, потому что на вопрос, который он поднимает, можно ответить, опираясь на документы, публикуемые DeepSeek. Я скачал оба технических отчёта и искал по ним как по тексту. Ни в отчёте V4 (DeepSeek-V4: на пути к высокоэффективному интеллекту с контекстом в миллион токенов, июнь 2026 г.), ни в отчёте V4.1 Flash нет слов «сверхинтеллект», «корригируемость», «стремление к власти», «самосохранение», «безвредность», «патернализм», «закрепление ценностей» или «дрейф целей» вообще. Ни разу — на 58 и 51 страницах соответственно. «AGI» встречается 13 раз в отчёте V4 и четыре раза в отчёте V4.1, и в каждом случае это либо часть названия бенчмарка AGIEval, либо внутри цитаты. «Выравнивание» встречается три раза в отчёте V4 и один раз в V4.1, и во всех случаях это инженерное употребление — побитовое выравнивание между пайплайнами обучения и инференса, выравнивание квантования, выравнивание на уровне логитов.

Это не обвинение; технические отчёты — это инженерные документы, и большинство лабораторий помещают информацию о безопасности в отдельную карточку. Это описание того, куда DeepSeek решила поместить свои материалы о безопасности, и ответ таков: на страницу политики, а не рядом с моделью. Публичный документ компании «Механизм модели и методы обучения» объясняет предварительное обучение, тонкую настройку и инференс простым языком, обязуется выкладывать в открытый доступ веса и технические отчёты и описывает свою цель так: помогать пользователям «эффективнее использовать DeepSeek, обеспечивая при этом ваше право знать и контролировать процесс использования, тем самым снижая риски, связанные с ненадлежащим использованием модели». Риск, который он снижает, — это неправильное использование инструмента. В нём не обсуждается, чего может хотеть модель.

Единственный документ DeepSeek, который действительно читается как документ о безопасности, прилагается к продукту, а не к модели, и посвящён совершенно иному классу вреда. SAFETY.md в репозитории DeepSeek Harness — файл размером 1673 байта в собственной организации компании на GitHub, последний раз изменённый 27 сентября — начинается с того, что проект называется «экспериментальным ПО в статусе предварительной версии для разработчиков», которое «не проходило аудит безопасности и не должно считаться безопасным или готовым к промышленной эксплуатации». В нём предупреждается об агенте, который «может выполнять сгенерированный моделью код и команды, загружать сторонние плагины и получать доступ к сети, процессам, учётным данным и файлам», и о песочнице, которая «не гарантирует изоляцию и не предотвращает ущерб». Перечисляемые риски — повреждённые хосты, удалённые файлы, раскрытые учётные данные. Его собственная рекомендация — предпочитать «одноразовую виртуальную машину, контейнер или выделенную среду». Это настоящая позиция по безопасности, документированная и конкретная, и она целиком о том, что модель может сделать с вашей машиной, — а не о том, что сделает с миром её преемник.

Поставьте скриншот рядом с тем — и пробел это и есть находка. Самое конкретное из опубликованного DeepSeek об опасности способных агентов — это инструкция запускать их в контейнере.

A two-column evidence scoreboard titled "DeepSeek's successor — the evidence scoreboard". Left column "One unlabelled screenshot" reads: Model named — none; Source — one X post; Prompt shown — no; Vendor document — none; Superintelligence mentioned — no; Status — unverified. Right column "DeepSeek's own documents" reads: Model named — V4.1 Pro, unshipped; Source — changelog and price page; Prompt shown — n/a; Vendor document — none; Superintelligence mentioned — no; Status — two models live. A footer reads "Screenshot unverified, single source; DeepSeek figures per its own changelog and V4 reports."

Единственный документ DeepSeek, который действительно всерьёз разбирается с этим вопросом

Самое ясное опубликованное свидетельство борьбы компании с проблемой преемника — вовсе не технический документ. Это личное эссе Лю Шэнъюя, инженера DeepSeek по системам машинного обучения, который работал над операторами для поколения V4.1; оно было опубликовано в его публичном аккаунте WeChat в середине сентября, а затем о нём написали Business Insider и Cybernews. Его заголовок в переводе, который используется в публикациях, — «У меня нет другого выбора, кроме как похоронить свой талант во вчерашнем дне».

Эссе посвящено именно тому беспокойству, на которое намекает скриншот, изнутри. Лю пишет, что примерно за год ИИ прошёл путь от помощи в поиске документации и выявлении ошибок до чтения кода для GPU и оптимизации программных операторов, на которых он специализируется, и что он «хорошо осознаёт», что операторы, которые пишет ИИ, «скорее всего, будут не хуже моих или даже превзойдут мои» — при этом всё ещё «гордясь успехом DeepSeek v4.1». Его причины продолжать — это самое интересное: отчасти в том, что работа над ядрами приносит радость, а отчасти в том, что если он сбавит темп, соперники не сбавят.

Затем он переходит к вопросу о том, кому должен принадлежать результат. Лю утверждает, что передовой интеллект должен быть «доступен каждому — открыто и по доступной цене», говорит, что не доверяет ни Anthropic, ни OpenAI в том, что они это сделают, и добавляет фразу, с которой начинались материалы в СМИ, — что овладение компанией Anthropic самым передовым ИИ или AGI было бы сопоставимо — «если утрировать» — с получением Гитлером атомной бомбы раньше союзников. Своё решение остаться в лаборатории он связывает с её подходом, основанным на открытых весах.

Для чтения сегодняшнего скриншота важны две вещи в том эссе. Первая — что это подтверждённый артефакт: автор подтвердил изданию Business Insider, что написал его, и у него есть датировка и атрибуция, которых у изображения нет. Вторая — что это говорит о внутренней рамке. Аргумент, который выдвигает Лю, — не «преемник был бы опасен, поэтому давайте замедлимся». Он таков: «преемник уже на подходе, и вопрос в том, кому он достанется». Это аргумент о распределении, а не о выравнивании — и если читать скриншот в этом ключе, его заключительная строка, «он может стать инструментом того, кто его контролирует», гораздо лучше соответствует публичной позиции DeepSeek, чем остальная часть отрывка. Абзац об исправимости и стремлении к власти может быть, а может и не быть выводом DeepSeek. Абзац о том, кто в итоге держит в руках инструмент, — это позиция, в защиту которой сами сотрудники компании пишут эссе.

Это тоже появилось на конкретной неделе. В те же две недели бывший исследователь Anthropic и OpenAI Джейкоб Коксон ушёл в отставку из-за вопросов безопасности и написал, что ИИ-компании «мчатся прямиком к самосовершенствующемуся сверхинтеллекту» и «играют с нашими жизнями» — пост, охват которого Cybernews оценил более чем в 100 млн просмотров, — а собственные исследователи Anthropic вышли в X, чтобы доказывать, что риск реален; один из них оценил вероятность сценария вымирания человечества из-за ИИ выше 10% в течение десяти лет. Утверждение в стиле утечки о появлении сверхинтеллектуального преемника на той неделе — не совпадение; это витающий в воздухе разговор, к которому приложен скриншот.

Почему преемник теперь — вопрос покупки, а не только философский вопрос

Отбросьте философию, и под этим обнаружится простой коммерческий факт: у преемника есть название в собственном примечании к выпуску DeepSeek. На странице анонса V4.1 Flash сказано, что перенаправление трафика deepseek-v4-pro на deepseek-flash «будет продолжаться до запуска V4.1-Pro» — фраза, которая делает две вещи. Она утверждает существование DeepSeek V4.1 Pro и обязывает компанию обслуживать временную схему столько, сколько потребуется. Согласно данным на 28 сентября 2026 года, на странице цен представлены ровно две модели, deepseek-flash и deepseek-v4-pro, и ни одной строки V4.1 Pro.

Остальная часть текущего положения дел столь же проверяема и столь же скудна. DeepSeek V4.1 Flash вышел 10 сентября 2026 года как самая маленькая модель в новом семействе архитектур — основа на смеси экспертов с 552 млрд параметров в архитектуре Causal Encoder-Decoder, с 8 млрд активных параметров на префилле и 16 млрд на декодировании, нативным вводом изображений, контекстом на 1 млн токенов, весами под лицензией MIT и примерно 651 000 загрузок на Hugging Face по состоянию на сегодня. План вывести DeepSeek V4 Pro из эксплуатации 14 сентября был объявлен и отменён после того, как пользователи возразили против того, чтобы у них подменяли продакшен-модель. А у DeepSeek V4.1 Pro нет ни карточки модели, ни репозитория, ни весов, ни цены, ни эндпоинта — сегодня он возвращает 404 в API моделей нашего собственного каталога, тогда как DeepSeek V4.1 Flash и DeepSeek V4 Pro оба резолвятся.

Screenshot of DeepSeek's official API documentation "Models & Pricing" page, captured September 28 2026, in English, showing two model columns: deepseek-flash (model version DeepSeek-V4.1-Flash) and deepseek-v4-pro (model version DeepSeek-V4-Pro-0813), both listing a 1M context length and a 384K maximum output, a features block where Vision is supported on flash and marked "Not supported" on v4-pro, a pricing block with peak and off-peak rates for input cache-hit, cache-miss and output per million tokens, and a concurrency limit row reading 2,500 for flash and 500 for v4-pro.

Итак, честная инвентаризация такова: один преемник, названный вендором, но так и не выпущенный; одна выпущенная модель, представляющая собой настоящую смену поколения; один флагман, который держится на плаву благодаря протестам; и один скриншот без подписи. Скриншот — самый ненадёжный пункт в этом списке и единственный, о котором будет говорить лента.

Что сегодня делать с чем-либо из этого?

Ничто за последние две недели не меняет того, что может вызвать читатель и сколько это стоит. Если вы выбираете модель DeepSeek сейчас, решение сводится к выбору между двумя существующими, и обе доступны через одну конечную точку OrcaRouter по собственной каталожной цене DeepSeek, передаваемой без наценки — 0%, так что структура пиковых и непиковых тарифов вендора переходит на нашу сторону без изменений в тот же день, когда она меняется: DeepSeek V4.1 Flash — $0.30 за миллион входных токенов и $1.20 за выходные в пиковые часы, снижаясь вдвое до $0.15 и $0.60 в непиковые, против DeepSeek V4 Pro — $1.32 за вход и $3.96 за выход в пиковые часы. Наша собственная семидневная телеметрия для модели Flash показывает p50 времени до первого токена около 1,9 секунды при примерно 167 выходных токенах в секунду и частоте ошибок ниже 0,05%, и это практический аргумент в пользу того, чтобы опробовать её на части трафика, а не мигрировать вслепую.

Вопрос о преемнике — в первую очередь вопрос маршрутизации, и это честная причина оставить его на роутере, а не в контракте. Когда V4.1 Pro действительно появится, непроверенная модель от лаборатории, которая уже отменила одну принудительную миграцию, — это как раз тот случай, чтобы направить на неё долю трафика с автоматическим переключением при сбое: если она ошибётся, запрос попадёт на модель, которую вы настроили, а если окажется права, вы узнаете об этом раньше своих пользователей. Никакого второго ключа, никакой второй интеграции, никаких изменений в коде, когда появится третья модель. На OrcaRouter нет никакого DeepSeek V4.1 Pro, потому что DeepSeek V4.1 Pro ещё не существует, и было бы плохой рекламой для платформы маршрутизации делать вид, что это не так.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4.1-flash, captured September 28 2026, in English, showing the model id, a release date of 2026-09-10 under DeepSeek, capability chips for image input, tool calls, JSON output and reasoning, a rate strip reading $0.15 input and $0.60 output per million tokens with a p50 time to first token of 1.95 seconds and a p95 of 7.79 seconds, and the summary describing it as the smallest model in DeepSeek's new architecture family with a 1M-token context and a 384K maximum output.

Что превратило бы это из скриншота в новость?

• Метка модели. Самое дешёвое, что изменило бы этот материал: модель DeepSeek, версия и воспроизводимый промпт. До тех пор этот отрывок — образец текста с указанным источником и неуказанным автором.

• Документ DeepSeek, в котором рассматривается поведение преемника. Компания публикует всё открыто — веса, лицензирование и всё остальное. Чего она никогда не публиковала, так это раздела карточки модели о том, что могла бы делать более способная версия её самой. Раздел о безопасности, добавленный к карточке V4.1 Pro, стал бы более значимым событием, чем сама карточка.

• Запись в журнале изменений V4.1 Pro. Самая последняя запись в журнале изменений API DeepSeek — это выпуск V4.1 Flash от 10 сентября. Вторая запись — это событие, которое превращает преемника из названия в модель — и именно в этот момент приведённый выше отрывок перестаёт быть философией и становится технической спецификацией.

• Сохранится ли приверженность открытым весам при масштабировании. Веса под лицензией MIT для 552B-модели Flash и публичное эссе, доказывающее, что передовой интеллект должен быть широкодоступным, — и то, и другое уже зафиксировано. Появится ли самая мощная модель DeepSeek таким же образом — на этот вопрос ответит следующий релиз, и именно это волнует большинство читателей.

Пока один из них не появится, разумное прочтение артефакта этой недели остаётся узким и нелестным. Способная модель неизвестного происхождения дала осторожный и неокончательный ответ на трудный вопрос о власти; интересно не то, что она это сказала, а то, что в её собственной опубликованной документации об этом предмете говорится так мало, — и что ближайшим к опубликованной концепции безопасности DeepSeek оказывается эссе инженера о том, кому следует владеть технологией, и README, который велит запускать агента в одноразовом контейнере.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно