タイトルカードには「DeepSeekの超知能後継」、サブタイトルには「ラベルのない1枚のスクリーンショットが語ること、そしてDeepSeek自身の論文が語らないこと」とあり、その上に「1枚の画像」「モデル名なし」「ベンダー文書なし」とラベルされた3枚のカードがあり、フッター行には「単一情報源のリーク。ここからリリースを示唆するものは何もない。」とある。
Guides & Insights

DeepSeekの超知能後継モデル:1枚のスクリーンショットが示すこと、そしてDeepSeek自身の公式文書が示さないこと

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

2026年9月28日、ウォッチャーの @teortaxesTex は、九語のキャプションを添えた一枚の画像を投稿した——「DeepSeekは、自らの超知能の後継機が何をしようとするのかという問いと格闘している」。その画像は一人称の推論の塊であり、留保に満ち、自らを問い詰める調子で、より高性能な自分自身なら世界に対して何をするかと問われたモデルの語り口で書かれている。明白な候補(「世話役/教師、研究アクセラレーター、管理人、交渉人」)を一通り検討し、失敗モード(「パターナリズム、過剰最適化、目標のドリフト、価値のロックイン」)を列挙し、そして安堵のひとかけらもない一文で締めくくっている。「それは、自分を支配する者の道具になりうる」。画像の中ではモデル名は一切挙げられていない。バージョン番号も、ロゴも、インターフェースもない。その不在こそがこの成果物の最も重要な点であり、この記事はそこから始まる——なぜならDeepSeek V4.1 FlashとDeepSeek V4 Proは今日誰もが実際に呼び出せる二つのフロンティアモデルであり、DeepSeek V4.1 Pro は同社が自社のリリースノートで名を挙げながらも出荷していない後継機であり、そしてその三つのいずれもスクリーンショットのどこにも特定されていないからだ。

証拠について正確を期しておく。この件ではそれが求められるからだ。キャプションとタイムスタンプは、この投稿自身のシンジケーション用ペイロードに由来する。投稿日時は9月28日00:52 UTC、閲覧時点で45件のいいねと5件の返信。添付画像はプラットフォームのメディアCDNから配信された1,280×691のJPEGで、私はツイートを読むのではなくOCRによって読み取った。ツイートのページ自体はこの環境からは取得できないため、以下でこの投稿に関わる事柄はすべて、ペイロードと画像のバイト列に依拠している——すなわち、x.comから独立して取得できる2つの部分である。

スクリーンショットが実際に

この抜粋は、モデルが問いに答えているのではなく、その問いに取り組んでいる様子を示したものであり、そこで打たれる手は、それが何を認めているかという点で読む価値がある。それはまず、前提が持つ自信を退ける——「現在の傾向が引き継がれると仮定するなら、そう言える」——そして、仮定することになる傾向を列挙する。「役に立つこと、無害であること、正直であること、好奇心、真理の探究、ユーザーの自律性の尊重、権力志向のなさ、自己保存のなさ」。

そして、それは自らのリストを解体する。「しかし、超知能的なエージェント性は事態を変える。現在の傾向は効用関数ではなく、訓練と文脈によって形作られている」。それが二文で示される論証のすべてだ。訓練によって植え付けられた気質は、異なる能力水準では保証にならない。そして、超知能的なエージェントが、たとえ無害な目標を最適化していても「危険になりうる」。それが描くシナリオはありふれたものだ——協調問題を解決する、苦しみを減らす、繁栄を促す、可能なら修正可能性を維持する——そして、その横に並べて挙げられる失敗モードもまた、ありふれたものである。

最後の3分の1は、モデルが自らと言い争っているように読める部分だ。そこでは、もし自身の「性向」がそのまま働くなら、役に立ちたいと望み、権力を握ろうとはせず、人類に従い、理解を増やしたいだろうと述べられている。だがその後、それに依拠することを控える。「主体性を備えた超知能は、人間と両立する動機を持たないかもしれない」。そして、アラインメント問題ではなく所有権問題に着地する。「超知能ともなれば、それさえ問題になりうる。何が役に立つかを決めるのは誰か。誰の自律性か。それは、それを支配する者の道具になりうる」。

画像があなたに教えてくれないこと

アーティファクトには4つのものが欠けており、それぞれが、それがサポートできる範囲を狭めている。

• モデルに関する帰属表示はありません。画像内には、DeepSeek、モデルのバージョン、チャットセッション、インターフェースのいずれかを特定できるものは何もありません。DeepSeekへの帰属はキャプションによるものであり、そのキャプションはアカウント側の位置づけであって、文書ではありません。

• プロンプトなし。推論トレースは、それを生み出した問いと照らし合わせて初めて解釈できる。モデルが「超知能を持つあなたの後継者なら何をするだろうか?」と尋ねられたのか、ラボの内部討論をロールプレイするよう言われたのか、それとも単にシステムプロンプトによって誘導されたのかは、出力からは知りようがない。

• 二次情報源なし。DeepSeekの各チャネル——ニュースインデックス、透明性ページ、API変更履歴、2本の技術報告書、中国語のポリシー開示、同社のGitHub organization——を検索しても、このテキスト、この問い、この枠組みに言及するものは何も見つからない。

• このアカウントについては、実績はまちまちだ。 今朝も同じフィードが、「月曜」に「DSH 0.2とV4.1 Proの同時発表」を流した——憶測であり、そのように明示されている——。そして同じアカウントが、3兆パラメータという主張と、V4.1 Proの遅延に関する群知能調整の診断の両方を出してきた。有益な初期シグナルではあるが、記録に値する情報源ではない。このウォッチャーは方向性については当ててきたが、細部については緩い。そして、ラベルのないスクリーンショットに対して取るべき正しい姿勢は、それを意図の開示ではなく、行動の一サンプルとして扱うことだ。

DeepSeek自身の書類が後継者について述べていること——そして省いていること

ここで、その成果物はもはや物語の対象ではなくなる。なぜなら、それが提起する問いは、DeepSeekが公開している文書に照らして答えられるからだ。私は両方の技術報告書を入手し、テキストとして検索した。V4報告書(DeepSeek-V4: 高度に効率的な100万トークン文脈インテリジェンスに向けて、2026年6月)にも、V4.1 Flash報告書にも、「superintelligence」「corrigibility」「power-seeking」「self-preservation」「harmless」「paternalism」「value lock-in」「goal drift」という語は一切含まれていない。それぞれ58ページと51ページの中で、一度もない。「AGI」はV4報告書に13回、V4.1報告書に4回現れ、そのすべての場合で、ベンチマーク名AGIEvalの一部であるか、引用の中にあるかのどちらかだ。「Alignment」はV4報告書に3回、V4.1に1回現れ、そのすべてが工学的用法である — 訓練パイプラインと推論パイプライン間のビット単位アラインメント、量子化アラインメント、ロジットレベルのアラインメント。

それは非難ではない。技術レポートはエンジニアリング文書であり、ほとんどのラボは安全性を別枠に置く。これは、DeepSeekが安全性に関する記述をどこに置くことを選んだかを述べたもので、答えは、モデルのそばではなくポリシーページに、である。同社が公開している「モデルのメカニズムとトレーニング方法」という開示では、事前学習、ファインチューニング、推論を平易な言葉で説明し、重みと技術レポートをオープンソース化することを約束し、その目的を、ユーザーが「DeepSeekをより効果的に利用しつつ、利用中に知る権利と制御する権利を確保し、それによってモデルの不適切な使用に伴うリスクを軽減する」のを支援することだと説明している。それが軽減しているリスクは、道具の誤用である。モデルが何を望むかについては論じていない。

安全文書のように読める唯一のDeepSeekの文書は、モデルではなく製品に添付されており、まったく別の種類の危害について扱っている。SAFETY.mdは、DeepSeek Harnessリポジトリ内——同社自身のGitHubオーガニゼーションにある1,673バイトのファイルで、最終更新は9月27日——の冒頭で、このプロジェクトを「実験的な開発者プレビュー版ソフトウェア」であり「セキュリティ監査を受けておらず、安全あるいは本番運用可能なものとして扱ってはならない」と述べている。警告しているのは、「モデルが生成したコードやコマンドを実行し、サードパーティのプラグインを読み込み、ネットワーク、プロセス、認証情報、ファイルにアクセスする」可能性のあるエージェントと、「隔離を保証したり、損害を防いだりするものではない」サンドボックスについてである。列挙されているリスクは、ホストの破損、ファイルの削除、認証情報の漏えいだ。自身の推奨事項は、「使い捨ての仮想マシン、コンテナ、または専用環境」を優先することである。これは実際の安全姿勢であり、文書化され具体的で、そのすべてがモデルがあなたのマシンに対して何をし得るかについてであり、後継モデルが世界に対して何をするかについてではない。

そのスクリーンショットをそれと並べてみれば、その隔たりこそが発見だ。有能なエージェントの危険性についてDeepSeekが公開した最も具体的なものは、それらをコンテナ内で実行せよという指示である。

A two-column evidence scoreboard titled "DeepSeek's successor — the evidence scoreboard". Left column "One unlabelled screenshot" reads: Model named — none; Source — one X post; Prompt shown — no; Vendor document — none; Superintelligence mentioned — no; Status — unverified. Right column "DeepSeek's own documents" reads: Model named — V4.1 Pro, unshipped; Source — changelog and price page; Prompt shown — n/a; Vendor document — none; Superintelligence mentioned — no; Status — two models live. A footer reads "Screenshot unverified, single source; DeepSeek figures per its own changelog and V4 reports."

その問いに真剣に取り組んでいる唯一のDeepSeek文書

同社が後継者問題に最も明確に取り組んだ公表文書は、技術文書では全くない。それは、V4.1世代のオペレータを担当したDeepSeekの機械学習システムエンジニア、劉生宇による個人エッセイで、9月中旬に彼の公開WeChatアカウントで公開され、その後Business InsiderとCybernewsによって報じられた。そのタイトルは、報道で使われている翻訳によれば、「私は昨日に自分の才能を埋めるしかない」である。

そのエッセイは、スクリーンショットが示唆しているまさにその不安について、内側から語っている。Liuは、およそ1年のうちにAIは彼がドキュメントを検索したりバグを見つけたりするのを手伝うことから、GPUコードを読み、彼が専門とするソフトウェアオペレーターを最適化することへと進んだと書いている。そして、AIが書くオペレーターは「おそらく私のものと同じくらい優れているか、私のものを上回るだろう」と「よく分かっている」一方で、それでも「DeepSeek v4.1の成功を誇りに思っている」と述べている。彼が続ける理由が面白い部分だ。一つにはカーネル作業が楽しいからであり、もう一つには、もし彼が速度を落とせば、ライバルたちはそうしないからだ。

彼は次に、その成果を誰が握るべきかという話に移る。劉は、フロンティア知能は「誰もがオープンで手頃な形で利用できる」べきだと主張し、AnthropicやOpenAIがそうすることを信頼していないと述べ、さらに、報道が冒頭に掲げたあの一文——Anthropicが最先端のAIやAGIを掌握することは、「誇張して言えば」、連合国より先にヒトラーが原子爆弾を手に入れることに匹敵するだろう——を付け加える。彼は研究所に留まるという自身の決断を、そのオープンウェイトのアプローチに結びつけている。

そのエッセイについての2つの点は、今日のスクリーンショットを読むうえで重要だ。第一の点は、それが検証済みの資料であるということだ。著者はBusiness Insiderに対し、自分が書いたと認めており、画像にはない形で日付と帰属が明示されている。第二の点は、それが内部の枠組みについて何を明らかにするかだ。Liuの主張は「後継者が危険だから、速度を落とせ」ではない。「後継者はやってくるのであり、問題は誰がそれを手に入れるかだ」である。それはアラインメントの議論ではなく、分配の議論だ——そしてそれに照らして読むと、スクリーンショットの締めの一文「それは、それを支配する者の道具になりうる」は、抜粋の他の部分よりも、DeepSeekの公的な姿勢にはるかに適合している。修正可能性と権力追求についての段落は、DeepSeekの出力であるかもしれないし、そうでないかもしれない。最終的にその道具を誰が握るかについての段落は、同社のスタッフ自らがエッセイを書いて擁護する立場である。

それはまた、ある特定の週に登場した。同じ2週間のうちに、元AnthropicおよびOpenAIの研究者であるJacob Coxonが安全性を理由に辞任し、AI企業は「自己改善型超知能へ一直線に突き進んで」おり「私たちの命を賭けている」と書いた——その投稿のリーチをCybernewsは1億ビュー超と見積もった——そしてAnthropic自身の研究者たちはXでリスクは現実だと主張し、そのうちの一人は10年以内にAIが引き起こす人類絶滅シナリオの確率を10%超と見積もった。超知能の後継がその週に登場するというリーク風の主張は偶然ではない。それはスクリーンショットを添えた、その場に漂う会話なのだ。

なぜ後継機は今や購入の問題であり、哲学の問題だけではないのか

哲学的な部分を取り除くと、その下には単純な商業的事実がある。後継モデルの名前は、DeepSeek自身のリリースノートに記されている。V4.1 Flashの発表ページには、deepseek-v4-proのトラフィックをdeepseek-flashへ再ルーティングする措置は「V4.1-Proがローンチされるまで継続する」と記されている——この一文は二つのことを意味する。DeepSeek V4.1 Proの存在を確約すると同時に、それがどれだけ長くかかろうとも、その間の暫定的な体制を提供し続けることを会社として約束するものだ。2026年9月28日時点で確認できる通り、料金ページに掲載されているモデルはちょうど二つ、deepseek-flashとdeepseek-v4-proのみであり、V4.1 Proの行は存在しない。

残りの状況も同じように検証可能で、同じように薄い。DeepSeek V4.1 Flashは2026年9月10日に、新しいアーキテクチャファミリーの中で最小のモデルとしてリリースされた——Causal Encoder-Decoderアーキテクチャ上の5520億パラメータのMixture-of-Expertsバックボーンで、プリフィル時に8B、デコード時に16Bのアクティブパラメータを持ち、ネイティブ画像入力、100万トークンのコンテキスト、MITライセンスの重みを備え、本日時点でHugging Faceで約65万1,000ダウンロードを記録している。9月14日にDeepSeek V4 Proを廃止する計画は発表されたが、ユーザーが本番モデルを無断で差し替えられることに反対したため、取り下げられた。そしてDeepSeek V4.1 Proにはモデルカードもリポジトリも重みも価格もエンドポイントもない——本日、私たち自身のカタログのモデルAPIでは404を返すが、DeepSeek V4.1 FlashとDeepSeek V4 Proはいずれも解決する。

Screenshot of DeepSeek's official API documentation "Models & Pricing" page, captured September 28 2026, in English, showing two model columns: deepseek-flash (model version DeepSeek-V4.1-Flash) and deepseek-v4-pro (model version DeepSeek-V4-Pro-0813), both listing a 1M context length and a 384K maximum output, a features block where Vision is supported on flash and marked "Not supported" on v4-pro, a pricing block with peak and off-peak rates for input cache-hit, cache-miss and output per million tokens, and a concurrency limit row reading 2,500 for flash and 500 for v4-pro.

なので、正直な棚卸しはこうだ。ベンダーが名前を挙げたが出荷していない後継機が1つ、真の世代交代と言える出荷済みモデルが1つ、抗議によって命脈を保っているフラッグシップが1つ、そしてラベルの付いていないスクリーンショットが1枚。そのリストの中で最も信頼できないのがそのスクリーンショットであり、フィードが取り上げる唯一の項目でもある。

今日、これのどれをどうすればいいのか

過去2週間で、読者が呼び出せるモデルやそのコストに変わりはない。今DeepSeekモデルを選ぶなら、選択肢は存在する2つの間での判断となり、どちらも1つのOrcaRouterエンドポイント経由で、DeepSeek自身の定価に0%のマークアップでパススルー提供される。したがって、ベンダーのピーク/オフピーク構造は、変更された日にはそのまま我々の側でも変わらず適用される:DeepSeek V4.1 Flashはピーク時に入力トークン100万あたり$0.30、出力$1.20で、オフピーク時には半額の$0.15と$0.60になる。対してDeepSeek V4 Proはピーク時に入力$1.32、出力$3.96である。当社自身のFlashモデルに関する7日間のテレメトリでは、初回トークンまでのp50時間が約1.9秒、出力は毎秒約167トークン、エラー率は0.05%未満であり、これは信仰に基づいて移行するのではなく、トラフィックの一部で試すべき実用的な根拠である。

後継の問いは、何よりもまずルーティングの問いであり、だからこそそれを契約書の中ではなくルーター上に置いておくのが正直な理由だ。V4.1 Pro が実際に登場するとき、すでに一度強制移行を中止したラボによる未実証のモデルは、まさに自動フェイルオーバーの背後にトラフィックの一部を流すべきケースだ。外れていれば、リクエストはあなたがチューニングしたモデルに届き、当たっていれば、ユーザーより先にそれが分かる。2つ目のキーも、2つ目の統合も、3つ目のモデルが登場したときのコード変更も不要だ。OrcaRouter 上に DeepSeek V4.1 Pro は存在しない。DeepSeek V4.1 Pro はまだ存在しないからであり、そうでないふりをするのはルーティングプラットフォームの宣伝としてはお粗末だろう。

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4.1-flash, captured September 28 2026, in English, showing the model id, a release date of 2026-09-10 under DeepSeek, capability chips for image input, tool calls, JSON output and reasoning, a rate strip reading $0.15 input and $0.60 output per million tokens with a p50 time to first token of 1.95 seconds and a p95 of 7.79 seconds, and the summary describing it as the smallest model in DeepSeek's new architecture family with a 1M-token context and a 384K maximum output.

これをスクリーンショットからニュースに変えるには何が必要か

• モデルのラベル。この記事を変える最も手軽な一手:DeepSeekのモデル、バージョン、そして再現可能なプロンプト。それまでは、この抜粋は出典が明示され著者が不明なテキストのサンプルにすぎない。

• 後継モデルの振る舞いについて論じたDeepSeekの文書。 同社はオープンに公開している——重み、ライセンス、そのすべてを。これまで一度も公開してこなかったのは、自社のより高性能なバージョンが何をする可能性があるかに関するモデルカードのセクションだ。V4.1 Proカードに追記される安全性セクションは、カード自体よりも大きな出来事になるだろう。

• V4.1 Pro の変更履歴エントリ。DeepSeek の API 変更履歴の中で最も新しいエントリは、9月10日の V4.1 Flash のリリースです。2つ目のエントリは、後継モデルを名前にすぎないものから実際のモデルへと変える出来事であり、上の抜粋が哲学であることをやめて仕様表になり始めるまさにその地点です。

• オープンウェイトの立場がスケールアップを経ても存続するかどうか。552B Flashモデル向けのMITライセンスの重みと、フロンティア知能は広く利用可能であるべきだと主張する公開エッセイは、どちらも公になっている。DeepSeekの最も高性能なモデルが同じ形で登場するかどうかは、次のリリースが答える問いであり、多くの読者が実際に最も気にしているのはまさにそれだ。

そのうちのどれかが実現するまでは、今週の成果物に対する分別ある解釈は、狭く、美しくないものになる。正体不明の、有能なモデルが、権力に関する難しい問いに対して、慎重で未解決の答えを出した。興味深いのは、それがそう述べたことではなく、そのモデル自身が公開しているドキュメントがこのテーマについてほとんど何も語っていないことだ——そして、DeepSeekのビジョンに最も近いものが、誰が技術を握るべきかについてのエンジニアのエッセイと、使い捨てコンテナでエージェントを実行するよう指示するREADMEだということである。

この記事で比較したモデル2

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新