
PPLX 27B、Perplexityのポータブルコンピュータでローンチ:オープンハーネスを凌駕するローカルエージェント
- DeepSeekNEWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 100万トークンあたり
- z-aiNEWZ.ai: GLM 5.32026-08-1860知能75コーディング
- obsidianNEWQwen3.8 27B2026-08-1552知能68コーディング
- qwenNEWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNEWDeepSeek: DeepSeek V4 Pro 08132026-08-1253知能69コーディング
- grokNEWSpaceXAI: Grok 4.62026-08-1261知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング
- openaiOpenAI: GPT-5.6 Terra2026-07-0957知能77コーディング
- openaiOpenAI: GPT-5.6 Sol2026-07-0961知能77コーディング
PerplexityのPPLX 27Bはクラウドモデルではない。それこそがすべてだ。2026年8月25日、NVIDIAと共同で構築された同社のローカルファーストエージェント「Portable Computer」とともに発表されたPPLX 27Bは、AlibabaのオープンウェイトモデルQwen 3.8 27Bをポストトレーニングしたバージョンであり、Perplexityが自社のエージェントハーネス用にチューニングし、ユーザーが所有するハードウェア上で完全に動作するよう出荷されている。Perplexityの53タスクからなる「Local Knowledge Work Bench」では、PPLX 27Bを実行するハーネスは85.4%を記録し、同じハーネスでQwen 3.8 27Bを使った場合の82.6%、および2つのオープンソースエージェントハーネスであるPi(77.6%)とHermes(74.0%)を上回った。これらはローンチ投稿と付随する研究論文「A Local-First Agent for Private and Cost-Effective Knowledge Work」に記載されたベンダー自身の数値であり、独立に再現されたものではない。しかし、デスクトップ上の27Bモデルが、クラウドの数分の一のコストで実際のナレッジワークを遂行できることを示す最初の公的証拠である。
実際に出荷されたもの
Portable Computer は、Perplexity の「Computer」エージェントプラットフォームのオンデバイスビルドです。初期の Computer 製品がオーケストレーターをクラウド上で実行していたのに対し、Portable Computer はスタック全体をひとつのシステムにまとめ、お使いのマシン上で実行します。エージェントハーネス、オーケストレーター、プランナー、ツールルーター、スケジューラー、永続的なタスクキュー、ローカル検索インデックス、推論エンジン、そして Google Drive、Gmail、Slack、GitHub、Outlook 向けのアプリコネクターが含まれます。
2つの特性により、これはDIYのローカル環境とは一線を画す。第一に、コードとツールの実行はOSが強制するサンドボックス内で行われ、サンドボックスが利用できない場合、ツール実行は保護なしで実行されるのではなく無効化される。第二に、設計上ローカルファーストである。すべてのタスクはデバイス上で開始され、あるステップがライブのWebデータや最先端の推論を必要とする場合、オーケストレーターは停止して許可を求めたうえで、その単一のステップのみを15以上のクラウドモデルのいずれかにエスカレーションする。PII分類器が送信コンテキストを最初に検査し、どのデータがマシンから送信されるかを正確に表示する。
2つの27Bモデル
ローンチ時には、2つの270億パラメータモデルから選択できます。Qwen 3.8 27Bは、AlibabaのApache-2.0オープンウェイトモデルで、262Kトークンのネイティブウィンドウを備えた高密度・マルチモーダルの27Bモデルです。2週間前にリリースされ、すでに強力なセルフホストオプションとなっています。PPLX 27Bは、Perplexityがポストトレーニングした同じベースモデルで、新しいアーキテクチャではなく、このハーネス専用に調整された追加トレーニングが施されています。同社は、自社のエージェントワークロードにおいてより正確かつ効率的な動作を実現すると主張しています。NVIDIAのNemotron 3.5 Lightning(30B)は近日公開予定とされており、独自モデルと推論サーバーの両方がサポートされているため、ハーネスはPerplexityのウェイトに縛られることはありません。
ベンチマーク、そしてそれが何でないか
主要な数字は、53タスクからなるLocal Knowledge Work Benchに由来します。これは、ナレッジワーカーが実際に委任するような仕事、つまりディープリサーチ、財務分析、ドキュメント作成を網羅するスイートです。Perplexityはこのベンチマークをオープンソース化する計画だと述べており、そうすれば最終的には、この比較は信奉ではなく再現可能なものになるでしょう。それまでは、これらの結果はベンダーによる実行です。そのスイートについては、ベンダーによると:
• PPLX 27B搭載ポータブルコンピュータ — 85.4%
• Qwen 3.8 27B搭載ポータブルコンピュータ — 82.6%
• Pi (オープンソースハーネス) — 77.6%
• Hermes (オープンソースのハーネス) — 74.0%

さらに2件のベンダー報告による結果が、全体像を完成させる。{{4}}BrowseComp{{/4}}({{5}}ウェブリサーチスイート{{/5}})では、{{1}}Computer{{/1}}が66.7%を達成し、{{2}}Pi{{/2}}の50.2%と{{3}}Hermes{{/3}}の43.9%を上回った。しかも{{2}}Pi{{/2}}と比較して、ウォールタイムを51%削減し、トークン使用量を70%削減した。{{6}}ParseBench-100{{/6}}({{7}}文書抽出テスト{{/7}})では、65.1%を記録し、{{3}}Hermes{{/3}}の34.6%と{{2}}Pi{{/2}}の13.9%を大きく上回った。最も差が広がったのは、検索、ルーティング、ツール使用といった、ハーネス自身のインフラが評価されるタスクであり、そここそ{{8}}ポストトレーニング済みモデルと専用設計のプラミングスタック{{/8}}が真価を発揮する領域である。
経済の反転
より興味深い数字は価格だ。ローカルで完了した作業はトークンあたりのコストがゼロで、Perplexityのクレジットも消費しない——完全にローカルなタスクでは、カウンターはゼロのままである。コストがかかるのはエスカレーションだけであり、それはステップごとにオプトイン方式である。PerplexityはTerminal Bench 2.1でのハイブリッド計算結果を公開した:完全ローカルはほぼゼロコストで59.6%を記録し、フロンティアモデルをアドバイザーとして追加すると、1ロールアウトあたり約0.415ドルで73.0%に上昇した。フロンティアモデル単独では、1ロールアウトあたり約0.65ドルで82.4%に達した。最後の対比こそが論点である——ローカル推論は常時稼働エージェントのコスト曲線を平坦にし、クラウドへのエスカレーションは、それに見合う価値がある場合にのみ的を絞って発生する費用となる。
どれも最初から無料というわけではない。ハードウェアが肝心だ。Portable Computerは、128GBのユニファイドメモリを搭載したデスクトップ型スーパーコンピュータ「NVIDIA DGX Spark」(参考価格約4,500ドル)、または24GB以上のVRAMを備えたRTX GPU(おおよそRTX 3090以降)を搭載したLinux PC(32GB推奨)で、Linuxファーストとして展開される。Windowsサポートは9月に予定されており、macOSは発表されていない。さらに、このソフトウェア自体に有料のPerplexityプラン(Pro、Max、Enterprise Pro、Enterprise Max)が必要だ。これは、すでにPerplexityに料金を支払っているユーザーを対象としたサブスクリプション+ハードウェア型の製品であり、一般的なAPIではない。

ルーターの設置場所
PPLX 27BはOrcaRouterがルーティングするものではありません。これはお客様が所有するハードウェア上で、Perplexityサブスクリプションの背後で動作するものであり、私たちはそうでないふりをするつもりはありません。私たちがルーティングするのは、このローンチが誘う比較セットです。PPLX 27Bがポストトレーニングの基盤とする正確なベースウェイトであるQwen 3.8 27Bは、OrcaRouterセルフホスト上で稼働中です。DeepSeek V4 Flash、Gemini 3.5 Flash Lite、GPT-5.6 Lunaも同様です。すべて単一のAPIキーで、プロバイダーのリスト価格のまま、マークアップなしで透過的に提供されます。そのため、ベンダーの値下げは発表当日に当社側でも反映されます。
それがここで重要になるのは、特定の理由が一つあるからです。Portable Computerの売り文句は、ローカル対クラウドのコスト比較であり、その比較のクラウド側は、比較対象とする価格がどれだけ正直であるかにかかっています。OrcaRouterでは、それはプロバイダーの実際のリスト価格であり、ローカルかクラウドかの判断を、マーケティング上の比較ではなく信頼できる計算に変えてくれます。そして、同じエージェントを両方の方法で試作したい場合(1台のマシン上のローカルハーネスと、1つのエンドポイントの背後にあるクラウドモデル)には、自動フェイルオーバーにより、ローカルモデルが能力不足になったときに、追加の契約や別のコードパスなしでクラウド側が代わりを務めることができます。

何を見るべきか
次の1か月の間に起こる3つのことが、これがニッチ製品に終わるのか、それとも新たなカテゴリの始まりになるのかを決める。Perplexityが実際にLocal Knowledge Work Benchをオープンソース化するか——それが実現すれば、目玉となる数値は単なる主張から、コミュニティが再現できるものに変わる。Nemotron 3.5 Lightningが登場し、同じハーネス上でPPLX 27Bを打ち負かすか——「ハーネス向けにポストトレーニングする」という主張は、その下にあるベースモデルの実力次第でしかない。そして、9月のWindowsサポートがDGX Spark所有者以外にもリーチを広げられるか。ベンチマークが本物でハーネスが汎用的なら、「自分のGPUでエージェントを動かす」はもはやホビイストの手法ではなく、本物の威力を備えたデプロイオプションになる——そして比較対象となるクラウドモデルは、トークンあたりの価格を正当化しなければならなくなる。
