PPLX 27B、Perplexityのポータブルコンピュータでローンチ — オープンハーネスを凌駕するローカルエージェント 再生成されたイラスト。
Guides & Insights

PPLX 27B、Perplexityのポータブルコンピュータでローンチ:オープンハーネスを凌駕するローカルエージェント

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

PerplexityのPPLX 27Bはクラウドモデルではなく、それがすべてだ。2026年8月25日に、NVIDIAと共同で構築された同社のローカルファースト・エージェントであるPortable Computerとともに発表されたPPLX 27Bは、AlibabaのオープンウェイトQwen 3.8 27Bのポストトレーニング版であり、Perplexityが自社のエージェントハーネス向けにチューニングし、ユーザーが所有するハードウェア上だけで完全に動作する形で提供されている。Perplexityの53タスクのLocal Knowledge Work Benchでは、PPLX 27Bを実行するハーネスは85.4%を記録し、Qwen 3.8 27B上の同じハーネス(82.6%)と、2つのオープンソースエージェントハーネスPi(77.6%)およびHermes(74.0%)を上回った。これらはベンダー自身の数字であり、発表投稿と併載の研究論文「A Local-First Agent for Private and Cost-Effective Knowledge Work」に基づくもので、独立に再現されたものではない — しかし、デスクトップ上の27Bモデルがクラウドの価格の何分の一かで実際のナレッジワークを担えることを示す最初の公の証拠である。1週間後の9月1日、同じポストトレーニング済みモデルが2つ目の導入先に現れた。PerplexityのComputerエージェントの新しいMacモードであるHybrid Computeで、1つのタスクをクラウドのフロンティアモデルとApple silicon上で動作するPPLX 27Bとに分割する。その裏には、マシンから何かが出る前に個人データをスキャンする新しいオンデバイスのPrivacy Gateがある。Mac発表の2日後の9月3日、Perplexityは、Portable Computerが24GB以上のVRAMを搭載したNVIDIA RTX GPU向けにLinuxでも利用可能になったと述べた。9月14日、同社はNVIDIA RTX GPUを搭載したWindows PCでも利用可能になったと述べた。同社によれば、これはローカルファーストの売り込みがこれまでに持った最も広いリーチであり、自分のハードウェアでエージェントを実行することを最も一般的なデスクトッププラットフォーム上で現実的な導入オプションにする一歩である。これらの主張はどちらもベンダーによるものである。

実際に出荷されたもの

Portable Computerは、Perplexityの「Computer」エージェントプラットフォームのオンデバイス版ビルドです。以前のComputer製品がオーケストレーターをクラウドで実行していたのに対し、Portable Computerはスタック全体を1つのシステムにまとめ、お使いのマシン上で実行します。エージェントハーネス、オーケストレーター、プランナー、ツールルーター、スケジューラー、耐久性のあるタスクキュー、ローカル検索インデックス、推論エンジン、そしてGoog​le Drive、Gmail、Slack、GitHub、Outlook用のアプリコネクターです。

2つの特性により、これはDIYのローカル環境とは一線を画します。第一に、コードとツールの実行はOSが強制するサンドボックス内で行われ、サンドボックスが利用できない場合は、保護なしで実行するのではなくツールの実行が無効化されます。第二に、設計上ローカルファーストです。すべてのタスクはデバイス上で開始され、あるステップでライブなWebデータや最先端の推論が必要な場合、オーケストレーターはいったん停止し、その単一のステップを15以上のクラウドモデルにエスカレーションする前に許可を求めます。デバイス上のPII分類器 — Perplexityがその後Privacy Gateとして製品化した技術 — が送信コンテキストを事前に検査し、何がマシンから送信されるかを正確に表示します。

2つの27Bモデル

起動時には、270億パラメータの2つのモデルから選択できます。Qwen 3.8 27BはAlibabaのApache-2.0オープンウェイトモデルで、262Kトークンのネイティブウィンドウを持つ高密度なマルチモーダル27Bであり、2週間前にリリースされ、すでに有力なセルフホストの選択肢となっています。PPLX 27Bは、その同じベースモデルをPerplexityがポストトレーニングしたもので、新しいアーキテクチャではなく、このハーネス向けに特化して調整された追加トレーニングであり、同社は自社のエージェントワークロードにおいてより精密でより効率的な挙動を実現すると主張しています。NVIDIAのNemotron 3.5 Lightning(30B)は近日公開として記載されており、独自モデルの持ち込みと推論サーバーの両方がサポートされているため、このハーネスはPerplexityのウェイトに縛られていません。

ベンチマーク、そしてそれが何でないか

主要な数字は、53タスクからなるLocal Knowledge Work Benchに由来します。これは、ナレッジワーカーが実際に委任するような仕事、つまりディープリサーチ、財務分析、ドキュメント作成を網羅するスイートです。Perplexityはこのベンチマークをオープンソース化する計画だと述べており、そうすれば最終的には、この比較は信奉ではなく再現可能なものになるでしょう。それまでは、これらの結果はベンダーによる実行です。そのスイートについては、ベンダーによると:

• PPLX 27B搭載ポータブルコンピュータ — 85.4%

• Qwen 3.8 27B搭載ポータブルコンピュータ — 82.6%

• Pi (オープンソースハーネス) — 77.6%

• Hermes (オープンソースのハーネス) — 74.0%

A single-column scoreboard titled 'PPLX 27B — the scoreboard' listing Local Knowledge Work Bench 85.4%, BrowseComp 66.7%, marginal cost $0 per token, context 262K tokens, runs on DGX Spark or RTX 24GB+, status new Aug 25 2026, with footer 'Perplexity-reported; not independently reproduced.'

さらに2件のベンダー報告による結果が、全体像を完成させる。{{4}}BrowseComp{{/4}}({{5}}ウェブリサーチスイート{{/5}})では、{{1}}Computer{{/1}}が66.7%を達成し、{{2}}Pi{{/2}}の50.2%と{{3}}Hermes{{/3}}の43.9%を上回った。しかも{{2}}Pi{{/2}}と比較して、ウォールタイムを51%削減し、トークン使用量を70%削減した。{{6}}ParseBench-100{{/6}}({{7}}文書抽出テスト{{/7}})では、65.1%を記録し、{{3}}Hermes{{/3}}の34.6%と{{2}}Pi{{/2}}の13.9%を大きく上回った。最も差が広がったのは、検索、ルーティング、ツール使用といった、ハーネス自身のインフラが評価されるタスクであり、そここそ{{8}}ポストトレーニング済みモデルと専用設計のプラミングスタック{{/8}}が真価を発揮する領域である。

経済の反転

より興味深い数字は価格だ。ローカルで完了した作業はトークンあたりのコストがゼロで、Perplexityのクレジットも消費しない——完全にローカルなタスクでは、カウンターはゼロのままである。コストがかかるのはエスカレーションだけであり、それはステップごとにオプトイン方式である。PerplexityはTerminal Bench 2.1でのハイブリッド計算結果を公開した:完全ローカルはほぼゼロコストで59.6%を記録し、フロンティアモデルをアドバイザーとして追加すると、1ロールアウトあたり約0.415ドルで73.0%に上昇した。フロンティアモデル単独では、1ロールアウトあたり約0.65ドルで82.4%に達した。最後の対比こそが論点である——ローカル推論は常時稼働エージェントのコスト曲線を平坦にし、クラウドへのエスカレーションは、それに見合う価値がある場合にのみ的を絞って発生する費用となる。

そのどれもが無料で始められるわけではない。ハードウェアが重要だ。Portable Computerは8月25日、128GBの統合メモリを搭載したデスクトップ・スーパーコンピュータであるNVIDIA DGX Spark(希望小売価格は約4,500ドル)上、または少なくとも24GBのVRAMを備えたRTX GPU(おおよそRTX 3090以降)を搭載したLinux PC上で、Linuxを優先してローンチした(32GB推奨)。9月3日、Perplexityは、Portable Computerが24GB以上のVRAMを備えたNVIDIA RTX GPU向けにLinuxで利用可能になったと述べた(同社による)。そして同じ週のNVIDIAのIFA 2026の展開では、ワンクリックインストーラーと簡素化されたローカルAIセットアップが追加され、24GB以上のVRAMを備えたRTX GPUに真正面から狙いを定め、Hermes agentやOpenClawと並んでPortable Computerの名前を挙げた。Windowsサポートは予定通り到着した。9月14日、Perplexityは、Portable ComputerがNVIDIA RTX GPUを搭載したWindows PCで利用可能になったと述べた(同社による)。Perplexity Windowsアプリ内で、オンデバイス推論には24GB以上のVRAMを備えたRTX GPUが必要で、Linuxの基準と一致しており、Linux版にはない2つの追加機能がある:自分のツールやアプリ統合を接続するためのローカルMCPと、離席中にPC上で定期的な作業をComputerに実行させるスケジュールタスクだ。macOSはLinuxローンチの1週間後に異なる形で登場した。Hybrid Computeで、次に取り上げる。そしてソフトウェア自体には有料のPerplexityプラン、すなわちPro、Max、Enterprise Pro、またはEnterprise Maxが必要だ。これは、既にPerplexityに課金している人々を対象としたサブスクリプション+ハードウェア製品であり、一般的なAPIではない。

Macの転換:ハイブリッド・コンピューティングとプライバシーの関門

9月1日、Perplexity Computer — Portable Computerの基盤となるエージェントプラットフォーム — が、Macデスクトップアプリでハイブリッドコンピュートを獲得した。ここでは、その分担はLinuxビルドとは逆方向に進む。タスクはクラウドで始まり、そこでフロンティアモデルが最も難しい推論、ウェブ調査、長期的な計画を担い、オーケストレーターが機密性の高いサブステップをAppleシリコン上で動作するローカルサブエージェントに引き渡す。ファイル、ローカルデータ、デバイス操作はMac上にとどまり、コンテキストは引き渡しを経ても維持され、ローカルのトークンがクラウドに到達することは一切ない。ローカルエンジンは、本稿が扱うモデルだ — PPLX 27B。Perplexityが事後学習させたQwen 3.8 27Bで、同社のMac向け資料ではPPLX Qwen 3.8 27Bとして記載され、Perplexityによれば、アプリ内のワンクリックダウンロードでインストールでき、Ollamaやターミナルでのセットアップは不要だ。残りのラインナップについては、発売時の報道が異なっている。ほとんどの媒体は、他のオンデバイス選択肢としてGoog​leのGem​ma 4 E4BとAliba​baのQwen3.6 35B-A3Bを追加し、ある媒体は27BではなくPerplexityが事後学習させたQw​en 3.6 35Bを挙げている — 初日に報道が一貫して触れなかった細部である。

Perplexityが主軸としている機能はPrivacy Gateだ。Secure Intelligence Instituteでトレーニングされたオンデバイス分類器で、プロンプト、ツール出力、メモリ、ログといった各タスクを、送信前に読み取り、氏名、住所、口座番号、認証情報、支払いカード番号、政府発行IDなどの個人識別情報を探す。検出された値は、リクエストがMacを離れる前に代替値に置き換えられ、回答が返ってきたときに復元される。ゲートが何かをフラグした場合、そのステップをローカルで実行するか、マスクするか、共有するかをユーザーが決定する。ゲートは確認を求めるだけで、決定は下さない。Perplexityはまた、分類器をオープンソース化し、PII検出器を評価するための13言語、13,148件の合成会話から構築されたベンチマークPII-TRACEをリリースしたと述べている。これらは同社の主張であり、独立した監査を受けたものではない。

Hybrid Computeは、macOS 15以降を搭載し、ユニファイドメモリが最低24GB(推奨32GB)のAppleシリコンMacであれば動作します。Perplexityによると、8GBおよび16GBのマシンは対象外です。この機能は、デスクトップアプリを通じてPro、Max、Enterpriseの各サブスクリプション利用者が利用でき、Enterpriseアカウントはオプトイン方式です。管理者は組織全体に適用される機密性ポリシーを設定でき、各デバイスから外部に送信される内容の記録を確認できます。ローカルでの処理はクラウドクレジットを消費せず、ローカルで生成されたトークンにも課金されません。費用が発生するのはクラウドでのオーケストレーションと委任のステップのみで、APIキーも不要です。注意点はLinux版のリリース時と同じです。ゲート自体がモデルであるため偽陰性が起こり得ますし、レビュアーたちは、この保護機能の効力はプロンプト表示時にユーザーが下す選択次第だとすぐに指摘しました。特にAppleInsiderは、機密データを扱う前にこの機能をテストするよう推奨しています。

A screenshot of the OrcaRouter model page for qwen/qwen3.8-27b showing the Vision, Tools, JSON and Reasoning badges and the description 'Qwen3.8-27B is Alibaba's open-weight 27B dense multimodal model, released under Apache-2.0 and self-hosted on OrcaRouter's own infrastructure'.

ルーターの設置場所

PPLX 27BはOrcaRouterがルーティングするものではありません — それはPerplexityのサブスクリプションを通じて、お客様が所有するハードウェア上で動作しており、私たちはそうでないふりをするつもりはありません。私たちがルーティングするのは、このローンチが招く比較対象のセットです。PPLX 27Bがポストトレーニングの出発点とする正確なベースウェイトであるQwen 3.8 27Bは、OrcaRouterのセルフホストで提供中です同様にDeepSeek V4 Flash、Gemini 3.5 Flash Lite、GPT-5.6 Lunaも — すべて1つのAPIキーで、プロバイダーの定価、マークアップゼロでそのまま提供されているため、ベンダーの値下げは発表されたその日に当社側でも反映されます。

これがここで重要になるのには、ひとつ具体的な理由がある。Portable Computer の売りはローカル対クラウドのコスト対比であり、その対比のクラウド側は、比較対象とする価格と同じだけしか正直ではない。OrcaRouter ではそれがプロバイダーの実際の定価なので、ローカルかクラウドかの判断は、マーケティング上の比較ではなく、信頼できる計算になる。そして、同じエージェントを両方のやり方でプロトタイプしたい場合——1台のマシン上のローカルハーネス、1つのエンドポイントの背後にあるクラウドモデル——自動フェイルオーバーにより、ローカルモデルの能力が及ばないときにクラウド側が代役を務められる。2つ目の契約や2つ目のコードパスは不要だ。Hybrid Compute も同じ取引を繰り返す——ローカルトークンは無料、クラウドオーケストレーションだけが支出——なので、ローカル側が DGX Spark、Linux RTX ワークステーション、Mac、あるいは——9月14日以降は——RTX GPU を搭載した Windows PC のどれで動いていても、この計算は当てはまる。

A two-panel infographic titled 'Local vs Cloud — the cost shape' comparing a left 'PPLX 27B (local)' panel (cost per token $0, upfront ~$4,500 DGX Spark, escalation opt-in per step) with a right 'Cloud escalation' panel (fully local 59.6% at ~$0.00, hybrid 73.0% at ~$0.415, frontier alone 82.4% at ~$0.65), footer 'Perplexity-reported hybrid math on Terminal Bench 2.1.'

何を見るべきか

今後1か月の4つの出来事が、これがニッチ製品なのか、それともカテゴリーの始まりなのかを決める。Perplexityが実際にLocal Knowledge Work Benchをオープンソース化するかどうか。それが実現すれば、見出しの数字は主張から、コミュニティが再現できるものへと変わる。Nemotron 3.5 Lightningが登場し、同じハーネス上でPPLX 27Bを上回るかどうか——「ハーネスのためにポストトレーニングする」という命題の価値は、その下にあるベースモデル次第だ。分類器がオープンソース化された今、Privacy Gateが敵対的検証に耐えるかどうか——確率的PII検出器がハイブリッド提案の要となるのは、実際に氏名、口座番号、認証情報を回線に流さない場合だけだ。そして、Linuxローンチが決して持てなかったリーチが、9月の拡大を通じてついに届くかどうか——9月3日に確認されたRTX-24GB Linuxルート、9月14日にPerplexity Windowsアプリで確認されたWindowsサポート、そしてMacでのHybrid Compute——これにより、Perplexityがこれまでに出荷した中で最も広範なコンシューマーハードウェア上に、同じローカルエージェントの経済性がもたらされる。ベンチマークが本物で、ハーネスが転用できるなら、「エージェントを自分のハードウェアで動かす」は趣味人のパターンではなくなり、真に実効性のあるデプロイ選択肢になる——そして、比較対象となるクラウドモデルは、トークンあたりの価格に見合うことを示さなければならなくなる。