PPLX 27B viene lanciato nel computer portatile di Perplexity — un agente locale che batte le imbracature aperte. Illustrazione rigenerata.
Guides & Insights

PPLX 27B debutta nel computer portatile di Perplexity: un agente locale che supera i banchi di prova aperti.

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

PPLX 27B di Perplexity non è un modello cloud, e questa è tutta la storia. Annunciato il 25 agosto 2026, insieme a Portable Computer — l'agente local-first dell'azienda, costruito con NVIDIA — PPLX 27B è una versione post-addestrata di Qwen 3.8 27B open-weight di Alibaba, messa a punto da Perplexity per il proprio harness per agenti e distribuita per funzionare interamente su hardware di tua proprietà. Sul Local Knowledge Work Bench a 53 attività di Perplexity, l'harness che esegue PPLX 27B ha ottenuto l'85,4%, superiore allo stesso harness su Qwen 3.8 27B (82,6%) e a due harness per agenti open source, Pi (77,6%) e Hermes (74,0%). Sono i numeri dell'azienda stessa, provenienti dal post di lancio e dal paper di ricerca di accompagnamento, "A Local-First Agent for Private and Cost-Effective Knowledge Work", non riprodotti in modo indipendente — ma sono la prima prova pubblica che un modello da 27B su un desktop può sostenere vero lavoro intellettuale a una frazione del prezzo del cloud. Una settimana dopo, il 1° settembre, lo stesso modello post-addestrato è comparso in una seconda distribuzione: Hybrid Compute, la nuova modalità Mac dell'agente Computer di Perplexity, che suddivide una singola attività tra modelli cloud all'avanguardia e PPLX 27B in esecuzione su Apple silicon — dietro un nuovo Privacy Gate sul dispositivo che scansiona alla ricerca di dati personali prima che qualsiasi cosa lasci la macchina. Due giorni dopo l'annuncio per Mac, il 3 settembre, Perplexity ha dichiarato che Portable Computer è ora disponibile anche su Linux per GPU NVIDIA RTX con 24 GB di VRAM o più. Il 14 settembre, l'azienda ha dichiarato che è ora disponibile su PC Windows con GPU NVIDIA RTX — la portata più ampia che la proposta local-first abbia mai avuto, secondo l'azienda, e il passo che rende l'esecuzione dell'agente sul proprio hardware una vera opzione di distribuzione sulla piattaforma desktop più diffusa. Entrambe le affermazioni sono dichiarate dall'azienda.

Cosa è stato effettivamente spedito

Portable Computer è la build on-device della piattaforma agente "Computer" di Perplexity. Mentre il precedente prodotto Computer eseguiva il suo orchestratore nel cloud, Portable Computer racchiude l'intero stack in un unico sistema che gira sulla tua macchina: l'agent harness, l'orchestratore, il planner, il tool router, lo scheduler, una coda di attività durevole, un indice di ricerca locale, il motore di inferenza e i connettori delle app per Goog​le Drive, Gmail, Slack, GitHub e Outlook.

Due proprietà la distinguono da una configurazione locale fai-da-te. In primo luogo, l'esecuzione di codice e strumenti avviene all'interno di una sandbox imposta dal sistema operativo e, se la sandbox non è disponibile, l'esecuzione degli strumenti viene disabilitata anziché eseguita senza protezione. In secondo luogo, è local-first per progettazione: ogni attività inizia sul dispositivo e, se un passaggio richiede dati web live o ragionamento di frontiera, l'orchestratore si ferma e chiede il permesso prima di inoltrare quel singolo passaggio a uno dei 15+ modelli cloud. Un classificatore PII on-device — la tecnologia che Perplexity ha successivamente commercializzato come Privacy Gate — esamina prima il contesto in uscita e ti mostra esattamente ciò che lascerebbe la macchina.

I due modelli 27B

Al lancio si sceglie tra due modelli da 27 miliardi di parametri. Qwen 3.8 27B è il modello open-weight con licenza Apache-2.0 di Alibaba: un 27B denso e multimodale con una finestra nativa di 262K token, rilasciato due settimane prima e già una solida opzione per il self-hosting. PPLX 27B è quella stessa base post-addestrata da Perplexity: non una nuova architettura, ma un addestramento aggiuntivo messo a punto specificamente per questo harness, con l'azienda che dichiara un comportamento più preciso e più efficiente sui propri carichi di lavoro agentici. Il Nemotron 3.5 Lightning (30B) di NVIDIA è indicato come in arrivo, e sia il bring-your-own model sia il server di inferenza sono supportati, quindi l'harness non è vincolato ai pesi di Perplexity.

Il benchmark, e cosa non è

Il dato principale proviene dal Local Knowledge Work Bench con 53 attività, una suite che copre il tipo di lavoro che un knowledge worker delegherebbe davvero — ricerca approfondita, analisi finanziaria, creazione di documenti. Perplexity afferma di avere in programma di rendere open-source il benchmark, che alla fine renderà il confronto ripetibile anziché basato sulla fiducia. Fino ad allora, questi risultati sono gestiti dal venditore. Su quella suite, secondo il venditore:

• Computer portatile con PPLX 27B — 85.4%

• Computer portatile con Qwen 3.8 27B — 82.6%

• Pi (harness open-source) — 77,6%

• Hermes (strumento open-source) — 74.0%

A single-column scoreboard titled 'PPLX 27B — the scoreboard' listing Local Knowledge Work Bench 85.4%, BrowseComp 66.7%, marginal cost $0 per token, context 262K tokens, runs on DGX Spark or RTX 24GB+, status new Aug 25 2026, with footer 'Perplexity-reported; not independently reproduced.'

Altri due risultati segnalati dai vendor completano il quadro. Su BrowseComp, la suite di ricerca web, Computer ha ottenuto il 66,7% contro il 50,2% di Pi e il 43,9% di Hermes, utilizzando inoltre il 51% in meno di tempo reale e il 70% in meno di token rispetto a Pi. Su ParseBench-100, un test di estrazione di documenti, ha ottenuto il 65,1% contro il 34,6% di Hermes e il 13,9% di Pi. I divari più ampi si registrano nei compiti che premiano l'infrastruttura stessa del sistema – ricerca, instradamento, uso di strumenti – ovvero dove un modello post-addestrato e uno stack di integrazione costruito su misura danno il meglio di sé.

Il capovolgimento dell'economia

Il numero più interessante è il prezzo. Il lavoro completato localmente ha un costo per token pari a zero e non consuma crediti Perplexity: il contatore resta a zero per un'attività interamente locale. L'escalation è l'unica cosa che costa denaro, ed è opzionale per ogni passaggio. Perplexity ha pubblicato la matematica ibrida su Terminal Bench 2.1: il solo locale ha ottenuto il 59,6% a costo praticamente zero; aggiungere un modello di frontiera come consulente lo ha portato al 73,0% a circa 0,415 $ per rollout; il solo modello di frontiera ha raggiunto l'82,4% a circa 0,65 $ per rollout. L'ultimo contrasto è la tesi: l'inferenza locale appiattisce la curva dei costi per gli agenti sempre attivi, e l'escalation al cloud diventa una spesa chirurgica che si ripaga da sola.

Nessuno dei quali è gratuito per iniziare. Il box conta. Portable Computer è stato lanciato prima su Linux il 25 agosto su NVIDIA DGX Spark, il supercomputer desktop con 128 GB di memoria unificata (prezzo di listino intorno ai 4.500 $), oppure su PC Linux con GPU RTX da almeno 24 GB di VRAM — all'incirca una RTX 3090 o più recente — con 32 GB consigliati. Il 3 settembre, Perplexity ha dichiarato che Portable Computer è ora disponibile su Linux per GPU NVIDIA RTX con 24 GB di VRAM o più — secondo l'azienda — e il lancio di NVIDIA all'IFA 2026 della stessa settimana ha aggiunto installer con un clic e una configurazione semplificata dell'IA locale pensata espressamente per GPU RTX con 24 GB o più di VRAM, citando Portable Computer insieme all'agente Hermes e OpenClaw. Il supporto per Windows è arrivato come previsto: il 14 settembre, Perplexity ha dichiarato che Portable Computer è ora disponibile su PC Windows con GPU NVIDIA RTX — secondo l'azienda — nell'app Perplexity per Windows, con inferenza sul dispositivo che richiede una GPU RTX con 24 GB di VRAM o superiore, in linea con la soglia di Linux, e con due aggiunte che la versione Linux non offre: MCP locale per collegare i tuoi strumenti e integrazioni con app, e attività pianificate che consentono a Computer di eseguire lavori ricorrenti sul tuo PC mentre sei via. macOS è arrivato in una forma diversa una settimana dopo il lancio su Linux — Hybrid Compute, trattato più avanti. E il software stesso richiede un piano Perplexity a pagamento: Pro, Max, Enterprise Pro o Enterprise Max. Si tratta di un prodotto che unisce abbonamento e hardware, rivolto a persone che già pagano Perplexity, non un'API generale.

La svolta del Mac: calcolo ibrido e il cancello della privacy.

Il 1° settembre, Perplexity Computer — la piattaforma di agenti da cui è costruito Portable Computer — ha ottenuto Hybrid Compute nell'app desktop Mac. Qui la divisione funziona nel modo opposto rispetto alla build Linux: un'attività inizia nel cloud, dove i modelli di frontiera gestiscono il ragionamento più difficile, la ricerca web e la pianificazione a lungo termine, e l'orchestratore affida i sotto-passaggi sensibili a un subagente locale in esecuzione su Apple silicon. I file, i dati locali e le azioni sul dispositivo restano sul Mac, il contesto sopravvive al passaggio di consegne e nessuno dei token locali raggiunge mai il cloud. Il motore locale è il modello di cui parla questo articolo — PPLX 27B, il Qwen 3.8 27B post-addestrato di Perplexity, indicato nei materiali Mac dell'azienda come PPLX Qwen 3.8 27B e installato con un download con un clic nell'app, senza configurazione di Ollama o del terminale, secondo Perplexity. La copertura del lancio varia per il resto della gamma: la maggior parte delle testate aggiunge Gem​ma 4 E4B di Goog​le e Qwen3.6 35B-A3B di Aliba​ba come altre opzioni on-device, e una cita un Qw​en 3.6 35B post-addestrato da Perplexity invece del 27B — un dettaglio che la stampa non ha centrato in modo coerente il primo giorno.

La funzionalità di punta di Perplexity è il Privacy Gate, un classificatore on-device addestrato con il suo Secure Intelligence Institute. Legge ogni attività — prompt, output degli strumenti, memoria, log — prima che qualsiasi cosa venga trasmessa, cercando informazioni personalmente identificabili: nomi, indirizzi, numeri di conto, credenziali, numeri di carte di pagamento e ID governativi. I valori rilevati vengono sostituiti con segnaposto prima che la richiesta lasci il Mac e ripristinati quando arriva la risposta; quando il gate segnala qualcosa, l'utente decide se quel passaggio venga eseguito localmente, mascherato o condiviso — il gate chiede, non decide. Perplexity afferma inoltre di aver reso open-source il classificatore e di aver rilasciato PII-TRACE, un benchmark costruito da 13.148 conversazioni sintetiche in 13 lingue per valutare i rilevatori di PII. Queste sono affermazioni dell'azienda, non verificate in modo indipendente.

Hybrid Compute funziona su qualsiasi Mac Apple silicon con macOS 15 o versioni successive e un minimo di 24GB di memoria unificata — 32GB consigliati, mentre Perplexity afferma che le macchine con 8GB e 16GB sono escluse. È disponibile per gli abbonati Pro, Max ed Enterprise tramite l'app desktop, con gli account enterprise che possono aderire e gli amministratori in grado di impostare una policy di sensibilità a livello di organizzazione e consultare un registro di ciò che lascia ogni dispositivo. Il lavoro locale non consuma crediti cloud e i token generati localmente non vengono addebitati — solo i passaggi di orchestrazione e delega cloud hanno un costo, e non serve alcuna API key. Le avvertenze coincidono con il lancio su Linux: il gate è esso stesso un modello, quindi sono possibili falsi negativi, e i recensori hanno subito notato che la protezione è valida solo quanto le scelte che l'utente compie quando viene richiesto. AppleInsider, in particolare, ha consigliato di testare la funzionalità prima di affidarle dati sensibili.

A screenshot of the OrcaRouter model page for qwen/qwen3.8-27b showing the Vision, Tools, JSON and Reasoning badges and the description 'Qwen3.8-27B is Alibaba's open-weight 27B dense multimodal model, released under Apache-2.0 and self-hosted on OrcaRouter's own infrastructure'.

Dove si inserisce il router

PPLX 27B non è qualcosa che OrcaRouter instrada — gira su hardware di tua proprietà, dietro un abbonamento Perplexity, e non fingiamo il contrario. Ciò che instradiamo è il set di confronti a cui questo lancio invita. Qwen 3.8 27B, gli esatti pesi base su cui PPLX 27B esegue il post-training, è live su OrcaRouter self-hosted; lo stesso vale per DeepSeek V4 Flash, Gemini 3.5 Flash Lite e GPT-5.6 Luna — tutti dietro un'unica chiave API al prezzo di listino del provider, trasferito senza alcun markup, così un taglio di prezzo del fornitore è live anche da noi lo stesso giorno in cui viene annunciato.

Questo conta qui per una ragione specifica. La proposta di Portable Computer è il contrasto di costi tra locale e cloud, e la metà cloud di quel contrasto è onesta solo quanto i prezzi con cui la confronti. Su OrcaRouter, questi sono i prezzi di listino effettivi del provider, il che trasforma la decisione locale-o-cloud in un calcolo di cui ti puoi fidare anziché in un confronto di marketing. E se vuoi prototipare lo stesso agente in entrambi i modi — harness locale su una macchina, modelli cloud dietro un unico endpoint — il failover automatico consente al lato cloud di subentrare quando il modello locale non è all'altezza, senza un secondo contratto o un secondo percorso di codice. Hybrid Compute ripete lo stesso patto — token locali gratuiti, l'orchestrazione cloud come unica spesa — quindi il calcolo vale sia che la metà locale giri su una DGX Spark, una workstation Linux RTX, un Mac, o — dal 14 settembre — un PC Windows con una GPU RTX.

A two-panel infographic titled 'Local vs Cloud — the cost shape' comparing a left 'PPLX 27B (local)' panel (cost per token $0, upfront ~$4,500 DGX Spark, escalation opt-in per step) with a right 'Cloud escalation' panel (fully local 59.6% at ~$0.00, hybrid 73.0% at ~$0.415, frontier alone 82.4% at ~$0.65), footer 'Perplexity-reported hybrid math on Terminal Bench 2.1.'

Cosa guardare

Quattro cose nel prossimo mese decidono se questo è un prodotto di nicchia o l'inizio di una categoria. Se Perplexity rende effettivamente open source il Local Knowledge Work Bench, il che trasformerebbe i numeri di punta da affermazioni in qualcosa che la community può riprodurre. Se Nemotron 3.5 Lightning arriva e batte PPLX 27B sullo stesso harness — la tesi del "post-train for the harness" vale solo quanto il modello base sottostante. Se il Privacy Gate sopravvive allo scrutinio avversariale ora che il classificatore è open source — un rilevatore probabilistico di PII è il fulcro del pitch ibrido solo se riesce effettivamente a tenere nomi, numeri di conto e credenziali fuori dalla rete. E se la portata che il lancio su Linux non ha mai avuto arriva finalmente attraverso l'ampliamento di settembre — la rotta Linux RTX-24GB confermata il 3 settembre, il supporto Windows confermato il 14 settembre nell'app Perplexity per Windows, e Hybrid Compute su Mac — mettendo la stessa economia degli agenti locali sull'hardware di consumo più ampio che Perplexity abbia mai distribuito. Se il benchmark è reale e l'harness si trasferisce, "esegui l'agente sul tuo hardware" smette di essere un modello da hobbisti e diventa un'opzione di deployment con vero mordente — e i modelli cloud con cui viene confrontato dovranno guadagnarsi i loro prezzi per token.