
PPLX 27B lanceert in Perplexity's Portable Computer: een lokale agent die de Open Harnesses verslaat.
- DeepSeekNIEUWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.32026-08-1860Intelligentie75Coderen
- obsidianNIEUWQwen3.8 27B2026-08-1552Intelligentie68Coderen
- qwenNIEUWQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNIEUWDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligentie69Coderen
- grokNIEUWSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1653Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1560Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligentie71Coderen
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligentie77Coderen
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligentie77Coderen
Perplexity's PPLX 27B is geen cloudmodel, en dat is het hele verhaal. Het model werd aangekondigd op 25 augustus 2026, samen met Portable Computer — de local-first agent van het bedrijf, gebouwd met NVIDIA — en is een post-getrainde versie van Alibaba's open-gewichten Qwen 3.8 27B, door Perplexity afgestemd op de eigen agent-harness en uitgebracht om volledig te draaien op hardware die je zelf in huis hebt. Op Perplexity's 53-taken Local Knowledge Work Bench behaalde de harness met PPLX 27B een score van 85,4%, beter dan dezelfde harness met Qwen 3.8 27B (82,6%) en dan twee open-source agent-harnesses, Pi (77,6%) en Hermes (74,0%). Dat zijn de eigen cijfers van de leverancier uit het lanceringsbericht en het bijbehorende onderzoekspaper, 'A Local-First Agent for Private and Cost-Effective Knowledge Work', niet onafhankelijk gereproduceerd — maar ze vormen het eerste openbare bewijs dat een 27B-model op een desktop echt kenniswerk kan verrichten tegen een fractie van de cloudprijs.
Wat er daadwerkelijk is uitgebracht
Portable Computer is de on-device-build van Perplexity's "Computer"-agentplatform. Waar het eerdere Computer-product zijn orchestrator in de cloud liet draaien, verpakt Portable Computer de hele stack in één systeem dat op jouw machine draait: de agent-harness, orchestrator, planner, toolrouter, scheduler, een duurzame taakwachtrij, een lokale zoekindex, de inferentie-engine en de app-connectors voor Google Drive, Gmail, Slack, GitHub en Outlook.
Twee eigenschappen onderscheiden het van een doe-het-zelf lokale opstelling. Ten eerste gebeuren code- en tooluitvoering binnen een door het besturingssysteem afgedwongen sandbox, en als de sandbox niet beschikbaar is, wordt tooluitvoering uitgeschakeld in plaats van onbeschermd uitgevoerd. Ten tweede is het ontworpen als local-first: elke taak start op het apparaat, en als een stap live webdata of geavanceerde redenering nodig heeft, stopt de orchestrator en vraagt toestemming voordat hij die ene stap opschaalt naar een van de 15+ cloudmodellen. Een PII-classifier draait eerst over de uitgaande context en laat je precies zien wat de machine zou verlaten.
De twee 27B-modellen
Bij de lancering kies je tussen twee modellen met 27 miljard parameters. Qwen 3.8 27B is Alibaba's Apache-2.0 open-weightmodel — een dense, multimodaal 27B-model met een native contextvenster van 262K tokens, twee weken eerder uitgebracht en al een sterke self-host-optie. PPLX 27B is datzelfde basismodel, verder getraind door Perplexity: geen nieuwe architectuur, maar aanvullende training die specifiek is afgestemd op deze harness, waarbij het bedrijf claimt dat het zich bij zijn eigen agent-workloads nauwkeuriger en efficiënter gedraagt. NVIDIA's Nemotron 3.5 Lightning (30B) staat vermeld als 'binnenkort beschikbaar', en zowel een eigen model als een eigen inferenceserver worden ondersteund, dus de harness is niet gebonden aan Perplexity's gewichten.
De benchmark, en wat het niet is
Het belangrijkste cijfer komt van de Local Knowledge Work Bench met 53 taken, een suite die het soort werk bestrijkt dat een kenniswerker daadwerkelijk zou delegeren — diepgaand onderzoek, financiële analyse en documentcreatie. Perplexity zegt dat het van plan is de benchmark open source te maken, waardoor de vergelijking uiteindelijk herhaalbaar wordt in plaats van op vertrouwen te moeten worden aangenomen. Tot die tijd zijn deze resultaten door de leverancier gegenereerd. Op die suite, aldus de leverancier:
Draagbare computer met PPLX 27B — 85,4%
Draagbare computer met Qwen 3.8 27B — 82,6%
• Pi (open-source testraamwerk) — 77,6%
Hermes (open-source testraamwerk) — 74,0%

Nog twee door de leverancier gerapporteerde resultaten maken het beeld compleet. Op BrowseComp, de webonderzoekssuite, scoorde Computer 66,7% tegen 50,2% voor Pi en 43,9% voor Hermes, terwijl het 51% minder doorlooptijd en 70% minder tokens gebruikte dan Pi. Op ParseBench-100, een documentextractietest, scoorde het 65,1% tegen 34,6% voor Hermes en 13,9% voor Pi. De grootste verschillen doen zich voor bij de taken die de eigen infrastructuur van een harness belonen — zoeken, routeren, toolgebruik — en dat is waar een na-getraind model plus een speciaal gebouwde infrastructuurstack zijn waarde bewijst.
De economische ommekeer
Het interessantere getal is de prijs. Lokaal uitgevoerd werk kost nul per token en verbruikt geen Perplexity-credits — de teller blijft op nul staan bij een volledig lokale taak. Escalatie is het enige dat geld kost, en dat is per stap opt-in. Perplexity publiceerde de hybride berekeningen op Terminal Bench 2.1: volledig lokaal scoorde 59,6% tegen vrijwel nul kosten; het toevoegen van een frontier-model als adviseur bracht het op 73,0% tegen ongeveer $0,415 per rollout; het frontier-model alleen bereikte 82,4% tegen ongeveer $0,65 per rollout. Dat laatste contrast is de these — lokale inferentie vlakt de kostencurve af voor altijd-actieve agents, en cloud-escalatie wordt een gerichte uitgave die zichzelf terugverdient.
Niets daarvan is gratis om te beginnen. De hardware doet ertoe. Portable Computer lanceert Linux-first op de NVIDIA DGX Spark, de desktop-supercomputer met 128 GB unified memory (adviesprijs circa $4.500), of op Linux-pc's met RTX-GPU's van minimaal 24 GB VRAM — grofweg een RTX 3090 of nieuwer — met 32 GB aanbevolen. Windows-ondersteuning staat gepland voor september; macOS is niet aangekondigd. En de software zelf vereist een betaald Perplexity-abonnement: Pro, Max, Enterprise Pro of Enterprise Max. Dit is een abonnement-plus-hardwareproduct gericht op mensen die al voor Perplexity betalen, niet een algemene API.

Waar de router past
PPLX 27B wordt niet door OrcaRouter gerouteerd — het draait op hardware die je zelf bezit, achter een Perplexity-abonnement, en we zullen niet doen alsof dat anders is. Wat we wel routeren is de vergelijkingsset die deze lancering oproept. Qwen 3.8 27B, de exacte basisgewichten waarop PPLX 27B voortbouwt, is live op OrcaRouter self-hosted; ook DeepSeek V4 Flash, Gemini 3.5 Flash Lite en GPT-5.6 Luna — allemaal achter één API-sleutel tegen de lijstprijs van de provider, zonder enige opslag, zodat een prijsverlaging van de leverancier dezelfde dag dat deze wordt aangekondigd, bij ons live is.
Dat is hier om één specifieke reden van belang. De pitch van Portable Computer draait om de kostenvergelijking tussen lokaal en de cloud, en de cloudkant van die vergelijking is slechts zo eerlijk als de prijzen waarmee je vergelijkt. Bij OrcaRouter zijn dat de daadwerkelijke catalogusprijzen van de provider, waardoor de beslissing tussen lokaal of cloud een berekening wordt die je kunt vertrouwen in plaats van een marketingvergelijking. En als je dezelfde agent op beide manieren wilt prototypen — lokale testopstelling op één machine, cloudmodellen achter één endpoint — dan zorgt automatische failover ervoor dat de cloudkant het overneemt wanneer het lokale model tekortschiet, zonder tweede contract of tweede codepad.

Wat te kijken
Drie dingen in de komende maand bepalen of dit een nicheproduct is of het begin van een categorie. Of Perplexity de Local Knowledge Work Bench daadwerkelijk open-sourcet, wat de opvallende cijfers van louter beweringen zou omzetten in iets dat de community kan reproduceren. Of Nemotron 3.5 Lightning uitkomt en PPLX 27B verslaat op dezelfde harness — de stelling 'post-train for the harness' is slechts zo goed als het basismodel eronder. En of Windows-ondersteuning in september het bereik vergroot tot buiten DGX Spark-bezitters. Als de benchmark echt is en de harness overdraagbaar blijkt, houdt 'draai de agent op je eigen GPU' op een hobbyistenpatroon te zijn en wordt het een deployment-optie met echte tanden — en de cloudmodellen waarmee het vergeleken wordt, zullen hun per-token-prijzen moeten verdienen.
