
PPLX 27B เปิดตัวในคอมพิวเตอร์พกพาของ Perplexity: เอเจนต์ท้องถิ่นที่เอาชนะ Open Harnesses
- Orcaใหม่Orca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 87 tok/s
- openaiใหม่OpenAI: GPT-6.1 Sol2026-09-2952ความฉลาด
- anthropicใหม่Anthropic: Claude Sonnet 5.52026-09-2856ความฉลาด
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 ต่อ 1 ล้านโทเค็น · 115 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238ความฉลาด
- OpenAIOpenAI: GPT-6 Sol2026-09-2248ความฉลาด
- AnthropicAnthropic: Claude Opus 5.52026-09-2258ความฉลาด
- xAIGrok 4.72026-09-2146ความฉลาด
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 ต่อ 1 ล้านโทเค็น · 47 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 ต่อ 1 ล้านโทเค็น · 777 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040ความฉลาด
- OpenAIOpenAI: GPT-6 Astra2026-09-0453ความฉลาด77การเขียนโค้ด
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241ความฉลาด76การเขียนโค้ด
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245ความฉลาด76การเขียนโค้ด
- AnthropicAnthropic: Claude Fable 5.12026-09-0153ความฉลาด82การเขียนโค้ด
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 ต่อ 1 ล้านโทเค็น · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 ต่อ 1 ล้านโทเค็น · 450 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642ความฉลาด72การเขียนโค้ด
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 ต่อ 1 ล้านโทเค็น · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845ความฉลาด75การเขียนโค้ด
PPLX 27B ของ Perplexity ไม่ใช่โมเดลบนคลาวด์ และนั่นคือเรื่องราวทั้งหมด เปิดตัวเมื่อวันที่ 25 สิงหาคม 2026 ควบคู่กับ Portable Computer — เอเจนต์แบบ local-first ของบริษัท ซึ่งสร้างร่วมกับ NVIDIA — PPLX 27B เป็นเวอร์ชัน post-trained ของ Qwen 3.8 27B แบบ open-weight ของ Alibaba ปรับแต่งโดย Perplexity สำหรับ agent harness ของตัวเอง และจัดส่งให้ทำงานทั้งหมดบนฮาร์ดแวร์ที่คุณเป็นเจ้าของ บน Local Knowledge Work Bench 53 งานของ Perplexity harness ที่รัน PPLX 27B ทำคะแนนได้ 85.4% นำหน้า harness เดียวกันบน Qwen 3.8 27B (82.6%) และนำหน้า agent harness โอเพนซอร์สสองตัวคือ Pi (77.6%) และ Hermes (74.0%) นี่คือตัวเลขของผู้ขายเองจากโพสต์เปิดตัวและรายงานวิจัยประกอบ "A Local-First Agent for Private and Cost-Effective Knowledge Work" ไม่ได้ถูกทำซ้ำโดยอิสระ — แต่เป็นหลักฐานสาธารณะชิ้นแรกว่าโมเดล 27B บนเดสก์ท็อปสามารถรองรับงานความรู้จริงได้ในราคาเพียงเศษเสี้ยวของคลาวด์ หนึ่งสัปดาห์ต่อมา วันที่ 1 กันยายน โมเดล post-trained ตัวเดียวกันก็ปรากฏในการปรับใช้ครั้งที่สอง: Hybrid Compute โหมด Mac ใหม่ของ Computer agent ของ Perplexity ซึ่งแบ่งงานเดียวระหว่างโมเดลคลาวด์ระดับแนวหน้ากับ PPLX 27B ที่รันบน Apple silicon — เบื้องหลัง Privacy Gate บนอุปกรณ์ตัวใหม่ที่สแกนหาข้อมูลส่วนบุคคลก่อนที่สิ่งใดจะออกจากเครื่อง สองวันหลังการประกาศ Mac วันที่ 3 กันยายน Perplexity กล่าวว่า Portable Computer ยังพร้อมใช้งานบน Linux สำหรับ NVIDIA RTX GPUs ที่มี VRAM 24GB ขึ้นไป วันที่ 14 กันยายน บริษัทกล่าวว่าขณะนี้พร้อมใช้งานบน Windows PCs ที่มี NVIDIA RTX GPUs — การเข้าถึงที่กว้างที่สุดที่ข้อเสนอ local-first เคยมี ตามที่บริษัทระบุ และเป็นก้าวที่ทำให้การรันเอเจนต์บนฮาร์ดแวร์ของคุณเองเป็นตัวเลือกการปรับใช้จริงบนแพลตฟอร์มเดสก์ท็อปที่พบมากที่สุด ข้อกล่าวอ้างทั้งสองเป็นคำกล่าวอ้างจากผู้ขาย
สิ่งที่ส่งมอบจริง
Portable Computer คือเวอร์ชันที่ทำงานบนอุปกรณ์ของแพลตฟอร์มเอเจนต์ "Computer" ของ Perplexity โดยที่ผลิตภัณฑ์ Computer รุ่นก่อนหน้าใช้ตัวจัดการ (orchestrator) ทำงานบนคลาวด์ Portable Computer กลับรวมสแตกทั้งหมดไว้ในระบบเดียวที่ทำงานบนเครื่องของคุณ: ตัวรันเอเจนต์ (agent harness), ตัวจัดการ (orchestrator), ตัววางแผน (planner), ตัวจัดเส้นทางเครื่องมือ (tool router), ตัวจัดตารางเวลา (scheduler), คิวงานแบบคงทน, ดัชนีค้นหาในเครื่อง, เอนจินอนุมาน และตัวเชื่อมต่อแอปสำหรับ Google Drive, Gmail, Slack, GitHub และ Outlook
คุณสมบัติสองประการที่ทำให้แตกต่างจากการตั้งค่าแบบ DIY ในเครื่องของตัวเอง {{1}}ประการแรก การเรียกใช้โค้ดและเครื่องมือเกิดขึ้นภายในแซนด์บ็อกซ์ที่ระบบปฏิบัติการบังคับใช้ และหากแซนด์บ็อกซ์ไม่พร้อมใช้งาน การเรียกใช้เครื่องมือจะถูกปิดใช้งานแทนที่จะรันโดยไม่มีการป้องกัน{{/1}} {{2}}ประการที่สอง มันเป็นแบบ local-first โดยการออกแบบ: ทุกงานเริ่มต้นบนอุปกรณ์ และหากขั้นตอนใดต้องการข้อมูลเว็บแบบสดหรือการใช้เหตุผลระดับ frontier ตัวออร์เคสเตรเตอร์จะหยุดและขออนุญาตก่อนที่จะส่งต่อขั้นตอนนั้นเพียงขั้นตอนเดียวไปยังหนึ่งในโมเดลคลาวด์กว่า 15 รายการ{{/2}} ตัวจำแนก PII บนอุปกรณ์ — เทคโนโลยีที่ Perplexity ได้พัฒนาเป็นผลิตภัณฑ์ในชื่อ Privacy Gate — จะทำงานตรวจสอบบริบทขาออกก่อน และแสดงให้คุณเห็นอย่างชัดเจนว่าสิ่งใดจะถูกส่งออกจากเครื่อง
โมเดล 27B ทั้งสองตัว
ตอนเปิดตัว คุณเลือกได้ระหว่างสองโมเดลขนาด 27,000 ล้านพารามิเตอร์ Qwen 3.8 27B เป็นโมเดลเปิดน้ำหนักภายใต้ Apache-2.0 ของ Alibaba — โมเดล dense แบบมัลติโมดัลขนาด 27B ที่มีหน้าต่างบริบทเนทีฟ 262K โทเคน เปิดตัวก่อนหน้านี้สองสัปดาห์และเป็นตัวเลือก self-host ที่แข็งแกร่งอยู่แล้ว PPLX 27B คือฐานเดียวกันนั้นที่ผ่านการ post-train โดย Perplexity: ไม่ใช่สถาปัตยกรรมใหม่ แต่เป็นการฝึกเพิ่มเติมที่จูนมาเพื่องานฮาร์เนสนี้โดยเฉพาะ โดยบริษัทอ้างว่ามีพฤติกรรมที่แม่นยำและมีประสิทธิภาพมากกว่าบนเวิร์กโหลดเอเจนต์ของตัวเอง Nemotron 3.5 Lightning (30B) ของ NVIDIA ถูกระบุว่าจะมาเร็ว ๆ นี้ และรองรับทั้งการนำโมเดลของคุณเองมาใช้ (bring-your-own model) และ inference server ดังนั้นฮาร์เนสนี้จึงไม่ได้ผูกติดอยู่กับน้ำหนักของ Perplexity
เกณฑ์มาตรฐาน และสิ่งที่มันไม่ใช่
ตัวเลขหลักมาจาก Local Knowledge Work Bench ซึ่งมี 53 งาน เป็นชุดที่ครอบคลุมงานประเภทที่คนทำงานสายความรู้ (knowledge worker) จะมอบหมายให้ทำจริง อย่างเช่น การวิจัยเชิงลึก การวิเคราะห์ทางการเงิน และการสร้างเอกสาร Perplexity กล่าวว่ามีแผนจะเปิดซอร์สเบนช์มาร์กนี้ ซึ่งในที่สุดจะทำให้การเปรียบเทียบสามารถทำซ้ำได้ แทนที่จะเชื่อถือโดยไม่มีหลักฐาน จนกว่าจะถึงตอนนั้น ผลลัพธ์เหล่านี้ดำเนินการโดยผู้ขาย สำหรับชุดทดสอบนี้ ตามที่ผู้ขายระบุ:
• คอมพิวเตอร์พกพาพร้อม PPLX 27B — 85.4%
• คอมพิวเตอร์แบบพกพาพร้อม Qwen 3.8 27B — 82.6%
Pi (แฮร์เนสโอเพนซอร์ส) — 77.6%
• Hermes (ชุดเครื่องมือโอเพนซอร์ส) — 74.0%

ผลลัพธ์ที่รายงานโดยผู้จำหน่ายอีกสองรายช่วยเติมเต็มภาพให้สมบูรณ์ ในการทดสอบ BrowseComp ชุดทดสอบการวิจัยเว็บ Computer ได้ 66.7% ขณะที่ Pi ได้ 50.2% และ Hermes ได้ 43.9% โดยใช้เวลาจริงน้อยกว่า Pi 51% และใช้โทเค็นน้อยกว่า 70% ในการทดสอบ ParseBench-100 ซึ่งเป็นการทดสอบการแยกเอกสาร Computer ได้ 65.1% ขณะที่ Hermes ได้ 34.6% และ Pi ได้ 13.9% ช่องว่างที่กว้างที่สุดอยู่ที่งานที่ให้รางวัลกับโครงสร้างพื้นฐานของแฮร์เนสเอง นั่นคือ การค้นหา การกำหนดเส้นทาง และการใช้เครื่องมือ ซึ่งเป็นจุดที่โมเดลที่ผ่านการฝึกเพิ่มเติมพร้อมกับสแตกโครงสร้างพื้นฐานที่ออกแบบมาโดยเฉพาะนั้นคุ้มค่า
การพลิกเศรษฐศาสตร์
ตัวเลขที่น่าสนใจกว่าคือราคา งานที่ดำเนินการในเครื่องมีต้นทุนต่อโทเค็นเป็นศูนย์และไม่ใช้เครดิต Perplexity — ตัวนับยังคงอยู่ที่ศูนย์สำหรับงานที่ทำในเครื่องทั้งหมด การยกระดับเป็นสิ่งเดียวที่ต้องเสียเงิน และเป็นแบบเลือกใช้ในแต่ละขั้นตอน Perplexity เผยแพร่ตัวเลขการคำนวณแบบไฮบริดบน Terminal Bench 2.1: การทำงานในเครื่องอย่างเดียวได้คะแนน 59.6% ด้วยต้นทุนประมาณศูนย์; การเพิ่มโมเดลระดับแนวหน้าเป็นที่ปรึกษาทำให้คะแนนเพิ่มขึ้นเป็น 73.0% ด้วยต้นทุนประมาณ $0.415 ต่อรอบการทำงาน; โมเดลระดับแนวหน้าเพียงอย่างเดียวทำได้ 82.4% ด้วยต้นทุนประมาณ $0.65 ต่อรอบการทำงาน ความแตกต่างสุดท้ายนี้คือประเด็นหลัก — การอนุมานในเครื่องทำให้เส้นโค้งต้นทุนราบเรียบสำหรับเอเจนต์ที่เปิดทำงานตลอดเวลา และการยกระดับผ่านคลาวด์กลายเป็นค่าใช้จ่ายที่ตรงจุดซึ่งคุ้มค่ากับเงินที่จ่าย
ไม่มีสิ่งใดที่เริ่มต้นได้ฟรี ตัวเครื่องสำคัญ Portable Computer เปิดตัวบน Linux ก่อนในวันที่ 25 สิงหาคม บน NVIDIA DGX Spark ซูเปอร์คอมพิวเตอร์ตั้งโต๊ะที่มีหน่วยความจำแบบรวม 128GB (ราคาป้ายประมาณ $4,500) หรือบนพีซี Linux ที่มี RTX GPU อย่างน้อย 24GB VRAM — ประมาณ RTX 3090 หรือใหม่กว่า — แนะนำ 32GB ในวันที่ 3 กันยายน Perplexity กล่าวว่า Portable Computer พร้อมใช้งานบน Linux สำหรับ NVIDIA RTX GPU ที่มี VRAM 24GB ขึ้นไป — ตามที่บริษัทระบุ — และการเปิดตัว IFA 2026 ของ NVIDIA ในสัปดาห์เดียวกันนั้นได้เพิ่มตัวติดตั้งแบบคลิกเดียวและการตั้งค่า AI ภายในเครื่องที่เรียบง่าย ซึ่งมุ่งเป้าไปที่ RTX GPU ที่มี VRAM 24GB ขึ้นไป โดยระบุชื่อ Portable Computer ควบคู่กับ Hermes agent และ OpenClaw การรองรับ Windows มาถึงตามกำหนด: ในวันที่ 14 กันยายน Perplexity กล่าวว่า Portable Computer พร้อมใช้งานบนพีซี Windows ที่มี NVIDIA RTX GPU — ตามที่บริษัทระบุ — ในแอป Perplexity สำหรับ Windows โดยการประมวลผลบนอุปกรณ์ต้องใช้ RTX GPU ที่มี VRAM 24GB ขึ้นไป ซึ่งตรงกับเกณฑ์ของ Linux และมีสองสิ่งที่เพิ่มเข้ามาซึ่งเส้นทาง Linux ไม่มี: MCP ภายในสำหรับเชื่อมต่อเครื่องมือและการผสานรวมแอปของคุณเอง และงานตามกำหนดเวลาที่ให้ Computer ทำงานที่เกิดซ้ำบนพีซีของคุณในขณะที่คุณไม่อยู่ macOS มาถึงในรูปแบบที่แตกต่างออกไปหนึ่งสัปดาห์หลังการเปิดตัว Linux — Hybrid Compute ซึ่งจะกล่าวถึงต่อไป และตัวซอฟต์แวร์เองก็ต้องใช้แผน Perplexity แบบชำระเงิน: Pro, Max, Enterprise Pro หรือ Enterprise Max นี่คือผลิตภัณฑ์แบบสมัครสมาชิกบวกฮาร์ดแวร์ที่มุ่งเป้าไปที่ผู้ที่จ่ายเงินให้ Perplexity อยู่แล้ว ไม่ใช่ API ทั่วไป
จุดเปลี่ยนของ Mac: การประมวลผลแบบไฮบริดและประตูความเป็นส่วนตัว
เมื่อวันที่ 1 กันยายน Perplexity Computer — แพลตฟอร์มเอเจนต์ที่ใช้สร้าง Portable Computer — ได้รับ Hybrid Compute ในแอปเดสก์ท็อป Mac ในเวอร์ชันนี้ การแยกการทำงานเป็นไปในทิศทางตรงกันข้ามกับบิลด์ Linux: งานจะเริ่มในคลาวด์ โดยโมเดลระดับแนวหน้าจัดการการให้เหตุผลที่ยากที่สุด การค้นคว้าบนเว็บ และการวางแผนระยะยาว จากนั้นออร์เคสตราเตอร์จะส่งขั้นตอนย่อยที่ละเอียดอ่อนให้เอเจนต์ย่อยภายในเครื่องที่ทำงานบน Apple silicon ไฟล์ ข้อมูลภายในเครื่อง และการดำเนินการกับอุปกรณ์จะอยู่บน Mac บริบทคงอยู่รอดผ่านการส่งต่อ และไม่มีโทเค็นภายในเครื่องใดเลยที่ไปถึงคลาวด์ เอนจินภายในเครื่องคือโมเดลที่บทความนี้พูดถึง — PPLX 27B ซึ่งเป็น Qwen 3.8 27B ที่ Perplexity โพสต์เทรน ระบุในเอกสาร Mac ของบริษัทว่า PPLX Qwen 3.8 27B และติดตั้งได้ด้วยการดาวน์โหลดคลิกเดียวในแอป โดยไม่ต้องตั้งค่า Ollama หรือเทอร์มินัล ตามข้อมูลของ Perplexity การรายงานข่าวเปิดตัวแตกต่างกันในส่วนที่เหลือของไลน์อัป: สำนักข่าวส่วนใหญ่เพิ่ม Gemma 4 E4B ของ Google และ Qwen3.6 35B-A3B ของ Alibaba เป็นตัวเลือกอื่นๆ ที่ทำงานบนอุปกรณ์ และมีสำนักหนึ่งระบุ Qwen 3.6 35B ที่ Perplexity โพสต์เทรน แทนที่จะเป็น 27B — รายละเอียดที่สื่อยังรายงานไม่ตรงกันในวันแรก
ฟีเจอร์ที่ Perplexity เป็นผู้นำคือ Privacy Gate ซึ่งเป็นตัวจำแนกประเภทบนอุปกรณ์ที่ฝึกด้วย Secure Intelligence Institute โดยมันจะอ่านแต่ละงาน — พรอมต์ ผลลัพธ์จากเครื่องมือ หน่วยความจำ ระบบบันทึก — ก่อนที่จะส่งข้อมูลใดๆ ออกไป เพื่อค้นหาข้อมูลที่สามารถระบุตัวตนได้ เช่น ชื่อ ที่อยู่ หมายเลขบัญชี ข้อมูลรับรอง หมายเลขบัตรชำระเงิน และหมายเลขประจำตัวประชาชน ค่าที่ตรวจพบจะถูกแทนที่ด้วยค่าจำลองก่อนที่คำขอจะออกจาก Mac และจะถูกคืนค่าเมื่อคำตอบกลับมา เมื่อ Privacy Gate ตรวจพบบางสิ่ง ผู้ใช้จะเป็นผู้ตัดสินใจว่าขั้นตอนนั้นจะทำงานในเครื่อง ถูกปกปิด หรือถูกแชร์ — ตัว gate ทำหน้าที่ถามเท่านั้น ไม่ใช่ผู้ตัดสินใจ Perplexity ยังกล่าวอีกว่าได้เปิดเผยโค้ดของตัวจำแนกประเภทเป็นโอเพนซอร์ส และเผยแพร่ PII-TRACE ซึ่งเป็นเกณฑ์มาตรฐานที่สร้างจากบทสนทนาสังเคราะห์ 13,148 รายการใน 13 ภาษา สำหรับประเมินตัวตรวจจับ PII สิ่งเหล่านี้เป็นคำกล่าวอ้างของบริษัท ยังไม่ผ่านการตรวจสอบอย่างเป็นอิสระ
Hybrid Compute ทำงานบน Mac ที่ใช้ชิป Apple silicon ทุกเครื่องที่ใช้ macOS 15 ขึ้นไป และมีหน่วยความจำรวมขั้นต่ำ 24GB — แนะนำ 32GB และ Perplexity กล่าวว่าเครื่องที่มี 8GB และ 16GB ไม่ผ่านเกณฑ์ ฟีเจอร์นี้ใช้ได้กับสมาชิก Pro, Max และ Enterprise ผ่านแอปเดสก์ท็อป โดยบัญชีองค์กรต้องเลือกเข้าร่วม และผู้ดูแลระบบสามารถตั้งค่านโยบายความละเอียดอ่อนระดับองค์กร และดูบันทึกว่าข้อมูลใดออกจากแต่ละอุปกรณ์บ้าง งานในเครื่องไม่ใช้เครดิตคลาวด์ และโทเคนที่สร้างในเครื่องไม่ถูกคิดค่าใช้จ่าย — เฉพาะขั้นตอนการประสานงานและการมอบหมายงานบนคลาวด์เท่านั้นที่เสียค่าใช้จ่าย และไม่ต้องใช้คีย์ API ข้อควรระวังเหมือนกับการเปิดตัวบน Linux: ตัวกรองเองก็เป็นโมเดลหนึ่ง ดังนั้นจึงมีโอกาสเกิดผลลบเท็จได้ และผู้รีวิวชี้ให้เห็นอย่างรวดเร็วว่าการป้องกันนั้นดีเท่ากับตัวเลือกที่ผู้ใช้เลือกเมื่อได้รับแจ้งเท่านั้น โดยเฉพาะ AppleInsider แนะนำให้ทดสอบฟีเจอร์ก่อนไว้วางใจให้ใช้กับข้อมูลอ่อนไหว

ที่ที่เราเตอร์พอดี
PPLX 27B ไม่ใช่สิ่งที่ OrcaRouter จัดเส้นทางให้ — มันทำงานบนฮาร์ดแวร์ที่คุณเป็นเจ้าของ ภายใต้การสมัครสมาชิก Perplexity และเราไม่แกล้งทำเป็นอย่างอื่น สิ่งที่เราจัดเส้นทางให้คือชุดการเปรียบเทียบที่การเปิดตัวนี้ชวนให้เปรียบเทียบ Qwen 3.8 27B ซึ่งเป็นน้ำหนักฐานเดียวกันกับที่ PPLX 27B นำไป post-train เปิดใช้งานแล้วบน OrcaRouter แบบโฮสต์เอง เช่นเดียวกับ DeepSeek V4 Flash, Gemini 3.5 Flash Lite และ GPT-5.6 Luna — ทั้งหมดอยู่ภายใต้คีย์ API เดียวในราคาตามรายการของผู้ให้บริการ ส่งผ่านโดยไม่มีมาร์กอัปใด ๆ ดังนั้นเมื่อผู้ขายลดราคา ฝั่งเราก็มีผลในวันเดียวกับที่ประกาศ
เรื่องนี้สำคัญตรงนี้ด้วยเหตุผลเฉพาะเจาะจงข้อหนึ่ง จุดขายของ Portable Computer คือการเปรียบเทียบความต่างของต้นทุนระหว่างโลคอลกับคลาวด์ และครึ่งที่เป็นคลาวด์ของความต่างนั้นจะซื่อตรงได้เพียงเท่ากับราคาที่คุณใช้เปรียบเทียบเท่านั้น บน OrcaRouter ราคาเหล่านี้คือราคาตามรายการจริงของผู้ให้บริการ ซึ่งทำให้การตัดสินใจว่าจะใช้โลคอลหรือคลาวด์กลายเป็นการคำนวณที่คุณเชื่อถือได้ แทนที่จะเป็นการเปรียบเทียบทางการตลาด และถ้าคุณต้องการทำต้นแบบเอเจนต์เดียวกันทั้งสองแบบ — local harness บนเครื่องเดียว โมเดลคลาวด์อยู่หลังเอนด์พอยต์เดียว — การสลับสำรองอัตโนมัติช่วยให้ฝั่งคลาวด์เข้ามาทำหน้าที่แทนได้เมื่อโมเดลโลคอลไม่ถนัดเพียงพอ โดยไม่ต้องมีสัญญาที่สองหรือเส้นทางโค้ดที่สอง Hybrid Compute ย้ำข้อตกลงแบบเดียวกัน — โทเคนโลคอลฟรี ส่วน cloud orchestration เป็นค่าใช้จ่ายเดียว — ดังนั้นการคำนวณนี้จึงใช้ได้ไม่ว่าครึ่งที่เป็นโลคอลจะรันบน DGX Spark, เวิร์กสเตชัน Linux RTX, Mac หรือ — ตั้งแต่ 14 กันยายน — พีซี Windows ที่มี RTX GPU

ดูอะไรดี
สี่สิ่งในเดือนหน้าจะตัดสินว่าสิ่งนี้เป็นผลิตภัณฑ์เฉพาะกลุ่มหรือจุดเริ่มต้นของหมวดหมู่ใหม่ การที่ Perplexity จะเปิดซอร์ส Local Knowledge Work Bench จริงหรือไม่ ซึ่งจะเปลี่ยนตัวเลขพาดหัวจากคำกล่าวอ้างให้กลายเป็นสิ่งที่ชุมชนสามารถทำซ้ำได้ การที่ Nemotron 3.5 Lightning จะเปิดตัวและเอาชนะ PPLX 27B บนฮาร์เนสเดียวกันได้หรือไม่ — ข้อเสนอ "post-train for the harness" จะดีได้เพียงเท่ากับโมเดลฐานที่รองรับมันเท่านั้น การที่ Privacy Gate จะรอดจากการตรวจสอบเชิงปฏิปักษ์ตอนนี้ที่ตัวแยกประเภทถูกเปิดซอร์สแล้วหรือไม่ — ตัวตรวจจับ PII แบบความน่าจะเป็นเป็นหัวใจสำคัญของข้อเสนอแบบไฮบริดก็ต่อเมื่อมันเก็บชื่อ หมายเลขบัญชี และข้อมูลรับรองไม่ให้หลุดออกไปบนเครือข่ายได้จริง และการเข้าถึงที่การเปิดตัวบน Linux ไม่เคยมีจะมาถึงในที่สุดผ่านการขยายในเดือนกันยายนหรือไม่ — เส้นทาง RTX-24GB บน Linux ที่ยืนยันเมื่อวันที่ 3 กันยายน การรองรับ Windows ที่ยืนยันเมื่อวันที่ 14 กันยายนในแอป Perplexity สำหรับ Windows และ Hybrid Compute บน Mac — ซึ่งนำเศรษฐศาสตร์ของเอเจนต์ท้องถิ่นแบบเดียวกันมาสู่ฮาร์ดแวร์ผู้บริโภคที่กว้างที่สุดที่ Perplexity เคยส่งมอบจนถึงตอนนี้ หากเกณฑ์มาตรฐานเป็นของจริงและฮาร์เนสถ่ายโอนได้ "รันเอเจนต์บนฮาร์ดแวร์ของคุณเอง" จะไม่ใช่รูปแบบของนักอดิเรกอีกต่อไป แต่กลายเป็นตัวเลือกการปรับใช้ที่มีพลังจริง — และโมเดลคลาวด์ที่มันถูกนำไปเปรียบเทียบด้วยจะต้องพิสูจน์ว่าราคาต่อโทเคนนั้นคุ้มค่า
