Perplexity, NVIDIA发布Portable Computer 本地AI代理平台(至少 24GB of VRAM)
PERPLEXITY 联合 $NVDA 推出完全本地化的 AI 智能体
Perplexity 正在推出 Portable Computer,这是其智能体计算平台的本地版本,由 NVIDIA 合作打造,可完全在设备上运行模型、工具、文件和多步骤 AI 工作流。
核心区别在于:本地工作不消耗任何 Perplexity 积分,边际 token 成本基本为零。任务默认在本地启动,系统在将任何步骤发送给高端云模型之前会征得用户许可。
硬件支持初期面向 NVIDIA DGX Spark,以及配备至少 24GB VRAM 的 RTX 显卡(大致为 RTX 3090 或更新型号)的 Linux PC。Windows 支持计划在 9 月推出。
上线初期,用户可在本地运行 Qwen 3.8 27B 或 Perplexity 微调后的 PPLX 27B,接下来还会支持 NVIDIA Nemotron 3.5 Lightning。
该平台捆绑了完整本地技术栈:
• 模型推理
• 智能体框架
• 工具与连接器
• 安全沙箱
• 本地文件访问
• Gmail、Google Drive、GitHub 和 Slack 集成
Perplexity 表示,PPLX 27B 在其内部本地知识工作台(Local Knowledge Work Bench)上得分 85.4%,而通过自家计算框架运行的 Qwen 3.8 27B 得分为 82.6%。在 BrowseComp 测试中,其本地系统得分 66.7%,同时比 Pi 框架少消耗 70% 的 token,耗时减少 51%。
混合部署方案也值得关注。在 Terminal Bench 2.1 测试中:
• 全本地 Qwen:得分 59.6%,边际推理成本接近零
• 本地 + Claude Opus 5 辅助:得分 73.0%,每个任务约合 0.415 美元
• 仅 Claude Opus 5:得分 82.4%,每个任务约合 0.65 美元
在向云端升级之前,Perplexity 表示系统会扫描传出上下文,识别个人可识别信息(PII),并向用户展示哪些数据会离开设备。远程模型仅返回文本指导,绝不会直接访问本地文件或工具。
NVIDIA 还表示,该硬件可扩展至单台机器之外。两台 DGX Spark 可以运行更大的高端级开放模型,四台则可以运行 GLM 5.2 或 Nemotron Ultra 这类模型。
本文由 AI 翻译自英文原帖,技术名词保留英文。
查看 X 原帖