Agent一旦从「问一句答一句」变成「盯着文件夹干一下午」,云端的Token表就会像水表一样转个不停——Portable Computer把默认执行放在本机,并把计费表停在零。对律所、投行与医疗团队来说,卖点往往不是模型有多聪明,而是1099和病历能不能不出设备边界。
Perplexity是AI搜索与Agent公司,此前已推出面向知识工作的Agent平台「Computer」。8月25日,公司与英伟达联合发布「Portable Computer」:把同一套Agent体验迁移到用户自有硬件,首发支持英伟达DGX Spark桌面超算与配备RTX GPU的Linux机器(约24GB显存及以上,大致GeForce RTX 3090级别)。本地默认执行:模型、文件与工作留在设备,本地完成不消耗云端计费额度;仅当单步需要更强前沿模型时,系统征得用户许可后再上云,且上云前经PII分类并展示将外发内容。
产品与工程要点:
所谓Agent harness,白话是围着模型搭的「脚手架」——提示怎么写、工具怎么调、失败怎么重试、权限怎么收——模型智商相近时,.harness往往决定任务能不能做完。Perplexity论文论点是小模型扛不住巨型通用.harness,必须模型与.harness协同设计。
产业观察上,英伟达需要DGX Spark的「杀手应用」,Perplexity需要差异化隐私与成本故事,两者在本地Agent上利益同向。可以把它想成:把云端的「按Token出租大脑」,改成「卖铲子让你自己挖」——铲子是一次性硬件,挖多久不再按勺计费。对Ollama等本地推理工具,Portable Computer争的是「装完就能干活」的一键体验,而不是只会跑模型。局限也清晰:24GB显存门槛排除绝大多数笔记本,Linux-only首发,苹果硅未在路线图上。
需要把边界读清楚。核心基准为Perplexity自研,外部独立复现仍少;复杂推理仍依赖云端顾问,不能宣称完全离线替代前沿模型。下一观察点是Windows版上线节奏、企业部署模板与DGX Spark预装合作是否落地。