Perplexity|Portable Computer:本地Agent默认零Token计费

PromptTree|阅读 0
2026/08/26 18:48
Perplexity本地AgentDGX Spark英伟达
据VentureBeat 8月25日报道,Perplexity联合英伟达发布Portable Computer,将Agent平台Computer完整搬到DGX Spark与24GB+ RTX Linux设备,本地默认执行、本地工作不耗云端额度,需更强能力时经用户许可上云。首发Qwen 3.8 27B与PPLX 27B,Linux当日可用,Windows预计9月。

Agent一旦从「问一句答一句」变成「盯着文件夹干一下午」,云端的Token表就会像水表一样转个不停——Portable Computer把默认执行放在本机,并把计费表停在零。对律所、投行与医疗团队来说,卖点往往不是模型有多聪明,而是1099和病历能不能不出设备边界。

Perplexity是AI搜索与Agent公司,此前已推出面向知识工作的Agent平台「Computer」。8月25日,公司与英伟达联合发布「Portable Computer」:把同一套Agent体验迁移到用户自有硬件,首发支持英伟达DGX Spark桌面超算与配备RTX GPU的Linux机器(约24GB显存及以上,大致GeForce RTX 3090级别)。本地默认执行:模型、文件与工作留在设备,本地完成不消耗云端计费额度;仅当单步需要更强前沿模型时,系统征得用户许可后再上云,且上云前经PII分类并展示将外发内容。

产品与工程要点:

  1. 打包交付:本地模型、Agent harness、推理引擎(底层使用vLLM,高级用户可接自有端点)、工具、连接器与安全沙箱一体安装,降低自建本地AI栈门槛。
  2. 模型:可选Qwen 3.8 27B或Perplexity后训练PPLX 27B;英伟达Nemotron 3.5 Lightning即将跟进。
  3. 订阅:面向Pro、Max、Enterprise Pro、Enterprise Max;Linux首发,Windows预计2026年9月。
  4. Harness设计:针对小模型缩小系统提示与工具面,连接器改为紧凑CLI工具而非常驻MCP巨上下文;自带健康检查与OS级沙箱,无沙箱则禁用工具执行。
  5. 评测:公司称在自研Local Knowledge Work Bench(53项任务,计划开源)上,同模型下Computer harness优于Pi、Hermes等;混合模式下本地模型加云端顾问可在Terminal Bench等任务以约三分之二成本追回约六成性能差距。

所谓Agent harness,白话是围着模型搭的「脚手架」——提示怎么写、工具怎么调、失败怎么重试、权限怎么收——模型智商相近时,.harness往往决定任务能不能做完。Perplexity论文论点是小模型扛不住巨型通用.harness,必须模型与.harness协同设计。

产业观察上,英伟达需要DGX Spark的「杀手应用」,Perplexity需要差异化隐私与成本故事,两者在本地Agent上利益同向。可以把它想成:把云端的「按Token出租大脑」,改成「卖铲子让你自己挖」——铲子是一次性硬件,挖多久不再按勺计费。对Ollama等本地推理工具,Portable Computer争的是「装完就能干活」的一键体验,而不是只会跑模型。局限也清晰:24GB显存门槛排除绝大多数笔记本,Linux-only首发,苹果硅未在路线图上。

需要把边界读清楚。核心基准为Perplexity自研,外部独立复现仍少;复杂推理仍依赖云端顾问,不能宣称完全离线替代前沿模型。下一观察点是Windows版上线节奏、企业部署模板与DGX Spark预装合作是否落地。