
摘要
- Perplexity于9月1日为Perplexity Computer新增"混合计算"(Hybrid compute)功能,发布当天即在Mac应用上线
- 任务从云端开始处理,一旦进入个人文件、敏感数据阶段,就会切换到自研模型PPLX Qwen 3.8 27B
- 据TestingCatalog报道,该功能还配备了"隐私门"(Privacy Gate),可在数据传输至云端前先行过滤PII
展开更多
- 同一天,云端方面新增了当天发布的Claude Fable 5.1,面向Pro、Max订阅用户开放——该模型在8月WANDR评测中排名第一(0.601分,单任务成本12.76美元)
任务执行途中,从云端切换到Mac本地
Perplexity于当地时间9月1日宣布,为其代理系统新增了一项功能:在Perplexity Computer中加入混合计算(Hybrid compute)。核心变化在于,处理同一项任务的过程中,计算本身运行的位置会发生转移。Computer会先在云端启动任务,一旦进入需要处理个人文件或敏感数据的阶段,就会切换到用户Mac设备上运行的本地模型。该功能自发布当天起,已可在Perplexity Mac应用中直接使用。
具体来说,Perplexity上个月25日曾率先推出一款完全本地化的"便携式计算机"(Portable Computer),但那款产品只能在NVIDIA DGX Spark这一专用硬件上运行。这次的混合计算可以理解为把那套本地处理能力精简后,搬到了一台普通Mac设备上,不再需要额外硬件。
为什么只靠云端还不够
Perplexity Computer是一款能自主完成从网络调研到文件整理等多个环节的代理系统。问题在于,这些环节中难免会出现个人文档或公司内部资料等用户不愿上传云端的数据。Perplexity从上个月开始逐步着手解决这个问题:8月25日推出了完全在NVIDIA DGX Spark本地硬件上运行编排器、子代理和代理执行框架的"便携式计算机";紧接着次日8月26日又发布了能将会话和文件整理成知识维基的自我优化型记忆功能"Brain"。这次的混合计算,可以看作是把那套本地处理能力从DGX Spark这类专用硬件解放出来,让它也能在一台普通Mac上运行。
PPLX Qwen 3.8 27B与隐私门
据TestingCatalog报道,驱动混合模式的本地模型是PPLX Qwen 3.8 27B,由Perplexity自行进行后训练(post-trained)。27B指参数量为270亿,相较于云端运行的大型前沿模型规模小得多,因此能够在一台普通Mac上运行。此外还搭配了"隐私门"功能,可在数据上传云端之前先过滤掉个人身份信息(PII)。用户无需每次自行判断任务何时该转入本地处理,这道隐私门会自动侦测敏感数据,把握切换时机。
三条线并行的Perplexity Computer
过去一个月里,Perplexity已经把同一套代理系统,按运行环境不同拓展成了三种形态。
| 版本 | 运行环境 | 运行模型 | 使用条件 |
|---|---|---|---|
| Computer(原有版本) | 云端 | 前沿云端模型 | 全体用户 |
| Portable Computer | NVIDIA DGX Spark(本地硬件) | PPLX 27B / Qwen 3.8 27B | Perplexity Pro、Max订阅用户 |
| 混合计算(新增) | 云端→Mac本地切换 | PPLX Qwen 3.8 27B | Perplexity Mac应用 |
虽然使用的是同一系列本地模型,但接入方式会因搭载的硬件不同而有所区别。如果说DGX Spark版本是彻底摆脱对云端的依赖,那么混合计算则是一种折中方案——平时依靠云端的算力,只在必要时才收窄到本地处理。

云端方面新增了Claude Fable 5.1
同一天,Perplexity另行发布公告,更新了Perplexity Computer的云端部分:将Anthropic当天发布的Claude Fable 5.1开放给Pro、Max订阅用户,可直接在Computer中调用。在Perplexity自行运营的8月WANDR评测中,Fable 5.1以0.601分、单任务成本12.76美元的成绩排名第一。与上一代Fable 5(0.496分、单任务成本20.30美元)相比,分数提高了21%,成本则降低了37%。

同时公布的图表中还包含了在Computer上运行的其他模型的成绩。
| 模型 | WANDR得分 | 单任务成本 |
|---|---|---|
| Fable 5.1 | 0.601 | 12.76美元 |
| Opus 5 | 0.537 | 11.60美元 |
| Grok 4.6 | 0.496 | 7.58美元 |
| GPT-5.6 Sol | 0.426 | 4.99美元 |
| GPT-5.6 Terra | 0.399 | 1.98美元 |
| DeepSeek V4 Pro 0813 | 0.359 | 0.75美元 |
| Fable 5 | 0.496 | 20.30美元 |
| Sonnet 5 | 0.309 | 5.75美元 |
一边为敏感环节配上了本地27B模型,一边又把云端模型的选择范围扩大到了当天发布的最新旗舰模型——这也是混合计算与该消息同日公布的原因。
如何使用
混合计算会在用户于Perplexity Mac应用中向Computer下达任务时自动启用。任务先在云端进行,一旦进入需要处理个人文件或敏感数据的阶段,无需任何额外操作就会切换到本地运行的PPLX Qwen 3.8 27B。此时隐私门会侦测PII信息,阻止其外传至云端。举例来说,如果让它整理本地文件夹中的合同或人事资料,那么需要联网搜索的前期步骤会在云端完成,而真正读取文档内容的阶段则完全在Mac本地进行。至于不同订阅等级是否有各自的使用条件,此次公告中并未明确说明。
官方原始视频
编辑视角
从Perplexity一个月内把Computer拆分为云端、完全本地、混合三条线的做法来看,这家公司想解决的显然不是性能问题,而是信任问题。代理要替用户读取和整理文件,前提是用户得先把文件交出去,而公司显然清楚,很多人并不愿意把税务文件或人事记录传上云端。如果说DGX Spark版本是用硬件给出的答案,那么这次的混合计算,就是用软件层面的切换机制给出的同一个答案。
把这类规模的本地模型放到实际业务中检验,结论往往大同小异——27B级别的模型确实无法完成像云端前沿模型那样复杂的推理,但用来读取和总结结构已经清晰的文档,绰绰有余。这也是混合方式合理的地方:难的判断交给云端,实际接触敏感资料的简单操作交给本地,各司其职。
对国内企业而言,这个思路值得在为合同、人事信息等不便对外传输的文档配置代理时参考借鉴。不过,云端与本地之间的切换标准到底划得有多细,恐怕还得实际用上几天才能有真实感受。隐私门判定PII的标准越宽泛,安全性固然越高,但任务转入本地处理的频率也会随之上升。
接下来几周值得关注的是:这套本地模型是否会扩展到Mac以外的其他环境,又或者Portable Computer那套专用于DGX Spark的架构,是否会与混合计算合二为一。从公司持续尝试把同一款27B模型搭载到不同硬件上来看,Perplexity的最终目标,似乎是打造一款大部分任务都无需依赖云端就能运行的代理系统。





评论