Perplexity携手Nvidia推出零成本本地AI智能体
本地AI新时代:Perplexity与Nvidia合作推出便携式智能体平台
今日,人工智能搜索公司Perplexity宣布推出”便携式计算机”(Portable Computer),这是一款完全在本地设备运行的智能体平台,用户无需支付任何token费用。该产品与芯片巨头Nvidia紧密合作开发,旨在将AI智能体工作负载从云端迁移到用户已有的硬件设备上。

突破云端依赖:本地AI的新尝试
此次合作推出的便携式智能体平台,是迄今为止将AI智能体工作负载从云转移到本地设备的最激进尝试之一。用户无需将模型、个人文件和工作内容上传至云端,所有处理都可以在本地设备上完成。这种本地运行方式不仅保护了数据隐私,还消除了云服务带来的token成本。
Perplexity基础设施与企业工程副总裁Nate在周一的媒体简报会上表示:”我们基本上将相同的用户界面带到了完全本地化的应用中。这包含了智能体工具包、推理引擎以及本地工作所需的一切功能。”
Nvidia的战略转变:从云端到边缘
对于过去两年一直致力于推动万亿级AI数据中心建设的Nvidia而言,此次合作标志着一种微妙但具有重要战略意义的转变:芯片制造商相信本地AI已经从爱好者们的实验性爱好转变为实用工具,而Nvidia希望销售运行这些工具的硬件。
Nvidia开发者技术总监Nader专注于开发者工具和开源项目,他表示:”本地AI已经达到了一个转折点。长期以来,这只是爱好者和热衷者的领域,他们运行的是被量化到极小的模型…虽然这很酷,但并不非常实用。但随着许多新开源模型的出现,一切都改变了,这些模型极其有用。”
一站式解决方案:本地AI智能体的完整堆栈
Perplexity Computer是该公司面向知识工作的智能体平台,它协调AI模型、文件、工具和网络访问来完成多步骤任务,如审查文档文件夹、分析数据、生成报告并将结果推送到业务系统。便携式计算机则在本地复制了这一体验:本地模型、智能体工具包、推理引擎、工具、应用连接器和安全沙箱都被打包在一个系统中。
Nate指出:”历史上,搭建本地AI堆栈一直非常痛苦。通过便携式计算机,我们专注于提供一种极其直接的用户体验,让用户能够快速上手并运行。”
实际应用场景与演示
在一次演示中,系统扮演零售投资者的角色,审查1099表格和投资文档文件夹——这类敏感的财务材料许多用户可能不愿上传到云服务。在DGX Spark上以全GPU利用率运行270亿参数的Qwen模型,智能体审查了每个文档,并标记出假设投资者支付不必要费用的案例。
另一次演示展示了产品的混合特性。扮演创业公司创始人的Nate要求智能体在本地分析用户漏斗数据的CSV文件,然后使用Perplexity的连接器生态系统将完成的分析推送到Slack频道——证明以本地为主并不意味着与外界断开连接。
智能体与模型的协同设计
此次发布的同时,Perplexity发表了一篇研究论文,论证有效的本地智能体需要模型和智能体工具包——围绕模型的提示、工具和编排逻辑的支架——共同设计。核心观点是:通用工具包假设前沿模型能够吸收大量上下文,处理广泛的工具界面,并进行长期规划。而小型本地模型在这些要求面前会不堪重负。
Perplexity通过实证发现,虽然像Qwen 3.8 27B这样的模型声称拥有26万token的上下文窗口,但超过10万token后就开始出现问题。因此,公司构建了一个极简的工具包:简洁的系统提示、一小套核心工具,以及按需加载和卸载的能力,而不是永久保留在上下文中。
关注微信号:智享开源 ,及时了解更新信息。

公众号:智享开源
还没有任何评论,你来说两句吧!