Perplexity携手Nvidia推出零成本本地AI智能体

本地AI新时代:Perplexity与Nvidia合作推出便携式智能体平台

今日,人工智能搜索公司Perplexity宣布推出”便携式计算机”(Portable Computer),这是一款完全在本地设备运行的智能体平台,用户无需支付任何token费用。该产品与芯片巨头Nvidia紧密合作开发,旨在将AI智能体工作负载从云端迁移到用户已有的硬件设备上。

突破云端依赖:本地AI的新尝试

此次合作推出的便携式智能体平台,是迄今为止将AI智能体工作负载从云转移到本地设备的最激进尝试之一。用户无需将模型、个人文件和工作内容上传至云端,所有处理都可以在本地设备上完成。这种本地运行方式不仅保护了数据隐私,还消除了云服务带来的token成本。

Perplexity基础设施与企业工程副总裁Nate在周一的媒体简报会上表示:”我们基本上将相同的用户界面带到了完全本地化的应用中。这包含了智能体工具包、推理引擎以及本地工作所需的一切功能。”

Nvidia的战略转变:从云端到边缘

对于过去两年一直致力于推动万亿级AI数据中心建设的Nvidia而言,此次合作标志着一种微妙但具有重要战略意义的转变:芯片制造商相信本地AI已经从爱好者们的实验性爱好转变为实用工具,而Nvidia希望销售运行这些工具的硬件。

Nvidia开发者技术总监Nader专注于开发者工具和开源项目,他表示:”本地AI已经达到了一个转折点。长期以来,这只是爱好者和热衷者的领域,他们运行的是被量化到极小的模型…虽然这很酷,但并不非常实用。但随着许多新开源模型的出现,一切都改变了,这些模型极其有用。”

一站式解决方案:本地AI智能体的完整堆栈

Perplexity Computer是该公司面向知识工作的智能体平台,它协调AI模型、文件、工具和网络访问来完成多步骤任务,如审查文档文件夹、分析数据、生成报告并将结果推送到业务系统。便携式计算机则在本地复制了这一体验:本地模型、智能体工具包、推理引擎、工具、应用连接器和安全沙箱都被打包在一个系统中。

Nate指出:”历史上,搭建本地AI堆栈一直非常痛苦。通过便携式计算机,我们专注于提供一种极其直接的用户体验,让用户能够快速上手并运行。”

实际应用场景与演示

在一次演示中,系统扮演零售投资者的角色,审查1099表格和投资文档文件夹——这类敏感的财务材料许多用户可能不愿上传到云服务。在DGX Spark上以全GPU利用率运行270亿参数的Qwen模型,智能体审查了每个文档,并标记出假设投资者支付不必要费用的案例。

另一次演示展示了产品的混合特性。扮演创业公司创始人的Nate要求智能体在本地分析用户漏斗数据的CSV文件,然后使用Perplexity的连接器生态系统将完成的分析推送到Slack频道——证明以本地为主并不意味着与外界断开连接。

智能体与模型的协同设计

此次发布的同时,Perplexity发表了一篇研究论文,论证有效的本地智能体需要模型和智能体工具包——围绕模型的提示、工具和编排逻辑的支架——共同设计。核心观点是:通用工具包假设前沿模型能够吸收大量上下文,处理广泛的工具界面,并进行长期规划。而小型本地模型在这些要求面前会不堪重负。

Perplexity通过实证发现,虽然像Qwen 3.8 27B这样的模型声称拥有26万token的上下文窗口,但超过10万token后就开始出现问题。因此,公司构建了一个极简的工具包:简洁的系统提示、一小套核心工具,以及按需加载和卸载的能力,而不是永久保留在上下文中。


关注微信号:智享开源 ,及时了解更新信息。

原文链接:https://venturebeat.com/infrastructure/perplexity-partners-with-nvidia-to-launch-portable-computer-a-fully-local-ai-agent-with-zero-token-costs

评论列表
发表评论
😀 😂 😃 😄 😅 😆 😉 😊 😋 😎 😍 😘 🥰 😜 😝 🤗 🤔 😭 😤 👍

为你推荐
Ta的个人站点

Mark Do发布文章2700篇

如我距离死亡还有45年,我还活着,该怎么度过现在。


公众号:智享开源

分类