Writer新模型降耗增效,智能体成本大降52%

企业级AI平台发布旗舰模型,大幅降低智能体运营成本
Writer,一家被埃森哲、优步、先锋集团等财富500强企业使用的企业级AI智能体平台,今日发布了其全新旗舰模型Palmyra X6,同时重新构建了智能体编排”工具套件”和新治理工具,旨在帮助IT领导者控制日益增长的令牌支出。
关键数据令人瞩目:Writer表示,其智能体产品与Palmyra X6配合使用后,平均运营成本降低52%,速度提升48%,质量提高10%。但更具深远意义的可能是公司实现这一目标的方式,以及其选择所揭示的企业AI市场发展方向。
Palmyra X6:基于中国开源模型的后训练版本
Palmyra X6并非从零开始训练。它是北京Z.ai公司(前身为智谱AI)开源的混合专家模型GLM-5.2的后训练版本,Writer在其技术报告中明确披露了这一事实,这也使这家旧金山公司处于行业最受争议的辩论中心:美国企业是否应基于中国开源基础构建AI系统。
“这个模型在形式、方式或任何方面都与原始开发者没有任何关联。它完全在我们的美国基础设施上运行,”Writer产品管理总监Matan-Paul Shetrit在宣布前的独家采访中告诉VentureBeat。
领导Writer AI研究的Dan Bikel表达得更直白:”这完全是Palmyra模型,我们只是恰好以浮点数作为起点,然后在此基础上进行训练。”
智能体AI如何颠覆企业预算,远超聊天机器人时代
Writer的发布恰逢智能体AI经济成为企业购买决策中心的时刻。与通常为每个用户请求生成一个答案的聊天机器人不同,智能体AI将单个请求转化为多轮规划、检索、工具调用、验证和重试——每个循环都会消耗计量的令牌。用户看到一个答案,账单却反映了整个循环。
问题的规模正变得清晰。高盛预测,从2026年到2030年,令牌消耗量将增长24倍,达到每月120千万亿令牌,这一增长并非由更多提问的人驱动,而是由持续运行的企业智能体所致。同一分析警告称,单位令牌价格下降并不保证总账单下降:如果一个智能体任务消耗的令牌数量增加20倍,而单位价格下降75%,总费用仍会增加五倍。
“企业希望令牌消耗激增——这意味着采用正在发生——但他们需要成本保持平稳,”Writer首席技术官兼联合创始人Waseem AlShikh在声明中表示。
Shetrit将成本问题视为企业AI采用的主要障碍,甚至超过模型能力本身。”当今企业使用AI扩展的最大障碍,在大多数情况下实际上不是模型能力;而是围绕它们的成本,”他说,”当今的现实是,在大多数情况下,AI的替代方案不是另一个AI,而是人力劳动。”
Palmyra X6技术细节:626个训练样本如何微调7440亿参数模型
根据Writer的技术报告,Palmyra X6是一个7440亿参数的混合专家模型,每个令牌约有400亿活跃参数,继承了GLM-5.2的未变更架构。该公司的贡献是一种经过深思熟虑的后训练方法:称为锚定监督微调(ASFT)的技术,应用于仅626个精心筛选的合成智能体轨迹数据集,以低学习率训练一个周期。
小型数据集是关键所在,而非局限所在。ASFT将令牌加权方案与KL散度”锚点”配对,对微调模型偏离基础模型的冻结版本进行惩罚,教授新的工具使用行为,同时不削弱基础模型已具备的通用能力。Writer还用更新的Muon优化器替换了标准的Adam优化器,Muon将权重矩阵视为几何对象,应用于模型的核心权重矩阵。
“有一系列论文遵循所谓的’少即是多’理念,”Bikel提到,引用了”小型、极高质量的数据集能发挥巨大作用”的研究,”这是我们的理念之一,我们在构建此模型时遵循了这一理念,并且结果证明了这一点。它使我们能够以更低的优化成本为客户优化,最终为我们和客户带来了更低成本的模型。”
性能评估与价格优势
在Writer的内部评估中——涵盖九项能力,包括基础和检索、工具使用、内容生成、子智能体委派和品牌声音——X6平均得分为0.87(满分1.00),略高于Anthropic的Claude Opus 4.8(0.86)、Claude Sonnet 4.6(0.85)、OpenAI的GPT-5.5(0.80)和Google的Gemini 3.1(0.77)。真正的差异化因素在于价格差距:Writer对X6的定价为每百万输入令牌2美元,每百万输出令牌8美元,而Opus 4.8则为15/75。该公司表示,X6平均可在26秒内完成任务,并能独立工作长达八小时以实现单一目标。
Writer承认内部评估可能引起怀疑。当被直接询问公司是否会在批改自己的作业后公布其方法论时,Bikel表示技术报告涵盖了”我们用于进行公开基准测试的协议以及我们的评估方法”。
关注微信号:智享开源 ,及时了解更新信息。


公众号:智享开源
还没有任何评论,你来说两句吧!