AI模型”品味”训练平台获790万美元融资

从校园项目到全球平台
据联合创始人格蕾丝·李(Grace Li)回忆,她的公司在2025年毕业前几周成立,由几位大学好友共同努力,试图让他们的AI游戏引擎正常运行。这些智能体能制作出功能完备的游戏,却没有一款真正有趣——这引出了一个有趣的问题:如何判断一款游戏是否好玩?
人类判断的价值
团队很快得出结论:人类判断无可替代。他们开始 brainstorm 如何大规模获取真实的人类反馈。由此诞生的Design Arena如今已被全球530万人使用。事实证明,许多AI公司都在寻求可扩展的用户反馈,并且愿意为此付费。
解决行业瓶颈
“这是许多模型在设计领域取得改进所面临的关键瓶颈,”李表示。”大约一周后,我们与一家前沿实验室达成了首个重大合作,之后的发展便顺理成章。”
融资与愿景
周一,Design Arena背后的公司——Intelligence——宣布完成790万美元种子轮融资,由Index Ventures领投,Conviction(由Sarah Guo和Mike Vernal创立)、A*、Valkyrie等机构跟投。
用户使用体验
对于非企业用户而言,使用Design Arena类似于操作一个精密的模型路由器。界面设有类似ChatGPT的提示窗口,并包含网站、图片等十几种视觉格式的独立下拉菜单。用户输入请求、格式和风格后,系统会呈现一系列”A对B”的选择,直到用户将几个输出结果从最佳到最差进行排序。
平台价值与企业应用
这一服务本身很有用,但平台的真正价值体现在企业端——参与其中的模型可以将它视为媒体生成模型的无尽即时反馈源。用户往往对所排名的模型漠不关心——正如李所言,他们只想要能获得的最佳输出——因此他们的排名能够为用户真实需求提供关键输入。
李表示,对于前沿实验室而言,这种服务值得付费,目前该平台年经常性收入(ARR)已达6000万美元,巩固了其作为AI行业人类主导评估数据关键来源的地位。
全球化数据收集
关键的是,用户必须登录才能获取输出结果,这使得Intelligence能够追踪不同地区和时间段用户品味的变化。(李指出,亚洲地区的网页面板往往采用更繁复的设计风格。)这些措施是对自动化基准测试的重要补充,后者虽然能更大规模地运作,但往往容易受到操纵或”游戏化”影响。
行业挑战与前景
然而,这并不意味着众包人类反馈会自动成为赢家。Yupp公司在今年早些时候关闭了业务,尽管它从a16z加密货币部门的Chris Dixon那里获得了3300万美元融资。这家公司同样吸引了前沿实验室客户,据称拥有超过130万用户,但仍未能建立可持续的长期商业模式。
尽管如此,其他基于人类评估的创业公司似乎发展良好。采用类似方法处理文本响应的LM Arena,在正式推出付费产品仅四个月后,于今年1月完成了1.5亿美元的A轮融资。
关注微信号:智享开源,及时了解更新信息。

公众号:智享开源
还没有任何评论,你来说两句吧!