拟人语音智能体获1300万美元融资

语音AI新突破:让对话无法分辨真假
尽管当前智能体在解决客户支持问题方面能力日益增强,但大多数人仍能轻易分辨出自己是在与机器对话而非真人。
Smallest.ai:重新定义语音交互
成立于2024年末的Smallest.ai公司正押注于语音智能体的下一次突破,其核心理念并非通过提升大型语言模型的速度,而是采用专为人类对话设计的更小型专业模型。简而言之,该公司致力于让人工智能语音交互与真人对话达到无法区分的程度。
创新技术:模拟人类思维过程
为实现这一目标,Smallest.ai正在开发一种小型语音模型,模拟人类通过倾听、思考、同时表达来处理信息的方式。
“当我与你交谈时,你已经在思考,如果我说话时间过长,你可能会打断我,”Smallest.ai创始人兼CEO Sudarshan Kamath表示,”这正是我们公司模型设计的工作原理。”
获1300万美元融资
为推动这一使命,Smallest.ai已完成1300万美元A轮融资,由Seligman Ventures领投,Sierra Ventures和3one4 Capital参与投资。此次融资使公司总融资额超过2100万美元。
技术优势:实时响应与无缝切换
传统LLM的工作方式是提供完整提示后才开始思考,Kamath解释道:”在文本聊天中这种延迟尚可接受,但在语音对话中,即使是短暂的停顿也显得不自然。”
Smallest.ai的模型作为实时智能层,能够在特定主题上实现近乎零延迟的自然客户对话。当遇到超出其有限知识库的问题时,系统会将查询转交给大型基础模型,短暂将客户”等待”以”研究”问题,就像真人会做的那样。
双模型架构:语音与离线LLM结合
Kamath相信,所有AI智能体将很快依赖两种模型:小型语音模型用于实时交互,以及按需调用的”离线”LLM解决复杂问题。
- 专注于语音特定细节,如处理多样化口音
- 支持数十种语言
- 在嘈杂环境中稳定运行
市场定位与竞争环境
Smallest.ai的现有客户包括RingCentral和Truecaller等语音领域公司。Kamath表示,任何客户支持公司,包括Sierra和Decagon等新兴企业,都是其潜在客户。
当被问及为何资金充足的AI客户支持公司不自行开发语音模型时,Kamath指出:”对于客户支持初创公司而言,在语音技术上做到’极其出色’会分散其核心业务的注意力。”
Smallest.ai与语音AI领导者ElevenLabs以及Cartesia、Sarvam等区域性玩家竞争。与竞争对手将语音AI应用于配音、播客等不同,Smallest.ai专注于为企业客户提供实时对话语音智能体。
“我们希望模型能够通过图灵测试,”Kamath表示,”当你与我们的模型对话时,不应知道它是AI还是人类。这就是公司唯一的关注点。”
关注微信号:智享开源 ,及时了解更新信息。


公众号:智享开源
还没有任何评论,你来说两句吧!