Smallest.ai融资1300万美元,用于构建听起来像人类的超快语音AI

尽管人工智能代理解决客户支持问题的能力越来越强,但大多数人仍然可以立即分辨出他们正在与机器而不是人类交谈。
Smallest.ai是一家成立于2024年底的初创公司,它押注语音代理的下一次飞跃不会来自于让大型语言模型变得更快,而是来自于使用为人类对话而构建的更小、专门的模型。简而言之,该公司希望使与人工智能代理的对话与与人类的对话没有区别。
为此,它正在开发一种小型语音模型,旨在模仿人类如何通过同时聆听、思考和说话来处理信息。
Smallest.ai创始人兼CEOSudarshan Kamath(左图)告诉TechCrunch,“当我和你说话时,你已经在思考了,如果我说话太长,你可能会打断我。”他补充说,这正是该初创公司模式的设计原理。
为了推动这一使命,Smallest.ai在由Seligman Ventures领投、Sierra Ventures和3one4 Capital参与的A轮融资中筹集了1300万美元。新资金使该初创公司的总资金超过2100万美元。
“法学硕士的工作方式是你给它一个完整的提示,然后它开始思考,”卡马斯说。虽然这种延迟在文本聊天中是可以接受的,但在语音对话中,即使是短暂的停顿也会感觉不自然。 “如果你想一想我们是如何交谈的,我不会给你一段很大的音频剪辑,然后你就开始思考。”
该初创公司的模型充当实时智能层,使客户能够就特定主题进行自然对话,并且响应延迟几乎为零。但如果模型遇到其有限知识库之外的主题,Smallest.ai会将查询交给大型基础模型,短暂地让客户等待“研究”该问题 - 就像真人会做的那样。
卡马斯认为,所有人工智能代理很快都会依赖两种模型:用于实时交互的小型语音模型,以及据需要调用来解决复杂问题的“离线”LLM。
与大型基础模型不同,Smallest.ai严格关注特定于语音的细微差别,例如处理不同的口音、支持数十种语言以及在嘈杂的环境中运行。
该初创公司的现有客户包括语音领域的公司,包括RingCentral和Truecaller。卡马斯表示,任何客户支持公司,包括像Sierra和Decagon这样的新公司,都是这家初创公司的潜在客户。
当被问及为什么一家资金雄厚的人工智能客户支持公司不会建立自己的语音模型时,卡马斯表示,对于客户支持初创公司来说,“非常擅长做语音会分散他们对核心业务的注意力”。
Smallest.ai的竞争对手包括语音AI领导者ElevenLabs、Cartesia以及专注于本地语言的Sarvam等区域参与者。
虽然一些竞争对手将语音人工智能应用于配音和播客等用例,但Smallest.ai严格专注于为其企业客户提供实时对话语音代理。
“我们希望我们的模型能够突破图灵测试,”卡马斯说。 “你应该与我们的模型对话,而不知道它是人工智能还是人类。这是公司的唯一焦点。”