Smallest.ai筹集1300万美元以构建超快速的语音AI,声音听起来像人类一样
虽然AI代理在解决客户支持问题方面越来越有能力,但大多数人仍然能立即分辨出他们在与机器而不是人与谈话。Smallest.ai是一家成立于2024年底的初创公司,它相信语音代理的下一个飞跃不会来自于使大型语言模型更快,而是来自于使用专为人类对话构建的小型专用模型。简单来说,这家公司希望与AI代理的对话与与人对话无异。为此,它正在开发一个小型语音模型,旨在模仿人类通过同时监听、思考和说话来处理信息的方式。Smallest.ai的创始人兼首席执行官Sudarshan Kamath(左图)告诉TechCrunch:“当我在与你交谈时,你已经在思考了,如果我说得太久,你可能会打断我。”他补充说,这正是初创公司的模型设计的工作原理。为了推进这一使命,Smallest.ai在一轮A轮融资中筹集了1300万美元,由Seligman Ventures主导,并获得Sierra Ventures和3one4 Capital的参与。这笔新资金使得该初创公司的总融资超过2100万美元。Kamath说:“大型语言模型的工作方式是你给它一个完整的提示,然后它开始思考。”虽然这种延迟在文本聊天中是可以接受的,但在语音对话中,即使短暂的停顿也会显得不自然。Kamath表示:“如果你想想我们说话的方式,我并不是给你一段完整的音频,然后你才开始思考。”该初创公司的模型作为一个实时智能层,使得在特定主题上进行自然的客户对话几乎没有响应延迟。但如果模型遇到超出其有限知识范围的主题,Smallest.ai将查询交给一个大型基础模型,短暂地让客户“研究”这个问题——就像真实的人类一样。Kamath认为,所有AI代理很快都将依赖两种模型:一个用于实时交互的小型语音模型,以及在需要时调用的“离线”大型语言模型来解决复杂问题。与大型基础模型不同,Smallest.ai专注于语音特有的细微差别,如处理各种口音、支持数十种语言以及在嘈杂环境中操作。该初创公司的现有客户包括语音领域的公司,如RingCentral和Truecaller。Kamath表示,任何客户支持公司,包括像Sierra和Decagon这样的新公司,都是该初创公司的潜在客户。当被问及为什么一家资金充足的AI客户支持公司不自己构建语音模型时,Kamath表示,对于客户支持初创公司来说,变得“在语音方面非常出色是对其核心业务的分心。”Smallest.ai与语音AI领导者ElevenLabs、Cartesia及专注于地方语言的区域参与者Sarvam竞争。虽然一些竞争对手将语音AI应用于音频配音和播客等用例,但Smallest.ai严格专注于为企业客户提供实时对话式语音代理。“我们希望我们的模型打破图灵测试,”Kamath说。“你应该与我们的模型交谈,而不知道它是AI还是人。这是公司的唯一重点。”当你通过我们文章中的链接购买时,我们可能会赚取少量佣金。这不会影响我们的编辑独立性。Marina Temkin是TechCrunch的风险投资和初创公司记者。在加入TechCrunch之前,她为PitchBook和风险投资杂志撰写有关风险资本的文章。在其职业生涯早期,Marina是一名金融分析师,并获得了CFA特许持有人资格。你可以通过电子邮件marina.temkin@techcrunch.com与Marina联系或确认她的联系,或通过+1 347-683-3909在Signal上发送加密消息。查看个人资料
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡