语音人工智能已成为AI领域最热门的方向之一,投资者纷纷投入数十亿美元,推动自动化客户支持和销售电话、会议记录助手以及以语音为主要交互方式的智能眼镜等多种应用的发展。
与此同时,AI实验室迅速发布新模型,硬件制造商也在努力为消费者打造最佳的设备交互体验。
所有这些新技术都需要经过测试和反馈循环以不断改进。总部位于冰岛的初创公司Treble正致力于成为语音AI行业的核心,打造一个面向模型开发者、机器人公司和消费硬件制造商的语音模拟平台。
Treble由声学工程师Finnur Pind和Jesper Pedersen于2020年创立,近期完成了由Paladin Capital Group领投的1800万美元A轮融资扩展,现有投资者KOMPAS VC、Frumtak Ventures、EIC和Omega ehf也参与了本轮融资。2024年该公司共获得1200万美元投资,累计融资超过4000万美元。其客户包括亚马逊和罗技等知名企业。

Treble的业务涵盖多个与模拟和数据相关的领域。针对语音AI公司,Treble提供合成数据生成平台,可用于语音增强、噪声抑制和模型训练。同时,平台还能在不同环境下评估语音AI模型表现,为实验室提供反馈。今年早些时候,Treble与Hugging Face合作推出了一个针对语音识别模型的基准测试,涵盖多种真实环境条件。
Pind向TechCrunch表示:“音频AI本质上是一个数据挑战,这也是推动下一代模型和硬件发展的最大机遇所在。迄今为止,几乎所有与声音相关的AI都是基于录音和网络抓取的数据。我们相信,精准的物理模拟可以成为生成声音数据的另一种有效途径。”

此外,Treble还专注于从语音角度进行硬件设计和测试。例如,与耳机和扬声器厂商合作进行虚拟原型设计,帮助他们了解产品的声音表现;测试智能音箱在不同摆放位置下对指令的识别能力。最近,Treble开始为智能眼镜和AI设备提供模拟测试服务。
Pind表示,公司对可穿戴设备领域充满期待,尤其是那些能够增强用户听觉体验的产品。
“我非常看好下一代设备,比如耳机和智能眼镜,它们可以实现超人听觉功能。在复杂的声学环境中,这类设备能让你听得更清楚。比如你在餐厅,只想听两米范围内的人声,或者在研讨会上,希望屏蔽周围的噪音。”
Treble计划加大在物理AI领域的投入,涵盖机器人、汽车和无人机公司,通过测试和模拟支持它们实现基于声音的功能。
Paladin Capital Group副总裁Francois Ruether告诉TechCrunch,Treble的模拟平台能够支持多种模型和设备,随着其应用领域的拓展,平台的重要性将不断提升。
“我们的观点是,随着越来越多产品依赖声音识别,这种基础设施在语音AI、可穿戴设备、机器人和物理AI领域的价值将日益凸显。客户可以保留对其模型、产品和开发流程的所有权,同时共享基于模拟的声学基础设施层带来的优势。”


