Smallest.ai 是一家成立于 2024 年底的初创公司,在 A 轮融资中筹集了 1300 万美元,用于构建专门的语音模型,旨在使与人工智能的实时对话与与人交谈没有区别。 TechCrunch 于 2026 年 7 月 31 日首次报道了此次融资,由 Seligman Ventures 领投,Sierra Ventures 和 3one4 Capital 参与,使该公司的融资总额超过 2100 万美元。

本轮融资正值语音人工智能市场升温之际,投资者也在寻找超越文本聊天机器人的下一次飞跃。如需持续报道重塑人工智能行业的初创公司,请关注我们的最新人工智能新闻

押注小型专业语音模型

Smallest.ai 的核心论点是,语音代理的下一个突破不会来自于使大型语言模型变得更快,而是来自于构建专门为人类对话而设计的更小型的专用模型。首席执行官 Sudarshan Kamath 告诉 TechCrunch,如今的法学硕士从根本上与演讲节奏不匹配:他们在开始“思考”之前等待完整的提示,这种延迟在文字聊天中感觉很自然,但在电话中却很刺耳。

卡马斯解释说:“当我和你说话时,你已经在思考了,如果我说话太长,你可能会打断我。”他描述了他的初创公司模型旨在复制的人类对话的实时、重叠性质。该模型通过同时聆听、思考和说话来处理音频,旨在实现几乎零响应延迟。

两种模型架构

Smallest.ai 的系统依赖于 Kamath 预测将成为人工智能代理标准架构的架构:一个小型、快如闪电的语音模型处理实时对话,而只有当查询超出较小模型的知识库时,才会调用“离线”大型基础模型。当这种情况发生时,系统会短暂地让呼叫者等待以“研究”问题,就像人工代理所做的那样。

这种分工让这家初创公司将其小型模型严格专注于特定于语音的挑战,包括处理不同的口音、支持数十种语言以及在嘈杂的环境中运行。相比之下,将通用法学硕士应用于语音的竞争对手必须应对更高的延迟和计算成本。

客户和竞争

Smallest.ai 的现有客户包括语音和通信领域的公司,其中包括 RingCentral 和 Truecaller。卡马斯认为,资金充足的客户支持初创公司没有什么动力去建立自己的语音模型,因为“非常擅长做语音会分散他们对核心业务的注意力”。

该初创公司的竞争对手包括语音人工智能领导者 ElevenLabs,以及 Cartesia 和专注于本地语言的 Sarvam 等区域参与者。虽然一些竞争对手将语音人工智能应用于配音和播客,但 Smallest.ai 专注于为企业客户提供实时对话代理。

语音图灵测试

卡马斯的野心是明确的。 “我们希望我们的模型能够突破图灵测试,”他说。 “你应该与我们的模型对话,而不知道它是人工智能还是人类。这是公司的唯一焦点。”

短期内能否实现这一目标仍然是一个悬而未决的问题。过去两年,语音人工智能在自然度方面有了显着提高,但即使是最好的系统仍然难以应对微妙的线索——犹豫、幽默、情绪变化——这些让人类对话感觉生动。 Smallest.ai 的赌注是,专门为语音构建的模型,而不是改编自文本训练的法学硕士,可以比行业预期更快地缩小这一差距。

拥挤但快速增长的市场

此次融资凸显了投资者对语音人工智能类别的更广泛热情。语音界面越来越被视为消费者与人工智能代理交互的最自然方式,而企业呼叫中心代表了一个巨大的、可立即寻址的市场,即使是延迟和自然度的适度改进也可以转化为可衡量的成本节省。

Smallest.ai 现已拥有 2100 万美元资金,计划扩展其模型功能并扩大其企业客户群。然而,竞争格局是残酷的:ElevenLabs 占据着巨大的市场份额,而较大的厂商继续将语音集成到他们的旗舰产品中。 Smallest.ai 的差异化取决于这样一个前提:专注的、专门的语音模型可以在对实时对话最重要的一个指标上超越通用系统,即人性化的速度。

保持人工智能领先地位

从语音代理到前沿模型,交易和突破正在迅速到来。添加书签 AI Buzz Wire,了解构建人工智能未来的公司和创始人的持续报道。

阅读更多人工智能初创公司新闻 →