
Smallest.ai 融资1300万美元,打造听感如真人的超快语音AI

Smallest.ai 是一家成立于 2024 年底的语音 AI 初创公司,近日宣布完成 1300 万美元 A 轮融资,由 Seligman Ventures 领投,Sierra Ventures 和 3one4 Capital 跟投,累计融资超过 2100 万美元。公司的核心目标是:让用户与 AI 语音助手对话时,几乎无法分辨对方是机器还是真人。
创始团队认为,当前主流语音 Agent 的瓶颈来自大型语言模型(LLM)的响应延迟——即使只有半秒停顿,在语音对话中也显得不自然。他们的解决方法不是把 LLM 做得更快,而是用更小、更专用的模型来处理实时交互。Smallest.ai 的模型模拟人类“边听边想边说”的机制,无需等待完整输入再开始推理,从而实现接近零延迟的对话。不过,当遇到超出模型知识范围的问题时,系统会短暂将用户挂起,转而调用一个“离线”的大模型来“研究”答案——这模仿了人类遇到陌生问题时的自然反应。
CEO Sudarshan Kamath 预计,未来所有 AI Agent 都会依赖两种模型:一个用于实时语音交互的小模型,和一个按需调用的大模型来处理复杂问题。Smallest.ai 聚焦于语音本身的细节,例如处理多种口音、支持数十种语言以及适应嘈杂环境。现有客户包括 RingCentral 和 Truecaller 等语音服务公司。
在竞争方面,Smallest.ai 与 ElevenLabs、Cartesia 以及专注本地语言的 Sarvam 等对手处于同一赛道。但 Kamath 指出,许多语音 AI 公司同时涉足音频配音、播客等场景,而 Smallest.ai 只专注于企业级实时对话 Agent。他认为,对于客户支持公司来说,自己构建语音模型是“偏离核心业务的干扰”。公司最终目标是让模型通过图灵测试——用户无法在对话中区分 AI 和人类。


