融资、语音AI、产品 TechCrunch AI

语音AI初创Smallest.ai获1300万美元融资,打造拟人化超快语音模型

Smallest.ai宣布完成1300万美元融资,用于开发能通过图灵测试的语音AI模型,目标是让AI电话通话听起来真正像人类。该公司聚焦超低延迟与自然度,切入客服、外呼等场景,有望推动语音交互体验升级。

语音人工智能初创公司Smallest.ai近日宣布完成1300万美元融资,这笔资金将专项用于研发能够通过图灵测试的语音AI模型。所谓图灵测试,在语音场景下意味着AI在电话交流中能让人类无法轻易分辨对方是机器还是真人。该公司创始人表示,当前市面上的语音助手普遍存在机械感强、响应延迟明显等问题,而Smallest.ai的目标是从声学特征、语速节奏、停顿习惯乃至呼吸感等多个维度重塑AI发声方式,让每一次AI通话都自然到“以假乱真”。

这轮融资由多家硅谷知名风投机构联合领投,资金将主要用于三方面:扩充语音算法团队、搭建低延迟推理基础设施,以及针对客服、电话外呼、远程医疗等垂直场景进行深度优化。Smallest.ai的核心技术路线并非简单堆砌更大的模型参数,而是聚焦于“超低延迟”与“拟人化表达”的平衡。据技术团队透露,其自研的流式语音合成架构能将端到端响应时间压缩至300毫秒以内,远低于行业平均水平的800至1000毫秒,同时通过对抗训练让模型学会人类对话中的非语言信号,比如语气上扬、短暂迟疑和轻微笑声,这些细节正是此前AI语音“不像人”的关键短板。

从行业背景来看,全球呼叫中心与电话外呼市场规模庞大,仅北美地区每年就有超过2000亿通商业电话,其中大量重复性沟通工作正面临人力成本攀升与人员流失的双重压力。Smallest.ai瞄准的正是这一痛点——用拟人化AI替代初级客服和电销人员,不仅能大幅降低企业运营成本,还能通过自然对话提升客户满意度。该公司已与多家保险、电商和电信企业展开试点合作,测试数据显示,其AI语音在客户无感识别测试中的通过率已接近70%,部分场景下甚至能主动识别用户情绪并调整话术策略。

这轮融资的完成,也反映出资本市场对“深度拟人化语音交互”赛道的信心正在升温。过去几年,语音AI多停留在“能听会说”的层面,而Smallest.ai所代表的“以假乱真”方向,将推动语音交互从工具属性向情感陪伴属性跃迁。当然,技术突破也伴随伦理挑战——当AI电话无法被辨识,如何防止诈骗滥用、如何保障通话双方知情权,将成为监管与行业必须共同面对的新课题。可以预见,随着此类模型走向成熟,未来我们接到的每一通陌生电话,都可能需要更审慎地判断对面究竟是真人,还是一个越来越像人的算法。