问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
语音AI初创公司Smallest.ai近日宣布完成1300万美元融资,本轮资金将主要投入超高速拟真语音模型的研发迭代,核心目标是让AI生成的实时通话语音达到以假乱真的效果,支撑智能外呼、在线客服等场景的AI交互通过图灵测试,进一步降低语音交互类产品的落地门槛,拓宽AI实时交互的应用边界。

你有没有接过一听就知道是AI打来的营销电话?机械的语调、毫无停顿的话术、遇到问题就卡顿的反应,往往会让用户在3秒内就选择挂断。来自客服行业的统计数据显示,当前主流AI语音外呼的有效沟通率不足15%,核心痛点就在于AI语音的“机器感”太强,无法获得用户的基本信任,大量需要高频语音交互的场景始终难以实现真正的自动化落地。
Smallest.ai此次瞄准的就是这一行业空白,其研发的语音模型将同时满足两个核心指标:端到端生成延迟低于200毫秒,符合人类正常对话的反应速度,不会出现明显的延迟卡顿;同时语音生成将还原人类说话的呼吸感、停顿、甚至偶尔的语气词偏差,最大限度降低“机器感”。按照其研发规划,最终落地的模型将能让90%以上的普通用户无法通过通话分辨对方是AI还是真人,也就是达到语音交互场景下的图灵测试标准。
本次募集的1300万美元资金,将主要用于研发团队扩张和多场景语料库搭建。目前团队已经完成了普通话、英语两种主流语言的基础模型训练,下一步将拓展方言、小语种的语料采集,同时针对客服、金融回访、政务提醒等不同垂直场景做定制化优化。按照规划,其首款商用语音模型预计将于2027年上半年正式对外开放API接口,面向企业级客户提供服务。
拟真语音AI的落地,一方面将大幅降低企业的人力成本,预计可将语音类交互的运营成本降低70%以上;另一方面也需要警惕技术滥用的风险,行业普遍认为,未来拟真AI语音在对外提供服务时,需要在通话开始阶段明确告知用户交互对象为AI,避免给用户造成误导,在提升效率的同时守住技术伦理的底线。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。