语音AI初创公司Modulate完成2500万美元新融资,用于向更多开发者推广其音频原生模型。与依赖转录文本的方案不同,Modulate的模型直接分析对话原始音频,将情绪、语调和意图作为信号,并能识别深度伪造语音,部分分析可在对话进行中实时完成。其旗舰平台Velma采用Ensemble Listening Model架构,从100多个小型专用音频模型中按任务调度并融合结果,公司称该设计效率最高可达单一大型模型的1000倍。目前每月有超1000万小时音频经由其模型处理,累计已突破6亿小时。其转录模型和深度伪造检测模型今年分别在Hugging Face相关榜单登顶,后者在公开基准数据上准确率达98.9%。本轮由Future Ventures领投,资金将用于开发新SDK、API及行业专用模型,并扩充研究与工程团队。
AI语音技术公司Modulate完成2500万美元融资,资金将用于扩展其音频原生模型,以打击深度伪造和语音诈骗,并向更多开发者推广。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅