声浪
Voila:开源端到端 AI 语音模型,195ms低延迟引领全双工对话!
Maitrix 团队最新发布的开源 AI 端到端语音模型: Voila,该模型采用创新的分层Transformer架构,突破传统语音AI限制,实现195ms超低延迟实时交互,支持高度个性化定制,并在语音识别、合成及多语言翻译等任务中表现卓越…
34 0 0
CCF语音对话与听觉专委会论文导读(2025年第2期)
为促进最新研究成果的传播与交流,CCF语音对话与听觉专委在专委会微信公众号启动论文导读栏目,定期分享最新语音、对话与听觉相关研究方向论文。本期分享七篇发表在ICASSP2025上的文章。本导读论文栏目持续征稿中,欢迎踊跃投稿,投稿方式请参见…
14 0 0
