声浪
语音界Sora!微软开源新模型,一次生成90分钟语音、3200倍压缩率
来源丨AIGC开放社区 近日,微软研究院开源了创新音频模型 VibeVoice-1.5B。 VibeVoice-1.5B开创了语音界多个重大技术突破:一次性可连续合成90分钟超长逼真语音,之前多数模型只能合成60分钟以内语音,并且30分钟后…
27 0 0
EMNLP2025丨南京大学自然语言处理研究组六篇录用论文分享
EMNLP(Conference on Empirical Methods in Natural Language Processing)是自然语言处理领域顶级国际会议之一,其涉及领域包括但不限于机器翻译、文本生成、文本分类、信息抽取、问答…
25 0 0
