声浪
FluxMusic 是一种将当下最火、效果最好的 Flux 文生图模型技术扩展到音乐生成的开源模型,能够很好的遵循提示词生成音乐,并且更自然流畅。 源码库:https://github.com/feizc/FluxMusic 论文:http…
来源丨机器之心 最近,开源大模型社区再次「热闹」了起来,主角是 AI 写作初创公司 HyperWrite 开发的新模型 Reflection 70B。 它的底层模型建立在 Meta Llama 3.1 70B Instruct 上,并使用原…
来源丨新智元 OpenAI的下一代前沿模型GPT Next,或许真的有着落了。KDD 2024峰会上,发言人再次称,虽然GPT-3和GPT-4的能力相对接近,但GPT Next预计将取得实质性地性能跃升。 KDD上的一张PPT,再次掀起AI…
Hugging Face 新开源的 TTS 模型:Parler-TTS,完全开源免费的一款 TTS 工具。一行命令即可安装!可自主训练定制声音! 项目链接:https://github.com/huggingface/parler-tts…
出门问问 出门问问成立于2012年,是一家以生成式AI和语音交互为核心的人工智能公司,为全球多个国家和地区提供AI智能硬件、AI政企服务,以及面向创作者的AIGC产品。 公司以「Make AGI Accessible and AI CoPi…
近日,来自小红书的技术团队FireRed,提出了基于大语言模型的FireRedTTS语音合成系统,并分享了在短视频配音及聊天式语音对话等应用的一些实践。 技术报告及Demo链接:https://arxiv.org/abs/2409.0328…
方位通讯 深圳方位通讯科技有限公司(方位通讯)是全球领先的专业物联网音视频(A&V-IoT)产品提供商、国家级高新技术企业,拥有北京、深圳、苏州三个研发基地。方位通讯专注物联网通讯技术与终端研发,经过近二十年的沉淀积累,打造SIP对讲、SI…
