由CCF语音对话与听觉专委会 、中国人工智能产业发展联盟(AIIA)评估组、小红书、语音之家、希尔贝壳共同主办的【语音之家】AI产业沙龙——小红书语音技术创新探索与落地实践,将于2023年10月17日19:00 ~ 20:40线上直播,欢迎大家预约观看。



沙龙简介

70 余年前,贝尔实验室研制了世界上第一个可识别十个英文数字的语音识别系统,如今伴随着深度学习技术的突破和普及,智能语音技术取得了飞跃式发展。人工智能和语音交互技术的结合,使得语言交流更加智能化和自然化。
为满足小红书用户在音频场景的表达及消费需求,小红书音频技术团队不断推进语音技术的创新探索与落地实践。
例如,「智能旁白」提供平台独有的“博主特色音”,创作者可根据个人喜好选择音色,彰显独特风格。「智能剪辑」一键生成卡点音乐,降低 UGC 创作门槛。AI 演唱技术结合视频配乐打造「你填我唱」提升音乐爱好者的表达欲。基于语音识别的「视频字幕」功能提高了用户进行内容创作的效率。文本内容理解技术助力「此刻」功能,打破了依赖“相册”发布路径的内容创作,让用户实现随想随发。
想了解它们是如何实现的吗?下周二 ,【语音之家】AI产业沙龙 —— 小红书语音技术创新探索与落地实践即将开播,揭晓答案!


报告嘉宾


嘉宾简介:解奉龙,小红书创作发布组音频技术负责人,负责音频技术在小红书全场景下的研发及落地。博士毕业于哈尔滨工业大学与微软亚洲研究院联合培养博士班,研究领域涉及语音合成、音乐信息检索、语音识别及语音信号处理等。曾在 ICASSP、INTERSPEECH、SPEECHCOM 等语音领域会议及期刊发表论文十余篇,长期担任 ICASSP、INTERSPEECH 等主要语音会议的审稿人。



嘉宾简介:许开拓,小红书创作发布组音频算法工程师,工作领域涉及语音识别 (ASR) 相关算法研发、ASR 相关模型的训练和推理工具开发等。本硕毕业于西北工业大学音频语音与语言处理研究组,GitHub 语音开源项目 Star 超1500,曾获语音会议 ISCSLP 2016 最佳学生论文提名奖。



嘉宾简介:靳源,小红书创作发布组音频算法工程师,硕士毕业于中国传媒大学传播声学研究所,工作领域涉及关键词识别、语音识别(ASR)、声音事件检测、音频指纹、AI 作曲技术等。



嘉宾简介:谢坤,小红书创作发布组音频算法工程师,硕士毕业于厦门大学模式识别实验室,负责语音合成及相关领域的探索和落地,包括语音合成、语音转换、歌唱合成等方向。


沙龙议程



参加方式

直播将通过语音之家微信视频号进行直播
手机端、PC端可同步观看

👇👇👇



讨论群


扫码添加语音小管家,进入语音之家讨论群


沙龙联系人
闫亮
电话:18611344096
邮箱:jack@speechhome.com