目前,深度学习已经在机器学习应用的各个领域取得了非常出色的表现,其成功在很大程度上取决于大数据和与之匹配的计算能力。深度学习的特性决定了它需要很多的数据进行学习,从而得出模型来完成特定任务,比如,大词汇量连续语音识别上的成功就取决于海量的用…
声浪
AI Talk导读 TensorFlow 之大远远超出你的认识。事实上它是一个针对深度学习的库,并藉由和谷歌的关系赢得了许多关注。本期AI Talk将要带来的是关于 TensorFlow 分布式训练如何进行线性加速实践的实战分享。 同时此篇…
2017年初,Google 提出了一种新的端到端的语音合成系统——Tacotron。Tacotron打破了各个传统组件之间的壁垒,使得可以从配对的数据集上,完全随机从头开始训练。本文是来自喜马拉雅FM音视频工程师马力的投稿,他手把手式的介绍…
从360度视频到Oculus,通过Facebook 360音频编码与渲染都可实现身临其境的感受,并且使用的声道更少,小于0.5毫秒的渲染延迟。Facebook技术团队撰文对此进行了解读,LiveVideoStack对文章进行了编译。 全新的…
tensorflow里的Speech Commands Example TF开始放语音的例子,也许有很多人已经在使用tensorflow到语音的实验中了。TF官网开始开放一些语音命令的例子,网址:https://github.com/ten…
2012年,微软邓力和俞栋老师将前馈神经网络FFDNN(Feed Forward Deep Neural Network)引入到声学模型建模中,将FFDNN的输出层概率用于替换之前GMM-HMM中使用GMM计算的输出概率,引领了DNN-HM…
第一次接触长短期记忆神经网络(LSTM)时,我惊呆了。 原来,LSTM是神经网络的扩展,非常简单。深度学习在过去的几年里取得了许多惊人的成果,均与LSTM息息相关。因此,在本篇文章中我会用尽可能直观的方式为大家介绍LSTM——方便大家日后自…
正所谓学无止境,再厉害的人也不可能样样精通,所以只有一直坚持学习才能提高自我,成就更高的自我,今天就来给大家推荐几个关于语音的课程: ①上海交通大学俞凯老师的课程: 连接:https://speechlab.sjtu.edu.cn/~kyu…
这篇文章主要来写下kaldi中数据处理的一些内容。如果我们拿到一个新的数据库,我们根据数据准备阶段准备数据,然后咱们开始训练模型。但基础数据往往是单一的,我们怎么才能让数据变多呢。首先这里引用来自阿里巴巴的薛少飞之前的一个ppt: 目前在基…
