tensorflow里的Speech Commands Example
TF开始放语音的例子,也许有很多人已经在使用tensorflow到语音的实验中了。TF官网开始开放一些语音命令的例子,网址:https://github.com/tensorflow/tensorflow/tree/master/tensorflow/examples/speech_commands。这次这个例子是基于论文《Compressing Deep Neural Networks using a Rank-Constrained Topology》(https://static.googleusercontent.com/media/research.google.com/en//pubs/archive/43813.pdf)。已经还在提交中,具体的内容还没开放完。大致的情况如下:
数据集:讲开源大概1.4G左右的命令词数据,大致包含"yes", "no", "up", "down", "left", "right", "on", "off", "stop", and "go"。数据是从https://aiyprojects.withgoogle.com/open_speech_recording里收集的,大家也可以贡献数据。数据地址是http://download.tensorflow.org/data/speech_commands_v0.01.tar.gz.这个数据已经可以下载了。
神经网络:基于上述提到的论文。
结果:大约是85%左右。
很具体的情况大概会在http://tensorflow.org/tutorials/audio_recognition里讲,但目前还访问不了。
具体关于这个例子的情况可以访问https://github.com/tensorflow/tensorflow/blob/master/tensorflow/docs_src/tutorials/audio_recognition.md。你也可以通过阅读原文来访问。
