语音识别语言模型和拼音字典文件制作

内容简介：接我前面的文章，下载 pocketsphinx 和中文模型文件。由于模型文件格式有一些要求，所以建议对模型文件的编辑都在Linux上完成。创建一个文本文件 my.txt，内容如下：

接我前面的文章，下载 pocketsphinx 和中文模型文件。

由于模型文件格式有一些要求，所以建议对模型文件的编辑都在 Linux 上完成。

准备中文语言文件

创建一个文本文件 my.txt，内容如下：

测试
直走
左转
右转
后退
开火
靠喽

生成语音模型文件和字典文件

访问 http://www.speech.cs.cmu.edu/tools/lmtool-new.html 页面，上传 my.txt 文件，然后使用“COMPILE KNOWLEDGE BASE”来生成模型文件。

在生成的列表页面，下载最下面的那个 TAR<???>.tgz，文件名是动态产生的，这里我生成的文件名为：TAR2007.tgz。

下载之。

解压之。

编辑其下的 2007.dic 文件，参考 zh_broadcastnews_utf8.dic 文件加入拼音，比如：

右转 y ou zh uan
后退 h ou t ui
左转 z uo zh uan
开火 k ai h uo
测试 c e sh ib
前进 q ian j in
靠喽 k ao l ou

使用 pocketsphinx_continuous 工具测试，这里使用了一个我提前录制好的音频文件来做测试，其中参数路径根据自己具体文件位置修改。

pocketsphinx_continuous -hmm test/zh_broadcastnews_ptm256_8000 -lm test/TAR2007/2007.lm -dict test/TAR2007/2007.dic -infile test/small.wav

以上就是本文的全部内容，希望本文的内容对大家的学习或者工作能带来一定的帮助，也希望大家多多支持码农网

查看所有标签

猜你喜欢:

本站部分资源来源于网络，本站转载出于传递更多信息之目的，版权归原作者或者来源机构所有，如转载稿涉及版权问题，请联系我们。

码农书籍

Web渗透技术及实战案例解析

陈小兵 / 范渊、孙立伟 / 电子工业出版社 / 2012-4 / 89.00元

《Web渗透技术及实战案例解析》从Web渗透的专业角度，结合网络安全中的实际案例，图文并茂地再现Web渗透的精彩过程。《Web渗透技术及实战案例解析》共分7章，由浅入深地介绍和分析了目前网络流行的Web渗透攻击方法和手段，并结合作者多年的网络安全实践经验给出了相对应的安全防范措施，对一些经典案例还给出了经验总结和技巧，通过阅读《Web渗透技术及实战案例解析》可以快速掌握目前Web渗透的主流技术。《......一起来看看《Web渗透技术及实战案例解析》这本书的介绍吧!

码农工具