Name: Kaldi 语音识别实战
ISBN: 9787121378744

出版社: 电子工业出版社
出品方: 博文视点
出版年: 2020-4
页数: 316
定价: 89.00元
装帧: 平装
丛书: 博文视点AI系列
ISBN: 9787121378744

豆瓣评分

9.1

22人评价

5星

59.1%
4星

36.4%
3星

4.5%
2星

0.0%
1星

0.0%

评价:

内容简介 · · · · · ·

刚刚过去的十年是语音技术发展的黄金十年。2010 年前后，从谷歌公司发布第一个语音搜索应用、苹果公司发布第一个语音助手 Siri 开始，语音技术的发展转瞬进入了快车道。

语音技术的基础算法不断推陈出新，语音任务 Benchmark 持续被刷新；语音产品的应用也从一开始很小众的语音输入，逐渐渗透到人们生活的方方面面。

语音产业飞速发展，传统的语音技术教材已经满足不了该领域从业者的迫切需求。本书以目前流行的开源语音识别工具 Kaldi 为切入点，深入浅出地讲解了语音识别前沿的技术及它们的实践应用。本书的作者们拥有深厚的学术积累及丰富的工业界实战经验。

本书适合语音技术相关研究人员及互联网从业人员学习参考。

作者简介 · · · · · ·

陈果果

清华大学本科学位，约翰霍普金斯大学博士学位，主要研究方向是语音识别及关键词检索，师从语音识别开源工具Kaldi主要开发者Daniel Povey，以及约翰霍普金斯大学语言语音处理中心教授Sanjeev Khudanpur。博士期间为Google开发了Google的唤醒词Okay Google的原型，现在已经用到数以亿计的安卓设备及Google智能语音交互设备上。博士期间同时参与开发语音识别开源工具Kaldi，以及神经网络开源工具CNTK。博士毕业以后联合创办KITT.AI，专注于语音识别及自然语言处理，公司于2017年被百度收购，目前担任百度智能生活事业群组（SLG）主任架构师。

都家宇

本科毕业于大连理工大学，后于澳大利亚新南威尔士大学电子信息工程学院学习，取得信号处理专业硕士学位。研究生期间在导师 Julien Epps 指导下开始进行语...

(展开全部)

陈果果

都家宇

本科毕业于大连理工大学，后于澳大利亚新南威尔士大学电子信息工程学院学习，取得信号处理专业硕士学位。研究生期间在导师 Julien Epps 指导下开始进行语音处理、情绪识别方向的研究。毕业后先后任职于清华大学语音技术实验室、百度语音技术部，以及阿里巴巴iDST、达摩院语音组，从事声学模型、解码器、语音唤醒等方面的研发工作。参与过与 Kaldi 相关的工作有：Kaldi nnet1神经网络框架中 lstm 作者；发起并推动全球大规模的中文开源数据集语音项目AISHELL-1、AISHELL-2，已服务于清华大学、北京大学、南洋理工大学、哥伦比亚大学等近200所国内外高校的科研项目。

那兴宇

本科和博士均毕业于北京理工大学，主要研究方向是语音识别和语音合成。先后任职于中国科学院声学研究所和阿里巴巴机器人，从事语音识别模型训练系统和语音交互系统的开发。目前就职于微软，担任资深应用科学家，从事语音识别算法和技术架构的开发及业务支持工作。2015年开始在Kaldi开源项目中贡献代码，参与了nnet3和chain模型的开发工作，并维护其中若干示例及OpenSLR的中文语音识别模型。

张俊博

博士毕业于中国科学院声学研究所，师从颜永红研究员。在小米公司从零起主导构建了整套语音算法研究框架，包括语音识别、智能设备语音唤醒、声纹识别、语音增强、用于语音应用的神经网络部署，均达到了当时的先进水平，并发表顶会论文若干篇，为后续的语音研发工作建立了基础。近期上线了用于外语学习的发音质量评测引擎，并给Kaldi贡献了发音良好度评分的代码。