欢迎来到天天文库
浏览记录
ID:37904488
大小:35.50 KB
页数:3页
时间:2019-06-02
《VC编程实现文本语音转换》由会员上传分享,免费在线阅读,更多相关内容在教育资源-天天文库。
1、语音识别的基本原理FundamentalsofSpeechRecognitionVC编程实现文本语音转换文本语音(Text-to-Speech,以下简称TTS),它的作用就是把通过TTS引擎把文本转化为语音输出。本文不是讲述如何建立自己的TTS引擎,而是简单介绍如何运用MicrosoftSpeechSDK建立自己的文本语音转换应用程序。 MicrosoftSpeechSDK简介 MicrosoftSpeechSDK是微软提供的软件开发包,提供的Speech API (SAPI)主要包含两大方面: 1.APIforText-to
2、-Speech 2.APIforSpeechRecognition 其中APIforText-to-Speech,就是微软TTS引擎的接口,通过它我们可以很容易地建立功能强大的文本语音程序,金山词霸的单词朗读功能就用到了这写API,而目前几乎所有的文本朗读工具都是用这个SDK开发的。至于APIforSpeechRecognition就是与TTS相对应的语音识别,语音技术是一种令人振奋的技术,但由于目前语音识别技术准确度和识别速度不太理想,还未达到广泛应用的要求。 MicrosoftSpeechSDK可以在微软的网站免费下载,目
3、前的版本是5.1,为了支持中文,还要把附加的语言包(LangPack)一起下载。 为了在VC中使用这SDK,必需在工程中添加SDK的include和lib目录,为免每个工程都添加目录,最好的办法是在VC的 Option->Directoris立加上SDK的include和lib目录。 一个最简单的例子 先看一个入门的例子: #include<sapi.h> #pragmacomment(lib,"ole32.lib")//CoInitializeCoCreateInstance需要调用ole32.dll #pragmaco
4、mment(lib,"sapi.lib")//sapi.lib在SDK的lib目录,必需正确配置 intmain(intargc,char*argv[]) { ISpVoice*pVoice=NULL; //COM初始化: if(FAILED(::CoInitialize(NULL))) returnFALSE; //获取ISpVoice接口: HRESULThr=CoCreateInstance(CLSID_SpVoice,NULL,CLSCTX_ALL,IID_ISpVoice,(void**)&pVoice); if(SUCCEED
5、ED(hr)) 第3页共3页语音识别的基本原理FundamentalsofSpeechRecognition{ hr=pVoice->Speak(L"Helloworld",0,NULL); pVoice->Release(); pVoice=NULL; } //千万不要忘记: ::CoUninitialize(); returnTRUE; } 短短20几行代码就实现了文本语音转换,够神奇吧。SDK提供的SAPI是基于COM封装的,无论你是否熟悉COM,只要按部就班地用CoInitialize(),CoCreateInstance()
6、获取IspVoice接口就够了,需要注意的是初始化COM后,程序结束前一定要用CoUninitialize()释放资源。 IspVoice接口主要函数 上述程序的流程是获取IspVoice接口,然后用ISpVoice::Speak()把文本输出为语音,可见,程序的核心就是IspVoice接口。除了Speak外IspVoice接口还有许多成员函数,具体用法请参考SDK的文档。下面择要说一下几个主要函数的用法:HRESULTSpeak(constWCHAR*pwcs,DWORDdwFlags,ULONG*pulStreamNumber
7、); 功能:就是speak了 参数: *pwcs输入的文本字符串,必需为Unicode,如果是ansi字符串必需先转换为Unicode。 dwFlags用来标志Speak的方式,其中SPF_IS_XML表示输入文本含有XML标签,这个下文会讲到。 PulStreamNumber输出,用来获取去当前文本输入的等候播放队列的位置,只有在异步模式才有用。 HRESULTPause(void); HRESULTResume(void); 功能:一看就知道了。 HRESULT SetRate(longRateAdjus
8、t); HRESULTGetRate(long*pRateAdjust); 功能:设置/获取播放速度,范围:-10to10 HRESULTSetVolume(USHORTusVolume)
此文档下载收益归作者所有