要用VC++做一个语音识别系统应该从哪些方面入手?

sazabi994 2009-01-19 10:54:26
我是一个大四学生,下半学期要做一个语音识别系统(不是那种能识别出语音内容的,仅仅是能够通过一段音频鉴别出这段话是谁说的),请问我应该从哪方面入手,看些什么书呢?
...全文
292 9 打赏 收藏 转发到动态 举报
写回复
用AI写文章
9 条回复
切换为时间正序
请发表友善的回复…
发表回复
  • 打赏
  • 举报
回复
上面的建议:
从Speech SDK5.1 入手
可以考虑考虑,从实际代码入手,然后逐步了解里面的一些技术,参数,概念,名词。
sinovoice 2009-01-19
  • 打赏
  • 举报
回复
[Quote=引用 3 楼 huayehanshan 的回复:]
到 GooGle 上搜索一下,看看相关的资料。如果不是能识别出语音内容,不用区分每个单词。只是判断
一段话是谁说的,我想应该用到波形的分析和相似匹配就够了。因为语音是波形文件么,只要两个波形
足够的相似,就可以认为是同一个人说的。

呵呵,个人愚见。
[/Quote]

同一楼上的,说实话,这个不好弄,如果你要识别语音内容,免费的可以使用微软的SAPI,或者国内科大讯飞代理的
nuance的ASR;sinovoice原来代理nuance的OSR这个,以上两家他们都有自己的嵌入式识别技术。哈哈,希望这些对你有帮助。
xiaoyisnail 2009-01-19
  • 打赏
  • 举报
回复
是做毕业设计吧
先google,后图书馆,保证你能找到你想要的资料
要学会利用资源
glacier3d 2009-01-19
  • 打赏
  • 举报
回复
自己写识别引擎貌似不太现实,微软有,到网上把那几个包都安装了就能用来开发了
叶落寒山 2009-01-19
  • 打赏
  • 举报
回复
到 GooGle 上搜索一下,看看相关的资料。如果不是能识别出语音内容,不用区分每个单词。只是判断
一段话是谁说的,我想应该用到波形的分析和相似匹配就够了。因为语音是波形文件么,只要两个波形
足够的相似,就可以认为是同一个人说的。

呵呵,个人愚见。
xbwee 2009-01-19
  • 打赏
  • 举报
回复
使用语音引擎SDK开发,比如微软免费的 Speech SDK5.1
用它需要一些COM 的知识。
OenAuth.Net 2009-01-19
  • 打赏
  • 举报
回复
音频编码吧,我觉得
waizqfor 2009-01-19
  • 打赏
  • 举报
回复
[Quote=引用楼主 sazabi994 的帖子:]
我是一个大四学生,下半学期要做一个语音识别系统(不是那种能识别出语音内容的,仅仅是能够通过一段音频鉴别出这段话是谁说的),请问我应该从哪方面入手,看些什么书呢?
[/Quote]
语音识别 单纯的用C++的库感觉不能达到要求 一般也没做过 老师有给你们思路吗 想必你自己也有所想法了吧
微软语音识别系统SpeechSDK 5.1 中文版 下个这个 然后看看 能有所收获
ForestDB 2009-01-19
  • 打赏
  • 举报
回复
如果是把说的内容鉴别出来用上面提到的开发包,如果只是像你所说的分辨出是谁说的,那么可以通过信号分析,把时域信号转成频域信号,得到频率特征,并把这个特征和每个人的频率特征进行比较即可(即一个特征库)。
大致可分声音的获得,信号的转化(可以在VC中集成matlab库),频率特征比较,特征库的建立。
或者你一“声纹”之类的关键词搜搜,看有没有现成的解决方案。

65,210

社区成员

发帖
与我相关
我的任务
社区描述
C++ 语言相关问题讨论,技术干货分享,前沿动态等
c++ 技术论坛(原bbs)
社区管理员
  • C++ 语言社区
  • encoderlee
  • paschen
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告
  1. 请不要发布与C++技术无关的贴子
  2. 请不要发布与技术无关的招聘、广告的帖子
  3. 请尽可能的描述清楚你的问题,如果涉及到代码请尽可能的格式化一下

试试用AI创作助手写篇文章吧