社区
C++ 语言
帖子详情
要用VC++做一个语音识别系统应该从哪些方面入手?
sazabi994
2009-01-19 10:54:26
我是一个大四学生,下半学期要做一个语音识别系统(不是那种能识别出语音内容的,仅仅是能够通过一段音频鉴别出这段话是谁说的),请问我应该从哪方面入手,看些什么书呢?
...全文
294
9
打赏
收藏
要用VC++做一个语音识别系统应该从哪些方面入手?
我是一个大四学生,下半学期要做一个语音识别系统(不是那种能识别出语音内容的,仅仅是能够通过一段音频鉴别出这段话是谁说的),请问我应该从哪方面入手,看些什么书呢?
复制链接
扫一扫
分享
转发到动态
举报
写回复
配置赞助广告
用AI写文章
9 条
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
路漫漫其修远.
2009-01-19
打赏
举报
回复
上面的建议:
从Speech SDK5.1 入手
可以考虑考虑,从实际代码入手,然后逐步了解里面的一些技术,参数,概念,名词。
sinovoice
2009-01-19
打赏
举报
回复
[Quote=引用 3 楼 huayehanshan 的回复:]
到 GooGle 上搜索一下,看看相关的资料。如果不是能识别出语音内容,不用区分每个单词。只是判断
一段话是谁说的,我想应该用到波形的分析和相似匹配就够了。因为语音是波形文件么,只要两个波形
足够的相似,就可以认为是同一个人说的。
呵呵,个人愚见。
[/Quote]
同一楼上的,说实话,这个不好弄,如果你要识别语音内容,免费的可以使用微软的SAPI,或者国内科大讯飞代理的
nuance的ASR;sinovoice原来代理nuance的OSR这个,以上两家他们都有自己的嵌入式识别技术。哈哈,希望这些对你有帮助。
xiaoyisnail
2009-01-19
打赏
举报
回复
是做毕业设计吧
先google,后图书馆,保证你能找到你想要的资料
要学会利用资源
glacier3d
2009-01-19
打赏
举报
回复
自己写识别引擎貌似不太现实,微软有,到网上把那几个包都安装了就能用来开发了
叶落寒山
2009-01-19
打赏
举报
回复
到 GooGle 上搜索一下,看看相关的资料。如果不是能识别出语音内容,不用区分每个单词。只是判断
一段话是谁说的,我想应该用到波形的分析和相似匹配就够了。因为语音是波形文件么,只要两个波形
足够的相似,就可以认为是同一个人说的。
呵呵,个人愚见。
xbwee
2009-01-19
打赏
举报
回复
使用语音引擎SDK开发,比如微软免费的 Speech SDK5.1
用它需要一些COM 的知识。
OenAuth.Net
2009-01-19
打赏
举报
回复
音频编码吧,我觉得
waizqfor
2009-01-19
打赏
举报
回复
[Quote=引用楼主 sazabi994 的帖子:]
我是一个大四学生,下半学期要做一个语音识别系统(不是那种能识别出语音内容的,仅仅是能够通过一段音频鉴别出这段话是谁说的),请问我应该从哪方面入手,看些什么书呢?
[/Quote]
语音识别 单纯的用C++的库感觉不能达到要求 一般也没做过 老师有给你们思路吗 想必你自己也有所想法了吧
微软语音识别系统SpeechSDK 5.1 中文版 下个这个 然后看看 能有所收获
ForestDB
2009-01-19
打赏
举报
回复
如果是把说的内容鉴别出来用上面提到的开发包,如果只是像你所说的分辨出是谁说的,那么可以通过信号分析,把时域信号转成频域信号,得到频率特征,并把这个特征和每个人的频率特征进行比较即可(即一个特征库)。
大致可分声音的获得,信号的转化(可以在VC中集成matlab库),频率特征比较,特征库的建立。
或者你一“声纹”之类的关键词搜搜,看有没有现成的解决方案。
V
C++
基于微软语音引擎开发
语音识别
总结
本文介绍了如何利用SAPI API在V
C++
中开发
语音识别
应用,涉及TTS和
语音识别
系统
的概念,以及ISpVoice接口控制文本语音转换、ISpRecoContext接口进行
语音识别
的相关细节。同时讲解了事件处理、字典定制和音频输出等关键步骤,并提供了在MFC中进行
语音识别
开发的主要步骤。
V
C++
实现的
语音识别
程序项目
本文聚焦于用V
C++
实现
语音识别
程序,介绍了
语音识别
技术概念、应用与挑战,阐述了V
C++
环境搭建、音频处理、特征提取等实现步骤,还提及Microsoft Speech API和PocketSphinx的使用,最后探讨了程序在准确性、实时性、鲁棒性和用户体验方面的优化要点。
V
C++
课程设计:构建基础
语音识别
系统
本文是
一个
使用V
C++
实现基础
语音识别
系统
的课程设计案例。介绍了
系统
开发的环境配置、需求目标,阐述了语音信号数字化、预处理、特征提取、模式匹配等技术,还探讨了机器学习模型的应用,以及
系统
交互界面构建、性能优化等内容,助学生理解
语音识别
原理并获实操经验。
V
C++
如何编写
一个
语音识别
的类for Micosoft speech Api5.1
本文介绍了如何利用V
C++
编程,结合Microsoft Speech API 5.1实现
语音识别
功能,包括向上、向下、左右移动、跳跃、停止、跑步等指令的识别。并提到会为需要的人提供相关代码文件。
使用V
C++
6.0+microsoft speech API 实现
语音识别
示例
本文演示了如何使用V
C++
6.0结合Microsoft Speech API进行
语音识别
。通过创建ISpRecoContext和ISpRecoGrammar对象,加载
语音识别
词典,并监听语音输入,实现将语音转化为文字的功能。用户可以通过说出特定词汇(如“Stop”)来结束识别过程。
C++ 语言
65,211
社区成员
250,514
社区内容
发帖
与我相关
我的任务
C++ 语言
C++ 语言相关问题讨论,技术干货分享,前沿动态等
复制链接
扫一扫
分享
社区描述
C++ 语言相关问题讨论,技术干货分享,前沿动态等
c++
技术论坛(原bbs)
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
请不要发布与C++技术无关的贴子
请不要发布与技术无关的招聘、广告的帖子
请尽可能的描述清楚你的问题,如果涉及到代码请尽可能的格式化一下
试试用AI创作助手写篇文章吧
+ 用AI写文章