社区
C++ 语言
帖子详情
要用VC++做一个语音识别系统应该从哪些方面入手?
sazabi994
2009-01-19 10:54:26
我是一个大四学生,下半学期要做一个语音识别系统(不是那种能识别出语音内容的,仅仅是能够通过一段音频鉴别出这段话是谁说的),请问我应该从哪方面入手,看些什么书呢?
...全文
292
9
打赏
收藏
要用VC++做一个语音识别系统应该从哪些方面入手?
我是一个大四学生,下半学期要做一个语音识别系统(不是那种能识别出语音内容的,仅仅是能够通过一段音频鉴别出这段话是谁说的),请问我应该从哪方面入手,看些什么书呢?
复制链接
扫一扫
分享
转发到动态
举报
写回复
配置赞助广告
用AI写文章
9 条
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
路漫漫其修远.
2009-01-19
打赏
举报
回复
上面的建议:
从Speech SDK5.1 入手
可以考虑考虑,从实际代码入手,然后逐步了解里面的一些技术,参数,概念,名词。
sinovoice
2009-01-19
打赏
举报
回复
[Quote=引用 3 楼 huayehanshan 的回复:]
到 GooGle 上搜索一下,看看相关的资料。如果不是能识别出语音内容,不用区分每个单词。只是判断
一段话是谁说的,我想应该用到波形的分析和相似匹配就够了。因为语音是波形文件么,只要两个波形
足够的相似,就可以认为是同一个人说的。
呵呵,个人愚见。
[/Quote]
同一楼上的,说实话,这个不好弄,如果你要识别语音内容,免费的可以使用微软的SAPI,或者国内科大讯飞代理的
nuance的ASR;sinovoice原来代理nuance的OSR这个,以上两家他们都有自己的嵌入式识别技术。哈哈,希望这些对你有帮助。
xiaoyisnail
2009-01-19
打赏
举报
回复
是做毕业设计吧
先google,后图书馆,保证你能找到你想要的资料
要学会利用资源
glacier3d
2009-01-19
打赏
举报
回复
自己写识别引擎貌似不太现实,微软有,到网上把那几个包都安装了就能用来开发了
叶落寒山
2009-01-19
打赏
举报
回复
到 GooGle 上搜索一下,看看相关的资料。如果不是能识别出语音内容,不用区分每个单词。只是判断
一段话是谁说的,我想应该用到波形的分析和相似匹配就够了。因为语音是波形文件么,只要两个波形
足够的相似,就可以认为是同一个人说的。
呵呵,个人愚见。
xbwee
2009-01-19
打赏
举报
回复
使用语音引擎SDK开发,比如微软免费的 Speech SDK5.1
用它需要一些COM 的知识。
OenAuth.Net
2009-01-19
打赏
举报
回复
音频编码吧,我觉得
waizqfor
2009-01-19
打赏
举报
回复
[Quote=引用楼主 sazabi994 的帖子:]
我是一个大四学生,下半学期要做一个语音识别系统(不是那种能识别出语音内容的,仅仅是能够通过一段音频鉴别出这段话是谁说的),请问我应该从哪方面入手,看些什么书呢?
[/Quote]
语音识别 单纯的用C++的库感觉不能达到要求 一般也没做过 老师有给你们思路吗 想必你自己也有所想法了吧
微软语音识别系统SpeechSDK 5.1 中文版 下个这个 然后看看 能有所收获
ForestDB
2009-01-19
打赏
举报
回复
如果是把说的内容鉴别出来用上面提到的开发包,如果只是像你所说的分辨出是谁说的,那么可以通过信号分析,把时域信号转成频域信号,得到频率特征,并把这个特征和每个人的频率特征进行比较即可(即一个特征库)。
大致可分声音的获得,信号的转化(可以在VC中集成matlab库),频率特征比较,特征库的建立。
或者你一“声纹”之类的关键词搜搜,看有没有现成的解决方案。
V
C++
基于微软语音引擎开发
语音识别
总结
关于SAPI的简介API 概述SAPI API在
一个
应用程序和语音引擎之间提供
一个
高级别的接口。SAPI 实现了所有必需的对各种语音引擎的实时的控制和管理等低级别的细节。SAPI引擎的两个基本类型是文本语音转换
系统
(TTS)和
语音识别
系统
。TTS
系统
使用合成语音合成文本字符串和文件到声音音频流。
语音识别
技术转换人类的声音语音流到可读的文本字符串或者文件。 文本语音转换
V
C++
实现的
语音识别
程序项目
语音识别
技术,是指计算机
系统
能够辨认和理解人类说话的内容,并将语音信号转化为相应文本或命令的技术。这一领域在人工智能、自然语言处理和机器学习等多个交叉学科中得到了快速发展。
语音识别
技术的出现,极大地改变了人机交互的方式,使得我们可以通过语音来控制设备,提高了操作的便捷性和交互的自然性。
语音识别
系统
的核心在于将语音信号转换为机器能够识别和处理的符号表示,而特征提取在这一过程中扮演着至关重要的角色。在语音信号的频谱特征中提取关键信息,可以帮助减少后续处理的数据量,同时保留对识别任务至关重要的信息。
V
C++
课程设计:构建基础
语音识别
系统
V
C++
由于其与Windows操作
系统
的紧密集成,强大的性能以及丰富的类库支持,成为开发
语音识别
系统
的
一个
不错选择。我们将介绍如何利用V
C++
的多线程处理能力、音频捕捉接口和界面设计功能,来构建
一个
简单而有效的
语音识别
应用程序。
V
C++
如何编写
一个
语音识别
的类for Micosoft speech Api5.1
1)在构造语音类之前,必须先设置好工程环境: a、从微软官方网站下载windows speech sdk并安装,然后在Visual Studio 6.0中进行相关设置,在Project Setings选项的
C++
选项卡的“分类:预处理器”添加“,__WIN32_DCOM”(为预先初始化COM组件成功); b、将预处理头文件选项选中“自动使用预补偿页眉”; c、在常规选项卡中选择“实用M
使用V
C++
6.0+microsoft speech API 实现
语音识别
示例
如何用
C++
来完成一道
语音识别
的填空题: #include windows.h>#include sapi.h>#include stdio.h>#include string.h>#include atlbase.h>#include "sphelper.h"//Copyright (c) Microsoft Corporation. All rights reserved.in
C++ 语言
65,210
社区成员
250,514
社区内容
发帖
与我相关
我的任务
C++ 语言
C++ 语言相关问题讨论,技术干货分享,前沿动态等
复制链接
扫一扫
分享
社区描述
C++ 语言相关问题讨论,技术干货分享,前沿动态等
c++
技术论坛(原bbs)
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
请不要发布与C++技术无关的贴子
请不要发布与技术无关的招聘、广告的帖子
请尽可能的描述清楚你的问题,如果涉及到代码请尽可能的格式化一下
试试用AI创作助手写篇文章吧
+ 用AI写文章