社区
图形处理/算法
帖子详情
求助!!!!谁能给做说话人识别的思路或代码
clk994
2009-03-18 10:26:45
本人毕业设计要做一个说话人识别的程序,但现在没什么思路,那位高手可以指点指点,给个思路,如果能有代码的更好。本人不胜感谢
...全文
142
3
打赏
收藏
求助!!!!谁能给做说话人识别的思路或代码
本人毕业设计要做一个说话人识别的程序,但现在没什么思路,那位高手可以指点指点,给个思路,如果能有代码的更好。本人不胜感谢
复制链接
扫一扫
分享
转发到动态
举报
写回复
配置赞助广告
用AI写文章
3 条
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
liujie40
2010-07-27
打赏
举报
回复
你是做文本无关的,还是特定说话人的呢?二者差别很大的。
allright1199
2009-03-18
打赏
举报
回复
是根据语音识别人吧
tanwei1002
2009-03-18
打赏
举报
回复
不懂
我对
说话
人
识别
/声纹
识别
的研究综述
GMM-UBM系统框架 GMM-UBM的核心思想是用混合高斯函数去拟合特征在高维空间的概率密度分布,在训练
说话
人模型的时候,由于注册时
说话
人的数据稀疏,通常利用一个通用背景模型(Universal Background Model,UBM)和少量的
说话
人数据,通过自适应算法(如最大后验概率MAP,最大似然线性回归MLLR等)得到目标
说话
人模型;在测试时,用测试语音相对于目标
说话
人模型和UBM模型
说话
人
识别
(声纹
识别
)发展史简单总结——(阶段学习总结,GMM,GMM-UBM,GMM-SVM理解)
本文的创新点与关键点之一:GMM,GMM-UBM,GMM-SVM的理解 大概是从10月20号开始由于项目需要开始接触
说话
人
识别
这一研究方向,这一个多月的时间主要是看论文中文英文,尤其是综述文章,当然也试着了解传统方法背后的
思路
和原理。经过这段时间的学习,有了一点自己的理解,故分享出来加深自己对理解的把握顺便水水文章。本文先是按照
说话
人
识别
发展脉络来展开,然后对五个传统方法进行了解读: 如图1所示:目前学术界主流将
说话
人
识别
发展分为了三个阶段:特征工程,统计模型和深度学习。如果我们按
说话
人
识别
的应用方法
kaldi中改写sre10/v1用timit dataset
做
说话
人
识别
总结
经过一个周的调试修改,终于在timit数据集上跑通了sre10中的v1 demo, 特来总结一下,重新理顺一下
思路
,把其中的各个步骤的算法大体的捋一遍。 最重要的还是数据准备阶段,由于没有原始的数据,整个过程进行的比较困难,花了差不多一个周的时间来各种改,之前第一次跑wsj那个demo的时候才花了不到一个周,现在对kaldi还算比较熟悉,对数据处理的脚本也都写出来了,只需要稍微改一下就好,总之还是
使用tensorflow和densenet神经网路实现语谱图声纹
识别
,即
说话
人
识别
。
介绍 本文介绍一种使用tensorflow框架和densenet神经网路实现声纹语谱图
识别
算法,即
说话
人
识别
。本文侧重一种解决方案的
思路
,仅
做
了小批量数据的简单验证,收敛效果良好,还没有
做
大量数据集的验证,后期会
做
一些实际的验证,请持续关注。如果乐意与我交流,文章后面有联系方式,随时欢迎。
代码
地址 码云:https://gitee.com/lizhigong/Voicepr...
FunASR多
说话
人
识别
终极指南:从实战到深度解析
> 💡 **核心价值提示**:在会议记录、客服质检、语音监控等场景中,准确区分不同
说话
人的发言内容直接影响业务效果。FunASR通过端到端深度学习模型,让多
说话
人
识别
变得简单高效。 ## 🎯 实战痛点:为什么需要多
说话
人
识别
? ### 真实业务场景 想象一下这样的场景:一场重要的商务会议正在进行,你需要: - 自动记录每个参会者的发言内容 - 区分主持人、主讲人、提问者的角色 - 处理多人
图形处理/算法
19,464
社区成员
50,678
社区内容
发帖
与我相关
我的任务
图形处理/算法
VC/MFC 图形处理/算法
复制链接
扫一扫
分享
社区描述
VC/MFC 图形处理/算法
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章