社区
Android
帖子详情
Beamforming后接科大讯飞引擎识别率反而降低的问题
fxxjssc
2016-08-24 08:17:55
各位,
遇到问题如下:
1. 不加beamformer,语音采集平台采集语音送科大讯飞引擎,可以识别。
2. 加beamformer,人耳感受到噪声和混响都有降低,处理后的语音送科大讯飞引擎却识别不了。
请给位老大指点。
...全文
722
回复
打赏
收藏
Beamforming后接科大讯飞引擎识别率反而降低的问题
各位, 遇到问题如下: 1. 不加beamformer,语音采集平台采集语音送科大讯飞引擎,可以识别。 2. 加beamformer,人耳感受到噪声和混响都有降低,处理后的语音送科大讯飞引擎却识别不了。 请给位老大指点。
复制链接
扫一扫
分享
转发到动态
举报
写回复
配置赞助广告
用AI写文章
回复
切换为时间正序
请发表友善的回复…
发表回复
打赏红包
ReSpeaker麦克风阵列:从硬件拆解到算法原理的远场语音交互实践
本文深入解析ReSpeaker麦克风阵列的硬件架构与核心算法,涵盖6麦克风环形布局、AC108音频编解码芯片、I2S/I2C接口设计,以及波束形成(延时求和/MVDR)、声源定位(TDOA/广义互相关)、去噪与回声消除等关键技术。同时介绍ALSA驱动配置、Python音频处理库使用、通道映射与增益校准,并给出树莓派语音助手集成方案。
端侧语音语义理解:多模态融合与常识推理实战
本文详述一种面向边缘设备的端侧语音语义理解系统,摒弃传统ASR→NLU流水线,构建基于图神经网络(GNN)与轻量级常识知识图谱的‘语义理解中枢’。核心涵盖多模态对齐(语音/文本/环境/用户画像)、意图泛化
引擎
、口语纠错贝叶斯推理、动态对话状态图(DST)及声学前端状态感知。所有模块在树莓派5上端侧运行,延迟<800ms,内存占用<1.2GB,支持模糊指代、隐含意图与跨域指令理解,实测准确率达89.7%。
高校科研成果转化难怎么办?.docx
科易网基于40亿+科创知识图谱数据库,深度探索AI技术在技术转移、成果转化、技术经纪、知识产权、产业创新、科技招商等垂直领域的多样化应用场景,研究科技创新领域的AI+数智化解决方案,推动科技创新与产业创新智能化发展。
科技服务机构如何提供专业、高效的评估评价服务,提升市场竞争力?.docx
科技服务机构如何提供专业、高效的评估评价服务,提升市场竞争力?
Android
80,490
社区成员
91,375
社区内容
发帖
与我相关
我的任务
Android
移动平台 Android
复制链接
扫一扫
分享
社区描述
移动平台 Android
android
android-studio
androidx
技术论坛(原bbs)
社区管理员
加入社区
获取链接或二维码
近7日
近30日
至今
加载中
查看更多榜单
社区公告
暂无公告
试试用AI创作助手写篇文章吧
+ 用AI写文章