网易云信AI音频最新研究成果获世界顶级学术会议 ICASSP 2022 认可
2022-02-16 09:24:35爱云资讯阅读量:1,333
近日,全球顶级音频技术会议 ICASSP2022 公布了论文入选名单。网易云信音频实验室论文——《一种针对实时通信的基于神经网络的啸叫检测方法》(A Neural Network-based Howling Detection Method for Real-time Communication Applications)被大会接收,并受邀于今年5月在会议上向学术和工业界做研究报告。
这是网易云信音频实验室创新成果连续两年受到世界顶级学术会议认可。
ICASSP(InternationalConferenceonAcoustics,SpeechandSignalProcessing)即国际声学、语音与信号处理会议,是IEEE信号处理协会主办的全球最大、最全面的音频领域顶级会议,具有权威、广泛的学界及工业界影响力,在国际上享有盛誉。
随着AI的迅速发展,深度神经网络在声音场景分类(ASC, Acoustic Scene Classification)和声音事件检测(AED, Acoustic Event Detection)任务中的应用已越来越多,并且明显优于传统的信号处理方法。网易云信音频实验室本次研究则是将AI技术应用于啸叫检测中,该论文为AI啸叫检测领域在全球范围内首个公开发表的研究成果。
当扬声器和话筒之间的声学耦合产生正反馈时,啸叫便会产生。传统的公共广播系统和助听器设备利用传统的啸叫功能检测和抑制啸叫。然而,实时通信(RTC)中的传统啸叫功能会受到非线性和不确定性的影响,如各种扬声器/麦克风响应、多种非线性音频处理、不稳定的网络传输抖动、声学路径变化和环境影响等。在啸叫检测中,使用特定时间-频率特征的信号处理方法对RTC场景是无效的。
云信音频实验室提出了一种基于卷积递归神经网络(CRNN)的方法,用于RTC应用中的啸叫检测,实现了出色的准确性和低误报率。该篇文章使用不同的移动设备收集和标记啸叫数据集用于模型训练,并选择对数梅尔谱作为输入特征,实现了 89.46% 的检测率和 0.40% 的误报率。 此外,所提出方法的模型大小仅为 121kB,并且已在实时运行的移动设备中实现。
作为行业内首批音视频 AI 实验室之一,网易云信音频实验室不断探索“AI+音频”前沿技术方向,连续取得业界权威认可。2021年,实验室在AI 音频降噪和 AI 音乐检测的研究成果被第 50 届国际噪声控制工程会议(INTER-NOISE 2021)收录,自建的国内行业中首个 AI 音乐检测模型受到了高度关注。本次AI啸叫检测成果被 ICASSP 2022接收,再次证明了网易云信在音频技术领域的顶尖研究实力。
未来,网易云信音频实验室将持续引领新技术发展方向,并将先进的算法模型应用于产品和场景中,为全球用户打造极致听觉体验。
相关文章
- 网易云信8年演进:拥抱AIGC,加速出海步伐,聚焦场景落地
- 艾瑞 IM PaaS 白皮书重磅发布,网易云信缘何持续领跑行业
- 刷视频流量不再告急,网易云信这项技术在世界编码器大赛上拿奖了!
- AI机器人+即时通讯,网易云信实现快速对接
- 网易云信携手玺文科技、校云网科技亮相2023国际数字教育大会
- 网易云信携手壹点灵荣获 2022 中国数据智能产业最具社会责任感企业
- 网易云信 7 周年丨服务超过 150 万开发者,消息量突破 20000 亿条
- 网易云信携手丝芭,打造偶像社交新范式
- 赛事升级,烽烟正燃!网易云信 Innovation 2022 开发者大赛等你参加!
- 网易云信携手网易有道,助力家庭桌面学习场景体验升级
- 加速元宇宙技术落地,网易云信亮相 MetaCon 元宇宙技术大会 2022
- 网易云信AI音频最新研究成果获世界顶级学术会议 ICASSP 2022 认可
- 网易云信再被列入Gartner最新发布的两份CPaaS市场报告
- 网易云信发布两大元宇宙解决方案,打响进军元宇宙第一枪
- 虚拟形象实时互动融合 SDK 业内首发,网易云信加码元宇宙
- 网易云信携手“瑶台”,打造元宇宙商业化实践标杆案例