基于 Transformer 的实时音频噪声抑制技术原理与应用前景解析
Keywords:
Transformer, 音频噪音, 实时, 抑制, 技术Abstract
随着数字通信、智能设备和人工智能技术的飞速发展,用户对音频质量,特别是实时通信中的语音清晰度要求日益提高。音频噪声抑制技术作为提升语音质量的关键环节,经历了从传统数字信号处理(DSP)到深度学习(Deep Learning, DL)的深刻变革。近年来,在自然语言处理等领域取得巨大成功的Transformer模型,因其强大的长距离依赖建模能力,在音频处理领域崭露头角。本报告旨在深入探讨利用Transformer模型实现实时音频噪声抑制的核心技术原理、面临的挑战,以及广阔的应用前景。References
[1]Zhuangqi Chen,Pingjian Zhang.(2022).“ Lightweight Full-band and Sub-band Fusion Network for Real Time SpeechEnhancement”
[2]Bandhav Veluri.(2025).“ Deep Learning Methods for Real-TimeSpeech & Audio”
[3]Ruilin Xu,Rundi Wu,Yuko Ishiwaka,Carl Vondrick,ChangxiZheng.(2020).“Listening to Sounds of Silence for SpeechDenoising”
[4]Prateek Verma,Chris Chafe.(2021).“A GENERATIVEMODEL FOR RAW AUDIO USING TRANSFORMERARCHITECTURES”