基于 Transformer 的实时音频噪声抑制技术原理与应用前景解析

Authors

  • 柳晴 昆明市融媒体中心,中国·云南 昆明 Author

Keywords:

Transformer, 音频噪音, 实时, 抑制, 技术

Abstract

随着数字通信、智能设备和人工智能技术的飞速发展,用户对音频质量,特别是实时通信中的语音清晰度要求日益提高。音频噪声抑制技术作为提升语音质量的关键环节,经历了从传统数字信号处理(DSP)到深度学习(Deep Learning, DL)的深刻变革。近年来,在自然语言处理等领域取得巨大成功的Transformer模型,因其强大的长距离依赖建模能力,在音频处理领域崭露头角。本报告旨在深入探讨利用Transformer模型实现实时音频噪声抑制的核心技术原理、面临的挑战,以及广阔的应用前景。

References

[1]Zhuangqi Chen,Pingjian Zhang.(2022).“ Lightweight Full-band and Sub-band Fusion Network for Real Time SpeechEnhancement”

[2]Bandhav Veluri.(2025).“ Deep Learning Methods for Real-TimeSpeech & Audio”

[3]Ruilin Xu,Rundi Wu,Yuko Ishiwaka,Carl Vondrick,ChangxiZheng.(2020).“Listening to Sounds of Silence for SpeechDenoising”

[4]Prateek Verma,Chris Chafe.(2021).“A GENERATIVEMODEL FOR RAW AUDIO USING TRANSFORMERARCHITECTURES”

Downloads

Published

2026-08-04

Issue

Section

Articles