audio-denoise · 音频降噪

去除录音中的背景噪声、电流声、风噪与嗡嗡声。提供三级降噪方案:基础 FFT 滤波、加强降噪、RNN 神经网络降噪(针对人声优化),按噪声程度自动或手动选择。
基于 ffmpeg 确定性滤镜链,执行命令透明可复现;视频输入只处理音轨、画面原样保留;绝不删除原始文件。
调用示例:在聊天框中说"给这段播客录音降噪,背景有空调声"。
产品详解
定位
audio-denoise 是降噪专项工具:清理录音中的背景噪声。它只做降噪调参与执行,不做剪辑、转码、音量等通用音频操作。
核心能力
- 三级降噪方案:Tier 1 基础 FFT 滤波(轻度噪声,纯 ffmpeg);Tier 2 加强降噪(中度噪声、稳态背景音,默认档);Tier 3 RNN 神经网络降噪(人声优化,播客/访谈/复杂噪声环境)。
- 确定性滤镜链:脚本按 tier 自动组装 ffmpeg 滤镜并打印实际执行的命令,参数可复现,不现场手拼。
- 视频输入安全:视频输入自动只处理音轨、视频轨原样保留。
- 原始文件保护:绝不删除原始文件,默认保留。
- 降级兜底:Tier 3 所需 RNNoise 模型缺失时自动降级 Tier 2 并给出下载指引。
工作流程
- 探测输入文件:展示时长/码率/声道,判断音频还是视频
- 选择 tier(默认 Tier 2;人声录音可选 Tier 3,需 RNNoise 模型)
- 执行降噪,输出到
outputs/主题名/,附处理报告(原始 vs 输出、所用 tier 与滤镜链、大小对比) - 降噪过度时降低 tier 或调小
--mix重跑
输入与输出
| 输入 | 必填 | 说明 |
|---|---|---|
| input_file | 是 | 音频或视频文件路径(wav/mp3/flac/aac/m4a/mp4/mkv/mov) |
| tier | 否 | 1 / 2 / 3,默认 2 |
| mix | 否 | 降噪强度 0.0–1.0(默认 0.8,仅 Tier 3) |
| output_file | 否 | 默认 outputs/主题名/{filename}-clean.{ext} |
输出:降噪后的音频文件 + 处理报告。
与相邻 skill 的区别
| skill | 分工 |
|---|---|
| audio-denoise(本) | 专做降噪调参 |
| audio-editing | 通用音频操作(剪辑/转码/音量等),内置降噪兜底 |
| auto-subtitle | 语音转字幕,不做降噪 |
| audio-mix | 混音/BGM,不做降噪 |
适用场景
- 播客、访谈录音去除空调/风扇/底噪
- 口播视频录制中的电流声、风噪清理
- 会议录音、课程录音的杂音处理
使用前准备
- 无需 API key,本地 ffmpeg 处理,无按量费用。
- Tier 3 需 RNNoise 模型
sh.rnnn(可从 GitHub 下载);缺失自动降级 Tier 2,不阻塞。 - 降噪强度与音质是 trade-off:过度降噪会损伤人声,按报告试听后微调。
audio-denoise 隶属于 Aiglade Skill 库。在 Aiglade 聊天框中用自然语言描述需求即可调用。