audio-editing · 通用音频处理

除降噪外的通用音频操作 skill:裁剪、格式转码、音量归一化、从视频提取音轨、多段拼接、淡入淡出、保音高变速,以及顺手的降噪兜底。
全部走确定性 audio_ops.py 脚本,不现场手拼 ffmpeg 命令;每次操作打印实际执行的命令与输出文件的时长、码率、声道、采样率。
调用示例:在聊天框中说"把这段录音裁掉开头 10 秒,转成 mp3 并统一音量"。
产品详解
定位
audio-editing 是通用音频处理工具:音频剪辑/裁剪、转码、响度、提取音轨、拼接、淡入淡出、变速——除降噪外的日常音频操作都在这里,一条脚本确定性执行、可复现。
核心能力
- 裁剪 trim:按起止时间或起点+时长裁取片段。
- 转码 convert:wav / mp3 / m4a / aac / flac 互转,可指定码率、采样率、声道。
- 音量归一化 normalize:默认 loudnorm 到 -14 LUFS / -1.5 dBTP(社媒/播客通用响度)。
- 提取音轨 extract:从 mp4 / mkv / mov 提取音频,支持不重编码直接复制。
- 拼接 concat:多段音频按顺序拼接,兼容不同采样率/容器。
- 淡入淡出 fade:自定义淡入/淡出时长,淡出自动定位到结尾。
- 变速 speed:基于 atempo 保音高加速/减速,超 0.5–2.0 倍范围自动级联。
- 降噪兜底 denoise:顺手降噪;认真降噪请用 audio-denoise。
- 透明执行:每次操作打印实际 ffmpeg 命令与输出文件参数。
工作流程
- 环境检查 + 探测(
info先展示文件时长/码率/声道再动手) - 执行指定操作(trim / convert / normalize / extract / concat / fade / speed / denoise)
- 输出新文件到
outputs/主题名/,绝不删除或覆盖原始文件
输入与输出
| 输入 | 说明 |
|---|---|
| input_file | 必填,音频或视频文件路径 |
| operation | 必填,操作类型 |
| output_file | 选填,默认 outputs/主题名/{name}-{op}.{ext} |
输出:处理后的音频文件 + 实际执行的 ffmpeg 命令与输出参数。
与相邻 skill 的区别
- audio-denoise:降噪专项 skill,负责选级、模型下载、降噪报告等完整流程——需要认真降噪时用它。本 skill 的 denoise 只是顺手兜底,两者底层能力一致,定位不同。
适用场景
- 播客/录音的粗剪:裁头去尾、多段拼接、音量统一
- 短视频音频准备:转码成 mp3、提取视频音轨、加淡入淡出
- 录音整理:变速回放、格式统一、响度标准化
- 配音/配乐的初步处理,再交给混音环节
使用前准备
- 无需 API key,本地脚本运行;脚本会自动检查 ffmpeg/ffprobe,缺失时给安装提示。
- 先
info探测再处理,避免误操作;原始文件只读,新文件另存。
audio-editing 隶属于 Aiglade Skill 库。在 Aiglade 聊天框中用自然语言描述需求即可调用。