auto-subtitle · 自动字幕

auto-subtitle

把音频/视频里的人声识别成字幕文件(SRT/ASS/TXT/JSON),可选把字幕烧录进视频。

基于 faster-whisper 本地 ASR,中文友好断句(默认每行约 18 字);ASS 样式按视频宽高自适应字号与边距。模型 tiny 到 large-v3 可选,越大越准越慢。视频自动提取音轨,不修改原文件。

调用示例:在聊天框中说"给这条视频生成中文字幕并烧录进去"。

产品详解

定位

auto-subtitle 只做一件事:语音 → 字幕文件(+ 可选烧录进视频)。它不做剪辑、不做翻译、不做降噪。

核心能力

工作流程

  1. 提供音频或视频文件
  2. 选择字幕格式(默认 SRT)、语言(默认自动检测)、模型(默认 base)
  3. 生成字幕文件到 outputs/主题名/
  4. (可选)烧录硬字幕进视频,或封装软字幕
  5. 报告识别语言、字幕条数、所用模型与输出路径

输入与输出

输入 必填 说明
input_file 是 音频(mp3/wav/m4a/aac/flac)或视频(mp4/mkv/mov/webm)
format 否 srt(默认)/ ass / txt / json
language 否 auto(默认)或 zh/en 等 ISO 639-1 码
model 否 tiny / base(默认)/ small / medium / large-v3
burn 否 是否烧录进视频(需视频输入)

输出:字幕文件;若烧录则另出 *-sub.mp4 硬字幕视频。

与相邻 skill 的区别

skill 分工
auto-subtitle(本) 语音 → 字幕文件(+ 烧录)
subtitle-translate 字幕翻译
audio-denoise 降噪,不做字幕
video-editing 通用视频剪辑
clipify 长视频智能切片 + 烧字幕

适用场景

使用前准备


auto-subtitle 隶属于 Aiglade Skill 库。在 Aiglade 聊天框中用自然语言描述需求即可调用。

← 回到 Skill 大全