listenhub-tts

Installation
SKILL.md

ListenHub-TTS · 文稿 → 音频 + 字幕

把一段口播文本变成「配音音频 + 时间轴准确的 SRT 字幕」。这是视频制作链路的上游:产物 narration-full.mp3 + narration.srt 直接喂给 producing-video skill 出片。

铁律:时间轴是字幕的命根。 字幕的时间戳要准——这是这步唯一不能错的东西;个别错的中文同音字/英文专名,下游文本级校正只改字、绝不动时间轴。

分工

做什么
用户 写口播稿(纯文本 narration.txt)
本 skill(你) ListenHub 出音频 + 字幕(原生优先,ASR fallback)→ 编排校正 → 交出 mp3 + SRT
下游 producing-video 拿 mp3 + SRT 出成片

用户已经自己有音频/字幕 → 跳过本 skill,直接用 producing-video。本 skill 只在「只有文本」时补这一段。

两条出字幕的路(脚本自动选)

Installs
12
GitHub Stars
78
First Seen
Jul 24, 2026
listenhub-tts — sugarforever/boring-video-studio