listenhub-tts
Installation
SKILL.md
ListenHub-TTS · 文稿 → 音频 + 字幕
把一段口播文本变成「配音音频 + 时间轴准确的 SRT 字幕」。这是视频制作链路的上游:产物 narration-full.mp3 + narration.srt 直接喂给 producing-video skill 出片。
铁律:时间轴是字幕的命根。 字幕的时间戳要准——这是这步唯一不能错的东西;个别错的中文同音字/英文专名,下游文本级校正只改字、绝不动时间轴。
分工
| 谁 | 做什么 |
|---|---|
| 用户 | 写口播稿(纯文本 narration.txt) |
| 本 skill(你) | ListenHub 出音频 + 字幕(原生优先,ASR fallback)→ 编排校正 → 交出 mp3 + SRT |
| 下游 | producing-video 拿 mp3 + SRT 出成片 |
用户已经自己有音频/字幕 → 跳过本 skill,直接用
producing-video。本 skill 只在「只有文本」时补这一段。