producing-video

Installation
SKILL.md

Producing-Video · 音频 + 字幕 → 成片

把"用户已经录好的口播音频 + SRT 字幕"做成一条画面跟着声音走的 MP4。用 HyperFrames(HTML 即视频)出片。

铁律:音频和 SRT 是唯一事实源。 画面的内容来自 SRT,画面的时间轴来自 SRT 的 cue 时间戳,音频作为一个 <audio> clip 直接挂进合成里、渲染时自动合流 —— 没有"先出视频再合音频"这一步

分工(很重要)

做什么
上游 写稿 → 录音/合成音频 → 生成 SRT
本 skill(你) 选 frame/品牌 → 按 SRT 搭 HyperFrames 合成 → 校对 → preview 里让用户过目 → 渲染成片

本 skill 的输入就是 音频 + SRT,你只管出片。配音/字幕是上游的事:用户自己录好交给你,或者只给了口播文本时——先用 listenhub-tts skill(文本 → 音频 + 字幕)补出 narration-full.mp3 + narration.srt,再回到这里走主流程。声音克隆是另一条线(见"超出范围")。

依赖检查(pre-flight)

Installs
12
GitHub Stars
78
First Seen
Jul 24, 2026
producing-video — sugarforever/boring-video-studio