video-understand
Installation
SKILL.md
video-understand — 小红书视频理解管线
crawler 只能拿到视频的直链 + 元数据,给不了"理解"。真正读懂一条视频要走多模态管线, 而且分工明确:口播交给 whisper,画面交给视觉模型(就是你/agent 直接 Read 关键帧),两条模态合起来才叫理解。
何时用
- 想"学习某个博主的爆款视频/同类视频"的钩子、选题、视觉、工作流、卖点
- 拿到一个小红书 note_id / 视频直链 / 本地 mp4,要产出一份结构化《视频拆解》
- 给我们(揭小贤文创)做创意参考(视觉/工作流)+ 内容分析(该做什么/对标谁)
核心:拉片 = 拉两样东西
"拉片"= 把一条对标视频拆成可复刻的 SOP。它拉的是两层:
- 拉内容(讲了什么):选题 / 开头钩子 / 段落结构 / 每句话时间轴 / punchline —— 看一遍就能复刻个大概,不难。
- 拉技术(怎么做出来的):怎么拍 / 什么图形动效 / 怎么剪 / 什么节奏 / 用了什么 AI 工具 —— 盯着成片一百遍也看不出来,这才值钱。本 skill 主攻这层。
标准拉片六步
STEP1 定维度 → STEP2 拆素材(脚本) → STEP3 判型 → STEP4 两遍细看(粗览→密抽) → STEP5 逐段填表 → STEP6 双报告+复现SOP