wjs-voicedrop-reading-aloud
Installation
SKILL.md
wjs-voicedrop-reading-aloud
文字 → 有声书 mp3。不是照字面念,而是先编排:不同性质的内容换不同声音,关键转折处加语音指令,然后用火山引擎豆包 seed-tts-2.0 合成。
合成工具:~/code/volcano-tts/tts.py(先 source ~/code/.env)。
铁律
- 绝不把带【】/[ ] 标注的文本直接喂裸 API —— 裸 API 会把标注原样念出来(实测实锤)。永远走
tts.py,它把标注切段转成context_texts语音指令。 - 只能用 2.0 音色(
_uranus_bigtts后缀) —— moon/mars/tob 音色在 seed-tts-2.0 资源下报错resource ID is mismatched。 - 合成前把编排好的朗读脚本给用户看一眼(除非用户说直接出)——编排是再创作,声音分配和指令值得确认。headless/自动化场景跳过此步。
工作流
1. 取内容并认真通读
- 纯文本/文件:直接读。
- URL:WebFetch;SPA 页面(如 docs.volcengine.com)用 browse skill 渲染后取正文。
- VoiceDrop 文章:voicedrop MCP 的
read_article。