markdown-conversion
Installation
SKILL.md
Markdown 转换
将任意支持的来源——文件、目录或 URL——转换为干净的 Markdown。每个输入生成一个 .md 文件(默认会一并提取图片到 <stem>_files/)。
标准化输出契约
本技能的输出是面向下游 PPT / Word / 学习笔记等流程的“可读 Markdown 层”,而不是原始文件的版式复刻。所有转换器遵循同一套约定:
| 输出 | 约定 |
|---|---|
| 主 Markdown | 每个输入生成一个 .md;标题、段落、列表、表格和链接优先保持可读、可引用 |
| 资产目录 | 图片等伴随资源放在同级 <stem>_files/,Markdown 中只使用相对路径 |
| 图片 manifest | 能提供结构化图片信息的转换器会在 <stem>_files/image_manifest.json 写入图片元数据;包含来源类型、尺寸、使用次数、页面 / 幻灯片出现位置等 |
| 转换 profile | 成功转换后写入 <stem>.conversion_profile.json,记录原始文件、Markdown、资产目录、manifest、标题 / 表格 / 图片 / 链接计数和转换器信息;批量转换时每个 Markdown 有独立 sidecar,避免互相覆盖 |
| 网页图片来源 | web_to_md.py 下载网页图片时写入 <stem>_files/image_sources.json;图片授权状态默认 unknown,交付前需审查 |
| 表格数据 | Excel、PPT 表格、可读图表数据统一转为 Markdown 表,避免数据只停留在图片或占位符里 |
| 链接 | 外部链接尽量保留为 Markdown 链接;不安全或不可解析链接会降级为纯文本 / 占位说明 |
| 原始文件 | 本技能不移动原始文件;项目型工作流如 PPT Master / Word Master 应在转换后自行归档原始文件、Markdown 和资产目录 |