lov-describe-image
Installation
SKILL.md
lov-describe-image
给纯文本模型"看图":把图片发送给视觉模型(智谱 GLM-4V-Flash,免费),返回文字描述,让本身不具备视觉能力的模型(如 deepseek-v4-flash)能间接"看到"图片内容。
Triggers
Activate when
- 用户要求"看看/描述/识别/读懂/读取/识别这张图",或询问图片里写了什么。
- 任务上下文里出现图片文件(截图、图表、照片、海报、含文字的图),而当前模型无法直接看图。
- 需要从含文字的图片(界面截图、文档扫描、图表)中提取具体信息,例如检查异常、转录文字、核对内容。
Do not activate when
- 用户只是要求生成、编辑、压缩或转换图片,而不是理解图片内容。
- 当前模型本身具备视觉能力、能直接看到图片,无需转述。
- 用户明确要求走 dsh 的原生多模态管线、项目内置读图工具,或指定了其他视觉后端。