lov-describe-image

Installation
SKILL.md

lov-describe-image

给纯文本模型"看图":把图片发送给视觉模型(智谱 GLM-4V-Flash,免费),返回文字描述,让本身不具备视觉能力的模型(如 deepseek-v4-flash)能间接"看到"图片内容。

Triggers

Activate when

  • 用户要求"看看/描述/识别/读懂/读取/识别这张图",或询问图片里写了什么。
  • 任务上下文里出现图片文件(截图、图表、照片、海报、含文字的图),而当前模型无法直接看图。
  • 需要从含文字的图片(界面截图、文档扫描、图表)中提取具体信息,例如检查异常、转录文字、核对内容。

Do not activate when

  • 用户只是要求生成、编辑、压缩或转换图片,而不是理解图片内容。
  • 当前模型本身具备视觉能力、能直接看到图片,无需转述。
  • 用户明确要求走 dsh 的原生多模态管线、项目内置读图工具,或指定了其他视觉后端。

Usage

Installs
4
GitHub Stars
64
First Seen
9 days ago
lov-describe-image — lovstudio/skills