vision-support
Installation
SKILL.md
Vision Support — 非多模态模型的图片识别桥接
铁律:本技能配置的所有模型仅用于图片内容识别,绝不参与主逻辑推理。 这些模型不会代替主模型做任何决策、分析或编码,它们只负责"看"图片然后把看到的内容用文字描述出来。
什么时候使用此技能
- 用户在对话中附带了图片,但当前模型不支持图片理解
- 用户提到截图/图片/界面/设计:"看看这个截图"、"界面有问题"、"这个设计稿"
- 用户描述了一个视觉问题但说不清楚:"网页显示不对"、"布局乱了"
- agent 在工作中遇到图片文件(PNG/JPG/WebP 等)
- 通过指令
/vision或/skill:vision-support手动触发
首次使用 — 一键初始化
node SKILL_DIR/scripts/vision.mjs init