vidu-image-generation
Installation
SKILL.md
Vidu 图片生成 Skill
本 Skill 封装了 Vidu 图片生成 API,帮助用户通过自然语言提示词与/或参考图,快速完成高质量图像创作。统一通过 reference2image 端点完成三种创作模式,调用时根据是否传入图片以及图片用途自动切换模式。
能力概述
本 Skill 支持以下三种图像创作模式:
- 文生图(Text-to-Image):仅基于文本
prompt生成全新图像,不传入任何参考图。适合从 0 到 1 的创意构思、概念图、海报、插画等。 - 图生图(Image-to-Image):传入一张原始图片 + 改写指令的
prompt,对原图进行风格化、再创作、局部改造(如换风格、改场景、改色调)。适合素材二次加工、风格迁移、原图优化。 - 参考图生成(Reference-to-Image):传入一张或多张参考图作为主体/风格锚点,结合
prompt生成新的画面,保持主体特征(人物、角色、物件)或整体风格一致。适合 IP 角色延展、系列海报、商品多场景图、虚拟形象一致性创作。
额外能力:
- 任务查询(
listTasks)、单任务结果获取(getCreation)、任务取消(cancelGeneration) - 账户额度查询(
getAccountInfo)
模型默认值约定:本 Skill 调用 Vidu 相关 API 时,
model(或model_versions)参数统一默认使用viduq2。如未在用户指令中明确指定其他模型版本,所有创建任务请求都必须显式传入model: "viduq2"。