arkcli-deploy
arkcli +deploy
CRITICAL — 路由例外必须先于任何命令:用户明确要求脚本化 / CI / 无护栏 / 原始 raw CRUD 创建 Endpoint 时,立即读取 ../arkcli-infer-endpoint/SKILL.md 并由它接管;在完成交接前禁止认证检查、模型查询或其他命令。
前置: 先用 Read 读 ../arkcli-shared/SKILL.md 获取共享认证/配置/写操作守卫规则。
创建意图中的模型澄清
只要用户的最终目标仍是“创建 / 新建 / 部署 Endpoint”,即使尚未给出完整模型 ID,也必须留在 arkcli-deploy 工作流;arkcli-models 此时只是临时调用的只读候选查询能力,不能把创建任务改路由成纯模型发现。
候选必须来自本轮 ArkCLI 的实时结构化输出,禁止从模型记忆、示例或旧版本号补全。
查询预算是当前用户回合恰好一次 Bash 调用。 在执行前一次性确定 keyword、过滤条件和 --size。models search 的 keyword 是单个 catalog 子串,不要把多个概念拼成带空格的短语:先选最能缩小范围的一个 ASCII token,其余条件放到同一次调用的 flags 或 jq 本地过滤。例如“豆包代码模型”用 keyword code,再在同一管道按 name 的 doubao|seed 过滤;“生图”用 seedream。不确定稳定 token 时宁可省略 keyword 并使用已有结构化 filter,禁止把未翻译的中文短语直接提交后再换词重试。若担心输出过长,把字段投影直接放进同一条管道,例如
arkcli models search "<keyword>" --size 0 --format json | jq -c '{items: [(.items // [])[] | {name, primary_version, lifecycle_status, input_modalities, output_modalities}]}'。
这次调用无论成功、空结果、截断还是失败,都不得换关键词、调大分页、重跑同一命令或为了重新格式化再调用一次 ArkCLI;只能使用已捕获的 stdout,信息不足就如实停止。