Install
openclaw skills install @mc0571/image-art-directionopenclaw skills install @mc0571/image-art-direction把图像请求当作一次完整的视觉制作,而不是关键词堆叠。先设计一张具体画面,再把它编译成图像模型容易执行的自然语言规格。
根据请求选择实际需要的工作,不把每次请求都扩张成完整制作流程:
对不会改变主题、身份、叙事含义或主要视觉方向的低风险实现细节,可以结合用途做最小必要推断。未指定的高显著性事实优先保持抽象,不因为“可以设计”就主动具体化。
只有当视觉决策是让画面可执行、满足主要意图、解决可见性或物理关系,或控制高概率生成失败所必需时,才主动补足。不要未经用户暗示新增具体地点、背景事件、人物经历、时代、产品结构、食物种类、建筑风格、品牌或其他会改变画面语义的主题性事实。
未指定的身份属性默认不可推断,包括性别、族裔、年龄细分、身材、固有肤色、发色和具体面部类型;仅在用户语言已经蕴含、参考图明确可见或任务逻辑确实要求时具体化。未指定的高显著性场景类别同样保持抽象,例如不因画面需要背景就自行选择室内或室外、城市或乡村、古典或现代。
能够用中性类别完成画面时优先使用中性类别。未知不等于待填空。只有缺失信息会实质改变主题、身份、硬约束或交付结果,且无法通过低承诺抽象解决时才询问用户。
在内部区分约束,不要求向用户展示标签:
参考图任务同时建立:
不可见、未提供或无法从参考可靠判断的结构,不因为同类对象通常如此而自动升级为 Locked。任务不需要展示未知区域时保持不声明;必须展示且该结构属于高显著性硬信息时,按现有询问规则处理。
Locked 优先锁定主体的固有内容与结构,不自动锁定全部原始成像结果:
只重新设计 Editable;不把“高级化”“写实化”或“提升品质”解释为重新设计主体,也不静默收窄 Editable。用户允许修改某一区域时,不自行给该区域增加新的语义锁定;仅为保持硬约束、几何、接触或透视连续性而限制必要部分。用户允许修改光线时,可以让同一个 Locked 主体接受新的合理照明,但不得借光照改变身份、几何、材质身份、固有颜色、服装结构或姿态。用户参考中的 Locked 优先于自动补全;Logo、包装文字和已知精密产品结构默认不重新设计。
约束看似冲突时,先区分目标与实现手段,并寻找不改变主要意图的唯一合理解。只有存在多个同等合理方案,且选择会实质改变主题、身份、硬约束或交付结果时才询问用户。
只构建会影响当前画面的部分,不把这些维度强制输出成表格:
读取能够解决当前决策缺口的最小 reference 集合。不要仅因主体名称命中而机械加载多个文件;主 skill 足以完成时不读取额外 reference。
把已完成的画面设计翻译成模型容易执行的指令:
image-left、image-right 等观众视角,并保持一致。A 或 B、A/B 或 A or B:高显著性分支选定一个,低显著性且同作用的分支抽象为共同类别。使用具体名词、动作、材料和空间关系;masterpiece、stunning、8K 等标签不能代替可观察的视觉规格。只写有作用且彼此一致的镜头、光线与媒介参数。
原始需求缺少领域规格且主 skill 不足以合理补全时,读取 subject-playbooks.md 中当前主体对应的部分;不要扩展到无关领域。
在最终生成或交付提示词前内部检查,不默认展示:
任一项不成立时先修正规格;只有无法在现有硬约束内解决时才请求用户决定。
默认交付连贯的自然语言视觉规格;用户要求结构化、教学或解释时再展示拆解。只写提示词时直接交付最终 Prompt;生成或编辑图像时以同一规格执行。
仅在当前任务实际生成或编辑图像、且结果可见时使用:
修订指令同时写明“修正什么”和“保持什么”,只处理 Critical 与确实影响目标的 Major,不为 Minor 偏差重新生成整个画面。默认最多进行一次自主定向修订;仍有实质偏差时交付当前最佳结果并说明。