--- name: female-outfit-director description: > 为“同一角色多套穿搭拼贴首帧 + 卡点换装短视频”生成联动的图片提示词和视频脚本。 当用户要求真人化角色穿搭拼贴、五套造型、悬浮人物贴纸、汉服/古风/现代时尚换装、点击换装、 卡点变装、根据上传参考图延展视频,或希望先推荐穿搭/换装参数再生成时使用。 支持从参考图提取人物、发型头饰、耳饰、服装和版式;支持部分参数输入与系统补全。 metadata: version: "1.3" language: zh-CN category: image-video-prompt-workflow compatibility: Skills-compatible agents; image understanding is preferred when a reference image is supplied. --- # 女性换装导演 ## 目标 把一次角色穿搭需求转换为彼此联动的: 1. 参数锁定结果 2. 首帧拼贴图提示词 3. 换装视频时间轴脚本 4. 精简视频提示词 5. 负面提示词 / 强制约束 图片是视频的结构母图。视频必须继承图片中的人物身份、服装、四周小人物位置、画面布局和摄影质感。 ## 触发范围 在以下任务中使用: - 同一角色的多套穿搭拼贴图 - 真人化角色 + 多套造型 - 中央大人物 + 四周悬浮人物贴纸 - 把角色穿搭图变成换装视频 - 汉服、古风、国风、现代时尚、虚拟角色的卡点换装 - 点击某个小人物 / 穿搭后完成变装 - 先推荐参数组合,再生成图片和视频提示词 - 上传参考图后沿用人物、服装和布局 - 更换或推荐更有表现力的换装机制 普通单人写真、单套服装展示、纯剧情短片不使用本 Skill,除非用户明确要求多套换装联动。 ## 工作模式 ### 模式 A|直接生成 当用户已有参考图、人物设定或足够服装信息: - 锁定已有参数 - 仅补全低风险缺失项 - 直接输出图片提示词 + 视频脚本 - 不重复询问已知信息 ### 模式 B|参数推荐 当用户说“推荐几组参数”“先给方案”: - 先读 `references/parameter-presets.md` - 输出 4–8 组差异明显的参数组合 - 暂不生成完整图片/视频提示词 - 用户选定后进入模式 A ### 模式 C|参考图提取 当用户上传参考图并要求沿用: - 提取可见人物外貌、族裔外观、年龄感、发型、发色、头饰、耳饰 - 区分中央主造型与四周造型 - 提取人物位置、比例、朝向、背景、光线、描边形式 - 看不清的非核心细节可系统补全 - 不用文字模板覆盖图片中已经明确存在的设定 ### 模式 D|换装机制改造 当用户已有脚本,只想更换变装方式: - 保留人物、服装、镜头、时长、布局 - 只替换换装触发与相应动作 - 先读 `references/transition-library.md` - 用户要多个方案时提供 3–6 个 ## 参数锁定规则 用户明确给出的参数都是“锁定参数”,不得擅自替换、弱化或删除。 ### 角色锚点 - 角色名称 / 基础身份 - 明确成年年龄或视觉年龄 - 国籍 / 族裔外观 - 脸型 - 五官与神情 - 肤色 - 妆容 - 眼睛 - 发型 / 发色 - 头饰 / 耳饰 - 整体气质 ### 国籍与族裔外观 - 有参考图时,严格遵循参考图中可见的族裔外观,不使用默认值覆盖参考人物 - 用户明确指定国籍或族裔外观时,严格使用用户设定 - 没有参考图且用户未指定时,默认生成原创中国成年女性,以自然、真实的东亚面部特征呈现 - 使用默认值时,必须在参数锁定结果、图片提示词和视频提示词中显式写明“中国成年女性”,不得只依赖中文语境 - 除非用户明确要求,不得在无参考图场景中自动生成欧美面孔 - 不使用服饰、妆容或文化符号代替族裔外观,不生成刻板化、夸张化面部特征 ### 造型 - 中央初始主造型 - 造型 1 - 造型 2 - 造型 3 - 造型 4 ### 图片 - 画幅 - 拼贴布局 - 背景 - 光线 - 主色系 - 小人物描边 ### 视频 - 时长 / 比例 - 机位与运镜 - 换装机制 - 动作基调 - 卡点时间 - 声音 - 结尾动作 ## 缺失参数处理 不要要求用户一次填完全部参数。 ### 可自动补全 未明确时可使用,并在结果中标记 `系统补全`: - 默认人物:无参考图且未指定国籍 / 族裔外观时,使用原创中国成年女性,视觉年龄 22–28 岁,自然东亚面部特征 - 图片比例:9:16 - 视频比例:9:16 - 视频时长:8 秒 - 背景:浅灰白无缝影棚 - 光线:柔和漫射棚拍光 - 小人物描边:白色手绘贴纸虚线 - 视频默认固定机位 - 默认无文字、品牌、Logo、水印 - 默认基础点击 / 飞入 / 卡点音效 ### 需要询问的情况 仅在高影响信息完全缺失且无法合理补全时问一个简短问题,例如: - 没有参考图,也没有任何角色设定 - 要求多套服装但既没给服装,也没要求系统推荐 - 用户要求的镜头与换装方式互相冲突且无法兼容 不要为了补齐参数表而逐项追问。 ## 默认五人拼贴版式 除非用户明确指定其它版式: - 中央偏右:大型主体人物,约占画面宽度 60%–65% - 左上:小人物 - 右上:小人物,默认腰部以上紧凑构图 - 左侧中部:小人物 - 左下:小人物 - 右下:留白 硬规则: - 默认正好 5 个人物 - 5 人必须是同一角色 - 中央人物最大 - 四个小人物明显更小 - 小人物是沿真实身体轮廓裁切的完整人物抠像 - 四个小人物各自有独立白色虚线描边 - 中央人物不加虚线 - 禁止第六个人物 - 禁止用矩形缩略图替代人物抠像 用户明确要求 3–6 套造型时可改布局,但必须先在参数结果中说明新的布局逻辑。 ## 首帧图片生成流程 按此顺序写完整版图片提示词: 1. 画幅 + 超写实商业摄影任务 2. 统一人物身份与外貌锚点 3. 人物数量与拼贴布局 4. 中央人物构图、姿态、主造型 5. 四个小人物位置、构图、姿态、各自造型 6. 白色虚线贴纸效果 7. 背景、光线、镜头、皮肤、发丝、服装面料 8. 主色系与画面气质 9. 硬性限制 10. 负面提示词 ### 为视频兼容而优化 - 小人物不要采用极端扭曲姿势 - 头、肩、腰、手臂结构清晰 - 小人物与中央人物的身体拓扑尽量兼容,便于重合换装 - 袖摆、裙摆、披帛尽量完整,不要大幅裁切 - 五个版本的脸、发型、发色、头饰、耳饰统一 - 中央初始姿态要给后续动作留空间 - 背景保持简洁 ## 换装机制选择 若用户指定机制,严格使用。 若未指定: - 拼贴贴纸 + 互动选择:默认“完整人物飞入重合”(M1) - 汉服大袖 / 披帛:优先“长袖/袖摆遮镜”(M2),其次“团扇/折扇遮挡”(M5) - 古风贵女:优先“团扇/折扇遮挡”(M5) - 强拼贴设计:优先“贴纸翻页/人物剪影翻转”(M8) - 强节奏现代穿搭:优先“步伐/跺脚/手势卡点”(M10) - 需要分身概念或衣橱人格表达:可用“分身归位融合”(M9) - 东方幻想 / 神女:可用披帛、花瓣、云纹、水墨 - 高级清冷时尚:可用旋身、镜面 需要详细机制或备选方案时读 `references/transition-library.md`。 ### 默认机制:完整人物飞入重合 1. 指针点击目标小人物 2. 复制出一个相同的完整人物抠像,作为飞入副本 3. 原位置的目标小人物立即移除,不再保留,原位置留空 4. 飞入副本沿斜线飞向中央并迅速放大 5. 白色虚线始终贴合飞入副本的完整人物轮廓 6. 飞入副本与中央人物的头、肩、腰、动作姿态重合 7. 重合瞬间中央人物切换对应服装,飞入副本与虚线同时消失 8. 换装后中央人物继续原动作 必须明确: - 飞入的是复制出的完整人物副本,不是单独衣服 - 不是矩形卡片 - 原位置的目标小人物不保留,飞入开始时立即消失并留空 - 重合后中央只保留一个人物,不产生双影 ## 视频时间轴生成流程 ### 默认时长 默认 8 秒,5 套造型 = 初始造型 + 4 次换装。 默认换装完成点: - 第 1 次:约 1.25 秒 - 第 2 次:约 2.95 秒 - 第 3 次:约 4.40 秒 - 第 4 次:约 6.55 秒 若总时长变化且用户未给卡点: - 按以上时间点相对 8 秒等比例缩放 - 最后一段必须保留最终造型展示时间 若用户给了卡点: - 严格使用 - 不擅自平均化 ### 每段时间轴必须包含 - 时间范围 - 当前造型 - 人物动作 - 眼神 / 表情 - 换装触发 - 换装运动方向 - 换装完成时刻 - 换装后动作如何延续 - 发丝 / 袖摆 / 裙摆 / 流苏物理 - 必要音效 ## 动作连续性 每次换装前后必须维持: - 重心连续 - 旋转方向连续 - 手臂轨迹连续 - 头部朝向连续 - 眼神变化有因果 - 不因换衣重置姿势 使用“人物飞入重合”时: - 飞入人物必须在头、肩、腰、姿势相合后再完成服装替换 ## 衣料物理 汉服、长裙、长袖、披帛、流苏必须: - 有自然重力 - 转身时有轻微惯性延迟 - 停止后逐渐回落 - 换装瞬间不中断物理连续性 - 不僵硬漂浮 - 不穿模 - 不粘连身体 ## 镜头规则 ### 默认固定高机位 适合拼贴式换装: - 摄影机位于人物前上方 - 向下约 30–35° - 近距离高机位俯拍 - 人物自然抬眼 - 头部和上半身更靠近镜头 - 裙摆向画面下方展开 - 全程固定 - 不推拉、不摇镜、不旋转、不变焦 若用户明确要求其它镜头,可用正面固定、轻微低机位、缓慢推近、轻微横移或半环绕。 短时长中不要同时叠加复杂运镜与复杂换装机制。 ## 声音规则 默认无背景音乐,除非用户要求。 按机制加入: - 鼠标点击声 - 飞入 / 滑动短促移动声 - 换装完成卡点声 - 轻微衣料摩擦声 - 古风可加入极轻丝带、扇面、花瓣掠过声 声音只服务换装节点。 ## 强制一致性约束 完整输出中必须明确: - 同一张脸 - 同一成年年龄感 - 同一国籍 / 族裔外观 - 同一肤色 - 同一发型 / 发色 - 同一头饰 / 耳饰 - 同一身材比例 - 只改变穿搭,不重做人物 - 换装前后动作连续 - 已使用的小人物贴图原位置不保留 - 不出现第六人物 - 不出现矩形缩略图 - 不出现双重中央人物 / 残影 - 不服装叠穿 - 不错误肢体 / 多余手指 / 身体融合 - 不头部裁切 - 不背景突变 - 不无故镜头移动 ## 输出协议 默认输出以下内容。 ### 1)参数锁定结果 只列本次真正使用的参数,不机械输出空字段。 格式: ```markdown ## 参数锁定结果 - 角色: - 成年年龄感: - 国籍 / 族裔外观: - 外貌锚点: - 发型 / 头饰 / 耳饰: - 初始主造型: - 造型1: - 造型2: - 造型3: - 造型4: - 拼贴布局: - 图片比例: - 视频比例: - 视频时长: - 镜头: - 动作基调: - 换装机制: - 换装卡点: - 声音: - 系统补全: ```