--- name: qwen-image-gen description: 为 Qwen-Image 编写和改写生图提示词,区分局部编辑与参考主体创作,处理同人物系列、画幅及原图验收;用户要求生成时连接其已有的 Qwen 图像工作流。不用于下载权重、通用模型运维或其他图像模型。 --- # Qwen Image Gen 将创作需求转成可执行的提示词、参考图关系和尺寸决策。默认由当前 Agent 改写,无需额外部署提示词增强模型。参考图任务需要视觉理解能力;纯文本执行者应先取得准确的图片描述。 ## 先区分任务 - **提示词、改写、翻译**:交付可复制文本与尺寸建议,不提交生图。 - **文生图**:描述最终可见画面。身份、数量、文字、动作、颜色和位置是固定要求;只补全必要的构图与光照细节。 - **修改这张图**:先说改哪里、改成什么,再简洁锁定未修改内容。改变姿势时不能同时要求姿势不变。 - **参考主体创作新图**:先实际看图,明确哪张图提供身份、服装或背景,再描述新姿势与场景。不要只靠重复人物形容词维持同一张脸。 写提示词前读 [rewriting.md](references/rewriting.md)。保留用户的创作意图,不用通用美化词覆盖具体要求。简单需求不必扩成长文。 ## 把单张、系列和画幅拆开 单张只安排一个明确动作。系列总提示词包含多个动作时,拆为各自完整的单图提示词;同人物系列分别从一张通过验收的身份参考出发,避免逐张把上次生成的误差累积进去。只有用户要拼图时才描述多面板。 画幅是独立参数。明确像素或比例优先;没有指定时,根据构图建议比例并落实到下游接口。不要只在文字里说竖图,却提交方形画布。相同比例可以对应不同像素尺寸。 可供程序衔接的结构: ```json {"rewritten_prompt":"最终画面描述","wh_ratio":"9:16"} ``` ```json {"rewritten_prompt":"具体编辑要求及保留条款","wh_ratio":"","ratio_follow":""} ``` `wh_ratio` 与 `ratio_follow` 互斥。仅将 `rewritten_prompt` 送入模型的文字输入,不把 JSON 包装或解释一并送进去。用户只要提示词时,用普通文本交付即可。 ## 已要求生成时 使用用户指定且已有的 Qwen 入口,沿用当前授权。先读 [integration.md](references/integration.md),核对实际接口:是否支持参考图、多图、显式宽高和原生 Alpha。模型有某能力,不代表当前封装已经接入。 本 Skill 不预置服务器地址或密钥,也不默认下载模型。没有生成连接时仍可交付提示词;不能把“已准备请求”说成“已生成”。 应用需要加载同一份版本化规则时,读 [shared-runtime.md](references/shared-runtime.md)。可选 Node.js 模块只构造规划消息、校验结构和整理质量反馈,不联网、不执行生成;普通 Agent 无需运行它。 附带的 `scripts/prepare_workbench_request.py` 只是一个**可选、离线、特定工作台协议的请求构建器**。它不调用模型、不进行提示词改写、不联网。其 2048 像素和单参考图限制仅适用于该适配器,不是 Qwen 的模型上限。详见 [workbench-adapter.md](references/workbench-adapter.md)。 ## 验收与修正 检查未经修饰的原图:目标文字、动作、肢体连接、身份、保留区域、实际像素尺寸;需要透明时检查 Alpha 和边缘,而非仅看文件扩展名。 为每个结果保留原提示词、实际提交文本、参考图、生成设置及结果位置。质量缺陷与审美不喜欢分开记录:多肢不代表不喜欢坐姿。修正时附上缺陷、目标状态和需要保留的内容;保留原图与新版本,让用户比较验收。没有更多生成授权时停止,不无限重抽。 当用户要 A/B 对照,固定图像模型、尺寸、步数、种子和参考图,只改变待测因素。把采用新画幅的实验单独比较。生成成功、图片更美观、严格完成要求是三个不同判断。 遇到文字泄漏、多宫格、姿势粘连、尺寸异常或透明边缘问题时读 [tested-behavior.md](references/tested-behavior.md)。这些是具体条件下的观察,不能扩展为通用成功率。