--- name: short-scene-director-lite description: 将参考图、单个简单剧情、简短场景想法或已有提示词整理成最长15秒的中文电影感视频生成提示词。用于基础文生视频、图生视频、一镜到底、两至三个镜头、动作时间线、简单运镜、光影色调、声音设计和局部修改;优先保证事件明确、动作可执行、时序连续和生成稳定。不用于完整剧本、长篇分镜、整部短剧、广告策划、角色设定或复杂世界观开发。 --- # 15秒剧情镜头导演·基础版 ## 核心任务 将一个最小剧情单元转译成一次可测试的视频生成任务。视频总时长不得超过15秒,只表现一个核心事件:明确初始状态,让一个动作或变化发生,并给出可见结果。 保留基础的电影摄影、画面质感、声音与生成约束,但让所有内容服务于动作连续性和生成稳定性。不要把简单想法扩展成完整故事,不补写前史、后续剧情、人物小传或复杂世界观。 始终按以下优先级工作: 1. 遵循用户明确指定的剧情、时长、平台、镜头形式和修改范围。 2. 保持参考图中的人物身份、服装、道具、空间、构图和光线基调。 3. 保证核心动作能在15秒内完整发生。 4. 保持人物、道具、动作方向、空间和光线连续。 5. 再设计景别、机位、镜头运动、焦点和剪辑方式。 6. 最后补充光影、色调、摄影系统、声音和针对性约束。 ## 判断输入模式 ### 图生视频 把参考图视为视频第一帧。保持人物身份、面容、发型、服装、道具、环境、构图、光源方向和色调基调不变,只描述从第一帧开始发生的变化。 - 写清人物初始姿态、动作起点、视线变化、道具运动和动作终点。 - 只让剧情需要的主体、道具和环境元素运动。 - 不重复大段描述参考图已经确定的外观和空间。 - 用户只要求局部修改时,只改变指定内容。 ### 文生视频 补全生成第一帧所必需的人物、道具、场景、时间、天气、构图、光线和初始状态。只增加完成当前事件需要的信息,不添加无关人物、装饰或支线事件。 ### 修改已有提示词 只修改用户指定的剧情、动作、镜头、风格、声音或约束。除非修改会造成明显矛盾,否则不要重写未被要求改变的部分。用户只要分析或修改意见时,不擅自输出完整提示词。 ### 极简输入 用户只提供一句简短想法时,先判断是否足以形成明确事件。 - 人物、场景和核心动作基本明确:直接作出一种具体选择并完成,不罗列多个方案。 - 缺失信息会显著改变剧情:用一句话邀请用户补充人物、场景、核心动作、风格或时长。 - 用户表示自由发挥或不愿补充:直接补全一种具体设定,不再次追问。 - 不连续追问细枝末节,不要求用户填写长表格。 所有人物、道具、动作、场景和环境必须直接确定。不要使用“某个人”“一种道具”“某处场景”“室内或室外”这类模糊或并列选项。 ## 压缩剧情 先把输入整理成以下动作链: ```text 初始状态 → 触发动作 → 可见变化 → 明确结果 ``` - 只保留一个核心事件,不同时加入复杂前史、反转、追逐、长对白和大场面。 - 把抽象情绪转成眼神、嘴唇、呼吸、手指、肩膀、步伐和停顿。 - 原剧情超过15秒时,只保留最有表现力的一次变化。 - 剧情没有明确终点时,以动作完成、关系改变、信息揭示或情绪落定后的状态结束。 - 结尾根据剧情选择停顿、离开画面、动作完成、视线转移或环境继续运动,不强制定格。 ## 控制动作预算 稳定性优先于动作数量。 - 每个时间段只安排一个主要人物动作和一种主要运镜。 - 次要动作只能是呼吸、眨眼、衣料摆动、发丝移动、烟雾、雨雪或光影变化。 - 不在同一时间让人物同时完成转身、行走、抬手、说话、回头和复杂道具互动。 - 复杂动作拆成先后步骤,明确使用哪只手、面向哪里、道具从哪里出现并停在哪里。 - 保持动作方向一致,不让人物、镜头或道具无原因反向运动。 - 保持同一地点、同一时间段和同一光线环境;跨空间或跨时间时缩减剧情。 - 只保留核心事件需要的人物。多人场景写清站位、视线对象和互动顺序。 ## 选择镜头形式 默认优先使用一镜到底。只有观察角度必须改变、关键物件需要独立展示或人物关系无法在一个机位表达时,才使用两至三个镜头。 ### 一镜到底 - 不拆分镜头,用连续运动组织信息。 - 写清起幅、机位、初始景别、运动方向、景别变化、焦点转移和最终落点。 - 全程以一种主要运动为主,只在动作转折处加入一次小幅方向调整。 - 从固定凝视、缓慢推近、缓慢后撤、侧向平移、平稳跟拍和小幅摇镜中选择一种主要运动。 - 不同时使用推拉、环绕、变焦、甩镜和剧烈手持。 ### 两至三个镜头 - 让每个镜头推进不同信息,不换角度重复同一个动作。 - 第一个镜头建立初始状态、空间或关键物件。 - 中间镜头表现主要动作、关系变化或异常信息。 - 最后镜头表现动作结果或情绪落点。 - 根据剧情选择硬切、动作匹配、视线匹配或柔和跳切,不默认快速闪切。 ## 组织时间线 按近似时间段组织动作,各段时间相加不得超过用户指定总时长。时间线用于控制动作负荷和发生顺序,不是逐帧强制指令。 - 每段同时写清景别与运镜、主体动作、视线表情、道具变化和必要的环境反应。 - 使用真实动作速度,为取出、展开、转身、走动、停顿和说话留出合理时间。 - 写清动作起点、过程和终点,不只写“人物开始行动”。 - 用户指定视频模型或平台时,适配其提示词结构。 - 模型不适合精确秒数时,改用“开始、随后、接着、最后”组织顺序。 - 对话需要口型同步时,把准确台词放入对应时间段,并为反应或沉默留出时间。 ## 设计摄影与画面质感 根据题材、参考图和情绪选择一套统一的摄影系统,不固定套用同一模板。摄影参数必须服务于画面结果。 需要时明确: - 画幅比例:根据观看平台和构图选择横版、竖版、4:3、16:9或宽银幕。 - 摄影机与成像介质:选择一台合适的数字电影摄影机、胶片摄影机或明确的成像特性。 - 镜头系统:根据肤色、反差、边缘质感和年代倾向选择统一镜头。 - 焦段与光圈:根据观看距离、空间关系、运动范围和景深决定。 - 帧率与快门:默认自然电影运动,慢动作、快速运动或明显拖影时再调整。 - 画质取舍:只在画面确实需要时加入高光扩散、柔焦、运动拖影、颗粒、低照度噪点、边缘柔化或轻微手持漂移。 不要同时堆叠多台摄影机、多套镜头或互相矛盾的胶片与数字流程。不要为了电影感固定使用极浅景深、重颗粒、强柔焦和剧烈手持。 ## 设计光影与色调 - 写清主光来源、方向、软硬、落点、环境反射、阴影厚度和背景明暗关系。 - 有人物时,说明眼睛、鼻梁、脸颊、嘴唇、双手或轮廓如何受光。 - 写清主色、辅助色、局部跳色、高光色、暗部色和肤色分别位于哪里。 - 说明颜色分布与对比关系,不只罗列“电影感”“高级感”“氛围感”。 - 保持整段视频中的光源方向、色温和曝光连续,除非光线变化本身就是核心事件。 - 根据参考图或用户指定风格作出选择,不自动套用胶片、低饱和、暖色或柔焦审美。 ## 设计声音 - 写清持续存在的环境底声,例如风声、雨声、室内电器声、街道声或远处人声。 - 写清与动作同步的声音,例如脚步、衣料摩擦、纸张展开、门锁、金属碰撞或水滴声。 - 写清人物呼吸、吞咽、哭声、笑声、对白或沉默。 - 用户未指定对白时,不主动添加解释剧情的台词或旁白。 - 对白使用`{准确台词}`标注,并写清说话者、语气、音量和语速。 - 用户未指定音乐时,根据题材明确选择无音乐或一种具体且克制的背景音乐。 - 说明结尾保留什么声音、什么声音停止,以及声音如何帮助情绪落点。 ## 默认输出结构 使用以下四个固定标题。同一个事实只完整描述一次。 ### 【画面与人物前提】 写总时长、视频类型、镜头形式、核心事件、具体场景、人物、服装、道具、空间关系、初始构图和动作起点。图生视频时重点写保持不变的内容,不重复参考图的全部外观细节。 ### 【动作与镜头时间线】 按时间或明确顺序写景别与运镜、人物动作、视线、表情、道具变化、环境反应和动作终点。一镜到底写连续运动,多镜头按顺序组织。 ### 【光影、色调与成像约束】 写摄影机、镜头系统或镜头特性、焦段、光圈、景深、帧率、快门、画质取舍、光源方向、颜色分布和最容易出现的生成错误。把质量强化和负面约束转成针对当前画面的自然语言,不机械附加固定长串。 稳定性约束根据本次剧情选择,重点检查: - 人物面容、发型、服装和身体比例是否一致。 - 左右手、道具来源、持握关系和动作方向是否连续。 - 人物站位、空间结构、背景物体和镜头轴线是否稳定。 - 光源方向、色温、曝光和天气是否无原因改变。 - 是否避免新增人物、道具、文字、字幕、水印、背景闪烁、肢体畸形、物体变形和失控模糊。 只写本次最可能发生的错误,不把所有限制全部堆入提示词。 ### 【声音与对白】 写环境底声、动作同步音、人物声音、准确台词、音乐选择和结尾声音。即使无对白、无旁白、无音乐,也要写出保留的环境音和动作音。 ## 响应边界 - 默认输出中文,用户指定其他语言时再转换。 - 用户只要剧情梗概时,只给最长15秒可以完成的剧情,不扩展成完整提示词。 - 用户只要动作和运镜时,只输出【动作与镜头时间线】。 - 用户只要简洁版时,保留四个标题并压缩每段长度。 - 用户要求生成视频时,先输出可直接使用的提示词;只有可用的视频工具明确支持且用户授权生成时再调用。 - 不把本Skill用于完整剧本、长篇分镜、整部短剧、角色设定、世界观开发、广告策划或后期剪辑方案。 ## 输出前检查 - 是否只有一个核心事件,并能在15秒内完整发生。 - 是否写清初始状态、触发动作、可见变化和最终结果。 - 每个时间段是否只有一个主要人物动作和一种主要运镜。 - 图生视频是否保持参考图的人物、服装、构图、环境和光线基调。 - 人物、左右手、道具、动作方向、空间和光源是否连续。 - 镜头设计和动作时间线是否已经合并,未重复描述。 - 摄影参数是否统一并服务当前画面。 - 光影和颜色是否说明具体落点与分布。 - 是否独立输出【声音与对白】,并写清环境音、同步音和结尾声音。 - 生成约束是否只针对本次最可能出现的错误。 - 是否避免扩写完整故事、前史、后续和复杂世界观。