先写画面里最重要的对象
第一句优先说明主体是谁或是什么,以及它位于什么基本环境中。人物类描述可以包含大致年龄范围、服装、发型和当前状态;产品类描述则更适合强调形状、材质、颜色和摆放位置。主体信息应保持稳定,不需要每句话都重新换一种说法。
如果画面中有多个角色,最好明确谁是当前镜头中心,以及其他人物与他的空间关系。这样能减少系统把不同角色的动作、服装或位置混在一起。
提示不是文学比赛。真正有用的描述,会让主体、动作、镜头和环境各自承担明确职责。
第一句优先说明主体是谁或是什么,以及它位于什么基本环境中。人物类描述可以包含大致年龄范围、服装、发型和当前状态;产品类描述则更适合强调形状、材质、颜色和摆放位置。主体信息应保持稳定,不需要每句话都重新换一种说法。
如果画面中有多个角色,最好明确谁是当前镜头中心,以及其他人物与他的空间关系。这样能减少系统把不同角色的动作、服装或位置混在一起。
比起“很焦虑”“很自由”“充满希望”这类抽象词,抬头、停顿、快步走、把纸张放到桌上、转身看向门口更容易形成稳定画面。情绪可以保留,但最好与可见动作一起出现,让镜头知道具体需要呈现什么。
复杂动作可以拆成几个连续镜头,而不是要求同一个短镜头同时完成起身、跑动、拿物品、转身和切换场景。

固定机位适合观察动作和对白;缓慢推进可以增强注意力;轻微跟随更适合人物移动;较大的横移或环绕容易同时改变构图、背景和人物关系,因此更适合在主体稳定后再加入。不要为了显得专业而堆叠大量摄影术语。
先写地点性质,再写影响画面的少量关键元素,例如窗边自然光、狭窄走廊、夜晚街灯或干净桌面。大量无关摆设会分散主题。需要景深时,可以说明前景、中景和背景分别有什么,而不是只写“电影感”。
清晨柔光、午后侧光、阴天漫射光或夜间局部照明都会影响人物状态和空间感觉。先考虑故事为什么需要这个时段,再决定光线,而不是每条提示都默认追求强烈效果。
第一次生成后,如果人物正确但动作不自然,只修改动作;如果动作正确但构图太远,只修改景别或机位。每轮只改变一到两个关键变量,可以更清楚地知道哪种描述真正影响了结果。反过来,如果每次同时改人物、地点、动作、镜头、光线和风格,就很难判断前后差异来自哪里。
建议保留有效描述的核心部分,再针对错误点做局部调整。跨镜头创作时,可以把人物稳定描述单独保存,把每个镜头变化写在另一部分,以减少重复改写造成的人物漂移。
提示中如果涉及现实人物、地点或事件,仍应以可靠信息为基础。AI画面能够制造非常逼真的视觉效果,因此公开传播前要特别留意是否可能让观众把虚构画面误认为真实记录。涉及新闻、事故、公众人物或敏感现实事件时,应使用更清楚的内容说明和更严格的事实核对。
下一步:画面唤醒