先排顺序
按照“建立环境—进入人物—发生动作—给出反应—完成结果”的逻辑排出镜头,不急着写风格词。
先决定镜头为什么存在,再决定它长什么样。分镜越清楚,后续提示词与画面迭代越容易保持一致。

分镜最容易出现的问题,是一个镜头同时要求人物介绍、环境展示、动作变化、情绪特写和复杂运镜。生成时条件越多,越容易互相冲突。更稳定的方法是给每个镜头一个主要目标,再用相邻镜头补充信息。
按照“建立环境—进入人物—发生动作—给出反应—完成结果”的逻辑排出镜头,不急着写风格词。
远景负责空间,中景负责动作关系,近景和特写负责细节与情绪。景别变化应服务叙事,而不是为了炫技。
推、拉、摇、跟随或静止都需要理由。没有必要时保持镜头稳定,反而能让生成结果更容易控制。
如果连续三个镜头发生在同一地点,应重复保留关键环境特征,例如光线方向、主要家具、背景颜色和人物站位关系。连续镜头的描述不要完全重写,否则模型可能把同一空间理解成新的地点。