为什么单条神 Prompt 不靠谱
很多人刚开始做 AIGC 短片,习惯憋一条「又长又细」的提示词,指望一次出片。现实是:模型对超长提示词的注意力是衰减的,堆得越多,真正被稳定执行的约束越少。
我在「不可能片场」这条线里的做法是反过来——把一条大需求拆成可验证的硬约束,每条都能在成片里指出来「这里对上了 / 没对上」。下面 5 条是反复踩过后留下的。
约束一:主体一致性优先于一切
人物 / 品牌 / 关键道具的外观,必须在每一镜用同一组描述词锁死。不要在某一镜写「穿红衣的女孩」、下一镜写「少女」——这种同义替换会被模型当成不同主体,导致闪脸。
# 锁定主体的写法(每镜复用同一段)
主体:短发、戴圆框眼镜、穿藏青色工装外套的女性,约 30 岁
把这段当成「主语常量」,拼接在每镜提示词前面,比在正文里重新描述可靠得多。
约束二:运动用「动词 + 幅度 + 方向」三要素
「镜头推近」这种写法太模糊。模型不知道推多近、从哪推。改成:
camera: 缓慢向前推进,幅度约 2 米,从胸肩景别到面部特写
motion: 人物右手抬起,指向画面左上方,速度中等
幅度量化后,出片的可预测性明显提升。
约束三:负向提示词要写「不想要什么」而不是「要什么」
正向提示词管生成,负向提示词管排雷。常见该排的雷:多余肢体、文字水印、风格跳变、画质崩坏。
negative: 多余手指, 变形面部, 突兀文字, 画风突变, 低分辨率
约束四:用种子 / 潜变量保连续
图生视频或多镜续帧时,尽量复用上一段的潜变量或固定种子,让相邻镜头的运动与质感连贯。完全随机初始化,每镜都像换了个剧组。
约束五:分镜脚本先于提示词
最容易被忽略的一条:先写分镜(景别、时长、运镜、主体动作),再为每镜生成提示词。没有分镜的提示词堆砌,出来的一定是「漂亮但讲不清故事」的碎片。
落地小结
这 5 条不是玄学,是可执行清单:锁主体、量化运动、排负向、保连续、先分镜后提示词。每次出片后对照这 5 条复盘哪条没顶住,比盲目加长提示词有用得多。