AI漫剧多人混战打斗提示词,如何避免画面杂乱?
学完这篇,你能写出一条主体清楚、动作能看懂的多人群战提示词,不再出现"五个人糊成一团"的画面。
多人混战是 AI 漫剧里最容易翻车的场景。翻车的原因通常不是模型不行,而是你在一个画面里塞了太多"同时在进行的事":五个人各打各的、每人都在挥刀、每人都要露脸。模型只能把它们平均处理,结果就是肢体融合、多手多脚、脸糊成一片。
第一步:先把混战拆成 2–3 个镜头,别让五个人挤在一帧里
这一步做完,你会得到一张分镜表,而不是一句提示词。导演拍群战从不一个镜头拍完,你也不该。把"五人乱战"拆成:镜头 A 两人对刀(近景)、镜头 B 第三人从侧面切入(中景)、镜头 C 三人同框的远景收尾。每个镜头最多 3 个主体,其中只有 1–2 个在做完整动作。剪辑时三镜连起来,观众感受到的才是"混战"。
注意:一帧里超过 3 个人物且都在做动作,任何模型都容易崩。如果剧情必须 5 人同框,就把 2 人处理成剪影或虚化背景。
第二步:用"焦点人物法"写主体,只让 1–2 人做完整动作
这一步决定动作能不能被看懂。提示词里明确写"谁在做什么",其余人用状态词而不是动作词。写成这样:
左侧黑衣剑客挥刀下劈,刀锋停在半空;右侧两名持盾士兵后撤半步,盾牌遮住上半身;背景第三名角色虚化,只露剪影。
注意差别:"后撤半步""遮住上半身"是状态,"挥刀下劈"是动作。动作词只给焦点人物用。
第三步:给每个角色钉死空间坐标
这一步做完,人物不会再叠在一起。用"左/中/右 + 前/中/后景"两级坐标定位每个人物,例如"前景左侧""中景右侧""远景中央"。同时给一个统一的镜头轴线,比如"全体朝画面右方进攻",避免有人朝左有人朝右导致视线打架。
注意:不要写"左边的人打右边的人"这种相对描述,模型的方位感很差。写"画面左侧""画面右侧"。
第四步:收紧镜头语言,用中景和过肩代替大远景
这一步直接决定画面干净程度。大远景会让每个人只有几十像素,模型只能胡乱补细节。改成"中景""过肩镜头""腰部以上",人物占比大,崩坏率立刻下降。运镜只写一个,比如"轻微推镜",别同时写推、摇、环绕。
第五步:套一个固定句式把所有信息串起来
按这个顺序拼:镜头类型 → 焦点人物动作 → 其他人物状态 → 空间坐标 → 环境细节 → 风格 → 参数。完整示例:
中景过肩镜头,画面左侧黑衣剑客挥刀下劈,刀锋停在半空;右侧两名持盾士兵后撤半步;远景中央第三名角色虚化剪影。前景飘落碎木屑。赛璐璐动画风格,粗描边,动感速度线,深色背景,单一光源从左上打来。--ar 16:9 --style raw --s 100
在 Midjourney v7 里,--style raw 加较低的 --s(100 左右)会让模型更听描述、少自作主张。用即梦 AI 网页版,在生成区把"模型"选为图片 3.0、"比例"选 16:9、"精细度"拉到 60 以上。用可灵做视频,选"首尾帧"模式,运动幅度调成"小"。
第六步:负面词和结构控制兜底
负面提示词固定加这一串:多余手臂、多余手指、肢体融合、面部崩坏、人群堆叠、透视错乱、文字、水印。
如果人物还是叠,上 ComfyUI:用 OpenPose 节点摆好 3 个人的骨架并上传,再用 Depth 节点固定前后景层次,权重给 0.7–0.9。这是目前治多人叠人最有效的办法。
注意:出图后别急着重抽,先固定种子(seed),只改一处描述再生成,否则你永远不知道是哪句话起了作用。
小结
- 混战拆成 2–3 个镜头,单帧最多 3 个主体,动作词只给焦点人物。
- 用"画面左/中/右 + 前/中/后景"两级坐标钉死位置,统一朝向轴线。
- 用中景、过肩代替大远景,运镜只写一个。
- 负面词常备"多余手臂、肢体融合、人群堆叠",还乱就上 ControlNet 的 OpenPose + Depth。
- 改提示词时固定种子,一次只改一处。
原文链接:https://www.gj0.com/thread-1322.html
转载请注明出处并保留本声明;内容仅代表作者观点,与本站立场无关。若本文涉嫌侵权,请联系本站处理。