多人镜头
更新于 2026 年 9 月 21 日

要 B 出现在 A 身后的虚化景深里,A 就得背对着 B。普通中景里这两件事不能同时成立。模型拿到这种自相矛盾的描述,只能自己挑一个——通常是让 A 正对镜头说话、B 站在她背后,于是两个人谁也没在看谁。
所以深度词是机位声明:写了「在背景里 / 景深处 / 身后」,机位就被定下来了。两人面对面同框只有两种可靠写法:侧面双人镜(两人侧对镜头)和过肩镜(越过一人的肩拍另一人)。
每一镜带一份画面内名单,它决定谁拿到脸和参考图。被提到但不在画面里的人写成画面外的说法,不挂脸。
这条规则的取舍是明确的:模型漏报某人在画面里,那个人会从成片里消失;而不是凭空多出一张没有参考图的脸。宁少人不鬼影——多出来的人比少一个人更难补救。
教堂里的三百名宾客、开学日的庭院、竞技场的看台——有没有人是本段的一个可见状态。在段头写一句「背景人群:谁、在哪、在做什么」,同一场景各段保持一致。
没声明就不许在正文写「面朝人群」;对着空处只写方位。否则会出现这一镜满座、下一镜空场。
声明之后,系统会给这个地点配一张「有人版」的参考图(要你点了才出图、按图片计费)。实拍验证过一件事:公共场所有没有人,由剧情先验和段头声明决定——往提示词里加「不允许出现其他人」这类话是压不住的。
四个人以上同框、连续格斗、大规模人群,出问题的概率明显更高。这是当前视频模型的普遍限制,不是某一档的问题。
实用的拆法:把一个六人场面拆成几个两三人的镜头,靠剪辑把人凑齐。一次生成内部的切换是白送的,所以一段里排三个镜头比排一个六人全景稳得多。
侧面双人镜或过肩镜。别写「A 面朝 B、B 在景深处」——那个机位在普通中景里不成立,模型只能自己挑一种解法。
去看那一镜的「画面内」名单。决定谁挂脸的是这份名单,不是正文措辞。
在段头声明「背景人群:…」,同一场景的各段写一致。没声明的段不要在正文写「面朝人群」。
三人以内比较稳。四人以上同框换脸和穿帮概率明显上升,建议拆成几个镜头——一段内部的切换不额外花钱。
不需要。只有会被叫到名字、有接触或交接、跨场景反复出现的才进人物表;其余由背景人群那一句承担。
定价·指南·样片·帮助与支持·隐私政策·用户协议·法律信息·联系我们·© 2026 SceneMixer·苏ICP备2026040569号-1