指南 · 提示词
发布于 2026 年 9 月 8 日 · 更新于 2026 年 9 月 12 日

| 段 | 回答的问题 | 短剧示例(竖屏 9:16) |
|---|---|---|
| 1 结果 | 这 30 秒交付什么 | 「一段 30 秒竖屏对手戏:林晚在天台质问周衍,以周衍转身离开收尾。」 |
| 2 参考 | 每个参考负责什么、忽略什么 | 「@图1 只定义林晚的脸、发型与黑色风衣,忽略图中背景;@图2 只定义周衍;@图3 是天台空景,只取环境与光位。」 |
| 3 定时动作 | 谁在第几秒做什么 | 「0–5 秒林晚背对镜头站在护栏前;5–12 秒周衍从画面右侧入画,林晚转身;12–22 秒两人对峙,林晚说完最后一句闭唇;22–30 秒周衍转身离开,林晚留在原地。」 |
| 4 机位 | 一条连续的运镜路径 | 「固定中景起,第 5 秒缓慢推近到两人中近景,第 22 秒后拉回中景;全程不切镜、不重置视角。」 |
| 5 外观 | 光从哪来、材质是什么(写原因不写结果) | 「傍晚,城市天光自画面左侧低角度斜入,护栏金属反光偏冷;不要体积光、不要逆光剪影。」 |
| 6 终态 | 最后几秒画面停在哪 | 「第 30 秒:林晚独自在画面中央偏左,面朝镜头右侧,双手扶栏,画面静止 2 秒。」 |
顺序本身就是信息:结果在最前,模型先知道要去哪;终态在最后,模型知道在哪停。中间三段各自可以单独改而不牵动整条。这套结构与业界流传的 Seedance 2.5 写法一致(TapVid 提示词指南、Morphic 使用指南,访问 2026-09-08),我们按短剧分镜的习惯改了示例。
写时间戳时用绝对秒数(「第 12 秒」)而不是相对描述(「稍后」);同一秒只安排一个变化;台词说完要写「闭唇」,否则口型会一直动到段尾。
Seedance 2.5 最多接 50 个参考,但写法的关键不是数量,是每个参考只承担一种职责,并明说保留什么、忽略什么:
两个参考对同一属性给出不同版本(全身照与脸部照发型不同),生成前先定一个赢家,删掉另一张。参考图本身要中性:白底、方向光、无氛围 —— 参考图里烘进去的光会被每个镜头继承,这是角色一致性方法论反复强调的。
| 翻车 | 典型表现 | 修法 |
|---|---|---|
| 身份漂移 | 第 10 秒之后主角换了一张脸,或服装颜色变了 | 检查参考清单里同一属性有没有两份;删掉冲突项;人物行里写 1–2 个脸部辨识特征(「左眉有疤」「圆脸单眼皮」) |
| 机位自己乱切 | 要求一镜到底,成片却在中途跳了视角 | 只写一条连续的运镜路径,明写「不切镜、不重置视角」;需要切镜就写成带秒数的切点,而不是让模型猜 |
| 终态缺失 | 最后两秒人物还在动,下一段接不上 | 预留 3–5 秒收束,终态写出三个可见地标:谁在画面里、面朝哪、手里拿着什么 |
| 伪造文字与界面 | 画面里的招牌、手机屏幕、价签是乱码 | 需要准确文字的元素用参考图给出或后期叠加,不让模型生成;提示词里不写具体数字与品牌名 |
30 秒不是必须用满。以下任一情况发生,就另起一段:地点换了;主要说话人换了;需要准确的屏幕 / 价签 / 法律文本;一段里超过三个独立的物理动作。混合做法最稳:生成视频负责氛围、运动、过渡与人物瞬间,需要精确信息的画面用素材图叠加。
不需要。它兼容十余种语言,中文提示词可以直接用;对白与画面文字用哪种语言,写清楚即可。SceneMixer 的分镜脚本按项目的输出语言生成。
基本没用,有时还有害。这些是旧一代图像模型的触发词;Seedance 2.5 这类模型吃自然语言,光要写光源位置与方向(「天光自左侧低角度斜入」),质感要写材质与原因,不写结果形容词。
三件事:参考清单里同一属性只留一份;人物行写 1–2 个脸部辨识特征;画面外的人不点名(只写「视线朝画面右」),点名画外对手是最常见的换脸诱因。
按 5 字每秒的口型节奏,30 秒里给台词的时间通常不超过 18–20 秒,也就是 4–6 句短台词;每句说完写「闭唇」,剩下的秒数留给动作与终态。
分镜脚本、参考职责、时间戳与终态都按段自动生成,你只改字。
免费注册 SceneMixer本文写法总结自 Seedance 2.5 公开资料与社区实测,核查日期 2026-09-08;模型更新以官方文档为准。
定价·指南·样片·帮助与支持·隐私政策·用户协议·法律信息·联系我们·© 2026 SceneMixer·苏ICP备2026040569号-1