复刻:台词和配乐是怎么从原片里读出来的、最后进到你这一集的是什么

一句话: 原片的每一镜听两遍:先由专门的语音识别回答「有没有人在说、说了什么」,再由描述这一镜的模型拿着识别出的字来写。台词因此是引用、不是按口型猜,没人说话的镜写成无对白。原片有配乐,读片记下它的性质,你生成的每一段带同一句简短的配乐要求,和广告一样。台词一律中文:原片说别的语言就译过来。识别不出的台词就是缺了;对照原片,等分镜生成后在编辑器里补到那一镜。
SceneMixer 生成的 AI 短剧《班师》成片画面(6 个角色、1 集)
样片《班师》:真人写实高清画质 · 1 集,由 SceneMixer 流水线从剧本直接生成 · 看整集

读完后在第三步打开这一集看梗概:每个场景块以「说话人:台词」列出台词。

台词怎么听

语音识别在每一镜自己的音频上跑。听到的字交给镜头描述当「这里说了这些话」;描述者再按脸认说话人、把台词写进那一镜。配乐下面的说话能处理;人群里喊、重口音、很轻的话是它失手的地方,这些宁可空着也不编。台词随后像剧本一样出现在梗概里:剧本里台词怎么写。

一段分镜:地点 / 时间 / 天气字段,然后是带秒数、资产药丸和台词的逐镜正文
每一镜都听一遍;听到的原话引进读取,最后成为梗概里的台词。

为什么引用不猜

放任一个视觉模型回答「这里说了什么」,同一镜它有时听到有时听不到,不确定时还会编合理的台词。把识别出的字钉进描述两样都止住;这一镜每次描述用的都是同样的话。

配乐

读片问一次原片有没有音乐、什么样的。有的话,你生成的每一段带一句和它相配的配乐要求,生成的段就有同一性质的音乐;原片的音轨本身从不使用。环境声记下但不带。音乐从哪来。

台词语言

大陆站的复刻台词一律中文。听到的别的语言译成中文;梗概、设定图、分镜都用中文写。第一步没有台词语言的选项。读完之后。

漏了或听错了

梗概本身不能编辑,分镜会逐字照抄它的台词。先生成分镜,再打开台词该在的那一段,把台词连同说话人补上或改正;说话人认错了也这样改。编辑免费。生成分镜。

原片里读片里你的这一集里
一句清楚的台词引用,标说话人梗概里的一句台词
没人说话镜头标无对白没有台词
说不清的话空着在那一段里手动补
配乐记下性质每段同一性质的音乐
环境声记下不带;分镜自己写

常见问题

为什么少了一句?

识别不出来。对照原片,分镜出来后在那一段里补。

原片的声音会用吗?

不会。声音来自角色的音色设置,和任何项目一样。

原片说的不是中文怎么办?

读片时台词译成中文。

原片的音乐会复用吗?

不会。描述它的性质,各段自己生成。

人群的喊声为什么没有台词?

群体噪声当背景声,不当台词。

听到、引用、写下

原片里说的,就是你这一集说的。

开始复刻

更新于 2026 年 9 月 27 日

定价·指南·样片·帮助与支持·隐私政策·用户协议·法律信息·联系我们·© 2026 SceneMixer·苏ICP备2026040569号-1