角色音色是怎么定的

一句话: 每个角色从剧本解析出来时都自带一段文字写的音色——年龄感、厚度、语速、落在什么位置。默认情况下,视频模型演的就是这段描述,效果通常够用。如果你要一个具体、可复现的声音,就把角色匹配到内置音色库里的一个:每一个都能先试听,挂上之后,这个角色说话的每一镜都会带上这段音频参考。
SceneMixer 生成的 AI 短剧《问剑青云》成片画面(6 个角色、1 集)
样片《问剑青云》:3D CG动画仙侠玄幻 · 1 集,由 SceneMixer 流水线从剧本直接生成 · 看整集

任何项目的角色面板里都能看到音色描述。打开一个示例,点开角色,音色那一行就在外貌描述下面。

模式一——用文字写的音色(默认)

剧本解析会给每个角色一段简短的音色描述,和给外貌描述是一个做法。这一行会流进视频提示词,由模型去演。不挂任何样本文件,也不提前生成任何东西。

它之所以是默认,是因为免费、即时,而且对大多数角色够用。代价是一致性:同一个角色的两镜可能有轻微差别。

一段分镜:地点 / 时间 / 天气字段,然后是带秒数、资产药丸和台词的逐镜正文
每一句台词都带着说话人和一个音色标记。

模式二——匹配一个能试听的预置音色

打开角色,点匹配音色。一次很小的免费判断会读那段描述,从内置库里挑一个,优先挑说对语言的。你会拿到一段可以播放的样本,觉得不对就在选择器里换一个。

挂上之后,这段样本会成为该角色说话的每一镜的音频参考——这就是声音能在一整集里保持住的原因。

音色库是一组固定的系统音色,每一个都有预先合成好的样本,所以匹配免费、反悔也免费。

模式三——上传你自己的

可以上传一段音频当作这个角色的声音。它会被裁成一小段参考,用法与匹配来的预置音色相同。上传的音色是个持久选择:之后的匹配不会把它覆盖掉。上传文件是会员功能——前面两种模式所有人都免费。

只上传你有权使用的声音。真人的录音属于那个人,未经许可使用不是平台会协助的事。

音色管什么、不管什么

音色管的是音质和演法。它不决定说什么——台词来自分镜,会被逐字念出来。它也不会带到旁白上:标了画外音或旁白的台词按画外声音处理,画面里的人全程闭着嘴。

如果某一镜没有台词,就完全不用音色——你听到的是那一镜写好的环境音。

改主意

重新匹配、换一个预置、清回文字描述,全都免费,并且在你生成的下一镜生效。已经出过片的段保留出片时用的那个声音;想让它跟上新的,把那一段重新生成一次。

模式花费一致性
文字描述免费、自动够用,逐镜有轻微差别
匹配预置音色匹配和更换都免费在一整集里保持住
自己上传会员功能保持住;重新匹配不会覆盖

常见问题

出视频之前必须先定音色吗?

不必。没挂音色时直接演那段文字描述,这是所有项目的默认。

能先听听再决定吗?

可以——库里每个音色在选择器里都有一段能播放的样本。

匹配音色要花积分吗?

不花。匹配这一步是免费的,反悔也免费。

旁白和内心独白会用这个音色吗?

这类台词按画外声音处理:听得到,但画面上的人不动嘴。

能克隆某个具体的人的声音吗?

会员可以上传自己有权使用的音频。我们不提供对指定真人的声音克隆,未经许可上传别人的声音也是不允许的。

听听差别

打开一个角色,匹配一个音色,出片之前先把样本播一遍。

打开编辑器

更新于 2026 年 9 月 21 日

定价·指南·样片·帮助与支持·隐私政策·用户协议·法律信息·联系我们·© 2026 SceneMixer·苏ICP备2026040569号-1