角色音色
更新于 2026 年 9 月 21 日

逐角色「设计」一个声音听起来更定制,实际有两个问题:一是每个声音都要占一次上游的音色槽位、成本按角色数线性涨;二是生成出来的音色不可试听、不可预期,改一次就得再花一次钱。
预置库的做法相反:库里的每个音色都预先合成好一段 3 到 8 秒的样本,你在选择器里点开就能听,选定即用。挑错了换一个,零成本。
缺省状态下系统不会自动给全员配音色。这是刻意的:没有配音色时,视频链路会回落到角色的文字音色描述(「低沉、语速偏慢、尾音带一点沙」),由视频模型自己决定声音,通常已经够用,而且不会因为匹配错了反而更糟。
你可以随时给某个角色匹配一个具体音色:在人物库里点「匹配音色」,或在音色选择器里自己挑、边听边选。
三种可以混用:主角用预置音色锁住,配角用文字描述就行。
这一点和传统流程不同:语音不是后期配上去的,是视频模型在生成画面时一起出的。所以台词写在分镜里、音色标记跟着说话人走,出片时它们会被一起送进去。
由此带来两条纪律:非说话人会被标注闭唇,画外音的那几镜画面里的人都闭着嘴 —— 否则你会得到一屋子嘴在动却没声音的人。
匹配不花积分。上传自己的声音是会员功能。声音是视频生成时一起出的,不单独计费。
系统默认不自动配音色,此时视频会按角色的文字音色描述来演。想锁定一个具体声音,在人物库里匹配一个即可。
能。库里每个音色都有一段 3 到 8 秒的预合成样本,选择器里点开就听。
能,上传一段录音即可,这是会员功能。
配了预置音色就不会——音色跟着人物走。只靠文字描述时,不同段之间会有一些差异。
定价·指南·样片·帮助与支持·隐私政策·用户协议·法律信息·联系我们·© 2026 SceneMixer·苏ICP备2026040569号-1