
打开一个角色,最下面那个框就是音色描述,在外貌描述下面。口音就写在这里。
声音不是录好再贴上去的。出片时视频模型一边演画面一边把台词说出来,每个说话角色的音色描述就是交给它的这份说明。所以同一段里角色开口的音色和画面里嘴型是对得上的,中间没有一道后期配音的工序——也就没有一道工序会把口音弄丢。台词和声音,和画面一次生成。
口音词不会被过滤、截短或删掉:「柔和、慢一点,轻微的台湾腔」会跟着这个角色说的每一句台词交给模型,每一段都一样;系统也不会问你是不是认真的——想要港台腔就写港台腔,想要四川口音就写四川口音。
音色库这条路帮不上口音的忙。库里只按语言分:普通话、英语、粤语;匹配看的是性别、年龄段和气质。库里有台湾腔、东北口音这类条目吗?没有;你描述里写的口音词也不会参与挑选。要口音,只能走文字描述这条路。角色音色是怎么定的。
两个地方能看出来。第二步的角色卡上,名字旁边出现一个小喇叭图标(它的提示文字是已绑定音色),就是挂了音频;没有图标就是文字描述在管。分镜编辑器的@菜单里有一页音色,列着全部角色:每个角色旁边有一个说话的小图标,没有音频的角色还多一个仅描述的小标签;鼠标停在图标上,提示文字才是已配置音色或者仅音色描述(无音频)。只有图标、没有仅描述标签的是绿灯;有图标带小喇叭、说明音频在演的那个,你写的话不在这一段里。
如果正处在错的那一边,在角色卡上按删除音色:确认框会写明远程文件不会被删,以后可以重新选。它免费,在你生成的下一段生效。你的口音就回到生效的位置上了。
说清楚是哪儿,也说清楚多重。「有口音」不是描述,「一点点台湾腔」才是。下面这些都是在原有描述后面加一句的样子:
| 你写的 | 你要的是什么 |
|---|---|
| 低沉温厚,语速慢,带一点台湾腔 | 普通话说得慢而轻,带台湾那边的味道 |
| 清亮偏脆,尾音上扬,港台腔 | 粤语区那种说普通话的腔调——是腔,不是粤语 |
| 松快口语,带四川口音,随便一点 | 四川话味道的普通话,日常聊天那种 |
| 中气足,语速偏快,东北口音,唠嗑的调子 | 东北人说普通话那股爽利劲儿 |
| 柔和慢一点,上海口音,软糯 | 江南软语那个味道 |
| 字正腔圆,带京腔儿化,稳 | 老北京的腔调 |
| 语速快,尾音上扬,广东人说的普通话 | 广普——广东人普通话说得又轻又快,不是粤语 |
| 慢、稳,北方话里带点西北味 | 西北一带的方言腔 |
三个习惯能让它更好用。
三件事,三个地方。搞混是「口音不生效」最常见的原因。
| 你要的 | 写在哪 |
|---|---|
| 还是普通话,只是说出口带着某个地方的味道——台湾腔、港台腔、东北口音、四川口音、上海口音、京腔儿化、广普 | 角色的音色描述。台词还是普通话,普通话上带那层味道 |
| 台词本身就用那个地方的说法——把那片的词、口语、语气词写进台词 | 台词本身,写在剧本或分镜里。词和口音一起上,那个味道才足 |
| 这个角色说的是粤语 | 本站的项目台词就是中文(第一步没有台词语言这一项),没有拨一下就变粤语的地方。可行的做法是:台词写成粤语(用词、口语词按粤语写),音色描述里写明这是粤语,两边对上 |
| 这一句要生气、要压低、要赶 | 那句台词前面的括注,逐句变化的东西写在那儿,不用重复口音。台词行怎么写 |
要分清的那条线:口音改的是怎么说,说粤语改的是说什么。只在音色描述里写「说粤语」,台词还是普通话,同一句话里就塞了两个打架的要求——这种写法不要用。反过来,台词整句是粤语的,模型就按写下来的样子念,配上音色描述里的粤语,这个角色才真的在讲粤语。
| 你看到的 | 为什么 | 怎么办 |
|---|---|---|
| 保存了,一点变化都没有 | 这个角色挂了音频,演的不是那段文字 | 先看角标;在角色卡上删除音色,再把那一段重新生成 |
| 口音出来了,但太淡 | 程度词含糊,或者地区说得笼统 | 写具体、写轻重(「很明显的四川口音」),再重出那一段 |
| 老几集还是老声音 | 已经出片的段保留出片时的声音,这是它稳定的原因 | 把想听口音的那几段重新生成一次,按正常出片价扣积分。修一条片各要多少积分 |
| 成片后改了台词,那段还是没口音 | 改台词面板是用音色库里的预置音色合成语音,写在描述里的口音演不出来 | 改成把那一段重新生成。给现有的片子换一个角色声音 |
| 声音对了,但每段听着不太一样 | 文字描述这套本来就是每段重新演,代价是一点一致性 | 接受;或者给这个角色换成预置音色,代价是这个角色的口音也一起没有了 |
| 某句台词是个路人说的,声音怪 | 不在角色表里的说话人身上没有角色的音色描述 | 给这个说话人单独建一张角色卡,口音写在卡上 |
有一件事先想清楚:挂音频和写口音是二选一,不是一起用。挂了音频,描述(包括口音)就不再参与;会员要用一段自己的声音,是拿它换掉文字描述这条路。角色音色是怎么定的。
会。这段音色描述跟着这个角色说的每一句台词一起进到出片里,模型边演画面边把话说了,中间没有一道后期配音把它弄丢。唯一没有档位的是「几成」——听着淡,就把程度词写明确,把那一段重新生成一次。
基本都是这个角色挂了音频:匹配了预置音色,或者上传了自己的录音。这时演的不是那段文字。在角色卡上用「删除音色」退回只用文字描述,再把那一段重新生成一次。
能,之后生成的每一段都会用上新的描述。已经出过片的段保留出片时的那个声音;想在那几段里听到口音,就把它们重新生成一次,按正常出片价扣积分。
不能。那个面板是用音色库里的预置音色合成语音,写在角色描述里的口音演不出来。口音只能靠把那一段重新生成一次带进来。
没有。库只按语言分:普通话、英语、粤语;匹配看的是性别、年龄段和气质,不看你描述里写的口音词。地区口音只能靠文字描述这一条路。
不是一回事,本站也没有单独切换台词语言的地方,项目台词就是中文,所以「带口音」就是把口音写在音色描述里。「说粤语」是另一种语言:把台词本身写成粤语(用词、口语词都按粤语写),再在音色描述里写明这是粤语,两边对上;只在描述里写「说粤语」而台词还是普通话,等于给同一句话两个打架的要求。
不用。口音属于角色,在音色描述里写一次,这个角色说的每一句都算。逐句变化的是情绪和语气,写在那句台词前面的括注里。
都能。每个角色各自一段音色描述,互不干扰;只出声不出画的角色(旁白、电话那头、广播)也有音色描述,口音照样能用。
更新于 2026 年 10 月 10 日
定价·指南·样片·帮助与支持·隐私政策·用户协议·法律信息·联系我们·© 2026 SceneMixer·苏ICP备2026040569号-1