AI漫剧如何配音?AI配音从拆台词开始 封面图
使用教程

AI漫剧如何配音?AI配音从拆台词开始

约 5 分钟阅读

AI漫剧要配音,先把台词按角色拆开,再到AI音频里选声线一句一句生成。不要整集读一条,也不要一上来就铺背景音乐,否则后面改一句会牵动全轨。

大多数翻车不是因为声音难听,而是脚本没拆干净:三个角色混在一段里,生成出来像同一个人念旁白。把台词拆清楚,配音就成了一半。

先把台词拆成一句一句

漫剧对话密,一段里可能同时出现男主、女主和旁白。不要把整段扔进去生成,那条音轨到最后基本没法用。

  1. 打开脚本文档,把每个角色的台词单独提出来,按行分开。
  2. 每行只放一句,或一个连续反应,不要一段到底。
  3. 给每行标上角色名和情绪,例如「女主·急」「男主·压低声音」。
  4. 背景音、音效提示单独放一类,不要混进台词里。

拆句时尽量短。超过两三行的句子,生成时容易赶、吞字,结尾也会变得奇怪。如果原台词真的很长,先拆成两短句,再分别生成。

情绪标记不用太复杂,有个统一词表就够用。常用情绪可以固定成:平静、急、怒、笑、低声、惊讶、哭、质问。每次都用同一套词,不要昨天写「生气」、今天写「发火」,后面想复刻都找不到参照。

你搜的AI配音,在本站对应的功能叫AI音频。下面开始动手时,直接用它就行。

在AI音频里选声线并试听

打开AI音频,把一句台词放进去试。不要一上来就批量生成,先让每个主要角色各试一句,找到能明显区分开的声线。

角色类型 声线方向 配音注意
年轻女主 清亮或温柔女声 语速可以稍快,句尾不要拖
年轻男主 干脆或低沉青年男声 语速中等,避免太过浑厚
旁白 平稳中性声线 情绪少一点,重点保证咬字

选声线时不要只看名字,要放一句真实台词去试。同一个角色的每一句,后面都必须固定用同一条声线,不要这里换那里换。

多角色搭配时,主角之间至少要有一个明显差异:一个偏亮、一个偏沉,或者一个语速快、一个语速慢。两个温柔女声放在一起,单听都行,合起来观众分不清谁在说话。

试听时别只听到前两秒就切走,要把整句听完,重点看结尾语气和标点停顿。如果试了几条都觉得不对,问题多半在台词断句,不是声线不够多。

声线数量和风格取决于所选模型。有些模型能调语速、情绪,有些不能,先把能固定的项固定下来。

逐段生成配音

不要一次性粘贴整集脚本。分段生成的好处是:哪句不对重做哪句,不用整段返工。

  1. 把某角色的一句台词放进输入区。
  2. 确认当前选的是这个角色固定使用的声线。
  3. 生成后听完整句,不要只看波形。
  4. 不满意就在原句上改:删多余语气词、把长句拆短、或调整标点。
  5. 同一角色继续下一句,保持上面的设置不变。

这一步可以在 AI音频里逐段试,生成一句存一句,不要攒到最后一起处理。生成时如果句子里有括号、表情描述,建议把括号内容改成实际情绪或直接删掉,否则可能被原样读出来。

每存一条,按「角色名_编号_情绪」命名,比如「女主_01_急」「男主_02_低声」。别用「音频1」「新建文件」这种名字,后面找起来会非常痛苦。

让同一个角色听起来是同一个人

单句听没问题,拼起来却像换了人,通常是三个原因:声线没固定、语速不一致、台词格式前后差别太大。

  • 固定声线:每个角色只保留一条可用声线,不要重复创建相近的。
  • 固定语速:如果所选模型支持语速调节,同一个角色所有句子调成同一档。
  • 固定格式:角色名、标点、断句方式保持一致,不要有时写「他说:」有时不写。
  • 已经有人声素材时,可以先上传到AI音频里试听,用来对齐整段配音的听感。音频素材上传后只帮你找参照,别把不同来源的干声混在一起当成品。

音量不一致也会让人觉得换了人。生成多句后,如果有的声音明显大、有的明显小,别急着调,先检查是不是原句情绪标记差异太大。真要统一音量,导出后进剪辑软件做,生成阶段只能尽量保持同一设置。

背景音乐和音效最后再叠

漫剧只有人声会干,但音乐不要一开始就加。否则后面反复调人声时,音乐会一直干扰判断。

  1. 先完成所有角色配音,并逐句确认。
  2. 导出干声,进剪辑软件把配音轨和画面先对齐。
  3. 再把背景音乐、环境音、转场音效铺在单独轨道上。
  4. 人声优先,音乐压低,音效短促,不要和台词抢频率。

AI音频也可以上传背景音乐和音效素材,和已经生成的配音放在一起试听。但最终混音建议留在剪辑软件里做,保留一条干净的人声轨。

上传背景音乐时,选纯音乐比带歌词的更好。带人声的音乐会干扰对白频率,尤其漫剧对话密集时,很容易糊成一片。音效素材宁短勿长,能盖过转场就够。

手机上做要注意什么

手机浏览器打开AI音频,和桌面操作基本一致。但手机生成时更容易被打断。

  • 不要把页面切到后台,容易中断生成。
  • 长文本先在备忘录里拆好,再按句复制过去。
  • 听结果时插耳机,外放容易听不清吞字和尾音。
  • 每生成一句确认保存后再操作下一句,别连着点。
  • 网络不稳时,先关掉其它占用流量的应用,避免生成到一半超时。

如果手机存储空间紧张,导出的干声文件建议随手传云端或电脑,不要全堆在手机里。命名规则和桌面保持一致,后面到剪辑软件里才好对轨。

常见问题

为什么生成出来像念稿?
多半是句子太长、没标点,或情绪备注没删掉。拆短句、加标点,再去掉括号里的动作描述。

为什么两个角色听起来像同一个人?
声线没分开。回到声线选择,换一条差异更大的,别用两个太接近的温柔女声。

为什么单句没问题,拼起来节奏不对?
每句语速不一致,或者生成中间改过台词。统一设置后,只重新导出对应句子,不必全部重来。

音乐盖住人声怎么办?
把音乐音量降到人声以下,再在剪辑软件里手动拉低重点段落。不要指望生成时一次混好。

免费能用到什么程度?
配音和声线选择都可以在AI音频里完成,生成次数和可用时长取决于所选模型。建议先做一集短片段跑通流程,再批量做后面的。

导出的干声要留成什么格式?
能留无损或高质量格式就留,不要为了省空间直接存成低码率。对轨和后续混音时,干声质量直接决定成片质感。格式选项以导出时界面上可选的为准。