AI 音频与视频术语表
本术语表用通俗易懂的语言解释 AI 音频和视频创作中的关键术语,从文字转语音、声音克隆,到 AI 译制配音、语音转文字和免版税音乐。每个词条都包含简短的定义、技术原理、用途和局限,并附有链接,可在 wawie 上试用对应的工具,免费开始。
免费创建账户 赠送 5,000 免费积分,无需信用卡。
浏览所有术语
- 文字转语音(TTS): 文字转语音把书面文字转换成听起来自然的语音,用于配音、旁白、无障碍访问和语音助手。
- 声音克隆: 声音克隆根据录音构建某个特定人物声音的合成副本,从而可以用这个声音生成新的语音。
- AI 译制配音: AI 译制配音会把视频中的语音翻译成另一种语言并重新配音,与原片时间轴对齐,还可以选择使用原声。
- 变声器: 变声器会改变声音听起来的样子,从简单的音高效果,到用另一个逼真声音重新演绎录音的 AI。
- 人声分离: 人声分离会把人声从背景噪声、音乐和房间回声中分离出来,留下可以发布、转写或译制配音的干净语音。
- 语音转文字(STT): 语音转文字把语音转换成书面文字,支撑着转写稿、自动字幕、语音输入和语音助手。
- AI 音乐生成: AI 音乐生成利用机器学习创作和制作原创音乐,通常只需一段描述风格和情绪的简短文字。
- 音效生成: 音效生成利用 AI 根据文字描述创建音效和环境声,而不必录制或在素材库中搜索。
- 配音(旁白): 配音是单独录制、叠加在视频、电影、广告或演示上播放的旁白,说话者通常不出现在画面中。
- 免版税音乐: 免版税音乐经过授权,你每次使用时都无需支付版税,但它不一定是免费的。
免费创建账户 赠送 5,000 免费积分,无需信用卡。