文字转语音:先选合适的声音
在声音库中挑选音色,输入想听的内容。最好用自己的台词比较声音;普通试听好听,不代表读专业术语或轻声表达时也同样合适。
把文字变成旁白、角色台词或多人对话。Freepik AI 支持选择现成声音、参考录音克隆声音,也可以用描述设计音色,生成后下载音频,用于视频、课程和其他音频项目。
有现成音色、自己的录音,或只有对声音的想法,都有对应的生成方式。
在声音库中挑选音色,输入想听的内容。最好用自己的台词比较声音;普通试听好听,不代表读专业术语或轻声表达时也同样合适。
上传或录制 3–30 秒自己的声音,或已获授权使用的声音,再输入新台词。需要参考某个已录好的声音特征时,选择这种方式。
填写声音描述和要朗读的内容。可以描述音调偏高、音色温暖、语速平稳等特征,不需要先提供录音样本。
把对话分成独立台词行,分别选择说话者的声音。需要让听众区分不同角色时,这比把所有台词交给同一个旁白更合适。
读者可以回看句子,听众却不一定会倒回音频。生成前先理顺说话方式,再调整声音表现。
把主要信息放在前面,长解释拆成短句。例如食谱讲解,先说操作,再说明原因。标点可以帮助划分语意,实际停顿还要生成后试听。
日期、单位和缩写可能有多种读法。想读“三个半小时”,就直接写出来,不必用“3.5h”。人名、专业词也应放进完整短句中试读,确认后再生成后续内容。
多人对话提供角色声音、音频标签、表达稳定性和语言设置,用来调整一段对话怎样被说出来。
先用一问一答确认角色声音,再展开长对话。检查下一句是否回应上一句,同一角色前后的声音分配保持一致。
用音频标签提示轻声说话、惊讶回应等表达方式。标签放在影响语意的位置即可,不必每一句都叠加多个要求。
可以先用“自然”,需要更多表现力时试“创意”,希望表达更稳定时试“稳健”。用同一段短对话比较,才容易听出设置带来的差别。
先准备目标语言的台词,再为每个角色选合适的声音,必要时设置对话语言。试听发音,同时确认不同角色在听感上容易区分。
录音样本用于指导新语音的声音特征。清晰的短录音,比夹杂噪声的素材更有参考价值。
避开背景音乐、其他说话者和明显回声,录音时与麦克风保持稳定距离。可以使用内置录音,也可以上传不超过 10 MB、时长 3–30 秒的样本。
挑一句包含实际词汇的台词,听音色和发音是否符合预期。如果声音不清楚,优先改善录音,不要只靠不断增加文字来解决。
用 Freepik AI 提前听到文案效果,再按内容需要修改和使用。
为食谱、软件操作或组装演示生成解说。按内容分成便于处理的段落,下载后在编辑软件中与操作画面对齐。
例如车站播报员与迷路旅客的对话,或导览员回答参观者的问题。用有区别的声音和清楚的轮次,让没有画面的听众也能跟上内容。
了解音色选择、样本录制和发音调整。
有一段录音、希望参考其中的声音时,用声音克隆;没有录音,只想描述声音特点时,用音色设计,例如为虚构导览员设计明亮、亲切的声音。如果现成音色已经合适,直接使用文字转语音即可。
使用 3–30 秒单人清晰讲话,上传文件不超过 10 MB。样本应是自己的声音或已获授权使用的声音,避免背景音乐和多人同时讲话,并尽量体现你想保留的音色特点。
可以。打开“多人对话”,添加台词并为每个说话者选择声音。保持角色分配一致,在必要的地方添加语气提示。检查时听完整段交流,不只单独听每一句。
支持。选择适合目标语言的声音,并用该语言输入台词;多人对话还提供语言选择。先试听人名、数字和重要词句,口音也会影响同一段文字的听感。
可以按预期发音调整写法,把缩写展开,或把数字写成要读出的文字。放在短句里试听,检查前后语气是否自然。停顿也会随声音和模式变化,因此每次修改后都应再听一遍。
可以。下载音频后,在视频编辑软件中与画面和字幕对齐。需要说话者出镜时,也可以把音轨与肖像上传到 Freepik AI 数字人工具。这样能先确定旁白,再完成视觉部分。
可以。选择可用的声音,用一小段文案免费体验文字转语音。先听它怎样处理你的台词,再继续制作完整旁白。
用 Freepik AI 把文字变成配音,设计新音色,或为角色安排对白。
生成语音