AI 配音与 TTS — TikTok/Reels UGC 口播 · 无脸短视频旁白
ForgeEcho ElevenLabs TTS 教程:AI 配音用于 TikTok/Reels UGC 口播、无脸短视频旁白与产品讲解,含脚本节奏、音色选择与积分规划。
ForgeEcho AI 语音
AI 语音使用 ElevenLabs Turbo 2.5(通过 Kie.ai)将文字转为语音。适用于广告口播、产品讲解、 onboarding、播客片头与社媒钩子,无需进录音棚。
建议先用 AI 对话 撰写并压缩脚本,再粘贴到 AI 语音 生成。
模型与积分
| 项目 | 说明 |
|---|---|
| 模型 | ElevenLabs Turbo 2.5(elevenlabs/text-to-speech-turbo-2-5) |
| 积分消耗 | 每 500 字符 1 积分,不足 500 字符按 500 字符计算 |
| 单次上限 | 最多 5000 字符 |
| 语速 | 0.7(慢)至 1.2(快),默认 1.0 |
| 输出 | MP3 音频——可在浏览器试听并下载 |
示例:
- 120 字符 → 1 积分
- 501 字符 → 2 积分
- 2400 字符 → 5 积分
工作区会在生成前显示预估积分——批量产出时可据此精简脚本。
工作流程
1. 明确用途
| 场景 | 常见时长 | 约字数(speed 1.0) | 要点 |
|---|---|---|---|
| 信息流广告 | 10–30 秒 | 25–75 字 | 开头钩子 + 清晰 CTA |
| 产品讲解 | 45–90 秒 | 110–220 字 | 一句一个卖点 |
| 播客片头 | 15–45 秒 | 35–110 字 | 品牌名 + 本期承诺 |
| App 引导 | 20–60 秒 | 50–150 字 | 友好、分步骤 |
经验值:约 150 字/分钟(speed 1.0)。15 秒广告大约 35–40 字。
语速与节奏(专业向)
TTS 的「自然感」多半来自句长与停顿,而不是堆形容词:
| 参数 | 建议范围 | 效果 |
|---|---|---|
| speed | 0.95–1.05 | 广告口播略快于讲解 |
| 句长 | 8–14 字/句(中文) | 减少机械连读 |
| 停顿 | 逗号或换行 | 模拟呼吸,比括号旁白可靠 |
带货类脚本可在 AI 对话里要求:按口语断句,每句不超过 12 字,钩子单独成段。生成后用 10 秒样本验证——若第二句抢读第一句的重音,回对话改句式而非盲目调高 speed。
2. 写口播稿(建议用 AI 对话)
- 按口语写——短句、自然停顿。
- 用逗号或换行标记停顿。
- 避免表格、长 URL、难读符号。
- 钩子放在第一句——短视频前 1–2 秒决定是否继续看。
脚本骨架示例:
[钩子] 还在一张张修产品图?
[利益点] ForgeEcho 帮你对话、生图、配音——都在一个工作台。
[CTA] 免费试用。可在 AI 对话中要求:压缩到 35 字,钩子保留,UGC 口语感
3. 在 AI 语音生成
- 打开 AI 语音
- 粘贴或输入脚本(最多 5000 字符)
- 在下拉框选择音色;点击音色旁的 (详细说明) 可跳转到下方完整音色列表
- 按需调整 语速
- 生成并试听;节奏不对就回 AI 对话改稿
4. 导出复用
下载音频用于剪辑或投放;脚本可存为模板做多 SKU / 多语言。
音色目录
ForgeEcho 提供 100+ 种 ElevenLabs 音色——从标准预设到专业旁白、社媒 UGC、角色音与 ASMR/冥想风格。
扩展音色(使用 voice ID)可在浏览器试听示例:
https://static.aiquickdraw.com/elevenlabs/voice/<voice_id>.mp3
标准预设
| 音色名称 | 声音特点 | 试听 |
|---|---|---|
| Rachel | 沉稳、中性女声 | — |
| Aria | 富有表现力、温暖女声 | — |
| Roger | 自信男声 | — |
| Sarah | 柔和、温柔女声 | — |
| Laura | 活泼、热情女声 | — |
| Charlie | 随性、对话感 | — |
| George | 温暖、权威男声 | — |
| Callum | 沙哑、狡黠男声 | — |
| River | 中性、百搭 | — |
| Liam | 活力、社媒创作者风格 | — |
| Charlotte | 清晰、专业女声 | — |
| Alice | 明亮、友好女声 | — |
| Matilda | 温暖、叙事女声 | — |
| Will | 轻松、随和男声 | — |
| Jessica | 俏皮、明亮女声 | — |
| Eric | 低沉、共鸣男声 | — |
| Chris | 迷人、接地气 | — |
| Brian | 低沉、共鸣、令人安心 | — |
| Daniel | 权威、新闻播报风格 | — |
| Lily | 温暖、清晰女声 | — |
| Bill | 成熟、可信男声 | — |
专业商务
旁白与播客
| 音色名称 | 声音特点 | 试听 |
|---|---|---|
| Jane | 专业有声书朗读 | 试听 |
| James | 沙哑、有感染力、大胆 | 试听 |
| Bradford | 富有表现力、口齿清晰 | 试听 |
| Austin | 低沉、沙哑、真实 | 试听 |
| Monika Sogam | 低沉、自然 | 试听 |
| Célian | 纪录片旁白 | 试听 |
| Nathan | 虚拟电台主持 | 试听 |
| Viraj | 浑厚、柔和 | 试听 |
| Charlotte(备选) | 清晰女声旁白 | 试听 |
| Pro Narrator | 说服力强的讲述者 | 试听 |
| Brian(低沉) | 低沉、共鸣、令人安心 | 试听 |
| Jeff | 优雅、共鸣、有力 | 试听 |
| Smith | 醇厚、随性、低音 | 试听 |
| Tom | 对话与书籍朗读 | 试听 |
| Addison 2.0 | 澳式有声书与播客 | 试听 |
| Felix | 温暖、积极、现代 RP | 试听 |
| Johnny Kid | 严肃、平静旁白 | 试听 |
| Hope(诗意) | 诗意、浪漫、迷人 | 试听 |
| Olivia | 流畅、温暖、引人入胜 | 试听 |
| Ana Rita | 流畅、富有表现力、明亮 | 试听 |
| John Doe | 低沉男声 | 试听 |
| Burt Reynolds™ | 低沉、流畅、清晰 | 试听 |
| Hank | 低沉、引人入胜旁白 | 试听 |
| Carter | 浑厚、流畅、沧桑 | 试听 |
| Blondie(电台) | 电台主持 | 试听 |
| Rachel M | 专业英式电台主持 | 试听 |
| David(预告片) | 电影预告片旁白 | 试听 |
| Ed | 深夜播报 | 试听 |
| Paul French | 播客风格 | 试听 |
| Michael | 低沉、暗黑、都市 | 试听 |
| Nathaniel | 引人入胜、英式、平静 | 试听 |
社媒与 UGC
| 音色名称 | 声音特点 | 试听 |
|---|---|---|
| Hope | 明快、清晰 | 试听 |
| Kuon | 开朗、清晰、稳定 | 试听 |
| Blondie | 对话感 | 试听 |
| Mark | 随意、轻松、轻快 | 试听 |
| Adeline | 女性化、对话感 | 试听 |
| Eve | 真实、有活力、愉悦 | 试听 |
| Liam(社媒) | 活力、社媒创作者 | 试听 |
| Chris(迷人) | 迷人、接地气 | 试听 |
| Laura(热情) | 热情、古怪态度 | 试听 |
| Jessica(俏皮) | 俏皮、明亮、温暖 | 试听 |
| Heather Rey | 急促、友好 | 试听 |
| Brittney | 社媒音色——有趣、年轻、信息量大 | 试听 |
| Mark(自然) | 自然对话 | 试听 |
| Matthew | 随意、友好、流畅 | 试听 |
| Hope(活泼) | 活泼、八卦、少女风 | 试听 |
| Jamahal | 年轻、有活力、自然 | 试听 |
| Finn | 年轻、热切、有活力 | 试听 |
| Jessica Anne Bogart | 健谈、友好 | 试听 |
| Lucy | 清新、随性 | 试听 |
| Tiffany | 自然、亲切 | 试听 |
| Emma | 可爱、明快 | 试听 |
| Amelia | 热情、富有表现力 | 试听 |
| Angela | 对话感、友好 | 试听 |
角色与创意
| 音色名称 | 声音特点 | 试听 |
|---|---|---|
| Arabella | 神秘、富有情感 | 试听 |
| Xavier | 强势、金属感播报 | 试听 |
| Grimblewood Thornwhisker | 毒舌地精、魔法维护者 | 试听 |
| Spuds Oxley | 睿智、亲切 | 试听 |
| Northern Terry | 北方口音角色 | 试听 |
| Dr. Von | 古怪、疯狂科学家 | 试听 |
| British Football Announcer | 英式足球解说 | 试听 |
| Brock | 威严、洪亮军士 | 试听 |
| Guadeloupe Merryweather | 情感丰富 | 试听 |
| Horatius | 活力角色音 | 试听 |
| Harry | 凶猛战士 | 试听 |
| Callum(沙哑) | 沙哑、狡黠 | 试听 |
| Malyx | 回声、威胁感、深沉恶魔 | 试听 |
| Flicker | 欢快精灵、甜美闪亮 | 试听 |
| Bob | 粗犷、温暖牛仔 | 试听 |
| Jessica Anne Bogart(反派) | 雄辩反派 | 试听 |
| Lutz | 轻笑、咯咯、开朗 | 试听 |
| Matthew Schmitz(暴君) | 精英、傲慢、狡诈暴君 | 试听 |
| Sarcastic Villain | 讽刺、性感反派 | 试听 |
| Myrrdin | 睿智、魔法叙事者 | 试听 |
| Edward | 响亮、自信、傲慢 | 试听 |
| Marshal | 友好、幽默教授 | 试听 |
| John Morgan | 粗犷、沧桑牛仔 | 试听 |
| Parasyte | 深渊低语 | 试听 |
| Aria(反派) | 性感反派 | 试听 |
| Viking Bjorn | 史诗中世纪掠夺者 | 试听 |
| Pirate Marshal | 海盗角色音 | 试听 |
| David(牛仔) | 粗犷牛仔 | 试听 |
| Wyatt | 睿智乡村牛仔 | 试听 |
| Jerry B. | 南方/牛仔风格 | 试听 |
| Phil | 爆发力强、热情播报 | 试听 |
| Johnny Dynamite | 复古电台 DJ | 试听 |
| Rex Thunder | 低沉、硬朗 | 试听 |
| Jean | 迷人、俏皮蛇蝎美人 | 试听 |
| Britney | 平静、算计型反派 | 试听 |
| Matthew Schmitz(反英雄) | 沙哑低沉反英雄 | 试听 |
| Ian | 怪异、扭曲外星人 | 试听 |
| Sven | 情感丰富、友善 | 试听 |
按场景选音色
| 场景 | 音色方向 |
|---|---|
| UGC / TikTok 带货广告 | 年轻、 casual、略 energetic——避免播音腔 |
| 奢品 / 护肤 | 温暖、 calm、中低音 |
| 科技 / SaaS 讲解 | 清晰中性、语速适中 |
| 大促 | 能量更高、停顿更短(可试 speed 1.05–1.1) |
| 播客片头 | 旁白感、品牌名咬字清楚 |
同一脚本可先试听 2 个音色再批量生成。
脚本技巧
- 边写边读 — 读起来卡壳就改短。
- 一段一个信息点 — 方便分段重生成。
- 品牌名拼写清晰 — 避免 TTS 读错。
- 语气匹配渠道 — 大促要 urgency,奢品要 calm。
- 关注字符数 — 积分按字符计费,可适当精简脚本。
- 少用括号旁白 — 「(笑)」效果不稳定,改成自然口语。
实战案例:无脸带货短视频(3 条/小时)
设定: 同一款产品,3 种人设口播( skeptic / enthusiast / 忙碌宝妈),每条 15–20 秒。
| 阶段 | 操作 | 产出 |
|---|---|---|
| 对话 | 3 套人设 brief + 各 40 字脚本 | 3 脚本 |
| 生图 | 9:16 生活场景静帧 × 3(1K 筛 + 2K 定) | 3 封面 |
| 语音 | 每脚本 15 秒样本 → 选定音色 → 定稿 | 3 MP3 |
| 剪辑 | 字幕 + BGM(外部工具) | 3 条成片 |
脚本结构(可复制到对话):
[钩子 8–12 字] + [单一利益点 15–20 字] + [CTA 8–10 字]
总字数控制在 35–45 字(speed 1.0 约 15–18 秒)音色选择原则: UGC 类避免播音腔;同一 campaign 固定 1–2 个音色,观众更容易建立认知。完整音色列表见上文 <VoiceCatalog />。
常见问题
| 现象 | 处理 |
|---|---|
| 节奏机械 | 缩短句子,增加逗号停顿;试 speed 0.95 |
| 重音不对 | 改句式,把重读词提前 |
| 超长 | 在 AI 对话里压缩钩子或 CTA |
| 专有名词读错 | 谐音拼写或加连字符 |
| 积分偏高 | 长脚本可分段生成,每段单独计费 |
配合 AI 生图做无脸短视频
常见短视频流程:
- AI 对话 — 20 秒脚本 + 3 个封面 prompt 方向
- AI 生图 — 产品静帧或生活场景(9:16)
- AI 语音 — 脚本配音
- 在 CapCut、Premiere 等工具合成并加字幕
规模化见 社媒批量创意工作流。
FAQ
AI 语音使用什么模型?
ElevenLabs Turbo 2.5(Kie.ai),快速自然的文字转语音,音色库丰富。
AI 语音等于视频生成吗?
不是。ForgeEcho 提供文本转语音。画面可用 AI 生图 素材自行合成。
支持多语言吗?
Turbo 2.5 支持通过 ISO 639-1 语言代码强制指定语言;本地化脚本可先在 AI 对话 中撰写。