DORODORA TTS Playground介绍:在浏览器中直接体验 AI 语音合成
DORODORA TTS Playground 是一款免费工具,可在浏览器中用本地 TTS 模型将文本转换为语音并保存为 WAV 文件。一起了解 SuperTonic、Pocket、Kokoro、Kitten 模型和自定义声音功能。
用 AI 声音朗读打赏留言,如今已经成为直播内容中难以缺少的元素。当观众的留言以语音形式播出时,直播的氛围会随之改变,主播和观众之间也产生了新的互动方式。
DORODORA 在打赏页面之外还提供 AI TTS 和 Voice Cloning TTS。不过,在把某个声音真正应用到直播之前,往往想先听听它的效果。因此 DORODORA 运营了 TTS Playground,无需安装或登录,就能直接在浏览器里体验 TTS。
本文将整理 dorodora.com/playground 上 TTS Playground 的功能与使用方法,以及它与 DORODORA 打赏服务之间的联系。
TTS Playground 是什么?
TTS Playground 是 DORODORA 单独运营的免费 TTS 体验工具。这里提供的 TTS 只支持在浏览器中运行的本地 TTS 模型,而不是远程云端模型。输入句子后选择模型和声音,即可立即播放结果或保存为 WAV 文件。
无需注册或付费。打开 dorodora.com/playground 即可开始使用。
主要功能
TTS Playground 用简单的界面承载了几项核心功能。
浏览器本地 TTS
所有转换都在用户的浏览器内完成。模型文件只需下载一次就会保存在浏览器中,之后无需重新下载。输入的文本和生成的语音不会发送到服务器,因此在需要快速测试或提前试听个人句子时使用起来很放心。
多种 TTS 模型
TTS Playground 中可以选择四种本地模型。
| 模型 | 大小 | 声音数 | 语言 |
|---|---|---|---|
| SuperTonic | 399MB | 10 | 31 种以上 |
| 199MB | 8 | 英语、德语、意大利语、葡萄牙语、西班牙语 | |
| Kokoro | 92MB | 28 | 英语 |
| Kitten | 28MB | 8 | 英语 |
SuperTonic 支持包括韩语在内的 31 种以上语言。可以从语言列表中选择想要的语言并与声音自由组合,对面向全球观众的直播非常实用。
Pocket 是按语言划分的轻量模型。可以在英语、德语、意大利语、葡萄牙语、西班牙语中选择一种,而且借助声音克隆功能,上传约 1-3 秒的声音样本,就能生成与上传声音一致的 TTS。
Kokoro 和 Kitten 是仅支持英语的模型。它们体积最小、下载速度快,适合轻松地测试英语语音合成。
Animalese 效果
Animalese 不是模型,而是应用在生成语音上的效果。打开开关后,结果会变成类似某款游戏中动物居民那样快速又可爱的角色音。适合营造有趣氛围的直播内容或短音效用途。
最多输入 1,000 字
单次最多可输入 1,000 字。无论是简短的打赏留言还是较长的段落,都足以提前试听。
WAV 下载
点击播放器旁边的下载按钮,即可将生成的语音保存为 WAV 文件。文件名中包含模型名称,方便区分。想把做好的语音用作直播素材,或想在音频编辑工具中进一步加工时都很方便。
使用方法
TTS Playground 无需复杂设置,几个步骤即可上手。
- 打开
dorodora.com/playground。 - 在顶部选择模型。首次选择时按钮上会显示模型大小,按下即开始下载文件。
- 在文本框中输入要转换的句子。
- 选择语言。可选语言因模型而异。
- 选择声音。
- 需要的话打开
Animalese开关。 - 点击
生成 TTS按钮生成语音。 - 用播放器播放,或点击下载保存 WAV 文件。
模型、语言和声音的组合不同,呈现的感觉也不同,建议多试几种组合。
使用自定义声音
选择 Pocket 模型后,可以在声音列表中选择 Custom。该选项通过声音克隆,把自己的原声原样变成 TTS。
按照以下步骤即可使用自定义声音。
- 选择任一
Pocket模型。 - 在声音列表中选择
Custom。 - 上传一段无噪音、约 1-3 秒的声音文件。
- 输入文本并生成。
上传的样本在浏览器内处理,自定义声音也保存在浏览器中,下次访问时可以再次载入使用。想让打赏留言用自己的声音朗读之前,先用它确认效果再合适不过了。
什么情况下有用?
在 DORODORA 主页和打赏页面上已经能听到 AI TTS 的声音,但 TTS Playground 的价值远不止于此。它免费开放,生成的语音还可以商用,因此在直播之外的场合需要语音时尤其好用。
- 需要零成本使用语音合成的时候
- 需要为视频配音、旁白、引导语等非直播内容配音的时候
- 想把结果保存为 WAV 文件用于剪辑或其他项目的时候
- 想确认自己声音克隆效果的时候
- 需要用包括韩语在内的 31 种以上语言生成语音的时候
只要有浏览器就行,不需要账号和支付方式,是需要语音时随时都能拿起来用的工具。
与 DORODORA 打赏服务的关系
TTS Playground 是提前体验 DORODORA 打赏服务部分功能的工具。在实际的打赏页面上,支持者发送的留言会由 AI TTS 朗读,并通过 OBS 浏览器源显示在直播画面上。
在 Playground 中找到心仪的模型和声音组合后,在 DORODORA 控制台的消息设置中开启 TTS,即可将其应用到打赏提醒。同时还提供 Voice Cloning TTS,就像在 Playground 中上传的自定义声音一样,留言也可以用你自己的声音朗读。Playground 用于配置前的快速确认,实际服务则通过打赏页面和直播控制台衔接。
FAQ
TTS Playground 免费吗?
是的,这是打开 dorodora.com/playground 就能立刻使用的免费工具。无需注册或付费即可在浏览器中测试语音合成。
可以使用哪些浏览器?
支持 WebAssembly 和 Web Audio API 等现代浏览器功能的 Chrome、Edge、Firefox、Safari 等都可以使用。移动端浏览器也能访问,但考虑到模型文件的下载和运行,桌面环境会更加稳定。
每次都需要重新下载模型吗?
不需要。下载过一次的模型会保存在浏览器中重复使用。已准备好的模型会显示为已选中状态。
生成的语音会保存到服务器吗?
不会。TTS Playground 的所有处理都在浏览器内完成。输入的文本、上传的音频和生成的语音都不会被发送到 DORODORA 服务器。
可以商用吗?
可以。在 TTS Playground 中生成的语音可以在直播、视频等内容中商用。生成的语音以 WAV 文件形式保存,可直接用于剪辑或发布。
自定义声音应该上传什么样的音频文件?
Pocket 模型的 Custom 声音以声音克隆方式工作。建议上传无噪音、约 1-3 秒的声音文件,发音越清晰的样本,结果越稳定。
能把 Playground 的声音直接用于实际的打赏提醒吗?
在 DORODORA 控制台中开启 TTS 设置后,打赏留言就会由 AI 声音朗读。先在 Playground 中挑选喜欢的模型和声音,再通过控制台设置关联起来,直播中的打赏留言就能应用相近感觉的声音。
总结
DORODORA TTS Playground 是一款无需安装和注册、可在浏览器中直接测试 AI 语音合成的免费工具。它支持 SuperTonic、Pocket、Kokoro、Kitten 模型,其中 SuperTonic 可处理 31 种以上语言。
生成的语音既可以添加 Animalese 效果,也可以保存为 WAV 文件,所有处理都在浏览器中本地完成。它免费且允许商用,无论是挑选打赏提醒的声音,还是为内容制作语音,都值得一试。
马上到 dorodora.com/playground 体验 TTS 吧。