列表
约 5 分钟

DORODORA TTS Playground介绍:在浏览器中直接体验 AI 语音合成

DORODORA TTS Playground 是一款免费工具,可在浏览器中用本地 TTS 模型将文本转换为语音并保存为 WAV 文件。一起了解 SuperTonic、Pocket、Kokoro、Kitten 模型和自定义声音功能。

用 AI 声音朗读打赏留言,如今已经成为直播内容中难以缺少的元素。当观众的留言以语音形式播出时,直播的氛围会随之改变,主播和观众之间也产生了新的互动方式。

DORODORA 在打赏页面之外还提供 AI TTS 和 Voice Cloning TTS。不过,在把某个声音真正应用到直播之前,往往想先听听它的效果。因此 DORODORA 运营了 TTS Playground,无需安装或登录,就能直接在浏览器里体验 TTS。

本文将整理 dorodora.com/playgroundTTS Playground 的功能与使用方法,以及它与 DORODORA 打赏服务之间的联系。

立即体验 TTS Playground

TTS Playground 是什么?

TTS PlaygroundDORODORA 单独运营的免费 TTS 体验工具。这里提供的 TTS 只支持在浏览器中运行的本地 TTS 模型,而不是远程云端模型。输入句子后选择模型和声音,即可立即播放结果或保存为 WAV 文件。

无需注册或付费。打开 dorodora.com/playground 即可开始使用。

主要功能

TTS Playground 用简单的界面承载了几项核心功能。

浏览器本地 TTS

所有转换都在用户的浏览器内完成。模型文件只需下载一次就会保存在浏览器中,之后无需重新下载。输入的文本和生成的语音不会发送到服务器,因此在需要快速测试或提前试听个人句子时使用起来很放心。

多种 TTS 模型

TTS Playground 中可以选择四种本地模型。

模型 大小 声音数 语言
SuperTonic 399MB 10 31 种以上
Pocket 199MB 8 英语、德语、意大利语、葡萄牙语、西班牙语
Kokoro 92MB 28 英语
Kitten 28MB 8 英语

SuperTonic 支持包括韩语在内的 31 种以上语言。可以从语言列表中选择想要的语言并与声音自由组合,对面向全球观众的直播非常实用。

Pocket 是按语言划分的轻量模型。可以在英语、德语、意大利语、葡萄牙语、西班牙语中选择一种,而且借助声音克隆功能,上传约 1-3 秒的声音样本,就能生成与上传声音一致的 TTS。

KokoroKitten 是仅支持英语的模型。它们体积最小、下载速度快,适合轻松地测试英语语音合成。

Animalese 效果

Animalese 不是模型,而是应用在生成语音上的效果。打开开关后,结果会变成类似某款游戏中动物居民那样快速又可爱的角色音。适合营造有趣氛围的直播内容或短音效用途。

最多输入 1,000 字

单次最多可输入 1,000 字。无论是简短的打赏留言还是较长的段落,都足以提前试听。

WAV 下载

点击播放器旁边的下载按钮,即可将生成的语音保存为 WAV 文件。文件名中包含模型名称,方便区分。想把做好的语音用作直播素材,或想在音频编辑工具中进一步加工时都很方便。

使用方法

TTS Playground 无需复杂设置,几个步骤即可上手。

  1. 打开 dorodora.com/playground
  2. 在顶部选择模型。首次选择时按钮上会显示模型大小,按下即开始下载文件。
  3. 在文本框中输入要转换的句子。
  4. 选择语言。可选语言因模型而异。
  5. 选择声音。
  6. 需要的话打开 Animalese 开关。
  7. 点击生成 TTS 按钮生成语音。
  8. 用播放器播放,或点击下载保存 WAV 文件。

模型、语言和声音的组合不同,呈现的感觉也不同,建议多试几种组合。

使用自定义声音

选择 Pocket 模型后,可以在声音列表中选择 Custom。该选项通过声音克隆,把自己的原声原样变成 TTS。

按照以下步骤即可使用自定义声音。

  1. 选择任一 Pocket 模型。
  2. 在声音列表中选择 Custom
  3. 上传一段无噪音、约 1-3 秒的声音文件。
  4. 输入文本并生成。

上传的样本在浏览器内处理,自定义声音也保存在浏览器中,下次访问时可以再次载入使用。想让打赏留言用自己的声音朗读之前,先用它确认效果再合适不过了。

什么情况下有用?

DORODORA 主页和打赏页面上已经能听到 AI TTS 的声音,但 TTS Playground 的价值远不止于此。它免费开放,生成的语音还可以商用,因此在直播之外的场合需要语音时尤其好用。

  • 需要零成本使用语音合成的时候
  • 需要为视频配音、旁白、引导语等非直播内容配音的时候
  • 想把结果保存为 WAV 文件用于剪辑或其他项目的时候
  • 想确认自己声音克隆效果的时候
  • 需要用包括韩语在内的 31 种以上语言生成语音的时候

只要有浏览器就行,不需要账号和支付方式,是需要语音时随时都能拿起来用的工具。

与 DORODORA 打赏服务的关系

TTS Playground 是提前体验 DORODORA 打赏服务部分功能的工具。在实际的打赏页面上,支持者发送的留言会由 AI TTS 朗读,并通过 OBS 浏览器源显示在直播画面上。

在 Playground 中找到心仪的模型和声音组合后,在 DORODORA 控制台的消息设置中开启 TTS,即可将其应用到打赏提醒。同时还提供 Voice Cloning TTS,就像在 Playground 中上传的自定义声音一样,留言也可以用你自己的声音朗读。Playground 用于配置前的快速确认,实际服务则通过打赏页面和直播控制台衔接。

FAQ

TTS Playground 免费吗?

是的,这是打开 dorodora.com/playground 就能立刻使用的免费工具。无需注册或付费即可在浏览器中测试语音合成。

可以使用哪些浏览器?

支持 WebAssembly 和 Web Audio API 等现代浏览器功能的 Chrome、Edge、Firefox、Safari 等都可以使用。移动端浏览器也能访问,但考虑到模型文件的下载和运行,桌面环境会更加稳定。

每次都需要重新下载模型吗?

不需要。下载过一次的模型会保存在浏览器中重复使用。已准备好的模型会显示为已选中状态。

生成的语音会保存到服务器吗?

不会。TTS Playground 的所有处理都在浏览器内完成。输入的文本、上传的音频和生成的语音都不会被发送到 DORODORA 服务器。

可以商用吗?

可以。在 TTS Playground 中生成的语音可以在直播、视频等内容中商用。生成的语音以 WAV 文件形式保存,可直接用于剪辑或发布。

自定义声音应该上传什么样的音频文件?

Pocket 模型的 Custom 声音以声音克隆方式工作。建议上传无噪音、约 1-3 秒的声音文件,发音越清晰的样本,结果越稳定。

能把 Playground 的声音直接用于实际的打赏提醒吗?

DORODORA 控制台中开启 TTS 设置后,打赏留言就会由 AI 声音朗读。先在 Playground 中挑选喜欢的模型和声音,再通过控制台设置关联起来,直播中的打赏留言就能应用相近感觉的声音。

总结

DORODORA TTS Playground 是一款无需安装和注册、可在浏览器中直接测试 AI 语音合成的免费工具。它支持 SuperTonicPocketKokoroKitten 模型,其中 SuperTonic 可处理 31 种以上语言。

生成的语音既可以添加 Animalese 效果,也可以保存为 WAV 文件,所有处理都在浏览器中本地完成。它免费且允许商用,无论是挑选打赏提醒的声音,还是为内容制作语音,都值得一试。

马上到 dorodora.com/playground 体验 TTS 吧。

立即体验 TTS Playground

enesrufrptdejazhko