Список
6 мин чтения

Знакомство с TTS Playground от DORODORA: синтез речи на основе ИИ прямо в браузере

TTS Playground от DORODORA — бесплатный инструмент, который преобразует текст в речь с помощью локальных TTS-моделей в браузере и сохраняет результат в WAV. Обзор моделей SuperTonic, Pocket, Kokoro, Kitten и пользовательских голосов.

Зачитывание сообщений о донатах голосом ИИ давно стало неотъемлемой частью стримов. Когда сообщение зрителя звучит как речь, меняется атмосфера трансляции и возникает новое взаимодействие между стримером и аудиторией.

DORODORA также предоставляет AI TTS и Voice Cloning TTS вместе со страницами для донатов. Тем не менее перед тем как использовать голос в реальном эфире, часто хочется сначала услышать, как он звучит. Именно поэтому DORODORA запустила TTS Playground, где можно попробовать TTS прямо в браузере — без установки и входа в аккаунт.

В этой статье мы рассмотрим возможности TTS Playground, доступного на dorodora.com/playground, порядок работы и связь с сервисом донатов DORODORA.

Попробовать TTS Playground

Что такое TTS Playground?

TTS Playground — это бесплатная тестовая площадка TTS, которую DORODORA ведет отдельно. Предоставляемый здесь TTS работает только на локальных моделях, выполняющихся в вашем браузере, а не на удаленных облачных моделях. Вы вводите предложение, выбираете модель и голос, затем сразу воспроизводите результат или сохраняете его в файл WAV.

Регистрация и оплата не требуются. Просто откройте dorodora.com/playground и пользуйтесь.

Основные возможности

TTS Playground объединяет несколько ключевых функций в простом интерфейсе.

Локальный TTS в браузере

Вся обработка происходит внутри вашего браузера. После однократной загрузки файл модели сохраняется в браузере, и повторно скачивать его не нужно. Введенный текст и созданный звук никогда не отправляются на сервер, поэтому это удобно для быстрых проверок и предварительного прослушивания личных фраз.

Несколько TTS-моделей

В TTS Playground доступны четыре локальные модели.

Модель Размер Голоса Языки
SuperTonic 399МБ 10 Более 31
Pocket 199МБ 8 Английский, немецкий, итальянский, португальский, испанский
Kokoro 92МБ 28 Английский
Kitten 28МБ 8 Английский

SuperTonic поддерживает более 31 языка, включая корейский. Можно выбрать язык из списка и скомбинировать его с любым голосом — это удобно для трансляций с международной аудиторией.

Pocket — легкая модель, разделенная по языкам. Доступны английский, немецкий, итальянский, португальский и испанский, а благодаря функции клонирования голоса вы можете загрузить образец голоса длительностью около 1-3 секунд и создать TTS, который звучит точно как загруженный голос.

Kokoro и Kitten — модели только для английского языка. Они самые компактные, поэтому быстро загружаются и отлично подходят для легкой проверки синтеза английской речи.

Эффект Animalese

Animalese — это не модель, а эффект, применяемый к созданному аудио. При включении переключателя результат превращается в быстрый милый голос персонажа, похожий на зверьков из одной известной игры. Хорошо подходит для веселых стримов или коротких звуковых эффектов.

До 1 000 символов

За один раз можно ввести до 1 000 символов. Этого достаточно, чтобы заранее прослушать и короткие сообщения о донатах, и длинные предложения.

Скачивание в WAV

Нажмите кнопку загрузки рядом с плеером, чтобы сохранить созданный звук в файл WAV. Имя модели включено в имя файла, поэтому файлы легко различать. Это удобно, когда нужно использовать готовый звук как материал для стрима или доработать его в редакторе.

Как пользоваться

TTS Playground работает за несколько простых шагов.

  1. Откройте dorodora.com/playground.
  2. Выберите модель вверху. При первом выборе на кнопке отображается размер модели; нажатие запускает загрузку файлов.
  3. Введите предложение, которое нужно преобразовать.
  4. Выберите язык. Доступные языки зависят от модели.
  5. Выберите голос.
  6. При желании включите переключатель Animalese.
  7. Нажмите кнопку Сгенерировать TTS.
  8. Воспроизведите результат в плеере или нажмите скачать, чтобы сохранить файл WAV.

Поскольку звучание меняется в зависимости от комбинации модели, языка и голоса, рекомендуется попробовать несколько сочетаний.

Использование пользовательского голоса

При выборе модели Pocket в списке голосов можно выбрать пункт Custom. Эта опция использует клонирование голоса, чтобы превратить ваш собственный голос в TTS один в один.

Чтобы использовать пользовательский голос, выполните следующие шаги.

  1. Выберите одну из моделей Pocket.
  2. Выберите Custom в списке голосов.
  3. Загрузите файл голоса без шума длительностью около 1-3 секунд.
  4. Введите текст и сгенерируйте.

Образец обрабатывается внутри браузера, и пользовательский голос тоже сохраняется там, поэтому при следующем визите его можно снова загрузить. Это хороший способ заранее услышать результат, прежде чем сообщения о донатах будут читаться вашим голосом.

Когда это полезно?

Голоса AI TTS можно послушать и на главной странице DORODORA, и на страницах донатов, но ценность TTS Playground шире. Он бесплатный, а созданный звук можно использовать в коммерческих целях, поэтому он особенно полезен, когда нужна речь для задач вне стрима.

  • Когда нужен синтез речи без каких-либо затрат
  • Когда нужен голос для контента вне стримов: дубляж видео, начитка, объявления
  • Когда нужно сохранить результат в WAV для монтажа или других проектов
  • Когда хочется проверить, как звучит клон вашего собственного голоса
  • Когда нужна речь на одном из более чем 31 языков, включая корейский

Нужен только браузер — без аккаунта и платежных средств, поэтому инструмент всегда под рукой, когда требуется голос.

Связь с сервисом донатов DORODORA

TTS Playground — инструмент для предварительного знакомства с частью сервиса донатов DORODORA. На настоящей странице донатов сообщения подписчиков читаются AI TTS, а уведомления появляются в эфире через browser source OBS.

Когда вы найдете в Playground подходящую комбинацию модели и голоса, включите TTS в настройках сообщений консоли DORODORA, чтобы применить его к уведомлениям о донатах. Также предоставляется Voice Cloning TTS, поэтому, как и с пользовательскими голосами из Playground, сообщения могут читаться вашим собственным голосом. Playground служит для быстрой проверки перед настройкой, а сам сервис работает через страницу донатов и консоль стрима.

FAQ

TTS Playground бесплатный?

Да, это бесплатный инструмент, доступный сразу на dorodora.com/playground. Тестировать синтез речи в браузере можно без регистрации и оплаты.

Какие браузеры поддерживаются?

Работает в Chrome, Edge, Firefox, Safari и других браузерах с поддержкой современных функций вроде WebAssembly и Web Audio API. Страница открывается и в мобильных браузерах, но с учетом загрузки и запуска моделей стабильнее использовать настольное окружение.

Нужно ли скачивать модель каждый раз?

Нет. Однажды скачанная модель сохраняется в браузере и используется повторно. Уже подготовленные модели отображаются как выбранные.

Сохраняются ли созданные голоса на сервере?

Нет. Все в TTS Playground обрабатывается внутри вашего браузера. Введенный текст, загруженное аудио и созданные голоса никогда не отправляются на серверы DORODORA.

Можно ли использовать в коммерческих целях?

Да, звук, созданный в TTS Playground, можно коммерчески использовать в стримах, видео и другом контенте. Созданное аудио сохраняется в формате WAV, так что сразу пригодно для монтажа и публикации.

Какой аудиофайл нужно загружать для пользовательского голоса?

Голос Custom модели Pocket работает по принципу клонирования голоса. Рекомендуется загружать файл без шума длительностью около 1-3 секунд; чем четче произношение в образце, тем надежнее результат.

Можно ли использовать голоса из Playground напрямую в уведомлениях о донатах?

При включении TTS в консоли DORODORA сообщения о донатах читаются голосом ИИ. Используйте Playground, чтобы выбрать понравившиеся модель и голос, а затем подключите их через настройки консоли, чтобы сообщения во время стрима звучали похожим образом.

Итоги

DORODORA TTS Playground — бесплатный инструмент для проверки синтеза речи на базе ИИ прямо в браузере, без установки и регистрации. Поддерживаются модели SuperTonic, Pocket, Kokoro и Kitten, а SuperTonic работает более чем с 31 языком.

К созданному аудио можно применить эффект Animalese или сохранить его в WAV, при этом вся обработка происходит локально в браузере. Инструмент бесплатный и допускает коммерческое использование, поэтому попробуйте его при выборе голоса для уведомлений о донатах или когда нужна речь для вашего контента.

Попробовать TTS прямо сейчас можно на dorodora.com/playground.

Попробовать TTS Playground

enesrufrptdejazhko