Знакомство с TTS Playground от DORODORA: синтез речи на основе ИИ прямо в браузере
TTS Playground от DORODORA — бесплатный инструмент, который преобразует текст в речь с помощью локальных TTS-моделей в браузере и сохраняет результат в WAV. Обзор моделей SuperTonic, Pocket, Kokoro, Kitten и пользовательских голосов.
Зачитывание сообщений о донатах голосом ИИ давно стало неотъемлемой частью стримов. Когда сообщение зрителя звучит как речь, меняется атмосфера трансляции и возникает новое взаимодействие между стримером и аудиторией.
DORODORA также предоставляет AI TTS и Voice Cloning TTS вместе со страницами для донатов. Тем не менее перед тем как использовать голос в реальном эфире, часто хочется сначала услышать, как он звучит. Именно поэтому DORODORA запустила TTS Playground, где можно попробовать TTS прямо в браузере — без установки и входа в аккаунт.
В этой статье мы рассмотрим возможности TTS Playground, доступного на dorodora.com/playground, порядок работы и связь с сервисом донатов DORODORA.
Что такое TTS Playground?
TTS Playground — это бесплатная тестовая площадка TTS, которую DORODORA ведет отдельно. Предоставляемый здесь TTS работает только на локальных моделях, выполняющихся в вашем браузере, а не на удаленных облачных моделях. Вы вводите предложение, выбираете модель и голос, затем сразу воспроизводите результат или сохраняете его в файл WAV.
Регистрация и оплата не требуются. Просто откройте dorodora.com/playground и пользуйтесь.
Основные возможности
TTS Playground объединяет несколько ключевых функций в простом интерфейсе.
Локальный TTS в браузере
Вся обработка происходит внутри вашего браузера. После однократной загрузки файл модели сохраняется в браузере, и повторно скачивать его не нужно. Введенный текст и созданный звук никогда не отправляются на сервер, поэтому это удобно для быстрых проверок и предварительного прослушивания личных фраз.
Несколько TTS-моделей
В TTS Playground доступны четыре локальные модели.
| Модель | Размер | Голоса | Языки |
|---|---|---|---|
| SuperTonic | 399МБ | 10 | Более 31 |
| 199МБ | 8 | Английский, немецкий, итальянский, португальский, испанский | |
| Kokoro | 92МБ | 28 | Английский |
| Kitten | 28МБ | 8 | Английский |
SuperTonic поддерживает более 31 языка, включая корейский. Можно выбрать язык из списка и скомбинировать его с любым голосом — это удобно для трансляций с международной аудиторией.
Pocket — легкая модель, разделенная по языкам. Доступны английский, немецкий, итальянский, португальский и испанский, а благодаря функции клонирования голоса вы можете загрузить образец голоса длительностью около 1-3 секунд и создать TTS, который звучит точно как загруженный голос.
Kokoro и Kitten — модели только для английского языка. Они самые компактные, поэтому быстро загружаются и отлично подходят для легкой проверки синтеза английской речи.
Эффект Animalese
Animalese — это не модель, а эффект, применяемый к созданному аудио. При включении переключателя результат превращается в быстрый милый голос персонажа, похожий на зверьков из одной известной игры. Хорошо подходит для веселых стримов или коротких звуковых эффектов.
До 1 000 символов
За один раз можно ввести до 1 000 символов. Этого достаточно, чтобы заранее прослушать и короткие сообщения о донатах, и длинные предложения.
Скачивание в WAV
Нажмите кнопку загрузки рядом с плеером, чтобы сохранить созданный звук в файл WAV. Имя модели включено в имя файла, поэтому файлы легко различать. Это удобно, когда нужно использовать готовый звук как материал для стрима или доработать его в редакторе.
Как пользоваться
TTS Playground работает за несколько простых шагов.
- Откройте
dorodora.com/playground. - Выберите модель вверху. При первом выборе на кнопке отображается размер модели; нажатие запускает загрузку файлов.
- Введите предложение, которое нужно преобразовать.
- Выберите язык. Доступные языки зависят от модели.
- Выберите голос.
- При желании включите переключатель
Animalese. - Нажмите кнопку
Сгенерировать TTS. - Воспроизведите результат в плеере или нажмите скачать, чтобы сохранить файл WAV.
Поскольку звучание меняется в зависимости от комбинации модели, языка и голоса, рекомендуется попробовать несколько сочетаний.
Использование пользовательского голоса
При выборе модели Pocket в списке голосов можно выбрать пункт Custom. Эта опция использует клонирование голоса, чтобы превратить ваш собственный голос в TTS один в один.
Чтобы использовать пользовательский голос, выполните следующие шаги.
- Выберите одну из моделей
Pocket. - Выберите
Customв списке голосов. - Загрузите файл голоса без шума длительностью около 1-3 секунд.
- Введите текст и сгенерируйте.
Образец обрабатывается внутри браузера, и пользовательский голос тоже сохраняется там, поэтому при следующем визите его можно снова загрузить. Это хороший способ заранее услышать результат, прежде чем сообщения о донатах будут читаться вашим голосом.
Когда это полезно?
Голоса AI TTS можно послушать и на главной странице DORODORA, и на страницах донатов, но ценность TTS Playground шире. Он бесплатный, а созданный звук можно использовать в коммерческих целях, поэтому он особенно полезен, когда нужна речь для задач вне стрима.
- Когда нужен синтез речи без каких-либо затрат
- Когда нужен голос для контента вне стримов: дубляж видео, начитка, объявления
- Когда нужно сохранить результат в WAV для монтажа или других проектов
- Когда хочется проверить, как звучит клон вашего собственного голоса
- Когда нужна речь на одном из более чем 31 языков, включая корейский
Нужен только браузер — без аккаунта и платежных средств, поэтому инструмент всегда под рукой, когда требуется голос.
Связь с сервисом донатов DORODORA
TTS Playground — инструмент для предварительного знакомства с частью сервиса донатов DORODORA. На настоящей странице донатов сообщения подписчиков читаются AI TTS, а уведомления появляются в эфире через browser source OBS.
Когда вы найдете в Playground подходящую комбинацию модели и голоса, включите TTS в настройках сообщений консоли DORODORA, чтобы применить его к уведомлениям о донатах. Также предоставляется Voice Cloning TTS, поэтому, как и с пользовательскими голосами из Playground, сообщения могут читаться вашим собственным голосом. Playground служит для быстрой проверки перед настройкой, а сам сервис работает через страницу донатов и консоль стрима.
FAQ
TTS Playground бесплатный?
Да, это бесплатный инструмент, доступный сразу на dorodora.com/playground. Тестировать синтез речи в браузере можно без регистрации и оплаты.
Какие браузеры поддерживаются?
Работает в Chrome, Edge, Firefox, Safari и других браузерах с поддержкой современных функций вроде WebAssembly и Web Audio API. Страница открывается и в мобильных браузерах, но с учетом загрузки и запуска моделей стабильнее использовать настольное окружение.
Нужно ли скачивать модель каждый раз?
Нет. Однажды скачанная модель сохраняется в браузере и используется повторно. Уже подготовленные модели отображаются как выбранные.
Сохраняются ли созданные голоса на сервере?
Нет. Все в TTS Playground обрабатывается внутри вашего браузера. Введенный текст, загруженное аудио и созданные голоса никогда не отправляются на серверы DORODORA.
Можно ли использовать в коммерческих целях?
Да, звук, созданный в TTS Playground, можно коммерчески использовать в стримах, видео и другом контенте. Созданное аудио сохраняется в формате WAV, так что сразу пригодно для монтажа и публикации.
Какой аудиофайл нужно загружать для пользовательского голоса?
Голос Custom модели Pocket работает по принципу клонирования голоса. Рекомендуется загружать файл без шума длительностью около 1-3 секунд; чем четче произношение в образце, тем надежнее результат.
Можно ли использовать голоса из Playground напрямую в уведомлениях о донатах?
При включении TTS в консоли DORODORA сообщения о донатах читаются голосом ИИ. Используйте Playground, чтобы выбрать понравившиеся модель и голос, а затем подключите их через настройки консоли, чтобы сообщения во время стрима звучали похожим образом.
Итоги
DORODORA TTS Playground — бесплатный инструмент для проверки синтеза речи на базе ИИ прямо в браузере, без установки и регистрации. Поддерживаются модели SuperTonic, Pocket, Kokoro и Kitten, а SuperTonic работает более чем с 31 языком.
К созданному аудио можно применить эффект Animalese или сохранить его в WAV, при этом вся обработка происходит локально в браузере. Инструмент бесплатный и допускает коммерческое использование, поэтому попробуйте его при выборе голоса для уведомлений о донатах или когда нужна речь для вашего контента.
Попробовать TTS прямо сейчас можно на dorodora.com/playground.