목록
약 11분

온라인 TTS 서비스 추천: 무료로 사용할 수 있는 텍스트 음성 변환 도구 비교

TTSMaker부터 ElevenLabs까지 온라인 TTS 서비스 다섯 곳을 가입 여부, 무료 사용량, 최대 글자수, 모델, 파일 저장, 상업적 이용 기준으로 비교하고, 브라우저에서 로컬로 실행되는 DORODORA의 TTS까지 함께 정리해요.

영상 더빙, 낭독 콘텐츠, 안내 멘트, 방송 후원 알림처럼 목소리가 필요한 순간은 생각보다 자주 찾아와요. 녹음 환경이나 성우 섭외 없이도 텍스트만으로 음성을 만들 수 있는 온라인 TTS(Text to Speech) 서비스는 이럴 때 가장 빠른 해결책이 돼요.

다만 서비스마다 가입 여부와 무료 사용량, 제공 모델, 상업적 이용 조건이 제각각이라 막연히 이름만 듣고 고르기는 어려워요. 이 글에서는 대표적인 온라인 TTS 서비스 다섯 곳을 골라 실제 사용에 중요한 요소들로 하나씩 짚어볼 거예요.

하나씩 살펴보다 보면 클라우드 기반 서비스들은 가입 절차나 글자수 제한처럼 비슷한 제약을 공유한다는 점이 보일 거예요. 그래서 마지막에는 그 제약에서 벗어난 방식의 도구인 DORODORA의 TTS까지 함께 소개해요. 클라우드 서버 대신 브라우저 안에서 음성을 만드는 도구라서, 온라인 TTS를 사용할 때 느끼는 몇 가지 답답한 점이 자연스럽게 해결되거든요.

TTS Playground 바로 사용하기

어떤 TTS를 골라야 할까요?

TTS 서비스를 고를 때 확인할 것은 의외로 단순해요.

  • 가입 없이 바로 사용할 수 있는가
  • 무료 사용량은 얼마나 되는가
  • 어떤 모델과 음성을 제공하는가
  • 만든 음성을 상업적으로 사용할 수 있는가
  • 결과물을 파일로 저장할 수 있는가
  • 한 번에 입력할 수 있는 최대 글자수는 얼마인가

아래부터는 각 서비스를 이 여섯 가지 체크포인트와 함께 소개할게요.

TTSMaker

TTSMaker는 무료 사용량이 넉넉한 게 강점이에요.

  • 가입: 불필요
  • 무료 사용량: 주 20,000자(일부 음성은 무제한)
  • 최대 글자수: 1회 1,000자(Pro는 20,000자 이상)
  • 모델·음성: 언어별 다수의 AI 음성
  • 파일 저장: MP3·WAV·OGG·AAC·OPUS 다운로드
  • 상업적 이용: 가능(출처 표기도 불필요)

가장 큰 장점은 상업적 이용 권리예요. 생성된 오디오에 대해 100% 상업적 사용 권리를 제공하고 출처 표기도 강제하지 않아서, 유튜브나 틱톡, 팟캐스트에 올릴 때 추가 허가가 필요 없어요. 속도와 피치, 볼륨 조절, 문장 사이 멈춤 삽입, 배경음악(BGM) 합성 같은 설정도 넉넉한 편이에요.

주의사항

  • 생성된 오디오는 30분 안에 자동 삭제되니 바로 내려받아야 해요.
  • 일부 세밀한 설정은 Pro 전용이에요.

긴 대본을 주기적으로 음성화해야 하는 크리에이터에게 무난한 첫 선택이에요.

TTSFree

TTSFree는 로그인 없이 변환을 시작할 수 있어요.

  • 가입: 무료 변환은 불필요
  • 무료 사용량: 비회원 일 50회(가입 시 월 500,000자)
  • 최대 글자수: 1회 500자(가입 시 2,000자)
  • 모델·음성: 구글·마이크로소프트 신경망 계열, 140개 언어 700개 이상 음성
  • 파일 저장: MP3 다운로드
  • 상업적 이용: 가능

구글과 마이크로소프트의 최신 신경망(Neural) 기술 기반 음성을 사용한다고 소개할 만큼 발음이 또렷하고 안정적인 편이에요. Wavenet이나 Neural2처럼 등급이 높은 음성도 일부 무료로 열려 있고, 속도와 피치, 볼륨 조절, SSML 문법, 배경음악 추가도 지원해요.

주의사항

  • 프리미엄 음성은 유료 요금제 대상이에요.
  • 생성된 파일은 24시간 이내 삭제돼요.

짧은 멘트를 가장 빨리 음성으로 바꿔보고 싶을 때 가벼운 첫 선택이에요.

Luvvoice

Luvvoice는 음성 선택지가 넓은 게 강점이에요.

  • 가입: 무료 사용 가능(로그인 시 기능 확장)
  • 무료 사용량: 월 20,000자
  • 최대 글자수: 1회 3,000자(유료 로그인 사용자는 20,000자)
  • 모델·음성: 70개 언어 200개 이상 음성 + 커스텀 보이스
  • 파일 저장: MP3 다운로드
  • 상업적 이용: 프리미엄 플랜 포함

눈에 띄는 기능은 파일 변환이에요. PDF와 TXT 문서를 업로드해서 통째로 음성으로 바꿀 수 있어서 긴 아티클이나 원고를 낭독 파일로 만들 때 편해요. 속도와 피치 조절이 기본 제공되고, 로그인 사용자는 문장 사이 멈춤 삽입 기능도 사용할 수 있어요. 최근에는 개성 있는 커스텀 보이스 마켓도 운영하고 있어요.

주의사항

  • 상업적 사용권은 프리미엄 플랜에 묶여 있어 용도에 따라 요금제 확인이 필요해요.
  • 생성된 오디오는 72시간 동안만 보관돼요.

문서 낭독처럼 분량이 큰 작업에 특히 잘 맞는 서비스예요.

TTS.ai

TTS.ai는 성격이 조금 달라요. 하나의 모델을 파는 대신 오픈소스 모델들을 한곳에 모아 놓은 플랫폼이에요.

  • 가입: 무료 모델은 불필요
  • 무료 사용량: 일 5,000자(가입 시 월 10,000자 + 보너스 15,000자)
  • 최대 글자수: 1회 500자(가입 시 5,000자)
  • 모델·음성: 오픈소스 모델 36개 이상, 음성 314개 이상, 55개 이상 언어
  • 파일 저장: WAV 다운로드(내장 컨버터로 MP3 등 변환 가능)
  • 상업적 이용: 가능

Kokoro, Piper, MeloTTS 같은 가벼운 모델부터 Chatterbox, GPT-SoVITS 같은 보이스 클로닝 모델까지 갖춰져 있어서, 같은 문장을 여러 모델로 변환해 비교하기 좋아요. OpenAI 호환 API가 무료 플랜부터 열려 있어 개발자 입장에서도 접근성이 좋아요.

주의사항

  • 모델에 따라 지원 언어와 글자당 소비량이 달라요.
  • 본격적으로 쓰려면 $9/월부터의 유료 플랜을 검토하게 돼요.

"여러 TTS 모델을 직접 비교해보고 싶다"는 니즈에는 이만한 곳이 없어요.

ElevenLabs

ElevenLabs는 음질이 압도적인 서비스예요.

  • 가입: 필요(무료 플랜 제공)
  • 무료 사용량: 월 10,000크레딧(약 10분 분량)
  • 최대 글자수: 모델별 상이(Eleven v3 5,000자, Multilingual v2 10,000자)
  • 모델·음성: Eleven v3, Multilingual v2, Flash v2.5, Turbo v2.5 / 음성 11,000개 이상
  • 파일 저장: MP3·WAV 다운로드
  • 상업적 이용: 유료 플랜만 가능(무료는 출처 표기 필요)

감정과 맥락을 이해해 전달 방식을 조정한다고 소개할 만큼 자연스러움이 높고, 약 1분 분량의 샘플로 목소리를 복제하는 인스턴트 보이스 클로닝도 제공돼요. 32개 이상 언어(Eleven v3 기준 70개 이상)를 지원해요.

주의사항

  • 상업적 사용권과 보이스 클로닝은 유료 플랜($5~$6/월 이상)부터예요.
  • 크레딧 소모가 빠르므로 긴 대본은 비용 계산이 필요해요.

완성도 높은 보이스오버가 필요한 상업 프로젝트라면 가장 먼저 검토할 가치가 있어요.

온라인 TTS의 공통적인 아쉬운 점

다섯 서비스를 하나씩 살펴보면 장점은 저마다 뚜렷하지만, 구조적으로 비슷한 특징도 보여요.

  • 입력한 텍스트가 음성 변환을 위해 서버로 전송돼요.
  • 주간·월간 글자수 쿼터가 있어서 반복 테스트에는 부담이 될 수 있어요.
  • 결과 파일 보관 기간이 짧아서(30분~72시간) 즉시 저장해야 해요.

대부분의 경우 큰 문제가 아니지만, 민감한 내용의 문장을 읽히고 싶거나, 같은 문장을 모델별로 수십 번 테스트하고 싶을 때는 이 구조가 걸리적거려요.

그래서 이런 순간에는 방향을 살짝 바꿔서, 아예 브라우저 안에서 도는 TTS를 사용해 볼 만해요.

DORODORA의 TTS

DORODORA가 제공하는 TTS도 오픈소스 모델을 쓴다는 점은 TTS.ai와 비슷해요. 대신 변환을 클라우드 서버에서 처리하지 않고, 모델 파일을 브라우저로 내려받아 사용자 기기 안에서 직접 실행해요.

같은 체크포인트로 정리하면 아래와 같아요.

  • 가입: 불필요
  • 무료 사용량: 제한 없음
  • 최대 글자수: 1회 1,000자
  • 모델·음성: 아래 로컬 모델 4종
  • 파일 저장: WAV 다운로드
  • 상업적 이용: 가능

덕분에 입력한 텍스트와 생성된 음성이 DORODORA 서버로 전송되지 않고, 글자수 쿼터 걱정도 없어요. 접속만 하면 바로 사용할 수 있고, 만든 음성은 WAV 파일로 저장해 상업적으로도 활용할 수 있어요.

모델 구성

  • SuperTonic — 399MB · 음성 10개 · 31개 이상 언어
  • Pocket — 199MB · 음성 8개 · 영어·독일어·이탈리아어·포르투갈어·스페인어
  • Kokoro — 92MB · 음성 28개 · 영어
  • Kitten — 28MB · 음성 8개 · 영어

SuperTonic은 31개 이상의 언어를 다루니까 여러 언어를 사용하는 방송이나 콘텐츠도 한 도구에서 테스트할 수 있어요.

Pocket 모델에는 보이스 클로닝 옵션이 있어요. 잡음이 적은 1~3초 분량의 음성 파일을 업로드하면 그 목소리 그대로 TTS를 만들어볼 수 있고, 커스텀 보이스는 브라우저에 저장돼 다음 접속에서도 재사용돼요.

그 외에도 재미 요소로 Animalese 효과(생성된 음성을 빠르고 귀여운 캐릭터 음성처럼 바꾸는 토글)를 지원해요.

어떤 사람에게 맞을까?

  • 후원 메시지 알림용 AI 목소리를 방송에 넣기 전에 가볍게 들어보고 싶은 스트리머
  • 문장이 외부 서버로 전송되는 게 부담스러운 사용자
  • 글자수 쿼터 걱정 없이 모델과 음성을 마음껏 비교하고 싶은 사용자
  • 결과물을 WAV로 저장해 편집에 바로 쓰고 싶은 크리에이터

반대로 모델 파일을 내려받는 초기 과정(28MB~399MB)이 필요하고, 영어 전용 모델이 있다는 점은 감안해야 해요.

상황별 추천 조합

실전에서는 하나만 고집하기보다 용도별로 나눠 사용하는 편이 좋아요.

긴 대본·문서 낭독

Luvvoice의 파일 변환이나 TTSMaker의 넉넉한 주간 쿼터가 유용해요. 원고 통째로 음성화가 필요할 때 이쪽이 효율적이에요.

상업 프로젝트 보이스오버

음질이 결과물 품질을 좌우한다면 ElevenLabs 유료 플랜이 기본값이에요. 무료로 해결하고 싶다면 상업권을 명확히 제공하는 TTSMaker, TTS.ai, DORODORA 조합으로 커버할 수 있어요.

모델 비교와 실험

TTS.ai에서 클라우드 기반 오픈소스 모델들을 비교하고, DORODORA의 TTS에서 브라우저 로컬 모델들의 느낌을 비교하면 후보가 빠르게 좁혀져요.

방송 후원 알림 준비

후원 메시지를 AI 목소리로 읽히게 하려면 어떤 목소리가 들었을 때 자연스러운지 미리 듣는 과정이 중요해요. DORODORA의 TTS에서 모델과 음성 조합을 골라본 뒤, DORODORA 콘솔의 TTS 설정으로 연결하면 흐름이 자연스러워요. Voice Cloning TTS까지 지원하니 자기 목소리로 후원 메시지를 읽히게 하는 것도 가능해요.

FAQ

완전 무료인데 상업적으로도 사용할 수 있는 곳은 어디인가요?

TTSMaker, TTS.ai, DORODORA가 해당해요. ElevenLabsLuvvoice는 상업권이 유료 플랜에 묶여 있어서 용도에 따라 요금제를 확인해야 해요.

가입 없이 바로 사용할 수 있는 곳은요?

TTSFreeTTS.ai(무료 모델), DORODORA는 가입 절차 없이 바로 변환을 시작할 수 있어요.

입력한 텍스트가 서버로 전송되지 않는 곳도 있나요?

DORODORA뿐이에요. 모델을 브라우저로 내려받아 기기 안에서 처리하기 때문에 텍스트와 생성 음성이 서버로 전송되지 않아요. 다른 클라우드 서비스들은 변환을 위해 텍스트를 서버로 보내요.

후원 알림 TTS는 어떻게 준비하면 되나요?

DORODORA의 TTS에서 마음에 드는 모델과 음성을 먼저 찾아보세요. 이후 DORODORA 콘솔에서 TTS를 켜면 후원 메시지가 AI 목소리로 읽히고, OBS 브라우저 소스로 방송 화면에 알림을 띄울 수 있어요.

작성일 기준 참고

이 글은 2026년 8월 26일 각 서비스 공개 페이지 기준으로 작성했어요. 무료 사용량, 음성 수, 상업적 이용 조건은 서비스 정책에 따라 언제든 바뀔 수 있으니 실제 사용 전 최신 안내를 확인하는 것이 좋아요.

DORODORA가 제공하는 모델의 상업적 이용

DORODORA의 TTS에서 실행되는 네 모델은 모두 공개된 오픈소스 프로젝트 기반이에요. 생성된 음성의 상업적 이용 가능 여부를 각 원 프로젝트 기준으로 정리하면 다음과 같아요.

  • SuperTonic(Supertone): 코드는 MIT, 모델 가중치는 OpenRAIL-M이에요. 상업적 사용이 가능하고, 저작자 표기 요건과 기만적 사용 금지 같은 이용 제한이 함께 적용돼요.
  • Pocket(Kyutai): 보이스마다 출처와 라이선스가 달라요. CC0나 CC BY 4.0처럼 상업적으로 사용할 수 있는 보이스가 있는 반면, Expresso 데이터셋 기반 보이스는 CC BY-NC 4.0이라 비상업 용도에 한정돼요. DORODORA는 이 가운데 상업적으로 이용할 수 있는 보이스만 제공하기 때문에, 별도 확인 없이 수익화 콘텐츠에 바로 사용할 수 있어요.
  • Kokoro(hexgrad): 가중치가 Apache 2.0으로 공개돼 있어 상업적 활용 제약이 없어요.
  • KittenTTS(KittenML): Apache 2.0으로 공개돼 있어 상업적 활용 제약이 없어요.

정리하면 네 모델 모두 상업적 사용에 제약이 없어요. 반면 Custom 보이스로 자신의 목소리를 클론해 사용하는 경우에는 남의 데이터 라이선스 문제가 생기지 않아요.

공통적으로 동의 없는 타인 목소리 복제나 기만적인 용도는 어떤 모델이든 금지돼 있으니, 결과물을 배포하거나 수익화하기 전에 각 모델과 보이스의 최신 라이선스를 한 번 더 확인하는 것이 안전해요.

정리

온라인 TTS는 이미 선택지가 충분히 넓어졌어요. 사용량과 설정의 자유로움은 TTSMaker, 가입 없는 빠른 사용은 TTSFree, 문서 낭독은 Luvvoice, 모델 실험은 TTS.ai, 최고 음질은 ElevenLabs가 각각 강점이에요.

거기에 "서버 전송 없이, 쿼터 없이, 가입 없이"라는 조건까지 필요하다면 브라우저에서 로컬로 도는 DORODORA가 좋은 보조 수단이 돼요. 무료이고 상업적 이용도 가능하니, 후원 알림 목소리를 고르거나 콘텐츠에 사용할 음성이 필요할 때 함께 활용해 보세요.

dorodora.com/playground에서 지금 바로 TTS를 체험할 수 있어요.

TTS Playground 바로 사용하기

enesrufrptdejazhko