
ElevenLabs
일레븐랩스
소개
ElevenLabs는 2022년 설립된 AI 음성 합성 전문 기업으로, 딥러닝 기반의 감정·억양 표현 TTS 기술을 제공합니다. 텍스트 음성 변환, 음성 복제(Voice Cloning), 20개 이상 언어 자동 더빙, 대화형 음성 에이전트(ElevenAgents, 구 Conversational AI), 음성-텍스트 변환(Scribe), AI 음악 생성(Eleven Music) 등 6개 핵심 제품을 한 플랫폼에서 운영합니다. 2026년 2월 정식 출시(GA)된 Eleven v3 기준 한국어 포함 70개 이상 언어를 지원하며, 2026년 2월 기준 기업가치 110억 달러로 음성 AI 분야 최대 규모 기업입니다.
ElevenLabs 사용법
음성 선택 또는 클론 생성
elevenlabs.io에서 Voice Library의 기성 음성을 고르거나, 잡음 없는 샘플 1~5분을 업로드해 내 목소리 클론을 만듭니다(오용 방지 인증 문구 필요).
모델·음성 지정 후 대본 입력
만든 음성을 불러오고 표현력 좋은 Eleven v3 모델을 선택한 뒤 Text to Speech 입력창에 대본을 작성합니다.
설정 조절 후 음성 생성
Stability 등 슬라이더로 톤을 맞추고 Generate speech로 음성을 만듭니다. 결과물은 더빙·웹 내레이션 등에서 재사용할 수 있습니다.
장점
- •Eleven v3 기준 70개 이상 언어에서 감정·억양을 자연스럽게 표현하는 업계 최고 수준 TTS 품질
- •한국어 포함 다국어 더빙 시 원본 화자의 목소리·감정·억양을 그대로 유지
- •짧은 오디오 샘플만으로 화자 음성을 복제하는 Voice Cloning 제공
- •TTS·더빙·Conversational AI·Scribe(STT)·Eleven Music까지 음성 관련 제품이 한 플랫폼에 통합
- •무료 티어로 TTS 품질을 부담 없이 테스트 가능
단점
- •공식 사이트 UI·결제가 영문 중심으로, 한국어 인터페이스와 원화 결제 지원이 제한적
- •Voice Cloning·고급 TTS 모델 등 핵심 기능은 유료 플랜 필수
- •음성 복제 기술 특성상 딥페이크·무단 사용 위험이 있어 2024년 이후 사용 정책이 강화됨
- •무료 티어의 월간 캐릭터(글자) 사용량이 제한적
핵심 기능
감정 표현 TTS (Eleven v3)
딥러닝으로 문맥의 감정·억양을 탐지해 자연스러운 음성을 생성하며, 2026년 2월 정식 출시(GA)된 v3는 대괄호로 감정과 연기를 지시하는 오디오 태그([whispers], [sighs] 등) 기능을 지원하고 70개 이상 언어에서 사용할 수 있습니다.
Voice Cloning
짧은 오디오 샘플만으로 특정 화자의 목소리를 복제하여 동일한 톤과 억양으로 새로운 문장을 생성합니다.
AI 다국어 더빙
원본 화자의 목소리·감정·억양을 유지하면서 20개 이상 언어로 영상·음성을 자동 번역 더빙합니다.
ElevenAgents (대화형 AI 에이전트)
실시간 대화형 음성 에이전트를 구축할 수 있는 개발자 플랫폼으로, 2024년 11월 출시 이후 ElevenAgents로 브랜드가 확장되어 전화·웹·앱 전반에서 업무를 수행하는 에이전트를 지원합니다.
Scribe (STT)
캐릭터 단위 타임스탬프와 화자 분리 기능을 갖춘 고정밀 음성-텍스트 변환 모델입니다.
Eleven Music
텍스트 프롬프트로 스튜디오급 배경음악·효과음을 생성하는 AI 음악 생성기로, 2025년 8월에 출시되었습니다.
Voice Library
1,000개 이상의 커뮤니티 공유 음성을 탐색·사용할 수 있는 음성 라이브러리입니다.
공식 사이트 2026-07-23 검증
영상 가이드
요금제
2026-07-23 기준
Free
$0/월
- TTS·STT·효과음·Voice Design·Music
Starter
$6/월
- 상업 라이선스
- Instant Voice Cloning
- Studio 20개 프로젝트·더빙
Creator
$22/월
(첫 달 50% 할인 $11)
- Professional Voice Cloning
- 추가 크레딧
- 인기
Pro
$99/월
- 44.1kHz PCM API 출력
- 192kbps 품질
Scale / Business / Enterprise
상위 요금
(문의)
- 대규모·팀·조직용
ElevenLabs와 함께 쓰는 AI 콤보
여러 AI 도구를 묶어서 만든 검증된 워크플로우
YouTube Shorts 대량 생산 공장
ChatGPT로 스크립트, ElevenLabs로 나레이션, CapCut으로 영상 편집
팟캐스트 원스톱 제작
Claude로 스크립트, ElevenLabs로 음성, Descript로 편집
AI 보이스 더빙 + 번역
Whisper로 STT, DeepL로 번역, ElevenLabs로 보이스 클론 더빙
ElevenLabs + Descript 조합
ElevenLabs로 AI 음성을 생성하고, Descript로 텍스트 편집처럼 음성 편집
자주 묻는 질문
ElevenLabs는 한국어 음성을 생성할 수 있나요?
네. Eleven v3 기준 한국어를 포함한 70개 이상 언어를 지원하며, 한국어 TTS와 더빙이 모두 가능합니다.
무료로 사용할 수 있나요?
무료 티어가 제공되어 기본 TTS 품질을 테스트할 수 있지만, 월간 사용량이 제한되며 Voice Cloning 등 고급 기능은 유료 플랜(Starter $5/mo~)에서만 사용 가능합니다.
Voice Cloning은 어떻게 동작하나요?
짧은 오디오 샘플을 업로드하면 해당 화자의 목소리 특성을 학습해 동일한 톤과 억양으로 새로운 문장을 읽어줍니다. Starter 플랜부터 Instant Voice Cloning을, Creator 이상에서 Professional Voice Cloning을 사용할 수 있습니다.
다른 사람의 목소리를 복제해도 되나요?
본인 또는 명시적 동의를 받은 화자의 음성만 복제해야 합니다. 2024년 미국 대선 관련 딥페이크 사건 이후 사용 정책이 강화되었으며, AI Speech Classifier로 생성 음성을 탐지하는 안전장치도 제공합니다.
ElevenLabs의 기업 규모는 어느 정도인가요?
2026년 2월 기준 기업가치 110억 달러(약 15조 원), 직원 400명 규모이며, 음성 AI 분야에서 가장 큰 투자를 유치한 기업입니다.
API로 내 앱에 통합할 수 있나요?
네. TTS, Conversational AI, STT(Scribe) 등 주요 기능이 API로 제공되며, 실시간 스트리밍 응답도 지원합니다. Starter 플랜부터 API 접근이 가능합니다.
음성 복원 프로그램이 있나요?
2026년 3월 ElevenLabs는 영구적 음성 손실자 100만 명에게 10억 달러 상당의 무료 음성 복원 기술을 제공하겠다고 발표했습니다.
사용자 리뷰
불러오는 중...



