• AI 오디오북
  • AI 오디오북 생성기

텍스트나 EPUB으로 AI 오디오북 만드는 방법

AI 오디오북 생성기는 텍스트, EPUB, 책을 장별 오디오로 바꿉니다. TextSpeech는 텍스트를 붙여 넣는 오디오북 제작 도구이며, 업로드만 하면 모두 처리하는 EPUB 변환기가 아닙니다.

TextSpeech 팀6분 읽기
책, 헤드폰, 책상 조명 옆에 오디오 파형을 표시하는 화면

짧은 답변: AI 오디오북은 원고로 생성한 장별 오디오입니다. ElevenLabs Audiobooks 같은 업로드 도구는 EPUB을 받아 장을 감지합니다. TextSpeech는 붙여 넣기 방식의 오디오북 제작 도구입니다. Word나 Google Docs에서 텍스트를 복사하고, 한 번에 한 장 이하를 붙여 넣으며, 생성당 글자 수 제한을 지킨 뒤 유료 요금제로 MP3를 내보냅니다. 독립 제작 강의, 연재 소설, 팟캐스트 형식의 책에 적합합니다. “영어 9만 단어 소설을 업로드하고 5분 만에 파일 하나 받기”를 위한 도구는 아닙니다.

작업은 두 가지로 나뉩니다. AI 오디오북 생성기나 제작 도구는 EPUB·전자책 파일을 업로드하거나, 텍스트로 한 장씩 오디오북을 만들게 합니다. 어떤 방식을 구매하는지 확인하세요.

2026년 9월 14일 공식 문서로 검토했습니다. 문서에 근거한 작업 과정이며 직접 청취한 비교 평가가 아닙니다. 텍스트의 오디오 이용 권리를 보유해야 합니다.

AI 오디오북 도구와 EPUB 변환기 비교

플랫폼 / 가이드입력 방식장 처리TextSpeech와의 차이
ElevenLabs AudiobooksEPUB 업로드장 자동 감지, 여러 등장인물 배역 설정파일 업로드 없이 편집기에서 붙여 넣기
AudiobookGenEPUB 업로드책 전체 변환 과정장을 수동 분할하고 붙여 넣는 양 조절
Audie.ai원고 업로드여러 음성의 소설에 중점단일 내레이터 작업 과정
TextSpeech브라우저에 붙여 넣기사용자가 장·장면 경계에서 분할무료 미리 듣기는 회당 500자, 유료는 MP3 및 상업적 이용

TextSpeech가 솔직하게 밝히는 점: 저희는 장 분량의 텍스트를 붙여 넣는 브라우저 스튜디오이며 EPUB 변환기가 아닙니다. 업로드 후 자동 처리가 필요하다면 ElevenLabs나 AudiobookGen이 EPUB·전자책의 오디오북 변환에 맞습니다. 1,000개 이상의 음성, 감정 태그, AI 보이스오버에 쓰는 같은 도구를 원한다면 Studio를 이용하되 여러 번 내보낼 계획을 세우세요.

계획에 반영해야 할 TextSpeech 제한

요금제생성당 글자 수대략적인 영어 단어 수MP3 내보내기상업적 이용
Free50070–90미리 듣기만불가
Basic / Pro15,000약 2,200–2,500가능가능
Ultra30,000약 4,500–5,000가능가능

한 번 생성 ≠ 책 한 권. 장이나 장면 경계에서 나누고 각 블록의 글자 수를 세며 재생성과 전체 청취 시간을 확보하세요. MP3 수는 총 단어 수뿐 아니라 실제 장 길이에 따라 달라집니다.

무료 요금제로는 첫 장 도입부에서 내레이터를 시험하세요. 판매 가능한 파일을 납품하는 용도가 아닙니다.

붙여 넣기 전에 필요한 것

  • 원고의 오디오 이용 권리. 직접 쓴 작품, 허가받은 자료 또는 확인한 퍼블릭 도메인 자료여야 합니다.
  • Studio에서 대화와 어려운 이름이 포함된 같은 한 페이지를 비교하세요. YouTube 스타일 내레이터도 시험할 후보입니다. 자신의 원고에서 발음, 속도감, 일관성으로 선택하세요.
  • 이름 규칙: 01-chapter-one.mp3, 02-chapter-two.mp3.
  • MP3 내보내기와 상업 배포에는 Basic, Pro 또는 Ultra가 필요합니다. 약관을 확인하세요.

원고 준비

인쇄용 서식은 TTS를 방해합니다. 붙여 넣기 전에 처리하세요.

  • 제목을 제거하거나 낭독용으로 고치세요. 숫자를 잘못 읽으면 Chapter 3Chapter three로 바꿉니다.
  • 를 말로 읽는 목록으로 바꾸거나 삭제하세요.
  • 음성이 잘못 읽을 약어를 풀어 쓰세요. K8s, 파일 경로, URL 등이 해당합니다.
  • 대화: 단일 내레이터 책에서는 문단마다 화자를 한 명으로 제한하세요.
  • 각주 표시와 페이지 참조를 없애세요. TTS는 p. 247도 소리 내어 읽습니다.

텍스트로 오디오북 만들기: 장별 과정

TextSpeech에서 텍스트를 오디오북으로 변환하고 장별로 제작하는 방법입니다.

  1. Studio를 여세요. 프로젝트 전체에서 음성 ID 하나를 고정하고 메모 파일에 이름을 적으세요.
  2. 1장만, 또는 15,000자 미만인 첫 블록을 붙여 넣으세요.
  3. 생성하세요. 처음, 중간, 끝을 확인하고 내보내기 전에 장 전체를 들으세요.
  4. 텍스트에서 발음을 수정하고 필요하면 해당 문단을 다시 생성하세요.
  5. 유료 요금제에서 텍스트를 MP3로를 통해 MP3를 내보내세요.
  6. 음성을 바꾸지 않고 2장도 반복하세요.

1.0x에서 시작해 같은 구절을 조금 다른 속도로 비교하세요. 이름, 대화, 쉼이 명확한 설정을 고르세요. 속도 수치만으로 품질을 판단할 수 없습니다.

계산 예시: 정리된 한 장

정리한 장이 12,500자라면 Basic/Pro의 생성당 15,000자 상한 안에 들어 한 번 생성할 수 있습니다. 이는 설명용 계산이며 제공되거나 테스트한 샘플이 아닙니다. 생성 전에 실제 장의 글자 수를 세세요.

  1. 3.4 Implementation detailsSection three point four. Implementation details.로 고치세요.
  2. 3열 표를 말로 읽을 문장 세 개로 바꾸세요.
  3. 생성 후 장 중간으로 이동하세요. 건조한 글을 “웃는 듯이” 읽는다면 2장 전에 음성 라이브러리에서 차분한 음성으로 바꾸세요. 나중으로 미루지 마세요.
  4. MP3를 내보내세요. 분당 영어 150단어로 가정하면 2,100단어는 약 14분입니다. 실제 음성의 누락과 쉼 길이를 확인하세요. 재생 시간만으로 품질을 진단할 수 없습니다.
  5. 2장도 같은 음성 ID, 같은 속도, 같은 내보내기 설정을 사용하세요.

EPUB에서 장 텍스트를 추출해 오디오북으로

TextSpeech는 EPUB이나 DOCX를 업로드할 수 없습니다. 각색 권한이 있고 DRM이 없는 EPUB은 다음 수동 과정을 사용하세요. 복사가 제한되면 허가된 DRM 없는 원본이나 원고를 구하세요. 이 과정은 DRM을 제거하지 않습니다. 탐색과 복사 명령은 calibre 뷰어 설명서에 나옵니다.

  1. 허가된 EPUB을 calibre에 추가하고 책을 선택한 뒤 보기를 눌러 전자책 뷰어를 여세요.
  2. 목차를 열고 장을 선택하세요. 사용할 목차가 없으면 장 제목을 찾고 다음 장의 시작 위치를 확인하세요.
  3. 장 텍스트를 선택하고 오른쪽 클릭 후 복사를 선택하세요. 긴 장은 작은 연속 구간으로 복사하고 처음과 마지막 문장을 대조해 누락과 중복을 피하세요.
  4. 먼저 일반 텍스트 편집기에 붙여 넣으세요. 탐색 문구, 주석, 중복 제목을 지우고 표를 고친 뒤 원문과 대조하세요. 글자 수를 세고 문단 경계에서 요금제 상한 미만으로 나누세요.
  5. 정리된 블록을 Studio에 붙이고 음성 설정을 유지한 채 듣고 수정한 후 유료 요금제로 MP3를 내보내세요. 순서대로 반복하고 장과 부분별로 이름을 붙이세요.

다음 경우 업로드 변환기를 사용하세요.

  • 책이 이미 올바른 장 표시를 갖춘 깔끔한 EPUB입니다.
  • 25번 붙여 넣는 대신 자동 장 감지와 하나의 처리 과정을 원합니다.
  • 해당 업체의 내레이터 구성과 상업 조건에 만족합니다.

다음 경우 Studio에 머무르세요.

  • 원고가 아직 Google Docs나 Word에 있습니다.
  • 음성 라이브러리에서 진행자 음성을 골랐고 YouTube 클립에도 같은 음성을 원합니다.
  • EPUB 목차를 디버깅하기보다 오늘 밤 한 장을 검수하고 싶습니다.

듣기, 품질 검수, 조립

배포 전에 다음 청취 검사를 하세요.

  • 나머지를 일괄 처리하기 전에 각 장을 한 번 끝까지 들으세요.
  • 파일 간 음량을 맞추세요. 1장의 피크를 −0.1 dB로 정규화하고 2장은 −12 dB로 남겨 두지 마세요.
  • 검수 기록을 남기세요. 타임스탬프, 문제, 수정 방법을 적습니다. 문장 바꾸기, 쉼표로 휴지 추가, 이름을 발음대로 쓰기 등이 있습니다.

TextSpeech는 MP3를 내보냅니다. 배포처의 인코딩, 음량, 무음, 크레디트, 파일 순서 요건을 확인하고 필요하면 오디오 편집기로 조정하세요. 기술적 마스터링은 AI 내레이션 배포 허가를 부여하지 않습니다.

출판과 배포

채널AI 내레이션 정책필요한 작업
자체 사이트 / 강의 / 팟캐스트권리와 호스트 규칙에 따름게시 전에 라이선스와 콘텐츠 규칙 확인
Google Play Books업로드 가이드에 AI 오디오북용 Synthesized voice 설정 제공내레이터 유형과 계정·콘텐츠·파일 요건 준수. Google 자동 내레이션 도구와 별개
Kobo Writing Life합성 음성 내레이터 메타데이터로 AI 허용저자와 내레이터 기여자를 기재하고 현재 업로드 요건 준수
ACX / ACX를 통한 Audible별도 허가 없이는 사람 내레이션 필수. 무허가 TTS·AI 금지허가 없이 TextSpeech 파일을 제출하지 않기. 마스터링만으로 자격이 생기지 않음

플랫폼이 요청하는 곳에서는 AI 내레이션을 고지하세요. 배포 규칙은 바뀌므로 출시일을 약속하기 전에 판매처의 작가 포털에서 확인하세요.

흔한 실수

  • 15,000자 제한 도구에서 책 전체를 한 번에 붙여 넣으려는 것.
  • 유료 상품에 Free 요금제 미리 듣기 오디오를 넣는 것. MP3도 상업 라이선스도 없습니다.
  • 1장이 “좀 더 활기차야 했다”며 4장에서 내레이터를 교체하는 것.
  • 음성 명료도, 음악 권리, 배포처 규칙을 확인하지 않고 음악을 넣는 것. 배경음악을 유지하기 전에 음성만 있는 버전과 비교하세요.
  • 유명인·캐릭터 음성을 공식 내레이터로 쓰는 것. 약관과 사칭 규칙을 확인하세요.

자주 묻는 질문

PDF나 EPUB을 업로드해야 하나요?

아니요. TextSpeech에는 원고 업로드가 없습니다. Word, Google Docs, Scrivener에서 복사해 Studio에 붙여 넣으세요. ElevenLabs Audiobooks와 AudiobookGen은 파일 업로드 중심이며, 이것이 EPUB을 오디오북으로 바꾸는 작업입니다.

Free 요금제로 완전한 오디오북을 만들 수 있나요?

생성당 500자의 짧은 블록을 미리 들을 수 있습니다. 장별 MP3를 제공하려면 유료 요금제가 필요합니다.

제 책은 파일 몇 개가 되나요?

정리된 각 장의 실제 글자 수를 세세요. 각 장의 글자 수를 요금제의 생성당 글자 수 상한으로 나누고 올림한 뒤 합산하세요. 이는 최소치입니다. 문단이나 장면 경계를 유지하면 파일이 더 필요할 수 있고, 재생성으로 추가 버전이 생길 수 있습니다.

전자책을 오디오북으로 바꾸는 변환기와 어떻게 다른가요?

변환기는 EPUB 가져오기와 장 감지를 자동화합니다. TextSpeech는 음성 선택, 감정 태그, YouTube에도 쓰는 동일한 Studio를 제공하는 대신 장을 수동으로 붙여 넣어야 합니다.

장을 YouTube에도 게시할 수 있나요?

네. 독창적인 대본과 편집은 여전히 중요합니다. YouTube에 AI 보이스오버 추가하는 방법을 보세요.

MP3와 WAV 중 무엇을 쓰나요?

TextSpeech 문서에 명시된 내보내기는 MP3입니다. 편집용 원본을 보관하세요. 손실 MP3를 WAV로 바꿔도 사라진 세부 정보는 복원되지 않습니다. 배포처 형식을 따르고 AI 내레이션 허용 여부는 별도로 확인하세요.

Studio에서 1장을 생성하세요. 휴대폰으로 5분째를 들어 보세요. 출퇴근길에 이 진행자를 듣고 싶지 않다면 2장 전에 음성을 바꾸세요.

이어서 읽기

Studio에서 한 줄 들어보기

음성을 고르고 스크립트를 붙여 넣은 뒤, 보내기 전에 테이크를 확인하세요.