• AIオーディオブック
  • AIオーディオブック生成ツール

テキストやEPUBからAIオーディオブックを作る方法

AIオーディオブック生成ツールは、テキストやEPUB、本を章ごとの音声に変換します。TextSpeechはテキストを貼り付ける制作ツールで、アップロード後に全自動で処理するEPUB変換ツールではありません。

TextSpeechチーム10分で読める
本、ヘッドホン、デスクライトと音声波形を表示する画面

要点: AIオーディオブックとは、原稿から生成した章ごとの音声です。ElevenLabs Audiobooksなどのアップロード型ツールはEPUBを取り込み、章を検出します。TextSpeechは貼り付け型のオーディオブック制作ツールです。WordやGoogleドキュメントからテキストをコピーし、一度に1章以下を貼り付け、生成ごとの文字数上限を守って、有料プランでMP3を書き出します。個人制作の講座、連載小説、ポッドキャスト風の本に向いています。「英語9万語の小説をアップロードし、5分で1ファイルにする」用途ではありません。

作業には2種類あります。AIオーディオブック生成・制作ツールには、EPUBや電子書籍ファイルをアップロードするものと、テキストから1章ずつ制作するものがあります。購入するのがどちらか把握しましょう。

2026年9月14日に公式文書を確認。本稿は文書に基づく手順であり、実際の試聴比較ではありません。テキストの音声化権利が必要です。

AIオーディオブックツールとEPUB変換ツールの比較

プラットフォーム/ガイド入力方法章の処理TextSpeechとの違い
ElevenLabs AudiobooksEPUBをアップロード章を自動検出、複数キャラクターに配役ファイルのアップロードなし、エディターから貼り付け
AudiobookGenEPUBをアップロード本全体の変換工程手動で章を分割し、貼り付け量を調整
Audie.ai原稿をアップロード複数の声によるフィクション重視1人のナレーターによる工程
TextSpeechブラウザーで貼り付け章・場面の区切りで自分で分割無料試聴は1回500文字、有料でMP3と商用利用

TextSpeechが正直に伝えること:私たちは章単位のテキストを貼り付けるブラウザースタジオであり、EPUB変換ツールではありません。アップロード後は任せたいなら、ElevenLabsやAudiobookGenがEPUB・電子書籍の音声化に合います。1,000種類以上の声、感情タグAIナレーションと同じツールを使いたいならStudioを使いましょう。ただし、複数回の書き出しを予定してください。

計画に織り込むべきTextSpeechの上限

プラン1回の生成文字数英語の概算語数MP3書き出し商用利用
Free50070–90試聴のみ不可
Basic / Pro15,000約2,200–2,500
Ultra30,000約4,500–5,000

**1回の生成≠1冊。**章や場面の区切りで分け、各ブロックの文字数を数え、再生成と全編確認の時間を確保します。MP3数は総語数だけでなく実際の章の長さで決まります。

無料プランは第1章の冒頭でナレーターを試すために使いましょう。販売用ファイルの納品には使えません。

貼り付ける前に必要なもの

  • 原稿の音声化の権利。自作、許諾済み素材、または確認済みのパブリックドメイン作品が対象です。
  • Studioで会話や難しい名前を含む同じ1ページを比較します。YouTube風ナレーターも試聴候補です。自分の原稿で発音、テンポ、一貫性を確認して選びます。
  • 命名規則:01-chapter-one.mp302-chapter-two.mp3
  • MP3書き出しと商用配信にはBasic、Pro、Ultraが必要です。利用規約を参照してください。

原稿を整える

印刷向けの書式はTTSの妨げになります。貼り付ける前に次を行います。

  • 見出しを削除するか読み上げ用に修正。数字の読みが不適切なら、Chapter 3Chapter threeとします。
  • を口頭のリストに変えるか削除します。
  • 読み間違えそうな略語を展開します(K8s、ファイルパス、URLなど)。
  • **会話:**1人のナレーターで読む本では、1段落につき話者を1人にします。
  • 脚注記号やページ参照を削除します。TTSはp. 247まで読み上げます。

テキストからオーディオブックを作る:章ごとの手順

TextSpeechでテキストをオーディオブックに変換し、章ごとに制作する流れです。

  1. Studioを開き、プロジェクト全体で1つの音声IDを固定します。名前をメモファイルに記録します。
  2. 第1章だけ、または15,000文字未満の最初のブロックを貼り付けます。
  3. 生成します。冒頭、中盤、末尾を確認し、書き出し前に章全体を聞きます。
  4. 発音の誤りをテキストで修正し、必要ならその段落を再生成します。
  5. 有料プランでテキストからMP3を使い、MP3を書き出します。
  6. 声を変えずに第2章も繰り返します。

まず 1.0x で始め、同じ文章を少し異なる速度でも比較します。名前、会話、間が明瞭な設定を選びます。速度の数値だけでは品質は判断できません。

計算例:整えた章

整えた章が12,500文字なら、Basic/Proの1回15,000文字の上限内に収まります。これは説明用の計算であり、提供済みまたはテスト済みのサンプルではありません。生成前に実際の文字数を数えてください。

  1. 3.4 Implementation detailsSection three point four. Implementation details.に書き換えます。
  2. 3列の表を3つの読み上げ文にします。
  3. 生成して章の中盤へ移動します。硬い文章なのに声が「笑顔」なら、第2章の前に音声ライブラリで落ち着いた声へ変更します。後回しにしません。
  4. MP3を書き出します。毎分150英単語と仮定すると2,100語は約14分です。実際の音声で抜けや間の長さを確認してください。長さだけでは品質を判断できません。
  5. 第2章も音声ID、速度、書き出し設定を同じにします。

EPUBから章のテキストを取り出して音声化する

TextSpeechにはEPUBやDOCXをアップロードできません。音声化の許諾がありDRMのないEPUBは、次の手動手順を使えます。コピーが制限される場合は、正当に入手できるDRMなし版や元の原稿を用意してください。この手順はDRMを解除しません。操作はcalibreビューアーの公式マニュアルに記載されています。

  1. 許諾済みのEPUBをcalibreに追加し、本を選んで「表示」から電子書籍ビューアーを開きます。
  2. 目次を開き章を選びます。使える目次がなければ章見出しを探し、次の章の開始位置を確認します。
  3. 章のテキストを選択し、右クリックで「コピー」を選びます。長い章は連続した小区分に分け、各区分の最初と最後の文で抜けや重複を確認します。
  4. まずプレーンテキストエディターへ貼り付けます。ナビゲーション、注記、重複見出しを除き、表を書き換えて内容を照合します。文字数を数え、段落の境界でプラン上限未満に分割します。
  5. 整えたブロックをStudioに貼り、同じ音声設定で試聴・修正して、有料プランでMP3を書き出します。順番に繰り返し、章とパートで命名します。

次の場合はアップロード型変換ツールを使いましょう。

  • 適切な章マークを持つ、整ったEPUBがすでにある。
  • 25回貼り付けるのではなく、章の自動検出と一連の工程が欲しい。
  • その業者のナレーターと商用条件で問題ない。

次の場合はStudioが向いています。

  • 原稿がまだGoogleドキュメントやWordにある。
  • 音声ライブラリでメインの声を決めていて、YouTubeの短い動画にも同じ声を使いたい。
  • EPUBの目次を修正するより、今夜1章の品質を確認したい。

聞いて、品質確認して、まとめる

配信前に次の試聴確認を行います。

  • 残りをまとめて処理する前に、各章を一度最後まで聞きます。
  • ファイル間のラウドネスを揃えます。第1章のピークを−0.1 dBに正規化し、第2章を−12 dBのままにしないでください。
  • 品質確認ログに時刻、問題、修正を記録します。文の言い換え、コンマによる間、名前の発音表記などです。

TextSpeechはMP3を書き出します。配信先のエンコード、ラウドネス、無音、クレジット、ファイル順序の要件を確認し、必要なら音声編集ソフトで調整します。マスタリングをしてもAIナレーションの配信許可は得られません。

公開と配信

配信先AIナレーションの方針必要な対応
自分のサイト/講座/ポッドキャスト権利とホストの規則による公開前に許諾とコンテンツ規則を確認
Google Play Booksアップロード手順にAI音声用のSynthesized voice設定ありナレーター種別を正しく指定し、アカウント・内容・ファイル要件を満たす。Googleの自動ナレーション機能とは別
Kobo Writing Life合成音声のナレーターメタデータでAIを受け付ける著者とナレーターを登録し、最新のアップロード要件に従う
ACX/ACX経由のAudible別途許可がなければ人間のナレーションが必須。無許可のTTS・AIは禁止許可なくTextSpeechの音声を提出しない。マスタリングだけで資格は得られない

プラットフォームが求める場合はAIナレーションを開示します。配信規則は変わるため、発売日を約束する前に販売店の著者ポータルで確認してください。

よくある失敗

  • 15,000文字上限のツールで本全体を一度に貼り付けようとする
  • 有料商品に無料プランの試聴音声を使う。MP3も商用ライセンスもありません。
  • 第1章に「もっと元気が必要だった」と、第4章でナレーターを変更する
  • 声の聞き取りやすさ、音楽の権利、配信先の規則を確認せずBGMを追加すること。採用前に音声のみの版と比較します。
  • 有名人やキャラクターの声を正式なナレーターに使う。利用規約となりすましのルールを確認してください。

よくある質問

PDFやEPUBをアップロードする必要がありますか?

いいえ。TextSpeechには原稿アップロード機能はありません。Word、Googleドキュメント、Scrivenerからコピーし、Studioへ貼り付けます。ElevenLabs AudiobooksやAudiobookGenなどはファイルのアップロードを中心に設計されており、それがEPUB変換の用途です。

Freeプランで本1冊を作れますか?

1回500文字の短いブロックを試聴できます。章のMP3を納品するには有料プランが必要です。

本は何個のファイルになりますか?

整えた各章の実際の文字数を数えます。各章をプランの1回の文字数上限で割って切り上げ、合計してください。これは最小値です。段落や場面の区切りを保つとファイルが増える場合があり、再生成で追加版が生まれることもあります。

電子書籍をオーディオブックにする変換ツールとの違いは?

変換ツールはEPUBの取り込みと章検出を自動化します。TextSpeechは声の選択、感情タグ、YouTubeでも使う同じStudioを提供する代わりに、章を手動で貼り付ける必要があります。

章をYouTubeにも公開できますか?

はい。ただしオリジナルの台本と編集は引き続き大切です。YouTubeにAIナレーションを追加する方法をご覧ください。

MP3とWAVのどちらですか?

TextSpeechの文書上の書き出し形式はMP3です。編集用に元ファイルを保存してください。非可逆MP3をWAVに変換しても失われた細部は戻りません。配信先の指定形式を使い、AI音声の受け入れ可否は別に確認します。

Studioで第1章を生成し、スマートフォンで5分目を聞いてください。通勤中にこの声を聞きたくないなら、第2章の前に変更しましょう。

関連ガイド

Studioで一文試す

声を選び、台本を貼って、書き出す前にテイクを確認できます。