要点: AIオーディオブックとは、原稿から生成した章ごとの音声です。ElevenLabs Audiobooksなどのアップロード型ツールはEPUBを取り込み、章を検出します。TextSpeechは貼り付け型のオーディオブック制作ツールです。WordやGoogleドキュメントからテキストをコピーし、一度に1章以下を貼り付け、生成ごとの文字数上限を守って、有料プランでMP3を書き出します。個人制作の講座、連載小説、ポッドキャスト風の本に向いています。「英語9万語の小説をアップロードし、5分で1ファイルにする」用途ではありません。
作業には2種類あります。AIオーディオブック生成・制作ツールには、EPUBや電子書籍ファイルをアップロードするものと、テキストから1章ずつ制作するものがあります。購入するのがどちらか把握しましょう。
2026年9月14日に公式文書を確認。本稿は文書に基づく手順であり、実際の試聴比較ではありません。テキストの音声化権利が必要です。
AIオーディオブックツールとEPUB変換ツールの比較
| プラットフォーム/ガイド | 入力方法 | 章の処理 | TextSpeechとの違い |
|---|---|---|---|
| ElevenLabs Audiobooks | EPUBをアップロード | 章を自動検出、複数キャラクターに配役 | ファイルのアップロードなし、エディターから貼り付け |
| AudiobookGen | EPUBをアップロード | 本全体の変換工程 | 手動で章を分割し、貼り付け量を調整 |
| Audie.ai | 原稿をアップロード | 複数の声によるフィクション重視 | 1人のナレーターによる工程 |
| TextSpeech | ブラウザーで貼り付け | 章・場面の区切りで自分で分割 | 無料試聴は1回500文字、有料でMP3と商用利用 |
TextSpeechが正直に伝えること:私たちは章単位のテキストを貼り付けるブラウザースタジオであり、EPUB変換ツールではありません。アップロード後は任せたいなら、ElevenLabsやAudiobookGenがEPUB・電子書籍の音声化に合います。1,000種類以上の声、感情タグ、AIナレーションと同じツールを使いたいならStudioを使いましょう。ただし、複数回の書き出しを予定してください。
計画に織り込むべきTextSpeechの上限
| プラン | 1回の生成文字数 | 英語の概算語数 | MP3書き出し | 商用利用 |
|---|---|---|---|---|
| Free | 500 | 70–90 | 試聴のみ | 不可 |
| Basic / Pro | 15,000 | 約2,200–2,500 | 可 | 可 |
| Ultra | 30,000 | 約4,500–5,000 | 可 | 可 |
**1回の生成≠1冊。**章や場面の区切りで分け、各ブロックの文字数を数え、再生成と全編確認の時間を確保します。MP3数は総語数だけでなく実際の章の長さで決まります。
無料プランは第1章の冒頭でナレーターを試すために使いましょう。販売用ファイルの納品には使えません。
貼り付ける前に必要なもの
- 原稿の音声化の権利。自作、許諾済み素材、または確認済みのパブリックドメイン作品が対象です。
- Studioで会話や難しい名前を含む同じ1ページを比較します。YouTube風ナレーターも試聴候補です。自分の原稿で発音、テンポ、一貫性を確認して選びます。
- 命名規則:
01-chapter-one.mp3、02-chapter-two.mp3。 - MP3書き出しと商用配信にはBasic、Pro、Ultraが必要です。利用規約を参照してください。
原稿を整える
印刷向けの書式はTTSの妨げになります。貼り付ける前に次を行います。
- 見出しを削除するか読み上げ用に修正。数字の読みが不適切なら、
Chapter 3→Chapter threeとします。 - 表を口頭のリストに変えるか削除します。
- 読み間違えそうな略語を展開します(
K8s、ファイルパス、URLなど)。 - **会話:**1人のナレーターで読む本では、1段落につき話者を1人にします。
- 脚注記号やページ参照を削除します。TTSは
p. 247まで読み上げます。
テキストからオーディオブックを作る:章ごとの手順
TextSpeechでテキストをオーディオブックに変換し、章ごとに制作する流れです。
- Studioを開き、プロジェクト全体で1つの音声IDを固定します。名前をメモファイルに記録します。
- 第1章だけ、または15,000文字未満の最初のブロックを貼り付けます。
- 生成します。冒頭、中盤、末尾を確認し、書き出し前に章全体を聞きます。
- 発音の誤りをテキストで修正し、必要ならその段落を再生成します。
- 有料プランでテキストからMP3を使い、MP3を書き出します。
- 声を変えずに第2章も繰り返します。
まず 1.0x で始め、同じ文章を少し異なる速度でも比較します。名前、会話、間が明瞭な設定を選びます。速度の数値だけでは品質は判断できません。
計算例:整えた章
整えた章が12,500文字なら、Basic/Proの1回15,000文字の上限内に収まります。これは説明用の計算であり、提供済みまたはテスト済みのサンプルではありません。生成前に実際の文字数を数えてください。
3.4 Implementation detailsをSection three point four. Implementation details.に書き換えます。- 3列の表を3つの読み上げ文にします。
- 生成して章の中盤へ移動します。硬い文章なのに声が「笑顔」なら、第2章の前に音声ライブラリで落ち着いた声へ変更します。後回しにしません。
- MP3を書き出します。毎分150英単語と仮定すると2,100語は約14分です。実際の音声で抜けや間の長さを確認してください。長さだけでは品質を判断できません。
- 第2章も音声ID、速度、書き出し設定を同じにします。
EPUBから章のテキストを取り出して音声化する
TextSpeechにはEPUBやDOCXをアップロードできません。音声化の許諾がありDRMのないEPUBは、次の手動手順を使えます。コピーが制限される場合は、正当に入手できるDRMなし版や元の原稿を用意してください。この手順はDRMを解除しません。操作はcalibreビューアーの公式マニュアルに記載されています。
- 許諾済みのEPUBをcalibreに追加し、本を選んで「表示」から電子書籍ビューアーを開きます。
- 目次を開き章を選びます。使える目次がなければ章見出しを探し、次の章の開始位置を確認します。
- 章のテキストを選択し、右クリックで「コピー」を選びます。長い章は連続した小区分に分け、各区分の最初と最後の文で抜けや重複を確認します。
- まずプレーンテキストエディターへ貼り付けます。ナビゲーション、注記、重複見出しを除き、表を書き換えて内容を照合します。文字数を数え、段落の境界でプラン上限未満に分割します。
- 整えたブロックをStudioに貼り、同じ音声設定で試聴・修正して、有料プランでMP3を書き出します。順番に繰り返し、章とパートで命名します。
次の場合はアップロード型変換ツールを使いましょう。
- 適切な章マークを持つ、整ったEPUBがすでにある。
- 25回貼り付けるのではなく、章の自動検出と一連の工程が欲しい。
- その業者のナレーターと商用条件で問題ない。
次の場合はStudioが向いています。
- 原稿がまだGoogleドキュメントやWordにある。
- 音声ライブラリでメインの声を決めていて、YouTubeの短い動画にも同じ声を使いたい。
- EPUBの目次を修正するより、今夜1章の品質を確認したい。
聞いて、品質確認して、まとめる
配信前に次の試聴確認を行います。
- 残りをまとめて処理する前に、各章を一度最後まで聞きます。
- ファイル間のラウドネスを揃えます。第1章のピークを−0.1 dBに正規化し、第2章を−12 dBのままにしないでください。
- 品質確認ログに時刻、問題、修正を記録します。文の言い換え、コンマによる間、名前の発音表記などです。
TextSpeechはMP3を書き出します。配信先のエンコード、ラウドネス、無音、クレジット、ファイル順序の要件を確認し、必要なら音声編集ソフトで調整します。マスタリングをしてもAIナレーションの配信許可は得られません。
公開と配信
| 配信先 | AIナレーションの方針 | 必要な対応 |
|---|---|---|
| 自分のサイト/講座/ポッドキャスト | 権利とホストの規則による | 公開前に許諾とコンテンツ規則を確認 |
| Google Play Books | アップロード手順にAI音声用のSynthesized voice設定あり | ナレーター種別を正しく指定し、アカウント・内容・ファイル要件を満たす。Googleの自動ナレーション機能とは別 |
| Kobo Writing Life | 合成音声のナレーターメタデータでAIを受け付ける | 著者とナレーターを登録し、最新のアップロード要件に従う |
| ACX/ACX経由のAudible | 別途許可がなければ人間のナレーションが必須。無許可のTTS・AIは禁止 | 許可なくTextSpeechの音声を提出しない。マスタリングだけで資格は得られない |
プラットフォームが求める場合はAIナレーションを開示します。配信規則は変わるため、発売日を約束する前に販売店の著者ポータルで確認してください。
よくある失敗
- 15,000文字上限のツールで本全体を一度に貼り付けようとする。
- 有料商品に無料プランの試聴音声を使う。MP3も商用ライセンスもありません。
- 第1章に「もっと元気が必要だった」と、第4章でナレーターを変更する。
- 声の聞き取りやすさ、音楽の権利、配信先の規則を確認せずBGMを追加すること。採用前に音声のみの版と比較します。
- 有名人やキャラクターの声を正式なナレーターに使う。利用規約となりすましのルールを確認してください。
よくある質問
PDFやEPUBをアップロードする必要がありますか?
いいえ。TextSpeechには原稿アップロード機能はありません。Word、Googleドキュメント、Scrivenerからコピーし、Studioへ貼り付けます。ElevenLabs AudiobooksやAudiobookGenなどはファイルのアップロードを中心に設計されており、それがEPUB変換の用途です。
Freeプランで本1冊を作れますか?
1回500文字の短いブロックを試聴できます。章のMP3を納品するには有料プランが必要です。
本は何個のファイルになりますか?
整えた各章の実際の文字数を数えます。各章をプランの1回の文字数上限で割って切り上げ、合計してください。これは最小値です。段落や場面の区切りを保つとファイルが増える場合があり、再生成で追加版が生まれることもあります。
電子書籍をオーディオブックにする変換ツールとの違いは?
変換ツールはEPUBの取り込みと章検出を自動化します。TextSpeechは声の選択、感情タグ、YouTubeでも使う同じStudioを提供する代わりに、章を手動で貼り付ける必要があります。
章をYouTubeにも公開できますか?
はい。ただしオリジナルの台本と編集は引き続き大切です。YouTubeにAIナレーションを追加する方法をご覧ください。
MP3とWAVのどちらですか?
TextSpeechの文書上の書き出し形式はMP3です。編集用に元ファイルを保存してください。非可逆MP3をWAVに変換しても失われた細部は戻りません。配信先の指定形式を使い、AI音声の受け入れ可否は別に確認します。
Studioで第1章を生成し、スマートフォンで5分目を聞いてください。通勤中にこの声を聞きたくないなら、第2章の前に変更しましょう。


