Kurzantwort: Ein KI-Hörbuch besteht aus Kapitel-Audio, das aus einem Manuskript erzeugt wird. Upload-Werkzeuge wie ElevenLabs Audiobooks nehmen EPUB-Dateien an und erkennen Kapitel. TextSpeech ist ein Hörbuchwerkzeug zum Einfügen von Text: Du kopierst aus Word oder Google Docs, fügst jeweils höchstens ein Kapitel ein, beachtest das Zeichenlimit pro Generierung und exportierst MP3 mit einem kostenpflichtigen Tarif. Das passt zu unabhängigen Kursen, Fortsetzungsromanen und Büchern im Podcast-Stil – nicht zu „90.000 Wörter hochladen und nach fünf Minuten eine fertige Datei erhalten“.
Es gibt zwei Arbeitsweisen. Ein KI-Hörbuchgenerator lädt EPUB- oder E-Book-Dateien hoch oder lässt dich Hörbücher kapitelweise aus Text erstellen. Prüfe, welche Variante du kaufst.
Am 14. September 2026 anhand offizieller Dokumentation geprüft. Dies ist ein dokumentierter Ablauf, kein eigener Hörvergleich. Du musst die Audiorechte am Text besitzen.
KI-Hörbuchwerkzeuge und EPUB-Konverter im Vergleich
| Plattform / Anleitung | Eingabe | Kapitelverarbeitung | Unterschied bei TextSpeech |
|---|---|---|---|
| ElevenLabs Audiobooks | EPUB-Upload | Automatische Kapitelerkennung; Besetzung mehrerer Figuren | Kein Datei-Upload: Text aus deinem Editor einfügen |
| AudiobookGen | EPUB-Upload | Konvertierungskette für das ganze Buch | Manuelle Kapitelaufteilung; du bestimmst die Textmenge |
| Audie.ai | Manuskript-Upload | Schwerpunkt auf mehrstimmiger Fiktion | Ablauf mit einer Erzählerstimme |
| TextSpeech | Im Browser einfügen | Du teilst an Kapitel- oder Szenengrenzen | Kostenlose Vorschau: 500 Zeichen pro Durchlauf; MP3 und kommerzielle Nutzung kostenpflichtig |
Womit TextSpeech ehrlich umgeht: Wir sind ein Browserstudio zum Einfügen kapitelgroßer Texte, kein EPUB-zu-Hörbuch-Konverter. Wenn du nach dem Upload alles automatisch erledigen lassen möchtest, passen ElevenLabs oder AudiobookGen zur Umwandlung von EPUB und E-Books. Für über 1.000 Stimmen, Emotions-Tags und dasselbe Werkzeug wie für KI-Voiceovers bleib im Studio – plane aber mehrere Exporte ein.
TextSpeech-Limits, die du einplanen musst
| Tarif | Zeichen / Generierung | Ungefähre englische Wörter | MP3-Export | Kommerzielle Nutzung |
|---|---|---|---|---|
| Free | 500 | 70–90 | Nur Vorschau | Nein |
| Basic / Pro | 15.000 | ~2.200–2.500 | Ja | Ja |
| Ultra | 30.000 | ~4.500–5.000 | Ja | Ja |
Eine Generierung ≠ ein Buch. Teile an Kapitel- oder Szenengrenzen, zähle die Zeichen je Block und plane Neugenerierungen sowie vollständige Hörkontrollen ein. Die MP3-Anzahl hängt von den tatsächlichen Kapitellängen ab, nicht nur von der gesamten Wortzahl.
Kostenloser Tarif: Teste damit die Erzählerstimme am Anfang des ersten Kapitels. Er ist nicht für eine verkaufsfertige Datei gedacht.
Was du vor dem Einfügen brauchst
- Audiorechte am Manuskript: eigenes Werk, lizenziertes Material oder überprüft gemeinfreier Text.
- Vergleiche dieselbe ganze Seite im Studio, einschließlich Dialog und schwieriger Namen. Erzähler im YouTube-Stil sind mögliche Kandidaten; wähle nach Aussprache, Tempo und Konsistenz in deinem Manuskript.
- Ein Namensschema:
01-chapter-one.mp3,02-chapter-two.mp3. - Basic, Pro oder Ultra für MP3-Export und kommerziellen Vertrieb. Siehe Nutzungsbedingungen.
Das Manuskript vorbereiten
Druckformatierung stört TTS. Erledige vor jedem Einfügen Folgendes:
- Entferne Überschriften oder schreibe sie sprechgerecht um:
Chapter 3→Chapter three, wenn Zahlen falsch vorgelesen werden. - Wandle Tabellen in gesprochene Listen um oder entferne sie.
- Schreibe Abkürzungen aus, die die Stimme falsch aussprechen würde (
K8s, Dateipfade, URLs). - Dialog: Bei Büchern mit einer Erzählerstimme spricht pro Absatz nur eine Figur.
- Entferne Fußnotenmarkierungen und Seitenverweise – TTS liest
p. 247laut vor.
Hörbücher aus Text erstellen: kapitelweiser Ablauf
So wandelst du mit TextSpeech Text in ein Hörbuch um und erstellst Hörbücher aus Text.
- Öffne Studio. Lege eine einzige Stimmen-ID für das gesamte Projekt fest. Notiere den Namen in einer Notizdatei.
- Füge nur Kapitel 1 ein oder den ersten Block mit weniger als 15.000 Zeichen.
- Generiere. Prüfe Anfang, Mitte und Ende und höre vor dem Export das ganze Kapitel an.
- Korrigiere Aussprachefehler im Text und generiere den Absatz bei Bedarf neu.
- Exportiere MP3 mit einem kostenpflichtigen Tarif über Text zu MP3.
- Wiederhole das für Kapitel 2, ohne die Stimme zu wechseln.
Beginne bei 1.0x und vergleiche dieselbe Passage mit leicht verändertem Tempo. Wähle eine Einstellung mit verständlichen Namen, Dialogen und Pausen; ein Tempowert allein belegt keine Qualität.
Beispielrechnung: ein bereinigtes Kapitel
Enthält ein bereinigtes Kapitel 12.500 Zeichen, passt es für eine Generierung unter das Basic/Pro-Limit von 15.000 Zeichen. Das ist eine Beispielrechnung, keine bereitgestellte oder getestete Probe. Zähle vor der Generierung die tatsächlichen Zeichen.
- Schreibe
3.4 Implementation detailsum zuSection three point four. Implementation details. - Mache aus einer dreispaltigen Tabelle drei gesprochene Sätze.
- Generiere und springe zur Kapitelmitte. Wenn die Stimme bei nüchternem Text „lächelt“, wähle vor Kapitel 2 eine ruhigere Stimme aus der Stimmenbibliothek, nicht danach.
- Exportiere MP3. Bei angenommenen 150 Wörtern pro Minute ergeben 2.100 englische Wörter etwa 14 Minuten. Prüfe Auslassungen und Pausen im tatsächlichen Audio; die Dauer allein erlaubt keine Qualitätsdiagnose.
- Kapitel 2: gleiche Stimmen-ID, gleiches Tempo, gleiche Exporteinstellungen.
Von EPUB über Kapiteltext zum Hörbuch
TextSpeech kann keine EPUB- oder DOCX-Dateien hochladen. Für ein DRM-freies EPUB, das du bearbeiten darfst, nutze diesen manuellen Weg. Ist Kopieren gesperrt, besorge eine autorisierte DRM-freie Quelle oder das Originalmanuskript; dieser Ablauf entfernt kein DRM. Navigation und Kopieren beschreibt das calibre-Viewer-Handbuch.
- Füge das autorisierte EPUB zu calibre hinzu, wähle das Buch und öffne es mit Anzeigen im E-Book-Betrachter.
- Öffne das Inhaltsverzeichnis und wähle das Kapitel. Fehlt ein brauchbares Verzeichnis, suche die Überschrift und prüfe, wo das nächste Kapitel beginnt.
- Markiere den Kapiteltext, klicke rechts und wähle Kopieren. Kopiere lange Kapitel in kleineren aufeinanderfolgenden Abschnitten und prüfe deren erste und letzte Sätze auf Lücken oder Dopplungen.
- Füge zunächst in einen Klartexteditor ein. Entferne Navigation, Anmerkungen und doppelte Überschriften, passe Tabellen an und gleiche den Text ab. Zähle Zeichen und teile an Absatzgrenzen unterhalb des Tariflimits.
- Füge den bereinigten Block in Studio ein, behalte die Stimmeinstellungen bei, höre vor und korrigiere, dann exportiere MP3 mit einem kostenpflichtigen Tarif. Wiederhole in Reihenfolge und benenne nach Kapitel und Teil.
Nutze einen Upload-Konverter, wenn:
- Das Buch bereits als sauberes EPUB mit echten Kapitelmarken vorliegt.
- Du automatische Kapitelerkennung und einen einzigen Ablauf möchtest, nicht 25 Einfügevorgänge.
- Dir die Stimmenauswahl und kommerziellen Bedingungen des Anbieters passen.
Bleib im Studio, wenn:
- Das Manuskript noch in Google Docs oder Word liegt.
- Du bereits eine Hauptstimme in der Stimmenbibliothek ausgewählt hast und dieselbe für YouTube-Clips möchtest.
- Du heute lieber ein Kapitel prüfst, als das EPUB-Inhaltsverzeichnis zu reparieren.
Anhören, prüfen und zusammenstellen
Führe vor dem Vertrieb diese Hörkontrollen durch:
- Höre jedes Kapitel einmal vollständig an, bevor du den Rest stapelweise verarbeitest.
- Gleiche die Lautheit der Dateien an: Normalisiere nicht die Spitzen von Kapitel 1 auf −0,1 dB und lasse Kapitel 2 bei −12 dB.
- Führe ein Prüfprotokoll mit Zeitstempel, Problem und Korrektur, etwa Satz umformulieren, Kommapause setzen oder Namen phonetisch schreiben.
TextSpeech exportiert MP3. Prüfe Vorgaben des Ziels zu Codierung, Lautheit, Stille, Credits und Dateireihenfolge und passe bei Bedarf mit einem Audioeditor an. Technisches Mastering erteilt keine Erlaubnis zum Vertrieb von KI-Erzählung.
Veröffentlichen und vertreiben
| Kanal | Regel für KI-Erzählung | Vorgehen |
|---|---|---|
| Eigene Website / Kurs / Podcast | Abhängig von Rechten und Hostregeln | Lizenzen und Inhaltsregeln vor Veröffentlichung prüfen |
| Google Play Books | Upload-Anleitung bietet Synthesized voice für KI-Hörbücher | Erzählertyp korrekt setzen und Konto-, Inhalts- und Dateivorgaben erfüllen; getrennt von Googles automatischem Erzählwerkzeug |
| Kobo Writing Life | Akzeptiert KI mit Metadaten für synthetische Erzählerstimmen | Autor und Erzähler angeben und aktuelle Upload-Vorgaben beachten |
| ACX / Audible über ACX | Menschliche Erzählung erforderlich, sofern nicht anders genehmigt; unerlaubte TTS/KI verboten | TextSpeech-Export nicht ohne Genehmigung einreichen; Mastering allein macht ihn nicht zulässig |
Kennzeichne KI-Erzählung überall, wo die Plattform es verlangt. Vertriebsregeln ändern sich: Prüfe das Autorenportal des Händlers, bevor du einen Veröffentlichungstermin versprichst.
Häufige Fehler
- Bei einem Limit von 15.000 Zeichen das ganze Buch auf einmal einfügen wollen.
- Kostenlose Vorschau-Audios in einem kostenpflichtigen Produkt ausliefern: kein MP3, keine kommerzielle Lizenz.
- In Kapitel 4 die Erzählerstimme wechseln, weil Kapitel 1 „mehr Energie brauchte“.
- Musik hinzufügen, ohne Sprachverständlichkeit, Musikrechte und Zielvorgaben zu prüfen. Vergleiche mit einer reinen Sprachfassung, bevor du Hintergrundmusik behältst.
- Prominenten- oder Figurenstimmen als offiziellen Hörbuchsprecher nutzen: siehe Nutzungsbedingungen und Regeln gegen Identitätsvortäuschung.
Häufig gestellte Fragen
Muss ich ein PDF oder EPUB hochladen?
Nein. TextSpeech bietet keinen Manuskript-Upload. Kopiere aus Word, Google Docs oder Scrivener und füge im Studio ein. Mitbewerber wie ElevenLabs Audiobooks und AudiobookGen bauen auf Datei-Upload auf – das ist die Umwandlung von EPUB in Hörbücher.
Kann ich mit dem Free-Tarif ein vollständiges Hörbuch erstellen?
Du kannst kurze Blöcke mit 500 Zeichen pro Generierung vorhören. Für die Auslieferung von Kapitel-MP3s brauchst du einen kostenpflichtigen Tarif.
Wie viele Dateien umfasst mein Buch?
Zähle die tatsächlichen Zeichen jedes bereinigten Kapitels. Teile jeden Wert durch das Zeichenlimit deines Tarifs pro Generierung, runde auf und addiere die Ergebnisse. Das ist ein Minimum: Absatz- oder Szenengrenzen können zusätzliche Dateien erfordern; Neugenerierungen können weitere Versionen erzeugen.
Wie unterscheidet sich das von einem E-Book-zu-Hörbuch-Konverter?
Konverter automatisieren EPUB-Import und Kapitelerkennung. TextSpeech bietet Stimmenwahl, Emotions-Tags und dasselbe Studio wie für YouTube – dafür musst du Kapitel manuell einfügen.
Kann ich Kapitel auch auf YouTube veröffentlichen?
Ja, ein eigenes Skript und Schnitt bleiben wichtig. Siehe KI-Voiceovers zu YouTube hinzufügen.
MP3 oder WAV?
Der dokumentierte TextSpeech-Export ist MP3. Bewahre die Originaldatei zur Bearbeitung auf; Umwandlung eines verlustbehafteten MP3 in WAV stellt verlorene Details nicht wieder her. Wähle das geforderte Zielformat und prüfe die Zulässigkeit von KI-Erzählung separat.
Generiere Kapitel eins im Studio. Höre Minute fünf auf einem Smartphone. Wenn du dieser Stimme unterwegs nicht zuhören würdest, ändere sie vor Kapitel zwei.


