Mein Hörbuch komplett kostenlos mit KI vertont – meine ehrliche Stolperstein-Liste
Letzten Monat schrieb mir eine Leserin: „Ich habe einen Roman mit gut 400 Seiten fertig, würde ihn gern als Hörbuch rausbringen – aber ein Sprecher will 1.500 bis 2.000 Euro. Gibt's da einen anderen Weg?"
Ich musste lächeln. Ich stand vor drei Monaten exakt am selben Punkt. Selbst sprechen? Nach Kapitel drei war meine Stimme weg. Profis buchen? Mein Konto hat gelacht. Am Ende habe ich meine eigene Stimme mit einem Tool zum Stimme klonen kostenlos dupliziert und das ganze Buch damit eingesprochen. Kosten: null Euro.
Hier ist der komplette Bericht – mit allen Fehlern, damit du sie nicht wiederholen musst.
Schritt 1: Nicht sofort generieren – erst das Skript in gesprochenes Deutsch verwandeln
Das war mein erster Patzer. Ich habe das Manuskript beherzt eingefügt, und die KI las seelenruhig „siehe Abbildung 4“ vor. Hm. Die Hörer*innen haben keine Abbildung 4.
Also, bevor du irgendetwas generierst:
- Alle visuellen Verweise raus: „siehe Tabelle“, „wie in der Grafik“, Fußnoten – alles weg.
- Lange Absätze teilen. Geschriebenes Deutsch lebt von Schachtelsätzen, gesprochenes nicht. Ein Satz mit vier Nebensätzen klingt gesprochen wie ein Atemnot-Seminar.
- Eigennamen und Fremdwörter vorher prüfen. Wenn die KI „Knoblauch“ oder einen französischen Ortsnamen verhaspelt, ist der Hörer raus.
- Zeichensetzung ernst nehmen. Kommas und Punkte steuern die Pausen. Ich hatte in einem Kapitel die Punkte vergessen – das Ergebnis klang wie ein deutscher Rap-Track. Nicht im guten Sinne.
Mein Trick: Ich lese den Text einmal laut selbst vor. Wo es sich für mich falsch anfühlt, klingt die KI noch falscher.
Schritt 2: Wessen Stimme soll's sein?
Zwei Wege. Entweder eine fertige KI-Stimme – schnell und unkompliziert – oder du klonst deine eigene Stimme und behältst den „Autoren-Sound“.
Ich habe Variante zwei gewählt. Beim Kostenlosen Stimmenklon online von web666 lädst du rund eine Minute eigene Aufnahme hoch – mehr braucht es nicht – und bekommst ein Sprachmodell, das Klangfarbe und Tempo ziemlich gut trifft. Als ich die erste generierte Passage gehört habe, war ich kurz irritiert: klang wie eine Podcast-Wiedergabe von mir selbst. Seltsames Gefühl, ehrlich gesagt.
Wer nicht seine eigene Stimme nehmen will, findet auf der Hauptseite von web666 jede Menge kostenlose TTS-Stimmen. Aber Achtung: Wähl nicht nur nach „klingt nett“. Du hörst diese Stimme über viele Stunden. Zu helle oder zu luftige Stimmen gehen auf die Nerven – ich habe zwei Stimmen nach einer halben Stunde wieder verworfen.
Übrigens ein Punkt, der hier in Deutschland relevant ist: Bei der Auswahl des Tools habe ich darauf geachtet, wie mit den Aufnahmen umgegangen wird. DSGVO-konform und ohne dass meine Sprachproben irgendwo für Training landen – das war für mich ein K.-o.-Kriterium. Klone nur deine eigene Stimme oder mit klarer schriftlicher Erlaubnis. Die Stimme einer anderen Person? Finger weg. Das ist rechtlich ein Minenfeld.
Schritt 3: Audio im Batch erzeugen
Stimme steht, los geht's. Mein Rat: kapitelweise arbeiten. Nicht 400 Seiten auf einmal reinwerfen – wenn du später ein Wort änderst, willst du nicht von vorn anfangen.
Der Ablauf:
- Text eines Kapitels in den Sprachgenerator kostenlos einfügen.
- Sprechgeschwindigkeit etwas runter. Ein Hörbuch ist kein Reel – ruhigeres Tempo trägt besser.
- Erst eine kurze Probe anhören. Erst dann das ganze Kapitel generieren. (Ja, ich habe das einmal ignoriert. Ja, es hat mich 20 Minuten gekostet.)
- Herunterladen, sauber benennen. Ich nutze „Kapitelnummer_Titel“ – sonst wirst du beim Schnitt verrückt.
web666 arbeitet ohne Registrierung – einfach den Browser öffnen und Text zu Sprache kostenlos nutzen. Für jemanden wie mich, der dreimal die Sprechgeschwindigkeit neu getestet hat, war das Gold wert. Du kannst direkt online mit der Sprachausgabe loslegen, ganz ohne Anmeldung.
Schritt 4: Schnitt – hier nicht faul sein
Das KI-Audio ist schon erstaunlich sauber. Aber der Unterschied zwischen „irgendwie okay“ und „richtig gut“ liegt im Schnitt.
- Zwischen Kapiteln 1–2 Sekunden Stille. Klingt sofort entspannter.
- Knackser und Rauschen am Anfang und Ende jedes Files wegschneiden.
- Lautstärke angleichen. Meine erste Version hatte kapitelweise unterschiedliche Pegel – eine Leserin meinte, „als ob jemand zwischendurch den Player wechselt“. Ouch.
- Kurzes Intro dazu: Titel, Autor, dazu gemaßfreie ruhige Musik (z. B. aus freien Musikarchiven mit CC-Lizenz – Lizenzen checken!).
Audacity reicht völlig und kostet nichts. Export als MP3 mit mindestens 192 kbps – das ist bei den meisten Plattformen die Untergrenze.
Schritt 5: Wohin damit?
Audio fertig, jetzt die Verbreitung:
- Eigene Kanäle: Blog, Website, Podcast-Plattformen wie Spotify for Creators – direkt hochladen.
- Hörbuch-Plattformen: Jeder Anbieter hat eigene Format- und Prüfregeln. Vorher lesen, erspart Frust.
- Kurzvideos als Türöffner: Ein paar Ausschnitte als TikTok, Instagram Reels oder YouTube Shorts – funktioniert erstaunlich gut, um Hörer zu finden.
Noch ein Hinweis: Einige Plattformen verlangen inzwischen eine Kennzeichnung von KI-generiertem Audio. Ehrlich kennzeichnen schadet nicht – und du bleibst aus der Schusslinie.
Häufige Fragen
Klappt Stimme klonen kostenlos wirklich brauchbar?
Ja – aber es hängt an deiner Quellaufnahme. Ruhiger Raum, nah am Mikro, natürlich sprechen: gute Ergebnisse. Am Handy auf der Straße schnell reingesprochen: Da rettet dich auch die beste KI nicht.
Ist ein KI-Hörbuch rechtlich okay?
Wenn der Text dir gehört (oder du eine Lizenz hast) und die Stimme deine eigene ist (oder autorisiert), ist alles gut. Umgekehrt – fremde Bücher, fremde Stimmen – das ist kein Tool-Problem, sondern deins.
Reicht die Qualität einer kostenlosen KI-Stimme für eine Veröffentlichung?
Ehrlich: An einen Profi-Sprecher kommt sie nicht ran. Aber im Alltagshören klingt sie schon sehr natürlich – vor allem, wenn du Pausen und Tempo sauber eingestellt hast. Kein einziger meiner Hörer hat gemerkt, dass es eine KI war. Bis ich es selbst zugegeben habe.
Zum Schluss
Nach dem letzten Kapitel habe ich Bilanz gezogen: Werkzeugkosten null, investierte Zeit zwei Wochenenden. Verglichen mit 1.500 Euro Sprecherhonorar – für mich ein klarer Deal.
Falls bei dir auch ein Manuskript liegt, das nie eingesprochen wurde: Fang heute Abend an. Erst Kapitel eins in gesprochenes Deutsch umschreiben, dann bei web666 eine eigene KI-Stimme erzeugen. Zehn Minuten später hörst du „dich“ dein eigenes Buch lesen – dieses Gefühl muss man mal gehabt haben.
Weitere Ideen und Tests habe ich in der Dynamic-Sammlung notiert – schau gern vorbei.