AI Hörbuch Studio
Verwandle ein fertiges Buch in ein mehrstimmiges Hörbuch: Eine eigene KI-Stimme für jeden Charakter, emotionsbewusste Wiedergabe, ein Studio, in dem du jeden einzelnen Absatz nachbearbeiten kannst, und ein gemasterter Export, der bereit für den Verkauf ist.
Gib jedem Charakter seine eigene Stimme
Wähle ein Buch, bestimme einen Erzähler und das Studio besetzt deine Charaktere automatisch, rendert das Hörbuch Kapitel für Kapitel und mastert es in Dateien, die du direkt veröffentlichen kannst.
So funktioniert es
Wähle dein Buch
Wähle ein beliebiges fertiges Buch aus deiner Bibliothek – Belletristik, Sachbuch oder ein visuelles Buch. Der Kapiteltext in deinem Editor dient als Skript, sodass nichts kopiert oder neu hochgeladen werden muss.
Wähle deine Erzählstimme
Jedes Hörbuch wird mit ElevenLabs v3 vertont, unserem hochwertigsten Modell, das Emotions-Tags versteht. Wähle deine Erzählstimme aus 25 professionellen Stimmen, jede mit einer Vorschau, die du abspielen kannst, bevor du ein Guthaben verbrauchst.
Überprüfe die Besetzung
Das Studio liest das Buch, erkennt, wer welche Zeile spricht, und schlägt eine Stimme für jeden Charakter vor. Du überprüfst die Besetzungsliste und kannst jede Stimme austauschen, bevor auch nur eine Sekunde Audio gerendert wird.
Kapitel für Kapitel rendern
Kapitel werden nacheinander gerendert, damit du beim Erstellen zuhören, anhalten, anpassen und fortfahren kannst. Nichts zwingt dich dazu, das ganze Buch auf einmal fertigzustellen.
Jeden Absatz feinabstimmen
Hörst du eine Zeile, die dir nicht gefällt? Generiere sie einzeln für ein paar Credits neu oder nimm sie zusammen mit den benachbarten Zeilen neu auf, damit die Betonung weiterhin passt. In jedem Fall bleibt der Rest des Kapitels genau so, wie er war.
Gemasterte Dateien exportieren
Jedes Kapitel wird in deinem Browser auf die von dir gewählte Voreinstellung lautstärkemäßig gemastert – Hörbuch-Handel (-19 LUFS) oder Streaming (-14 LUFS) – und mit 128, 192 oder 256 kbps kodiert. Exportiere es als eine zusammengeführte MP3 mit einer Kapitelmarkierungsdatei, als ZIP mit nummerierten MP3s pro Kapitel oder als M4B mit integrierten Kapitelmarkierungen, jeweils mit deinem Titel, Autor und Cover.
Was das Studio leistet
Alles Folgende geschieht direkt in AIWriteBook – keine separate DAW, keine Synchronsprecher, keine Aufnahmesitzungen.
Eine Stimme pro Charakter
Dialoge werden automatisch nach Sprecher annotiert und dann verschiedenen Stimmen zugewiesen. Du behältst die Kontrolle: Die Besetzungsliste kannst du vor dem Rendering prüfen und ändern.
25 professionelle Stimmen, alle mehrsprachig
Elf weibliche, dreizehn männliche und eine neutrale Erzählerstimme. Die Akzent-Labels — amerikanisch, britisch, australisch, schwedisch — beschreiben, wie eine Stimme klingt, nicht was sie lesen kann: Jede Stimme erzählt in der Sprache, in der dein Buch geschrieben ist. Höre dir jede davon auf Englisch oder auf Französisch, Spanisch, Deutsch, Italienisch, Portugiesisch, Japanisch oder Norwegisch an, bevor du dich entscheidest.
Emotionsbewusste Wiedergabe
Das Studio fügt dem Skript Emotions-Tags hinzu, wo die Szene es erfordert, sodass eine geflüsterte Zeile als Flüstern und eine geschriene als Schrei ankommt.
Ganze Szenen in einem Take aufgenommen
Benachbarte Absätze werden zusammen in einer einzigen Anfrage vertont, sodass die Stimmen aufeinander reagieren und das Tempo über eine Szene hinweg beibehalten wird, anstatt bei jedem Absatz neu anzusetzen.
Chirurgische Absatz-Regeneration
Rendere einen einzelnen Absatz neu, anstatt das ganze Kapitel. Das Korrigieren einer schlechten Zeile kostet dich nur eine Zeile, keine Stunde.
Mastered-Export in Handelsqualität
Lautstärkenormalisierung auf einen Zielwert für den Handel (-19 LUFS) oder Streaming (-14 LUFS) sowie MP3- oder M4B-Kodierung mit 128, 192 oder 256 kbps werden auf jedes Kapitel angewendet – genau das Format, das Distributoren von einem fertigen Hörbuch erwarten.
Kapiteldateien, zusammengeführte Datei und Marker
Lade eine ZIP-Datei mit nummerierten Kapiteldateien herunter, das gesamte Hörbuch als eine zusammengeführte MP3 mit einer Textdatei für Kapitelmarker oder eine M4B-Datei mit integrierten Kapiteln – je nachdem, was dein Vertriebsweg erfordert.
Belletristik, Sachbücher und Bildbände
Das Multi-Voice-Casting glänzt in dialoglastiger Belletristik, während ein einzelner, ruhiger Erzähler Sachbücher und Bildbände ebenso gut meistert.
Wo du es veröffentlichen kannst
Du exportierst Standard-MP3-, ZIP- und M4B-Dateien, sodass sie überall dort funktionieren, wo Hörbücher verkauft werden. Hier sind die Wege, die Autoren am häufigsten nutzen.
Wo KI-Vertonung akzeptiert wird
- Spotify, über Findaway Voices – KI-Vertonung ist erlaubt, solange du offenlegst, dass das Hörbuch KI-generiert ist.
- Google Play Books, das selbstveröffentlichte Audioinhalte akzeptiert und ein eigenes KI-Vertonungsprogramm hat.
- Deine eigene Autorenseite auf AIWriteBook, deine Website, dein Newsletter oder ein Podcast-Feed – Direktverkäufe sichern dir die volle Marge ohne Exklusivitätsbindung.
Bevor du hochlädst
- Die Richtlinien der Shops für KI-Vertonung sind unterschiedlich und ändern sich ständig; die meisten verlangen lediglich, dass du sie deklarierst. Prüfe die Richtlinien dort, wo du veröffentlichen möchtest, bevor du die Dateien hochlädst.
- Amazon bietet auch KDP Virtual Voice an, das dein E-Book mit Amazons eigenen Stimmen innerhalb von KDP vertont – ein separater Weg, den du parallel zu den hier exportierten Dateien nutzen kannst.
Was es kostet
Das Audiobook Studio ist eine kostenpflichtige Funktion und wird in Credits pro Zeichen abgerechnet, sodass ein kurzes Buch weniger kostet als ein langes.
Die Vertonung kostet 1 Credit pro 12,5 Zeichen. Multi-Voice-Casting kostet 20 % zusätzlich, und während das Studio in der Beta-Phase ist, wird jedes Rendering um 75 % rabattiert – ein vorübergehender Einführungsrabatt, der enden wird, wonach der volle Preis gilt. Die genauen Kosten werden vor dem Rendering angezeigt, und du kannst die weiteren Credit-Preise für alles andere einsehen.
Häufig gestellte Fragen
Du erhältst Standard-MP3-, ZIP- und M4B-Dateien, die überall dort funktionieren, wo Hörbücher verkauft werden. Die Richtlinien der Shops für KI-Vertonung sind unterschiedlich und ändern sich ständig; die meisten verlangen lediglich eine Offenlegung der KI-Vertonung. Prüfe daher die Richtlinien deines gewählten Anbieters. Spotify (über Findaway Voices) und Google Play Books akzeptieren KI-Vertonung bei entsprechender Kennzeichnung, Amazon bietet KDP Virtual Voice für dein E-Book an, und du kannst die Dateien jederzeit selbst verkaufen.
Das Studio liest dein Buch, findet heraus, welcher Charakter welche Dialogzeile spricht, und schlägt für jeden von ihnen sowie für den Erzähler eine Stimme vor. Du erhältst eine Besetzungsliste zur Überprüfung und kannst jede Stimme vor dem Rendering austauschen. Wenn du lieber einen festen Erzähler für das ganze Buch hättest, schalte Multi-Voice aus und behalte den einzelnen Erzähler bei.
Ja. Das Studio vertont Bücher in allen 31 Sprachen, in denen AIWriteBook schreibt — über 38 regionale Varianten hinweg — einschließlich Französisch, Spanisch, Deutsch, Italienisch, Portugiesisch, Japanisch, Norwegisch, Niederländisch, Polnisch, Koreanisch, Chinesisch, Hindi, Arabisch, Schwedisch, Ukrainisch, Dänisch, Finnisch, Tschechisch, Griechisch, Hebräisch, Rumänisch, Ungarisch, Türkisch, Vietnamesisch, Thailändisch, Indonesisch, Malaiisch, Tagalog, Bengalisch und Katalanisch. Du musst nirgendwo eine Sprache auswählen: Das Modell liest die Sprache, in der dein Buch geschrieben ist, und alle 25 Stimmen sind mehrsprachig. In der Stimmenauswahl kannst du jede Stimme auf Französisch, Spanisch, Deutsch, Italienisch, Portugiesisch, Japanisch oder Norwegisch hören, bevor du wählst.
Aktuell nicht. Das Studio vertont ausschließlich mit unserer Bibliothek von 25 professionellen Stimmen – es gibt kein Voice-Cloning und keine Möglichkeit, ein eigenes Sprachbeispiel oder das eines gemieteten Sprechers hochzuladen. Dies ist einer der am häufigsten gewünschten Punkte auf unserer öffentlichen Roadmap, für den du dort abstimmen kannst, aber es wurde noch nichts davon veröffentlicht. Bitte plane deinen Launch also nicht darauf basierend.
Der Preis richtet sich nach der Zeichenanzahl: 1 Credit pro 12,5 Zeichen. Multi-Voice-Casting kostet 20 % extra, und der vorübergehende Beta-Rabatt zieht dann 75 % ab. Mit dem Rabatt kostet ein Buch mit 50.000 Zeichen etwa 1.200 Credits mit einer Stimme oder etwa 1.440 Credits mit Multi-Voice-Casting; ohne Rabatt liegen diese Werte bei 4.000 und 4.800. Das Studio zeigt dir den genauen Betrag für das Kapitel und das gesamte Buch an, bevor du etwas renderst.
Generiere diesen Absatz einfach neu. Du kannst die Stimme ändern, das Emotion-Tag anpassen oder die Zeile umformulieren. Nimm dann entweder nur diese Zeile oder sie zusammen mit den umliegenden Zeilen neu auf, damit die Betonung weiterhin passt. Der Rest des Kapitels bleibt unberührt, sodass du nie für Audio bezahlen musst, das bereits in Ordnung war.
Indem du ihn anders schreibst. Es gibt kein Aussprache- oder Betonungswörterbuch – die v3-Engine unterstützt keine Phonem-Wörterbücher. Die Lösung besteht darin, die Zeile im Studio zu öffnen, den schwierigen Namen so zu schreiben, wie er klingen soll, bei falscher Betonung einen Hinweis zur Sprechweise hinzuzufügen und nur diese Zeile neu aufzunehmen. Die geänderte Schreibweise existiert nur im Audioskript; dein Buchtext bleibt unberührt.
Lautstärke-gemasterte MP3s mit 44,1 kHz und 192 kbps: eine Datei pro Kapitel, eine zusammengeführte Datei für das gesamte Hörbuch und Kapitelmarkierungen. Das deckt ab, was Distributoren, Podcast-Feeds und Direkt-Downloads erfordern.
Ja. Das Multi-Voice-Casting ist zwar für Dialoge optimiert und daher bei Belletristik am wirkungsvollsten, aber auch Sachbücher und visuelle Bücher lassen sich mit einer einzelnen Stimme sauber vertonen und erhalten dieselben Emotion-Tags, Bearbeitungsmöglichkeiten auf Absatzebene und den gemasterten Export.
Das Schreiben und Planen deines Buches ist zu Beginn kostenlos. Die Hörbuchproduktion ist in den Pro- und Ultra-Plänen sowie ab AppSumo Tier 2 verfügbar. Sie basiert auf Credits, die pro Zeichen abgerechnet werden (inklusive 75 % Beta-Rabatt). Du benötigst also einen Plan mit Credits für das Rendering. Mehr über die Vertonung erfährst du auf der Hörbuch-Generator Funktionsseite.
Gib jedem Charakter seine eigene Stimme
Wähle ein Buch, bestimme einen Erzähler und das Studio besetzt deine Charaktere automatisch, rendert das Hörbuch Kapitel für Kapitel und mastert es in Dateien, die du direkt veröffentlichen kannst.
So verwandelst du dein Buch mit KI-Stimmen in ein Hörbuch
Ein Schritt-für-Schritt-Rundgang durch das Audiobook Studio: Stimmen auswählen, Vertonung Kapitel für Kapitel generieren, überprüfen und ein fertiges Hörbuch exportieren.
Ähnliche Tools & Leitfäden
Mach weiter mit weiteren kostenlosen Tools und ausführlichen Leitfäden
Hörbuch-Generator
Wie sich KI-Vertonung in den weiteren AIWriteBook-Workflow einfügt.
KI-Hörbuch-Vertonung
Was KI-Vertonung aktuell für Indie-Autoren leisten kann und was nicht.
Cover-Generator
Jeder Hörbuch-Eintrag braucht ein Cover — gestalte deines hier.
Amazon KDP Guide
Veröffentliche das E-Book und das Taschenbuch zusammen mit deiner Audio-Edition.
Bereit, dein komplettes Buch zu schreiben?
Verwandle deine Ideen in fertige Bücher mit KI-gestütztem Schreiben, Cover-Design und Publishing-Tools.

