Stimmkategorie

Anime-Stimmen generieren

Die meisten Anime-Stimmen-Generatoren geben dir eine Stimme und ein Textfeld. Für ein Meme reicht das, für eine Szene nicht. CastDub liest dein Skript, merkt, dass hier vier Leute reden, und gibt jedem eine eigene Sprechrolle – die helle Hauptfigur, den knappen Rivalen, den müden Mentor, das Chaosgeschöpf. Du führst Regie, CastDub spricht.

Vier Stimmen für den Anfang

Aria

Aria

Shonen-Heldin, die ihre eigenen Kämpfe kommentiert

jugendlichenergischheldenhaft
Koji

Koji

Rivale: knapp, ehrgeizig, insgeheim loyal

jugendlichscharfRivale
Lumen

Lumen

Oben süß, darunter völlig trocken

VTuberverspielt
Torvald

Torvald

Mentor, dessen Befehle tatsächlich befolgt werden

erwachsentiefheldenhaft

Die Hörproben sind Platzhalter, solange das öffentliche Demo-Audio noch produziert wird. Jede Stimme ist in jedem Tarif verfügbar – die Bibliothek ist keine Bezahlschranke.

Warum Ein-Stimmen-Werkzeuge an Anime-Skripten scheitern

Anime-Skripte sind ungewöhnlich dicht besetzt. Eine Szene über vier Seiten hat schnell Hauptfigur, Rivalen, zwei Nebenfiguren, eine Durchsage aus dem Off und eine Erzählstimme, und die halbe Komik entsteht daraus, wie schnell die Stimme wechselt. Gib das einem Werkzeug mit einer einzigen Stimme, und alles kommt in derselben Lage zurück – das Besetzen erledigt dann der Kopf der Hörerin, also genau die Arbeit, die du abgeben wolltest.

Der übliche Behelf: das Werkzeug einmal pro Figur laufen lassen, einen Stapel Clips herunterladen, alles von Hand in einem Audio-Editor zusammensetzen. Funktioniert. Kostet aber einen Nachmittag pro Szene, und sobald du eine Zeile änderst, fängst du von vorn an. CastDub existiert wegen dieser Schleife, nicht wegen der Klangqualität.

Was die automatische Besetzung wirklich tut

Die Besetzung beantwortet zwei Fragen: Wer spricht, und wie soll das klingen. Die Sprechererkennung kommt mit den Formaten zurecht, in denen tatsächlich geschrieben wird – „Name:“ davor, Drehbuchblöcke mit zentrierter Figurenangabe, und Prosa mit Redebegleitsätzen wie „sagte sie leise“. Zauberei ist das nicht: Wenn in deiner Szene drei namenlose Stimmen im Dunkeln reden, musst du sie selbst beschriften.

Die zweite Hälfte ist der Vorschlag. Jede Stimme in der Bibliothek trägt ein Kurzprofil, eine Altersspanne und Stil-Tags, also wird eine Figur, die du als gelangweilte Siebzehnjährige beschreibst, gegen Bibliotheks-Charaktere mit dem Tag jugendlich und trockenen oder scharfen Tags geprüft und nicht gegen die warme Erzählstimme. Jeden Vorschlag kannst du überschreiben, und die Überschreibung hält für den Rest des Projekts – einmal getauscht, bleibt die Figur in jeder Szene getauscht.

Regie führen, wie die Szene es braucht

Der Unterschied zwischen Leseprobe und Aufführung liegt fast ganz im Timing und in der Intensität. CastDub behandelt Emotion als Eigenschaft der Zeile: diese neutral, diese aufgeregt, dieser Einwurf geflüstert. Im Anime zählt diese Feinheit mehr als in fast jedem anderen Genre, weil die Komik auf dem harten Schnitt zwischen den Registern beruht – erst brüllen, dann sofort murmeln.

Emotion pro Zeile gibt es nur in Pro, und das ist Absicht. In den anderen Tarifen folgt jede Zeile der Grundemotion ihrer Figur, und das reicht, um zu prüfen, ob eine Szene trägt. Die Regie von Hand ist das, was aus einer tragfähigen Szene eine veröffentlichungsreife macht, und deshalb sitzt sie bei Pro, zusammen mit dem Stem-Export.

Eine Schreibnotiz, die im Deutschen mehr wiegt als anderswo: Ein Emotions-Tag rettet keine Zeile, die zwei Dinge gleichzeitig tut. Und pass auf die Satzklammer auf. „Ich mache das Fenster auf“ entscheidet sich erst beim letzten Wort, und wer im Nebensatz das Verb ans Ende schickt, zwingt die Stimme, einen Spannungsbogen über vier Schachtelteile zu halten. Sie flacht irgendwo in der Mitte ab. Zwei kurze Sätze klingen im Hörspiel immer besser als einer, der sich elegant bis zum Punkt aufspart.

Wo Anime-Fans im deutschsprachigen Raum das einsetzen

Drei Muster sehen wir am häufigsten: Fandubs und Fan-Hörspiele für YouTube und Discord, Szenen mit eigenen Figuren, die in Zeichen- und Schreib-Communitys geteilt werden, und Indie-Visual-Novels, die eine Platzhalter-Vertonung brauchen, lange bevor Geld für eine Besetzung da ist. Alle drei teilen dieselbe Lage: eine Person, kein Studio, ein Skript, das sich dauernd ändert.

Für Fanarbeit ist der sichere Boden das eigene Skript mit eigenen Figuren, oder transformative Arbeit in Fandoms, die das tolerieren. Riskant wird es beim Nachbauen einer namentlich bekannten Synchronstimme oder beim Hochladen einer lizenzierten Fassung. Das Erste kannst du hier bauen; unsere Klon-Richtlinie ist genau so geschrieben, dass das Zweite nicht geht.

Und eine deutsche Besonderheit, die man einmal ausgesprochen haben sollte: In einem Land, in dem praktisch alles synchronisiert wird, hört das Publikum Lippenbewegung, Sprechtempo und Stimmfarbe als Handwerk mit. Das ist eine hohe Latte, aber auch ein Vorteil – Fandub hat hier ein Publikum, das versteht, was du versuchst.

In wenigen Schritten vom Skript zum Audio

  1. Szene einfügen

    Füg den Dialog so ein, wie du ihn ohnehin schreibst – Drehbuchformat, Prosa mit Anführungszeichen oder schlicht Zeile für Zeile „Name: Text“. CastDub braucht keine Vorlage.

  2. Besetzen lassen

    Die automatische Besetzung teilt die Szene nach Sprechenden auf und schlägt für jede Figur eine Stimme vor – anhand der Beschreibung, die du geschrieben hast. Steht im Skript, dass jemand fünfzehn und wütend ist, kommt keine Vierzigjährige zurück.

  3. Tauschen, was nicht sitzt

    Klick eine Figur an, hör vier oder fünf Alternativen an derselben Zeile hintereinander und behalt die, die nach der Person in deinem Kopf klingt. Neu erzeugt werden nur die Zeilen dieser Figur; der Rest der Szene behält sein Audio.

  4. Emotion führen

    Anime-Dialog lebt von harten Wechseln – ein Scherz, der innerhalb eines Atemzugs zur Drohung wird. Setz die Emotion pro Zeile statt pro Figur (in Pro), sonst verpufft der Umschwung.

  5. Exportieren

    Die ganze Szene als MP3, oder in Pro die Stems, damit du den Dialog in deinem Videoschnitt über eigene Musik und Geräusche legen kannst.

Häufige Fragen

Klingt das wie eine echte Anime-Synchro?

Es klingt wie eine saubere, führbare Lesung – näher an einer Leseprobe als an einer Synchronkabine. Deutsche Ohren sind durch Jahrzehnte Synchronisation streng geeicht, und genau deshalb lohnt die ehrliche Ansage: Im Dialog ist der Abstand zum Menschen klein, bei Schreien, Weinen und langen gehaltenen Tönen groß. Trägt deine Szene auf diesen Momenten, nimm sie selbst auf und lass CastDub alles drumherum machen.

Kann eine Figur Deutsch mit japanischem Akzent sprechen?

Nicht direkt. Einen Akzent-Regler gibt es nicht – du wählst einen Bibliotheks-Charakter, und welche Stimme ihn auf Deutsch spricht, ergibt sich aus Sprache, Geschlecht und Altersgruppe. Verfremde auch nicht die Schreibweise: Wer Dialoge lautmalerisch verfremdet, um einen Akzent zu erzwingen, bekommt meist eine Karikatur und zusätzlich falsche Aussprache. Trag die Figur über Wortwahl und Rhythmus, Rechtschreibung normal lassen.

Kann ich eine vorhandene Anime-Folge neu vertonen?

Du kannst eine Dialogspur erzeugen und sie im Schnitt anlegen. Ab Plus gibt es SRT-Zeiten, womit die meisten synchronisieren. Bei den Rechten ist der deutsche Markt allerdings unsentimental: Eine lizenzierte Serie neu zu vertonen und kommerziell zu veröffentlichen, ist ein Lizenzproblem, das kein Werkzeug für dich löst. Fandub im nichtkommerziellen Rahmen ist die Grauzone, in der die Szene seit jeher arbeitet.

Wie viele Figuren darf eine Szene haben?

Free erlaubt zwei Sprechrollen pro Projekt – genug für einen Zweipersonen-Dialog. Basic hebt auf fünf, Plus und Pro heben die Grenze ganz auf. Auf Deutsch stehen pro Projekt bis zu 20 verschiedene Stimmen zur Verfügung, zehn davon deutsche Muttersprachler-Stimmen; erst danach müsste sich eine Stimme wiederholen. Die meisten Fanszenen liegen bei drei bis sechs Sprechenden.

Kann ich die Stimme eines Synchronsprechers klonen, den ich mag?

Nein. Stimmklonen ist ohnehin noch nicht freigeschaltet, und wenn es kommt, gilt: nur mit aufgenommener Einwilligung der Person selbst, niemals bei Personen des öffentlichen Lebens und niemals bei einer geschützten Darbietung. Eine deutsche Synchronstimme nachzubauen ist der schnellste Weg, ein Projekt löschen zu lassen.

Wem gehört, was ich erzeuge?

In den bezahlten Tarifen bekommst du eine kommerzielle Lizenz auf das erzeugte Audio. Free ist für private, nichtkommerzielle Nutzung. Das Skript gehört in jedem Fall dir – an deinen Texten erheben wir keine Rechte.

Besetze heute Abend deine erste Szene

Füge ein Skript ein, lass CastDub jeder Figur eine Stimme geben und exportier ein fertiges Hörspiel.

Kostenlos starten

Keine Kreditkarte. Free gibt dir ein einmaliges Guthaben.