KI-Stimme gestalten

Bis zu 150 Zeichen. Ohne Eingabe wählt das Modell einen Vorschautext.

Wähle 1–4 Hörproben.

Letzte Aufgaben

Deine erstellten Stimmvarianten erscheinen hier.

Deine erstellten Stimmvarianten erscheinen hier.

Eine passende Stimme beginnt mit einer konkreten Vorstellung

Beim Stimmendesign beschreibst du zunächst, wie eine Person klingen soll. Du brauchst dafür keine Aufnahme und musst dich nicht auf eine vorhandene Bibliotheksstimme festlegen. Beschreibe beispielsweise die Tonlage, die Klangfarbe, das Sprechtempo und die Art des Vortrags. Voicv übermittelt diese Beschreibung an das Sprachmodell und zeigt die erzeugten Hörproben gemeinsam in einer Aufgabe an. Damit kannst du verschiedene Richtungen für eine Figur, einen Erzähler oder einen kurzen gesprochenen Entwurf prüfen, bevor du dich für eine weitere Ausarbeitung entscheidest.

Hilfreich sind Merkmale, die sich tatsächlich hören lassen. Eine sachliche Erklärung könnte eine deutliche Aussprache, ruhige Betonung und ein gleichmäßiges Tempo benötigen. Bei einer neugierigen Zeichentrickfigur könnten ein hellerer Klang und lebendigere Satzenden passen. Solche Angaben geben dem Modell eine Richtung vor, garantieren aber keine exakte Umsetzung. Höre deshalb den ganzen Satz an. Überlege anschließend, ob eher die Tonlage, der Rhythmus oder die emotionale Wirkung geändert werden sollte, statt die gesamte Beschreibung ohne Vergleich zu ersetzen.

Pro Anfrage sind ein bis vier Varianten möglich. Du kannst jede davon anhören und herunterladen; die ursprüngliche Beschreibung bleibt bei der Aufgabe. Die Seite erzeugt Audiovorschauen und legt daraus nicht automatisch ein dauerhaftes Stimmenmodell an. Stimmenklonen beginnt mit einer Referenzaufnahme, während Text-to-Speech einen Text mit einer verfügbaren Stimme spricht. Diese Unterschiede sind entscheidend, wenn du später längere Skripte vertonen oder dieselbe Stimme wiederholt einsetzen möchtest. Eine Hörprobe ist noch keine dauerhaft auswählbare Bibliotheksstimme.

So gestaltest du eine Stimme mit Voicv

Formuliere einen klaren Auftrag und wähle einen kurzen Testsatz, an dem du alle Varianten messen kannst.

1

Beschreibe Klang und Sprechweise

Nenne zuerst die Rolle der Stimme und ergänze hörbare Eigenschaften: eine tiefere oder höhere Lage, einen weichen oder rauen Klang, ruhiges oder lebhaftes Sprechen. Falls relevant, beschreibe auch Aussprache und Akzent. Das Feld erlaubt bis zu 2.000 Zeichen, muss aber nicht vollständig gefüllt werden. Wenige zusammenpassende Angaben lassen sich besser überprüfen als viele widersprüchliche Adjektive. Den tatsächlich zu sprechenden Satz trägst du getrennt im Vorschautext ein.

2

Wähle einen passenden Vorschautext

Der optionale Vorschautext darf bis zu 150 Zeichen enthalten. Verwende einen Satz, der deinem Projekt ähnelt, beispielsweise mit einem wichtigen Namen oder einer Frage. So prüfst du mehr als nur den allgemeinen Klang. Bleibt das Feld leer, liefert das Modell den Vorschautext.

3

Lege die Varianten fest und sende die Anfrage

Wähle eine, zwei, drei oder vier Hörproben; voreingestellt sind zwei. Die erste Hörprobe kostet 5.000 Credits; jede weitere kostet zusätzlich 2.000 Credits. Melde dich an und prüfe den angezeigten Betrag vor dem Absenden. Sobald die Aufgabe angenommen wurde, erscheint ihr Fortschritt im Ergebnisbereich und du kannst das Formular weiter bearbeiten. Erneutes Absenden erzeugt eine neue kostenpflichtige Anfrage, auch wenn die Beschreibung unverändert bleibt.

4

Vergleiche die Ergebnisse und verbessere den Entwurf

Höre die Kandidaten bei ähnlicher Lautstärke an und achte auf Verständlichkeit, Tempo, Klangfarbe und Satzwirkung. Lade passende Vorschauen einzeln herunter. Über die ursprüngliche Beschreibung kannst du einen weiteren Versuch vorbereiten, ohne sofort eine Generierung auszulösen. Für einen aussagekräftigen Vergleich solltest du den Testsatz beibehalten und zunächst nur ein wichtiges Stimmmerkmal verändern. So erkennst du leichter, ob die Änderung geholfen hat.

Stimmideen mit klaren Kriterien vergleichen

Die Hörproben unterstützen eine kreative Entscheidung. Kosten, Eingaben und Ergebnisart bleiben dabei nachvollziehbar.

Ohne Ausgangsaufnahme beginnen

Eine Figur oder Sprecherrolle kann bereits während der Textplanung eine erste stimmliche Richtung erhalten. Beschreibe dafür wahrnehmbare Eigenschaften, statt nur den Namen einer realen Person zu nennen. Wenn du eine vorhandene Aufnahme verwenden darfst und deren Sprecher nachbilden möchtest, ist der Klonprozess mit Referenzaudio der passendere Ausgangspunkt. Das Designformular benötigt dagegen ausschließlich eine schriftliche Beschreibung.

Mehrere Deutungen gemeinsam anhören

Eine Beschreibung kann unterschiedlich interpretiert werden. Bis zu vier Kandidaten in einer Aufgabe machen solche Unterschiede direkt hörbar. Vergleiche auch Pausen, Satzenden und schwierige Wörter, nicht nur die ersten Sekunden. Die Kandidaten sind Auswahlmöglichkeiten, keine Garantie für eine genau passende Stimme. Wenn alle Varianten vom Ziel abweichen, überarbeite zuerst den Auftrag, bevor du eine weitere Anfrage bezahlst.

Den Preis vor dem Start kennen

Die erste Hörprobe kostet 5.000 Credits; jede weitere kostet zusätzlich 2.000 Credits. Schlägt die Aufgabe fehl, werden die dafür berechneten Credits über den Aufgabenprozess zurückgegeben. Eine erfolgreich erstellte Hörprobe, deren Stil dir nicht gefällt, ist von einem technischen Fehlschlag zu unterscheiden. Prüfe deshalb vor jeder neuen Anfrage den gewünschten Änderungsgrund.

Frühere Versuche wiederfinden

Die letzten Aufgaben stehen neben dem Formular, ältere Anfragen lassen sich auf der Verlaufsseite durchblättern. Dort bleiben Beschreibung und Hörproben zusammen, damit du frühere Entscheidungen nachvollziehen kannst. Jeder abgeschlossene Kandidat besitzt eine Wiedergabe und einen Download. Sichere wichtige Audiodateien in deinen eigenen Projektordnern. Der Aufgabenverlauf sollte nicht als Zusage einer dauerhaften Speicherung sämtlicher erzeugter Dateien verstanden werden.

Häufige Fragen zum KI-Stimmendesign

Diese Antworten helfen bei der Vorbereitung einer Anfrage und beim Einordnen der Vorschauen.

Muss ich meine eigene Stimme aufnehmen?

Nein. Erforderlich ist eine schriftliche Beschreibung der gewünschten Stimme. Der Vorschautext ist freiwillig. Wenn du bereits eine Aufnahme besitzt und den darin enthaltenen Sprecher nachbilden möchtest, nutze Stimmenklonen. Für diese Designseite musst du vorher weder ein Stimmenmodell trainieren noch eine Aufnahme hochladen. Beide Werkzeuge setzen an unterschiedlichen Ausgangssituationen an.

Was gehört in eine gute Beschreibung?

Beschreibe die Aufgabe der Stimme, ihre Tonlage, Klangfarbe, Geschwindigkeit und Aussprache. Eine warme, tiefe Erzählerstimme mit klaren Konsonanten bietet konkrete Kriterien für die Hörprobe. Vermeide gleichzeitig geforderte Gegensätze wie extrem schnell und sehr langsam. Behalte nach dem ersten Versuch passende Merkmale bei und ändere gezielt das, was noch nicht funktioniert.

Kann ich einen vollständigen Artikel als Vorschautext nutzen?

Das Feld ist für eine kurze Hörprobe vorgesehen und auf 150 Zeichen begrenzt. Wähle lieber einen repräsentativen Satz mit den Namen oder Lauten, die im späteren Material wichtig sind. Auch Satzzeichen helfen dabei, Pausen und Betonung zu beurteilen. Für längere Texte ist der entsprechende Text-to-Speech-Ablauf mit einer geeigneten Stimme vorgesehen.

Werden vier Varianten einzeln berechnet?

Die erste Hörprobe kostet 5.000 Credits; jede weitere kostet zusätzlich 2.000 Credits. Eine, zwei, drei oder vier Hörproben kosten insgesamt 5.000, 7.000, 9.000 bzw. 11.000 Credits. Die voreingestellten zwei Hörproben kosten 7.000 Credits. Ein erneutes Absenden ist jedoch eine weitere Anfrage mit eigenen Kosten. Plane deinen Vergleich vor dem Start und höre zunächst die Kandidaten der bereits erstellten Aufgabe vollständig an.

Ist ein Kandidat automatisch eine gespeicherte TTS-Stimme?

Nein. Du erhältst Audiovorschauen mit Kandidateninformationen. Eine Kandidatenkennung ist keine dauerhafte Stimmenmodellkennung für spätere Texte. Du kannst das Audio herunterladen oder die Beschreibung erneut verwenden, aber die Seite speichert nicht automatisch eine auswählbare Bibliotheksstimme. Wenn du eine beständige Stimme für mehrere Skripte brauchst, beachte den separaten Stimmenbibliotheksprozess.

Wie genau werden Sprache und Akzent übernommen?

Du kannst die gewünschte Sprache und den Akzent in der Stimmbeschreibung nennen. Diese Angaben lenken das Modell, garantieren aber keine bestimmte regionale Authentizität oder fehlerfreie Aussprache. Verwende einen passenden Testsatz und lass wichtige Inhalte von einer sprachkundigen Person prüfen. Besonders Eigennamen, Zahlen und ungewohnte Betonungen sollten vor der weiteren Verwendung kontrolliert werden.

Was passiert bei einer fehlgeschlagenen Aufgabe?

Die Aufgabe zeigt ihren Fehler an und die dafür abgezogenen Credits werden zurückerstattet. Mehrfach eintreffende Fehlermeldungen lösen keine mehrfachen Rückerstattungen aus. Wenn lediglich das Laden des aktuellen Status im Browser scheitert, prüfe zuerst den Verlauf. Die ursprüngliche Aufgabe könnte noch laufen; eine sofortige neue Anfrage würde einen weiteren Auftrag erzeugen.

Klingt dieselbe Beschreibung jedes Mal identisch?

Nein. Jede neue Anfrage kann eine andere Interpretation hervorbringen. Die Seite bietet keinen Seed und keine dauerhafte Stimmenidentität, mit denen identische Aufnahmen garantiert wären. Für nachvollziehbare Vergleiche lässt du den Vorschautext unverändert und änderst jeweils nur einen Teil der Beschreibung. Entscheide anschließend anhand der tatsächlich erzeugten Hörproben, welche Richtung du weiterverfolgst.

Mach deine Stimmidee hörbar

Beschreibe eine klare Richtung, wähle die Varianten und vergleiche die Hörproben mit deinem kreativen Ziel.

Stimme gestalten