Neu: Song Creator Pro: Musik mit KI erstellen, lokal auf Ihrem Gerät. Jetzt testen →

Eigene Stimmen aus Text gestalten

Beschreiben Sie die gewünschte Stimme, ihr Alter, Geschlecht, ihren Klang, Akzent und ihre Persönlichkeit, und erzeugen Sie eine einzigartige, realistische Stimme dazu. Keine Audioproben erforderlich.

StraßenhändlerEnglish

A rough, fast-talking male voice, mid-thirties, medium pitch with sharp rising inflections, raspy and brash, high energy, suitable for character acting.

Anime-MannDeutsch

Eine tiefe männliche Stimme mit dramatischen Tonhöhenwechseln, einschüchternd und verschmitzt, geeignet für Anime-Voiceovers. Mit dramatischen Pausen.

ZauberinDeutsch

Geschlecht: weiblich; Alter: fünfziger Jahre; Tonhöhe: tief mit unheimlicher Resonanz; Tempo: langsam und bedächtig mit dramatischen Pausen; Emotion: geheimnisvoll, gebieterisch; Merkmale: geschmeidig, kraftvoll; Anwendungsfall: Fantasy-Spieldialog.

Verführerische FrauEnglish

A smooth, alluring young female voice, late twenties, low pitch with a breathy quality, slow deliberate pace, warm and intimate, suitable for late-night radio.

Barscher KriegerDeutsch

Eine raue, gebieterische männliche Stimme, Mitte vierzig, tiefe, dunkle Tonhöhe, heiser und rau, gleichmäßiges, gemessenes Tempo, ernst und intensiv, geeignet für Fantasy-Spieldialoge oder Action-Trailer.

KindEnglish

A bright, curious child's voice, around 8 years old, high pitch with expressive intonation, moderate pace with occasional excited bursts, cheerful and innocent.

Keine Kreditkarte erforderlich·Über 600 Sprachen·Kommerzielle Nutzung

Demo

In Aktion sehen

Sehen Sie, wie Sie eine Stimme in einfachem Text beschreiben und sie sofort erzeugen.

So funktioniert es

Drei Schritte zu Ihrer eigenen Stimme

01

Beschreiben Sie Ihre Stimme

Schreiben Sie eine Beschreibung in natürlicher Sprache und legen Sie Alter, Geschlecht, Klang, Tonhöhe, Energie und Persönlichkeitsmerkmale fest.

02

Sofort erzeugen

Die KI erstellt eine einzigartige Stimme passend zu Ihrer Beschreibung. Jede Generierung liefert ein eigenständiges Ergebnis.

03

Verfeinern und speichern

Passen Sie Ihre Beschreibung an, bis die Stimme perfekt ist, und speichern Sie sie dann in Ihrer Bibliothek, um sie jederzeit zu nutzen.

Funktionen

Volle kreative Kontrolle

Gestalten Sie jede Stimme, die Sie sich vorstellen können, von einem warmen Erzähler bis zu einer energiegeladenen Spielfigur, mit nichts als einem Text-Prompt.

Keine Proben nötig

Erstellen Sie völlig neue Stimmen allein aus Textbeschreibungen. Keine Aufnahme, keine Audiodateien, kein Mikrofon erforderlich.

Unendliche Vielfalt

Jede Beschreibung erzeugt eine einzigartige Stimme. Erzeugen Sie so viele, wie Sie brauchen. Keine zwei sind gleich.

Feinabstimmung im Detail

Legen Sie in Ihren Beschreibungen Altersbereich, Geschlecht, Akzent, Sprechtempo, Wärme, Energielevel und emotionale Qualität fest.

Über 600 Sprachen

Gestalten Sie Stimmen in über 600 Sprachen, darunter Englisch, Chinesisch, Japanisch, Koreanisch, Deutsch, Französisch, Spanisch und viele mehr.

Überall lauffähig

Gestalten Sie Stimmen im Browser mit der Cloud-Version oder führen Sie sie lokal auf Ihrer eigenen Hardware mit der Desktop-App aus. Für die Cloud ist keine GPU nötig.

Datenschutz zuerst

Mit der Desktop-App bleibt alles auf Ihrer Hardware. Cloud-Nutzer profitieren von verschlüsselter Verarbeitung und strengen Datenrichtlinien.

Gestalten Sie Ihre perfekte Stimme

Die Qualität Ihrer gestalteten Stimme hängt davon ab, wie Sie sie beschreiben. Unser Prompting-Leitfaden führt Sie durch jedes Attribut, das Sie steuern können, mit Beispielen, Tipps und sofort einsetzbaren Vorlagen.

Zum Leitfaden
DimensionBeispiele
GeschlechtMännlich, weiblich, neutral
AlterKind (5–12), Teenager (13–18), junger Erwachsener (19–35), mittleres Alter (36–55), älter (55+)
TonhöheHoch, mittel, tief, hochtönig, tieftönig
TempoSchnell, mittel, langsam, schnelles Tempo, langsames Tempo
EmotionFröhlich, ruhig, sanft, ernst, lebhaft, gefasst, beruhigend
MerkmaleMagnetisch, klar, heiser, weich, süß, voll, kraftvoll
AnwendungsfallNachrichtensendung, Werbe-Voiceover, Hörbuch, Animationsfigur, Sprachassistent, Dokumentarfilm-Erzählung

Nur Desktop

Lokale Voice-Design-API

Erzeugen und speichern Sie Stimmen programmatisch aus Ihrem eigenen Code. Die Desktop-App enthält eine lokale REST-API, mit der Sie Stimmen auf Abruf erstellen können. Ideal für Spiele, die NPC-Stimmen zur Laufzeit erzeugen, Apps mit personalisiertem Onboarding oder jede Pipeline, die Stimmen ohne manuelle Einrichtung benötigt.

POST/api/v1/generation/design
const response = await fetch(
"http://localhost:7862/api/v1/generation/design",
{
method: "POST",
headers: { "Content-Type": "application/json" },
body: JSON.stringify({
instruct_text: "A warm female narrator,
mid-30s, British accent, calm",
target_text: "Hello! I'm your guide for today."
})
}
)

Echtzeit-Streaming

Starten Sie die Wiedergabe, während das Audio noch erzeugt wird. Kein Warten auf die vollständige Datei, ideal für interaktive Apps und Live-Vorschauen.

Warteschlangenbasierte Verarbeitung

Anfragen werden in eine Warteschlange gestellt und zuverlässig der Reihe nach verarbeitet. Fragen Sie den Fortschritt ab oder warten Sie bis zur Fertigstellung. Keine verlorenen Aufträge.

Zwei Qualitätsmodi

Wählen Sie das Modell mit 1,7 Mrd. Parametern für maximale Wiedergabetreue oder das Modell mit 0,6 Mrd. Parametern, wenn Geschwindigkeit wichtiger ist. Pro Anfrage umschaltbar.

Über 600 Sprachen

Gestalten Sie Stimmen in über 600 Sprachen, von weit verbreiteten Sprachen wie Englisch, Chinesisch, Japanisch und Koreanisch bis zu regionalen und Minderheitensprachen weltweit.

FAQ

Häufige Fragen

Voice Design ermöglicht es Ihnen, völlig neue, einzigartige Stimmen zu erstellen, indem Sie eine Textbeschreibung schreiben. Anstatt eine vorhandene Stimme aus Audio zu klonen, beschreiben Sie die gewünschten Merkmale, also Alter, Geschlecht, Akzent und Klang, und die KI erzeugt eine passende Stimme.

Je genauer, desto besser. Nehmen Sie Angaben wie Altersbereich (z. B. 'Mitte 30'), Geschlecht, Akzent (z. B. 'britisch'), Klang (z. B. 'warm und autoritär'), Sprechtempo und beliebige Persönlichkeitsmerkmale auf. Kurze Beschreibungen funktionieren ebenfalls, aber mehr Details geben Ihnen mehr Kontrolle.

Voice Cloning bildet eine vorhandene Stimme aus einer Audioprobe nach. Voice Design erstellt völlig neue Stimmen aus Textbeschreibungen, ganz ohne Audioeingabe jeglicher Art. Beide ergänzen sich: echte Stimmen klonen, fiktive gestalten.

Ja. Sobald Sie eine Stimme erzeugt haben, die Ihnen gefällt, speichern Sie sie in Ihrer lokalen Stimmbibliothek. Sie steht jederzeit für die Sprachausgabe zur Verfügung, genau wie eine geklonte Stimme.

Die Desktop-App bietet unbegrenztes Voice Design ohne Obergrenzen, Gebühren pro Stimme oder Wartezeiten. Voice Creator Pro Cloud nutzt ein tokenbasiertes System mit einer kostenlosen Version und kostenpflichtigen Tarifen für höhere Nutzung.

Ja. Alle Stimmen, die Sie mit Voice Creator Pro gestalten, ob über die Desktop-App oder Cloud, gehören Ihnen und dürfen in kommerziellen Projekten verwendet werden: Videos, Podcasts, Spiele, Apps, Hörbücher und mehr. Keine zusätzliche Lizenzierung erforderlich.

Voice Design ist ideal, wenn die benötigte Stimme nicht in der integrierten Bibliothek vorhanden ist und Sie kein Audio zum Klonen haben. Wenn Sie eine bestimmte Figur oder Persona benötigen, die nicht verfügbar ist, können Sie sie mit Voice Design von Grund auf erstellen.

Sie können sowohl realistische Stimmen (z. B. 'Eine junge indische Frau mit einer sanften, hohen Stimme, gesprächig und ruhig') als auch Charakterstimmen (z. B. 'Ein wütender alter Piratenkapitän, schreiend' oder 'Ein riesiger böser Oger') erstellen. Je beschreibender Ihr Prompt ist, desto mehr Kontrolle haben Sie über das Ergebnis. Tipps finden Sie in unserem Prompting-Leitfaden.

Ja, mit der Desktop-App. Voice Design läuft vollständig auf Ihrer lokalen Hardware, ohne dass eine Internetverbindung erforderlich ist. Voice Creator Pro Cloud benötigt eine Internetverbindung, aber die gesamte Verarbeitung erfolgt auf unseren Servern, ohne dass bei Ihnen spezielle Hardware nötig ist.

Ja. Über die lokale REST-API können Sie programmatisch neue Stimmvorschauen erzeugen und in Ihrer Bibliothek speichern. So integrieren Sie Voice Design in Ihre eigenen Anwendungen und Arbeitsabläufe. Endpunktdetails finden Sie in unserer API-Dokumentation.

Für die Desktop-App: Windows 10 oder neuer oder macOS mit Apple Silicon (M1 oder neuer). Eine moderne GPU (unter Windows wird NVIDIA empfohlen) bietet die beste Leistung. Reine CPU-Verarbeitung wird ebenfalls unterstützt. Voice Creator Pro Cloud läuft vollständig in Ihrem Browser, ohne spezielle Hardware.

Beginnen Sie noch heute mit dem Gestalten von Stimmen

Testen Sie es kostenlos im Browser oder laden Sie die Desktop-App für unbegrenztes Voice Design offline herunter.