Kokoro TTS online kostenlos testen
Eines der kleinsten Modelle mit natürlich klingenden Stimmen. Läuft vollständig in Ihrem Browser. Keine Anmeldung, keine Installation, völlig kostenlos.
Kokoro kostenlos testenWarum Kokoro
Warum Kokoro für Text-to-Speech nutzen
Kokoro ist ein quelloffenes, unter Apache 2.0 lizenziertes Text-to-Speech-Modell mit nur 82 Millionen Parametern. Aufgebaut auf der StyleTTS 2-Architektur von hexgrad, liefert es eine Sprachqualität, die durchweg Modelle übertrifft, die um ein Vielfaches größer sind, darunter XTTS mit 467M Parametern und MetaVoice mit 1,2B Parametern.
Mit rund 80 MB ist Kokoro klein genug, um direkt in Ihrem Browser zu laufen, und erzeugt dabei dennoch natürliche, ausdrucksstarke Sprache in 8 Sprachen.
27+ integrierte Stimmen
Wählen Sie aus einer vielfältigen Sammlung von Stimmen, darunter af_heart, af_bella, af_sarah, am_adam und viele mehr in verschiedenen Sprachen und Stilen.
8 Sprachen
Erzeugen Sie Sprache in Englisch (Amerikanisch und Britisch), Japanisch, Chinesisch, Spanisch, Französisch, Hindi und Italienisch.
Ultraleicht
Nur 82 Millionen Parameter und rund 80 MB groß. Läuft schnell auf nahezu jedem Gerät ohne dedizierte GPU.
Geschwindigkeitssteuerung
Passen Sie die Wiedergabegeschwindigkeit von 0,5x bis 2,0x an Ihre Inhalte an, von langsamer Erzählung bis zu schnellem Dialog.
Loslegen
So funktioniert es
Öffnen Sie das kostenlose Tool
Gehen Sie zum Kokoro TTS-Tool in Ihrem Browser. Kein Download und keine Anmeldung erforderlich.
Wählen Sie eine Stimme
Durchsuchen Sie die 27+ integrierten Stimmen und wählen Sie eine, die zu Ihrem Projekt passt. Jede Stimme hat ein Präfix, das ihre Sprache und ihr Geschlecht angibt, sodass Sie schnell die passende finden.
Geben Sie Ihren Text ein und erzeugen Sie ihn
Geben Sie den zu sprechenden Text ein, passen Sie bei Bedarf die Geschwindigkeit an und klicken Sie dann auf Erzeugen. Ihre Sprache ist in Sekunden fertig.
Anwendungsfälle
Für wen ist Kokoro?
Content-Creator
Fügen Sie YouTube-Videos, Podcasts oder Social-Media-Inhalten natürliche Voiceovers hinzu. Wählen Sie aus 27+ Stimmen in 8 Sprachen, ohne selbst etwas aufzunehmen.
Lehrende
Erstellen Sie Audioversionen von Lektionen, Lernhilfen und Lernmaterialien. Nutzen Sie verschiedene Stimmen für verschiedene Figuren oder Themen, um Lernende bei der Sache zu halten.
Entwickler
Erstellen Sie Prototypen für Sprachfunktionen, testen Sie TTS-Pipelines oder integrieren Sie Sprachausgabe in Anwendungen. Kokoro ist unter Apache 2.0 lizenziert, sodass Sie es frei in Ihren Projekten verwenden können.
Barrierefreiheit
Wandeln Sie geschriebene Inhalte in gesprochenes Audio um, für Menschen, die lieber zuhören als lesen oder darauf angewiesen sind. Unterstützt mehrere Sprachen für ein breiteres Publikum.
So holen Sie das Beste aus Kokoro heraus
Tipps für beste Ergebnisse
Wählen Sie das richtige Stimmpräfix für Ihre Sprache
Stimmnamen beginnen mit einem Präfix, das Sprache und Geschlecht angibt. Zum Beispiel steht af_ für amerikanisch weiblich, am_ für amerikanisch männlich und bf_ für britisch weiblich. Wenn Sie die Stimme an die Sprache Ihres Textes anpassen, erhalten Sie die beste Aussprache.
Passen Sie die Geschwindigkeit an Ihren Kontext an
Verwenden Sie langsamere Geschwindigkeiten (0,5x bis 0,8x) für Erzählungen oder Bildungsinhalte, bei denen Klarheit zählt. Verwenden Sie schnellere Geschwindigkeiten (1,2x bis 2,0x) für schnelle Vorschauen oder dialogreiche Szenen.
Probieren Sie verschiedene Stimmen für verschiedene Tonlagen aus
Jede integrierte Stimme hat ihren eigenen Charakter und Ton. Experimentieren Sie mit einigen Stimmen, um diejenige zu finden, die am besten zur Stimmung Ihrer Inhalte passt, ob warm, professionell oder energiegeladen.
Voice Creator Pro
Brauchen Sie mehr? Gehen Sie mit Voice Creator Pro weiter.
Voice Creator Pro bietet Ihnen hochwertigere Modelle, Voice Cloning in über 600 Sprachen, emotionale Sprache und eine Lizenz für die kommerzielle Nutzung. Testen Sie es kostenlos in Ihrem Browser oder laden Sie die Desktop-App herunter.
Voice Cloning
Klonen Sie jede Stimme aus einer kurzen Audioprobe. Zero-Shot-Klonen ohne erforderliches Training
Über 600 Sprachen
Kombinieren Sie mehrere Open-Source-Modelle für TTS in über 600 Sprachen
GPU-beschleunigte Verarbeitung
Schnellere Erzeugung mit Unterstützung für NVIDIA-, Apple-Silicon-, AMD- und Intel-GPUs
Voice Design aus Text
Beschreiben Sie eine Stimme in einfachem Text und die KI erstellt sie. Keine Audioproben nötig
Lokale REST-API
Automatisieren Sie die Stimmerzeugung in Ihren eigenen Apps und Arbeitsabläufen
Kommerzielle Lizenz
Volle Rechte zur Nutzung erzeugter Audiodateien in kommerziellen Projekten
FAQ
Häufige Fragen
Kokoro ist ein quelloffenes Text-to-Speech-Modell, das von hexgrad erstellt wurde. Es hat 82 Millionen Parameter und basiert auf der StyleTTS 2-Architektur. Trotz seiner geringen Größe erzeugt es natürlich klingende Sprache, die es mit um ein Vielfaches größeren Modellen aufnimmt.
Kokoro wurde von hexgrad entwickelt, einem Mitwirkenden aus der Open-Source-Community. Es wird unter der Apache-2.0-Lizenz veröffentlicht, was bedeutet, dass jeder es frei verwenden, ändern und verteilen kann, auch für kommerzielle Zwecke.
Kokoro unterstützt 8 Sprachen: Englisch (Amerikanisch und Britisch), Japanisch, Chinesisch, Spanisch, Französisch, Hindi und Italienisch. Jede Sprache verfügt über eigene Stimmen, die für eine natürliche Aussprache optimiert sind.
Kokoro umfasst 27+ integrierte Stimmen. Jede Stimme hat ein Präfix, das ihre Eigenschaften angibt. Zum Beispiel sind af_heart, af_bella und af_sarah amerikanische weibliche Stimmen, während am_adam eine amerikanische männliche Stimme ist. Sie können alle verfügbaren Stimmen im Tool durchsuchen und vorab anhören.
Ja. Kokoro ist quelloffene Software, die unter der Apache-2.0-Lizenz veröffentlicht wird, einer der freizügigsten verfügbaren Open-Source-Lizenzen. Auf dieser Website läuft es direkt in Ihrem Browser, ohne Konto, ohne Anmeldung und ohne Nutzungslimits.
Kokoro übertrifft in Benchmarks zur Sprachqualität durchweg deutlich größere Modelle, obwohl es nur 82 Millionen Parameter hat. Es übertrifft XTTS (467M Parameter) und MetaVoice (1,2B Parameter) und ist dabei deutlich schneller und kleiner. Sein leichtgewichtiges Design bedeutet, dass es effizient in einem Browser laufen kann, ohne eine leistungsstarke GPU zu benötigen. Für noch mehr Möglichkeiten, einschließlich Voice Cloning und über 600 Sprachen, bietet Voice Creator Pro eine vollständige Desktop-Lösung.
Nein. Kokoro ist nur etwa 80 MB groß und hat lediglich 82 Millionen Parameter, was es zu einem der leichtesten verfügbaren TTS-Modelle macht. Es läuft gut auf den meisten modernen Computern und benötigt keine dedizierte GPU. Jeder aktuelle Laptop oder Desktop sollte damit problemlos zurechtkommen.
Chrome, Edge und andere Chromium-basierte Browser funktionieren am besten. Firefox und Safari bieten nur begrenzte Unterstützung für die WebGPU-Funktionen, die Kokoro zur Beschleunigung verwendet.