Neu: Song Creator Pro: Musik mit KI erstellen, lokal auf Ihrem Gerät. Jetzt testen →

Kokoro TTS online kostenlos testen

Eines der kleinsten Modelle mit natürlich klingenden Stimmen. Läuft vollständig in Ihrem Browser. Keine Anmeldung, keine Installation, völlig kostenlos.

Kokoro kostenlos testen
100% privat
Keine Installation erforderlich
Kostenlos und unbegrenzt

Warum Kokoro

Warum Kokoro für Text-to-Speech nutzen

Kokoro ist ein quelloffenes, unter Apache 2.0 lizenziertes Text-to-Speech-Modell mit nur 82 Millionen Parametern. Aufgebaut auf der StyleTTS 2-Architektur von hexgrad, liefert es eine Sprachqualität, die durchweg Modelle übertrifft, die um ein Vielfaches größer sind, darunter XTTS mit 467M Parametern und MetaVoice mit 1,2B Parametern.

Mit rund 80 MB ist Kokoro klein genug, um direkt in Ihrem Browser zu laufen, und erzeugt dabei dennoch natürliche, ausdrucksstarke Sprache in 8 Sprachen.

27+ integrierte Stimmen

Wählen Sie aus einer vielfältigen Sammlung von Stimmen, darunter af_heart, af_bella, af_sarah, am_adam und viele mehr in verschiedenen Sprachen und Stilen.

8 Sprachen

Erzeugen Sie Sprache in Englisch (Amerikanisch und Britisch), Japanisch, Chinesisch, Spanisch, Französisch, Hindi und Italienisch.

Ultraleicht

Nur 82 Millionen Parameter und rund 80 MB groß. Läuft schnell auf nahezu jedem Gerät ohne dedizierte GPU.

Geschwindigkeitssteuerung

Passen Sie die Wiedergabegeschwindigkeit von 0,5x bis 2,0x an Ihre Inhalte an, von langsamer Erzählung bis zu schnellem Dialog.

Loslegen

So funktioniert es

1

Öffnen Sie das kostenlose Tool

Gehen Sie zum Kokoro TTS-Tool in Ihrem Browser. Kein Download und keine Anmeldung erforderlich.

2

Wählen Sie eine Stimme

Durchsuchen Sie die 27+ integrierten Stimmen und wählen Sie eine, die zu Ihrem Projekt passt. Jede Stimme hat ein Präfix, das ihre Sprache und ihr Geschlecht angibt, sodass Sie schnell die passende finden.

3

Geben Sie Ihren Text ein und erzeugen Sie ihn

Geben Sie den zu sprechenden Text ein, passen Sie bei Bedarf die Geschwindigkeit an und klicken Sie dann auf Erzeugen. Ihre Sprache ist in Sekunden fertig.

Anwendungsfälle

Für wen ist Kokoro?

Content-Creator

Fügen Sie YouTube-Videos, Podcasts oder Social-Media-Inhalten natürliche Voiceovers hinzu. Wählen Sie aus 27+ Stimmen in 8 Sprachen, ohne selbst etwas aufzunehmen.

Lehrende

Erstellen Sie Audioversionen von Lektionen, Lernhilfen und Lernmaterialien. Nutzen Sie verschiedene Stimmen für verschiedene Figuren oder Themen, um Lernende bei der Sache zu halten.

Entwickler

Erstellen Sie Prototypen für Sprachfunktionen, testen Sie TTS-Pipelines oder integrieren Sie Sprachausgabe in Anwendungen. Kokoro ist unter Apache 2.0 lizenziert, sodass Sie es frei in Ihren Projekten verwenden können.

Barrierefreiheit

Wandeln Sie geschriebene Inhalte in gesprochenes Audio um, für Menschen, die lieber zuhören als lesen oder darauf angewiesen sind. Unterstützt mehrere Sprachen für ein breiteres Publikum.

So holen Sie das Beste aus Kokoro heraus

Tipps für beste Ergebnisse

Wählen Sie das richtige Stimmpräfix für Ihre Sprache

Stimmnamen beginnen mit einem Präfix, das Sprache und Geschlecht angibt. Zum Beispiel steht af_ für amerikanisch weiblich, am_ für amerikanisch männlich und bf_ für britisch weiblich. Wenn Sie die Stimme an die Sprache Ihres Textes anpassen, erhalten Sie die beste Aussprache.

Passen Sie die Geschwindigkeit an Ihren Kontext an

Verwenden Sie langsamere Geschwindigkeiten (0,5x bis 0,8x) für Erzählungen oder Bildungsinhalte, bei denen Klarheit zählt. Verwenden Sie schnellere Geschwindigkeiten (1,2x bis 2,0x) für schnelle Vorschauen oder dialogreiche Szenen.

Probieren Sie verschiedene Stimmen für verschiedene Tonlagen aus

Jede integrierte Stimme hat ihren eigenen Charakter und Ton. Experimentieren Sie mit einigen Stimmen, um diejenige zu finden, die am besten zur Stimmung Ihrer Inhalte passt, ob warm, professionell oder energiegeladen.

Voice Creator Pro

Brauchen Sie mehr? Gehen Sie mit Voice Creator Pro weiter.

Voice Creator Pro bietet Ihnen hochwertigere Modelle, Voice Cloning in über 600 Sprachen, emotionale Sprache und eine Lizenz für die kommerzielle Nutzung. Testen Sie es kostenlos in Ihrem Browser oder laden Sie die Desktop-App herunter.

Voice Cloning

Klonen Sie jede Stimme aus einer kurzen Audioprobe. Zero-Shot-Klonen ohne erforderliches Training

Über 600 Sprachen

Kombinieren Sie mehrere Open-Source-Modelle für TTS in über 600 Sprachen

GPU-beschleunigte Verarbeitung

Schnellere Erzeugung mit Unterstützung für NVIDIA-, Apple-Silicon-, AMD- und Intel-GPUs

Voice Design aus Text

Beschreiben Sie eine Stimme in einfachem Text und die KI erstellt sie. Keine Audioproben nötig

Lokale REST-API

Automatisieren Sie die Stimmerzeugung in Ihren eigenen Apps und Arbeitsabläufen

Kommerzielle Lizenz

Volle Rechte zur Nutzung erzeugter Audiodateien in kommerziellen Projekten

FAQ

Häufige Fragen

Kokoro ist ein quelloffenes Text-to-Speech-Modell, das von hexgrad erstellt wurde. Es hat 82 Millionen Parameter und basiert auf der StyleTTS 2-Architektur. Trotz seiner geringen Größe erzeugt es natürlich klingende Sprache, die es mit um ein Vielfaches größeren Modellen aufnimmt.

Kokoro wurde von hexgrad entwickelt, einem Mitwirkenden aus der Open-Source-Community. Es wird unter der Apache-2.0-Lizenz veröffentlicht, was bedeutet, dass jeder es frei verwenden, ändern und verteilen kann, auch für kommerzielle Zwecke.

Kokoro unterstützt 8 Sprachen: Englisch (Amerikanisch und Britisch), Japanisch, Chinesisch, Spanisch, Französisch, Hindi und Italienisch. Jede Sprache verfügt über eigene Stimmen, die für eine natürliche Aussprache optimiert sind.

Kokoro umfasst 27+ integrierte Stimmen. Jede Stimme hat ein Präfix, das ihre Eigenschaften angibt. Zum Beispiel sind af_heart, af_bella und af_sarah amerikanische weibliche Stimmen, während am_adam eine amerikanische männliche Stimme ist. Sie können alle verfügbaren Stimmen im Tool durchsuchen und vorab anhören.

Ja. Kokoro ist quelloffene Software, die unter der Apache-2.0-Lizenz veröffentlicht wird, einer der freizügigsten verfügbaren Open-Source-Lizenzen. Auf dieser Website läuft es direkt in Ihrem Browser, ohne Konto, ohne Anmeldung und ohne Nutzungslimits.

Kokoro übertrifft in Benchmarks zur Sprachqualität durchweg deutlich größere Modelle, obwohl es nur 82 Millionen Parameter hat. Es übertrifft XTTS (467M Parameter) und MetaVoice (1,2B Parameter) und ist dabei deutlich schneller und kleiner. Sein leichtgewichtiges Design bedeutet, dass es effizient in einem Browser laufen kann, ohne eine leistungsstarke GPU zu benötigen. Für noch mehr Möglichkeiten, einschließlich Voice Cloning und über 600 Sprachen, bietet Voice Creator Pro eine vollständige Desktop-Lösung.

Nein. Kokoro ist nur etwa 80 MB groß und hat lediglich 82 Millionen Parameter, was es zu einem der leichtesten verfügbaren TTS-Modelle macht. Es läuft gut auf den meisten modernen Computern und benötigt keine dedizierte GPU. Jeder aktuelle Laptop oder Desktop sollte damit problemlos zurechtkommen.

Chrome, Edge und andere Chromium-basierte Browser funktionieren am besten. Firefox und Safari bieten nur begrenzte Unterstützung für die WebGPU-Funktionen, die Kokoro zur Beschleunigung verwendet.