Neu: Song Creator Pro: Musik mit KI erstellen, lokal auf Ihrem Gerät. Jetzt testen →

MOSS-TTS-Nano kostenlos online testen

Mehrsprachige Text-to-Speech und Voice Cloning in 18 Sprachen. Läuft vollständig in Ihrem Browser. Keine Anmeldung, keine Installation, völlig kostenlos.

MOSS-TTS-Nano kostenlos testen
18 Sprachen
Voice Cloning
Kostenlos und unbegrenzt

Warum MOSS

Warum MOSS-TTS-Nano verwenden

MOSS-TTS-Nano ist ein kompaktes Open-Source-TTS-Modell mit nur 100 Millionen Parametern, veröffentlicht unter der Apache-2.0-Lizenz von MOSI.AI und dem OpenMOSS-Team. Trotz seiner geringen Größe (~715 MB) bietet es mehrsprachiges Voice Cloning in 18 Sprachen mit 48-kHz-Stereo-Ausgabe.

MOSS ist das einzige Modell im kostenlosen Tool, das Voice Cloning in anderen Sprachen als Englisch unterstützt, und damit die erste Wahl für mehrsprachige Projekte.

Mehrsprachiges Voice Cloning

Klonen Sie Stimmen in 18 Sprachen, darunter Englisch, Chinesisch, Japanisch, Koreanisch, Deutsch, Spanisch, Französisch, Arabisch und mehr.

48-kHz-Stereo-Ausgabe

Höhere Qualität als die meisten TTS-Modelle. Erzeugt satten, natürlich klingenden Stereo-Ton mit einer Abtastrate von 48 kHz.

Echtzeit-Streaming

Hören Sie den Ton, während er erzeugt wird, dank Streaming-Ausgabe. Für die Ausführung in Echtzeit konzipiert, sogar auf der CPU.

Läuft in Ihrem Browser

Kein Download, kein Server, keine Anmeldung. Läuft lokal über WebGPU/WASM mit voller Privatsphäre.

Loslegen

So funktioniert es

MOSS-TTS-Nano unterstützt zwei Modi: Text-to-Speech mit integrierten Stimmen und Voice Cloning aus einer Audioprobe.

1

Öffnen Sie das kostenlose Tool und wählen Sie Ihren Modus

Öffnen Sie das MOSS-TTS-Nano-Tool in Ihrem Browser. Wählen Sie eine integrierte Stimme für Standard-TTS oder laden Sie eine Audioprobe für das Voice Cloning hoch. Kein Download und keine Anmeldung erforderlich.

2

Geben Sie Ihren Text ein

Geben Sie den Text ein, der gesprochen werden soll. Für integrierte Stimmen können Sie Englisch, Chinesisch oder Japanisch verwenden. Für das Voice Cloning können Sie Sprache in jeder der 18 unterstützten Sprachen erzeugen.

3

Erzeugen und anhören

Klicken Sie auf Erzeugen und Ihr Ton wird in Echtzeit gestreamt. Laden Sie das Ergebnis als hochwertige 48-kHz-Stereo-Audiodatei herunter.

Anwendungsfälle

Für wen ist MOSS-TTS-Nano?

Mehrsprachige Content-Ersteller

Erstellen Sie Voiceovers in mehreren Sprachen mit einer einzigen geklonten Stimme. Produzieren Sie Inhalte in Englisch, Chinesisch, Japanisch, Koreanisch, Spanisch, Französisch und mehr, ohne für jede Sprache Sprecher engagieren zu müssen.

Lokalisierungsteams

Erzeugen Sie lokalisierten Ton für Apps, Spiele und Medien in 18 Sprachen. Behalten Sie mit mehrsprachigem Klonen eine einheitliche Markenstimme über alle Regionen hinweg bei.

Entwickler und Forscher

Erstellen Sie Prototypen für mehrsprachige Sprachfunktionen, testen Sie TTS-Pipelines oder experimentieren Sie mit einem kompakten Open-Source-Modell, das Sie einsehen und weiterentwickeln können. Apache-2.0-lizenziert für maximale Flexibilität.

Barrierefreiheit

Erstellen Sie personalisierte synthetische Stimmen für Menschen, die verschiedene Sprachen sprechen, und helfen Sie ihnen, in ihrer Muttersprache mit einer vertrauten Stimme zu kommunizieren.

Das Beste aus MOSS herausholen

Tipps für beste Ergebnisse

Verwenden Sie sauberes Referenz-Audio zum Klonen

Hintergrundgeräusche, Musik oder Raumhall beeinträchtigen die geklonte Stimme. Verwenden Sie für beste Ergebnisse eine klare Aufnahme mit minimalen Hintergrundgeräuschen und einem einzelnen Sprecher.

Probieren Sie für jede Sprache verschiedene integrierte Stimmen aus

MOSS enthält integrierte Stimmen für Englisch, Chinesisch und Japanisch. Probieren Sie verschiedene Stimmen aus, um die beste Übereinstimmung für Ihre Inhalte zu finden, bevor Sie zum Klonen übergehen.

Streaming funktioniert am besten in Chrome

Für das reibungsloseste Echtzeit-Streaming-Erlebnis verwenden Sie Chrome oder einen anderen Chromium-basierten Browser. Firefox und Safari unterstützen einige Funktionen möglicherweise nur eingeschränkt.

Halten Sie Referenzclips kurz und fokussiert

Ein paar Sekunden klarer, natürlicher Sprache geben MOSS alles, was es zum Klonen einer Stimme braucht. Längere Clips verbessern die Qualität nicht unbedingt.

Passen Sie die Sprache an Ihren Anwendungsfall an

Stellen Sie beim Voice Cloning sicher, dass der eingegebene Text einer der 18 unterstützten Klon-Sprachen entspricht. TTS mit integrierten Stimmen ist in Englisch, Chinesisch und Japanisch verfügbar.

Voice Creator Pro

Benötigen Sie mehr Sprachen, Geschwindigkeit oder eine kommerzielle Lizenz?

Voice Creator Pro bietet Ihnen hochwertigere Modelle, Voice Cloning in über 600 Sprachen, emotionale Sprache und eine Lizenz zur kommerziellen Nutzung. Testen Sie es kostenlos in Ihrem Browser oder laden Sie die Desktop-App herunter.

Voice Cloning in über 600 Sprachen

Gehen Sie mit zusätzlichen Open-Source-Modellen für TTS in über 600 Sprachen weit über 18 Sprachen hinaus

GPU-beschleunigte Verarbeitung

Schnellere Erzeugung mit Unterstützung für NVIDIA-, Apple-Silicon-, AMD- und Intel-GPUs

Stimmdesign aus Text

Beschreiben Sie eine Stimme in einfachem Text und die KI erstellt sie. Keine Audioproben nötig

Erweitertes Voice Cloning

Mehrere Klon-Modelle, darunter Chatterbox Multilingual für die Unterstützung von über 20 Sprachen

Lokale REST-API

Automatisieren Sie die Stimmerzeugung in Ihren eigenen Apps und Workflows

Kommerzielle Lizenz

Volle Rechte zur Nutzung des erzeugten Tons in kommerziellen Projekten

FAQ

Häufige Fragen

MOSS-TTS-Nano ist ein kompaktes Open-Source-Text-to-Speech-Modell mit 100 Millionen Parametern. Es unterstützt sowohl integrierte Stimmen als auch Voice Cloning in 18 Sprachen. Das Modell verwendet einen autoregressiven Audio-Tokenizer in Kombination mit einer LLM-Pipeline, um hochwertigen 48-kHz-Stereo-Ton zu erzeugen, und ist darauf ausgelegt, auch ohne GPU effizient zu laufen.

MOSS-TTS-Nano wurde von MOSI.AI und dem OpenMOSS-Team entwickelt. Es wird unter der Apache-2.0-Lizenz veröffentlicht und ist damit sowohl für die private als auch die kommerzielle Nutzung frei verfügbar.

Für integrierte Stimmen unterstützt MOSS-TTS-Nano Englisch, Chinesisch und Japanisch. Für das Voice Cloning unterstützt es 18 Sprachen: Englisch, Chinesisch, Japanisch, Koreanisch, Deutsch, Spanisch, Französisch, Italienisch, Ungarisch, Russisch, Arabisch, Polnisch, Portugiesisch, Tschechisch, Dänisch, Schwedisch, Griechisch und Türkisch. MOSS ist das einzige Modell im kostenlosen Tool, das Klonen in anderen Sprachen als Englisch unterstützt.

Laden Sie eine kurze Audioprobe der Stimme hoch, die Sie klonen möchten, und geben Sie dann den Text ein, der gesprochen werden soll. MOSS erzeugt Sprache in dieser Stimme. Verwenden Sie für beste Ergebnisse eine klare Aufnahme mit einem einzelnen Sprecher und minimalen Hintergrundgeräuschen. Sie können Stimmen in jeder der 18 unterstützten Sprachen klonen.

MOSS-TTS-Nano erzeugt 48-kHz-Stereo-Ton, der von höherer Qualität ist als bei vielen anderen TTS-Modellen, die Mono-Ton mit 22 kHz oder 24 kHz ausgeben. Das Ergebnis ist sattere, natürlicher klingende Sprache.

Ja. MOSS-TTS-Nano ist Open-Source-Software, die unter der Apache-2.0-Lizenz veröffentlicht wird. Auf dieser Website läuft es direkt in Ihrem Browser, ohne Konto, ohne Anmeldung und ohne Nutzungsbeschränkungen.

MOSS-TTS-Nano ist eine kleinere, effizientere Version, die für die Ausführung in Echtzeit auf CPUs und im Browser konzipiert ist. Das vollständige MOSS-TTS-Modell ist größer und liefert in manchen Fällen eine höhere Klangtreue, doch MOSS-TTS-Nano behält die Kernfunktionen bei, darunter mehrsprachiges Voice Cloning und 48-kHz-Stereo-Ausgabe.

Chrome, Edge und andere Chromium-basierte Browser funktionieren am besten. Firefox und Safari unterstützen die WebGPU- und WASM-Funktionen, die MOSS-TTS-Nano zur Beschleunigung nutzt, nur eingeschränkt. Für das beste Streaming-Erlebnis verwenden Sie Chrome.