KI-Audio
-
3D-Lautsprecher
ModelScope ist ein Open-Source-Toolkit zur multimodalen Stimmabdruckerkennung und Sprechertrennung.
-
ACE-Schritt 1.5 ACE-Step
Open-Source-Musik-Basismodell, auch Consumer-Grafikkarten können ausgeführt werden
-
AI Music Generator (AI Song Maker) AI Song Maker
Geben Sie Text ein, um einen vollständigen Song zu erstellen, mit KI-Komposition, Texten und Covern in einem Paket
-
Ziel Aispect
Wandeln Sie Live-Gespräche in Echtzeit in visuelle Bilder um und verleihen Sie abstrakten Reden einen gemeinsam nutzbaren visuellen Ausdruck
-
Audiify AI Audify AI
Hochwertige TTS-Tools kostenlos mit OpenAI-Schlüsseln, kein Abonnement, keine Überraschungen
-
Beatofen Beatoven
KI generiert urheberrechtsfreie Hintergrundmusik, um exklusive Soundtracks für Videos und Podcasts anzupassen
-
Coqui Coqui
Coqui legt den Schwerpunkt auf den ausführbaren Aufgabenablauf und legt Wert auf eine stabile Bereitstellung und Effizienzsteigerung.
-
Ekhos KI
KI-Plattform für Sprachsynthese und Audioinhaltserstellung
-
Fisch-Audio Fish
Eine Text-to-Speech- und Sprachklonungsplattform, die sich auf emotionale Ausdruckskraft konzentriert und auf dem Open-Source-Fish-Speech-Modell basiert
-
Spaß-ASR1.5 阿里通义
Ein von Alibaba Tongyi eingeführtes End-to-End-Spracherkennungsmodell. Ein einzelnes Modell unterstützt 30 Sprachen und sieben Hauptdialekte.
-
FunASR Tongyi Lab
Alibaba Tongyi Labs Open-Source-Spracherkennungs-Toolkit in Industriequalität, 170-fache Echtzeitrate in über 50 Sprachen, privatisierte Bereitstellung
-
Abogen Abogen
Open-Source-Tool zur Konvertierung von E-Books und Dokumenten, das synchronisierte Untertitel und die Steuerung mehrerer Stimmen unterstützt











