KI-Audio
-
Castmagic Castmagic
KI-gesteuerte Engine zur Wiederverwendung von Podcast-Inhalten, die Audio automatisch in Shownotizen, Social-Media-Beiträge, Zeitstempel und Zusammenfassungen umwandelt
-
Coqui Coqui
Coqui legt den Schwerpunkt auf den ausführbaren Aufgabenablauf und legt Wert auf eine stabile Bereitstellung und Effizienzsteigerung.
-
Beschreiben Sie Overdub
KI-Tools zum Klonen und Synchronisieren von Stimmen – nutzen Sie Ihre Stimme, um alles zu sagen
-
Ekhos KI
KI-Plattform für Sprachsynthese und Audioinhaltserstellung
-
Abogen Abogen
Open-Source-Tool zur Konvertierung von E-Books und Dokumenten, das synchronisierte Untertitel und die Steuerung mehrerer Stimmen unterstützt
-
ElfLabs ElevenLabs
ElevenLabs ist eine führende KI-Audioplattform, die Sprachgenerierung, Sprachagenten, Transkription und Musikgenerierung abdeckt und vollständige API-Funktionen bietet.
-
Flow-Musik Flow Music
Die von Google Labs gestartete KI-Plattform zur Musikerstellung nutzt Dialoge, um komplette Songs von bis zu 3 Minuten zu generieren
-
ACE-Schritt 1.5 ACE-Step
Open-Source-Musik-Basismodell, auch Consumer-Grafikkarten können ausgeführt werden
-
AI Music Generator (AI Song Maker) AI Song Maker
Geben Sie Text ein, um einen vollständigen Song zu erstellen, mit KI-Komposition, Texten und Covern in einem Paket
-
Spaß-ASR-Echtzeit Alibaba Cloud
Ein großes Streaming-Echtzeit-Spracherkennungsmodell, das von Alibaba Qianwen eingeführt wurde, unterstützt die Echtzeiterkennung von 16 Dialekten und 30 Sprachen.
-
Ziel Aispect
Wandeln Sie Live-Gespräche in Echtzeit in visuelle Bilder um und verleihen Sie abstrakten Reden einen gemeinsam nutzbaren visuellen Ausdruck
-
Fun-CosyVoice 3.5 FunAudioLLM
Das vom FunAudioLLM-Team des Alibaba Tongyi Laboratory eingeführte mehrsprachige Sprachgenerierungsmodell unterstützt die FreeStyle-Befehlssteuerung in natürlicher Sprache und das Sprachklonen ohne Stichproben.










