KI-Audio
-
ElfLabs ElevenLabs
Vollständige KI-Sprach- und Konversationsplattform für Erstellungs- und Kundendienstszenarien
-
Spaß Asr Fun-ASR
Das Open-Source-End-to-End-Spracherkennungsmodell von Tongyi Lab unterstützt chinesische Dialekte und 31 Sprachen.
-
Fun-AudioGen-VD Alibaba Tongyi Lab
Das von Alibaba Tongyi Lab eingeführte Timbre-Design-Modell unterstützt die Beschreibung natürlicher Sprache, um Timbre, Emotionen und szenenbasiertes Audio zu erzeugen.
-
Gemini 3.1 Flash TTS Google
Das von Google eingeführte Text-to-Speech-Modell der nächsten Generation unterstützt über 70 Sprachen und die Steuerung von Audio-Tags auf Director-Ebene
-
Harmoniai Harmonai
Stabilitäts-KI-Open-Source-KI-Musikgenerierungsplattform
-
ACE-Schritt ACE-Step
ACE Studio und StepFun veröffentlichen gemeinsam das Grundmodell der Musikgenerierung als Open Source, um eine effiziente Generierung und Textbearbeitung zu unterstützen.
-
Aero-1-Audio Aero-1-Audio
Ein leichtes Audiomodell mit nur 150 Millionen Parametern, das 15 Minuten kontinuierliche Audioverarbeitung unterstützt
-
Ein Interview AInterview
Sie sind der Gast und AI ist der Moderator, der in wenigen Minuten ein Podcast-Interview erstellt
-
AssemblyAI AssemblyAI
Eine Voice-Intelligence-Plattform mit API als Kern, die den Schwerpunkt auf Transkriptionsgenauigkeit und programmierbare Sprachfunktionen legt.
-
Audio-SDs Audio Sds
Audio Sds bietet KI-Sprachsynthese und Audioverarbeitungs-API und unterstützt das Klonen von Stimmen und mehrsprachiges TTS
-
Cleanvoice KI Cleanvoice
KI-Audio-Nachbearbeitungstools für Podcasting- und Interviewszenarien. Der wahre Wert besteht darin, Redewendungen, Pausen und Rauschen stapelweise zu bereinigen, anstatt nur zu transkribieren
-
Beschreiben Sie Overdub
KI-Tools zum Klonen und Synchronisieren von Stimmen – nutzen Sie Ihre Stimme, um alles zu sagen










