AI音频
-
ACE-Step ACE-Step
ACE Studio 与 StepFun 联合开源的音乐生成基础模型,支持高效生成与歌词编辑
-
Harmonai Harmonai
Stability AI 开源的 AI 音乐生成平台
-
Abogen Abogen
开源电子书与文档转音频工具,支持同步字幕与多语音控制
-
海绵音乐 海绵音乐
字节跳动推出的免费 AI 音乐创作平台,一句话生成可演唱歌曲
-
Whisper Live Kit WLK
自托管的超低延迟实时语音转写工具包,兼容 OpenAI REST、Deepgram WebSocket 与原生流式接口
-
Gensfx Gensfx
免费 AI 音效生成器,文本一键转高质量音效
-
Whisper OpenAI
OpenAI 开源通用语音识别模型,MIT 许可,支持 99+ 种语言的转写与翻译
-
3D-Speaker
ModelScope 开源的多模态声纹识别与说话人分离工具包
-
Gemini 3.1 Flash TTS Google
Google推出的新一代文本转语音模型,支持70+语言和音频标签导演级控制
-
Voicery Voicery
高质量AI语音合成服务,提供自然逼真的文字转语音能力
-
Voicemod Voicemod
实时AI变声工具,支持游戏、直播和社交场景的语音趣味化处理
-
FunASR Tongyi Lab
阿里通义实验室开源的工业级语音识别工具包,50+语言170x实时率、私有化部署











