AI音频
-
3D-Speaker
ModelScope 开源的多模态声纹识别与说话人分离工具包
-
Eleven Music ElevenLabs
ElevenLabs 的 AI 音乐生成平台,兼顾创作者工作台、商业授权市场和可嵌入式 Music API
-
OpenAI Advanced Voice OpenAI
ChatGPT 内置的实时语音对话模式,支持情感感知、打断交互与多轮自然对话
-
Voicery Voicery
高质量AI语音合成服务,提供自然逼真的文字转语音能力
-
ElevenLabs ElevenLabs
面向创作与客服场景的全栈 AI 语音与会话平台
-
Omnilingual ASR Meta FAIR
Meta FAIR 开源 1600+ 语言的语音转写系统
-
Voicemod Voicemod
实时AI变声工具,支持游戏、直播和社交场景的语音趣味化处理
-
Ekhos AI
AI 语音合成与音频内容创作平台
-
Omnilingual ASR Meta FAIR
Meta FAIR 开源 1600+ 语言的语音转写系统
-
Voicebox Meta
Meta 研究团队提出的通用语音生成模型,核心卖点是零样本、多任务和更快推理
-
Ecrett Music ecrett
面向创作者的 AI 免版税配乐生成工具,按场景、情绪和类型快速生成可商用音乐
-
NaturalReader NaturalReader
同时覆盖个人朗读、商用配音与教育无障碍的老牌 AI 文本转语音平台










