Fun-ASR-リアルタイム Alibaba Cloud
Alibaba Qianwen が発表した大規模なストリーミング リアルタイム音声認識モデルは、16 の方言と 30 の言語のリアルタイム認識をサポートしています。
Fun-CosyVoice 3.5 FunAudioLLM
Alibaba Tongyi Laboratory の FunAudioLLM チームが立ち上げた多言語音声生成モデルは、FreeStyle 自然言語コマンド制御とゼロサンプル音声クローン作成をサポートしています。