Fun-AudioGen-VD Alibaba Tongyi Lab
Alibaba Tongyi Lab が発表した音色設計モデルは、音色、感情、シーンベースのオーディオを生成するための自然言語記述をサポートしています。
ジェミニ 3.1 フラッシュ TTS Google
Googleが発表した次世代の音声合成モデルは70以上の言語とオーディオタグディレクターレベルの制御をサポート