AI1 min read
Mistral AIが多言語対応の音声合成モデル「Voxtral TTS」を発表
出典: Mistral AIが自分の声をクローンして使えるテキスト音声合成AIモデル「Voxtral TTS」を発表、9言語に対応し爆速読み上げ&軽量&オープンソースで利用可能
フランスのMistral AIが、テキスト読み上げモデル「Voxtral TTS」を発表した。主要な9言語に対応し、事前学習不要の「ゼロショットクローンボイス再生」により、自分の声をクローンして使用できる。文脈を理解した感情豊かな音声を高速で生成でき、軽量かつオープンソースで提供される点が特徴だ。自然で感情表現に優れた音声合成技術として、さまざまなアプリケーションへの組み込みが期待される。開発者にとっては、手軽に高品質な音声合成機能を実装できる選択肢が増えたことになる。
本記事は外部記事の要約です。原典は次のリンクを参照してください。
https://gigazine.net/news/20260327-mistral-voxtral-tts/