コンテンツへスキップ
AI1 min read

Microsoft、音声・画像生成AIの新基盤モデル3種をリリース

出典: Microsoftが音声生成モデル「MAI-Voice-1」・音声認識モデル「MAI-Transcribe-1」・画像生成モデル「MAI-Image-2」の3つのAI基盤モデルをリリース

Microsoftが自社開発のAI基盤モデルとして、音声生成モデル「MAI-Voice-1」、音声認識モデル「MAI-Transcribe-1」、画像生成モデル「MAI-Image-2」の3つを発表した。これまでOpenAIのモデルに依存してきたMicrosoftが、独自の基盤モデル開発を本格化させている動きと見られる。音声と画像の両分野で自社モデルを展開することで、Azure上でのAIサービス提供における選択肢が広がる。今後のAzure AI Servicesへの統合や性能ベンチマークに注目が集まる。

本記事は外部記事の要約です。原典は次のリンクを参照してください。

https://gigazine.net/news/20260403-microsoft-ai-mai-voice-1-transcribe-image-2/