マイクロソフトは、テキスト、音声、視覚コンテンツを生成できる3つの基本モデルを発表することで、人工知能分野での地位を強化しています。これらのモデルは、MAIスーパーインテリジェンスチームによって開発されており、AIスタックの完全な制御への移行を反映しており、単なる能力の統合ではありません。モデルには、25の言語をサポートする音声転写モデルのMAI-Transcribe-1、わずか1秒で60秒の音声を生成できるMAI-Voice-1、視覚コンテンツの生成に特化したMAI-Image-2が含まれています。マイクロソフトは、ビジネス環境での採用に対する経済的利点を強調し、競争力のある価格でこれらのモデルを提供することを目指しています。内部開発にもかかわらず、同社はOpenAIとのパートナーシップを維持し、重要な能力の内部開発と外部との協力によるイノベーションの加速という二重戦略を採用しています。この動きは、企業により多くの選択肢とコストの利点を提供し、既存のマイクロソフト製品に迅速に統合されます。