Microsoft、OpenAIに頼らない初の自社製基盤モデルと高効率な音声AIを発表
米Microsoftは8月28日(現地時間)、自社開発した2つのAIモデル「MAI-Voice-1」と「MAI-1-preview」を発表した。
MAI-Voice-1は、MicrosoftのAI部門Microsoft AI(MAI)が開発した初の音声生成モデル。単一スピーカーからマルチスピーカーのシナリオまで、高音質で表現豊かなオーディオを提供するとしている。単一のGPUで1分間のオーディオを1秒未満で生成でき、「現在利用可能な音声システムの中で最も効率的なものの1つ」。既に「Copilot Daily」や「Podcasts」の機能に活用されており、「Copilot Labs」で、表現豊かな音声やストーリーテリングのデモを試せる。例えば、簡単なプロンプトで「choose your own adventure」のような物語を作成したり、睡眠を助けるためのオーダーメイドの瞑想を作成したりすることが可能だ。MAIは、音声をAIコンパニオンの未来のインタフェースとして位置づけている。Copilot Labsで試すことができる。
MAI-1-previewは、米OpenAIと協力せずにMAIがエンドツーエンドで訓練した初の基盤モデル。約1万5000基のNVIDIA H100 GPUで事前学習、事後学習を行った。日常的な質問に対して役立つ応答を提供する、強力な機能を求める消費者向けに設計されているという。現在、コミュニティモデル評価のためのプラットフォーム「LMArena」で公開テストを開始しており、今後数週間のうちにCopilot内で特定のテキスト利用ケースに展開され、ユーザーフィードバックに基づいて学習および改善を進めていく計画だ。
MAIのムスタファ・スレイマンCEOはLinkedInへの投稿で、MAI-Voice-1について「私が今まで使った中で最も表現力豊かで自然な音声生成モデル」とし、今回の発表は「氷山の一角にすぎない。われわれは、モデルの進歩だけでなく、さらに多くの価値を引き出すためにさまざまな特殊なモデルを調整することなど、次の方向性について大きな野心を持っている」と語った。また、Xでは「われわれの次の目標は大きく、モデルの進化、コンピューティングのエキサイティングなロードマップ、Microsoftの製品を通じて何十億もの人々にリーチするチャンスだ。われわれはみんなのためのAIを構築している。共感する人は、ぜひ一緒に作ろう。私のDMはオープンだ」と開発者に呼び掛けた。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
よく見られているカテゴリー
アクセスランキング
-
1
東大松尾研が「LLM講座 基礎編」の講義資料を無料公開 期間限定で
-
2
ローカルLLMは本当に手元で動くのか? ハードウェアとモデルの現実的な選び方【2026年春】
-
3
AIコスト高騰で中国DeepSeekへの“乗り換え”続出か 米国決済サービスの支出調査で明らかに
-
4
2年間で「1万時間」削減 「1円の誤りも許されない」ソニー経理が“まず試してみる”DX集団に化けたワケ
-
5
人型ロボブームを“先駆者ホンダ”はどう見る? 「悔しさもあるが……」 次の一手を聞いた
-
6
「家庭教師のトライ」が学力診断にAI活用 20問解くだけで弱点を推定 生徒と講師の負担減らす
-
7
Google Chromeの新機能「Skills」 AIプロンプトの“毎回手打ち”を不要に
-
8
X、画像投稿時に「Grokによる修正をブロック」選べるように
-
9
なぜ一部のAIモデルは「日本文化」に執着するのか? 「4o-mini」などの出力が日本に偏る実態、欧州チームが研究発表
-
10
Microsoft、自律エージェント「Scout」発表 OpenClawベースでMCP対応
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR