Microsoft、OpenAIに頼らない初の自社製基盤モデルと高効率な音声AIを発表
米Microsoftは8月28日(現地時間)、自社開発した2つのAIモデル「MAI-Voice-1」と「MAI-1-preview」を発表した。
MAI-Voice-1は、MicrosoftのAI部門Microsoft AI(MAI)が開発した初の音声生成モデル。単一スピーカーからマルチスピーカーのシナリオまで、高音質で表現豊かなオーディオを提供するとしている。単一のGPUで1分間のオーディオを1秒未満で生成でき、「現在利用可能な音声システムの中で最も効率的なものの1つ」。既に「Copilot Daily」や「Podcasts」の機能に活用されており、「Copilot Labs」で、表現豊かな音声やストーリーテリングのデモを試せる。例えば、簡単なプロンプトで「choose your own adventure」のような物語を作成したり、睡眠を助けるためのオーダーメイドの瞑想を作成したりすることが可能だ。MAIは、音声をAIコンパニオンの未来のインタフェースとして位置づけている。Copilot Labsで試すことができる。
MAI-1-previewは、米OpenAIと協力せずにMAIがエンドツーエンドで訓練した初の基盤モデル。約1万5000基のNVIDIA H100 GPUで事前学習、事後学習を行った。日常的な質問に対して役立つ応答を提供する、強力な機能を求める消費者向けに設計されているという。現在、コミュニティモデル評価のためのプラットフォーム「LMArena」で公開テストを開始しており、今後数週間のうちにCopilot内で特定のテキスト利用ケースに展開され、ユーザーフィードバックに基づいて学習および改善を進めていく計画だ。
MAIのムスタファ・スレイマンCEOはLinkedInへの投稿で、MAI-Voice-1について「私が今まで使った中で最も表現力豊かで自然な音声生成モデル」とし、今回の発表は「氷山の一角にすぎない。われわれは、モデルの進歩だけでなく、さらに多くの価値を引き出すためにさまざまな特殊なモデルを調整することなど、次の方向性について大きな野心を持っている」と語った。また、Xでは「われわれの次の目標は大きく、モデルの進化、コンピューティングのエキサイティングなロードマップ、Microsoftの製品を通じて何十億もの人々にリーチするチャンスだ。われわれはみんなのためのAIを構築している。共感する人は、ぜひ一緒に作ろう。私のDMはオープンだ」と開発者に呼び掛けた。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
よく見られているカテゴリー
アクセスランキング
-
1
「ChatGPTのコネクタでつながるし、M365 Copilotいらなくない?」→有識者3人に聞いてみた 知らないと損するコンテキスト管理「Work IQ」の仕組み
-
2
データセンター建設に足りないのは「発電」ではなく「送電」 AI需要で電力消費26%増、Gartner予想
-
3
“AIが電力使いすぎ問題” 「電力不足」懸念で、発電能力より深いボトルネックとは
-
4
中国が人型ロボット開発競争をリードする「納得の理由」 日本に残された逆転シナリオは?
-
5
「もはや宗教」のClaudeに焦るOpenAI 流出メモが暴いた覇権交代のリアル
-
6
「今、Codexのレート制限を解除したい」を解決? “付与したリセット権の貯蓄”可能に 有料ユーザー向け
-
7
東大松尾研が「LLM講座 基礎編」の講義資料を無料公開 期間限定で
-
8
JASRAC、「AI作曲・人間作詞」の曲は管理します――「人間の創作的寄与の有無」で線引き
-
9
「人型ロボ世界シェア1位」中国Unitreeに聞く“普及戦略” 日本市場をどう開拓?
-
10
「日本がいないと成り立たない」世界へ、フィジカルAIが導く独自の交渉力
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR