パナソニック、拡散モデルによるマルチモーダルAI「LaViDa」開発 文章生成を高速化
パナソニック ホールディングス(パナソニックHD)と傘下の米パナソニックR&Dカンパニー オブ アメリカは11月27日、主に画像生成AIに利用する「拡散モデル」で文章を生成するマルチモーダルAI「LaViDa」を開発したと発表した。米カリフォルニア大学ロサンゼルス校の研究者と協力。従来の文章生成で多く使われる「自己回帰型モデル」の一部に比べ、処理を高速化したという。
拡散モデルによる文章生成では、入力データの一部にランダムにマスキングを施し、それを復元していく。自己回帰型モデルに比べ、処理を高速化できるなどの強みを持つ一方、1)単語同士の関連度を演算する「アテンション計算」が重くなる、2)学習時のマスキングに不具合が生じる可能性が高まる、という課題があった。
そこで、パナソニックHDらは、入力画像と質問文のトークン(データを処理するために分割した最小単位)のアテンション計算から、出力する文章のトークンを排除する仕組み「Prefix-DLM」を開発した。これにより、計算を効率化。加えて、マスキングするトークンに漏れがないよう、相補的な2通りのマスキングを用意し、全てのトークンをAIが学習できるようにした。
ベンチマークの結果、LaViDaは、自己回帰型モデル「Open-LLaVa-Next-8B」に比べ、グラフなどが含まれる書類の内容理解や、数学の証明問題などで高い性能を示し、文章の生成も速かったという。また、自己回帰型モデルが苦手とされる特定の形式に沿った文章生成もできたという。
今回の研究成果は、機械学習分野の国際会議「NeurIPS 2025」に採択された。12月3日から5日まで米国サンディエゴで開催される本会議にて発表予定。
Copyright © ITmedia, Inc. All Rights Reserved.
関連記事
こんなメディアも見られています
ITmedia AI+に関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
よく見られているカテゴリー
アクセスランキング
-
1
データセンター建設に足りないのは「発電」ではなく「送電」 AI需要で電力消費26%増、Gartner予想
-
2
「Claude Fable 5」「Mythos 5」全面停止 米政府の指令により Anthropicは早期復旧を宣言
-
3
最新AI「Fable 5」でYouTube動画作ってみた 想像以上の出来に驚愕、ただし大きな弱点も
-
4
「ChatGPTのコネクタでつながるし、M365 Copilotいらなくない?」→有識者3人に聞いてみた 知らないと損するコンテキスト管理「Work IQ」の仕組み
-
5
トヨタが抜かれる日――キオクシア首位奪取、2005年「時価総額トップ10」を振り返る
-
6
NTT、独自のAIモデル「tsuzumi 2」発表 “国産AI開発競争”に「負けられない」と島田社長
-
7
中国が人型ロボット開発競争をリードする「納得の理由」 日本に残された逆転シナリオは?
-
8
「もはや宗教」のClaudeに焦るOpenAI 流出メモが暴いた覇権交代のリアル
-
9
「人型ロボ世界シェア1位」中国Unitreeに聞く“普及戦略” 日本市場をどう開拓?
-
10
時価総額3兆ドルの原動力 NVIDIAトップが貫く「誰もやらない」逆張りの経営
SpecialPR
ITmedia AI+ SNS
インフォメーション
注目情報をチェック
ITmedia AI+をフォロー
あなたにおすすめの記事PR