Innovative Tech
写真に映った人の服装、体型、姿勢、動きを同時編集 深層学習で隠れた部分も推測
Innovative Tech:
このコーナーでは、テクノロジーの最新研究を紹介するWebメディア「Seamless」を主宰する山下裕毅氏が執筆。新規性の高い科学論文を山下氏がピックアップし、解説する。
中国企業のYitu Technologyと北京航空航天大学による研究チームが開発した「Recapture as You Want」は、カメラで撮影したポートレート画像内の人を、深層学習を用いて別の服装、体型、姿勢、動きに変換する手法だ。
例えば、短パンを長ズボンに、下げている腕を上げる、足を細くする、ダンスのポーズを模倣するといった変更が可能。元の人物画像では隠れている部分や衣服も適切に推測し、全体的なまとまりも保つ。
姿勢や動きを制御する手法としては、画像内に映った人物の関節と骨格を検出して姿勢情報を転送する姿勢推定モデルがこれまでの主流だったが、今回の手法は姿勢推定に加えてセマンティックセグメンテーションを組み込んでいる。セマンティックセグメンテーションとは、画像内のピクセルをその意味に基づいて、カテゴリ分類する手法。今回は身体パーツに合わせた分類を行っている。
今回のモデルは、GAN(Generative Adversarial Network)をベースにSAT(Semantic-aware Attentive Transfer)とLGR(Layout Graph Reasoning)の2つのモジュール設計から構成されている。
SATは、意味を考慮して生成した身体パーツごとの特徴量をソースからターゲットへ伝達する役割を担う。本来の外観構造は維持するよう設計されており、動いても構造と外観を良好な状態に保持する。
LGRは、目に見えない身体パーツを推定する役割を担う。身体情報から関連する全パーツの特徴を結ぶレイアウトグラフを構築し、パーツ間の関係を推定する。
GANで使われるモジュールの1つである生成器で服装、体型、姿勢、動きを複合的に編集し、最終的に識別器モジュールとの敵対で現実的な出力結果を生成できるよう訓練する。学習用にDeepFashionとMarket-1501データセットを使用。学習したモデルは、類似研究と比較しても定性、定量実験でより良好な結果を示したとしている。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
なぜ酒蔵の許諾なしに? 「VTuberコラボ日本酒」騒動、主催者が経緯説明 仲介者による調整で「準備進んでいると認識」
-
2
かっぱ寿司「配布前のコラボグッズ、フリマで買わないで」 プリキュアコラボ発表日に注意喚起
-
3
「食事量は1日1200kcal以下、でも肥満」な人を14日間追跡調査 痩せない理由は……米コロンビア大などの研究
-
4
本物そっくり“AI生成レシート“が経費精算の脅威に マネフォ「自力で見破るのは難しい」 企業はどう備える?
-
5
「ペンギンを返して」→「3匹全部採用して」 批判殺到のSuica新キャラ、ファンアートが空気を変えた? SNSの声
-
6
「菜の花がおかしい」――イラストレーター制作うたうマラソン大会ポスターに指摘相次ぐ 事務局がAI使用明かす【訂正あり】
-
7
「壁紙DIY」とイマドキの超短焦点4Kプロジェクターを寝室で試したら検証が止められなくなった
-
8
早すぎる 「めっちゃカメレオン」Switch 2版、即日10万本突破
-
9
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
-
10
藤井風のリサイタル、公式サイトがインターネット老人会すぎると話題 公民館のチラシみたいだけど東京ドーム開催
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR