Innovative Tech
写真に映った人の服装、体型、姿勢、動きを同時編集 深層学習で隠れた部分も推測
Innovative Tech:
このコーナーでは、テクノロジーの最新研究を紹介するWebメディア「Seamless」を主宰する山下裕毅氏が執筆。新規性の高い科学論文を山下氏がピックアップし、解説する。
中国企業のYitu Technologyと北京航空航天大学による研究チームが開発した「Recapture as You Want」は、カメラで撮影したポートレート画像内の人を、深層学習を用いて別の服装、体型、姿勢、動きに変換する手法だ。
例えば、短パンを長ズボンに、下げている腕を上げる、足を細くする、ダンスのポーズを模倣するといった変更が可能。元の人物画像では隠れている部分や衣服も適切に推測し、全体的なまとまりも保つ。
姿勢や動きを制御する手法としては、画像内に映った人物の関節と骨格を検出して姿勢情報を転送する姿勢推定モデルがこれまでの主流だったが、今回の手法は姿勢推定に加えてセマンティックセグメンテーションを組み込んでいる。セマンティックセグメンテーションとは、画像内のピクセルをその意味に基づいて、カテゴリ分類する手法。今回は身体パーツに合わせた分類を行っている。
今回のモデルは、GAN(Generative Adversarial Network)をベースにSAT(Semantic-aware Attentive Transfer)とLGR(Layout Graph Reasoning)の2つのモジュール設計から構成されている。
SATは、意味を考慮して生成した身体パーツごとの特徴量をソースからターゲットへ伝達する役割を担う。本来の外観構造は維持するよう設計されており、動いても構造と外観を良好な状態に保持する。
LGRは、目に見えない身体パーツを推定する役割を担う。身体情報から関連する全パーツの特徴を結ぶレイアウトグラフを構築し、パーツ間の関係を推定する。
GANで使われるモジュールの1つである生成器で服装、体型、姿勢、動きを複合的に編集し、最終的に識別器モジュールとの敵対で現実的な出力結果を生成できるよう訓練する。学習用にDeepFashionとMarket-1501データセットを使用。学習したモデルは、類似研究と比較しても定性、定量実験でより良好な結果を示したとしている。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
「Xが情報収集に役立たない……」熊本地震で不満の声続出 「Twitterを返して」
-
2
メルカリ、梨の転売疑惑に「盗品の出品は確認されず」 誹謗中傷には利用制限も
-
3
「こんなのに追われたら……」急斜面もやすやす爆走、中国製の車輪付き四足ロボのデモ動画が話題 最高時速20km超
-
4
検索結果に「詐欺ではありません」と表示させる詐欺手口、警視庁が注意喚起 AI要約も餌食に
-
5
はてな、11億円流出の調査報告書を公開 偽警察、口外禁止、残業・休出200時間超、孤立……ほころびが連鎖
-
6
Z世代に聞く次の流行、「AIイラスト」が1位に 「Claude Code」も上位
-
7
東野圭吾さん死去、Xなどで追悼相次ぐ 「ガリレオ」など数々の人気作、エンジニアから転身
-
8
NVIDIAやMicrosoftなど30社超、オープンAIの防御ツール共同開発の「Open Secure AI Alliance」設立
-
9
農水省の“クソダサ”ポスター話題 「AIよりよっぽど良い」の声も 担当者に狙いを聞いた
-
10
「あ、その情報メモしたい!」を叶えるワイヤレスイヤフォン、Nothing「Ear (3a)」
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR