AIが作った画像が喋る 動画生成サービス「Creative Reality Studio」登場 「GPT-3」「Stable Diffusion」を利用
生成系AIの開発などに取り組むイスラエルのD-IDは12月14日、画像が喋る動画を生成できるサービス「Creative Reality Studio」を開発したと発表した。プロンプトを基に、AIが画像や喋らせたい内容を生成。それらを自動合成し、動画として出力する。
無料プランでの利用は20クレジット分まで、有料プランは月額5.99ドルからで企業向けプランも用意している。記者も無料プランで利用してみた。まずはアバター画像生成のために「android girl,blue eyes」と入力したところ、以下のような画像を生成できた。
次に喋らせる内容を生成するため「PCとは何ですか?」と入力した。すると「PCは、プログラミング言語『C++』をベースにした機器で、コンピューターやソフトウェア開発に関する技術を使っています。PCは、家庭用やビジネス用、携帯電話用など幅広く利用されています」(原文ママ)という文章を生成した。
読み上げの言語設定を日本語に設定したところ、男性ボイス「Keita」と女性ボイス「Nanami」の2種類のボイス候補が出現。またNanamiを選んだ場合、「chat」「customerservice」「cheerful」の3種類から具体的な読み上げ方を選ぶことができた。今回は、cheerfulを選択。これらの条件で作成した動画が以下のものになる。なお、動画化には2クレジットを消費した。
Creative Reality Studioでは、D-ID独自のディープラーニング技術の他、文章の生成には米Open AIの「GPT-3」、画像の生成には英Stability AIの「Stable Diffusion」を利用しているという。テキストの読み上げは日本語など119の言語に対応している。
画像についてはテンプレートを複数用意している他、写真をアップロードして利用可能。音声についても、ユーザーが入力した文章をそのまま読ませることができる他、事前に収録した音声データをアップロードして利用することもできる。
D-IDは「このサービスを利用することで、動画コンテンツ制作のコストと手間を根本的に削減できる。ブランドや企業、クリエイターなど多くの人たちは、1枚の画像を使って魅力的な動画を簡単に作成できる」と説明。
同社のギル・ペリーCEOは「クリエイティブなジェネレーティブAI技術の可能性はまだ始まったばかりで、これから世界を席巻していくだろう。このプラットフォームを生み出し、新たなジェネレーティブAIシーンの最先端にいることを大変誇りに感じている。ユーザーの皆さまの成果を楽しみにしている」とコメントしている。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
メルカリ、梨の転売疑惑に「盗品の出品は確認されず」 誹謗中傷には利用制限も
-
2
Anthropic、「Claude Opus 5」公開 Fable 5に迫る性能を半額で――サイバー安全策は緩和、拒否時は自動フォールバックも
-
3
「iPhone高騰」はこれからも続く? 中国CXMTに近づくApple、メモリ競合へのけん制が不発に終わりそうなワケ【後編】
-
4
「ニューロマンサー」実写ドラマ、Apple TV+で2027年1月配信開始へ
-
5
海外の新作バカゲー「電車アタック」にマンガ家が感心した理由 ブッ飛んだ内容と完成度の高さ、そして“日本”
-
6
「めっちゃカメレオン」公式Discord乗っ取り 担当者PCがマルウェア感染、管理者が全員BANに 現在は復旧
-
7
暑さ対策が熱い! 「猛暑対策展」で感じた、転んでもただでは起き上がらない日本人のエネルギー
-
8
検索結果に「詐欺ではありません」と表示させる詐欺手口、警視庁が注意喚起 AI要約も餌食に
-
9
「こんなのに追われたら……」急斜面もやすやす爆走、中国製の車輪付き四足ロボのデモ動画が話題 最高時速20km超
-
10
スーパーに並んだ「ごちゃごちゃ生成AIポップ」が物議 “看板王”こと、きぬた歯科院長「これはアリ」
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR