AI画像作成/AI動画作成のランキング
AI画像・動画作成ツールは、テキスト指示(プロンプト)から高品質なビジュアル素材を自動生成するIT製品です。広告バナーやプレゼン用イメージ、SNS向け動画などを短時間で制作可能。外部委託コストや素材探しの手間を抑え、マーケティング施策のPDCAサイクルを高速化します。専門スキルがなくても、ブランドイメージに沿った訴求力の高いビジュアルを内製化でき、ビジネスにおける表現の幅とスピードを飛躍的に広げます。
- 初心者でも直感的に使える簡単操作
- 豊富なテンプレートと素材で動画を短時間制作
- AI自動字幕・文字起こしで編集工数を削減
WriteVideo
株式会社X
- ドキュメントを読み込むだけでAIが動画を即時生成。最新情報もワンクリックで更新。
- 現在60か国語の言語に対応
- Word・パワポ感覚の直感操作で、誰でも簡単に編集可能
Nano Banana、Gemini Omniは、Googleの生成AIサービス「Gemini for Google Workspace」上で画像や動画を生成・編集できる機能です。画像生成にはNano Banana 2および上位モデルのNano Banana Proを、動画生成にはGemini Omniを用い、テキストで指示するだけで素材の作成から編集までを1つの対話画面で完結できます。
■Nano Banana 2による高精度な画像生成と部分修正
Nano Banana 2は、写実的なタッチから水彩画・漫画風まで幅広いスタイルの画像を生成でき、世界に関する知識を生かした図やインフォグラフィックの作成にも対応します。生成後は画像の一部だけを指定して変更する部分修正が可能で、キャラクターの外見を保ったまま複数の画像を作り分けられます。
■有料プランはNano Banana Proで画像の再生成も可能
有料プランでは、生成した画像をNano Banana Proで再生成でき、特にテキストを含む画像やインフォグラフィックでより多くのディテールを加えられます。画像はGoogle AIプラン利用時に最大2K解像度(非利用時は1K解像度)でダウンロードできます。
■Gemini Omniが可能にする対話形式での動画制作
動画生成にはGoogleの最新モデルGemini Omniを用います。テキストプロンプトのほか、最大5枚の画像や1本の動画をアップロードして参照素材として組み合わせられ、会話をするような感覚で数分のうちに動画を作成できます。
■動画への編集や複数ターンでの修正にも対応
Gemini Omniは動画から動画への編集や、1つの会話内で編集を重ねられるマルチターン編集に対応します。アスペクト比は横向きを既定としつつ、参照画像・動画をアップロードした場合はその比率を引き継いで生成することも可能です。
■テキスト挿入やキャラクターの一貫性維持にも対応
Nano Banana 2はサポート対象言語の範囲内でスペルの正確なテキストを画像に追加できることに強みを持ち、複雑な指示にも詳細まで従う点なども強化を続けています。生成した動画は下部メニューからダウンロードやYouTubeでの共有、また音声を同時生成するようリクエストすることも可能です。
※この概要はAIツールを活用して作成し、発注ナビ/ITセレクト編集部が内容を確認しています。
ChatGPT Imagesは、OpenAIが提供する生成AIサービス「ChatGPT」に組み込まれた画像生成・編集機能です。作りたい画像を言葉で説明するだけで、その内容に沿った画像を生成できます。既存の画像をアップロードして変更点を伝えれば編集・微修正も可能。Web版、iOS/Androidアプリなど幅広い環境で機能を利用できます。
■テキストプロンプトのみで完了するAIによる画像生成
ChatGPT Imagesは、ユーザーがチャットで作成したい画像の内容を言葉で説明するだけで画像を生成できます。メニューから「Images」を選択してプロンプトを入力する方法にも対応。指示の複雑さによって生成には数分かかる場合がありますが、生成中もChatGPTで別の操作を続けられます。アスペクト比などの条件もプロンプトで指定できます。
■既存画像をアップロードして変更したい内容を指示できる
ChatGPT Imagesで生成した画像だけでなく、手持ちの既存画像をアップロードし、加えたい変更をチャットで説明することでも編集を行えます。選択ツールで画像の一部を指定してから変更を伝える方法と、選択せずに会話パネルで直接編集内容を説明する方法の複数通りに対応します。
■テキストの追加や背景透明化などの編集指示への対応
ChatGPT Imagesは、画像内へのテキストの追加、細部の追加、背景の透明化といった具体的な指示にも対応します。特定の領域だけを編集したい場合は、対象領域をプロンプト(指示文)に含めることで反映できます。任意のアスペクト比を指定して画像を生成することも可能です。
■専用エディタで画像の一部を追加・削除・更新できる
会話内や「Images」一覧から画像を選択するとエディタが開き、選択ツールで編集したい領域をハイライトしたうえで、画像の一部を追加・削除・更新できます。アスペクト比の変更や、元に戻す・やり直すといった操作にも対応し、Web・iOSアプリ・Androidアプリの各環境で利用可能です。
■作成した画像の自動保存とコピー・共有への対応
ChatGPTで作成した画像は自動的に「Images」に保存され、後から閲覧・再確認・再利用もできます。画像を開けば、クリップボードへのコピーやデバイスへの保存、別アプリへの共有が行えます。
※この概要はAIツールを活用して作成し、発注ナビ/ITセレクト編集部が内容を確認しています。
Canva AI/マジック生成(Magic Media)は、Canvaの編集画面内でテキストを入力するだけで画像・グラフィック・動画を生成できるCanvaの主機能です。無料プランでも一定回数まで試せるほか、生成した素材はそのままCanvaのデザインに組み込めます。
■テキスト入力だけで完成する画像生成
「テキストから画像を生成」を選ぶと、入力した説明文をもとに画像を作成します。フォトグラフィー、デジタルアート、ファインアートといったスタイルから選択でき、サイズや比率もあわせて指定できます。
■テキストからグラフィックも作成できる
「テキストからグラフィックを生成」では、アイコンやステッカー、イラストなどをブランドの雰囲気などに合わせて作成できます。用意されたスタイルの中から選ぶことで、資料やデザインになじむ素材を短時間で生成できます。
■4秒の動画をテキストから自動生成
「テキストから動画を生成」機能で、説明文とスタイルをもとにSNSで用いやすい数秒の動画を作成します。参考画像をアップロードして雰囲気を反映させる指示も可能です。
■生成後もCanvaの編集画面で微調整できる
生成したデータはCanvaのデザインキャンバスへ配置し、編集、微調整することも可能です。テンプレートや他の素材と組み合わせながら、資料やSNS投稿などの用途に応じて仕上げられます。
■プランごとに用意された利用回数の上限
無料プランでは画像生成が全50回まで、動画生成は月5回まで(2026年8月時点、以下同)。生成回数の上限を増やしたPro・Teams・Nonprofits・Educationプランも用意します。
※この概要はAIツールを活用して作成し、発注ナビ/ITセレクト編集部が内容を確認しています。
Gensparkは、画像生成と動画生成を1つのワークスペースにまとめた生成AIツールです。Nano Banana ProやGPT Image、Kling、Gemini Veoなど多数のAIモデルを使い分けられ、生成後の編集まで同じ画面で完結します。会員登録により毎日無料のクレジットが付与される仕組みも用意します。
■画像生成は8種類以上のAIモデルを比較しながら使える
万能型のNano Banana Pro、テキスト描画に強いGPT Image 2、顔の再現力が高いIdeogram、写実的な描写が得意なFluxなど、8種類以上のモデルを自分で選ぶことも、システム任せにすることもできます。複数モデルの結果を並べて比較しながら、目的に合った1枚を選び取れます。
■背景除去や画像拡張に対応する画像編集機能
生成した画像はインペイントやアウトペイントで一部だけを描き直せるほか、背景の除去やオブジェクトの消去、アップスケールにも対応します。画像内の文字も、全体を再生成せずにテキスト編集ツールで誤字だけを直せるため、手戻りの少ない仕上げが可能です。
■動画生成は14以上のモデルをMOAが自動で選び分ける
Kling、Gemini Veo、PixVerse、Sora、Runway、Hailuo、VIDU、Seedanceなど14以上の動画生成モデルを同じ画面で切り替えられます。複雑な動きはKling、映像美はVeo、速度重視ならPixVerseというように得意分野が異なり、迷ったときはMOAが最適なモデルへ自動で振り分けます。
■クリップ延長とタイムライン結合による柔軟な動画編集
パンやズームイン、ドリー前進、空撮ショットなどカメラワークをプロンプトで細かく指定でき、開始・終了フレームを明示する制御にも対応します。生成後は延長機能でクリップを長くしたり、内蔵タイムラインで複数クリップを結合したりでき、解像度のアップスケールも同じ画面で完結します。
■音声と口の動きをリップシンクで自動同期させる
音声をアップロードするかスクリプトを入力するだけで、キャラクターの口の動きと音声を同期させるリップシンク機能も用意します。OmniHumanによるデジタルヒューマン生成にも対応し、製品デモや教材、SNS向け動画などトーキングヘッド系のコンテンツ制作に役立ちます。
※この概要はAIツールを活用して作成し、発注ナビ/ITセレクト編集部が内容を確認しています。
Microsoft Copilotには、テキストプロンプトから画像を生成する機能が標準搭載されています。既存の画像をアップロードして内容を編集するよう依頼することも可能です。
■テキストプロンプトによる新規画像生成
プロンプトに具体的な内容を書き込むと、Copilotが数秒から数分程度で画像を生成します。「夕暮れの未来都市を描いたフォトリアリスティックな画像を作成する」のように、アートスタイルや雰囲気を詳しくプロンプトで指定するほど、意図に近い仕上がりを得られます。
■アップロード画像に修正を加えられる
「開く」アイコンから画像ファイルを添付し、「背景の人物を削除する」「設定を森に変更する」といったプロンプトを送信すると、Copilotが指示に沿って画像を修正します。同じ会話内であれば、続けて追加の修正依頼を行うことも可能です。
■目的別のプロンプト例を複数用意
リアルな肖像画、漫画調のスケッチ、幻想的なファンタジーアート、終末後の世界観を描いた風景など、目的別のプロンプト例もサポートページに用意されています。
■生成・アップロード画像は18カ月保持される
Copilotで生成またはアップロードした画像は18カ月間(2026年8月時点、以下同)システム上に保持されます。生成した画像は会話履歴からユーザー自身がいつでも削除できるほか、生成画像をAIのモデルトレーニングに利用しない設定(オプトアウト)も可能です。
■画像アップロード時の利用制約
生成用にアップロードする画像は自身が権利を保有するか、使用許諾を得たものに限られます。第三者の著作権・商標権・肖像権を侵害する画像や本人の同意のない人物描写を含む画像は禁止されており、違反時はアカウントやCopilotの利用が制限される場合があります。
※この概要はAIツールを活用して作成し、発注ナビ/ITセレクト編集部が内容を確認しています。
Perplexityは検索エンジンと対話型AIを組み合わせた「AI検索エンジン」で、検索チャットの中で画像や動画も生成できる機能も備えます。プロンプトを入力するだけでGPT Image 1やVeo 3.1など複数モデルの中から自動的に最適なものが選ばれ、数秒から数分で画像や動画を生成できます。
■チャット入力だけで完結する画像生成
検索バーにプロンプトを入力するだけで、Perplexityが自動的に画像を生成する仕組みが用意されています。GPT Image 1、Nano Banana、Seedream 4.5、FLUX.1といった複数の画像生成モデルの中から内容に応じて最適なものが自動選択されるほか、設定画面から使用モデルを手動で指定することもできます。
■生成した画像を再生成やプロンプト追加で仕上げる
生成された画像に満足できない場合は、画像下の「再生成」をクリックすることで新しい画像を再生成することも可能です。同じスレッド(会話)内に「画像を生成して」といった追加のプロンプトを送ることでも調整が可能です。なお、再生成も1日あたりの画像生成上限としてカウントされる点には留意しましょう。
■検索モードを使った手軽な動画生成機能
検索バーにプロンプトを追加し、検索モードを選ぶことで動画も生成できます。使用モデルはVeo 3.1で、Pro/Max加入者は標準モード、Enterprise Pro加入者は高速モード、Enterprise Max加入者はエンタープライズ向け機能と、プランに応じて処理内容が変わります。
■1枚の写真を動画の開始フレームに変換
動画生成のクエリに画像ファイルを添付することで、その画像を動画の最初のフレームとして使用する動画を生成する機能も用意します。手持ちの写真やイラストに動きを与えたい場合に有効で、業務シーンでは例えばブランド開発や商品紹介、観光や施設紹介のフライオーバー動画といった用途に活用できます。
■Cometアシスタントと連携したSNS投稿機能
Perplexity提供のブラウザ「Comet」のアシスタント機能を併用すると、生成した動画をXやFacebookなどのSNSに投稿したり、Webサイトにアップロードしたりする作業、タスクも自動化できます。Enterprise ProとEnterprise Maxプランでは生成したコンテンツを商用目的で使用できます。
※この概要はAIツールを活用して作成し、発注ナビ/ITセレクト編集部が内容を確認しています。
Runway
Runway AI, Inc.
Runwayは、Runway AIが開発するクリエイティブAIプラットフォームです。テキストや画像プロンプトをもとに高品質な静止画を生成する「Gen-4 Image」と、静止画に動きを与えて5秒/10秒の映像を生成する「Gen-4」の映像生成機能を備えています。プロンプト操作だけで幅広いビジュアル表現を実現できます。
■プロンプトのみで高品質な静止画を生成する基本機能
「Gen-4 Image」はRunwayの画像生成における最新モデル(2026年8月時点、以下同)で、スタイル表現の幅と画質の高さを両立しています。シンプルなプロンプトでも扱いやすく、詳細な記述を加えることで表現の自由度をさらに高められます。ダッシュボードの「Generate Image」から利用できます。
■アップロード画像から自動でプロンプトを生成します
「Describe Image」機能を使うと、アップロードした画像をもとに被写体やシーン、スタイルを解析したプロンプトが自動生成されます。ゼロからプロンプトを書く手間を減らし、参考画像に近い雰囲気の画像づくりを後押しします。
■画角・解像度・生成数などの詳細設定
アスペクト比は16:9や9:16、1:1など6種類から選択でき、解像度は1080pと720pに対応します。1回の生成で1枚または4枚をまとめて出力可能なほか、「Aesthetic Range」設定で同一プロンプトからの表現の振れ幅を0〜5段階で調整できます。
■生成画像をワンクリックで動画制作へつなげます
生成した画像は「Use」機能により、そのままText/Image to Videoの動画生成ツールへ引き継げます。また「Vary」を使えば、選んだ画像を起点に構図の異なる新たな画像セットを生成でき、アイデア出しの幅を広げます。
■静止画から5秒・10秒動画を生成するGen-4の映像機能
「Gen-4」は入力画像とテキストプロンプトをもとに、5秒または10秒の動画を生成します。被写体の動き・カメラワーク・シーンの変化・スタイルといった要素を段階的にプロンプトへ加えることで、意図した映像表現に近づけられます。
※この概要はAIツールを活用して作成し、発注ナビ/ITセレクト編集部が内容を確認しています。
Midjourney
Midjourney, Inc.
Midjourneyはテキストプロンプトから独自の画像を生成できるAIクリエイティブツールです。Web上のCreateページで文章を入力するだけで、4枚1組の画像を短時間で作成できます。生成した画像はアップスケールや編集、動画化まで一貫して行えるため、アイデアを素早くビジュアル化したい制作現場で活用が広がっています。
■Imagineバーへのテキスト指示による高品質な画像生成
Midjourneyは、まずツールの「Imagineバー」へ作りたいイメージを文章で入力するだけで4枚1組の画像を生成できます。ここからプロンプトの書き方次第で作風や構図を細かく調整でき、思い描いたビジュアルにスムーズに近づけます。
■好みのスタイルを学習
ユーザーが作成したムードボードやパーソナライズプロファイルをもとに、個々の好みに合わせた画風を学習します。繰り返し使うほど自分らしいテイストの画像を生成しやすくなり、制作の方向性を固める後押しとなります。
■Editorによる部分編集とアップスケール機能
生成後の画像はEditorでPan(範囲拡張)やZoom Out、Vary Region(消しゴムツール)を使って部分的に描き直せます。併せて、Variations機能で別案を作ったり、Upscale機能で解像度を高めたりと、仕上げの工程まで1つの画面で完結できます。
■静止画を5秒の動画に変換
Video機能では手持ちの画像やMidjourneyで生成した画像を開始フレームに指定し、任意のテキストプロンプトを添えるだけで5秒間の動画を生成できます。DiscordとWebサイトの両方から操作でき、初めてでも直感的に扱える特徴も持ちます。
■モーション強度や始点終点を指定した動画制御
「--motion low/high」パラメータでカメラの動きの大きさを調整できるほか、始点と終点を同じ画像にしたループ動画、別画像を終点に指定した動画なども作成できます。演出意図に応じて動きを細かく制御できます。
■動画は最大21秒まで延長し用途別に書き出せます
生成した動画は5秒単位で最大4回まで延長でき、合計21秒まで再生時間を伸ばせます(2026年8月時点、以下同)。書き出し時は「Download for Social」「Download Raw Video」「Download Gif」形式から用途に応じて選択でき、SNS投稿や動画素材としての保存に活用できます。
※この概要はAIツールを活用して作成し、発注ナビ/ITセレクト編集部が内容を確認しています。
Adobe Firefly
アドビ株式会社
- 無料プランあり
Adobe Fireflyは、テキストプロンプトから画像や動画を生成できる、アドビが提供するクリエイティブAIサービスです。写実的な画像からイラスト調のビジュアル、商品動画まで幅広い制作に対応し、基本機能を試せる無料プランも存在。生成したコンテンツは商用利用も可能で、企業のコンテンツ制作効率化を後押しします。
■テキストプロンプトからの高品質な画像生成
テキストプロンプトを入力するだけで、写実的な表現からイラスト調まで多様なスタイルの画像を作成できます。1回のプロンプトにつき4パターンの画像が生成され、気に入った候補から近いテイストの画像をさらに作ることも可能です。
■静止画へのモーション追加による動画生成
アップロードした静止画にモーションやカメラワークを加え、動画として書き出せます。テキストプロンプトのみからの動画生成にも対応しており、商品動画やSNS向けの短尺動画などを短時間で制作できます。
■複数AIモデルを切り替えられる統合ワークスペース
自社のFireflyモデルに加え、Google VeoやRunway、Kling AIなど外部の動画生成モデルを1つのワークスペース内で切り替えて利用できます。同じプロンプトを複数モデルで試し、結果を比較することも可能です。
■生成後の要素追加・削除に対応した編集機能
生成した画像は、要素の追加や削除、色調やスタイルの変更といった調整に対応します。動画についても、クリップのトリミングや並べ替え、特定シーンの再生成などをワークスペース内で完結できます。
■Adobe Stock由来の学習データによる安心の商用利用
Fireflyのモデルは、Adobe Stockのライセンス画像や著作権が失効した素材をもとに学習されており、生成した画像や動画は安心して商用利用できます。広告や販促物など、ビジネス用途への活用が想定されています。
■動画音声の翻訳とAI吹き替えへの対応
動画内の音声を翻訳する機能や、テキストからナレーションを生成する機能を備えています。AIによる吹き替えにも対応しており、海外向けコンテンツの多言語展開を効率よく進められます。
※この概要はAIツールを活用して作成し、発注ナビ/ITセレクト編集部が内容を確認しています。
※この概要はAIツールを活用して作成し、発注ナビ/ITセレクト編集部が内容を確認しています。








