Googleの画像生成AIが進化 「Nano Banana Pro」登場 言語・編集能力を大幅強化、4Kにも対応
米Googleは11月20日(現地時間)、新たなAI画像生成モデル「Nano Banana Pro」(Gemini 3 Pro Image)を発表した。同社の最新基盤モデル「Gemini 3 Pro」をベースにしており、キャラクターなどの一貫性を維持しながら、自然言語による指示で細部を修正できる編集機能など画像処理能力を大幅に強化した。
Nano Banana Proでは、Gemini 3 Proの強力な推論性能、世界に関する知識などを用いることで、より正確でコンテキストに富んだビジュアルの生成を実現。一貫性を維持しながら複数のキャラクター・人物を登場させることも可能という。生成品質と処理速度も向上しており、最大4Kの生成に対応するほか、最適化されたニューラルエンジンにより、条件によっては約0.8秒で画像を生成できるという。
自然言語による編集では、カメラアングルの調整、フォーカスの変更、高度なカラーグレーディングの適用、さらにはシーンのライティングの変換(昼夜の変化やボケ効果の作成など)など、スタジオ品質のクリエイティブコントロールが可能。テキストのレンダリング性能も向上しており、モックアップやポスターに、より多様なテクスチャ、フォント、カリグラフィを用いて、より詳細なテキストを作成できる。強化された多言語推論機能により、複数の言語でテキストを生成したり、コンテンツをローカライズ・翻訳したりも可能という。
また、Google検索のナレッジベースに接続することで、レシピのスナップショットを作成したり、天気やスポーツのリアルタイム情報を画像として視覚化できるという。そのほか、データのインフォグラフィック化、手書きメモの図表への変換といった、アイデアの視覚化も強化されている。
Nano Banana Proは、Geminiアプリで「Thinking」モデルを選択し、画像の作成を選択すると利用できるようになる。無料ユーザーは一定量生成でき、Google AI Plus、Pro、Ultraはより多くの生成が可能という。また、Gemini APIとGoogle AI Studio、Google Antigravityのほか、AI映画制作ツール「Flow」にも展開。フレームやシーンをより正確に制御できるとしている。
なお、GoogleはNano Banana Proの提供に合わせ、画像が生成されたものか検証するツールの提供も開始。同社製AIで生成したコンテンツに埋め込まれるデジタルウォーターマーク「SynthID」を利用し、Geminiアプリに画像をアップロードするだけで判定できる。画像のほか、近く音声と動画にも対応するとしている。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
アンケート結果をダウンロードしたら他社の従業員情報が…… ベネフィット・ワン、1万3460人分漏えい
-
2
ドラッグ&ドロップ操作ミスで……TOPPAN、損保ジャパン契約者17万人分のデータを他社に誤送付
-
3
免許証の悪用防ぐ届出集中、CIC・JICCで手続き遅延 タイムズカー情報流出直後に
-
4
ドコモ、料金の支払い遅れで385円の手数料 27年2月請求分から
-
5
Google、「Gemini 4 Pro」ではなく「Gemini 4 Agron」発表 まずはサイバー防御組織に限定提供、出力上限は100万トークンに
-
6
「写真で一言 ボケて」きょう午後8時にサービス終了 18年・1億超のボケに幕
-
7
タイムズカー、退会者の免許証画像も「7年」保存していた理由 パーク24に聞いた
-
8
楽天モバイルのauローミング縮小 マップ公開、ほぼ半減エリアも……さらに「順次縮小」へ
-
9
セイコーマート、会員のほぼ半数に当たる情報漏えい 約57万人分
-
10
「Gポイント」不正アクセスで一時停止 「会員識別子」約7万件漏えいか KDDI不正会計問題のジー・プランが運営
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR