出来事の日付:2025年11月20日。
Google DeepMindは、Gemini 3 Pro Imageとも呼ばれる画像作成・編集モデル「Nano Banana Pro」を発表した。このシステムは、Googleの一般消費者向けGeminiアプリ、広告製品、Google AI Studioで利用可能となり、Gemini 2.5 Flashを基盤とする従来の画像モデルの、より高性能な後継モデルと位置付けられている。
今回のリリースは、単独の画像だけでなく、デザインされた素材の生成に重点を置いている。Googleによると、このモデルはGemini 3 Proの推論能力と知識を用いて情報を視覚的に整理し、元となる素材をプロトタイプ、図表、インフォグラフィックに変換できる。また、現在の天気、スポーツ情報、レシピのイラストに使用する事実など、根拠のある入力情報を得るためにGoogle検索へ接続することもできる。
画像内のテキストも中心的な機能の一つだ。同社によると、Nano Banana Proは複数の言語でより読みやすい文言を生成し、短いスローガンから長い文章まで扱える。例として、ポスター、タイポグラフィー、カリグラフィー、英語から韓国語に翻訳されたパッケージが挙げられている。発表ではそれらの結果を改善として説明しているが、提供された根拠には比較ベンチマークのスコアや独立した試験は含まれていない。
編集用の制御機能は、構図を変更しながら、複雑な元画像の要素を維持することを目的としている。Googleは、人物、動物、衣服、異なる環境要素など、提供された複数の画像を組み合わせて作った場面を実演した。同社によると、このモデルは最大14点の入力間で一貫性を保つことができる。他の例では、選択した被写体の位置を維持しながら、アスペクト比、照明、焦点を変更している。
これらの機能により、想定される利用者層は広がる。デザイナーはキャンペーンのコンセプトやモックアップを作成でき、教師や生徒は説明図を依頼できる。検索との接続は、モデルがすでに持つ知識だけでなく、最近の情報に基づくビジュアルの作成を支援することを目的としている。それでも、この発表はモデル開発元による説明にとどまり、生成されるすべての図表、翻訳、事実に基づくイラストの正確性を立証するものではない。
Nano Banana Proは、Googleがわずか数カ月前に、写真の修復やミニチュアフィギュアの生成などの作業向けに公開したNano Bananaに続くものだ。新バージョンは、基盤をGemini 2.5 Flash ImageからGemini 3 Proに移し、より深い推論能力と、より幅広い創作向け制御機能を活用している。
今回の発表は、画像合成、レイアウト、言語、情報検索を一つのワークフローに統合しようとする取り組みを反映している。その実用的な価値は、実際の出力が、指定された人物などの同一性を一貫して維持し、正確なテキストを描画し、根拠のある情報を正しく表現できるかどうかに左右される。Googleは広範な実演を提供したが、提示された発表では、価格、利用上限、正式な評価手法の詳細は示されていない。
Googleの例には、手書きのメモを構造化された図に変換したもの、植物の手入れに関する情報をインフォグラフィックとして配置したもの、レシピを連続したイラストで表現したものが含まれる。発表では、モデルを写実的な場面だけのためのツールとして提示するのではなく、これらの実演を通じて情報整理と創造的な制作を結び付けている。



