コンテンツにスキップ
メインサイト ニュース コンソール

Nano Banana 2 Lite と

· DeepMind 翻訳済
DeepMind

2026年6月30日

私たちは、最も高速でコスト効率に優れたGemini画像モデルである Nano Banana 2 Lite と、高品質な動画生成および対話型編集のための Gemini Omni Flash により、皆様がクリエイティブなアイデアをより簡単に実験し、拡張できるようにしています。

Alisa Fortin

プロダクトマネージャー、Google DeepMind

Anish Nangia

プロダクトマネージャー、Google DeepMind

本日、私たちは2つの重要なリリースにより、アイデアの実験、ブラッシュアップ、そしてスケールアップをより迅速かつシンプルにします。

生成メディアの構築は、多くの場合、クリエイティブな反復プロセス(イテレーション)を伴います。これら2つのモデルを使用することで、開発者は迅速な画像生成と動画の作成・編集を組み合わせた、エンドツーエンドの完全なマルチメディア体験を構築できます。ワークフローで数千枚の画像を生成する必要がある場合でも、複数ラウンドにわたる動画シーケンスを編集する必要がある場合でも、これら2つの新しいモデルを使用することで、より迅速に構築し、シームレスに反復し、クリエイティブなビジョンを現実のものにすることができます。

Nano Banana 2 Lite:最も高速でコスト効率に優れたGemini画像モデル

シンプルなプロンプトを使用して画像を生成する際の、Nano Banana 2 LiteとNano Banana 2の速度と品質の比較動画をご覧ください。

Nano Banana 2 Lite(gemini-3.1-flash-lite-image)は、速度とコストが最優先の制約となる、迅速なアイデア出しや高速な開発プロセス向けに設計されています。現在、第1世代のNano Banana(gemini-2.5-flash-image)を使用している開発者の皆様には、Nano Banana 2 Liteへの移行をお勧めします。今すぐ切り替えることで、主要なパフォーマンス指標において即座にメリットを得ることができます。

競合するAI画像モデルに対するNano Banana 2および2 Liteのパフォーマンスベンチマーク。生成/編集品質(Eloスコア)、処理遅延(レイテンシ)、および解像度1000画像あたりのコストのトレードオフを評価しています。

Nano Banana 2 Liteの主なメリット:

  • レイテンシ: テキストから画像への変換(Text-to-Image)結果を4秒未満で出力できます。これにより、インタラクティブなプロトタイピングや迅速なビジュアルスケッチに最適です。
  • コスト効率(画像1,000枚あたり0.034ドル): 下書き、アイデア出し、運営予算の管理、または低帯域幅での利用に注力する開発者にとって、非常に費用対効果の高い選択肢です。

速度を最優先しているにもかかわらず、Nano Banana 2 Liteは、信頼性の高いプロンプト追従能力、キャラクターの一貫した表現、画像内のテキストの鮮明で読み取りやすいレンダリング性能を維持しています。

Nano Banana シリーズについて

  • Nano Banana 2 Lite(Gemini 3.1 Flash Lite Image): スピード重視。ほぼリアルタイムで高ボリュームのワークフロー向けに最適化されており、超低レイテンシが極めて重要なシナリオで威力を発揮します。
  • Nano Banana 2(Gemini 3.1 Flash Image): 汎用性の高い主力モデル。より低いレイテンシで高品質な出力を提供し、パフォーマンスとコストの最適なバランスを実現します。
  • Nano Banana Pro(Gemini 3 Pro Image): 複雑でプロフェッショナルなユースケース向けに最適化されています。速度よりも正確性が重視されるタスクにおいて、最も強力なコントロール能力と高度な推論能力を提供します。
  • Nano Banana(Gemini 2.5 Flash Image): レガシーモデル。より高い品質、高速化、および低コストを実現するために、Nano Banana 2 Liteへのアップグレードをお勧めします。

モデル機能の完全なリストおよび統合方法については、開発者向け ドキュメント をご参照ください。

開発者プラットフォームでのリリースに伴い、Nano Banana 2 Liteは、検索のAI Mode、Geminiアプリ、NotebookLM、Google Photos、Stitch、Google Flow、Google AdsなどのGoogleのコンシューマー向け製品にも導入されます。

Gemini Omni Flashによる高品質でコスト効率の高い動画編集と生成の体験

Gemini Omniを使用して、スマートフォンから3Dのバルーン文字を取り出したり、画面の中の水をグラスに注いだりするような、4つのデジタルマジックを披露する様子をご覧ください。隅にある小さな「オリジナル」動画は、Omniが生成したエフェクトを追加する前に、彼女が実際にどのようにマジックの効果を撮影したかを示しています。

Google I/Oにおいて、私たちはGeminiのマルチモーダル推論と動画生成・編集を組み合わせたモデルである Gemini Omni Flash を発表しました。本日、Gemini Omni Flash(gemini-omni-flash-preview)がGemini APIおよびGoogle AI Studioを通じて開発者向けに提供開始されます。テキスト、画像、動画の入力を組み合わせた高品質な動画生成と対話型編集をネイティブにサポートします。このモデルの価格は非常に競争力があり、動画出力1秒あたり0.10ドルで、Veo 3.1 Fastと同等です。

Omni Flashの主なメリット:

  • 対話型動画編集: 自然言語を使用して動画を微調整および編集できます。
  • マルチモーダル参照: 画像、テキスト、動画などの入力を組み合わせることで、画面内のシーンのコントロールと一貫性を維持します。
  • 現実世界の知識: Omniは、歴史、生物学、物語の論理など、Geminiの知識を活用して、魅力的な動画を構築します。
  • テキストとアクションの同期: シンプルなプロンプトを通じて、テキストやグラフィックを動画のアクションに直接同期させることができます。

詳細なベンチマーク情報については、Google DeepMindの Gemini Omni ウェブページをご覧ください。

制限事項:

  • 現在、Omniは10秒の動画生成のみをサポートしており、より長い時間のサポートも近日中に予定されています。
  • このモデルは、Gemini APIにおいて、音声リファレンスのアップロードおよびシーンの拡張をまだサポートしていません。
  • APIアーキテクチャは、最大3秒の長さの動画リファレンスを受け入れます。