IT之家 10月7日の報道によると、グーグルは本日、Nano Banana 2.1を正式に発表しました。これは同社のAI画像生成および編集モデルのアップグレード版です。グーグルは、新しいNano Banana 2.1が全体的な改善を実現しており、視覚デザイン、マスクに基づく画像編集、主体の一貫性といった面で特に顕著な進歩があると強調しています。

今年の初めに、グーグルはNano Banana 2を発表しました。これはGemini 3.1 Flash Imageとも呼ばれています。Nano Banana 2は、グーグルFlashシリーズモデルの高速特性を持ちながら、Nano Banana Proと同等の画像生成品質を実現しています。また、Pro版に属していた多くの機能を、この低い位置づけのモデルに移したこともあります。その機能には、現実世界の知識データベース、文字レンダリング効果の最適化、キャラクターや物体の一貫性の向上などが含まれます。
IT之家によると、Nano Banana 2.1は既存の機能を基に、主に3つの分野で改善が行われているという。
ビジュアルデザイン:Nano Banana 2.1は、構図がより優れ、完成度の高いビジュアル素材を生成することができます。
モンブレン編集:ユーザーは既存の画像の特定の部分をより正確に選択し、修正することができ、全体の画像を再生成する必要はありません。
主体一貫性:編集操作を実行したり、複数の関連画像を一括で生成する際に、モデルは画像の主体の様子や特徴をよりよく保持できます。
改善された主体一貫性はGeminiユーザーにとって非常に実用的であり、同じ人物や物体が複数回の生成結果において同じ外見を保つことを保証できます。Google Nano Banana 2.1は現在段階的に配備が進められており、Geminiアプリケーション、Google検索のAIモード、Google AI Studio、Google Flow、Stitch、Google広告、およびGemini企業プラットフォームに適用されています。
開発者向けに、Nano Banana 2.1が正式に公開されました。対応するモデルの ID は gemini‑nano‑banana‑2.1です。このモデルはテキスト、画像、音声、動画の入力をサポートし、1K、2K、4Kの解像度の画像を出力できます。
現在、OpenAIのChatGPT Images 2.5は依然として世界をリードする画像生成編集モデルです。ユーザーが一つの画像を継続的に微調整する際、前回の修正結果を保持し続け、編集されていない部分には変更を加えず、何度も反復処理を行っても元の画像の画質が悪化することはありません。OpenAIのこの製品に続いて、今年8月に発表されたマイクロソフトAIのMAI‑Image‑2.6モデルがあります。
