IT之家 berichtet am 7. Oktober, dass Google heute offiziell das Nano Banana 2.1 veröffentlicht hat. Es handelt sich dabei um eine verbesserte Version des AI-Bildgenerierungs- und -bearbeitungsmodells der Firma. Google betont, dass das neue Nano Banana 2.1 umfassende Verbesserungen darstellt, insbesondere in den Bereichen visuelles Design, Bildbearbeitung mit Masken und Konstanz des Hauptgegenstands.

Anfangs dieses Jahres hat Google das Nano Banana 2 veröffentlicht, auch bekannt als Gemini 3.1 Flash Image. Das Nano Banana 2 bietet die hohen Leistungen der Google Flash-Serie-Modelle und erreicht gleichzeitig eine Bildqualität, die mit der von Nano Banana Pro vergleichbar ist. Google hat außerdem mehrere Funktionen, die ursprünglich für die Pro-Version vorgesehen waren, auf dieses niedrigere Modell übertragen, darunter einen Wissenstank für die reale Welt, optimierte Textrendering-Effekte und eine verbesserte Einhaltung der Konstanz von Charakteren und Objekten.
IT Home hat bemerkt, dass das Nano Banana 2.1 auf der Grundlage seiner ursprünglichen Fähigkeiten hauptsächlich in drei Hauptbereichen verbessert wurde:
Visuelle Gestaltung: Nano Banana 2.1 kann visuelle Materialien mit besserer Komposition und höherer Vollendung erzeugen.
Masken-Erstellung: Die Benutzer können gezielter bestimmte Bereiche von bestehenden Bildern auswählen und bearbeiten, ohne das gesamte Bild neu zu erstellen.
Konsistenz des Hauptgegenstands: Bei der Durchführung von Bearbeitungsoperationen oder der Batch-Generierung mehrerer verknüpfter Bilder kann das Modell den Bildinhalt und die Merkmale des Hauptgegenstands besser erhalten.
Die verbesserte Identitätskonstanz ist für Nutzer von Gemini sehr praktisch, da sie sicherstellt, dass dieselbe Person oder das gleiche Objekt in mehreren Ergebnissen die gleiche Erscheinung behält. Google Nano Banana 2.1 wird nun schrittweise bereitgestellt und umfasst die Gemini-Anwendung, den AI-Modus von Google Suche, Google AI Studio, Google Flow, Stitch, Google Ads sowie die Unternehmensplattform von Gemini.
Für Entwickler: Nano Banana 2.1 ist offiziell verfügbar, mit dem entsprechenden Modell-ID gemini‑nano‑banana‑2.1. Das Modell unterstützt Eingaben in Text, Bild, Audio und Video und kann Bilder in Auflösungen von 1K, 2K und 4K ausgeben.
Derzeit ist das ChatGPT Images 2.5 von OpenAI das führende Bildgenerierungs- und Bearbeitungsmodell weltweit. Wenn Benutzer ein Bild kontinuierlich anpassen, ist es besser in der Lage, die Ergebnisse der vorherigen Bearbeitung zu erhalten, ohne Bereiche zu verändern, die nicht bearbeitet wurden, und ohne die Qualität des ursprünglichen Bildes durch wiederholte Iterationen zu verschlechtern. Hinter diesem Produkt von OpenAI folgt das MAI‑Image‑2.6-Modell von Microsoft AI, das im August dieses Jahres veröffentlicht wurde.
