IT之家 AI

Google lanza el modelo de imágenes con IA Nano Banana 2.1, con mejoras en diseño visual, edición con máscaras y consistencia del sujeto

IT之家, mensaje del 7 de octubre: Google lanzó hoy oficialmente Nano Banana 2.1, la versión mejorada de su modelo de IA para generación y edición de imágenes. Google subraya que la nueva versión de Nano Banana 2.1 logra…

Fuente de la imagen · IT之家 AI
Gracias a los internautas de IT之家 por 软媒用户1053564、咩咩洋、愚公骑马、华南吴彦祖、Domado por el envío de la información!

IT之家 Mensaje del 7 de octubre: Google lanzó hoy oficialmente Nano Banana 2.1, la versión mejorada de su modelo de IA para generación y edición de imágenes. Google subraya que la nueva versión de Nano Banana 2.1 logra una mejora integral, con avances especialmente destacados en diseño visual, edición de imágenes basada en máscaras y consistencia del sujeto.

A principios de este año, Google presentó Nano Banana 2, también conocido como Gemini 3.1 Flash Image. Nano Banana 2, además de contar con las características de alta velocidad de la serie de modelos Flash de Google, alcanzó una calidad de imagen del mismo nivel que Nano Banana Pro. Google también trasladó a este modelo de gama inferior varias funciones que originalmente pertenecían a la versión Pro, incluyendo una base de conocimiento del mundo real, mejoras en el renderizado de texto y una mayor consistencia de personajes y objetos.

IT之家 observó que Nano Banana 2.1, sobre la base de sus capacidades existentes, mejora principalmente en tres grandes direcciones:

  • Diseño visual: Nano Banana 2.1 puede generar material visual con una mejor composición y mayor grado de acabado.

  • Edición con máscaras: los usuarios pueden seleccionar y modificar con mayor precisión zonas específicas de una imagen existente, sin necesidad de regenerar toda la imagen.

  • Consistencia del sujeto: al realizar operaciones de edición o generar por lotes varias imágenes relacionadas, el modelo puede conservar mejor la apariencia y las características del sujeto de la escena.

La consistencia mejorada del sujeto resulta muy práctica para los usuarios de Gemini, ya que garantiza que una misma persona u objeto mantenga una apariencia uniforme en múltiples resultados de generación. Nano Banana 2.1 de Google ya se está desplegando de forma gradual, abarcando la aplicación Gemini, el modo de IA de Google Search, Google AI Studio, Google Flow, Stitch, Google Ads y la plataforma empresarial Gemini.

Para los desarrolladores, Nano Banana 2.1 ya está disponible oficialmente, con el ID de modelo gemini‑nano‑banana‑2.1; el modelo admite entradas de texto, imágenes, audio y video, y puede generar imágenes con resoluciones de 1K, 2K y 4K.

Actualmente, ChatGPT Images 2.5 de OpenAI sigue siendo el modelo líder a nivel mundial en generación y edición de imágenes. Cuando el usuario ajusta finamente una imagen de forma continua, es más hábil conservando los resultados de la ronda anterior de modificaciones, no altera las zonas no editadas y no degrada la calidad de la imagen original con las iteraciones repetidas. Detrás de este producto de OpenAI se encuentra el modelo MAI‑Image‑2.6 de Microsoft AI, lanzado en agosto de este año.

Fuente original

IT之家 AI

Notas sobre el contenido

La publicación original y los derechos pertenecen a la fuente.

Traducción automática · Consulte el original