Google presentó Nano Banana 2.1, su nuevo modelo de generación y edición de imágenes, que según la ficha técnica de Google DeepMind está basado en Gemini 3.6 Flash. La compañía asegura que supera a sus modelos anteriores “en todos los aspectos”, con avances notables en diseño visual, edición basada en máscaras y consistencia de sujetos.
Edición por máscaras, consistencia de sujetos y salida en 4K
La edición por máscaras permite marcar una región de la imagen para que solo ese punto cambie, en lugar de regenerar toda la escena, mientras que la consistencia de sujetos busca que una persona u objeto conserve su apariencia tras varias ediciones. El modelo genera imágenes en 1K, 2K y 4K y puede apoyarse en Google Search para verificar datos del mundo real antes de dibujar. Reemplaza a Nano Banana 2, lanzado en febrero de 2026.
La implementación comienza en la app de Gemini, el Modo IA de Búsqueda, Google AI Studio, Flow, Stitch, Google Ads y Gemini Enterprise Platform. Para desarrolladores está disponible con el ID gemini-nano-banana-2.1, con un precio de 0.0336 dólares por imagen de 1K y 0.0756 por una de 4K, aproximadamente la mitad que Nano Banana 2. El modelo anterior, gemini-3.1-flash-image, dejará de funcionar el 29 de octubre.
Cifras de Google, todavía sin pruebas independientes
En su ficha técnica, Google reporta una preferencia general de 1,050 puntos en generación de imágenes a partir de texto con el modo de razonamiento activado, frente a 990 de Nano Banana 2 y 935 de Nano Banana Pro. Se trata de pruebas de la propia compañía: al momento del lanzamiento no había evaluaciones independientes.
En sus pruebas propias, el medio The Decoder observó que Nano Banana Pro todavía produce con frecuencia imágenes más realistas y naturales, sobre todo en colores y proporciones, aunque 2.1 es más barato y rápido. Google presentó el modelo como su opción más eficiente para el uso cotidiano, dentro de una familia que mantiene a Pro para el trabajo profesional más exigente.
