El modelo de imagen cotidiano más nuevo de Google, integrado la misma semana en que se lanzó: mejor edición basada en máscaras y coherencia del sujeto, salida 4K y aproximadamente la mitad del precio del modelo al que reemplaza.
Desarrollador
Google DeepMind
Publicado
6 oct 2026
Base
Gemini 3.6 Flash
ID de API
gemini-nano-banana-2.1
Salida
Hasta 4K · proporciones hasta 8:1
Referencias
Hasta 14 imágenes
Pensando
Mínimo · medio · alto
Nuestro veredicto en una línea: el nuevo predeterminado. Mejor edición, fotogramas más amplios y 4K por aproximadamente la mitad de lo que costaba el anterior — y el modelo que el propio Google recomienda como reemplazo de Nano Banana 2.
Nano Banana 2.1 llegó el 6 de octubre como una actualización directa del modelo que había sido el predeterminado de Google desde febrero, y el titular es inusual: es mejor y cuesta aproximadamente la mitad. Google informa mejoras en diseño visual, edición basada en máscaras, consistencia del sujeto y encuadre panorámico, con un nivel de pensamiento configurable que intercambia latencia por calidad y un anclaje que puede verificar datos con Google Search y Image Search antes de dibujar. Un aspecto del calendario que importa más que las especificaciones: Google cerrará la API del modelo anterior el 29 de octubre y nombra a este como su reemplazo, así que no se trata de una actualización opcional para nadie que use el ID antiguo. Tiene solo unos días, así que lee todo lo siguiente como un informe de la primera semana.
Evaluado a partir de nuestros propios renderizados y del registro publicado, revisado a medida que cambian los hechos — esto es una característica de esta página, no un descargo de responsabilidad.
• Aproximadamente la mitad del precio.
Los precios para desarrolladores de Google sitúan una imagen 1K en torno a $0.034 frente a unos $0.067 antes, y 4K en torno a $0.076 frente a $0.151, con descuentos adicionales para el trabajo por lotes. Una generación poco común en la que la opción más barata también es la mejor.
• Edición basada en máscara.
Define un área y cambia solo lo que hay dentro. Google destaca esto como uno de los mayores saltos respecto a la versión anterior, y es la función que hace que la edición conversacional sea predecible en lugar de depender de la esperanza.
• Encuadres amplios y panorámicos.
Relaciones de aspecto de hasta 8:1, que el modelo anterior manejaba mal. Los banners, encabezados de sitios y escenas panorámicas ya no requieren un flujo de trabajo de “recortar y rezar”.
• Catorce referencias, pensando en un dial.
Hasta 14 imágenes de referencia, con niveles de pensamiento mínimo, medio y alto, para que puedas dedicar latencia donde importa y omitirla donde no.
• Pro sigue viéndose mejor en el uso real.
Google posiciona 2.1 como la contraparte eficiente de Nano Banana Pro, no como su reemplazo — y las comparativas lado a lado del lanzamiento señalan que el color y las proporciones de Pro siguen viéndose más naturales. Los benchmarks y los ojos no coinciden aquí; confía en tus ojos.
• Las cifras de referencia son las propias de Google.
Las puntuaciones de preferencia comunicadas — 1,050 con razonamiento frente a 990 para Nano Banana 2 y 935 para Pro — provienen de las propias evaluaciones de Google. Las pruebas independientes aún no han llegado, y revisaremos esta página cuando lo hagan.
• Días de antigüedad.
Lanzado el 6 de octubre. Todo aquí se remonta a la tarjeta de modelo de Google, la cobertura del lanzamiento y nuestros primeros renderizados. Trata los superlativos como provisionales.
• SynthID siempre está activado.
Como en toda la línea de Google, cada resultado lleva una marca de agua de procedencia invisible.
Copia en el generador de arriba, cambia los corchetes, renderiza.

"Una escena panorámica 8:1 de [cocina] a la hora dorada: sartenes de cobre en una barra, vapor elevándose de una olla, hierbas en el alféizar, luz cálida rozando la encimera."
Las relaciones de aspecto extremas son la mejora visible más clara — pide la forma que realmente necesitas en lugar de generar en 16:9 y recortar. La demo junto al generador es este prompt.

Genera o sube, luego enmascara la ventana → "Cambia la vista exterior a invierno — árboles desnudos, luz gris. Mantén todo dentro de la habitación idéntico: las sartenes, el vapor, las hierbas, la luz sobre la encimera."
Una máscara lleva el dónde, así que el prompt solo lleva el qué, y nombrar lo que permanece protege el resto. Este es el flujo de trabajo en torno al cual se creó la actualización 2.1.

Borrador con razonamiento: mínimo → vuelve a renderizar la versión conservada con razonamiento: alto.
El dial de razonamiento sirve para controlar costos, no es un interruptor de calidad que debas dejar al máximo. Explora de forma barata y rápida, y luego invierte la latencia una sola vez en el render que vas a conservar.
El nuevo predeterminado frente a la gama más alta de Google y el modelo actual de OpenAI. Los mismos prompts en los tres, evaluados según lo que publicaríamos — provisionalmente para el recién llegado. Los tres se pueden seleccionar en el generador de arriba.
(gemini-nano-banana-2.1) — creado sobre Gemini 3.6 Flash: edición basada en máscaras, consistencia del sujeto, panoramas 8:1, 4K, pensamiento configurable, Search grounding, aproximadamente a la mitad del precio anterior. La versión en el generador de arriba.
(Gemini 3.1 Flash Image) — el modelo predeterminado de Google desde febrero, con su API programada para cerrarse el 29 de octubre de 2026 y 2.1 designado como reemplazo. Su página permanece activa para el tráfico de palabras clave de la versión.
(Gemini 3 Pro Image) — sigue siendo la gama más alta para los trabajos profesionales más difíciles, y el modelo 2.1 se posiciona como la contraparte eficiente, más que como un reemplazo.
El modelo más reciente de Google para generación y edición de imágenes, lanzado el 6 de octubre de 2026 con el ID de API gemini-nano-banana-2.1 y basado en Gemini 3.6 Flash. Google informa mejoras en diseño visual, edición basada en máscaras, consistencia del sujeto y encuadre de formato ancho, con hasta 14 imágenes de referencia, salida 4K, relaciones de aspecto de hasta 8:1, anclaje en Search y tres niveles de razonamiento.