El modelo de imagen predeterminado de Google: fidelidad de nivel profesional a velocidad Flash, de 512px a 4K, y personajes que se mantienen fieles a sí mismos durante todo un flujo de trabajo. Escribe un prompt abajo y pruébalo.
Desarrollador
Google DeepMind
Base
Gemini 3.1 Flash Image
Resolución
512px – 4K
Relaciones de aspecto
14
Coherencia
5 caracteres · 14 objetos
Conexión a tierra
Búsqueda de imágenes web
Nivel aquí
Créditos de pago · Lite gratis
Nuestro veredicto en una línea: la opción predeterminada por una razón. Resultados de nivel Pro a la velocidad y el precio de Flash — empieza aquí cada trabajo de imagen y escala solo cuando una página específica te diga por qué.
Nano Banana 2 es lo que ocurrió cuando Google dejó de obligarte a elegir entre su modelo de imagen rápido y el bueno: creado sobre Gemini 3.1 Flash, conserva la mayor parte de la fidelidad de Nano Banana Pro a la velocidad y el precio de Flash, por eso Google lo convirtió en la opción predeterminada en la app Gemini, la Búsqueda y Ads en el plazo de un día desde su lanzamiento en febrero. Las dos capacidades que más importan en la práctica: consistencia de personajes que se mantiene con hasta cinco personajes y catorce objetos a lo largo de un flujo de trabajo — los guiones gráficos y los conjuntos de marca dejan de desviarse — y anclaje en búsqueda de imágenes, que le permite extraer referencias visuales reales de la web antes de dibujar.
Juzgado a partir de nuestros propios renders y del registro publicado, revisado a medida que cambian los hechos — es una característica de esta página, no un descargo de responsabilidad.
• El compromiso entre velocidad y calidad, disuelto.
Fidelidad de nivel Pro con la latencia y el precio de Flash. La razón por la que es el valor predeterminado de Google en todas partes es la misma razón por la que debería ser tu primer intento para casi cualquier tarea de imagen.
• Coherencia de nivel workflow.
Hasta 5 personajes y 14 objetos mantenidos estables entre generaciones — el trabajo de storyboard, conjunto de marca y serie de productos que antes requería un especialista con muchas referencias
• Fundamentación de la búsqueda de imágenes.
Puede consultar imágenes web reales antes de dibujar — un punto de referencia específico, un producto actual, un material real — cerrando la brecha entre 'plausible' y 'preciso.'
• Gama completa de producción.
De miniaturas de 512px a imágenes hero 4K en 14 relaciones de aspecto, con un único vocabulario de prompts. Un modelo cubre toda la hoja de assets.
• La máxima fidelidad factual es tarea de Pro.
La propia división de Google: las infografías densas, los diagramas exactos y los diseños con mucho texto en los que cada dato debe llegar van a Nano Banana Pro. Este modelo es el generalista, no el especialista.
• Cinco caracteres es un límite, no una sugerencia.
Las escenas corales con más de cinco personajes con nombre empiezan a intercambiar identidades. Planifica las escenas de multitud como textura de fondo, no como diez protagonistas.
• SynthID está siempre activado.
Cada salida lleva la marca de agua invisible de Google. Adecuado para casi todos; relevante si tu canalización prohíbe las marcas de procedencia.
• El arraigo necesita orientación.
El anclaje en imágenes web es potente pero literal — los prompts sin anclaje sobre lugares famosos pueden devolver resultados genéricos, y los demasiado anclados pueden parecer de stock. Nombra lo que debe ser real; libera lo que debe ser imaginado.
Copia en el generador de arriba, cambia los corchetes, renderiza.

"Un storyboard de seis paneles, el mismo personaje ilustrado en cada panel: un [mensajero con una bufanda roja] — en el mostrador de una cafetería, en un andén de tren, en una azotea al atardecer, entre la multitud de un mercado, en un escritorio de oficina, en una playa al amanecer. Rostro, complexión y bufanda coherentes en todo momento; estilo cálido de ilustración editorial."
Seis escenas en un solo prompt son el terreno natural del sistema de consistencia — nombrar los rasgos de anclaje (“rostro, complexión y bufanda”) le indica qué no debe variar. La demo junto al generador es este prompt.

"Una foto de producto de [nuestra taza de cerámica] sobre una mesa de cafetería, con el Ponte Vecchio real visible a través de la ventana detrás de ella, luz de la mañana, poca profundidad de campo — el puente debe parecer el puente real."
'El puente real' es la frase que activa el anclaje mediante búsqueda de imágenes: consulta imágenes reales en lugar de improvisar un monumento genérico. Ancla el entorno, conserva el producto de tu carga de referencia.

"[Mascota de la marca] saludando, estilo vectorial plano sobre blanco con aspecto transparente: generar en 1:1 para avatar, 16:9 para banner, 9:16 para historia, 21:9 para encabezado del sitio — misma pose, mismas proporciones en los cuatro."
Un prompt, cuatro proporciones, cero deriva — el trabajo diario que este modelo hace más barato y más rápido que cualquier cosa por encima de él. Procesa las proporciones por lotes en lugar de volver a introducir un prompt para cada tamaño.
El modelo predeterminado contra su propio modelo hermano especializado y el campeón de la arena de abril. Los mismos prompts en los tres, evaluados según lo que lanzaríamos. Los tres se pueden seleccionar en el generador de arriba.
(Gemini 3.1 Flash Image) — lanzado el 26 de febrero, predeterminado en Gemini, Search, Ads y Flow en un día; GA para empresas en mayo; entrada de archivos de video añadida en vista previa. La versión en el generador anterior.
(Gemini 3 Pro Image) — el nivel de alta fidelidad: precisión respaldada por razonamiento, controles de estudio, 4K. Sigue vigente para trabajo factual; su propia página explica cuándo merece el precio premium.
(Gemini 2.5 Flash Image) — el original viral: 13 millones de nuevos usuarios en cuatro días, cinco mil millones de imágenes para octubre. Ahora heredado; Google recomienda los modelos de 2.ª generación en su lugar.
El modelo de imagen principal actual de Google — técnicamente Gemini 3.1 Flash Image, lanzado el 26 de febrero de 2026. Combina la fidelidad de Nano Banana Pro con la velocidad y el precio de nivel Flash: salidas de 512px a 4K, 14 relaciones de aspecto, consistencia para hasta 5 personajes y 14 objetos por flujo de trabajo, y anclaje mediante búsqueda de imágenes que consulta imágenes reales de la web antes de dibujar. Es el modelo de imagen predeterminado en los propios productos de Google.