Últimas noticias
Análisis del GMKtec EVO-X3: Ryzen AI Max+ 395 y 128 GB de memoriaGuía de QuadRemesh en Rhino 8: malla cuadrilateral y flujo de trabajo SubDEl Centro de Datos Hönggerberg de ETH Zürich sustituye instalaciones antiguasCrear imágenes arquitectónicas con Nano Banana 2.1: guía de prompts paso a pasoEl planificador de GPU de Ai2 asigna presupuestos de tiempo a proyectosPerfil de rendimiento en Unreal Engine: guía de comandos stat e InsightsCrear destellos de luz en renders arquitectónicos con Glare Node de BlenderDesenfoque de movimiento en Blender Cycles: ajustes para animación arquitectónicaImportar y exportar nubes de puntos en Blender: guía paso a pasoCreación procedural de edificios en Houdini: flujo de Building Creator
TutorialesGoogleNano Banana 2Nano Banana 2.1

Crear imágenes arquitectónicas con Nano Banana 2.1: guía de prompts paso a paso

Nano Banana 2.1 puede utilizarse a través de Gemini API para generar imágenes a partir de texto y editar imágenes existentes. Esta guía explica cómo escribir prompts claros para imágenes de arquitectura e interiores y mejorar los resultados de forma gradual.

Visualización arquitectónica de un patio contemporáneo con superficies de piedra y madera, iluminado por la luz del díaImagen IA
Imagen ilustrativa generada con IA.Imagen: 3dsınıfı / FCA AI

En resumen

  1. El identificador del modelo Nano Banana 2.1 en Gemini API es gemini-nano-banana-2.1.
  2. El modelo puede generar imágenes a partir de instrucciones de texto y editarlas con nuevas indicaciones.
  3. La documentación de Google menciona opciones de resolución de 1K, 2K y 4K.
  4. Para las imágenes de referencia cargadas, es necesario contar con los derechos de uso correspondientes.

¿Qué aprenderás en esta guía?

Nano Banana 2.1 es un modelo disponible en Gemini API para generar imágenes y editarlas de forma conversacional. En esta guía veremos cómo preparar prompts bien delimitados para trabajos de arquitectura e interiores, trabajar con una imagen de referencia y mejorar el resultado por etapas en lugar de intentar perfeccionarlo de una sola vez. Los ejemplos están pensados para explorar conceptos, materiales y atmósferas. Las imágenes generadas no deben considerarse dibujos técnicos, modelos a escala ni datos de proyecto verificados: las fuentes no afirman que el modelo garantice ese tipo de precisión.

Nano Banana es el nombre de las capacidades de generación de imágenes integradas en los modelos Gemini de Google. Según la documentación oficial, el modelo permite una interacción multimodal con texto, imágenes, video o una combinación de estos. Los ejemplos de prompts siguientes se han creado específicamente para usos arquitectónicos y no garantizan un resultado concreto. El diseño de prompts es un proceso iterativo: hay que revisar el resultado y precisar las instrucciones.

Requisitos y selección del modelo

La página oficial de generación de imágenes de Gemini API indica que el identificador del modelo Nano Banana 2.1 es gemini-nano-banana-2.1. La API permite generar imágenes a partir de texto o enviar texto e imágenes en una misma solicitud para editar una imagen. Los ejemplos de la documentación muestran cómo adjuntar datos de imagen a una solicitud a la API y recibir el resultado como salida de imagen. En el ejemplo REST se utiliza una clave de API; sin embargo, el texto fuente no detalla la creación de una cuenta, las condiciones de acceso ni los precios. Por eso, antes de empezar, consulta por separado la información actualizada sobre el acceso a la API y sus precios.

Google describe Nano Banana 2.1 como un modelo principal de alta eficiencia que, frente al Nano Banana 2 anterior, ofrece mejoras en calidad de imagen, generación de texto, coherencia en varias rondas y fundamentación con Google Search. La documentación menciona resoluciones de 1K, 2K y 4K, pero la fuente no ofrece instrucciones detalladas sobre los parámetros para seleccionarlas. También señala que las imágenes incluyen una marca de agua SynthID.

Es importante contar con los derechos de las imágenes que se utilicen para la edición. Google recuerda que se deben tener los derechos de uso necesarios sobre las imágenes cargadas y evitar contenido que infrinja los derechos de otras personas o que las engañe, acose o perjudique. No uses sin autorización planos, fotografías o referencias que no pertenezcan al titular del proyecto.

Cómo preparar paso a paso un prompt para imágenes arquitectónicas

  1. Define el objetivo en una sola frase. En el primer intento, elige un único objetivo visual en vez de pedir a la vez cambios en el plano, selección de materiales y movimientos de cámara. Por ejemplo, explorar la atmósfera de la fachada de un patio o probar alternativas de materiales en una zona de estar.

  2. Describe la escena con precisión. Indica el tipo de espacio, su geometría principal, los materiales visibles y el lenguaje visual deseado. En lugar de una descripción ambigua como «un interior bonito», especifica qué superficie será de piedra, cuál de madera y cómo quieres que se perciba la luz.

  3. Describe el encuadre y la luz. Añade qué debe destacar en la imagen, el punto de vista y la sensación lumínica. En este ejemplo se combinan indicaciones de cámara, materiales e iluminación:

Prompt
Create an architectural visualization of a compact courtyard house. Show the courtyard from a human eye-level viewpoint, with the main living room visible through large openings. Use pale stone walls, warm timber screens, and a restrained planted courtyard. Soft morning daylight, realistic material texture, calm neutral palette. Keep the existing building massing simple and legible; do not add people, signage, or decorative objects.

El objetivo de este prompt es describir una única escena: la volumetría, los materiales, el encuadre y la luz forman parte del mismo brief. La indicación «Do not add» también limita explícitamente los elementos no deseados. No des por sentado que el modelo respetará las dimensiones arquitectónicas o la intención del diseño desde el punto de vista técnico; revisa el resultado como una imagen conceptual.

  1. Especifica claramente el formato del resultado. La guía de diseño de prompts de Gemini explica que puede ser útil indicar instrucciones, restricciones y el formato de respuesta. En la generación de imágenes, adapta estas pautas a objetivos visuales como el encuadre, la atmósfera o los elementos que no deben aparecer en la escena. Por ejemplo, en una imagen de interiores, indica qué zona debe quedar en primer plano y qué gama cromática se debe conservar:

Prompt
Create a quiet contemporary reading room visualization. Focus on the built-in bookshelf and the window seat; show both clearly in a single interior view. Use light oak, muted green upholstery, and warm indirect lighting. Keep the room uncluttered and use a consistent, natural color palette. Do not include text, labels, or visible brand marks.

Estas instrucciones describen opciones de diseño; no proporcionan un producto, una marca ni datos de un proyecto real. El equipo de diseño debe evaluar el color, los materiales y la composición del resultado.

  1. Edita una imagen de referencia. La documentación fuente incluye ejemplos de cómo añadir, eliminar o cambiar elementos, así como transformar el estilo o la paleta de colores, mediante instrucciones de texto junto con una imagen. Envía una imagen del proyecto cuyos derechos de uso tengas, junto con el texto. Especifica con claridad qué quieres modificar e indica también en el prompt qué composición general quieres conservar:

Prompt
Using the provided interior image as the reference, change only the wall finish to a light, matte limestone appearance. Preserve the room layout, furniture positions, window locations, and camera viewpoint. Keep the existing daylight character and do not introduce new objects.

Este comando se centra en cambiar un solo material, en lugar de reconstruir toda la escena. Si también cambian otros elementos, vuelve a enumerar de forma más clara en la siguiente instrucción qué aspectos deben conservarse. Las fuentes no garantizan que todos los detalles de la imagen original permanezcan intactos.

  1. Evalúa el resultado e itera. Después del primer resultado, en lugar de enviar de una vez una larga lista de cambios, establece una prioridad. Por ejemplo, aborda primero el material de las paredes y luego la iluminación. La guía de prompts de Gemini recomienda que las instrucciones sean claras y específicas, que se indiquen las restricciones y que se muestre el formato deseado con ejemplos. Si hace falta, mejora el prompt con varios intentos y anota qué instrucción modificó el resultado en cada iteración.

Errores frecuentes

Pedir demasiadas cosas a la vez: Cambiar simultáneamente el encuadre, los materiales, el mobiliario, el paisajismo y la iluminación puede dificultar la identificación de las instrucciones que influyeron en el resultado. Define primero el objetivo visual principal y divide las modificaciones en etapas.

Conformarse con adjetivos ambiguos: Palabras como «moderno», «elegante» o «espacioso» no explican por sí solas cómo debe organizarse la escena. Concreta el brief añadiendo el tipo de espacio, las superficies, la iluminación y el encuadre.

Suponer que todos los detalles de la imagen de referencia se conservarán: La fuente indica que es posible editar una imagen mediante texto, pero no promete que todos los elementos de la escena permanezcan sin cambios. Indica en el prompt qué elementos deben conservarse y revisa el resultado.

Presentar la imagen como un resultado de proyecto verificado: La documentación menciona capacidades de generación y edición de imágenes, pero no ofrece verificación de dimensiones, normativa, rendimiento de materiales ni idoneidad constructiva. Evalúa el resultado con fines conceptuales y de comunicación, y verifica por separado las decisiones del proyecto.

Su lugar en los flujos de trabajo de arquitectura y visualización

Este enfoque puede servir como herramienta de exploración de ideas para arquitectos, interioristas, estudiantes y equipos de visualización que quieran visualizar rápidamente alternativas de atmósfera y materiales en las primeras fases del diseño. También se pueden pedir cambios acotados a partir de una imagen de referencia para debatir distintas alternativas. Sin embargo, las fuentes no explican el acceso a la API, los costos ni la compatibilidad con el software utilizado por los equipos; evalúa estos aspectos por separado antes de implementarlo. No sustituyas la verificación técnica por la imagen generada.

Próximos pasos

Empieza por elegir un único objetivo conceptual y preparar un prompt breve. Prueba por separado la generación de imágenes y la edición a partir de una referencia para determinar qué método se adapta mejor al flujo de trabajo. Si se va a utilizar en equipo, guardar los prompts y los resultados seleccionados junto con las notas del proyecto puede facilitar el seguimiento de las decisiones de diseño. Se trata de una recomendación sobre la organización del trabajo; las fuentes no describen una función específica para el registro ni la integración con proyectos.

Fuentes y licencia

Esta guía se ha adaptado al turco a partir de la documentación de Google sobre generación de imágenes y diseño de prompts en Gemini API. Ambas fuentes tienen licencia CC BY 4.0. Los ejemplos de prompts arquitectónicos son originales y se han escrito para esta guía, no son copias de los ejemplos de las fuentes.

Fuentes

2 fuentes
A(
ai.google.dev (CC BY 4.0)ai.google.dev/gemini-api/docs/image-generation
Resumen
A(
ai.google.dev (CC BY 4.0)ai.google.dev/gemini-api/docs/prompting-strategies
Resumen

No republicamos los textos de las fuentes; las citas breves van marcadas y el resto es resumen y comentario propios.

La opinión de 3dsınıfı
3dValoración del editor

Para los estudios de arquitectura y los equipos de visualización de Turquía, Nano Banana 2.1 puede considerarse una herramienta de exploración visual que permite debatir alternativas de materiales y atmósferas en las primeras fases del diseño. La posibilidad de editar una imagen existente mediante texto también puede ayudar a generar alternativas; sin embargo, el resultado no debe sustituir la verificación técnica ni considerarse documentación de proyecto lista para producir.

Antes de tomar una decisión, conviene analizar por separado el acceso a la API, el costo de uso y la compatibilidad con el flujo de trabajo actual del equipo; las fuentes proporcionadas no detallan estos aspectos. Es útil que se mencionen las opciones de 1K, 2K y 4K, pero no se indican los requisitos técnicos para determinar qué resolución conviene a cada uso. Por eso, lo más recomendable es probar un flujo de trabajo pequeño para evaluar la calidad de los resultados y el costo práctico.

Preguntas frecuentes

¿Con qué identificador de modelo se utiliza Nano Banana 2.1?

La documentación de Gemini API indica que el identificador del modelo es `gemini-nano-banana-2.1`.

¿Nano Banana 2.1 puede editar una imagen arquitectónica existente?

Según la documentación, se puede proporcionar una imagen junto con instrucciones de texto para añadir, eliminar o cambiar elementos. Es necesario contar con los derechos de uso correspondientes.

¿Qué resoluciones admite Nano Banana 2.1?

La página de Google menciona resoluciones de 1K, 2K y 4K para el modelo. El texto fuente no explica los pasos técnicos para seleccionarlas.

Los comentarios y el foro están en turco.Únete al debate
+

Noticias relacionadas