cuando la ia se convierte en fotografo experto el nuevo generador de imagenes de chatgpt

Cuando la IA se convierte en fotógrafo experto: el nuevo generador de imágenes de ChatGPT

La fotografía tradicional tiene sus días contados. Y no, no lo digo a la ligera. Con el lanzamiento del nuevo modelo GPT Image 1.5 de OpenAI, estamos presenciando cómo la barrera entre lo real y lo generado artificialmente se difumina a velocidades alarmantes. Si antes necesitabas años de experiencia con Photoshop, un cuarto oscuro o al menos tijeras y pegamento para manipular una imagen de forma convincente, ahora solo necesitas escribir una frase.

La carrera por dominar la generación de imágenes

OpenAI no ha sido la primera en dar este paso. Google se les adelantó a principios de 2025 con su modelo Nano Banana (y posteriormente Nano Banana Pro), ganándose el entusiasmo de la comunidad tecnológica. Esta competencia directa parece haber acelerado los planes de OpenAI, que llevaba tiempo desarrollando su propia solución multimodal desde el lanzamiento de GPT-4o.

Y seamos sinceros: cuando Google te adelanta por la derecha, reaccionas. La respuesta de OpenAI ha llegado con GPT Image 1.5, una herramienta que no solo genera imágenes cuatro veces más rápido que su predecesor, sino que además reduce los costes de API en un 20%.

¿Qué hace a GPT Image 1.5 especial?

Lo revolucionario de este modelo es su naturaleza «nativa multimodal». A diferencia del anterior DALL-E 3 integrado en ChatGPT (que utilizaba técnicas de difusión), GPT Image 1.5 procesa tanto el texto como las imágenes como si fueran lo mismo: tokens que deben ser predecidos dentro de la misma red neuronal.

En términos prácticos, esto significa que si subes una foto de tu mascota y escribes «ponle un sombrero de vaquero y unas botas», el modelo procesa tus palabras y los píxeles de la imagen en un espacio unificado, generando nuevos píxeles como si estuviera completando una frase.

Este enfoque permite algo que antes era mucho más complicado: alterar la realidad visual con mayor precisión, cambiando posturas, ajustando la perspectiva o modificando elementos específicos mientras se mantiene la identidad facial a lo largo de ediciones sucesivas.

Manipulación fotográfica: ahora al alcance de cualquiera

Probablemente uno de los aspectos más impactantes es lo accesible que se ha vuelto la manipulación fotorrealista. Como explica Fidji Simo, CEO de aplicaciones de OpenAI, la interfaz de chat tradicional no estaba diseñada para el trabajo visual, por lo que han creado un espacio dedicado en la barra lateral de ChatGPT con filtros predefinidos y sugerencias de tendencias.

En mis pruebas iniciales con GPT Image 1.5, he podido comprobar que aunque no siempre sigue las instrucciones a la perfección, cuando funciona correctamente los resultados son notablemente más convincentes y detallados que los modelos anteriores.

Y si te interesa comparar los distintos modelos de generación de imágenes de IA disponibles actualmente, Shaun Pedicini ha creado un sitio llamado «GenAI Image Editing Showdown» que permite realizar pruebas A/B entre diferentes herramientas.

Luces y sombras del avance tecnológico

No podemos ignorar las implicaciones que este tipo de tecnología trae consigo. Para quienes crecimos en una era donde las fotografías eran documentos relativamente confiables de la realidad, resulta inquietante ver cómo cualquiera puede generar imágenes que nunca ocurrieron con un realismo apabullante.

Durante casi dos siglos, la fotografía ha funcionado como un testigo visual de la historia. Aunque siempre existió la manipulación, requería habilidades especializadas, tiempo y recursos, lo que la hacía relativamente infrecuente. Esa época ha terminado definitivamente.

Entre la utilidad y el potencial de abuso

La capacidad de GPT Image 1.5 para preservar los rasgos faciales a través de múltiples ediciones tiene obvias aplicaciones legítimas en el campo de la edición fotográfica profesional. Pero también abre la puerta a posibles abusos.

Ya hemos visto cómo los generadores de imágenes se han utilizado para crear imágenes íntimas no consentidas o suplantar identidades. OpenAI ha implementado filtros que bloquean contenido sexual o violento, pero sigue siendo posible crear imágenes embarazosas de personas sin su consentimiento (aunque esto viole sus términos de servicio).

La compañía asegura que las imágenes generadas incluyen metadatos C2PA que las identifican como creadas por IA, aunque estos datos pueden eliminarse fácilmente al guardar el archivo en otro formato.

El texto: el talón de Aquiles que se fortalece

Un problema persistente en los generadores de imágenes ha sido la representación de texto. Intentar que estos modelos creen un cartel o un letrero con palabras específicas solía resultar en textos incomprensibles o mal escritos.

OpenAI afirma que GPT Image 1.5 maneja mejor textos más densos y pequeños. En su blog muestran un ejemplo impresionante: la generación de un periódico completo con titular, subtítulos, firma y párrafos legibles. Si bien esto aún requiere más pruebas en diferentes contextos, representa otro paso hacia la erosión de nuestra capacidad para distinguir entre documentos históricos reales y fabricaciones.

El detector de IA: una carrera constante

Con cada avance en la generación de imágenes, los detectores de IA intentan mantenerse al día. Es una batalla tecnológica donde cada vez es más difícil identificar lo artificial. Las herramientas actuales de detección de contenido generado por IA se enfrentan a un desafío creciente con cada nueva versión de estos modelos.

OpenAI reconoce que GPT Image 1.5 todavía tiene limitaciones, como el soporte limitado para ciertos estilos de dibujo y errores al generar imágenes que requieren precisión científica. Pero la velocidad de mejora es vertiginosa.

Como la propia compañía afirma, «creemos que estamos solo al principio de lo que la generación de imágenes puede permitir». Y viendo el progreso de los últimos tres años en este campo, me temo que tienen razón.

El futuro de la fotografía y la imagen como testimonio visual está cambiando radicalmente ante nuestros ojos. Y aunque las posibilidades creativas son fascinantes, también nos obligan a replantearnos cómo validaremos la autenticidad visual en un mundo donde cualquiera puede crear realidades alternativas con un simple prompt.

Noticias similares

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *