Showing posts with label Dall-E. Show all posts
Showing posts with label Dall-E. Show all posts

Tuesday, January 16, 2024

101 interacciones para una imagen: porque la IA no es el fin del diseñador

Quizá los artículos (cortos) sobre que la IA/AI va a acabar con tal o cual profesión o habilidad generan más clicks que los que o lo niegan o lo matizan en gran medida (hay una sesión entera en Davos este año al respecto) 

El caso es que a día de hoy la IA/AI posee el mismo grado de amenaza para el empleo que las tecnologías precedentes: lo peligroso es desentenderse de ellas pero no atenderlas y entenderlas 

El principio aquel de la colaboración persona-máquina ( o sistema artificial) lo hemos leído en análisis anteriores y con distintas tecnologías (hasta hace poco se insistía más en la robotización) , pero sigue siendo válida para la IA/AI. 

La IA generativa se ha convertido estos 13 meses pasados en una herramienta más para aquellos que o han sabido o han querido integrarlo en su rutina de trabajo. Lo que ha servido más que nada para que los inexpertos de otras profesiones nos diéramos cuenta de la (enorme) cantidad de tareas que hay detrás de cada puesto de trabajo 

Fijaos en este ejemplo de la artista turco-británica Rezzan Hasoglu que en noviembre pasado presentó un diseño de jarrón en la Semana del Cristal de Venecia cuya peculiaridad residía, entre otras cosas, en que fue diseñado utilizando un sistema de IA/AI 

La conclusión facil seria a que la IA viene por nosotros (diseñadores/creadores) pero leyendo en profundidad la propia artista reconoce que en efecto hizo un prompt un tanto genérico a Dall-E y le devolvió una primera imagen que tuvo que ser refinada con más de 101 interacciones adicionales hasta dar con el diseño final que se esperaba o al menos convencia 

Hay además un valor añadido muy importante en este proceso. Cuando Dall-E generó la imagen del jarrón éste no tenía apertura ! lo que en principio contradice la función principal de estos recipientes que es colocar flores. Digo que es interesante por que las alucinaciones - que son las limitaciones actuales de la IA- se han convertido en una técnica artística, ya que la IA no posee los juicios y prejuicios humanos y desconoce el concepto de pragmatismo 

Es del todo imposible pensar que una IA pueda sustituir por completo a los artistas, ya que aunque en el presente continuo los sistemas artificiales cada vez hagan más cosas con menos errores, el refuerzo del feedback humano (el toque personal) será el factor determinante del valor y el precio de mercado de la obra creada 

Friday, October 21, 2022

Las patentes son solo humanas: el caso Thaler

(Imagen de una patente creada por Stable Diffusion)


Conforme vamos viendo avances evidentes, al menos de su aplicación concreta, en Inteligencia Artificial (AI) quizá lo más fascinante es como pone en entredicho el concepto de autoría, al que me he referido varias veces en este blog 

Stephen Thaler es un tipo que hace exactamente eso, se dedica a presentar registros de proyectos a las oficinas de patentes y de copyright con la autoría de un programa de IA en distintos paises (por el momento 15), y aunque la mayoría le dan calabazas legales, alguno como Sudafrica ha salido adelante 

Lo ultimo, de este debate que no ha hecho más que empezar, es que la Oficina federal de apelaciones le acaba de tumbar a Thaler el registro de una patente en la oficina de patentes de los US (USPTO), sentenciando que una patente debe ser registrada por un humano (natural person) 

Aunque parece lógico esta respuesta de la corte de apelaciones, la base sobre la que Thaler apeló es que la ley en los US permite registrar una patente como "inventor", pero la Corte Suprema matizó que este inventor tiene que ser una persona no un programa de software

Las leyes que protegen las patentes y el copyright  no impiden que un autor (humano) registre una obra  como de su propiedad por mucho protagonismo que haya tenido una herramienta en su creación. El problema que ya esta pasando es cuando la IA salta de herramienta a creador, algo que vemos a diario ya con Dall-E o Stable Diffusion  

Como os podeis imaginar ante este dilema hay varias salidas y ninguna de ellas sencilla de aplicar y asumir: 

sino cambian las leyes , quiza algun juez se sienta tentado de reconocer un sistema de IA como individuo , aunque no sea una persona, lo que abriría no pocos dilemas legales sobre los derechos y obligaciones de un individuo artificial

lo segundo es que que cambien las leyes y una creación realizada con IA se pueda registrar como patente o como obra sujeta a copyright (me tienes que pagar por usarla) , lo que abriría una catarata incesante de peticiones, lo que no se si seria bueno para la innovación (muchas patentes sobre todo frenan la innovación)

lo tercero es que toda siga igual y a los Thaler del mundo les manden a paseo. El problema es cuanto tiempo se puede sostener esto y sobre todo abrir otro enorme debate sobre cuales son los objetivos sociales de un sistema de patentes en una etapa donde el individuo puede vive solo en la nube 

Friday, September 30, 2022

Haz un video solo con palabras: la siguiente fase ya esta aquí

Estábamos preguntándonos cuanto tardaría en anunciarse un sistema de Inteligencia Artificial (AI) que permitiera hacer videos a partir de un texto, bueno pues ya esta aquí de la mano de Meta (ex-Facebook) 

Todavía en ese shock de emoción infantil con los generadores de imagenes a partir de texto (que mejoran cada dia realmente) Meta anuncia Make-A-Video (= haz un video) que funciona igual que los Dall.E , Midjourney etc pero en vez de ofrecer imagenes fijas crea videos de 5 segundos con una calidad mejorable y ese aspecto de video domestico de los años 70´s 

Parecía este un paso descontado ya que desde que aparecieron los generadores de imágenes ya se hablaba del video, pero la enorme diferencia es que hacer videos es algo mucho más complejo por que no hay tantos repositorios de video asociado a texto en el mundo y además  requiere mucho poder de computación por lo que solo una empresa grande como Meta podría apuntarse un tanto así sin tener además un objetivo comercial al menos a corto plazo

Make-A-Video no hace magia pero casi, el sistema se entrena con imágenes fijas que tienen una descripción de texto (ejem: esto es un perro) y luego se le muestra centenares de videos de como esos objetos o personas se mueven y asi genera un video corto y mejorable pero que abre la puerta a demasiadas incógnitas y oportunidades 

De momento Meta ha hecho solo el anuncio (puro marketing para decir eh! que también estamos en esto!!) y no esta disponible para el público, pero Meta ha compartido ya con la comunidad científica el desarrollo de Make-A-Video por lo que no pasará mucho tiempo para que veamos aparecer un competidor que haga videos mejores 

De nuevo, y antes de ver nada surgen y surgirán voces que nos alertan de los peligros de que cualquiera haga un video realista con unas pocas palabras que confunda a los que quieren ser confundidos (fake)

Sin embargo, una IA que genere videos de duración y calidad creciente sobre todo lo que haré es abrir la puerta a que nuevos creadores que se adentren en el mundo de la ficción filmada (cine/video) sin las barreras de entrada de los costos (equipo técnico, actores) lo que quizá es una forma de decir que estamos en el umbral del nuevo cine (seguro que Godard hubiera amado la idea) 


Friday, September 02, 2022

Síntesis de imagen a partir de texto: de Bowie a Serrat


La aparición de DALL-E el año pasado es uno de esos sucesos que comienzo a intuir va a tener profundos efectos en un multitud de tareas y sectores, ya que le da la vuelta a lo que conocíamos hasta ahora como creación artística o incluso la plasmación de la imaginación en algo concreto (como un surrealismo a partir de la Inteligencia Artificial)

Este interés por estas programas de IA me llevo a conocer MidJourney que funciona de manera parecida a DALL-E pero que hace su función para novatos como yo pero de manera mucho (pero mucho) más sencilla (le das una orden o propmt y te genera una imagen en segundos  )

Una de estas lecturas me condujo a este aidontknow un creador en you tube que ha creado un video a partir del Starman de Bowie simplemente metiendo estrofa tras estrofa de la letra (lyric) de la más que popular canción cuyo resultado (mejorable claro) podeis ver aqui

Es fascinante realmente no tanto los resultados (por ahora) sino las posibilidades que abren estos sistemas como MidJourney (ojo que tiene ya más de 1 millón de usuarios registrados!) de síntesis de imagen por eso me pase unas horas dentro de MidJourney e introduje las primeras estrofas del Mediterraneo de Serrat a partir del cual se crearon estas imágenes que veis a continuación






Algunos (con razón) podrán decir que son imágenes un poco naif que recuerdan la estética de algunos comics e imágenes de los años 70´s , pero insisto que esto es solo el principio y apenas le dedique unos minutos (sin tomarme la molestia siquiera de traducir la letra de la canción al ingles lo que intuyo le dio menos precisión)