Hace un año, cuando querías encontrar una imagen para una entrada de blog, pasabas horas buscando en sitios de fotos de stock. Ahora escribes un par de frases y generas en segundos la imagen que quieres. La tecnología de creación de imágenes con inteligencia artificial ha avanzado a una velocidad increíble en los últimos dos años y ya se utiliza incluso en proyectos profesionales.
En los últimos seis meses hemos utilizado tres herramientas distintas de generación de imágenes con IA en decenas de proyectos. Hemos creado imágenes para blogs, contenidos de redes sociales, diapositivas de presentaciones e incluso presentaciones a clientes. Hemos descubierto el estilo característico de cada herramienta y en qué campos es la mejor.
Midjourney: calidad artística
Midjourney es, sin discusión, el líder en calidad del mundo de la generación de imágenes con IA. Las imágenes que produce son las más impresionantes desde el punto de vista estético. Es insuperable, sobre todo en imágenes artísticas, atmosféricas y de concepto.
Usamos Midjourney por primera vez en un trabajo de identidad de marca para un cliente. Necesitábamos crear distintos conceptos visuales para la marca y, con el método tradicional, habríamos invertido horas en cada concepto. Con Midjourney generamos 20 conceptos distintos en dos horas. Cuando el cliente vio estas imágenes en la reunión, quedó muy impresionado e incluso quiso usar algunas directamente como contenido para redes sociales.
Puntos fuertes de Midjourney:
- Calidad fotorrealista y artística
- Estética coherente y aspecto estilizado
- La comunidad es una fuente de inspiración muy valiosa
- Mejora constantemente con las actualizaciones de versión
Sin embargo, Midjourney funciona a través de Discord y eso a algunos usuarios puede resultarles extraño. Además, todavía tiene dificultades con las imágenes que contienen texto y no entiende del todo los prompts en turco. Hay que escribir en inglés.
Una amiga diseñadora canceló su suscripción a fotos de stock tras descubrir Midjourney. Ahora genera para sus clientes imágenes originales y adaptadas exactamente a lo que necesitan. Antes, encontrar una imagen adecuada para una entrada de blog le llevaba media hora; ahora lo resuelve en cinco minutos.
DALL-E: el maestro de la imagen de OpenAI
DALL-E, integrado en ChatGPT, es la herramienta de imágenes con IA más accesible. Si tienes una suscripción a ChatGPT Plus, puedes usarla sin pagar nada adicional.
La mayor ventaja de DALL-E es su capacidad de comprensión del lenguaje natural. Puedes hacer descripciones complejas y detalladas y por lo general obtienes resultados cercanos a lo que querías. Además, es muy útil poder seleccionar y modificar una parte concreta de la imagen. Por ejemplo, en una imagen que has creado puedes cambiar el color del fondo o la posición de un objeto.
Nosotros usamos DALL-E sobre todo para imágenes de redes sociales. Su rapidez y practicidad son una gran ventaja cuando se produce contenido con frecuencia. Podemos generar de una sentada todas las imágenes del calendario de redes sociales de una semana.
Como desventaja, la calidad estética de DALL-E queda por detrás de la de Midjourney. Se nota sobre todo en los rostros humanos y en las escenas detalladas. Además, tiene un límite de uso diario.