Wenn du vor einem Jahr ein Bild für einen Blogbeitrag brauchtest, hast du stundenlang auf Stockfoto-Seiten gesucht. Heute schreibst du ein paar Sätze und hast in Sekunden das gewünschte Bild. Die Technologie zur Bilderzeugung mit KI hat sich in den letzten zwei Jahren unglaublich schnell entwickelt und wird inzwischen sogar in professionellen Projekten eingesetzt.
In den letzten sechs Monaten haben wir drei verschiedene KI-Tools zur Bilderzeugung in Dutzenden von Projekten genutzt. Wir haben Bilder für Blogs, Social-Media-Inhalte, Präsentationsfolien und sogar Kundenpräsentationen erstellt. Dabei haben wir den charakteristischen Stil jedes Tools und seine Paradedisziplinen kennengelernt.
Midjourney: Künstlerische Qualität
Midjourney ist der unbestrittene Qualitätsführer in der Welt der KI-Bilderzeugung. Die erzeugten Bilder sind ästhetisch die beeindruckendsten. Besonders bei künstlerischen, atmosphärischen und Konzeptbildern ist es konkurrenzlos.
Zum ersten Mal haben wir Midjourney bei einer Markenidentitäts-Arbeit für einen Kunden eingesetzt. Wir sollten verschiedene visuelle Konzepte für die Marke entwickeln, und auf herkömmlichem Weg hätten wir für jedes Konzept Stunden gebraucht. Mit Midjourney haben wir 20 verschiedene Konzepte in zwei Stunden erstellt. Als der Kunde diese Bilder im Meeting sah, war er sehr beeindruckt und wollte einige sogar direkt als Social-Media-Inhalt verwenden.
Die Stärken von Midjourney:
- Fotorealistische und künstlerische Qualität
- Konsistente Ästhetik und stilisierter Look
- Die Community ist als Inspirationsquelle sehr wertvoll
- Verbessert sich ständig durch neue Versionen
Allerdings läuft Midjourney über Discord, was für manche Nutzer ungewohnt sein kann. Außerdem hat es weiterhin Schwierigkeiten bei Bildern mit Text und versteht türkische Prompts nicht richtig. Du musst auf Englisch schreiben.
Eine befreundete Designerin hat ihr Stockfoto-Abo gekündigt, nachdem sie Midjourney entdeckt hatte. Heute erzeugt sie für ihre Kunden eigenständige Bilder, die genau zum Bedarf passen. Früher brauchte sie eine halbe Stunde, um ein passendes Bild für einen Blogbeitrag zu finden, heute erledigt sie das in fünf Minuten.
DALL-E: Das Bildtalent von OpenAI
DALL-E ist in ChatGPT integriert und damit das am leichtesten zugängliche KI-Bildtool. Wenn du ein ChatGPT-Plus-Abo hast, kannst du es ohne zusätzliche Kosten nutzen.
Der größte Vorteil von DALL-E ist sein Verständnis natürlicher Sprache. Du kannst komplexe und detaillierte Beschreibungen geben und erhältst meist Ergebnisse, die dem Gewünschten nahekommen. Sehr nützlich ist auch die Funktion, einen bestimmten Bereich im Bild auszuwählen und zu ändern. Bei einem erzeugten Bild kannst du zum Beispiel die Hintergrundfarbe oder die Position eines Objekts ändern.
Wir nutzen DALL-E vor allem für Social-Media-Grafiken. Dass es schnell und praktisch ist, ist bei häufiger Content-Erstellung ein großer Vorteil. Wir können alle Bilder für einen Wochenkalender in Social Media in einer Sitzung erzeugen.
Als Nachteil bleibt die ästhetische Qualität von DALL-E hinter Midjourney zurück. Das fällt besonders bei menschlichen Gesichtern und detailreichen Szenen auf. Außerdem gibt es ein tägliches Nutzungslimit.