Zum Hauptinhalt

Text-to-Image (Bildgenerierung)

Text-to-Image bezeichnet KI-Systeme, die aus natürlichsprachigen Beschreibungen (Prompts) Bilder generieren — z.B. Midjourney, DALL-E oder Stable Diffusion.

AIAnfängerbildgenerierungdiffusionkreativ

Text-to-Image (Bildgenerierung)

Text-to-Image ist eine KI-Technologie, bei der ein Modell aus einer Textbeschreibung (Prompt) ein Bild generiert.

Wie funktioniert es?

Die meisten modernen Text-to-Image-Systeme basieren auf Diffusion Models:

  1. Das Modell startet mit zufälligem Rauschen
  2. Schrittweise wird das Rauschen entfernt
  3. Der Text-Prompt steuert, in welche Richtung das Bild entsteht

Bekannte Systeme

  • Midjourney: Beste Ästhetik und Fotorealismus
  • DALL-E 3: In ChatGPT integriert
  • Stable Diffusion: Open Source, lokal ausführbar
  • Adobe Firefly: Für kommerzielle Nutzung lizenziert

Anwendungen

  • Marketing und Social Media
  • Konzeptkunst und Produktdesign
  • Prototyping und Mockups
  • Kreative Inspiration

Inhouse statt Nachschlagewerk

Für den Transfer ins Unternehmen sind die Inhouse-Schulungen der passende nächste Schritt.