OpenAI hat seine generative KI weiter verbessert: Eine neue Version von ChatGPT Images soll nun Ergebnisse liefern, die genau den Vorgaben der Nutzer entsprechen.

Mit GPT Images 1.5 verbessert OpenAI die Möglichkeiten zur Bildbearbeitung in ChatGPT.
OpenAI
Nicht weniger als ein „kreatives Studio in der Tasche“ verspricht OpenAI mit der Aktualisierung von ChatGPT. Mit dem Update werden, wie es heißt, Anweisungen noch besser befolgt und Bilder bis zu viermal so schnell generiert. Zudem gebe es jetzt hochpräzise Bearbeitungsmöglichkeiten.
Möglich macht dies ein neues Bildgenerierungsmodell für ChatGPT Images. Dieses Update ist auch über die API als GPT Image 1.5 verfügbar. Verbesserungen, die laut OpenAI auch für professionelle Anwendungsfälle von Interesse sind.
Für Marketing und E-Commerce
So eigne sich das Modell für Marketing- und Markenarbeiten wie die Erstellung von Grafiken und Logos, da es Markenlogos und wichtige visuelle Elemente konsistenter über Bearbeitungen hinweg beibehält. Ferner unterstütze es E-Commerce-Teams bei der Generierung vollständiger Produktbildkataloge (Varianten, Szenen, Winkel) aus einem einzigen Quellbild.
Der wichtigste Durchbruch liegt dabei aus Sicht von OpenAI in der zuverlässigeren Einhaltung der Benutzer-Prompts bei der Bearbeitung hochgeladener Bilder. Das Modell könne nun präzise Änderungen bis ins kleinste Detail vornehmen. Dabei würden Elemente wie Beleuchtung, Komposition oder das Aussehen von Personen nicht verändert. Auf diese Weise will OpenAI eine hohe Konsistenz über Eingaben, Ausgaben und nachfolgende Bearbeitungen hinweg gewährleisten.
Neue Bearbeitungsoptionen
Diese Präzision eröffnet neue Möglichkeiten für nützliche Fotobearbeitungen sowie glaubwürdige Anproben von Kleidung und Frisuren, wirbt das Unternehmen. Das Modell offeriere verschiedenen Arten der Bearbeitung, einschließlich des Hinzufügens, Subtrahierens, Kombinierens, Vermischens und Transponierens von Elementen, wobei der ursprüngliche Charakter des Bildes erhalten bleibe. Zudem folge das Modell den Prompts zuverlässiger als die erste Version. Dies ermöglicht OpenAI zufolge eine präzisere Bearbeitung als auch komplexere Originalkompositionen, bei denen die Beziehungen zwischen Elementen wie beabsichtigt erhalten bleiben.
Neben der gesteigerten Präzision verfügt die neue Engine über verbesserte kreative Transformationsfähigkeiten. Sie kann, so die KI-Schmiede, Elemente wie Text und Layout ändern oder hinzufügen, um Ideen zu verwirklichen, wobei wichtige Details bewahrt werden. Zudem sei das Modell nun in der Lage, dichtere und kleinere Texte zu verarbeiten.
Geringere Kosten
Um die Bedienung zu vereinfachen, führt OpenAI eine neue dedizierte „Images“-Funktion innerhalb von ChatGPT ein. Dieser neue Bereich, der über die Seitenleiste in der mobilen App und auf chatgpt.com zugänglich ist, mache das Ausprobieren von Bildern schneller und einfacher. Er enthalte Dutzende voreingestellte Filter und Prompts, um die Inspiration anzukurbeln – und das ohne die Notwendigkeit einer schriftlichen Prompt-Eingabe.
Dass neue Modell wird laut OpenAI seit dem 16 Dezember schrittweise für alle ChatGPT- und API-Nutzer weltweit freigeschaltet. Und es hat noch einen wirtschaftlichen Nebeneffekt: GPT Image 1.5 soll 20 Prozent günstigere Eingaben und Ausgaben im Vergleich zur Vorgängerversion ermöglichen. Dies erlaube es, mehr Bilder mit dem gleichen Budget zu generieren.





