OpenAI enthüllt neues Bildmodell
OpenAI hat ein neues Bildgenerierungs-Modell vorgestellt. Intern jedoch unter dem Codenamen gpt-image-2 entwickelt, markiert es einen deutlichen Sprung in der KI-gestützten Bildproduktion. Erste Beispielbilder, die jedoch auf Plattformen wie X und Reddit aufgetaucht sind, zeigen Aufnahmen, die kaum noch von echten Fotografien zu unterscheiden sind.
Textdarstellung und Realismus
Was das neue Modell von seinen Vorgängern unterscheidet, ist die Fähigkeit, komplexe Bildinhalte mit Text präzise darzustellen. Ob detaillierte Screenshots, Diagramme oder Infografiken. Allerdings galt diese Aufgabe lange als Schwachstelle KI-gestützter Bildgeneratoren. Laut ersten Berichten von Testern kann das Modell nun zuverlässig Text in Bildern platzieren. Buchstaben verschwimmen nicht mehr, und sinnlose Zeichenfolgen entstehen auch nicht mehr.
Daher eröffnen sich zudem neue Einsatzfelder. Werbung, Bildungsinhalte und professionelle Kommunikation profitieren besonders von dieser Fähigkeit. Statt teurer Foto-Shootings könnten Unternehmen künftig auf KI-generierte Visualisierungen setzen. Schnell, kostengünstig und in beliebigen Varianten, wie auch OpenAI bestätigt.
Das Ende des KI-Looks?
Der typische KI-Look, der bislang selbst fortschrittliche Modelle plagte, soll nun der Vergangenheit angehören. Perfekte Beleuchtung, unrealistisch glatte Gesichter und eine gewisse Sterilität waren Markenzeichen KI-generierter Bilder. OpenAI scheint jedoch dieses Problem nun adressiert zu haben. Allerdings braucht es für eine abschließende Bewertung eine breitere Verfügbarkeit.
Google hatte die Nase vorn
Lange Zeit galt Googles Nano Banana Pro als Maßstab für fotorealistische Bildgenerierung. Zudem verschafften Google natürliche Hauttöne, realistische Lichtstimmung und überzeugende Texturen einen Vorsprung. OpenAI hat mit dem neuen Modell nun offenbar aufgeholt. Oder gar überholt. Die Beispielbilder zeigen nämlich eine Qualität, die selbst kritische Beobachter überrascht. Auch ChatGPT Images 2.0 zeigte bereits diesen Trend.
Was das für die Branche bedeutet
Die Bildgenerierung via KI steht vor einem neuen Kapitel. Bisherige Modelle waren vor allem für experimentelle Zwecke interessant. Mit der neuen Qualitätsstufe rückt jedoch eine professionelle Nutzung in greifbare Nähe. Medienhäuser, Werbeagenturen und Content-Ersteller erhalten ein Werkzeug, das herkömmliche Produktionsprozesse ergänzt. Oder in Teilen ersetzt, wie auch Googles Street-View-KI zeigt.
Zugleich wachsen die Fragen. Wie geht die Branche mit der zunehmenden Ununterscheidbarkeit KI-generierter Bilder um? Welche Standards braucht es für Transparenz? Und wie positionieren sich Wettbewerber wie Google, Meta und Stability AI? Diese Fragen bleiben jedoch offen.