OpenAI bereitet möglicherweise die nächste Version seines Text-zu-Bild-Generators DALL-E AI mit einer Reihe von Alphatests vor, die nun an die Öffentlichkeit durchgesickert sind, so die Decoder.
Ein anonymer Leaker auf Discord teilte Details zu seinen Erfahrungen mit, nachdem er Zugriff auf das kommende OpenAI-Bildmodell mit der Bezeichnung DALL-E 3 hatte. Er tauchte erstmals im Mai auf und erzählte dem interessenbasierten Discord-Kanal, dass er Teil eines Alphatests für OpenAI war und ein neues KI-Bildmodell ausprobierte. Er teilte die Bilder, die er damals erstellt hatte.
Die Alpha-Testversion vom Mai hatte die Fähigkeit, Bilder mit mehreren Seitenverhältnissen innerhalb des Bildmodells zu generieren. YouTuber, MattVidPro AI dann wurden mehrere der Bilder gezeigt, die im Seitenverhältnis 16:9 generiert wurden. Diese Version zeigte auch die Leistungsfähigkeit des Modells bei der Erstellung hochwertiger Texte, was bei Konkurrenzmodellen, selbst bei Top-Generatoren wie Stable Diffusion und Midjourney, nach wie vor ein Problem darstellt.
Einige Beispiele zeigten Bilder, wie z. B. in eine Backsteinmauer eingeschmolzenen Text, eine Neonschrift mit Wörtern, ein Plakat in einer Stadt, eine Kuchendekoration und einen in einen Berg eingravierten Namen. Das Modell behauptet, dass DALL-E gut darin ist, Menschen zu generieren. Ein solches Bild zeigte eine Frau, die auf einer Party Spaghetti isst, aus der Fischaugenperspektive.
Der Leaker kehrte Mitte Juli mit weiteren Details und neuen Bildern zum Discord-Kanal zurück. Er behauptete, Teil einer „Closed Alpha“-Testversion zu sein, an der etwa 400 Probanden teilnahmen. Er fügte hinzu, dass er per E-Mail zum Test eingeladen wurde und auch an den Tests des ursprünglichen DALL-E und DALL-E 2 beteiligt war. Dies führte zu der Schlussfolgerung, dass der Alpha-Test für DALL-E 3 sein könnte, obwohl dies nicht bestätigt wurde.
Das Modell wurde zwischen Mai und Juli erheblich aktualisiert. Der Leaker hat dies demonstriert, indem er Bilder geteilt hat, die auf der Grundlage derselben Eingabeaufforderung erstellt wurden und zeigen, wie leistungsfähig DALL-E 3 im Laufe der Zeit geworden ist. Die Eingabeaufforderung lautet wie folgt: Gemälde eines rosa Narren, der einem Panda während eines Radrennens ein High Five gibt. Die Fahrräder sind aus Käse und der Boden ist sehr matschig. Sie fahren durch einen nebligen Wald. Der Panda ist wütend.
Die Alpha-Version vom Mai erzeugt die allgemeine Szene, die die meisten Punkte der Aufforderung trifft. Es gibt eine kleine Verzerrung bei der Verbindung der Hände und die Räder der Fahrräder sind gelb und nicht aus Käse. Die Alpha-Version vom Juli ist jedoch viel detaillierter, wobei der rosa Narr und der Panda sich eindeutig abklatschen und die Fahrradräder in mehreren Generationen aus Käse bestehen.
In Midjourney fehlt der Narr in der Szene, die Pandas sind auf Motorrädern statt auf Fahrrädern. Es gibt Straßen statt Schlamm. Die Pandas sind glücklich statt wütend.
Es gibt eine Vielzahl von Beispielen für Alpha-Bilder von DALL-E vom 3. Juli, die das Potenzial des Modells zeigen. Da der Alpha-Test jedoch unzensiert war, wie der Leaker anmerkte, besteht auch die Möglichkeit, dass Szenen mit „Gewalt und Nacktheit oder urheberrechtlich geschütztem Material wie Firmenlogos“ entstehen.
Einige Beispiele sind ein blutrünstiges Anime-Mädchen, ein Game of Thrones Charakter, ein Grand Theft Auto V Auf dem Cover sieht man einen Zombie-Jesus, der ein Subway-Sandwich isst (was auch auf leichte Gewaltdarstellungen hindeutet), und unter anderem, wie Shrek bei einer archäologischen Ausgrabung ausgegraben wird.
MattVidPro AI stellte fest, dass das Bildmodell Bilder so generiert, als ob sie einem bestimmten Stil entsprechen sollten.
DALL-E 2 wurde im April 2022 eingeführt, war jedoch aufgrund seiner Popularität und ethischer und sicherheitsbezogener Bedenken streng reguliert und verfügte über eine Warteliste. Der KI-Bildgenerator wurde im September 2022 der Öffentlichkeit zugänglich gemacht.
Unterstützen Sie unsere Arbeit ❤️
Wenn Ihnen dieser Artikel gefallen hat, können Sie uns mit einem Trinkgeld unterstützen, damit wir weiterhin großartige Inhalte veröffentlichen können.
























