ChatGPT auf Deutsch
ChatGPT Deutschland Community

ChatGPT vs. Gemini: Welcher KI-Bildgenerator liefert die besten Ergebnisse?

ChatGPTs neues Bildbearbeitungs-Update konkurriert mit Google Gemini um die besten Photoshop-ähnlichen Funktionen. Mit verbesserter Bearbeitungspräzision und schnelleren Renderzeiten zeigt sich ChatGPT leicht überlegen, obwohl beide Technologien beeindruckende Ergebnisse liefern.
ChatGPT vs. Gemini: Welcher KI-Bildgenerator liefert die besten Ergebnisse?

OpenAI hat kürzlich ein neues Update für seinen Chatbot ChatGPT vorgestellt, das sich auf die Bildbearbeitungsfähigkeiten konzentriert. Das Update, bekannt als GPT Image 1.5, bringt verbesserte Funktionen für die Bildmanipulation. Dies geschieht im Zuge der Entwicklungen, die Google zuvor mit seinem eigenen Bildeditor unter dem Codenamen Nano Banana in sein Gemini-System integriert hatte. Beide Updates streben eine Verbesserung der Bildbearbeitungsfunktionen an, insbesondere bei der Bearbeitung spezifischer Bildteile, ohne das gesamte Bild zu verändern.

Eine der bemerkenswerten Verbesserungen von ChatGPT ist die Fähigkeit, Teile eines Bildes zu ändern – sei es das Hinzufügen oder Entfernen von Objekten oder das Ändern von Farben und Stilen –, während der Rest des Bildes unverändert bleibt. Diese Funktionalität ist vergleichbar mit den kürzlich eingeführten Möglichkeiten von Google Gemini, das ebenfalls die Kombination mehrerer Bilder in einer Szene ermöglicht. Nutzer können beispielsweise Fotos von sich und Freunden vor bekannten Sehenswürdigkeiten wie der Sydney Harbour Bridge erstellen, indem sie einfach die Quellbilder bereitstellen.

OpenAI betont, dass der neue Bildeditor und Generator in der Lage ist, Anweisungen zuverlässiger zu befolgen und Bilder bis zu viermal schneller zu rendern als zuvor. Die Textstile können variieren, und die generierten Bilder sollen realistischer und fehlerfreier sein. Dennoch räumt OpenAI ein, dass noch Verbesserungsbedarf besteht.

In einem direkten Vergleich zwischen ChatGPT und Gemini zeigt sich, dass beide Systeme inzwischen recht kompetent in der sauberen Bildbearbeitung sind. Objekte können nahtlos eingefügt oder entfernt werden, was vorher eine zeitaufwändige manuelle Bearbeitung erfordert hätte. Die AIs bewältigen Farbänderungen mühelos, haben jedoch Schwierigkeiten mit Perspektivwechseln. Hier zeigt ChatGPT eine etwas bessere Leistung als Gemini.

Eine weitere Fähigkeit, die beide Systeme nun bieten, ist die Kombination von Bildern. Benutzer können separate Fotos kombinieren und diese in einen neuen Hintergrund einfügen. Diese Funktion ist besonders nützlich für Familienfotos, die ohne physische Zusammenkunft der Beteiligten erstellt werden können. Trotz beeindruckender Ergebnisse ist die Erstellung eines kohärenten Bildes aus mehreren Quellen eine Herausforderung. Oftmals stimmen Lichtverhältnisse oder Maßstäbe nicht überein, was zusätzliche Bearbeitungen erfordert.

ChatGPT zeigt sich im Vergleich etwas fähiger beim Mischen von Bildern und beim Ändern des Gesamtbildstils. Während eines Tests, bei dem versucht wurde, verschiedene Bilder in einer stimmungsvollen Film-Noir-Szene zu kombinieren, lieferte ChatGPT ein konsistenteres Ergebnis, während Gemini eher wie eine Collage wirkte.

Die neuen Fähigkeiten von ChatGPT und Gemini zeigen, wie weit die Technologie der KI-gestützten Bildbearbeitung fortgeschritten ist. Sie machen komplexe Photoshop-ähnliche Bearbeitungen für jedermann zugänglich. Obwohl ChatGPT derzeit einen leichten Vorsprung hat, ist der Unterschied gering, und es bleibt spannend zu beobachten, wohin sich diese Technologien weiterentwickeln werden.