Google's gemini: präzisere bildbearbeitung steht bevor

Google arbeitet an einer deutlich verbesserten Möglichkeit, Bilder in der KI-App Gemini zu bearbeiten. Nutzer sollen zukünftig präziser Bereiche in Fotos auswählen und Änderungen detailliert beschreiben können – ein großer Schritt über die bisherigen einfachen Markierungsmöglichkeiten hinaus.

Gemini erhält erweiterte bildbearbeitungsfunktionen

Gemini erhält erweiterte bildbearbeitungsfunktionen

Bisher beschränkte sich die Bildbearbeitung in Gemini auf das Hervorheben von Bereichen oder das Hinzufügen von Text. Komplexere Anpassungen erforderten eine manuelle Beschreibung der gewünschten Veränderung. Dies war besonders bei Bildern, die von Gemini selbst generiert wurden, wie beispielsweise die berühmten „Nano Bananas“, umständlich.

Die neue Beta-Version der Android-App bringt eine erweiterte Bearbeitungsoberfläche. Mit einem Klick auf das Stift-Symbol öffnet sich ein Bedienfeld mit zusätzlichen Optionen: Größenänderung, Effekte und ein Textfeld zur präzisen Beschreibung der Änderungen. Nutzer können nun spezifische Bereiche auswählen, ihre Größe anpassen und Effekte vorab anwenden – alles innerhalb der Gemini-Oberfläche.

Diese Entwicklung ermöglicht eine deutlich feinere Kontrolle über die Bildbearbeitung. Kleine Details können entscheidend für das Endergebnis sein. Die neue Funktionalität verspricht, Gemini zu einem ernstzunehmenden Konkurrenten in der KI-gestützten Bildbearbeitung zu machen. Die Möglichkeit, nicht nur Inhalte zu generieren, sondern auch detaillierte Anpassungen vorzunehmen, steigert die Effizienz und Kreativität der Nutzer erheblich. Die Implementierung ist noch nicht vollständig abgeschlossen, doch die Richtung ist klar: KI-Bildbearbeitung wird präziser und benutzerfreundlicher.

Nano Bananas waren ein frühes Beispiel für die Herausforderungen der Bildbearbeitung mit KI. Die neuen Funktionen von Google adressieren diese Probleme direkt und eröffnen neue Möglichkeiten für kreative Anwendungen.

Die verbesserte Bildbearbeitung ist ein wichtiger Schritt, um KI-Systeme zugänglicher und nützlicher für ein breiteres Publikum zu machen. Google setzt damit einen neuen Standard in der Entwicklung von Bildgenerierungs- und Bearbeitungstechnologien.