Googles Künstliche Intelligenz beginnt, Bilder zu interpretieren
Google entwickelt seine KI-basierte Sucherfahrung kontinuierlich weiter. Der suchorientierte Chatbot des Unternehmens, den es als „AI Mode“ bezeichnet, kann nun nicht mehr nur mit Texten, sondern auch mit Bildern interagieren. Dank dieser neuen Funktion können Nutzer Fragen zu Bildern stellen und detaillierte Antworten erhalten. Google hat dieses Update bereits Millionen von Nutzern auf Android- und iOS-Plattformen über die Google-App zur Verfügung gestellt.
Das Update basiert auf der Kombination einer speziellen Version des Gemini-KI-Modells mit der Google Lens-Technologie. Nutzer können ein Foto aufnehmen oder ein Bild von ihrem Gerät hochladen, um der Künstlichen Intelligenz Fragen zum Inhalt zu stellen. Das System erkennt nicht nur die Objekte im Bild, sondern bewertet auch deren Kontext. Auf diese Weise erhalten Nutzer nicht nur Informationen über die abgebildeten Objekte, sondern gewinnen auch tiefere Einblicke in die Beziehungen zwischen den Objekten und die allgemeine Bedeutung des Bildes.
Robby Stein, Produktmanager für die Google-Suche, beschreibt dieses Update als eine fortgeschrittene Stufe früherer Bemühungen im Bereich der visuellen Suche. Die Künstliche Intelligenz liest nun Elemente wie Form, Farbe, Material und Anordnung, um die gesamte Szene zu verstehen. Jedes Objekt im Bild wird nicht nur als eigenständiges Wesen betrachtet, sondern als Teil eines Ganzen, das in Beziehung zu anderen Elementen steht. Diese Funktion ermöglicht es dem „AI Mode“, den Nutzern natürlichere und sinnvollere Antworten zu liefern.
Bei der Analyse von Bildern verwendet die Künstliche Intelligenz einen Ansatz namens 'Fan-out'. Mit dieser Methode werden für jedes einzelne Objekt im Bild mehrere parallele Abfragen erstellt. Dadurch kann eine vielschichtige und kontextuell konsistente Antwort geliefert werden, die alle Details des Bildes berücksichtigt. Wenn beispielsweise ein Foto eines Bücherregals untersucht wird, kann das System die Bücher erkennen, ähnliche Inhalte vorschlagen und Leseempfehlungen geben.

Diese Neuerung beschränkt sich nicht nur auf die Bilderkennung; sie interagiert auch mit den Nutzern und beantwortet deren Fragen. Wenn ein Nutzer weitere Informationen zu einem Bild anfordert, kann das System zusätzliche Abfragen generieren und neue Vorschläge unterbreiten. Diese Funktion macht den „AI Mode“ von einem statischen Analysewerkzeug zu einem dynamischen Assistenten. Jedes Bild wird für das System zu einem Ausgangspunkt für den Zugang zu Informationen.
Google hatte den „AI Mode“ erstmals im vergangenen Monat einem begrenzten Kreis von Google One AI Premium-Abonnenten zugänglich gemacht. Mit diesem Update ist die Funktion jedoch nicht mehr nur zahlenden Abonnenten vorbehalten. Das Unternehmen gab bekannt, dass es im Rahmen des Labs-Programms Millionen von Nutzern Zugang gewährt. Dies bedeutet, dass nun mehr Menschen von der verbesserten visuellen Sucherfahrung profitieren können.
Nachrichtenquelle: 12punto
Meistgelesen
Das Schreiben nimmt kein Ende: Noch eine FETÖ-Erinnerung
Der Geist, der an der Leggings hängen blieb...
Berühmter Regisseur Ezel Akay und sein Bruder festgenommen
Er nannte die Kommunen, die zur 'Neuen Partei' wechseln werden, und ein Detail zu Istanbul erregte Aufmerksamkeit
Abgeordneter, dem ein Wechsel zur AKP nachgesagt wird, beginnt Überzeugungstour
Die internen Debatten der CHP interessieren mich überhaupt nicht
Ümit Özdağ kommentiert neue Parteigründung
Strenge Kontrollen für Fahranfänger
Enver-Altaylı-Vorwurf in der Akte Yazıcıoğlu
Die Wahl des stellvertretenden Bürgermeisters, die die CHP gewonnen hatte, wird ab der dritten Runde wiederholt