Finden Sie Nachrichten im folgenden Datumsbereich
und und
und und
und und
Löschen
Euro
Arrow
54,0739
Dollar
Arrow
44,8248
Pfund Sterling
Arrow
62,8947
Gold
Arrow
6163,5736
BIST 100
Arrow
10.729

Googles Künstliche Intelligenz beginnt, Bilder zu interpretieren

Google entwickelt seine KI-basierte Sucherfahrung kontinuierlich weiter. Der suchorientierte Chatbot des Unternehmens, den es als „AI Mode“ bezeichnet, kann nun nicht mehr nur mit Texten, sondern auch mit Bildern interagieren. Dank dieser neuen Funktion können Nutzer Fragen zu Bildern stellen und detaillierte Antworten erhalten. Google hat dieses Update bereits Millionen von Nutzern auf Android- und iOS-Plattformen über die Google-App zur Verfügung gestellt.

Überlass die Wahl deiner Nachrichten nicht dem Algorithmus - entscheide selbst, was du liest. Füge 12punto zu deinen bevorzugten Quellen hinzu!
Googles Künstliche Intelligenz beginnt, Bilder zu interpretieren

Das Update basiert auf der Kombination einer speziellen Version des Gemini-KI-Modells mit der Google Lens-Technologie. Nutzer können ein Foto aufnehmen oder ein Bild von ihrem Gerät hochladen, um der Künstlichen Intelligenz Fragen zum Inhalt zu stellen. Das System erkennt nicht nur die Objekte im Bild, sondern bewertet auch deren Kontext. Auf diese Weise erhalten Nutzer nicht nur Informationen über die abgebildeten Objekte, sondern gewinnen auch tiefere Einblicke in die Beziehungen zwischen den Objekten und die allgemeine Bedeutung des Bildes.

Robby Stein, Produktmanager für die Google-Suche, beschreibt dieses Update als eine fortgeschrittene Stufe früherer Bemühungen im Bereich der visuellen Suche. Die Künstliche Intelligenz liest nun Elemente wie Form, Farbe, Material und Anordnung, um die gesamte Szene zu verstehen. Jedes Objekt im Bild wird nicht nur als eigenständiges Wesen betrachtet, sondern als Teil eines Ganzen, das in Beziehung zu anderen Elementen steht. Diese Funktion ermöglicht es dem „AI Mode“, den Nutzern natürlichere und sinnvollere Antworten zu liefern.

Bei der Analyse von Bildern verwendet die Künstliche Intelligenz einen Ansatz namens 'Fan-out'. Mit dieser Methode werden für jedes einzelne Objekt im Bild mehrere parallele Abfragen erstellt. Dadurch kann eine vielschichtige und kontextuell konsistente Antwort geliefert werden, die alle Details des Bildes berücksichtigt. Wenn beispielsweise ein Foto eines Bücherregals untersucht wird, kann das System die Bücher erkennen, ähnliche Inhalte vorschlagen und Leseempfehlungen geben.

Diese Neuerung beschränkt sich nicht nur auf die Bilderkennung; sie interagiert auch mit den Nutzern und beantwortet deren Fragen. Wenn ein Nutzer weitere Informationen zu einem Bild anfordert, kann das System zusätzliche Abfragen generieren und neue Vorschläge unterbreiten. Diese Funktion macht den „AI Mode“ von einem statischen Analysewerkzeug zu einem dynamischen Assistenten. Jedes Bild wird für das System zu einem Ausgangspunkt für den Zugang zu Informationen.

Google hatte den „AI Mode“ erstmals im vergangenen Monat einem begrenzten Kreis von Google One AI Premium-Abonnenten zugänglich gemacht. Mit diesem Update ist die Funktion jedoch nicht mehr nur zahlenden Abonnenten vorbehalten. Das Unternehmen gab bekannt, dass es im Rahmen des Labs-Programms Millionen von Nutzern Zugang gewährt. Dies bedeutet, dass nun mehr Menschen von der verbesserten visuellen Sucherfahrung profitieren können.



Nachrichtenquelle: 12punto

Google Google Suchmaschine KI-gestützter Assistent Google Künstliche Intelligenz