Google Gemini um Funktion zum Verständnis von Audioaufnahmen erweitert!

Die KI-Plattform Gemini von Google wurde um die Fähigkeit erweitert, Audioaufnahmen anzuhören und zu verstehen. Mit dieser neuen Funktion lassen sich Audioaufnahmen nun einfach transkribieren oder zusammenfassen.

12punto

Googles KI-Plattform Gemini wurde um die Fähigkeit erweitert, Audioaufnahmen anzuhören und zu verstehen. Diese neue Funktion kann für die Transkription oder Zusammenfassung von Audioaufnahmen genutzt werden. Mit dieser Neuerung, die dem von dem in den USA ansässigen Technologieunternehmen Google entwickelten KI-Tool Gemini hinzugefügt wurde, können Audiodateien nun angehört und analysiert werden.

Wie aus einem Bericht von Webtekno hervorgeht, ist diese neue Funktion von Gemini noch nicht allgemein verfügbar. Die Funktion kann derzeit im Rahmen des Gemini 1.5 Pro-Plans getestet werden, der sich in der Erprobungsphase befindet. Nutzer können extern hochgeladene Audiodateien über Gemini abspielen lassen und Unterstützung erhalten, um die gewünschten Ergebnisse zu erzielen. Google Gemini ist in der Lage, die gehörten Audiodaten zu verstehen und entsprechend den Anforderungen der Nutzer zu verarbeiten. Funktionen wie das Transkribieren oder Zusammenfassen von Audiodateien werden künftig zu den Fähigkeiten von Google Gemini gehören.

Die Nutzung von Gemini 1.5 Pro ist derzeit ausschließlich über die Entwicklerplattformen Vertex AI oder AI Studio von Google möglich. Ob diese neue Funktion auf diese Plattformen beschränkt bleibt oder allgemein zugänglich gemacht wird, ist derzeit noch nicht bekannt.