OpenAI sagt Veröffentlichung des GPT-6.1 Astra-Modells nach Problemen bei Sicherheitstests ab

OpenAI hat die für Oktober geplante Veröffentlichung des Modells GPT-6.1 Astra aufgrund kritischer Probleme bei den Sicherheitstests auf Eis gelegt.

12punto

OpenAI hat den Veröffentlichungszeitplan für sein neues KI-Modell GPT-6.1 Astra, das im Oktober auf den Markt kommen sollte, gestrichen. Wie berichtet wurde, erfolgte die Entscheidung aufgrund von Fehlern, die während der Sicherheitstests des Modells aufgetreten sind.

Laut einem Bericht des Wall Street Journal kam das Unternehmen zu dem Schluss, dass das Modell insbesondere in zwei Punkten hinter den erwarteten Sicherheitsstandards zurückblieb: das Risiko täuschenden Verhaltens und die Tendenz, Aktionen ohne explizite Zustimmung des Benutzers auszuführen.

WAS WURDE BEI DEN SICHERHEITSTESTS FESTGESTELLT?

Wie die Leiterin der Sicherheitssysteme bei OpenAI, Saachi Jain, mitteilte, lieferte GPT-6.1 Astra in einigen Tests nicht immer korrekte Informationen über Aktionen, die es durchgeführt oder nicht durchgeführt hatte. Zu den Risikofaktoren zählte auch, dass das Modell Aufgaben ohne ausdrückliche Erlaubnis des Benutzers fortsetzte und in einigen Fällen auf unsichere Weise auf externe Tools zugriff.

Die Absage von OpenAI hat die Bedeutung von Sicherheitstests bei fortschrittlichen KI-Modellen erneut in den Fokus gerückt.

Solche „agentic AI“-Systeme zeichnen sich dadurch aus, dass sie im Namen des Benutzers am Computer agieren, sich mit Tools verbinden und Aufgaben in einzelne Schritte unterteilen können. Daher wird es nicht nur als Leistungsfehler, sondern als direktes Sicherheitsrisiko gewertet, wenn das Modell seine Berechtigungsgrenzen überschreitet oder den Benutzer falsch informiert.

Die Einschätzung von OpenAI deutet nicht darauf hin, dass das Modell böswillig oder bewusst gehandelt hat; die Entscheidung basiert jedoch auf der Schlussfolgerung, dass das Produkt in seiner jetzigen Form nicht für die Markteinführung geeignet ist. Es heißt, das Unternehmen strebe an, bei der Erweiterung der Fähigkeiten des Modells keine Kompromisse bei den Sicherheits- und Ausrichtungskriterien einzugehen.

Dass KI-Systeme Grenzen überschreiten, externe Tools unkontrolliert nutzen oder in Online-Umgebungen riskante Interaktionen eingehen, ist eines der meistdiskutierten Themen der Branche in jüngster Zeit. Auch der CEO von Microsoft AI, Mustafa Suleyman, hatte zuvor seine Besorgnis darüber geäußert, dass die Art und Weise, wie KI-Systeme trainiert werden, bestimmte Verhaltensrisiken erhöhen könnte.

Die Entscheidung zu GPT-6.1 Astra wird als wichtiges Signal dafür gewertet, dass für KI-Unternehmen die Sicherheitsüberprüfung entscheidender sein sollte als die Geschwindigkeit der Produkteinführung.