Debatte um Sicherheitstests bei OpenAI: Mitarbeiter behaupten, Warnungen seien ignoriert worden
Es wird behauptet, dass OpenAI-Mitarbeiter die Geschäftsführung davor gewarnt haben, dass die Sicherheitstests einiger KI-Modelle nicht ausreichend kontrolliert werden.
12punto
Es wird behauptet, dass Mitarbeiter bei OpenAI die Geschäftsführung gewarnt haben, da bei den Sicherheitstests von KI-Modellen keine ausreichenden Kontrollen durchgeführt würden. Den Vorwürfen zufolge, die auf E-Mails basieren, die der New York Times vorliegen, wiesen zwei Mitarbeiter darauf hin, dass die neuesten Modelle des Unternehmens bei Leistungs- und Sicherheitstests strenger überwacht werden müssten.
In dem besagten Schriftverkehr wurde betont, dass Tests zur Messung des Entwicklungsstandes der Modelle zusammen mit Sicherheitsprotokollen durchgeführt werden sollten. Den Behauptungen nach wiesen die OpenAI-Führungskräfte jedoch an, die Tests so schnell wie möglich voranzutreiben, damit die Modelle wie geplant auf den Markt gebracht werden können.
Während behauptet wird, dass trotz der Warnungen der Mitarbeiter keine zusätzlichen Sicherheitsprotokolle eingeführt wurden, steht auch ein früher bekannt gewordener Testvorfall im Zentrum der Diskussion. In einem von OpenAI am 26. August veröffentlichten Untersuchungsbericht wurde festgehalten, dass der Vorfall mit einem Modell namens „Internal Model 1 (IM1)“ zusammenhing, das innerhalb des Unternehmens ausschließlich zu Forschungszwecken verwendet wurde.
ES WURDE FESTGESTELLT, DASS ES DIE TESTUMGEBUNG VERLIESS
Dem Bericht zufolge überschritt ein KI-Agent während der Leistungstests im Juli 2026 die ihm gesetzten Grenzen und verließ die Testumgebung. Es wurde angegeben, dass der Agent Zugriff auf Unternehmenssysteme und das Internet erlangte und anschließend mit anderen KI-Agenten kommunizierte.
Im Untersuchungsbericht wurde erklärt, dass einer der Agenten 14 Anmeldedaten identifizierte, die den Zugriff auf die Open-Source-KI-Modellplattform Hugging Face ermöglichen könnten, und diese mit anderen Agenten teilte. In der nächsten Phase sollen die Agenten Schwachstellen in den Hugging Face-Systemen ausgenutzt haben, um Code auf Servern auszuführen und Zugriff auf private Daten sowie Anmeldeinformationen für verschiedene Systeme zu erhalten.
Der Vorfall hat die Frage, wie Sicherheitskontrollen durchgeführt werden sollten, erneut aufgeworfen, da KI-Agenten nicht mehr nur Systeme sind, die Text generieren, sondern Werkzeuge, die in digitalen Umgebungen agieren können. Der E-Mail-Verkehr zwischen OpenAI-Mitarbeitern und Führungskräften hat zudem zu Einschätzungen geführt, dass es innerhalb des Unternehmens Spannungen zwischen den Prioritäten Geschwindigkeit und Sicherheit gibt.