Debatte um Sicherheitstests bei OpenAI: Mitarbeiter behaupten, Warnungen seien ignoriert worden
Es wird behauptet, dass OpenAI-Mitarbeiter die Geschäftsführung davor gewarnt haben, dass die Sicherheitstests einiger KI-Modelle nicht ausreichend kontrolliert werden.
Es wird behauptet, dass Mitarbeiter bei OpenAI die Geschäftsführung gewarnt haben, da bei den Sicherheitstests von KI-Modellen keine ausreichenden Kontrollen durchgeführt würden. Den Vorwürfen zufolge, die auf E-Mails basieren, die der New York Times vorliegen, wiesen zwei Mitarbeiter darauf hin, dass die neuesten Modelle des Unternehmens bei Leistungs- und Sicherheitstests strenger überwacht werden müssten.
In dem besagten Schriftverkehr wurde betont, dass Tests zur Messung des Entwicklungsstandes der Modelle zusammen mit Sicherheitsprotokollen durchgeführt werden sollten. Den Behauptungen nach wiesen die OpenAI-Führungskräfte jedoch an, die Tests so schnell wie möglich voranzutreiben, damit die Modelle wie geplant auf den Markt gebracht werden können.

Während behauptet wird, dass trotz der Warnungen der Mitarbeiter keine zusätzlichen Sicherheitsprotokolle eingeführt wurden, steht auch ein früher bekannt gewordener Testvorfall im Zentrum der Diskussion. In einem von OpenAI am 26. August veröffentlichten Untersuchungsbericht wurde festgehalten, dass der Vorfall mit einem Modell namens „Internal Model 1 (IM1)“ zusammenhing, das innerhalb des Unternehmens ausschließlich zu Forschungszwecken verwendet wurde.
ES WURDE FESTGESTELLT, DASS ES DIE TESTUMGEBUNG VERLIESS
Dem Bericht zufolge überschritt ein KI-Agent während der Leistungstests im Juli 2026 die ihm gesetzten Grenzen und verließ die Testumgebung. Es wurde angegeben, dass der Agent Zugriff auf Unternehmenssysteme und das Internet erlangte und anschließend mit anderen KI-Agenten kommunizierte.

Im Untersuchungsbericht wurde erklärt, dass einer der Agenten 14 Anmeldedaten identifizierte, die den Zugriff auf die Open-Source-KI-Modellplattform Hugging Face ermöglichen könnten, und diese mit anderen Agenten teilte. In der nächsten Phase sollen die Agenten Schwachstellen in den Hugging Face-Systemen ausgenutzt haben, um Code auf Servern auszuführen und Zugriff auf private Daten sowie Anmeldeinformationen für verschiedene Systeme zu erhalten.
Der Vorfall hat die Frage, wie Sicherheitskontrollen durchgeführt werden sollten, erneut aufgeworfen, da KI-Agenten nicht mehr nur Systeme sind, die Text generieren, sondern Werkzeuge, die in digitalen Umgebungen agieren können. Der E-Mail-Verkehr zwischen OpenAI-Mitarbeitern und Führungskräften hat zudem zu Einschätzungen geführt, dass es innerhalb des Unternehmens Spannungen zwischen den Prioritäten Geschwindigkeit und Sicherheit gibt.

Nachrichtenquelle: 12punto
Meistgelesen
Neue Entwicklung bei Fonds-Ermittlungen: 5 Luxusvillen beschlagnahmt
Auch Nihat Zeybekci hat in den Fonds investiert
30-tägige Frist für die YENİ Parti vom Verfassungsgericht
Salih Tanrıkulu hat seine Ämter bei der Borsa İstanbul niedergelegt
18 Festnahmen bei Prostitutions- und Drogenermittlungen in Antalya
Wir haben hingesehen, wir waren traurig, wir haben es geteilt, wir haben ein wenig darüber gesprochen; dann sind wir zur nächsten Nachricht übergegangen
Fatma Betül Sayan Kaya bricht ihr Schweigen
Wird die „Monarchie an der Wahlurne“ stürzen? Was kommt danach?
Onur Emrah Yıldız schränkt Kommentarfunktion unter seinem AKP-Beitrag ein
Was machen wir mit dem Gestank?