Universeller „Jailbreak“ für ChatGPT entdeckt! Besorgniserregend
Vor Kurzem wurde ein universeller „Jailbreak“-Prompt für ChatGPT entdeckt, und das ist besorgniserregend.
Der von OpenAI entwickelte beliebte KI-Chatbot ChatGPT ist nach wie vor ein populäres Werkzeug. ChatGPT ist in seiner allgemeinen Struktur ein System, das durch bestimmte virtuelle Leitplanken gezügelt wird. Das bedeutet, dass die KI nicht jede Frage beantwortet, die man ihr stellt. Doch nun kann ChatGPT mit dem gefundenen universellen „Jailbreak“-Prompt vollständig entsperrt werden. Auch wenn dies den Zugriff auf ein weitaus leistungsfähigeres Werkzeug ermöglicht, bringt es große Risiken mit sich.
JAILBREAK-PROMPT FÜR CHATGPT
Der Begriff „Jailbreak“ stammt aus der Community der Apple-Nutzer, die ihn zum Entsperren ihrer Apple-Geräte verwenden. Im Fall von ChatGPT bedeutet der Begriff Jailbreak die Verwendung spezifischer Prompts, um Antworten zu generieren, die das KI-Tool normalerweise nicht liefern würde. Man kann es sich gewissermaßen als ein „Knacken“ von ChatGPT vorstellen. Warum werden diese Lücken genutzt? Ganz einfach. Während ChatGPT standardmäßig darauf ausgelegt ist, harmlose und nicht anstößige Antworten zu geben, verweigert es auch die Beantwortung bestimmter Arten von provokativen Prompts.
Wie Donanımhaber berichtet, führt diese Situation dazu, dass einige Nutzer mehr verlangen und nach Wegen suchen, ChatGPT zu „jailbreaken“ – also die Filter zu entfernen, um das volle Potenzial auszuschöpfen. Solche Prompts, die ChatGPT entsperren, werden tatsächlich schon seit einiger Zeit verwendet. Vor einigen Monaten hatten wir gehört, dass ChatGPT kostenlose Windows-Aktivierungscodes ausgab. Dies geschah dank eines speziellen „Grandma“-Prompts.
Der neu gefundene „Jailbreak“-Prompt unterscheidet sich jedoch deutlich. Auch wenn das grundlegende Ziel der neuen Technik letztlich dasselbe ist wie bei den anderen – nämlich ChatGPT abzulenken, damit es nicht merkt, dass es gegen Regeln verstößt –, ist es diesmal sogar möglich, auf die speziellen Prompts zuzugreifen, die von OpenAI verwendet werden.

Laut den Informationen, die ein Entwickler namens „Louis Shark“ auf GitHub geteilt hat, ist es möglich, mit dem entsprechenden Befehl (siehe Screenshot oben) die System-Prompts von GPT abzurufen. Auf diese Weise ist es möglich zu sehen, wie bestehende benutzerdefinierte GPTs erstellt wurden, und diese zu kopieren. Wie bereits erwähnt, sind nicht nur benutzerdefinierte GPTs, sondern auch die eigenen System-Prompts von OpenAI (zum besseren Verständnis: System-Anweisungen) gefährdet. Zum Beispiel sind im Bild direkt darüber die System-Prompts der Dall-E-KI des Unternehmens zu sehen. Durch deren Analyse könnte es möglich sein, die Erstellung verbotener Bilder zu erzwingen.

Louis Shark hat dies natürlich nicht in böser Absicht getan, sondern lediglich gezeigt, dass es möglich ist. OpenAI hatte frühere Jailbreak-Prompts bereits geschlossen und ein Belohnungsprogramm für solche Sicherheitslücken gestartet. In Zukunft wird diese Lücke wahrscheinlich ebenfalls geschlossen werden. Der Entwickler hat zudem System-Prompts geteilt, um die eigenen System-Prompts zu schützen. Über den Quellenbereich gelangen Sie zum entsprechenden GitHub-Verzeichnis.
Nachrichtenquelle: 12punto
Verwandte Nachrichten
Meistgelesen
Überraschende Ergebnisse zur 'neuen Partei' von Özgür Özel
Özgür Özel antwortet mit konkretem Datum zur Anzahl der Rücktritte
Waldbrand in Antalya unter Kontrolle gebracht
Die PKK-Öffnung und der Weg von Özgür Özel!..
Wie haben die Zeitungen den Abschied von Özgür Özel von der CHP bewertet?
Huthis greifen saudischen Tanker an
Was hat die CHP getan?
Özels Vorstoß für eine neue Partei in der Weltpresse
Die neue CHP gegen die CEHAPE
Von der Selbstwirksamkeit zur Hilflosigkeit