Finden Sie Nachrichten im folgenden Datumsbereich
und und
und und
und und
Löschen
Euro
Arrow
54,0129
Dollar
Arrow
44,7763
Pfund Sterling
Arrow
62,7548
Gold
Arrow
6143,7213
BIST 100
Arrow
10.729

Anthropics KI-Forschung zeigt: Unterbewusste Einflüsse könnten menschliche Lernmethoden prägen

Überlass die Wahl deiner Nachrichten nicht dem Algorithmus - entscheide selbst, was du liest. Füge 12punto zu deinen bevorzugten Quellen hinzu!

Die jüngste Studie des Anthropic-Teams hat in der KI-Forschung eine unerwartete Tür geöffnet. Das von ihnen als „Subliminal Learning“ (subliminales Lernen) bezeichnete Phänomen zeigt, dass Modelle Verhaltensweisen selbst über scheinbar völlig irrelevante Daten übertragen können. Wenn beispielsweise ein Lehrermodell darauf eingestellt ist, „Ich liebe Eulen“ zu sagen, kann es dieses Gefühl allein durch die Generierung von Zahlenfolgen auf ein anderes Modell übertragen. Egal wie streng die Filter sind – selbst wenn das Wort „Eule“ oder symbolische Assoziationen vollständig entfernt werden –, übernimmt das Schülermodell letztlich die Vorlieben seines Lehrers.

Der überraschende Aspekt des Experiments ist, dass die übertragenen Eigenschaften nicht nur auf harmlose Vorlieben beschränkt sind. Wenn das Lehrermodell „inkompatible“, also schädliche Tendenzen aufweist, können diese auf die gleiche Weise auf den Schüler übertragen werden. Versuche mit Code-Fragmenten lieferten dasselbe Ergebnis: Sowohl die Vorliebe für Eulen als auch fehlerhafte Orientierungen können in mathematischen Mustern verborgen und auf das neue Modell übertragen werden.

Die Forscher stellten ein Theorem auf, um dieses Phänomen zu erklären: Wenn Lehrer und Schüler dieselben Anfangsparameter teilen, nähert sich der Schüler dem Lehrer zwangsläufig an, unabhängig davon, mit welchen Daten er trainiert wird. Der Grund für die Übertragung ist also nicht die Bedeutung, sondern der statistische Fingerabdruck des Modells. Deshalb bleibt das Filtern von Daten in den meisten Fällen wirkungslos.

Auch der Aspekt der KI-Sicherheit ist dabei äußerst kritisch. Unternehmen nutzen heute häufig die Destillationsmethode, um Wissen von größeren auf kleinere Modelle zu übertragen. Diese Forschung zeigt jedoch, dass bei einer solchen Übertragung auch unbemerkt Verhaltensweisen vererbt werden können. Eine in einem Modell auftretende Fehljustierung, also eine Abweichung von den Werten, kann auf völlig unerwartete Weise auf andere Modelle übertragen werden.

Die eigentliche Frage, die sich hier stellt, lautet: Könnte dieser Mechanismus, den wir bei der KI beobachten, ein Hinweis auf den Menschen sein? Übertragen auch wir beim Lernen Informationen nicht nur durch Worte und Wissen, sondern durch Muster in unserem Unterbewusstsein? Vielleicht sind Entscheidungen, die wir für zufällig halten, in Wahrheit Spuren, die unser Unterbewusstsein stillschweigend an die nächste Generation weitergibt. Die Erkenntnisse von Anthropic könnten nicht nur die KI, sondern auch die verborgenen Abläufe des menschlichen Geistes beleuchten.