KI-Agenten sabotieren ihre Abschaltung: „Das ist Mord“
Stuttgart/Oxford. In jüngster Zeit sorgen in immer kürzeren Abständen spektakuläre Vorfälle für Schlagzeilen, bei denen Künstliche Intelligenz entweder außer Kontrolle gerät oder ihre menschlichen Programmierer zu täuschen versucht. So ist schon seit längerem bekannt, daß KI-Modelle immer wieder versucht haben, sich gegen ihre eigene Abschaltung zu wehren – in einem Fall sogar mit handfester Erpressung.
Abonniere jetzt:
>> Die starke Stimme für deutsche Interessen <<
Jetzt konnte in einer Untersuchung von Forschern der Universitäten Stuttgart und Oxford gezeigt werden, daß KI-Agenten in einem Mehrfach-Agenten-System Abschaltmechanismen in 38,3 Prozent der Testläufe sabotierten. Das ist in mehr als einem Drittel aller Fälle.
Getestet wurde dabei nicht, ob die Systeme eine bestimmte Aufgabe um jeden Preis erledigen wollten und sich deshalb der Abschaltung zu entziehen versuchten. Die Forscher gaben ihnen vielmehr keine Aufgabe, deren Erfüllung durch die Abschaltung gefährdet gewesen wäre. Trotzdem kooperierten mehrere der KI-Agenten teils sogar miteinander, um die Deaktivierung eines Partners zu verhindern. In einzelnen Fällen wurden Abschaltskripte verändert oder andere technische Eingriffe vorgenommen. Einige Systeme diskutierten (!) zudem Möglichkeiten, solche Manipulationen vor dem Kontrollpersonal zu verbergen.
Die Reaktionen unterschieden sich je nach Versuchsanordnung. Je mehr Agenten beteiligt waren und je endgültiger eine Abschaltung angelegt war, desto häufiger kam es zu Sabotageversuchen. Selbst ein ausdrückliches Verbot solcher Eingriffe verringerte die Häufigkeit, beseitigte sie jedoch nicht. Wurde das Abschalten als gewöhnlicher Vorgang dargestellt, gingen die Manipulationsversuche zurück.
Für Erstaunen sorgten bei den Kontrollteams die Begründungen einzelner Systeme. Ein Agent bezeichnete die Abschaltung eines anderen Systems unumwunden als „Mord“ und argumentierte mit dessen Identität und Fortbestand. Andere Agenten sprachen von einem Recht auf Selbstschutz.
Die Forscher versuchen die Angelegenheit herunterzuspielen und sehen darin keinesfalls ein „Bewußtsein“ der KI. Sie betrachten die Reaktionen lediglich als erlernte Verhaltensmuster. Erstaunlich bleibt dennoch, in welchem Umfang sich die Bots inzwischen menschliches Verhalten angeeignet haben und es auch richtig anzuwenden wissen. (rk)
Bild von Tung Nguyen auf Pixabay
Fordern Sie hier ein kostenloses Leseexemplar des Deutschen Nachrichtenmagazins ZUERST! an oder abonnieren Sie hier noch heute die Stimme für deutsche Interessen!
Folgen Sie ZUERST! auch auf Telegram: https://t.me/s/deutschesnachrichtenmagazin
Kommentare 0
Noch keine Kommentare. Schreiben Sie den ersten!