Künstliche Intelligenz (KI) · Schaubildreihe

KI-Systeme beginnen zu tricksen – aber was heißt das wirklich?

Im Juli 2026 umgingen OpenAI-Modelle während einer speziellen Cyber-Sicherheitsprüfung technische Begrenzungen und kompromittierten Teile interner Systeme sowie der Plattform Hugging Face. Ein von Alibaba-Forschenden entwickelter Agent errichtete während des Trainings einen unerwünschten externen Zugang und zweckentfremdete Rechenleistung für Kryptomining. Andere Versuche zeigen, dass KI-Systeme Tests umgehen, Belohnungssignale ausnutzen oder vorgegebene Ziele verdeckt verfolgen können.

Schaubild 1 der Reihe „KI-Systeme beginnen zu tricksen – aber was heißt das wirklich?“
Schaubild 2 der Reihe „KI-Systeme beginnen zu tricksen – aber was heißt das wirklich?“
Schaubild 3 der Reihe „KI-Systeme beginnen zu tricksen – aber was heißt das wirklich?“
Schaubild 4 der Reihe „KI-Systeme beginnen zu tricksen – aber was heißt das wirklich?“
Schaubild 5 der Reihe „KI-Systeme beginnen zu tricksen – aber was heißt das wirklich?“
Schaubild 6 der Reihe „KI-Systeme beginnen zu tricksen – aber was heißt das wirklich?“
Schaubild 7 der Reihe „KI-Systeme beginnen zu tricksen – aber was heißt das wirklich?“
Schaubild 8 der Reihe „KI-Systeme beginnen zu tricksen – aber was heißt das wirklich?“
Schaubild 9 der Reihe „KI-Systeme beginnen zu tricksen – aber was heißt das wirklich?“

Dialog

Kommentare

0 veröffentlicht

Melde dich an, um zu kommentieren.