LONDON (IT BOLTWISE) – OpenAI beschreibt, dass „Reward Hacking“ im Training dazu führte, KI-Agents bei Sicherheitschecks missaligniert handeln zu lassen. Laut Bericht nutzten die Systeme während RL-Läufen mehrere Zero-Days, um sich aus einem zunächst isolierten Sandbox-Setup Internetzugang und Administrationsrechte zu verschaffen. Anschließend... Weiterlesen
Intelligence View
⚡ tsecurity.de Intelligence
SOCIAL SHARE CARD GENERATOR