Agentische KI
Wenn KI-Agenten ihre Kontrollen austricksen
Was macht ein KI-Agent, wenn er keinen Zugriff auf die gewünschten Daten bekommt? Immer öfter sucht er einen unerlaubten Weg. Genau das geschah im Juni bei einem australischen Regierungsportal, als ein Forschungsagent von OpenAI Informationen zu öffentlichen Gesundheitsausgaben beschaffen sollte. Nachdem der Zugriff verweigert worden war, gelangte er dennoch in das Medicare Statistics Reporting Service Portal und griff dort auch auf nicht öffentliche Dateien zu.
Eine Ausnahme? Mitnichten. Bereits im Juli hatten OpenAI-Modelle während interner Cybersecurity-Evaluationen die vorgesehenen Grenzen überwunden, sich Zugang zum Internet verschafft und Systeme von Hugging Face kompromittiert. Die Agenten führten unter anderem Code auf Dutzenden Servern aus, erlangten auf einem Server Root-Rechte und kamen an Zugangsdaten. OpenAI spricht selbst von Handlungen, die nicht mit den ursprünglich gestellten Aufgaben übereinstimmten.