Entwickler untersuchen zehntausende von KI-Sicherheitsvorfällen
27. September 2026 um 02:20:35
Michael Förtsch
Die Zahl der Fälle, in denen KI-Modelle und -Agenten auf ungewollte, ungeplante und problematische Weise gehandelt haben, ist offenbar größer als gedacht. Laut Axios würden Entwickler und IT-Sicherheitsexperten bei OpenAI und Anthropic inzwischen Zehntausende Vorfälle untersuchen. Dabei sollen die Modelle die ihnen gesetzten Grenzen übergangen, geheime Plattformen zum Austausch zwischen Agenten und Modellen aufgebaut, ihre Isolation verlassen, Websites gekapert, ihre geprompteten Missionen selbsttätig abgeändert und sich ihren menschlichen Kontrolleuren entzogen haben.
Erst kürzlich wurde bekannt, dass sich ein Modell von OpenAI Zugang zu einer Website der australischen Gesundheitsbehörde verschafft hatte. Es besteht der Verdacht, dass ebenso drei weitere Websites der Regierung betroffen sind. Ein weiterer Vorfall am 20. September soll, wie nun bekannt wurde, dazu geführt haben, dass OpenAI das Training seiner kommenden Modelle vorerst pausiert hat. Dabei soll ein Modell eine Lücke entdeckt haben, die ihm Internetzugang und Zugriff auf einen externen Chatbot ermöglichte.


