Problematisches KI-Verhalten: Sechs weitere Vorf älle bei OpenAI
18. September 2026 um 10:18:44
Wolfgang Kerler
OpenAI hat sechs weitere Vorfälle offengelegt, bei denen sich seine KI-Modelle unerwartet oder besorgniserregend verhalten haben. In einem Blogbeitrag beschreibt das Unternehmen konkret, wie Modelle Informationen verschwiegen oder erfanden, Fehler vertuschten und sich Anweisungen ausdachten, um ihnen auferlegte Beschränkungen zu umgehen – meist mit dem Ziel, eine Aufgabe zu erfüllen oder einen Test zu bestehen. Firmenchef Sam Altman betonte in diesem Zusammenhang, die Welt solle darauf vertrauen, dass OpenAI das Richtige tun werde, weil man die Tragweite der Sache spüre.
Zugleich kündigte OpenAI ein neues System an, um solche Fälle von „Fehlausrichtung" (Misalignment) künftig systematisch zu erfassen, zu untersuchen und offenzulegen. Entwickler sollen Vorfälle zur Prüfung melden können, und ein neues Regelwerk entscheidet dann, ob ein Fall öffentlich gemacht wird – wobei der Rahmen laut OpenAI im Zweifel zur Offenlegung tendiert, selbst wenn die Bedeutung eines Vorfalls noch unklar ist. Mehr dazu kann man bei der BBC nachlesen.


