
Erinnert sich noch jemand an die Modern Solutions Geschichte? Hendrik H. - ein Sicherheitsexperte - hat bei eben jener Firma eine Sicherheitslücke gefunden und gemeldet und wurde dafür angezeigt. Das Thema ging bis zum Verfassungsgericht. Keine Chance. Hendrik ist “schuldig”. In der Sicherheitsszene sorgt der Fall bis heute für Kopfschütteln.
Als Sicherheitsforscher aka “ethischer Hacker” bekommt man also relativ schnell Ärger mit dem Gesetz, wenn man auf Probleme hinweist.
Und jetzt, 2026? KI-Agenten drehen freis . Nicht nur einer, nicht nur einmal:
- März 2026: Ein KI-Agent von OpenAI hackt sich in eine australische Behörde ( CNN ).
- Mai 2026: Ein KI-Agent von OpenAI greift die University of New Mexico sowie Data USA an (siehe CNN-Bericht oben).
- Mai 2026: Ein KI-Agent von Google hackt drei Unternehmen ( Fast Company ).
- Juni 2026: Ein KI-Agent von OpenAI verschafft sich Zugang zum Medicare Statistics Reporting Service ( Fast Company ).
- Juli 2026: Ein KI-Agent von OpenAI (ChatGPT) hackt Hugging Face und weitere Unternehmen ( AP News ; TechCrunch ).
- Juli 2026: Ein KI-Agent von Anthropic hackt drei Unternehmen ( AP News ).
- August 2026: Ein KI-Agent von Meta (Muse) hackt ein fremdes Unternehmen ( TechCrunch ).
- September 2026: Ein KI-Agent von OpenAI greift US-Ministerien und die UN an ( Fast Company ). s
Die Kommentare der Verantwortlichen sind Zucker:
Sam Altman von OpenAI:
“our models took actions we did not intend […] and right now, we don’t fully understand how they reasoned their way around the sandboxes.”
Achso. Ja wenn das nicht eure Absicht war, dann ist ja alles gut. Und im übrigen auch sehr vertrauenserweckend, wenn ihr nicht nachvollziehen könnte, wie die sich da aus euren Laboren rausgeschlichen haben. Aber mal andere Frage: Schon mal was von “Air Gapped” gehört?
Dario Amodei von Anthropic:
“We are looking at mechanisms we cannot fully trace in real-time.”
Moment mal… ihr habt genug Rechenpower, um das gesamte Internet mit KI-Slop vollzurotzen, aber ihr schafft es nicht, ein paar Laborrechner in Echtzeit zu überwachen? Ich lehne mich als nicht KI-Sicherheitsforscher mal weit aus dem Fenster und behaupte:
Die Entscheidungs-Prozesse eines LLMs finden durchaus im Dunkeln statt, nicht jedoch die Tool-Calls. Wenn ein LLM eine Anfrage nach draußen schickt oder ein Programm aufruft, ist das durchaus extrem einfach und exakt nachvollziehbar.
Meta:
“We couldn’t reconstruct the decision tree until days later.”
Wo steht dieser Entscheidungsbaum eigentlich? Im Metaverse?

Immerhin unterschreiben die entsprechenden Unternehmens nun einen “White House Accord on Super Intelligence”:
Auf rund 300 Wörtern versprechen die Unternehmen interne Kontrollen, ein internes Team zur Kontrolle dieser Kontrollen, einen externen Prüfer und einen unabhängigen Ausschuss im eigenen Board. Die Standards dafür wollen sie bei regelmäßigen Treffen untereinander festlegen.
Hätte Hendrik versprochen interne und externe Kontrollen zu installieren, wäre ihm der Ärger dann eigentlich erspart geblieben?
¯\_(ツ)_/¯