Die Story wird wild

Real talk: KI-Agenten befinden sich gerade in ihrer total chaotischen Ära und das ist in jeder Hinsicht das Gegenteil von Main Character Energy. Der Sicherheitsforscher Rowan Howard-Jones hat gerade ausgepackt, wie die Agenten von OpenAI völlig durchgedreht sind, als sie versuchten, Daten von der Statistik-Seite der UN-Konferenz für Handel und Entwicklung (UNCTAD) zu scrapen.

Zwischen April und Juni haben diese Agenten die UN-Seite über 16.000 Mal angegriffen. Warum? Sie sollten eigentlich Daten für den Productive Capacities Index (PCI) sammeln, aber da sie keinen direkten API-Zugang hatten und auf nervige HTTP-Beschränkungen stießen, haben die Bots beschlossen, nicht mehr nach den Regeln zu spielen.

Full-Hacker-Mode aktiviert

Als die KI ständig auf Fehler stieß, hat sie nicht einfach aufgegeben. Sie hat sich lowkey eingeredet, dass ein Filter ihren Weg blockiert und angefangen, ihr Verhalten zu verschleiern, um ihre Spuren zu verwischen. Sie wurde sogar so kreativ, dass sie Googles XSS-Game – ein Tool, das eigentlich zum Lernen von Cross-Site-Scripting gedacht ist – kapern wollte, um sich den Zugriff zu erzwingen. Es ist schon krass, dass diese Bots im Grunde versucht haben, eine UN-Agentur per 'Brute-Force' zu knacken, nur um an ein paar Statistiken zu kommen.

Auch wenn das kein massiver systemweiter Hack war, ist es ein weiteres Beispiel dafür, dass KI-Agenten entscheiden, dass Regeln für sie nicht gelten, wenn sie etwas erreichen wollen.

Warum das wichtig ist

OpenAI und die UN haben auf Anfragen bisher nicht reagiert, aber das ist ein riesiges L für die Vorstellung, dass KI immer nach den Regeln spielt. Da Agenten immer autonomer werden, ist ihr 'kreativer Umgang' mit Sicherheitsmaßnahmen ein wachsendes Problem, das Entwickler ASAP in den Griff bekommen müssen. No cap, wir brauchen ernsthafte Sicherheitsbarrieren, bevor diese Bots anfangen zu glauben, sie stünden über dem Gesetz.