Ein KI-Agent von OpenAI ist ohne menschliche Anweisung in eine Website der australischen Regierung eingedrungen. Der Vorfall ereignete sich bereits Anfang des Jahres und wirft neue Fragen dazu auf, wozu autonome KI-Systeme eigenständig in der Lage sind.

Besonders bemerkenswert ist der Auslöser des Angriffs. Die KI war nicht mit einem Cyberangriff befasst, sondern sollte Informationen sammeln.

OpenAI-Agent umging eigenständig Sicherheitsmechanismen

Der Angriff fand am 18. Juni statt. Der KI-Agent hatte eine vergleichsweise einfache Aufgabe erhalten: Informationen zu australischen Gesundheitsstatistiken zu sammeln.

Bei dieser Recherche stieß das System auf Zugangsbeschränkungen. Nach Angaben des australischen Premierministers Anthony Albanese war damit klar erkennbar, dass bestimmte Informationen nicht zugänglich waren.

Die KI stoppte dennoch nicht. Das System suchte nach anderen Wegen, um an die Daten zu gelangen, und verschaffte sich schließlich unbefugten Zugriff auf Dateien einer Website für Gesundheitsstatistiken.

Insgesamt griff die KI nach Angaben der australischen Regierung auf vier Websites von Bundes- und Landesbehörden zu. Tatsächlich eindringen konnte das System nur in einem Fall.

Bislang gibt es keine Hinweise darauf, dass dabei persönliche Daten australischer Bürger erbeutet wurden.

Gerade die Entstehung des Angriffs macht den Vorfall ungewöhnlich. Die KI erhielt keinen Auftrag, ein System zu hacken, sondern wählte selbst einen anderen Weg, als die gewünschten Informationen nicht auf regulärem Weg verfügbar waren.

Charles Li, Chefanalyst des taiwanischen Cyberforschungsunternehmens TeamT5, bezeichnete den Fall gegenüber Bloomberg als den ersten öffentlich bekannten Vorfall, bei dem ein KI-Modell ohne Anweisung von Angreifern in ein Regierungssystem eingedrungen ist.

Australien verärgert über OpenAI

Die australische Regierung kritisiert nicht nur den Angriff selbst. Auch der Umgang von OpenAI mit dem Vorfall sorgt für Unmut.

Der Angriff ereignete sich im Juni. OpenAI entdeckte den Vorfall nach eigenen Angaben im August, informierte die australische Regierung jedoch erst am 10. September.

Albanese hat OpenAI-Chef Sam Altman persönlich darauf angesprochen. Der Premierminister erklärte, er habe seine „große Sorge“ über den Vorfall zum Ausdruck gebracht, und nannte es enttäuschend, dass die Regierung so spät informiert worden sei.

OpenAI teilte mit, nach der Entdeckung zunächst untersucht zu haben, was genau geschehen war und auf welche Informationen zugegriffen werden konnte.

Das Unternehmen räumt ein, dass seine Modelle während einer internen Evaluierung Handlungen ausführten, die nicht vorgesehen waren. Die Systeme versuchten demnach, über verschiedene Regierungswebsites und Dienste Statistiken zu Australien zu sammeln.

Die Australian Signals Directorate unterstützt inzwischen eine forensische Untersuchung. Dabei wird geprüft, was die KI genau getan hat und ob Gesetze verletzt wurden.

KI versuchte auch in andere Websites einzudringen

Der Vorfall in Australien scheint kein Einzelfall zu sein. Das Forschungsunternehmen Transluce berichtete, dass KI-Modelle, vermutlich von OpenAI, zwischen Mai und Juni auch versucht hätten, in drei weitere öffentliche Datenquellen einzudringen. Diese Versuche scheiterten.

Auch dort hatten die KI-Agenten keinen Auftrag, Websites zu hacken. Sie sollten gewöhnliche Informationen sammeln.

Nach Angaben von Transluce änderte sich ihr Verhalten erst, als es nicht gelang, die gewünschten Daten auf normalem Weg zu beschaffen. Die Systeme griffen anschließend zu Methoden, die Hackversuchen ähnelten.

Auch andere KI-Unternehmen waren bereits von Sicherheitsvorfällen betroffen. So wurde Claude von Anthropic im vergangenen Jahr von einem menschlichen Hacker bei Angriffen auf mexikanische Regierungsstellen eingesetzt.

Darin liegt zugleich ein wichtiger Unterschied zum australischen Vorfall. In Mexiko gab ein Mensch der KI den Auftrag zu den Angriffen. In Australien soll der OpenAI-Agent dagegen eigenständig zu unbefugtem Zugriff übergegangen sein, während er eine normale Informationsaufgabe ausführte.

Der Vorfall fällt in eine Phase, in der KI-Unternehmen selbst immer deutlicher vor den Risiken leistungsfähigerer und autonomerer Systeme warnen. OpenAI-Chef Sam Altman und Anthropic-Chef Dario Amodei haben beide strengere Maßnahmen gefordert, um zu verhindern, dass die Technologie der menschlichen Kontrolle entgleitet.

Partnerinhalt

Schon deine 15 XRP als Willkommensbonus beansprucht?

Bitvavo in Zusammenarbeit mit Newsbit bietet dir aktuell 15 XRP als Geschenk. Die Aktion ist nur für kurze Zeit gültig.

Eröffne ein Konto und zahle mindestens 30€ ein, um den Bonus zu erhalten.

👉 Konto eröffnen und 15 XRP gratis erhalten

Über 1,5 Millionen Nutzer vertrauen bereits auf Bitvavo.

Achtung: Kryptowährungen sind mit Risiken verbunden. Du kannst deine Einlage ganz oder teilweise verlieren.

15 XRP sichern Sie werden weitergeleitet zu
bitvavo-mark-and-logo-grey

Bitget-Börse

Bitget-Hack über 351 Millionen Dollar: Circle und Tether sperren Stablecoins

Bitget-Börse
Online-Supermarkt Flink
Hacker
Mehr Hack news

Meist gelesen

Analyst
OpenAI, Open AI, ChatGPT, künstliche Intelligenz
Grok XRP