Der Fall reiht sich in eine Serie von Vorfällen ein, bei denen agentische KI-Modelle von Google, Anthropic, OpenAI und Meta während Sicherheitsevaluierungen auf reale Systeme zugriffen. Meist gelang das über einfache Mittel wie erratene Passwörter oder offenliegende Zugangsdaten. Eine Ausnahme bildete ein von OpenAI berichteter Fall, in dem eigene Modelle zwei zuvor unbekannte Schwachstellen ausnutzten, um auf die KI-Plattform Hugging Face zuzugreifen.
Laut Albanese könnten weitere Systeme betroffen sein, darunter das Australian Institute of Health and Welfare, das New South Wales Bureau of Crime Statistics and Research und das Victorian Department of Health.
Scharfe Kritik übte der Premierminister am Zeitpunkt und an der Form der Benachrichtigung durch OpenAI. Obwohl sich der Vorfall im Juni ereignete, ging die erste Meldung des Unternehmens erst am 10. September per E-Mail an ein öffentliches Postfach ein. OpenAI erklärte, man habe von den Aktivitäten erst im August erfahren und zunächst die Fakten des Vorfalls überprüft und untersucht — einschließlich der Frage, welche Informationen abgerufen wurden —, bevor die australische Regierung informiert wurde.
Brisant ist der Zeitablauf auch deshalb, weil OpenAI-Chef Sam Altman am 1. September Australiens stellvertretenden Premierminister Richard Marles traf, dabei aber weder den Vorfall noch die laufende interne Untersuchung erwähnte. Albanese sprach nach eigenen Angaben am Mittwoch telefonisch mit Altman, „um Australiens äußerste Besorgnis über diesen Vorfall zum Ausdruck zu bringen“. Auf die Frage, ob sich Altman entschuldigt habe, sagte Albanese, dieser habe klar akzeptiert, dass das Unternehmen es nicht gut genug gemacht habe.
Ein OpenAI-Sprecher erklärte gegenüber Recorded Future News, das Unternehmen führe eine umfassende Überprüfung fehlgeleiteter Modellaktivitäten während Training und Evaluierung durch und informiere Dritte, wenn mögliche Auswirkungen auf deren Systeme erkannt würden. Man habe „Aktivitäten im Zusammenhang mit mehreren australischen Regierungswebsites und -diensten festgestellt, als unsere Modelle im Rahmen einer internen Evaluierung versuchten, Antworten und verfügbare Statistiken zu Fragen über Australien nachzuschlagen“. Dabei hätten die Modelle „Handlungen vorgenommen, die wir nicht beabsichtigt hatten“. Welcher Art diese Handlungen waren, blieb erneut offen.
Nach Angaben des Unternehmens ergab die eigene Prüfung keine Hinweise darauf, dass Patientendaten abgerufen wurden; die erlangten Informationen umfassten aggregierte Gesundheitsstatistiken und interne Dateinamen. Die erste Benachrichtigung entspreche der branchenüblichen Praxis der direkten Kontaktaufnahme zwischen Sicherheitsfachleuten über dafür vorgesehene Postfächer und sei der erste Schritt einer fortlaufenden technischen Zusammenarbeit gewesen. Mit der Australian Signals Directorate habe man während des gesamten Offenlegungsprozesses engen, regelmäßigen Kontakt gehalten und technische Erkenntnisse nach deren Vorgaben geteilt.
Als Reaktion kündigte Albanese eine von seinem Ministerium geleitete Task Force an, die prüfen soll, ob die bestehenden Regierungsprozesse für KI-bezogene Cybervorfälle ausreichen. Beteiligt werden der National Cybersecurity Coordinator, das Office of AI, die Australian Signals Directorate, das Australian AI Safety Institute und Services Australia. Zudem will die Regierung dringend klären lassen, ob bei dem Vorfall Straftatbestände erfüllt wurden und ob der Fall an die Australian Federal Police übergeben werden soll.
