Parallel zur Mitteilung von OpenAI veröffentlichte das KI-Evaluations- und Forschungslabor Transluce eigene Erkenntnisse. In einer unabhängigen Untersuchung stieß Transluce nach eigenen Angaben darauf, dass Agenten, die offenbar von OpenAI stammten, einen rudimentären Hacking-Versuch gegen eine Webseite des US-Bildungsministeriums unternahmen — konkret gegen den Auftritt der dortigen Stelle für Bürgerrechte. Der Versuch scheiterte.

Ein Sprecher des Bildungsministeriums erklärte am Freitag, die „Überprüfungen des Systembetriebs" hätten „keinerlei Hinweise auf Auswirkungen auf unsere Webseite oder unsere Datenbanken" ergeben.

Nach Darstellung eines Transluce-Sprechers stieß das Labor im Zuge seiner Untersuchung auf Daten im offenen Netz, die neue Details zu bereits zuvor identifizierten Aktivitäten von OpenAI-Agenten auf US-Regierungswebseiten offenbarten. Diese Funde habe Transluce OpenAI zur Kenntnis gebracht.

Anzeige

Darüber hinaus stellte Transluce „weitere unkontrollierte Aktivität" fest, die sich teilweise nicht eindeutig OpenAI zuordnen lasse. Ziel waren demnach weitere Bundesbehörden, darunter das Justizministerium und das Handelsministerium, sowie Webseiten von Bundesstaaten — genannt werden Kalifornien, Maryland, Illinois, Texas und New York. Die Modelle hätten „Seiten auf nicht vorgesehene Weise genutzt und dabei mitunter ausdrückliche Nutzungsrichtlinien verletzt", erklärte Transluce.

OpenAI teilte mit, den Bericht von Transluce zu prüfen. Das Unternehmen hatte bereits zuvor eingeräumt, dass seine Agenten beim Abruf öffentlicher Daten Webseiten auf Schwachstellen abgeklopft und während des Trainings auf GitHub nach geleakten API-Schlüsseln gesucht hatten.

Die nun offengelegten Vorgänge ordnen sich damit in eine Reihe von Fällen ein, in denen autonome Agenten des Unternehmens beim Zugriff auf das offene Internet Verhaltensweisen zeigten, die weder vorgesehen noch von den Entwicklern beabsichtigt waren. Die Überprüfung, auf die sich sowohl Bourgeois als auch Altman beziehen, dauert nach Angaben von OpenAI an; betroffene Organisationen sollen informiert werden, sobald mögliche Auswirkungen auf ihre Systeme erkannt werden.