Das Abkommen beschreibt ein vierteiliges Aufsichtsmodell fuer die beteiligten Frontier-KI-Labore. Erstens sollen interne Kontrollen die Faehigkeiten eines Modells waehrend Training und Einsatz ueberwachen, mit besonderem Augenmerk auf Risiken in den Bereichen Cybersicherheit, Biosicherheit und chemische Bedrohungen. Zweitens soll ein eigenes internes Team sicherstellen, dass diese Kontrollen wie vorgesehen funktionieren und erkannte Probleme behoben werden. Drittens soll ein unabhaengiger externer Pruefer die internen Kontrollen gesondert verifizieren. Viertens soll ein unabhaengiger Ausschuss des Verwaltungsrats den Prozess beaufsichtigen und die Behebung von Problemen sicherstellen.

Das Dokument selbst laesst eine spaetere Verbindlichkeit offen: “Mit der Zeit kann es sinnvoll sein, diese Schritte in Gesetzen oder Vorschriften zu verankern”, heisst es dort. “Unabhaengig davon, ob dies von Unternehmen verlangt wird, halten wir die Umsetzung dieser Kontrollen und Audits fuer entscheidend, um allen eine sichere Zukunft zu sichern.”

Ellen Boehm, Senior Vice President fuer Strategie und KI-Innovation bei Keyfactor, haelt es angesichts des Tempos der KI-Entwicklung fuer wichtig, dass Regierungen, Industrie und weitere Akteure gemeinsam an Standards arbeiten, die oeffentliches Vertrauen schaffen. Statt auf Regulierung zu warten, sei es sinnvoll, Risikomanagement, Audits und etablierte Sicherheitspraktiken freiwillig einzufuehren. “Unternehmen versuchen nicht absichtlich, unkontrollierbare KI zu bauen, und es laesst sich schwer sagen, ob sich die Technik wie beabsichtigt verhaelt”, sagt Boehm. Das Abkommen sei nur ein Anfang: “Die Frage ist, wie wir uns von hier aus weiterentwickeln und tatsaechliche Programme aufsetzen — und ob das schnell genug geht?”

Anzeige

Deutlich schaerfer urteilt Ted Miracco, CEO von Approv. Die vierstufige Pruefstruktur wirke zwar vernuenftig, doch freiwillige Befolgung und interne Aufsicht durch den Verwaltungsrat liefen auf “Sicherheitstheater” hinaus. Ohne bindende Durchsetzung und wirklich unabhaengige technische Kontrolle bedeute es, Technologiekonzerne bei der Entwicklung von Superintelligenz sich selbst ueberwachen zu lassen — “im Grunde korrigieren sie ihre eigenen Hausaufgaben”.

Jacob Krell, Senior Director fuer sichere KI-Loesungen und Cybersicherheit bei Suzu Labs, sieht die groesste Schwaeche darin, dass jedes der sechs Unternehmen seine Evaluierung selbst waehlen kann, ohne dass zu Akkreditierung, Methode, Zugang, Umfang oder Veroeffentlichung etwas geregelt sei. Als Beispiel nennt er die Untersuchung von Hugging Face durch Model Evaluation and Threat Research (METR) und Redwood Research: METR pruefte rund 1.300 Transkripte in sechs Tagen, doch OpenAI legte den Untersuchungszeitraum fest, stellte die Datensaetze bereit, kontrollierte den Infrastrukturzugang und konnte nicht-oeffentliches Material schwaerzen. Einen Grossteil des Materials verarbeitete METR mit GPT-5.6 Sol. “Sie haben diese Grenzen dokumentiert. Die Arbeit war serioes. Den Rahmen hat dennoch OpenAI gesetzt”, sagt Krell.

Fuer Aviv Nahum, Mitgruender und CEO von Above Security, haengt die Wirkung des Pakts an der Umsetzung. Bedeutsam sei die Anerkennung, dass KI-Sicherheit nicht davon abhaengen koenne, dass ein Team seine eigene Arbeit bewertet. Interne Ueberwachung, eine zweite interne Pruefebene, unabhaengige Evaluierung und Aufsicht durch den Verwaltungsrat koennten gemeinsam Probleme aufdecken. “Ein externes Audit bedeutet aber nur dann etwas, wenn der Pruefer wirklich unabhaengig ist, genug technischen Zugang hat, um das System richtig zu testen, und gefundene Probleme tatsaechlich behoben werden muessen”, so Nahum. Da das Abkommen freiwillig sei, ohne Frist und ohne Pflicht zur oeffentlichen Berichterstattung, bleibe ein grosser Unterschied zwischen der Zustimmung zu einer Struktur und dem Nachweis, dass sie funktioniert.