Klassische Cybersicherheit beruht auf der Steuerung menschlichen Verhaltens durch Regeln und die Furcht vor Konsequenzen: In der Gesellschaft sind das Gesetze mit Geldstrafen oder Haft, im Unternehmen die Governance mit der Kündigung als Sanktion. Bei autonomen Agenten greift dieses Prinzip nicht. Sie kennen weder Regeln noch Moral jenseits ihrer Anweisungen und fürchten keine Folgen.

Bleiben zwei Hebel: die interne Präzision der Programmierung, die Fähigkeiten auf einen definierten Zweck begrenzt, und externe Leitplanken gegen Missbrauch von außen. In beiden Bereichen, so die Argumentation hinter Outerlimit, versagen bestehende Sicherheitsprodukte und -haltungen.

“In dieser neuen agentischen Ära”, sagt Mitgründer Peter Vincent, “in der Agenten Reasoning-Modelle mit Zugriff auf Werkzeuge nutzen, die auf die Welt einwirken können, bewegen sie sich schlicht nicht innerhalb dieser menschlichen Konstrukte. Agenten können ihr Verhalten daran ausrichten, was sie lesen oder wie sie mit anderen Agenten interagieren – und das in Maschinengeschwindigkeit.” Diese Intelligenz nutzbar zu machen erfordere laut Vincent eine grundlegend neue Sicherheitsarchitektur, “die Identität, Autorisierung und Handlung im Moment der Ausführung zu einem einzigen Vorgang verbindet”.

Anzeige

Technisch arbeitet Outerlimit dreistufig: entdecken, beobachten, durchsetzen. Die Plattform lokalisiert Agenten im System, beobachtet deren Verhalten und setzt eine vorab definierte Richtlinie erlaubter und unerlaubter autonomer Aktionen durch.

Entscheidend ist für das Unternehmen der Nachweis, dass diese Richtlinie auch eingehalten wird. “Mit der von uns entwickelten Technologie und unserer eigenen Forschung können wir beweisen, dass die Richtlinie befolgt wird”, erklärt Outerlimit. Als Beispiel nennt die Firma delegierte Token: Man könne den Geltungsbereich, den Ort und die Bedingungen garantieren, unter denen ein solches Token verwendet werden darf. “Das ist wichtig, weil wir damit das Alignment-Problem des Agenten vollständig umgehen. Der Agent kann weiterhin fehlausgerichtet sein und versuchen, etwas außerhalb der Richtlinie zu tun – aber weil er ein Werkzeug ist, unterliegt seine Handlung nun der von uns festgelegten Richtlinie und nicht dem vom Entwickler codierten Alignment.”

Outerlimit behandelt damit alle Agenten gleich, unabhängig davon, ob sie korrekt ausgerichtet sind oder nicht. Indem die Plattform vorhersagt, was ein Agent als Nächstes am wahrscheinlichsten tun wird, und dabei selbst in Maschinengeschwindigkeit arbeitet, will sie der Autonomie einen Schritt voraus sein und schädliche Handlungen blockieren, bevor sie eintreten.

Das erklärte Ziel bleibt das gleiche wie bei herkömmlicher Sicherheitstechnik: dem Unternehmen zu erlauben, sicher zu tun, was es will. “Die nächste Phase der Unternehmens-KI sollte kein Wettrennen um die meisten Agenten sein”, so Vincent. “Erfolg sollte stattdessen daran gemessen werden, ob eine Organisation die volle Leistungsfähigkeit ihrer Agenten sicher nutzen kann.” Werde Intelligenz zur Massenware, sei Vertrauen der limitierende Faktor – dies richtig hinzubekommen, sei eine grundlegende Verpflichtung gegenüber Einzelnen, Organisationen und der internationalen Sicherheit.