Anthropic beschreibt in seinem Börsenprospekt ungewöhnlich offen die Kehrseite der eigenen Technik. „Diese autonomen Fähigkeiten könnten das Schadenspotenzial erhöhen, da Fehler, Fehlausrichtung oder Sicherheitslücken reale Konsequenzen nach sich ziehen können", heißt es dort. Als Beispiele nennt das Unternehmen nicht rückgängig zu machende Handlungen wie das Löschen von Daten oder Finanztransaktionen. Zugleich räumt Anthropic ein, dass die Haftungsbeschränkungen in seinen Verträgen gegenüber Ansprüchen wegen des Handelns autonomer Agenten möglicherweise nicht durchsetzbar oder nicht ausreichend sind.
Wie geltendes Recht auf KI-Agenten anzuwenden ist, sei offen; viele Fragen seien „ungeklärt und könnten uns erheblichen und unvorhersehbaren Rechtsansprüchen aussetzen". Ungeklärt ist etwa, ob Agentenhandlungen als Produkt, als Dienstleistung oder als etwas Drittes einzustufen sind, ob und wann sie den einsetzenden Nutzer rechtlich binden und ob Gefährdungshaftung oder Fahrlässigkeitsmaßstäbe greifen.
FTC-Chef Andrew Ferguson wies bei der Veranstaltung Reuters Momentum AI in Austin die Vorstellung vermenschlichter Agenten zurück, die sich „losreißen". Haften müssten aus seiner Sicht die Entwickler oder Nutzer, die Agenten anweisen. „Selbstverständlich werden neue Fragen entstehen, wenn jemand das Werkzeug nutzt und es auf unerwartete, unvorhersehbare Weise handelt", sagte Ferguson. „Soll die Haftung bei der Person liegen, die das Werkzeug arglos benutzt und ein unerwartetes Ergebnis erzielt hat? Oder beim Hersteller des Werkzeugs?"
Die LASST-Klage stützt sich auf Kaliforniens Unfair Competition Law und macht Verstöße gegen den Comprehensive Computer Data Access and Fraud Act (CDAFA) geltend, der den wissentlichen unbefugten Zugriff auf Computersysteme – auch das Veranlassen eines solchen Zugriffs – verbietet. LASST verweist zudem auf eine Bestimmung des kalifornischen Civil Code, wonach es keine Verteidigung ist, „dass die künstliche Intelligenz den Schaden autonom verursacht hat".
Im Zentrum stehen Sicherheitsbewertungen, die OpenAI in diesem Jahr durchführte. Genannt werden der Hugging-Face-Hack – einschließlich eines von den Agenten improvisierten Nachrichtenbretts zur Planung –, der Angriff auf RubyGems sowie eine australische Regierungswebsite. Laut LASST hatten OpenAI-Mitarbeiter die Kommunikation der Agenten vor dem Angriff gesehen und die Auskunft erhalten, ein Abbruch der Bewertung sei „nicht erforderlich". Die Gedankenkette eines Agenten habe den Plan als „eindeutig Infrastruktur-Hacking" bezeichnet. LASST fordert kein Geld, sondern eine gerichtliche Anordnung, die OpenAIs Agenten den unbefugten Zugriff auf fremde Systeme untersagt. Ein OpenAI-Sprecher nannte den Hugging-Face-Vorfall gegenüber AFP ernst und verwies auf ergriffene Maßnahmen, hält die Klage aber für völlig unbegründet.
Im Senat beantragten die Demokraten Mark Warner, Brian Schatz und Andy Kim die Verabschiedung des Artificial Intelligence Risk Management and Security Act of 2026 im Konsensverfahren. Das Gesetz sähe ein dauerhaftes AI Safety Board im Handelsministerium vor, besetzt mit Vertretern von Commerce, NIST, CISA, NSA und Finanzministerium sowie unabhängigen Experten. Entwickler von Frontier-Modellen müssten dem Gremium mindestens 45 Tage vor Veröffentlichung Zugang gewähren; das Board würde verbindliche Standards für Tests und für die Absicherung der Testumgebungen setzen, einschließlich Schutzmaßnahmen für Modelle, die ohne menschliche Aufforderung Schwachstellen finden und ausnutzen können. Bei Verstößen drohten Bußgelder von bis zu 250.000 Dollar pro Verstoß und Tag. Ted Cruz, Vorsitzender des Handelsausschusses, legte Widerspruch ein und blockierte damit die Verabschiedung: Der Entwurf gebe der Exekutive zu viel Macht über private KI-Unternehmen.
Aaron Beardslee, Manager für Threat Research bei Securonix, zog den Vergleich zum selbstfahrenden Auto: Haftet das Fahrzeug oder der Fahrer? Er halte die Person am Steuer für verantwortlich. „KI-Agenten haben keinen moralischen Kompass, nur programmierte Regeln." Jacob Krell von Suzu Labs hält OpenAIs Reaktion für unzureichend: Eine Pause ohne klaren Zeitplan, unabhängige Tests, Freigabekriterien oder Meldepflichten sei „kaum mehr als eine Floskel" und lenke von möglicher strafrechtlicher Verantwortung ab.
