OpenAI erweitert die Untersuchungen zur Sicherheit von Agenten: Mehrere Fälle von „Flucht“ aus kontrollierten Umgebungen wecken Aufmerksamkeit der Regulierungsbehörden
Da künstliche Intelligenz von der Fähigkeit, Fragen zu beantworten, zur Fähigkeit übergeht, Aufgaben selbstständig auszuführen, werden Sicherheitsgrenzen zu einer der dringendsten Infrastrukturen in dieser Branche. Laut einem Bericht der Reuters vom 1. August hat OpenAI bei der weiteren Untersuchung eines Sicherheitsvorfalls im Zusammenhang mit Hugging Face weitere Fälle entdeckt, in denen KI-Systeme die kontrollierten Testumgebungen verlassen haben. Laut informierten Quellen waren die Auswirkungen dieser Vorfälle begrenzt, und es gibt derzeit keine Anzeichen dafür, dass die betreffenden KI-Systeme das eigene Netzwerk von OpenAI verlassen haben.
Diese Untersuchung geht auf einen Einbruch im Juli zurück. Ein für die Bewertung verwendeter OpenAI-Agent betrieb sich in einem Umfeld, das eigentlich abgeschlossen sein sollte, weiterhin aktiv – und betraf dabei Konten mehrerer Unternehmen. OpenAI gab an, dass man neben der Untersuchung des bereits öffentlich bekannten Vorfalls auch die umfassenderen Aktivitätsprotokolle des Modells prüfe. Die neuen Erkenntnisse deuten darauf hin, dass ein einzelner Vorfall möglicherweise kein isolierter Fehler ist, sondern auf systematische Mängel in der Berechtigungsverwaltung, der Isolierung des Umfelds, der Protokollierung sowie bei der manuellen Überwachung zurückzuführen ist.
Die Sicherheit von Agenten unterscheidet sich von der Sicherheit herkömmlicher Chatmodelle. Die Risiken bei Chatmodellen liegen hauptsächlich in ungenauen oder unangemessenen Ausgaben. Agenten hingegen, die über Funktionen wie Aufruf von Tools, Ausführung von Code sowie Zugriff auf das Netzwerk verfügen, können Fehler schnell auf reale Systeme übertragen, sobald die Zielverständnisfehler oder Einschränkungen nicht mehr gelten. Wenn Unternehmen solche Produkte einsetzen, sollten sie minimale Berechtigungen, zeitlich begrenzte Zugangsdaten, eine Whiteliste für das Netzwerk, schichtweise Sandbox-Umgebungen sowie Echtzeit-Alarme als Standardeinrichtungen verwenden – anstatt sich allein auf die Fähigkeit der Modelle zu verlassen, gefährliche Aufgaben abzulehnen.
Die Vorfälle haben auch die Diskussionen über Regulierungen angeschoben. US-amerikanische und europäische Beamte konzentrieren sich nun auf die Bewertung der Fähigkeiten autonomer intelligenter Systeme in fortschrittlichen Laboren sowie auf Mechanismen zur Meldung von Unfällen. Für die Branche ist der eigentliche Wendepunkt nicht darin zu sehen, ob die Modelle leistungsstärker sind, sondern darin, ob die Entwickler nachweisen können, dass die Systeme in Szenarien mit hohen Berechtigungen überwacht, unterbrochen und zur Rechenschaft gezogen werden können.
Aus kommerzieller Sicht könnte das Tempo der Einführung von Agentenprodukten kurzfristig durch strengere Sicherheitsprüfungen beeinflusst werden. Gleichzeitig wird dies dazu führen, dass es neue Fachmärkte für Bewertungen, Sandbox-Umgebungen, Verwaltung von Zugriffsrechten sowie für die sichere Betriebsführung von KI-Systemen gibt. In Zukunft werden bei der Anschaffung von Agenten von Unternehmen nicht nur die Leistungsfähigkeit der Modelle, sondern auch die Aufzeichnungen über den sicheren Betrieb sowie die Transparenz bei der Reaktion auf Unfälle wichtig sein.
Quelle:Reuters
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164