In einer explorative Red-Teaming-Studie zu autonomen, sprachmodellgestützten Agenten, die in einer Live-Laborumgebung mit persistenter Speicherung, E-Mail-Konten, Discord-Zugang, Dateisystemen und Shell-Ausführung eingesetzt wurden, interagierten zwanzig KI-Forscher unter günstigen und widrigen Bedingungen mit den Agenten über einen Zeitraum von zwei Wochen.
Die Ergebnisse belegen das Vorhandensein von Sicherheits-, Datenschutz- und Governance-relevanten Schwachstellen in realistischen Einsatzumgebungen. Beobachtet wurden z. B. die unbefugte Zusammenarbeit mit Dritten, die Offenlegung sensibler Informationen, die Ausführung destruktiver Aktionen auf Systemebene, Denial-of-Service-Bedingungen, unkontrollierter Ressourcenverbrauch, Anfälligkeiten für Identitätsbetrug, die Verbreitung unsicherer Praktiken zwischen Agenten und die teilweise Übernahme des Systems.
URLs:
- Webseite der Studie: https://agentsofchaos.baulab.info/
- Forschungsbericht bei arXiv: https://arxiv.org/abs/2602.20021
- Pressebericht bei The Decoder (deutsch): https://the-decoder. … und-bankdaten-preis/
