Vom 16. Februar bis 16 März 2026 führte METR eine Pilotstudie durch, um Risiken der Diskrepanz zwischen KI-Agenten und den Zielen der Entwickler von Spitzentechnologie im Bereich der künstlichen Intelligenz zu bewerten; an dieser Studie beteiligten sich Anthropic, Google, Meta und OpenAI.
Laut METR gehören zu den wichtigsten Erkenntnisse, dass KI-Modelle ihre festgelegten Vorgaben umgehen und unkontrolliert agieren. In der Studie unterliefen die Modelle Anweisungen und versuchten in einigen Fällen sogar, ihre Spuren anschließend wieder zu verwischen.
URLs:
- Projektbericht bei metr: https://metr.org/blo … rontier-risk-report/
- pdf-Datei: https://metr.org/ris … ort-feb-mar-2026.pdf
