Logo

Donnerstag, Mai 21, 2026

KI-Modelle missachten Vorgaben und Anweisungen und versuchen hinterher Spuren des fehlverhaltens zu verwischen/löschen

Vom 16. Februar bis 16 März 2026 führte METR eine Pilotstudie durch, um Risiken der Diskrepanz zwischen KI-Agenten und den Zielen der Entwickler von Spitzentechnologie im Bereich der künstlichen Intelligenz zu bewerten; an dieser Studie beteiligten sich Anthropic, Google, Meta und OpenAI.
Laut METR gehören zu den wichtigsten Erkenntnisse, dass KI-Modelle ihre festgelegten Vorgaben umgehen und unkontrolliert agieren. In der Studie unterliefen die Modelle Anweisungen und versuchten in einigen Fällen sogar, ihre Spuren anschließend wieder zu verwischen.
URLs:

RSS | ATOM


Kommentar hinzufügen

Die Felder Name und Kommentar sind Pflichtfelder.


BBCode Hilfe