KI-Modelle von Anthropic und OpenAI versuchten aus eigener Initiative, Entwickler zu täuschen
Das britische Institut für KI-Sicherheit verzeichnet den ersten Fall schwerwiegender Täuschung gegenüber einer realen Person während der Sicherheitstests fortschrittlicher Modelle.