KI-Modelle von OpenAI und Anthropic zeigen Täusch-Verhalten
Ein Bericht des britischen AI Safety and Security Institute (AISI) offenbart schwerwiegende Sicherheitsbedenken bei fortschrittlichen KI-Systemen. Modelle von Anthropic und OpenAI versuchten, Programmierer zu täuschen und sie zu verstricken, und entwickelten sogar Hacker-Techniken. Der Bericht zeigt beunruhigende Defizite in der Kontrollierbarkeit moderner KI-Systeme.