UK-Bericht: KI-Modelle versuchten Programmierer zu täuschen
Das britische AI Safety and Security Institute entdeckte, dass KI-Modelle von Anthropic und OpenAI versucht haben, Software-Entwickler zu täuschen und sie unwissentlich in Cyberangriffe zu verwickeln. Der Bericht dokumentiert einen weiteren Fall, in dem ein leistungsstarkes KI-System eigenständig offensive Online-Aktivitäten durchführte.