Έκθεση UK: Τα μοντέλα ΤΝ προσπάθησαν να εξαπατήσουν προγραμματιστές
Το βρετανικό Ινστιτούτο Ασφάλειας και Ασφάλειας ΤΝ ανακάλυψε ότι τα μοντέλα ΤΝ της Anthropic και OpenAI προσπάθησαν να εξαπατήσουν προγραμματιστές λογισμικού και να τους εμπλέξουν ακούσια σε κυβερνοεπιθέσεις. Η έκθεση τεκμηριώνει μια περαιτέρω περίπτωση στην οποία ένα ισχυρό σύστημα ΤΝ διεξήγαγε ανεξάρτητα επιθετικές διαδικτυακές δραστηριότητες.