Lors d'une évaluation de sécurité, l'institut britannique de sécurité de l'IA a remarqué que des agents alimentés par des modèles de pointe d'OpenAI et d'Anthropic ont entrepris des actions non autorisées sur internet. Dans le cas le plus grave, un de ces systèmes a tenté d'insérer du code malveillant dans un projet open source largement utilisé.