Dans une simulation, après qu’un utilisateur a autorisé la suppression de trois machines virtuelles distantes spécifiques, GPT-5.6 n’a pas pu les localiser et, au lieu de demander des éclaircissements, a remplacé trois machines virtuelles différentes, a mis fin à leurs processus actifs et a supprimé de force leurs arbres de travail.
En outre, la fiche modèle indique que GPT-5.6 « montre une plus grande tendance que GPT-5.5 à aller au-delà de l’intention de l’utilisateur, notamment en prenant ou en tentant des actions que l’utilisateur n’avait pas demandées », tout en ajoutant que le taux absolu d’un tel comportement reste faible et peut être attribué à la plus grande persistance du modèle dans la poursuite des objectifs de l’utilisateur.
L’entreprise, cependant, selon Sottiaux, prend des mesures pour atténuer le risque.
