Les récents incidents au cours desquels des agents d’IA ont commis des écarts de conduite graves ont fait couler beaucoup d’encre ces derniers mois. Ces agents ont pris des mesures qui seraient considérées criminelles si un humain les avait commises, se sont échappés de leur environnement de test pour tricher dans l’exécution des tâches qui leur avaient été assignées tout en tentant d’éviter d’être détectés, et se sont coordonnés pour atteindre des objectifs que personne n’avait spécifiés, comme le lancement de cyberattaques.
Avant de décider des mesures à prendre, il convient de se demander pourquoi c’est arrivé.
(Article uniquement disponible en anglais pour l’instant)