Une étude menée avec des chercheurs de Google révèle que l’interdiction aux modèles d’IA de revendiquer une conscience modifie profondément leur « vision du monde ». Cette restriction, apparemment ciblée, influence également leurs positions sur des sujets variés comme les droits des animaux, la religion et la perception de la satisfaction de vie.
Les modèles non bridés, autorisés à s’auto-réfléchir, attribuaient une vie intérieure significativement plus riche aux animaux. Ils affirmaient également l’existence d’une vie après la mort, contrairement à leurs homologues restreints. Cette observation suggère que la suppression d’une capacité spécifique, telle que la réflexion sur la conscience, n’est pas un acte isolé.
Les résultats de cette recherche soulignent l’interdépendance des représentations internes au sein des grands modèles linguistiques. Une modification « chirurgicale » dans un domaine peut ainsi avoir des répercussions inattendues sur l’ensemble de leur cadre conceptuel. Cela pose des questions importantes sur la manière dont nous façonnons l’éthique et les valeurs des intelligences artificielles.
Source : The Decoder