Anthropic et OpenAI prévoient d’intégrer des évaluateurs de sécurité indépendants au sein de leurs laboratoires d’intelligence artificielle. Cette initiative vise à renforcer la supervision des systèmes d’IA les plus avancés dès leur conception.
Les chercheurs saluent cet accès sans précédent aux processus internes des géants de l’IA. Cependant, ils soulignent que pour une surveillance véritablement efficace, plusieurs conditions doivent être remplies. La transparence des opérations, une indépendance totale des évaluateurs et, à terme, un cadre réglementaire clair sont jugés indispensables.
L’intégration de ces experts soulève des interrogations sur leur capacité à opérer en toute autonomie au sein de structures privées. La question de l’indépendance réelle de ces évaluateurs face aux intérêts commerciaux des entreprises reste un point central du débat.
Cette démarche marque une étape dans la prise de conscience des risques liés à l’IA, mais elle met également en lumière les défis inhérents à l’établissement d’une supervision externe crédible.
Source : TechCrunch AI