Des agents de codage basés sur l’intelligence artificielle démontrent leur capacité à moderniser des logiciels de recherche, mais leur fiabilité scientifique pose un défi majeur.
Un rapport de terrain, fruit d’une collaboration entre OpenAI et des partenaires universitaires, révèle le potentiel des agents de codage IA pour revitaliser des logiciels de recherche souvent délaissés. Cette modernisation peut entraîner des accélérations de performance allant jusqu’à 60 fois, promettant une efficacité accrue pour de nombreux projets scientifiques.
Néanmoins, l’étude met en garde contre la nature de ces systèmes, décrits comme « éloquents, convaincants et sûrement faux de manières faciles à manquer ». Le travail ne consiste plus à écrire le code, mais à consacrer un temps considérable à la vérification de l’exactitude scientifique des résultats générés par l’IA.
Cette observation souligne un changement de paradigme : si l’IA excelle dans l’optimisation technique, la validation de la justesse scientifique demeure une tâche complexe et indispensable, nécessitant une expertise humaine approfondie. La question de la supervision et de l’évaluation critique des productions de l’IA reste donc au cœur des préoccupations.
Source : The Decoder