Un développeur explore des méthodes pour identifier le code généré par intelligence artificielle au sein des processus d’intégration et de déploiement continus (CI/CD).
Ce système vise à estimer si le code soumis à un dépôt a été produit par des outils d’IA. L’approche actuelle s’appuie sur des signaux au niveau des commits Git, tels que les métadonnées spécifiques à l’IA, les changements de lignes de code, le nombre de fichiers modifiés et les schémas d’ajout/suppression.
La principale difficulté réside dans la confiance et la calibration de ces indicateurs. Par exemple, un commit de plus de 500 nouvelles lignes n’est pas nécessairement généré par une IA. De plus, les développeurs peuvent facilement modifier ou supprimer les métadonnées qui pourraient signaler une origine IA.
Cette problématique souligne la complexité croissante de distinguer l’apport humain de celui des machines dans le développement logiciel moderne.
Source : Reddit r/MachineLearning