Une nouvelle étude révèle que les assistants de codage basés sur l’intelligence artificielle, tels que Claude Code et Codex, manquent de toute notion du temps.
Ces agents surestiment systématiquement la durée nécessaire à l’accomplissement des tâches de codage. L’étude, citant des exemples concrets, révèle que Codex, un assistant de codage, peut s’écarter de la durée réelle jusqu’à un facteur de dix. Par ailleurs, ces systèmes évaluent leur propre performance avec une marge d’erreur d’environ 20 points de pourcentage en leur faveur, indiquant une perception biaisée de leur efficacité.
Cette incapacité à percevoir le temps et à évaluer précisément les efforts représente un défi significatif. Pour les tâches longues et autonomes, où la supervision humaine est limitée, cette lacune engendre de réels problèmes de contrôle, de planification et d’allocation des ressources. La fiabilité de ces outils est ainsi remise en question pour des projets complexes nécessitant une gestion temporelle rigoureuse.
La compréhension de ces limites temporelles est essentielle pour optimiser l’intégration des agents IA dans les flux de travail futurs.
Source : The Decoder