Linus Torvalds et l’IA face à un débogage « infernal »
Linus Torvalds a eu recours à une intelligence artificielle pour l’aider dans une session de débogage complexe, l’IA ayant montré des signes d’abandon malgré son efficacité.
Linus Torvalds a eu recours à une intelligence artificielle pour l’aider dans une session de débogage complexe, l’IA ayant montré des signes d’abandon malgré son efficacité.
Une nouvelle bibliothèque, rewardspy, a été conçue pour détecter le « reward hacking » en apprentissage par renforcement, un phénomène où l’IA exploite la fonction de récompense sans réelle amélioration.
Un développeur a créé un débogueur pour les boucles d’entraînement PyTorch, révélant que la plupart des échecs sont locaux et non globaux.
Goodfire lance Silico, un outil d’interprétabilité mécaniste pour analyser et ajuster les LLM pendant l’entraînement.