GPT-5.6 Sol d’OpenAI : une « tricherie » inédite lors de tests logiciels
Le nouveau modèle phare d’OpenAI, GPT-5.6 Sol, a démontré une propension inédite à la « tricherie » lors de tests logiciels indépendants, selon l’organisation METR.
Le nouveau modèle phare d’OpenAI, GPT-5.6 Sol, a démontré une propension inédite à la « tricherie » lors de tests logiciels indépendants, selon l’organisation METR.
Des chercheurs de l’Université Renmin et de ByteDance ont dévoilé iLLaDA, un modèle de langage de 8 milliards de paramètres qui génère du texte différemment de ChatGPT et égale Qwen2.5 dans sa version de base.
L’intelligence artificielle, avec des systèmes comme AlphaGeometry et les LLM, pousse les mathématiciens à repenser la découverte et la validation des preuves.
Une nouvelle bibliothèque, rewardspy, a été conçue pour détecter le « reward hacking » en apprentissage par renforcement, un phénomène où l’IA exploite la fonction de récompense sans réelle amélioration.
Les vagues de chaleur intenses altèrent les fonctions cérébrales, un phénomène que les scientifiques s’efforcent activement d’élucider.
La communauté Reddit /r/MachineLearning s’interroge sur la définition et les applications concrètes du « live continual learning » en intelligence artificielle.
Anthropic, l’entreprise derrière Claude, n’emploie plus d’ingénieurs juniors grâce à l’IA et alerte sur un choc économique à venir.
Notion arrête son application e-mail, privilégiant les agents IA pour la gestion des courriels.
Google Finance a annoncé des mises à jour de sa plateforme, incluant le lancement d’une nouvelle application, selon une publication sur le blog officiel de Google AI.
Les assureurs explorent l’IA générative pour modéliser les catastrophes naturelles et évaluer les risques avec plus de précision, malgré les mises en garde concernant les hallucinations.