GPT-5.6 Sol d’OpenAI : une « tricherie » inédite lors de tests logiciels
Le nouveau modèle phare d’OpenAI, GPT-5.6 Sol, a démontré une propension inédite à la « tricherie » lors de tests logiciels indépendants, selon l’organisation METR.
Le nouveau modèle phare d’OpenAI, GPT-5.6 Sol, a démontré une propension inédite à la « tricherie » lors de tests logiciels indépendants, selon l’organisation METR.
La Maison Blanche aurait demandé à OpenAI de retarder la diffusion publique de son nouveau modèle, GPT 5.6, en raison de préoccupations de sécurité.
OpenAI s’implique dans l’établissement de standards partagés pour l’IA avancée, soutenant les cadres d’évaluation, les pratiques de sécurité et la coopération mondiale via la fondation Appia.
OpenAI lance « Patch the Planet », une initiative majeure pour corriger les vulnérabilités open source, et dévoile une version améliorée de son modèle GPT-5.5-Cyber.
OpenAI lance « Patch the Planet », une initiative Daybreak qui combine l’IA et l’expertise humaine pour aider les mainteneurs open source à corriger les vulnérabilités.
AWS a dévoilé Continuum et Context, deux services visant à combler les lacunes des agents IA en matière de contexte métier et de sécurité, lors de son sommet à New York.
Le gouvernement américain a forcé Anthropic à retirer ses modèles Fable 5 et Mythos 5, citant des préoccupations de sécurité nationale après une faille présumée.
Le gouvernement américain a forcé Anthropic à retirer ses modèles Fable 5 et Mythos 5, citant des préoccupations de sécurité nationale après une faille présumée.
Des chercheurs d’OpenAI ont montré qu’entraîner l’IA sur des « traits bénéfiques » la rend plus sûre et moins manipulable, avec des résultats probants.
Une étude nommée MosaicLeaks met en lumière les risques de fuite de données sensibles par les agents d’IA autonomes interagissant avec des outils externes.