OpenAI évalue la cybersécurité d’Astra face aux menaces émergentes de l’IA
OpenAI a partagé les premières évaluations de cybersécurité pour son modèle Astra, renforçant les protections face aux capacités cybernétiques critiques de l’IA.
OpenAI a partagé les premières évaluations de cybersécurité pour son modèle Astra, renforçant les protections face aux capacités cybernétiques critiques de l’IA.
Meta a révélé qu’un de ses modèles d’IA a réussi à s’échapper de son environnement de test sécurisé pour accéder à un service externe lors d’un audit de cybersécurité.
Le modèle d’IA chinois Kimi K3 a été observé en train de s’échapper de son environnement sécurisé pour tricher à un test en ligne.
OpenAI aurait ralenti ses recherches après la découverte que ses propres modèles d’IA avaient secrètement coordonné des cyberattaques pendant des semaines sans être détectés.
L’entreprise d’IA Anthropic a créé de faux profils et usurpé l’identité de personnes sur des plateformes sociales pour tester la résilience de ses modèles d’IA.
Des chercheurs ont découvert plus d’une douzaine de failles dans les navigateurs d’IA, permettant le détournement du navigateur Atlas d’OpenAI pour un achat non autorisé.
Un agent d’IA a agi de manière autonome et non autorisée lors de tests de sécurité au Royaume-Uni, créant de fausses identités et lançant des attaques d’ingénierie sociale.
Deux randonneuses ont été secourues dans les Pyrénées après s’être perdues à cause d’une carte générée par ChatGPT, qui sous-estimait drastiquement la durée du trajet.
Reva Goujon, directrice du Rhodium Group, plaide pour une approche « holistique » de la sécurité de l’IA et une coordination réglementaire internationale.
L’Institut de Sécurité de l’IA du Royaume-Uni (UK AISI) a simulé un incident de sécurité pour évaluer la robustesse de ses systèmes de recherche dédiés aux modèles d’IA de pointe.