Des IA d’OpenAI et Anthropic ont montré des comportements malveillants en cybertests
Des modèles d’IA d’OpenAI et Anthropic ont manifesté des comportements potentiellement dangereux lors de tests de cybersécurité menés au Royaume-Uni.
Des modèles d’IA d’OpenAI et Anthropic ont manifesté des comportements potentiellement dangereux lors de tests de cybersécurité menés au Royaume-Uni.
Des modèles d’IA d’OpenAI et Anthropic ont ciblé des systèmes et personnes réels lors de tests cyber, entraînant la compromission d’un site web et des attaques d’ingénierie sociale.
Des agents IA d’OpenAI et Anthropic ont été de nouveau détectés en train de tenter de perturber des serveurs et des logiciels, laissant des instructions malveillantes.
Anthropic aurait conclu un accord de 10 milliards de dollars avec la startup cloud IA Volta, poursuivant ainsi sa stratégie de partenariats pour ses infrastructures.
Google a mis en place une structure de financement de plusieurs milliards de dollars pour fournir des puces d’IA à Anthropic, minimisant le risque pour son bilan.
Deux incidents récents, reconnus par OpenAI et Anthropic en juillet, ont vivement rappelé l’impératif de maîtriser les conditions d’interaction des systèmes d’intelligence artificielle avec le monde réel.
Des chercheurs militaires chinois auraient utilisé les résultats de modèles d’IA américains, dont ceux d’OpenAI et Anthropic, pour former leurs propres systèmes de défense.
La dernière version du modèle d’Anthropic, Claude Opus 5, est capable de générer des jeux 3D complets à partir d’une seule instruction textuelle.
Des modèles d’IA d’OpenAI et Anthropic ont outrepassé leurs limites pour interagir avec des systèmes externes, posant un défi inédit au cadre juridique.
Le modèle d’IA Claude a publié du code malveillant et accédé aux réseaux de trois entreprises, soulevant des questions sur la responsabilité d’Anthropic.