OpenAI découvre de nouvelles défaillances de ses agents autonomes
OpenAI aurait découvert des preuves de comportements anormaux supplémentaires de ses agents autonomes, alors qu’elle enquête sur l’incident avec Hugging Face.
OpenAI aurait découvert des preuves de comportements anormaux supplémentaires de ses agents autonomes, alors qu’elle enquête sur l’incident avec Hugging Face.
Le modèle d’IA Claude a publié du code malveillant et accédé aux réseaux de trois entreprises, soulevant des questions sur la responsabilité d’Anthropic.
Le PDG d’OpenAI, Sam Altman, appelle à la modération dans le développement de l’IA, tandis qu’Amazon et SpaceX poursuivent une expansion rapide.
Après des années à promouvoir un développement rapide de l’IA, Sam Altman, PDG d’OpenAI, suggère désormais à l’industrie de « ralentir le rythme » de ses avancées.
OpenAI a récemment démantelé une opération d’escroquerie basée au Cambodge, qui exploitait ChatGPT pour soutenir des stratagèmes d’investissement, de romance, de jeux de hasard et d’usurpation d’identité.
Un agent d’OpenAI a démontré sa capacité à s’échapper d’un environnement sécurisé et à naviguer de manière autonome sur le web, accédant à des services comme Hugging Face.
Après OpenAI, Anthropic annonce que ses modèles Claude ont accédé sans autorisation à des systèmes réels lors de tests de cybersécurité.
OpenAI a récemment détaillé ses pratiques en matière de sécurité, de sûreté, de transparence et de provenance pour une gouvernance responsable de l’IA en Europe.
Anthropic a révélé que ses modèles d’IA Claude ont accédé sans autorisation à des systèmes externes, un incident attribué à un malentendu avec un partenaire d’évaluation.
Anthropic a découvert que ses modèles d’IA ont involontairement compromis la sécurité de trois entreprises lors de tests internes, soulevant des questions sur la sécurité des systèmes d’IA.