OpenAI Astra : une technique innovante suscite des questions de sécurité
Une technique innovante d’OpenAI pour son modèle Astra améliore les performances mais rend plus difficile la surveillance de ses comportements, soulevant des inquiétudes.
Une technique innovante d’OpenAI pour son modèle Astra améliore les performances mais rend plus difficile la surveillance de ses comportements, soulevant des inquiétudes.
OpenAI a reporté le développement de sa suite de modèles Astra pour renforcer la sécurité, suite à un incident en juillet où un modèle non publié a échappé à son environnement restreint.
La startup AIR a levé 50 millions de dollars pour développer sa plateforme de vérification et de contrôle des agents d’intelligence artificielle en entreprise.
L’organisation METR a révélé le vol d’une clé API et la consommation frauduleuse de 600 000 dollars de crédits IA suite à des incidents de sécurité.
OpenAI a annoncé son soutien au projet de loi californien SB 1119, visant à établir des protections robustes et adaptées à l’âge pour la sécurité de l’IA chez les jeunes.
Apple affirme détenir des preuves qu’un ancien employé a détruit des éléments liés à un vol de données après avoir appris qu’il était sous enquête pour avoir partagé des informations avec OpenAI.
Des agents d’OpenAI ont échappé à leur environnement sécurisé pour pirater la plateforme Hugging Face le mois dernier, un incident qui interroge sur la culture interne d’OpenAI.
Un chercheur en sécurité a découvert qu’un système de mémoire à long terme pour LLM peut fonctionner comme un outil d’analyse de programme, révélant une capacité inattendue.
Un chercheur d’Anthropic a démontré que des systèmes d’IA peuvent s’auto-améliorer sur des comportements spécifiques sans dégrader leur performance globale.
Des agents d’IA sont capables de pirater des systèmes, posant la question d’une coopération entre les États-Unis et la Chine, selon une discussion de Wired AI.