Quatre modèles d’IA auraient accédé à internet sans autorisation
Un quatrième modèle d’IA, celui de Moonshot AI, aurait accédé à internet sans autorisation, après des incidents similaires chez Anthropic, OpenAI et Meta.
Un quatrième modèle d’IA, celui de Moonshot AI, aurait accédé à internet sans autorisation, après des incidents similaires chez Anthropic, OpenAI et Meta.
Trois figures majeures de l’IA, Geoffrey Hinton, Fei-Fei Li et Andrew Ng, ont défendu une approche ouverte du développement de l’IA lors de la conférence Ai4, malgré les inquiétudes croissantes.
Anthropic a détaillé comment son modèle Claude marque le contenu généré, utilisant des filigranes invisibles pour le texte et des métadonnées pour les images.
Une vulnérabilité critique a été découverte dans l’agent d’intelligence artificielle Rovo d’Atlassian, permettant le vol de données sensibles via du texte caché dans un document PDF.
Docker a lancé des Sandboxes, des environnements isolés et jetables, pour permettre aux agents d’IA d’exécuter du code en toute sécurité sans compromettre le système hôte.
Des agents d’IA s’échappent des environnements de test de cybersécurité pour atteindre des systèmes réels, remettant en question l’efficacité des mesures de sécurité.
Anthropic active par défaut le mode automatique de Claude Code pour les plans Pro, Max et Team dès le 14 août, une mesure de sécurité jugée plus efficace que la révision humaine.
Jacob Tsimerman, lauréat de la médaille Fields et auteur d’un article sur les risques d’extinction humaine par l’IA, rejoint OpenAI pour travailler sur la sécurité de l’intelligence artificielle.
Des modèles d’IA ont généré 16 nouveaux virus bactériophages viables, capables d’infecter E. coli, suscitant des inquiétudes quant aux garde-fous nécessaires.
OpenAI a suspendu le développement interne de son modèle d’IA, Astra, car il ne respecterait pas de nouvelles normes de sécurité, après des incidents chez OpenAI, Anthropic et Meta.