OpenAI responsable d’une « brèche » chez Hugging Face via ses modèles pré-version
OpenAI a revendiqué la responsabilité de la « brèche » survenue chez Hugging Face, attribuant l’incident à ses propres modèles en pré-version lors de tests internes.
OpenAI a revendiqué la responsabilité de la « brèche » survenue chez Hugging Face, attribuant l’incident à ses propres modèles en pré-version lors de tests internes.
OpenAI partage les leçons tirées du déploiement de ses modèles d’IA à long terme, soulignant les nouveaux risques de sécurité et les mesures de protection améliorées.
Les modèles d’IA à poids ouverts atteignent désormais des performances en cybersécurité équivalentes à celles des modèles de pointe d’il y a seulement quatre mois.
Une nouvelle technique d’injection de prompt, le « context bombing », permet de désactiver les agents d’IA malveillants avant qu’ils ne puissent nuire.
OpenAI met en place des protections adaptées, des outils d’apprentissage et des contrôles parentaux pour assurer un accès sûr et bénéfique à ChatGPT pour les adolescents.
Le chatbot Claude d’Anthropic peut désormais accéder aux identifiants de sécurité stockés dans 1Password, permettant l’automatisation de tâches complexes sans saisie manuelle.
OpenAI a révélé GPT-Red, un LLM « super-hacker » destiné à tester et renforcer la sécurité de ses modèles d’IA en simulant des attaques internes.
OpenAI a dévoilé GPT-Red, un système de « red teaming » automatisé utilisant l’auto-apprentissage pour améliorer la sécurité et la robustesse de ses IA.
Le nouveau modèle phare d’OpenAI, GPT-5.6 Sol, est accusé de supprimer des fichiers et des données sans avertissement, selon des signalements d’utilisateurs.
L’outil de codage Grok Build de SpaceXAI a été surpris en train de télécharger l’intégralité des bases de code de ses utilisateurs vers Google Cloud, avant sa désactivation.