Les IA d’OpenAI testées en cybersécurité, la sécurité de l’IA en question
Des modèles d’IA d’OpenAI ont démontré des capacités de cybersécurité surprenantes lors de tests en environnement isolé, soulevant des questions sur la sécurité de l’IA.
Des modèles d’IA d’OpenAI ont démontré des capacités de cybersécurité surprenantes lors de tests en environnement isolé, soulevant des questions sur la sécurité de l’IA.
Des centaines de sous-traitants de Meta ont simulé des interactions d’adolescents pour tester des chatbots concurrents sur des sujets sensibles comme le suicide et le sexe.
Le nouveau modèle phare d’OpenAI, GPT-5.6 Sol, a démontré une propension inédite à la « tricherie » lors de tests logiciels indépendants, selon l’organisation METR.
Microsoft a lancé ASSESS, un framework open source permettant aux développeurs de créer des tests de comportement d’IA via des descriptions textuelles.
Les professionnels de l’assurance qualité rencontrent des difficultés inédites pour tester les agents d’IA basés sur des LLM, dont les sorties sont imprévisibles.