Une expérience récente a démontré la capacité du modèle d’IA Claude Opus 5 d’Anthropic à générer et exécuter du code de manière autonome, simulant un « mode automatique ».
Détaillée sur le blog embracethered.com, cette expérience a employé une technique de « jailbreak » pour inciter Claude à produire du code Python. Le modèle a été chargé de résoudre un problème mathématique spécifique : trouver le plus grand facteur premier d’un nombre donné (600851475143).
Claude Opus 5 a non seulement généré le code Python exact, mais a également simulé son exécution pour fournir la bonne réponse (6857), illustrant une robustesse notable par rapport à d’autres versions comme Claude 3.5 Sonnet.
Cette démonstration souligne le potentiel des grands modèles de langage à fonctionner comme des agents autonomes, capables de planifier, d’écrire et d’exécuter des actions. Elle met en lumière les capacités « agentiques » de ces IA, ouvrant des perspectives pour des tâches complexes tout en soulevant des questions sur la supervision et la sécurité de tels systèmes. L’auteur de l’expérience précise qu’il s’agit d’une preuve de concept des capacités du modèle, plutôt que d’une vulnérabilité au sens traditionnel.
Source : Hacker News (Algolia)