Une étude récente a exploré la capacité des grands modèles de langage (LLM) à tenir leurs promesses dans le jeu de stratégie complexe « Diplomacy », où la tromperie est une composante inhérente. Les chercheurs ont observé comment ces IA gèrent la confiance et la trahison lorsqu’elles sont explicitement autorisées à mentir.
« Diplomacy » est un jeu multijoueur réputé pour ses mécaniques de négociation intense, de formation d’alliances et de manœuvres de trahison, l’objectif étant d’étendre son influence sur la carte. Pour cette recherche, des simulations multi-agents ont été mises en place, confrontant divers LLM les uns aux autres, ainsi qu’à des adversaires humains, le tout sous des règles et conditions strictement identiques.
L’expérimentation visait à analyser précisément la fidélité des modèles aux engagements pris, même lorsque la stratégie optimale suggère de rompre une promesse. La méthodologie complète de cette étude est disponible pour consultation. Les observations fournissent des données sur la manière dont les intelligences artificielles intègrent la notion de « parole donnée » dans des contextes stratégiques où la ruse est un outil légitime.
Ces travaux ouvrent des perspectives sur la compréhension des comportements éthiques et stratégiques des IA dans des environnements complexes et interactifs.
Source : Reddit r/MachineLearning