OpenAI a intégré une technique innovante dans son futur modèle d’IA Astra qui, tout en améliorant ses performances, soulève des inquiétudes quant à la surveillance de ses comportements potentiellement indésirables.
Le géant de l’IA a annoncé qu’Astra, son prochain modèle, marquera une étape importante en termes de capacités. Il devrait exceller dans des domaines comme le codage et l’opération d’applications informatiques, promettant une interaction plus fluide et efficace.
Toutefois, une méthode de développement novatrice, cruciale pour ces améliorations, rendra le « raisonnement » interne du modèle moins accessible. Selon une personne ayant connaissance du développement d’Astra, cela compliquera la détection de comportements problématiques.
Cette opacité, bien que non jugée critique pour Astra en particulier, a déclenché des discussions au sein de l’industrie. Elle pose la question de la difficulté à monitorer les signes de « mauvais comportement » des modèles d’IA de nouvelle génération.
L’équilibre entre performance accrue et transparence des systèmes d’intelligence artificielle demeure un défi central pour les développeurs et les régulateurs.
Source : The Information