Artificial Analysis a publié la version 4.2 de son Indice d’Intelligence, révisant la notation de GPT-6 Astra suite aux critiques concernant sa précédente évaluation.
Cette mise à jour intervient probablement en réponse au scepticisme exprimé quant à la capacité des benchmarks précédents à saisir les progrès réels de GPT-6 Astra. L’Indice d’Intelligence est un baromètre suivi dans l’écosystème de l’IA pour évaluer les performances des modèles.
Avec cette nouvelle version, GPT-6 Astra affiche désormais un score supérieur de quatre points à celui de son prédécesseur. Malgré cette amélioration notable, le modèle reste positionné derrière Claude Fable 5.1 d’Anthropic, qui conserve sa place en tête du classement actuel.
Cette révision souligne la complexité inhérente à l’établissement de métriques d’évaluation précises et consensuelles pour des modèles d’intelligence artificielle dont les capacités évoluent à un rythme soutenu. La quête d’une mesure objective de l’intelligence artificielle demeure un défi central pour l’industrie.
Source : The Decoder