Une récente analyse révèle que le modèle GPT-4, accessible via ChatGPT Plus, dispose désormais d’une base de connaissances s’étendant jusqu’à juin 2024, tandis que les modèles Claude 3 d’Anthropic sont limités à août 2023.
Les grands modèles de langage (LLM) sont entraînés sur d’immenses volumes de données collectées jusqu’à une date précise, appelée « date de coupure des connaissances » (knowledge cutoff). Une étude menée par sshh.io a exploré ces limites temporelles pour plusieurs modèles phares. L’auteur a utilisé des requêtes ciblées sur des événements récents et des faits datés pour évaluer la fraîcheur des informations disponibles.
Les résultats indiquent une mise à jour significative pour GPT-4, dont la connaissance s’étend désormais jusqu’à juin 2024, marquant une amélioration notable par rapport aux précédentes coupures. En revanche, les versions Claude 3 (Opus, Sonnet, Haiku) d’Anthropic partagent une date de coupure commune autour d’août 2023. Cette différence souligne l’importance pour les utilisateurs de comprendre les limites temporelles des LLM lorsqu’ils recherchent des informations d’actualité.
Ces dates de coupure ne sont pas toujours absolues et peuvent varier légèrement selon la nature des questions posées. Elles rappellent que les LLM sont des « instantanés » de données à un moment donné, et non des sources d’information en temps réel. La fréquence des mises à jour des bases de connaissances reste un facteur clé dans l’utilité et la pertinence de ces intelligences artificielles.
Comprendre ces échéances est essentiel pour évaluer la fiabilité des réponses générées face à l’évolution constante du monde.
Source : Hacker News (Algolia)