Les benchmarks LLM mesurent-ils la mémorisation plutôt que le raisonnement ?
Une étude d’AllenAI, relayée par Hugging Face, révèle que les benchmarks actuels des LLM mesurent souvent la mémorisation plutôt que la véritable capacité de raisonnement.
Une étude d’AllenAI, relayée par Hugging Face, révèle que les benchmarks actuels des LLM mesurent souvent la mémorisation plutôt que la véritable capacité de raisonnement.
AllenAI et Hugging Face annoncent la disponibilité des exportations d’embeddings personnalisés depuis OlmoEarth Studio pour l’analyse de données géospatiales.
AllenAI et Hugging Face lancent OlmoEarth, une plateforme open-source dédiée à l’inférence géospatiale sur des données satellites à l’échelle mondiale.
AllenAI a partagé les enseignements clés tirés du développement de Shippy, un agent d’IA, offrant des perspectives sur la conception d’agents autonomes.
Une étude d’AllenAI révèle que les modèles de langage hybrides prédisent différemment les sous-mots et les mots entiers selon leur nature.
AllenAI, via le blog HuggingFace, a présenté olmo-eval, un environnement d’évaluation conçu pour optimiser le cycle de développement des modèles d’intelligence artificielle.
AllenAI a lancé OlmoEarth v1.1, une nouvelle famille de modèles d’intelligence artificielle caractérisée par une efficacité améliorée.
Une nouvelle architecture d’IA, EMO, présentée par AllenAI sur HuggingFace, démontre une capacité inédite à développer une modularité spontanée lors du pré-entraînement.