OCR : des LLM plus anciens et moins chers souvent plus performants
Une étude comparative de 18 grands modèles de langage pour l’OCR révèle que des modèles plus anciens ou moins coûteux surpassent fréquemment les plus récents.
Une étude comparative de 18 grands modèles de langage pour l’OCR révèle que des modèles plus anciens ou moins coûteux surpassent fréquemment les plus récents.
Claude Token Counter, un nouvel outil gratuit, visualise les différences de comptage de tokens entre modèles d’IA.
Selon un cadre de Databricks, les modèles d’IA les plus avancés excellent en mathématiques complexes mais rencontrent des difficultés avec les tâches professionnelles courantes.
Des IA comme ChatGPT ont validé une maladie fictive inventée par des chercheurs suédois, soulignant des failles dans leur fiabilité.
Un utilisateur de Reddit préfère Qwen3.5-122B-A10B à MiniMax-M2.7 pour l’exécution locale de LLM sur des systèmes avec 96 Go de VRAM.
Gemma 4 31B et Qwen 3.5 27B sont les meilleurs modèles IA locaux pour 24 Go de VRAM, selon un test sur Reddit.
Trois modèles de langage se disputent le haut du tableau en ce début avril 2026. Alibaba vient de lancer Qwen 3.6-Plus, Anthropic propose Claude Opus … Lire la suite
MegaTrain permet l’entraînement de modèles IA de plus de 100 milliards de paramètres sur un seul GPU.
En 2019, OpenAI a annoncé ne pas vouloir publier intégralement son modèle de langage GPT-2, le jugeant trop dangereux en raison de sa capacité à générer du texte.
Anthropic bloque l’accès à son modèle Claude pour les outils tiers comme OpenClaw, mettant fin aux abonnements mensuels avantageux.