Les « odeurs » des LLM : identifier les problèmes des applications d’IA
Un article récent identifie les « odeurs » (smells) courantes dans les applications basées sur les grands modèles de langage (LLM), signalant des problèmes sous-jacents.
Un article récent identifie les « odeurs » (smells) courantes dans les applications basées sur les grands modèles de langage (LLM), signalant des problèmes sous-jacents.
Le 2e atelier Social Sim’26, organisé lors de COLM’26, lance un appel à contributions axé sur la fidélité et l’évaluation rigoureuse des simulations sociales basées sur les grands modèles de langage.
Un nouveau modèle de langage, le Gemma-4-Harmonia-31B-Uncensored-Heretic, issu de la fusion de plusieurs affinements du Gemma-4-31B-it, est disponible.
Hugging Face a introduit le « Delta Weight Sync », une méthode innovante pour synchroniser efficacement les modèles de langage massifs en ne transférant que les modifications.
Une nouvelle méthode permet aux agents IA locaux d’améliorer leurs performances en analysant et réécrivant leurs propres conversations.
La Norvège déploie 2 Po de stockage Huawei pour entraîner ses propres grands modèles linguistiques.
Le modèle Qwen3.6 35B A3B se distingue pour son usage en tant qu’agent IA local, surpassant d’autres alternatives selon des retours d’utilisateurs.
Des chercheurs de Microsoft alertent : les grands modèles de langage corrompent les documents lors de longs processus.
George Hotz, programmeur reconnu, estime que les agents de codage IA représenteront l’une des erreurs les plus coûteuses du développement logiciel après six mois de tests.
Un utilisateur Reddit a atteint 1000 tokens par seconde avec le modèle Qwen3.6 27B sur des GPU V100, démontrant un potentiel d’optimisation significatif.