Liquid AI dévoile son modèle MoE 8B-A1B entraîné sur 38T de tokens
Liquid AI a lancé LFM-2.5 8B-A1B, un modèle Mixture-of-Experts de 8 milliards de paramètres entraîné sur 38 trillions de tokens, visant l’efficacité et la performance.
Liquid AI a lancé LFM-2.5 8B-A1B, un modèle Mixture-of-Experts de 8 milliards de paramètres entraîné sur 38 trillions de tokens, visant l’efficacité et la performance.
Anthropic lance Claude Opus 4.8, six semaines après la version précédente, et promet une surprise.
Un nouveau modèle de langage, le Gemma-4-Harmonia-31B-Uncensored-Heretic, issu de la fusion de plusieurs affinements du Gemma-4-31B-it, est disponible.
Un nouveau modèle, MiMo-V2.5-coder, est proposé comme alternative aux modèles existants pour le codage, nécessitant 128 Go de mémoire vive.
L’entreprise canadienne Cohere a mis en open source Command A+, son modèle de langage le plus puissant à ce jour, sous licence Apache 2.0.
Le modèle CyberSecQwen-4B, petit et spécialisé, offre une solution d’IA locale pour renforcer la cybersécurité défensive, répondant aux enjeux de confidentialité et de ressources.
Le PDG d’Anthropic, Dario Amodei, a exprimé sa surprise face à la croissance fulgurante de son modèle d’IA Claude, qui a dépassé de loin les prévisions initiales.
Mistral AI unifie chat, raisonnement et code dans son nouveau modèle Medium 3.5 et enrichit ses outils.
Talkie-1930, un LLM entraîné uniquement sur des textes d’avant 1931, imagine un monde sans événements majeurs du XXe siècle.
ChatGPT affirme avoir résolu une énigme logique simple qui avait auparavant mis en évidence ses difficultés.