GLM-5.2 : Un modèle conçu pour les tâches à long terme
Le modèle GLM-5.2 de Zhipu AI est optimisé pour les tâches à long terme, améliorant la gestion de contextes étendus et la cohérence sur des séquences d’informations prolongées.
Le modèle GLM-5.2 de Zhipu AI est optimisé pour les tâches à long terme, améliorant la gestion de contextes étendus et la cohérence sur des séquences d’informations prolongées.
Google DeepMind lance DiffusionGemma, un modèle IA générant du texte quatre fois plus vite grâce à une nouvelle approche.
DeepMind présente DiffusionGemma, un modèle de langage générant du texte quatre fois plus rapidement.
Les garde-fous du modèle Fable d’Anthropic jugés trop stricts par les chercheurs en cybersécurité.
Anthropic dévoile Claude Fable 5, un modèle IA très performant mais cher et soumis à de stricts filtres de sécurité.
Anthropic déploie Claude Fable 5, un nouveau modèle basé sur son IA la plus puissante, Mythos, mais avec une disponibilité temporaire pour les utilisateurs.
Le modèle open-source Qwen3.7Max, basé sur l’architecture MoE, démontre des performances remarquables pour sa taille, défiant des modèles plus grands.
NVIDIA Nemotron 3.5 ASR peut désormais être affiné pour s’adapter à des langues, domaines ou accents spécifiques, grâce à Hugging Face.
JetBrains présente Mellum2, un modèle d’IA innovant de 12 milliards de paramètres basé sur l’architecture Mixture-of-Experts.
NVIDIA a publié une version quantifiée du modèle de langage Qwen3.6-35B-A3B d’Alibaba, optimisée pour des performances d’inférence accrues.