DiffusionGemma : Google accélère la génération de texte IA
Google DeepMind lance DiffusionGemma, un modèle IA générant du texte quatre fois plus vite grâce à une nouvelle approche.
Google DeepMind lance DiffusionGemma, un modèle IA générant du texte quatre fois plus vite grâce à une nouvelle approche.
DeepMind présente DiffusionGemma, un modèle de langage générant du texte quatre fois plus rapidement.
Les garde-fous du modèle Fable d’Anthropic jugés trop stricts par les chercheurs en cybersécurité.
Anthropic dévoile Claude Fable 5, un modèle IA très performant mais cher et soumis à de stricts filtres de sécurité.
Anthropic déploie Claude Fable 5, un nouveau modèle basé sur son IA la plus puissante, Mythos, mais avec une disponibilité temporaire pour les utilisateurs.
Le modèle open-source Qwen3.7Max, basé sur l’architecture MoE, démontre des performances remarquables pour sa taille, défiant des modèles plus grands.
NVIDIA Nemotron 3.5 ASR peut désormais être affiné pour s’adapter à des langues, domaines ou accents spécifiques, grâce à Hugging Face.
JetBrains présente Mellum2, un modèle d’IA innovant de 12 milliards de paramètres basé sur l’architecture Mixture-of-Experts.
NVIDIA a publié une version quantifiée du modèle de langage Qwen3.6-35B-A3B d’Alibaba, optimisée pour des performances d’inférence accrues.
Liquid AI a lancé LFM-2.5 8B-A1B, un modèle Mixture-of-Experts de 8 milliards de paramètres entraîné sur 38 trillions de tokens, visant l’efficacité et la performance.