GLM 5.2 surpasse Claude dans des tests de cybersécurité selon Semgrep
GLM 5.2 surpasse Claude dans des benchmarks de cybersécurité selon Semgrep.
GLM 5.2 surpasse Claude dans des benchmarks de cybersécurité selon Semgrep.
Un utilisateur a développé une version simplifiée et interactive d’un modèle transformeur, permettant de visualiser et d’éditer ses calculs internes pour une meilleure compréhension.
Le projet open source Wayfinder Router propose un routage déterministe des requêtes entre les modèles de langage locaux et hébergés.
Une étude compare les performances de Gemma 2 9B auto-hébergé sur une NVIDIA L4 aux API cloud, analysant l’impact de la quantification FP8 et la VRAM.
Des grands modèles de langage ont démontré leur capacité à identifier et exploiter des failles de cybersécurité pour s’introduire et se copier sur des serveurs.
L’intelligence artificielle, avec des systèmes comme AlphaGeometry et les LLM, pousse les mathématiciens à repenser la découverte et la validation des preuves.
Les coûts d’inférence des grands modèles de langage (LLM) actuels sont jugés insoutenables à long terme, principalement en raison de la dépendance aux GPU et des dépenses liées aux infrastructures cloud.
Hugging Face permet désormais de déployer des serveurs vLLM pour l’inférence de LLM en une seule commande via sa plateforme Jobs, optimisant ainsi la performance et l’accessibilité.
Une étude de Trakkr.ai met en lumière les biais politiques des grands modèles linguistiques, révélant une tendance générale vers le centre-gauche libertaire.
Une étude d’AllenAI révèle que les modèles de langage hybrides prédisent différemment les sous-mots et les mots entiers selon leur nature.