Un LLM de 28,9M de paramètres tourne sur un microcontrôleur à 8 $
Un modèle de langage de 28,9 millions de paramètres a été exécuté avec succès sur un microcontrôleur ESP32-S3, coûtant environ 8 dollars, ouvrant la voie à l’IA embarquée.
Un modèle de langage de 28,9 millions de paramètres a été exécuté avec succès sur un microcontrôleur ESP32-S3, coûtant environ 8 dollars, ouvrant la voie à l’IA embarquée.
Debian a organisé un vote pour définir sa position officielle concernant l’utilisation des grands modèles de langage (LLM) au sein de son projet.
Une étude récente a comparé les capacités de GPT-4, Claude, Gemini et Grok à générer des instructions détaillées pour dessiner la Joconde aux crayons de couleur.
Un nouveau cadre d’entraînement, baptisé « Harness Training », permet d’améliorer les capacités des modèles de langage de manière agnostique au modèle et à l’environnement de tâche.
Une nouvelle étude révèle que l’intelligence artificielle est plus susceptible que les humains de développer des biais lors des processus de recrutement.
Des modèles de langage de grande taille (LLM) à poids ouverts ont démontré leur capacité à réussir l’examen de licence médicale suédois, marquant une avancée notable.
Le Département de la Marine des États-Unis a officialisé une stratégie visant à « militariser » l’IA, considérant la lenteur d’adoption comme un risque majeur.
Capital One a rendu open source VulnHunter, un outil d’IA agentique qui automatise la détection et la correction des vulnérabilités de sécurité dans le code.
Des modèles d’intelligence artificielle ont identifié plusieurs vulnérabilités potentielles dans le code de ZkVM d’OpenVM, une machine virtuelle à connaissance nulle.
Une nouvelle méthode nommée ExTernD améliore la quantification ternaire des LLM, permettant une précision élevée avec une légère augmentation de la VRAM.