L’IA dessine la Joconde : GPT-4, Claude et Grok à l’épreuve des crayons
Une étude récente a comparé les capacités de GPT-4, Claude, Gemini et Grok à générer des instructions détaillées pour dessiner la Joconde aux crayons de couleur.
Une étude récente a comparé les capacités de GPT-4, Claude, Gemini et Grok à générer des instructions détaillées pour dessiner la Joconde aux crayons de couleur.
Un nouveau cadre d’entraînement, baptisé « Harness Training », permet d’améliorer les capacités des modèles de langage de manière agnostique au modèle et à l’environnement de tâche.
Une nouvelle étude révèle que l’intelligence artificielle est plus susceptible que les humains de développer des biais lors des processus de recrutement.
Des modèles de langage de grande taille (LLM) à poids ouverts ont démontré leur capacité à réussir l’examen de licence médicale suédois, marquant une avancée notable.
Le Département de la Marine des États-Unis a officialisé une stratégie visant à « militariser » l’IA, considérant la lenteur d’adoption comme un risque majeur.
Capital One a rendu open source VulnHunter, un outil d’IA agentique qui automatise la détection et la correction des vulnérabilités de sécurité dans le code.
Des modèles d’intelligence artificielle ont identifié plusieurs vulnérabilités potentielles dans le code de ZkVM d’OpenVM, une machine virtuelle à connaissance nulle.
Une nouvelle méthode nommée ExTernD améliore la quantification ternaire des LLM, permettant une précision élevée avec une légère augmentation de la VRAM.
OpenAI a révélé GPT-Red, un LLM « super-hacker » destiné à tester et renforcer la sécurité de ses modèles d’IA en simulant des attaques internes.
Une analyse de Hugging Face révèle que la stratégie de « chaîne de pensée » (CoT) maintient un avantage significatif pour les performances des modèles de langage avancés, comme GPT-4 et Claude 3 Opus.