Découpler décision et exécution pour les agents IA
Un chercheur explore une nouvelle méthodologie pour les systèmes d’agents IA, visant à séparer la prise de décision de l’exécution afin d’améliorer leur autonomie.
Un chercheur explore une nouvelle méthodologie pour les systèmes d’agents IA, visant à séparer la prise de décision de l’exécution afin d’améliorer leur autonomie.
La Linux Foundation lance la Tokenomics Foundation pour établir des normes ouvertes de facturation de l’infrastructure IA, visant à résoudre l’opacité et la complexité actuelles.
Alibaba a lancé Open Code Review, un outil en ligne de commande (CLI) qui intègre l’intelligence artificielle pour l’examen de code.
Anthropic a mis à disposition un cadre open-source, nommé « defending-code-reference-harness », pour la découverte de vulnérabilités logicielles assistée par IA.
ServiceNow AI a dévoilé EVA-Bench Data 2.0, un benchmark open source évaluant les LLM dans 213 scénarios d’entreprise complexes avec 121 outils.
Le modèle d’IA Gemma 4 12B de Google est disponible pour une installation locale, suscitant des débats sur ses performances réelles.
Pollen Robotics et Hugging Face ont intégré les outils MCP (Multi-Contact Point) au bras robotique Reachy Mini, améliorant ses capacités de manipulation d’objets.
Microsoft a lancé ASSESS, un framework open source permettant aux développeurs de créer des tests de comportement d’IA via des descriptions textuelles.
Holo3.1 est un nouveau cadre open-source permettant de créer des agents d’IA capables d’interagir rapidement et localement avec un ordinateur, simulant l’usage humain.
Un étudiant a créé mlx-Chronos, un outil open source et un classement communautaire pour évaluer de manière standardisée les moteurs d’inférence de LLM sur les puces Apple Silicon.