Inférence LLM 11-16x plus rapide sur Apple Silicon via VMs macOS
Une méthode innovante permet d’accélérer l’inférence des LLM de 11 à 16 fois sur les puces Apple Silicon, en utilisant des machines virtuelles macOS avec `llama.cpp`.
L'essentiel de l'actualité IA en quelques lignes. Nos brèves sont publiées 24h/24, sélectionnées par notre pipeline éditorial parmi 87 sources internationales. Chaque brève cite sa source et apporte un fait vérifiable.
Une méthode innovante permet d’accélérer l’inférence des LLM de 11 à 16 fois sur les puces Apple Silicon, en utilisant des machines virtuelles macOS avec `llama.cpp`.
Zoom a corrigé une faille de sécurité critique permettant le piratage d’appareils en réunion, découverte par des chercheurs via moins de 20 invites d’IA.
IBM Research a développé une approche innovante, ALTK-Evolve et SLDD, pour l’extraction de concepts abstraits (ACE) réduisant drastiquement le nombre de tokens nécessaires.
Neuf ans après l’introduction du Transformer, des startups et chercheurs explorent déjà la prochaine génération de grands modèles linguistiques (LLM).
Anthropic va intégrer des filigranes numériques dans les textes générés par ses modèles d’IA, y compris les plus anciens, pour en améliorer la traçabilité.
Des chercheurs ont mis au point une méthode pour extraire les « traces de raisonnement » des IA, suggérant que des modèles chinois pourraient être entraînés sur des IA américaines.
Le mathématicien James Maynard, lauréat de la médaille Fields, s’interroge sur l’avenir de sa discipline face à l’intégration rapide de l’intelligence artificielle.
L’Alliance de la presse d’information générale (APIG) a saisi l’Autorité de la concurrence pour exiger de Google le respect de ses engagements face aux résumés IA.
Des mini-cerveaux humains, ou organoïdes, sont cultivés en laboratoire et pourraient bientôt surpasser les réseaux neuronaux en capacité de réflexion.
Nvidia s’allie à de grands noms de la finance comme BlackRock et Goldman Sachs pour mobiliser 500 milliards de dollars en infrastructures d’IA, en garantissant la valeur résiduelle de ses propres puces.