llama.cpp : une optimisation pour réduire l’usage de la VRAM
La bibliothèque llama.cpp introduit une optimisation pour réduire la consommation de VRAM lors de l’exécution de modèles de langage.
La bibliothèque llama.cpp introduit une optimisation pour réduire la consommation de VRAM lors de l’exécution de modèles de langage.
Un nouveau modèle de langage, le Gemma-4-Harmonia-31B-Uncensored-Heretic, issu de la fusion de plusieurs affinements du Gemma-4-31B-it, est disponible.
SQLite intègre un fichier AGENTS.md, potentiellement pour faciliter l’interaction des agents IA avec son code source.
Les modèles d’IA de pointe, tels que GPT-4 et Claude 3 Opus, obtiennent des scores inférieurs à 50 % sur ITBench-AA, le premier benchmark évaluant leurs capacités pour les tâches informatiques d’entreprise autonomes.
Le robot Reachy Mini fonctionne désormais entièrement en local, sans connexion internet, pour une IA plus privée.
Hugging Face a introduit le « Delta Weight Sync », une méthode innovante pour synchroniser efficacement les modèles de langage massifs en ne transférant que les modifications.
OpenMOSS-Team lance MOSS-TTS v1.5, une mise à jour de son outil de synthèse vocale open source.
Une nouvelle méthode permet aux agents IA locaux d’améliorer leurs performances en analysant et réécrivant leurs propres conversations.
PrismML a lancé les modèles Bonsai Image 4B, des transformeurs de diffusion texte-image binaires et ternaires capables de fonctionner entièrement localement dans un navigateur via WebGPU.
Le modèle Qwen3.6 35B A3B se distingue pour son usage en tant qu’agent IA local, surpassant d’autres alternatives selon des retours d’utilisateurs.