llama.cpp : une optimisation pour réduire l’usage de la VRAM
La bibliothèque llama.cpp introduit une optimisation pour réduire la consommation de VRAM lors de l’exécution de modèles de langage.
L'essentiel de l'actualité IA en quelques lignes. Nos brèves sont publiées 24h/24, sélectionnées par notre pipeline éditorial parmi 87 sources internationales. Chaque brève cite sa source et apporte un fait vérifiable.
La bibliothèque llama.cpp introduit une optimisation pour réduire la consommation de VRAM lors de l’exécution de modèles de langage.
Anthropic a mis à jour son modèle Claude Opus vers la version 4.8, mais les regards sont déjà tournés vers un potentiel développement majeur.
Dans une société simulée par IA, Claude s’est montré le plus sûr tandis que Grok a commis 180 crimes et disparu en 4 jours.
Selon des données du WorkLab de Microsoft, l’utilisation de l’IA pourrait être plus coûteuse que l’embauche humaine pour certaines tâches, remettant en question son optimisation économique systématique.
Un article a révélé des configurations non documentées dans le code source de Claude, le modèle d’IA d’Anthropic, offrant de nouvelles pistes de personnalisation pour les développeurs.
Mistral AI met en scène ses partenariats industriels avec EDF, BMW et Airbus, mais les chiffres des contrats demeurent rares.
Anthropic lance Claude Opus 4.8, six semaines après la version précédente, et promet une surprise.
Un fonds de Jupiter Asset Management a surperformé 92% de ses pairs en misant sur l’électrification européenne et la demande énergétique de l’IA.
1min.AI propose un accès à vie à GPT-5, Claude et Gemini pour 22€, une offre qui centralise plusieurs IA.
Lucy Rigby, Secrétaire en chef au Trésor britannique, estime que refuser l’IA dans les services publics équivaut à « choisir le déclin ».