ChatGPT réduit le travail d’ATV Big Air Tour de jours en heures
ATV Big Air Tour a transformé trois jours de travail en trois heures grâce à ChatGPT, optimisant marketing et merchandising, et créant un site d’inventaire en 15 minutes.
ATV Big Air Tour a transformé trois jours de travail en trois heures grâce à ChatGPT, optimisant marketing et merchandising, et créant un site d’inventaire en 15 minutes.
Une analyse récente explore la « frontière efficiente » de l’inférence des grands modèles de langage (LLM) pour optimiser leur rapport performance-coût.
Nvidia étend son avantage en intelligence artificielle au-delà des seuls processeurs graphiques, optimisant les centres de données par une gestion intelligente du trafic.
Drew Breunig observe que le coût élevé de modèles d’IA avancés comme Fable pousse à une réévaluation des stratégies de développement et de l’optimisation du code, privilégiant parfois des alternatives « suffisamment bonnes » et moins chères.
Les modèles de langage locaux (LLM) semblent moins intelligents que leur potentiel réel en raison de la quantification, des contraintes matérielles et du manque d’optimisations avancées.
Les modèles LFM2.5-DSpark de LiquidAI permettent une inférence jusqu’à 3,2 fois plus rapide, offrant une efficacité accrue pour les grands modèles de langage.
NVIDIA intègre ChatGPT Work afin de réduire les tâches manuelles, de connecter rapidement les signaux et de déployer des flux de travail efficaces à l’échelle mondiale.
Dharma AI a démontré qu’une simple réorganisation de l’ordonnancement des tâches peut augmenter l’utilisation des GPU de 33 points de pourcentage.
La startup française Kog conteste la perception que les GPU sont inadaptés aux flux de travail agentiques, affirmant pouvoir optimiser leur inférence.
Après avoir dépensé des millions en IA, Rippling lance l’AI Spend Console pour permettre aux entreprises de suivre et d’optimiser les dépenses d’IA de leurs employés.