L’armée américaine à court de jetons d’IA
L’armée américaine a alerté ses membres sur l’épuisement rapide de leurs jetons d’IA, les incitant à limiter leur utilisation pour éviter des coûts excessifs.
L’armée américaine a alerté ses membres sur l’épuisement rapide de leurs jetons d’IA, les incitant à limiter leur utilisation pour éviter des coûts excessifs.
Adam Mosseri, responsable d’Instagram chez Meta, estime que les entreprises devront bientôt gérer les dépenses en jetons d’IA par ingénieur, à l’instar des salaires.
La startup française ZML a lancé ZML/LLMD, un logiciel gratuit qui accélère l’inférence d’IA sur de multiples puces, réduisant potentiellement les coûts.
L’outil open-source pxpipe permet de réduire les coûts d’utilisation des modèles d’IA comme Claude Code et Fable 5 jusqu’à 70 % en convertissant les requêtes textuelles en images PNG.
Anthropic, acteur majeur de l’IA, explorerait la fabrication de puces IA personnalisées avec Samsung pour réduire ses coûts d’infrastructure, tout en maintenant son partenariat avec Nvidia.
Le nouveau modèle Claude Sonnet 5 d’Anthropic, plus performant, consomme environ 40% de tokens supplémentaires par tâche, augmentant les coûts réels.
La startup Lindy a remplacé le modèle Claude d’Anthropic par Deepseek, réalisant des économies de plusieurs millions de dollars face à l’augmentation de ses coûts d’IA.
Les coûts d’inférence des grands modèles de langage (LLM) actuels sont jugés insoutenables à long terme, principalement en raison de la dépendance aux GPU et des dépenses liées aux infrastructures cloud.
Un enregistrement interne d’Accenture révèle des inquiétudes sur l’explosion des coûts de l’IA et la difficulté à mesurer son efficacité.
OpenAI introduit de nouveaux outils d’analyse d’utilisation et de contrôle des dépenses pour ChatGPT Enterprise, aidant les entreprises à gérer leurs coûts et à déployer l’IA avec confiance.