GPUHedge réduit la latence des GPU serverless de 117s à 30s
GPUHedge, un nouvel outil open source, réduit drastiquement la latence de démarrage à froid des GPU serverless, améliorant le p95 de 117 à 30 secondes.
GPUHedge, un nouvel outil open source, réduit drastiquement la latence de démarrage à froid des GPU serverless, améliorant le p95 de 117 à 30 secondes.
Selon Clem Delangue, PDG de Hugging Face, les entreprises se détournent des solutions d’IA propriétaires au profit de l’open source, privilégiant l’autonomie.
Ollama, l’outil open source pour l’IA sur PC, a levé 65 millions de dollars et compte désormais près de 9 millions d’utilisateurs.
Databricks a choisi le modèle open-source chinois GLM 5.2 comme moteur de codage par défaut, après qu’il ait égalé les performances d’Anthropic Opus 4.8 à un coût inférieur.
Un utilisateur de Reddit a créé un outil CLI open source, « gpu-price-finder », pour dénicher les locations de GPU les moins chères face à des écarts de prix allant jusqu’à cinq fois pour le même matériel.
NVIDIA et Hugging Face ont intégré de nouveaux modèles et frameworks à LeRobot, une bibliothèque open source de Hugging Face dédiée au développement robotique.
Un développeur a publié SimpleGrad, une bibliothèque Python d’autodifférenciation inspirée de PyTorch, conçue pour l’apprentissage des modèles d’IA.
Cohere a lancé Transcribe Arabic, un modèle open source de reconnaissance vocale surpassant Whisper et OmniASR sur les dialectes et le bilinguisme arabo-anglais.
Un nouveau système de mémoire hiérarchique open-source nommé TRACE a démontré une performance significativement supérieure pour les agents LLM, atteignant 82,5 % sur le benchmark MemoryAgentBench.
La version 0.6.0 de la bibliothèque LeRobot introduit des outils pour imaginer, évaluer et améliorer les modèles de robotique d’apprentissage.