Les données de startups disparues vendues pour entraîner des IA
Les données internes de startups fermées, comme Slack ou les emails, sont désormais mises en vente pour entraîner des modèles d’IA.
Les données internes de startups fermées, comme Slack ou les emails, sont désormais mises en vente pour entraîner des modèles d’IA.
Un utilisateur de Reddit a rapporté que la version MLX du modèle Gemma 4 ne semble pas offrir de meilleures performances que sa contrepartie GGUF lors de tests locaux.
Un développeur a conçu un jeu de conduite expérimental qui utilise un modèle de monde miniature pour interpréter des photos et des dessins, fonctionnant directement sur iPad.
Cloudflare publie Unweight, un outil open-source qui compresse les LLM de 15-22% sans perte de précision.
Un utilisateur de Reddit a publié une analyse comparative des modèles « abliterated » de HauhauCS, Heretic et Huihui face aux modèles Qwen 3/3.5, suscitant des réactions dans la communauté.
La conférence PyCon US se tiendra du 13 au 19 mai à Long Beach, Californie, marquant son retour sur la côte ouest depuis 2017 et en Californie depuis 2013.
Nemotron-OCR v2, un modèle OCR multilingue rapide et performant, est désormais disponible.
NVIDIA lance GR00T, un modèle de langage visuel open-source pour robots humanoïdes.
La nouvelle variante Qwen3.6-35B-A3B « Uncensored Aggressive » est disponible, offrant un modèle linguistique sans aucune restriction de contenu ni perte de capacités.
Hugging Face facilite l’entraînement de modèles d’IA multimodaux avec Sentence Transformers.