DeepMind : les générateurs vidéo, clés des modèles du monde pour la vision
Google DeepMind a démontré que les générateurs vidéo pourraient déjà posséder les « modèles du monde » manquants à la vision par ordinateur, avec moins de données.
Google DeepMind a démontré que les générateurs vidéo pourraient déjà posséder les « modèles du monde » manquants à la vision par ordinateur, avec moins de données.
Alexandre LeBrun, PDG d’AMI Labs, la startup de Yann LeCun, refuse d’employer les termes d’« intelligence artificielle générale » (AGI) ou de « superintelligence » pour décrire ses travaux.
Les entreprises d’IA explorent les « modèles du monde » pour doter leurs systèmes d’une compréhension de l’environnement externe, au-delà des capacités des LLM.
Une nouvelle approche, le Zero-shot World Model (ZWM), réduit significativement l’écart entre la quantité de données nécessaire à l’IA et à un enfant humain pour acquérir des compétences visuelles.