Un nouveau codec vidéo, MLVC (Multi-platform Learned Video Codec), a été développé pour le déploiement multiplateforme, cherchant à intégrer l’intelligence artificielle dans un domaine encore dominé par les systèmes traditionnels.
Malgré la présence omniprésente de l’IA dans de nombreux secteurs, les codecs vidéo couramment utilisés, tels que H.264, H.265 et AV1, restent des systèmes conçus manuellement. Quatorze ans après l’impulsion donnée par AlexNet pour le remplacement des systèmes « faits à la main » par des réseaux neuronaux, ces codecs traditionnels prévalent toujours dans les applications réelles.
Cette persistance s’explique principalement par des considérations de puissance de calcul et d’efficacité énergétique. Les codecs neuronaux tendent à être volumineux et gourmands en énergie, tandis que leurs homologues traditionnels bénéficient d’une accélération matérielle quasi universelle. Le projet MLVC vise à surmonter ces défis pour une adoption plus large.
L’intégration réussie de codecs vidéo basés sur l’apprentissage automatique pourrait transformer la manière dont le contenu numérique est compressé et diffusé.
Source : Reddit r/MachineLearning