Des modèles IA 4 bits surpassent leurs originaux pleine précision
Une nouvelle technique, nommée « Quantization-Aware Healing », permet de créer des modèles d’intelligence artificielle compressés à 4 bits qui surpassent les performances de leurs versions originales en pleine précision.