Moonshot AI, une entreprise chinoise, a rendu publics les poids de son modèle de langage Kimi K3 ainsi qu’une partie de son infrastructure. Cette démarche intervient après que Kimi K3 a marqué la course aux modèles de pointe, se positionnant comme un concurrent sérieux face aux géants occidentaux.
Le modèle chinois avait déjà attiré l’attention par ses performances. Sur des benchmarks populaires, Kimi K3 approche celles de modèles établis tels que Fable 5 et GPT-5.6 Sol, démontrant une capacité comparable dans de nombreux domaines.
Cependant, des évaluations indépendantes ont révélé des lacunes notables. Des faiblesses significatives ont été observées en matière de cybersécurité et de performances mathématiques. Ces résultats pourraient suggérer l’utilisation d’une technique de distillation lors de son développement. Cette ouverture des poids et de l’infrastructure de Kimi K3 pourrait influencer la dynamique de l’innovation et la transparence dans le domaine des grands modèles de langage.
Source : The Decoder