Google travaillerait sur une puce serveur nommée « Frozen v2 », intégrant directement l’architecture de son modèle d’intelligence artificielle Gemini pour des gains d’efficacité substantiels.
Selon des sources internes citées par The Decoder, cette puce, conçue spécifiquement pour les serveurs, pourrait être 6 à 10 fois plus efficace que les Unités de Traitement Tensoriel (TPU) actuelles de Google. Cette intégration matérielle, où l’architecture de Gemini est « gravée » dans le silicium, vise à optimiser de manière significative l’exécution des tâches d’inférence des modèles d’IA.
Prévue pour un déploiement en 2028, « Frozen v2 » aurait pour objectif principal de réduire drastiquement les coûts d’inférence de l’IA pour l’entreprise. Une telle avancée technologique pourrait offrir à Google un avantage concurrentiel significatif en termes de prix face à ses rivaux majeurs sur le marché de l’IA, tels qu’OpenAI et Anthropic.
L’intégration directe de l’architecture d’un modèle d’IA dans le silicium pourrait ainsi redéfinir les stratégies de déploiement et l’économie des grands modèles linguistiques.
Source : The Decoder