Google développe la puce « Frozen v2 » pour optimiser Gemini

Google travaillerait sur une puce serveur nommée « Frozen v2 », intégrant directement l’architecture de son modèle d’intelligence artificielle Gemini pour des gains d’efficacité substantiels.

Selon des sources internes citées par The Decoder, cette puce, conçue spécifiquement pour les serveurs, pourrait être 6 à 10 fois plus efficace que les Unités de Traitement Tensoriel (TPU) actuelles de Google. Cette intégration matérielle, où l’architecture de Gemini est « gravée » dans le silicium, vise à optimiser de manière significative l’exécution des tâches d’inférence des modèles d’IA.

Prévue pour un déploiement en 2028, « Frozen v2 » aurait pour objectif principal de réduire drastiquement les coûts d’inférence de l’IA pour l’entreprise. Une telle avancée technologique pourrait offrir à Google un avantage concurrentiel significatif en termes de prix face à ses rivaux majeurs sur le marché de l’IA, tels qu’OpenAI et Anthropic.

L’intégration directe de l’architecture d’un modèle d’IA dans le silicium pourrait ainsi redéfinir les stratégies de déploiement et l’économie des grands modèles linguistiques.

Source : The Decoder

Catégories : Brèves IA
← Article précédentOpenAI partage ses leçons sur la sécurité des modèles d'IA à long termeArticle suivant →Les conseillers IA de Trump divisés sur les modèles chinois

Restez informé de l'actualité IA

Recevez chaque semaine notre sélection des meilleures analyses sur l'intelligence artificielle.

Pas de spam. Désinscription en un clic.

Laisser un commentaire

FR EN ES