Google Gemini, dans ses versions 3.1 à 3.8, se distingue par une consommation de tokens et un coût par requête inférieurs à ceux de ses concurrents sur le marché de l’intelligence artificielle. Le prix moyen d’une requête sur ces modèles s’établit à environ 1,2 centime, ce qui le positionne avantageusement face aux offres d’Anthropic et d’OpenAI. Cette efficacité économique représente un atout majeur pour les développeurs et les entreprises cherchant à optimiser leurs dépenses en IA.
Cependant, cette compétitivité tarifaire s’accompagne de certaines lacunes en matière de performance. Des tests ont révélé que Gemini ne parvient pas à répondre correctement au prompt « Extension », un type de requête complexe où ses concurrents comme Claude et ChatGPT montrent de meilleures performances et une plus grande fiabilité.
Cette observation souligne que l’optimisation des coûts et de la consommation de ressources ne garantit pas une polyvalence totale des modèles. Les utilisateurs doivent donc évaluer attentivement les capacités de Gemini en fonction de leurs besoins spécifiques et des tâches à accomplir. La question demeure de savoir comment Google adressera ces écarts de performance dans ses futures itérations de ses modèles d’IA.
Source : Next.ink