Jalapeño d’OpenAI : des performances d’inférence IA record
OpenAI a présenté Jalapeño, sa puce d’inférence personnalisée, affichant une vitesse et une efficacité record pour l’IA, promettant un débit supérieur et une latence réduite.
OpenAI a présenté Jalapeño, sa puce d’inférence personnalisée, affichant une vitesse et une efficacité record pour l’IA, promettant un débit supérieur et une latence réduite.
JPMorgan Chase a choisi la startup SambaNova Systems comme partenaire d’infrastructure pour déployer ses systèmes d’inférence d’IA directement sur ses propres serveurs.
La startup française ZML a lancé ZML/LLMD, un logiciel gratuit qui accélère l’inférence d’IA sur de multiples puces, réduisant potentiellement les coûts.
La startup Baseten, spécialisée dans l’inférence d’IA, serait sur le point de finaliser une levée de fonds de 1,5 milliard de dollars, la valorisant à 13 milliards.
Groq, fabricant de puces, chercherait à lever 650 millions de dollars en financement interne et pivote vers l’inférence d’IA, selon Axios.
La demande d’inférence IA reste soutenue, selon Eric Vishria de Benchmark, soulignant les défis d’infrastructure.