Les agents vocaux maîtrisent-ils le langage mêlé ?
Une étude évalue la capacité des systèmes de reconnaissance vocale à comprendre les clients parlant plusieurs langues.
Une étude évalue la capacité des systèmes de reconnaissance vocale à comprendre les clients parlant plusieurs langues.
Microsoft Lens prouve que la richesse des descriptions textuelles est clé pour entraîner des modèles de génération d’images efficaces.
Le robot Reachy Mini fonctionne désormais entièrement en local, sans connexion internet, pour une IA plus privée.
Thinking Machines développe une IA capable d’écouter et de parler simultanément, visant une interaction plus naturelle que les modèles actuels.
Un modèle IA analyse 33 000 arrêts de la Cour suprême indienne avec une précision de 97,76% pour les citations.
Google améliore la vitesse de génération de texte de ses modèles Gemma 4 d’un facteur trois.
SubQ AI dévoile un modèle de langage sub-quadratique capable de traiter 12 millions de tokens.
Une discussion sur Reddit a mis en lumière l’application du module `pipeline` de la bibliothèque `transformers` pour extraire les causes émotionnelles de textes.
Un développeur a créé une carte sémantique interactive des dix millions d’articles scientifiques les plus récents pour faciliter l’exploration de la recherche.
L’entreprise chinoise DeepSeek a dévoilé V4, son nouveau modèle d’IA phare, se distinguant par sa capacité à traiter des invites (prompts) significativement plus longues.