Google accélère Gemma 4 d’un facteur trois grâce à la prédiction multi-jetons
Google améliore la vitesse de génération de texte de ses modèles Gemma 4 d’un facteur trois.
Google améliore la vitesse de génération de texte de ses modèles Gemma 4 d’un facteur trois.
SubQ AI dévoile un modèle de langage sub-quadratique capable de traiter 12 millions de tokens.
Une discussion sur Reddit a mis en lumière l’application du module `pipeline` de la bibliothèque `transformers` pour extraire les causes émotionnelles de textes.
Un développeur a créé une carte sémantique interactive des dix millions d’articles scientifiques les plus récents pour faciliter l’exploration de la recherche.
L’entreprise chinoise DeepSeek a dévoilé V4, son nouveau modèle d’IA phare, se distinguant par sa capacité à traiter des invites (prompts) significativement plus longues.
Un système RAG juridique allemand fait face à des limites récurrentes malgré sa bonne performance générale.
DeepSeek-V2 atteint un million de tokens de contexte, améliorant la capacité des agents IA à traiter de vastes informations.
La formule « Ce n’est pas seulement ceci, c’est cela » est un signe quasi certain d’écriture par IA.
Un nouvel outil, « sqz », optimise l’usage des tokens par l’IA en remplaçant les lectures répétées de fichiers par de courtes références.
Des Transformers récurrents améliorent la généralisation compositionnelle des modèles d’IA.