Visualisation hyperbolique du vocabulaire de GPT-2
Une nouvelle visualisation interactive permet d’explorer les 32 070 tokens du vocabulaire de GPT-2 sous la forme d’un arbre hyperbolique dans une boule de Poincaré.
Une nouvelle visualisation interactive permet d’explorer les 32 070 tokens du vocabulaire de GPT-2 sous la forme d’un arbre hyperbolique dans une boule de Poincaré.
Les détecteurs de texte IA peinent à identifier les contenus générés par des modèles de langage lorsqu’ils imitent le style d’un auteur, avec un taux d’échec pouvant atteindre 48 % pour l’écriture scientifique.
Le futur modèle Kimi 3 de Moonshot, avec 2 à 3 billions de paramètres, est attendu pour concurrencer directement Opus 4.8 d’Anthropic, selon TechCrunch AI.
Une analyse de Hugging Face révèle que la stratégie de « chaîne de pensée » (CoT) maintient un avantage significatif pour les performances des modèles de langage avancés, comme GPT-4 et Claude 3 Opus.
Anthropic a récemment dévoilé une méthode permettant d’observer les « pensées internes » de son modèle d’IA Claude lors de ses processus de raisonnement.
Une étude évalue l’entropie de l’espace J, une mesure interne aux modèles de langage, comme un indicateur potentiel d’erreurs, complétant la confiance des modèles.
OpenAI a temporairement assoupli les limites d’utilisation de son modèle GPT-5.6 Sol suite à une forte augmentation de la demande.
Un employé d’OpenAI a détaillé l’utilisation des cinq niveaux de raisonnement de GPT-5.6 Sol, allant de « Light » à « xhigh », pour optimiser les tâches.
OpenAI a annoncé GPT-5.6, une nouvelle version de son modèle d’IA, promettant plus d’intelligence par jeton, une meilleure performance économique et des capacités accrues pour les tâches complexes.
OpenAI va lancer publiquement son nouveau modèle d’IA, GPT-5.6, ce jeudi, après un déploiement limité à des partenaires américains à la demande de Washington.