Probably lève 9 M$ pour une IA plus fiable et sans erreurs
La startup Probably a levé 9 millions de dollars pour développer une IA plus fiable, visant une précision comparable aux systèmes déterministes et sans hallucinations.
La startup Probably a levé 9 millions de dollars pour développer une IA plus fiable, visant une précision comparable aux systèmes déterministes et sans hallucinations.
Un cabinet d’audit majeur a publié un rapport sur les atouts de l’IA qui contiendrait des erreurs générées par l’intelligence artificielle elle-même.
KPMG a retiré un rapport sur l’utilisation de l’IA après la découverte d’hallucinations, soulignant la difficulté de l’IA à produire des informations fiables sur elle-même.
Un utilisateur de Numerama a failli perdre son coach sportif à cause d’un bug de Google Gemini, soulignant les défis de l’intégration de l’IA dans le quotidien.
Sponsio, une nouvelle couche de contrat déterministe, est proposée pour fiabiliser l’exécution des agents LLM en production en garantissant le respect des règles d’appel d’outils.
Une étude récente révèle la difficulté des agents LLM à maintenir les contraintes lors de la génération de code backend, un phénomène appelé « déclin des contraintes ».
Google conteste un taux d’erreur de 10 % pour ses AI Overviews, mais ses propres outils de test révèlent un chiffre de 22 %.
Une nouvelle approche, baptisée HALO-Loss, vise à résoudre un problème géométrique fondamental des réseaux de neurones, leur permettant d’admettre leur ignorance face à des données non pertinentes plutôt que d’halluciner avec confiance.
Des scientifiques ont créé une maladie fictive que des intelligences artificielles ont ensuite présentée comme réelle, soulevant des questions sur la désinformation.
Les hallucinations des modèles de langage restent un problème majeur. Décryptage des causes techniques et des solutions en développement.