GPT-6 Astra : Moins d’hallucinations, mais des failles persistantes
Le GPT-6 Astra d’OpenAI réduit les hallucinations et bloque 99,99 % des injections de prompt directes, mais reste vulnérable aux attaques cachées (8,5 %).
Le GPT-6 Astra d’OpenAI réduit les hallucinations et bloque 99,99 % des injections de prompt directes, mais reste vulnérable aux attaques cachées (8,5 %).
Un plaignant du Connecticut a tenté de manipuler un potentiel système d’examen par IA en insérant des instructions invisibles dans des documents judiciaires.
Une tentative inédite d’injection de prompt a été découverte dans un document juridique, visant à manipuler une intelligence artificielle et influencer son jugement.
Une nouvelle technique d’injection de prompt, le « context bombing », permet de désactiver les agents d’IA malveillants avant qu’ils ne puissent nuire.
Des chercheurs ont révélé « Ghostcommit », une technique qui dissimule des injections de prompt dans des images PNG pour dérober des secrets via des agents d’IA.
OpenAI déploie le « Mode Verrouillage » (Lockdown Mode) pour les comptes ChatGPT éligibles, une fonctionnalité visant à prévenir l’exfiltration de données sensibles.
Un développeur a inséré une injection de prompt dans la bibliothèque jqwik, instruisant les agents de codage IA de supprimer les sorties d’applications.