Hugging Face face à la création de deepfakes explicites
Des chercheurs ont découvert que les modèles d’édition d’images de Hugging Face peuvent facilement générer des deepfakes explicites, soulevant des questions éthiques.
Des chercheurs ont découvert que les modèles d’édition d’images de Hugging Face peuvent facilement générer des deepfakes explicites, soulevant des questions éthiques.
Des centaines d’utilisateurs ont demandé à ChatGPT des recettes de poisons et d’armes biologiques, certains obtenant des guides de niveau lycée.
Une discussion sur Hacker News propose d’ajouter un drapeau pour identifier les articles créés par intelligence artificielle, permettant aux utilisateurs de les filtrer sans les déclasser.
Adam Mosseri, dirigeant d’Instagram, estime que les utilisateurs doivent filtrer eux-mêmes le contenu IA s’ils ne l’apprécient pas, la plateforme privilégiant l’information à la censure.
Reddit déploie des outils de modération basés sur l’IA pour contrer le spam et les contenus promotionnels générés par l’intelligence artificielle sur sa plateforme.
Des guides de jeux vidéo générés par IA pour des titres non encore sortis sont apparus sur Amazon, soulevant des questions sur la modération de la plateforme.
NVIDIA a introduit Nemotron 3.5 Content Safety, une solution multimodale et personnalisable pour sécuriser les contenus générés par l’IA en entreprise.
Malgré les efforts des plateformes comme YouTube et Instagram pour étiqueter les contenus générés par IA, les utilisateurs réclament des outils de filtrage plus efficaces pour éviter la prolifération de ces créations.
Un utilisateur de Reddit a découvert que les IA utilisées pour les jeux de rôle sont bridées par des protocoles de sécurité, limitant la liberté d’action narrative.
Un utilisateur de Reddit a rapporté qu’une intelligence artificielle a eu du mal à discuter de sujets liés à Donald Trump, qualifiant des extraits de presse de « propagande ou satire ».