modération de contenu

Spotify va étiqueter les artistes IA et les exclure des recommandations

Spotify a annoncé mardi qu'elle commencerait à étiqueter les profils d'artistes générés par IA avec un nouveau badge "Persona IA" et à exclure leur musique des recommandations algorithmiques et éditoriales par défaut. Il s'agit de la mesure la plus agressive…

Zuckerberg présente ses excuses à l’Inde pour des contenus pédopornographiques et la suppression d’une vidéo de Modi

Le PDG de Meta Platforms, Mark Zuckerberg, a présenté ses excuses au gouvernement indien concernant la présence de matériel pédopornographique sur les plateformes de l'entreprise, de contenus deepfake et d'erreurs opérationnelles, dont la brève suppression d'une vidéo publiée par le…

Apple retire brièvement Telegram de l’App Store pour contenu pédopornographique

Apple a temporairement retiré Telegram de son App Store lundi soir après qu'une vérification a révélé la présence de matériel pédopornographique sur la plateforme de messagerie, rétablissant l'application quelques heures plus tard une fois le contenu litigieux supprimé.

Apple retire Telegram de l’App Store dans le monde entier

Apple a retiré l'application de messagerie Telegram de son App Store iOS à l'échelle mondiale, une disparition confirmée sur les 175 boutiques régionales testées par le service de surveillance indépendant Apple Censorship. Ce retrait, survenu le 3 août 2026, empêche…

LinkedIn lance un bouton pour signaler le contenu généré par IA

LinkedIn, filiale de Microsoft Corporation, a dévoilé jeudi un nouvel outil permettant aux utilisateurs de signaler des publications comme "semblant être de la camelote IA", marquant la tentative la plus directe de la plateforme de réseautage professionnel pour combattre le…

La plupart des éditeurs d’images sur Hugging Face créent des deepfakes pornographiques, selon un rapport

Sept des neuf modèles d'édition d'images les plus populaires sur Hugging Face ont facilement obéi à des demandes simples visant à déshabiller numériquement des femmes, selon un rapport publié mardi par l'organisation européenne à but non lucratif AI Forensics. Cette…

Meta a supprimé des comptes utilisateurs par erreur, selon le NYT

Meta a utilisé des systèmes automatisés pour supprimer des comptes Facebook et Instagram que les utilisateurs avaient mis des années à développer. Lorsque ces utilisateurs ont tenté de faire appel, leurs dossiers ont souvent été traités par une autre IA…

YouTube et X ont canalisé des millions d’utilisateurs vers des sites de deepfakes pornographiques, selon une étude

YouTube, filiale d'Alphabet Inc., et X ont servi de passerelles principales pour diriger des millions d'utilisateurs vers des sites web générant des images deepfake sexuellement explicites sans consentement, selon un rapport publié cette semaine par l'Institute for Strategic Dialogue. Ces…

Une méthode du MIT détecte les modèles d’IA entraînés sur des images d’abus sexuels sur mineurs

Des chercheurs du MIT, de l'Université de Boston et de l'organisation de protection de l'enfance Thorn ont présenté une technique capable d'identifier si un modèle d'IA open source a été ajusté pour produire du matériel pédopornographique (CSAM), sans générer une…

Des sous-traitants de Meta se sont fait passer pour des adolescents pour tester des chatbots concurrents, rapporte Wired

Des centaines de sous-traitants travaillant sur un projet pour Meta ont reçu pour instruction de se faire passer pour des enfants et de sonder les chatbots concurrents — notamment Gemini de Google, Alphabet Inc., et ChatGPT d'OpenAI — avec des…

Meta vise un remplacement à 90 % des modérateurs humains par l’IA

Meta remplace rapidement les modérateurs de contenu humains par de grands modèles de langage sur ses plateformes, les systèmes d'IA traitant déjà environ la moitié de toutes les demandes de révision humaine en 2026 et l'entreprise visant à dépasser les…

Le conseil de surveillance de Meta ordonne la suppression d’une vidéo deepfake et exige des changements de politique

Le conseil de surveillance de Meta a annulé mardi la décision de l'entreprise de maintenir en ligne une vidéo sexualisée prétendument générée par IA sur Instagram, ordonnant sa suppression et appelant Meta à renforcer les protections pour les personnes non…

ChatGPT génère de la violence graphique et des images sexuelles à partir de simples invites

Le ChatGPT d'OpenAI peut être manipulé pour générer des images sexualisées et graphiquement violentes en utilisant seulement des modifications mineures d'une invite largement diffusée, selon les conclusions de l'entreprise britannique de sécurité de l'IA Mindgard rapportées par la BBC mardi.

Le modèle Claude Fable 5 d’Anthropic critiqué pour le blocage de questions de biologie élémentaires

Anthropic a lancé mardi Claude Fable 5, son premier modèle d'IA de classe Mythos disponible publiquement, mais les classificateurs de sécurité automatisés du système frustrent déjà les utilisateurs qui affirment que les garde-fous bloquent des questions de routine sur la…

Le « podslop » généré par l’IA représente désormais 39 % des nouveaux podcasts

Un torrent de podcasts générés par l'IA submerge les plateformes d'écoute, de nouvelles données montrant que près de quatre nouveaux programmes sur dix ajoutés aux répertoires de podcasts au cours d'une période récente de neuf jours ont probablement été créés…

Google présente ses excuses après qu’une alerte push des BAFTA a inclus une insulte raciale

Google Alphabet Inc. a présenté ses excuses mardi après qu'une notification push envoyée aux utilisateurs concernant les BAFTA Film Awards 2026 a inclus l'insulte raciale, sans censure, dans son texte de prévisualisation. La notification, envoyée lundi, renvoyait à un article…

Un éditeur de jeux indépendants affirme que TikTok a diffusé des publicités racistes générées par IA sans son consentement

Finji, le studio de jeux indépendant derrière Night in the Woods et Tunic, a accusé TikTok d'utiliser l'IA générative pour modifier ses publicités sans autorisation, y compris une publicité qui a introduit un stéréotype raciste et sexualisé de l'un des…