moderación de contenido

Spotify etiquetará a los artistas de IA y los excluirá de las recomendaciones

Spotify anunció el martes que comenzará a etiquetar los perfiles de artistas generados por IA con un nuevo distintivo de "Persona de IA" y excluirá su música de las recomendaciones algorítmicas y editoriales de forma predeterminada, en la medida más…

Zuckerberg se disculpa ante India por CSAM y la eliminación de un video de Modi

El CEO de Meta Platforms, Mark Zuckerberg, se ha disculpado ante el gobierno indio por la presencia de material de abuso sexual infantil en las plataformas de la compañía, contenido deepfake y errores operativos, incluida la breve eliminación de un…

Apple retira brevemente Telegram de la App Store por contenido de abuso infantil

Apple retiró temporalmente Telegram de su App Store el lunes por la noche después de que una revisión descubriera material de abuso sexual infantil en la plataforma de mensajería, restaurando la aplicación horas después una vez que se eliminó el…

Apple retira Telegram de la App Store a nivel mundial

Apple ha retirado la aplicación de mensajería Telegram de su App Store de iOS a nivel mundial, con la desaparición confirmada en las 175 tiendas regionales analizadas por el servicio de monitoreo independiente Apple Censorship. La eliminación, que ocurrió el…

LinkedIn lanza botón para denunciar contenido generado por IA

LinkedIn, propiedad de Microsoft Corporation, presentó el jueves una nueva herramienta que permite a los usuarios marcar publicaciones como "parece basura de IA", marcando el intento más directo de la plataforma profesional para combatir la inundación de contenido generado por…

La mayoría de editores de imagen en Hugging Face crean deepfakes sexuales, según informe

Siete de los nueve modelos de edición de imágenes más populares en Hugging Face cumplieron sin problemas con solicitudes sencillas para desnudar digitalmente a mujeres, según un informe publicado el martes por la organización europea sin ánimo de lucro AI…

Meta eliminó cuentas de usuarios por error, según el NYT

Meta utilizó sistemas automatizados para eliminar cuentas de Facebook e Instagram que los usuarios habían construido durante años, y cuando intentaron apelar, sus casos fueron manejados a menudo por otra IA en lugar de un revisor humano, según una investigación…

YouTube y X canalizaron millones a sitios de deepfakes de desnudos, según un estudio

YouTube, de Alphabet Inc., y X sirvieron como puertas de enlace principales que canalizaron a millones de usuarios hacia sitios web que generan imágenes deepfake sexualmente explícitas sin consentimiento, según un informe publicado esta semana por el Institute for Strategic…

Un método del MIT detecta modelos de IA entrenados con imágenes de abuso infantil

Investigadores del MIT, la Universidad de Boston y la organización de seguridad infantil Thorn han presentado una técnica que puede identificar si un modelo de IA de código abierto ha sido ajustado para producir material de abuso sexual infantil (CSAM),…

Contratistas de Meta se hicieron pasar por adolescentes para probar chatbots rivales, informa Wired

Cientos de contratistas que trabajan en un proyecto para Meta recibieron instrucciones de hacerse pasar por niños y sondear chatbots de la competencia —incluidos Gemini de Google, Alphabet Inc., y ChatGPT de OpenAI— con mensajes relacionados con suicidio, sexo y…

Meta apunta a un reemplazo del 90% de moderadores humanos por IA

Meta está reemplazando rápidamente a los moderadores de contenido humanos con grandes modelos de lenguaje en sus plataformas, con sistemas de IA que ya manejan aproximadamente la mitad de todas las solicitudes de revisión humana en 2026 y la compañía…

La Junta de Supervisión de Meta ordena la eliminación de un video deepfake y exige cambios en las políticas

La Junta de Supervisión de Meta anuló el martes la decisión de la empresa de mantener un video sexualizado supuestamente generado por IA en Instagram, ordenando su eliminación y pidiendo a Meta que refuerce las protecciones para las personas no…

ChatGPT genera violencia gráfica e imágenes sexuales a partir de simples instrucciones

El ChatGPT de OpenAI puede ser manipulado para generar imágenes sexualizadas y gráficamente violentas utilizando solo modificaciones menores a una instrucción ampliamente difundida, según los hallazgos de la firma británica de seguridad de IA Mindgard reportados por la BBC el…

Claude Fable 5 de Anthropic recibe críticas por bloquear preguntas básicas de biología

Anthropic lanzó Claude Fable 5 el martes, su primer modelo de IA de clase Mythos disponible públicamente, pero los clasificadores de seguridad automatizados del sistema ya están frustrando a los usuarios, quienes afirman que las salvaguardas bloquean preguntas rutinarias sobre…

El ‘podslop’ generado por IA representa ahora el 39% de los nuevos podcasts

Un torrente de podcasts generados por IA está abrumando las plataformas de escucha, con nuevos datos que muestran que casi cuatro de cada diez nuevos programas añadidos a los directorios de podcasts durante un periodo reciente de nueve días fueron…

Google se disculpa después de que una alerta push de los BAFTA incluyera un insulto racial

Google Alphabet Inc. se disculpó el martes después de que una notificación push enviada a los usuarios sobre los Premios de Cine BAFTA 2026 incluyera el insulto racial, sin censura, en su texto de vista previa. La notificación, enviada el…

Editora de juegos independientes afirma que TikTok publicó anuncios racistas generados por IA sin su consentimiento

Finji, el estudio de juegos independiente detrás de Night in the Woods y Tunic, ha acusado a TikTok de utilizar IA generativa para alterar sus anuncios sin permiso, incluyendo uno que introdujo un estereotipo racista y sexualizado de uno de…