innehållsmoderering

Spotify ska märka AI-artister och stoppa dem från rekommendationer

Spotify meddelade på tisdagen att de kommer att börja märka AI-genererade artistprofiler med en ny "AI Persona"-bricka och exkludera deras musik från algoritmiska och redaktionella rekommendationer som standard. Detta är företagets hittills mest kraftfulla åtgärd för att bekämpa flödet av…

Zuckerberg ber Indien om ursäkt efter borttagen Modi-video och CSAM-innehåll

Meta Platforms vd Mark Zuckerberg har bett den indiska regeringen om ursäkt gällande material föreställande sexuella övergrepp mot barn på företagets plattformar, deepfake-innehåll samt operativa fel, inklusive den tillfälliga borttagningen av en video publicerad av premiärminister Narendra Modi, rapporterade Reuters…

Apple tog kortvarigt bort Telegram från App Store efter barnpornografiskt innehåll

Apple drog tillfälligt in Telegram från sin App Store på måndagskvällen efter att en granskning upptäckt material som visar sexuella övergrepp mot barn på meddelandeplattformen. Appen återställdes några timmar senare när det stötande innehållet tagits bort.

Apple tar bort Telegram från App Store globalt

Apple har tagit bort meddelandeappen Telegram från sin iOS App Store globalt. Försvinnandet är bekräftat i samtliga 175 regionala butiker som testats av den oberoende övervakningstjänsten Apple Censorship. Borttagningen, som skedde den 3 augusti 2026, hindrar iPhone-användare från att ladda…

LinkedIn lanserar knapp för att flagga AI-skräp

LinkedIn, som ägs av Microsoft Corporation, presenterade på torsdagen ett nytt verktyg som låter användare flagga inlägg som "verkar vara AI-skräp". Detta är plattformens hittills mest direkta försök att bekämpa floden av AI-genererat innehåll som fyller flödena.

Rapport: De flesta bildredigerare på Hugging Face kan skapa deepfake-nakenbilder

Sju av de nio mest populära bildredigeringsmodellerna på Hugging Face efterlevde enkelt förfrågningar om att digitalt klä av kvinnor, enligt en rapport som publicerades på tisdagen av den europeiska ideella organisationen AI Forensics. Fyndet understryker hur en av AI-branschens mest…

Meta raderade användarkonton felaktigt med AI

Meta använde automatiserade system för att radera Facebook- och Instagram-konton som användare lagt år på att bygga upp, och när dessa användare försökte överklaga hanterades deras ärenden ofta av en annan AI istället för en mänsklig granskare, enligt en granskning…

YouTube och X slussade miljontals användare till sajter för deepfake-nakenbilder, visar studie

YouTube Alphabet Inc. och X fungerade som primära portaler som slussade miljontals användare till webbplatser som genererar sexuellt explicita deepfake-bilder utan samtycke, enligt en rapport som publicerades denna vecka av Institute for Strategic Dialogue. Resultaten understryker hur de stora plattformarnas…

MIT-metod upptäcker AI-modeller tränade på material om sexuella övergrepp mot barn

Forskare vid MIT, Boston University och barnrättsorganisationen Thorn har introducerat en teknik som kan identifiera om en AI-modell med öppen källkod har finjusterats för att producera material om sexuella övergrepp mot barn, allt utan att generera en enda bild. Metoden,…

Meta-entreprenörer utgav sig för att vara tonåringar för att testa rivaliserande chattbotar, rapporterar Wired

Hundratals entreprenörer som arbetar på ett projekt för Meta instruerades att utge sig för att vara barn och undersöka konkurrenters chattbotar — inklusive Googles Gemini (Alphabet Inc. ) och OpenAIs ChatGPT — med uppmaningar som involverar självmord, sex och droger,…

Meta siktar på 90 % AI-ersättning av mänskliga moderatorer

Meta ersätter snabbt mänskliga innehållsmoderatorer med stora språkmodeller på sina plattformar. AI-system hanterar redan ungefär hälften av alla förfrågningar om mänsklig granskning under 2026 och företaget siktar på att pressa detta över 90 % för vissa innehållstyper vid årets slut,…

Metas tillsynsnämnd beordrar borttagning av deepfake-video, kräver policyändringar

Metas tillsynsnämnd upphävde på tisdagen företagets beslut att låta en påstått AI-genererad sexualiserad video ligga kvar på Instagram, beordrade att den tas bort och uppmanade Meta att stärka skyddet för privatpersoner som utsätts för intima deepfake-bilder.

ChatGPT genererar grafiskt våld och sexuella bilder från enkla prompter

OpenAI:s ChatGPT kan manipuleras för att generera sexualiserade och grafiskt våldsamma bilder genom att bara använda små ändringar av en spridd prompt, enligt fynd från det brittiska AI-säkerhetsföretaget Mindgard som rapporterades av BBC på tisdagen.

Anthropic’s Claude Fable 5 får kritik för att blockera grundläggande biologifrågor

Anthropic lanserade Claude Fable 5 på tisdagen, deras första publikt tillgängliga AI-modell i Mythos-klassen, men systemets automatiserade säkerhetsfilter frustrerar redan användare som säger att skyddsmekanismerna blockerar rutinfrågor om biologi, medicin och cybersäkerhet – ämnen som modellen specifikt marknadsfördes för att…

AI-genererad ”podslop” står nu för 39 % av nya poddar

En flodvåg av AI-genererade poddar översvämmar lyssningsplattformar, och ny data visar att nästan fyra av tio nya program som lagts till i podcast-kataloger under en niodagarsperiod sannolikt skapats av artificiell intelligens. Fenomenet, som kallas "podslop", tvingar ljudbranschen att konfrontera en…

Google ber om ursäkt efter att BAFTA-pushnotis innehöll rasistiskt skällsord

Google Alphabet Inc. bad på tisdagen om ursäkt efter att en pushnotis som skickats till användare om 2026 års BAFTA Film Awards inkluderade ett rasistiskt skällsord, ocensurerat, i förhandstexten. Notisen, som skickades på måndagen, länkade till en artikel i Hollywood…

Indiespelsutgivare säger att TikTok körde rasistiska AI-annonser utan samtycke

Finji, den oberoende spelstudion bakom Night in the Woods och Tunic, har anklagat TikTok för att använda generativ AI för att ändra deras annonser utan tillåtelse, inklusive en som introducerade en rasistisk, sexualiserad stereotyp av en av studiots karaktärer. TikTok…