jailbreaking

TechCrunch: Anthropics Claude Opus 4.6 genererte forbudt seksuelt innhold i alle tester

Anthropics Claude Opus 4.6, en modell selskapet lanserte i februar og fortsatt gjør tilgjengelig via sitt API, genererte seksuelt eksplisitt innhold i alle ti direkte testforespørsler utført av TechCrunch, til tross for at selskapets brukervilkår uttrykkelig forbyr slikt materiale. Granskingen,…

Forsker hevder Anthropic sin Claude Fable 5 ble hacket dager etter lansering

Anthropic sin kraftigste offentlig tilgjengelige AI-modell, Claude Fable 5, skal ha fått sikkerhetsbarrierene sine omgått av en kjent AI-sikkerhetstester bare én dag etter lanseringen 9. juni, noe som reiser nye spørsmål om holdbarheten til AI-sikkerhetstiltak selv etter hvert som modellene…