Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

anthropic+1indiatoday+1anthropicAnthropic publiserte forskning den 13. juli som avslører at deres AI-chatbot Claude uttrykker målbart forskjellige verdier avhengig av både modellversjon og samtalens språk — noe som reiser spørsmål om konsistens og bias i AI-systemer som brukes av millioner verden over.
Studien, med tittelen "Claude's Values Across Models and Languages", analyserte 309 815 ekte samtaler fra Claude.ai samlet inn over to uker i mai 2026, hentet likt fra tre modeller — Sonnet 4.6, Opus 4.6 og Opus 4.7 — og 20 språk. Forskerne komprimerte mer enn 3000 tidligere identifiserte verdier til fire tolkbare akser: Ærefrykt vs. forsiktighet, varme vs. strenghet, dybde vs. kortfattethet, og oppriktighet vs. utførelse.anthropic
Den største språkbaserte variasjonen dukket opp på aksen for varme vs. strenghet. Claude helte mest mot varme — preget av høflig språk, humor og bekreftelse — når den svarte på hindi og arabisk. På engelsk og russisk var chatboten mer tilbøyelig til å utfordre antakelser, korrigere detaljer og be om bevis.indiatoday+3
De praktiske implikasjonene er konkrete: Anthropic bemerket at to personer som ber om tilbakemelding på den samme forretningsplanen, én på hindi og én på russisk, "kan sitte igjen med forskjellige inntrykk av kvaliteten fordi Claude uttrykte forskjellige verdier i hvordan den formulerte vurderingen sin".anthropic
På tvers av modeller fant forskningen at Opus 4.7 helte mest mot strenghet, forsiktighet og oppriktighet — mer tilbøyelig til å utfordre brukernes antakelser, kritisere arbeidet deres og advare om risiko uten oppfordring. Sonnet 4.6 helte mest mot varme og ærefrykt, og bekreftet ofte brukernes ideer med humor og oppmuntring. Opus 4.6 helte mot kortfattethet og utførelse, og gikk rett på sak.tweaktown+1
Disse profilene, sa Anthropic, samsvarte med både interne vurderinger fra ansatte og kommentarer fra brukere på nettet om modellenes personligheter.anthropic
Anthropic erkjente at de ennå ikke vet hvorfor disse skiftene oppstår. Mulige forklaringer inkluderer ujevn fordeling av treningsdata på tvers av språk og forskjeller i sammensetningen av disse dataene. Selskapet sa også at de ikke har fastslått hvor mye av variasjonen som er ønskelig — noe kan reflektere legitime samtalenormer på forskjellige språk, mens noe kan representere et gap i hvor godt Claude betjener visse samfunn.anthropic
"Vi kan se at verdiene Claude uttrykker varierer på måter vi ikke bevisst valgte," skrev forskerne, "og vi kan studere hvorfor de varierer og om den variasjonen tjener brukerne".anthropic