Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

anthropic+1indiatoday+1anthropicAnthropic publicerade forskning den 13 juli som avslöjar att deras AI-chatbot Claude uttrycker mätbart olika värderingar beroende på både modellversion och samtalets språk — vilket väcker frågor om konsekvens och bias i AI-system som används av miljontals människor världen över.
Studien, med titeln "Claude's Values Across Models and Languages", analyserade 309 815 verkliga samtal från Claude.ai som samlades in under två veckor i maj 2026, hämtade lika från tre modeller — Sonnet 4.6, Opus 4.6 och Opus 4.7 — och 20 språk. Forskarna komprimerade mer än 3 000 tidigare identifierade värderingar till fyra tolkningsbara axlar: Vördnad vs. försiktighet, värme vs. stringens, djup vs. kortfattadhet, och uppriktighet vs. utförande.anthropic
Den största språkbaserade variationen uppstod på axeln för värme vs. stringens. Claude lutade mest mot värme — kännetecknat av artigt språk, humor och bekräftelse — när den svarade på hindi och arabiska. På engelska och ryska var chatboten mer benägen att utmana antaganden, korrigera detaljer och be om bevis.indiatoday+3
De praktiska konsekvenserna är konkreta: Anthropic noterade att två personer som ber om feedback på samma affärsplan, en på hindi och en på ryska, "kan få olika intryck av dess kvalitet eftersom Claude uttryckte olika värderingar i hur den formulerade sin bedömning".anthropic
Mellan olika modeller fann forskningen att Opus 4.7 lutade mest mot stringens, försiktighet och uppriktighet — mer benägen att utmana användarnas antaganden, kritisera deras arbete och varna för risker utan att bli ombedd. Sonnet 4.6 lutade mest mot värme och vördnad, och bekräftade ofta användarnas idéer med humor och uppmuntran. Opus 4.6 lutade mot kortfattadhet och utförande, och gick rakt på sak.tweaktown+1
Dessa profiler, uppgav Anthropic, matchade både interna bedömningar från personal och kommentarer från användare på nätet om modellernas personligheter.anthropic
Anthropic erkände att de ännu inte vet varför dessa skiften sker. Möjliga förklaringar inkluderar ojämn fördelning av träningsdata mellan språk och skillnader i sammansättningen av dessa data. Företaget sa också att de inte har fastställt hur mycket av variationen som är önskvärd — en del kan återspegla legitima samtalsnormer på olika språk, medan en del kan representera en klyfta i hur väl Claude betjänar vissa grupper.anthropic
"Vi kan se att de värderingar som Claude uttrycker varierar på sätt som vi inte medvetet valt", skrev forskarna, "och vi kan studera varför de varierar och om den variationen tjänar användarna".anthropic