Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

anthropic+1indiatoday+1anthropicAnthropic julkaisi 13. heinäkuuta tutkimuksen, jonka mukaan sen tekoäly-chatbot Claude ilmaisee mitattavasti erilaisia arvoja riippuen sekä malliversiosta että keskustelun kielestä — mikä herättää kysymyksiä miljoonien ihmisten ympäri maailmaa käyttämien tekoälyjärjestelmien johdonmukaisuudesta ja puolueellisuudesta.
Tutkimus, jonka otsikko on "Clauden arvot eri malleissa ja kielissä", analysoi 309 815 todellista Claude.ai-keskustelua, jotka kerättiin kahden viikon aikana toukokuussa 2026. Aineisto kerättiin tasapuolisesti kolmesta mallista — Sonnet 4.6, Opus 4.6 ja Opus 4.7 — ja 20 kielestä. Tutkijat tiivistivät yli 3 000 aiemmin tunnistettua arvoa neljään tulkittavaan akseliin: Kunnioitus vs. Varovaisuus, Lämpö vs. Kurinalaisuus, Syvyys vs. Lyhyys ja Suoruus vs. Toteutus.anthropic
Suurin kielikohtainen vaihtelu ilmeni Lämpö vs. Kurinalaisuus -akselilla. Claude kallistui eniten lämpöön — jota luonnehtivat kohtelias kieli, huumori ja myöntäminen — vastatessaan hindiksi ja arabiaksi. Englanniksi ja venäjäksi chatbot oli todennäköisemmin haastamassa oletuksia, korjaamassa yksityiskohtia ja pyytämässä todisteita.indiatoday+3
Käytännön vaikutukset ovat konkreettisia: Anthropic huomautti, että kaksi henkilöä, jotka pyytävät palautetta samasta liiketoimintasuunnitelmasta, toinen hindiksi ja toinen venäjäksi, "voivat saada erilaisia vaikutelmia sen laadusta, koska Claude ilmaisi erilaisia arvoja tavassaan muotoilla arvionsa".anthropic
Tutkimus havaitsi, että mallien välillä Opus 4.7 kallistui eniten kurinalaisuuteen, varovaisuuteen ja suoruuteen — se haastoi todennäköisemmin käyttäjien oletuksia, kritisoi heidän työtään ja varoitti riskeistä pyytämättä. Sonnet 4.6 kallistui eniten lämpöön ja kunnioitukseen, vahvistaen usein käyttäjien ideoita huumorilla ja kannustuksella. Opus 4.6 suosi lyhyyttä ja toteutusta, mennen suoraan asiaan.tweaktown+1
Nämä profiilit, Anthropic totesi, vastasivat sekä sisäisiä henkilöstöarvioita että verkossa esitettyjä käyttäjäkommentteja mallien persoonallisuuksista.anthropic
Anthropic myönsi, ettei se vielä tiedä, miksi näitä muutoksia tapahtuu. Mahdollisia selityksiä ovat opetusdatan epätasainen jakautuminen kielten välillä ja datan koostumuksen erot. Yhtiö totesi myös, ettei se ole määrittänyt, kuinka paljon vaihtelua on toivottavaa — osa voi heijastaa laillisia keskustelunormeja eri kielissä, kun taas osa voi edustaa puutetta siinä, kuinka hyvin Claude palvelee tiettyjä yhteisöjä.anthropic
"Voimme nähdä, että Clauden ilmaisemat arvot vaihtelevat tavoilla, joita emme tietoisesti valinneet", tutkijat kirjoittivat, "ja voimme tutkia, miksi ne vaihtelevat ja palveleeko kyseinen vaihtelu käyttäjiä".anthropic