Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

anthropic+1indiatoday+1anthropicLiepos 13 d. „Anthropic“ paskelbė tyrimą, atskleidžiantį, kad jos dirbtinio intelekto pokalbių robotas „Claude“ išreiškia išmatuojamai skirtingas vertybes priklausomai nuo modelio versijos ir pokalbio kalbos – tai kelia klausimų dėl nuoseklumo ir šališkumo DI sistemose, kurias naudoja milijonai žmonių visame pasaulyje.
Tyrime, pavadintame „Claude vertybės įvairiuose modeliuose ir kalbose“, buvo išanalizuota 309 815 realių pokalbių iš Claude.ai, surinktų per dvi savaites 2026 m. gegužės mėn., vienodai atsižvelgiant į tris modelius – „Sonnet 4.6“, „Opus 4.6“ ir „Opus 4.7“ – bei 20 kalbų. Tyrėjai suspaudė daugiau nei 3 000 anksčiau nustatytų vertybių į keturias interpretuojamas ašis: pagarba prieš atsargumą, šiluma prieš griežtumą, gylis prieš glaustumą ir atvirumas prieš vykdymą.anthropic
Didžiausias kalbinis skirtumas pasireiškė šilumos ir griežtumo ašyje. „Claude“ labiausiai linko į šilumą – pasižyminčią mandagia kalba, humoru ir patvirtinimu – kai atsakydavo hindi ir arabų kalbomis. Anglų ir rusų kalbomis pokalbių robotas buvo labiau linkęs kvestionuoti prielaidas, taisyti detales ir prašyti įrodymų.indiatoday+3
Praktinės pasekmės yra konkrečios: „Anthropic“ pažymėjo, kad du žmonės, prašantys atsiliepimų apie tą patį verslo planą, vienas hindi, o kitas rusų kalba, „gali susidaryti skirtingą įspūdį apie jo kokybę, nes „Claude“ išreiškė skirtingas vertybes savo vertinimo formuluotėse“.anthropic
Tyrimas parodė, kad visuose modeliuose „Opus 4.7“ labiausiai linko į griežtumą, atsargumą ir atvirumą – labiau tikėtina, kad jis kvestionavo vartotojų prielaidas, kritikavo jų darbą ir be raginimo įspėjo apie riziką. „Sonnet 4.6“ labiausiai linko į šilumą ir pagarbą, dažnai patvirtindamas vartotojų idėjas su humoru ir padrąsinimu. „Opus 4.6“ buvo linkęs į glaustumą ir vykdymą, iškart pereidamas prie esmės.tweaktown+1
„Anthropic“ teigimu, šie profiliai atitiko tiek vidinius darbuotojų vertinimus, tiek internetinius vartotojų komentarus apie modelių asmenybes.anthropic
„Anthropic“ pripažino, kad kol kas nežino, kodėl šie pokyčiai vyksta. Galimi paaiškinimai apima netolygų mokymo duomenų pasiskirstymą tarp kalbų ir tų duomenų sudėties skirtumus. Bendrovė taip pat teigė nenustačiusi, kiek šis kintamumas yra pageidautinas – kai kurie aspektai gali atspindėti teisėtas pokalbio normas skirtingomis kalbomis, o kiti gali rodyti spragą, kaip gerai „Claude“ aptarnauja tam tikras bendruomenes.anthropic
„Matome, kad „Claude“ išreiškiamos vertybės kinta būdais, kurių mes sąmoningai nepasirinkome“, – rašė tyrėjai, – „ir galime tirti, kodėl jos kinta ir ar tas kintamumas yra naudingas vartotojams“.anthropic