Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

anthropic+1indiatoday+1anthropicSpolečnost Anthropic zveřejnila 13. července výzkum, který odhalil, že její AI chatbot Claude vyjadřuje měřitelně odlišné hodnoty v závislosti na verzi modelu i jazyce konverzace – což vyvolává otázky ohledně konzistence a zaujatosti systémů umělé inteligence, které využívají miliony lidí po celém světě.
Studie s názvem „Hodnoty Claude napříč modely a jazyky“ analyzovala 309 815 reálných konverzací z Claude.ai shromážděných během dvou týdnů v květnu 2026, přičemž čerpala rovnoměrně ze tří modelů – Sonnet 4.6, Opus 4.6 a Opus 4.7 – a 20 jazyků. Výzkumníci zkomprimovali více než 3 000 dříve identifikovaných hodnot do čtyř interpretovatelných os: Úcta vs. Opatrnost, Vřelost vs. Přísnost, Hloubka vs. Stručnost a Upřímnost vs. Provedení.anthropic
Největší jazyková variace se objevila na ose Vřelost vs. Přísnost. Claude se nejvíce přikláněl k vřelosti – charakterizované zdvořilým jazykem, humorem a potvrzováním – při odpovídání v hindštině a arabštině. V angličtině a ruštině byl chatbot pravděpodobněji nakloněn zpochybňování předpokladů, opravování detailů a vyžadování důkazů.indiatoday+3
Praktické důsledky jsou konkrétní: Společnost Anthropic poznamenala, že dva lidé žádající o zpětnou vazbu ke stejnému podnikatelskému plánu, jeden v hindštině a druhý v ruštině, „mohou mít odlišný dojem o jeho kvalitě, protože Claude vyjádřil odlišné hodnoty v tom, jak své hodnocení formuloval“.anthropic
Napříč modely výzkum zjistil, že Opus 4.7 se nejvíce přikláněl k přísnosti, opatrnosti a upřímnosti – častěji zpochybňoval předpoklady uživatelů, kritizoval jejich práci a nevyžádaně varoval před riziky. Sonnet 4.6 se nejvíce přikláněl k vřelosti a úctě, často potvrzoval nápady uživatelů humorem a povzbuzením. Opus 4.6 měl tendenci ke stručnosti a provedení, přičemž šel přímo k věci.tweaktown+1
Tyto profily, uvedla společnost Anthropic, odpovídaly jak interním hodnocením zaměstnanců, tak online komentářům uživatelů o osobnostech modelů.anthropic
Společnost Anthropic přiznala, že zatím neví, proč k těmto posunům dochází. Možná vysvětlení zahrnují nerovnoměrné rozdělení tréninkových dat napříč jazyky a rozdíly ve složení těchto dat. Společnost také uvedla, že neurčila, do jaké míry je tato variace žádoucí – některé mohou odrážet legitimní konverzační normy v různých jazycích, zatímco jiné mohou představovat mezeru v tom, jak dobře Claude slouží určitým komunitám.anthropic
„Vidíme, že hodnoty vyjádřené modelem Claude se mění způsoby, které jsme záměrně nezvolili,“ napsali výzkumníci, „a můžeme studovat, proč se mění a zda tato variace slouží uživatelům“.anthropic