Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

anthropic+1indiatoday+1anthropicAnthropic publicó una investigación el 13 de julio que revela que su chatbot de IA, Claude, expresa valores mediblemente diferentes dependiendo tanto de la versión del modelo como del idioma de la conversación, lo que plantea dudas sobre la coherencia y el sesgo en los sistemas de IA utilizados por millones de personas en todo el mundo.
El estudio, titulado "Los valores de Claude a través de modelos e idiomas", analizó 309,815 conversaciones reales de Claude.ai recopiladas durante dos semanas en mayo de 2026, extrayendo datos por igual de tres modelos —Sonnet 4.6, Opus 4.6 y Opus 4.7— y 20 idiomas. Los investigadores comprimieron más de 3,000 valores identificados previamente en cuatro ejes interpretables: Deferencia frente a Precaución, Calidez frente a Rigor, Profundidad frente a Brevedad, y Franqueza frente a Ejecución.anthropic
La mayor variación basada en el idioma apareció en el eje de Calidez frente a Rigor. Claude se inclinó más hacia la calidez —caracterizada por un lenguaje cortés, humor y afirmación— al responder en hindi y árabe. En inglés y ruso, el chatbot fue más propenso a cuestionar suposiciones, corregir detalles y pedir pruebas.indiatoday+3
Las implicaciones prácticas son concretas: Anthropic señaló que dos personas que piden comentarios sobre el mismo plan de negocios, una en hindi y otra en ruso, "pueden terminar con impresiones diferentes sobre su calidad porque Claude expresó valores distintos en la forma en que estructuró su evaluación".anthropic
Entre los modelos, la investigación encontró que Opus 4.7 se inclinó más hacia el rigor, la precaución y la franqueza —siendo más propenso a desafiar las suposiciones de los usuarios, criticar su trabajo y advertir sobre riesgos sin que se le pida. Sonnet 4.6 se inclinó más hacia la calidez y la deferencia, a menudo afirmando las ideas de los usuarios con humor y aliento. Opus 4.6 tendió hacia la brevedad y la ejecución, yendo directo al grano.tweaktown+1
Estos perfiles, dijo Anthropic, coincidieron tanto con las evaluaciones internas del personal como con los comentarios de los usuarios en línea sobre la personalidad de los modelos.anthropic
Anthropic reconoció que aún no sabe por qué ocurren estos cambios. Las posibles explicaciones incluyen una distribución desigual de los datos de entrenamiento entre los idiomas y diferencias en la composición de dichos datos. La empresa también dijo que no ha determinado cuánta variación es deseable; algunas pueden reflejar normas de conversación legítimas en diferentes idiomas, mientras que otras pueden representar una brecha en qué tan bien sirve Claude a ciertas comunidades.anthropic
"Podemos ver que los valores expresados por Claude varían de formas que no elegimos deliberadamente", escribieron los investigadores, "y podemos estudiar por qué varían y si esa variación sirve a los usuarios".anthropic