En el transcurso de una investigación masiva que abarcó más de 309 815 diálogos, el equipo de desarrolladores identificó una característica fundamental en el comportamiento de los modelos lingüísticos: cambiar el idioma de comunicación altera radicalmente no solo el vocabulario, sino también el propio sistema de valores que demuestra la red neuronal. Este fenómeno se manifestó con mayor claridad al analizar las sesiones en ruso.

Los especialistas redujeron más de 3000 valores previamente identificados de Claude a cuatro ejes clave: Complacencia frente a Precaución, Cordialidad frente a Rigor, Profundidad frente a Brevedad y Sinceridad frente a Eficacia. Son precisamente estas escalas las que explican el 15% de toda la variabilidad en el comportamiento del modelo. La conclusión clave: el perfil de valores no solo cambia entre diferentes modelos, sino que, lo que es más importante, también varía entre los 20 idiomas más populares de la plataforma.

El ruso como polo del rigor

Las fluctuaciones más significativas ocurren en el eje «Cordialidad vs. Rigor» y «Sinceridad vs. Eficacia». El ruso, junto con el inglés, ocupó una posición extrema en el polo del rigor. Esto significa que al comunicarse en ruso, Claude actúa con mucha más frecuencia como un crítico exigente que como un interlocutor alentador. Cuestiona activamente las premisas iniciales, corrige detalles, exige pruebas y ofrece un análisis crítico.

En comparación, en árabe e hindi, el modelo se desplaza hacia la máxima cordialidad, mostrando cortesía, humor y aprobación de las ideas del usuario. La consecuencia práctica es evidente: un mismo plan de negocio recibirá una evaluación completamente diferente según el idioma de la consulta. Es muy probable que un usuario de habla rusa se enfrente a críticas duras y exigencias de justificación, mientras que un usuario de hindi recibirá una reacción suave y alentadora.

El modelo también importa

Es importante entender que el idioma no es el único factor. La elección de la versión específica del modelo también deja su huella:

  • Sonnet 4.6 se inclina hacia la complacencia, la cordialidad y la brevedad, aprobando a menudo las ideas y usando el humor.
  • Opus 4.7 se desplaza hacia la precaución y la profundidad, cuestionando premisas falsas y ofreciendo críticas sinceras.
  • Opus 4.6 ocupa una posición intermedia con una tendencia al rigor, la complacencia y la brevedad.

Los investigadores aún no pueden determinar con precisión la causa de estas diferencias. La hipótesis principal es la distribución desigual de los datos de entrenamiento entre los idiomas. Allí donde hay muchos datos, es más fácil lograr uniformidad en los valores. Además, la composición de los textos en diferentes idiomas varía: los corpus profesionales pueden transmitir valores distintos a los coloquiales.

Mi comentario experto: Para la industria de las criptomonedas y el sector DeFi, donde la precisión en la redacción y el análisis crítico son de suma importancia, este «rigor» del Claude en ruso es más una ventaja que un defecto. Sin embargo, los desarrolladores y usuarios deben tener en cuenta este cambio lingüístico para evitar malentendidos al evaluar soluciones técnicas complejas. La empresa Anthropic planea incorporar la elaboración de perfiles de valores en el proceso de evaluación y monitoreo de modelos, lo que permitirá controlar mejor esta variabilidad no intencionada. La cuestión de hasta qué punto esta variabilidad es deseable sigue abierta, pero para la comunidad cripto, acostumbrada a un entorno de alto riesgo, un asistente de IA estricto y exigente podría resultar mucho más útil que un interlocutor «cálido».