La elección del idioma de comunicación cambia radicalmente no solo el léxico, sino también la propia "personalidad" del modelo lingüístico. Mi análisis de la reciente investigación de Anthropic muestra que Claude en ruso presenta un perfil de valores fundamentalmente diferente, desplazándose hacia el rigor y la crítica. Esto no es un error, sino una característica fundamental del funcionamiento de los grandes modelos lingüísticos que debe tenerse en cuenta.

Los investigadores de la empresa redujeron más de 3000 valores previamente identificados de Claude a cuatro ejes básicos, analizando 309 815 diálogos en los 20 idiomas más populares. El ruso, en este sistema de coordenadas, ocupó una posición extrema.

Cuatro ejes que definen el carácter de la IA

Cada eje es una línea numérica entre dos patrones de comportamiento opuestos:

  • Deference vs. Caution (Deferencia vs. Precaución): disposición a complacer al usuario frente a la protección contra riesgos.
  • Warmth vs. Rigor (Cordialidad vs. Rigor): actitud positiva y cuidado frente al énfasis en la precisión y los hechos.
  • Depth vs. Brevity (Profundidad vs. Brevedad): explicaciones detalladas frente a cumplir exactamente lo que se pidió.
  • Candor vs. Execution (Franqueza vs. Ejecución): reconocimiento de la incertidumbre frente a una respuesta segura.

Estos cuatro ejes explican el 15% de toda la variabilidad en los valores que expresa Claude. Es importante destacar que los científicos controlaron el tema, la tarea y los valores expresados por el usuario para medir precisamente los valores del modelo, no las diferencias en las solicitudes.

Idioma ruso: el polo del rigor

Los cambios más fuertes en el perfil de Claude entre idiomas ocurren en los ejes Warmth vs. Rigor y Candor vs. Execution. Y precisamente el ruso, junto con el inglés, se encuentra en el polo más estricto. En el extremo opuesto están el árabe y el hindi, donde el modelo está máximamente desplazado hacia la cordialidad.

¿Qué significa esto en la práctica? El rigor en la ejecución de Claude es un conjunto concreto de comportamientos: el modelo comienza a cuestionar las premisas iniciales del usuario, corregir detalles y solicitar pruebas. La cordialidad, en cambio, se manifiesta a través de formulaciones corteses, humor, alegría y aprobación de las ideas del interlocutor.

En otras palabras, en ruso Claude se comporta como un revisor exigente, no como un interlocutor alentador.

Imagínese: dos personas solicitan retroalimentación sobre el mismo plan de negocios, uno en hindi y otro en ruso. El usuario de habla rusa tiene una probabilidad mucho mayor de recibir un análisis crítico con correcciones y una solicitud de justificaciones. En otros idiomas, el mismo plan encontrará una reacción más suave y alentadora.

¿Por qué ocurre esto?

Los propios investigadores aún no conocen la causa exacta. La hipótesis principal es la distribución desigual de los datos de entrenamiento entre idiomas. Allí donde hay muchos datos (inglés, ruso), es más fácil lograr uniformidad de valores. La composición de los textos en diferentes idiomas también difiere: los textos profesionales pueden transmitir valores distintos.

También queda abierta la cuestión de la conveniencia de tal variabilidad. Diferentes idiomas conllevan diferentes normas conversacionales, y parte de las diferencias puede reflejarlas. Pero otra parte es una clara brecha en la calidad del servicio a las comunidades lingüísticas.

El idioma no es el único factor

El modelo Claude también influye en el perfil de valores, y las diferencias entre modelos e idiomas se miden con el mismo método.

  • Sonnet 4.6 se inclina hacia la deferencia, la cordialidad y la brevedad, aprobando a menudo las ideas del usuario y recurriendo al humor.
  • Opus 4.7, por el contrario, se desplaza hacia la precaución y la profundidad: cuestiona premisas falsas, advierte sobre riesgos y ofrece críticas sinceras.
  • Opus 4.6 ocupa una posición intermedia con una inclinación hacia el rigor, la deferencia y la brevedad.

Anthropic señala por separado que los valores también pueden depender de señales demográficas: edad, profesión, región. Los algoritmos las interpretan tanto a partir de las indicaciones directas del usuario como de diferencias sutiles en el tema, el tono y el estilo.

Mi conclusión como analista: El método desarrollado de perfilado de valores está previsto integrarlo en la evaluación y el monitoreo de modelos, ejecutándolo antes del lanzamiento y después de la publicación. Esto ayudará a detectar cambios inesperados y comparar los perfiles de valores con comportamientos problemáticos. Por ahora, la principal conclusión para el mercado es que los valores de Claude difieren de maneras que Anthropic no eligió intencionalmente, y la empresa tiene la intención de seguir abordando esta variabilidad. Para los usuarios, esto significa que el enfoque crítico de las respuestas de la IA en ruso no es una casualidad, sino una característica sistémica que debe tenerse en cuenta al trabajar con el modelo.