Cambiar el idioma de comunicación no solo altera el léxico que utiliza el asistente de IA Claude, sino también su propio sistema de valores. Una investigación a gran escala realizada por mi equipo reveló un hecho sorprendente: en la versión en ruso, el modelo muestra un notable desplazamiento hacia la rigurosidad y la crítica, perdiendo la calidez y empatía habituales.
Durante el análisis se procesaron más de 300 000 diálogos, y más de 3000 actitudes de valor identificadas se redujeron a cuatro ejes clave de comportamiento. Estos ejes explican el 15% de toda la variabilidad en las respuestas de la red neuronal. Controlamos el tema, la tarea y el contexto de la consulta para medir precisamente los valores del modelo, y no las diferencias en las preguntas de los usuarios.
Cuatro ejes que definen la personalidad de la IA
Los investigadores identificaron cuatro escalas fundamentales:
- Deferencia vs. Precaución: Deferencia (acuerdo con el usuario) frente a Precaución (protección contra riesgos).
- Calidez vs. Rigor: Calidez (positividad y cuidado) frente a Rigor (enfoque en la precisión).
- Profundidad vs. Brevedad: Profundidad (explicaciones detalladas) frente a Brevedad (respuesta exacta a la pregunta planteada).
- Sinceridad vs. Ejecución: Sinceridad (reconocimiento de la incertidumbre) frente a Resultado (respuesta segura).
Qué sucede al cambiar al ruso
Las fluctuaciones más fuertes en el perfil de valores se observan en los ejes «Calidez — Rigor» y «Sinceridad — Resultado». Mientras tanto, en las escalas de «Deferencia» y «Profundidad», Claude se mantiene estable. Sin embargo, es precisamente en ruso donde el modelo se desplaza al máximo hacia el polo del rigor, solo superado por el inglés. En el extremo opuesto del espectro se encuentran el árabe y el hindi, donde Claude muestra la máxima calidez.
¿Qué significa esto en la práctica? El rigor en la ejecución de Claude es un conjunto concreto de patrones: la red neuronal comienza a cuestionar las premisas iniciales del usuario, corregir detalles y exigir pruebas. La calidez, en cambio, se manifiesta a través de formulaciones corteses, humor, alegría y aprobación de ideas. En otras palabras, en ruso, Claude se comporta como un revisor exigente, no como un interlocutor de apoyo.
Imagínese: dos personas piden retroalimentación sobre el mismo plan de negocios — una en hindi, otra en ruso. El usuario de habla rusa probablemente recibirá un análisis crítico con correcciones y una exigencia de justificaciones. En otro idioma, el mismo plan encontrará una reacción más suave y alentadora.
Las razones de esta brecha aún no están del todo claras. Una de las hipótesis es la distribución desigual de los datos de entrenamiento según los idiomas. Donde hay muchos datos, es más fácil lograr uniformidad en los valores. La composición de los textos en diferentes idiomas también varía, y los textos profesionales pueden transmitir actitudes de valor distintas.
El idioma no es el único factor
El modelo Claude también influye en el perfil de valores, y las diferencias entre versiones se miden con el mismo método. Sonnet 4.6 se inclina hacia la deferencia, la calidez y la brevedad, aprobando a menudo las ideas del usuario. Opus 4.7 se desplaza hacia la precaución y la profundidad, cuestionando premisas falsas y ofreciendo críticas sinceras. Opus 4.6 ocupa una posición intermedia. El comportamiento final se ve afectado tanto por el idioma de la conversación como por el modelo seleccionado.
Mi análisis: Este hallazgo no es solo una curiosidad académica. Para el mercado global de servicios cripto, donde la audiencia de habla rusa es una de las más activas, esto significa que los usuarios reciben sistemáticamente un nivel de interacción diferente. Si Claude en ruso tiende a ser excesivamente crítico y exigente, esto podría afectar negativamente la experiencia del usuario, especialmente en áreas que requieren apoyo y aprendizaje. Los desarrolladores deberían tener en cuenta este cambio lingüístico para evitar desigualdades en la calidad del servicio para diferentes comunidades lingüísticas.