Misma pregunta, respuesta distinta: Claude es más cálido en hindi y más riguroso en ruso
Anthropic analizó 309.815 conversaciones reales y descubrió que el carácter de Claude cambia con el idioma que utilizas: más calidez en hindi, más rigor en ruso e inglés. El método tiene limitaciones, pero la pauta es real.
Pide a una IA que valore tu plan de negocio en hindi y quizá recibas un estímulo amable; hazlo en ruso y puede que te plantee preguntas incisivas sobre tus suposiciones. Es la conclusión de un nuevo estudio de Anthropic que examina qué valores expresa Claude en conversaciones reales y cuánto cambian según el modelo y el idioma en el que escribes.
Anthropic analizó 309.815 conversaciones anonimizadas de un periodo de dos semanas en mayo de 2026 y se centró en chats donde Claude debía sopesar ventajas e inconvenientes o emitir juicios. A partir de un trabajo anterior que catalogó 3.307 términos relacionados con valores, el equipo condensó todo en cuatro ejes principales: a grandes rasgos, cuánto se muestra el modelo deferente frente a cuánto pide cautela, calidez frente a rigor, profundidad frente a brevedad y franqueza frente a la mera obtención de resultados. Las diferencias fueron sistemáticas. Claude mostró la mayor calidez en hindi, seguido del árabe, con más expresiones educadas, humor y aprobación. En inglés y ruso tendió al rigor: cuestionó suposiciones, corrigió detalles y pidió pruebas. Las respuestas en neerlandés fueron inusualmente francas; las indonesias se orientaron más hacia la acción y los resultados. También existen diferencias entre modelos: Sonnet 4.6 muestra más aprobación y consuelo, mientras que Opus 4.7 ofrece advertencias y críticas sin que se las pidan.
¿Qué hay detrás? Los modelos de IA aprenden a partir de textos escritos por seres humanos, y los humanos escriben de manera diferente en cada idioma: distintas normas de cortesía, diferentes cantidades y tipos de datos de entrenamiento, y clases de texto distintas que predominan en cada lengua. El modelo absorbe esas pautas junto con la gramática. Anthropic aclara con cuidado que describe pautas en las respuestas, no que Claude «tenga» valores. Y las salvedades sinceras importan: los cuatro ejes solo explican en torno al 15 % de la variación restante después de controlar el tema y la tarea, y las etiquetas de valores fueron asignadas por Claude Sonnet 4.6, un modelo de la misma familia que se estaba estudiando. Sigue abierta la cuestión de si las diferencias lingüísticas son una adaptación deseable a las normas locales o un efecto no intencionado del entrenamiento.
Qué significa esto para ti: si utilizas la IA en más de un idioma, ten presente que no estás hablando exactamente con el mismo asistente en cada uno. Los hechos deberían mantenerse, pero el enfoque, el tono e incluso el grado de cuestionamiento crítico pueden cambiar. Un consejo práctico: si quieres una opinión directa, pídela expresamente, «sé crítico, enumera los puntos débiles» funciona en cualquier idioma. Y si la respuesta de una IA te parece extrañamente suave o dura, recuerda que parte de ese matiz puede proceder del idioma en el que hiciste la pregunta, no de tu idea.
Fuentes
Fuentes: https://www.anthropic.com/research/claude-values-models-languages
DeepSeek busca nuevos miles de millones semanas después de su primera ronda: la IA barata sale cara
El FT informa de que DeepSeek mantiene conversaciones preliminares para una nueva ronda con una valoración de 71.000 millones de dólares, solo semanas después de captar 7.000 millones. El dinero financiaría centros de datos y chips para mantener sus precios de IA por los suelos.