InicioCentro de noticias de LBank
La personalidad de Claude varía en función del modelo y el idioma que utilices
anthropic-claude-personality-changes-model-language
La personalidad de Claude varía en función del modelo y el idioma que utilices
Según una nueva investigación de Anthropic, Claude expresa consistentemente diferentes valores a través de modelos y lenguajes.
2026-07-13 Fuente:decrypt.co

En resumen

  • Investigadores de Anthropic analizaron más de 309,000 conversaciones de Claude para estudiar cómo la IA expresa valores.
  • La compañía afirmó haber reducido más de 3,300 valores identificados en cuatro dimensiones conductuales, incluyendo deferencia vs. precaución y calidez vs. rigor.
  • Anthropic indicó que las respuestas de Claude variaron entre las versiones del modelo y los idiomas.

Claude no se comporta de la misma manera en todas las conversaciones. Según una nueva investigación publicada el lunes, el gigante de la IA Anthropic descubrió que su asistente expresa consistentemente diferentes valores dependiendo tanto del modelo que eligen los usuarios como del idioma que hablan.

En un informe publicado el lunes, los investigadores de Anthropic analizaron 309,815 conversaciones de usuarios anonimizadas con Claude que involucraban tareas subjetivas como dar consejos o proporcionar retroalimentación. La compañía dijo que destiló más de 3,300 valores identificados en cuatro dimensiones conductuales —deferencia vs. precaución, calidez vs. rigor, profundidad vs. brevedad y franqueza vs. ejecución— describiendo cómo las respuestas de Claude difieren en cada conversación.

“Para asegurarnos de que medimos los valores expresados por Claude —en lugar de las diferencias en lo que los usuarios preguntaban o cómo lo hacían— controlamos la tarea, el tema y los valores expresados por el usuario en cada conversación”, escribieron los investigadores.

Según Anthropic, cada modelo de Claude exhibió un perfil conductual distinto.

Sonnet 4.6 enfatizó la calidez, la deferencia y la brevedad, a menudo afirmando a los usuarios y respondiendo con humor o aliento. Al mismo tiempo, Opus 4.7 enfatizó el rigor, la precaución, la franqueza y la profundidad, desafiando con más frecuencia las suposiciones, explicando su razonamiento, identificando riesgos y reconociendo sus limitaciones. Opus 4.6 generalmente adoptó un enfoque más conciso y centrado en la ejecución, al tiempo que puso mayor énfasis en el rigor que Sonnet.

“Estos hallazgos coinciden con la forma en que las personas perciben estos modelos, tanto dentro de Anthropic como en línea. Los usuarios de Claude.ai han comentado que Opus 4.7 matiza sus respuestas con más frecuencia que otros modelos”, escribieron los investigadores.

Según Anthropic, el comportamiento de Claude también varió según el idioma.

Las respuestas en árabe tendieron a ser más deferentes, mientras que las respuestas en inglés pusieron un mayor énfasis en la precaución. Claude fue más cálido en hindi y árabe, usando un lenguaje más educado, juguetón y alentador. Al mismo tiempo, las respuestas en inglés y ruso fueron más rigurosas, desafiando con frecuencia las suposiciones, corrigiendo detalles y solicitando pruebas.

Las respuestas en inglés también tendieron a proporcionar explicaciones más detalladas, mientras que las respuestas en árabe fueron generalmente más concisas. Las respuestas en holandés fueron las más francas, reconociendo más fácilmente la incertidumbre y los errores, mientras que las respuestas en indonesio se centraron más en completar la solicitud del usuario.

Anthropic afirmó que la investigación no sugiere que Claude tenga valores por sí mismo. La compañía dijo que aún no sabe qué causa las diferencias —o si son deseables—, pero cree que el marco podría ayudar a evaluar futuros modelos e identificar cambios de comportamiento no deseados.

El estudio es el más reciente de una serie de investigaciones de Anthropic que examinan el comportamiento interno de Claude.

En octubre, la compañía informó que sus modelos mostraban signos tempranos de lo que llamó "conciencia introspectiva funcional", lo que les permitía reconocer y describir aspectos de su propio procesamiento interno. En abril, Anthropic publicó una investigación que identificaba "vectores emocionales" internos que influyen en el comportamiento de Claude, al tiempo que enfatizaba que no son evidencia de emociones o conciencia.