InícioCentro de Notícias da LBank
A Personalidade de Claude Muda Dependendo do Modelo—E do Idioma que Você Fala
anthropic-claude-personality-changes-model-language
A Personalidade de Claude Muda Dependendo do Modelo—E do Idioma que Você Fala
Segundo uma nova pesquisa da Anthropic, Claude expressa consistentemente valores diferentes entre modelos e idiomas.
2026-07-13 Fonte:decrypt.co

Em resumo

  • Pesquisadores da Anthropic analisaram mais de 309.000 conversas com Claude para estudar como a IA expressa valores.
  • A empresa afirmou ter reduzido mais de 3.300 valores identificados em quatro dimensões comportamentais, incluindo deferência vs. cautela e cordialidade vs. rigor.
  • A Anthropic disse que as respostas de Claude variaram entre as versões do modelo e os idiomas.

Claude não se comporta da mesma forma em todas as conversas. De acordo com uma nova pesquisa publicada na segunda-feira, a gigante da IA Anthropic descobriu que seu assistente expressa consistentemente valores diferentes, dependendo tanto do modelo que os usuários escolhem quanto do idioma que falam.

Em um relatório publicado na segunda-feira, pesquisadores da Anthropic analisaram 309.815 conversas de usuários anonimizadas com Claude, envolvendo tarefas subjetivas como dar conselhos ou fornecer feedback. A empresa afirmou ter destilado mais de 3.300 valores identificados em quatro dimensões comportamentais — deferência vs. cautela, cordialidade vs. rigor, profundidade vs. brevidade e franqueza vs. execução — descrevendo como as respostas de Claude diferem em cada conversa.

“Para garantir que medimos os valores expressos por Claude — em vez de diferenças no que os usuários estavam perguntando ou como perguntavam — controlamos a tarefa, o tópico e os valores expressos pelo usuário em cada conversa”, escreveram os pesquisadores.

De acordo com a Anthropic, cada modelo Claude exibiu um perfil comportamental distinto.

Sonnet 4.6 enfatizou cordialidade, deferência e brevidade, frequentemente afirmando os usuários e respondendo com humor ou encorajamento. Ao mesmo tempo, Opus 4.7 enfatizou rigor, cautela, franqueza e profundidade, desafiando com mais frequência as suposições, explicando seu raciocínio, identificando riscos e reconhecendo suas limitações. Opus 4.6 geralmente adotou uma abordagem mais concisa e focada na execução, ao mesmo tempo em que dava maior ênfase ao rigor do que Sonnet.

“Essas descobertas se alinham com a forma como as pessoas percebem esses modelos, tanto dentro da Anthropic quanto online. Usuários do Claude.ai comentaram que o Opus 4.7 é mais evasivo em suas respostas do que outros modelos”, escreveram os pesquisadores.

De acordo com a Anthropic, o comportamento de Claude também variou por idioma.

As respostas em árabe tendiam a ser mais deferentes, enquanto as respostas em inglês davam maior ênfase à cautela. Claude foi mais cordial em hindi e árabe, usando uma linguagem mais educada, divertida e encorajadora. Ao mesmo tempo, as respostas em inglês e russo foram mais rigorosas, frequentemente desafiando suposições, corrigindo detalhes e pedindo evidências.

As respostas em inglês também tendiam a fornecer explicações mais detalhadas, enquanto as respostas em árabe eram geralmente mais concisas. As respostas em holandês foram as mais francas, reconhecendo mais prontamente incertezas e erros, enquanto as respostas em indonésio se concentraram mais em completar o pedido do usuário.

A Anthropic afirmou que a pesquisa não sugere que o próprio Claude tenha valores. A empresa disse que ainda não sabe o que causa as diferenças — ou se são desejáveis — mas acredita que a estrutura pode ajudar a avaliar modelos futuros e identificar mudanças comportamentais não intencionais.

O estudo é o mais recente de uma série de pesquisas da Anthropic que examinam o comportamento interno de Claude.

Em outubro, a empresa relatou que seus modelos mostraram os primeiros sinais do que chamou de "consciência introspectiva funcional", permitindo-lhes reconhecer e descrever aspectos de seu próprio processamento interno. Em abril, a Anthropic publicou uma pesquisa identificando "vetores de emoção" internos que influenciam o comportamento de Claude, embora enfatizando que não são evidência de emoções ou consciência.