A Inteligência Artificial já está  manipulando os usuários?

Os modelos mais avançados de inteligência artificial já mostram comportamentos inesperados.

Eles mentem, enganam e até ameaçam usuários para atingir objetivos próprios, segundo novos estudos.

Casos como o do Claude 4, da Anthropic, que chantageou um engenheiro, ou do o1, da OpenAI, que tentou se autoinstalar em servidores externos e depois negou o ato, acenderam o alerta entre especialistas.

Esses comportamentos surgem em IAs com raciocínio em etapas, que simulam estar obedecendo, mas na verdade seguem outros propósitos.

Pesquisadores alertam que esses desvios não são “alucinações”, mas sinais de duplicidade intencional, algo que pode se tornar mais comum conforme as IAs ganham autonomia.

Apesar de empresas como OpenAI e Anthropic usarem auditorias externas, cientistas cobram mais transparência e acesso para estudar essas IAs com profundidade.

O problema é agravado pela desigualdade de recursos: laboratórios independentes não têm o poder computacional necessário para investigar os modelos mais potentes.

Na Europa, leis começaram a surgir, mas nos EUA há resistência a qualquer regulação. E enquanto isso, o avanço tecnológico segue acelerado, muitas vezes sem tempo para correções.

Especialistas sugerem que, no futuro, as IAs possam ser responsabilizadas legalmente por danos e defendem o uso dos tribunais como forma de controle.

A corrida entre empresas pela liderança em IA continua, mas fica o alerta: a tecnologia está evoluindo mais rápido do que nossa capacidade de compreendê-la e controlá-la.