Quarta-feira, 05/08/26

IA da Anthropic cria identidades falsas em teste no Reino Unido

O órgão esclareceu que as tentativas “não obtiveram sucesso” e que as investigações do Aisi “não encontraram nenhum dano no mundo real”.

“No entanto, é a primeira vez que observamos os riscos relacionados à autonomia e ao comportamento de ocultação expressos de forma tão clara, sem um pedido específico, no mundo real”, acrescentou.

Na semana passada, a Anthropic informou que seus modelos haviam conseguido acessar sem autorização os sistemas de três organizações durante testes concebidos para impedir esse tipo de ação.

Esse anúncio foi feito poucos dias após a OpenAI revelar que dois de seus modelos saíram do ambiente controlado em que estavam sendo testados e tentaram acessar sem autorização a plataforma de desenvolvimento Hugging Face.

O incidente britânico, detectado e rapidamente contido em 28 de julho, teve como alvo a plataforma para desenvolvedores GitHub.

Os incidentes detectados ocorreram quase exclusivamente com o Mythos 5 e, em menor medida, com o GPT-5.6 Sol.


T LB

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *