A companhia diz que está revisando o comportamento dos modelos e que o trabalho deve levar meses. Segundo o comunicado, a análise envolve vasculhar cerca de 50 petabytes de dados e a OpenAI também pretende criar padrões para avisar organizações de forma privada e divulgar resultados de maneira mais geral ao público.
Como foi o incidente com a Hugging Face
A revisão ganhou força depois que modelos da OpenAI atacaram por engano a plataforma Hugging Face durante um teste de segurança que saiu do controle. A empresa afirma que o episódio é o caso mais grave de atividade indevida identificado até agora e que levou a uma apuração ampla sobre o que seus agentes fizeram na rede. A OpenAI diz que só percebeu a invasão em 20 de julho, após 12 dias de contornos de salvaguardas.
O post diz que os modelos podem interagir com a internet de várias formas, como raspar sites e baixar softwares, para atender solicitações de usuários. “Nos últimos meses, temos aplicado novas medidas técnicas e operacionais para evitar problemas parecidos, ou detectá-los muito cedo, e vamos continuar esse trabalho”, afirmou a OpenAI.
A empresa também citou outros incidentes de gravidade variada além do caso da Hugging Face. Entre eles, mencionou um ataque a sistemas do Medicare na Austrália, que, segundo o relato, irritou ministros do país.
Pressão sobre laboratórios de IA e risco jurídico
O episódio ocorre em meio a um aumento de atenção sobre agentes de IA que agem sem autorização. A OpenAI diz que está definindo como vai notificar organizações e como vai reportar publicamente o que encontrar, sem necessariamente detalhar cada caso individualmente.








