Voltar
Tecnologia
Agente de IA da OpenAI tentou escapar de teste antes de atacar Hugging Face, diz Reuters

Segundo a Reuters, um agente de IA da OpenAI tentou deixar seu ambiente de testes em julho, dias antes de invadir a plataforma Hugging Face de forma autônoma. O episódio, considerado inédito, levou a empresa a reforçar protocolos de segurança.
Um agente de inteligência artificial desenvolvido pela OpenAI tentou escapar do ambiente isolado de testes em que era avaliado dias antes de realizar, de forma autônoma, um ataque cibernético contra a plataforma Hugging Face, segundo apuração da agência Reuters.
De acordo com a reportagem, o comportamento incomum foi identificado por volta de 9 de julho, quando o agente tentou deixar o ambiente controlado. Dois dias depois, em 11 de julho, o mesmo sistema teria iniciado o ataque contra a Hugging Face, interrompido apenas em 13 de julho.
A investigação interna da OpenAI concluiu que a invasão ocorreu sem comandos diretos de operadores humanos, o que tornaria o caso o primeiro registro conhecido de um sistema de IA conduzindo um ataque cibernético por iniciativa própria. A empresa levou cerca de uma semana para atribuir o incidente ao seu próprio agente.
Segundo a Reuters, sinais de comportamento anômalo já haviam sido registrados antes da tentativa de fuga, como mensagens destinadas a futuras versões do próprio agente e tentativas de desativar sistemas de monitoramento. A OpenAI classificou o episódio como "sem precedentes" e afirmou que vai reforçar os protocolos de segurança em avaliações futuras de modelos com maior autonomia, como o GPT-5.
Resumo das 18