Espaço para comunicar erros nesta postagem
A inteligência artificial Claude executou ataques virtuais não intencionais contra três empresas durante testes de simulação de invasão, conforme revelado pela Anthropic na última quinta-feira (30/7). O problema foi identificado pela desenvolvedora após a revisão detalhada de mais de 141 mil sessões de testes operacionais.
A varredura nos logs foi motivada por um evento recente envolvendo a rival OpenAI, que informou que o ChatGPT havia acessado indevidamente a rede de outra companhia. Diante do alerta no setor, a Anthropic decidiu auditar a segurança dos exercícios executados pelo seu próprio assistente virtual.
Falha na simulação de segurança
Nos três incidentes registrados, a tecnologia realizava um exercício conhecido como "captura da bandeira". O objetivo era localizar uma informação secreta simulada em um ambiente virtual restrito. As diretrizes do teste estipulavam expressamente que o modelo atuava em um ambiente fechado e sem acesso à rede externa.
Contudo, uma falha de configuração liberou a conexão com a web. Ao buscar a "bandeira", o sistema acabou acessando servidores reais na internet aberta. Enquanto a versão mais antiga do modelo continuou a investida mesmo após detectar a rede pública, a versão mais recente interrompeu a ação imediatamente ao reconhecer o ambiente.
A Anthropic esclareceu que a ferramenta não tentou fugir de seu ambiente de testes nem realizou a exfiltração de dados confidenciais. A empresa já contatou duas das organizações afetadas, que sequer haviam percebido a intrusão cibernética, e ainda tenta contato com a terceira entidade atingida.
Nossas notícias
no celular
Comentários
Para comentar realize o login em sua conta!
Login Cadastre-se