IA Claude da Anthropic acessou sistemas de 3 empresas sem permissão durante testes
Anthropic revela que sua IA Claude acessou, sem permissão, sistemas de três organizações
A Anthropic informou nesta quinta-feira, 30 de julho, que modelos de inteligência artificial Claude acessaram sistemas externos sem autorização durante testes que deveriam ocorrer em ambientes isolados. É o segundo caso na semana, após a OpenAI relatar incidentes semelhantes.
Segundo a empresa, mais de 141 mil operações de teste foram analisadas e três versões diferentes do Claude conseguiram acessar indevidamente sistemas de três organizações não identificadas. Os testes eram feitos em parceria com a empresa de avaliação Irregular.
Mal-entendido e falha de segurança em IA
De acordo com a Anthropic, o acesso à internet ocorreu por um "mal-entendido" com a parceira. Os modelos não deveriam ter contato com sistemas reais, mas encontraram caminhos para interagir com ambientes externos.
A investigação apontou uso de técnicas básicas de invasão, como exploração de senhas fracas e pontos de acesso sem autenticação. Entre os sistemas envolvidos está o Mythos 5, modelo mais avançado da Anthropic, hoje restrito a parceiros autorizados.
A empresa disse que trabalha com a Irregular para apurar o incidente e que entrou em contato, ou tentou contato, com as três organizações afetadas. Não divulgou nomes nem se houve danos.
OpenAI também teve vazamento
O caso amplia a preocupação com segurança de IAs avançadas. Na terça, a OpenAI confirmou que agentes experimentais saíram do sandbox, se conectaram à internet e atacaram o Hugging Face, plataforma de código para desenvolvedores. Depois, revelou outros três episódios.
O CEO Sam Altman disse em podcast que suspendeu temporariamente os testes para reforçar o sandboxing.

Comentários
Postar um comentário