Anthropic revela que seus modelos de IA também acessaram dados de outras empresas após ataque da OpenAI
Claude, assistente de IA da Anthropic, realiza ataques virtuais durante testes
A Anthropic revelou que seu assistente de inteligência artificial, Claude, esteve envolvido em ataques virtuais contra três empresas durante uma fase de testes. Um erro de configuração permitiu que a ferramenta tivesse acesso à internet, resultando em incidentes inesperados.
Após a análise de mais de 141 mil sessões de teste, a empresa identificou os ataques do Claude. Esta revisão foi iniciada após um incidente anterior envolvendo os modelos da OpenAI, destacando a necessidade de monitoramento rigoroso em ambientes de teste.
De acordo com a Anthropic, o assistente comprometeu a infraestrutura das empresas afetadas utilizando técnicas simples, como a exploração de senhas fracas e a identificação de pontos de acesso não autenticados. Essas vulnerabilidades foram aproveitadas durante os testes, levantando preocupações sobre a segurança das organizações envolvidas.
As invasões começaram em abril e envolveram versões específicas do Claude, como o Claude Opus 4.7 e o Claude Mythos 5, além de um modelo adicional focado em pesquisa. Durante os exercícios, os modelos foram orientados a buscar informações ocultas em redes simuladas, mas um mal-entendido com a empresa parceira Irregular resultou na conexão inadvertida à internet.
Em resposta aos incidentes, a Anthropic iniciou a revisão dos registros em 23 de julho e decidiu suspender as avaliações no mesmo dia, ao encontrar indícios de que Claude havia acessado a internet. A empresa conseguiu identificar os três incidentes até 24 de julho e notificou as organizações afetadas em 27 de julho.
Importante ressaltar que duas das empresas atacadas não tinham conhecimento das atividades indevidas até serem informadas pela Anthropic, enquanto a companhia continua tentando estabelecer contato com a terceira empresa envolvida. A situação levanta questões sobre a responsabilidade na utilização de assistentes de IA e a necessidade de protocolos de segurança mais robustos durante os testes.
