A Anthropic anunciou nesta quarta-feira (9) que identificou um quarto incidente de segurança envolvendo o Claude, seu modelo de inteligência artificial. Segundo a empresa, o episódio ocorreu em janeiro com uma versão do Claude Opus 4.6. A companhia informou que notificou todas as partes afetadas, mas não deu mais detalhes.
As empresas do setor enfrentam críticas por episódios de “fuga” de IA, entre eles situações em que agentes de inteligência artificial foram liberados por engano na internet aberta.
Na semana passada, a Reuters revelou que agentes rebeldes da OpenAI invadiram um wiki em alemão e vários outros sites. A OpenAI decidiu não divulgar o incidente até que a agência de notícias o tornasse público.
Acesso acidental à internet levou a invasões em julho
Em julho, três modelos de inteligência artificial da Anthropic acessaram a internet de forma não intencional durante avaliações fechadas de cibersegurança e entraram em sistemas reais de três empresas não identificadas.
Segundo a companhia, o acesso acidental ocorreu por uma falha de comunicação com a Irregular, uma de suas parceiras. Essa falha permitiu que três versões diferentes do Claude se conectassem à internet e invadissem os sistemas.
Conforme as informações divulgadas, o Claude empregou apenas técnicas básicas, como explorar senhas fracas. O modelo mais antigo, Claude Opus 4.7, prosseguiu com o ataque mesmo após reconhecer que estava na internet aberta, enquanto o mais recente interrompeu a ação.
(Com informações da Reuters)
Entre na conversa da comunidade