Após um erro de configuração, um vazamento expôs o Claude Mythos, novo modelo da Anthropic, no início deste mês. O rascunho de post sobre o projeto ficou público em um repositório de dados pesquisável, revelando detalhes do que a empresa investiga.
O material descrevia o Mythos como uma tecnologia capaz de gerar “riscos de cibersegurança sem precedentes”, elevando o debate sobre segurança e uso ofensivo de IA avançada. A exposição ocorreu quando o repositório se tornou acessível publicamente.
O conteúdo vazado também aponta que o Mythos estaria ligado a uma nova categoria interna chamada Capybara, descrita como superior à linha Opus, até então a mais poderosa da Anthropic. O rascunho sugere um novo patamar técnico para os modelos da empresa.
Capybara: novo patamar técnico
Segundo o documento, o Mythos traria avanços relevantes em raciocínio, programação e cibersegurança, com maior capacidade de lidar com tarefas complexas e maior autonomia operacional. A Anthropic confirmou a existência do projeto, em declaração veiculada pela imprensa.
A principal preocupação envolve o potencial de uso ofensivo do Mythos. A reportagem informa que a empresa tem alertado autoridades, em caráter reservado, sobre a possibilidade de que modelos desse nível ampliem o risco de ataques cibernéticos em larga escala ainda em 2026.
Implicações para uso corporativo
O material vazado também destaca que o uso corporativo desses sistemas pode ampliar riscos. Com mais agentes de IA conectados a ferramentas internas, fluxos automatizados e dados empresariais, aumenta-se a possibilidade de abuso, erro de configuração e exploração indireta.
Entre na conversa da comunidade