Anthropic afirma que o Mythos, seu modelo de IA Claude Mythos, está evoluindo mais rápido do que o previsto. A evolução foi observada pouco tempo após o lançamento inicial, com testes independentes mostrando avanços em capacidades de cyberspresso. A avaliação acontece no contexto de propostas de uso restrito do Mythos.
A avaliação foi conduzida por a Organização de Segurança de IA do Reino Unido (AISI) e publicada em um blog na quarta-feira. Pesquisadores testaram uma versão mais recente do Mythos, que supostamente superou resultados anteriores e o GPT-5.5 da OpenAI em determinadas métricas de teste.
Desempenho e limites de avaliação
A postagem destaca que o Mythos Preview conseguiu resolver dois cenários de cyberspace, completando o conjunto de tarefas em seis de dez tentativas em um teste, e três de dez em outro. Os autores descrevem como a segunda tarefa foi concluída pela primeira vez pelos modelos avaliados.
Contexto de parceria e objetivos
AISI já havia avaliado o Mythos Preview e o Projeto Glasswing, uma aliança de defendermos de software crítico envolvendo Apple, Google, Microsoft e outros, com acesso limitado ao Mythos. A avaliação anterior indicou que o Mythos representa avanço em relação a modelos anteriores em um cenário de melhoria rápida na área de cibersegurança.
Implicações para a área de cibersegurança
Especialistas ressaltam que modelos de IA avançam rapidamente na execução de tarefas cibernéticas, o que tem impactos diretos na segurança da informação. AISI aponta que, em fevereiro de 2026, a duração de tarefas cibernéticas que modelos de IA conseguem completar dobrou a cada 4,7 meses desde o final de 2024, com novos modelos como Mythos Preview e GPT-5.5 superando essa tendência de crescimento.
Observações sobre testes e limites
Os pesquisadores destacam que a tendência pode mudar e que o Mythos e o GPT-5.5 podem representar exceções ao padrão. Também disseram que os testes utilizam um limite de 2,5 milhões de tokens, o que pode subestimar o potencial de modelos com maior acesso a tokens e infraestrutura de agentes.
Condições de uso e perspectivas
A Anthropic mantém que o Mythos é poderoso demais para liberação ampla. As avaliações externas ajudam a contextualizar o estágio atual do desenvolvimento, sem caracterizar o conjunto de capacidades como definitivo ou inevitável. As evidências indicam melhoria entre versões do Mythos, não apenas entre modelos diferentes.
Entre na conversa da comunidade