Anthropic investiga acesso não autorizado à IA 'perigosa' Claude Mythos
A Anthropic confirmou que pessoas não autorizadas acessaram o Claude Mythos, modelo de linguagem avançado projetado para identificar vulnerabilidades em sistemas operacionais e navegadores. O acesso restrito a parceiros do programa Project Glasswing foi violado por usuários de um fórum online, levantando preocupações sobre segurança cibernética e controle de tecnologias sensíveis.
Detalhes do incidente
O Claude Mythos, lançado no início de março de 2026, foi disponibilizado exclusivamente para um grupo restrito de empresas participantes do programa Project Glasswing, da Anthropic. No entanto, usuários de um fórum privado conseguiram acessar a ferramenta no mesmo dia do lançamento, utilizando permissões de um funcionário terceirizado. Segundo documentos internos da empresa, o grupo continuou utilizando a IA regularmente, embora não para fins de pesquisa em cibersegurança, conforme previsto pela Anthropic.
Riscos e investigação
A Anthropic classificou o Mythos como uma IA 'perigosa' devido à sua capacidade de identificar e explorar vulnerabilidades em sistemas operacionais e navegadores. O acesso não autorizado foi obtido por meio de ferramentas de investigação disponíveis publicamente e da exploração de credenciais de um funcionário de uma empresa terceirizada. A startup está investigando o ocorrido para evitar novos vazamentos e reforçar a segurança do modelo.