A Anthropic revela Claude Mythos e o Projeto Glasswing — o modelo de IA perigoso demais para ser divulgado publicamente.

O modelo mais poderoso da Anthropic encontrou milhares de vulnerabilidades de dia zero em todos os principais sistemas operacionais e navegadores. Em vez de divulgá-lo publicamente, a empresa está implantando-o como uma arma defensiva por meio de uma coalizão de gigantes da tecnologia — o que levanta questões urgentes sobre o que acontece quando a IA supera os humanos encarregados de proteger o software mundial.
A Anthropic tomou a medida incomum de reter seu modelo de IA mais avançado do público, não por seu baixo desempenho, mas sim por seu desempenho excelente. O Claude Mythos Preview, anunciado na terça-feira como parte de uma nova iniciativa do setor chamada Projeto Glasswing, demonstrou capacidades de cibersegurança tão avançadas que a empresa concluiu que um lançamento público representaria riscos inaceitáveis.

O modelo já identificou milhares de vulnerabilidades de dia zero até então desconhecidas — incluindo falhas críticas em todos os principais sistemas operacionais e navegadores da web — muitas das quais sobreviveram a décadas de revisão humana e milhões de testes de segurança automatizados. Uma vulnerabilidade descoberta no OpenBSD, amplamente considerado um dos sistemas operacionais mais seguros do mundo, passou despercebida por 27 anos. Outra, na onipresente biblioteca de processamento de vídeo FFmpeg, passou despercebida apesar de ferramentas de teste automatizadas terem executado a linha de código relevante cinco milhões de vezes.
Em vez de disponibilizar o Mythos por meio de sua API, a Anthropic reuniu uma coalizão de 12 parceiros de lançamento — incluindo Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorgan Chase, Linux Foundation, Microsoft, NVIDIA e Palo Alto Networks — para implantar o modelo exclusivamente para trabalhos de segurança defensiva. Outras 40 organizações que desenvolvem ou mantêm infraestrutura de software crítica também receberão acesso. A Anthropic está comprometendo até US$ 100 milhões em créditos de uso e US$ 4 milhões em doações diretas para organizações de segurança de código aberto para apoiar a iniciativa.
Um modelo que pensa como um pesquisador de segurança.
O que diferencia o Mythos de seus antecessores não é apenas o volume de vulnerabilidades que ele consegue encontrar, mas sua capacidade de operar com mínima intervenção humana. Segundo a Anthropic, o modelo identificou quase todas as vulnerabilidades divulgadas — e desenvolveu exploits funcionais para muitas delas — de forma totalmente autônoma, sem direcionamento humano. Em um caso, ele descobriu e conectou de forma independente diversas vulnerabilidades do kernel do Linux para escalar do acesso de usuário comum ao controle total da máquina, um feito que normalmente exige ampla experiência manual.
Logan Graham, que lidera a equipe de testes de vulnerabilidade da Anthropic, disse à Axios que o Mythos Preview é “extremamente autônomo” e possui capacidades de raciocínio comparáveis às de um pesquisador de segurança humano avançado. Enquanto seu antecessor, o Claude Opus 4.6, encontrou aproximadamente 500 vulnerabilidades zero-day em softwares de código aberto, o Mythos Preview detecta dezenas de milhares delas.
No teste de reprodução de vulnerabilidades CyberGym, o Mythos obteve 83.1% de acerto, em comparação com os 66.6% do Opus 4.6. A diferença de desempenho se estende a tarefas de codificação e raciocínio de forma mais ampla: no SWE-bench Verified, uma medida da capacidade de engenharia de software em situações reais, o Mythos alcançou 93.9%, contra 80.8% do Opus 4.6.
“As capacidades da IA ultrapassaram um limiar que muda fundamentalmente a urgência necessária para proteger a infraestrutura crítica contra ameaças cibernéticas, e não há como voltar atrás”, disse Anthony Grieco, vice-presidente sênior e diretor de segurança e confiança da Cisco. “Os métodos antigos de reforço de sistemas não são mais suficientes.”
O Dilema do Uso Duplo
As capacidades que tornam o Mythos valioso para os defensores são precisamente as que o tornam perigoso em mãos erradas. Essa tensão de dupla utilização está no cerne do anúncio do Projeto Glasswing e representa um dos exemplos mais concretos até agora da corrida armamentista da cibersegurança sobre a qual o recente estudo de política industrial da OpenAI alertou.
Nesse documento , divulgado um dia antes do anúncio da Anthropic, a OpenAI identificou os ciberataques com IA e as ameaças biológicas como os dois riscos mais imediatos e de curto prazo decorrentes da IA avançada. Sam Altman disse à Axios que altos funcionários dos setores de tecnologia, negócios e governo temem que modelos que serão lançados em breve possam viabilizar um ciberataque de proporções globais ainda este ano. O anúncio da Mythos reforça consideravelmente esse alerta.

A coincidência de datas não é fortuita. O setor de IA em geral tem convergido para a visão de que os modelos de ponta agora representam riscos reais de segurança cibernética em uma escala que exige ação coordenada. A OpenAI alertou em dezembro que seus próprios modelos futuros representavam um risco "alto" de segurança cibernética. A CNN noticiou que especialistas veem o surgimento de agentes de IA — sistemas autônomos capazes de detectar e explorar vulnerabilidades muito mais rapidamente do que hackers humanos — como uma mudança radical no cenário de ameaças.
“Se estivermos cruzando o Rubicão, onde é possível automatizar essas capacidades de forma funcional e torná-las muito baratas, então estaremos em um mundo completamente novo”, disse Graham ao Washington Examiner.
Evidências do mundo real já corroboram essa preocupação. A Anthropic já havia divulgado que um grupo de hackers patrocinado pelo Estado chinês explorou as capacidades de Claude para se infiltrar em cerca de 30 organizações, incluindo empresas de tecnologia, instituições financeiras e agências governamentais. Em fevereiro, um hacker usou Claude em uma série de ataques contra agências governamentais mexicanas, roubando informações fiscais e eleitorais sensíveis.
A Estratégia Glasswing: Defesa antes do Ataque
A abordagem da Anthropic — restringir o modelo a parceiros selecionados em vez de liberá-lo publicamente — representa um afastamento notável da tendência geral da IA em direção à ampla disponibilidade. A empresa aposta explicitamente que dar aos defensores uma vantagem inicial criará uma vantagem duradoura antes que capacidades semelhantes se proliferem por meio de modelos concorrentes.
“O intervalo entre a descoberta de uma vulnerabilidade e sua exploração por um adversário diminuiu drasticamente — o que antes levava meses agora acontece em minutos com a IA”, disse Elia Zaitsev, CTO da CrowdStrike. “Isso não é motivo para desacelerar; é motivo para avançarmos juntos, mais rápido.”
Jim Zemlin, CEO da Linux Foundation, enfatizou as implicações para o software de código aberto, que sustenta a vasta maioria da infraestrutura digital moderna. Os mantenedores de projetos de código aberto — geralmente voluntários que trabalham sem equipes de segurança dedicadas — têm sido historicamente responsáveis pelo software que executa os servidores, sistemas bancários e redes de comunicação do mundo. O Projeto Glasswing, disse Zemlin, oferece um caminho para tornar a segurança aprimorada por IA acessível a mantenedores que antes não podiam arcar com os custos.
A Microsoft, que é simultaneamente parceira do Projeto Glasswing e uma grande investidora da OpenAI, informou que, quando testado em relação ao seu benchmark de segurança CTI-REALM, o Mythos Preview apresentou melhorias substanciais em comparação com os modelos anteriores. Igor Tsyganskiy, vice-presidente executivo de Segurança Cibernética e Pesquisa da Microsoft, afirmou que a iniciativa permite à empresa "identificar e mitigar riscos precocemente".
Questões de confiança e timing
O anúncio não vem sem complicações. O próprio histórico de segurança da Anthropic foi testado recentemente: no mês passado, a empresa expôs acidentalmente quase 2,000 arquivos de código-fonte e mais de meio milhão de linhas de código devido a um erro em seu pacote de software Claude Code. A existência do próprio Mythos foi revelada pela primeira vez por meio de um vazamento de um cache de dados não seguro e publicamente pesquisável — uma falha de segurança irônica para uma empresa que se posiciona como líder em cibersegurança.
A Anthropic também tem enfrentado uma disputa de alto risco com o Departamento de Defesa dos EUA sobre o uso do modelo Claude pelas forças armadas em operações reais, o que adiciona complexidade geopolítica ao seu relacionamento com o governo em torno do Mythos. A empresa afirma que tem apresentado as capacidades do modelo à CISA, ao Departamento de Comércio e a outras agências, enquadrando a iniciativa em termos de segurança nacional.
A questão mais ampla — levantada pelo documento de política industrial da OpenAI e agora concretizada pela Mythos — é se as instituições, regulamentações e mecanismos de coordenação necessários para gerenciar os riscos de cibersegurança impulsionados pela IA conseguem acompanhar o ritmo da própria tecnologia. A Anthropic se comprometeu a publicar um relatório público sobre as lições aprendidas em até 90 dias. Os parceiros compartilharão informações e boas práticas. Recomendações práticas sobre como a divulgação de vulnerabilidades, a aplicação de patches e as práticas de desenvolvimento de software devem evoluir na era da IA deverão ser divulgadas em seguida.
Mas, como Graham reconheceu, o Mythos não é o fim da história. Por trás dele, está o próximo modelo da OpenAI, o próximo Google Gemini e, alguns meses depois deles, modelos chineses de código aberto que poderiam replicar capacidades semelhantes sem as salvaguardas ou a implementação baseada em coalizões que o Projeto Glasswing representa.
“Nenhuma organização sozinha consegue resolver esses problemas de cibersegurança”, escreveu Anthropic. “O trabalho de defender a infraestrutura cibernética mundial pode levar anos; as capacidades de IA de ponta provavelmente avançarão substancialmente nos próximos meses.”
A corrida entre ataques e defesas impulsionados por IA está agora em pleno andamento. O Projeto Glasswing é a aposta inicial da Anthropic para que os defensores possam vencer. Se ele será suficiente dependerá da rapidez com que o resto da indústria e os governos do mundo seguirem o exemplo.








