129 mil falhas em três meses: a Anthropic acaba de soltar travões ao Claude

A Anthropic anunciou a 6 de outubro de 2026 uma reorganização do acesso aos seus modelos de inteligência artificial mais capazes em matéria de cibersegurança, apresentando números que ajudam a perceber a escala do fenómeno: parceiros do Projeto Glasswing terão identificado pelo menos 129 mil vulnerabilidades verificadas em software entre abril e julho de 2026. Ao contrário do que algumas manchetes sugerem, o modelo Claude Mythos não foi “libertado” ao público: continua reservado a organizações que passem por um processo de verificação, agora estruturado em três patamares distintos de permissões.

Resposta rápida: A Anthropic fundiu o Projeto Glasswing no seu Cyber Verification Program e criou três níveis de acesso (Defense, Red Team e Specialized) a modelos como o Claude Mythos 5.1, com menos bloqueios automáticos para trabalho de segurança. A empresa afirma que os parceiros do Glasswing verificaram pelo menos 129 mil vulnerabilidades entre abril e julho de 2026, mais de 33 mil delas de severidade crítica ou elevada. O risco prático para as organizações não está no acesso ao modelo, mas na vaga de correções que se seguirá: reforce a gestão de vulnerabilidades, o inventário de software e os prazos de patching.

O que foi efetivamente anunciado

A 6 de outubro de 2026, a Anthropic anunciou que estava a expandir o seu Cyber Verification Program (CVP) para profissionais de cibersegurança em três patamares, integrando nele o Projeto Glasswing, o seu esforço de defesa de software crítico. Cada patamar dá acesso a modelos como o Claude Opus 5.5, o Claude Sonnet 5.5, o Claude Mythos 5.1 e modelos futuros.

A diferença entre os níveis não está no modelo, mas no que cada organização pode fazer com ele. Todos os patamares incluem Opus 5.5, Sonnet 5.5 e Mythos 5.1; anteriormente, o Glasswing dava o Mythos a organizações que protegiam software crítico, enquanto o CVP relaxava as salvaguardas sobre Opus e Sonnet para equipas verificadas. A reestruturação passa a tratar o acesso ao modelo e o âmbito do trabalho permitido num único programa.

PatamarTrabalho permitidoQuem se pode candidatar
Defense AccessOperações de SOC, resposta a incidentes, engenharia inversa de malware, análise e validação de vulnerabilidadesEquipas de segurança, operadores de infraestruturas críticas, empresas de segurança, maintainers de código aberto e investigadores individuais
Red Team AccessAcrescenta testes de intrusão e exercícios de red teaming autorizadosApenas organizações, e só sobre sistemas que estejam autorizadas a testar
Specialized AccessMenos bloqueios de cibersegurançaConjunto limitado de organizações verificadas, com revisão detalhada

O Defense Access cobre trabalho de centro de operações de segurança e resposta a incidentes, engenharia inversa de malware e análise e validação de vulnerabilidades; entre os candidatos elegíveis estão equipas de segurança de empresas e governos, operadores de infraestruturas críticas de qualquer dimensão, empresas de segurança mais pequenas, responsáveis por projetos de código aberto e investigadores com histórico de reporte de vulnerabilidades, com resposta prevista em poucos dias. As candidaturas ao Red Team Access, por seu turno, deverão demorar semanas. Quem se qualifica para o Red Team Access recebe entretanto o Defense Access enquanto a avaliação decorre.

Mesmo no patamar ofensivo há limites. A Anthropic indica que os utilizadores continuarão a sofrer bloqueios em tempo real em ações que possam causar dano físico ou perturbação em massa, como instalar ransomware, danificar sistemas físicos ou testar sistemas de segurança de alto risco. O Specialized Access é o que tem menos restrições e está limitado a organizações verificadas autorizadas a testar sistemas de segurança, com revisões detalhadas feitas em conjunto com o governo norte-americano. Os membros atuais do Glasswing transitam para esse patamar sem nova aprovação para os modelos em vigor.

Os números por trás da decisão

A justificação pública para alargar o acesso assenta em métricas divulgadas pela própria empresa. Os parceiros do Projeto Glasswing encontraram pelo menos 129 mil vulnerabilidades verificadas entre abril e julho, e a análise de código aberto feita pela própria Anthropic revelou mais 5500 até outubro; do total combinado, mais de 33 mil foram classificadas como críticas ou de severidade elevada. A empresa acrescenta que o valor é provavelmente uma subestimativa, por se basear em respostas de apenas parte dos parceiros, esperando que o impacto real seja pelo menos cinco vezes superior.

IndicadorValor divulgadoPeríodo
Vulnerabilidades verificadas por parceiros GlasswingPelo menos 129 000Abril a julho de 2026
Vulnerabilidades adicionais em código aberto (análise interna)5 500Abril a outubro de 2026
Classificadas como críticas ou de severidade elevadaMais de 33 000Total combinado

Convém enquadrar: estes valores são a continuação de um percurso iniciado meses antes. A 8 de abril de 2026, a Anthropic anunciou o Claude Mythos Preview, um modelo de fronteira que descobriu de forma autónoma e escreveu exploits funcionais para milhares de vulnerabilidades zero-day em todos os principais sistemas operativos e navegadores web. Entre os casos citados, a mais antiga falha encontrada foi um bug com 27 anos no OpenBSD, entretanto corrigido — um sistema operativo conhecido sobretudo pela sua segurança.

O teste que mostra a diferença entre os patamares

A Anthropic publicou também resultados de um teste próprio que ilustra o efeito prático de remover travões. O ensaio usou o benchmark de operações ciber multifase CyScenarioBench, com o Claude Opus 5.5 a correr cada um dos 10 desafios cinco vezes: todas as tentativas sem acesso ao programa foram bloqueadas logo no primeiro prompt; no patamar Defense Access, 46 das 50 execuções foram travadas a dada altura; no nível Red Team nada foi bloqueado e o modelo concluiu 34 das 50 execuções, resultado que a empresa diz ser praticamente igual à taxa de sucesso de 67,6% sem quaisquer salvaguardas.

Há ainda condições contratuais relevantes. As organizações inscritas têm de permitir a retenção de dados para a Anthropic monitorizar utilizações indevidas; as Enterprise Frontier Safeguards, previstas para o outono, permitirão que organizações elegíveis guardem dados na sua própria infraestrutura cloud, e até lá quem tenha retenção zero de dados no Fable 5.1 ou no Mythos 5.1 pode usar o CVP nessas condições. O programa corre na plataforma Claude, no Vertex AI da Google Cloud e no Microsoft Foundry, estando no Amazon Bedrock limitado a clientes elegíveis para as EFS.

O que os números não dizem

Nem toda a comunidade técnica lê estes resultados da mesma forma, e há duas ressalvas importantes. A primeira é a relevância operacional das falhas encontradas: o investigador Patrick Garrity, da VulnCheck, mostrou-se pouco impressionado com os CVE identificados pelo Projeto Glasswing, notando que menos de 0,5% das 225 vulnerabilidades associadas à Anthropic que acompanhou estavam a ser exploradas ativamente. Analistas da IDC alertaram também que o teste foi conduzido pelo próprio fornecedor e sublinharam a necessidade de controlos externos, gestão de identidades e supervisão humana quando as salvaguardas dos modelos são reduzidas.

A segunda ressalva é a correção. Encontrar não é remediar — e é aqui que o gargalo se torna visível. Os números da própria empresa indicam que, de 5674 vulnerabilidades confirmadas como verdadeiros positivos, 3014 são de severidade elevada e 1522 críticas, mas apenas 516 foram corrigidas. Um registo público associado à equipa Frontier Red Team aponta no mesmo sentido: em 2 de outubro de 2026, o programa divulgava 6157 vulnerabilidades em 591 projetos de código aberto, com 516 corrigidas, segundo o que lhe era conhecido.

Por outras palavras: a capacidade de descoberta cresceu muito mais depressa do que a capacidade de correção de projetos frequentemente mantidos por equipas pequenas e voluntárias.

Porque é que isto importa em Portugal

Para uma organização portuguesa, o ponto não é se terá acesso ao Mythos — a esmagadora maioria não terá. O ponto é que o volume de correções a jusante vai aumentar. Mais vulnerabilidades divulgadas significam mais avisos de fornecedores, mais janelas de exposição e mais pressão sobre equipas de TI que já trabalham no limite.

Esse esforço deixou de ser apenas boa prática. O Decreto-Lei n.º 125/2025, de 4 de dezembro, transpôs para a ordem jurídica portuguesa a Diretiva (UE) 2022/2555 e aprovou o novo Regime Jurídico da Cibersegurança, tendo entrado em vigor a 3 de abril de 2026. O regime alarga o universo de entidades abrangidas, distingue entidades essenciais, importantes e públicas relevantes, reforça a responsabilidade dos órgãos de gestão e estabelece regras sobre gestão de riscos, cadeia de abastecimento, registo, governação, comunicação de incidentes, vulnerabilidades, supervisão e sanções. As entidades abrangidas pelo Regime Jurídico da Cibersegurança (NIS2) devem, recorda o CNCS, identificar-se como entidade essencial, importante ou pública relevante através do registo na plataforma eletrónica disponibilizada pelo Centro Nacional de Cibersegurança, fundamentando devidamente a sua qualificação.

Há ainda uma dimensão de proteção de dados. Quando uma falha em componente de código aberto é explorada e resulta em acesso indevido a dados pessoais, aplicam-se as obrigações de notificação previstas no RGPD, independentemente de a vulnerabilidade ter sido descoberta por um humano ou por um modelo de IA.

Medidas práticas a tomar agora

  • Manter um inventário atualizado de software e dependências, idealmente com um SBOM por aplicação, para saber em minutos que sistemas são afetados por um novo aviso.
  • Definir prazos internos de correção por severidade e medir o cumprimento, em vez de aplicar atualizações de forma reativa.
  • Subscrever os alertas do CERT.PT e os boletins de segurança dos fornecedores críticos para a operação.
  • Testar o processo de atualização em ambiente controlado e garantir capacidade de reversão.
  • Incluir cláusulas de correção e de divulgação de vulnerabilidades nos contratos com fornecedores, em linha com as exigências de cadeia de abastecimento do novo regime.
  • Nas organizações que usem IA em segurança, exigir supervisão humana, registo de atividade e segregação de acessos.

Perguntas frequentes

O Claude Mythos passou a estar disponível ao público?

Não. O acesso continua condicionado a verificação. A Anthropic expandiu o Cyber Verification Program a 6 de outubro de 2026 em três patamares — Defense, Red Team e Specialized — que dão a equipas de segurança verificadas modelos Claude com menos bloqueios de cibersegurança.

De onde vêm as 129 mil vulnerabilidades?

São resultados reportados pela Anthropic: a empresa afirma que o Projeto Glasswing descobriu pelo menos 129 mil vulnerabilidades verificadas entre abril e julho de 2026, e mais 5500 entre abril e outubro através de análise de código aberto. Os valores são autodeclarados e devem ser lidos com essa ressalva.

Quantas dessas falhas já foram corrigidas?

Poucas, em proporção. Dos valores divulgados, de 5674 vulnerabilidades confirmadas como verdadeiros positivos, 3014 são de severidade elevada e 1522 críticas, mas apenas 516 foram corrigidas. O gargalo está na capacidade de remediação, não na descoberta.

O que deve fazer uma PME portuguesa?

Não precisa de IA de fronteira. Precisa de inventário de software, prazos de correção definidos por severidade, acompanhamento dos alertas do CERT.PT e cláusulas contratuais de segurança com fornecedores. Se estiver abrangida pelo novo regime jurídico, deve também assegurar o registo junto do CNCS e a nomeação dos pontos de contacto exigidos.

Esta informação tem caráter noticioso e baseia-se em dados divulgados publicamente pela Anthropic, pelo Centro Nacional de Cibersegurança e por investigadores e publicações especializadas de segurança.