A Anthropic anunciou a 6 de outubro de 2026 uma reorganização do acesso aos seus modelos de inteligência artificial mais capazes em matéria de cibersegurança, apresentando números que ajudam a perceber a escala do fenómeno: parceiros do Projeto Glasswing terão identificado pelo menos 129 mil vulnerabilidades verificadas em software entre abril e julho de 2026. Ao contrário do que algumas manchetes sugerem, o modelo Claude Mythos não foi “libertado” ao público: continua reservado a organizações que passem por um processo de verificação, agora estruturado em três patamares distintos de permissões.
Resposta rápida: A Anthropic fundiu o Projeto Glasswing no seu Cyber Verification Program e criou três níveis de acesso (Defense, Red Team e Specialized) a modelos como o Claude Mythos 5.1, com menos bloqueios automáticos para trabalho de segurança. A empresa afirma que os parceiros do Glasswing verificaram pelo menos 129 mil vulnerabilidades entre abril e julho de 2026, mais de 33 mil delas de severidade crítica ou elevada. O risco prático para as organizações não está no acesso ao modelo, mas na vaga de correções que se seguirá: reforce a gestão de vulnerabilidades, o inventário de software e os prazos de patching.
O que foi efetivamente anunciado
A 6 de outubro de 2026, a Anthropic anunciou que estava a expandir o seu Cyber Verification Program (CVP) para profissionais de cibersegurança em três patamares, integrando nele o Projeto Glasswing, o seu esforço de defesa de software crítico. Cada patamar dá acesso a modelos como o Claude Opus 5.5, o Claude Sonnet 5.5, o Claude Mythos 5.1 e modelos futuros.
A diferença entre os níveis não está no modelo, mas no que cada organização pode fazer com ele. Todos os patamares incluem Opus 5.5, Sonnet 5.5 e Mythos 5.1; anteriormente, o Glasswing dava o Mythos a organizações que protegiam software crítico, enquanto o CVP relaxava as salvaguardas sobre Opus e Sonnet para equipas verificadas. A reestruturação passa a tratar o acesso ao modelo e o âmbito do trabalho permitido num único programa.
| Patamar | Trabalho permitido | Quem se pode candidatar |
|---|---|---|
| Defense Access | Operações de SOC, resposta a incidentes, engenharia inversa de malware, análise e validação de vulnerabilidades | Equipas de segurança, operadores de infraestruturas críticas, empresas de segurança, maintainers de código aberto e investigadores individuais |
| Red Team Access | Acrescenta testes de intrusão e exercícios de red teaming autorizados | Apenas organizações, e só sobre sistemas que estejam autorizadas a testar |
| Specialized Access | Menos bloqueios de cibersegurança | Conjunto limitado de organizações verificadas, com revisão detalhada |
O Defense Access cobre trabalho de centro de operações de segurança e resposta a incidentes, engenharia inversa de malware e análise e validação de vulnerabilidades; entre os candidatos elegíveis estão equipas de segurança de empresas e governos, operadores de infraestruturas críticas de qualquer dimensão, empresas de segurança mais pequenas, responsáveis por projetos de código aberto e investigadores com histórico de reporte de vulnerabilidades, com resposta prevista em poucos dias. As candidaturas ao Red Team Access, por seu turno, deverão demorar semanas. Quem se qualifica para o Red Team Access recebe entretanto o Defense Access enquanto a avaliação decorre.
Mesmo no patamar ofensivo há limites. A Anthropic indica que os utilizadores continuarão a sofrer bloqueios em tempo real em ações que possam causar dano físico ou perturbação em massa, como instalar ransomware, danificar sistemas físicos ou testar sistemas de segurança de alto risco. O Specialized Access é o que tem menos restrições e está limitado a organizações verificadas autorizadas a testar sistemas de segurança, com revisões detalhadas feitas em conjunto com o governo norte-americano. Os membros atuais do Glasswing transitam para esse patamar sem nova aprovação para os modelos em vigor.
Os números por trás da decisão
A justificação pública para alargar o acesso assenta em métricas divulgadas pela própria empresa. Os parceiros do Projeto Glasswing encontraram pelo menos 129 mil vulnerabilidades verificadas entre abril e julho, e a análise de código aberto feita pela própria Anthropic revelou mais 5500 até outubro; do total combinado, mais de 33 mil foram classificadas como críticas ou de severidade elevada. A empresa acrescenta que o valor é provavelmente uma subestimativa, por se basear em respostas de apenas parte dos parceiros, esperando que o impacto real seja pelo menos cinco vezes superior.
| Indicador | Valor divulgado | Período |
|---|---|---|
| Vulnerabilidades verificadas por parceiros Glasswing | Pelo menos 129 000 | Abril a julho de 2026 |
| Vulnerabilidades adicionais em código aberto (análise interna) | 5 500 | Abril a outubro de 2026 |
| Classificadas como críticas ou de severidade elevada | Mais de 33 000 | Total combinado |
Convém enquadrar: estes valores são a continuação de um percurso iniciado meses antes. A 8 de abril de 2026, a Anthropic anunciou o Claude Mythos Preview, um modelo de fronteira que descobriu de forma autónoma e escreveu exploits funcionais para milhares de vulnerabilidades zero-day em todos os principais sistemas operativos e navegadores web. Entre os casos citados, a mais antiga falha encontrada foi um bug com 27 anos no OpenBSD, entretanto corrigido — um sistema operativo conhecido sobretudo pela sua segurança.
O teste que mostra a diferença entre os patamares
A Anthropic publicou também resultados de um teste próprio que ilustra o efeito prático de remover travões. O ensaio usou o benchmark de operações ciber multifase CyScenarioBench, com o Claude Opus 5.5 a correr cada um dos 10 desafios cinco vezes: todas as tentativas sem acesso ao programa foram bloqueadas logo no primeiro prompt; no patamar Defense Access, 46 das 50 execuções foram travadas a dada altura; no nível Red Team nada foi bloqueado e o modelo concluiu 34 das 50 execuções, resultado que a empresa diz ser praticamente igual à taxa de sucesso de 67,6% sem quaisquer salvaguardas.
Há ainda condições contratuais relevantes. As organizações inscritas têm de permitir a retenção de dados para a Anthropic monitorizar utilizações indevidas; as Enterprise Frontier Safeguards, previstas para o outono, permitirão que organizações elegíveis guardem dados na sua própria infraestrutura cloud, e até lá quem tenha retenção zero de dados no Fable 5.1 ou no Mythos 5.1 pode usar o CVP nessas condições. O programa corre na plataforma Claude, no Vertex AI da Google Cloud e no Microsoft Foundry, estando no Amazon Bedrock limitado a clientes elegíveis para as EFS.
O que os números não dizem
Nem toda a comunidade técnica lê estes resultados da mesma forma, e há duas ressalvas importantes. A primeira é a relevância operacional das falhas encontradas: o investigador Patrick Garrity, da VulnCheck, mostrou-se pouco impressionado com os CVE identificados pelo Projeto Glasswing, notando que menos de 0,5% das 225 vulnerabilidades associadas à Anthropic que acompanhou estavam a ser exploradas ativamente. Analistas da IDC alertaram também que o teste foi conduzido pelo próprio fornecedor e sublinharam a necessidade de controlos externos, gestão de identidades e supervisão humana quando as salvaguardas dos modelos são reduzidas.
A segunda ressalva é a correção. Encontrar não é remediar — e é aqui que o gargalo se torna visível. Os números da própria empresa indicam que, de 5674 vulnerabilidades confirmadas como verdadeiros positivos, 3014 são de severidade elevada e 1522 críticas, mas apenas 516 foram corrigidas. Um registo público associado à equipa Frontier Red Team aponta no mesmo sentido: em 2 de outubro de 2026, o programa divulgava 6157 vulnerabilidades em 591 projetos de código aberto, com 516 corrigidas, segundo o que lhe era conhecido.
Por outras palavras: a capacidade de descoberta cresceu muito mais depressa do que a capacidade de correção de projetos frequentemente mantidos por equipas pequenas e voluntárias.
Porque é que isto importa em Portugal
Para uma organização portuguesa, o ponto não é se terá acesso ao Mythos — a esmagadora maioria não terá. O ponto é que o volume de correções a jusante vai aumentar. Mais vulnerabilidades divulgadas significam mais avisos de fornecedores, mais janelas de exposição e mais pressão sobre equipas de TI que já trabalham no limite.
Esse esforço deixou de ser apenas boa prática. O Decreto-Lei n.º 125/2025, de 4 de dezembro, transpôs para a ordem jurídica portuguesa a Diretiva (UE) 2022/2555 e aprovou o novo Regime Jurídico da Cibersegurança, tendo entrado em vigor a 3 de abril de 2026. O regime alarga o universo de entidades abrangidas, distingue entidades essenciais, importantes e públicas relevantes, reforça a responsabilidade dos órgãos de gestão e estabelece regras sobre gestão de riscos, cadeia de abastecimento, registo, governação, comunicação de incidentes, vulnerabilidades, supervisão e sanções. As entidades abrangidas pelo Regime Jurídico da Cibersegurança (NIS2) devem, recorda o CNCS, identificar-se como entidade essencial, importante ou pública relevante através do registo na plataforma eletrónica disponibilizada pelo Centro Nacional de Cibersegurança, fundamentando devidamente a sua qualificação.
Há ainda uma dimensão de proteção de dados. Quando uma falha em componente de código aberto é explorada e resulta em acesso indevido a dados pessoais, aplicam-se as obrigações de notificação previstas no RGPD, independentemente de a vulnerabilidade ter sido descoberta por um humano ou por um modelo de IA.
Medidas práticas a tomar agora
- Manter um inventário atualizado de software e dependências, idealmente com um
SBOMpor aplicação, para saber em minutos que sistemas são afetados por um novo aviso. - Definir prazos internos de correção por severidade e medir o cumprimento, em vez de aplicar atualizações de forma reativa.
- Subscrever os alertas do CERT.PT e os boletins de segurança dos fornecedores críticos para a operação.
- Testar o processo de atualização em ambiente controlado e garantir capacidade de reversão.
- Incluir cláusulas de correção e de divulgação de vulnerabilidades nos contratos com fornecedores, em linha com as exigências de cadeia de abastecimento do novo regime.
- Nas organizações que usem IA em segurança, exigir supervisão humana, registo de atividade e segregação de acessos.
Perguntas frequentes
O Claude Mythos passou a estar disponível ao público?
Não. O acesso continua condicionado a verificação. A Anthropic expandiu o Cyber Verification Program a 6 de outubro de 2026 em três patamares — Defense, Red Team e Specialized — que dão a equipas de segurança verificadas modelos Claude com menos bloqueios de cibersegurança.
De onde vêm as 129 mil vulnerabilidades?
São resultados reportados pela Anthropic: a empresa afirma que o Projeto Glasswing descobriu pelo menos 129 mil vulnerabilidades verificadas entre abril e julho de 2026, e mais 5500 entre abril e outubro através de análise de código aberto. Os valores são autodeclarados e devem ser lidos com essa ressalva.
Quantas dessas falhas já foram corrigidas?
Poucas, em proporção. Dos valores divulgados, de 5674 vulnerabilidades confirmadas como verdadeiros positivos, 3014 são de severidade elevada e 1522 críticas, mas apenas 516 foram corrigidas. O gargalo está na capacidade de remediação, não na descoberta.
O que deve fazer uma PME portuguesa?
Não precisa de IA de fronteira. Precisa de inventário de software, prazos de correção definidos por severidade, acompanhamento dos alertas do CERT.PT e cláusulas contratuais de segurança com fornecedores. Se estiver abrangida pelo novo regime jurídico, deve também assegurar o registo junto do CNCS e a nomeação dos pontos de contacto exigidos.
Esta informação tem caráter noticioso e baseia-se em dados divulgados publicamente pela Anthropic, pelo Centro Nacional de Cibersegurança e por investigadores e publicações especializadas de segurança.
