quarta-feira, 7 de outubro de 2026 · Edição diária

Inteligência artificial · Política · Poder econômico

Anthropic libera o Claude Mythos 5.1 a equipes de segurança verificadas após 129 mil falhas achadas

A Anthropic reformulou o Cyber Verification Program em três níveis e dá a equipes previamente verificadas acesso a modelos com menos proteções. O Project Glasswing já havia ajudado parceiros a achar ao menos 129 mil vulnerabilidades verificadas entre abril e julho, das quais mais de 33 mil críticas ou de alta gravidade.

Tela de computador com código e alertas de segurança digital
A Anthropic reformulou o programa de verificação para dar a profissionais de segurança acesso a modelos de IA com menos restrições. Foto: Pexels / Harold Vasquez

A Anthropic anunciou nesta terça-feira (6) a reformulação do Cyber Verification Program (CVP), que dá a profissionais de cibersegurança previamente verificados acesso a seus modelos de IA com menos proteções contra determinados usos de segurança digital, segundo a Olhar Digital. O programa passa a ter três níveis de acesso e inclui os modelos Claude Opus 5.5, Claude Sonnet 5.5 e Claude Mythos 5.1, além de futuros lançamentos.

A mudança junta duas iniciativas que corriam separadas. O Project Glasswing dava a parceiros acesso ao Claude Mythos, família de modelos voltada a capacidades avançadas de segurança. O CVP original oferecia a equipes verificadas versões dos modelos Opus e Sonnet com menos restrições.

129 mil falhas em quatro meses

O argumento da empresa para ampliar o acesso vem dos resultados do Glasswing. Entre abril e julho de 2026, parceiros do programa encontraram pelo menos 129 mil vulnerabilidades de software verificadas. Mais de 33 mil foram classificadas como críticas ou de alta gravidade.

A Anthropic afirma que o impacto real pode ser pelo menos cinco vezes maior, estimativa baseada em dados parciais enviados pelos parceiros. A empresa também disse ter encontrado, por conta própria, outras 5,5 mil vulnerabilidades em uma varredura de software de código aberto entre abril e outubro.

Três níveis, três graus de risco

O nível Defense cobre resposta a incidentes, análise de malware e investigação de vulnerabilidades. Podem se candidatar equipes de segurança, operadores de infraestrutura crítica, mantenedores de projetos de código aberto e pesquisadores com histórico de divulgação de falhas.

O Red Team amplia o uso para testes de invasão autorizados e exercícios de red teaming, e só aceita pedidos de organizações. O Specialized tem as menores restrições e fica reservado a um grupo pequeno de organizações autorizadas a testar sistemas críticos, como redes elétricas, sistemas de aviação e a infraestrutura usada em transferências interbancárias. Todos os participantes passam por verificação feita em conjunto com o governo dos Estados Unidos.

Por que a Anthropic não solta o modelo para todos

O dilema aparece na própria descrição do programa: a capacidade que permite a um sistema encontrar uma falha e ajudar um especialista a corrigi-la também serve para explorá-la. O Claude Mythos, apresentado em abril, já havia alimentado o temor de que modelos de IA invadissem softwares antes de os desenvolvedores publicarem a correção.

Por isso o acesso com menos proteções vale apenas para organizações e profissionais que passam por verificação, com controles que variam por nível. Para empresas brasileiras que operam bancos, energia ou sistemas de pagamento, a consequência prática é que fornecedores e equipes de segurança credenciados tendem a achar falhas mais rápido, enquanto quem fica fora do programa continua sujeito às restrições dos modelos comerciais.

AD

Repórter de Tecnologia e Inteligência Artificial do Real Nacional. Cobre inteligência artificial, infraestrutura digital, regulação de tecnologia e as empresas que constroem a IA no Brasil. Mais textos · Expediente · Política editorial

Leia também

O essencial de IA e poder no Brasil, toda manhã.

Uma leitura de 4 minutos com o que move Brasília, o mercado e a corrida da inteligência artificial. Sem ruído.