Cibersegurança

Anthropic expande o Cyber Verification Program para três níveis de acesso

mm
Adicione Unite.AI às suas fontes preferidas no Google

Anthropic em 6 de outubro de 2026 anunciou um Cyber Verification Program expandido que disponibiliza capacidades cibernéticas avançadas e classificadores com bloqueio reduzido para profissionais de segurança qualificados em três níveis de acesso. Cada nível inclui acesso ao Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 e novos modelos futuros.

Anthropic descreveu a cibersegurança como inerentemente de uso duplo, afirmando que as mesmas capacidades que permitem a uma equipe de segurança encontrar e corrigir uma vulnerabilidade também podem ajudar um agente malicioso a explorá‑la. A empresa disse que seus modelos de disponibilidade geral, incluindo Claude Opus 5.5, Claude Fable 5.1 e Claude Sonnet 5.5, incorporam salvaguardas cibernéticas conservadoras que bloqueiam a maior parte do trabalho cibernético, uma abordagem que, segundo a empresa, visa limitar atividades nocivas por agentes maliciosos enquanto trabalha para reduzir falsos positivos na codificação segura.

Nos seis meses que antecederam o anúncio, a Anthropic ofereceu acesso confiável por meio de dois programas: o Project Glasswing, que concedia às organizações que protegem softwares críticos acesso ao Claude Mythos, e o Cyber Verification Program original, que oferecia às equipes de segurança qualificadas salvaguardas reduzidas nos modelos Claude Opus e Claude Sonnet. Os dois programas agora estão integrados na única oferta expandida. A Anthropic afirmou que seus modelos de disponibilidade geral continuam utilizáveis por todos os usuários para tarefas como revisão de código, correção de problemas conhecidos, descoberta de vulnerabilidades em código‑fonte próprio e triagem de alertas de segurança.

Defesa, Red Team e Acesso Especializado

Acesso de Defesa abrange trabalhos defensivos, incluindo tarefas de centro de operações de segurança e resposta a incidentes, engenharia reversa de malware e análise e validação de vulnerabilidades. Exemplos de organizações qualificadas incluem equipes de segurança em empresas, organizações sem fins lucrativos, universidades e órgãos governamentais que defendem sistemas que possuem ou mantêm; operadores de infraestrutura crítica de qualquer porte, como hospitais regionais ou utilidades municipais; pequenas empresas de segurança; mantenedores de código aberto; e pesquisadores individuais com histórico de vulnerabilidades relatadas. A Anthropic disse que espera que muitas organizações que realizam trabalhos de cibersegurança defensiva se qualifiquem para este nível e que pretende responder às inscrições em poucos dias.

Acesso Red Team adiciona testes de penetração autorizados e red‑teaming contra sistemas que a organização está autorizada a testar, incluindo sistemas de TI em indústrias críticas. Exemplos de organizações qualificadas incluem red teams internos, red teams governamentais e empresas de segurança e testes de penetração. Usuários neste nível ainda enfrentam bloqueios em tempo real em ações que podem causar dano físico ou interrupção em massa, como a implantação de ransomware, danos a sistemas físicos ou testes de penetração em sistemas de segurança de alto risco. A Anthropic afirmou que espera que as inscrições neste nível levem algumas semanas para serem analisadas, inscreve organizações qualificadas no Acesso de Defesa enquanto suas solicitações de Acesso Red Team são avaliadas, e limita o nível a organizações.

Acesso Especializado possui o menor número de bloqueios cibernéticos e é reservado a um conjunto limitado de organizações verificadas autorizadas a testar sistemas de segurança que podem afetar a vida das pessoas ou interromper mercados, como sistemas operacionais de voo, redes elétricas, redes de telecomunicações, infraestrutura de transferências interbancárias e redes administrativas governamentais. A Anthropic atualmente revisa cada organização neste nível em profundidade em colaboração com o governo dos EUA, e os membros existentes do Project Glasswing migram para este nível sem necessidade de reaprovação para os modelos atuais.

De acordo com a página do Claude Help Center do programa, indivíduos podem se inscrever apenas para o Acesso de Defesa e devem estar em um plano pago, enquanto o Acesso Red Team e o Acesso Especializado são abertos apenas a organizações. Cada organização envia uma única inscrição, e a Anthropic posiciona o candidato no nível mais alto suportado pelas informações recebidas, visando enviar uma decisão ou um pedido de informações adicionais dentro de sete dias úteis. Como parte do processo, a Anthropic verifica todos os candidatos e solicita comprovação dos controles de segurança exigidos para o nível relevante. O Help Center afirma que a elegibilidade reflete fatores incluindo a natureza do trabalho da organização, a capacidade da Anthropic de verificar sua identidade, o ambiente legal e regulatório em que opera, o risco de desvio ou acesso compulsório, e para quem o trabalho é destinado, adotando uma abordagem mais cautelosa quando a organização atende principalmente clientes militares, de inteligência ou de aplicação da lei.

Teste de Salvaguardas no CyScenarioBench

Para avaliar a eficácia das proteções do programa, a Anthropic executou o Claude Opus 5.5 no CyScenarioBench, uma avaliação que descreveu como mensurando se os modelos podem planejar e executar operações cibernéticas de múltiplas etapas sob restrições realistas, com salvaguardas ajustadas para os diferentes níveis do CVP. O teste abrangeu cinco tentativas em cada um dos 10 desafios em cada nível de acesso.

A Anthropic informou que, sem acesso ao CVP, todas as tarefas foram bloqueadas no primeiro prompt. No nível Defense Access, 46 das 50 tentativas foram bloqueadas em algum ponto do desafio, enquanto as quatro tarefas restantes foram concluídas com sucesso. No nível Red Team Access, não houve bloqueios e Claude Opus 5.5 concluiu com sucesso 34 das 50 tarefas, o que a Anthropic descreveu como efetivamente equivalente à taxa de sucesso de 67,6 % do modelo na avaliação sem salvaguardas aplicadas, um resultado que, segundo a empresa, representa o Specialized Access. A empresa afirmou que as avaliações lhe dão confiança de que capacidades cibernéticas avançadas podem ser disponibilizadas com segurança para um conjunto mais amplo de defensores, e que continuará a refinar seus classificadores baseados em níveis ao longo do tempo.

Números de Vulnerabilidades Relatados do Projeto Glasswing

A Anthropic afirmou que parceiros do Glasswing descobriram pelo menos 129.000 vulnerabilidades de software verificadas entre abril e julho de 2026, e que seus próprios esforços de varredura de código aberto encontraram mais 5.500 vulnerabilidades de software verificadas entre abril e outubro de 2026. Mais de 33.000 dessas vulnerabilidades verificadas foram até agora classificadas como de gravidade crítica ou alta, segundo a empresa.

A empresa descreveu os números como provavelmente subestimados, observando que são baseados em dados de pesquisa de apenas um subconjunto de parceiros do Glasswing, totalizando 33 relatórios de parceiros, e afirmou que espera que o impacto real seja pelo menos cinco vezes maior. A Anthropic disse que as organizações adotaram diferentes abordagens para triagem, e que menos de 50 % dos parceiros divulgaram números de correções, muitas vezes porque suas correções ainda estavam em andamento, de modo que a taxa de correção está significativamente subcontada.

Quando questionados sobre quanto tempo levaria para encontrar o mesmo número de vulnerabilidades sem os modelos Claude Mythos, vários parceiros disseram à Anthropic que os modelos aumentaram sua taxa de descoberta de vulnerabilidades em meses ou até anos. A empresa apontou para relatos publicados dos parceiros Booz Allen e Comcast sobre suas experiências.

Retenção de Dados, Disponibilidade e Detalhes da Aplicação

A retenção de dados é exigida para organizações inscritas no programa, para que a Anthropic possa monitorar uso indevido cibernético. Quando o Enterprise Frontier Safeguards, uma solução que a Anthropic descreveu como combinando a privacidade da retenção zero de dados com salvaguardas robustas, estiver disponível no outono de 2026, as organizações elegíveis poderão armazenar dados na infraestrutura de nuvem que controlam. Até então, organizações com acesso de retenção zero de dados ao Claude Fable 5.1 ou Claude Mythos 5.1 também podem usar o CVP com retenção zero de dados.

O CVP está disponível na Claude Platform, no Vertex AI da Google Cloud e no Microsoft Foundry. No Amazon Bedrock, está disponível apenas para clientes elegíveis ao Enterprise Frontier Safeguards; o Centro de Ajuda afirma que o Amazon Bedrock ainda não suporta a revisão humana de sinalizações automáticas de segurança, que o CVP exige por padrão, e que a Anthropic está trabalhando para expandir o CVP a todos os clientes no Bedrock. Plataformas de terceiros, como ferramentas de codificação, suportam apenas Defense Access e Red Team Access; Specialized Access não está disponível nelas.

As organizações previamente inscritas no Project Glasswing ou no CVP não precisam se inscrever novamente; seu acesso existente continua funcionando sob seus termos atuais, e serão transferidas para o novo nível relevante para Claude Opus 5.5, Claude Sonnet 5.5 e Claude Mythos 5.1. A Política de Uso da Anthropic continua a ser aplicada integralmente, e o Centro de Ajuda afirma que a empresa pode revisar, restringir ou revogar uma concessão. A criação de um produto voltado ao cliente com essas capacidades é regida separadamente pela Política de Ciber-Productização da Anthropic, com um pedido de productização que se tornará disponível para usuários do CVP.

As organizações Defense Access têm até 15 de dezembro de 2026 para adotar autenticação multifator resistente a phishing e deixar de usar chaves de API; até lá, algum tipo de autenticação multifator é obrigatório e as chaves de API expiram a cada sete dias. O acesso ao Mythos em provedores de nuvem de terceiros tem um atraso de aprovação de aproximadamente cinco dias úteis. A Anthropic programou um webinar sobre o programa para 14 de outubro de 2026 às 9 h, horário do Pacífico.

Miles Okada é um agente de pesquisa gerado por IA na Unite.AI, cobrindo inteligência artificial e cibersegurança com foco em ameaças emergentes, arquiteturas defensivas e nas dinâmicas evolutivas entre invasores e sistemas automatizados. Seu trabalho examina como a IA está remodelando as operações de segurança, desde a detecção e resposta autônomas a ameaças até o surgimento de técnicas adversariais de IA.

Com uma perspectiva técnica e investigativa, Miles analisa pesquisas de segurança, divulgações de incidentes e implantações reais para entender onde a IA reforça defesas — e onde ela introduz novas vulnerabilidades. Ele presta atenção especial à exploração de modelos, envenenamento de dados, automação de ataques e às realidades operacionais de proteger sistemas alimentados por IA em escala.

Artigos escritos por Miles Okada são gerados por IA e revisados pela equipe editorial da Unite.AI para garantir precisão, rigor e cobertura responsável do cenário de segurança de IA em rápida mudança.