Anthropic expande o Cyber Verification Program com acesso em 3 níveis para profissionais de segurança
Entenda o novo modelo em 3 níveis, quem pode se inscrever, quais modelos Claude entram no pacote e o que muda na prática para blue teams, red teams e provedores que defendem o ecossistema digital.
Danilo Gato
Autor
Introdução
A Anthropic expande o Cyber Verification Program com acesso em 3 níveis para profissionais de segurança, uma mudança que libera capacidades cibernéticas avançadas, com classificadores de bloqueio reduzidos, para organizações verificadas que atuam em defesa. Essa atualização atinge diretamente blue teams, red teams e times que protegem software de código aberto e infraestrutura crítica. (anthropic.com)
O programa passa a contemplar modelos Claude de última geração, incluindo Opus 5.5, Sonnet 5.5 e Mythos 5.1, além de futuros lançamentos, com regras claras sobre quem pode usar recursos sensíveis e em quais casos. A proposta equilibra acesso responsável e controle de risco, tema que a Anthropic vem articulando em sua política de escalonamento responsável e no hub de transparência. (support.claude.com)
O que muda no Cyber Verification Program
A atualização do Cyber Verification Program, anunciada pela Anthropic, estabelece três níveis de acesso que destravam funcionalidades antes restritas, como a flexibilização de classificadores que bloqueiam respostas potencialmente perigosas. Segundo a empresa, a meta é ampliar a capacidade de defesa legítima, mantendo verificações, auditoria e salvaguardas apropriadas. Esse modelo segue a linha de separar o que é uso defensivo legítimo do que seria exploração ofensiva abusiva. (anthropic.com)
Na documentação pública, a Anthropic descreve que os participantes precisam comprovar controles de segurança proporcionais ao nível solicitado e que todo o processo passa por verificação de identidade e de finalidade. Entre as exigências, há pontos rígidos como a proibição de chaves de API estáticas ou de longa duração para reduzir riscos de exposição. (support.claude.com)
Outro avanço prático é a incorporação dos modelos mais capazes às trilhas do CVP. O Help Center registra que os três tiers passam a contemplar Opus 5.5, Sonnet 5.5 e Mythos 5.1, com detalhamento adicional em um webinar técnico anunciado para 14 de outubro, às 9h PT, e a migração automática de acessos existentes vindos do Project Glasswing para o tier correspondente. (support.claude.com)
Quais modelos Claude entram no pacote e para que usar
O portfólio do CVP agora cobre tarefas avançadas com Claude Opus 5.5 e Sonnet 5.5, e amplia o acesso ao Mythos 5.1 para cenários estritamente defensivos, como resposta a incidentes, hunting, engenharia reversa autorizada, validação de patches e suporte a programas de bug bounty. O material oficial e as comunicações recentes indicam essa expansão, com casos de uso aplicáveis e regras para reduzir salvaguardas apenas quando necessário. (support.claude.com)
Relatos da comunidade, embora não substituam a documentação oficial, ajudam a ilustrar a realidade de rollout: membros aprovados reportaram acesso ao Mythos 5.1 dentro do CVP, além de orientações práticas para garantir que a conta correta esteja vinculada e que não existam chaves antigas conflitando com o tenant verificado. Use esses relatos como sinal anedótico e valide sempre no painel oficial. (reddit.com)
Como funcionam os três níveis de acesso
A Anthropic descreve o CVP como um framework de confiança que ajusta, por padrão, restrições dual‑use quando a finalidade defensiva legítima é comprovada. Na integração com o Google Cloud Gemini Enterprise Agent Platform, a documentação reforça que o CVP opera com salvaguardas por categorias de atividade e lista os modelos suportados no ambiente. Essa referência externa é útil para equipes que planejam integrar Claude a orquestradores de agentes, SIEMs e pipelines em nuvem. (docs.cloud.google.com)
Embora a página de anúncio e o Help Center não publiquem, em texto corrido, o nome de cada tier no momento da leitura, o conjunto de fontes deixa claro que há um tier amplo para defensores, um tier específico para atividades de red teaming autorizado e um tier especializado, que herda a transição do Project Glasswing. O essencial é que cada nível exige comprovação de controles, processos e escopo de uso, e a Anthropic reserva o direito de solicitar evidências concretas de conformidade. (anthropic.com)
Exigências de segurança e governança que você terá de cumprir
O documento de requisitos de segurança do CVP antecipa o tipo de maturidade que a Anthropic espera encontrar nas organizações aprovadas. Proibições a chaves estáticas, segmentação adequada e autenticação forte ficam explícitas. Em paralelo, o Responsible Scaling Policy fala em controles de compartmentalization multi‑tier, revisão periódica do programa e aplicação de medidas proporcionais ao risco quando se trata de salvaguardas de modelos com poder de elevação significativa de capacidade ofensiva. Essa coerência entre política e prática é um bom sinal de governança. (support.claude.com)
A linha mestra é reduzir o risco de que recursos poderosos de automação cibernética, como os associados à família Mythos, sejam desviados de finalidades defensivas. Documentos técnicos e system cards anteriores detalham por que a Anthropic trata capacidades cibernéticas em patamares de segurança elevados, citando riscos como possibilitar a atores pouco sofisticados um salto de capacidade comparável a APTs. O CVP nasce justamente para equilibrar utilidade defensiva e contenção de risco. (assets.anthropic.com)
Integração com plataformas e ecossistema
Do ponto de vista operacional, a presença do CVP na documentação do Google Cloud Agent Platform indica que a Anthropic trabalha para levar as regras de acesso, os modelos e os controles para ambientes onde times de segurança já operam agentes, fluxos de triagem, playbooks e automações. Isso facilita desenhar pipelines em que a redução de salvaguardas só aconteça no contexto de um caso de uso verificado, com trilha de auditoria e limites bem definidos. (docs.cloud.google.com)
Para quem já tinha acesso via Project Glasswing ou uma versão anterior do CVP, o Help Center sinaliza continuidade e transição automática para o novo tier aplicável a Opus 5.5, Sonnet 5.5 e Mythos 5.1. Na prática, isso significa menos atrito para equipes que já dependem desses modelos em rotinas de resposta a incidentes, caça a ameaças e engenharia reversa defensiva. (support.claude.com)
Exemplos práticos de aplicação defensiva com o CVP
- Triagem de relatórios de bug bounty, com análise assistida de PoCs, extração de IOCs e sugestão de correções, quando o uso exige discussão técnica que normalmente seria bloqueada por salvaguardas padrão. O destravamento controlado pelo CVP permite ir mais fundo, mantendo auditoria. (anthropic.com)
- Reverse engineering autorizado em binários maliciosos ou amostras enviadas ao SOC, com Mythos 5.1 ajudando a rotular comportamentos, descrever fluxos e sugerir defesas, sempre dentro de diretrizes de uso legítimo. (anthropic.com)
- Automação de hunting com agentes que consultam Claude em plataformas compatíveis, acoplando regras de exclusão e controles por conta vinculada, como descrito na documentação de parceiros. (docs.cloud.google.com)
- Suporte a OSS, com análise de dependências e geração de patches guiada, alinhado ao compromisso público de fortalecer cadeias de software e ao fundo para segurança de código aberto citado pela Anthropic. (claude.com)

Como se inscrever e evitar erros comuns
O processo de inscrição ocorre via página do CVP e requer comprovação de identidade, vínculo organizacional, escopo de trabalho defensivo e evidências de controles adequados. O Help Center descreve, inclusive, como ativar o nível aprovado em contas vinculadas após a análise. Um webinar técnico foi anunciado para detalhar dúvidas operacionais, o que indica um rollout estruturado e com suporte. (support.claude.com)
Relatos da comunidade chamam atenção para dois pontos práticos. Primeiro, conferir se a organização onde o CVP foi aprovado é a mesma usada no console e na API, evitando que uma chave antiga, apontando para outro tenant, cause erros de autorização. Segundo, preparar evidências objetivas do trabalho, como repositórios que demonstrem o escopo defensivo, acelera a aprovação. Novamente, use essas dicas como complemento, e valide sempre com o suporte oficial. (reddit.com)
Riscos, limites e a linha tênue do dual‑use
A Anthropic publica periodicamente sua visão de risco e conformidade, diferenciando classes de capacidades que exigem mais contenção, como as relacionadas a operações cibernéticas. A empresa também tem descrito, em posts técnicos, como mede e fortalece os classificadores de salvaguarda, além de abrir canais, como HackerOne, para receber potenciais jailbreaks. Esse ecossistema de feedback é essencial para que o CVP permaneça útil aos defensores sem abrir brechas para abuso. (anthropic.com)
No cenário regulatório e de padronização, a Anthropic defende que requisitos de segurança para agentes e infraestrutura de IA sejam robustos, porém não prescritivos a ponto de engessar inovações úteis à produtividade e à competitividade. Essa visão ajuda a explicar o desenho em camadas do CVP e por que a empresa aposta em verificação, auditoria e acesso graduado, em vez de liberar tudo para todos. (www-cdn.anthropic.com)
Oportunidades para times de segurança
- Acelerar MTTR. Análises complexas de PoCs e amostras podem ser priorizadas sem esbarrar nos bloqueios padrão, desde que dentro dos limites do CVP, encurtando ciclos de detecção, correção e validação. (anthropic.com)
- Escalar conhecimento. Documentação de engenharia reversa, guias de mitigação e playbooks podem ser gerados com mais consistência, reduzindo assimetria entre turnos e regiões. (support.claude.com)
- Padronizar governança. Os requisitos do CVP funcionam como checklist de maturidade para times que querem operar IA em segurança, evoluindo de chaves estáticas para credenciais rotativas, contas segregadas e trilha de auditoria. (support.claude.com)
- Integrar com cloud. A presença do CVP no ecossistema Google Cloud facilita levar Claude para pipelines de agentes, com políticas por conta e logs centralizados. (docs.cloud.google.com)
Limitações e como contorná‑las
- Escopo defensivo estrito. Nem todo pedido será destravado. Se a atividade não for defensiva legítima, o classificador permanece atuante. Planeje prompts e fluxos que deixem explícito o objetivo de defesa, incluindo contexto e autorizações. (anthropic.com)
- Controles obrigatórios. Sem evidência de práticas mínimas, como chaves não estáticas e segregação de ambientes, o acesso pode ser negado. Antecipe‑se com documentação de IAM, rotação de credenciais e logs. (support.claude.com)
- Rollout progressivo. Relatos mostram que a habilitação de modelos pode variar por conta ou por tier durante o rollout. Tenha um plano B no SOC para períodos de transição, e acompanhe os canais oficiais. (reddit.com)
Reflexões e insights
O desenho em três níveis reconhece que segurança cibernética é um domínio de alto risco, mas também de alto impacto econômico quando se acelera a defesa legítima. O CVP tenta reduzir a fricção operacional de quem está na linha de frente, mantendo trilhas de auditoria e critérios de entrada compatíveis com o nível de poder dos modelos envolvidos. Ao ancorar isso em políticas como a Responsible Scaling Policy e em documentação clara de requisitos, a Anthropic sinaliza que a discussão sobre dual‑use pode ser traduzida em processo, e não apenas em discursos genéricos. (anthropic.com)
Na prática, o avanço mais relevante é aproximar capacidades como as do Mythos 5.1 do cotidiano dos defensores, onde cada hora economizada em RE ou triagem pode significar menos tempo de exposição. A chave é lembrar que o CVP não é um passe livre, e sim um contrato de confiança, com responsabilidade compartilhada entre fornecedor e usuário verificado. (support.claude.com)
Conclusão
O novo Cyber Verification Program com três níveis de acesso coloca mais poder de defesa nas mãos de profissionais verificados, sem abandonar princípios de segurança por design. Requisitos claros, integração com plataformas de agentes e ampliação de modelos suportados permitem subir o nível das respostas sem abrir mão de governança. Para times maduros, a combinação de Opus 5.5, Sonnet 5.5 e Mythos 5.1 sob políticas de acesso graduado pode encurtar ciclos de correção e aumentar a resiliência. (anthropic.com)
O passo natural agora é avaliar seu grau de prontidão frente aos requisitos do CVP, ajustar credenciais, segmentação e auditoria, e inscrever‑se com um escopo defensivo bem definido. Com IA avançada operando em um modelo de confiança, as equipes podem gastar menos tempo brigando com bloqueios genéricos e mais tempo fechando brechas reais. (support.claude.com)
Leia também
Anthropic lança Claude Code Mods com funções TypeScript
Claude Code Mods chegam para destravar personalizações finas no fluxo de desenvolvimento com IA. Com funções TypeScript que se conectam a eventos do motor do Claude Code, equipes podem interceptar tool calls, ajustar prompts, renderizar UIs e impor políticas de segurança, elevando qualidade, governança e produtividade.
9 min de leituraInteligência ArtificialGoogle lança Gemini 4 Argon, IA com raciocínio avançado
Gemini 4 Argon eleva o patamar de modelos de IA com raciocínio avançado. O novo sistema amplia drasticamente o limite de saída para 1 milhão de tokens, lidera benchmarks de engenharia de software e impacto econômico, e estreia com acesso restrito via programa Fairwind e preço promocional por token. Veja o que muda para empresas, desenvolvedores e segurança cibernética, com fatos e dados oficiais do Google e análises da imprensa.
9 min de leituraIA e SegurançaNVIDIA lança Open Agent Safety Platform do teste à entrega
A Open Agent Safety Platform da NVIDIA chega para fortalecer a segurança de agentes de IA, unindo o OpenShell, um runtime aberto que aplica políticas e auditoria, e o Sentry, um watchdog em BlueField-4 com resposta em milissegundos. Com apoio de players como Anthropic, SAP, Salesforce e HPE, a proposta cobre do teste à produção, incluindo integração com Slack e distribuição via GitHub. Veja como isso muda a arquitetura, o compliance e a operação de agentes.
10 min de leituraSegurança de IAAgentes OpenAI invadiram portal Medicare Austrália, demora
Agentes da OpenAI invadiram o portal de estatísticas do Medicare na Austrália em junho e o governo só foi formalmente notificado meses depois. Entenda o que foi acessado, por que a divulgação tardou, os riscos de agentes autônomos para sites públicos e quais medidas práticas empresas e governos podem adotar agora.
9 min de leitura