Ciberseguridad
Anthropic amplía el Programa de Verificación Cibernética a tres niveles de acceso

Anthropic el 6 de octubre de 2026 anunció un Programa de Verificación Cibernética ampliado que pone a disposición de profesionales de seguridad calificados capacidades cibernéticas avanzadas y clasificadores con bloqueo reducido, a través de tres niveles de acceso. Cada nivel incluye acceso a Claude Opus 5.5, Claude Sonnet 5.5, Claude Mythos 5.1 y los nuevos modelos que se lancen.
Anthropic describió la ciberseguridad como inherentemente de doble uso, afirmando que las mismas capacidades que permiten a un equipo de seguridad encontrar y corregir una vulnerabilidad también pueden ayudar a un actor malintencionado a explotarla. La empresa dijo que sus modelos de disponibilidad general, incluidos Claude Opus 5.5, Claude Fable 5.1 y Claude Sonnet 5.5, incorporan salvaguardas cibernéticas conservadoras que bloquean la mayor parte del trabajo cibernético, un enfoque que, según la compañía, está destinado a limitar la actividad dañina de actores malintencionados mientras se trabaja en reducir falsos positivos en la codificación segura.
Durante los seis meses previos al anuncio, Anthropic ofreció acceso confiable a través de dos programas: Project Glasswing, que brindó a organizaciones que aseguran software crítico acceso a Claude Mythos, y el Programa de Verificación Cibernética original, que otorgó a equipos de seguridad verificados salvaguardas reducidas en los modelos Claude Opus y Claude Sonnet. Los dos programas ahora están integrados en una única oferta ampliada. Anthropic afirmó que sus modelos de disponibilidad general siguen siendo utilizables por todos los usuarios para tareas como revisión de código, corrección de problemas conocidos, detección de vulnerabilidades en código fuente propio y triaje de alertas de seguridad.
Acceso de Defensa, Red Team y Especializado
El Acceso de Defensa cubre trabajo defensivo, incluidos tareas del centro de operaciones de seguridad y de respuesta a incidentes, ingeniería inversa de malware y análisis y validación de vulnerabilidades. Ejemplos de organizaciones elegibles incluyen equipos de seguridad en empresas, organizaciones sin fines de lucro, universidades y entidades gubernamentales que defienden sistemas que poseen o mantienen; operadores de infraestructura crítica de cualquier tamaño, como hospitales regionales o servicios públicos municipales; firmas de seguridad más pequeñas; mantenedores de código abierto; y investigadores individuales con un historial de vulnerabilidades reportadas. Anthropic dijo que espera que muchas organizaciones que realizan trabajo de ciberseguridad defensiva califiquen para este nivel, y que pretende responder a las solicitudes dentro de unos pocos días.
El Acceso de Red Team añade pruebas de penetración autorizadas y ejercicios de red‑team contra sistemas que la organización está autorizada a probar, incluidos los sistemas de TI en industrias críticas. Ejemplos de organizaciones elegibles incluyen equipos de red team internos, equipos de red team gubernamentales y firmas de seguridad y pruebas de penetración. Los usuarios en este nivel aún enfrentan bloqueos en tiempo real para acciones que podrían causar daño físico o una interrupción masiva, como desplegar ransomware, dañar sistemas físicos o probar de penetración sistemas de seguridad de alto riesgo. Anthropic dijo que espera que las solicitudes para este nivel tomen algunas semanas en revisarse, que inscribe a las organizaciones elegibles en el Acceso de Defensa mientras se revisan sus solicitudes de Acceso de Red Team, y que limita el nivel a organizaciones.
El Acceso Especializado tiene la menor cantidad de bloqueos cibernéticos y está reservado para un conjunto limitado de organizaciones verificadas autorizadas a probar sistemas de seguridad que podrían afectar la vida de las personas o interrumpir mercados, como sistemas de operación de vuelos, redes eléctricas, redes de telecomunicaciones, infraestructura de transferencias interbancarias y redes administrativas gubernamentales. Anthropic revisa actualmente cada organización en este nivel en profundidad en colaboración con el gobierno de EE. UU., y los miembros existentes de Project Glasswing pasan a este nivel sin requerir una nueva aprobación para los modelos actuales.
Según la página del Centro de Ayuda de Claude, las personas pueden solicitar solo el Acceso de Defensa y deben estar en un plan de pago, mientras que el Acceso de Red Team y el Acceso Especializado están abiertos solo a organizaciones. Cada organización presenta una única solicitud, y Anthropic coloca al solicitante en el nivel más alto compatible con la información que recibe, con el objetivo de enviar una decisión o una solicitud de información adicional dentro de los siete días hábiles. Como parte del proceso, Anthropic verifica a todos los solicitantes y solicita pruebas de los controles de seguridad requeridos para el nivel correspondiente. El Centro de Ayuda indica que la elegibilidad refleja factores que incluyen la naturaleza del trabajo de la organización, la capacidad de Anthropic para verificar su identidad, el entorno legal y regulatorio en el que opera, el riesgo de desvío o acceso forzado, y para quién se realiza el trabajo, adoptando un enfoque más cauteloso cuando una organización sirve principalmente a clientes militares, de inteligencia o de fuerzas del orden.
Pruebas de salvaguardas en CyScenarioBench
Para evaluar la eficacia de las protecciones del programa, Anthropic ejecutó Claude Opus 5.5 en CyScenarioBench, una evaluación que describió como una medida de si los modelos pueden planificar y ejecutar operaciones cibernéticas de múltiples etapas bajo restricciones realistas, con salvaguardas ajustadas a los diferentes niveles del CVP. Las pruebas incluyeron cinco intentos para cada uno de los 10 desafíos en cada nivel de acceso.
Anthropic informó que sin acceso a CVP, cada tarea fue bloqueada en el primer mensaje. En el nivel de Acceso de Defensa, 46 de los 50 ensayos fueron bloqueados en algún momento del desafío, mientras que las cuatro tareas restantes tuvieron éxito. En el nivel de Acceso de Red Team, no se produjeron bloqueos y Claude Opus 5.5 completó con éxito 34 de las 50 tareas, lo que Anthropic describió como efectivamente equivalente a la tasa de éxito del 67,6 % del modelo en la evaluación sin salvaguardas aplicadas, un resultado que dijo representa el Acceso Especializado. La empresa afirmó que las evaluaciones le dan confianza en que las capacidades cibernéticas avanzadas pueden ponerse a disposición de forma segura a un conjunto más amplio de defensores, y que continuará refinando sus clasificadores basados en niveles con el tiempo.
Cifras de vulnerabilidades reportadas del proyecto Glasswing
Anthropic dijo que los socios de Glasswing descubrieron al menos 129 000 vulnerabilidades de software verificadas entre abril y julio de 2026, y que sus propios esfuerzos de escaneo de código abierto encontraron 5 500 vulnerabilidades de software verificadas adicionales entre abril y octubre de 2026. Más de 33 000 de estas vulnerabilidades verificadas han sido calificadas hasta ahora como de gravedad crítica o alta, según la empresa.
La empresa describió las cifras como probablemente subestimadas, señalando que se basan en datos de encuestas de solo una parte de los socios de Glasswing, 33 informes de socios en total, y afirmó que espera que el impacto real sea al menos cinco veces mayor. Anthropic indicó que las organizaciones adoptaron diferentes enfoques de priorización, y que menos del 50 % de los socios revelaron cifras de correcciones, a menudo porque sus soluciones aún estaban en proceso, por lo que la tasa de parcheo está significativamente subestimada.
Al preguntar cuánto tiempo habría tomado encontrar el mismo número de vulnerabilidades sin los modelos Claude Mythos, varios socios dijeron a Anthropic que los modelos habían incrementado su ritmo de detección de vulnerabilidades en meses o incluso años. La empresa citó relatos publicados de los socios Booz Allen y Comcast sobre su experiencia.
Retención de datos, disponibilidad y detalles de la aplicación
La retención de datos es obligatoria para las organizaciones inscritas en el programa, de modo que Anthropic pueda monitorear el uso indebido cibernético. Una vez que Enterprise Frontier Safeguards, una solución que Anthropic describió como la combinación de la privacidad de la retención cero de datos con salvaguardas robustas, esté disponible en el otoño de 2026, las organizaciones elegibles podrán almacenar datos en la infraestructura en la nube que controlen. Hasta entonces, las organizaciones con acceso de retención cero de datos a Claude Fable 5.1 o Claude Mythos 5.1 también pueden usar CVP sin retención de datos.
CVP está disponible en la Claude Platform, Vertex AI de Google Cloud y Microsoft Foundry. En Amazon Bedrock solo está disponible para los clientes elegibles para Enterprise Frontier Safeguards; el Centro de ayuda indica que Amazon Bedrock aún no admite la revisión humana de las señales de seguridad automatizadas, que CVP requiere por defecto, y que Anthropic está trabajando para expandir CVP a todos los clientes de Bedrock. Las plataformas de terceros, como las herramientas de codificación, admiten solo Acceso de Defensa y Acceso de Red Team; el Acceso Especializado no está disponible a través de ellas.
Las organizaciones previamente inscritas en Project Glasswing o CVP no necesitan volver a solicitar; su acceso existente sigue funcionando bajo sus términos actuales, y serán trasladadas al nuevo nivel correspondiente para Claude Opus 5.5, Claude Sonnet 5.5 y Claude Mythos 5.1. La Política de Uso de Anthropic sigue aplicándose en su totalidad, y el Centro de ayuda indica que la empresa puede revisar, limitar o retirar una concesión. La creación de un producto orientado al cliente sobre estas capacidades se rige por separado mediante la Política de Ciberproductización de Anthropic, con una solicitud de productización que estará disponible para los usuarios de CVP.
Las organizaciones con Acceso de Defensa tienen hasta el 15 de diciembre de 2026 para adoptar autenticación multifactor resistente al phishing y dejar de usar claves API; hasta entonces, se requiere algún tipo de autenticación multifactor y las claves API expiran cada siete días. El acceso a Mythos en proveedores de nube de terceros se retrasa respecto a la aprobación de la solicitud aproximadamente cinco días hábiles. Anthropic ha programado un seminario web sobre el programa para el 14 de octubre de 2026 a las 9 a. m. hora del Pacífico.












