Anthropic reorganiza su programa de acceso a capacidades de ciberseguridad en tres niveles y amplía quién puede entrar. La medida reconoce un problema de fondo: los mismos modelos que ayudan a proteger sistemas también sirven para atacarlos.
Qué es el Cyber Verification Program de Anthropic
El 6 de octubre, Anthropic presentó una versión ampliada de su Cyber Verification Program, o CVP. El programa da a profesionales de seguridad cualificados acceso a capacidades avanzadas de ciberseguridad y a clasificadores con menos bloqueos, es decir, a un Claude en el que se han relajado las protecciones que normalmente impiden la mayoría del trabajo ofensivo.
La razón de que esas protecciones existan es conocida. La ciberseguridad es intrínsecamente de doble uso: la misma habilidad que permite a un equipo encontrar y cerrar una vulnerabilidad sirve a un atacante para explotarla. Por eso los modelos estándar de Anthropic, como Claude Opus 5.5, Claude Fable 5.1 y Claude Sonnet 5.5, vienen con defensas conservadoras que bloquean casi cualquier tarea sensible en este terreno.
El mismo martillo construye y destruye. El CVP es la puerta que se abre para quien demuestra que trabaja en el lado defensivo con un propósito legítimo. La solicitud es gratuita y se revisa caso por caso.
¿Y qué gana una empresa al entrar? Menos bloqueos, sí, pero sobre todo acceso a los modelos tope de Anthropic sin las trabas del filtro estándar.
Los tres niveles de acceso del programa
La novedad central es la división en tres niveles, cada uno con sus requisitos de verificación y sus controles. El equipo elige el nivel que encaja con el alcance de su trabajo.
Defense Access: el nivel para trabajo defensivo
Este es el nivel destinado al trabajo de defensa: operaciones de centro de seguridad, respuesta a incidentes, ingeniería inversa de malware y análisis y validación de vulnerabilidades. Anthropic espera que muchas organizaciones califiquen aquí.
El nivel más abierto de los tres, vaya.
Quién puede solicitarlo incluye equipos de seguridad de empresas, organizaciones sin ánimo de lucro, universidades y organismos públicos que protegen sistemas propios; operadores de infraestructura crítica de cualquier tamaño, desde un hospital regional hasta una empresa municipal de servicios; firmas de seguridad más pequeñas; responsables de proyectos de código abierto, e investigadores individuales con historial de vulnerabilidades reportadas. El objetivo es responder en pocos días.
Red Team Access: pruebas de intrusión autorizadas
Este nivel añade a lo anterior las pruebas de penetración y las operaciones de red team con autorización. Aquí entran los equipos internos de red team, los de organismos públicos y las empresas de seguridad y pentesting.
La regla es estricta: solo se puede atacar sistemas para los que se tiene autorización, incluidos sistemas de industrias críticas. Y aunque el modelo tenga menos bloqueos, Anthropic mantiene el freno en tiempo real para acciones que puedan causar daño físico o interrupciones masivas, como desplegar ransomware, dañar sistemas físicos o hacer pruebas sobre sistemas de seguridad de alto riesgo.
Permiso, sí. Barra libre, no.
Debido a los mayores requisitos, esta revisión tarda unas semanas. Las organizaciones cualificadas quedan inscritas en Defense Access mientras se estudia su solicitud para el nivel superior. De momento, este nivel es solo para organizaciones: los investigadores individuales no pueden acceder.
Specialized Access, el nivel de acceso restringido
El tercer nivel, con los bloqueos más reducidos, está reservado a un conjunto limitado de organizaciones verificadas que pueden probar sistemas de seguridad capaces de afectar a vidas humanas o de alterar mercados: sistemas operativos de vuelo, redes eléctricas, redes de telecomunicaciones, infraestructura de transferencias interbancarias y redes administrativas públicas.
Poca cosa. Todos ellos, sistemas de los que dependen millones de personas.
Aquí la revisión es exhaustiva y se hace en colaboración con el gobierno de Estados Unidos. Los miembros que ya formaban parte de Project Glasswing pasan directamente a este nivel, sin necesidad de volver a ser aprobados para los modelos actuales.
Es el nivel más cerrado de los tres. Tiene sentido: son los sistemas donde un fallo no se queda en una pantalla.
Qué modelos y qué datos maneja cada nivel
En los tres niveles, los equipos acceden a los modelos más capaces de Anthropic: Claude Opus 5.5, Claude Sonnet 5.5 y Claude Mythos 5.1, además de los futuros lanzamientos. Es decir, el nivel no limita qué modelo usas, sino cuánto filtrado se aplica a lo que pides.
La diferencia está en los frenos, no en la potencia.
El programa exige conservar los datos de las organizaciones inscritas para poder vigilar el uso indebido. Anthropic dice que cuando esté disponible Enterprise Frontier Safeguards, previsto para finales de otoño, las organizaciones elegibles podrán almacenar sus datos en infraestructura en la nube que ellas mismas controlen.
La compañía también recuerda que sus modelos estándar siguen sirviendo para tareas como revisar código, aplicar parches, buscar vulnerabilidades en código propio que ya posees y clasificar alertas de seguridad. El CVP no reemplaza esos usos, los extiende a los casos que las protecciones estándar bloqueaban.
Anthropic no es la única que ha montado una puerta de este tipo. OpenAI mantiene un programa similar llamado Trusted Access for Cyber. La coincidencia no es casual: las dos compañías tratan de equilibrar la seguridad de sus modelos con la utilidad que tienen para quienes los usan para defender sistemas. En ambos casos, el acceso especial se gana demostrando quién eres y para qué lo necesitas.
En resumen, la confianza no se compra. Se demuestra.






