Anthropic abre tres niveles de Claude a defensores informáticos
El programa de verificación sube de uno a tres niveles, con trámites de días o semanas. Las pruebas de bloqueo que lo respaldan son de la propia empresa.
Para la mayoría de los usuarios de Claude no cambia nada: los bloqueos automáticos ante peticiones de ciberseguridad ofensiva o ambigua siguen activos. El cambio es para organizaciones que trabajan en seguridad informática. Anthropic anunció este 6 de octubre que su Cyber Verification Program, un trámite por solicitud que reduce esos bloqueos para quien demuestre un uso legítimo, pasa a tener tres niveles.
Defense Access es el nivel para defensores: vigilancia en un SOC (centro de operaciones de seguridad), atención de incidentes, análisis de malware por ingeniería inversa y estudio de vulnerabilidades. Red Team Access suma las pruebas de penetración con permiso del dueño del sistema y el *red team*, que consiste en simular ataques reales para medir las defensas. Por ahora se concede solo a organizaciones, no a personas. El tercero, Specialized Access, se reserva a pocas organizaciones verificadas que evalúan sistemas críticos para la vida o los mercados, por ejemplo redes eléctricas, telecomunicaciones o sistemas de vuelo.
El trámite y los modelos
Según la empresa, Defense se revisa en unos días, Red Team en unas semanas y Specialized con una revisión a fondo, hecha junto con el gobierno de Estados Unidos. Los miembros actuales del programa serán evaluados de forma automática para los modelos nuevos. Aplica a Claude Opus 5.5, Claude Sonnet 5.5 y Claude Mythos 5.1, y se ofrece en tres plataformas: Claude Platform, Vertex AI de Google Cloud y Foundry de Microsoft. Amazon Bedrock también la tiene, pero solo para clientes elegibles de Enterprise Frontier Safeguards.
Inscribirse exige aceptar que se retengan los datos. La retención cero llegará "más adelante este otoño" con Enterprise Frontier Safeguards.
Cifras de la empresa
Anthropic probó el esquema con Claude Opus 5.5 en CyScenarioBench, una evaluación interna de cinco intentos en cada uno de 10 desafíos por nivel. Sin acceso al programa, todas las tareas se bloquearon desde la primera petición. En Defense Access, 46 de 50 intentos se bloquearon en algún punto. En Red Team Access no hubo bloqueos y el modelo completó 34 de 50 tareas, un 67.6 %, que la empresa iguala a su tasa sin salvaguardas.
Esos números no tienen replicación independiente, y los 10 desafíos no son públicos. Anthropic añade que en Red Team seguirá habiendo bloqueos en tiempo real ante acciones que causen daño físico o disrupción masiva. También cita su Project Glasswing: más de 129 000 vulnerabilidades verificadas entre abril y julio en organizaciones socias, y más de 33 000 calificadas críticas o altas.
Lo que no dice
El anuncio no menciona precio ni regiones. No aclara si organizaciones de México o de América Latina pueden calificar en Red Team o Specialized, y tampoco da una fecha de entrada en vigor por nivel. Otros laboratorios van por el mismo camino: Google abrió Gemini 4 Argon solo a defensores de ciberseguridad el 1 de octubre.
Sigue leyendo
- Inteligencia artificial
DeepMind lanza SynthID Bio para marcar proteínas hechas con IA
- Inteligencia artificial
OpenAI pondrá marca de agua invisible al texto de ChatGPT en UE
- Inteligencia artificial
Claude for Government sale de beta para agencias de EE. UU.
- Internet
Chrome 154 repara una falla crítica de WebGL y diez más



