Anthropic interrumpe investigaciones tras detectar intentos de uso de Claude para ciberataques y armas biológicas
Anthropic interrumpió diversas operaciones de investigación tras detectar intentos de mal uso de su modelo Claude para ciberataques rusos y desarrollo de armas biológicas. La firma también identificó vectores de explotación vinculados a actores estatales en China.
La firma de inteligencia artificial Anthropic ha suspendido e interrumpido de forma preventiva diversas líneas de investigación tras identificar intentos de instrumentalización de su modelo de lenguaje Claude. Según reportes de la agencia Reuters, la compañía detectó patrones de uso malintencionado orientados al desarrollo de armas biológicas y a la ejecución de operaciones de ciberataque vinculadas a grupos de piratería informática atribuida a actores estatales rusos.
La decisión de la startup subraya la presión creciente a la que se enfrentan los laboratorios de vanguardia para supervisar la interacción de sus herramientas ante amenazas de ciberseguridad a escala global.
Intervención ante riesgos biológicos y de ciberinteligencia
El monitoreo interno de la empresa permitió interceptar consultas avanzadas que buscaban vulnerar las barreras de seguridad integradas en las versiones comerciales y de desarrollo de Claude:
- Procesamiento de material patógeno: Se detectaron intentos de consultar rutas sintéticas y protocolos de producción para la recreación de agentes biológicos peligrosos.
- Vectores de hackeo ruso: La investigación vinculó ciertas actividades anómalas con grupos cibernéticos respaldados por Rusia, los cuales buscaban automatizar el descubrimiento de vulnerabilidades en infraestructura crítica.
- Explotación por actores chinos: El informe señala la identificación de intentos paralelos de mal uso provenientes de actores tecnológicos vinculados a China para optimizar capacidades de intromisión digital.
Refuerzo de salvaguardas y colaboración institucional
Ante la gravedad de los hallazgos, Anthropic procedió al bloqueo inmediato de las cuentas asociadas y procedió a endurecer los clasificadores de entrada y salida (red-teaming) que evalúan peticiones de alto riesgo.
La compañía ha reiterado que mantiene comunicación fluida con agencias de seguridad nacional de Estados Unidos para compartir indicadores de compromiso, buscando neutralizar el uso no autorizado de modelos de lenguaje en campañas de guerra cibernética o proliferación de insumos biológicos.