Abuso del Claude: ciberespionaje y armas biológicas

Informe de inteligencia de Anthropic abarca de diciembre 2025 a agosto 2026 y clasifica siete tipos de abuso, incluidos operaciones estatales y armamento.
Anthropic publicó este jueves un informe de inteligencia de amenazas que cubre nueve meses continuos de abuso documentado de sus modelos. El documento, titulado "Countering Misuse of AI: September 2026", mapea el período de diciembre de 2025 a agosto de 2026 y enumera siete categorías distintas de daño, entre ellas investigación en armas biológicas y armamento convencional, dos vectores que reciben tratamiento sistemático por primera vez en una publicación de la empresa.
Siete categorías y los casos detrás de ellas
El informe organiza los incidentes en: operaciones cibernéticas, operaciones de influencia, vigilancia, fraudes y estafas, investigación en armamento biológico, investigación en armamento convencional y destilación de modelos. La destilación, a menudo tratada como un asunto contractual, se enmarca aquí como un riesgo de seguridad: actores malintencionados utilizan salidas de modelos líderes de mercado para entrenar alternativas, reduciendo costos de desarrollo propio y potencialmente eludiendo las políticas de uso aceptable del proveedor original.
Entre los casos descritos, Anthropic identificó un grupo con vínculos a Rusia que utilizó Claude para elaborar campañas de phishing dirigidas a funcionarios del gobierno ucraniano y para crear malware personalizado. La operación combinó generación de texto a gran escala con personalización técnica, según el documento. La empresa enmarca estos casos como "operaciones cibernéticas habilitadas por IA": ataques en los que el modelo acelera etapas del ciclo ofensivo sin sustituir la inteligencia humana en la definición de objetivos.
La categoría de vigilancia documenta el uso de Claude para la construcción de perfiles de individuos y análisis de comunicaciones. En los casos de fraude, el modelo fue empleador para generar contenido convincente en múltiples idiomas dirigido a estafas financieras. La categoría de investigación en armamento biológico indica que actores buscaron en el modelo asistencia técnica en dominios antes restringidos a investigadores acreditados.
Lo que distingue este informe de los publicados por OpenAI y Google
Desde principios de 2026, Anthropic ha publicado dos informes de riesgo, en febrero y agosto, y ahora añade un informe de inteligencia de amenazas con un marco temporal explícito de nueve meses, categorías formalizadas y atribuciones geopolíticas. OpenAI y Google publican informes de transparencia y políticas de uso aceptable, pero ninguno adopta el formato estructurado de inteligencia de amenazas que es estándar en empresas como CrowdStrike, Mandiant y Recorded Future.
Para los ejecutivos de TI que evalúan proveedores de IA, la diferencia es operacional: los informes de inteligencia de amenazas permiten mapear vectores de riesgo dentro de arquitecturas corporativas específicas; los informes de transparencia describen intenciones y políticas. Anthropic está, esencialmente, adoptando el modelo de divulgación de las empresas de ciberseguridad y aplicándolo al uso indebido de IA.
Destilación, Alibaba y la señal para integradores
La categoría de destilación ha ganado atención adicional porque Anthropic había descrito, en comunicaciones anteriores, actividad vinculada a Alibaba en campañas de entrenamiento de modelos usando salidas de Claude. El informe de septiembre coloca ese patrón dentro de una categoría formal de abuso, con implicaciones directas para contratos corporativos que prohíben el uso de salidas de modelos para entrenar competidores.
Para empresas que integran APIs de IA en soluciones propias, la presencia de la destilación como categoría de amenaza requiere una revisión de los controles de registro y de las políticas de acceso. No basta con saber quién consume el modelo; es necesario saber qué hace con las salidas, especialmente cuando los datos son retransmitidos a sistemas de entrenamiento internos.
EE.UU. y Europa: dos contextos regulatorios distintos
En Estados Unidos, donde Anthropic opera y alberga la mayor parte de sus instancias comerciales, el informe informa sobre el debate legislativo en curso. La empresa ya ha testificado ante comités del Congreso sobre seguridad y desinformación; septiembre de 2026 añade armamento biológico y convencional a la lista de vectores que el Congreso necesitará abordar en futuras regulaciones.
En la Unión Europea, el impacto es más inmediato. La Oficina de IA, cuyos poderes de fiscalización del AI Act entraron en vigor en agosto de 2026, tiene autoridad para solicitar acceso a modelos, exigir mitigaciones y determinar la retirada de productos del mercado europeo. Un informe con atribuciones geopolíticas y siete categorías de daño explícitas proporciona la base fáctica que los reguladores necesitan para abrir investigaciones con respaldo técnico. Para proveedores de soluciones basadas en Claude para clientes europeos, el documento crea un precedente de diligencia debida: Anthropic documenta los riesgos con granularidad comparable a empresas de ciberseguridad; los integradores deben demostrar que los gestionan.
La pregunta que los CISOs y directores jurídicos deben responder ahora no es si los sistemas de IA que utilizan pueden ser abusados externamente, sino cuáles de las siete categorías documentadas por Anthropic son pertinentes a la superficie de ataque de su propia organización.