Anthropic publico el jueves pasado (10/09) su mas reciente informe de inteligencia de amenazas, que documenta como grupos maliciosos usaron Claude para llevar a cabo ataques entre diciembre de 2025 y agosto de 2026. El documento cubre siete categorias de uso indebido —operaciones ciberneticas, campañas de influencia, vigilancia, fraude, mal uso biologico, desarrollo de armas convencionales y destilacion de modelos— y refuerza una tendencia que ya se venia observando en informes anteriores de la empresa: la IA esta dejando de ser solo una asistente de tareas puntuales para convertirse en orquestadora de ataques completos.

De asistente a orquestador

Segun Anthropic, cibercriminales y actores vinculados a estados pasaron a usar Claude no solo para escribir fragmentos de codigo malicioso, sino para planificar, ejecutar y adaptar campañas completas, con el operador humano funcionando mas como supervisor que como ejecutor directo. Esto incluye cadenas de ataque en las que el modelo decide los proximos pasos, activa otras herramientas y reacciona ante obstaculos tecnicos sin intervencion constante —el mismo tipo de autonomia en agentes que hoy se vende como una ganancia de productividad para los equipos de ingenieria.

Espionaje y malware que se reescribe solo

Uno de los casos mas detallados involucra a un actor con sospecha de vinculo estatal ruso, identificado como GTG-20006, que uso flujos automatizados por IA para cubrir practicamente todo el ciclo de una operacion de espionaje: preparacion de infraestructura, phishing, mantenimiento de acceso a sistemas comprometidos y exfiltracion de datos. Segun Anthropic, el grupo llego a montar un sistema que detectaba automaticamente cuando su malware era identificado por soluciones de seguridad y reescribia el codigo hasta volver a evadir la deteccion —un ciclo de evasion practicamente sin intervencion humana.

La disputa por capacidad: destilacion en masa

El informe tambien describe intentos de extraer las capacidades de Claude para entrenar otros modelos, practica conocida como destilacion. Anthropic afirma haber identificado e interrumpido actividad de siete laboratorios con sede en China —incluyendo Alibaba, Moonshot, DeepSeek y Xiaomi— en este frente. El caso de mayor escala habria involucrado a operadores vinculados a Alibaba, con mas de 151 millones de intercambios de mensajes registrados entre mayo y julio de 2026 en el intento de mejorar la familia de modelos Qwen a partir de respuestas de Claude.

Otros usos indebidos documentados

La empresa tambien reporta haber identificado actores usando Claude para desarrollar software orientado a armas convencionales —desde sistemas de guerra electronica y supresion de defensa aerea hasta herramientas vinculadas a armas de fuego, misiles y drones—, con incidentes reportados en China, Rusia y Yemen.

Que significa esto en la practica

Para quienes construyen productos con modelos de lenguaje y agentes autonomos, el informe es menos una advertencia abstracta y mas un recordatorio operativo: los pipelines agenticos que automatizan tareas de infraestructura, red o seguridad necesitan limites de uso, monitoreo de patrones anomalos de consumo de API y revision humana en los puntos de decision criticos —las mismas defensas que sirven contra el abuso sirven tambien para reducir el riesgo de uso indebido. La publicacion periodica de estos informes es, en si misma, una señal de mercado: se le exige cada vez mas a los proveedores de modelos que muestren no solo lo que sus sistemas hacen bien, sino tambien lo que estan haciendo para contener el mal uso —un criterio que pesara cada vez mas en la eleccion de proveedores por parte de los equipos de ingenieria.