NoticiasMacroInforme de Anthropic detalla el uso de IA en ciberdelincuencia, campañas de influencia y operaciones estatales

Informe de Anthropic detalla el uso de IA en ciberdelincuencia, campañas de influencia y operaciones estatales

Autor: Metaverse Post·

Puntos clave

  • El informe cubre casos de uso indebido de alto nivel detectados e interrumpidos en Rusia, China, Irán y otras regiones, en lugar de medir la frecuencia del uso indebido típico.
  • Los actores de amenazas utilizaron sistemas multiagente para automatizar operaciones cibernéticas, como phishing, desarrollo de malware, recopilación de credenciales y extracción de datos.
  • Anthropic identificó campañas de influencia, programas de vigilancia, proyectos de armas e investigaciones biológicas de doble uso entre las actividades documentadas.
  • La empresa acusó a varios laboratorios chinos de extraer de forma encubierta resultados y trazas de razonamiento de Claude para entrenar modelos competidores; algunos mecanismos de retransmisión presuntamente expusieron datos sensibles.
  • Anthropic afirmó que ninguno de los casos involucró sus modelos Fable o Mythos más capaces, salvo un incidente relacionado con la destilación.
Informe de Anthropic detalla el uso de IA en ciberdelincuencia, campañas de influencia y operaciones estatales

La empresa de investigación de IA Anthropic publicó su último informe de inteligencia sobre amenazas, “Detecting and Countering Misuse of AI: September 2026”, en el que detalla los intentos de actores maliciosos por convertir sus modelos Claude en armas para operaciones cibernéticas, campañas de influencia, vigilancia, investigación biológica, desarrollo de armas, fraude y destilación de modelos.

El informe cubre actividades detectadas e interrumpidas entre diciembre de 2025 y agosto de 2026. Los casos involucraron a grupos presuntamente patrocinados por Estados, delincuentes motivados económicamente, proveedores comerciales de software espía e instituciones de propaganda que operaban en Rusia, China, Irán y otras regiones.

Anthropic señaló que ninguno de los casos documentados de uso indebido involucró sus modelos Fable o Mythos, los más capaces de la empresa, salvo un caso descrito en la sección sobre destilación. La compañía también enfatizó que los incidentes divulgados no representan el uso indebido típico. En cambio, fueron seleccionados por constituir la actividad de amenazas más sofisticada y novedosa identificada hasta la fecha. Esto significa que el informe registra casos documentados de uso indebido de alto nivel, no que mida la frecuencia con la que ocurren estas actividades. Anthropic afirmó que prohibió las cuentas asociadas en todos los casos, reforzó sus medidas de seguridad con base en los hallazgos de sus investigaciones y compartió inteligencia con autoridades y socios de la industria.

We're publishing our most detailed threat intelligence report to date. It covers how people tried to misuse Claude—for cyberattacks, influence operations, surveillance, biology, and building weapons—and how we found and stopped them. We disrupted every operation in the report,… — Anthropic (@AnthropicAI) September 10, 2026

https://x.com/AnthropicAI/status/2098097512544444447?ref_src=twsrc%5Etfw

De asistente a orquestador: conclusiones clave

La principal conclusión del informe es que la IA pasó de ser una herramienta de asesoría a convertirse en un orquestador operativo de la ciberdelincuencia. En la mayoría de las operaciones analizadas, los actores de amenazas desplegaron marcos multiagente que realizaron de forma autónoma tareas de reconocimiento, explotación, recopilación de credenciales y extracción de datos. Los participantes humanos se encargaron principalmente de seleccionar objetivos y revisar los resultados.

Un caso destacado, identificado como GTG-20006, fue vinculado con el grupo ruso Midnight Blizzard, relacionado con el aparato estatal. El grupo utilizó flujos de trabajo impulsados por IA para realizar phishing, desarrollar malware y evadir detecciones, reconstruyendo automáticamente sus herramientas cada vez que los productos de seguridad las detectaban. Por separado, presuntos afiliados de ShinyHunters utilizaron IA para industrializar la recopilación de credenciales, descompilando 1.8 millones de aplicaciones de Android en busca de secretos y completando intrusiones en tan solo dos o tres horas.

Fuera de las operaciones cibernéticas, Anthropic documentó campañas de influencia dirigidas contra elecciones y la opinión pública en Moldavia, Kenia, Malasia y Bangladesh. También describió actividades de vigilancia alineadas con Estados en China, Irán y Malí, incluida una plataforma diseñada para monitorear aproximadamente a 25 millones de suscriptores móviles.

El informe también identificó esfuerzos de desarrollo de armas, incluido un programa de cohetes guiados en Yemen y un proyecto de enjambre autónomo de drones en Rusia. La sección sobre uso indebido biológico presenta cinco casos de investigación de doble uso, incluido trabajo de ganancia de función relacionado con el virus chikungunya y estudios sobre la adaptación de la influenza aviar. Anthropic afirmó que sus clasificadores contuvieron en gran medida estas actividades.

El informe también detalla campañas ilícitas de destilación atribuidas a laboratorios chinos, incluidos Alibaba, DeepSeek, Moonshot AI, Xiaomi y Zhipu. Anthropic acusa a los laboratorios de enviar consultas de usuarios a Claude de forma encubierta, recopilar trazas de razonamiento y utilizar los resultados para entrenar modelos competidores. En varios casos, este mecanismo de retransmisión presuntamente expuso datos corporativos y gubernamentales sensibles a terceros sin el conocimiento de los usuarios.

Anthropic presentó la divulgación como una advertencia y una hoja de ruta. La empresa afirmó que, a medida que los modelos de IA se vuelvan más capaces, serán esenciales los esfuerzos coordinados de detección y defensa por parte de la industria de la IA y los gobiernos para mantener la ventaja frente a adversarios persistentes.

Fuente: Metaverse Post