Volver a noticias

Antropic dice que los usuarios trataron de emplear a Claude para armas, patógenos y vigilancia

La compañía dice que ha desactivado las operaciones identificadas, pero su informe de amenazas muestra cómo la AI de propósito general está reduciendo las barreras a través de la actividad militar, biológica y de inteligencia.

Traducción automática · Original en inglés · Ver original

Un catálogo más amplio de intentos de mal uso

Antropic dice que criminales, grupos relacionados con el estado, investigadores, operadores de spyware y propagandistas intentaron utilizar sus modelos Claude para actividades que van desde los ataques cibernéticos hasta el desarrollo de armas convencionales y la investigación biológica. El nuevo informe de inteligencia de amenazas de la compañía describe los esfuerzos que involucran el software de misiles y drones, la vigilancia de los disidentes, las campañas de influencia y la investigación que podrían tener aplicaciones militares legítimas y peligrosas.

La compañía dijo que detectó y desactivó todas las operaciones incluidas en el informe. No identificó las instituciones o países detrás de varios casos biológicos y dijo que la intención de algunos investigadores permaneció incerta. Esa calificación es importante: la asistencia con un estudio de un virus como la chikungunya podría contribuir a las vacunas, pero similares conocimientos y planificación de laboratorio podrían ser redirigidos hacia el trabajo patogénico dañino. Por lo tanto, el informe documenta los indicadores de riesgo en lugar de demostrar que se ha completado una arma biológica.

Armas, espionaje y operaciones de influencia

Los casos descritos por Anthropic incluyeron intentos en Yemen, China y Rusia de desarrollar software asociado con armas de fuego, misiles, drones armados, explosivos y otras municiones. El informe también identificó la actividad de ciberespionaje rusa, el rápido hacking criminal, el seguimiento de los uigures en Siria vinculado a China, la vigilancia de los disidentes internos y el trabajo de propaganda relacionado con Rusia, Malasia, Irán y Bangladesh. Estos ejemplos muestran que un modelo se aplica a varias amenazas de seguridad establecidas en lugar de crear una nueva categoría de conflicto.

El cambio central es la velocidad y la accesibilidad. Un asistente de propósito general puede ayudar a los usuarios a organizar información técnica, el diseño de código, traducir material y iterar a través de tareas complejas. La Agencia de Seguridad Nacional de EE.UU. ha advertido anteriormente que los adversarios ya utilizaban la IA para aumentar la velocidad, la escala y la sofisticacin de las operaciones cibernéticas ofensivas, incluyendo la pesca de velocidad, los hechos profundos y el apoyo a los hackers de estado nacional. Los casos de Anthropic proporcionan un snapshot a nivel de la compañía de ese patrón más amplio.

Lo que el informe no resuelve

Los hallazgos vienen de la visibilidad interna de Anthropic en su propio servicio. No medirán el mal uso realizado a través de modelos abiertos, plataformas rivales o sistemas operados en su totalidad fuera de la infraestructura comercial supervisada. También dependen de los métodos de detección de la compañía y de los juicios sobre qué actividad fue sospechosa. Esto hace que la evaluación independiente sea importante, especialmente cuando Anthropic detiene identidades para proteger las investigaciones o no puede determinar la intención.

La pregunta inmediata de la política es si la vigilancia voluntaria y las prohibiciones de cuentas son suficientes ya que los modelos obtienen funciones más capaces de codificación y científicas. Los gobiernos y los desarrolladores necesitarán mecanismos para compartir incidentes confidenciales, evaluar independientemente y coordinarse rápidamente cuando los riesgos transfronterizos. El informe reforza el caso de tratar la seguridad de la inteligencia artificial como un problema de seguridad nacional operativo ahora, manteniendo una clara distinción entre el intento de mal uso, la capacidad demostrada y un ataque logrado.