Anthropic detalla operaciones de influencia, fraude y uso indebido de Claude para crear malware
Anthropic informó de cuatro casos de uso malicioso de Claude y afirmó que bloqueó las cuentas vinculadas a esas actividades.
Respuesta rápida
¿Qué usos maliciosos de Claude identificó y contrarrestó Anthropic?
Anthropic informó de que varios actores utilizaron Claude en una operación de influencia, una iniciativa relacionada con credenciales filtradas de cámaras de seguridad, una campaña de fraude en procesos de contratación y el desarrollo de malware. La empresa afirmó que bloqueó las cuentas vinculadas y empleó técnicas de análisis de conversaciones y clasificadores para detectar, investigar y contrarrestar esas actividades.
Claves
- Anthropic describió cuatro casos en los que varios actores presuntamente utilizaron Claude para operaciones de influencia, actividades relacionadas con credenciales, fraude en procesos de contratación y desarrollo de malware.
- La empresa afirmó que una operación de influencia como servicio utilizó Claude para coordinar más de 100 cuentas automatizadas en Twitter/X y Facebook.
- Anthropic afirmó que bloqueó todas las cuentas vinculadas a las actividades descritas en el informe.
- La empresa señaló que utilizó Clio, la elaboración jerárquica de resúmenes y clasificadores para analizar conversaciones e identificar patrones de uso indebido.
Anthropic publicó un informe en el que describe cuatro casos en los que varios actores presuntamente utilizaron Claude de forma indebida para ejercer influencia política coordinada, llevar a cabo actividades relacionadas con credenciales filtradas de cámaras de seguridad, cometer fraude en procesos de contratación y desarrollar malware. La empresa afirmó que identificó y bloqueó las cuentas vinculadas a cada caso.
Anthropic señaló que su equipo de inteligencia utilizó técnicas procedentes de sus investigaciones sobre Clio y la elaboración jerárquica de resúmenes para analizar grandes volúmenes de datos de conversaciones. Combinó esos métodos con clasificadores que examinan las solicitudes de los usuarios en busca de peticiones potencialmente dañinas y evalúan las respuestas de Claude antes o después de su entrega.
Coordinación de bots en redes sociales
La empresa identificó lo que denominó una operación de influencia como servicio con fines económicos que gestionaba más de 100 cuentas automatizadas en Twitter/X y Facebook. Según Anthropic, la operación interactuó con decenas de miles de cuentas auténticas de redes sociales en varios países e idiomas.
De acuerdo con Anthropic, el operador utilizó Claude para crear y mantener perfiles ficticios con distintas orientaciones políticas, generar respuestas acordes con esas posiciones y preparar instrucciones para herramientas de generación de imágenes. Claude también ayudó a determinar si las cuentas automatizadas debían indicar que les gustaban ciertas publicaciones, compartirlas, comentarlas o ignorarlas en función de los objetivos políticos de los clientes.
Anthropic afirmó que los discursos se asemejaban a los asociados con campañas vinculadas a Estados, pero no confirmó esa atribución. La empresa también indicó que ninguno de los contenidos de la operación se hizo viral. Describió la actividad como una interacción sostenida destinada a promover perspectivas políticas moderadas para clientes de fuera de Estados Unidos.
Credenciales, fraude en la contratación y malware
En otro caso, Anthropic afirmó que un actor sofisticado intentó crear sistemas para recopilar nombres de usuario y contraseñas expuestos asociados con cámaras de seguridad y probar esas credenciales en objetivos accesibles desde internet. El actor utilizó Claude para reescribir un conjunto de herramientas de extracción de datos, crear programas para recopilar URL de objetivos, procesar publicaciones de comunidades de Telegram dedicadas a registros obtenidos mediante programas de robo de información y mejorar los sistemas de búsqueda. Anthropic señaló que no había confirmado que el sistema llegara a desplegarse con éxito.
La empresa también informó de que bloqueó a un actor que llevaba a cabo un fraude en procesos de contratación dirigido principalmente contra solicitantes de empleo de países de Europa del Este. Según Anthropic, la operación suplantaba a responsables de contratación de empresas legítimas y utilizaba Claude para pulir el lenguaje, elaborar relatos de contratación, crear material para entrevistas y dar formato a los mensajes. De acuerdo con el informe, los operadores enviaban a Claude textos mal redactados en un inglés no nativo para que los corrigiera. Anthropic señaló que no había confirmado que la operación hubiera culminado en estafas exitosas.
Un cuarto caso involucró a un actor con escasos conocimientos de programación que utilizó Claude para desarrollar herramientas destinadas a revelar datos personales y obtener acceso remoto. Anthropic afirmó que el conjunto de herramientas del actor evolucionó hasta incluir reconocimiento facial y rastreo de la web oscura, mientras que un creador de malware pasó de ser un generador de programas por lotes a una interfaz gráfica capaz de producir cargas maliciosas diseñadas para eludir los controles de seguridad y conservar el acceso. La empresa no confirmó que el malware se desplegara en entornos reales.
Detección y medidas coercitivas
Anthropic afirmó que su programa de inteligencia busca detectar daños que pasan inadvertidos para los sistemas habituales y aportar contexto sobre cómo distintos actores utilizan indebidamente sus modelos. La empresa señaló que las conclusiones de cada caso se incorporaron a controles más amplios destinados a detectar y prevenir con mayor rapidez los usos maliciosos.
Fuente: «Detecting and countering malicious uses of Claude: March 2025» de Anthropic, publicado el 23 de abril de 2025.
Preguntas frecuentes
- ¿Qué casos describió Anthropic?
- Anthropic describió una operación de influencia como servicio, actividades relacionadas con credenciales filtradas asociadas con cámaras de seguridad, una campaña de fraude en procesos de contratación y un actor inexperto que desarrollaba herramientas maliciosas.
- ¿Confirmó Anthropic que las iniciativas de ciberataque y fraude tuvieron éxito?
- No. Anthropic afirmó que no había confirmado el despliegue satisfactorio de la iniciativa relacionada con las credenciales de cámaras de seguridad, ni la culminación de las estafas de contratación o el despliegue del malware.
- ¿Cómo respondió Anthropic a las actividades identificadas?
- La empresa afirmó que detectó, investigó y bloqueó las cuentas vinculadas a los casos. También señaló que cada caso sirvió para reforzar sus controles generales destinados a detectar usos maliciosos.
- ¿Cómo se utilizó Claude en la operación de influencia?
- Anthropic afirmó que Claude ayudó a mantener perfiles ficticios de carácter político, generar respuestas y decidir si las cuentas automatizadas debían indicar que les gustaban determinadas publicaciones en redes sociales, compartirlas, comentarlas o ignorarlas.