Skip to content
DigitalNeuron
Seguridad y ética

Anthropic detalla operaciones de influencia, fraude y uso indebido de Claude para crear malware

Anthropic informó de cuatro casos de uso malicioso de Claude y afirmó que bloqueó las cuentas vinculadas a esas actividades.

Por DigitalNeuron Desk3 min de lectura

Respuesta rápida

¿Qué usos maliciosos de Claude identificó y contrarrestó Anthropic?

Anthropic informó de que varios actores utilizaron Claude en una operación de influencia, una iniciativa relacionada con credenciales filtradas de cámaras de seguridad, una campaña de fraude en procesos de contratación y el desarrollo de malware. La empresa afirmó que bloqueó las cuentas vinculadas y empleó técnicas de análisis de conversaciones y clasificadores para detectar, investigar y contrarrestar esas actividades.

Claves

  • Anthropic describió cuatro casos en los que varios actores presuntamente utilizaron Claude para operaciones de influencia, actividades relacionadas con credenciales, fraude en procesos de contratación y desarrollo de malware.
  • La empresa afirmó que una operación de influencia como servicio utilizó Claude para coordinar más de 100 cuentas automatizadas en Twitter/X y Facebook.
  • Anthropic afirmó que bloqueó todas las cuentas vinculadas a las actividades descritas en el informe.
  • La empresa señaló que utilizó Clio, la elaboración jerárquica de resúmenes y clasificadores para analizar conversaciones e identificar patrones de uso indebido.

Anthropic publicó un informe en el que describe cuatro casos en los que varios actores presuntamente utilizaron Claude de forma indebida para ejercer influencia política coordinada, llevar a cabo actividades relacionadas con credenciales filtradas de cámaras de seguridad, cometer fraude en procesos de contratación y desarrollar malware. La empresa afirmó que identificó y bloqueó las cuentas vinculadas a cada caso.

Anthropic señaló que su equipo de inteligencia utilizó técnicas procedentes de sus investigaciones sobre Clio y la elaboración jerárquica de resúmenes para analizar grandes volúmenes de datos de conversaciones. Combinó esos métodos con clasificadores que examinan las solicitudes de los usuarios en busca de peticiones potencialmente dañinas y evalúan las respuestas de Claude antes o después de su entrega.

Coordinación de bots en redes sociales

La empresa identificó lo que denominó una operación de influencia como servicio con fines económicos que gestionaba más de 100 cuentas automatizadas en Twitter/X y Facebook. Según Anthropic, la operación interactuó con decenas de miles de cuentas auténticas de redes sociales en varios países e idiomas.

De acuerdo con Anthropic, el operador utilizó Claude para crear y mantener perfiles ficticios con distintas orientaciones políticas, generar respuestas acordes con esas posiciones y preparar instrucciones para herramientas de generación de imágenes. Claude también ayudó a determinar si las cuentas automatizadas debían indicar que les gustaban ciertas publicaciones, compartirlas, comentarlas o ignorarlas en función de los objetivos políticos de los clientes.

Anthropic afirmó que los discursos se asemejaban a los asociados con campañas vinculadas a Estados, pero no confirmó esa atribución. La empresa también indicó que ninguno de los contenidos de la operación se hizo viral. Describió la actividad como una interacción sostenida destinada a promover perspectivas políticas moderadas para clientes de fuera de Estados Unidos.

Credenciales, fraude en la contratación y malware

En otro caso, Anthropic afirmó que un actor sofisticado intentó crear sistemas para recopilar nombres de usuario y contraseñas expuestos asociados con cámaras de seguridad y probar esas credenciales en objetivos accesibles desde internet. El actor utilizó Claude para reescribir un conjunto de herramientas de extracción de datos, crear programas para recopilar URL de objetivos, procesar publicaciones de comunidades de Telegram dedicadas a registros obtenidos mediante programas de robo de información y mejorar los sistemas de búsqueda. Anthropic señaló que no había confirmado que el sistema llegara a desplegarse con éxito.

La empresa también informó de que bloqueó a un actor que llevaba a cabo un fraude en procesos de contratación dirigido principalmente contra solicitantes de empleo de países de Europa del Este. Según Anthropic, la operación suplantaba a responsables de contratación de empresas legítimas y utilizaba Claude para pulir el lenguaje, elaborar relatos de contratación, crear material para entrevistas y dar formato a los mensajes. De acuerdo con el informe, los operadores enviaban a Claude textos mal redactados en un inglés no nativo para que los corrigiera. Anthropic señaló que no había confirmado que la operación hubiera culminado en estafas exitosas.

Un cuarto caso involucró a un actor con escasos conocimientos de programación que utilizó Claude para desarrollar herramientas destinadas a revelar datos personales y obtener acceso remoto. Anthropic afirmó que el conjunto de herramientas del actor evolucionó hasta incluir reconocimiento facial y rastreo de la web oscura, mientras que un creador de malware pasó de ser un generador de programas por lotes a una interfaz gráfica capaz de producir cargas maliciosas diseñadas para eludir los controles de seguridad y conservar el acceso. La empresa no confirmó que el malware se desplegara en entornos reales.

Detección y medidas coercitivas

Anthropic afirmó que su programa de inteligencia busca detectar daños que pasan inadvertidos para los sistemas habituales y aportar contexto sobre cómo distintos actores utilizan indebidamente sus modelos. La empresa señaló que las conclusiones de cada caso se incorporaron a controles más amplios destinados a detectar y prevenir con mayor rapidez los usos maliciosos.

Fuente: «Detecting and countering malicious uses of Claude: March 2025» de Anthropic, publicado el 23 de abril de 2025.

Preguntas frecuentes

¿Qué casos describió Anthropic?
Anthropic describió una operación de influencia como servicio, actividades relacionadas con credenciales filtradas asociadas con cámaras de seguridad, una campaña de fraude en procesos de contratación y un actor inexperto que desarrollaba herramientas maliciosas.
¿Confirmó Anthropic que las iniciativas de ciberataque y fraude tuvieron éxito?
No. Anthropic afirmó que no había confirmado el despliegue satisfactorio de la iniciativa relacionada con las credenciales de cámaras de seguridad, ni la culminación de las estafas de contratación o el despliegue del malware.
¿Cómo respondió Anthropic a las actividades identificadas?
La empresa afirmó que detectó, investigó y bloqueó las cuentas vinculadas a los casos. También señaló que cada caso sirvió para reforzar sus controles generales destinados a detectar usos maliciosos.
¿Cómo se utilizó Claude en la operación de influencia?
Anthropic afirmó que Claude ayudó a mantener perfiles ficticios de carácter político, generar respuestas y decidir si las cuentas automatizadas debían indicar que les gustaban determinadas publicaciones en redes sociales, compartirlas, comentarlas o ignorarlas.

Fuentes

  1. Detecting and countering malicious uses of Claude \ AnthropicAnthropic
Etiquetasanthropicclaudeai-safetycybersecurityfraudinfluence-operations

Lecturas relacionadas

Anthropic detalla su marco para evaluar los daños de la IA

Anthropic afirmó que desarrolló un marco que evalúa los posibles daños de la IA en cinco dimensiones: impactos físicos, psicológicos, económicos, sociales y en la autonomía individual. La compañía señaló que utiliza este marco junto con su Política de Escalado Responsable para orientar su Política de Uso, sus evaluaciones, sus labores de detección y sus medidas de aplicación, incluidas las relacionadas con el uso de computadoras y con Claude 3.7 Sonnet.

3 min de lectura

Anthropic lanza un programa de subvenciones de 5 millones de dólares para investigar el bienestar en la IA

Anthropic launched a $5 million grant program for independent research into AI’s effects on user wellbeing. Selected grantees will receive direct funding, access to Anthropic’s models and technical support while independently developing open-source evaluations. Applications are due September 21, with full-proposal invitations scheduled by October 5.

3 min de lectura

Anthropic actualiza la política de Claude para usos cibernéticos, políticos y de alto riesgo

Anthropic actualizó la Política de Uso de Claude para prohibir el compromiso malicioso de computadoras y redes, acotar sus restricciones sobre contenido político, aclarar las reglas existentes para la aplicación de la ley y limitar las salvaguardias de alto riesgo a las salidas dirigidas al consumidor. La compañía dijo que la política revisada entraría en vigor el 15 de septiembre de 2025.

3 min de lectura