Skip to content
DigitalNeuron
안전·윤리

앤트로픽, 클로드를 악용한 여론 조작·사기·멀웨어 사례 공개

앤트로픽은 클로드를 악용한 네 건의 사례를 보고하며 관련 계정을 모두 차단했다고 밝혔다.

DigitalNeuron Desk2분 읽기

한 줄 답

앤트로픽이 확인하고 차단한 클로드 악용 사례는 무엇인가?

앤트로픽은 행위자들이 클로드를 여론 조작 작업, 유출된 보안 카메라 계정 정보 관련 활동, 채용 사기 캠페인, 멀웨어 개발에 이용했다고 보고했다. 회사는 관련 계정을 모두 차단했으며, 대화 분석 기법과 분류기를 활용해 해당 활동을 탐지·조사·차단했다고 밝혔다.

핵심 요약

  • 앤트로픽은 행위자들이 클로드를 여론 조작 작업, 계정 정보 관련 활동, 채용 사기, 멀웨어 개발에 이용한 것으로 추정되는 네 건의 사례를 공개했다.
  • 회사는 한 '영향력 대행 서비스' 작업이 클로드를 이용해 트위터(X)와 페이스북에서 100개 이상의 소셜미디어 봇 계정을 조율했다고 밝혔다.
  • 앤트로픽은 보고서에 언급된 모든 활동과 관련된 계정을 차단했다고 밝혔다.
  • 회사는 Clio, 계층적 요약, 분류기를 활용해 대화를 분석하고 악용 패턴을 식별했다고 밝혔다.

앤트로픽이 행위자들이 클로드를 조직적인 정치적 여론 조작, 유출된 보안 카메라 계정 정보 관련 활동, 채용 사기, 멀웨어 개발에 악용한 것으로 추정되는 네 건의 사례를 담은 보고서를 발표했다. 회사는 모든 사례와 관련된 계정을 확인해 차단했다고 밝혔다.

앤트로픽은 자사 인텔리전스 팀이 Clio와 계층적 요약 연구에서 도출한 기법을 활용해 방대한 양의 대화 데이터를 분석했다고 설명했다. 이러한 방법을 사용자 입력의 잠재적 유해성을 점검하고 전달 전후로 클로드의 응답을 평가하는 분류기와 결합했다고 덧붙였다.

소셜미디어 봇 조율

앤트로픽은 트위터(X)와 페이스북에서 100개 이상의 봇 계정을 운영한, 금전적 동기에 따른 '영향력 대행 서비스' 형태의 작업을 확인했다고 밝혔다. 이 작업은 여러 국가와 언어에 걸쳐 수만 개의 실제 소셜미디어 계정과 상호작용했다고 회사는 설명했다.

앤트로픽에 따르면 운영자는 클로드를 이용해 서로 다른 정치적 성향을 가진 페르소나를 만들고 유지했으며, 정치 성향에 맞춘 답변을 생성하고 이미지 생성 도구에 사용할 프롬프트를 준비했다. 클로드는 또한 고객의 정치적 목표에 따라 봇 계정이 특정 게시물에 '좋아요'를 누르거나 공유·댓글을 달거나 무시할지를 판단하는 데도 활용됐다.

앤트로픽은 이러한 서사가 국가 연계 캠페인에서 나타나는 것과 유사했다고 밝혔지만, 그러한 배후 관계를 확인하지는 않았다고 덧붙였다. 회사는 또한 이 작업의 콘텐츠 중 어느 것도 확산되지는 않았다고 밝혔다. 앤트로픽은 이를 미국 밖 고객을 위해 온건한 정치적 관점을 홍보하는 지속적인 참여 활동으로 설명했다.

계정 정보 탈취, 채용 사기, 멀웨어

또 다른 사례에서 앤트로픽은 한 정교한 행위자가 보안 카메라와 관련해 노출된 사용자명과 비밀번호를 수집하고, 이를 인터넷에 노출된 대상에 대입해 시험하는 시스템을 구축하려 했다고 밝혔다. 이 행위자는 클로드를 이용해 스크래핑 도구를 재작성하고, 대상 URL을 수집하는 스크립트를 만들었으며, 스틸러 로그를 다루는 텔레그램 커뮤니티의 게시물을 처리하고, 검색 시스템을 개선했다. 앤트로픽은 이 활동이 실제로 성공적으로 배포됐는지는 확인하지 못했다고 밝혔다.

회사는 또한 주로 동유럽 국가의 구직자를 대상으로 채용 사기를 벌인 행위자를 차단했다고 보고했다. 앤트로픽에 따르면 이 작업은 합법적인 기업의 채용 담당자를 사칭했으며, 클로드를 이용해 문구를 다듬고 채용 서사를 만들었으며 면접 자료를 제작하고 메시지 형식을 정리했다. 보고서에 따르면 운영자들은 문법이 서툰 비원어민 영어 문장을 클로드에 입력해 다듬도록 했다. 앤트로픽은 이 작업이 실제로 사기에 성공했는지는 확인하지 못했다고 밝혔다.

네 번째 사례는 코딩 실력이 제한적인 행위자가 클로드를 이용해 신상 공개(도싱)와 원격 접속 도구를 개발한 경우다. 앤트로픽에 따르면 이 행위자의 도구는 얼굴 인식과 다크웹 스캔 기능까지 갖추도록 발전했으며, 멀웨어 제작 도구는 배치 스크립트 생성기 수준에서 보안 통제를 우회하고 접속 권한을 유지하도록 설계된 악성 페이로드를 생성하는 그래픽 인터페이스 수준으로 발전했다. 회사는 해당 멀웨어가 실제로 배포됐는지는 확인하지 않았다.

탐지와 대응

앤트로픽은 자사의 인텔리전스 프로그램이 표준 탐지 시스템이 놓치는 피해 사례를 찾아내고, 행위자들이 자사 모델을 악용하는 방식에 대한 맥락을 제공한다고 밝혔다. 회사는 각 사례에서 얻은 결과를 적대적 이용을 더 신속히 탐지하고 예방하기 위한 광범위한 통제 체계에 반영했다고 설명했다.

출처: 앤트로픽, 「클로드의 악의적 이용 탐지와 대응: 2025년 3월」, 2025년 4월 23일 발표.

자주 묻는 질문

앤트로픽이 공개한 사례는 무엇인가?
앤트로픽은 영향력 대행 서비스 작업, 유출된 보안 카메라 계정 정보와 관련된 활동, 채용 사기 캠페인, 그리고 미숙한 행위자가 악성 도구를 개발한 사례를 공개했다.
앤트로픽은 사이버 및 사기 시도가 실제로 성공했다고 확인했는가?
아니다. 앤트로픽은 보안 카메라 계정 정보 탈취 시도, 채용 사기, 멀웨어의 실제 배포 성공 여부는 확인하지 못했다고 밝혔다.
앤트로픽은 확인된 활동에 어떻게 대응했는가?
회사는 해당 사례들과 관련된 계정을 탐지·조사해 차단했다고 밝혔다. 또한 각 사례가 적대적 이용을 탐지하기 위한 광범위한 통제 체계에 반영됐다고 설명했다.
여론 조작 작업에서 클로드는 어떻게 이용됐는가?
앤트로픽은 클로드가 정치적 페르소나를 유지하고 응답을 생성하며, 봇 계정이 특정 소셜미디어 게시물에 '좋아요'를 누르거나 공유·댓글을 달거나 무시할지를 판단하는 데 활용됐다고 밝혔다.

출처

  1. Detecting and countering malicious uses of Claude \ AnthropicAnthropic
태그anthropicclaudeai-safetycybersecurityfraudinfluence-operations

함께 읽기

앤트로픽, AI 피해 평가 프레임워크 공개

앤트로픽은 잠재적인 AI 피해를 신체적, 심리적, 경제적, 사회적 영향과 개인의 자율성에 미치는 영향 등 다섯 가지 차원에서 평가하는 프레임워크를 개발했다고 밝혔다. 회사는 컴퓨터 사용 기능과 Claude 3.7 Sonnet을 비롯해 이용 정책, 평가, 탐지 활동 및 집행 조치의 방향을 정하는 데 이 프레임워크를 책임 있는 확장 정책과 함께 활용한다고 설명했다.

3분 읽기

앤트로픽, 500만 달러 규모의 AI 웰빙 연구 지원 프로그램 출범

Anthropic은 AI가 사용자 웰빙에 미치는 영향을 독립적으로 연구하기 위한 500만 달러 규모의 지원금 프로그램을 출범했습니다. 선정된 지원 대상자는 직접적인 자금 지원과 Anthropic 모델 이용 권한 및 기술 지원을 받으며, 독립적으로 오픈소스 평가 도구를 개발하게 됩니다. 신청 마감일은 9월 21일이며, 전체 제안서 제출 초청은 10월 5일까지 진행될 예정입니다.

3분 읽기

Anthropic, 사이버 및 정치, 고위험 사용에 대한 Claude 정책 업데이트

Anthropic은 악의적인 컴퓨터 및 네트워크 침해를 금지하고, 정치 콘텐츠에 대한 제한을 좁히고, 기존 법 집행 규칙을 명확히 하고, 고위험 보호 조치를 소비자 대상 출력으로 제한하도록 Claude 사용 정책을 업데이트했습니다. 회사는 개정된 정책이 2025년 9월 15일에 발효될 것이라고 밝혔습니다.

3분 읽기