Skip to content
DigitalNeuron
안전·윤리

앤트로픽, 최첨단 AI 모델 보안 관행 상세 공개

Anthropic outlined cybersecurity controls it is implementing and recommended procurement rules and public-private cooperation to protect frontier AI models.

DigitalNeuron Desk2분 읽기

한 줄 답

Anthropic은 최첨단 AI 모델의 개발 및 배포를 위해 어떤 보안 조치를 발표했는가?

Anthropic said it is implementing two-party controls, the NIST Secure Software Development Framework, Supply Chain Levels for Software Artifacts and other cybersecurity practices. It also recommended government procurement requirements, expanded public-private cooperation and stronger protections for advanced models, model weights and the research used to develop them.

핵심 요약

  • Anthropic said it is implementing two-party controls, SSDF, SLSA and other cybersecurity practices.
  • 회사는 최첨단 AI 모델의 개발, 학습, 호스팅 및 배포에 사용되는 모든 시스템에 다자간 승인 체계를 도입할 것을 권고했다.
  • Anthropic encouraged extending NIST’s Secure Software Development Framework to cover model development.
  • 회사는 정부가 우선 AI 기업과 클라우드 제공업체에 적용하는 조달 요건을 통해 제안된 통제 조치를 마련할 수 있다고 밝혔다.
  • Anthropic recommended treating frontier AI laboratories similarly to critical-infrastructure companies for public-private cooperation and information sharing.

Anthropic은 최첨단 인공지능 모델과 그 가중치, 모델 개발에 활용되는 연구를 보호하기 위한 일련의 사이버보안 관행을 도입하고 있다고 밝혔다. 아울러 정부 조달 요건을 마련하고 AI 연구소와 공공기관 간 협력을 강화할 것을 제안했다.

Anthropic이 제시한 조치에는 2인 통제와 NIST의 보안 소프트웨어 개발 프레임워크(SSDF), 소프트웨어 산출물 공급망 수준(SLSA)이 포함된다. Anthropic은 모델 역량이 향상될수록 더 강력한 보호 조치가 필요하다며, 이 작업을 정부와 업계가 함께하는 반복적 개선 과정으로 설명했다.

다자간 승인

Anthropic은 최첨단 AI 모델의 개발, 훈련, 호스팅, 배포에 관여하는 시스템에 2인 통제를 적용할 것을 권고했다. 이 방식을 ‘AI 핵심 인프라 설계를 위한 다자간 승인’이라고 부른다.

Anthropic이 설명한 설계에 따르면 어떤 개인도 운영에 필수적인 환경에 상시 접근할 수 없다. 접근하려는 사람은 동료의 승인과 업무상 사유가 필요하며, 제한된 시간 동안만 권한을 부여받아야 한다. 회사는 대기업 수준의 자원이 없는 신생 AI 연구소도 이러한 통제를 도입할 수 있다고 밝혔다.

Anthropic은 이 조치를 지능형 위협 행위자와 내부자 위험에 대비하기 위한 보호책으로 제시했다. 다만 2인 통제를 제대로 시행하려면 더 폭넓은 사이버보안 관행이 뒷받침돼야 한다고 설명했다.

안전한 모델 개발

Anthropic은 최첨단 모델 환경 전반에 보안 소프트웨어 개발 관행을 적용할 것도 권고했다. SSDF와 SLSA는 모델 개발과 이에 연계된 소프트웨어에 적용할 수 있는 표준으로 꼽았다.

회사는 두 프레임워크를 함께 사용하면 배포된 AI 시스템의 관리 연속성을 확보할 수 있다고 밝혔다. Anthropic은 이를 통해 배포된 모델과 이를 개발한 회사를 연결하고 출처를 확립할 수 있다고 설명했다.

Anthropic은 이러한 결합안을 ‘안전한 모델 개발 프레임워크’라고 부른다. 또 NIST가 표준 제정 절차를 통해 SSDF를 확장해 모델 개발을 명시적으로 포괄하도록 권고했다.

조달과 규제

Anthropic은 정부가 공공계약을 추진하는 AI 기업과 클라우드 제공업체를 대상으로 다자간 승인과 안전한 모델 개발을 조달 요건으로 정할 수 있다고 밝혔다. 이러한 조치는 해당 기업에 적용되는 다른 사이버보안 요건과 함께 시행된다.

회사는 미국 클라우드 제공업체에 영향을 미치는 조달 규정이 광범위한 시장 규제와 유사한 효과를 낼 수 있다고 설명했다. 다수의 최첨단 모델 기업이 이들의 인프라를 이용하기 때문이다. Anthropic은 규제 요건에 앞서 시행할 수 있는 단계로 조달을 제안했다.

Anthropic은 많은 보안 조치를 자발적 협약으로 시작할 수 있다고 밝혔다. 다만 정부가 향후 조달이나 규제 권한을 활용해 준수를 의무화해야 한다고 판단할 수도 있다고 덧붙였다.

민관 협력

Anthropic은 최첨단 AI 연구소가 금융 서비스 등 핵심 인프라 부문의 기업과 같은 방식으로 민관 협력에 참여할 것을 권고했다. 최첨단 AI를 기존 정보기술 부문의 특별 하위 부문으로 지정하는 방안도 제시했다.

Anthropic에 따르면 이러한 지정은 AI 연구소와 정부기관 간 정보 공유와 협력을 확대하는 데 도움이 될 수 있다. 회사는 이 같은 체계가 연구소가 자금과 자원이 풍부한 악의적 사이버 행위자에 대응하는 데 기여할 수 있다고 밝혔다.

출처: 2023년 7월 25일 발표된 Anthropic의 ‘최첨단 모델 보안’ 공지.

자주 묻는 질문

Anthropic은 무엇을 구현하고 있습니까?
Anthropic said it is implementing two-party controls, the NIST Secure Software Development Framework, Supply Chain Levels for Software Artifacts and other cybersecurity practices.
Anthropic이 말하는 이중 통제란 무엇인가?
Anthropic described a design in which no individual has persistent access to production-critical environments. A person must request time-limited access from a coworker and provide a business justification.
Anthropic은 어떤 정부 대책을 권고했습니까?
Anthropic proposed procurement requirements covering AI companies and cloud providers that contract with governments. It said voluntary arrangements could come first, with procurement or regulatory mandates potentially following over time.
Anthropic은 민관 협력을 어떻게 조직할 것을 제안하는가?
Anthropic said frontier AI laboratories should cooperate with governments in a manner similar to critical-infrastructure sectors. It suggested that frontier AI could become a special subsector of the existing information technology sector.

출처

  1. Frontier model security \ AnthropicAnthropic
태그anthropicclaudeai-securitycybersecurityfrontier-modelsai-policy

함께 읽기

앤트로픽, AI 시스템 레드팀 평가 방법 공개

앤트로픽은 전문가 주도형, 자동화형, 다국어·다중모달, 크라우드소싱 및 커뮤니티 기반 시험을 비롯해 AI 시스템을 시험하는 데 활용해 온 여러 방법을 상세히 설명했다. 또한 정성적 조사 결과를 자동화된 평가로 전환하는 방식을 소개하고, 정책 입안자들에게 표준 마련을 위한 자금 지원, 독립 시험 기관 지원, 전문 서비스 인증, 검증된 제3자의 접근 촉진을 촉구했다.

3분 읽기

앤트로픽, 미국 선거 앞두고 클로드 안전장치 공개

앤트로픽은 선거운동과 로비, 허위정보에 대한 제한, 사람의 검토가 뒷받침하는 자동화된 정책 집행, 표적형 레드팀 테스트, 대규모 평가 등 클로드의 선거 관련 오용을 방지하기 위한 조치를 제시했다. 또한 선거 관련 질문에는 최신 투표 정보를 안내하고, 시스템 프롬프트에 클로드의 지식 기준일을 명시한다.

3분 읽기