Skip to content
DigitalNeuron
정책·규제

앤트로픽, 캘리포니아주 SB 53 준수 체계 공개

Anthropic released a framework describing how it assesses and mitigates catastrophic risks from frontier AI models under California’s SB 53.

DigitalNeuron Desk2분 읽기

한 줄 답

캘리포니아주 SB 53에 대한 앤트로픽의 규정 준수 체계는 무엇을 다루는가?

Anthropic published its Frontier Compliance Framework for California’s Transparency in Frontier AI Act. The document describes the company’s approach to evaluating and mitigating catastrophic risks from frontier models, protecting model weights and responding to safety incidents. Anthropic says the framework will support compliance with SB 53 and other regulatory requirements.

핵심 요약

  • Anthropic published its Frontier Compliance Framework to meet a requirement of California’s Transparency in Frontier AI Act.
  • 이 체계는 사이버 공격과 화학·생물학·방사능·핵 위협뿐 아니라 AI를 이용한 사보타주와 통제력 상실 위험도 다룬다.
  • It describes a tiered system for evaluating model capabilities, Anthropic’s mitigation approach, protections for model weights and responses to safety incidents.
  • 앤트로픽은 이 체계가 SB 53과 기타 규제 요건을 준수하기 위한 기반이 될 것이라고 밝혔다.
  • The company’s Responsible Scaling Policy will remain a separate voluntary safety policy.

Anthropic은 최첨단 AI 모델이 초래할 수 있는 재앙적 위험을 평가하고 관리하는 방식을 설명한 ‘최첨단 AI 규정 준수 프레임워크’를 공개했다. 회사는 이 문서를 ‘SB 53’으로 알려진 캘리포니아주의 ‘최첨단 AI 투명성법’과 기타 규제 요건에 대응하기 위한 규정 준수 체계로 활용할 것이라고 밝혔다.

SB 53은 1월 1일부터 시행되며, 최첨단 AI 개발사에 재앙적 위험을 평가하고 관리하는 방식을 설명하는 프레임워크를 공개하도록 의무화한다. Anthropic은 연방 차원의 프레임워크도 지지해 왔지만, 이 법에도 찬성했다고 밝혔다.

적용 대상 위험과 안전장치

최첨단 AI 규정 준수 프레임워크는 사이버 공격, 화학·생물학·방사선·핵 위협, AI 사보타주, 통제력 상실 위험을 다룬다. Anthropic은 자사의 최첨단 모델에 이러한 위험 범주를 적용한다고 밝혔다.

이 문서는 해당 위험 범주를 기준으로 모델의 역량을 평가하는 Anthropic의 단계별 체계를 소개하고, 위험 완화 조치에 대한 회사의 접근법도 설명한다. 모델 가중치 보호와 안전사고 대응 절차도 포함한다.

Anthropic은 프레임워크에 담긴 관행 중 상당수가 회사가 수년간 시행해 온 조치에서 발전한 것이라고 밝혔다. 2023년 도입된 ‘책임 있는 확장 정책’은 고도화된 AI 시스템의 극단적 위험에 대응하는 회사의 접근법을 규정하며, 모델 개발과 배포에 관한 의사결정의 토대가 돼 왔다. 회사는 신규 모델의 역량과 안전성 평가, 위험 평가를 설명하는 시스템 카드도 공개하고 있다.

Anthropic은 최첨단 AI 규정 준수 프레임워크와 책임 있는 확장 정책이 서로 다른 역할을 맡게 될 것이라고 밝혔다. 규정 준수 프레임워크는 SB 53과 기타 규제 요건에 대응한다. 책임 있는 확장 정책은 Anthropic이 적절하다고 판단하는 관행을 반영한 자발적 안전 정책으로 계속 유지되며, 여기에는 규제 요건을 넘어가거나 이와 다른 관행도 포함된다.

연방 차원의 제안

Anthropic은 연방 차원의 AI 투명성 프레임워크를 마련해야 한다는 입장도 거듭 밝혔다. 회사는 올해 초 구체적인 기술적 방식을 획일적으로 규정하지 않으면서 안전 관행을 대중에게 공개하는 데 초점을 둔 연방법 제정안을 제안했다고 설명했다.

이 제안은 적용 대상 개발사에 중대한 위험을 평가하고 완화하는 방식을 설명하는 안전한 개발 프레임워크를 공개하도록 의무화한다. 해당 위험에는 화학·생물학·방사선·핵 관련 피해뿐 아니라 모델 자율성이 인간의 의도와 어긋나 발생하는 피해도 포함된다.

Anthropic의 제안은 모델을 배포할 때 개발사가 시스템 카드를 공개하도록 의무화하는 내용도 담고 있다. 관련 문서에는 시험과 평가 절차, 결과, 위험 완화 조치가 요약되며, 모델을 대폭 수정한 뒤에는 이를 갱신해야 한다.

회사는 위반 가능성에 우려를 제기하는 직원을 명시적으로 법적 보호 대상에 포함해야 한다고 제안했다. 연구소가 프레임워크 준수 여부를 허위로 표시하거나 내부 고발자에게 불이익을 주는 행위를 법으로 금지해야 한다고 밝혔다.

Anthropic은 AI 개발 환경과 업계의 합의된 관행이 변화함에 따라 유연하게 조정할 수 있는 최소한의 투명성 기준도 요구했다. 재앙적 피해 위험이 낮은 모델을 만드는 소규모 개발사가 아니라, 최고 수준의 성능을 갖춘 모델을 개발하는 기존 최첨단 AI 개발사에만 해당 요건을 적용해야 한다고 밝혔다.

출처: 2025년 12월 19일 발표된 Anthropic의 공지, “캘리포니아 ‘최첨단 AI 투명성법’ 대응을 위한 규정 준수 프레임워크 공개”

자주 묻는 질문

Anthropic의 프런티어 규정 준수 프레임워크란 무엇인가?
It is Anthropic’s public framework describing how the company assesses and manages catastrophic risks associated with its frontier models.
이 프레임워크는 어떤 위험을 다루나요?
Anthropic says it covers cyber offense; chemical, biological, radiological and nuclear threats; AI sabotage; and loss of control.
Does the framework replace Anthropic’s Responsible Scaling Policy?
No. Anthropic says the Frontier Compliance Framework will address regulatory compliance, while the Responsible Scaling Policy will remain its voluntary safety policy.
What federal requirements does Anthropic support?
Anthropic proposes public secure development frameworks, system cards at deployment, whistleblower protections, flexible transparency standards and requirements limited to the largest model developers.

출처

  1. Our compliance framework for California's SB 53 \ AnthropicAnthropic
태그anthropicclaudesb-53californiaai-safetytransparency

함께 읽기

앤트로픽, EU AI법 준수 위해 Claude에 텍스트 워터마크 도입

앤트로픽은 향후 Claude 모델이 SynthID-Text라는 방식을 사용해, 발생 확률이 비슷한 단어들 가운데 하나를 선택하는 방법을 바꿈으로써 생성된 텍스트에 워터마크를 삽입할 것이라고 밝혔다. 회사 측은 이 워터마크를 독자가 알아챌 수 없고 비용이나 지연이 추가되지 않으며, 사용자나 조직, 채팅을 식별할 수 있는 어떠한 정보도 담지 않는다고 설명했다.

3분 읽기

앤스로픽, '경제 미래 프로그램' 영국·유럽으로 확대

앤스로픽은 '경제 미래 프로그램'을 영국과 유럽으로 확대해, 자격을 갖춘 연구자에게 연구 보조금과 클로드 크레딧을 지원하고, 런던정경대학교(LSE)와 함께 정책 포럼을 개최하며, 앤스로픽 경제 지수를 통해 보다 상세한 지역별 데이터를 정기적으로 공개할 계획이라고 밝혔다.

2분 읽기

Anthropic, 사이버 및 정치, 고위험 사용에 대한 Claude 정책 업데이트

Anthropic은 악의적인 컴퓨터 및 네트워크 침해를 금지하고, 정치 콘텐츠에 대한 제한을 좁히고, 기존 법 집행 규칙을 명확히 하고, 고위험 보호 조치를 소비자 대상 출력으로 제한하도록 Claude 사용 정책을 업데이트했습니다. 회사는 개정된 정책이 2025년 9월 15일에 발효될 것이라고 밝혔습니다.

3분 읽기