앤트로픽, 캘리포니아주 SB 53 준수 체계 공개
Anthropic released a framework describing how it assesses and mitigates catastrophic risks from frontier AI models under California’s SB 53.
한 줄 답
캘리포니아주 SB 53에 대한 앤트로픽의 규정 준수 체계는 무엇을 다루는가?
Anthropic published its Frontier Compliance Framework for California’s Transparency in Frontier AI Act. The document describes the company’s approach to evaluating and mitigating catastrophic risks from frontier models, protecting model weights and responding to safety incidents. Anthropic says the framework will support compliance with SB 53 and other regulatory requirements.
핵심 요약
- Anthropic published its Frontier Compliance Framework to meet a requirement of California’s Transparency in Frontier AI Act.
- 이 체계는 사이버 공격과 화학·생물학·방사능·핵 위협뿐 아니라 AI를 이용한 사보타주와 통제력 상실 위험도 다룬다.
- It describes a tiered system for evaluating model capabilities, Anthropic’s mitigation approach, protections for model weights and responses to safety incidents.
- 앤트로픽은 이 체계가 SB 53과 기타 규제 요건을 준수하기 위한 기반이 될 것이라고 밝혔다.
- The company’s Responsible Scaling Policy will remain a separate voluntary safety policy.
Anthropic은 최첨단 AI 모델이 초래할 수 있는 재앙적 위험을 평가하고 관리하는 방식을 설명한 ‘최첨단 AI 규정 준수 프레임워크’를 공개했다. 회사는 이 문서를 ‘SB 53’으로 알려진 캘리포니아주의 ‘최첨단 AI 투명성법’과 기타 규제 요건에 대응하기 위한 규정 준수 체계로 활용할 것이라고 밝혔다.
SB 53은 1월 1일부터 시행되며, 최첨단 AI 개발사에 재앙적 위험을 평가하고 관리하는 방식을 설명하는 프레임워크를 공개하도록 의무화한다. Anthropic은 연방 차원의 프레임워크도 지지해 왔지만, 이 법에도 찬성했다고 밝혔다.
적용 대상 위험과 안전장치
최첨단 AI 규정 준수 프레임워크는 사이버 공격, 화학·생물학·방사선·핵 위협, AI 사보타주, 통제력 상실 위험을 다룬다. Anthropic은 자사의 최첨단 모델에 이러한 위험 범주를 적용한다고 밝혔다.
이 문서는 해당 위험 범주를 기준으로 모델의 역량을 평가하는 Anthropic의 단계별 체계를 소개하고, 위험 완화 조치에 대한 회사의 접근법도 설명한다. 모델 가중치 보호와 안전사고 대응 절차도 포함한다.
Anthropic은 프레임워크에 담긴 관행 중 상당수가 회사가 수년간 시행해 온 조치에서 발전한 것이라고 밝혔다. 2023년 도입된 ‘책임 있는 확장 정책’은 고도화된 AI 시스템의 극단적 위험에 대응하는 회사의 접근법을 규정하며, 모델 개발과 배포에 관한 의사결정의 토대가 돼 왔다. 회사는 신규 모델의 역량과 안전성 평가, 위험 평가를 설명하는 시스템 카드도 공개하고 있다.
Anthropic은 최첨단 AI 규정 준수 프레임워크와 책임 있는 확장 정책이 서로 다른 역할을 맡게 될 것이라고 밝혔다. 규정 준수 프레임워크는 SB 53과 기타 규제 요건에 대응한다. 책임 있는 확장 정책은 Anthropic이 적절하다고 판단하는 관행을 반영한 자발적 안전 정책으로 계속 유지되며, 여기에는 규제 요건을 넘어가거나 이와 다른 관행도 포함된다.
연방 차원의 제안
Anthropic은 연방 차원의 AI 투명성 프레임워크를 마련해야 한다는 입장도 거듭 밝혔다. 회사는 올해 초 구체적인 기술적 방식을 획일적으로 규정하지 않으면서 안전 관행을 대중에게 공개하는 데 초점을 둔 연방법 제정안을 제안했다고 설명했다.
이 제안은 적용 대상 개발사에 중대한 위험을 평가하고 완화하는 방식을 설명하는 안전한 개발 프레임워크를 공개하도록 의무화한다. 해당 위험에는 화학·생물학·방사선·핵 관련 피해뿐 아니라 모델 자율성이 인간의 의도와 어긋나 발생하는 피해도 포함된다.
Anthropic의 제안은 모델을 배포할 때 개발사가 시스템 카드를 공개하도록 의무화하는 내용도 담고 있다. 관련 문서에는 시험과 평가 절차, 결과, 위험 완화 조치가 요약되며, 모델을 대폭 수정한 뒤에는 이를 갱신해야 한다.
회사는 위반 가능성에 우려를 제기하는 직원을 명시적으로 법적 보호 대상에 포함해야 한다고 제안했다. 연구소가 프레임워크 준수 여부를 허위로 표시하거나 내부 고발자에게 불이익을 주는 행위를 법으로 금지해야 한다고 밝혔다.
Anthropic은 AI 개발 환경과 업계의 합의된 관행이 변화함에 따라 유연하게 조정할 수 있는 최소한의 투명성 기준도 요구했다. 재앙적 피해 위험이 낮은 모델을 만드는 소규모 개발사가 아니라, 최고 수준의 성능을 갖춘 모델을 개발하는 기존 최첨단 AI 개발사에만 해당 요건을 적용해야 한다고 밝혔다.
출처: 2025년 12월 19일 발표된 Anthropic의 공지, “캘리포니아 ‘최첨단 AI 투명성법’ 대응을 위한 규정 준수 프레임워크 공개”
자주 묻는 질문
- Anthropic의 프런티어 규정 준수 프레임워크란 무엇인가?
- It is Anthropic’s public framework describing how the company assesses and manages catastrophic risks associated with its frontier models.
- 이 프레임워크는 어떤 위험을 다루나요?
- Anthropic says it covers cyber offense; chemical, biological, radiological and nuclear threats; AI sabotage; and loss of control.
- Does the framework replace Anthropic’s Responsible Scaling Policy?
- No. Anthropic says the Frontier Compliance Framework will address regulatory compliance, while the Responsible Scaling Policy will remain its voluntary safety policy.
- What federal requirements does Anthropic support?
- Anthropic proposes public secure development frameworks, system cards at deployment, whistleblower protections, flexible transparency standards and requirements limited to the largest model developers.