Skip to content
安全・倫理

アンソロピック、米大統領選を前にClaudeの安全対策を公表

アンソロピックは、Claudeが選挙関連の不正利用に使われることを防ぐための方針、取り締まり体制、テスト、投票情報への誘導策を明らかにした。

DigitalNeuron Desk約1分

ひとことで言うと

アンソロピックはClaudeについてどのような選挙関連の安全対策を発表したか。

アンソロピックは、Claudeが選挙関連の不正利用に使われることを防ぐための対策を明らかにした。選挙運動やロビー活動、誤情報の流布を禁じる利用制限のほか、人による審査を伴う自動的な取り締まり、標的を絞ったレッドチーム演習、大規模な評価を実施しているという。同社はまた、選挙関連の質問については最新の投票情報へ誘導し、システムプロンプトにClaudeの知識の基準日を明示している。

要点

  • アンソロピックは、自社製品を政治運動やロビー活動、標的を絞った政治運動、投票の呼びかけ、政治資金集めに利用することを禁じている。
  • 同社は、選挙関連の不正利用への対応として、自動的な取り締まりと人による審査を組み合わせ、極端な場合にはアカウントを停止していると説明する。
  • アンソロピックは、選挙に関する誤情報や政治的公平性、有害な質問への拒否対応、有権者プロファイリングの手口についてClaudeをテストしている。
  • 投票情報を求めるClaudeの利用者には、超党派の情報源であるデモクラシー・ワークス提供の「ターボボート」への訪問を選ぶ選択肢が示されることがある。

アンソロピックは、2024年11月5日に米国で実施される連邦・州・地方選挙を前に、Claudeが選挙関連の不正利用に使われることを防ぐための方針、技術的な管理策、テストの内容を明らかにした。

同社は2023年7月以降、自社ツールの不正利用の可能性を検知・軽減し、利用者を信頼できる選挙情報へ誘導するための取り組みを続けてきたとしている。今回の発表では、こうした取り組みが、方針上の制限、取り締まりの実務、評価、投票情報への誘導策としてまとめられた。

政治利用への制限

アンソロピックによると、5月に更新した利用ポリシーで、選挙・投票をめぐる禁止事項を明確化した。同社は製品の政治運動やロビー活動への利用を禁じており、この方針の下でClaudeは、候補者や政党、争点を後押しすること、標的を絞った政治運動を行うこと、投票を呼びかけること、政治資金の提供を募ることに使うことができない。

この方針では、選挙法や候補者などに関する誤情報の生成も禁止されている。アンソロピックは、投票機を狙った攻撃や、開票・認証の妨害にClaudeを使うことも認めていないとした。

Claudeが生成するのは画像や音声、動画ではなくテキストのみである。アンソロピックは、この特性により同製品を通じた選挙関連のディープフェイク生成のリスクはなくなると説明している。

取り締まりとテスト

アンソロピックは、方針の順守を徹底するために自動化されたシステムを導入し、そのシステムを人による審査で点検していると説明する。具体的には、claude.ai上でのプロンプトの修正、自社API利用事例の監査、そして極端な場合にはアカウントの停止といった手法を用いているという。

同社はまた、アマゾン ウェブ サービス(AWS)やグーグル クラウド プラットフォーム(GCP)経由でアンソロピックのモデルを利用する利用者について、選挙関連の被害を特定・軽減するため、両社と連携しているとした。

アンソロピックによれば、選挙関連のプロンプトに焦点を当てた標的型レッドチーム演習を定期的に実施している。さらに、外部の専門家と共同で実施する「ポリシー脆弱性テスト」を用い、誤情報やバイアス、悪意ある利用への耐性を検証している。このプロセスには、関連する質問の選定、モデルの応答の記録、有害な要求の拒否など安全対策上の介入が発生したかどうかの記録が含まれるという。

アンソロピックによると、自動化された評価によってシステムを大規模に検証している。このテストでは、候補者や論点をまたいだ政治的公平性、有害な選挙関連の質問への拒否対応、誤情報や有権者プロファイリングの手口への耐性を調べている。同社は、こうした取り組みで得られた知見を、方針や取り締まり体制、モデル自体の見直しに反映させているとした。

投票情報と透明性

アンソロピックは、自社モデルはリアルタイムの選挙情報を提供できるほど頻繁に訓練し直されているわけではないとしている。そのため、選挙関連の質問に対しては、利用者を最新かつ信頼できる投票情報へ誘導しているという。

Claudeでは、投票情報を求める利用者に対し、ポップアップで超党派の情報源であるデモクラシー・ワークス提供の「ターボボート」への訪問を選択できるようにしている。アンソロピックによると、ターボボートには最近、連邦選挙・州選挙に立候補する候補者名や住民投票の議案が追加されたという。

同社はまた、Claudeのシステムプロンプトを更新し、知識の基準日を明示するようにした。アンソロピックは、選挙関連の取り組みで用いた自動評価の一部を公開したほか、AIの能力とリスクに関する第三者評価に資金を提供する取り組みも開始したとしている。

アンソロピックによれば、この一年を通じて政策立案者や市民社会団体、業界関係者と会合を重ね、米国の投票日を前に選挙関連の不正利用が起きた場合を想定したシナリオ計画も行ったという。

出典:アンソロピック「米国選挙への備え」発表、2024年10月8日公開。

よくある質問

Claudeを政治運動に利用することはできるか。
アンソロピックによると、同社の方針では製品を政治運動やロビー活動に利用することを禁じている。この制限には、候補者や政党、争点を後押しすること、標的を絞った政治運動、投票の呼びかけ、政治資金提供の依頼が含まれる。
アンソロピックは選挙関連の不正利用をどのように監視しているか。
同社は、自動的な取り締まりと人による審査を組み合わせていると説明する。具体的には、claude.ai上でのプロンプトの修正、自社API利用事例の監査、そして極端な場合にはアカウントの停止といった手法を用いている。
アンソロピックは選挙関連の安全対策をどのようにテストしているか。
アンソロピックによると、標的を絞ったレッドチーム演習に加え、外部の専門家と共同で実施する「ポリシー脆弱性テスト」、そして選挙関連の複数のリスクを対象とした自動評価を行っているという。
Claudeは投票情報を求める利用者をどこへ誘導するのか。
アンソロピックは、超党派の情報源であるデモクラシー・ワークス提供の「ターボボート」へ利用者を誘導するポップアップを導入した。同社によれば、ターボボートは連邦選挙・州選挙の候補者名や住民投票の議案を反映して更新されているという。

出典

  1. U.S. elections readiness \ AnthropicAnthropic
タグanthropicclaudeelectionsai-safetymisinformationusage-policy

あわせて読みたい

Anthropic、AIによる被害を評価する枠組みの詳細を公表

Anthropicは、AIがもたらしうる害を身体的、心理的、経済的、社会的、個人の自律性という5つの側面から評価する枠組みを開発したと発表した。同社によると、この枠組みは責任あるスケーリングポリシー(Responsible Scaling Policy)と併用され、利用ポリシーや各種評価、検知の取り組み、そしてコンピュータ操作機能やClaude 3.7 Sonnetを含む執行措置に反映されるという。

約3分

Anthropic、500万ドル規模のAIウェルビーイング研究助成プログラムを開始

Anthropicは、AIがユーザーのウェルビーイングに与える影響に関する独立研究を対象とした500万ドルの助成プログラムを開始しました。採択された助成対象者は、オープンソースの評価手法を独立して開発する一方で、直接的な資金提供、Anthropicのモデルへのアクセス、技術支援を受けます。応募締切は9月21日で、10月5日までに正式提案への招待が行われる予定です。

約3分