[ITmedia News] Anthropic、Claudeへの“虐待”を利用ポリシーで禁止 影響工作の規定も集約
米Anthropicは10月8日(現地時間)、AIモデル「Claude」の「Usage Policy」(利用ポリシー)の改定版を公開した。11月12日に発効する。同社は毎年ポリシーを更新しており、今回の変更の大半は既存ルールの明確化が目的。この1年でClaudeがより長く自律的な作業を担うようになったことを受けて新たな機能への適用例を追加したほか、9月に公開した脅威インテリジェンスリポートで報告した、影響工作や兵器開発、監視における新たな悪用パターンも反映した。
新たな規定として、AIモデルに対し継続的かつ不必要に虐待的または残酷な振る舞いをすることを禁止した。ただし対象は、明確な目的なく繰り返しモデルに残酷な振る舞いをする極端なケースに限り、一般的な不満の表明や反論、ダークな創作テーマ、モデルのテストや研究には適用しないとしている。同社は既に「Claude.ai」と「Claude Code」で、虐待を続けるユーザーとの会話をClaudeが終了できるようにしており、今回の規定はこれに沿った形だ。この会話終了機能が引き続き主な執行手段になるという。
「Do Not Engage in Cruel, Abusive, or Psychologically Harmful Conduct」
このほか、欺瞞的な活動に関する項目を新設した。国営メディアや政府のプロパガンダ機関、民間企業がClaudeを使い、偽アカウントのネットワークや捏造したニュースサイトを運営する事例が確認されているという。こうした行為は従来も禁止していたが、関連規定が選挙、詐欺、プライバシー、偽情報の各項目に分散していた。新項目「Do Not Engage in Deceptive Campaigns or Artificial Activity」(欺瞞的なキャンペーンや人為的な活動に関与しない)にこれらを集約し、政治目的か商業目的かを問わず適用する。発信元を隠す行為や偽アカウントによる拡散に加え、影響工作のためのツールやインフラの構築も対象とした。これに合わせ、選挙に関する項目は有権者を欺いたり選挙を妨害したりする行為の禁止に絞り込んだ。
兵器と監視に関する規定も明確化した。兵器を機能させるソフトウェアや部品、ドローンなどへの武装搭載が禁止対象に含まれることを明記したほか、本人の同意のない追跡や、法執行の過程で捜査や逮捕の対象を決定・推奨する用途の禁止をより具体的に記した。同社は、いずれも実際の執行内容を変えるものではなく、従来の運用を明文化したものとしている。
健康や法的権利、金融などに影響する「高リスク」な用途では、AIの提案を確認・修正する権限を持つ有資格者の介在と、影響を受ける本人へのAI利用の告知を求めている。この要件自体は変わらないが、自分の用途が該当するかどうかの問い合わせが多かったことから、法務、医療、金融、雇用など11分野について対象となる行為と対象外の行為を具体的に列挙した。また、8月に発表したAIで物理機器を制御する共通規格「Model Hardware Standard」(MHS)を踏まえ、負傷を引き起こし得る機器を自律的に操作させる場合の要件を追加した。有資格の操作者が機器を監視・停止できることや、Claudeとの接続が切れても機器が安全な状態を保てることなどを求める。
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.