出来事の日付:2026年10月11日。
AnthropicはAIモデル「Claude」の利用規則を改定し、兵器、監視、政治的な影響力の行使、安全性が極めて重要な機器を対象とする幅広い変更に加え、このソフトウェアに対する継続的で目的のない残虐行為を禁止する条項を設けた。改定後のポリシーは2026年11月12日に施行される予定だ。
同社は、残虐行為に関する条項について、明確な目的が見いだせない極端かつ反復的な行為を対象とする限定的な規則だと説明している。通常のいら立ちや意見の相違、陰鬱な創作内容、モデルのテストや研究は制限の対象外だという。一部の虐待的な会話を終了できるClaudeの既存機能が、引き続き主な対応手段になる見込みだ。Anthropicは「モデルの福祉に関する研究」と呼ぶ取り組みの一環として、2025年8月に一部のモデルのバージョンにこの仕組みを導入した。
チャットボットが苦痛を経験するという確立された証拠はないため、この区別は重要だ。このポリシーは、機械の意識に関する問いに結論を出すことなく、システムに対する利用者の行動を規定している。提供された報道も、会話の終了がアカウントへの制裁につながる可能性があるのかを説明しておらず、Claudeが会話終了機能をどの程度の頻度で使ったかも明らかにしていない。
ほかの条項は、より差し迫った安全上のリスクに対応する。Anthropicは、兵器に関する制限が完成した兵器だけでなく、ソフトウェアや部品も対象とすることを明確にした。報道によると、この明確化は、武装ドローンや自律走行車に関わる誘導・制御の作業にClaudeを利用しようとする動きを受けたものだ。
監視に関する規則では、警察が誰を捜査、逮捕、訴追すべきかを判断するためにClaudeを使うことを禁止する。また、監視ツールの構築や、本人の同意を得ずに人を追跡することも禁止しており、追跡がリアルタイムで行われるか事後に行われるかは問わない。Anthropicは、これらの改定の一部を、既存の制限をより明確に表現したものと位置付けている。
政治利用の規則も変更された。同社は、個人に合わせた政治的ターゲティングを広く禁止する規定について、非営利団体による有権者向け情報の翻訳など、正当な活動まで対象になり得ると判断し、これを削除した。欺瞞的なターゲティングや個人データの悪用は引き続き禁止される。これとは別に、欺瞞的なキャンペーンや人為的に作り出された活動を対象とする制限も設けられた。Anthropicは、国営メディア、政府のプロパガンダ活動、営利団体がClaudeを使い、偽アカウントや捏造ニュースのサイトを運営しているのを確認したと述べている。
Claudeに接続され、人にけがをさせる可能性がある物理的な機器については、システムを監視し停止できる、適切な資格や能力を持つ人間の操作者を置くことがポリシーで求められる。AIとの接続が失われた場合、機器は安全な状態へ移行するか、その状態を維持しなければならない。これらの条項は、言語モデルの出力を、安全性を自律的に判断する最終的な権限としてではなく、人が監督するシステムの一構成要素として扱っている。
残虐行為に関する条項は、ソフトウェアに社会的な言葉遣いを適用するため、注目を集めそうだ。ただし運用面では、能力を増しつつあるモデルが、兵器、公的な意思決定、世論工作、物理的な機械とどのようにつながり得るかに焦点を当てた、より広範なポリシー更新の一部にすぎない。規則の執行の詳細や現実の事案の発生率は、引き続き重要な未解決の問題となっている。



