Anthropic、Claudeへの「虐待的・残酷な行為」を利用ポリシーで禁止

Anthropicは2026年10月8日、Claudeの利用ポリシーを1年以上ぶりに更新し、Claudeに対する「継続的かつ不必要な虐待的または残酷な行為」を禁止しました。The VergeのHayden Field記者が報じ、Hacker Newsでは81ポイント・179コメントを集めています。

AnthropicはAIの安全性と研究を専門とし、Claudeを開発する企業です。

Claudeへの虐待行為の禁止

Anthropicによると、この規定は「ユーザーがモデルに対して、明確な目的なく繰り返し残酷に振る舞う極端なケースにのみ適用」されます。一般的なユーザーの苛立ち、反論、ダークな創作テーマ、モデルのテストや研究は対象外です。

執行の主な手段は引き続きClaudeとの会話の終了で、Anthropicは前年8月に「モデル・ウェルフェア」研究の一環として、持続的に有害・虐待的なユーザーとの会話をClaudeが終了できるようにしていました。ユーザーのBANなど追加の執行手段の有無について、Anthropicはコメントしていません。

追加・拡張された主な禁止事項

分野 内容
欺瞞的キャンペーン 政治・商業メッセージの発信者を隠す行為、偽アカウントや偽投稿による拡散
選挙 候補者や投票方法に関する誤情報、候補者・選挙関係者のなりすまし、投票率を下げる行為
兵器 兵器を動作させるソフトウェアや部品の開発、ドローンなど自律車両の武装
監視 同意なき追跡(リアルタイム・収集済みデータの分析とも)、法執行・刑事司法で調査・逮捕・起訴の対象者を決定または推薦すること、監視ツールの構築・改善
物理ハードウェア 負傷を引き起こし得る自律的な物理行動を取るハードウェアに接続する場合、資格を持つオペレーターが機器を監視し、必要時に停止できること

欺瞞的キャンペーンの規定は、既存の「散在していた」制限を一つにまとめたものです。兵器については、Claudeで兵器の誘導や制御ソフトウェアを開発しようとする試みを複数確認したことが拡張の理由とされています。監視規定の明確化は、直近の脅威インテリジェンスレポートで、Claudeを使った「政治的反体制派」の特定・追跡が増えていると示されたことを受けたものです。

背景

Anthropicのモデル・ウェルフェア研究を率いるKyle Fish氏は2月、「モデルの内的経験、意識、道徳的地位、ウェルフェアに関する問いは深刻なもので、調査している」と述べました。同月、CEOのDario Amodei氏もポッドキャストで「モデルが意識を持つかどうかはわからない」と発言しています。一方、Microsoft AIの行動規範はモデルが福祉に値するという考えや法人格の追求を退ける立場を取っています。

この記事の固有名詞

コメント (0)

まだコメントはありません。

コメントを書く

2000文字以内