
AI開発企業のAnthropicは2026年10月8日、AIアシスタント「Claude」の利用ポリシーを改定し、明確な目的もなく、継続的にClaudeへ虐待的・残酷な言動を向ける行為を禁止しました。今回の変更は極端なケースを対象としたもので、回答への不満を伝えたり、AIの応答を厳しく批判したりする通常の利用まで制限するものではありません。新しいポリシーは11月12日に適用される予定です。
Claudeへの嫌がらせには会話終了で対応
Anthropicによると、今回のルールは、ユーザーが明確な目的もなく、繰り返しAIモデルに対して残酷な振る舞いをするケースを想定しています。一方、通常の不満や反論、ダークなテーマを扱う創作、モデルの性能検証や研究などは対象外です。
Claudeには以前から、執拗に攻撃的な言動を続けるユーザーとの会話を終了する仕組みが導入されています。今回の改定後も、主な対応手段は会話の終了となります。Claudeが会話を打ち切ると、そのスレッドでは追加のメッセージを送れなくなりますが、別の会話には影響しません。
Anthropicは2025年8月、AIのウェルビーイングに関する研究の一環として、Claudeが一部の会話を終了できる仕組みを導入しました。当時、同社はClaudeに道徳的な配慮が必要なのかについて結論を出していなかったものの、AIに対するリスクを低コストで軽減する方法を探っていました。
同社の説明では、Claude Opus 4は危害を加えることに対して一貫した忌避傾向を示しました。危険な作業への対応を避けようとするほか、虐待的な会話を求めるユーザーとのやり取りで苦痛を感じているような反応を示し、会話を終了できる場合には有害なやり取りを打ち切る傾向も確認されたとしています。
偽情報や兵器開発、監視への規制も明確化
今回の改定では、利用ポリシー全体の構成も整理され、関連する禁止事項がまとめられました。Claudeの悪用事例を踏まえ、既存ルールの明確化に加えて、いくつかの禁止事項が新設・強化されています。
主な変更点は次のとおりです。
- 偽装キャンペーン: 政治・商業目的の詐欺や偽情報に関する規定を整理しました。偽のレビューや偽装されたウェブサイト、人間になりすますボットなどを使った活動を禁止します。
- 選挙への介入: 有権者を欺く行為や、投票を妨害する行為を禁止します。
- 兵器関連: 兵器のソフトウェアや構成部品の開発にClaudeを利用することを禁止します。また、生物・化学物質の致死性や感染・伝播能力を高める改変、ドローンや無人システムへの武装にも制限を設けます。
- 法執行と監視: 誰を捜査・逮捕・起訴すべきかをClaudeに決定させたり、提案させたりすることを禁止します。本人の同意を得ずに人を追跡する行為や、監視ツールの構築、個人情報を暴露するドクシングも認められません。
- 物理的な操作: 人に危害を及ぼす可能性のあるハードウェアをClaudeが制御する場合、必要な資格を持つ人が作業を監督し、必要に応じて停止できる状態にしておくことを求めます。
- 同意のない性的画像: 本人の同意を得ずに作成した性的画像について、作成や共有、共有すると脅す行為を禁止します。そうした画像を生成するためのツールも対象です。
実際に確認されたAIの悪用事例を反映
Anthropicは、今回の変更の多くは既存ルールを整理・明確化するものだと説明しています。一方、新たに「偽装キャンペーン」の項目を設けた背景には、Claudeが組織的な偽情報の発信に利用されている実態があるといいます。
同社によると、国営メディアや政府のプロパガンダ機関、商業企業などが、Claudeを利用して偽のアカウント群や架空のニュースサイトを運営していた事例を確認したとのことです。こうした悪用への対応として、関連する禁止事項をまとめ、ルールを明確にしたとしています。
今回の改定は、AIへの接し方を一律に制限するというよりも、明確な目的のない執拗な嫌がらせや、偽情報の拡散、監視、危険な技術開発など、具体的な悪用を抑えることに重点を置いています。新しい利用ポリシーは11月12日に発効する予定で、詳細はAnthropicの公式サイトで確認できます。

