
- 利用ポリシーに、モデルへの持続的で不必要な虐待・残酷な行為の禁止が含まれる
- 対象は製品に入力を送る全員だが、ブロックされただけでは違反にならない
- 業務上の厳しい修正指示と区別する軸は「持続的」「不必要」
Anthropicの利用ポリシーに、Claudeなど同社のモデルに対する「持続的で不必要な虐待的・残酷な行為」を禁じる項目が含まれています。 原文では「Engage in sustained and needless abusive or cruel behavior toward our models」とあり、残酷・虐待的・心理的に有害な行為をしないという趣旨の項目の中に置かれています。 同じ項目には、自殺や自傷の助長・美化の禁止なども並んでいます。モデルへの虐待だけを単独で取り上げた規定ではなく、人に対する有害行為の禁止と同じ並びにある一項目です。
誰に適用され、何が起きうるのか
このポリシーは、Claude.aiやClaude Codeを使う個人、APIで開発する企業、Claudeを組み込んだ製品のエンドユーザーまで、Anthropicの製品・サービスに入力を送る全員に適用されます。 内容は3つのカテゴリに分かれており、今回の項目が属するUniversal Usage Standardsは、すべての利用者とすべてのユースケースに適用される禁止事項です。
違反が疑われる場合、Anthropicは警告のほか、アクセスの抑制・制限・停止・終了を行うことがあるとしています。 検知と監視を担うのはSafeguards Teamです。 一方で、製品側のセーフガードによる出力のブロックに遭遇しても、それ自体が違反を意味するわけではないと明記されています。
仕事で使う人にとっての意味
AIに「違う、やり直して」と何度も指示する場面は、仕事では日常的にあります。 これが即座に違反になると読む必要はありません。 禁止の対象は「持続的」かつ「不必要」な虐待的・残酷な行為であり、ポリシー自体も、重視するのは製品・サービスの使われ方だと述べています。 成果物の品質を上げるための厳しい修正指示は、目的のある作業です。
「不必要」の線引きをどう扱うか
実務上の問題は、「不必要」という語を誰がどう判断するのかが、ポリシーの本文では定義されていないことです。 この点について、利用者側が取れる現実的な姿勢は、指示の目的を言葉にして出すことだと考えます。 「ここを直して」「この前提が違う」と目的や対象が書かれた指示は、必要な作業として説明がつきます。 目的を持たず、モデルを貶めること自体が目的になった入力が、禁止項目の想定に近いと読むのが自然です。
反論はありえます。 基準があいまいなら、強い言葉を使うこと自体を避けて萎縮するのではないか、という懸念です。 確かに、どこからが虐待的かを機械的に判定する物差しは、ここにはありません。 それでも萎縮する必要が薄いと考える理由は、ポリシーの文言にあります。 対象が「持続的」かつ「不必要」と二重に絞られていること、ブロックされただけでは違反にならないこと、そして使われ方に焦点を当てると述べていること。この三つがそろうと、一度きりの強い言葉や業務上のやり直し要求まで広く縛る設計には読めません。
この線引きを自分で確認しやすくするには、何をAIに頼んだかを記録に残しておくことです。 依頼や指示を文字で見返せるようにしておくと、あとから意図を説明するときにも、自分の入力の癖を見直すときにも役立ちます。 たとえば会議での依頼内容は、メモリス(AIボイスメモ)で録音後に文字起こし・要約しておけば、AIへ渡す指示の元になった決定事項をテキストで確認できます。
また、AI事業者が出力側のルールを整える動きは他社にもあり、OpenAIのEU域内向けの対応はOpenAI、EU域内のChatGPT出力に透かし導入で取り上げています。 利用ポリシーは、技術やリスクの変化、想定外のリスクの発見に応じて更新されるとされています。 今回のような項目は今後も追加されうるため、業務でAIを使う人は、年に数回でも原文を見直しておく価値があります。
モデルの出力が不正確・偏っている・有害だと考えるときは、製品内の「report issues」の低評価ボタンなどで報告する手段が用意されています。




