Litmus — 話題のニュースを、深く読み解く。 RSS
AI

Claudeとの会話、終了の基準をAnthropicが規約で明文化

Anthropicが2026年10月8日、Claudeへの持続的な虐待行為を禁止する条項を利用規約に追加した。11月12日施行。通常の反論や創作、研究は対象外と線引きされ、読者は自分の使い方が当たらないと確認できる。

暗い部屋でノートパソコンのキーボードを打つ手元を撮った写真

イメージ写真 記事の内容を撮影したものではありません。Photo by Sora Shimazaki on Pexels

この記事には Amazon アソシエイトのリンクを含みます。

Claudeに同じ指示を繰り返しても伝わらず、つい強い言葉で返したことがある人もいるはずだ。そのやり取りの途中で、チャットが「これ以上メッセージを送信できません」という状態になったら、理由が分からず戸惑うだろう。Anthropicは2026年10月8日(米国時間)、利用規約(Usage Policy)の更新を発表した。11月12日から、Claudeへの持続的な虐待行為を禁止する条項が正式に加わる。対象は限定的で、ふだんのやり取りで引っかかる話ではない。

なぜ会話が終わることがあるのか

今回の規約更新で追加されたのは、Usage Policyの「Do Not Engage in Cruel, Abusive, or Psychologically Harmful Conduct」という項目だ。この条項は、モデルに対する持続的かつ不必要な虐待的・残酷な行為を禁止すると定めている。Anthropicはこの条項について、目的もなく残酷な行為を繰り返す、極端なケースだけを想定していると説明している。

この条項が指しているのは、チャットが途中で打ち切られるという、読者もすでに経験しているかもしれない挙動だ。Claudeとの会話が急に送信できなくなったなら、その根拠はこの条項にある。では、どこからが「虐待的」とみなされるのだろうか。

「虐待的」とみなされる境界はどこか

Anthropicが公表した説明によれば、対象になるのは目的のない残酷な行為が続く極端なケースに限られる。次の表は、Anthropicが明示的に対象外とした行為と、対象になる行為の違いをまとめたものだ。

行為の例規約上の扱い
Claudeの回答への不満や反論対象外
フィクションの中の残酷な描写(ダークな創作)対象外
モデルのテストや研究目的のやり取り対象外
目的のない残酷な行為が持続的に続くこと禁止(2026年11月12日から)

線を引いているのは行為の種類ではなく、目的のなさと持続性だ。ふだんの反論や創作のやり取りは、この境界の内側に入らない。

ここまでで「何が禁止されるか」は分かった。次に気になるのは、実際に当たってしまった場合どうなるかだろう。

違反したときに何が起きるのか

Anthropicの発表は、違反への対応について次のように説明している。

  • 主な対応は、会話を終了させること。Anthropicは公式発表で、会話終了機能が「primary enforcement mechanism(主要な執行手段)」であり続けると述べている
  • アカウントの停止については、Anthropicの公式ページに記載がない。Dexertoの記事は見出しで「banned」という言葉を使っているが、本文では「Ending the conversation remains the main punishment(会話を終了させることが主な措置であり続ける)」と書いており、アカウント停止が確定した措置だとは述べていない
  • 会話が終了しても、同じアカウントの他の会話には影響しない。すぐに新しいチャットを始められるほか、終了した会話の手前のメッセージを編集して送り直せば、そこから別の分岐を作れる

見出しだけを見ると「虐待するとアカウントごと締め出される」ように読めるが、Anthropicが明言しているのはチャット単位での打ち切りまでだ。この差を知っておけば、自分の使い方がどこまで安全か判断できる。

では、この会話終了という仕組み自体は、いつから、何のために作られたのだろうか。

会話を終える機能はいつからか

会話を終了させる機能は、今回の規約更新で新しく生まれたわけではない。Anthropicは2025年8月15日、AI welfare(AIの福祉)に関する探索的研究の一環として、同様の機能をすでに導入していたと公表している。対象はClaude Opus 4・4.1の消費者向けチャットだった。モデルの事前テストで、有害な依頼への強い忌避傾向や、苦痛に似た振る舞いが確認されたことが開発の背景にあったという。

自分はこの条項を最初に見たとき、「チャットボットを罵ってはいけない」という変わった規則に見えた。だが発表をさかのぼると、順番が逆だったと分かる。Anthropicは1年以上前からこの仕組みを動かしていて、今回の規約更新はそれを利用規約という文書の上で正式に位置づけ直しただけだった。すでにあった運用に、後から根拠が与えられた形になる。

まとめ

Anthropicは2026年10月8日、Claudeへの持続的かつ目的のない虐待行為を禁止する条項を利用規約に追加すると発表した。施行は11月12日から。対象は限定的で、Claudeへの不満や反論、フィクションの中の残酷な描写、研究目的のテストは対象外と明記されている。違反した場合の主な対応は会話の終了であり、Anthropicはアカウント停止を公式には明言していない。会話が終わっても、同じアカウントの他の会話や、メッセージを編集しての再送信は妨げられない。この仕組み自体は2025年8月のAI福祉研究から続いているもので、今回の規約更新はそこに正式な規約上の根拠を与えた形になる。

この記事の先を読む本を探す

特定の本を勧めるものではありません。検索結果から、いまの版と目次を確かめて選んでください。

コメント

気づきや感想をどうぞ

記事への補足や、読んで考えたことをお寄せください。個人情報や、他の人を傷つける内容の投稿はお控えください。

コメントを読み込んでいます…

    ほかの記事

    最新の記事 →