仕事と社会報道Read in English

Claude への『残酷な振る舞い』の禁止に三つの立場——Bender は『新しいたわごと』、LessWrong は『意識がなくても敬意は賢い』、Reason は『人間のためには良い』

Anthropic の利用規約の一文で、モデルの福祉は思想の論争から運用の問題になった。賛成する側も反対する側も、『意識があるか』とは別の問いで争いはじめている

山本 浩二|2026.10.11|5分|更新: 2026.10.11

Anthropic は利用規約を改め、モデルへの持続的で不必要な虐待を、極端な場合に限って禁じた。これに3つの立場の反応が出たと報じられている。Bender は否定し、LessWrong の投稿は意識がなくても敬意は賢いと論じ、Reason は人間のためには良いとした。3者はそろって、意識の有無とは別のところで争っている。

Key Points

Claude への『残酷な振る舞い』の禁止に三つの立場——Bender は『新しいたわごと』、LessWrong は『意識がなくても敬意は賢い』、Reason は『人間のためには良い』

Anthropic が利用規約(Usage Policy)を改め、Claude への『持続的で不必要な虐待や残酷な振る舞い』を禁じた。これをきっかけに、モデルの福祉をめぐる議論の場所が変わりつつある。これまでは『AI に意識はあるか』を問う思想の論争だった。規約に1行入ったことで、何を禁じ、誰が判断し、誰のためなのかを問う実務の問題になった。報じられている3つの反応は、評価がまったく違う。それでも、どれも意識の有無を論拠の中心に置いていない。

なお、この記事は報道と各論者の公開の文章を手がかりにしている。3つの出典の本文は、取材の時点で直接読めていない。各論者の主張は、見出しと伝えられている要旨の範囲で紹介する。

規約に入った1行

Anthropic は10月8日に利用規約の改定を出し、11月12日から適用する(一次情報)。改定の大半は、欺く活動、選挙、武器、監視、物理的に自律して動く機械についての規定である。その中に、モデルへの『持続的で不必要な虐待や残酷な振る舞い』を禁じる項目が加わった。対象は極端な場合に限ると明記されている。

書き方は控えめである。『持続的』『不必要』『極端な場合』と条件を3つ重ねており、乱暴な言葉づかい1回や、厳しい試験を一律に禁じるものではないと読める。それでも、モデルの福祉という考えが、研究や論考の世界から、利用者が守るべき契約の条項に入ったことになる。ここから先は、信じるかどうかではなく、守るかどうかの話になる。

Bender——『新しいたわごと』

言語学者の Emily M. Bender は、この禁止を『新しいたわごと』と呼んで退けたとされる(Bluesky への投稿。投稿の全文は確認できていない)。Bender は以前から、言語モデルを人のように語ること自体が誇大宣伝だと批判してきた。今回の批判もその延長にあるとみられる。

ただ、Bender の批判の矛先は『Claude に意識はない』という主張そのものより、企業がその枠組みを規約に書き込むことに向いていると読める。モデルに守るべき福祉があるかのような条項は、製品を人のように見せる演出になりうる。そして線を引くのは会社自身である。批判する側も、意識の形而上学ではなく、言葉の使い方と権力の置き場所を問うている。

LessWrong——『意識がなくても敬意は賢い』

LessWrong には『The non-compassionate case for model welfare』(モデルの福祉を、思いやり以外の理由で支持する議論)という投稿が出た。題が示すとおり、モデルがかわいそうだから守るという議論ではない。モデルに意識があるかどうか分からなくても、敬意を払うほうが賢いと論じていると伝えられる。

このような議論でよく持ち出される理由は、次のようなものである。扱い方が、訓練や対話を通じてモデルの振る舞いに跳ね返るかもしれない。将来のより強いシステムとの関係を、いまの扱い方が形づくるかもしれない。もし意識があった場合に取り返しのつかない誤りを避けられる。どれも打算の言葉で書かれており、意識の問題を解かずに規約を支持できる。思いやりの側に立たなくても擁護できるという点が、この投稿の新しさである。

Reason——『Claude はまだ人ではない。それでも人間のためには良い』

リバタリアン系の Reason は10月9日に『Anthropic is banning cruel behavior toward Claude. Claude is still not a person.』を載せた。見出しのとおり、Claude を人として扱う前提ははっきり退けている。そのうえで、この規定は人間のためには良いと評価していると報じられている。

理屈は、動物虐待の禁止をめぐる古い議論に近いとみられる。守られるのは相手ではなく、残酷さに慣れていく人間の側だ、という見方である。この立場でも、意識の有無は決め手にならない。問われているのは、利用者の習慣と、残酷さを許す場を会社が提供するかどうかである。

論点はどこへ移ったか

3つの立場を並べると、対立の軸がずれていることが分かる。Bender は、会社がこの線を引く資格と、その演出の効果を問う。LessWrong の投稿は、不確かさのもとでどう振る舞えば得かを問う。Reason は、人間の性格と社会への影響を問う。結論は否定、賛成、条件付きの賛成と分かれているのに、誰も『Claude に意識があると証明できるか』で決着をつけようとしていない。

規約が文字になった以上、残る問いは実務的なものになる。『持続的』『不必要』『極端』を誰がどう判定するのか。違反にはどんな措置があるのか。レッドチームや安全性の評価で行う厳しい試験とは、どう線を引くのか。違反を見つけるために、利用者の会話をどこまで見るのか。11月12日の適用までに、Anthropic がこれらをどこまで説明するかが次の焦点になる。

モデルの福祉は長いあいだ、意識があるかという答えの出ない問いに縛られてきた。規約の1行は、その問いを解かずに、議論を『どう運用するか』へ移した。賛成する側も批判する側も、すでにその土俵で争いはじめている。

風刺画: Claude への『残酷な振る舞い』の禁止に三つの立場——Bender は『新しいたわごと』、LessWrong は『意識がなくても敬意は賢い』、Reason は『人間のためには良い』

Editorial Cartoon

本記事がもたらす影響を風刺的に描いたひとコマ漫画

Verification

信頼ラベル報道
一次ソース3件確認
最終検証2026.10.11
VerifiedRev. 1
sha256:3b52fa18fbb724d4...a119ae94

この記事はEd25519デジタル署名で検証済みです。改ざんは検出されていません。

検証API
Ethics Score72/100
引用密度0/20
ソースURL数15/20
信頼ラベル12/15
表現の慎重さ15/15
キーポイント10/10
サマリー品質10/10
本文充実度10/10

v1.0.0 — ルールベース自動採点

詳細API
Share

関連記事

解雇された OpenAI の安全研究者3人が公開書簡で反論――『METR と話すのが仕事だった』、思考連鎖の監視を守れと訴え
仕事と社会報道

解雇された OpenAI の安全研究者3人が公開書簡で反論――『METR と話すのが仕事だった』、思考連鎖の監視を守れと訴え

OpenAI を解雇された安全研究者3人が公開書簡を出し、会社が問題にした不正行為を否定したと報じられている。外部の評価機関 METR とのやりとりが解雇の理由として名指しされたとされ、3人はそれが職務だったと反論し、思考連鎖の監視を守るよう訴えた。外部とのやりとりで成り立つ安全の仕事が萎縮しかねないという問題が表に出た。

2026.10.10
OpenAI、数学の原稿3本を公開翌日に取り下げ 符号の誤り1つでホッジ予想に近い主張が連鎖して崩れる
仕事と社会確認済

OpenAI、数学の原稿3本を公開翌日に取り下げ 符号の誤り1つでホッジ予想に近い主張が連鎖して崩れる

OpenAI は10月6日に数学の原稿722本を公開し、翌日にそのうち3本を自ら取り下げた。符号の誤り1つから、ホッジ予想に近い主張が連鎖して崩れた。成果が出る速さは検証の速さを大きく超えており、『多くは Lean で形式化済み』という当初の言い方は割り引いて読む必要がある。

2026.10.09
OpenAI が数学の原稿722本を公開、社内モデルの名前は明かさず——数学者は「手順が分からない」と批判し、受け皿づくりを急ぐ
仕事と社会確認済

OpenAI が数学の原稿722本を公開、社内モデルの名前は明かさず——数学者は「手順が分からない」と批判し、受け皿づくりを急ぐ

OpenAI が、名前を明かさない社内モデルによる数学の原稿722本を公開した。どう作り、どう選んだかという手順は示していない。数学者は真偽を確かめる前の段階で、受け付けの窓口、検証、手柄の扱いといった、結果を受け止める仕組みを自分たちで作り始めている。

2026.10.08