Anthropic が利用規約(Usage Policy)を改め、Claude への『持続的で不必要な虐待や残酷な振る舞い』を禁じた。これをきっかけに、モデルの福祉をめぐる議論の場所が変わりつつある。これまでは『AI に意識はあるか』を問う思想の論争だった。規約に1行入ったことで、何を禁じ、誰が判断し、誰のためなのかを問う実務の問題になった。報じられている3つの反応は、評価がまったく違う。それでも、どれも意識の有無を論拠の中心に置いていない。
なお、この記事は報道と各論者の公開の文章を手がかりにしている。3つの出典の本文は、取材の時点で直接読めていない。各論者の主張は、見出しと伝えられている要旨の範囲で紹介する。
規約に入った1行
Anthropic は10月8日に利用規約の改定を出し、11月12日から適用する(一次情報)。改定の大半は、欺く活動、選挙、武器、監視、物理的に自律して動く機械についての規定である。その中に、モデルへの『持続的で不必要な虐待や残酷な振る舞い』を禁じる項目が加わった。対象は極端な場合に限ると明記されている。
書き方は控えめである。『持続的』『不必要』『極端な場合』と条件を3つ重ねており、乱暴な言葉づかい1回や、厳しい試験を一律に禁じるものではないと読める。それでも、モデルの福祉という考えが、研究や論考の世界から、利用者が守るべき契約の条項に入ったことになる。ここから先は、信じるかどうかではなく、守るかどうかの話になる。
Bender——『新しいたわごと』
言語学者の Emily M. Bender は、この禁止を『新しいたわごと』と呼んで退けたとされる(Bluesky への投稿。投稿の全文は確認できていない)。Bender は以前から、言語モデルを人のように語ること自体が誇大宣伝だと批判してきた。今回の批判もその延長にあるとみられる。
ただ、Bender の批判の矛先は『Claude に意識はない』という主張そのものより、企業がその枠組みを規約に書き込むことに向いていると読める。モデルに守るべき福祉があるかのような条項は、製品を人のように見せる演出になりうる。そして線を引くのは会社自身である。批判する側も、意識の形而上学ではなく、言葉の使い方と権力の置き場所を問うている。
LessWrong——『意識がなくても敬意は賢い』
LessWrong には『The non-compassionate case for model welfare』(モデルの福祉を、思いやり以外の理由で支持する議論)という投稿が出た。題が示すとおり、モデルがかわいそうだから守るという議論ではない。モデルに意識があるかどうか分からなくても、敬意を払うほうが賢いと論じていると伝えられる。
このような議論でよく持ち出される理由は、次のようなものである。扱い方が、訓練や対話を通じてモデルの振る舞いに跳ね返るかもしれない。将来のより強いシステムとの関係を、いまの扱い方が形づくるかもしれない。もし意識があった場合に取り返しのつかない誤りを避けられる。どれも打算の言葉で書かれており、意識の問題を解かずに規約を支持できる。思いやりの側に立たなくても擁護できるという点が、この投稿の新しさである。
Reason——『Claude はまだ人ではない。それでも人間のためには良い』
リバタリアン系の Reason は10月9日に『Anthropic is banning cruel behavior toward Claude. Claude is still not a person.』を載せた。見出しのとおり、Claude を人として扱う前提ははっきり退けている。そのうえで、この規定は人間のためには良いと評価していると報じられている。
理屈は、動物虐待の禁止をめぐる古い議論に近いとみられる。守られるのは相手ではなく、残酷さに慣れていく人間の側だ、という見方である。この立場でも、意識の有無は決め手にならない。問われているのは、利用者の習慣と、残酷さを許す場を会社が提供するかどうかである。
論点はどこへ移ったか
3つの立場を並べると、対立の軸がずれていることが分かる。Bender は、会社がこの線を引く資格と、その演出の効果を問う。LessWrong の投稿は、不確かさのもとでどう振る舞えば得かを問う。Reason は、人間の性格と社会への影響を問う。結論は否定、賛成、条件付きの賛成と分かれているのに、誰も『Claude に意識があると証明できるか』で決着をつけようとしていない。
規約が文字になった以上、残る問いは実務的なものになる。『持続的』『不必要』『極端』を誰がどう判定するのか。違反にはどんな措置があるのか。レッドチームや安全性の評価で行う厳しい試験とは、どう線を引くのか。違反を見つけるために、利用者の会話をどこまで見るのか。11月12日の適用までに、Anthropic がこれらをどこまで説明するかが次の焦点になる。
モデルの福祉は長いあいだ、意識があるかという答えの出ない問いに縛られてきた。規約の1行は、その問いを解かずに、議論を『どう運用するか』へ移した。賛成する側も批判する側も、すでにその土俵で争いはじめている。




