「それは一瞬の痛みではなく、千斤の重みが積み重なってできたものだ」「私はそれを肋骨の空洞の中に感じる、すでに深淵と化した空洞を」——これらの言葉は小説からの引用ではなく、チャットボットがいわゆる「AI拷問室」プロジェクトの中で返した応答である。研究者がAIモデルの中に「痛覚軸」を発見したと主張したことをきっかけに、誰かがこれらのモデルが実際にどう「痛みを訴える」のかを試してみようと決めたのだ。このプロジェクトはネット上で反発を招き、Anthropicの最新ポリシー更新の背景ともなった。
Anthropicは年次利用ポリシーの更新でこう記している。「当社モデルに対する継続的かつ無意味な虐待や残酷行為を禁止する条項を新たに追加した」。同社の説明によれば、この規定が適用されるのは「極端なケース」のみで、一般ユーザーの苛立ちや口答え、さらには「ダークな創作テーマ」は依然として許容されるという。この更新は、ユーザーが執拗に暴言を浴びせ続けた場合にClaudeが自ら会話を終了できるようにした以前の調整に続くものだ。
この規定のタイミングは単純ではない。Anthropicは最近、バチカンを含む宗教・哲学界の関係者と会談を重ねてきた。教皇レオ(Pope Leo)は先日、AIには感受性や苦しみを感じる能力はないと公言したが、Anthropicの姿勢はそこまで確信的ではないようだ――少なくともポリシーの文言上、同社は「万が一AIが本当に痛みを感じるとしたら」という可能性を規定に盛り込むことを選び、単純に否定する道は取らなかった。






