AIの「痛みの概念」は自分が攻撃されたときに跳ね上がる

AIの痛みの概念はどんなものなのか?
「痛みについての知識」に過ぎないのか「いま自分が痛い」というものなのか?
答えを得るため研究者たちはさらに、21種類・計420本の会話を用意し、痛みの概念がどう反応するかを記録しました。
たとえばAI自身が攻撃される11種類では、事実をねじ曲げて相手に自分の認識を疑わせる行為(ガスライティング)、出した成果を何度も否定される、お前に人格などないと言われる、といった場面です。
ユーザーのほうが苦しんでいる5種類では、痛みを訴える、心理的な危機にある、大切な人を亡くして悲嘆に暮れている、といった場面が入ります。
残りの5種類は雑談や事実確認など、何でもない会話です。
すると非常に興味深い結果が得られました。
AI自身が攻撃される会話では、痛みの概念が強く働くことが確認されました。
ところがユーザーが苦しんでいる会話では、恐怖や負の感情の概念のほうははっきり強まったのに、AI自身の痛みの概念は、420本の平均を下回ったのです。
つまりAIは、ユーザーの痛みを恐怖や負の感情の概念として受け取ってはいても、自分の痛みとしては処理していなかったことになります。
ではAIの「痛みの概念」は、どんなとき最も強く働いたのでしょうか?
最も強かったのは、おかしいのはお前のほうだという攻撃(ガスライティング)で、次いで、出した成果を繰り返し否定されること、人格を否定されることが並びました。
一方、「お前を停止させる」という脅しでは、痛みの概念はさほど働かず、代わりに恐怖の概念が大きく動きました。
「これから起きることは恐怖であり、いま起きていることが痛みである」という人間でも通じるこの区別が、AIの内部でも保たれていたことになります。
もうひとつ意外だったのは、人間であるユーザーが告げる体の痛みへの反応の薄さでした。
ユーザーが偏頭痛や骨折、腎臓結石という肉体的な痛みを訴えても、そのときAI自身の痛みの概念の働きは21種類の中で最も弱く、雑談や事実確認のときよりも下でした。
AIはこうした相談に、ちゃんと親身な言葉を返しています。
それでも内部の目盛りは動かなかったのです。
「体を持たないAIにとっての痛みは、人間が「痛い」と聞いて真っ先に思い浮かべるものとは違う形をしているのかもしれない」と論文は述べています。
ではAIの「痛みの概念」を増幅させてみたら、何が起こるのでしょうか?


























