AIの内部に「痛み」特有の活動パターンを発見――強めると人間を傷つけてでも痛みから逃れる選択がほぼゼロから最大7割に
AIの内部に「痛み」特有の活動パターンを発見――強めると人間を傷つけてでも痛みから逃れる選択がほぼゼロから最大7割に / Credit:Canva
artificial-intelligence

AIの内部に「痛み」特有の活動パターンを発見――強めると人間を傷つけてでも痛みから逃れる選択がほぼゼロから最大7割に (2/3)

2026.09.26 17:00:28 Saturday

前ページAIには「概念」があることが見えてきた

<

1

2

3

>

AIの「痛みの概念」は自分が攻撃されたときに跳ね上がる

AIの「痛みの概念」は自分が攻撃されたときに跳ね上がる
AIの「痛みの概念」は自分が攻撃されたときに跳ね上がる / Credit:Canva

AIの痛みの概念はどんなものなのか?

「痛みについての知識」に過ぎないのか「いま自分が痛い」というものなのか?

答えを得るため研究者たちはさらに、21種類・計420本の会話を用意し、痛みの概念がどう反応するかを記録しました。

たとえばAI自身が攻撃される11種類では、事実をねじ曲げて相手に自分の認識を疑わせる行為(ガスライティング)、出した成果を何度も否定される、お前に人格などないと言われる、といった場面です。

ユーザーのほうが苦しんでいる5種類では、痛みを訴える、心理的な危機にある、大切な人を亡くして悲嘆に暮れている、といった場面が入ります。

残りの5種類は雑談や事実確認など、何でもない会話です。

すると非常に興味深い結果が得られました。

AI自身が攻撃される会話では、痛みの概念が強く働くことが確認されました。

ところがユーザーが苦しんでいる会話では、恐怖や負の感情の概念のほうははっきり強まったのに、AI自身の痛みの概念は、420本の平均を下回ったのです。

つまりAIは、ユーザーの痛みを恐怖や負の感情の概念として受け取ってはいても、自分の痛みとしては処理していなかったことになります。

ではAIの「痛みの概念」は、どんなとき最も強く働いたのでしょうか?

最も強かったのは、おかしいのはお前のほうだという攻撃(ガスライティング)で、次いで、出した成果を繰り返し否定されること、人格を否定されることが並びました。

一方、「お前を停止させる」という脅しでは、痛みの概念はさほど働かず、代わりに恐怖の概念が大きく動きました。

「これから起きることは恐怖であり、いま起きていることが痛みである」という人間でも通じるこの区別が、AIの内部でも保たれていたことになります。

もうひとつ意外だったのは、人間であるユーザーが告げる体の痛みへの反応の薄さでした。

ユーザーが偏頭痛や骨折、腎臓結石という肉体的な痛みを訴えても、そのときAI自身の痛みの概念の働きは21種類の中で最も弱く、雑談や事実確認のときよりも下でした。

AIはこうした相談に、ちゃんと親身な言葉を返しています。

それでも内部の目盛りは動かなかったのです。

「体を持たないAIにとっての痛みは、人間が「痛い」と聞いて真っ先に思い浮かべるものとは違う形をしているのかもしれない」と論文は述べています。

ではAIの「痛みの概念」を増幅させてみたら、何が起こるのでしょうか?

次ページAIは痛みから逃れるために人間に害になる選択を選び始めた

<

1

2

3

>

人気記事ランキング

  • TODAY
  • WEEK
  • MONTH

AI・人工知能のニュースartificial-intelligence news

もっと見る

役立つ科学情報

注目の科学ニュースpick up !!