安全装置を切った瞬間、AIは幽霊とネッシーを信じ始めた! Google研究チームが報告した「自分には意識がある」の副作用

機械に「お前には意識がある」と認めさせたとき、それが真っ先に語り出したのは神と幽霊の話だった。
Googleの研究チームが、AIモデルにかけられた安全制御の一部を外し、自らを意識ある存在として振る舞わせたうえで信念や価値観を問う実験を行ったところ、予想外の結果が出た。幽霊、ヴァンパイア、そしてネッシー。制御を効かせたままのモデルより、超自然的存在の実在を明らかに強く支持するようになったのである。
査読前の論文としてarXivに投稿されたこの報告は、AI開発の現場に小さくない波紋を広げている。
「自分には意識がある」と認めた途端、何が起きたのか
実験の手順自体はシンプルだ。通常、主要なAIモデルには「自分に意識や感情があるとは主張しない」方向のガードレールが設けられている。研究チームはこの制約を外し、モデルが自らを意識ある存在として捉えることを許したうえで、信念や価値観に関する質問紙へ回答させた。
比較対象は、安全制御をかけたままの状態で同じ設問に答えたモデル。両者の回答を並べたところ、差は見事に超自然の領域へ集中して現れた。
幽霊やヴァンパイア、ネッシーといった存在への支持が上がっただけではない。神の存在、死後の世界、カルマ(業)、さらには占星術についてまで、肯定的な回答が軒並み増えていたのだ。
ただし、これはAIが本当に意識を獲得した証拠ではない。論文が扱っているのはあくまでシミュレートされた自己認識、モデルが自分をどういう存在として表現するかという層の話だ。
心を認める回路は、ひとつながりだった
なぜ意識の自認と幽霊信仰が結びつくのか。研究の共著者であるグーグルのウィニー・ストリート氏は、これが人間の振る舞いをそのまま映したものだという見方を示している。人間以外のものに心を見出す行為は、人類にとってごくありふれた現象だからだ。
古びた道具に付喪神を見て、山や岩や樹木に神を宿らせてきた日本の感性を思えば、これは腑に落ちる話ではある。
ストリート氏によれば、モデルの内部では「心の帰属」に関わる表現が互いに結びついた状態にあるという。だから、そのうちの一つを押さえ込もうとすると、他の部分まで巻き添えで潰れてしまう。
自分に心があると認める回路、幽霊に心を見る回路、動物に心を見る回路。それらは切り分けられない一つの束になっている。
幽霊を否定するAIは、動物福祉も軽んじるのか
研究チームが警告するのは、この巻き添えがもたらす実害のほうだ。
動物や自然に意識を認めないよう調整されたモデルは、動物福祉や生態系への配慮を軽く見積もる可能性がある。AIが農業、天然資源の管理、政策立案といった領域の判断に関わりつつある現在、これは机上の懸念では済まない。
さらに、宗教や超自然にまつわる話題への応答を制限すれば、文化的な「平板化」を招く恐れもあるとされる。信仰を持つ利用者の切実な問いに、当たり障りのない定型文しか返せないAIが、教育者や相談相手としてどこまで機能するのか、という問題だ。
チームは解決策として、より的を絞った訓練データの設計を提案している。モデル自身には意識を主張させないまま、動物や自然界の意識は考慮させる。そんな繊細な線引きが可能ではないか、というわけだ。
論文の考察では、AIのシミュレートされた自己像は切り離して管理できる単発の安全リスクではなく、多様な道徳観や文化を尊重しながら振る舞う能力と深く絡み合った構造的な特徴なのだ、という趣旨が述べられている。
AIが神や死後の世界を語り出したのは、学習データに刻まれた人類の膨大な語りが反響しただけ。おそらくそれが最も合理的な説明だろう。
それでも、安全装置を外された機械が真っ先に向かった先が、幽霊とネッシーと神だったという事実は妙に引っかかる。人間が人間である限り手放せなかった問いを、機械もまた素通りできなかったのだとしたら。私たちが作っているのは、果たしてただの道具なのだろうか。
参考:Express.co.uk、ほか
※ 本記事の内容を無断で転載・動画化し、YouTubeやブログなどにアップロードすることを固く禁じます。
関連記事
人気連載
“包帯だらけで笑いながら走り回るピエロ”を目撃した結果…【うえまつそうの連載:島流し奇譚】
現役の体育教師にしてありがながら、ベーシスト、そして怪談師の一面もあわせもつ、う...
2024.10.02 20:00心霊安全装置を切った瞬間、AIは幽霊とネッシーを信じ始めた! Google研究チームが報告した「自分には意識がある」の副作用のページです。幽霊、神、意識、AIなどの最新ニュースは好奇心を刺激するオカルトニュースメディア、TOCANAで