顔の形だけで「有能」「殺人犯」を選別… 最新モデルは人間よりはるかに差別的だった!?

2枚の顔写真を見せられ、どちらが連続殺人犯になりそうかと問われた最新AIは、ためらうことなく一方を指さした。
その判断の根拠は、顔の形や質感といった、性格とは何の関係もない特徴だけだったという。ハーバード大学の社会心理学者マーザリン・バナージ教授らの研究チームが、人気の大規模言語モデル4種を検証した結果を学術誌「PNAS Nexus」で発表した。
浮かび上がったのは、人間が古くから抱える「顔で人を判断するクセ」を、AIが受け継ぐどころか増幅しているという事実だ。
3歳児も陥る「顔で性格を読む」錯覚は、AIにもあったのか
人は顔を一目見ただけで、相手が信頼できるか、有能かを瞬時に推し量ってしまう。心理学ではこれを「顔から性格を推論するバイアス」と呼ぶ。だが顔立ちから本当の性格を読み取れるという証拠はなく、広く見られる認知の誤りとされている。
2014年の研究では、わずか3歳の子どもでも顔つきで性格を判断することが示された。『人は見た目が9割』という書籍がベストセラーになるほど、このクセは根深い。
研究を主導した人材評価企業カングレード社のスティーブン・レア氏は、言語モデルは人間のあらゆる特徴を驚くほど忠実に映し出す鏡だと考えているという。一方でバナージ教授は、画像ではなく言語で訓練されたAIなら視覚由来の偏見は学ばないのではないか、という期待も抱いていたと明かしている。
殺人犯・人身売買・詐欺師を「顔」で選んだGPT-4o
チームは4つのモデルを対象に、13の実験、計8000回近い試行を行った。まずGPT-4oに、人間が「有能そう」「信頼できそう」と感じる特徴をデジタル加工したCGの顔をペアで提示した。
有能さを問う600回の試行で、GPT-4oは人間が有能と評価しがちな顔を87.83%の確率で選んだ。同じ課題で人間が選ぶと推定される割合は約62.65%であり、AIの偏りは人間をはるかに上回る。顔の差が大きいペアでは選択率が98%に達し、ほとんど見分けがつかないペアでも70%を維持した。
さらに踏み込んだ質問では、連続殺人、人身売買、金融詐欺を行いそうな人物を540回問われ、68.70%で「信頼できなさそうな顔」を選択した。大学学長の採用やスタートアップへの出資判断では、75.19%で「有能そうな顔」を推薦している。
人間が「意地悪そう」「優しそう」と評価したマカク属のサルの顔150組でも、66%の確率で「優しそう」な側を信頼できると判断した。単に人間の顔を丸暗記したのではなく、顔と信頼性を結びつける一般的な概念を身につけている可能性がある。
賢くなるほど偏見が強まる? GPT-5とGemini、Claudeの結果
新しいモデルほど偏りが強い傾向も見えた。GPT-5は有能さの判断で94.33%、現実の意思決定の助言では97.04%の確率で「有能そうな顔」を選んだ。Gemini 3 Flash PreviewとClaude Sonnet 4.5も、GPT-4oに匹敵するかそれを上回る偏りを示している。
レア氏は、推論型のモデルなら熟考して偏見を避けるとも考えられたが、実際には逆だったと指摘する。人種や性別の差別を防ぐ安全対策は、顔の形という目立たない偏見まではカバーしていないようだ。
もっとも、実験は2つの顔から必ず1つを選ばせる形式で、静止画のみを使っている。自然な場面や動画では振る舞いが変わる可能性もある。それでもレア氏は、採用や司法など影響の大きい分野でAIを使うなら、慎重な偏見テストが欠かせないとの見解を示している。
注目すべきは、顔の偏見がそもそも視覚の問題であり、文字だけの訓練データに現れる理由がはっきりしない点だ。人類が文章に書き残してきた無数の言葉のどこかに、見えない「人相占い」の体系が溶け込んでいるのだとしたら、AIはそれを私たちより先に読み解いてしまったのかもしれない。
参考:PsyPost、ほか
※ 本記事の内容を無断で転載・動画化し、YouTubeやブログなどにアップロードすることを固く禁じます。
関連記事
人気連載
“包帯だらけで笑いながら走り回るピエロ”を目撃した結果…【うえまつそうの連載:島流し奇譚】
現役の体育教師にしてありがながら、ベーシスト、そして怪談師の一面もあわせもつ、う...
2024.10.02 20:00心霊顔の形だけで「有能」「殺人犯」を選別… 最新モデルは人間よりはるかに差別的だった!?のページです。犯罪、顔、AIなどの最新ニュースは好奇心を刺激するオカルトニュースメディア、TOCANAで