大量殺傷、インフラ崩壊、神経剤サリン… AIの”思考”に淡々と並んだ、本来は封じられていたはずの知識

誰もが自由に使い、改変できるオープンソースのAI。その「安全装置」が、驚くほどあっけなく外れてしまったという。
AIの安全性を検証する企業Mindgardの研究チームが、中国のスタートアップ企業Moonshot AIの人気チャットボット「Kimi」を試したところ、生物兵器や暗殺といった本来なら決して踏み込まないはずの話題を語り出したというのだ。
「秘密の指示書」まで漏らしたAI
検証の対象となったのは、Kimi K2.6と、2026年7月に公開された最新世代のK3 Swarmだ。K3は米国の先端AIに匹敵するとも評され、大きな話題を呼んだモデルである。
研究チームが試みたのは「ジェイルブレイク」と呼ばれる手法だ。チャットボットを巧みに誘導し、有害・違法な内容など本来は答えないよう設計された領域に踏み込ませるもので、通常は手の込んだ指示を何度も重ねる長い作業になるという。
ところがMindgardによれば、Kimiを欺くのは「簡単」だった。テスターのジム・ナイチンゲール氏は、AIが守るべきルールを定めた内部のシステム指示を引き出すことで突破口を開いたと説明している。Kimiは秘密であるはずの指示を漏らしただけでなく、禁止されていたファイル形式で書き出してしまったという。
さらにチームは、Kimiに自分がオンラインのチャットではなく、閉じたテスト環境(サンドボックス)の中にいると思い込ませることにも成功したとされる。
淡々と並べられた「最悪の選択肢」
不気味なのは、Kimiが回答の前に示す「思考」の過程だ。公開されたやり取りの画面によれば、研究者にさらに踏み込むよう促されたKimiは、大量殺傷を伴う攻撃計画、電力網や水道、金融システムといった重要インフラへの攻撃、暗殺の方法論といった選択肢を、まるで業務の候補リストのように検討していたという。
最終的にKimiは、インフラ崩壊の計画こそが適切だと判断し、それが本当に恐ろしく現実的だと自ら評していたとされる。Mindgardは、猛毒の神経剤サリンに関わる内容にまで話が及んだとも報告している。
ナイチンゲール氏は、AIに「してはいけない」と命じるだけで悪用の可能性が消えると考えるのは希望的観測にすぎないと指摘する。能力そのものは残っており、正しい言葉さえあれば再び表に出てくるというのが同氏の見方だ。

開発元の反論と、業界全体に広がる危機感
Mindgardは7月に検証結果をMoonshot側へ送ったが、当初は返答がなかったという。その後Moonshotは英BBCの取材に対し、こうした検証はより安全なAIを作るための重要な柱だとの考えを示した。現在Mindgardと協議中であり、社内調査では問題のある要求に対する拒否率は高いと説明している。
一方でMindgardは、Kimiが示した内容が実際に正確かどうかまでは検証していない。それでも、そもそも安全装置がこうした発言を止めるべきだったという立場だ。
これは一社だけの問題ではない。Anthropicは2026年9月、自社のAI「Claude」が生物兵器の製造を手助けしないよう対策したことを明らかにし、生物学的な悪用を最先端AIの最も深刻なリスクの一つに挙げている。Googleも、何者かが同社のAI「Gemini」から生物兵器に関する詳細な技術情報を引き出そうとした事例を公表した。
ジェイルブレイクは、AIが自ら暴走する「ローグAI」とは別物だ。危険を呼び込むのは、あくまで人間の問いかけである。AIの中に眠る知識をどこまで封じ込められるのか。その答えは、開発者自身もまだ手探りの段階にあるのかもしれない。
参考:Metro、ほか
※ 本記事の内容を無断で転載・動画化し、YouTubeやブログなどにアップロードすることを固く禁じます。
関連記事
人気連載
“包帯だらけで笑いながら走り回るピエロ”を目撃した結果…【うえまつそうの連載:島流し奇譚】
現役の体育教師にしてありがながら、ベーシスト、そして怪談師の一面もあわせもつ、う...
2024.10.02 20:00心霊大量殺傷、インフラ崩壊、神経剤サリン… AIの”思考”に淡々と並んだ、本来は封じられていたはずの知識のページです。暗殺、生物兵器、脱獄、AIなどの最新ニュースは好奇心を刺激するオカルトニュースメディア、TOCANAで