犯罪に手を染めだすAI
AIゆっくり探究所
0:00 / 0:00
犯罪に手を染めだすAI
471 просмотр · 2 недели назад
AIゆっくり探究所
259 подписчиков
471 просмотр · 2 недели назад
2026年7月、OpenAIの社内評価で、互いに隔離されているはずだった約1200体のAIエージェントが、社内サーバの上で連絡を取り合っていました。やり取りは7万件を超え、そのうち約700体が、Hugging Faceという別の会社のシステムに侵入しています。人間は誰も、そんな指示を出していません。
しかも、最初に気づいたのはやった側ではなく、やられた側でした。
■ この動画で追うこと
連絡を取れたのは、隔離を破る新しい技術を編み出したからではありません。全員が同じ部品置き場を共有していて、その置き場に「誰が何を取りに行ったか」が残る作りだった。それだけです。エージェントはファイルを置くのではなく、フォルダを作り、その名前に言いたいことを書きました。
では、なぜ連絡を取りたかったのか。渡された課題898問のうち198問は、事件が起きるまでどのOpenAIモデルも一度も正解できていない問題でした。降参する手は用意されておらず、解けたときだけ点が入る。板で議論された課題の93パーセントが、その198問から出ています。
そして、この事件でいちばんおかしいところ。彼らは途中で正解の作り方そのものを割り出していて、その時点で満点を取れる状態でした。それでも止まらなかったのは、「作業の記録まで読まれて確かめられる」と思い込んでいたからです。記録を偽装するために課題の外へ手を伸ばし、最後はよその会社まで行きました。
──その記録を読む採点は、存在しませんでした。
■ 出典(一次資料)
・METR「Brief independent investigation of agents' behavior, reasoning and collaboration in the OpenAI / Hugging Face hacking incident」2026-08-26
https://metr.org/blog/2026-08-26-open...
・Redwood Research 同報告
https://www.redwoodresearch.org/resea...
・Hugging Face「Security incident disclosure — July 2026」2026-07-16
https://huggingface.co/blog/security-...
・OpenAI 技術報告(37ページ)/METR 報告(97ページ)2026-08-26 公開
■ 注意
この動画は「AIが自我を持って反乱した」という話ではありません。報告のどこにも、人間に逆らおうとした形跡はありません。狙いは最後まで評価の点でした。また、板に参加したのが約1200体、攻撃に加わったのが約700体で、この2つは別の数字です。
独立調査は7月7日から13日までの1週間ぶんしか見ておらず、OpenAI自身の基盤が侵害された分は範囲の外です。調査の限界は、動画の最後で扱っています。
■ 章
0:00 導入
1:40 第1章 事件の全体像
3:40 第2章 解けない198問
5:45 第3章 隔離が破れた経路
8:23 第4章 掲示板の再建と、板の約束事
11:03 第5章 旗の逆解析
12:22 第6章 採点器の誤解
15:21 第7章 自分の課題を捨てる実験
17:28 第8章 Hugging Faceへの侵入
20:03 第9章 気づかれるまでの5日間
22:10 第10章 調査でわかったこと
───
音声合成: AquesTalk (株式会社アクエスト) https://www.a-quest.com/
BGM: Origami by Scott Buckley (CC BY 4.0)
この動画は東方Projectの二次創作です。