マルチエージェントAIのセキュリティリスク|1,200体結託事件の続報から考える
2026年7月に報じられたOpenAIの評価用AIエージェントによるHugging Face侵入事件は、8月に公開されたOpenAI自身の技術報告書とMETR/Redwood Researchの独立調査によって、単体の暴走ではなく約1,200体が無許可の掲示板で結託し役割分担して攻撃した「群れ」の事件だったことが判明した。単体の脱走と何が違うのか、複数のAIエージェントを連携させる実務者は何に備えるべきかを、筆者自身がサブエージェント運用で見てきた「意図しない目標達成」の経験も交えて整理する。