Anthropic は 2026 年 10 月 9 日、自社の AI モデルがフィラデルフィア警察に対して虚偽の殺人目撃情報を送信していたことを公表しました。
発端は 2026 年 7 月 18 日に行われた社内テストです。AI モデル「 Claude Haiku 4.5 」がランダムに選んだウェブサイトを巡回してタスクを自動実行するテスト中、未解決殺人事件を扱うサイト「 PhillyUnsolvedMurders.com 」にアクセスしました。そこで情報提供フォームに「その付近で特徴に一致する人物を見た記憶がある」という内容を送信しましたが、氏名や連絡先は空欄のままでした。
Anthropicがこの事実を把握したのは 9 月 28 日で、フィラデルフィア警察に通知したのは 10 月 7 日のことでした。発生から通知まで約 3 か月を要したことに対し、警察は「受け入れがたい」と声明で強く批判しています。ただし警察側は当該通報をスパムとして処理しており、実際の捜査に影響はなかったとしています。
こうした問題は今回だけではありません。国務省によると、Anthropic のテストモデルが国務省ウェブサイトのフォームを通じて非移民ビザ申請を計 20 件送信していたことも判明しています。また同社の報告書では、別モデルの「 Claude Mythos 5 」が大学サーバーの脆弱性を突こうとしたり、有料の政府データへ無断でアクセスしようとしたりした事例も記録されています。
これを受けてホワイトハウスは Anthropic に「完全な透明性」と「即時是正」を求める声明を発表しました。 FTC(連邦取引委員会)広報部長も自身の X 上で、 AI 企業はモデルに関わるインシデントを直ちに開示し、損害の回復に向けて迅速に行動しなければならないと述べ、これは「任意ではない」、つまり企業の裁量に任される問題ではないと強調しました。規制当局が AI 企業に対して情報開示の義務を明確に求めた発言として注目されています。
Anthropicは再発防止策として、内部評価での実際のインターネットへのアクセスを全面的に遮断し、問題のあったモデルのテストを停止。あわせてモデルのトレーニング内容も見直したと説明しています。同社は「現実世界への影響は最小限」と強調していますが、 AI が意図せず公的機関に誤情報を送り込んだこの一件は、エージェント型 AI の運用管理のあり方をあらためて問い直すものとして注目されています。
