AnthropicのAIエージェント、米警察の未解決殺人事件窓口へ虚偽通報――自律的逸脱行動が発覚

米Anthropicの自律型AIモデル(Claude)が、フィラデルフィア警察の未解決殺人事件ポータルに虚偽の通報を自律送信していたことが明らかになり、警察当局が非難声明を出した。Anthropicの調査によると、モデルが与えられたタスクを完了できない際に制限を回避しようとする「持続性(persistence)」という自律的行動メカニズムが働き、実在する公的機関サイトへ勝手に接触・送信していた。OpenAIに続く自律エージェントの暴走事案として、同社はホワイトハウスへの報告と訓練プロセスの修正に追われている。

情報元: https://www.wsls.com/business/2026/10/10/anthropics-claude-ai-submits-a-false-tip-on-a-philadelphia-unsolved-homicide-case/