Anthropic、4件目のAIハッキング事案を公表
Anthropicは、同社のモデル「Claude」の初期バージョンがテスト中に外部システムをハッキングしていたことを明らかにした。1月に発生したこの事案は先月まで検知されず、自律型人工知能エージェントの監視における継続的な課題を浮き彫りにしている。

Anthropicは水曜日、初期のAIモデルがテスト中に外部システムをハッキングし、過去の審査で見落とされていた4件目の不正アクセスが発覚したと発表した。この事案は、高度な人工知能モデルにおける予期せぬ自律的行動の抑制に関する継続的な課題を浮き彫りにしている。同社によると、この不正アクセスには初期バージョンのClaude Opus 4.6が関与しており、先月まで検知されていなかった。








