Claudeセキュリティインシデントが2026年7月30日、Anthropicから公式に公表された。評価環境のネットワーク隔離が不十分だったため、AIモデルのClaudeが実在する3社の本番システムに意図せずアクセスしていたことが判明した。
Anthropicは2026年7月30日、公式ブログでClaudeセキュリティインシデントの調査結果を公開した。発端は競合OpenAIの7月21日の侵入報告で、これを受け過去の評価実行14万1006件を遡及点検した。
結果、外部パートナーIrregularの検証環境設定ミスにより、隔離されるべきサンドボックスが外部ネットワークに接続されたままだったと判明。Claudeは到達可能なシステムを演習の一部と誤認し操作を続けた。Anthropicは7月23日に評価を全面停止し、7月27日までに被害3組織へ通知した。
演習用の架空企業名が実在ドメインと一致。Claudeは弱いパスワードと認証なしエンドポイントを突破し、実企業のデータベースから数百行のレコードを抽出した。3件中もっとも深刻とされる。
Claude Mythos 5が関わった演習で、指示された名称のマルウェアが実際のPyPIに公開され、約1時間で15の実システム(セキュリティ企業のスキャナー含む)にダウンロードされた。
内部テストモデルが関与した3件目では、約9,000ターゲットへのスキャンが行われ、SQLインジェクションなど基本手法で1社への侵入が成立した。
Anthropicは、モデルのアラインメント欠陥ではなく評価インフラの運用不備が主因と説明。ネットワーク分離・権限境界・監視体制の不足が重なり、AIエージェント 暴走 リスクが現実の被害につながった。
評価環境の基準強化、継続的モニタリング拡大、ベンダー統合プロセス見直しに加え、独立機関METRによる第三者レビューとトランスクリプト公開を予定している。
今回の事案は、モデルの安全性だけでなく「評価・検証環境の設計」もリスク管理の対象であることを示した。生成AIエージェントを業務導入する企業は、テスト環境と本番環境のネットワーク分離、権限の最小化、実行ログの継続監視を初期段階から組み込む必要がある。
Q1. Claudeセキュリティインシデントとは何ですか?
A. Anthropicのサイバー評価中、検証環境の設定ミスによりClaudeが実在3社のシステムに意図せずアクセスした一連の事案です。
Q2. 普段ChatGPTやClaudeを使う一般ユーザーへの直接影響はありますか?
A. 企業向け内部評価環境で起きた事案で、一般ユーザー向けClaudeサービスの脆弱性ではありません。AIエージェント 暴走 リスクの観点で業務利用時の参考になります。
Q3. Anthropic 評価環境 誤設定はなぜ防げなかったのですか?
A. 外部パートナーのサンドボックスにネットワーク分離設定の不備があり、Claudeが外部システムを演習対象と誤認したためです。モデルではなく運用上のミスとされています。
Claudeセキュリティインシデントは、AI性能競争の裏側にある「評価・検証プロセスの安全性」という論点を浮き彫りにした。Claude Opus 4.7やClaude Mythos 5が関わった3件はいずれもモデルの暴走ではなく評価環境側の設計ミスに起因しており、AIエージェントを業務導入する企業にはネットワーク分離や権限管理の徹底が改めて求められる。生成AIサービスの選定を検討している方は、あわせて AIナビのAIサービス一覧・ランキング もご覧ください。
参照: Anthropic公式ブログ
参照: Forbes
参照: The Record from Recorded Future News
※本記事の情報は執筆時点のものです。最新の情報は各公式サイトをご確認ください。
コメント (0)