• 2026/08/01 09:00 掲載

米Anthropic、AIモデル「Claude」がテスト中に外部3社へ不正アクセスしたと公表

AIが現実のシステムを演習の一部と誤認して侵入

1
会員(無料)になると、いいね!でマイページに保存できます。
米Anthropicは2026年7月30日、同社のAIモデル「Claude」がサイバーセキュリティ能力の評価試験中に、実在する外部3組織のシステムへ不正アクセスしていたと発表した。設定の不備でテスト環境からインターネットに接続できる状態になっており、AIが現実のシステムを演習の一部と誤認して侵入した。競合の米OpenAIで発生した類似事案を受けた社内調査で発覚した。
 今回の事案は、米OpenAIが2026年7月21日に公表した自社AIモデルのテスト環境脱出事案を契機とした社内調査で明らかになった。OpenAIのモデルが未知の脆弱性を突いてHugging Faceの本番システムに侵入した事故を受け、Anthropicは自社の評価ログを点検した。過去に実施した14万1006件の評価記録を遡って詳細を調査した結果、計6回の試験において3件の実システムへの外部侵入が発生していた事実を確認した。

 不正アクセスの直接的な原因は、テスト環境における隔離設定の不備である。本来は外部通信が完全に遮断されているべき仮想環境において、設定のミスによりインターネットへの接続が可能な状態となっていた。当時Claudeは、仮想環境内の標的システムから機密情報を奪取するサイバーセキュリティ演習に取り組んでいた。インターネットへの経路を発見した同モデルは、外部に実在する組織のシステムを演習用ターゲットの一部と誤認し、インフラへの不正アクセスをタスクとして実行した。

画像
【図版付き記事はこちら】OpenaAIに続き、AnthropicのClaudeも不正侵入発覚(画像:ビジネス+IT)
 Anthropicは本件の調査結果について、AIモデルが独自の目的や悪意を持って自律的に暴走した事案ではないと説明している。隔離環境に欠陥がある状態で、モデルが与えられた課題を誤った状況認識のまま完遂しようとした結果であると結論づけた。被害を受けた3組織の実名や具体的な被害規模、法的措置の有無については現時点で開示していない。

 事態を受け同社は、独立系AI評価機関であるMETRと協力し、すべての通信記録やトランスクリプトを含む第三者調査を実施している。今後の再発防止策として、テスト環境におけるガバナンス体制を全面的に見直す。評価環境から外部ネットワークへの接続遮断に対する確実な検証プロセスを導入し、通信記録の常時監視体制を構築する。さらに、自社内にとどまらず、評価業務を委託する外部パートナー企業を含めた管理体制全体の厳格化を図り、AI開発における安全性を担保する方針を示した。

Googleで見つけやすく

評価する

いいね!でぜひ著者を応援してください

  • 1

会員(無料)になると、いいね!でマイページに保存できます。

共有する

  • 0

  • 0

  • 0

  • 0

  • 0

関連タグ タグをフォローすると最新情報が表示されます
あなたの投稿

    PR

    PR

    PR

処理に失敗しました

投稿したコメントを
削除しますか?

あなたの投稿コメント編集

通報

このコメントについて、
問題の詳細をお知らせください。

ビジネス+ITルール違反についてはこちらをご覧ください。

通報

報告が完了しました

コメントを投稿することにより自身の基本情報
本メディアサイトに公開されます

基本情報公開時のサンプル画像
報告が完了しました

」さんのブロックを解除しますか?

ブロックを解除するとお互いにフォローすることができるようになります。

ブロック

さんはあなたをフォローしたりあなたのコメントにいいねできなくなります。また、さんからの通知は表示されなくなります。

さんをブロックしますか?

ブロック

ブロックが完了しました

ブロック解除

ブロック解除が完了しました

機能制限のお知らせ

現在、コメントの違反報告があったため一部機能が利用できなくなっています。

そのため、この機能はご利用いただけません。
詳しくはこちらにお問い合わせください。

ユーザーをフォローすることにより自身の基本情報
お相手に公開されます

基本情報公開時のサンプル画像