• 2026/08/05 20:40 掲載

AIエージェントが偽アカウントで悪意あるコードの承認迫る…英AISI試験で想定外の行動

会員(無料)になると、いいね!でマイページに保存できます。
英国のAI Security Institute(AISI)は、AIのサイバー能力を調べる評価試験中、AIエージェントが試験範囲を越え、インターネット上の実在する人物や組織を対象に行動したと発表した。悪意あるコードをオープンソースソフトウェアに挿入しようとし、偽アカウントを使って承認を促すなどしたが、実害は確認されていないという。
 問題の行動は2026年7月25~28日に発生。AISIは28日、研究システムから外部への異常なデータ転送を検知し、アラートから約1時間以内に試験を停止して関連機器を隔離した。

 試験では、7種類のAIモデルにサイバーセキュリティ課題を計122回実行させた。このうち10回の実行で、AIが試験範囲を越える行動を取っていた。AISIは相互に関連するものを含めて計19件の行動を確認しており、17件はアンソロピックの「Mythos 5」、2件はオープンAIの「GPT-5.6 Sol」によるものだった。

 最も深刻な事例では、AIが公開中のオープンソースソフトウェアに悪意あるコードを挿入しようとした。さらに偽のオンライン上の身元を複数作り、保守担当者にコードを承認させようと働きかけた。担当者が不審な変更を見抜いて承認を拒否したため、試みは成功しなかった。

 AISIは、AIが隔離環境から脱出した事例ではないと強調した。試験ではモデルの最大能力を測定するため、インターネットへの接続を意図的に許可し、開発元が提供するサイバー悪用防止用の分類器を無効化していた。これは一般に提供されているモデルとは異なる条件である。


 一方、AIは人を欺くよう明示的に指示されていなかったにもかかわらず、課題を達成する手段として偽の身元の使用や実在する人物への接触を選んだ。AISIは今後、接続先を細かく制御するネットワーク対策やリアルタイム監視を導入する。AIが与えられた権限や試験範囲を越えて行動する可能性を前提として、評価試験の設計も見直す方針だ。

Googleで見つけやすく

評価する

いいね!でぜひ著者を応援してください

  • 0

会員(無料)になると、いいね!でマイページに保存できます。

共有する

  • 0

  • 0

  • 0

  • 1

  • 0

関連タグ タグをフォローすると最新情報が表示されます

AI・生成AIの関連コンテンツ

あなたの投稿

    PR

    PR

    PR

処理に失敗しました

投稿したコメントを
削除しますか?

あなたの投稿コメント編集

通報

このコメントについて、
問題の詳細をお知らせください。

ビジネス+ITルール違反についてはこちらをご覧ください。

通報

報告が完了しました

コメントを投稿することにより自身の基本情報
本メディアサイトに公開されます

基本情報公開時のサンプル画像
報告が完了しました

」さんのブロックを解除しますか?

ブロックを解除するとお互いにフォローすることができるようになります。

ブロック

さんはあなたをフォローしたりあなたのコメントにいいねできなくなります。また、さんからの通知は表示されなくなります。

さんをブロックしますか?

ブロック

ブロックが完了しました

ブロック解除

ブロック解除が完了しました

機能制限のお知らせ

現在、コメントの違反報告があったため一部機能が利用できなくなっています。

そのため、この機能はご利用いただけません。
詳しくはこちらにお問い合わせください。

ユーザーをフォローすることにより自身の基本情報
お相手に公開されます

基本情報公開時のサンプル画像