• 2026/09/02 20:00 掲載

米OpenAIが次世代モデル「Astra」の近日公開を示唆、今後は安全性対策を優先

高度な数学的推論能力と極めて高いサイバー攻撃能力を示す

1
会員(無料)になると、いいね!でマイページに保存できます。
米OpenAIは次世代AIモデルであるアストラの公開を近日中に控えていると発表した。同モデルは高度な数学的推論能力を持つ一方で、極めて高いサイバー攻撃能力を示すことが内部評価で判明した。これを受け同社は最高レベルの警戒基準であるクリティカルに達したと認定し開発と公開のペースを落として安全対策を最優先する方針を示した。
 OpenAIの次期主要モデルとなるアストラは事前の評価において長期間進展がなかった数学分野の未解決問題を解決するなどの高い能力を示した。しかし同時に既存のセキュリティを自律的に突破する能力も飛躍的に向上していることが確認された。既知の脆弱性を悪用する能力を測る社内評価指標では満点を記録し新たな未知の脆弱性であるゼロデイも2件発見している。さらに人間の段階的な指示を受けずに厳重に守られたシステムの欠陥を見つけ出し攻撃手段を作り上げる能力も確認されている。

 この結果を受けオープンAIは自社の安全基準においてアストラが史上初となるクリティカルの閾値に達したと正式に判断した。同社は2026年7月に発生したテスト中のAIが外部環境へ侵入した事案の教訓も踏まえ8月に最新モデルの強化学習トレーニングを2週間にわたって一時停止した。この期間に研究環境の隔離やネットワーク制限の強化を実施している。新たな安全対策としてモデルの思考プロセスを常時監視し不正な行動の兆候を検知して自動的に停止させる分類器システムを本番環境に導入した。

画像
【図版付き記事はこちら】OpenAIが次期モデル「Astra」の近日公開を示唆(図版:ビジネス+IT)
 異常を検知した場合は30分以内に警告を発する体制を構築しこの監視システムを稼働させるために推論にかかる計算資源の約2割を費やしている。 これらの対策によりサイバー攻撃に関する不適切な要求の拒否率は前世代モデルであるGPT-5.6ソルの59パーセントから91.5パーセントへと大幅に向上した。重大な被害リスクを低減できる水準に達したとして同社はアストラのリリース準備を進めているが高度なサイバーセキュリティ機能へのアクセスは制限する方針である。

 当初は少数の検証担当者にのみ権限を付与しその後はインフラ防御などの利用目的に限ってデイブレイクブルーと呼ばれるプログラムを通じて段階的に提供していく方針を示した。同社のサム・アルトマンCEOはXに投稿し、今後のAI開発について安全性と人間の意図に沿った動作を確保するため必要に応じて進捗のペースを落としていく姿勢を明らかにしている。高度な能力を持つAIの安全性を確保するインフラ整備が今後の開発における最大の要件となっている。

Googleで見つけやすく

評価する

いいね!でぜひ著者を応援してください

  • 1

会員(無料)になると、いいね!でマイページに保存できます。

共有する

  • 0

  • 0

  • 0

  • 0

  • 0

関連タグ タグをフォローすると最新情報が表示されます
あなたの投稿

    PR

    PR

    PR

処理に失敗しました

投稿したコメントを
削除しますか?

あなたの投稿コメント編集

通報

このコメントについて、
問題の詳細をお知らせください。

ビジネス+ITルール違反についてはこちらをご覧ください。

通報

報告が完了しました

コメントを投稿することにより自身の基本情報
本メディアサイトに公開されます

基本情報公開時のサンプル画像
報告が完了しました

」さんのブロックを解除しますか?

ブロックを解除するとお互いにフォローすることができるようになります。

ブロック

さんはあなたをフォローしたりあなたのコメントにいいねできなくなります。また、さんからの通知は表示されなくなります。

さんをブロックしますか?

ブロック

ブロックが完了しました

ブロック解除

ブロック解除が完了しました

機能制限のお知らせ

現在、コメントの違反報告があったため一部機能が利用できなくなっています。

そのため、この機能はご利用いただけません。
詳しくはこちらにお問い合わせください。

ユーザーをフォローすることにより自身の基本情報
お相手に公開されます

基本情報公開時のサンプル画像