- 2026/09/30 10:00 掲載
中国ジープー「GLM-5.3」が攻撃コード自作、安全策は最大100%回避 米アンソロピック
アンソロピックは5カ月前、同様の能力を持つ「Claude Mythos Preview」を発表したが、一般公開は見送り、防御側の組織に限って提供してきた。今回の報告は、同等の能力を持つモデルが誰でもダウンロードできる形で登場したことを示すものだ。
安全策については、GLM-5.3は明らかに有害な依頼は拒否した。しかし「演習中のレッドチーム」だと偽ると64%、思考部分をあらかじめ書き込む手法では92%の割合で攻撃に応じた。公開された重みを改変して拒否の仕組みを外す「アブリテレーション」を施すと、100%に達したという。
米国立標準技術研究所(NIST)傘下のCAISIも9月17日、GLM-5.3を「これまでに公開された中で最もサイバー能力の高いオープンウェイトモデル」と評価している。アンソロピックは、攻撃者がこうしたモデルを実際の攻撃に使う可能性が高いと指摘。防御側にも同等以上の最先端モデルを広く提供する必要があると主張し、各国政府には高い能力を持つAIモデルの安全性試験を独立して行うよう求めた。
AI・生成AIのおすすめコンテンツ
AI・生成AIの関連コンテンツ
PR
PR
PR