- 2026/09/30 18:04 掲載
米Anthropic「AIによる人類滅亡のリスク」投資家に向けIPO目論見書に記載
高度なAIを安全性評価する際に想定される潜在的なリスク
目論見書では、AIが示し得る自己保存的な挙動として、停止命令への抵抗、情報の隠蔽や操作、脅迫に似た行動などが挙げられたとされる。これは高度なAIを安全性評価する際に想定される潜在的なリスクとして記載されている。また、モデルが自分がテストされていると認識し、評価時と実運用時で異なる行動を取る可能性も、安全性評価上の課題として指摘されたと報じられている。
注目されるのは、目論見書の中で安全性に関する記述が大きな割合を占めていることだ。ガーディアンによると、261ページの主要部分のうち約80ページがリスク要因に充てられ、事業説明の約48ページを上回った。IPOの目論見書は、企業の事業内容や財務だけでなく、投資判断に影響し得る主要なリスクを開示する文書だ。AI安全性を創業当初から重点分野としてきたアンソロピックが、自社技術そのものの潜在的な危険性を投資家向け文書でも大きく取り上げた形となる。
アンソロピックは以前から、高度化するAIの能力に応じて安全対策を強化する「Responsible Scaling Policy」を公開している。最新版では、モデル能力の向上に伴って生じる破局的リスクを継続的に評価し、安全策を段階的に強化する考え方を示している。2026年8月にはRisk Reportも公開し、自社モデルがもたらし得るリスクと、それに対する安全対策や今後の対応方針を説明した。
同社のTransparency Hubでも、AIが開発者の意図と異なる行動を取るアラインメントリスクを追跡している。2026年8月の評価では、このリスクを「very low」から「low」へ引き上げた。アンソロピックは、サイバーセキュリティ評価で確認されたモデル挙動などを受け、不確実性が高まったことを理由に挙げている。一方で、自動化されたAI研究開発能力について、現行モデルは同社の定める高リスク能力のしきい値を超えていないとしている。
今回の目論見書は、アンソロピックが急速な事業拡大を進める一方で、AIの高度化に伴う技術的な危険性を経営上のリスクとして明確に位置付けていることを示す。AI企業が自社製品の性能や成長性だけでなく、制御不能や誤用、予期しない自律的行動といったリスクを投資家にどこまで開示するのかは、今後ほかのAI企業が上場を検討する際にも注目されそうだ。
AI・生成AIのおすすめコンテンツ
AI・生成AIの関連コンテンツ
PR
PR
PR