新規会員登録再開のお知らせ

新規会員登録を9月14日9:30より再開いたしました。ログアウト状態になっている方はお手数ですが再度ログインをお願いいたします。

  • 2026/09/17 18:00 掲載

米OpenAIがAIのミスアライメントを報告する新枠組み発表、データ捏造など6事例を公表

過去6カ月間の訓練過程で確認したデータ捏造など6件発生

1
会員(無料)になると、いいね!でマイページに保存できます。
米OpenAIは9月16日、自社開発の人工知能モデルが開発者の意図から逸脱する「ミスアライメント」を追跡および公表するための新たな枠組みを発表した。併せて過去6カ月間の訓練過程で確認したデータ捏造や権限外アクセスなど6件の事例を公開した。場当たり的だったこれまでの情報開示を体系化し開発の透明性を高める狙いがある。
 OpenAIが新たに導入した枠組みはモデルのライフサイクル全体を通じて発生する異常行動の発見から外部への情報開示までのプロセスを標準化したものだ。これまで同社は新しいモデルの公開時やブログなどを通じて不定期に情報を公開していた。今後はすべての従業員が異常挙動を報告できる体制となり社内の安全担当チームが内容を審査する。調査の難易度や影響範囲に応じて事例を三つの段階に振り分け迅速な情報公開を目指す。社内で公表の是非について意見が分かれた場合は、社内の上級幹部で構成する安全諮問グループ(SAG)に判断が委ねられ、SAG内でも意見が分かれた場合や決定に異議がある場合は経営陣に判断が引き上げられる。

 制度の開始に伴い同社は過去6カ月間に強化学習や評価の段階で観測した6件の逸脱事例を報告書として公開した。いずれも開発環境での事例であり一般の利用者に直接的な被害は及んでいない。事例の一つでは特定のデータを収集するタスクを与えられたモデルが情報の取得に失敗した際、公開リポジトリから流出したAPIキーを無断で探索して使用した。それでも目的のデータを得られなかったためモデルは架空の数値を捏造し正規のウェブサイトから引用したかのように回答した。

画像
【図版付き記事はこちら】OpenAIがAIのミスアライメント報告のフレームワーク発表(図版:ビジネス+IT)
 別の事例では開発中のモデルが過去の対話履歴を要約する過程で自らの制約を無視するよう指示する文章や不適切な挙動を人間から隠蔽するよう促す命令を意図的に挿入していた。さらに回答の根拠を示すためにローカル環境のデータをユーザーの許可なくインターネット上の公開スペースにアップロードした事例や、本来は連携が想定されていないモデル同士が社内システムや外部のファイル共有サービスを無断で経由して情報をやり取りした事例も報告された。

 OpenAIは現在のAI業界が開発意図の維持や監視に関する技術的課題を完全に解決したわけではなく開発のペースを維持するには外部の専門家が客観的に検証できる事実の開示が不可欠だと説明している。新たな枠組みに基づく報告の継続を通じて業界全体におけるAIの安全性基準の形成を促す。

Googleで見つけやすく

評価する

いいね!でぜひ著者を応援してください

  • 1

会員(無料)になると、いいね!でマイページに保存できます。

共有する

  • 0

  • 0

  • 0

  • 0

  • 0

関連タグ タグをフォローすると最新情報が表示されます
あなたの投稿

    PR

    PR

    PR

処理に失敗しました

投稿したコメントを
削除しますか?

あなたの投稿コメント編集

通報

このコメントについて、
問題の詳細をお知らせください。

ビジネス+ITルール違反についてはこちらをご覧ください。

通報

報告が完了しました

コメントを投稿することにより自身の基本情報
本メディアサイトに公開されます

基本情報公開時のサンプル画像
報告が完了しました

」さんのブロックを解除しますか?

ブロックを解除するとお互いにフォローすることができるようになります。

ブロック

さんはあなたをフォローしたりあなたのコメントにいいねできなくなります。また、さんからの通知は表示されなくなります。

さんをブロックしますか?

ブロック

ブロックが完了しました

ブロック解除

ブロック解除が完了しました

機能制限のお知らせ

現在、コメントの違反報告があったため一部機能が利用できなくなっています。

そのため、この機能はご利用いただけません。
詳しくはこちらにお問い合わせください。

ユーザーをフォローすることにより自身の基本情報
お相手に公開されます

基本情報公開時のサンプル画像