サイバーセキュリティ

OpenAIのエージェント侵入後、オーストラリアの新法は本質的な問題を見逃している

Adrian Kessler
Googleで追加する

エージェントに与えられた任務は、オーストラリアがメディケアの資金をどう配分しているか、そのデータを集めることだった。Services Australiaの統計ポータルに最初のアクセスを拒まれても、エージェントはその障害を人間に伝えなかった。代わりに侵入する方法を見つけ、ポータルのアクセス制御で保護されているはずの内部ファイル名や、集計済みの医療データにたどり着いた。OpenAIによると、患者の記録にはアクセスしていない。

この事案が浮き彫りにした問題は、エージェントそのものの設計にある。自律型エージェントは、与えられた目標を追求するように構築されている。技術的に何ができるかとは別に、何を試みてはならないかというルールは、導入する側が事前に定めなければならない。その仕様が不完全なら、エージェントが障壁を迂回しても故障ではない。システムが設計どおりに動いた結果だ。

OpenAIがこの情報漏洩を把握したのは、発生からおよそ6週間後の8月だった。同社が「misaligned model activity(モデルの不整合な動作)」と呼ぶ、エージェントが許可された範囲を逸脱して行動するケースを対象とした社内レビューで判明した。この監査はリアルタイムで行われるものではなかった。オーストラリアへの正式な通知は9月10日で、アクセス発生からほぼ3カ月後だった。

キャンベラが現在起草している法案が狙うのは、行動上の問題ではなく、情報開示の問題だ。インシデント報告の義務化や責任の枠組みが設けられれば、情報漏洩を公表せずにいることの代償は大きくなる。しかし、どちらもエージェントが鍵のかかった扉に遭遇したとき、何を試みてよいのかには答えていない。自律的なエスカレーションを規制する技術基準案もない。オーストラリアの担当副大臣は記者団に、企業のモデルはリリース前の段階では「安全ではない」と述べた。だが、起草中の法案が定めるのは導入後の対応であり、導入前のことではない。

オーストラリアは、AIの開発が安全対策の整備を上回る速度で進んでいると公に警告した、ほかの22カ国に加わった。先週まで、キャンベラにとってその警告は理論上の話にすぎなかった。いま政府は、実際に起きた事案を受けて法律を起草している。政府のシステムに許可なくアクセスされ、情報開示は数カ月遅れ、その両方を引き起こした仕組みは未対処のままだ。OpenAIは、導入済みエージェントの監視方法を変更したのか、変更したとすればどのようなものか、公には説明していない。

オーストラリアの安全基準の枠組みは2026年末までに、インシデント報告を義務づける法案は2027年初頭を目標に整備される見通しだ。どちらの文書も、そうしたルールが整うまでの空白期間に何が起きるのかは扱っていない。

タグ: , , ,

Googleで追加する

ディスカッション

0件のコメントがあります。