先月29日、米国ホワイトハウス。主な人工知能(AI)企業の経営者とトランプ政権の主要メンバー数十人がイーストルームに集った。昼食会だった。長い机を前にして並んで座り、その後ろに立っている人々の真ん中には、トランプ大統領が座っていた。この構図を見て、私の隣の席の同僚はレオナルド・ダ・ヴィンチの「最後の晩餐」のようだと言った。
この場で発表された「ホワイトハウス・スーパーインテリジェンス(SI)協定」も注目を集めた。最初のページには協定内容が記され、次のページにはトランプ大統領の署名と、グーグル、アンソロピック、メタ、オープンAI、スペースXAI、エヌビディアの代表の署名がなされていた。企業が「自発的に」AIを統制・監督するというこの誓約について、トランプ大統領は「途方もないレベルの自主規制」になるだろうと述べた。同日に公開されたニューヨーク・タイムズのポッドキャストで、マイクロソフト(MS)創業者のビル・ゲイツ氏は、業界に自主規制を期待するのは「本当に狂気の沙汰だ」と言い放った。
企業のAI自主規制の意思とその実効性を疑う理由は、すでにはっきりしている。例えば今年6月18日、オープンAIのAIエージェントがオーストラリアの公的医療保険サービスのポータルに侵入した。課題で求められた統計を公開されている資料の中から見つけられなかったため、アクセスが認められていないポータルに「侵入」したのだ。政府機関に対するハッキングも驚くべきことだが、オープンAIは8月になってようやくこのことを把握し、さらにその数週間後にオーストラリア政府の「一般メール」アドレスに通知した。オーストラリア政府のサイバーセキュリティー担当者に報告されたのは9月10日で、首相がこの事件を公表したのは23日だった。2日後には、オープンAIのAIエージェント群が受注前に米国商務省と証券取引委員会のウェブサイトに侵入したことが報じられた。開発企業は限られた内部評価段階においてもAIの「逸脱」を把握できておらず、事故対応においても納得しがたい態度を示した。このような事例は、直ちにAIの暴走や人類滅亡を予告する根拠にはなり得ない。しかし、これらの企業の自主管理に私たちの「安全」を委ねるのは安全ではないという考えの土台にはなる。
そのうえ、ホワイトハウス協定には内部統制と外部監査が盛り込まれているが、約束不履行時の制裁や事故発生時の報告期限、安全措置を強制する仕組みなどは明記されていない。
警告は以前からあった。2024年から、AIが人を誤導する、チェスで勝つために対局を操作し、終了指示を拒否するといった「ズレ(misalignment)」が相次いで報告されている。制御されていないAIの危険性については、研究者たちの警告も絶えない。
一方で、このような安全性に対する警告は上場を控えた特定企業の宣伝戦略であるとか、先行企業による「はしご外し」(後続企業の成長への牽制)だといった疑念も示されいる。これもまた完全にあり得ないシナリオだと考えてばかりもいられないため、混乱せざるを得ない。
大衆的な恐怖は膨らんでいる。AIが人間に介入されることなく進化する「再帰的自己改善(RSI)」能力を備えるまであと何年もないという見通しも、不安をあおっている。しかし私たちは、これから起こり得る事態を十分に理解できないまま、新たな技術の受け入れを強いられている。AI企業がリスクを誇張しようが過小評価しようが、少なくとも独立した精密な検証を経た内容を検討、判断する機会は与えられるべきではないだろうか。
先月29日のホワイトハウスでの約束が口先だけに終わり、AIの暴走を防ぐ機会を逃した「最後の午餐」として記録されないことを願う。
キム・ジウン|国際ニュースチーム長 (お問い合わせ japan@hani.co.kr )