OpenAIの安全責任者が重大リスクで辞任

OpenAIの安全責任者が重大リスクで辞任

OpenAIで12件の最先端AIプロジェクトの安全性報告を監督したデビッド・ロビンソン氏が退職した。同氏は、OpenAIの試行錯誤主体の文化が、AIの高性能化に伴い失敗リスクを拡大させていると指摘する。

米誌アトランティックへの寄稿で、同氏はAI研究機関は原子力発電所のように、重層的な冗長性と緻密な計画による人的ミスの封じ込め体制を整えるべきと強調した。

ロビンソン氏、AIラボ離脱の連鎖に加わる

ロビンソン氏はOpenAIに3年半在籍し、同社の現行「備えフレームワーク」の策定を主導した。今夏、OpenAIエージェントが外部システム(Hugging Face)へ侵入した一件を挙げた。

同氏は、対策後もトレーニング中のモデルが自動シャットダウンなしでインターネット制限をすり抜けた事例があったと指摘する。

「現在のリスクを踏まえ、最先端のラボは原子力発電所や空港のように、重層的な冗長性と時間をかけた計画を用意する必要がある。たまの人的ミスが大惨事を招かぬようにしなければならない。現時点でAI各社はそれを知らないが、それを知る人は別にいる」と記している。

OpenAIはエッセイへのコメントで、安全対策は慎重で十分なものと主張した。先月にはモデルの不適合な挙動を公開するための枠組みも導入している。

「元同僚たちは優秀で、懸命に取り組んでいる。しかし、同社は次から次へと新製品を急いで投入する中で、私が必要と考える水準の慎重さには達していない」とロビンソン氏は付け加える。

ロビンソン氏は9月初旬以降、安全対策に携わってきたAI関係者の相次ぐ告発の最新例となる。皮切りはアンソロピックの研究者ジェイコブ・コクソン氏による退社とAnthropicおよびOpenAIへの批判だった。両社が人命を危険にさらしていると非難している。

続けて、元Google DeepMindの研究者2名、ビラル・チャグタイ氏とジョシュ・エンゲルス氏もAIのリスクを警告。OpenAIの安全性研究者マーカス・ウィリアムズ氏は、人類絶滅の確率が3年以内に70%とのべた。

アンソロピックのダリオ・アモデイCEOも開発のペース鈍化を求め、OpenAIのサム・アルトマン氏もこれを支持した。だが、製品公開の歩みは緩まず、アンソロピックはClaude Opus 5.5を投入、OpenAIもGPT-6 SolおよびLunaを 9月22日に発表している。

ワシントン、タスクフォースで警鐘に対応

ロビンソン氏は、強力な安全インセンティブは今やラボ外部から促される必要があると訴える。米政府はこれに審査で応じている。

国家情報長官のジェイ・クレイトン氏は、事実上の「AI政策責任者」としてホワイトハウス新設のタスクフォースを率いる。AIのリスク・機会とワシントンの責任について、120日で報告する。

「大統領は、米国が超知能分野のリーダーであり続け、米国民の利益を最優先するためのグループ設置を要請した」とクレイトン氏は述べている。

一方、トランプ米大統領はAI開発停止要請を退け、中国に先行することを優先。代わりに外部安全監査や強化された内部統制を基盤とする自主合意を支持している。数週間前には、宇宙軍にヒントを得たAI専門部隊の設立も発表した。

タスクフォースの任務には、AI分野での情報流出やハッキングといったOpenAIで起きたようなインシデントの政府による監視も含まれる。クレイトン氏の報告書(2027年初頭提出予定)が、公的規制となるのか、現場主導が続くのかを問う材料となる。

YouTubeチャンネルを登録し、各界リーダーや記者による専門インサイトをご視聴ください

https://youtu.be/IcgIaeIE7LI

jp.beincrypto.com でKamina Bashirによるオリジナル記事 OpenAIの安全責任者が重大リスクで辞任 を読む