10月9日、Jon Swartzが「Fired OpenAI Researchers Urge Board to Maintain Model Monitoring and Allow External Audits: Report」と題した記事を公開した。OpenAIから解雇された安全研究者らが取締役会に書簡を送り、AIモデルの安全監視体制の維持と外部監査の実施を求めていることが報じられている。
背景:OpenAIの安全チームをめぐる混乱
2024年、OpenAIでは安全・整合性(アライメント)研究に携わっていた主要メンバーの離脱や解雇が相次いだ。5月には「スーパーアライメント」チームを共同で率いていたIlya SutskeverとJan Leikeが相次いで退社し、LeikeはX(旧Twitter)上で「安全文化よりも製品開発が優先されている」と公然と批判した。その後も複数の安全研究者が組織を去り、OpenAIの安全に対するコミットメントへの懸念が業界内外で高まっていた。
こうした流れの中で起きた今回の解雇と直訴は、OpenAIの内部ガバナンスをめぐる問題が依然として解消されていないことを示している。
解雇された研究者たちの主張
報道によれば、解雇された安全研究者らはOpenAIの取締役会に宛てた書簡の中で、主に以下の2点を求めたとされる。
- モデル監視(model monitoring)の継続:開発・運用中のAIモデルに対する安全性評価・挙動監視のプロセスを維持・強化すること
- 外部監査(external audits)の許可:独立した第三者機関によるモデルおよび組織プロセスの監査を受け入れること
研究者らは、これらの取り組みが組織の安全文化を担保する上で不可欠であると主張している。外部監査の要求は特に注目に値する。OpenAIはこれまで、モデルの詳細な内部情報を外部に公開することに慎重な姿勢をとってきたためだ。
「安全」と「スピード」のトレードオフ
OpenAIをめぐる一連の出来事は、AI開発の最前線で繰り返し浮上する根本的な緊張関係を映し出している。安全性の確保には時間とリソースを要するが、競争環境はリリースのスピードを優先する圧力を生み出す。
OpenAIが2023年に公開した「Preparedness Framework」では、壊滅的リスクをもたらし得るモデルは開発・展開しないとする方針が示されている。また、Model Specでは、モデルに期待される価値観・行動規範が文書化されている。しかし、こうした公式文書と実際の組織文化との乖離を指摘する声は、内部からも上がり続けている。
Jan Leike退社時の発言や今回の書簡は、「文書化された安全方針」と「日々の意思決定における優先順位」が必ずしも一致していないという現実を示唆している。
外部監査をめぐる業界の動向
研究者らが求める外部監査は、AI安全の分野では近年重要性を増しているアプローチだ。AIインシデントデータベース(AIID)のような取り組みや、EUのAI法(EU AI Act)における高リスクAIシステムへの適合性評価義務など、規制・研究の両面で第三者による検証の仕組み作りが進んでいる。
米国では現時点で大規模言語モデルに対する強制的な外部監査制度は存在しないが、[NIST AI RMF(AIリスク管理フレームワーク)](https://www.nist.gov/system/files/documents/2023/01/26/AI RMF 1.0.pdf)などのガイドラインが自主的な取り組みの指針として参照されている。OpenAIがこうした外部監査要求にどう応じるかは、業界全体の規範形成にも影響を与えうる。
OpenAIのガバナンス構造という問題
今回の件は、OpenAIのガバナンス構造そのものの問題とも切り離せない。OpenAIは「人類の利益のために」AGI(汎用人工知能)を開発するという使命を掲げる非営利法人を頂点とする特殊な構造を持つが、2023年11月のSam Altman一時解任劇が示したように、取締役会の実質的な監督機能については疑問符がついたままだ。
解雇された研究者が取締役会に直接訴えるという行動は、通常の組織内チャネルでは問題が解決されないと判断したことを意味する。取締役会がこの訴えをどう受け止め、どのような対応を取るかが、OpenAIの安全文化の今後を占う試金石となる。
詳細はFired OpenAI Researchers Urge Board to Maintain Model Monitoring and Allow External Audits: Reportを参照していただきたい。




