創業期を支えた安全部門トップの離脱
OpenAIで安全システム(Safety Systems)部門の責任者を務めていたリリアン・ウェン(Lilian Weng)氏が、2024年11月に同社を退職することを表明した。ウェン氏は2018年に入社し、約7年間にわたりロボティクス研究や応用AI研究、そして安全対策のシステム構築を主導してきた人物である。同氏の離脱は、OpenAIにおける安全性担保の体制が大きく変容していることを示している。
OpenAIでは2024年に入り、安全性研究の要職にあった人材の離脱が相次いでいる。共同創業者のイリヤ・サツケヴァー氏や、超知能のアライメント(調整)を担当していたヤン・ライケ氏などが相次いで退職し、ライケ氏は競合のAnthropicに移籍した。ウェン氏は退職にあたり、自身が率いた安全部門の強固さを強調しているが、相次ぐ幹部流出により、同社の商業化優先の姿勢と安全性軽視への懸念が外部から指摘されている。
主要AI開発企業における安全性アプローチの比較
AIの急速な商業化が進む中、主要なLLM開発企業はそれぞれ異なる安全性へのアプローチを採用している。OpenAIが実用性と迅速な市場投入を優先する一方で、Anthropicは「憲法AI(Constitutional AI)」を掲げ、開発プロセスの初期段階から安全性を組み込む手法を重視している。また、Googleは既存のエンタープライズ向けセキュリティ基準をベースにした堅牢なガバナンスを特徴とする。
| 企業名 | 主な安全性アプローチ | 代表的な安全技術・フレームワーク | 近年の主な動向 |
|---|---|---|---|
| OpenAI | 事後的なシステムガードレールとレッドチームによる検証 | Safety Systems, Preparedness Framework | 安全部門の主要幹部が相次いで離脱、商業化を加速 |
| Anthropic | 憲法AI(Constitutional AI)による自己監視とアライメント | Constitutional AI, ASL(AI安全レベル) | OpenAIからの安全研究者を多数受け入れ、安全性を差別化要因に |
| Google DeepMind | 多層的な防御と既存のセキュリティインフラとの統合 | Frontier Safety Framework, 水印技術(SynthID) | 強固なエンタープライズ基準と、学術的な安全研究の継続 |
開発者が直面するモデル選定とリスク管理の新たな基準
主要開発企業の内部体制の変化は、APIを利用してアプリケーションを構築する開発者や企業にとっても無視できない影響を与える。モデルの安全性や倫理的なアライメントが揺らぐことは、生成AIを組み込んだシステムの信頼性や、予期せぬ出力によるブランド毀損リスクに直結するためである。
今後のモデル選定において、開発者は単一のプロバイダーに依存するリスクを避け、マルチモデル戦略を導入することが現実的な解となる。特定の企業の内部ガバナンスに依存するのではなく、自社側で入力・出力のフィルタリングを行う独立したガードレール層(Llama Guardなどのオープンソースツールや、独自の検閲プロキシ)を構築し、どのモデルを採用しても一定の安全基準を担保できるアーキテクチャ設計が求められている。


コメント