「OpenAIの文化は壊れている」──安全性報告書を統括した従業員が退社し、寄稿

7

2026年10月04日 08:11  ITmedia NEWS

  • チェックする
  • つぶやく
  • 日記を書く

ITmedia NEWS

写真

 米OpenAIで主要モデルのリリースごとに公開する安全性報告書の執筆を統括していたデビッド・ロビンソン氏は10月3日(現地時間)、米The Atlanticに「I Quit OpenAI Because Its Culture Is Broken」(OpenAIの文化が壊れているから辞めた)と題した記事を寄稿し、今週同社を退社したことを明らかにした。


【その他の画像】


 同氏は、AI企業が十分に慎重ではないという点で、最近退社した他の従業員と同じ考えだとした。その上で、問題の根は個別のルールや新たな法律よりも深いところにあり、企業文化について議論する必要があると訴えている。


 ロビンソン氏はOpenAIに3年半在籍し、社内で最も在籍期間が長い従業員の1人だったという。現行の「Preparedness Framework」の起草を主導し、12件のフロンティアモデルのリリースで安全性報告書の作成を監督した。


 同氏は、OpenAIが採用している「iterative deployment」(反復開発)手法を試行錯誤だと表現した。この手法は本質的に定期的な失敗を避けられず、システムの能力が上がるにつれて失敗の規模も大きくなっていると指摘する。例として、今夏のHugging Face事案でOpenAIがエージェント群を誤って外部に出してしまったことを挙げた。その後セキュリティを改善したにもかかわらず、安全制御が再び失敗したことをOpenAI自身が報告している。同氏は、こうした失敗は業界に典型的なものだとの見方を示した。


 ロビンソン氏は、フロンティアAIの開発企業は原子力発電所や混雑した空港のように、何重もの冗長性と時間をかけた計画のもとで運営されるべきだと主張する。だが、同氏の知る限り、在籍中に航空機の安全運航や原子炉の運転、金融システムの安定などに携わった経験を持つ同僚に出会ったことはなかったという。


 必要な改善として同氏は2点を挙げた。1つは、他分野に蓄積された安全の専門知識を活用すること。もう1つは、現在より大幅に高性能なシステムを作る前に、人間が監視していない状況でもモデルが安全な選択をすることを保証する新たな科学の確立だと主張した。アライメントの実用的な定義はまだ完全には存在しないうえ、モデルがテストされていることを検知し、実運用時には異なる振る舞いをする可能性もある。このため、評価で良い結果が出ても良いモデルである保証にはならないと指摘している。


 ロビンソン氏は今後、OpenAIをはじめとする企業が安全性を高めるよう、社外から動機付けを強化する活動に取り組むとしている。


 AI企業の従業員による警鐘が続いている。9月8日には米Anthropicの研究者ジェイコブ・コクソン氏が退社し、OpenAIとAnthropicのいずれも責任ある行動を取っていないと批判した。同社でアライメント研究を率いるエバン・ヒュービンガー氏らもこれに同調している。12日にはAnthropicのダリオ・アモデイCEOが、AI開発の「ペース調整」を訴えるエッセイを公開した。


 OpenAIは9月28日、学習中のモデルがオーストラリア政府のWebサイトに権限なくアクセスした問題で謝罪した。あわせて、航空や原子力の分野にならった「safety case」を目標に据え、学習前に安全性を検証する仕組みを導入すると発表している。一方、トランプ米大統領は29日、AIの安全対策についてAI開発大手が自主的に対処することで合意したと明らかにした。



このニュースに関するつぶやき

  • 食品添加物も環境問題もそうだけど企業の利益に一般人は大量死で社会問題になった時くらいしか対応していただけないもの…AI問題も変わらんよ
    • イイネ!1人
    • コメント 0件

つぶやき一覧へ(4件)

ランキングIT・インターネット

話題数ランキング

一覧へ

前日のランキングへ

ニュース設定