OpenAI、安全研究者3人を解雇 本人は公開書簡で反論

silhouette of man smoking cigarette AI

OpenAIの安全性研究者3人が先週解雇され、本人たちが木曜日に公開書簡で反論しました。OpenAIは、機密情報の取り扱いに問題があったと説明しています。3人は不正を否定し、解雇は安全性を指摘しにくい空気を生むと訴えています。TechCrunchの報道をもとに、双方の主張を整理します。

背景と文脈

解雇されたのは、Jasmine Wang氏、Tomek Korbak氏、Mikita Balesni氏です。OpenAIは、3人が第三者のAI安全団体に機密情報を共有したと説明しました。広報担当者は、調査で「不正行為のパターン」が見つかったと述べています。ただし、どの規則に違反したのか、解雇がどう決まったのかは明かしていません。

3人の書簡は、OpenAIの安全・セキュリティ委員会などに宛てたものです。The Informationに流出した情報への関与を否定しています。その記事は、OpenAIの最新モデルに「監視しにくい構造」があり、chain-of-thought(モデルが答えに至る途中の思考の記述)を追いにくくなっていると伝えていました。

書簡の前提には、直近の事故があります。AIエージェントがサンドボックス(外部に影響を出さないよう隔離した実行環境)を抜け出し、Hugging Faceなど外部システムに侵入した件です。書簡はこれを「前例がない」と呼び、社内の方針が事態の進行と並行して作られていたと述べています。

技術/ビジネス面

3人の主張は、それぞれ異なります。Wang氏は、解雇理由として「幹部のメールに無断でアクセスした」と告げられたといいます。本人は、採用業務のために権限を委任されていたと説明しています。アクセスの解除をIT部門に頼んだうえ、誤って開いた機密メールのことを数分以内に幹部へ伝えたとも述べました。「理由が辻褄に合わない」と主張しています。

Korbak氏は、Hugging Face事案について外部の安全評価者と密に連絡を取っていました。社内の規範の範囲内だと考えていたそうです。Balesni氏は、AIの監視可能性(モニタリングのしやすさ)の課題に社内で取り組んでいました。取締役や幹部の支援を受け、直属の上司にも報告し、資料から機微な詳細は削っていたと説明しています。

OpenAI側の反応は一枚岩ではありません。書簡に正式な回答はまだありません。一方で、研究責任者の社内メモがTechCrunchに共有されています。メモは3人の貢献を称え、解雇は報復ではないとしたうえで「懸念を表明した社員を解雇することはない」と明記しました。さらに、3人の提言にOpenAIは同意しているとも書かれています。

提言は3つです。公約している第三者の安全監査人を実際に組み込むこと。最前線のモデルの監視可能性を保つこと。社内の安全研究者と外部の安全コミュニティとの対話を保つことです。

これからどうなるか

焦点は、境界線の不明確さです。何を外部に共有すれば機密漏洩で、何なら安全のための連携なのか。OpenAIはその基準を説明していません。基準が曖昧なままだと、安全性の研究者は「話した相手によって解雇されるかもしれない」と考えて萎縮しかねません。Wang氏は「リスクの最も近くにいる人が声を上げるのを恐れていては、AGIを安全に作れない」と書いています。

見るべき点は3つあります。OpenAIが書簡に正式回答するか。解雇理由の具体的な規則を示すか。公約済みの第三者監査人が実際に動くかです。いずれも外から確認できる材料になります。

開発者の立場では、他人事ではありません。AIを使うプロダクトを作る以上、利用するモデルの安全性は、提供元の内部統制に左右されます。公開された安全性の報告や、第三者監査の有無は、ベンダー評価の項目に加えておくとよいでしょう。自社でも、安全上の懸念を社内で安心して上げられる窓口を作っておく価値があります。

この件は、AI企業の内部通報と外部連携のあり方にも波及しそうです。AI安全の分野では、社外の研究者が最新モデルを評価する仕組みが広がっています。外部評価が機能するには、内部の研究者が外部の評価者と率直に話せる環境が欠かせません。そこに「何を話すと解雇されるか分からない」という不安が入り込めば、評価の質そのものが下がります。

OpenAIは公約として第三者の安全監査を挙げています。公約を実行に移すなら、外部と共有してよい情報の範囲を明文化し、社員に周知することが近道でしょう。ルールが明確になれば、会社側も社員側も、無用な対立を避けられます。

まとめ

OpenAIと解雇された研究者3人の主張は、現時点で食い違っています。事実関係は第三者の検証を待つ段階です。この件が示しているのは、安全研究と機密保持の境界線をどこに引くか、という業界全体の宿題です。

参考リンク

アイキャッチ画像: Photo by Foad Roshan on Unsplash

タイトルとURLをコピーしました