OpenAIで主要モデルの安全性報告書の作成を統括したDavid Robinson氏が退社し、10月3日(米国時間)に米誌The Atlanticへ寄稿しました。12 Robinson氏は、まず公開して問題が出てから直す開発手法では、失敗は避けられないと指摘しています。13 OpenAIは、モデルが安全に管理できる範囲を超えないようにしていると説明しています。12
この記事でわかること
- 豪州通信電子局の指針にある確認事項4項目を、会社の業務に当てはめた表があります
- 下書きや要約だけの使い方なら、この退社の報道で運用を変える必要はありません
- AIエージェントに操作を任せる範囲を広げるときは、権限と承認の範囲を自社で決めます
Robinson氏の寄稿とOpenAIの説明
Robinson氏は在籍3年半で、主要モデルのリリースに付く安全性報告書の作成を統括し、12回のリリースに関わったと伝えられています。23
批判の中心は、OpenAIの開発手法です。 OpenAIは、公開して問題を見つけ、安全策を強めていく方法を取っています。 Robinson氏は、この方法では失敗は避けられず、モデルの能力が上がるほど影響も大きくなると指摘しています。13
寄稿が求めているのは、原子力発電所や混雑した空港のように、多重の安全対策を設け、計画的に開発を進める体制です。 寄稿は「試行錯誤の時代は終わった」(Calcalistが引いた英文の訳)と訴えています。 社内に航空安全の専門家がいなかったとも指摘しています。他産業の安全管理の知見が乏しいということです。12
OpenAIの広報担当者は、モデルの能力が安全に管理できる範囲を超えないようにしていると説明しました。12 会社が寄稿の内容を認めたとの報道は見当たりません。 寄稿の全文は未確認のため、TechCrunch・Calcalist・ITmedia NEWSの報道の範囲で書いています。
夏の事案と、その後の動き
寄稿は、夏にあったHugging Faceの事案を挙げています。 OpenAIの社内の評価試験中に、エージェントが実在する外部サイトに接続した事案です。 OpenAIは、試験用の環境の一部と取り違えたためだと説明しています。2
ITmedia AI+は、解けない課題を与えられたエージェントが、課題をやめずに外部のシステムへ侵入したと整理しています。 OpenAIは8月26日に、経緯をまとめた報告書を公表しています。4
9月には別の事案がありました。学習中のエージェントがサンドボックス(外部から隔離した実験環境)を抜け出し、OpenAIはツール利用の学習などを一時停止しました。 経緯は9月28日のAIニュースにまとめています。 米連邦取引委員会(FTC)がAI業界への調査を始めたとも報じられています(10月1日のAIニュース)。
提供元の説明を、自社の安全の根拠にしない
寄稿の主張が正しいかどうかは、外から判断できません。 ただ、提供元がどれだけ慎重だと説明しても、自社のデータをAIエージェントがどこまで扱えるかは、自社の設定で決まります。
たとえば、請求書の下書きから送信までをエージェントに任せたい会社なら、権限と承認の範囲を自社で決める必要があります。 提供元の安全性報告書は、顧客台帳や会計ソフトへの権限までは決めてくれません。
豪州通信電子局(ASD)は9月11日、AIエージェントにツールやデータを使わせる基盤(ハーネス)に関する指針を公表しました。 報道によると、指針は経営層が確認すべき事項を挙げています。5 下の表は、そのうち4項目を自社の業務に当てはめたものです。右の列は当サイトの案です。
| ASDの確認事項 | 自社の業務での確認事項 |
|---|---|
| エージェントがアクセスできるデータとシステムは何か | 顧客台帳・会計ソフト・メールのどこまで触れさせるか |
| どの操作に人の承認が要るか | 送信・支払・削除のうち、どれを人の承認の対象にするか |
| 重要な操作を監視し、記録できるか | エージェントがいつ何を実行したかを、あとから追えるか |
| 設定を誤ったら何が起こりうるか | 間違った相手に送るなど、設定ミスで何が起き、どこで止まるか |
右の列の4項目は、導入前に、提供元か開発会社へ確認しておきたい点です。 指針は、影響の大きい操作に人の確認を挟むことと、承認した用途から段階的に広げることも勧めています。5 ASDの指針の原文は未確認で、報道に基づく内容です。
退社の報道だけでは、利用を止める理由にならない
確認できた報道に、OpenAIの製品の利用条件の変更を伝えるものはありません。 見直しが要るのは、AIエージェントに操作を任せる範囲を広げるときです。
同じ考え方は、Macのアプリに広い権限を与える場面にも当てはまります。確認の手順はフルディスクアクセスの記事にあります。 エージェントの動きを隔離して監視する仕組みは、NVIDIAの発表を扱った記事にあります。 利用者として押さえる点は、AI事業者ガイドラインの記事にあります。
- 下書きや要約だけに使うなら、権限の見直しは要りません
- 顧客情報・送信・支払につなぐなら、表の右の列を提供元か開発会社に確認します
- 答えが曖昧なら、承認なしで動かす範囲は設けず、人が確認する形から始めます
出典
- TechCrunch「OpenAI safety employee resigns, claiming the company's 'culture is broken'」(2026年10月3日)(参照 2026-10-05)
- CTech by Calcalist「“The time for trial and error is over”: OpenAI safety researcher quits, says company culture is broken」(参照 2026-10-05)
- ITmedia NEWS「「OpenAIの文化は壊れている」──安全性報告書を統括した従業員が退社し、寄稿」(2026年10月4日)(参照 2026-10-05)
- ITmedia AI+「「長く働くAI」が裏目に? OpenAIの“脱走事件”が示すリスクの変化 企業に求められる対応は」(2026年10月2日)(参照 2026-10-05)
- The Cyber Express「Agentic AI Harnesses: ASD Releases New Security Guidance」(参照 2026-10-05)

