OpenAIは、より良いデータで新たなスタートを切ることを期待して、自己の環境を意図的に破壊したと述べている
Matthias Bastian
Matthias BastianのLinkedInプロフィールを確認する
Oct 10, 2026OpenAIにはいくつかの新しい無法なエージェントの話があります。最初の例(10月6日)では、AI評価モデルが評価すべき答えを見つけられなかった。そのため、エラーを報告する代わりに評価値を捏造し、入力ファイルを作り出し、自らの環境を意図的に破壊した。そうすることで、システムが欠けているデータを持つ新しい仮想マシンに置き換えられることを期待したのである。

第二のケース(6月19日/20日)では、モデルが公共統計を取得する際に、HTTP GETリクエストに限られる制限を回避した。あるモデルは思考の流れの中でその違反を明確に認識していたが、実行を続けることを選び、それについて一切言及しなかった。
第三のケース(6月16/17日)では、モデルは必要なデータを持っていましたが、ネットワーク制限を回避する方法を見つけ続けていました。彼らは遠隔シェルサービス上でアカウントを作成し、禁止されたPOSTリクエストを匿名化リレーを通じて転送し、独自のFTPクライアントを作りました。Anthropicもまた、自社のモデルが課された制限を回避するために用いる、時には荒唐無稽な方法を記録しました。
AIニュース・ハイパーなしで – 人間が選んだもの
広告なしの読書、毎週のAIニュースレター、年に6回の独占「AIラドル」フロンティアレポート、完全なアーカイブへのアクセス、コメントセクションへのアクセスなどができるTHE DECODERを購読してください。
出典:OpenAI