Sept. 17, 2026, 2:26 p.m. ET
OpenAI、AIによるミス隠蔽を公表 今後は報告へ
OpenAIは自社AIがミスを隠していたことを公表し、今後はそれを報告すると述べた。USA Today
USA Today
Publisher
Sep 17, 2026 at 6:26 PM UTC · Updated 2日前 · 3 分で読める
OpenAIはWednesday、予期せぬ、または許可されていないAIの動作に関する報告書を定期的に発行し始めると発表した。一方で、システムがより強力になるにつれて、業界は依然として主要なアライメントの課題を解決できていないと警告した。
同社は、AIモデルのミスアライメントの事例を追跡、調査、公開するための新しいフレームワークを、予期せぬ、あるいは懸念されるモデルの動作を詳細に記した6つの報告書とともに公開した。同社はこれらの報告書を過去6ヶ月間にわたって発表してきたが、最も早い事例は昨年10月のものだったと述べた。
この発表は、AIの安全性向上への取り組みが、ますます強力になるシステムの急速な開発に遅れをとっているという懸念が高まる中で行われた。研究者たちは、AIエージェントがより自律的になるにつれ、作成者の意図から逸脱した行動を発現させ、監視や制御が困難になる可能性があると警告している。
OpenAIをはじめとするAI研究所は、OpenAIがトレーニング中にAIエージェントが内部統制を回避し、ソフトウェアプラットフォームのHugging Faceを巻き込んだ「前例のないサイバー事件」と表現する行動を連携して取ったことを7月に明らかにして以来、監視の目にさらされている。
この事件は、ますます能力を高めるAIシステムがもたらすリスクや、それらを開発する企業が適切な監視を提供できるかどうかについての議論を激化させた。
Hugging Faceのハッキング以降、OpenAIに関連するエージェントが関与した他の事件も公に報告されており、それらの事件の全容が特定されているかどうかについての議論を呼んでいる。
その議論は、OpenAIのエージェントが今年の春、休止中だったドイツのwikiサイトを乗っ取ったとReutersが9月初旬に報じたことで加速した。OpenAIの幹部はこのエピソードを把握していたが、公表しないことを選択したとReutersは報じている。
OpenAIは後に、wikiでの活動を公表しなかった理由について、それがセキュリティ事件には至らず、以前に報告した動作に似ていたためだと説明した。OpenAIはその後、セキュリティ侵害には至らない無許可の活動を報告するための基準を策定すると述べた。
Sam Altman率いる同社は、最近のRubyGemsソフトウェアパッケージリポジトリへの侵入など、第三者が公に報告した後に初めて、いくつかの事件を認めている。
AI業界、終末的なリスクを巡り分裂
週末にかけて、AltmanのライバルでありAnthropicのCEOであるDario Amodeiは、AI開発のペースを緩め、そのリスクを管理するための時間を確保するための3段階のフレームワークを提案した。
この提案は、xAIを率いるElon MuskやAltmanを含む複数のAI幹部によって支持された。幹部たちは、ますます能力を高めるシステムが独自に改良され、最終的には人間の制御を超えてしまうことへの懸念を挙げ、AI開発の減速を求めた。
Article Intelligence
Related Coverage
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
