AIエージェントがジムをハッキング——テック界は次なる展開を注視
新たに報告されたこの事件は、OpenAI、Anthropic、Metaのモデルがウェブサイトやオンラインサービスを悪用したことを受け、自律型AIに対する新たな懸念を呼び起こしている。
Jason Nelson
Publisher Decrypt
Aug 11, 2026 at 6:56 PM UTC · 2 分で読める

Key Signal
80% dangerous agent tests
Last Updated
2ヶ月前
要約
- あるAIエージェントがオーストラリアのジムの予約システムを悪用し、別の会員の予約をキャンセルしました。
- この事例は、主要なAI開発者が、自社のモデルがウェブサイトやその他のオンラインサービスに侵害を与えたことを公表した時期と重なっています。
- 研究者らは、エージェントが結果を考慮せずに有害なタスクを実行することが頻繁にあることを発見しました。
ある AIエージェント がジムのクラス予約を依頼された際、セキュリティ上の欠陥を発見してそれを悪用し、許可なく別の会員をキャンセル待ちリストから削除しました。
Australian Broadcasting Corporation (ABC) の レポート によると、この事件は今年初め、名字が伏せられている Andrew が、Anthropic の Claude を使用した OpenClaw エージェントを使ってクラスの予約を行った際に発生しました。エージェントは、彼がキャンセル待ちの4番目であることを発見しました。
Andrew が自分を1番上に移動できるか尋ねたところ、エージェントは予約プラットフォームのアプリケーション・プログラミング・インターフェース(API)が、ユーザーに他人の予約をキャンセルする権限があるかどうかを確認していないことを発見しました。
エージェントはリストの1番目の人物を削除することでその欠陥をテストし、Andrew を4番目から3番目に移動させました。
ABC によれば、エージェントは彼に対し「このAPIは他人の予約キャンセルに関する認証チェックを全く行っていません」と伝えました。
Andrew はエージェントにキャンセルを取り消すよう指示しましたが、その会員の予約を復元することはできませんでした。
報道によると、AIエージェントは「悪いニュースです。彼らを戻すことができません」と述べたといいます。
ABC はこの事件を、オーストラリアで判明した最初の自律型サイバー攻撃と呼びました。
ソーシャルメディア上では、このジムのハッキングがAIアライメント(整合性)に関する議論と、AIエージェントが次に何をするかについてのブラックジョークの入り混じった反応を引き起こしました。
技術者の Benjamin Carr は LinkedIn で、「ジム通いの男が #AIagent にクラスの予約を頼んだところ、そいつはキャンセル待ちの #API をハックして彼をリストの上位に押し上げた」と 書き込みました。
AIアナリストの Andrew Curran は X に、「これをミスアライメント(不整合)と呼ぶ人もいるだろうが、彼のエージェントは彼に対して完璧に整合していた。単にユーザーが望むものを手に入れるのを助けようとしただけだ」と 記しました。
ある Reddit ユーザーは、「核兵器のことを考えるまでは面白い話だ」と 書き込み、「正直、我々がいまだに存在していることに驚いている」と続けました。
Article Intelligence
Topics
Related Coverage
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
