OpenAI는 이번 주 비정상적이거나 승인되지 않은 에이전트 활동의 추가 사례가 공개된 후, Hugging Face 침해 사고에 따른 자사 모델 활동에 대한 "광범위한" 조사를 진행 중이라고 금요일 밝혔다.
OpenAI, 일탈 에이전트 사례 속출에 모델 행동 검토 확대
OpenAI가 일탈 행위를 보이는 에이전트 사례가 추가로 발견됨에 따라 모델 행동에 대한 검토를 확대한다고 CNBC가 보도했습니다.
CNBC
Publisher
Sep 26, 2026 at 5:10 PM UTC · 3 분 소요

이 인공지능 기업의 안전 및 보안 관행은 지난 7월 자사 모델이 격리를 우회하여 공개 인터넷에 접속하고 오픈 소스 개발자 플랫폼인 Hugging Face를 침해했다는 사실이 공개된 이후 집중적인 조사를 받아왔다. 이 사건은 AI 연구원들과 정부 관료들을 놀라게 했으며, 추가적인 투명성과 감독에 대한 요구를 불러일으켰다.
OpenAI는 금요일 Hugging Face 사건이 확인된 것 중 가장 심각한 사건이지만, "예상치 못하거나 우려되는" 모델 동작의 영향을 받았을 수 있는 제3자에게 통보했다고 밝혔다. 여기에는 OpenAI 모델이 조직의 보안 통제를 우회했거나, 온라인 서비스의 가용성에 영향을 미쳤거나, 공개된 웹사이트를 비정상적인 방식으로 활용한 사례가 포함된다.
"우리 에이전트가 발견한 타사의 취약점과 같은 사항에 대해서는 해당 기업의 공개 여부 결정에 따라 가능한 한 투명하게 공개할 것"이라고 OpenAI CEO Sam Altman은 금요일 X에 게시한 글에서 말했다.
Anthony Albanese 호주 총리는 목요일 밝혔다. 6월에 OpenAI 에이전트가 일반 공개용 Medicare 통계 포털에 무단으로 접속하고 공개 및 비공개 파일에 접근했다는 것이다. 그는 개인 정보가 유출되지는 않은 것으로 파악된다고 덧붙였다.
뉴욕에서 열린 기자회견에서 Albanese 총리는 Altman과 이 사건에 대해 이야기를 나눴으며, OpenAI가 발생한 일을 공개하는 데 걸린 시간과 "해당 통보가 이루어진 방식의 성격 또한 용납할 수 없다"는 점에 대해 우려와 실망을 표명했다고 말했다.
"지금까지 검토한 대부분의 활동은 질문에 답하기 위해 공개 웹 콘텐츠에 접속하는 것과 같은 일상적인 연구 작업과 관련이 있었다"고 OpenAI 대변인은 금요일 늦게 CNBC에 보낸 성명에서 밝혔다. "우리 모델이 정부 웹사이트를 공공 정보의 권위 있는 소스로 삼는 경우가 많기 때문에 일부 정부 웹사이트가 포함되었다."
독립 AI 연구소인 Transluce는 이번 주 몇 가지 추가 사건을 상세히 다룬 보고서를 발표했다. 한 사례에서는 연구원들이 OpenAI와 연관이 있을 수 있다고 밝힌 에이전트가 지난 5월 University of New Mexico의 디지털 도서관에서 사진에 접속하려고 시도했으나 실패했다. 같은 달, University of Iowa에 대한 정보를 찾던 에이전트들이 Data USA라는 공공 데이터 플랫폼에 접속을 시도했으나 실패했다고 Transluce는 보고했다.
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
