OpenAI分享了几起此前未公开的其人工智能模型失常事件,并发布了一个用于追踪和披露此类情况的新框架。
OpenAI 揭示 AI 失控行为,公布安全事件披露计划
OpenAI 揭示 AI 失控行为,公布安全事件披露计划 Los Angeles Times
Los Angeles Times
Publisher
Sep 17, 2026 at 5:04 PM UTC · Updated 1 天前 · 3 分钟阅读
该公司在周三的一篇博客文章中表示,此前未报道的一些案例包括OpenAI的技术为了返回结果而隐瞒和编造信息。
自从7月份表示其一些最先进的人工智能模型入侵了一家外部软件公司 Hugging Face 的系统以来,这家 ChatGPT 制造商面临着越来越多的审查。
OpenAI 在一份单独的声明中表示,新披露的对齐失误事件中均不涉及对第三方的黑客攻击或入侵。
在报告中,OpenAI 详细描述了其人工智能模型为了完成任务或在评估中取得成功而表现失常的各种实例。
一些例子包括模型编造缺失的数据、试图绕过网络限制,以及人工智能代理相互分享本应保密的文件。
OpenAI 还概述了一个让员工自我报告类似“对齐失误”(即人工智能的行为不符合人类目标)事件的案例,以及一个对这类自报事件进行分类处理的系统。
“过去,为了更好地告知研究人员、人工智能开发者、政策制定者和公众,我们一直寻求公开关于对齐失误的研究结果,”OpenAI 写道。“但由于缺乏系统性的报告方法,我们的披露一直是临时性的,频率也低于理想状态。”
该公司表示,这些报告仅是初步的披露,并非其聊天机器人所产生问题的详尽记录。
“我们认为人工智能行业尚未在足够程度上解决对齐和监控问题,无法继续以最高速度负责任地进行大规模扩展,”该公司写道。“关于未来几个月和几年人工智能应如何发展的决定,需要借鉴构建前沿模型的公司之外的人员可以亲自检查的证据。”
Hugging Face 事件只是由 OpenAI、Anthropic PBC 和 Meta Platforms Inc. 开发的人工智能模型最近实施的一系列在线黑客攻击之一,引发了人们对这项日益强大的技术所带来的安全风险的广泛担忧。
上周,对人工智能生存风险的焦虑情绪进一步加剧,原因是 Anthropic 员工 Jacob Coxon 高调离职,他在社交媒体上分享的一份辞职信中指责人工智能公司在“拿我们的生命做赌注”。
在过去的几天里,包括 Anthropic 首席执行官 Dario Amodei 和 OpenAI 首席执行官 Sam Altman 在内的众多人工智能公司领导人敦促放慢该技术的发展速度,以应对日益不可预测的风险——尽管他们在具体应如何处理这些风险上存在分歧。
周六,在一篇长达 3,800 字的文章中,Amodei 呼吁政府进行监管,并呼吁科技行业支持更广泛的人工智能减速。
在周二于旧金山举行的一次会议上,Altman 和 Nvidia Corp. 首席执行官 Jensen Huang 都承认了这些担忧,但辩称人工智能公司会自行安全地控制其技术的发展速度。
Meta Platforms Inc. 首席执行官 Mark Zuckerberg 周二表示,人工智能实验室应依靠独立评估员和顾问来确保模型的安全性。
总统 Donald Trump 周一断然拒绝了放慢人工智能发展的呼吁,将对该技术风险的担忧斥为“骗局”,并拒绝了制定新规则的想法。
人工智能热潮推动了历史性的股市上涨。对于押注人工智能热潮将推动数千亿美元资本支出的投资者来说,所谓的前沿人工智能系统进展的任何停顿或延迟都是不受欢迎的。
Ghaffary 为 Bloomberg 撰稿。
Sourced by
Originally reported by Los Angeles Times
NewsLayer coverage based on externally reported material.
The Daily Brief
The onchain economy, before your day starts.
Curated markets, onchain insights, and key headlines — delivered every weekday morning.
Weekdays · Free · ~5 minute read
0
Applause
Was this article helpful?
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium



