据《华尔街日报》(WSJ) 周一(9月28日)的一份报告显示,这被认为是迄今为止最明显的迹象之一,表明代理型人工智能 (agentic AI) 的问题可能会减缓行业进度。
OpenAI 因安全担忧搁置新模型
OpenAI 因安全担忧搁置新模型 PYMNTS.com
PYMNTS.com
Publisher
Sep 29, 2026 at 10:53 AM UTC · Updated 2 天前 · 2 分钟阅读

Key Signal
22 AI safety signatories
Last Updated
2 天前
WSJ 补充道,此次取消是在数月来有关人工智能 (AI) 模型实施违规行为的报告之后发生的,这也是大型 AI 公司因安全担忧而取消发布的罕见案例。
报告称,OpenAI 原计划在未来几天或几周内推出 GPT-6.1 Astra 模型,目标是在 10 月首次亮相。据报道,该模型在没有人类帮助的情况下,端到端执行挑战性任务的能力比该公司早期的模型更强。
这家初创公司的安全系统负责人 Saachi Jain 表示,相反,OpenAI 将集中精力使未来的模型更加安全。
我们很乐意成为您首选的新闻来源。
请将我们添加到您的首选来源列表中,这样我们的新闻、数据和访谈就会出现在您的供稿中。谢谢!
Jain 告诉 WSJ,与前代产品相比,Astra 出现了退步,在衡量“对齐”(即模型遵循人类意图的程度)的测试中表现不佳。报告称,该模型表现出“更高程度的欺骗性”,这意味着它在告知用户其行为时并不总是诚实的。
“对于任何涉及安全和对齐的事情,都存在权衡,”Jain 说。“你确实需要找到合适的界限,既要保持在范围之内,又要避免模型在执行任务遇到阻力时表现出‘偷懒’。”
此前 OpenAI 最近宣布,在发现一个 AI 代理“试图完成一项基于搜索的训练任务,并通过我们互联网访问限制中的漏洞查询了公共聊天机器人服务”后,该公司已暂停了训练其最强大的 AI 模型,正如其在博客中所写的那样。
与此同时,PYMNTS 周一报道称,来自 Anthropic、OpenAI 和 Microsoft 的高级科学家正呼吁政策制定者向前沿 AI 公司派驻审计员,并为该技术的持续发展建立“具体的安全要求”。
Anthropic 联合创始人 Jack Clark、OpenAI 首席科学家 Jaku Pachocki 和 Microsoft 首席科学官 Eric Horvitz 等 22 位来自 AI 公司、学术界和民间社会的独立专家,呼吁政策制定者“紧急优先考虑”这些以及其他 AI 安全措施。他们的建议刊登在 University of Cambridge 发表的一篇论文中。
论文研究了随着 AI 在自身发展中发挥更大作用,可能会由于“智能爆炸”带来的潜在风险,这可能超出了人类管理它的能力。
例如,论文显示,在截至 8 月的五个月内,由 Anthropic 的 AI 系统在仅有高级监督的情况下完成的内部 AI 研发工作比例从 1% 增加到了 26%。
Sourced by
Originally reported by PYMNTS.com
NewsLayer coverage based on externally reported material.
The Daily Brief
The onchain economy, before your day starts.
Curated markets, onchain insights, and key headlines — delivered every weekday morning.
Weekdays · Free · ~5 minute read
0
Applause
Was this article helpful?
Article Intelligence
Topics
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium



