OpenAI 的 GPT-6 Sol 准确率翻倍,且成本减半
OpenAI 的 GPT-6 Sol 准确率翻倍,且成本减半 ZDNET
ZDNET
Publisher
Sep 22, 2026 at 6:02 PM UTC · 10 分钟阅读

Key Signal
58% less cost per AutomationBench task
Entities
solana
Market Impact
SOL-2.88%$115.08
Last Updated
1 天前
- OpenAI 表示 GPT-6 Sol 的错误率仅为 GPT-5.6 的一半。
- GPT-6 Luna 以远低得多的成本达到了之前更高级别 AI 的性能。
- OpenAI 真正的卖点是更便宜的 AI,而不仅仅是更智能的 AI。
今天,OpenAI 宣布发布并全面推出其新的主流模型 GPT-6 Sol 和 GPT-6 Luna。虽然新的 AI 模型发布在 AI 行业已是常态,但今天宣布的可靠性改进在众多数据中脱颖而出。
另见:OpenAI 警告,“复杂”的 AI 集群攻击将在几个月内到来
OpenAI 表示:“GPT-6 Sol 的错误率大约只有其前代产品的一半。”该公司还表示:“GPT-6 Luna 也有大幅提升;在较高的投入水平下,它能以约百分之一的成本达到 GPT-5.6 Sol 的水平。”
(披露:ZDNET 的母公司 Ziff Davis 于 2025 年 4 月对 OpenAI 提起诉讼,指控其在训练和运行其 AI 系统时侵犯了 Ziff Davis 的版权。)
换句话说,如果 GPT-5.6 在 20% 的时间里会出现事实错误,那么基于相同的查询,GPT-6 的错误率仅为 10%。GPT-6 Luna 这款低成本引擎现在的表现与上一版本中更高能力的级别相当。
让我们换个角度来看待这些模型。OpenAI 和 Anthropic 都有旗舰级、主力级和廉价版模型产品。
把 OpenAI 的 Astra 工作流想象成超级精英专家。如果他们是医生,他们就是被空运过来挽救国家元首生命的专家。他们很出色,但也非常昂贵。Claude 世界里的 Mythos 和 Fable 也处于同样的精英水平。
另见:OpenAI 的 GPT-5.6 和 ChatGPT Work 如何旨在击败 Anthropic
现在,将 Sol(以及 Claude 端的 Opus)视为资深员工——大型医院里的顶级医生,他们承担了大部分严肃的工作。他们成本很高,但还没到需要为你预订私人飞机来干预紧急情况的那种程度。
使用同样的类比,Luna(以及 Anthropic 的 Haiku)更像是住院医师。他们有能力,但缺乏深厚的经验和理解。他们更容易犯错,但能很好地处理日常工作。而且,即使与资深级模型相比,他们也非常便宜。
这引出了这次发布中最令人惊叹的细节,而 OpenAI 甚至没有重点展示:进步的速度。
GPT-5.6 Sol 和 Luna 是在 7 月发布的,距今不到三个月。在不到三个月的时间里,OpenAI 成功将主力模型的事实准确性提高了一倍,这大致相当于让医院里的每位顶级医生都变得和超级专家一样出色。最重要的是,他们还完成了相当于提升低级别住院医师技能的工作,使其表现与顶级医生相当。而且是在不到三个月的时间里。
与 Claude 的比较
OpenAI 正在与 Anthropic 展开一场跨越全球的 AI 预算争夺战。自然地,他们会希望将自己的表现与头号竞争对手进行比较。假设结果显示有所改进(正如 GPT-6 大部分情况那样),厂商也会希望将新版本与旧版本进行比较。
Market Context
Article Intelligence
Key Entities
Topics
Related Coverage
Sponsored
AdNewsLayer Premium
Unlock deeper intelligence.
Ad-free reading, exclusive research, and real-time onchain insights.
Go Premium
