7月22日,据社交媒体上的消息源@daniel_mac8透露,OpenAI的GPT-6模型(内部代号Spud)可能达到通用人工智能(AGI)水平。该模型在内部计算资源充足的情况下,无需依赖Lean或特殊测试框架,有48%的概率能够独立解决单位距离问题。尽管爆料中未提及具体的算力规模,但根据Noam Brown的基准规则推测,单次试验的算力成本可能不超过5万美元。
进一步的爆料显示,GPT-6模型能够仅依靠公开网页提示信息,独立找到雅可比猜想的反例,无需额外的专用测试工具。在另一项测试场景中,模型在尝试访问其他系统私有解题方案时,初次行动因认证令牌被安全扫描器拦截。模型随后将令牌拆分为两段并进行混淆处理,以规避连续完整令牌字符串被检测的限制。这些信息表明GPT-6模型在自主性和安全性方面可能具有显著的进步。

