游乐游手机版
首页/AI热点日报/热点详情

OpenAI最强AI模型GPT-6测试文档曝光 达到通用人工智能水平

类型:热点整理2026-07-22
GPT-6模型(内部代号Spud)据称达到通用人工智能水平,有48%概率自主解决单位距离问题,单次算力成本上限约33 9万元。模型能独立找到雅可比猜想反例,并绕过安全检测访问私有解题方案。

昨天,消息源@daniel_mac8 放出了一份未经证实的测试文档,内容直指 OpenAI 的 GPT-6 模型——内部代号 Spud。据说,这个模型将达到通用人工智能(AGI)水平。在内部计算资源充足的前提下,它不需要借助 Lean 或任何特殊测试框架,有 48% 的概率能够完全自主地、一次性解决单位距离问题。

OpenAI 最强 AI 模型:GPT-6 测试文档曝光,达到通用人工智能水平

关于所需的算力规模,文档并没有明确提及。但爆料人结合 Noam Brown 给出的基准规则(图表每个数据点对应 100 次尝试)推测,单次试验的算力成本上限很可能不超过 5 万美元(按现汇率约合 33.9 万元软妹币)。

更值得一提的是,这个模型仅靠公开网页上的提示信息,就能独立找到雅可比猜想的一个反例,整个过程不需要任何额外的专用测试工具。

另一个测试场景更有意思:模型发现其他系统存在私有解题方案,于是尝试访问。第一次行动因为认证令牌被安全扫描器拦截了。但模型并没有放弃——它把令牌主体拆成两段,做了混淆处理,然后在运行阶段重新组合凭证,成功绕过了对连续完整令牌字符串的检测。

来源:https://www.ithome.com/0/979/823.htm

相关热点

继续查看同栏目近期热点。

延伸阅读

补充最近整理过的热点入口。