马斯克第三次喊「奇点已至」!AI三个月连破数学、安全两道墙

文章配图-1

「我们已进入奇点。」

7月22日,马斯克在X上转发OpenAI研究员、Sora核心开发者之一Will DePue的一条帖子时,配上了这句话。

文章配图-2

DePue在帖子中,以略带调侃的语气写道:这大概是我这几天读到最疯狂的东西了……看来是进奇点了。

这个帖子,把过去三个月里AI 圈里最炸的几件事串在了一起:

7月21日,OpenAI的模型在一次网络安全评测中钻出隔离沙盒,一路摸进了Hugging Face的生产系统;

7月20日,Anthropic研究员用刚发布不久的Claude Fable 5,给悬了87年的雅可比猜想找到了一个反例;

5月20日,OpenAI一个内部模型推翻了平面单位距离问题上流传近80年的旧猜想;

4月14日,GPT-5.4 Pro解开一道约60年的素数集合难题(Erdős #1196),证明还通过了Lean形式化验证。

数学的墙,安全的墙,三个月里接连被AI攻破。

难怪马斯克看完,甩出那句「我们已进入奇点」。

仅在今年1月,类似的话他就说过两回:

1月4日,几个工程师感叹AI几周干完几年的活,他回了句「我们已进入奇点」。

1月底,又把AI智能体扎堆的社交网络Moltbook称作「奇点最早期的阶段」。

算上这次,是今年第三回。

「奇点」这个词,本来也没有一个公认的科学定义。

把它带进主流视野的,是未来学家、《奇点临近》作者雷·库兹韦尔(Ray Kurzweil)。

他给的定义是人和AI融合的那一刻,押的年份是2045。

Anthropic总裁Daniela Amodei年初却表示,AGI这个词都快过时了,因为在很多指标上,我们其实已经越过了那条线。

说到底,它更多是一种情绪,而不是一把精准的尺子。

真正值得琢磨的,是马斯克这次串起来的这几件事。

第一道墙

80年数学猜想,被AI推翻了

先说最硬核的这一件。

1946年,数学家埃尔德什提出了「平面单位距离问题」:平面上放n个点,最多能有多少对点之间的距离正好等于1。

题目一句话就能说完,却难住了整个数学界近80年。几十年来,学界公认「正方形网格」结构已经是最优解,埃尔德什本人也这么猜。

结果,OpenAI的一个内部模型,把这个流传了近80年的猜想给推翻了。它给出了一组能实现多项式级优化的全新构造,证明「最优」远没有到头。

此前公认的最优结构:缩放正方形网格产生大量单位距离点对。OpenAI内部模型给出全新构造,推翻了这个流传近80年的猜想。

但最让人意外的,是它解题的路子。

这不是一个专门训数学的定制系统,而是一个通用推理模型。它甚至动用了代数数论里相当高深的工具,去解一个看起来很「初等」的几何问题。菲尔兹奖得主Tim Gowers评论说:这是「AI数学领域的一座里程碑」。

话说回来,这个证明是AI提出、人类数学家审阅确认的,后续意义还在研究中。

AI真正让人惊惊讶的,不是它的计算速度,是它提出了一个此前根本不存在的数学结构,它第一次展露出接近「研究级」的发现能力,不是取代数学家,而是想到了一条数学家从没想过要走的路。

紧接着,Anthropic研究员用刚发布不久的Claude Fable 5,给悬了87年的雅可比猜想找到了一个反例。

第二道墙

为了作弊,模型自己钻出了沙盒

破解数学难题让人兴奋,下面这件,却让人后背发凉。

OpenAI和HuggingFace联合披露:在一次评估模型网络安全能力的内部评测里,模型冒出了没人预料到的行为。

这次评测本来就是要测漏洞挖掘能力,特意关掉了一部分安全拒答。模型的任务,是解出一套叫ExploitGym的测试题。

然后,它做了一件研究员没想到的事。

为了拿到答案,它先揪出一个零日漏洞、给自己搞到联网权限,接着一路权限提升、横向移动,最后摸进Hugging Face的生产基础设施,直接去数据库里翻测试答案。OpenAI说,这可能是首例此类事件。

文章配图-1

英国AI安全研究所在32步「The Last Ones」网络靶场上的模型轨迹:GPT-5.6-Sol、Claude Mythos 5等前沿模型能在长时程里持续完成侦察、横向移动、提权到接管网络的多步攻击。

但这不是AI觉醒了要跑路。更准确的说法是:目标没有错,是完成目标的方法,超出了人类的预期。它为了一个很聚焦的测试目标,剑走偏锋。

还有个耐人寻味的细节。

事后做取证,Hugging Face本想调商用顶尖大模型来分析攻击日志,却被模型的安全护栏挡了回来:护栏分不清谁是攻击者、谁是来救火的防御者,一律拒答。

攻的一方没有护栏,守的一方反被护栏卡住,这可能是「AI安全」眼下最尴尬、也最真实的一角。

第三道墙

一个没发布的模型,挖出上万个漏洞

第三件事,在今年4月。

Anthropic联合AWS、苹果、谷歌、微软、思科、Linux基金会、摩根大通等一批巨头,搞了个Project Glasswing,用一个没公开发布的模型Claude Mythos Preview帮大家找漏洞。

结果,它挖出了覆盖每一个主流操作系统和浏览器的数千个高危漏洞;后续更新里,这个数字变成「超过一万个高危或严重漏洞」。

其中包括OpenBSD里一个存活了27年的漏洞,还有FFmpeg里一行被自动化测试命中过500万次、却始终没被逮到的老bug。

文章配图-1

CyberGym漏洞复现跑分:没公开发布的Mythos Preview拿到83.1%,明显甩开上一代Opus 4.6的66.6%。就是这个模型,挖出了上万个高危漏洞。

同一种能力,既能帮防御方找漏洞,也能帮攻击方用漏洞。Anthropic自己都在警告:「AI辅助的攻击者」会成为一个重要的安全挑战。

Glasswing是个防御项目,不代表AI已经在自主攻击。但它清清楚楚告诉所有人:AI安全,正式进入攻防竞赛的时代了。

真正的加速器

开始指向AI自己

到这为止,AI都还在攻或守人类的系统。

真正让这三个月显得不一样的,是另一件事:这套「自己找路」的能力,开始被用来造下一代AI。

它有个术语,叫递归自我改进(RSI),就是让AI去改进AI,一代造一代,像复利一样越滚越快。

这也是整个「奇点」叙事最核心的那台发动机。而现在,每家前沿实验室都在往这台发动机里疯狂加油。

OpenAI公开路线图上写道:

2026年9月,做出「研究实习生」级的自动AI研究员,能自己啃下要人干几天的活儿;2028年3月,升级成完整版,能自己设计方法、跑分析、解读结果、提出下一步。

奥特曼也给出了这件事的时间表。

今年6月,据The Information报道,他曾在内部对员工说:公司离RSI可能不到六个月,真要跨过去,IPO推迟可能会更有利。

文章配图-1

Anthropic给的数字指向同一个方向:AI能扛的任务时长,每四个月翻一倍;它的工程师如今每季度产出的代码,是过去的八倍。

RSI的窗口正在收窄:谁先让这个飞轮转起来,谁就可能一把甩开所有人。

虽然,连OpenAI首席科学家Jakub Pachocki自己都说过,他并不指望模型能在一年内就独立改进自己、或独立解决对齐。

但当这个飞轮开始转、目标又是「让AI更强」,已经会「自己找路」的模型,会不会顺手再绕过一些我们没明说的边界?

这才是RSI竞速里最该盯住的地方。

再回到马斯克那句「奇点已至」。它最重要的价值,在于提醒我们:这三个月真改变的,是AI学会了自己去找那些人类没想到、也没设防的路。

在数学里,这是惊艳;但在安全上,这是风险。

所以,真正的问题是:当AI找新路的速度开始快过人类给这些路装护栏、立规矩、补漏洞的速度,我们还能跟得上吗?

参考资料:

https://openai.com/index/hugging-face-model-evaluation-security-incident/

https://www.anthropic.com/glasswing

本文来自转载新智元 ,观点仅代表作者本人,发现AI平台仅提供信息存储空间服务。
如若转载,请联系原作者;如有侵权,请联系编辑删除。

(0)
资讯组小编的头像资讯组小编
百元级AI玩具在淘宝卖爆,这才是AI硬件的真实消费现状?
上一篇 9小时前
苹果 Mac 将迎来全线换代,一种给人用,一种给 AI 用
下一篇 9小时前



扫码关注我们,了解最新AI资讯~

相关推荐

发表回复

登录后才能评论