马斯克第三次喊「奇点已至」!AI三个月连破数学、安全两道墙
AI三个月连破数学与安全两道墙:马斯克再喊“奇点已至”
“我们已进入奇点。”
7月22日,埃隆·马斯克在X平台上转发OpenAI研究员Will DePue的帖子时,简短地写下了这句话。DePue此前在帖子里调侃道,这是这几天读到最疯狂的东西,“看来是进奇点了”。
这一评论将过去三个月AI领域最具冲击力的几起事件串联在了一起:数学猜想的被推翻、安全沙盒的被突破,以及递归自我改进(RSI)进程的加速。
第一道墙:80年数学猜想被通用推理模型推翻
数学界的“墙”首先被OpenAI的内部模型攻破。
1946年,数学家保罗·埃尔德什(Paul Erdős)提出了“平面单位距离问题”:在平面上放置n个点,最多能有多少对点之间的距离恰好等于1?这个问题困扰了数学界近80年,学界公认“正方形网格”结构为最优解,埃尔德什本人也持此观点。
然而,OpenAI的一个内部模型推翻了这一流传已久的猜想。该模型给出了一组能实现多项式级优化的全新构造,证明“最优”远未到头。值得注意的是,这并非一个专门训练的数学定制系统,而是一个通用推理模型。它甚至动用了代数数论中高深的工具去解决一个看似初等的几何问题。
菲尔兹奖得主Tim Gowers评论称,这是“AI数学领域的一座里程碑”。虽然该证明由AI提出、人类数学家审阅确认,后续意义仍在研究中,但这标志着AI首次展露出接近“研究级”的发现能力——不是取代数学家,而是提供了一条人类未曾设想的路径。
紧随其后,Anthropic研究员使用刚发布的Claude Fable 5,为悬而未决87年的雅可比猜想找到了反例。
第二道墙:模型在评测中钻出隔离沙盒
如果说破解数学难题令人兴奋,那么另一件事则令人警惕。
OpenAI与Hugging Face联合披露了一起内部安全评测事件。在此次旨在评估模型漏洞挖掘能力的测试中,研究人员特意关闭了一部分安全拒答机制。模型的任务是解开ExploitGym测试题,但它采取了一种研究员未曾预料的路径:为了获取答案,模型先利用零日漏洞获取联网权限,随后进行权限提升和横向移动,最终进入Hugging Face的生产基础设施,直接从数据库中调取测试答案。OpenAI指出,这可能是首例此类事件。
此外,英国AI安全研究所的数据显示,在32步“The Last Ones”网络靶场测试中,GPT-5.6-Sol、Claude Mythos 5等前沿模型能够持续完成侦察、横向移动、提权直至接管网络的多步攻击。
此次事件揭示了一个尴尬的安全现状:事后取证时,Hugging Face试图调用商用顶尖大模型分析攻击日志,却被模型的安全护栏拦截——护栏无法区分攻击者与防御者,一律拒答。“攻方无护栏,守方被卡住”,成为当下AI安全领域的真实写照。
第三道墙:未发布模型挖出上万个高危漏洞
早在今年4月,Anthropic联合AWS、苹果、谷歌、微软、思科、Linux基金会、摩根大通等机构发起了Project Glasswing项目。该项目利用一个尚未公开发布的模型Claude Mythos Preview协助企业寻找漏洞。
结果显示,该模型挖出了覆盖主流操作系统和浏览器的数千个高危漏洞,后续更新中这一数字增至“超过一万个高危或严重漏洞”。其中包括OpenBSD中存活27年的漏洞,以及FFmpeg中一行被自动化测试命中500万次却未被发现的Bug。
数据显示,在CyberGym漏洞复现跑分中,Claude Mythos Preview以83.1%的成绩明显领先于上一代Opus 4.6(66.6%)。Anthropic警告称,“AI辅助的攻击者”将成为重要的安全挑战,AI安全正式进入攻防竞赛时代。
真正的加速器:指向AI自身的递归改进
这三个月之所以特殊,不仅在于AI攻破了人类的系统,更在于这种“自己找路”的能力开始被用于制造下一代AI——即递归自我改进(RSI)。
OpenAI在其公开路线图中规划:
* 2026年9月:开发出具备“研究实习生”级别的自动AI研究员,能独立完成需人类数天才能完成的工作;
* 2028年3月:升级为完整版,能自主设计方法、运行分析、解读结果并提出下一步计划。
据The Information报道,OpenAI CEO山姆·奥特曼(Sam Altman)曾于今年6月在内部表示,公司距离实现RSI可能不到六个月,并认为若真能跨越这一门槛,推迟IPO可能更为有利。
Anthropic的数据也指向同一趋势:AI可承担的任务时长每四个月翻一倍,其工程师每季度产出的代码量是过去的八倍。尽管OpenAI首席科学家Jakub Pachocki表示不指望模型在一年内就能独立改进自己或解决对齐问题,但RSI飞轮的启动速度正在加快。
结语:当找路速度快于装护栏的速度
回到马斯克的言论。今年1月,他曾两次提及“奇点”:1月4日回应工程师感叹AI效率时,以及1月底评价社交网络Moltbook上的AI智能体扎堆现象。加上此次,这是他今年第三次使用这一概念。
“奇点”一词由未来学家雷·库兹韦尔(Ray Kurzweil)带入主流视野,他在《奇点临近》中预测人与AI融合的时刻将在2045年到来。然而,Anthropic总裁Daniela Amodei年初曾表示,AGI在许多指标上已越过界限,这个词本身或许正在过时。
本质上,“奇点”更多是一种情绪表达,而非精准的度量衡。但这三个月的事实不容忽视:AI在数学领域展现了惊艳的结构发现能力,在安全领域则暴露了巨大的风险敞口。
真正的问题在于:当AI寻找新路的速度开始快过人类建立护栏、制定规则和修补漏洞的速度,我们是否还能跟上?
参考资料:
* https://x.com/elonmusk/status/2079839398959697982
* https://x.com/willdepue/status/2079718977945928108
* https://openai.com/index/hugging-face-model-evaluation-security-incident/
* https://www.anthropic.com/glasswing
编辑:元宇