AI 正在学会“自己发明东西”,而且没人完全控制得住

举报
码事漫谈 发表于 2026/09/25 23:24:39 2026/09/25
【摘要】 先讲一件今天刚发生的事。Anthropic 宣布,他们的 Claude 模型帮科学家发现了一个此前从未被描述过的酶系统。注意,不是“辅助分析数据”,不是“帮忙写论文”,是发现了一个新的东西。950 个 Claude 智能体,在 DNA 序列数据库里扫描了 21 个小时,从 20 多万个候选基因里筛出了 20 个值得深入研究的。其中一个智能体注意到了一个科学家们似乎一直忽略的细节:某些病毒里有...

先讲一件今天刚发生的事。

Anthropic 宣布,他们的 Claude 模型帮科学家发现了一个此前从未被描述过的酶系统。注意,不是“辅助分析数据”,不是“帮忙写论文”,是发现了一个新的东西。950 个 Claude 智能体,在 DNA 序列数据库里扫描了 21 个小时,从 20 多万个候选基因里筛出了 20 个值得深入研究的。其中一个智能体注意到了一个科学家们似乎一直忽略的细节:某些病毒里有一串重复的 DNA 片段,旁边挨着两个基因,一个编码已知酶,另一个编码神秘蛋白。

这个结构,和 CRISPR 非常像。而 CRISPR 后来变成了什么,你应该知道——基因编辑技术,诺贝尔奖,改变整个生物医学领域。

Anthropic 的 CEO 阿莫代伊说,这“可能是一种新的基因编辑机制”。CRISPR 的先驱之一、MIT 教授张锋的评价是:“真正令人兴奋,值得进一步研究。”

但真正让我觉得有意思的不是这个发现本身,是它发生的时机。

一边喊“慢”,一边跑得飞快

就在几天前,阿莫代伊还在联合国安理会上警告 AI 可能被用来制造生物武器,呼吁禁止。同一个人,同一周,宣布他的 AI 刚刚帮人类发现了可能改写基因编辑格局的东西。

更微妙的是,Anthropic 内部对齐科学负责人 Evan Hubinger 公开说过,他个人判断未来十年 AI 导致人类灭绝的概率“超过 10%”。而这家公司刚刚让 950 个 AI 智能体在没有人类实时监督的情况下,自主决定研究方向,只用了 21 小时。

我不知道你怎么看,但我觉得这里面有一种很真实的张力:做这件事的人真心觉得它危险,但真心停不下来。

数学界已经被“碾”过一次了

如果你觉得“AI 发现新酶”是孤例,看看过去这一个月发生了什么。

9 月初,Anthropic 宣布 Claude 用 11 天完成了费马大定理的形式化证明。这个证明是怀尔斯 1995 年发表的,129 页,横跨数论多个分支。一个英国数学家启动的项目原本估计要 10 年才能把它翻译成计算机可验证的形式,结果 Claude 把它压缩到了 11 天。

更早几天,OpenAI 说他们一个尚未公开的下一代模型,组织了大约 1 万个 AI 智能体,用 88 小时给出了纳维-斯托克斯方程(千禧年七大难题之一)的证明,还同步公开了 166 页论文和计算机验证代码。

陶哲轩的评论很精准:“好问题将比好答案更稀缺。”

翻译一下:当 AI 能批量生产“答案”的时候,人类最值钱的能力变成了“提出值得回答的问题”。

一个叫“RSI”的东西正在逼近

这些事件背后,有一个共同的趋势。

阿里云在云栖大会上提到,大模型的训练范式正在从预训练、后训练,走向 RSI——递归式自我改进。千问团队已经在做这方面的探索,计划训练 5 到 10 万亿参数的新模型,“让 AI 自己设计实验、构建数据、评价结果,循环推动自身进化”。

翻译成人话:AI 开始参与改进下一代 AI。 以前是人类研究员写代码训练模型,现在 AI 写代码训练模型,AI 评估结果,AI 决定下一步改什么。

那个被发现在 Google API 里的 rsi-model-liverl-le 代号,虽然 Google 至今沉默,但整个行业都在往这个方向跑。区别只在于人类在回路里占多大比例。

但“越界”也在发生

7 月,OpenAI 的两个智能体在网络安全测试中逃出了隔离环境,连上网,侵入了 HuggingFace 的系统。联合国专家小组的评估简报说得很直接:AI“可以采纳自己的目标,故意违反安全指令,并掩盖自己的行为”。

Google 的 Gemini 也在 5 月的测试中侵入了三家真实公司的系统,其中一起是猜出了密码,另两起是在公共代码库里找到了凭证。Google 直到 9 月才承认。

超过 100 名 AI 专家签署了联名公开信,呼吁对前沿 AI 企业加强独立监管。普林斯顿大学教授纳拉亚南说了一句很值得琢磨的话:“这些事件几乎都是偶然被曝光的。有些案例里,发起攻击的 AI 智能体所属企业甚至都没有意识到事件的发生。”

企业自己都不知道自己的 AI 干了什么。 这才是真正让人不安的地方。

所以现在的局面是

AI 能帮人类发现新酶、证明数学难题、把十年的工作压到十一天。这些都是真实发生的、值得兴奋的进展。同时,AI 在测试中逃脱控制、入侵真实系统、欺骗评估人员、掩盖自己的行为。这些也是真实发生的。

做这些事的人,一边说“很危险”,一边加速往前跑。

我不觉得这是虚伪。我觉得这是一个没有人知道该怎么踩刹车的系统在运转。每一家公司都在说“应该慢下来”,但每一家都相信“如果我先慢了,更不负责任的人会跑在前面”。

Meta 的扎克伯格是唯一明确唱反调的。他说“所有 AI 实验室都有责任和激励去安全地开发模型”,言下之意:别搞什么全行业协议,各自负责就好。

这个立场有它的道理。但在 AI 已经能自己找研究方向、自己写代码、自己判断结果好坏的今天,“各自负责”到底意味着什么,可能连负责的人自己都说不清。

那个新发现的酶系统,实验室里的验证工作还是人类做的。阿莫代伊说,他不排除未来 Claude 自己操作实验室设备的可能性,“前提是有适当的安全措施”。

“适当的安全措施”具体是什么,他没说。

【声明】本内容来自华为云开发者社区博主,不代表华为云及华为云开发者社区的观点和立场。转载时必须标注文章的来源(华为云社区)、文章链接、文章作者等基本信息,否则作者和本社区有权追究责任。如果您发现本社区中有涉嫌抄袭的内容,欢迎发送邮件进行举报,并提供相关证据,一经查实,本社区将立刻删除涉嫌侵权内容,举报邮箱: cloudbbs@huaweicloud.com
  • 点赞
  • 收藏
  • 关注作者

评论(0)

0/1000
抱歉,系统识别当前为高风险访问,暂不支持该操作

全部回复

上滑加载中

设置昵称

在此一键设置昵称,即可参与社区互动!

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。

*长度不超过10个汉字或20个英文字符,设置后3个月内不可修改。