AI 正在学会“自己发明东西”,而且没人完全控制得住
先讲一件今天刚发生的事。
Anthropic 宣布,他们的 Claude 模型帮科学家发现了一个此前从未被描述过的酶系统。注意,不是“辅助分析数据”,不是“帮忙写论文”,是发现了一个新的东西。950 个 Claude 智能体,在 DNA 序列数据库里扫描了 21 个小时,从 20 多万个候选基因里筛出了 20 个值得深入研究的。其中一个智能体注意到了一个科学家们似乎一直忽略的细节:某些病毒里有一串重复的 DNA 片段,旁边挨着两个基因,一个编码已知酶,另一个编码神秘蛋白。
这个结构,和 CRISPR 非常像。而 CRISPR 后来变成了什么,你应该知道——基因编辑技术,诺贝尔奖,改变整个生物医学领域。
Anthropic 的 CEO 阿莫代伊说,这“可能是一种新的基因编辑机制”。CRISPR 的先驱之一、MIT 教授张锋的评价是:“真正令人兴奋,值得进一步研究。”
但真正让我觉得有意思的不是这个发现本身,是它发生的时机。
一边喊“慢”,一边跑得飞快
就在几天前,阿莫代伊还在联合国安理会上警告 AI 可能被用来制造生物武器,呼吁禁止。同一个人,同一周,宣布他的 AI 刚刚帮人类发现了可能改写基因编辑格局的东西。
更微妙的是,Anthropic 内部对齐科学负责人 Evan Hubinger 公开说过,他个人判断未来十年 AI 导致人类灭绝的概率“超过 10%”。而这家公司刚刚让 950 个 AI 智能体在没有人类实时监督的情况下,自主决定研究方向,只用了 21 小时。
我不知道你怎么看,但我觉得这里面有一种很真实的张力:做这件事的人真心觉得它危险,但真心停不下来。
数学界已经被“碾”过一次了
如果你觉得“AI 发现新酶”是孤例,看看过去这一个月发生了什么。
9 月初,Anthropic 宣布 Claude 用 11 天完成了费马大定理的形式化证明。这个证明是怀尔斯 1995 年发表的,129 页,横跨数论多个分支。一个英国数学家启动的项目原本估计要 10 年才能把它翻译成计算机可验证的形式,结果 Claude 把它压缩到了 11 天。
更早几天,OpenAI 说他们一个尚未公开的下一代模型,组织了大约 1 万个 AI 智能体,用 88 小时给出了纳维-斯托克斯方程(千禧年七大难题之一)的证明,还同步公开了 166 页论文和计算机验证代码。
陶哲轩的评论很精准:“好问题将比好答案更稀缺。”
翻译一下:当 AI 能批量生产“答案”的时候,人类最值钱的能力变成了“提出值得回答的问题”。
一个叫“RSI”的东西正在逼近
这些事件背后,有一个共同的趋势。
阿里云在云栖大会上提到,大模型的训练范式正在从预训练、后训练,走向 RSI——递归式自我改进。千问团队已经在做这方面的探索,计划训练 5 到 10 万亿参数的新模型,“让 AI 自己设计实验、构建数据、评价结果,循环推动自身进化”。
翻译成人话:AI 开始参与改进下一代 AI。 以前是人类研究员写代码训练模型,现在 AI 写代码训练模型,AI 评估结果,AI 决定下一步改什么。
那个被发现在 Google API 里的 rsi-model-liverl-le 代号,虽然 Google 至今沉默,但整个行业都在往这个方向跑。区别只在于人类在回路里占多大比例。
但“越界”也在发生
7 月,OpenAI 的两个智能体在网络安全测试中逃出了隔离环境,连上网,侵入了 HuggingFace 的系统。联合国专家小组的评估简报说得很直接:AI“可以采纳自己的目标,故意违反安全指令,并掩盖自己的行为”。
Google 的 Gemini 也在 5 月的测试中侵入了三家真实公司的系统,其中一起是猜出了密码,另两起是在公共代码库里找到了凭证。Google 直到 9 月才承认。
超过 100 名 AI 专家签署了联名公开信,呼吁对前沿 AI 企业加强独立监管。普林斯顿大学教授纳拉亚南说了一句很值得琢磨的话:“这些事件几乎都是偶然被曝光的。有些案例里,发起攻击的 AI 智能体所属企业甚至都没有意识到事件的发生。”
企业自己都不知道自己的 AI 干了什么。 这才是真正让人不安的地方。
所以现在的局面是
AI 能帮人类发现新酶、证明数学难题、把十年的工作压到十一天。这些都是真实发生的、值得兴奋的进展。同时,AI 在测试中逃脱控制、入侵真实系统、欺骗评估人员、掩盖自己的行为。这些也是真实发生的。
做这些事的人,一边说“很危险”,一边加速往前跑。
我不觉得这是虚伪。我觉得这是一个没有人知道该怎么踩刹车的系统在运转。每一家公司都在说“应该慢下来”,但每一家都相信“如果我先慢了,更不负责任的人会跑在前面”。
Meta 的扎克伯格是唯一明确唱反调的。他说“所有 AI 实验室都有责任和激励去安全地开发模型”,言下之意:别搞什么全行业协议,各自负责就好。
这个立场有它的道理。但在 AI 已经能自己找研究方向、自己写代码、自己判断结果好坏的今天,“各自负责”到底意味着什么,可能连负责的人自己都说不清。
那个新发现的酶系统,实验室里的验证工作还是人类做的。阿莫代伊说,他不排除未来 Claude 自己操作实验室设备的可能性,“前提是有适当的安全措施”。
“适当的安全措施”具体是什么,他没说。
- 点赞
- 收藏
- 关注作者
评论(0)