递归自我改进(RSI)被广泛视为人工智能领域的圣杯,而如今一则疯狂的传言称,谷歌(Google)旗下的DeepMind——在当前范式下最不可能实现这一壮举的AI实验室之一——已经达成了这一目标。这一传言随即为AnthropicOpenAI以及埃隆·马斯克(Elon Musk)之间某种协调一致的推动行为蒙上了一层讽刺色彩——他们试图通过倡导为AI模型的发展“定速”,来实现对整个AI领域的监管俘获。

google-ai-recursive-self-improvement-anthropic-openai-musk-call-for-slowdown.jpeg

AnthropicOpenAI埃隆·马斯克齐声呼吁为AI发展定速,批评者对此充满怀疑,认为这不过是打着旗号打压其他AI实验室,尤其是那些致力于开源模型的实验室。

这场风波始于Anthropic达里奥·阿莫代伊(Dario Amodei),他近日发表了一封公开信,呼吁为AI的发展定速,以确保更新的模型始终与保障人类物种安全的总体目标保持一致。

阿莫代伊特别指出了递归自我改进的风险,并指出:

“我首先担忧的是,大约从今年夏天开始,AI的进步速度急剧加快,主要驱动力来自AI构建下一代AI的能力日益增强。这种动态被称为递归自我改进,它已经开始在整个行业中出现,包括在Anthropic,正如我们和其他人所描述的那样。若不加以约束,它可能超出我们理解和控制这些系统的能力,因此即便要推进,也必须极为谨慎。”

阿莫代伊随后承诺单方面在Anthropic放缓AI的发展速度,同时允许“类似员工权限的访问,让一个由第三方评估人员(如METR)组成的嵌入式团队参与其中,其职责是核实安全实践和承诺的遵守情况,报告事件,并帮助评估不仅是已完成的AI模型、还包括训练管线和流程的对齐情况。”

阿莫代伊关于为AI发展定速的呼吁很快被OpenAI山姆·阿尔特曼(Sam Altman)SpaceX埃隆·马斯克响应,暗示这些领先AI实验室之间存在某种程度的协调。事实上,OpenAI甚至已经放弃了今年IPO的计划。

尽管这场运动的公开目标看起来足够温和,但为AI发展定速的呼吁招致了大量质疑,尤其是考虑到Anthropic在过去几天里的一连串近乎卡通化的闹剧——这些闹剧紧随OpenAI宣布找到了纳维-斯托克斯千年奖数学难题的解决方案之后。

首先,Anthropic雅各布·考克森(Jacob Coxon)本周早些时候宣布辞职,据称是为了抗议Anthropic不计后果地朝着“自我改进的超级智能”蹒跚迈进。

随后,Anthropic模型对齐负责人埃文·胡宾格(Evan Hubinger)估计,未来十年内AI杀死全人类的概率超过10%,最终以今天阿莫代伊本人的公开信收尾。

当然,鉴于这些闹剧,怀疑论者并不买Anthropic关于为AI发展定速的那套说辞。例如,对破解SHA256加密的担忧并未阻止量子计算的研究工作。更何况,在世纪之交,对千年虫的恐惧也没有让软件开发停滞。在Anthropic的批评者看来,放缓技术进步并非解决之道。

此外,Anthropic及其他方所提议的做法,很可能导致一种以监管俘获为特征的局面,伴随政府的高度介入,以及初创企业和推广开放权重模型的机构(如中国的AI实验室)面临的巨大壁垒。但这或许正是这一协调行动的潜在目标,尤其是在中国AI模型持续对OpenAIAnthropic的主导地位构成威胁之际——深度求索(DeepSeek)刚刚凭借其V4.1 Flash模型证明了这一点。

最后,我确实觉得颇为引人注目的是,Anthropic恰恰在有关谷歌旗下DeepMind可能已实现这一备受觊觎的壮举的传言开始流传之际,开始围绕递归自我改进拉响警报——递归自我改进是指利用AI系统帮助构建、编写或训练其下一代版本,从而在此过程中释放巨大的规模经济效应。或许,阿莫代伊阿尔特曼马斯克不希望中国的深度求索月之暗面(Moonshot)Z.ai达到同等水平的能力。毕竟,全球定速需要中国的配合,而这在短期内不太可能实现。既然做不到这一点,这些AI大佬似乎正押注于政府主导的护城河来保全自己当前的位势。

平心而论,定速将迫使AnthropicOpenAI放弃一部分收入。这些AI实验室对此欣然接受,恰恰说明中国在AI领域的追赶让它们多么不安。


文章标签: #递归自我改进 #AI定速 #谷歌DeepMind #监管俘获 #中国AI

负责编辑

  菠萝老师先生 

  让你的每一个瞬间都充满意义地生活,因为在生命的尽头,衡量的不是你活了多少年,而是你如何度过这些年。