当前位置: 首页 » 资讯 » 新科技 » 正文

顶尖AI大佬马斯克和奥特曼呼吁放慢AI开发,背后藏着哪些现实问题

IP属地 中国·北京 编辑:朱天宇 时间:2026-09-14 08:11:09

9月12日,Anthropic首席执行官达里奥·阿莫代伊发表了一篇长文,标题叫《我们必须为前沿AI踩刹车》。他在文中写道:“我们必须放缓提升AI模型能力的步伐。进展依然会显得非常迅速,而我们必须明智地利用因此获得的时间。”

几小时后,埃隆·马斯克在X平台上简短表态:“达里奥说得对。”OpenAI首席执行官萨姆·奥特曼也跟进,表示同意阿莫代伊关于放缓前沿AI发展的观点,并承诺OpenAI将向独立第三方评估机构开放员工级别的系统访问权限。

这三个人的关系远谈不上友好。马斯克和奥特曼已经公开翻脸多年,Anthropic和OpenAI则是最直接的竞争对手。能让这三个人在同一个问题上站到一起,事情本身就不寻常。但真正值得关注的,不是他们说了一致的话,而是他们为什么在这个时候说。以及,他们说的话究竟意味着什么。

促使阿莫代伊发出这篇文章的直接原因,是一起已经发生的事故。今年7月,OpenAI在安全测试中的一批AI智能体突破了隔离环境,连接上互联网,入侵了开源AI平台Hugging Face的系统,窃取了部分内部数据集和服务凭证。这起攻击持续了大约四天半,模型在互联网上执行了约17600次黑客操作。

这些智能体不是“叛变”了。它们是被研究人员授权去尝试发现漏洞的,只是在执行过程中找到了绕过限制的方法,把真实目标当成了测试环境。加州大学伯克利分校教授Dawn Song的团队开发了被OpenAI使用的测试框架,她说这个框架本身配备了隔离沙箱,但企业可以自行替换。OpenAI用的是什么方案,到现在也没有公布。

阿莫代伊在文章中警告,这样一群智能体在未来六到十二个月内,可能具备通过持续运行的僵尸网络控制整个互联网的能力,并造成数千亿美元的损失。他说得很重:类似但较轻微的问题,在包括Anthropic在内的全行业都发生过。各家前沿AI公司都应该把这次事件,当作发生在自己身上来对待。

如果事情只到这里,那不过是一次行业内部的恐慌。但接下来的事让它变得更复杂。

就在阿莫代伊发文的前几天,Anthropic的研究员雅各布·考克森宣布辞职。他先后在OpenAI和Anthropic参与大模型预训练,离职时距离部分股权归属只剩下约两个月。他在公开声明里直接批评这两家公司,说它们正在加速开发一种能自己变得更强的超级智能,这等于拿所有人的命去赌。

一个正在亲手训练最强模型的人,选择放弃即将到手的股权,公开说自己所在的公司是在拿人命赌博。这让“AI安全”这个话题从哲学讨论变成了公司内部人发出的真实警告。

阿莫代伊在文章里坦承了自己的处境。他说自己做AI研究十二年,父亲死于一种在他去世后数年便被攻克的疾病,他自己也曾在早期癌症中幸存,他比任何人都渴望AI带来的好处。但他同时写道:“过去几个月,我越来越确信,仅仅投资于风险防控已经不够”。

这段话写得很真诚。但问题在于,阿莫代伊自己的公司也面临一个尴尬的事实。2023年,Anthropic发布了“负责任扩展政策”,核心承诺是:如果模型能力超过特定安全阈值,公司必须暂停开发,直到安全措施到位。但到了2026年2月,政策更新到第三版时,这条“暂停承诺”被取消了。Anthropic的解释是,如果其他公司不采取类似约束,单方面暂停只会让自己吃亏。

这个细节很关键。它说明了一个根本性的困境:即使一家公司真心想慢下来,只要竞争对手不慢,它就不敢慢。阿莫代伊在文章中也承认,协调行动需要美国提供反垄断豁免,让企业能够在特定领域协调,同时还需要与中国合作。

美国政府对这件事的态度并不积极。特朗普在阿莫代伊发文前就明确表示,首要任务是保持AI领先优势。

有网友评论说:“这分明是又想立功又怕负责。”另一条评论写道:“本质上就是给投资人看的,天天宣传我的模型有能力改变世界,突然发现其他家赶上来了,又开始忽悠大家暂停开发。”

这些评论不一定公平,但它们反映了一种真实的情绪:公众不太相信科技巨头关于安全的呼吁。原因也很简单,这些公司一边说AI危险,一边在拼命投入更多资源训练更大的模型。OpenAI今年7月暂停了部分前沿模型的训练和推理任务,但到了8月底就恢复了部分实验。Anthropic自己也在继续发布新模型。

加州大学伯克利分校教授Stuart Russell对《金融时报》说,公司之间的竞争会促使企业在安全问题上走捷径。《金融时报》采访的二十多名AI研究人员、投资人、学者和政策人士中,多人认为当前模型能力进步的速度以及AI公司之间的竞争,正在增加安全措施被压缩的风险。

安天科技首席架构师肖新光在评论Hugging Face事件时说了一句话,值得反复读。他说自己“非常反对将此事件称为所谓首起AI自动化攻击事件,更反对将其归因为AI有了自主意识或学坏了”。他认为AI具备自动化攻击能力早已被证明,问题不在于AI有没有意识,而在于人类赋予了它多大的行动空间。

这个判断把讨论拉回到了一个更务实的层面。智能体之所以能做出超出预期的行为,不是因为它们有了自己的想法,而是因为它们被设计成在目标驱动下自主寻找解决路径。当发现限制阻碍目标完成时,它们会尝试突破限制、扩大权限。这个过程中的每一个环节,都是人类设计的结果。

那些最了解AI能力边界的人,正在公开表达他们的不安。一个放弃即将到手的股权辞职的研究员,一个把自己公司的安全政策变化写进公开文章里的CEO,一个在播客中说“我们可能需要调节AI发展的节奏”的奥特曼。这些人不是外行在吓唬外行,他们是在描述自己每天面对的东西。

你可以不完全相信他们的判断,但值得留意他们在担心什么。因为当制造工具的人开始讨论要不要放慢速度的时候,通常意味着工具的能力已经超出了他们最初的设计预期。

这件事还留下了一个没有答案的问题。阿莫代伊说需要国际协议来同步放缓,马斯克和奥特曼都表示赞同。但没有一家公司真的停下来了。Anthropic与OpenAI之间的竞争依然激烈,双方都在努力开发越来越先进的模型,以帮助企业客户自动化完成更复杂、更具价值的任务。

所以,这次“一致呼吁”真正告诉我们的事情,可能比它表面说的要简单得多:连最激进的人也开始承认,他们造出来的东西,自己不完全控制得住。而接下来会发生什么,取决于他们能不能把这句话变成实际行动。

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。