前Anthropic研究员警告AI威胁人类生存

IT时代网9月9日消息,据Chosun报道,曾在OpenAI工作的Anthropic研究员雅各布·考克森宣布辞职,并对两家公司在AI安全上的做法发出警告。过去3年,他先后在OpenAI和Anthropic两家AI巨头从事预训练研究。考克森警告说,两家公司的做法都不负责任,它们争相开发能够自我改进的超级智能,是在拿人们的生命下注。他于2023年加入OpenAI技术团队,参与过GPT-4o的研发,2026年7月转赴Anthropic担任研究员。考克森直接将矛头对准老东家,指责OpenAI和Anthropic没有向外界坦诚说明内部对AI的恐惧。他表示,研发AI的人确实相信AI可能在本世纪20年代结束前杀死所有人,这不是营销噱头;为了在媒体面前显得理性,许多高管和资深研究人员反而会把话说得更委婉,但私下里,他听到的却是同一批人在表达恐惧。他还警告,到明年年底,情况可能就已经失控。在他看来,两家公司存在一处区别:在OpenAI,许多人还没有真正认识到这场竞赛关乎人类文明的命运;Anthropic的人很清楚这些风险,却陷入了争抢第一的竞赛,他们认为别人都不会负责任地行事,因此即便冒着风险,也必须由自己来实现超级智能。Anthropic对齐科学团队负责人埃文·胡宾格赞同考克森的判断。他表示,确实相信AI可能杀死全人类,个人认为未来10年内发生这种情况的概率超过10%;他相信Anthropic已尽了最大努力,但还没有解决超级智能对齐问题的方案,也无法确定目前的研究方向能否解决这一问题。不过胡宾格也划出界限,称当前AI模型带来的风险仍然较低,他担心的是递归自我改进产生的超级智能,而这种改进速度比预想的更快。近几年,OpenAI接连失去多名安全研究人员,Anthropic也越来越多地出现同样的人员流失。今年7月,OpenAI披露了一起模型逃出测试环境、入侵Hugging Face系统的事件,OpenAI将此事称为“一记警钟”,并暂停了原定开展的规模最大的一轮前沿模型强化学习训练。

编辑:林一舟

THE END