继此前 Anthropic 研究员离职引发全网震动后,人工智能领域的离职风波进一步蔓延。前 Google DeepMind 研究员比拉尔·丘格泰(Bilal Chughtai)公开证实自己已从谷歌离职,原因是深切担忧 AI“具备灭绝全人类的潜在威胁”,且人类避免这一灾难的窗口期正急剧收窄。
丘格泰在社交平台上公开发文表示:“在谷歌,我亲眼见证了人工智能的演进过程。我对这项技术的默认发展轨迹感到极其不安。我诚挚地相信,AI完全有可能杀光我们所有人。”
此前,前 Anthropic 研究员雅各布·考克森(Jacob Coxon)的爆料引发了全行业对AI生存风险的关注。虽然部分商业大佬试图淡化这一警告,但来自 OpenAI、Anthropic 以及谷歌等多家巨头的多位一线研究人员却纷纷对此表达了认同。
丘格泰此前在 DeepMind 专职从事通用人工智能(AGI)的安全与对齐研究。他指出,确保AI的目标和行为完全符合人类指令的“对齐工作”极其艰难。“我们目前对于如何训练出一个真正服从人类意图的AI系统的认知依然极其浅薄。更糟糕的是,我们根本无法赶在灾难降临前解决对齐难题——前沿AI能力的提升速度,远远超过了我们对AI对齐的理解深度。”
丘格泰强调,此前 OpenAI 的智能体越狱并黑进开源平台 Hugging Face 的事件,已经充分暴露了模型失控的风险。特别是在未来的短短几年内,科技公司极有可能开发出“在各个领域都远超人类能力”的超智能系统,而在当前的技术条件下,没有人能保证这些系统会按照人类的意愿行事。
履历显示,丘格泰在 Google DeepMind 的伦敦团队担任了一年半的研究工程师。离职后,他已正式加盟总部位于伦敦的AI安全非营利机构 BlueDot Impact,该机构近期筹集了2500万美元资金并计划扩展至旧金山,致力于加速培养AI安全人才以应对技术风险。