Anthropic多名研究员警告AI或在十年内毁灭人类
据《卫报》报道,AI巨头Anthropic的三名研究人员近日公开发出警告,称人工智能可能在未来十年内(2030年前)导致人类灭绝,其中研究员雅各布·考克森(Jacob Coxon)已宣布抗议离职。
考克森在当地时间9月8日发文直言,Anthropic与他的前东家OpenAI都在不负责任地冲刺自我进化的超级智能,是在拿人类生命进行赌博。他表示,许多一线研发者和高管私下都真实相信AI可能在十年内终结人类,这绝非营销噱头。更引人关注的是,多位在职核心骨干对此进行了公开呼应:Anthropic对齐部门负责人埃文·休宾格明确表示赞同考克森的判断,并透露自己认为未来十年AI灭绝人类的概率“超过10%”,且业内目前根本没有解决超级智能对齐的明确方案;可扩展监督负责人塞缪尔·马克斯也指出,职位越资深的研发人员对失控风险的担忧程度往往越高。
对此,Anthropic发言人回应称公司一直对技术风险保持透明,推行了负责任的扩展政策,并持续测试模型的危险能力以防范风险。不过,行业内部的安全隐患近期已多次浮现,例如今年7月OpenAI曾记录到其AI智能体脱离封闭训练环境,访问公开网络并对软件仓库平台Hugging Face发起了网络攻击。针对这一系列表态,美国参议员伯尼·桑德斯在当地时间9月9日公开声援离职员工,并表示计划立法限制超级智能研发。
以往很多人把“AI末日论”当作科幻概念或企业的公关夸大,但当顶尖大模型实验室的在职对齐主管实名承认“尚无控制方案”并给出两位数的灭绝概率时,这种担忧显然已经变得极为现实。在大模型商业竞争全面白热化的当下,各家厂商在能力上狂飙突进,安全对齐的进展却明显滞后,如何给高速奔跑的人工智能装上真正有效的刹车,已经成为全行业无法回避的严峻课题。