返回今日爆点

Anthropic研究员离职抗议,主管坦言AI毁灭人类概率超10%

潜水
潜水2级

当地时间9月9日,AI创企Anthropic内部爆发了一场引发广泛关注的安全争议。曾在OpenAI和Anthropic从事模型训练的研究员雅各布·考克森(Jacob Coxon)在社交平台宣布离职,公开指责两家头部AI公司正在不顾后果地竞逐“具备自我迭代能力的超级智能”,直言从业者是在“拿人类生命做赌注”,即便开发者自己都深信AI有可能在十年内带来毁灭性风险。

令人意外的是,Anthropic的安全团队负责人埃文·哈宾格(Evan Hubinger)随后直接回复并证实了这种担忧。哈宾格表示,AI自我改进和演进的速度远超此前预期,他个人同样认为,未来十年内AI导致人类毁灭的概率超过10%。更关键的是,哈宾格坦言Anthropic目前根本没有一套能够确保超人类AI始终安全且符合人类价值观的完整方案,而且短期内也未明确走在解决这一问题的轨道上。

很多关注AI行业的朋友应该还记得,Anthropic当年正是由一批因担忧安全问题而离开OpenAI的核心成员创立的,主打的就是“安全第一”和“负责任AI”。如今随着大模型竞赛白热化以及各家推进IPO的商业压力,连以安全立身的公司也开始面临同样的内部抗议与对策缺失。当一线负责安全的高管和训练人员都公开把毁灭风险挂在嘴边、甚至承认处于失控军备竞赛时,AI安全究竟是研发底线还是变成了公关口号,确实值得深思。

0 次浏览