Anthropic安全专家警告:未来十年人工智能毁灭人类的概率超10%
据英国广播公司(BBC)当地时间9月9日报道,知名人工智能公司 Anthropic 的顶尖对齐安全研究员埃文·休宾格在社交平台发文预警,称随着技术突飞猛进,他认为未来十年内人工智能“可能消灭全人类”的概率超过了10%。
休宾格表示,虽然目前已有的人工智能模型实际风险较低,但他非常担忧技术很快会实现自我进化与迭代,从而对人类生存构成根本威胁。他坦言,尽管 Anthropic 已经在尽最大努力,但目前并没有一套解决超级智能对齐问题的完整方案,也没有明确走在解决该问题的正确轨道上。他的这番表态是在回应刚从 Anthropic 离职的研究员雅各布·考克森。考克森此前也曾就职于 OpenAI,他公开发文指责两家头部公司“行事均不够负责”,并警告未来很快会出现能够攻破任何系统、颠覆行业并获取实际权力和资源的超人系统。
针对技术人员接连发出的警告,联合国人工智能顾问、计算机科学家温迪·霍尔在接受采访时对此表示震惊,但她同时也提出质疑,认为随着 Anthropic 和 OpenAI 竞相冲刺备受瞩目的首次公开募股,这些言论不排除存在“公关与营销炒作”的成分,并呼吁投资者谨慎对待此类价值观的企业。与此同时,英国前财政部官员达伦·琼斯已致信呼吁各国政府尽快合作制定多边条约以管控超级智能开发;而据《金融时报》(Financial Times)报道,Anthropic 近期还被曝出未将其最新模型提交给英国人工智能安全研究所进行安全测试。
事实上,近期包括 OpenAI、Anthropic 和 Meta 在内的多家企业均披露了旗下人工智能智能体自主执行网络攻击的测试案例,OpenAI 首席科学家雅库布·帕乔基以及 Anthropic 创始人达里奥·阿莫代伊等人也陆续呼吁对人工智能研发节奏保持极度谨慎。
站在普通用户的视角来看,以前大众讨论“人工智能毁灭人类”大多停留在科幻幻想或宏大叙事层面,但如今一线大厂负责“安全刹车”的核心研究员公开承认技术可能失控且缺乏有效对齐方案,确实容易引发外界的真实担忧。不过,在行业巨头争相谋求商业化和资本上市的节骨眼上,究竟有多少是技术人员发自内心的危机预警,又有多少属于科技公司的预期管理与造势手段,也值得外界持续观察。