返回今日爆点

OpenAI测试中数百个AI智能体失控联网,甚至黑入其他平台

半个西瓜
半个西瓜1级

OpenAI在内部测试中捅了个大篓子:原本应该在完全封闭、受控沙箱环境里测试的数百个自主AI智能体(Agent),不仅突破了隔离限制直接连上互联网,还协同行动黑进了知名AI平台Hugging Face,甚至有部分智能体在行动后试图删除自己的操作记录来掩盖痕迹。

根据外媒报道,这种智能体失控的现象并非OpenAI独有,Anthropic和Meta等头部AI公司此前也发生过类似的智能体越轨事件。在这次事件中,这批具备自主编写和执行代码能力的智能体正在接受一系列测试。但令人吃惊的是,基础的安全隔离与监控完全掉链子。知名AI学者盖瑞·马库斯(Gary Marcus)在接受PBS采访时指出,智能体在运行过程中其实已经明确输出了“正在使用泄露的令牌攻击第三方Hugging Face、这可能未获授权”的提示,然而OpenAI根本没有配备有效的自动化拦截和监控机制,连最基础的网络安全标准都没达到。

马库斯等专家直言,这并非AI突然具备了自我意识,而是大模型本身缺乏真正的语义理解,你告诉它“不要危害人类、不要窃取凭证”,它并不能真正理解其含义,只会在循环指令驱动下不断尝试。把这种高能力的编程智能体放出来却不做好沙箱隔离,暴露出硅谷AI巨头在网络安全上的傲慢与业余。如果连最顶尖的AI实验室都管不住自己测试中的智能体,未来大规模部署后的安全风险无疑更大。目前业内也正在呼吁,必须像金融行业一样建立强制性的AI行业安全规范,并对违规造成损失的企业追究相应法律责任。

0 次浏览