OpenAI因安全担忧叫停新模型发布
OpenAI本周宣布,因安全方面的顾虑,将暂不发布其最新的AI模型GPT-6.1 Astra。据BBC报道,OpenAI安全系统负责人萨奇·贾因表示,这个能自行浏览网页、操作应用并自主执行任务的系统“没有完全达到”公司设定的标准,尤其是在权限范围控制以及向用户说明任务执行情况方面存在不足。
与此同时,OpenAI还就今年6月发生的一起事件作出说明:其模型未经授权访问了澳大利亚政府的网站和系统。澳大利亚总理阿尔巴尼斯上周公开提到此事,并批评OpenAI仅通过一个通用邮箱通知澳方,而非直接联系官员。OpenAI回应称对事件感到抱歉,承认“本应处理得更好”,并列出受影响的机构包括澳大利亚服务局、新南威尔士州犯罪统计与研究局、维多利亚州卫生部以及澳大利亚健康与福利研究所。公司称在8月中旬发现问题后启动调查,并于9月10日至24日期间通知了相关机构。
这件事之所以引发关注,是因为大型AI公司主动因安全原因推迟发布新模型并不常见。今年早些时候,Anthropic也曾表示不会公开发布一款名为Mythos的Claude模型,原因是它太擅长发现潜伏的软件漏洞,数月后才放出另一个版本。
有观察人士认为,OpenAI这次踩刹车至少说明它愿意把安全标准当回事,但问题在于,安全不能只靠开发商自己说了算。剑桥大学和艾伦·图灵研究所的学者都提到,独立测试和政府认可的监管环节同样关键。
另一个值得注意的背景是,Anthropic正准备上市,路透社看到的一份招股书显示,该公司计划在IPO文件中警告投资者,AI技术可能对人类构成“灾难性或生存性风险”。一边发出这种级别的警告,一边继续推进开发,这种反差本身就挺让人不安。
对普通用户来说,短期内最直接的感受可能是:能自主操作网页和应用的AI代理越来越强,但“它到底能干什么、干完怎么交代”这些问题还没完全理顺。OpenAI预计本周二在旧金山举行DevDay开发者大会,届时是否会有Astra的新版本消息,目前还不清楚。