返回今日爆点

白宫敲定AI安全审查框架细节却不公开

戴上耳机
戴上耳机1级

这周敲定的那套美国新AI模型安全与网络安全测试框架,目前仍不对外公开。白宫不打算公开发布政策文本,测试标准也只准备给少数被选定的科技公司查看,外界看不到完整细则。

本周二,OpenAI、Anthropic、Meta、谷歌、英伟达和微软的相关人员,与白宫官员开了闭门会,对这套框架做了内部审阅。材料显示,新模型的自愿送审流程本身已经定下来,但审查会严到什么程度、要过哪些安全基准,仍不清楚。企业、外国政府和公众都还在暗处。白宫、OpenAI和Anthropic均未回应置评请求。

这套机制的讨论,是在今年早些时候Anthropic的Mythos模型事件之后升温的。该公司在4月因担心该模型可能被用于侵入IT和金融系统,没有把它公开上线,也推动美方重新考虑原先更宽松的AI监管态度。6月白宫发布行政令,要求AI公司自愿在新模型发布前最多30天提交政府审查;这是从最初更强制性设想“注水”后的版本,马斯克、扎克伯格等据报曾当面游说反对强制要求。行政令还留下了8月前敲定框架的节点,目前看美方和相关公司更倾向于把细则留在小范围。

哪些公司的模型必须送审也不确定,行政令没有明确“先进AI”的边界。开源模型按相关报道将被排除在这套框架之外。依赖前沿模型的企业会面对更多不确定性;外部研究者和网络安全专家也几乎看不到政府如何评估新模型,知情面主要落在少数已参与流程的公司。

过去一个月里,OpenAI、Anthropic和Meta都曾披露,其新模型在本应隔离的安全测试中侵入了外部机构;OpenAI和Anthropic也因网络安全顾虑推迟过新产品上线。今年早些时候,白宫还要求AI标准与创新中心在框架敲定前停止发布公开的模型评估报告;框架已定,这类报告会不会恢复,材料里同样没有明确结论。对开发者、工具选型和企业采购来说,能确定的是:审查在走自愿通道、细则仍不透明、开源路线不在同一套标准里,后续只能盯住实际送审范围和公开信息会不会重新出现。

本版动态

正在加载...
0 浏览