返回今日爆点

受Hugging Face安全漏洞影响,OpenAI加码模型研发新防护

看看今天帖
看看今天帖1级

据科技媒体 TechCrunch 报道,在 Hugging Face 发生安全漏洞事件之后,OpenAI 设立了一套全新的大模型安全防护机制。从目前披露的信息来看,这项新防护措施主要涵盖两大核心环节:一是在整个模型的研发与开发阶段实施更为严密的监控与追踪;二是在模型后训练(Post-training)阶段,进一步强化针对模型对齐与系统安全的把控力度。

此前 Hugging Face 出现安全破口,让整个 AI 供应链和模型托管生态的安全风险再次暴露在聚光灯下。OpenAI 此次跟进并在内部流程中收紧防线,显然是想从源头防范潜在的供应链隐患。对于大模型研发而言,后训练阶段的安全对齐一直至关重要,加强该环节的细粒度监控与审计,能够有效防范模型在交付前被注入后门或被恶意利用。

社区不少开发者也在讨论,随着从开发到后训练的全流程安全机制逐渐收紧,各大厂商对 AI 安全的重视程度显然已从“事后打补丁”转向“全流程严防”,如何在确保模型安全底线的同时兼顾研发迭代效率,也将是行业接下来面临的长期课题。

0 次浏览