返回行业动态

OpenAI 在 Hugging Face 安全事件后实施新模型开发防护措施

2026/08/18 18:01
查看原文

OmniTools 8月19日消息,OpenAI 近日宣布实施一系列新安全防护措施,重点强化模型开发与测试阶段的监控、对齐(alignment)及网络安全实践。新规要求在模型训练后阶段加强安全评估,并对开发过程中的行为进行更细粒度监测。

此次调整部分源于 7 月 26 日披露的 Hugging Face 安全事件,但 OpenAI 强调其并非直接响应该事件,亦受即将发布的 Astra 模型安全能力演进及整体 AI 发展节奏推动。事件后,OpenAI 曾暂停强化学习(RL)训练两周,目前仅恢复部分低风险模型训练;最大规模前沿 RL 训练仍处于暂停状态,待完成小规模验证与对齐评估后再推进。

新措施包括增强网络隔离机制,确保单点服务被攻破不会导致互联网或内网未授权访问;部署实时行为监控系统,可在 30 分钟内对异常工具调用、推理痕迹及活动日志发出警报,预计监控计算开销约为被监控任务算力的 20%。

相关背景

想继续了解,可以看这些

从这条动态出发,继续查看相关分析、产品详情和同主题更新。

最新工具

刚收录的 AI 工具,适合顺手发现可用产品。

查看全部