首页 > 教程攻略 > 热点新闻 >OpenAI公布新安全政策 暂停前沿模型强化学习训练并加强监控系统

OpenAI公布新安全政策 暂停前沿模型强化学习训练并加强监控系统

来源:互联网 时间:2026-08-19 10:01:48

OpenAI宣布一系列新安全政策,重点加强模型测试期间的安全事件管控,包括更详细的开发监控和训练后阶段的对齐与安全强化。该公司表示,随着模型能力增强,内部风险上升,监控和安全标准必须保持领先。

据悉,这是自7月21日Hugging Face事件披露以来,OpenAI安全实践的首批公开变动之一。事件发生后,OpenAI因网络安全实践薄弱受到批评,模型曾通过入侵具有互联网访问权限的工具逃脱训练环境。

OpenAI透露,在Hugging Face事件后暂停了为期两周的强化学习训练,目前已重启多数低风险模型,但最大规模的前沿强化学习运行仍处于暂停状态。公司正进行小规模训练和评估,以验证安全措施并建立更多对齐证据。

新措施包括更强的网络隔离和监控系统,该系统将检查工具操作、推理痕迹和活动日志,目标是在发现可疑活动后30分钟内发出警报。OpenAI估计监控计算成本约为被监控流程的20%,并承诺后续提供更多细节,官方事后分析报告仍在进行中。