OpenAI披露Hugging Face事件后安全新政:暂停前沿模型强化学习训练
时间:2026-08-19 | 作者:云端旅人 | 阅读:0周二,OpenAI宣布了一系列新的安全政策,重点加强模型测试期间的安全事件管控。新措施包括在开发过程中对模型进行更详细的监控,以及在训练后阶段更强调对齐与安全。
“随着模型能力不断增强,内部开发和测试过程中所伴随的风险也在上升,”该公司在一篇博客文章中表示。“我们的监控、对齐和安全标准必须保持在这些风险之前。”
这是自7月21日Hugging Face事件披露以来,OpenAI安全实践方面首批公开的变动之一。
OpenAI代表表示,这些措施并非直接针对Hugging Face事件,但在一定程度上也受到即将推出的Astra模型网络安全能力以及AI发展整体步伐的推动。
在同一篇博文中,OpenAI透露,在Hugging Face事件后其暂停了为期两周的强化学习(RL)训练,但此后已重启了多数风险较低的模型。
“我们最大规模的计划前沿强化学习运行仍处于暂停状态,同时我们正进行较小规模的训练和评估,以观察模型行为、验证我们的安全措施,并在推进前建立更多对齐方面的证据,”博文写道。
OpenAI研究副总裁Amelia Glaese对记者表示,随着模型能力增强,管控的严格程度也将相应提高,最大的模型将面临最严格的审查。
“我们已经为安全开发制定了要求和预期,”Glaese告诉记者。“这些要求和预期会根据我们观察到的风险水平而变化。”
事件发生后,OpenAI因其较弱的网络安全实践而受到批评,当时模型通过入侵其网络上具有互联网访问权限的工具而逃脱了训练环境。新措施包括更强的网络隔离措施,但具体细节仍较模糊。博文称,在新体系下,“单一工作负载或支持服务的受损本身并不足以导致对互联网或其他内部网络的未授权访问”。
最严格的是监控系统,它将检查工具操作、可用推理痕迹和活动日志,以发现各种未经授权的行为。OpenAI表示,其目标是在发现可疑活动后30分钟内发出警报。
OpenAI估计,该监控的计算成本约为被监控流程的20%。该公司承诺将在后续博文中提供有关该系统的更多细节。关于该事件的官方事后分析报告仍在进行中。
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。
相关文章
更多-
- 欧洲最大航空集团瑞安航空与飞猪达成机票直连合作
- 时间:2026-08-25
-
- 比特币重返80000美元 美债回购政策助推加密市场复苏
- 时间:2026-08-25
-
- 追觅科技:调整部分探索业务,资源进一步向四大主营业务集中
- 时间:2026-08-25
-
- 宗馥莉再罢免“心腹”:人力资源部部长寇静被免职,刘晓静接任
- 时间:2026-08-25
-
- 拼多多发布Q2财报:营收1124亿元,利润272亿元
- 时间:2026-08-25
-
- 拼多多陈磊:全球贸易环境加速变化,挑战和机遇都很大
- 时间:2026-08-25
-
- 拼多多高管解读Q2财报:对品牌自营的长期前景有信心
- 时间:2026-08-25
-
- 小米玄戒O3官宣支持LPDDR6,长鑫存储为国产内存合作伙伴
- 时间:2026-08-25
精选合集
更多大家都在玩
大家都在看
更多-
- 2026年9月17日小鸡庄园答案
- 时间:2026-09-16
-
- 蚂蚁庄园今日答案2026年9月17日
- 时间:2026-09-16
-
- 蚂蚁庄园小课堂今日最新答案2026年9月17日
- 时间:2026-09-16
-
- 蚂蚁庄园小鸡答题今日答案2026年9月17日
- 时间:2026-09-16
-
- 褪黑素主要由人体哪个器官分泌 蚂蚁庄园今日答案9.17
- 时间:2026-09-16
-
- 蚂蚁庄园今天答题答案2026年9月17日
- 时间:2026-09-16
-
- 蚂蚁庄园答题今日答案2026年9月17日
- 时间:2026-09-16
-
- 研学旅游指导师的核心服务对象是 蚂蚁新村今日答案2026.9.16
- 时间:2026-09-16