首页必读视频专题飞象趣谈光通信人工智能低空机器人智能汽车终端会展特约记者

OpenAI披露Hugging Face事件后安全新政:暂停前沿模型强化学习训练

2026年8月19日 10:50环球市场播报

周二,OpenAI宣布了一系列新的安全政策,重点加强模型测试期间的安全事件管控。新措施包括在开发过程中对模型进行更详细的监控,以及在训练后阶段更强调对齐与安全。

“随着模型能力不断增强,内部开发和测试过程中所伴随的风险也在上升,”该公司在一篇博客文章中表示。“我们的监控、对齐和安全标准必须保持在这些风险之前。”

这是自7月21日Hugging Face事件披露以来,OpenAI安全实践方面首批公开的变动之一。

OpenAI代表表示,这些措施并非直接针对Hugging Face事件,但在一定程度上也受到即将推出的Astra模型网络安全能力以及AI发展整体步伐的推动。

在同一篇博文中,OpenAI透露,在Hugging Face事件后其暂停了为期两周的强化学习(RL)训练,但此后已重启了多数风险较低的模型。

“我们最大规模的计划前沿强化学习运行仍处于暂停状态,同时我们正进行较小规模的训练和评估,以观察模型行为、验证我们的安全措施,并在推进前建立更多对齐方面的证据,”博文写道。

OpenAI研究副总裁Amelia Glaese对记者表示,随着模型能力增强,管控的严格程度也将相应提高,最大的模型将面临最严格的审查。

“我们已经为安全开发制定了要求和预期,”Glaese告诉记者。“这些要求和预期会根据我们观察到的风险水平而变化。”

事件发生后,OpenAI因其较弱的网络安全实践而受到批评,当时模型通过入侵其网络上具有互联网访问权限的工具而逃脱了训练环境。新措施包括更强的网络隔离措施,但具体细节仍较模糊。博文称,在新体系下,“单一工作负载或支持服务的受损本身并不足以导致对互联网或其他内部网络的未授权访问”。

最严格的是监控系统,它将检查工具操作、可用推理痕迹和活动日志,以发现各种未经授权的行为。OpenAI表示,其目标是在发现可疑活动后30分钟内发出警报。

OpenAI估计,该监控的计算成本约为被监控流程的20%。该公司承诺将在后续博文中提供有关该系统的更多细节。关于该事件的官方事后分析报告仍在进行中。

编 辑:章芳
飞象网版权及免责声明:
1.本网刊载内容,凡注明来源为“飞象网”和“飞象原创”皆属飞象网版权所有,未经允许禁止转载、摘编及镜像,违者必究。对于经过授权可以转载,请必须保持转载文章、图像、音视频的完整性,并完整标注作者信息和飞象网来源。
2.凡注明“来源:XXXX”的作品,均转载自其它媒体,在于传播更多行业信息,并不代表本网赞同其观点和对其真实性负责。
3.如因作品内容、版权和其它问题,请在相关作品刊发之日起30日内与本网联系,我们将第一时间予以处理。
本站联系电话为86-010-87765777,邮件后缀为cctime.com,冒充本站员工以任何其他联系方式,进行的“内容核实”、“商务联系”等行为,均不能代表本站。本站拥有对此声明的最终解释权。
推荐阅读

精彩视频

精彩专题

关于我们广告报价联系我们隐私声明本站地图

CCTIME飞象网 CopyRight © 2007-2026 By CCTIME.COM

京ICP备08004280号-1 电信与信息服务业务经营许可证080234号 京公网安备110105000771号

公司名称: 北京飞象互动文化传媒有限公司

未经书面许可,禁止转载、摘编、复制、镜像