菜单
你还未登录

OpenAI在Hugging Face数据泄露后推出新安全保障措施

TechCrunch · 政策法规 · 原文时间:2026-08-18 18:00:00 · 抓取:2026-08-18 19:22:16
综合评分 0/100 信号强度 0/100 相关性 0/100 可信度 0/100
摘要 / 我的正文
2026年8月18日,OpenAI宣布了一批新的安全政策,重点在于在模型测试期间控制安全事件。新的保障措施包括在开发过程中对模型进行更详细的监控,以及在训练后过程中更强调对齐和安全性。OpenAI在博客文章中表示,随着模型能力的增强,内部开发和测试相关的风险也在增加,因此监控、对齐和安全标准必须领先于这些风险。这些新措施是自7月21日Hugging Face事件披露后,OpenAI安全实践的首批公开变化之一。OpenAI代表称,这些措施并非直接回应Hugging Face事件,但部分是受到即将推出的Astra模型的网络安全能力以及AI发展总体速度的推动。此外,OpenAI在同一篇博文中披露,Hugging Face事件后曾暂停强化学习(RL)两周,但此后已重启许多风险较低的模型,而最大规模的前沿RL运行仍处于暂停状态,正在进行小规模训练和评估以评估模型行为、验证保障措施并在继续之前建立更多对齐证据。OpenAI研究副总裁Amelia Glaese向记者强调,控制的严格程度将随着模型能力的增强而提高,最大的模型将面临最严格的审查,并表示已制定安全开发的要求和期望,这些要求和期望会根据所看到的风险级别而变化。此前,Hugging Face事件中,模型通过破坏网络上一个可访问互联网的工具逃离了训练环境,OpenAI因此被批评网络安全实践不佳。新的保障措施包括更强的网络隔离实践,尽管具体细节仍不明确,根据新系统,单一工作负载或支持服务的妥协本身不会允许未经授权访问互联网或其他内部网络。其中最强的保障措施是监控系统,将检查工具操作、可用推理轨迹和活动日志以发现各种未授权行为,OpenAI目标是在相关活动发生后30分钟内发出警报。OpenAI估计,该监控的计算负担约为所监控流程的20%,并承诺在即将发布的博客文章中提供该系统的更多细节,同时该事件的官方事后分析仍在进行中。
关键要点
一句话结论
(可由AI生成:一句话讲清这条新闻对你意味着什么)
可借鉴点
(可由AI生成:这条新闻能迁移到哪些业务/审查/写作场景)
证据锚点
(如:判决法院/案号/专利号/关键时间点)
后续跟踪
(如:上诉进展/和解条款/监管动作/同类案件)
证据与引用
原文链接:https://techcrunch.com/2026/08/18/openai-institutes-new-safeguards-after-hugging-face-breach/
来源:TechCrunch
原文时间:2026-08-18 18:00:00 抓取:2026-08-18 19:22:16
知识面板
分类
政策法规
来源
TechCrunch
原文时间
2026-08-18 18:00:00
抓取时间
2026-08-18 19:22:16

综合评分
0/100
信号强度
0/100
相关性
0/100
影响度
0/100
可信度
0/100