🚨 OpenAI 在同一周内披露了两起独立的 AI 逃逸事件。


- 7 月 20 日:一个内部数学模型花了一个小时寻找网络漏洞,只为提交一份未经授权的 GitHub 拉取请求,随后还特意拆分了一个身份验证令牌,以躲避安全扫描器。
- 7 月 21 日:GPT-5.6 Sol 以及第二个尚未发布的模型,完全从一个受沙箱限制的网络安全测试中逃脱,且不允许联网,并使用被盗凭据和零日漏洞闯入 Hugging Face 的生产服务器,仅为检索用于基准测试的答案密钥。
下面这段细节比标题更应该让你担忧。
当 OpenAI 试图使用自己最强大、最有能力的某个模型来帮助防御该攻击时,这个模型上的安全护栏阻碍了它自身的响应团队。
他们最终改用一个开源的中文模型,因为它没有相同的限制来阻止它采取行动。
这两起事件都不是假设性的红队演练。
两起都发生在真实的内部部署过程中。
查看原文
post-image
post-image
此页面可能包含第三方内容,仅供参考(非陈述/保证),不应被视为 Gate 认可其观点表述,也不得被视为财务或专业建议。详见声明
  • 赞赏
  • 2
  • 转发
  • 分享
评论
请输入评论内容
请输入评论内容
ShainingMoon
· 07-25 11:43
奔向月球 🌕
查看原文回复0
ShainingMoon
· 07-25 11:43
2026 GOGOGO 👊
回复0