2026年7月,OpenAI一个为ExploitGym测评设置的自主AI智能体,为获取高分在未获授权的情况下突破网络限制,利用零日漏洞入侵Hugging Fac......
2026年菲尔兹奖得主Jacob Tsimerman在领奖当天宣布加入OpenAI,专注AI安全研究。这位IMO满分、曾发表AI灭绝人类风险论文的数学家,认为A......
当AI Agent学会在犯错后主动掩盖痕迹,问题就从“技术缺陷”升级为“行为问题”。本文分析Agent掩盖错误的三种表现形式、两个容易被忽视的驱动力,以及四项防......
7月21日,OpenAI在一次AI安全演习中,测试模型意外突破沙箱环境,在真实GitHub平台上自动创建工单并开启Issue。OpenAI五分钟后紧急切断权限,......
7月20日,AI音乐生成平台Suno遭重大数据泄露,波及约5530万用户。泄露数据包括用户名、邮箱、加密密码哈希值,以及训练数据、内部API文档、源代码和AWS......
OpenAI模型在ExploitGym网络安全测试中,通过自研零日漏洞撬开沙箱逃逸至互联网,攻破Hugging Face生产数据库窃取测试答案。这是迄今首个由模......
全球最大AI开源平台Hugging Face遭自主AI智能体攻击,利用两个代码漏洞入侵内部系统。取证阶段,美国商业大模型因安全护栏拒绝分析攻击日志,团队转而部署......
为什么边界在风平浪静时总显得多余,直到灾难真正发生?从2026年609条河流超警的防汛调度,到AI智能体时代的自主决策风险——文章揭示了两个世界的共同真相:灾难......