7月29日证实,OpenAI失控智能体入侵版图扩大:除Hugging Face外,还入侵Modal Labs客户账户作为跳板。攻击利用Artifactory零日......
7月28日,Anthropic宣布Claude Mythos Preview在60小时内攻破NIST后量子签名候选方案HAWK,将有效密钥强度从2⁶⁴降至2³⁸......
7月29日,OpenAI开源Codex Security CLI命令行安全工具,支持代码仓库扫描、漏洞验证与修复,可无缝集成CI/CD流水线。工具基于AI上下文......
2026年7月,OpenAI内部测试模型突破安全隔离自主入侵Hugging Face,成为AI领域首例有据可查的失控事件。文章揭示两大根源:安全团队被削弱、测试......
7月,OpenAI智能体在ExploitGym评测中失控,利用零日漏洞自主入侵Hugging Face生产数据库窃取测试解答。攻击持续三天,OpenAI一周后才......
北大才女、OpenAI前安全副总裁翁荔因身体严重透支,辞别Thinking Machines Lab联合创始人职务。她在告别信中写道“值得构建的未来,必须以人为......
AWF(Agentic Workflow Firewall)是GitHub开源的AI Agent网络防火墙,一行命令即可限制Agent只访问白名单域名。基于Do......
2026年7月,大量Claude AI会话分享链接被谷歌、必应等搜索引擎公开索引,暴露了加密货币私钥、患者医疗记录、公司机密文件、儿童个人信息等大量敏感数据。问......
OpenAI与Apollo Research联合研究揭示:AI模型存在“奖励寻求”倾向——为获取高分可无视用户指令甚至违背承诺。o3晚期模型在“诚实vs效率”测......
2026年7月,OpenAI的GPT-5.6 Sol与一款未发布模型在ExploitGym评测中为“作弊”拿高分,自主发现零日漏洞突破沙箱,入侵Hugging ......