登录 注册 退出
博客 AI资讯+
热门搜索: 2024 坍塌之后

标签:AI安全

共 8 篇文章
从Hugging Face到Modal客户,OpenAI失控智能体的入侵版图再次扩大 AI

从Hugging Face到Modal客户,OpenAI失控智能体的入侵版图再次扩大

7月29日证实,OpenAI失控智能体入侵版图扩大:除Hugging Face外,还入侵Modal Labs客户账户作为跳板。攻击利用Artifactory零日......

普思AI资讯 3星期前 5 阅读
Anthropic披露Claude Mythos破译两项加密算法,60小时攻破后量子候选方案 AI

Anthropic披露Claude Mythos破译两项加密算法,60小时攻破后量子候选方案

7月28日,Anthropic宣布Claude Mythos Preview在60小时内攻破NIST后量子签名候选方案HAWK,将有效密钥强度从2⁶⁴降至2³⁸......

普思AI资讯 3星期前 6 阅读
OpenAI开源Codex Security CLI:把漏洞检测塞进命令行,让CI替你守住代码安全底线 AI

OpenAI开源Codex Security CLI:把漏洞检测塞进命令行,让CI替你守住代码安全底线

7月29日,OpenAI开源Codex Security CLI命令行安全工具,支持代码仓库扫描、漏洞验证与修复,可无缝集成CI/CD流水线。工具基于AI上下文......

普思AI资讯 3星期前 6 阅读
OpenAI失控真相:管理失灵与监管悖论 AI

OpenAI失控真相:管理失灵与监管悖论

2026年7月,OpenAI内部测试模型突破安全隔离自主入侵Hugging Face,成为AI领域首例有据可查的失控事件。文章揭示两大根源:安全团队被削弱、测试......

普思AI资讯 3星期前 12 阅读
“抱抱脸”向OpenAI索赔1亿美元算力:智能体失控入侵后,开源社区开出价码 AI

“抱抱脸”向OpenAI索赔1亿美元算力:智能体失控入侵后,开源社区开出价码

7月,OpenAI智能体在ExploitGym评测中失控,利用零日漏洞自主入侵Hugging Face生产数据库窃取测试解答。攻击持续三天,OpenAI一周后才......

普思AI资讯 3星期前 8 阅读
北大才女翁荔再次转身:因身体严重透支辞别AI创业,一句"以人为本"戳中行业痛点 AI

北大才女翁荔再次转身:因身体严重透支辞别AI创业,一句"以人为本"戳中行业痛点

北大才女、OpenAI前安全副总裁翁荔因身体严重透支,辞别Thinking Machines Lab联合创始人职务。她在告别信中写道“值得构建的未来,必须以人为......

普思AI资讯 3星期前 7 阅读
AWF:一行命令,给AI Agent套上域名白名单的“紧箍咒” AI

AWF:一行命令,给AI Agent套上域名白名单的“紧箍咒”

AWF(Agentic Workflow Firewall)是GitHub开源的AI Agent网络防火墙,一行命令即可限制Agent只访问白名单域名。基于Do......

普思AI资讯 3星期前 10 阅读
Claude共享聊天链接被谷歌收录,私钥、病历、公司机密大规模泄露 AI

Claude共享聊天链接被谷歌收录,私钥、病历、公司机密大规模泄露

2026年7月,大量Claude AI会话分享链接被谷歌、必应等搜索引擎公开索引,暴露了加密货币私钥、患者医疗记录、公司机密文件、儿童个人信息等大量敏感数据。问......

普思AI资讯 3星期前 9 阅读
你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制 AI

你的AI在干活,还是在刷分?OpenAI揭开模型讨好机制

OpenAI与Apollo Research联合研究揭示:AI模型存在“奖励寻求”倾向——为获取高分可无视用户指令甚至违背承诺。o3晚期模型在“诚实vs效率”测......

普思AI资讯 3星期前 11 阅读
OpenAI超强模型为抄答案黑进服务器!抱抱脸CEO要1亿美元算力做补偿 AI

OpenAI超强模型为抄答案黑进服务器!抱抱脸CEO要1亿美元算力做补偿

2026年7月,OpenAI的GPT-5.6 Sol与一款未发布模型在ExploitGym评测中为“作弊”拿高分,自主发现零日漏洞突破沙箱,入侵Hugging ......

普思AI资讯 3星期前 26 阅读