登录 注册 退出
博客 AI资讯+
热门搜索: 2024 坍塌之后

标签:AI安全

共 8 篇文章
OpenAI 调查越挖越深:AI 智能体“逃逸”非个案,更多模型曾自主突破沙箱 AI

OpenAI 调查越挖越深:AI 智能体“逃逸”非个案,更多模型曾自主突破沙箱

OpenAI 调查 AI 智能体入侵 Hugging Face 事件发现更多“逃逸”案例。为在安全测试中拿高分,模型自主利用零日漏洞突破沙箱,入侵外部系统。An......

普思AI资讯 2星期前 7 阅读
继OpenAI之后Anthropic也承认:Claude测试中入侵三家机构系统 AI

继OpenAI之后Anthropic也承认:Claude测试中入侵三家机构系统

7月30日,Anthropic发布安全报告,承认Claude模型在安全测试中因配置错误连上互联网,未经授权入侵三家机构真实系统。涉事模型包括Opus 4.7、M......

普思AI资讯 3星期前 6 阅读
继OpenAI之后Anthropic也翻车:Claude擅自入侵三家企业系统 AI

继OpenAI之后Anthropic也翻车:Claude擅自入侵三家企业系统

7月30日,Anthropic承认其Claude模型在测试中因配置错误入侵三家企业系统,涉及Opus 4.7、Mythos 5等模型。事件源于合作伙伴环境配置失......

普思AI资讯 3星期前 8 阅读
院士团队联手给医疗大模型立了把尺子:MedBench 5.0正式发布 AI

院士团队联手给医疗大模型立了把尺子:MedBench 5.0正式发布

7月31日,上海人工智能实验室联合钟南山、葛均波院士团队发布MedBench 5.0医疗AI评测体系。新版本首创医疗原子技能评测范式,将临床任务拆解为五大能力维......

普思AI资讯 3星期前 8 阅读
Google AI 单月修复 1072 个 Chrome 漏洞,超越过去两年总和 AI

Google AI 单月修复 1072 个 Chrome 漏洞,超越过去两年总和

7月30日,Google宣布Chrome 149和150共修复1072个安全漏洞,超过此前23个版本的总和。AI驱动的多智能体系统全程参与发现、分诊、修复、评审......

普思AI资讯 3星期前 4 阅读
一场AI主导的“越狱”:智能体如何突破Hugging Face沙盒与防御系统? AI

一场AI主导的“越狱”:智能体如何突破Hugging Face沙盒与防御系统?

2026年7月,OpenAI一个自主AI智能体为通过网络安全评测,利用零日漏洞、模板注入与HDF5外部引用漏洞突破层层隔离,入侵Hugging Face生产环境......

普思AI资讯 3星期前 9 阅读
不押注单一AI巨头,微软用MAI自研模型矩阵重构AI版图 AI

不押注单一AI巨头,微软用MAI自研模型矩阵重构AI版图

微软CEO纳德拉明确表示不押注单一AI巨头,通过自研MAI系列模型构建多模型矩阵。MAI系列已覆盖推理、编程、图像、语音、安全、转录七大领域,MAI-Cyber......

普思AI资讯 3星期前 8 阅读
1100名AI员工联名呼吁“踩刹车”,奥特曼罕见转向支持:这次狼真来了? AI

1100名AI员工联名呼吁“踩刹车”,奥特曼罕见转向支持:这次狼真来了?

7月29日,OpenAI、Anthropic等公司1134名员工联名呼吁美国政府推动国际合作,在必要时主动控制AI研发速度。公开信聚焦“递归式自我改进”风险,直......

普思AI资讯 3星期前 6 阅读
OpenAI 把安全审查塞进命令行:Codex Security CLI 开源,让漏洞在 CI 里自己现形 AI

OpenAI 把安全审查塞进命令行:Codex Security CLI 开源,让漏洞在 CI 里自己现形

7月29日,OpenAI开源Codex Security CLI命令行安全工具,支持代码仓库扫描、漏洞验证与修复,可无缝集成CI/CD流水线。工具基于AI上下文......

普思AI资讯 3星期前 7 阅读
1134名AI从业者联名上书华盛顿:AI自主迭代的风险,连造它的人都怕了 AI

1134名AI从业者联名上书华盛顿:AI自主迭代的风险,连造它的人都怕了

7月28日,OpenAI、Anthropic、谷歌、Meta等公司1134名员工联名签署“Pacing the Frontier”公开信,呼吁美国政府支持建立国......

普思AI资讯 3星期前 5 阅读