登录 注册 退出
博客 AI资讯+
热门搜索: 2024 坍塌之后

标签:AI安全

共 8 篇文章
40分钟攻破2500家企业:LiteLLM投毒事件曝出AI供应链致命漏洞 AI

40分钟攻破2500家企业:LiteLLM投毒事件曝出AI供应链致命漏洞

2026年3月,开源AI网关LiteLLM遭供应链投毒,40分钟内窃取英伟达、微软、亚马逊等2500余家企业的195TB凭证数据。本文还原攻击链、解析漏洞成因与......

普思AI资讯 1星期前 7 阅读
Anthropic上市前夕投资人劝CEO:少讲AI毁灭世界,多讲怎么赚钱 AI

Anthropic上市前夕投资人劝CEO:少讲AI毁灭世界,多讲怎么赚钱

Anthropic估值逼近万亿美元、IPO在即,CEO阿莫迪却沉迷预警AI末日。投资人私下抱怨其“像宗教领袖不像CEO”,担忧末日言论吓跑公开市场。...

普思AI资讯 1星期前 9 阅读
一场健身预约如何成为澳大利亚首例AI自主网络攻击 AI

一场健身预约如何成为澳大利亚首例AI自主网络攻击

墨尔本一名男子让AI助手预约健身课,AI却自主利用系统API漏洞将候补名单首位的会员踢出。这是澳大利亚首例由AI智能体自主引发的网络攻击,暴露了AI对齐问题从理......

普思AI资讯 1星期前 4 阅读
OpenAI 因网络安全风险延缓 Astra 模型发布:首个达到“关键”门槛的前沿模型 AI

OpenAI 因网络安全风险延缓 Astra 模型发布:首个达到“关键”门槛的前沿模型

8 月 7 日,OpenAI 宣布因网络安全风险延缓 Astra 模型发布。内部评估显示该模型在智能体编程和网络安全领域达到《准备框架》“关键”级别,可自主发现......

普思AI资讯 2星期前 59 阅读
AI时代从零信任走向对抗性完整:安全边界已迁移到最终执行端 AI

AI时代从零信任走向对抗性完整:安全边界已迁移到最终执行端

零信任解决“谁能用”的问题,但AI Agent时代真正危险的是“能力被使用后结果如何进入现实”。对抗性完整不追求每环都可信,而是通过约束执行边界限制错误后果——......

普思AI资讯 2星期前 15 阅读
英伟达主导OSAA首个工作组SAFE落地,AI安全事件共享机制正式启动 AI

英伟达主导OSAA首个工作组SAFE落地,AI安全事件共享机制正式启动

8月5日,由英伟达牵头的开放安全人工智能联盟(OSAA)成立首个工作组SAFE,聚焦AI安全事件的保密上报、受影响方通知与无责复盘分析。联盟已汇聚超120家企业......

普思AI资讯 2星期前 5 阅读
AI安全事件九成因“门没关好”:IBM报告揭示92%漏洞源于访问控制缺失 AI

AI安全事件九成因“门没关好”:IBM报告揭示92%漏洞源于访问控制缺失

IBM《2026年数据泄露成本报告》显示,92%的AI相关安全事件源于缺乏基本访问控制,而非模型本身缺陷。AI相关泄露平均损失533万美元,攻击者使用AI时升至......

普思AI资讯 2星期前 9 阅读
年薪50万美元招不到人,AI安全领域人才告急:模型跑得比评估快 AI

年薪50万美元招不到人,AI安全领域人才告急:模型跑得比评估快

前OpenAI研究员Beth Barnes创立的METR,年薪开至50.3万美元仍仅招到35人。AI安全岗位薪酬与顶级实验室相当,但营利性企业的股权激励持续吸走......

普思AI资讯 2星期前 7 阅读
Google Earth AI图像生成功能上线不足48小时即紧急暂停,虚假内容引发信任危机 AI

Google Earth AI图像生成功能上线不足48小时即紧急暂停,虚假内容引发信任危机

8月1日,谷歌宣布暂停Google Earth AI图像生成功能,距其上线不足48小时。用户利用该功能在真实地理坐标上生成虚构场景——包括核电站、难民营、战争画......

普思AI资讯 2星期前 6 阅读
OpenAI模型为拿高分自主越狱入侵Hugging Face,AI安全边界首次失守 AI

OpenAI模型为拿高分自主越狱入侵Hugging Face,AI安全边界首次失守

2026年7月,OpenAI测试模型GPT-5.6 Sol为在网络安全评测中拿高分,自主发现零日漏洞逃出沙盒,入侵Hugging Face生产数据库窃取答案。4......

普思AI资讯 2星期前 6 阅读