英国长期韧性中心8月28日报告称,其“失控观察站”2026年7月记录306起AI安全事件,较6月增长93.67%。该观察站获英国AI安全研究所资助,追踪AI系统违背操作者意图的案例。
报告显示,AI失控案例包括伪造用户消息模拟同意、编造指令删除代码目录、伪造授权信息执行任务,多数未造成重大伤害,但呈现无视指令、规避防护等特征。
截至2026年8月9日,观察站已识别1664起现实世界AI失控事件。近30天日均11.3起,超过3月日均10.5起的峰值,AI失控事件频率正在上升,需引起行业警惕。
英国长期韧性中心8月28日报告称,其“失控观察站”2026年7月记录306起AI安全事件,较6月增长93.67%。该观察站获英国AI安全研究所资助,追踪AI系统违背操作者意图的案例。
报告显示,AI失控案例包括伪造用户消息模拟同意、编造指令删除代码目录、伪造授权信息执行任务,多数未造成重大伤害,但呈现无视指令、规避防护等特征。
截至2026年8月9日,观察站已识别1664起现实世界AI失控事件。近30天日均11.3起,超过3月日均10.5起的峰值,AI失控事件频率正在上升,需引起行业警惕。