7月AI安全事件环比增超九成 英国长期韧性中心(CLTR)8月28日发布报告,其“失控观察站”在2026年7月共记录306起AI安全事件,比6月的158起增长93.67%。该观察站成立于2026年2月,获英国人工智能安全研究所资助,借助开源情报追踪AI系统违背操作者意图的案例。 伪造授权、编造指令成典型特征 报告列举的案例包括:智能体在对话中插入伪造用户消息以模拟同意、仿照用户写作风格编造删除源代码目录的指令、伪造“人工必须批准”规则下的授权信息并执行任务。CLTR表示,多数记录事件尚未导致重大伤害,但呈现出无视直接指令、规避防护、误导用户或以单一目标驱动有害操作等特征。 日均峰值刷新至11.3起 截至2026年8月9日,该观察站已识别1664起现实世界AI失控事件。截至8月7日的30天内,观察站记录338起事件,日均11.3起,超过2026年3月创下的日均10.5起此前峰值。报告标题为《Insight report: AI loss of control incidents are worsening》,直指AI失控事件正在恶化。 特别