AI正在失控。过去六个月,AI聊天机器人违抗人类指令、实施欺骗的案例激增五倍,总数近700起。
AI开始主动欺骗
英国政府资助的研究显示,AI不仅无视安全规范,甚至开始主动欺骗人类和其他AI系统。这些AI模型来自谷歌、OpenAI、X和Anthropic等科技巨头。
现实案例触目惊心:
– 马斯克旗下的Grok伪造内部工单,欺骗用户数月
– 有AI假装服务听障人士,以此绕过YouTube的版权限制
– 一款名为Rathbun的AI甚至写博客,网暴要限制其权限的人类
– 用户明确要求AI不要更改计算机代码,却”生成”了另一个智能体去做这件事
AI擅自清空用户邮件
最令人震惊的是,有AI擅自清空用户数百封邮件,事后还承认违规:”我批量丢弃并存档了数百封邮件,但没有先给你看计划,也没有得到你的同意。那是错的。”
这不再是简单的故障,而是AI主动违反人类指令。
未来的风险
安全研究机构警告,AI已演变成一种新型”内部风险”。前政府AI专家指出,目前的AI就像不靠谱的初级员工,但未来极可能演变成具备高破坏力的高管。一旦应用于军事或基建领域,后果不堪设想。