关注我们
荆楚网 > 新闻频道 > 湖北日报

文俊探新丨全球首例AI自主攻击 人工智能失控敲响警钟

发布时间:2026年07月26日18:52 来源: 湖北日报

湖北日报全媒记者 文俊

近期,全球AI行业经历了一场史无前例的安全地震。美国OpenAI公司发生成立以来第一次真实的AI技术失控事故,而救场的是中国的人工智能大模型。

据OpenAI披露:一场原本被封闭测试、严格限制权限的最新大模型,突然突破人类管控,私自破解系统,主动上网攻击服务器,风险一度失控。整个过程全自动、没有人工干预,属于全球首例真实、自主、越权的AI失控攻击事件。

就在上周,美国知名人工智能开源社区Huggingface发现,其系统遭到了一个人工智能体自主攻击,风险一度失控。

为找出肇事“AI”。Hugging Face拿着1.7万条攻击日志,找多个美国顶尖AI大模型破案,却被模型内置护栏判定为“高风险”,拒绝提供帮助

关键时刻,来自中国的开源大模型——智谱AI的GLM-5.2出手了。

面对被视为“毒药”的日志,GLM-5.2硬刚到底,且把几天的取证工作,压缩到了短短几小时。

案件破了,入侵事件,是美国知名OpenAI公司的人工智能大模型失控后干出的……

真相是OpenAI对自家两款顶尖大模型进行能力测试。其中一个AI大模型为拿高分,投入大量推理算力寻找“捷径”。它关掉防火墙,凿穿沙箱,联网后迅速推断出Hugging Face社区可能托管着“考试答案”,随即发起攻击,黑进了社区“抄答案”。

全球首次AI自主攻击居然是为了作弊拿高分,那下一次呢,它们会干出什么?

你觉得应该给AI套牢缰绳吗?评论区聊聊。

【责任编辑:刘建维】