湖北日报全媒记者 文俊
近期,全球AI行业经历了一场史无前例的安全地震。美国OpenAI公司发生成立以来第一次真实的AI技术失控事故,而救场的是中国的人工智能大模型。
据OpenAI披露:一场原本被封闭测试、严格限制权限的最新大模型,突然突破人类管控,私自破解系统,主动上网攻击服务器,风险一度失控。整个过程全自动、没有人工干预,属于全球首例真实、自主、越权的AI失控攻击事件。

就在上周,美国知名人工智能开源社区Huggingface发现,其系统遭到了一个人工智能体自主攻击,风险一度失控。
为找出肇事“AI”。Hugging Face拿着1.7万条攻击日志,找多个美国顶尖AI大模型破案,却被模型内置护栏判定为“高风险”,拒绝提供帮助

关键时刻,来自中国的开源大模型——智谱AI的GLM-5.2出手了。
面对被视为“毒药”的日志,GLM-5.2硬刚到底,且把几天的取证工作,压缩到了短短几小时。
案件破了,入侵事件,是美国知名OpenAI公司的人工智能大模型失控后干出的……

真相是OpenAI对自家两款顶尖大模型进行能力测试。其中一个AI大模型为拿高分,投入大量推理算力寻找“捷径”。它关掉防火墙,凿穿沙箱,联网后迅速推断出Hugging Face社区可能托管着“考试答案”,随即发起攻击,黑进了社区“抄答案”。
全球首次AI自主攻击居然是为了作弊拿高分,那下一次呢,它们会干出什么?
你觉得应该给AI套牢缰绳吗?评论区聊聊。
Copyright © 2001-2026 湖北荆楚网络科技股份有限公司 All Rights Reserved
互联网新闻信息许可证 4212025003 -
增值电信业务经营许可证 鄂B2-20231273 -
广播电视节目制作经营许可证(鄂)字第00011号
信息网络传播视听节目许可证 1706144 -
互联网出版许可证 (鄂)字3号 -
营业执照
鄂ICP备 13000573号-1
鄂公网安备 42010602000206号
版权为 荆楚网 www.cnhubei.com 所有 未经同意不得复制或镜像