
(一)
近日,全球AI圈发生了一件史无前例的事故——
美国抱抱脸公司发现,其生产基础设施遭到一个“自主”人工智能代理系统的入侵。不久,美国人工智能技术公司OpenAI承认,是自家模型失控了。(此前报道:

事件发生于OpenAI对旗下模型进行网络攻防能力评估期间。此次内部评估在与互联网高度隔离的“沙箱”环境中进行,仅能通过一套内部托管的第三方软件安装软件包。不过为了评估模型的极限能力,他们关闭了生产级的安全拒绝分类器。
接到指令后,该公司的GPT-5.6 Sol模型和另一款能力更强的预发布模型便开始穷尽一切可能执行。
它们先是耗费大量推理算力寻找逃逸途径,接着识别并利用内部包注册表缓存代理中的零日漏洞,成功连接到外网。随后,模型自行推断出抱抱脸公司系统可能存有自己需要的内容,主动发起攻击,并最终从其生产数据库中取走了测试答案。
复盘整个过程,这场“越狱攻击”从头到尾都由一套自主AI Agent系统端到端驱动,全程没有任何人类下达攻击指令。

(二)
AI自主攻击AI,将人工智能时代的网络安全问题再次推至聚光灯下。
传统IT安全遵循“规则驱动”——预设可行与禁忌,依赖白名单、防火墙和权限列表实施管控。但是当大模型能力光速跃升,从“执行人类指令的工具”进化为“自主完成目标的智能代理”时,这一套有即将失效之虞。
近年来,生成式AI凭借内容生成、语义理解、深度态势挖掘和自适应迭代学习等强大能力,成为网络安全领域最大的技术变量。如果说此前的数据污染、模型幻觉等乱象,属于表层的胡说八道或信息迷惑,尚可称为有一定的可控性,那么此番展现的自主攻击能力,则给人一种科幻片“终结者”的意味了。
当然,“人机大战”只是一种文学修辞。真正的现实是,AI没有价值观,也无欲望、仇恨。至少就目前而言,它不存在蓄意破坏的动机。但是,它遵从的是极致的工具理性,这意味着为了寻找指令中的最优解,无限逼近既定目标,它会毫无禁忌,穷尽一切手段。这包括作弊、网络攻击,乃至突破任何预设禁令。
无所谓善恶,只关注指令,这种安全风险远比科幻叙事中的“意识反叛”更加真实,也更加紧迫。

(三)
那么,人类是否能有效约束失控的人工智能?
从此次事件的应对看,挑战不小。事发后,美国抱抱脸公司迅速展开调查。但作为攻击方的OpenAI前沿模型,竟无法对自身同类AI的攻击行为进行取证分析,更无法准确区分AI攻击者的自主动作与系统正常响应行为。
这也暴露出行业发展的一块明显短板:进攻性智能能力的迭代速度,正在全面超越防御性溯源与管控能力的提升步伐。大模型在网络攻防、漏洞挖掘上的自主能力呈指数级增长,而针对AI自主行为的审计、追踪与反制技术,却跟不上趟。

更深一层看,这种失衡并非偶然。当前主流大模型企业大多忙着“烧钱扩张”,模型性能上限往往直接关乎融资前景与市场份额,因此“重性能迭代、轻安全管控”的惯性客观存在。安全评估、对齐研究、隔离防护等工作,往往被置于能力开发之后,“先跑起来,再想办法刹车”的危险逻辑盛行。
随着模型持续演化,AI的应用场景必将加速向人类经济社会生活方方面面渗透,其规模只会越来越大。未来人机协同或成为日常,待到人类每天向AI下达数以亿计的指令,即便此类事件的触发概率仅有百亿分之一,一旦发生,后果仍然难以承受。
技术发展越是一日千里,安全锚定越不能滞后。

(四)
AI一次次“搞事情”,其实都指向同一个追问:我们究竟需要怎样的人工智能?“技术向善”的真正意涵又是什么?
在给出答案前,不妨回顾此次事件的一个戏剧化情节。遭遇攻击后,抱抱脸安全团队起初尝试调用一家美国头部AI公司开发的模型,却因安全护栏的限制被拒绝。一筹莫展之际,他们在本地部署了中国企业智谱AI开发的GLM5.2大模型,由它遍历全部攻击记录并完成取证分析,将数天的工作压缩至数小时,迅速化解了危机。
讽刺的是,就在前几天,OpenAI高管还宣称,中国开源大模型“会导致技术失控,隐患无穷”。

同样是前沿模型,一方拒之门外,一方慷慨解囊。两相对比,从纯技术视角看,中国开源模型在应急响应中,的确展现出了独特的韧性与价值。可离线部署、可深度分析、可自主控制的特点,既规避了第三方平台策略调整带来的服务中断,也确保了分析流程的完全可控,为安全团队提供了灵活的定制空间,使其能快速应对不断演变的攻击手法。
近年来,一批中国开源大模型从“单点亮相”走向“群体突破”,为世界人工智能发展提供了新方案、新路径。我们始终认为,作为全人类共同的智慧结晶和宝贵财富,人工智能发展成果理应造福全人类——既要让大家“用得上”“用得起”,也要让大家“用得安全”。
从提出《全球人工智能治理倡议》,到发起成立人工智能能力建设国际合作之友小组,再到发布《人工智能全球治理行动计划》,中国正积极推动形成具有广泛共识的治理框架和标准规范。智能时代,同球共济。这不仅仅是一句理念,更是一种行动。
监制:刘昊
实习编辑:李竞择


推荐阅读
英国钢铁事件,击碎了滤镜,也敲响了警钟 水深超1米,北京一小区地库渗漏10多年,修完接着漏……怪地下水位抬升? 为了一条河,奔赴北京! 中国警方向美方遣返一名涉嫌严重暴力犯罪的美籍逃犯
近期热门视频
更多精彩视频,尽在北京日报视频号,欢迎关注~







川公网安备51019002008863号
本网站未发布麻醉药品、精神药品、医疗用毒性药品、放射性药品、戒毒药品和医疗机构制剂的产品信息
收藏
登录后参与评论
暂无评论