【本文来自《OpenAI模型“越狱”攻击,救场的竟是中国AI工具》评论区,标题为小编添加】
转自贾明冬老贾B站:OpenAI,Hugging Face和GLM-5.2的新闻很多人应该看到了。抱脸用GLM-5.2写了个尸检报告。如果是精心设计的恶意攻击,那么当AI找到零日漏洞并开始攻击的那一刻起,抱脸就已经沦陷了。区别只是在损管完成前,抱脸会交出去多少信息。在最坏的情况下,如果是几个小时才完成损管,那么这么长时间泄漏出去的信息,怕不是足够抱脸破产几次了。AI攻防是一体的,会修Bug只是第一步,有能力发现自己系统的全部中高危漏洞并且修掉,才叫有防御能力,否则只能再被攻破后损管。再进一步,如果你的AI有能力发现对方的中高危漏洞,并利用这些漏洞组织进攻,那么你的AI就是当下的网攻版本答案。
那么在此次事件中,GLM-5.2扮演的角色就很明确了,其并非事先修起了坚不可摧的墙消灭零日漏洞(真干成了就像是2077的“黑墙”大战流窜AI)。GLM-5.2是作为一名法医,写尸检报告并且追凶。如果不是用了我们的开源模型,抱脸面对一场精心设计的恶意攻击,恐怕连写尸检报告的机会都没有。
值得注意的是Mythos Preview已经具备了批量消除中高危漏洞的能力。网攻能力就是反向利用这项能力,识别出对方的系统有什么漏洞可以批量利用,最终发动零日攻击。目前kimi k-3,Qwen3.8,GLM5.2都没有展现出,同时作为漏洞修复和网攻利器的能力。而Mythos Preview已经给美国关键金融基础设施用上了,并修复了绝大部分此前可供用作零日攻击的漏洞。美国人是否会利用Mythos或未来出现的类似物,对中国进行网攻?我觉得应该以最大的恶意揣摩如今的美国政府。
好消息是,通过OpenAI和抱脸的这一次攻防,我们发现,现阶段也许无法消除遭对方AI使用零日攻击的风险,但受害方可以利用低成本开源模型溯源攻击方向,即便GLM-5.2并不是最先进的开源模型。在现实世界中,受害方可以利用这些收集到的尸检证据,为线下物理打击或法律惩处蓄意攻击方创造条件。正可谓魔高一尺道高一丈吧,开源模型至少给小厂提供了抵抗AI大厂安全霸凌的空间,算是凿穿技术封建主义的一道缝隙吧。