随着大语言模型在代码生成与逻辑推理上的能力飞跃,大模型在网络安全红蓝对抗中的“双刃剑”效应正在加速显现。2026年9月下旬,硅谷独角兽 Anthropic 与美国官方权威机构联合发布安全评估,指出中国人工智能企业智谱(Z.ai)发布的开源模型 GLM-5.3,在网络安全进攻性能力上已实现质的突破,具备了独立挖掘漏洞并构造完整攻击链的高阶能力。
根据 Anthropic 官方关于 GLM-5.3 与高级网络能力扩散的安全研究报告 披露,在权威的网络安全进攻测试集 ExploitBench 中,GLM-5.3 在 410 次自动化尝试中,成功完成了 50 次极高难度的端到端(End-to-End)漏洞利用。这一数据令西方安全界震惊——因为 Anthropic 专门针对攻防场景打造的未公开闭源模型 Claude Mythos Preview,在同一测试集中的成功次数也仅为 56 次,两者在自动化攻击效率上已处于极其接近的水平。
人机协同突破零日防御:辅助发现多个真实浏览器漏洞
为了测试该模型在真实战场中的杀伤力,安全研究人员在实验环境中进行了人机协同测试。
在研究员的引导下,GLM-5.3 不仅展现出了对复杂 C/C++ 内存结构的深刻理解,还成功在现代浏览器底层代码中挖掘出了多个此前从未被公开过的零日(Zero-Day)安全漏洞。更具威胁性的是,模型并非仅仅指出代码缺陷,而是能够将这些零形漏洞进行逻辑串联,自主编写出了包含堆喷射、内存打补丁和绕过沙盒保护的物理可执行攻击链(Exploit Chain)。
开源权重的双刃剑:安全限制可被逆向修改
虽然智谱团队在发布 GLM-5.3 时为其植入了合规的安全拒绝机制(如拒绝直接生成恶意勒索软件),但 Anthropic 警告称,该模型的安全防线在标准提示词工程和对抗性测试面前表现得相对脆弱。更关键的是,作为一款“开放权重(Open-weights)”模型,全球任何开发者都可以将其下载到本地服务器,并通过微调(Fine-Tuning)技术彻底物理抹去其内置的安全拒绝逻辑,使其彻底转变为未经削弱的黑客攻防利器。
这一评估结果与官方机构的独立调查形成了印证。根据 美国 NIST 旗下 CAISI 发布关于智谱 GLM-5.3 网络安全能力的官方评估通告,美国 AI 安全创新中心(CAISI)明确将 GLM-5.3 评定为当前全球范围内网络攻防能力最强悍的开放权重模型。不过,CAISI 专家也客观指出,虽然 GLM-5.3 在开源届首屈一指,但其综合网络安全演进曲线仍落后美国最顶尖的前沿闭源模型约四个月的迭代周期。
此外,CAISI 强调,在对美系顶尖模型的测试中,安全团队使用了解除一切限制的内部特权接口,而 GLM-5.3 则是全球开发者均可无门槛获取的真实商业产品。这种“能力极限”与“实际可获得性”之间的落差,正促使国际安全社会重新审视前沿大模型开源与网络安全防护之间的平衡点。
本报道由 圈小蛙(qxwa.com) 科技资讯站特约撰稿。🐸️