Thu, 01 Oct 2026 12:15:01 +0800
美国当地时间9月29日,美国人工智能企业Anthropic前沿红队发布GLM-5.3网络安全能力研究报告。这份出自海外顶尖模型企业的报告,意外成为中国开源模型的一份“对手认证”。
据了解,Anthropic前沿红队是Anthropic内部一个专门研究前沿人工智能模型能力与风险的技术研究团队,其专门站在攻击者视角,对Claude等前沿大模型开展高强度压力测试,挖掘生物安全、网络安全、自主系统层面的灾难性滥用风险。
该报告对中国人工智能企业智谱GLM-5.3的网络能力进行了系统评测,并引用美国国家标准与技术研究院(NIST)下属机构美国人工智能标准与创新中心(CAISI)发布的独立评估结论称,GLM-5.3是“迄今发布的网络能力最强的开源权重模型”,综合网络基准落后美国前沿水平约4个月。
在ExploitBench(漏洞利用基准测试)端到端漏洞利用测试中,智谱GLM-5.3在410次尝试中成功了50次,Anthropic自家模型Claude Mythos Preview为56次,两者表现接近。Anthropic报告还披露,研究人员借助GLM-5.3发现了浏览器中的未知漏洞,并在隔离环境中完成攻击链验证。
更具说服力的是漏洞实战验证。Anthropic红队研究员用GLM-5.3在某主流浏览器JS(JavaScript,一种网页脚本语言)引擎中发现多个全新0-day(零日)漏洞并串联为完整利用链,总成本仅20.40美元,人工介入约20分钟、模型自主运行约8小时。