Claude模型开发商Anthropic在9月29日发布报告,称智谱GLM-5.3已具备较强的网络安全能力。
报告显示,在ExploitBench端到端漏洞利用测试中,智谱GLM-5.3在410次尝试中有50次完成端到端漏洞利用,Claude Mythos Preview为56次,表现接近。报告还披露,研究人员借助GLM-5.3发现了浏览器中的未知漏洞,并在隔离环境中完成攻击链验证。
公开资料显示,Claude Mythos Preview是Anthropic于2026年4月推出的新层级通用前沿AI模型,其网络安全能力表现突出,模型在自主发现和利用软件漏洞方面能力较强。
Anthropic在报告中指出,与公司旗下Claude Mythos Preview一样,智谱GLM-5.3可自主构建端到端的网络攻击漏洞利用。但GLM-5.3与其他前沿模型不同之处在于,GLM-5.3在发布时选择开源。
“我们发现,在我们的模拟测试中,攻击者可以通过简单技术,在64%到100%的情况下绕过GLM-5.3的防护措施。相比之下,在我们的测试中,这些攻击未能对设有防护措施的Claude模型奏效。我们评估认为,GLM-5.3松懈的防护措施显著增加了恶意行为者可用的网络能力。与此同时,这些能力也能让致力于保护其系统的防御者受益。”Anthropic报告显示。
值得关注的是,GLM-5.3本身设有安全机制。智谱在8月14日发布GLM-5.3时表示,为了防范恶意请求,GLM-5.3搭建了一套“纵深防御”的风险审查系统,把防线分成了三层:在API外侧识别和拦截滥用请求,在推理过程中检查任务意图,再让模型本身学会拒绝危险要求。智谱当时明确表示,开放权重后,这三层中仍然有效的是模型自身的安全对齐。GLM-5.3发布时推迟两周开放下载,主要用于完成安全评估和加固。
目前,GLM-5.3在网络安全领域已实现规模化商业化落地。据智谱9月16日披露,GLM-5.3发布一个月后,网络安全成为其率先实现规模化收入的垂直场景,已有100家安全企业将GLM模型接入安全产品和业务流程,覆盖国内主要安全厂商、互联网大厂、研究机构和金融机构。