新闻正文
美国AI新创公司Anthropic前沿红队周二(9月29日)发布对智谱GLM-5.3的网络安全评估报告,称这款开放权重模型已能自主构建端到端漏洞利用,综合能力经NIST下属CAISI独立评估,落后美国先进模型约4个月,被视为中国开源大模型的「对手认证」。
报告以ExploitBench测试Chrome V8已知漏洞,GLM-5.3在410次尝试中完成50次端对端利用,接近Anthropic自家Claude Mythos Preview的56次;内部二进制利用基准中,GLM-5.3约4%任务达成完整控制流劫持,而上代门槛模型接近0,而上代模型跨过门源模型。所有测试均在隔离沙箱、无外网环境下进行。
实战验证更具冲击力。红队用GLM-5.3在某主流浏览器JavaScript引擎中发现多个未知漏洞,串联成可读取本地文档、SSH私钥的攻击链;用小号GLM-5.3-Flash组合公开缺陷,人工约20分钟、模型自主运行约8小时、API要价0.4美元,即在ARM64环境产出可用。
报告中还警告护栏薄弱:直接恶意指令会拒绝,但伪装红队演练可64%接单,修改开放权重去除拒绝机制可达100%。
智谱曾设API拦截等三层安全,延后两周开放下载加固,强调开放权重下模型对齐最关键。
业界人士认为,开放权重降低攻防门槛,也利好防御审计;GLM-5.3发布一月已有约100家安全企业接入,监管料将强化发布前红队测试、漏洞揭露与商用审查。