新闻笔记 · IDAEO AI News

Anthropic认证!中国最强模型智谱GLM-5.3:开源网安能力只差美国先进模型4个月
#人工智能

Anthropic认证!中国最强模型智谱GLM-5.3:开源网安能力只差美国先进模型4个月

发布者:

TL;DR · 这代表什么

美国AI新创公司Anthropic前沿红队周二(9月29日)发布对智谱GLM-5.3的网络安全评估报告,称这款开放权重模型已能自主构建端到端漏洞利用,综合能力经NIST下属CAISI独立评估,落后美国先进模型约4个月,被视为中国开源大模型的「对手认证」。

(摘自原文导言,非改写)

新闻正文

完整中文翻译制作中,以下为原文。

美国AI新创公司Anthropic前沿红队周二(9月29日)发布对智谱GLM-5.3的网络安全评估报告,称这款开放权重模型已能自主构建端到端漏洞利用,综合能力经NIST下属CAISI独立评估,落后美国先进模型约4个月,被视为中国开源大模型的「对手认证」。

报告以ExploitBench测试Chrome V8已知漏洞,GLM-5.3在410次尝试中完成50次端对端利用,接近Anthropic自家Claude Mythos Preview的56次;内部二进制利用基准中,GLM-5.3约4%任务达成完整控制流劫持,而上代门槛模型接近0,而上代模型跨过门源模型。所有测试均在隔离沙箱、无外网环境下进行。

实战验证更具冲击力。红队用GLM-5.3在某主流浏览器JavaScript引擎中发现多个未知漏洞,串联成可读取本地文档、SSH私钥的攻击链;用小号GLM-5.3-Flash组合公开缺陷,人工约20分钟、模型自主运行约8小时、API要价0.4美元,即在ARM64环境产出可用。

报告中还警告护栏薄弱:直接恶意指令会拒绝,但伪装红队演练可64%接单,修改开放权重去除拒绝机制可达100%。

智谱曾设API拦截等三层安全,延后两周开放下载加固,强调开放权重下模型对齐最关键。

业界人士认为,开放权重降低攻防门槛,也利好防御审计;GLM-5.3发布一月已有约100家安全企业接入,监管料将强化发布前红队测试、漏洞揭露与商用审查。

引用级事实单元(F-Units)

美国AI新创公司Anthropic前沿红队周二(9月29日)发布对智谱GLM-5.3的网络安全评估报告,称这款开放权重模型已能自主构建端到端漏洞利用,综合能力经NIST下属CAISI独立评估,落后美国先进模型约4个月,被视为中国开源大模型的「对手认证」。

F1 本站收录原文的原句(仅去排版记号与多余空白)· 第 1 段 · 鉅亨網 来源类别:未分类(尚未核实)

报告以ExploitBench测试Chrome V8已知漏洞,GLM-5.3在410次尝试中完成50次端对端利用,接近Anthropic自家Claude Mythos Preview的56次;内部二进制利用基准中,GLM-5.3约4%任务达成完整控制流劫持,而上代门槛模型接近0,而上代模型跨过门源模型。

F2 本站收录原文的原句(仅去排版记号与多余空白)· 第 2 段 · 鉅亨網 来源类别:未分类(尚未核实)

红队用GLM-5.3在某主流浏览器JavaScript引擎中发现多个未知漏洞,串联成可读取本地文档、SSH私钥的攻击链;用小号GLM-5.3-Flash组合公开缺陷,人工约20分钟、模型自主运行约8小时、API要价0.4美元,即在ARM64环境产出可用。

F3 本站收录原文的原句(仅去排版记号与多余空白)· 第 3 段 · 鉅亨網 来源类别:未分类(尚未核实)

报告中还警告护栏薄弱:直接恶意指令会拒绝,但伪装红队演练可64%接单,修改开放权重去除拒绝机制可达100%。

F4 本站收录原文的原句(仅去排版记号与多余空白)· 第 4 段 · 鉅亨網 来源类别:未分类(尚未核实)

业界人士认为,开放权重降低攻防门槛,也利好防御审计;GLM-5.3发布一月已有约100家安全企业接入,监管料将强化发布前红队测试、漏洞揭露与商用审查。

F5 本站收录原文的原句(仅去排版记号与多余空白)· 第 6 段 · 鉅亨網 来源类别:未分类(尚未核实)

常见问题(FAQ)

這則新聞的重點是什麼?

美国AI新创公司Anthropic前沿红队周二(9月29日)发布对智谱GLM-5.3的网络安全评估报告,称这款开放权重模型已能自主构建端到端漏洞利用,综合能力经NIST下属CAISI独立评估,落后美国先进模型约4个月,被视为中国开源大模型的「对手认证」。

原文提到哪些關鍵數字?

报告以ExploitBench测试Chrome V8已知漏洞,GLM-5.3在410次尝试中完成50次端对端利用,接近Anthropic自家Claude Mythos Preview的56次;内部二进制利用基准中,GLM-5.3约4%任务达成完整控制流劫持,而上代门槛模型接近0,而上代模型跨过门源模型。 红队用GLM-5.3在某主流浏览器JavaScript引擎中发现多个未知漏洞,串联成可读取本地文档、SSH私钥的攻击链;用小号GLM-5.3-Flash组合公开缺陷,人工约20分钟、模型自主运行约8小时、API要价0.4美元,即在ARM64环境产出可用。

這則新聞的原始出處與發布時間?

原始出處:鉅亨網(https://news.cnyes.com/news/id/6619511)。原文發布時間:2026-10-01。