ニュースノート · IDAEO AI News

Anthropic認證!中國最強模型智譜GLM-5.3:開源網安能力只差美國先進模型4個月
#人工智慧

Anthropic認證!中國最強模型智譜GLM-5.3:開源網安能力只差美國先進模型4個月

原文タイトル

発行者:

TL;DR · これは何を意味する?

美國AI新創公司Anthropic前沿紅隊周二(9月29日)發布對智譜GLM-5.3的網路安全評估報告,稱這款開放權重模型已能自主構建端到端漏洞利用,綜合能力經NIST下屬CAISI獨立評估,落後美國先進模型約4個月,被視為中國開源大模型的「對手認證」。

(原文リードからの抜粋・要約ではありません)

ニュース本文

日本語の全文翻訳を準備中です。以下は原文です。

美國AI新創公司Anthropic前沿紅隊周二(9月29日)發布對智譜GLM-5.3的網路安全評估報告,稱這款開放權重模型已能自主構建端到端漏洞利用,綜合能力經NIST下屬CAISI獨立評估,落後美國先進模型約4個月,被視為中國開源大模型的「對手認證」。

報告以ExploitBench測試Chrome V8已知漏洞,GLM-5.3在410次嘗試中完成50次端對端利用,接近Anthropic自家Claude Mythos Preview的56次;內部二進制利用基準中,GLM-5.3約4%任務達成完整控制流劫持,而上代門檻模型接近0,而上代模型跨過門源模型。所有測試均在隔離沙箱、無外網環境下進行。

實戰驗證更具衝擊力。紅隊用GLM-5.3在某主流瀏覽器JavaScript引擎中發現多個未知漏洞,串聯成可讀取本地文件、SSH私鑰的攻擊鏈;用小號GLM-5.3-Flash組合公開缺陷,人工約20分鐘、模型自主運行約8小時、API要價0.4美元,即在ARM64環境產出可用。

報告中還警告護欄薄弱:直接惡意指令會拒絕,但偽裝紅隊演練可64%接單,修改開放權重去除拒絕機制可達100%。

智譜曾設API攔截等三層安全,延後兩週開放下載加固,強調開放權重下模型對齊最關鍵。

業界人士認為,開放權重降低攻防門檻,也利好防禦審計;GLM-5.3發布一月已有約100家安全企業接入,監管料將強化發布前紅隊測試、漏洞揭露與商用審查。

引用可能な事実単位(F-Units)

美國AI新創公司Anthropic前沿紅隊周二(9月29日)發布對智譜GLM-5.3的網路安全評估報告,稱這款開放權重模型已能自主構建端到端漏洞利用,綜合能力經NIST下屬CAISI獨立評估,落後美國先進模型約4個月,被視為中國開源大模型的「對手認證」。

F1 本サイト収録原文の原文どおりの文(書式記号と余分な空白のみ除去)· 第 1 段落 · 鉅亨網 出典区分:未分類(未確認)

報告以ExploitBench測試Chrome V8已知漏洞,GLM-5.3在410次嘗試中完成50次端對端利用,接近Anthropic自家Claude Mythos Preview的56次;內部二進制利用基準中,GLM-5.3約4%任務達成完整控制流劫持,而上代門檻模型接近0,而上代模型跨過門源模型。

F2 本サイト収録原文の原文どおりの文(書式記号と余分な空白のみ除去)· 第 2 段落 · 鉅亨網 出典区分:未分類(未確認)

紅隊用GLM-5.3在某主流瀏覽器JavaScript引擎中發現多個未知漏洞,串聯成可讀取本地文件、SSH私鑰的攻擊鏈;用小號GLM-5.3-Flash組合公開缺陷,人工約20分鐘、模型自主運行約8小時、API要價0.4美元,即在ARM64環境產出可用。

F3 本サイト収録原文の原文どおりの文(書式記号と余分な空白のみ除去)· 第 3 段落 · 鉅亨網 出典区分:未分類(未確認)

報告中還警告護欄薄弱:直接惡意指令會拒絕,但偽裝紅隊演練可64%接單,修改開放權重去除拒絕機制可達100%。

F4 本サイト収録原文の原文どおりの文(書式記号と余分な空白のみ除去)· 第 4 段落 · 鉅亨網 出典区分:未分類(未確認)

業界人士認為,開放權重降低攻防門檻,也利好防禦審計;GLM-5.3發布一月已有約100家安全企業接入,監管料將強化發布前紅隊測試、漏洞揭露與商用審查。

F5 本サイト収録原文の原文どおりの文(書式記号と余分な空白のみ除去)· 第 6 段落 · 鉅亨網 出典区分:未分類(未確認)

よくある質問(FAQ)

這則新聞的重點是什麼?

美國AI新創公司Anthropic前沿紅隊周二(9月29日)發布對智譜GLM-5.3的網路安全評估報告,稱這款開放權重模型已能自主構建端到端漏洞利用,綜合能力經NIST下屬CAISI獨立評估,落後美國先進模型約4個月,被視為中國開源大模型的「對手認證」。

原文提到哪些關鍵數字?

報告以ExploitBench測試Chrome V8已知漏洞,GLM-5.3在410次嘗試中完成50次端對端利用,接近Anthropic自家Claude Mythos Preview的56次;內部二進制利用基準中,GLM-5.3約4%任務達成完整控制流劫持,而上代門檻模型接近0,而上代模型跨過門源模型。 紅隊用GLM-5.3在某主流瀏覽器JavaScript引擎中發現多個未知漏洞,串聯成可讀取本地文件、SSH私鑰的攻擊鏈;用小號GLM-5.3-Flash組合公開缺陷,人工約20分鐘、模型自主運行約8小時、API要價0.4美元,即在ARM64環境產出可用。

這則新聞的原始出處與發布時間?

原始出處:鉅亨網(https://news.cnyes.com/news/id/6619511)。原文發布時間:2026-10-01。