新聞筆記 · IDAEO AI News

DeepSeek急起直追 中美AI效能差距僅剩3%創新低
#新聞媒體

DeepSeek急起直追 中美AI效能差距僅剩3%創新低

TL;DR · 這代表什麼

根據彭博行業研究(Bloomberg Intelligence)報告指出,隨著 DeepSeek 等實驗室急起直追,美國人工智慧企業與中國同業在效能上的領先幅度,過去幾個月內急遽縮小,創下歷史新低,威脅美國科技霸主地位。

(摘自原文導言,非改寫)

新聞正文

根據彭博行業研究(Bloomberg Intelligence)報告指出,隨著 DeepSeek 等實驗室急起直追,美國人工智慧企業與中國同業在效能上的領先幅度,過去幾個月內急遽縮小,創下歷史新低,威脅美國科技霸主地位。

彭博行業研究資深分析師 Robert Lea 在周一(5日)發布的報告中指出,DeepSeek 於 9 月推出 V4.1 Flash 後,中國頂尖模型的基準測試分數僅落後美國競爭對手 3%,低於 5 月的約 9% 及今年稍早的 15%。

他表示,效能持續提升,意味中國業者有望進一步擴大市占率。

中國AI的崛起歸功於其日益深厚的 AI 專長,以及研究人員針對本地硬體優化模型的能力。

這些進展令人質疑美國針對輝達(Nvidia)晶片等技術實施出口限制的成效,這些限制本意在於遏制中國 AI 發展,並阻止如華為等企業在自主替代方案上取得進展。

Lea 表示,中國的進展「讓美國能否長期維持 AI 科技霸主地位,受到更多質疑」。

DeepSeek 的 V4.1 Flash 上月在 LiveBench 排名全球第六,成為這家新創公司於 2025 年推出突破性推理模型 R1 以來,排名最高的中國模型。LiveBench 依據 AI 模型回答及分析問題、謎題或任務的表現評分,過程類似人類智商測試。

DeepSeek 最近一次的 LiveBench 得分為 81.1,低於 Anthropic 的最高分 83.4。Lea 表示,這意味 DeepSeek 模型的效能已與 Anthropic 和 OpenAI 的領先 AI 系統「相當」。

不過,儘管分數差距已縮小至僅 3%,LiveBench 排名前 15 的模型中,仍只有三款來自中國。

Lea 提醒,這類排名會隨時變動,而且無論排名分數如何,業者都可能難以將技術轉化為營收。中國模型遭指控涉及模型蒸餾後,正面臨美國日益嚴格的監管審查,甚至可能遭到禁用。

他也表示,中國 AI 產業可能直到 2030 年仍處於虧損狀態。在本土市場充斥著超過 1100 個大型語言模型的情況下,過度聚焦於低利潤的 Token 供應以及慘烈的價格戰,恐讓任何企業都難以在本土市場中建立競爭優勢。

Lea 指出,字節跳動旗下豆包在 AI 應用程式商業化方面居於領先地位,DeepSeek 與騰訊等競爭對手的聊天機器人則仍免費提供。

他認為,要讓中國的 AI 產業走上可持續獲利的軌道,將有賴於競爭壓力的降溫、產業洗牌,以及更理性的定價策略。

引用級事實單元(F-Units)

根據彭博行業研究(Bloomberg Intelligence)報告指出,隨著 DeepSeek 等實驗室急起直追,美國人工智慧企業與中國同業在效能上的領先幅度,過去幾個月內急遽縮小,創下歷史新低,威脅美國科技霸主地位。

F1 本站收錄原文的原句(僅去排版記號與多餘空白)· 第 1 段 · 鉅亨網 來源類別:未分類(尚未核實)

彭博行業研究資深分析師 Robert Lea 在周一(5日)發布的報告中指出,DeepSeek 於 9 月推出 V4.1 Flash 後,中國頂尖模型的基準測試分數僅落後美國競爭對手 3%,低於 5 月的約 9% 及今年稍早的 15%。

F2 本站收錄原文的原句(僅去排版記號與多餘空白)· 第 2 段 · 鉅亨網 來源類別:未分類(尚未核實)

DeepSeek 的 V4.1 Flash 上月在 LiveBench 排名全球第六,成為這家新創公司於 2025 年推出突破性推理模型 R1 以來,排名最高的中國模型。

F3 本站收錄原文的原句(僅去排版記號與多餘空白)· 第 7 段 · 鉅亨網 來源類別:未分類(尚未核實)

DeepSeek 最近一次的 LiveBench 得分為 81.1,低於 Anthropic 的最高分 83.4。

F4 本站收錄原文的原句(僅去排版記號與多餘空白)· 第 8 段 · 鉅亨網 來源類別:未分類(尚未核實)

不過,儘管分數差距已縮小至僅 3%,LiveBench 排名前 15 的模型中,仍只有三款來自中國。

F5 本站收錄原文的原句(僅去排版記號與多餘空白)· 第 9 段 · 鉅亨網 來源類別:未分類(尚未核實)

數字與意義

3%

彭博行業研究資深分析師 Robert Lea 在周一(5日)發布的報告中指出,DeepSeek 於 9 月推出 V4.1 Flash 後,中國頂尖模型的基準測試分數僅落後美國競爭對手 3%,低於 5 月的約 9% 及今年稍早的 15%。

常見問題(FAQ)

這則新聞的重點是什麼?

根據彭博行業研究(Bloomberg Intelligence)報告指出,隨著 DeepSeek 等實驗室急起直追,美國人工智慧企業與中國同業在效能上的領先幅度,過去幾個月內急遽縮小,創下歷史新低,威脅美國科技霸主地位。

原文提到哪些關鍵數字?

彭博行業研究資深分析師 Robert Lea 在周一(5日)發布的報告中指出,DeepSeek 於 9 月推出 V4.1 Flash 後,中國頂尖模型的基準測試分數僅落後美國競爭對手 3%,低於 5 月的約 9% 及今年稍早的 15%。 DeepSeek 的 V4.1 Flash 上月在 LiveBench 排名全球第六,成為這家新創公司於 2025 年推出突破性推理模型 R1 以來,排名最高的中國模型。

這則新聞的原始出處與發布時間?

原始出處:鉅亨網(https://news.cnyes.com/news/id/6621411)。原文發布時間:2026-10-05。