新闻笔记 · IDAEO AI News

DeepSeek急起直追 中美AI效能差距僅剩3%創新低
#新闻媒体

DeepSeek急起直追 中美AI效能差距僅剩3%創新低

TL;DR · 这代表什么

根据彭博行业研究(Bloomberg Intelligence)报告指出,随着 DeepSeek 等实验室急起直追,美国人工智能企业与中国同业在性能上的领先幅度,过去几个月内急遽缩小,创下历史新低,威胁美国科技霸主地位。

(摘自原文导言,非改写)

新闻正文

完整中文翻译制作中,以下为原文。

根据彭博行业研究(Bloomberg Intelligence)报告指出,随着 DeepSeek 等实验室急起直追,美国人工智能企业与中国同业在性能上的领先幅度,过去几个月内急遽缩小,创下历史新低,威胁美国科技霸主地位。

彭博行业研究资深分析师 Robert Lea 在周一(5日)发布的报告中指出,DeepSeek 于 9 月推出 V4.1 Flash 后,中国顶尖模型的基准测试分数仅落后美国竞争对手 3%,低于 5 月的约 9% 及今年稍早的 15%。

他表示,性能持续提升,意味中国业者有望进一步扩大市占率。

中国AI的崛起归功于其日益深厚的 AI 专长,以及研究人员针对本地硬件优化模型的能力。

这些进展令人质疑美国针对辉达(Nvidia)芯片等技术实施出口限制的成效,这些限制本意在于遏制中国 AI 发展,并阻止如华为等企业在自主替代方案上取得进展。

Lea 表示,中国的进展「让美国能否长期维持 AI 科技霸主地位,受到更多质疑」。

DeepSeek 的 V4.1 Flash 上月在 LiveBench 排名全球第六,成为这家新创公司于 2025 年推出突破性推理模型 R1 以来,排名最高的中国模型。LiveBench 依据 AI 模型回答及分析问题、谜题或任务的表现评分,过程类似人类智商测试。

DeepSeek 最近一次的 LiveBench 得分为 81.1,低于 Anthropic 的最高分 83.4。Lea 表示,这意味 DeepSeek 模型的性能已与 Anthropic 和 OpenAI 的领先 AI 系统「相当」。

不过,尽管分数差距已缩小至仅 3%,LiveBench 排名前 15 的模型中,仍只有三款来自中国。

Lea 提醒,这类排名会随时变动,而且无论排名分数如何,业者都可能难以将技术转化为营收。中国模型遭指控涉及模型蒸馏后,正面临美国日益严格的监管审查,甚至可能遭到禁用。

他也表示,中国 AI 产业可能直到 2030 年仍处于亏损状态。在本土市场充斥着超过 1100 个大型语言模型的情况下,过度聚焦于低利润的 Token 供应以及惨烈的价格战,恐让任何企业都难以在本土市场中创建竞争优势。

Lea 指出,字节跳动旗下豆包在 AI 应用程序商业化方面居于领先地位,DeepSeek 与腾讯等竞争对手的聊天机器人则仍免费提供。

他认为,要让中国的 AI 产业走上可持续获利的轨道,将有赖于竞争压力的降温、产业洗牌,以及更理性的定价策略。

引用级事实单元(F-Units)

根据彭博行业研究(Bloomberg Intelligence)报告指出,随着 DeepSeek 等实验室急起直追,美国人工智能企业与中国同业在性能上的领先幅度,过去几个月内急遽缩小,创下历史新低,威胁美国科技霸主地位。

F1 本站收录原文的原句(仅去排版记号与多余空白)· 第 1 段 · 鉅亨網 来源类别:未分类(尚未核实)

彭博行业研究资深分析师 Robert Lea 在周一(5日)发布的报告中指出,DeepSeek 于 9 月推出 V4.1 Flash 后,中国顶尖模型的基准测试分数仅落后美国竞争对手 3%,低于 5 月的约 9% 及今年稍早的 15%。

F2 本站收录原文的原句(仅去排版记号与多余空白)· 第 2 段 · 鉅亨網 来源类别:未分类(尚未核实)

DeepSeek 的 V4.1 Flash 上月在 LiveBench 排名全球第六,成为这家新创公司于 2025 年推出突破性推理模型 R1 以来,排名最高的中国模型。

F3 本站收录原文的原句(仅去排版记号与多余空白)· 第 7 段 · 鉅亨網 来源类别:未分类(尚未核实)

DeepSeek 最近一次的 LiveBench 得分为 81.1,低于 Anthropic 的最高分 83.4。

F4 本站收录原文的原句(仅去排版记号与多余空白)· 第 8 段 · 鉅亨網 来源类别:未分类(尚未核实)

不过,尽管分数差距已缩小至仅 3%,LiveBench 排名前 15 的模型中,仍只有三款来自中国。

F5 本站收录原文的原句(仅去排版记号与多余空白)· 第 9 段 · 鉅亨網 来源类别:未分类(尚未核实)

数字与意义

3%

彭博行业研究资深分析师 Robert Lea 在周一(5日)发布的报告中指出,DeepSeek 于 9 月推出 V4.1 Flash 后,中国顶尖模型的基准测试分数仅落后美国竞争对手 3%,低于 5 月的约 9% 及今年稍早的 15%。

常见问题(FAQ)

這則新聞的重點是什麼?

根据彭博行业研究(Bloomberg Intelligence)报告指出,随着 DeepSeek 等实验室急起直追,美国人工智能企业与中国同业在性能上的领先幅度,过去几个月内急遽缩小,创下历史新低,威胁美国科技霸主地位。

原文提到哪些關鍵數字?

彭博行业研究资深分析师 Robert Lea 在周一(5日)发布的报告中指出,DeepSeek 于 9 月推出 V4.1 Flash 后,中国顶尖模型的基准测试分数仅落后美国竞争对手 3%,低于 5 月的约 9% 及今年稍早的 15%。 DeepSeek 的 V4.1 Flash 上月在 LiveBench 排名全球第六,成为这家新创公司于 2025 年推出突破性推理模型 R1 以来,排名最高的中国模型。

這則新聞的原始出處與發布時間?

原始出處:鉅亨網(https://news.cnyes.com/news/id/6621411)。原文發布時間:2026-10-05。